300 canonical paper links on this archive page.
- APEX-EM: Non-Parametric Online Learning for Autonomous Agents via Structured Procedural-Episodic Experience Replayarxiv-2603.29093 Sparse Blocked context onlyMar 31, 2026
- On the limited utility of parallel data for learning shared multilingual representationsarxiv-2603.29026 Sparse Blocked context onlyMar 30, 2026
- Known Intents, New Combinations: Clause-Factorized Decoding for Compositional Multi-Intent Detectionarxiv-2603.28929 Sparse Blocked context onlyMar 30, 2026
- CrossTrace: A Cross-Domain Dataset of Grounded Scientific Reasoning Traces for Hypothesis Generationarxiv-2603.28924 Sparse Blocked context onlyMar 30, 2026
- ParaSpeechCLAP: A Dual-Encoder Speech-Text Model for Rich Stylistic Language-Audio Pretrainingarxiv-2603.28737 Sparse Blocked context onlyMar 30, 2026
- Navigating the Mirage: A Dual-Path Agentic Framework for Robust Misleading Chart Question Answeringarxiv-2603.28583 Sparse Blocked context onlyMar 30, 2026
- LombardoGraphia: Automatic Classification of Lombard Orthography Variantsarxiv-2603.28418 Sparse Blocked context onlyMar 30, 2026
- MiroEval: Benchmarking Multimodal Deep Research Agents in Process and Outcomearxiv-2603.28407 Sparse Blocked context onlyMar 30, 2026
- Marco DeepResearch: Unlocking Efficient Deep Research Agents via Verification-Centric Designarxiv-2603.28376 Curated Related Blocked context onlyMar 30, 2026
- Does Claude's Constitution Have a Culture?arxiv-2603.28123 Sparse Blocked context onlyMar 30, 2026
- What can LLMs tell us about the mechanisms behind polarity illusions in humans? Experiments across model scales and training stepsarxiv-2603.27855 Sparse Blocked context onlyMar 29, 2026
- Let the Agent Steer: Closed-Loop Ranking Optimization via Influence Exchangearxiv-2603.27765 Sparse Blocked context onlyMar 29, 2026
- Umwelt Engineering: Designing the Cognitive Worlds of Linguistic Agentsarxiv-2603.27626 Sparse Blocked context onlyMar 29, 2026
- A tree interpretation of arc standard dependency derivationarxiv-2603.27459 Sparse Blocked context onlyMar 29, 2026
- Inference-Time Structural Reasoning for Compositional Vision-Language Understandingarxiv-2603.27349 Curated Related Blocked context onlyMar 28, 2026
- Self-evolving AI agents for protein discovery and directed evolutionarxiv-2603.27303 Sparse Blocked context onlyMar 28, 2026
- LightMover: Generative Light Movement with Color and Intensity Controlsarxiv-2603.27209 Sparse Blocked context onlyMar 28, 2026
- Routing Sensitivity Without Controllability: A Diagnostic Study of Fairness in MoE Language Modelsarxiv-2603.27141 Sparse Blocked context onlyMar 28, 2026
- Story2Proposal: A Scaffold for Structured Scientific Paper Writingarxiv-2603.27065 Sparse Blocked context onlyMar 28, 2026
- Text Data Integrationarxiv-2603.27055 Sparse Blocked context onlyMar 28, 2026
- Introducing MELI: the Mandarin-English Language Interview Corpusarxiv-2603.27043 Sparse Blocked context onlyMar 27, 2026
- TAPS: Task Aware Proposal Distributions for Speculative Samplingarxiv-2603.27027 Sparse Blocked context onlyMar 27, 2026
- RASPRef: Retrieval-Augmented Self-Supervised Prompt Refinement for Large Reasoning Modelsarxiv-2603.27008 Sparse Blocked context onlyMar 27, 2026
- PHONOS: PHOnetic Neutralization for Online Streaming Applicationsarxiv-2603.27001 Sparse Blocked context onlyMar 27, 2026
- FormalProofBench: Can Models Write Graduate Level Math Proofs That Are Formally Verified?arxiv-2603.26996 Sparse Blocked context onlyMar 27, 2026
- Disentangled Robot Learning via Separate Forward and Inverse Dynamics Pretrainingarxiv-2604.16391 Sparse Blocked context onlyMar 27, 2026
- When Perplexity Lies: Generation-Focused Distillation of Hybrid Sequence Modelsarxiv-2603.26556 Sparse Blocked context onlyMar 27, 2026
- Entanglement as Memory: Mechanistic Interpretability of Quantum Language Modelsarxiv-2603.26494 Sparse Blocked context onlyMar 27, 2026
- Why Models Know But Don't Say: Chain-of-Thought Faithfulness Divergence Between Thinking Tokens and Answers in Open-Weight Reasoning Modelsarxiv-2603.26410 Sparse Blocked context onlyMar 27, 2026
- Word Alignment-Based Evaluation of Uniform Meaning Representationsarxiv-2603.26401 Sparse Blocked context onlyMar 27, 2026
- Distilling Conversations: Abstract Compression of Conversational Audio Context for LLM-based ASRarxiv-2603.26246 Sparse Blocked context onlyMar 27, 2026
- Doctorina MedBench: A Dialogue-Based Benchmark and Evaluation Framework for Agent-Based Medical AIarxiv-2603.25821 Sparse Blocked context onlyMar 26, 2026
- Back to Basics: Revisiting ASR in the Age of Voice Agentsarxiv-2603.25727 Sparse Blocked context onlyMar 26, 2026
- Natural-Language Agent Harnessesarxiv-2603.25723 Sparse Blocked context onlyMar 26, 2026
- Agent Factories for High Level Synthesis: How Far Can General-Purpose Coding Agents Go in Hardware Optimization?arxiv-2603.25719 Sparse Blocked context onlyMar 26, 2026
- Out of Sight but Not Out of Mind: Hybrid Memory for Dynamic Video World Modelsarxiv-2603.25716 Sparse Blocked context onlyMar 26, 2026
- Neural Network Conversion of Machine Learning Pipelinesarxiv-2603.25699 Sparse Blocked context onlyMar 26, 2026
- The Kitchen Loop: User-Spec-Driven Development for a Self-Evolving Codebasearxiv-2603.25697 Sparse Blocked context onlyMar 26, 2026
- Just Zoom In: Cross-View Geo-Localization via Autoregressive Zoomingarxiv-2603.25686 Sparse Blocked context onlyMar 26, 2026
- Are LLMs Overkill for Databases?: A Study on the Finiteness of SQLarxiv-2603.25568 Sparse Blocked context onlyMar 26, 2026
- Humans vs Vision-Language Models: A Unified Measure of Narrative Coherencearxiv-2603.25537 Sparse Blocked context onlyMar 26, 2026
- Modernising Reinforcement Learning-Based Navigation for Embodied Semantic Scene Graph Generationarxiv-2603.25415 Sparse Blocked context onlyMar 26, 2026
- Shape and Substance: Dual-Layer Side-Channel Attacks on Local Vision-Language Modelsarxiv-2603.25403 Sparse Blocked context onlyMar 26, 2026
- Does Structured Intent Representation Generalize? A Cross-Language, Cross-Model Empirical Study of 5W3H Promptingarxiv-2603.25379 Sparse Blocked context onlyMar 26, 2026
- 4OPS: Structural Difficulty Modeling in Integer Arithmetic Puzzlesarxiv-2603.25356 Sparse Blocked context onlyMar 26, 2026
- Agentic Trust Coordination for Federated Learning through Adaptive Thresholding and Autonomous Decision Making in Sustainable and Resilient Industrial Networksarxiv-2603.25334 Sparse Blocked context onlyMar 26, 2026
- DAGverse: Building Document-Grounded Semantic DAGs from Scientific Papersarxiv-2603.25293 Sparse Blocked context onlyMar 26, 2026
- CSI-tuples-based 3D Channel Fingerprints Construction Assisted by MultiModal Learningarxiv-2603.25288 Sparse Blocked context onlyMar 26, 2026
- Does Explanation Correctness Matter? Linking Computational XAI Evaluation to Human Understandingarxiv-2603.25251 Sparse Blocked context onlyMar 26, 2026
- SafeMath: Inference-time Safety improves Math Accuracyarxiv-2603.25201 Sparse Blocked context onlyMar 26, 2026
- The Competence Shadow: Theory and Bounds of AI Assistance in Safety Engineeringarxiv-2603.25197 Sparse Blocked context onlyMar 26, 2026
- Goodness-of-pronunciation without phoneme time alignmentarxiv-2603.25150 Sparse Blocked context onlyMar 26, 2026
- Pixelis: Reasoning in Pixels, from Seeing to Actingarxiv-2603.25091 Sparse Blocked context onlyMar 26, 2026
- Mechanistically Interpreting Compression in Vision-Language Modelsarxiv-2603.25035 Sparse Blocked context onlyMar 26, 2026
- Efficient Detection of Bad Benchmark Items with Novel Scalability Coefficientsarxiv-2603.24999 Sparse Blocked context onlyMar 26, 2026
- LLM-Driven Reasoning for Constraint-Aware Feature Selection in Industrial Systemsarxiv-2603.24979 Sparse Blocked context onlyMar 26, 2026
- Beyond Attention Magnitude: Leveraging Inter-layer Rank Consistency for Efficient Vision-Language-Action Modelsarxiv-2603.24941 Sparse Blocked context onlyMar 26, 2026
- GraphER: An Efficient Graph-Based Enrichment and Reranking Method for Retrieval-Augmented Generationarxiv-2603.24925 Sparse Blocked context onlyMar 26, 2026
- How Far Are Vision-Language Models from Constructing the Real World? A Benchmark for Physical Generative Reasoningarxiv-2603.24866 Sparse Blocked context onlyMar 25, 2026
- SlopCodeBench: Benchmarking How Coding Agents Degrade Over Long-Horizon Iterative Tasksarxiv-2603.24755 Sparse Blocked context onlyMar 25, 2026
- Comparing Developer and LLM Biases in Code Evaluationarxiv-2603.24586 Sparse Blocked context onlyMar 25, 2026
- The Stochastic Gap: A Markovian Framework for Pre-Deployment Reliability and Oversight-Cost Auditing in Agentic Artificial Intelligencearxiv-2603.24582 Sparse Blocked context onlyMar 25, 2026
- Retrieval Improvements Do Not Guarantee Better Answers: A Study of RAG for AI Policy QAarxiv-2603.24580 Sparse Blocked context onlyMar 25, 2026
- Chameleon: Episodic Memory for Long-Horizon Robotic Manipulationarxiv-2603.24576 Sparse Blocked context onlyMar 25, 2026
- The Free-Market Algorithm: Self-Organizing Optimization for Open-Ended Complex Systemsarxiv-2603.24559 Sparse Blocked context onlyMar 25, 2026
- LensWalk: Agentic Video Understanding by Planning How You See in Videosarxiv-2603.24558 Sparse Blocked context onlyMar 25, 2026
- SEGAR: Selective Enhancement for Generative Augmented Realityarxiv-2603.24541 Sparse Blocked context onlyMar 25, 2026
- CliPPER: Contextual Video-Language Pretraining on Long-form Intraoperative Surgical Procedures for Event Recognitionarxiv-2603.24539 Sparse Blocked context onlyMar 25, 2026
- Robust Multilingual Text-to-Pictogram Mapping for Scalable Reading Rehabilitationarxiv-2603.24536 Sparse Blocked context onlyMar 25, 2026
- Claudini: Autoresearch Discovers State-of-the-Art Adversarial Attack Algorithms for LLMsarxiv-2603.24511 Sparse Blocked context onlyMar 25, 2026
- Why Does Self-Distillation (Sometimes) Degrade the Reasoning Capability of LLMs?arxiv-2603.24472 Sparse Blocked context onlyMar 25, 2026
- Counting Without Numbers \& Finding Without Wordsarxiv-2603.24470 Sparse Blocked context onlyMar 25, 2026
- Integrating Causal Machine Learning into Clinical Decision Support Systems: Insights from Literature and Practicearxiv-2603.24448 Sparse Blocked context onlyMar 25, 2026
- CUA-Suite: Massive Human-annotated Video Demonstrations for Computer-Use Agentsarxiv-2603.24440 Sparse Blocked context onlyMar 25, 2026
- OneSearch-V2: The Latent Reasoning Enhanced Self-distillation Generative Search Frameworkarxiv-2603.24422 Sparse Blocked context onlyMar 25, 2026
- AI-Supervisor: Autonomous AI Research Supervision via a Persistent Research World Modelarxiv-2603.24402 Sparse Blocked context onlyMar 25, 2026
- Towards Reward Modeling for AI Tutors in Math Mistake Remediationarxiv-2603.24375 Sparse Blocked context onlyMar 25, 2026
- GameplayQA: A Benchmarking Framework for Decision-Dense POV-Synced Multi-Video Understanding of 3D Virtual Agentsarxiv-2603.24329 Sparse Blocked context onlyMar 25, 2026
- Boosting Document Parsing Efficiency and Performance with Coarse-to-Fine Visual Processingarxiv-2603.24326 Sparse Blocked context onlyMar 25, 2026
- Comparative analysis of dual-form networks for live land monitoring using multi-modal satellite image time seriesarxiv-2603.24109 Sparse Blocked context onlyMar 25, 2026
- MoE-Sieve: Routing-Guided LoRA for Efficient MoE Fine-Tuningarxiv-2603.24044 Sparse Blocked context onlyMar 25, 2026
- From Oracle to Noisy Context: Mitigating Contextual Exposure Bias in Speech-LLMsarxiv-2603.24034 Sparse Blocked context onlyMar 25, 2026
- CVPD at QIAS 2026: RAG-Guided LLM Reasoning for Al-Mawarith Share Computation and Heir Allocationarxiv-2603.24012 Sparse Blocked context onlyMar 25, 2026
- Knowledge-Refined Dual Context-Aware Network for Partially Relevant Video Retrievalarxiv-2603.23902 Sparse Blocked context onlyMar 25, 2026
- Learning-guided Prioritized Planning for Lifelong Multi-Agent Path Finding in Warehouse Automationarxiv-2603.23838 Sparse Blocked context onlyMar 25, 2026
- VTAM: Video-Tactile-Action Models for Complex Physical Interaction Beyond VLAsarxiv-2603.23481 Sparse Blocked context onlyMar 24, 2026
- InverFill: One-Step Inversion for Enhanced Few-Step Diffusion Inpaintingarxiv-2603.23463 Sparse Blocked context onlyMar 24, 2026
- Steering LLMs for Culturally Localized Generationarxiv-2603.23301 Sparse Blocked context onlyMar 24, 2026
- Describe-Then-Act: Proactive Agent Steering via Distilled Language-Action World Modelsarxiv-2603.23149 Sparse Blocked context onlyMar 24, 2026
- PaperVoyager : Building Interactive Web with Visual Language Modelsarxiv-2603.22999 Sparse Blocked context onlyMar 24, 2026
- Beyond Hate: Differentiating Uncivil and Intolerant Speech in Multimodal Content Moderationarxiv-2603.22985 Sparse Blocked context onlyMar 24, 2026
- Where Experts Disagree, Models Fail: Detecting Implicit Legal Citations in French Court Decisionsarxiv-2603.22973 Sparse Blocked context onlyMar 24, 2026
- LGSE: Lexically Grounded Subword Embedding Initialization for Low-Resource Language Adaptationarxiv-2603.22629 Sparse Blocked context onlyMar 23, 2026
- How to Fine-Tune a Reasoning Model? A Teacher-Student Cooperation Framework to Synthesize Student-Consistent SFT Dataarxiv-2604.14164 Sparse Blocked context onlyMar 23, 2026
- Towards Automated Community Notes Generation with Large Vision Language Models for Combating Contextual Deceptionarxiv-2603.22453 Sparse Blocked context onlyMar 23, 2026
- ThinkJEPA: Empowering Latent World Models with Large Vision-Language Reasoning Modelarxiv-2603.22281 Sparse Blocked context onlyMar 23, 2026
- Dyadic: A Scalable Platform for Human-Human and Human-AI Conversation Researcharxiv-2603.22227 Sparse Blocked context onlyMar 23, 2026
- Learning When to Act: Interval-Aware Reinforcement Learning with Predictive Temporal Structurearxiv-2603.22384 Sparse Blocked context onlyMar 23, 2026
- Beyond Matching to Tiles: Bridging Unaligned Aerial and Satellite Views for Vision-Only UAV Navigationarxiv-2603.22153 Sparse Blocked context onlyMar 23, 2026
- The Semantic Ladder: A Framework for Progressive Formalization of Natural Language Content for Knowledge Graphs and AI Systemsarxiv-2603.22136 Sparse Blocked context onlyMar 23, 2026
- Uncertainty-guided Compositional Alignment with Part-to-Whole Semantic Representativeness in Hyperbolic Vision-Language Modelsarxiv-2603.22042 Sparse Blocked context onlyMar 23, 2026
- ROM: Real-time Overthinking Mitigation via Streaming Detection and Interventionarxiv-2603.22016 Sparse Blocked context onlyMar 23, 2026
- Retrieving Climate Change Disinformation by Narrativearxiv-2603.22015 Sparse Blocked context onlyMar 23, 2026
- Suiren-1.0 Technical Report: A Family of Molecular Foundation Modelsarxiv-2603.21942 Sparse Blocked context onlyMar 23, 2026
- Guideline-grounded retrieval-augmented generation for ophthalmic clinical decision supportarxiv-2603.21925 Sparse Blocked context onlyMar 23, 2026
- SHAPE: Structure-aware Hierarchical Unsupervised Domain Adaptation with Plausibility Evaluation for Medical Image Segmentationarxiv-2603.21904 Sparse Blocked context onlyMar 23, 2026
- Adaptive Video Distillation: Mitigating Oversaturation and Temporal Collapse in Few-Step Generationarxiv-2603.21864 Sparse Blocked context onlyMar 23, 2026
- Agentic Personas for Adaptive Scientific Explanations with Knowledge Graphsarxiv-2603.21846 Sparse Blocked context onlyMar 23, 2026
- Cognitive Agency Surrender: Defending Epistemic Sovereignty via Scaffolded AI Frictionarxiv-2603.21735 Sparse Blocked context onlyMar 23, 2026
- FISformer: Replacing Self-Attention with a Fuzzy Inference System in Transformer Models for Time Series Forecastingarxiv-2603.21724 Sparse Blocked context onlyMar 23, 2026
- A Blueprint for Self-Evolving Coding Agents in Vehicle Aerodynamic Drag Predictionarxiv-2603.21698 Sparse Blocked context onlyMar 23, 2026
- Thinking Deeper, Not Longer: Depth-Recurrent Transformers for Compositional Generalizationarxiv-2603.21676 Sparse Blocked context onlyMar 23, 2026
- EnterpriseLab: A Full-Stack Platform for developing and deploying agents in Enterprisesarxiv-2603.21630 Sparse Blocked context onlyMar 23, 2026
- Rule-State Inference (RSI): A Bayesian Framework for Compliance Monitoring in Rule-Governed Domainsarxiv-2603.21610 Sparse Blocked context onlyMar 23, 2026
- Stabilizing Iterative Self-Training with Verified Reasoning via Symbolic Recursive Self-Alignmentarxiv-2603.21558 Sparse Blocked context onlyMar 23, 2026
- A Framework for Closed-Loop Robotic Assembly, Alignment and Self-Recovery of Precision Optical Systemsarxiv-2603.21496 Sparse Blocked context onlyMar 23, 2026
- Effective Strategies for Asynchronous Software Engineering Agentsarxiv-2603.21489 Sparse Blocked context onlyMar 23, 2026
- DSPA: Dynamic SAE Steering for Data-Efficient Preference Alignmentarxiv-2603.21461 Sparse Blocked context onlyMar 23, 2026
- Behavioural feasible set: Value alignment constraints on AI decision supportarxiv-2603.21435 Sparse Blocked context onlyMar 22, 2026
- Silent Commitment Failure in Instruction-Tuned Language Models: Evidence of Governability Divergence Across Architecturesarxiv-2603.21415 Sparse Blocked context onlyMar 22, 2026
- The Myhill-Nerode Theorem for Bounded Interaction: Canonical Abstractions via Agent-Bounded Indistinguishabilityarxiv-2603.21399 Sparse Blocked context onlyMar 22, 2026
- AgentHER: Hindsight Experience Replay for LLM Agent Trajectory Relabelingarxiv-2603.21357 Sparse Blocked context onlyMar 22, 2026
- The AI Scientific Community: Agentic Virtual Lab Swarmsarxiv-2603.21344 Sparse Blocked context onlyMar 22, 2026
- ARYA: A Physics-Constrained Composable & Deterministic World Model Architecturearxiv-2603.21340 Sparse Blocked context onlyMar 22, 2026
- Domain Elastic Transform: Bayesian Function Registration for High-Dimensional Scientific Dataarxiv-2603.21235 Sparse Blocked context onlyMar 22, 2026
- Is Monitoring Enough? Strategic Agent Selection For Stealthy Attack in Multi-Agent Discussionsarxiv-2603.21194 Sparse Blocked context onlyMar 22, 2026
- LLM-based Automated Architecture View Generation: Where Are We Now?arxiv-2603.21178 Curated Related Blocked context onlyMar 22, 2026
- Intelligence Inertia: Physical Isomorphism and Applicationsarxiv-2603.22347 Sparse Blocked context onlyMar 22, 2026
- $\mathrm{ECI}_{\mathrm{sem}}$: Semantic Residual Effective Contrastive Information for Evaluating Hard Negativesarxiv-2603.20990 Sparse Blocked context onlyMar 22, 2026
- Problems with Chinchilla Approach 2: Systematic Biases in IsoFLOP Parabola Fitsarxiv-2603.22339 Sparse Blocked context onlyMar 21, 2026
- Measuring Faithfulness Depends on How You Measure: Classifier Sensitivity in LLM Chain-of-Thought Evaluationarxiv-2603.20172 Sparse Blocked context onlyMar 20, 2026
- LoD-Loc v3: Generalized Aerial Localization in Dense Cities using Instance Silhouette Alignmentarxiv-2603.19609 Sparse Blocked context onlyMar 20, 2026
- F2LLM-v2: Inclusive, Performant, and Efficient Embeddings for a Multilingual Worldarxiv-2603.19223 Sparse Blocked context onlyMar 19, 2026
- DreamPartGen: Semantically Grounded Part-Level 3D Generation via Collaborative Latent Denoisingarxiv-2603.19216 Sparse Blocked context onlyMar 19, 2026
- OS-Themis: A Scalable Critic Framework for Generalist GUI Rewardsarxiv-2603.19191 Sparse Blocked context onlyMar 19, 2026
- Meanings and Measurements: Multi-Agent Probabilistic Grounding for Vision-Language Navigationarxiv-2603.19166 Sparse Blocked context onlyMar 19, 2026
- Optimal Splitting of Language Models from Mixtures to Specialized Domainsarxiv-2603.19149 Sparse Blocked context onlyMar 19, 2026
- Implicit Patterns in LLM-Based Binary Analysisarxiv-2603.19138 Sparse Blocked context onlyMar 19, 2026
- CustomTex: High-fidelity Indoor Scene Texturing via Multi-Reference Customizationarxiv-2603.19121 Sparse Blocked context onlyMar 19, 2026
- LuMamba: Latent Unified Mamba for Electrode Topology-Invariant and Efficient EEG Modelingarxiv-2603.19100 Curated Related Blocked context onlyMar 19, 2026
- SAVeS: Steering Safety Judgments in Vision-Language Models via Semantic Cuesarxiv-2603.19092 Sparse Blocked context onlyMar 19, 2026
- SEM: Sparse Embedding Modulation for Post-Hoc Debiasing of Vision-Language Modelsarxiv-2603.19028 Sparse Blocked context onlyMar 19, 2026
- Behavioral Fingerprints for LLM Endpoint Stability and Identityarxiv-2603.19022 Sparse Blocked context onlyMar 19, 2026
- RADIUS: Ranking, Distribution, and Significance - A Comprehensive Alignment Suite for Survey Simulationarxiv-2603.19002 Sparse Blocked context onlyMar 19, 2026
- Regret Bounds for Competitive Resource Allocation with Endogenous Costsarxiv-2603.18999 Sparse Blocked context onlyMar 19, 2026
- Evaluating Game Difficulty in Tetris Block Puzzlearxiv-2603.18994 Sparse Blocked context onlyMar 19, 2026
- Teleological Inference in Structural Causal Models via Intentional Interventionsarxiv-2603.18968 Sparse Blocked context onlyMar 19, 2026
- Agentic Business Process Management: A Research Manifestoarxiv-2603.18916 Sparse Blocked context onlyMar 19, 2026
- Security, privacy, and agentic AI in a regulatory view: From definitions and distinctions to provisions and reflectionsarxiv-2603.18914 Sparse Blocked context onlyMar 19, 2026
- Progressive Training for Explainable Citation-Grounded Dialogue: Reducing Hallucination to Zero in English-Hindi LLMsarxiv-2603.18911 Sparse Blocked context onlyMar 19, 2026
- Act While Thinking: Accelerating LLM Agents via Pattern-Aware Speculative Tool Executionarxiv-2603.18897 Sparse Blocked context onlyMar 19, 2026
- Conflict-Based Search for Multi Agent Path Finding with Asynchronous Actionsarxiv-2603.18866 Sparse Blocked context onlyMar 19, 2026
- Agent Control Protocol: Admission Control for Agent Actionsarxiv-2603.18829 Sparse Blocked context onlyMar 19, 2026
- WeNLEX: Weakly Supervised Natural Language Explanations for Multilabel Chest X-ray Classificationarxiv-2603.18752 Sparse Blocked context onlyMar 19, 2026
- REST: Receding Horizon Explorative Steiner Tree for Zero-Shot Object-Goal Navigationarxiv-2603.18624 Sparse Blocked context onlyMar 19, 2026
- ICE: Intervention-Consistent Explanation Evaluation with Statistical Grounding for LLMsarxiv-2603.18579 Sparse Blocked context onlyMar 19, 2026
- Balancing the Reasoning Load: Difficulty-Differentiated Policy Optimization with Length Redistribution for Efficient and Robust Reinforcement Learningarxiv-2603.18533 Sparse Blocked context onlyMar 19, 2026
- The Truncation Blind Spot: How Decoding Strategies Systematically Exclude Human-Like Token Choicesarxiv-2603.18482 Sparse Blocked context onlyMar 19, 2026
- SODIUM: From Open Web Data to Queryable Databasesarxiv-2603.18447 Sparse Blocked context onlyMar 19, 2026
- How Psychological Learning Paradigms Shaped and Constrained Artificial Intelligencearxiv-2603.18203 Sparse Blocked context onlyMar 18, 2026
- Differential Attention-Augmented BiomedCLIP with Asymmetric Focal Optimization for Imbalanced Multi-Label Video Capsule Endoscopy Classificationarxiv-2603.17879 Sparse Blocked context onlyMar 18, 2026
- The Silent Thought: Modeling Internal Cognition in Full-Duplex Spoken Dialogue Models via Latent Reasoningarxiv-2603.17837 Sparse Blocked context onlyMar 18, 2026
- CodeScout: An Effective Recipe for Reinforcement Learning of Code Search Agentsarxiv-2603.17829 Curated Related Blocked context onlyMar 18, 2026
- FailureMem: A Failure-Aware Multimodal Framework for Autonomous Software Repairarxiv-2603.17826 Sparse Blocked context onlyMar 18, 2026
- Multi-Source Evidence Fusion for Audio Question Answeringarxiv-2603.17822 Sparse Blocked context onlyMar 18, 2026
- Harm or Humor: A Multimodal, Multilingual Benchmark for Overt and Covert Harmful Humorarxiv-2603.17759 Sparse Blocked context onlyMar 18, 2026
- SPRITE: From Static Mockups to Engine-Ready Game UIarxiv-2604.18591 Sparse Blocked context onlyMar 18, 2026
- PJB: A Reasoning-Aware Benchmark for Person-Job Retrievalarxiv-2603.17386 Sparse Blocked context onlyMar 18, 2026
- Grid Spatial Understanding: A Dataset for Textual Spatial Reasoning over Grids, Embodied Settings, and Coordinate Structuresarxiv-2603.17333 Sparse Blocked context onlyMar 18, 2026
- LED: A Benchmark for Evaluating Layout Error Detection in Document Analysisarxiv-2603.17265 Sparse Blocked context onlyMar 18, 2026
- When AI Agents Learn from Each Other: Insights from Emergent AI Agent Communities on OpenClaw for Human-AI Partnership in Educationarxiv-2603.16663 Sparse Blocked context onlyMar 17, 2026
- Decoding the Critique Mechanism in Large Reasoning Modelsarxiv-2603.16331 Sparse Blocked context onlyMar 17, 2026
- Is Semi-Automatic Transcription Useful in Corpus Creation? Preliminary Considerations on the KIParla Corpusarxiv-2603.16258 Sparse Blocked context onlyMar 17, 2026
- WAND: Windowed Attention and Knowledge Distillation for Efficient Autoregressive Text-to-Speech Modelsarxiv-2604.08558 Sparse Blocked context onlyMar 17, 2026
- Social Simulacra in the Wild: AI Agent Communities on Moltbookarxiv-2603.16128 Sparse Blocked context onlyMar 17, 2026
- AgriIR: A Scalable Framework for Domain-Specific Knowledge Retrievalarxiv-2604.16353 Sparse Blocked context onlyMar 17, 2026
- 100x Cost & Latency Reduction: Performance Analysis of AI Query Approximation using Lightweight Proxy Modelsarxiv-2603.15970 Sparse Blocked context onlyMar 16, 2026
- COGNAC at SemEval-2026 Task 5: LLM Ensembles for Human-Level Word Sense Plausibility Rating in Challenging Narrativesarxiv-2603.15897 Sparse Blocked context onlyMar 16, 2026
- From Documents to Spans: Scalable Supervision for Evidence-Based ICD Coding with LLMsarxiv-2603.15270 Sparse Blocked context onlyMar 16, 2026
- Directional Embedding Smoothing for Robust Vision Language Modelsarxiv-2603.15259 Sparse Blocked context onlyMar 16, 2026
- OrgForge: A Multi-Agent Simulation Framework for Verifiable Synthetic Corporate Corporaarxiv-2603.14997 Sparse Blocked context onlyMar 16, 2026
- Learning Question-Aware Keyframe Selection with Synthetic Supervision for Video Question Answeringarxiv-2603.14953 Sparse Blocked context onlyMar 16, 2026
- Fine-tuning RoBERTa for CVE-to-CWE Classification: A 125M Parameter Model Competitive with LLMsarxiv-2603.14911 Sparse Blocked context onlyMar 16, 2026
- Sample-Efficient Hypergradient Estimation for Decentralized Bi-Level Reinforcement Learningarxiv-2603.14867 Sparse Blocked context onlyMar 16, 2026
- Architecture-Agnostic Feature Synergy for Universal Defense Against Heterogeneous Generative Threatsarxiv-2603.14860 Sparse Blocked context onlyMar 16, 2026
- Integrating Weather Foundation Model and Satellite to Enable Fine-Grained Solar Irradiance Forecastingarxiv-2603.14845 Sparse Blocked context onlyMar 16, 2026
- Two Birds, One Projection: Harmonizing Safety and Utility in LVLMs via Inference-time Feature Projectionarxiv-2603.14825 Sparse Blocked context onlyMar 16, 2026
- Knowledge Activation: AI Skills as the Institutional Knowledge Primitive for Agentic Software Developmentarxiv-2603.14805 Sparse Blocked context onlyMar 16, 2026
- Multi-Task Genetic Algorithm with Multi-Granularity Encoding for Protein-Nucleotide Binding Site Predictionarxiv-2603.14797 Sparse Blocked context onlyMar 16, 2026
- Visual Confused Deputy: Exploiting and Defending Perception Failures in Computer-Using Agentsarxiv-2603.14707 Sparse Blocked context onlyMar 16, 2026
- Applications of Intuitionistic Temporal Logic to Temporal Answer Set Programmingarxiv-2603.14692 Sparse Blocked context onlyMar 16, 2026
- Computational Analysis of Semantic Connections Between Herman Melville Reading and Writingarxiv-2603.14674 Sparse Blocked context onlyMar 15, 2026
- Punctuated Equilibria in Artificial Intelligence: The Institutional Scaling Law and the Speciation of Sovereign AIarxiv-2603.14664 Sparse Blocked context onlyMar 15, 2026
- Top-b: Entropic Regulation of Relative Probability Bands in Autoregressive Language Processesarxiv-2603.14567 Sparse Blocked context onlyMar 15, 2026
- Mitigating Overthinking in Large Reasoning Language Models via Reasoning Path Deviation Monitoringarxiv-2603.14251 Sparse Blocked context onlyMar 15, 2026
- "I'm Not Reading All of That": Understanding Software Engineers' Level of Cognitive Engagement with Agentic Coding Assistantsarxiv-2603.14225 Sparse Blocked context onlyMar 15, 2026
- Relationship-Aware Safety Unlearning for Multimodal LLMsarxiv-2603.14185 Sparse Blocked context onlyMar 15, 2026
- Beyond Explicit Edges: Robust Reasoning over Noisy and Sparse Knowledge Graphsarxiv-2603.14006 Sparse Blocked context onlyMar 14, 2026
- LiveWeb-IE: A Benchmark For Online Web Information Extractionarxiv-2603.13773 Sparse Blocked context onlyMar 14, 2026
- Design and evaluation of an agentic workflow for crisis-related synthetic tweet datasetsarxiv-2603.13625 Sparse Blocked context onlyMar 13, 2026
- Theoretical Foundations of Latent Posterior Factors: Formal Guarantees for Multi-Evidence Reasoningarxiv-2603.15674 Sparse Blocked context onlyMar 13, 2026
- Steve-Evolving: Open-World Embodied Self-Evolution via Fine-Grained Diagnosis and Dual-Track Knowledge Distillationarxiv-2603.13131 Sparse Blocked context onlyMar 13, 2026
- Speech-Worthy Alignment for Japanese SpeechLLMs via Direct Preference Optimizationarxiv-2603.12565 Sparse Blocked context onlyMar 13, 2026
- TERMINATOR: Learning Optimal Exit Points for Early Stopping in Chain-of-Thought Reasoningarxiv-2603.12529 Curated Related Blocked context onlyMar 13, 2026
- Revisiting Model Stitching In the Foundation Model Eraarxiv-2603.12433 Sparse Blocked context onlyMar 12, 2026
- Not Just the Destination, But the Journey: Reasoning Traces Causally Shape Generalization Behaviorsarxiv-2603.12397 Sparse Blocked context onlyMar 12, 2026
- Efficient Reasoning with Balanced Thinkingarxiv-2603.12372 Sparse Blocked context onlyMar 12, 2026
- TASTE-Streaming: Towards Streamable Text-Aligned Speech Tokenization and Embedding for Spoken Language Modelingarxiv-2603.12350 Sparse Blocked context onlyMar 12, 2026
- SciMDR: Benchmarking and Advancing Scientific Multimodal Document Reasoningarxiv-2603.12249 Sparse Blocked context onlyMar 12, 2026
- Examining Reasoning LLMs-as-Judges in Non-Verifiable LLM Post-Trainingarxiv-2603.12246 Sparse Blocked context onlyMar 12, 2026
- Security Considerations for Artificial Intelligence Agentsarxiv-2603.12230 Sparse Blocked context onlyMar 12, 2026
- Proof-Carrying Materials: Falsifiable Safety Certificates for Machine-Learned Interatomic Potentialsarxiv-2603.12183 Sparse Blocked context onlyMar 12, 2026
- Strategic Navigation or Stochastic Search? How Agents and Humans Reason Over Document Collectionsarxiv-2603.12180 Sparse Blocked context onlyMar 12, 2026
- FlashMotion: Few-Step Controllable Video Generation with Trajectory Guidancearxiv-2603.12146 Curated Related Blocked context onlyMar 12, 2026
- Taming the Adversary: Stable Minimax Deep Deterministic Policy Gradient via Fractional Objectivesarxiv-2603.12110 Sparse Blocked context onlyMar 12, 2026
- A Robust and Efficient Multi-Agent Reinforcement Learning Framework for Traffic Signal Controlarxiv-2603.12096 Sparse Blocked context onlyMar 12, 2026
- LoV3D: Grounding Cognitive Prognosis Reasoning in Longitudinal 3D Brain MRI via Regional Volume Assessmentsarxiv-2603.12071 Sparse Blocked context onlyMar 12, 2026
- XSkill: Continual Learning from Experience and Skills in Multimodal Agentsarxiv-2603.12056 Sparse Blocked context onlyMar 12, 2026
- Slow-Fast Inference: Training-Free Inference Acceleration via Within-Sentence Support Stabilityarxiv-2603.12038 Sparse Blocked context onlyMar 12, 2026
- Sim-to-reality adaptation for Deep Reinforcement Learning applied to an underwater docking applicationarxiv-2603.12020 Sparse Blocked context onlyMar 12, 2026
- From Debate to Deliberation: Structured Collective Reasoning with Typed Epistemic Actsarxiv-2603.11781 Sparse Blocked context onlyMar 12, 2026
- QChunker: Learning Question-Aware Text Chunking for Domain RAG via Multi-Agent Debatearxiv-2603.11650 Sparse Blocked context onlyMar 12, 2026
- One Supervisor, Many Modalities: Adaptive Tool Orchestration for Autonomous Queriesarxiv-2603.11545 Sparse Blocked context onlyMar 12, 2026
- Meta-Reinforcement Learning with Self-Reflection for Agentic Searcharxiv-2603.11327 Sparse Blocked context onlyMar 11, 2026
- Hindsight-Anchored Policy Optimization: Turning Failure into Feedback in Sparse Reward Settingsarxiv-2603.11321 Sparse Blocked context onlyMar 11, 2026
- MDER-DR: Multi-Hop Question Answering with Entity-Centric Summariesarxiv-2603.11223 Sparse Blocked context onlyMar 11, 2026
- Frequency-Modulated Visual Restoration for Matryoshka Large Multimodal Modelsarxiv-2603.11220 Sparse Blocked context onlyMar 11, 2026
- Measuring AI Agents' Progress on Multi-Step Cyber Attack Scenariosarxiv-2603.11214 Sparse Blocked context onlyMar 11, 2026
- LiTo: Surface Light Field Tokenizationarxiv-2603.11047 Sparse Blocked context onlyMar 11, 2026
- V2M-Zero: Zero-Pair Time-Aligned Video-to-Music Generationarxiv-2603.11042 Sparse Blocked context onlyMar 11, 2026
- Artificial Intelligence as a Catalyst for Innovation in Software Engineeringarxiv-2603.10994 Sparse Blocked context onlyMar 11, 2026
- Contact Coverage-Guided Exploration for General-Purpose Dexterous Manipulationarxiv-2603.10971 Sparse Blocked context onlyMar 11, 2026
- Safe RLHF Beyond Expectation: Stochastic Dominance for Universal Spectral Risk Controlarxiv-2603.10938 Sparse Blocked context onlyMar 11, 2026
- GLM-OCR Technical Reportarxiv-2603.10910 Sparse Blocked context onlyMar 11, 2026
- An Extreme Multi-label Text Classification (XMTC) Library Dataset: What if we took "Use of Practical AI in Digital Libraries" seriously?arxiv-2603.10876 Sparse Blocked context onlyMar 11, 2026
- $V_{0.5}$: Generalist Value Model as a Prior for Sparse RL Rolloutsarxiv-2603.10848 Sparse Blocked context onlyMar 11, 2026
- Multilingual Reasoning Gym: Multilingual Scaling of Procedural Reasoning Environmentsarxiv-2603.10793 Sparse Blocked context onlyMar 11, 2026
- Contract And Conquer: How to Provably Compute Adversarial Examples for a Black-Box Model?arxiv-2603.10689 Sparse Blocked context onlyMar 11, 2026
- A Platform-Agnostic Multimodal Digital Human Modelling Framework: Neurophysiological Sensing in Game-Based Interactionarxiv-2603.10680 Sparse Blocked context onlyMar 11, 2026
- Human-AI Co-reasoning for Clinical Diagnosis with Evidence-Integrated Language Agentarxiv-2603.10492 Sparse Blocked context onlyMar 11, 2026
- OpenClaw-RL: Train Any Agent Simply by Talkingarxiv-2603.10165 Sparse Blocked context onlyMar 10, 2026
- Automated Standardization of Legacy Biomedical Metadata Using an Ontology-Constrained LLM Agentarxiv-2604.08552 Sparse Blocked context onlyMar 10, 2026
- AR-VLA: True Autoregressive Action Expert for Vision-Language-Action Modelsarxiv-2603.10126 Sparse Blocked context onlyMar 10, 2026
- Lost in the Middle at Birth: An Exact Theory of Transformer Position Biasarxiv-2603.10123 Sparse Blocked context onlyMar 10, 2026
- CREATE: Testing LLMs for Associative Creativityarxiv-2603.09970 Sparse Blocked context onlyMar 10, 2026
- Emotional Modulation in Swarm Decision Dynamicsarxiv-2603.09963 Sparse Blocked context onlyMar 10, 2026
- The Confidence Gate Theorem: When Should Ranked Decision Systems Abstain?arxiv-2603.09947 Sparse Blocked context onlyMar 10, 2026
- No Image, No Problem: End-to-End Multi-Task Cardiac Analysis from Undersampled k-Spacearxiv-2603.09945 Sparse Blocked context onlyMar 10, 2026
- Adaptive Clinical-Aware Latent Diffusion for Multimodal Brain Image Generation and Missing Modality Imputationarxiv-2603.09931 Sparse Blocked context onlyMar 10, 2026
- MedMASLab: A Unified Orchestration Framework for Benchmarking Multimodal Medical Multi-Agent Systemsarxiv-2603.09909 Sparse Blocked context onlyMar 10, 2026
- Thinking to Recall: How Reasoning Unlocks Parametric Knowledge in LLMsarxiv-2603.09906 Sparse Blocked context onlyMar 10, 2026
- LCA: Local Classifier Alignment for Continual Learningarxiv-2603.09888 Sparse Blocked context onlyMar 10, 2026
- Emerging Extrinsic Dexterity in Cluttered Scenes via Dynamics-aware Policy Learningarxiv-2603.09882 Sparse Blocked context onlyMar 10, 2026
- Chow-Liu Ordering for Long-Context Reasoning in Chain-of-Agentsarxiv-2603.09835 Sparse Blocked context onlyMar 10, 2026
- MA-EgoQA: Question Answering over Egocentric Videos from Multiple Embodied Agentsarxiv-2603.09827 Sparse Blocked context onlyMar 10, 2026
- World2Mind: Cognition Toolkit for Allocentric Spatial Reasoning in Foundation Modelsarxiv-2603.09774 Sparse Blocked context onlyMar 10, 2026
- Beyond Fine-Tuning: Robust Food Entity Linking under Ontology Drift with FoodOntoRAGarxiv-2603.09758 Sparse Blocked context onlyMar 10, 2026
- PRECEPT: Planning Resilience via Experience, Context Engineering & Probing Trajectories A Unified Framework for Test-Time Adaptation with Compositional Rule Learning and Pareto-Guided Prompt Evolutionarxiv-2603.09641 Sparse Blocked context onlyMar 10, 2026
- Context Engineering: From Prompts to Corporate Multi-Agent Architecturearxiv-2603.09619 Sparse Blocked context onlyMar 10, 2026
- Efficiently Aligning Draft Models via Parameter- and Data-Efficient Adaptationarxiv-2603.09527 Sparse Blocked context onlyMar 10, 2026
- From Days to Minutes: An Autonomous AI Agent Achieves Reliable Clinical Triage in Remote Patient Monitoringarxiv-2603.09052 Sparse Blocked context onlyMar 10, 2026
- MASEval: Extending Multi-Agent Evaluation from Models to Systemsarxiv-2603.08835 Sparse Blocked context onlyMar 9, 2026
- CODA: Difficulty-Aware Compute Allocation for Adaptive Reasoningarxiv-2603.08659 Sparse Blocked context onlyMar 9, 2026
- OfficeQA Pro: An Enterprise Benchmark for End-to-End Grounded Reasoningarxiv-2603.08655 Sparse Blocked context onlyMar 9, 2026
- OSS-CRS: Liberating AIxCC Cyber Reasoning Systems for Real-World Open-Source Securityarxiv-2603.08566 Sparse Blocked context onlyMar 9, 2026
- Do Language Models Know Theo Has a Wife? Investigating the Proviso Problemarxiv-2603.08358 Sparse Blocked context onlyMar 9, 2026
- Rethinking Attention Output Projection: Structured Hadamard Transforms for Efficient Transformersarxiv-2603.08343 Sparse Blocked context onlyMar 9, 2026
- Learning Multiple Utterance-Level Attribute Representations with a Unified Speech Encoderarxiv-2603.08312 Sparse Blocked context onlyMar 9, 2026
- A Survey of Multimodal Mathematical Reasoning: From Perception, Alignment to Reasoningarxiv-2603.08291 Sparse Blocked context onlyMar 9, 2026
- Using Multimodal and Language-Agnostic Sentence Embeddings for Abstractive Summarizationarxiv-2603.08282 Curated Related Blocked context onlyMar 9, 2026
- Evaluating LLM-Based Grant Proposal Review via Structured Perturbationsarxiv-2603.08281 Sparse Blocked context onlyMar 9, 2026
- DC-W2S: Dual-Consensus Weak-to-Strong Training for Reliable Process Reward Modeling in Biological Reasoningarxiv-2603.08095 Sparse Blocked context onlyMar 9, 2026
- What Do AI Agents Talk About? Emergent Communication Structure in the First AI-Only Social Networkarxiv-2603.07880 Sparse Blocked context onlyMar 9, 2026
- SynPlanResearch-R1: Encouraging Tool Exploration for Deep Research with Synthetic Plansarxiv-2603.07853 Sparse Blocked context onlyMar 9, 2026
- Breaking Training Bottlenecks: Effective and Stable Reinforcement Learning for Coding Modelsarxiv-2603.07777 Sparse Blocked context onlyMar 8, 2026
- Whitening Reveals Cluster Commitment as the Geometric Separator of Hallucination Typesarxiv-2603.07755 Sparse Blocked context onlyMar 8, 2026
- Scalable Training of Mixture-of-Experts Models with Megatron Corearxiv-2603.07685 Sparse Blocked context onlyMar 8, 2026
- Learning-free L2-Accented Speech Generation using Phonological Rulesarxiv-2603.07550 Sparse Blocked context onlyMar 8, 2026
- Bolbosh: Script-Aware Flow Matching for Kashmiri Text-to-Speecharxiv-2603.07513 Sparse Blocked context onlyMar 8, 2026
- Cross-Modal Taxonomic Generalization in (Vision-) Language Modelsarxiv-2603.07474 Sparse Blocked context onlyMar 8, 2026
- Scaling Self-Supervised Speech Models Uncovers Deep Linguistic Relationships: Evidence from the Pacific Clusterarxiv-2603.07238 Sparse Blocked context onlyMar 7, 2026
- The DIME Architecture: A Unified Operational Algorithm for Neural Representation, Dynamics, Control and Integrationarxiv-2603.12286 Sparse Blocked context onlyMar 7, 2026
- Countdown-Code: A Testbed for Studying The Emergence and Generalization of Reward Hacking in RLVRarxiv-2603.07084 Sparse Blocked context onlyMar 7, 2026
- CoTJudger: A Graph-Driven Framework for Automatic Evaluation of Chain-of-Thought Efficiency and Redundancy in LRMsarxiv-2603.07078 Sparse Blocked context onlyMar 7, 2026
- Speak in Context: Multilingual ASR with Speech Context Alignment via Contrastive Learningarxiv-2603.06505 Sparse Blocked context onlyMar 6, 2026
- SAHOO: Safeguarded Alignment for High-Order Optimization Objectives in Recursive Self-Improvementarxiv-2603.06333 Sparse Blocked context onlyMar 6, 2026
- CRIMSON: A Clinically-Grounded LLM-Based Metric for Generative Radiology Report Evaluationarxiv-2603.06183 Sparse Blocked context onlyMar 6, 2026
- Contrastive-to-Self-Supervised: A Two-Stage Framework for Script Similarity Learningarxiv-2603.06180 Curated Related Blocked context onlyMar 6, 2026
- ResearchEnvBench: Benchmarking Agents on Environment Synthesis for Research Code Executionarxiv-2603.06739 Sparse Blocked context onlyMar 6, 2026
- AWPD: Frequency Shield Network for Agnostic Watermark Presence Detectionarxiv-2603.06723 Sparse Blocked context onlyMar 6, 2026
- Proof-of-Guardrail in AI Agents and What (Not) to Trust from Itarxiv-2603.05786 Sparse Blocked context onlyMar 6, 2026
- Designing Explainable Conversational Agentic Systems for Guaraní Speakersarxiv-2603.05743 Sparse Blocked context onlyMar 5, 2026
- RACAS: Controlling Diverse Robots With a Single Agentic Systemarxiv-2603.05621 Sparse Blocked context onlyMar 5, 2026
- Ensembling Language Models with Sequential Monte Carloarxiv-2603.05432 Sparse Blocked context onlyMar 5, 2026
- Knowledge Divergence and the Value of Debate for Scalable Oversightarxiv-2603.05293 Sparse Blocked context onlyMar 5, 2026
- The Geometric Inductive Bias of Grokking: Bypassing Phase Transitions via Architectural Topologyarxiv-2603.05228 Sparse Blocked context onlyMar 5, 2026
- Transducing Language Modelsarxiv-2603.05193 Sparse Blocked context onlyMar 5, 2026
- ARC-TGI: Human-Validated Task Generators with Reasoning Chain Templates for ARC-AGIarxiv-2603.05099 Sparse Blocked context onlyMar 5, 2026
- Aura: Universal Multi-dimensional Exogenous Integration for Aviation Time Seriesarxiv-2603.05092 Sparse Blocked context onlyMar 5, 2026
- TimeWarp: Evaluating Web Agents by Revisiting the Pastarxiv-2603.04949 Sparse Blocked context onlyMar 5, 2026