300 canonical paper links on this archive page.
- LatentRAG: Latent Reasoning and Retrieval for Efficient Agentic RAGarxiv-2605.06285 Sparse Blocked context onlyMay 7, 2026
- Rethinking RL for LLM Reasoning: It's Sparse Policy Selection, Not Capability Learningarxiv-2605.06241 Sparse Blocked context onlyMay 7, 2026
- Federation of Experts: Communication Efficient Distributed Inference for Large Language Modelsarxiv-2605.06206 Sparse Blocked context onlyMay 7, 2026
- A$^2$TGPO: Agentic Turn-Group Policy Optimization with Adaptive Turn-level Clippingarxiv-2605.06200 Sparse Blocked context onlyMay 7, 2026
- The Granularity Axis: A Micro-to-Macro Latent Direction for Social Roles in Language Modelsarxiv-2605.06196 Sparse Blocked context onlyMay 7, 2026
- Rethinking Adapter Placement: A Dominant Adaptation Module Perspectivearxiv-2605.06183 Curated Related Blocked context onlyMay 7, 2026
- Listwise Policy Optimization: Group-based RLVR as Target-Projection on the LLM Response Simplexarxiv-2605.06139 Sparse Blocked context onlyMay 7, 2026
- MemReranker: Reasoning-Aware Reranking for Agent Memory Retrievalarxiv-2605.06132 Sparse Blocked context onlyMay 7, 2026
- Skill1: Unified Evolution of Skill-Augmented Agents via Reinforcement Learningarxiv-2605.06130 Direct Blocked context onlyMay 7, 2026
- Shallow Prefill, Deep Decoding: Efficient Long-Context Inference via Layer-Asymmetric KV Visibilityarxiv-2605.06105 Sparse Blocked context onlyMay 7, 2026
- Milestone-Guided Policy Learning for Long-Horizon Language Agentsarxiv-2605.06078 Direct Blocked context onlyMay 7, 2026
- Novelty-based Tree-of-Thought Search for LLM Reasoning and Planningarxiv-2605.06040 Sparse Blocked context onlyMay 7, 2026
- From Articles to Premises: Building PrimeFacts, an Extraction Methodology and Resource for Fact-Checking Evidencearxiv-2605.06006 Sparse Blocked context onlyMay 7, 2026
- 4DThinker: Thinking with 4D Imagery for Dynamic Spatial Understandingarxiv-2605.05997 Sparse Blocked context onlyMay 7, 2026
- Think, then Score: Decoupled Reasoning and Scoring for Video Reward Modelingarxiv-2605.05922 Sparse Blocked context onlyMay 7, 2026
- Training-Free Dense Hand Contact Estimation with Multi-Modal Large Language Modelsarxiv-2605.05886 Sparse Blocked context onlyMay 7, 2026
- X-OmniClaw Technical Report: A Unified Mobile Agent for Multimodal Understanding and Interactionarxiv-2605.05765 Direct Blocked context onlyMay 7, 2026
- BioTool: A Comprehensive Tool-Calling Dataset for Enhancing Biomedical Capabilities of Large Language Modelsarxiv-2605.05758 Sparse Blocked context onlyMay 7, 2026
- RVPO: Risk-Sensitive Alignment via Variance Regularizationarxiv-2605.05750 Sparse Blocked context onlyMay 7, 2026
- Auto Research with Specialist Agents Develops Effective and Non-Trivial Training Recipesarxiv-2605.05724 Sparse Blocked context onlyMay 7, 2026
- More Is Not Always Better: Cross-Component Interference in LLM Agent Scaffoldingarxiv-2605.05716 Sparse Blocked context onlyMay 7, 2026
- Decodable but Not Corrected by Fixed Residual-Stream Linear Steering: Evidence from Medical LLM Failure Regimesarxiv-2605.05715 Sparse Blocked context onlyMay 7, 2026
- SafeHarbor: Hierarchical Memory-Augmented Guardrail for LLM Agent Safetyarxiv-2605.05704 Sparse Blocked context onlyMay 7, 2026
- XL-SafetyBench: A Country-Grounded Cross-Cultural Benchmark for LLM Safety and Cultural Sensitivityarxiv-2605.05662 Sparse Blocked context onlyMay 7, 2026
- From Storage to Experience: A Survey on the Evolution of LLM Agent Memory Mechanismsarxiv-2605.06716 Sparse Blocked context onlyMay 7, 2026
- One Turn Too Late: Response-Aware Defense Against Hidden Malicious Intent in Multi-Turn Dialoguearxiv-2605.05630 Sparse Blocked context onlyMay 7, 2026
- The Cost of Context: Mitigating Textual Bias in Multimodal Retrieval-Augmented Generationarxiv-2605.05594 Sparse Blocked context onlyMay 7, 2026
- Nonsense Helps: Prompt Space Perturbation Broadens Reasoning Explorationarxiv-2605.05566 Sparse Blocked context onlyMay 7, 2026
- Masked Diffusion Language Models are Strong and Steerable Text-Based World Models for Agentic RLarxiv-2607.16204 Sparse Blocked context onlyMay 7, 2026
- ZAYA1-8B Technical Reportarxiv-2605.05365 Sparse Blocked context onlyMay 6, 2026
- D-OPSD: On-Policy Self-Distillation for Continuously Tuning Step-Distilled Diffusion Modelsarxiv-2605.05204 Direct Blocked context onlyMay 6, 2026
- The First Token Knows: Single-Decode Confidence for Hallucination Detectionarxiv-2605.05166 Sparse Blocked context onlyMay 6, 2026
- Beyond Semantics: An Evidential Reasoning-Aware Multi-View Learning Framework for Trustworthy Mental Health Predictionarxiv-2605.05121 Sparse Blocked context onlyMay 6, 2026
- Automatically Finding and Validating Unexpected Side-Effects of Interventions on Language Modelsarxiv-2605.05090 Sparse Blocked context onlyMay 6, 2026
- When Relations Break: Analyzing Relation Hallucination in Vision-Language Model Under Rotation and Noisearxiv-2605.05045 Sparse Blocked context onlyMay 6, 2026
- Why Expert Alignment Is Hard: Evidence from Subjective Evaluationarxiv-2605.04972 Sparse Blocked context onlyMay 6, 2026
- UFAL-CUNI at SemEval-2026 Task 11: An Efficient Modular Neuro-symbolic Method for Syllogistic Reasoningarxiv-2605.04941 Sparse Blocked context onlyMay 6, 2026
- Rethinking Local Learning: A Cheaper and Faster Recipe for LLM Post-Trainingarxiv-2605.04913 Sparse Blocked context onlyMay 6, 2026
- Storage Is Not Memory: A Retrieval-Centered Architecture for Agent Recallarxiv-2605.04897 Direct Blocked context onlyMay 6, 2026
- Uncertainty-Aware Exploratory Direct Preference Optimization for Multimodal Large Language Modelsarxiv-2605.04874 Sparse Blocked context onlyMay 6, 2026
- Assessing Cognitive Effort in L2 Idiomatic Processing: An Eye-Tracking Datasetarxiv-2605.04857 Sparse Blocked context onlyMay 6, 2026
- Elicitation Matters: How Prompts and Query Protocols Shape LLM Surrogates under Sparse Observationsarxiv-2605.04764 Sparse Blocked context onlyMay 6, 2026
- Gyan: An Explainable Neuro-Symbolic Language Modelarxiv-2605.04759 Sparse Blocked context onlyMay 6, 2026
- Every Step Counts: Step-Level Credit Assignment for Tool-Integrated Text-to-SQLarxiv-2605.04719 Sparse Blocked context onlyMay 6, 2026
- Sparse Tokens Suffice: Jailbreaking Audio Language Models via Token-Aware Gradient Optimizationarxiv-2605.04700 Sparse Blocked context onlyMay 6, 2026
- ReflectDrive-2: Reinforcement-Learning-Aligned Self-Editing for Discrete Diffusion Drivingarxiv-2605.04647 Sparse Blocked context onlyMay 6, 2026
- Graph-Augmented LLMs for Swiss MP Ideology Predictionarxiv-2605.04643 Sparse Blocked context onlyMay 6, 2026
- Open-Source Image Editing Models Are Zero-Shot Vision Learnersarxiv-2605.04566 Sparse Blocked context onlyMay 6, 2026
- UniVer: A Unified Perspective for Multi-step and Multi-draft Speculative Decodingarxiv-2605.04543 Sparse Blocked context onlyMay 6, 2026
- RLearner-LLM: Balancing Logical Grounding and Fluency in Large Language Models via Hybrid Direct Preference Optimizationarxiv-2605.04539 Sparse Blocked context onlyMay 6, 2026
- Distilling Bayesian Belief States into Language Models for Auditable Negotiationarxiv-2605.04507 Sparse Blocked context onlyMay 6, 2026
- GEM: Graph-Enhanced Mixture-of-Experts with ReAct Agents for Dialogue State Trackingarxiv-2605.04449 Sparse Blocked context onlyMay 6, 2026
- Budgeted LoRA: Distillation as Structured Compute Allocation for Efficient Inferencearxiv-2605.04341 Curated Related Blocked context onlyMay 5, 2026
- Hierarchical Visual Agent: Managing Contexts in Joint Image-Text Space for Advanced Chart Reasoningarxiv-2605.04304 Sparse Blocked context onlyMay 5, 2026
- Material Database Agent: A Multimodal Agentic Framework for Scientific Literature Miningarxiv-2605.04278 Sparse Blocked context onlyMay 5, 2026
- Audio-Visual Intelligence in Large Foundation Modelsarxiv-2605.04045 Sparse Blocked context onlyMay 5, 2026
- Safety and accuracy follow different scaling laws in clinical large language modelsarxiv-2605.04039 Sparse Blocked context onlyMay 5, 2026
- OpenSeeker-v2: Pushing the Limits of Search Agents with Informative and High-Difficulty Trajectoriesarxiv-2605.04036 Direct Blocked context onlyMay 5, 2026
- Rethinking Reasoning-Intensive Retrieval: Evaluating and Advancing Retrievers in Agentic Search Systemsarxiv-2605.04018 Sparse Blocked context onlyMay 5, 2026
- Awaking Spatial Intelligence in Unified Multimodal Understanding and Generationarxiv-2605.04128 Sparse Blocked context onlyMay 5, 2026
- Correct Is Not Enough: Training Reasoning Planners with Executor-Grounded Rewardsarxiv-2605.03862 Sparse Blocked context onlyMay 5, 2026
- MCJudgeBench: A Benchmark for Constraint-Level Judge Evaluation in Multi-Constraint Instruction Followingarxiv-2605.03858 Sparse Blocked context onlyMay 5, 2026
- Stream-R1: Reliability-Perplexity Aware Reward Distillation for Streaming Video Generationarxiv-2605.03849 Sparse Blocked context onlyMay 5, 2026
- Natural Language Processing: A Comprehensive Practical Guide from Tokenisation to RLHFarxiv-2605.03799 Sparse Blocked context onlyMay 5, 2026
- SERE: Structural Example Retrieval for Enhancing LLMs in Event Causality Identificationarxiv-2605.03701 Sparse Blocked context onlyMay 5, 2026
- CASCADE: Case-Based Continual Adaptation for Large Language Models During Deploymentarxiv-2605.06702 Sparse Blocked context onlyMay 5, 2026
- BIT.UA-AAUBS at ArchEHR-QA 2026: Evaluating Open-Source and Proprietary LLMs via Prompting in Low-Resource QAarxiv-2605.03618 Sparse Blocked context onlyMay 5, 2026
- Workspace-Bench 1.0: Benchmarking AI Agents on Workspace Tasks with Large-Scale File Dependenciesarxiv-2605.03596 Sparse Blocked context onlyMay 5, 2026
- Revisiting Graph-Tokenizing Large Language Models: A Systematic Evaluation of Graph Token Understandingarxiv-2605.03514 Sparse Blocked context onlyMay 5, 2026
- CuraView: A Multi-Agent Framework for Medical Hallucination Detection with GraphRAG-Enhanced Knowledge Verificationarxiv-2605.03476 Sparse Blocked context onlyMay 5, 2026
- FINER-SQL: Boosting Small Language Models for Text-to-SQLarxiv-2605.03465 Sparse Blocked context onlyMay 5, 2026
- Exposing LLM Safety Gaps Through Mathematical Encoding:New Attacks and Systematic Analysisarxiv-2605.03441 Sparse Blocked context onlyMay 5, 2026
- When to Think, When to Speak: Learning Disclosure Policies for LLM Reasoningarxiv-2605.03314 Sparse Blocked context onlyMay 5, 2026
- SHIELD: A Diverse Clinical Note Dataset and Distilled Small Language Models for Enterprise-Scale De-identificationarxiv-2605.03301 Sparse Blocked context onlyMay 5, 2026
- RLDX-1 Technical Reportarxiv-2605.03269 Direct Blocked context onlyMay 5, 2026
- Benchmarking Local Language Models for Social Robots using Edge Devicesarxiv-2605.03111 Sparse Blocked context onlyMay 4, 2026
- Liberating LLM Capabilities in Full-Duplex Speech Modelsarxiv-2606.07547 Sparse Blocked context onlyMay 4, 2026
- Reinforcement Learning for LLM-based Multi-Agent Systems through Orchestration Tracesarxiv-2605.02801 Sparse Blocked context onlyMay 4, 2026
- Linearizing Vision Transformer with Test-Time Trainingarxiv-2605.02772 Sparse Blocked context onlyMay 4, 2026
- Perceptual Flow Network for Visually Grounded Reasoningarxiv-2605.02730 Sparse Blocked context onlyMay 4, 2026
- AcademiClaw: When Students Set Challenges for AI Agentsarxiv-2605.02661 Sparse Blocked context onlyMay 4, 2026
- GRAIL: A Deep-Granularity Hybrid Resonance Framework for Real-Time Agent Discovery via SLM-Enhanced Indexingarxiv-2605.02489 Sparse Blocked context onlyMay 4, 2026
- The Compliance Trap: How Structural Constraints Degrade Frontier AI Metacognition Under Adversarial Pressurearxiv-2605.02398 Sparse Blocked context onlyMay 4, 2026
- MolViBench: Evaluating LLMs on Molecular Vibe Codingarxiv-2605.02351 Sparse Blocked context onlyMay 4, 2026
- Perturbation Dose Responses in Recursive LLM Loops: Raw Switching, Stochastic Floors, and Persistent Escape under Append, Replace, and Dialog Updatesarxiv-2605.02236 Sparse Blocked context onlyMay 4, 2026
- Enhanced LLM Reasoning by Optimizing Reward Functions with Search-Driven Reinforcement Learningarxiv-2605.02073 Sparse Blocked context onlyMay 3, 2026
- Counting as a minimal probe of language model reliabilityarxiv-2605.02028 Sparse Blocked context onlyMay 3, 2026
- The Reasoning Trap: An Information-Theoretic Bound on Closed-System Multi-Step LLM Reasoningarxiv-2605.01704 Sparse Blocked context onlyMay 3, 2026
- Injecting Distributional Awareness into MLLMs via Reinforcement Learning for Deep Imbalanced Regressionarxiv-2605.01402 Sparse Blocked context onlyMay 2, 2026
- ESARBench: A Benchmark for Agentic UAV Embodied Search and Rescuearxiv-2605.01371 Sparse Blocked context onlyMay 2, 2026
- Chain of Evidence: Pixel-Level Visual Attribution for Iterative Retrieval-Augmented Generationarxiv-2605.01284 Sparse Blocked context onlyMay 2, 2026
- When LLMs Stop Following Steps: A Diagnostic Study of Procedural Execution in Language Modelsarxiv-2605.00817 Sparse Blocked context onlyMay 1, 2026
- Persistent Visual Memory: Sustaining Perception for Deep Generation in LVLMsarxiv-2605.00814 Sparse Blocked context onlyMay 1, 2026
- Let ViT Speak: Generative Language-Image Pre-trainingarxiv-2605.00809 Curated Related Blocked context onlyMay 1, 2026
- MedMosaic: A Challenging Large Scale Benchmark of Diverse Medical Audioarxiv-2605.00969 Sparse Blocked context onlyMay 1, 2026
- Learning to Act and Cooperate for Distributed Black-Box Consensus Optimizationarxiv-2605.00691 Sparse Blocked context onlyMay 1, 2026
- UniVidX: A Unified Multimodal Framework for Versatile Video Generation via Diffusion Priorsarxiv-2605.00658 Curated Related Blocked context onlyMay 1, 2026
- Healthcare AI GYM for Medical Agentsarxiv-2605.02943 Sparse Blocked context onlyMay 1, 2026
- Hierarchical Abstract Tree for Cross-Document Retrieval-Augmented Generationarxiv-2605.00529 Sparse Blocked context onlyMay 1, 2026
- AEM: Adaptive Entropy Modulation for Multi-Turn Agentic Reinforcement Learningarxiv-2605.00425 Sparse Blocked context onlyMay 1, 2026
- Trees to Flows and Back: Unifying Decision Trees and Diffusion Modelsarxiv-2605.00414 Sparse Blocked context onlyMay 1, 2026
- Odysseus: Scaling VLMs to 100+ Turn Decision-Making in Games via Reinforcement Learningarxiv-2605.00347 Sparse Blocked context onlyMay 1, 2026
- RSAT: Structured Attribution Makes Small Language Models Faithful Table Reasonersarxiv-2605.00199 Sparse Blocked context onlyApr 30, 2026
- HERMES++: Toward a Unified Driving World Model for 3D Scene Understanding and Generationarxiv-2604.28196 Sparse Blocked context onlyApr 30, 2026
- Visual Generation in the New Era: An Evolution from Atomic Mapping to Agentic World Modelingarxiv-2604.28185 Sparse Blocked context onlyApr 30, 2026
- Helpfulness Hurts: Domain-Dependent Degradation of Mid-Trained Compassion Values Under Post-Trainingarxiv-2606.26102 Sparse Blocked context onlyApr 30, 2026
- PhyCo: Learning Controllable Physical Priors for Generative Motionarxiv-2604.28169 Sparse Blocked context onlyApr 30, 2026
- FlashRT: Towards Computationally and Memory Efficient Red-Teaming for Prompt Injection and Knowledge Corruptionarxiv-2604.28157 Sparse Blocked context onlyApr 30, 2026
- Claw-Eval-Live: A Live Agent Benchmark for Evolving Real-World Workflowsarxiv-2604.28139 Sparse Blocked context onlyApr 30, 2026
- MoCapAnything V2: End-to-End Motion Capture for Arbitrary Skeletonsarxiv-2604.28130 Direct Blocked context onlyApr 30, 2026
- From Unstructured Recall to Schema-Grounded Memory: Reliable AI Memory via Iterative, Schema-Aware Extractionarxiv-2604.27906 Sparse Blocked context onlyApr 30, 2026
- MASCing: Configurable Mixture-of-Experts Behavior via Activation Steering Masksarxiv-2604.27818 Sparse Blocked context onlyApr 30, 2026
- World2Minecraft: Occupancy-Driven Simulated Scenes Constructionarxiv-2604.27578 Sparse Blocked context onlyApr 30, 2026
- Leveraging Verifier-Based Reinforcement Learning in Image Editingarxiv-2604.27505 Sparse Blocked context onlyApr 30, 2026
- Skills-Coach: A Self-Evolving Skill Optimizer via Training-Free GRPOarxiv-2604.27488 Sparse Blocked context onlyApr 30, 2026
- ScaleBox: Enabling High-Fidelity and Scalable Code Verification for Large Language Modelsarxiv-2604.27467 Sparse Blocked context onlyApr 30, 2026
- InteractWeb-Bench: Can Multimodal Agent Escape Blind Execution in Interactive Website Generation?arxiv-2604.27419 Sparse Blocked context onlyApr 30, 2026
- From Unstructured to Structured: LLM-Guided Attribute Graphs for Entity Search and Rankingarxiv-2604.27410 Curated Related Blocked context onlyApr 30, 2026
- MiniCPM-o 4.5: Towards Real-Time Full-Duplex Omni-Modal Interactionarxiv-2604.27393 Sparse Blocked context onlyApr 30, 2026
- Learning When to Remember: Risk-Sensitive Contextual Bandits for Abstention-Aware Memory Retrieval in LLM-Based Coding Agentsarxiv-2604.27283 Sparse Blocked context onlyApr 30, 2026
- Compliance versus Sensibility: On the Reasoning Controllability in Large Language Modelsarxiv-2604.27251 Sparse Blocked context onlyApr 29, 2026
- Web2BigTable: A Bi-Level Multi-Agent LLM System for Internet-Scale Information Search and Extractionarxiv-2604.27221 Sparse Blocked context onlyApr 29, 2026
- Path-Lock Expert: Separating Reasoning Mode in Hybrid Thinking via Architecture-Level Separationarxiv-2604.27201 Sparse Blocked context onlyApr 29, 2026
- Exploring the Limits of Pruning: Task-Specific Neurons, Model Collapse, and Recovery in Task-Specific Large Language Modelsarxiv-2604.27115 Sparse Blocked context onlyApr 29, 2026
- Co-Evolving Policy Distillationarxiv-2604.27083 Sparse Blocked context onlyApr 29, 2026
- Turning the TIDE: Cross-Architecture Distillation for Diffusion Large Language Modelsarxiv-2604.26951 Sparse Blocked context onlyApr 29, 2026
- ClawGym: A Scalable Framework for Building Effective Claw Agentsarxiv-2604.26904 Sparse Blocked context onlyApr 29, 2026
- GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agentsarxiv-2604.26752 Sparse Blocked context onlyApr 29, 2026
- Unified 4D World Action Modeling from Video Priors with Asynchronous Denoisingarxiv-2604.26694 Sparse Blocked context onlyApr 29, 2026
- Shorthand for Thought: Compressing LLM Reasoning via Entropy-Guided Supertokensarxiv-2604.26355 Sparse Blocked context onlyApr 29, 2026
- Addressing Performance Saturation for LLM RL via Precise Entropy Curve Controlarxiv-2604.26326 Sparse Blocked context onlyApr 29, 2026
- EvoSelect: Data-Efficient LLM Evolution for Targeted Task Adaptationarxiv-2604.26170 Sparse Blocked context onlyApr 28, 2026
- RADIO-ViPE: Online Tightly Coupled Multi-Modal Fusion for Open-Vocabulary Semantic SLAM in Dynamic Environmentsarxiv-2604.26067 Sparse Blocked context onlyApr 28, 2026
- Recursive Multi-Agent Systemsarxiv-2604.25917 Direct Blocked context onlyApr 28, 2026
- Toward Scalable Terminal Task Synthesis via Skill Graphsarxiv-2604.25727 Sparse Blocked context onlyApr 28, 2026
- Step-Audio-R1.5 Technical Reportarxiv-2604.25719 Sparse Blocked context onlyApr 28, 2026
- Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Modelsarxiv-2604.25636 Sparse Blocked context onlyApr 28, 2026
- A Systematic Post-Train Framework for Video Generationarxiv-2604.25427 Sparse Blocked context onlyApr 28, 2026
- AutoResearchBench: Benchmarking AI Agents on Complex Scientific Literature Discoveryarxiv-2604.25256 Sparse Blocked context onlyApr 28, 2026
- Prior-Aligned Data Cleaning for Tabular Foundation Modelsarxiv-2604.25154 Sparse Blocked context onlyApr 28, 2026
- FAMA: Failure-Aware Meta-Agentic Framework for Open-Source LLMs in Interactive Tool Use Environmentsarxiv-2604.25135 Sparse Blocked context onlyApr 28, 2026
- Nemotron 3 Nano Omni: Efficient and Open Multimodal Intelligencearxiv-2604.24954 Sparse Blocked context onlyApr 27, 2026
- Large Language Models Explore by Latent Distillingarxiv-2604.24927 Sparse Blocked context onlyApr 27, 2026
- World-R1: Reinforcing 3D Constraints for Text-to-Video Generationarxiv-2604.24764 Direct Blocked context onlyApr 27, 2026
- X2SAM: Any Segmentation in Images and Videosarxiv-2605.00891 Sparse Blocked context onlyApr 27, 2026
- The Last Human-Written Paper: Agent-Native Research Artifactsarxiv-2604.24658 Sparse Blocked context onlyApr 27, 2026
- Meta-CoT: Enhancing Granularity and Generalization in Image Editingarxiv-2604.24625 Sparse Blocked context onlyApr 27, 2026
- Improving Vision-language Models with Perception-centric Process Reward Modelsarxiv-2604.24583 Sparse Blocked context onlyApr 27, 2026
- MEG-RAG: Quantifying Multi-modal Evidence Grounding for Evidence Selection in RAGarxiv-2604.24564 Sparse Blocked context onlyApr 27, 2026
- Programming with Data: Test-Driven Data Engineering for Self-Improving LLMs from Raw Corporaarxiv-2604.24819 Sparse Blocked context onlyApr 27, 2026
- Zero-to-CAD: Agentic Synthesis of Interpretable CAD Programs at Million-Scale Without Real Dataarxiv-2604.24479 Sparse Blocked context onlyApr 27, 2026
- SeaEvo: Advancing Algorithm Discovery with Strategy Space Evolutionarxiv-2604.24372 Sparse Blocked context onlyApr 27, 2026
- ReVSI: Rebuilding Visual Spatial Intelligence Evaluation for Accurate Assessment of VLM 3D Reasoningarxiv-2604.24300 Sparse Blocked context onlyApr 27, 2026
- Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysisarxiv-2604.24198 Sparse Blocked context onlyApr 27, 2026
- Jailbreaking Frontier Foundation Models Through Intention Deceptionarxiv-2604.24082 Sparse Blocked context onlyApr 27, 2026
- From Skill Text to Skill Structure: The Scheduling-Structural-Logical Representation for Agent Skillsarxiv-2604.24026 Sparse Blocked context onlyApr 27, 2026
- TCOD: Exploring Temporal Curriculum in On-Policy Distillation for Multi-turn Autonomous Agentsarxiv-2604.24005 Direct Blocked context onlyApr 27, 2026
- Stabilizing Efficient Reasoning with Step-Level Advantage Selectionarxiv-2604.24003 Sparse Blocked context onlyApr 27, 2026
- GoClick: Lightweight Element Grounding Model for Autonomous GUI Interactionarxiv-2604.23941 Sparse Blocked context onlyApr 27, 2026
- TSAssistant: A Human-in-the-Loop Agentic Framework for Automated Target Safety Assessmentarxiv-2604.23938 Sparse Blocked context onlyApr 27, 2026
- Prox-E: Fine-Grained 3D Shape Editing via Primitive-Based Abstractionsarxiv-2604.23774 Sparse Blocked context onlyApr 26, 2026
- PageGuide: Browser extension to assist users in navigating a webpage and locating informationarxiv-2604.23772 Sparse Blocked context onlyApr 26, 2026
- Agentic Fusion of Large Atomic and Language Models to Accelerate Superconductors Discoveryarxiv-2604.23758 Sparse Blocked context onlyApr 26, 2026
- AgentEval: DAG-Structured Step-Level Evaluation for Agentic Workflows with Error Propagation Trackingarxiv-2604.23581 Sparse Blocked context onlyApr 26, 2026
- IndustryAssetEQA: A Neurosymbolic Operational Intelligence System for Embodied Question Answering in Industrial Asset Maintenancearxiv-2604.23446 Sparse Blocked context onlyApr 25, 2026
- OceanPile: A Large-Scale Multimodal Ocean Corpus for Foundation Modelsarxiv-2605.00877 Sparse Blocked context onlyApr 25, 2026
- Efficient Rationale-based Retrieval: On-policy Distillation from Generative Rerankers based on JEPAarxiv-2604.23336 Sparse Blocked context onlyApr 25, 2026
- Discovering Agentic Safety Specifications from 1-Bit Danger Signalsarxiv-2604.23210 Sparse Blocked context onlyApr 25, 2026
- How Do AI Agents Spend Your Money? Analyzing and Predicting Token Consumption in Agentic Coding Tasksarxiv-2604.22750 Sparse Blocked context onlyApr 24, 2026
- Aligning Dense Retrievers with LLM Utility via DistillationAligning Dense Retrievers with LLM Utility via Distillationarxiv-2604.22722 Sparse Blocked context onlyApr 24, 2026
- Thinking Without Words: Efficient Latent Reasoning with Abstract Chain-of-Thoughtarxiv-2604.22709 Sparse Blocked context onlyApr 24, 2026
- BERAG: Bayesian Ensemble Retrieval-Augmented Generation for Knowledge-based Visual Question Answeringarxiv-2604.22678 Sparse Blocked context onlyApr 24, 2026
- From Natural Language to Verified Code: Toward AI Assisted Problem-to-Code Generation with Dafny-Based Formal Verificationarxiv-2604.22601 Sparse Blocked context onlyApr 24, 2026
- Learning Evidence Highlighting for Frozen LLMsarxiv-2604.22565 Sparse Blocked context onlyApr 24, 2026
- SOLAR-RL: Semi-Online Long-horizon Assignment Reinforcement Learningarxiv-2604.22558 Sparse Blocked context onlyApr 24, 2026
- Controllable Spoken Dialogue Generation: An LLM-Driven Grading System for K-12 Non-Native English Learnersarxiv-2604.22542 Sparse Blocked context onlyApr 24, 2026
- RouteLMT: Learned Sample Routing for Hybrid LLM Translation Deploymentarxiv-2604.22520 Sparse Blocked context onlyApr 24, 2026
- Aggregate vs. Personalized Judges in Business Idea Evaluation: Evidence from Expert Disagreementarxiv-2604.22517 Sparse Blocked context onlyApr 24, 2026
- CGC: Compositional Grounded Contrast for Fine-Grained Multi-Image Understandingarxiv-2604.22498 Sparse Blocked context onlyApr 24, 2026
- SSG: Logit-Balanced Vocabulary Partitioning for LLM Watermarkingarxiv-2604.22438 Sparse Blocked context onlyApr 24, 2026
- AgentSearchBench: A Benchmark for AI Agent Search in the Wildarxiv-2604.22436 Sparse Blocked context onlyApr 24, 2026
- Introducing Background Temperature to Characterise Hidden Randomness in Large Language Modelsarxiv-2604.22411 Sparse Blocked context onlyApr 24, 2026
- Selective Contrastive Learning For Gloss Free Sign Language Translationarxiv-2604.22374 Sparse Blocked context onlyApr 24, 2026
- CNSL-bench: Benchmarking the Sign Language Understanding Capabilities of MLLMs on Chinese National Sign Languagearxiv-2604.22367 Sparse Blocked context onlyApr 24, 2026
- Preference Heads in Large Language Models: A Mechanistic Framework for Interpretable Personalizationarxiv-2604.22345 Sparse Blocked context onlyApr 24, 2026
- Context-Fidelity Boosting: Enhancing Faithful Generation through Watermark-Inspired Decodingarxiv-2604.22335 Sparse Blocked context onlyApr 24, 2026
- ChangeQuery: Advancing Remote Sensing Change Analysis for Natural and Human-Induced Disasters from Visual Detection to Semantic Understandingarxiv-2604.22333 Sparse Blocked context onlyApr 24, 2026
- BLAST: Benchmarking LLMs with ASP-based Structured Testingarxiv-2604.22306 Sparse Blocked context onlyApr 24, 2026
- ReLeVAnT: Relevance Lexical Vectors for Accurate Legal Text Classificationarxiv-2604.22292 Sparse Blocked context onlyApr 24, 2026
- Self-Correction as Feedback Control: Error Dynamics, Stability Thresholds, and Prompt Interventions in LLMsarxiv-2604.22273 Sparse Blocked context onlyApr 24, 2026
- Semantic Error Correction and Decoding for Short Block Channel Codesarxiv-2604.22269 Sparse Blocked context onlyApr 24, 2026
- Large Language Models Decide Early and Explain Laterarxiv-2604.22266 Sparse Blocked context onlyApr 24, 2026
- Bridging the Long-Tail Gap: Robust Retrieval-Augmented Relation Completion via Multi-Stage Paraphrase Infusionarxiv-2604.22261 Sparse Blocked context onlyApr 24, 2026
- TTS-PRISM: A Perceptual Reasoning and Interpretable Speech Model for Fine-Grained Diagnosisarxiv-2604.22225 Sparse Blocked context onlyApr 24, 2026
- Verbal Confidence Saturation in 3-9B Open-Weight Instruction-Tuned LLMs: A Pre-Registered Psychometric Validity Screenarxiv-2604.22215 Sparse Blocked context onlyApr 24, 2026
- UniSonate: A Unified Model for Speech, Music, and Sound Effect Generation with Text Instructionsarxiv-2604.22209 Sparse Blocked context onlyApr 24, 2026
- Behavioral Canaries: Auditing Private Retrieved Context Usage in RL Fine-Tuningarxiv-2604.22191 Sparse Blocked context onlyApr 24, 2026
- ResRank: Unifying Retrieval and Listwise Reranking via End-to-End Joint Training with Residual Passage Compressionarxiv-2604.22180 Sparse Blocked context onlyApr 24, 2026
- dWorldEval: Scalable Robotic Policy Evaluation via Discrete Diffusion World Modelarxiv-2604.22152 Sparse Blocked context onlyApr 24, 2026
- Voice Under Revision: Large Language Models and the Normalization of Personal Narrativearxiv-2604.22142 Curated Related Blocked context onlyApr 24, 2026
- Emergent Strategic Reasoning Risks in AI: A Taxonomy-Driven Evaluation Frameworkarxiv-2604.22119 Sparse Blocked context onlyApr 23, 2026
- SketchVLM: Vision language models can annotate images to explain thoughts and guide usersarxiv-2604.22875 Sparse Blocked context onlyApr 23, 2026
- Memanto: Typed Semantic Memory with Information-Theoretic Retrieval for Long-Horizon Agentsarxiv-2604.22085 Sparse Blocked context onlyApr 23, 2026
- Outcome Rewards Do Not Guarantee Verifiable or Causally Important Reasoningarxiv-2604.22074 Sparse Blocked context onlyApr 23, 2026
- Reliability Auditing for Downstream LLM tasks in Psychiatry: LLM-Generated Hospitalization Risk Scoresarxiv-2604.22063 Sparse Blocked context onlyApr 23, 2026
- Incentivizing Neuro-symbolic Language-based Reasoning in VLMs via Reinforcement Learningarxiv-2604.22062 Sparse Blocked context onlyApr 23, 2026
- Lightweight Retrieval-Augmented Generation and Large Language Model-Based Modeling for Scalable Patient-Trial Matchingarxiv-2604.22061 Sparse Blocked context onlyApr 23, 2026
- Context Unrolling in Omni Modelsarxiv-2604.21921 Sparse Blocked context onlyApr 23, 2026
- When Prompts Override Vision: Prompt-Induced Hallucinations in LVLMsarxiv-2604.21911 Sparse Blocked context onlyApr 23, 2026
- UniGenDet: A Unified Generative-Discriminative Framework for Co-Evolutionary Image Generation and Generated Image Detectionarxiv-2604.21904 Sparse Blocked context onlyApr 23, 2026
- Learning to Communicate: Toward End-to-End Optimization of Multi-Agent Language Systemsarxiv-2604.21794 Sparse Blocked context onlyApr 23, 2026
- StructMem: Structured Memory for Long-Horizon Behavior in LLMsarxiv-2604.21748 Sparse Blocked context onlyApr 23, 2026
- Encoder-Free Human Motion Understanding via Structured Motion Descriptionsarxiv-2604.21668 Curated Related Blocked context onlyApr 23, 2026
- Process Supervision via Verbal Critique Improves Reasoning in Large Language Modelsarxiv-2604.21611 Sparse Blocked context onlyApr 23, 2026
- Generalizing Numerical Reasoning in Table Data through Operation Sketches and Self-Supervised Learningarxiv-2604.21495 Sparse Blocked context onlyApr 23, 2026
- Efficient Agent Evaluation via Diversity-Guided User Simulationarxiv-2604.21480 Sparse Blocked context onlyApr 23, 2026
- CARE: Counselor-Aligned Response Engine for Online Mental-Health Supportarxiv-2604.21352 Sparse Blocked context onlyApr 23, 2026
- Beyond Single Plots: A Benchmark for Question Answering on Multi-Chartsarxiv-2604.21344 Sparse Blocked context onlyApr 23, 2026
- Ideological Bias in LLMs' Economic Causal Reasoningarxiv-2604.21334 Sparse Blocked context onlyApr 23, 2026
- Understanding and Mitigating Spurious Signal Amplification in Test-Time Reinforcement Learning for Math Reasoningarxiv-2604.21327 Sparse Blocked context onlyApr 23, 2026
- CAP: Controllable Alignment Prompting for Unlearning in LLMsarxiv-2604.21251 Sparse Blocked context onlyApr 23, 2026
- Learning Dynamic Representations and Policies from Multimodal Clinical Time-Series with Informative Missingnessarxiv-2604.21235 Sparse Blocked context onlyApr 23, 2026
- Trust but Verify: Introducing DAVinCI -- A Framework for Dual Attribution and Verification in Claim Inference for Language Modelsarxiv-2604.21193 Sparse Blocked context onlyApr 23, 2026
- Breaking MCP with Function Hijacking Attacks: Novel Threats for Function Calling and Agentic Modelsarxiv-2604.20994 Sparse Blocked context onlyApr 22, 2026
- Co-Evolving LLM Decision and Skill Bank Agents for Long-Horizon Tasksarxiv-2604.20987 Sparse Blocked context onlyApr 22, 2026
- LLaDA2.0-Uni: Unifying Multimodal Understanding and Generation with Diffusion Large Language Modelarxiv-2604.20796 Direct Blocked context onlyApr 22, 2026
- Working Memory Constraints Scaffold Learning in Transformers under Data Scarcityarxiv-2604.20789 Sparse Blocked context onlyApr 22, 2026
- Anchor-and-Resume Concession Under Dynamic Pricing for LLM-Augmented Freight Negotiationarxiv-2604.20732 Sparse Blocked context onlyApr 22, 2026
- COMPASS: COntinual Multilingual PEFT with Adaptive Semantic Samplingarxiv-2604.20720 Sparse Blocked context onlyApr 22, 2026
- The Expense of Seeing: Attaining Trustworthy Multimodal Reasoning Within the Monolithic Paradigmarxiv-2604.20665 Sparse Blocked context onlyApr 22, 2026
- Self-Aware Vector Embeddings for Retrieval-Augmented Generation: A Neuroscience-Inspired Framework for Temporal, Confidence-Weighted, and Relational Knowledgearxiv-2604.20598 Sparse Blocked context onlyApr 22, 2026
- Exploring Spatial Intelligence from a Generative Perspectivearxiv-2604.20570 Sparse Blocked context onlyApr 22, 2026
- CHASM: Unveiling Covert Advertisements on Chinese Social Mediaarxiv-2604.20511 Sparse Blocked context onlyApr 22, 2026
- HaS: Accelerating RAG through Homology-Aware Speculative Retrievalarxiv-2604.20452 Sparse Blocked context onlyApr 22, 2026
- WebGen-R1: Incentivizing Large Language Models to Generate Functional and Aesthetic Websites with Reinforcement Learningarxiv-2604.20398 Sparse Blocked context onlyApr 22, 2026
- Hybrid Policy Distillation for LLMsarxiv-2604.20244 Sparse Blocked context onlyApr 22, 2026
- Chasing the Public Score: User Pressure and Evaluation Exploitation in Coding Agent Workflowsarxiv-2604.20200 Sparse Blocked context onlyApr 22, 2026
- Simplified Sparse Attention via Gist Tokensarxiv-2604.20920 Sparse Blocked context onlyApr 22, 2026
- Temporally Extended Mixture-of-Experts Modelsarxiv-2604.20156 Sparse Blocked context onlyApr 22, 2026
- EvoAgent: An Evolvable Agent Framework with Skill Learning and Multi-Agent Delegationarxiv-2604.20133 Sparse Blocked context onlyApr 22, 2026
- SkillLearnBench: Benchmarking Continual Learning Methods for Agent Skill Generation on Real-World Tasksarxiv-2604.20087 Sparse Blocked context onlyApr 22, 2026
- Bootstrapping Post-training Signals for Open-ended Tasks via Rubric-based Self-play on Pre-training Textarxiv-2604.20051 Sparse Blocked context onlyApr 21, 2026
- EmbodiedMidtrain: Bridging the Gap between Vision-Language Models and Vision-Language-Action Models via Mid-trainingarxiv-2604.20012 Sparse Blocked context onlyApr 21, 2026
- Visual Reasoning through Tool-supervised Reinforcement Learningarxiv-2604.19945 Sparse Blocked context onlyApr 21, 2026
- CreativeGame:Toward Mechanic-Aware Creative Game Generationarxiv-2604.19926 Sparse Blocked context onlyApr 21, 2026
- MMCORE: MultiModal COnnection with Representation Aligned Latent Embeddingsarxiv-2604.19902 Sparse Blocked context onlyApr 21, 2026
- AnyRecon: Arbitrary-View 3D Reconstruction with Video Diffusion Modelarxiv-2604.19747 Direct Blocked context onlyApr 21, 2026
- PlayCoder: Making LLM-Generated GUI Code Playablearxiv-2604.19742 Sparse Blocked context onlyApr 21, 2026
- DR-Venus: Towards Frontier Edge-Scale Deep Research Agents with Only 10K Open Dataarxiv-2604.19859 Sparse Blocked context onlyApr 21, 2026
- Chat2Workflow: A Benchmark for Generating Executable Visual Workflows with Natural Languagearxiv-2604.19667 Sparse Blocked context onlyApr 21, 2026
- Pause or Fabricate? Training Language Models for Grounded Reasoningarxiv-2604.19656 Sparse Blocked context onlyApr 21, 2026
- CoInteract: Physically-Consistent Human-Object Interaction Video Synthesis via Spatially-Structured Co-Generationarxiv-2604.19636 Curated Related Blocked context onlyApr 21, 2026
- SmartPhotoCrafter: Unified Reasoning, Generation and Optimization for Automatic Photographic Image Editingarxiv-2604.19587 Sparse Blocked context onlyApr 21, 2026
- A Self-Evolving Framework for Efficient Terminal Agents via Observational Context Compressionarxiv-2604.19572 Direct Blocked context onlyApr 21, 2026
- LePREC: Reasoning as Classification over Structured Factors for Assessing Relevance of Legal Issuesarxiv-2604.19464 Sparse Blocked context onlyApr 21, 2026
- What Makes an LLM a Good Optimizer? A Trajectory Analysis of LLM-Guided Evolutionary Searcharxiv-2604.19440 Sparse Blocked context onlyApr 21, 2026
- HP-Edit: A Human-Preference Post-Training Framework for Image Editingarxiv-2604.19406 Sparse Blocked context onlyApr 21, 2026
- DASH-KV: Accelerating Long-Context LLM Inference via Asymmetric KV Cache Hashingarxiv-2604.19351 Curated Related Blocked context onlyApr 21, 2026
- Evaluating LLM-Driven Summarisation of Parliamentary Debates with Computational Argumentationarxiv-2604.19331 Sparse Blocked context onlyApr 21, 2026
- RDP LoRA: Geometry-Driven Identification for Parameter-Efficient Adaptation in Large Language Modelsarxiv-2604.19321 Sparse Blocked context onlyApr 21, 2026
- IndiaFinBench: An Evaluation Benchmark for Large Language Model Performance on Indian Financial Regulatory Textarxiv-2604.19298 Sparse Blocked context onlyApr 21, 2026
- Detoxification for LLM: From Dataset Itselfarxiv-2604.19124 Curated Related Blocked context onlyApr 21, 2026
- Expert Upcycling: Shifting the Compute-Efficient Frontier of Mixture-of-Expertsarxiv-2604.19835 Sparse Blocked context onlyApr 21, 2026
- SAVOIR: Learning Social Savoir-Faire via Shapley-based Reward Attributionarxiv-2604.18982 Sparse Blocked context onlyApr 21, 2026
- AI scientists produce results without reasoning scientificallyarxiv-2604.18805 Sparse Blocked context onlyApr 20, 2026
- Remask, Don't Replace: Token-to-Mask Refinement in Diffusion Large Language Modelsarxiv-2604.18738 Sparse Blocked context onlyApr 20, 2026
- MathNet: a Global Multimodal Benchmark for Mathematical Reasoning and Retrievalarxiv-2604.18584 Sparse Blocked context onlyApr 20, 2026
- Sessa: Selective State Space Attentionarxiv-2604.18580 Sparse Blocked context onlyApr 20, 2026
- When Can LLMs Learn to Reason with Weak Supervision?arxiv-2604.18574 Sparse Blocked context onlyApr 20, 2026
- MultiWorld: Scalable Multi-Agent Multi-View Video World Modelsarxiv-2604.18564 Direct Blocked context onlyApr 20, 2026
- ClawEnvKit: Automatic Environment Generation for Claw-Like Agentsarxiv-2604.18543 Direct Blocked context onlyApr 20, 2026
- StepPO: Step-Aligned Policy Optimization for Agentic Reinforcement Learningarxiv-2604.18401 Sparse Blocked context onlyApr 20, 2026
- River-LLM: Large Language Model Seamless Exit Based on KV Sharearxiv-2604.18396 Sparse Blocked context onlyApr 20, 2026
- OpenGame: Open Agentic Coding for Gamesarxiv-2604.18394 Sparse Blocked context onlyApr 20, 2026
- Agent-World: Scaling Real-World Environment Synthesis for Evolving General Agent Intelligencearxiv-2604.18292 Sparse Blocked context onlyApr 20, 2026
- Beyond Pattern Matching: Seven Cross-Domain Techniques for Prompt Injection Detectionarxiv-2604.18248 Sparse Blocked context onlyApr 20, 2026
- AJ-Bench: Benchmarking Agent-as-a-Judge for Environment-Aware Evaluationarxiv-2604.18240 Sparse Blocked context onlyApr 20, 2026
- WebCompass: Towards Multimodal Web Coding Evaluation for Code Language Modelsarxiv-2604.18224 Sparse Blocked context onlyApr 20, 2026
- Multiplication in Multimodal LLMs: Computation with Text, Image, and Audio Inputsarxiv-2604.18203 Sparse Blocked context onlyApr 20, 2026
- MM-JudgeBias: A Benchmark for Evaluating Compositional Biases in MLLM-as-a-Judgearxiv-2604.18164 Sparse Blocked context onlyApr 20, 2026
- Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Explorationarxiv-2604.18131 Sparse Blocked context onlyApr 20, 2026
- Employing General-Purpose and Biomedical Large Language Models with Advanced Prompt Engineering for Pharmacoepidemiologic Study Designarxiv-2604.17988 Sparse Blocked context onlyApr 20, 2026
- Unlocking the Edge deployment and ondevice acceleration of multi-LoRA enabled one-for-all foundational LLMarxiv-2604.18655 Sparse Blocked context onlyApr 20, 2026
- On the Reliability of Computer Use Agentsarxiv-2604.17849 Sparse Blocked context onlyApr 20, 2026
- Democratizing Tool Learning with Environments Fully Simulated by a Free 8B Language Modelarxiv-2604.17739 Sparse Blocked context onlyApr 20, 2026
- Screen Before You Interpret: A Portable Validity Protocol for Benchmark-Based LLM Confidence Signalsarxiv-2604.17714 Sparse Blocked context onlyApr 20, 2026
- The Geometric Canary: Predicting Steerability and Detecting Drift via Representational Stabilityarxiv-2604.17698 Sparse Blocked context onlyApr 20, 2026
- Stratagem: Learning Transferable Reasoning via Trajectory-Modulated Game Self-Playarxiv-2604.17696 Sparse Blocked context onlyApr 20, 2026
- MoE-nD: Per-Layer Mixture-of-Experts Routing for Multi-Axis KV Cache Compressionarxiv-2604.17695 Sparse Blocked context onlyApr 20, 2026
- Agents Explore but Agents Ignore: LLMs Lack Environmental Curiosityarxiv-2604.17609 Sparse Blocked context onlyApr 19, 2026
- Terminal Wrench: A Dataset of 331 Reward-Hackable Environments and 3,632 Exploit Trajectoriesarxiv-2604.17596 Sparse Blocked context onlyApr 19, 2026
- UniGeo: Unifying Geometric Guidance for Camera-Controllable Image Editing via Video Modelsarxiv-2604.17565 Sparse Blocked context onlyApr 19, 2026
- HSG: Hyperbolic Scene Grapharxiv-2604.17454 Sparse Blocked context onlyApr 19, 2026
- Jupiter-N Technical Reportarxiv-2604.17429 Sparse Blocked context onlyApr 19, 2026
- EvoMaster: A Foundational Agent Framework for Building Evolving Autonomous Scientific Agents at Scalearxiv-2604.17406 Sparse Blocked context onlyApr 19, 2026
- Speculative Decoding for Autoregressive Video Generationarxiv-2604.17397 Sparse Blocked context onlyApr 19, 2026
- Precise Debugging Benchmark: Is Your Model Debugging or Regenerating?arxiv-2604.17338 Sparse Blocked context onlyApr 19, 2026
- When Background Matters: Breaking Medical Vision Language Models by Transferable Attackarxiv-2604.17318 Sparse Blocked context onlyApr 19, 2026
- Cat-DPO: Category-Adaptive Safety Alignmentarxiv-2604.17299 Sparse Blocked context onlyApr 19, 2026
- LLaTiSA: Towards Difficulty-Stratified Time Series Reasoning from Visual Perception to Semanticsarxiv-2604.17295 Sparse Blocked context onlyApr 19, 2026