- Deterministic Decisions for High-Stakes AI. A Zero-Egress Pipeline with the Deployability of RAG and the Accuracy of Machine Learning
Craig Atkinson · Jun 28, 2026 · Citations: 0
Llm As JudgeAutomatic Metrics General
We identify intervention bias as a previously unquantified failure mode of zero-shot large-language-model (LLM) educational advisory agents: without task-specific training, they recommend action when a hindsight-optimal oracle policy…
- RuleForge: Automated Generation and Validation for Web Vulnerability Detection at Scale
Ayush Garg, Sophia Hager, Jacob Montiel, Aditya Tiwari, Michael Gentile · Apr 2, 2026 · Citations: 0
Llm As JudgeAutomatic Metrics Math
This paper focuses on RuleForge's architecture and operational deployment for CVE-related threat detection, with particular emphasis on our novel LLM-as-a-judge (Large Language Model as judge) confidence validation system and systematic…
- FairMed-XGB: A Bayesian-Optimised Multi-Metric Framework with Explainability for Demographic Equity in Critical Healthcare Data
Mitul Goswami, Romit Chatterjee, Arif Ahmed Sekh · Mar 16, 2026 · Citations: 0
Automatic Metrics Medicine
Post-mitigation evaluation on seven clinically distinct cohorts derived from the MIMIC-IV-ED and eICU databases demonstrates substantial bias reduction: Statistical Parity Difference decreases by 40 to 51 percent on MIMIC-IV-ED and 10 to 19…
- Entropy trajectory shape predicts LLM reasoning reliability: A diagnostic study of uncertainty dynamics in chain-of-thought
Xinghao Zhao · Mar 19, 2026 · Citations: 0
Automatic Metrics Math
Chain-of-thought (CoT) reasoning improves LLM accuracy, yet detecting failures cheaply remains elusive.
- Do Thinking Tokens Help with Safety?
Narutatsu Ri, Abhishek Panigrahi, Sanjeev Arora · Jun 23, 2026 · Citations: 0
Automatic Metrics General
Today's reasoning models use thinking tokens to attain stronger performance on benchmarks than their instruction-tuned counterparts.
- Just how sure are you? Improving Verbalized Uncertainty Calibration in Medical VQA
Eren Senoglu, Federico Toschi, Nicolo Brunello, Andrea Sassella, Mark James Carman · Jun 25, 2026 · Citations: 0
- Thermodynamic Signatures of Reasoning: Free-Energy and Spectral-Form-Factor Diagnostics for Hallucination Detection in Large Language Models
Salim Khazem · Jun 17, 2026 · Citations: 0
- The ACUTE Protocol: Operationalizing Language Model Activations for Better Calibration, Utility, and Trust
Nishant Subramani, Palash Goyal, Yiwen Song, Mani Malek, Yuan Xue · Jun 5, 2026 · Citations: 0
- Cognitive Fatigue in Autoregressive Transformers: Formalization and Measurement
Riju Marwah, Ritvik Garimella, Vishal Pallagani, Atishay Jain, Michael Stewart · May 29, 2026 · Citations: 0
- Amplifying, Not Learning: Fine-Tuned AI Text Detectors Amplify a Pretrained Direction
Alexander Smirnov · May 20, 2026 · Citations: 0
- Calibration vs Decision Making: Revisiting the Reliability Paradox in Unlearned Language Models
Divyaksh Shukla, Ashutosh Modi · May 20, 2026 · Citations: 0
- Calibrating LLMs with Semantic-level Reward
Fengfei Yu, Ruijia Niu, Dongxia Wu, Yian Ma, Rose Yu · May 15, 2026 · Citations: 0
- FutureSim: Replaying World Events to Evaluate Adaptive Agents
Shashwat Goel, Nikhil Chandak, Arvindh Arun, Ameya Prabhu, Steffen Staab · May 14, 2026 · Citations: 0
- Task-Aware Calibration: Provably Optimal Decoding in LLMs
Tim Tomov, Dominik Fuchsgruber, Rajeev Verma, Stephan Günnemann · May 11, 2026 · Citations: 0
- Hidden Error Awareness in Chain-of-Thought Reasoning: The Signal Is Diagnostic, Not Causal
Aojie Yuan, Zhiyuan Julian Su, Haiyue Zhang, Yi Nian, Yue Zhao · May 10, 2026 · Citations: 0
- MIPIAD: Multilingual Indirect Prompt Injection Attack Defense with Qwen -- TF-IDF Hybrid and Meta-Ensemble Learning
Al Muhit Muhtadi, Mostafa Rifat Tazwar · May 8, 2026 · Citations: 0
- When No Benchmark Exists: Validating Comparative LLM Safety Scoring Without Ground-Truth Labels
Sushant Gautam, Finn Schwall, Annika Willoch Olstad, Fernando Vallecillos Ruiz, Birk Torpmann-Hagen · May 7, 2026 · Citations: 0
- Decodable but Not Corrected by Fixed Residual-Stream Linear Steering: Evidence from Medical LLM Failure Regimes
Ming Liu · May 7, 2026 · Citations: 0
- Learning Dynamic Representations and Policies from Multimodal Clinical Time-Series with Informative Missingness
Zihan Liang, Ziwen Pan, Ruoxuan Xiong · Apr 23, 2026 · Citations: 0
- Self-Aware Vector Embeddings for Retrieval-Augmented Generation: A Neuroscience-Inspired Framework for Temporal, Confidence-Weighted, and Relational Knowledge
Naizhong Xu · Apr 22, 2026 · Citations: 0
- Concurrent Criterion Validation of a Validity Screen for LLM Confidence Signals via Selective Prediction
Jon-Paul Cacioli · Apr 20, 2026 · Citations: 0
- SegWithU: Uncertainty as Perturbation Energy for Single-Forward-Pass Risk-Aware Medical Image Segmentation
Tianhao Fu, Austin Wang, Charles Chen, Roby Aldave-Garza, Yucheng Chen · Apr 16, 2026 · Citations: 0
- Calibration-Gated LLM Pseudo-Observations for Online Contextual Bandits
Maksim Pershin, Ivan Golovanov, Pavel Baltabaev, Natalia Trankova · Apr 16, 2026 · Citations: 0
- Comparison of Modern Multilingual Text Embedding Techniques for Hate Speech Detection Task
Evaldas Vaiciukynas, Paulius Danenas, Linas Ablonskis, Algirdas Sukys, Edgaras Dambrauskas · Apr 16, 2026 · Citations: 0
- Retrieve, Then Classify: Corpus-Grounded Automation of Clinical Value Set Authoring
Sumit Mukherjee, Juan Shu, Nairwita Mazumder, Tate Kernell, Celena Wheeler · Apr 16, 2026 · Citations: 0
- Rhetorical Questions in LLM Representations: A Linear Probing Study
Louie Hong Yao, Vishesh Anand, Yuan Zhuang, Tianyu Jiang · Apr 15, 2026 · Citations: 0
- FairLogue: A Toolkit for Intersectional Fairness Analysis in Clinical Machine Learning Models
Nick Souligne, Vignesh Subbian · Apr 6, 2026 · Citations: 0
- CANDI: Curated Test-Time Adaptation for Multivariate Time-Series Anomaly Detection Under Distribution Shift
HyunGi Kim, Jisoo Mok, Hyungyu Lee, Juhyeon Shin, Sungroh Yoon · Apr 2, 2026 · Citations: 0
- Multi-Agent Reasoning with Consistency Verification Improves Uncertainty Calibration in Medical MCQA
John Ray B. Martinez · Mar 25, 2026 · Citations: 0
- Confidence Calibration under Ambiguous Ground Truth
Linwei Tao, Haoyang Luo, Minjing Dong, Chang Xu · Mar 24, 2026 · Citations: 0
- Theoretical Foundations of Latent Posterior Factors: Formal Guarantees for Multi-Evidence Reasoning
Aliyu Agboola Alege · Mar 13, 2026 · Citations: 0
- I Know What I Don't Know: Latent Posterior Factor Models for Multi-Evidence Probabilistic Reasoning
Aliyu Agboola Alege · Mar 13, 2026 · Citations: 0
- Proof-Carrying Materials: Falsifiable Safety Certificates for Machine-Learned Interatomic Potentials
Abhinaba Basu, Pavan Chakraborty · Mar 12, 2026 · Citations: 0
- Decoupling Reasoning and Confidence: Resurrecting Calibration in Reinforcement Learning from Verifiable Rewards
Zhengzhao Ma, Xueru Wen, Boxi Cao, Yaojie Lu, Hongyu Lin · Mar 10, 2026 · Citations: 0
- Benchmarking BERT-based Models for Sentence-level Topic Classification in Nepali Language
Nischal Karki, Bipesh Subedi, Prakash Poudyal, Rupak Raj Ghimire, Bal Krishna Bal · Feb 27, 2026 · Citations: 0
- Residual Koopman Spectral Profiling for Predicting and Preventing Transformer Training Instability
Bum Jun Kim, Shohei Taniguchi, Makoto Kawano, Yusuke Iwasawa, Yutaka Matsuo · Feb 26, 2026 · Citations: 0
- Linear probes rely on textual evidence: Results from leakage mitigation studies in language models
Gerard Boxo, Aman Neelappa, Shivam Raval · Sep 16, 2025 · Citations: 0