←── back to feed
/topics/arxiv-ai-agents-papers-september-18

arXiv AI agents papers September 18

86 items1 sourcesupdated 2d agotrend 0

On September 18, 2026, arXiv published 20 machine learning papers spanning diverse topics including query suggestion, LLM compression, diffusion models, federated learning, attention mechanisms, and Bayesian optimization. The papers address efficiency, privacy, interpretability, and scalability challenges across language models, neural networks, and domain-specific applications.

  • Intent-Driven Query Suggestion Framework uses dual-stage optimization with intent-aware diversity rewards for follow-up query generation
  • Layer-wise curriculum learning enables efficient LLM compression through progressive knowledge transfer from teacher to student models
  • Block parallelism (BP) reduces distributed attention communication overhead for long-context diffusion language model training
  • Probe guidance method achieves state-of-the-art performance on continuous diffusion language models without additional inference passes
  • Stiefel Attention constrains query/key projections to Riemannian manifold with O(d)-equivariant Riemannian Adam optimizer
[BLG]blog/rss86
Generative Query Suggestion via Intent Coverage and Query-Level Credit Assignment
arXiv cs.LG · Xinpeng Liu, Lu Ma, Jiayi Qiao, Mengyu Zhou, Linglong Li, Xiaofeng Bian, Haonan Chen, Xiaoxi Jiang, Guanjun Jiang · 3d
Layer-wise Curriculum Learning for Efficient LLM Compression
arXiv cs.LG · Donggeon Lee, Dooyeon Na, Seungmin Oh, Jongbin Ryu · 3d
Block Parallelism For Efficient Distributed Long-Context Diffusion Language Model Training
arXiv cs.LG · Tarun Suresh, Pranshu Chaturvedi, Hangoo Kang, Parth Shroff, Ishan S. Khare, Hermann Kumbong, Azalia Mirhoseini · 3d
Randomized SVD Approximations for Spectral Co-Clustering of Word-Document Matrices
arXiv cs.LG · Fateme Mazdarani, Carlos Toxtli · 3d
Radio-Frequency Convolutional Neural Networks
arXiv cs.LG · Zhihui Gao, Shi-Yuan Ma, Yiran Chen, Dirk Englund, Tingjun Chen · 3d
Learning-Induced Dynamical Transition in Recurrent Neural Networks
arXiv cs.LG · Varun Vaidya · 3d
Personalized Federated Hierarchical Gaussian Processes for Privacy-Preserving Modeling of Heterogeneous Distributed Systems
arXiv cs.LG · Xianjian Xie, Hao Yan · 3d
How to Guide Your Language Flow
arXiv cs.LG · Rohit Dilip, Tianrong Chen, Yuyang Wang, David Van Valen, Joshua Susskind, Miguel Angel Bautista · 3d
Smart Insole Human Activity Recognition for Continuous Monitoring in Elderly Care
arXiv cs.LG · Edwin Rios, Antony Garcia, Fengpei Yuan, Xinming Huang · 3d
Stiefel Attention: When the Geometry of Transformer Projection Matrices Dominates Optimizer Choice---and When It Does Not
arXiv cs.LG · Rub\'en Dar\'io Guerrero · 3d
Machine-Learning Assessment of the Predictive Value of Inflammatory Biomarkers for Cognitive Impairment in an Older Hispanic Adult Cohort
arXiv cs.LG · Antony Garcia, Gabrielle Britton, Alcibiades Villarreal, Diana Oviedo, Giselle Rangel, Xinming Huang · 3d
FCx: An algorithm for finding Feasible Counterfactual Explanations
arXiv cs.LG · Kleopatra Markou, Vana Kalogeraki, Dimitrios Gunopulos · 3d
Improving Offline Goal-Conditioned Reinforcement Learning via Selective Reward Stimulation
arXiv cs.LG · Jing Zhang · 3d
Bayesian Optimization with Rich Auxiliary Information via LLMs
arXiv cs.LG · Tejus Gupta, Efe Mert Karag\"ozl\"u, Rohit Sonker, Barnab\'as P\'oczos, Jeff Schnieder · 3d
Sharpness-Aware Minimization (SAM) Improves Classification Accuracy of Bacterial Raman Spectral Data Enabling Portable Diagnostics
arXiv cs.LG · Kaitlin Zareno, Jarett Dewbury, Siamak K. Sorooshyari, Hossein Mobahi, Loza F. Tadesse · 3d
Enhanced Agriculture-informed Neural Network by Domain Knowledge
arXiv cs.LG · Ci Lin, Futong Li, Rose Chong-Wu, Tet Yeap, Iluju Kiringa · 3d
Search at the Cost of Sampling: Nearly-Instant Latent Space Bayesian Optimization
arXiv cs.LG · Donney Fan, Colin Doumont, Aleksandra Kalisz, Paul Duckworth, Jacob R. Gardner, Henry Moss, Geoff Pleiss · 3d
Sample Count Is Not Enough: Candidate-Generation Strategy Shapes the Energy and Performance of LLM Test-Time Scaling
arXiv cs.LG · Mobina Kashaniyan, Ali Jannesari · 3d
LSTM-UT and Recurrent-Depth Transformers on Cellular Automata
arXiv cs.LG · Aras Kavuncu · 3d
Compressed Active Subspaces for Scalable Bayesian Inference
arXiv cs.LG · Thomas Flynn, Sanket Jantre, Byung-Jun Yoon, Kibaek Kim · 3d
FedFIbOS: Fisher Importance based Optimal Submodelling for Heterogeneous Federated Learning
arXiv cs.LG · Yasmeen Afzal, Jeremiah D. Deng, Haibo Zhang · 3d
The Complexity Kink: A Prompt-Side Structural Complexity Index for Code-Generation Reliability
arXiv cs.LG · Michael Hernandez, Tian Zhao · 3d
A Policy Profile for Croissant: Refusal as a Property of the Dataset
arXiv cs.LG · Alexander Chernov · 3d
CoRe: Coherence and Relational Alignment for Multivariate Time Series Forecasting
arXiv cs.LG · Xiaoyu Lin, Huiran Duan, Yining Liu, Zhixiang Wu, Chu Lin, Lin Lu · 3d
Conservation Buys Stability and Factoring Buys Counterfactuals in Physical World Models
arXiv cs.LG · Yufeng Wang, Parivesh Priye, Lu Wei, Haibin Ling · 3d
Opinion Dynamics-based Coalition Formation for Federated Learning in Heterogeneous IoT Systems
arXiv cs.LG · Mohammed El Hanjri, Anas Abouaomar, Hamidou Tembine, Abdellatif Kobbane · 3d
Odds-Ratio Thompson Sampling: A Specification and Design Guide for Contrast-Based Multi-Armed Bandits
arXiv cs.LG · Sulgi Kim · 3d
Learn Your Own Thoughts: Abstract Token Curriculum
arXiv cs.LG · Khashayar Gatmiry, Avrajit Ghosh, Parsa Mirtaheri, Jason D. Lee, Nika Haghtalab, Emmanuel Abbe, Peter Bartlett · 3d
Alliance Beats Isolation: Unifying Heterogeneous Allied Datasets Improves Classifier Performance
arXiv cs.LG · Girish Keshav Palshikar · 3d
OceanMoE: Structured Conditional Sparse Computation for Long-Horizon Multivariate Ocean Forecasting
arXiv cs.LG · Yishun Zhu, Jian Wang · 3d
PhyRestore: Physics-Structured Latent-Factor Restoration
arXiv cs.LG · Ahmed Shafee, Chayan Lahiri · 3d
Learning-Based Reconstruction of Optical Properties in Bilayered Media from Single-distance Time-Resolved Reflectance Measurements
arXiv cs.LG · Caterina Amendola, Giulia Maffeis, Lorenzo Buffoni, Lorenzo Chicchi, Francesco Coghi, Duccio Fanelli, Raffaele Marino, Fabrizio Martelli, Riccardo Paoli, Lorenzo Pattelli, Lorenzo Spinelli · 3d
DeliveryGym: An RL Environment for Long-Horizon Embodied Agent Planning with Adaptive Curriculum
arXiv cs.LG · Haoqiang Kang, Yiming Zhang, Yiyang Guo, Chuying Li, Jianzhi Shen, Tianruo Rose Xu, Xiaokang Ye, Lianhui Qin · 3d
Beyond Flattened Tokens: Structure-Preserving EEG Decoding with Reusable TriDim Blocks
arXiv cs.LG · Shiyue Su, Song Wang, Zekai Zhan, Junjie Zeng, Ziling Lu, Zongsheng Li, Xinyuan Ye, Zhiyuan Ma, Xinke Shen, Quanying Liu · 3d
Expected Hypervolume Maximization for Multiobjective Optimization under Uncertainties
arXiv cs.LG · Victor Trappler (Mines Saint-\'Etienne MSE, LIMOS, FAYOL-ENSMSE, FAYOL-ENSMSE) · 3d
Pretrained Medical Representations for the Practical Screening of Drug Repositioning Candidates
arXiv cs.LG · Yuhei Fujioka, Daitaro Misawa, Shingo Fukuma · 3d
AURA: Adaptive Uncertainty-Routed Analysis for Email Threat Detection
arXiv cs.LG · Omran Berjawi, Walid fahs, Rida Khatoun · 3d
Regularized Emphatic Temporal-Difference Learning: Stability under Constant Stepsizes
arXiv cs.AI · Xingguo Chen, Zhaohui Wu, Jinguo Ye, Chao Li, Shangdong Yang, Guang Yang, Skylar Liang, Wenhao Wang · 3d
BioPhys-Bridge: A Benchmark for Interdisciplinary Scientific Reasoning in Physics-Grounded Biological Research
arXiv cs.AI · Qingyang Xu · 3d
What Do We Expect from LLMs? Mapping the Design of LLM Benchmarks
arXiv cs.AI · Chao Wang (Independent Researcher) · 3d
Position: It is Time to Virtualize Foundation Models with a Self-evolving Operating System Layer
arXiv cs.AI · Suparna Bhattacharya, Tarun Kumar, Cong Xu, Satish Kumar Mopur, Jiahao Li, Ashish Mishra, Aalap Tripathy, Annmary Justine Koomthanam, Martin Foltin, Ian Foster · 3d
What Do Current Systematic Generalization Tasks Miss? A Reasoning-Centered Analysis
arXiv cs.AI · Chengwen Qi, Deheng Ye, Yatao Bian · 3d
Characterizing Web Search by Conversational LLM Agents: From Search Decisions and Strategies to Results and Responses
arXiv cs.AI · Mahsa Amani, Seungeon Lee, Abhisek Dash, Asmaa El Fraihi, Yunah Jang, Elisabeth Kirsten, Qinyuan Wu, Krishna P. Gummadi, Manish Gupta, Abhilasha Ravichander, Muhammad Bilal Zafar, Soumi Das · 3d
Do AI Agents Understand Computer Architecture?
arXiv cs.AI · Ambika Sharan, Grigory Chirkov, Soheil Abbasloo · 3d
MAGS: Multi-agent Auto-formalization Guarantees Safety for Agentic Outputs
arXiv cs.AI · Albert Wu, Nicholas Roberts, Tzu-Heng Huang, Haoran Lin, Gil Friedman, Sungjun Cho, Gabriel Orlanski, Frederic Sala · 3d
Closed-World Resolution Against Tool Hallucination in LLM Agents
arXiv cs.AI · Laxmipriya Ganesh Iyer · 3d
The syntax and semantics of goals
arXiv cs.AI · David M. Abel, Mark K. Ho · 3d
Compositional Reasoning in Language Models under Reinforcement Learning Post-Training
arXiv cs.AI · Yu He, Yingxi Li, Yifei Wang, Ellen Vitercik · 3d
Safety Beyond the Interface: Detecting Harm via Latent States in Large Language Models
arXiv cs.AI · Alizishaan Khatri, Chiquita Prabhu, Omkar Neogi · 3d
QVAC Genesis III: A Large-Scale, High-Quality Open Synthetic STEM Corpus for Efficient Language Model Pre-Training
arXiv cs.AI · Davide Vitabile, N. Ranjan, Akshay Nambiar, Kamal K. Gupta, Amril Nazir · 3d
LLM-as-an-Improver: Turning Verification into Better Candidates
arXiv cs.AI · Akiyoshi Tomihari, Yuma Ichikawa · 3d
An Architecture for Long-Horizon Agents: Levels, Ticks and Cascaded Intelligence
arXiv cs.AI · Erik Nijkamp, Anurag Koul, Egor Pakhomov, Bo Pang · 3d
EconSkills: Studying Skill Transfer and Retrieval for Web Agents on Live Economic Data
arXiv cs.AI · Yinzhu Quan, Zefang Liu · 3d
A Unified Evaluation Framework for Trustworthy Large Language Models, Agentic AI, and Multimodal Systems
arXiv cs.AI · Shaina Raza, Ahmed Y. Radwan, Imran Liaquat, Kathryn Hume · 3d
Self Improvement via Fast Tree-search
arXiv cs.AI · Xinghong Fu, Aravinth Kulanthaivelu, Yutaro Yamada · 3d
When Hiring Becomes Agent-Mediated: Evaluating Access and Recurrence in Two-Agent R\'esum\'e Screening
arXiv cs.AI · Jian Gao, Hang Jiang · 3d
Agentic AI Networking for Heterogeneous Unmanned Aerial Systems in Low-Altitude Wireless Networks
arXiv cs.AI · Nguyen Duc Minh Quang, Chang Liu, Shuangyang Li, Derrick Wing Kwan Ng · 3d
Continual Enterprise World Model Discovery in Dynamic Systems
arXiv cs.AI · Shambhavi Mishra, David Vazquez, Perouz Taslakian, Marco Pedersoli, Jose Dolz, Issam H. Laradji · 3d
SIMLIFE: Pattern Understanding for Long-Horizon Human-Agent Partnership
arXiv cs.AI · Run Peng, Zinnia Nie, Jing Ding, Yinpei Dai, Yichi Zhang, Zengqing Wu, Yao Fu, Ziqiao Ma, Jiayuan Mao, Joyce Chai · 3d
From Intent to Action: Benchmarking LLM Safety in Vehicle Voice Command Authorization
arXiv cs.AI · Diba Afroze, Xingli Zhang, Yazhou Tu, Xiali Hei · 3d
Reach or Solve? Attributing Agentic RL Gains with Checkpoint Handoffs
arXiv cs.AI · Xuan Liu, Jingbin Qian · 3d
ScientistTwo: Pioneering the Human Knowledge Frontier with Autonomous AI
arXiv cs.AI · Jaehyun Nam, Jinsung Yoon, Yanzhou Pan, Yubo Wang, Rui Meng, Parthasarathy Ranganathan, Tomas Pfister · 3d
Replan, Repair, or Edit? A Unified Empirical Evaluation of Travel Agents for Itinerary Revision under Resource Disruptions
arXiv cs.AI · Xiaofei Yuan, Yan Zhang, Shaobo Qiao, Huangleshuai He, Leyan Ni, Mingchen Ju, Lujia Yang, Sijia Xu, Yifu Tang, Zhengyi Yang · 3d
When2Think: Learning Difficulty-Aware Length Control for Efficient Hybrid Reasoning Models
arXiv cs.AI · Jaejun Shim, HyunJin Kim, Young Jin Kim, JinYeong Bak · 3d
FINSKILLOPS: A Self-Evolving Multi-Agent System for SEC Filing QA
arXiv cs.AI · Yanzhang Ma, Zhenghan Tai, Hanwei Wu, Sizhe Guan, Jianliang Lei, Hailin He, Chaolong Jiang, Jijun Chi, Tung Sum Thomas Kwok, Bohuai Xiao, Jingrui Tian, Xinlu Wu, Xingao Zhan, Peng Lu, Muzhi Li, Yihong Wu, Liheng Ma, Sicheng Lyu, Tianshuo Yan, Junhao Zhu, Yaqian Xu, Lei Ding, Yufei Cui, Ziquan Liu, Boyu Han, Hengli Liu, Ling Zhou, Xinyu Wang · 3d
LearnActCoder: Role-Aware Error Memory for Adaptive Clinical Coding Agents
arXiv cs.AI · Meysam Ghaffari, Bhaskar Sen, Nasim Sabetpour, Nina Fatehi, Animesh Agarwal, Carlos Morato · 3d
AutoData: Agentic Search for Pre-training Data Selection
arXiv cs.AI · Yan Meng, Dhruv Srikanth, Bingchen Zhao, Zhengyao Jiang, Yuxiang Wu · 3d
Rethinking Multi-Agent Collaboration: When More Is Less
arXiv cs.AI · Yishuo Yuan, Yibo Wu, Yihan Zhang, Minyuan Sun, Shenliang Li, Xinkai Ma, Yifan Li, Jiaheng Liu · 3d
TorchCraft: Unified binder design by inverting an all-atom structure predictor
arXiv cs.AI · TorchCraft Team, Yu Liu, Zhouhanyu Shen, Zhengyi Li, Xikun Huang, Jiaqi Liu, Shuxian Gao, Qilin Yu, Xiayan Qin, Yucheng Zhang, Mingchen Chen · 3d
Integrating knowledge from case reports: a medical ontology based multimodal information system with structured summary
arXiv cs.AI · Shuyu Guo, Lan Huang, Yichen Liu, Hanbin Ma, Tian Bai · 3d
Contagion on the Trading Floor: How Adversarial Signals Spread in Multi-Agent Trading Systems
arXiv cs.AI · Qi Rong Sua, Junhao Dong, Nguyen Duc Thai, Yuqing Wen, Cheston Tan, Yew-Soon Ong · 3d
Steering Equilibrium Selection in Regularized Self-Play via the Reference Policy
arXiv cs.AI · Luis Leal · 3d
MetaRTL: Meta-path Attention Enhanced Relational Table Learning
arXiv cs.AI · Ken Zhong, Weichen Li, Zheng Wang · 3d
A Dual-Process Perspective on Nudge Susceptibility in LLM-Based GUI Agents
arXiv cs.AI · Haya Halimeh, Sascha Kaltenpoth, Kevin B\"osch, Oliver M\"uller · 3d
Constraint-Safe Graph-Context Scoring for Stable Point-Feature Labels Under Text-Width and Accessibility-Inspired Profiles
arXiv cs.AI · Taimoor Ahmad · 3d
Reproducibility is not construct validity: LLM measurement of institutionally situated communication
arXiv cs.AI · Veronika Batzdorfer (KIT), Carlo Romano Marcello Alessandro Santagiustina (ALMAnaCH, m\'edialab, Sciences Po) · 3d
Physical knowledge on historical data matters more than enforcing physical constraints on the forecast
arXiv cs.AI · Etienne Lehembre (CA, LIFO), Pascal Audigane (BRGM), Vincent Nguyen (LIFO), Christel Vrain (LIFO, CA), Thi-Bich-Hanh Dao (LIFO, CA) · 3d
TRACE: Accountable Agentic Retrieval for Source Discovery in Digital Archives
arXiv cs.AI · Donghan Bian (ENC, LRE), Marie Puren (LRE, ENC), Florian Cafiero (LRE, ENC) · 3d
From "Who Is This User?" to "What Does This Purchase Mean?": A Deployed Pipeline for Semantic User Profiling at Bank Scale
arXiv cs.AI · Ryota Mitsuhashi, Tetsuro Morimura, Hirotake Ito · 3d
Beyond Depth Truncation: Controlled Evaluation of Depth Utilization in Recursive Language Models
arXiv cs.AI · Ha Van Dau, Thanh Tung Khuat, Nguyen Thanh Dung · 3d
MaSCoD: A Multi-Agent Framework for Structural-Context-Guided Candidate Causal Graph Generation
arXiv cs.AI · Yudai Nakada, Yuichiro Nishiura, Jin Michael Splichal · 3d
Not All AI Agents Are Equal: Characterizing Resource and Performance Dynamics
arXiv cs.AI · Wonmi Choi, Minuk Park, Zhixiong Niu, Yongqiang Xiong, Chuck Yoo, Gyeongsik Yang · 3d
Neuro-Symbolic Agentic AI for Networked Low-Altitude UAVs
arXiv cs.AI · Yuqi Ping, Tianhao Liang, Nanchi Su, Guangyu Lei, Junwei Wu, Qinyu Zhang, Tingting Zhang · 3d
Customizable and Jointly Optimized Route Planning: A Deep Architecture Enabling Differentiable Shortest-Path Search
arXiv cs.AI · Rui Zhao, Chao Chen, Longfei Xu, Chenguang Ji, Hengbin Cui, Kaikui Liu, Xiaolong Li · 3d
E-AVI: Evidence-Grounded Multimodal Assessment for Automated Video Interviews
arXiv cs.AI · Haoshen Wang, Dongbo Che, Zeyi Xie, Yuanjie Du, Shicheng Hua, Xingyu Wang · 3d
Geopolitical Divisions Across Languages in Large Language Models
arXiv cs.AI · Maxim Chupilkin · 3d