←── back to feed
/topics/arxiv-computational-linguistics-papers-september-23

arXiv computational linguistics papers September 23

31 items1 sourcesupdated 22h agotrend 2

[BLG]blog/rss31
What Does 99% Accuracy Measure? A Reproducible Audit of Shortcut Learning in a Widely Used Fake News Corpus
arXiv cs.CL · Yuvraj Verma · 22h
Training a Language Model End-to-End in Rust: An Experience Report
arXiv cs.CL · Arif Adito · 22h
Same Quantity, Different Answer: Numerical Representation Invariance in Language Models
arXiv cs.CL · Ephraim Atta-Duncan · 22h
A Computational Approach to Measuring Semantic Change in Sanskrit Literature
arXiv cs.CL · Tanay Agrawal · 22h
Retrieved-Span Training for Efficient Query-Focused Meeting Summarization on QMSum
arXiv cs.CL · Edward Xi Yang (Ertas AI) · 22h
From Tone to Trajectory: Continuous Sentiment and the Shape of Monetary Policy Communication
arXiv cs.CL · Martin Feldkircher, M\'arton Kardos, Kristoffer Laigaard Nielbo · 22h
Peerify: Benchmarking Peer-Review Claim Verification
arXiv cs.CL · Alireza Daghighfarsoodeh, Sajad Ebrahimi, Ali Ghorbanpour, Soroush Sadeghian, Radin Cheraghi, Negar Arabzadeh, Ebrahim Bagheri · 22h
AIBuildAI-2.5: Efficient Autonomous AI Model Development Through LLM-Guided Tree Search
arXiv cs.CL · Peijia Qin, Ruiyi Zhang, Qi Cao, Han Guo, Li Zhang, Pengtao Xie · 22h
Prompt Breadth and Rollout Refresh Interact in On-Policy Distillation
arXiv cs.CL · Lingxiang Hu, Tianle Xia, Ming Xu, Yiding Sun, Linfang Shang · 22h
Mitigating LLM Over-Refusal via Dynamic Semantic Routing Calibratione
arXiv cs.CL · Zixuan Wang, Bingjie Zhang, He Zhao, Dandan Guo · 22h
FrontierMath Erd\H{o}s
arXiv cs.CL · Tom Adamczewski (Epoch AI), Thomas F. Bloom (University of Manchester) · 22h
LLM-Driven Training-free Location-Attribute Synergic Fusion: A Closed-Loop Paradigm for Dual-source Encrypted POIs and LULC Mapping
arXiv cs.CL · Chang Li, Xingtao Peng, Yongjun Zhang, Yinfei He, Cairun Huang · 22h
Self-Cleaning and Captured Anyway: One Measured Primitive for Error in a Store an Agent Writes to Itself, and What a Falling Score Actually Measures
arXiv cs.CL · Wenhui Chen, Jianlin Chen, Ziyao Lin, Chi Man Vong · 22h
LatentPort: Beyond KV Cache - Cross-Model Transfer of Recurrent Memory in Hybrid Language Models: A 4B-to-9B Hybrid-State Handoff Without Target Prefix Replay
arXiv cs.CL · Simon P. Villani · 22h
MoM: Memory of Memory
arXiv cs.CL · Bowen Qin, Yao Lu · 22h
ICDAR2026 Competition on Multimodal Reasoning over Documents in Multiple Domains
arXiv cs.CL · Artemis Llabr\'es, Marc Serra Ortega, Tom\`as Ockier, Samuel Ortega Cuadra, Amritpal Singh, Christos Georgakilas, Andrey Barsky, Ernest Valveny, Dimosthenis Karatzas · 22h
Graph-Based Inference for Feedback-Driven Word Deduction: A Scalable Framework for the Jotto Problem
arXiv cs.CL · Dakshi Arora, Prakhar Kumar Srivastava, Ranjib Banerjee · 22h
ChainDoRA: Tensor-Train Factorized Weight-Decomposed Low-Rank Adaptation for Parameter-Efficient LLM Fine-Tuning
arXiv cs.CL · Ashfak Yeafi, Mehedi Hasan, Md Khairul Islam · 22h
Understanding Reliability in LLM-based Human Behavior Simulation
arXiv cs.CL · Pei Wang, Lei Wang, Yuanzi Li, Xu Chen · 22h
ufakzeka-1: Building and Evaluating a 151M-Parameter Turkish Language Model from Scratch
arXiv cs.CL · Sait Furkan Teke (ufak AI) · 22h
Impact Is Not Invalidation: Ask About the Claim, Not the Diff
arXiv cs.CL · Atul Anand · 22h
FinFIRST: Benchmarking Search Agents for Financial Information Retrieval, Sourcing and Traceability
arXiv cs.CL · Wenqing Wang, Haitao Xiang, Xinyi Zhao, Mingming Yin, Ying Zhong, Zhaoxin Huan, Qiheng Zhou, Jin Zhu, Xiaolu Zhang, Shi Chang, Jun Zhou · 22h
FineWeb-CLaR: Culture, Language, and Region Annotations for Benchmark-Aligned Corpus Auditing
arXiv cs.CL · Yusser Al Ghussin, Eva Gavaller, Cristina Espa\~na-Bonet, Josef van Genabith, Simon Ostermann · 22h
TelecomGPT-R1: Unified Post-Training for Reasoning Across Heterogeneous Telecom Tasks
arXiv cs.CL · Bohao Wang, Chenwei Wu, Hang Zou, Yu Tian, Lina Bariah, Li Wei, Chongwen Huang, Yongliang Shen, Zhaoyang Zhang, Merouane Debbah · 22h
Passes Alone, Fails Together: Benchmarking Semantic Coordination in Parallel LLM-Agent Development
arXiv cs.CL · Haocheng Xia, Eugene Wu, Yongjoo Park · 22h
Mining Legal Arguments in U.S. Corporate Case Law
arXiv cs.CL · Luis Brena, William Jurayj, Gregory Deyesu, Zaid Al-Huneidi, Andrew Blair-Stanek, Benjamin Van Durme · 22h
Conduct Under Pressure: What Sixty Language Models Do When a User Pushes
arXiv cs.CL · Tapan Parikh · 22h
Matryoshka attribution: Learning to attribute language model outputs to representations and weights
arXiv cs.CL · Aryaman Arora, Kirill Acharya, Nathan Hu, Yanzhe Zhang, Noah Goodman, Dan Jurafsky, Christopher Potts · 22h
Compressing Long Context into Answer-Aligned Memory Embeddings for LLM Inference
arXiv cs.CL · Md Mostafizer Rahman, Md Faizul Ibne Amin, Md Shahajada Mia, Yutaka Watanobe, Fang Liu · 22h
Qwen3.8-Omni: Towards Native Omni-Modal Agents
arXiv cs.CL · Qwen Team · 22h
From Utterances to Networks: Modelling Slang Adoption and Diffusion Across Subreddits
arXiv cs.CL · Xiaoning Wang, Ted Underwood, Zhewei Sun · 22h