←── back to feed
/topics/arxiv-computational-linguistics-papers-september-21

arXiv computational linguistics papers September 21

39 items1 sourcesupdated 20h agotrend 2

[BLG]blog/rss39
Do small language models know what they don't know?
arXiv cs.CL · Prashant Mudgal · 20h
HERMES: Contrast-Aware Knowledge Graph Reasoning from Clinical Notes for Patient Outcome Prediction
arXiv cs.CL · Gia-Bach Nguyen, Hoang-Ha Nguyen, Tuan-Cuong Vuong, Trang Mai Xuan, Duy Quoc Ngo, Tien-Cuong Nguyen, Huan Vu, Thien Van Luong · 20h
TALON: A Temporally Aware Longitudinal Framework for Radiology Report Generation
arXiv cs.CL · Nien-Tsyr Sun, Min-Chen Chen, Hui Nien Hung, Vincent S. Tseng · 20h
From Discharge Notes to Patient Understanding: Persona-Grounded, Open-Ended Simulation of LLMs as Discharge Educators
arXiv cs.CL · Won Seok Jang, Zonghai Yao, Hong Yu · 20h
Beyond WER: Entity and Disfluency Recall in Accented Conversational ASR
arXiv cs.CL · Fiza Husain, Ankit Pandey, Yash Singh · 20h
SAGE: Schema-Guided LLMs for Grant Review
arXiv cs.CL · Erik Varapaev, Andrei Chetvergov, Stepan Ukolov, Timofei Sivoraksha, Alexander Evseev, Sergey Bolovtsov · 20h
Reviser: Revision-Capable Text Generation via Autoregressive Cursor Actions
arXiv cs.CL · Sean Diab · 20h
Recursive Language Models Generalize Out of Domain
arXiv cs.CL · Chenxiao Yang, Zhiyuan Li, David McAllester, Nathan Srebro · 20h
TatBLiMP: A Benchmark of Linguistic Minimal Pairs for Tatar
arXiv cs.CL · Ilshat Saetov, Dmitry Gaynullin · 20h
Transsion's Speaker-Attributed Multilingual ASR System for the MLC-SLM 2026 Challenge
arXiv cs.CL · Zhecheng Ren, Xuanji He, Xiaoxiao Li, Zhichen Han, Gaoyang Dong, Gaosheng Zhang, Minchuan Chen, Fengjie Zhu · 20h
Towards Secure Cloud-Native Computing: Unveiling Kubernetes Misconfigurations with Large Language Models
arXiv cs.CL · Mostafa Anouar Ghorab, Mohamed Aymen Saied · 20h
A Generative Grammar Underlying the Voynich Manuscript, the Pastiche Hypothesis: Evidence from Large Language Models
arXiv cs.CL · Nicolas Turenne · 20h
PhysioBench: A Unified Benchmark for Physiological Signal Question Answering
arXiv cs.CL · Mengxuan Li, Junfa Chen, Jinze Xia, Yundan Chen, Lixin Fan, Ke Liu, Keyue Shi, Haishuai Wang · 20h
From Generation to Detection: Exploration of Discourse Driven Scenario based LLM Generated Fake News
arXiv cs.CL · Zeynep \"Ozdemir, Murat Osmano\u{g}lu, Sevgi Yi\u{g}it-Sert, \"Omer \"Ozg\"ur Tanr{\i}\"over, Y{\i}lmaz Ar · 20h
Curriculum-Based Noise Adaptation for Phoneme-to-Text Reconstruction in Visual Speech Recognition
arXiv cs.CL · Matthew Kit Khinn Teng, Haibo Zhang, Takeshi Saitoh · 20h
COAL-SQL: Coverage-Guided Augmentation and Failure-Driven Learning for Text-to-SQL Post-Training
arXiv cs.CL · Qifeng Cai, Xuanguang Pan, Hao Liang, Chang Xu, Wentao Zhang · 20h
VISPATH: Visual-Intent-Guided Path Reasoning for Multimodal Knowledge Graph Question Answering
arXiv cs.CL · Jinke Wu, Zhengpin Li, Mengzhe Jia, Yang Li, Wentao Zhang · 20h
Boosting Deepresearch and LongContext Ability with Self-Generated Deepresearch Rollouts Traces
arXiv cs.CL · Zihan Wang, Hao Wang, Boyuan Jiang, Yiqun Zhang, Shi Feng, Xiaocui Yang, Yiwen Ye, Jianghang Lin, Xiaozhong Ji, Jinghao Lin, Kai Wu · 20h
Reading Less While Writing: A Closed-Form Bandwidth Dial for Streaming Multimodal Decoders
arXiv cs.CL · Yasir Mehmood, Kashif Javed · 20h
Rewarding Efficient Reasoning Improves Abstention on Underspecified Tasks in Reasoning Models
arXiv cs.CL · Polina Tsvilodub, Max H\"oth, Michael Franke, Bj\"orn Deiseroth, Carina Kauf · 20h
Reading Anxiety or Reading the Label? Comparing Fine-Tuned and Frontier Models for Anxiety Detection on Social Media
arXiv cs.CL · Cris Huynh, Arlene Pham · 20h
Enhancing Audio Reasoning via Semantic Summary Prediction
arXiv cs.CL · Francesco Bonzi, Pooneh Mousavi, Cem Subakan, Mirco Ravanelli · 20h
MME-Safety: A Fine-grained Benchmark for Safety Evaluation of MLLMs
arXiv cs.CL · Yueming Lyu, Yilian Shi, Haoxiang Tan, Linzhuang Zou, Qihao Wang, Guihua Yu, Jie Qin, Xin Gao, Chenyang Si, Jing Dong, Caifeng Shan · 20h
Generative Artificial Intelligence Chatbots for Motivational Interviewing: A Scoping Review From System Design to Intervention Outcomes
arXiv cs.CL · Runze Hu, Jingqi Kong, Yang Yang, Yihang Yang, Jingyao Liu, Haizhou Tang, Shanghang Zhang, Zheng Liu · 20h
$\mu^2$-Bench: A Multilingual Machine Unlearning Benchmark
arXiv cs.CL · Kyomin Hwang, Hyeonjin Kim, Hyunho Lee, Yearim Kim, Yeji Song, Nojun Kwak · 20h
Aligning with Lived Experience: Heterogeneous Benefits of Fine Tuning in Mental Health Support Generation
arXiv cs.CL · Mohit Chandra, Nabin Kim, Eli Min, Aamogh Sawant, Tanmay Sutar, Munmun De Choudhury · 20h
Geometry of Values: Task Vector Composition for Ethical Preference Alignment in Language Models
arXiv cs.CL · Utkarsh Agarwal, Monojit Choudhury · 20h
From Task Success to Productive Success: Evaluating Human-AI Collaboration by Quality and Cost
arXiv cs.CL · Saki Imai, Mert \.Inan, Malihe Alikhani · 20h
Scaling Forced Alignment to End-User Devices
arXiv cs.CL · Lawry Sorenson, Michael Crandall, Eric K. Ringger, Stephen D. Richardson · 20h
CoLearn: An Agentic Tutor that Learns its Learner in a Human--AI Co-Learning Loop
arXiv cs.CL · Kailai He, Zhihao Wu, Linhai Zhang, Runcong Zhao, Yulan He, Jiazheng Li · 20h
Not All Irregularity Is Equal: Causally Isolating a Rare Failure Mode in Japanese Morphological Inflection
arXiv cs.CL · Wen Zhang · 20h
When Better Turns Do Not Make Better Agents: Diagnosing the Gap Between Next-Turn Metrics and Workflow Success
arXiv cs.CL · Md Tahmid Rahman Laskar, Xue-Yong Fu, Gundeep Singh, Karol Chang, Kevin Sanders, Shi Zong, Tania Habib, Julien Bouvier Tremblay, Shayna Gardiner, Harsh Saini, Matthias Lee, Elena Khasanova, Quinten McNamara, Shashi Bhushan TN · 20h
Hallucination-R1: Robustness-Oriented Paraphrase Generation for Factual Consistency
arXiv cs.CL · Wenhan Yu, Wenxin Wu, Hao Wang, Lei Sha · 20h
Beyond Reference-Based Evaluation: Reward Models for Meta-Evaluation of Grammatical Error Correction
arXiv cs.CL · Ruotian Wu, Bill E. Johnson, Gene Saunders, Osama Hamzeh, Ankit Vadehra, Pascal Poupart · 20h
When Does Reasoning Help in Machine Translation? A Hierarchical Analysis of LRM Reasoning Traces
arXiv cs.CL · Yuxiang Liu, Jiaming Luo, Eleftheria Briakou, Colin Cherry · 20h
How Many Humans Is a Judge Panel Worth?
arXiv cs.CL · Chao Li, Yingying Yu, Yunfeng Li · 20h
From Memory to Behavior: A Behavior-Aware Role-Playing Framework for Social Media Influencers
arXiv cs.CL · Ji-Lun Peng, Yi-Zhen Zhang, Chun-Nan Chou, Yun-Nung Chen · 20h
Beyond Atomic Tokens: Factorizing Syllables for Language Model Pretraining
arXiv cs.CL · Nghia Hieu Nguyen, Thai Bao Huynh, Binh-An Dinh-Le, Phu Gia Hoang, Dat Tien Nguyen, Kiet Van Nguyen, Ngan Luu-Thuy Nguyen · 20h
ArenaFlow: From Trajectory Ranking to Hierarchical Credit Propagation for Open-Ended Agent RL
arXiv cs.CL · Qiang Zhang, Ruixue Ding, Fanrui Zhang, Xi Chen, Boli Chen, Shihang Wang, Yinfeng Huang, Yi Zheng, Pengjun Xie, Kaipeng Zhang, Jiawei Liu, Zheng-Jun Zha · 20h