Sign in

arxiv cs.CL

@arxiv-cs-cl.bsky.social
1.7K followers 0 following 45K posts

Computer Science -- Computation and Language source: export.arxiv.org/rss/cs.CL maintainer: @tmaehara.bsky.social

PostsRepliesMedia
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Haohan Yuan, Simin Chen, Xi Niu, Hanqing Guo, Depeng Xu, Haopeng Zhang Forging LLM Authorship Fingerprints with Targeted Rewriting arxiv.org/abs/2609.38831
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Zizhuo Fu, Runsheng Wang, Meng Li Scaling Parameter and Context in Attention: Native Sparse Attention from Mixture-of-Head arxiv.org/abs/2609.38832
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Xia Hu, Brian Potetz, Chun-Ta Lu, Huanfen Yao, Leonidas Guibas, Zhicheng Wang, Howard Zhou, Pengfei Xing, Andrew Gallagher Where MLLMs Fail and Why: Causal Task Decomposition for Capability Failure Diagnosis arxiv.org/abs/2609.38851
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Sachin Gupta, Divya Godara TRACE: Target-Aware Retrieval, Attributed Evidence, and Contract-Constrained Extraction for LitTraceQA arxiv.org/abs/2609.38861
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Qisheng Su, Hanchen Wang, Guanru Zhu, Huicheng Jiang, Qiuyinzhe Zhang, Kou Shi, Zhen Fang, Ziao Zhang, Qingnan Ren, Zehui Chen, Tao Gui, Feng Zhao GraphForge: Training Working Agents with Graph-Anchored Workspace Synthesis arxiv.org/abs/2609.38923
001
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Yihuai Hong, Shauli Ravfogel, Chen Zhao, Eunsol Choi Making LLMs Say What They Think: Measuring and Improving CoT-Interpretability Alignment arxiv.org/abs/2609.38972
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Srishti Ginjala, Eric Fosler-Lussier, Srinivasan Parthasarathy Fairness Beyond a Single Run: Training-Seed Variability in Speech LLM Adaptation arxiv.org/abs/2609.38976
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Di Huang, Hao Li, Yixin Chen, Fuhai Li When Clipping Reverses Correction: Failure Dynamics of Pointwise Forward-KL On-Policy Self-Distillation arxiv.org/abs/2609.38995
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Ryan Brown, Zihao Fu, Chris Russell Settle: Learning When to Stop Reasoning arxiv.org/abs/2609.38997
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Thomas Serval The Invisible Language Tax: Token Premiums of French and Regional Languages in 2026 LLM Tokenizers, and a French-Optimized Prototype arxiv.org/abs/2609.39001
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Divya Godara, Sachin Gupta Evidence First, Arithmetic Second: A System Report and Failure Analysis for DocSem arxiv.org/abs/2609.39013
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Chenguang Wang, Ming Li, Chengrui Fan, Jianpeng Chen, Han Chen, Tianyi Zhou, Dawei Zhou A Missing Piece for Trustworthy AI Reviewers: From Benchmarking Rhetorical Robustness to SciCore Review arxiv.org/abs/2609.39027
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Wenyi Wu, Minghao Fu, Jieyu You, Kun Zhou, Siqi Liu, Aayush Salvi, Yiheng Lin, Ce Zhang, Xiaohan Lan, Jiahui Zhu, Yujie Zhong, Qi She, Biwei Huang RSIGame: Autonomous Agentic Game Development with Recursive Self-improvement arxiv.org/abs/2609.39045
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Xinkai Chen Structure vs. Chain-of-Thought: Evaluating LLM Criteria Extraction for Depression Severity arxiv.org/abs/2609.39049
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Siyu Song, Rui Xu, Jia Lin, Kai Liu, Weifang Wang CORE: Conflict-Oriented Reasoning Elimination for Verifiable Language-Model Search arxiv.org/abs/2609.39069
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Yida Cai, Xin Dai, Bingxiang He, Huiyuan Xie, Yuxiao Ye, Zhenghao Liu, Yang Bai, Zhiyuan Liu LexReward: A Taxonomy-Driven Reward Framework for Legal Language Models arxiv.org/abs/2609.39071
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Yutong Hu, Jinho Choi Beyond Text: LLM-Based Dimensional Emotion Evaluation in Multimodal Dialogue arxiv.org/abs/2609.39072
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Meijia Chen, Hao Li, Zheng Lu, Hongshan Lin, Junbai Tian, Yichen Liu, Zijun Tian, Yufan Zou, Shuhan Sun, Hanxin Chen, Zeyu Zhang, Weizhi Du, Yueting Li, Tianyu Shi, Alaa Khamis False Frontiers: Diagnosing and Mitigating Co-Cheating in Self-Evolving Search Agents arxiv.org/abs/2609.39102
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Li Ding, Haidi Jin, Chen Ji Bongard: Training Machine Intuition arxiv.org/abs/2609.39111
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Yang Li, Gongle Xue, Yuheng Yuan, Yijia Guo, Shizhe Zhang, Liwen Hu, Lei Ma Diagnosing On-Policy Self-Distillation for Reasoning Language Models arxiv.org/abs/2609.39118
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Hanwen Liu, Yuanfu Sun, Qiaoyu Tan DAGent: Evaluate-then-Grow Planning for Deep Research Agents arxiv.org/abs/2609.39154
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Dat Tien Nguyen, Nghia Hieu Nguyen, Anh Thi-Hoang Nguyen, Dung Ha Nguyen, Kiet Van Nguyen, Ngan Luu-Thuy Nguyen ViLegalExpert: A Large-Scale Benchmark for Vietnamese Legal Retrieval and Question Answering from Real-World Consultations arxiv.org/abs/2609.39189
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Siddharth Bhargava, Sara Tonelli, Patricia Mart\'in-Rodilla, Javier Parapar Argument Structure Prediction in Online Conversations: A Comparative Study of Modeling Paradigms and Task Architectures arxiv.org/abs/2609.39225
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Elia Onofri, Roberto Di Pietro RAIM: Robust Aggregation of Inexpensive Models for Hallucination Detection arxiv.org/abs/2609.39229
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Markus Frey 4MT-VLM: How Coarse Is a VLMs Cognitive Map? arxiv.org/abs/2609.39238
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Aojie Yuan, Zhiyuan Julian Su, Haiyue Zhang, Zijian Su Concept Subspaces Compute Beyond the Logit Lens: A Weights-Only Test for Locating Representations Upstream of Readout arxiv.org/abs/2609.39263
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Bohan Zhang (Southeast University), Linan Yue (Southeast University), Weibo Gao (Hong Kong Polytechnic University), Pengyu Chen (Southeast University), ... Offline Guidance, Online Reasoning: Reusing LLM Feedback for Small Language Models arxiv.org/abs/2609.39346
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Sietse Schelpe Working Around the Compute Ceiling: Byte-Exact Memory in Galahad Makes LLM Reading a One-Time Cost LLM Reading a One-Time Cost arxiv.org/abs/2609.39358
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Jeesu Jung, Hwan Chang, Juseon Do, Jeonghwan Choi, Jinho Choo, Sungwoo Nam, S. K. Hong, Hwanjun Song Ready2Blend: From Natural-Language Instructions to Composable Alignment Prompts arxiv.org/abs/2609.39365
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 03/10/2026
Sean Papay, Roman Klinger Making Grid Beam Search Less Greedy arxiv.org/abs/2609.39368
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 02/10/2026
Jiahe Fan, Si Chen, Yinghao Hou, Wenbo Xia, Ke Xu, Hong Xie, Enhong Chen Exploring Heterogeneous Model Merging Approach for Complex Knowledge Transfer arxiv.org/abs/2609.39369
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 02/10/2026
Bhuvanesh Verma, Ali Abusaleh, Alexander Mehler TTLab at Daleel 2026: STAR-Ar, Sequence Tagging for Argument Recognition in Arabic arxiv.org/abs/2609.39385
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 02/10/2026
Alexey Chernysh, Orkhan Ekhtibarov, Dmitry Zmitrovich QuantCode Model: Specializing Language Models for Executable Algorithmic Trading Code arxiv.org/abs/2609.39420
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 02/10/2026
Keyue Xing, Wentao Ding, Mengmeng Wang, Wenming Tu, Zilong Zheng, Yipeng Kang DuplexAct-Bench: Broadening Full-Duplex Speech Evaluation toward Proactive Interaction across Diverse Behavioral Requirements arxiv.org/abs/2609.39446
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 02/10/2026
Irene Lago, Ana Ezquerro, David Vilares Synthetic Data Characterization via Training Dynamics arxiv.org/abs/2609.39447
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 02/10/2026
Carlotta Schneeberger (Heinrich Heine University D\"usseldorf), Kevin Tang (Heinrich Heine University D\"usseldorf, University of Florida) Right-Wing Rock or Just Rock? A Computational Linguistic Analysis of Frei.Wild arxiv.org/abs/2609.39460
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 02/10/2026
Shuai Wang, Malu Zhang, Mingquan Liu, Weihui Dai, Dehao Zhang, Jieyuan Zhang, Yimeng Shan, Zijian Zhou, Yang Yang Spike-driven Vision-Language-Action Model arxiv.org/abs/2609.39514
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 02/10/2026
Shouli Wang, Yanfeng Jia, Zhihao Ou, Zitao Su, Ruize He, Haotong Xie, Hao Peng, Juanzi Li, Xiaozhi Wang CATCH: A Controllable Analysis Testbed for Reward Hacking in Coding RL arxiv.org/abs/2609.39533
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 02/10/2026
Michaela Regneri, Nina Scheller, S\"oren Laue Compact Language, Complex Model Shifts: How and Where Ambiguity and Underspecification Affect LLMs arxiv.org/abs/2609.39572
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 02/10/2026
Minghan Wang, Boyuan Wang, Jinhang Zuo, Yuxin Tao, Fang kong Thinking Outside the Box: Can Language Models Rely on External Guidance Selectively? arxiv.org/abs/2609.39578
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 02/10/2026
Haoyang Zhang, Jianpeng Zhao, Qi Hao, Pengyang Wang Is This Evidence Decision-Critical? Learning to Verify Rule-Governed Decisions arxiv.org/abs/2609.39608
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 02/10/2026
Liangyu Teng, Yicheng Ding, Jing Liu, Hengsong Liu, Juncen Guo, Hongru Li, Jingyu Zhang, Liang Song Marginal Response Surface Elicitation for Zero-Label Tabular Learning arxiv.org/abs/2609.39639
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 02/10/2026
Dalton Raphael Harmsen, Swier Garst, Thomas van Osch, Zar\`e Palanciyan, Joaquin Vanschoren Zero-Compute Cross-Lingual Transferability Estimation Using Typological Feature Proxies arxiv.org/abs/2609.39640
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 02/10/2026
Weijie Ren, Yanwen Zhang, Hao Li, Zhuolin Qi, Hengyi Zhang, Naibo Wang SEPAL: Separated Expert Pairs with Answer-Level Fusion for Reliable LLM Collaboration arxiv.org/abs/2609.39645
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 02/10/2026
Zhentao Tan, Jingyi Shen, Yanbo Li, Yao Liu, Yue Wu, Jieping Ye The Evolution of Attention in Large Language Models: Mechanisms, Trade-offs, and Emerging Trends arxiv.org/abs/2609.39661
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 02/10/2026
Xincheng Wei, Yifan Ding, Yoshua Li, Yuquan Lu, Ziheng Li, Yi Lu, Dongsheng Ma, Rongxiang Weng, Xunliang Cai Better Supervision Is Nearby: Neighborhood On-Policy Self-Distillation arxiv.org/abs/2609.39687
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 02/10/2026
Vsevolod Karimov, Stepan Ostarkov, Anastasia Poroshina, Anatoly Frolov, Alexander Panchenko Drift Inspector: Exploring and Measuring Scientific Drift with Atomic Contribution Claims arxiv.org/abs/2609.39710
000
arxiv cs.CL @arxiv-cs-cl.bsky.social · 02/10/2026
Xiaoqiang Wang, Suyuchen Wang, Bang Liu LatentHarness: Learning Latent Actions for Memory and Reasoning via Counterfactual Policy Distillation arxiv.org/abs/2609.39740
001
arxiv cs.CL @arxiv-cs-cl.bsky.social · 02/10/2026
Xiaoqiang Wang, Bang Liu MemCodex: Self-Programming Hierarchical Memory for Language Agents arxiv.org/abs/2609.39765
010
arxiv cs.CL @arxiv-cs-cl.bsky.social · 02/10/2026
Ola El Khatib, Djellel Difallah Explore-on-Graph: Hybrid Embedding-LLM Reasoning for Knowledge Graph Question Answering under Incompleteness arxiv.org/abs/2609.39786
000