arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

Annual Meeting of the Association for Computational Linguistics · 会议 · Natural Language Processing

共收录 10304
2601.06559 2026-04-17 cs.CV

ArrowGEV: Grounding Events in Video via Learning the Arrow of Time

ArrowGEV:通过学习时间之箭来视频中接地事件

Fangxu Yu, Ziyao Lu, Liqiang Niu, Fandong Meng, Jie Zhou

机构 * School of Artificial Intelligence, Nanjing University, China(南京大学人工智能学院,中国) Pattern Recognition Center, WeChat AI, Tencent Inc, China(腾讯人工智能研究院,中国)

AI总结 本文提出ArrowGEV框架,通过学习时间方向性提升视频中事件接地与时间理解能力,通过区分时间敏感和时间不敏感事件增强模型鲁棒性与泛化能力。

Comments Accepted to Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14509 2026-04-17 cs.SE cs.AI cs.CL

E2Edev: Benchmarking Large Language Models in End-to-End Software Development Task

E2EDev:端到端软件开发任务中大语言模型的基准测试

Jingyao Liu, Chen Huang, Zhizhao Guan, Wenqiang Lei, Yang Deng

机构 * College of Computer Science, Sichuan University(四川大学计算机学院) Institute of Data Science, National University of Singapore(新加坡国立大学数据科学研究所) CHAT NLP Group, Singapore Management University(新加坡国立管理大学CHAT NLP组) Engineering Research Center of Machine Learning and Industry Intelligence, Ministry of Education, China(教育部长机器学习与产业智能工程研究中心)

AI总结 本文提出E2EDev基准,基于行为驱动开发原则,通过模拟真实用户交互评估端到端软件开发框架的能力,揭示现有方法在解决复杂任务中的不足。

Comments Accepted to ACL 2026 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07890 2026-04-17 cs.CL

Standard-to-Dialect Transfer Trends Differ across Text and Speech: A Case Study on Intent and Topic Classification in German Dialects

标准到方言的转移趋势在文本和语音上有所不同:以德语方言意图和主题分类的案例研究

Verena Blaschke, Miriam Winkler, Barbara Plank

机构 * MaiNLP lab, CIS, LMU Munich, Germany(慕尼黑大学自然语言处理实验室、计算机研究所、慕尼黑大学,德国) Munich Center for Machine Learning, Germany(慕尼黑机器学习中心,德国)

AI总结 研究比较了标准到方言的文本和语音转移效果,发现语音处理在方言数据上表现最佳,而文本处理在标准数据上更优,同时提出了首个方言语音意图分类数据集。

Comments ACL 2026 (main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15066 2026-04-17 cs.LG cs.AI cs.MM

Time-RA: Towards Time Series Reasoning for Anomaly Diagnosis with LLM Feedback

Time-RA:面向时间序列推理的异常诊断方法:基于LLM反馈

Yiyuan Yang, Zichuan Liu, Lei Song, Kai Ying, Zhiguang Wang, Tom Bamford, Svitlana Vyetrenko, Jiang Bian, Qingsong Wen

机构 * University of Oxford(牛津大学) Nanjing University(南京大学) MSRA(微软研究院) SJTU(上海交通大学) Abel AI Outsampler University of Strasbourg(斯特拉斯堡大学) Squirrel Ai Learning(Squirrel AI学习)

AI总结 本文提出Time-RA,通过引入RATs40K多模态数据集,改进时间序列异常检测的生成式推理方法,提升诊断准确性和解释性,实现可解释的多模态时间序列分析。

Comments ACL 2026 Findings. 27 pages, 11 figures, 15 tables. Code and dataset are publicly available

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19807 2026-04-17 cs.AI cs.CL cs.CV cs.LG cs.MA

KnowRL: Exploring Knowledgeable Reinforcement Learning for Factuality

KnowRL: 探索知识增强型强化学习以提升事实性

Baochang Ren, Shuofei Qiao, Da Zheng, Huajun Chen, Ningyu Zhang

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团) Zhejiang University - Ant Group Joint Laboratory of Knowledge Graph(知识图谱联合实验室)

AI总结 KnowRL通过整合事实性奖励提升慢思考模型的事实准确性,实验表明其有效缓解了幻觉问题并保持推理能力。

Comments ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20214 2026-04-17 cs.AI

When Slower Isn't Truer: Inverse Scaling Law of Truthfulness in Multimodal Reasoning

当慢并非真:多模态推理中真理性的反比例定律

Sitong Fang, Wenjing Cao, Jiahao Li, Xuyao Wang, Juntao Dai, Chi-Min Chan, Sirui Han, Yike Guo, Yaodong Yang, Jiaming Ji

机构 * Institute for AI(人工智能研究院) Peking University(北京大学) Hong Kong University of Science and Technology(香港科技大学)

AI总结 研究探讨了多模态推理中慢思考模式的反比例定律,发现慢思考模型在面对不完整或误导性视觉输入时更易生成虚假细节,揭示了推理模型在处理模糊输入时的脆弱性。

Comments Accepted at ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.16409 2026-04-17 cs.CL cs.CY

Counterfactual Probing for the Influence of Affect and Specificity on Intergroup Bias

反事实探测用于情感和特异性对群体偏见的影响

Venkata S Govindarajan, Kyle Mahowald, David I. Beaver, Junyi Jessy Li

机构 * Department of Linguistics(语言学系) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

AI总结 本文通过反事实探测研究情感和特异性如何影响群体偏见,发现神经模型在预测群体关系标签时可靠使用情感,但特异性的使用不明确。

Comments To appear in Findings of ACL 2023

Journal ref Findings of the Association for Computational Linguistics: ACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.06687 2026-04-17 cs.CL

How people talk about each other: Modeling Generalized Intergroup Bias and Emotion

人们如何谈论彼此:建模一般化的群体偏见和情感

Venkata S Govindarajan, Katherine Atwell, Barea Sinno, Malihe Alikhani, David I. Beaver, Junyi Jessy Li

机构 * Department of Linguistics, The University of Texas at Austin(德克萨斯大学奥斯汀分校语言学系) Department of Computer Sciences, University of Pittsburgh(匹兹堡大学计算机科学系) Department of Political Science, Rutgers University(罗格斯大学政治学系)

AI总结 本文探讨了群体偏见的广义建模,通过细粒度的人际情感预测人际关系,构建了首个标注人际情感的英文推文数据集,展示了神经模型在识别偏见方面的优越性能。

Comments To be presented at EACL 2023

Journal ref Proceedings of the 17th Conference of the European Chapter of the Association for Computational Linguistics 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
1901.11429 2026-04-17 cs.CL

Decomposing Generalization: Models of Generic, Habitual, and Episodic Statements

分解泛化:通用、习惯性和事件性陈述的模型

Venkata Subrahmanyan Govindarajan, Benjamin Van Durme, Aaron Steven White

机构 * University of Rochester(罗切斯特大学) Johns Hopkins University(约翰霍普金斯大学)

AI总结 本文提出语义框架建模泛化表达,构建涵盖Universal Dependencies数据集,并验证类型级和词级信息在预测泛化表达中的有效性。

Journal ref Transactions of the Association for Computational Linguistics, 2019, Volume 7

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14885 2026-04-17 cs.CL cs.AI

RACER: Retrieval-Augmented Contextual Rapid Speculative Decoding

RACER:检索增强的上下文快速推测解码

Zihong Zhang, Zuchao Li, Lefei Zhang, Ping Wang, Hai Zhao

机构 * School of Artificial Intelligence, Wuhan University(武汉大学人工智能学院) School of Computer Science, Wuhan University(武汉大学计算机学院) School of Information Management, Wuhan University(武汉大学信息管理学院) School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机学院)

AI总结 RACER通过整合检索的精确模式与logit驱动的未来提示,提升大语言模型的推理效率,实现超过2倍的加速,优于现有无训练方法。

Comments Accepted to Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14856 2026-04-17 cs.CL cs.AI

ClimateCause: Complex and Implicit Causal Structures in Climate Reports

气候原因:气候报告中的复杂和隐含因果结构

Liesbeth Allein, Nataly Pineda-Castañeda, Andrea Rocci, Marie-Francine Moens

机构 * Department of Computer Science, KU Leuven, Belgium(比利时库勒芬大学计算机科学系) Department of Electronics and Information Systems, Ghent University, Belgium(比利时根特大学电子与信息系统系) Institute of Argumentation, Linguistics, and Semiotics (IALS), Università della Svizzera italiana, Switzerland(瑞士意大利大学论证、语言学与象征学研究所)

AI总结 本文提出ClimateCause数据集,通过专家标注揭示气候报告中的高阶因果结构,包括隐含和嵌套因果关系,用于提升因果推理和可读性量化。

Comments Accepted to ACL 2026 [Findings]

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14847 2026-04-17 cs.AI

TrigReason: Trigger-Based Collaboration between Small and Large Reasoning Models

TrigReason:基于触发的大小推理模型协作

Yi Zhao, Yajuan Peng, Cam-Tu Nguyen, Zuchao Li, Xiaoliang Wang, Xiaoming Fu, Hai Zhao

机构 * AGI Institute, School of Computer Science, Shanghai Jiao Tong University, Shanghai, China(AGI研究院,计算机科学学院,上海交通大学,上海,中国) Key Laboratory of Shanghai Education Commission for Intelligent Interaction and Cognitive Engineering, Shanghai Jiao Tong University, Shanghai, China(上海市教育委员会智能交互与认知工程重点实验室,上海交通大学,上海,中国) Shanghai Key Laboratory for Intelligent Information Processing, Fudan University(上海市智能信息处理重点实验室,复旦大学) State Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学) School of Artificial Intelligence, Wuhan University(人工智能学院,武汉大学) Institute of Computer Science, University of Göttingen, Göttingen, Germany(计算机科学研究所,哥廷根大学,哥廷根,德国)

AI总结 本文提出TrigReason框架,通过触发机制将大部分推理任务交给小型模型,仅在必要时调用大模型,提升推理效率与准确性。

Comments ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14808 2026-04-17 cs.CL

Modeling LLM Unlearning as an Asymmetric Two-Task Learning Problem

将LLM去学习视为一个非对称的双任务学习问题

Zeguan Xiao, Siqing Li, Yong Wang, Xuetao Wei, Jian Yang, Yun Chen, Guanhua Chen

机构 * Shanghai University of Finance and Economics(上海金融学院) Alibaba Group(阿里巴巴集团) Southern University of Science and Technology(南方科技大学) Beihang University(北航) MoE Key Laboratory of Interdisciplinary Research of Computation and Economics(计算与经济交叉学科研究教育部重点实验室)

AI总结 本文将LLM去学习视为非对称双任务问题,提出优先保留的梯度合成框架,通过分离任务特定梯度提取与冲突感知组合,改进梯度冲突解决方法,实验证明通过重塑梯度几何而非重新平衡损失,有效缓解去学习-保留的权衡。

Comments ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14773 2026-04-17 cs.CL

CoPA: Benchmarking Personalized Question Answering with Data-Informed Cognitive Factors

CoPA:基于数据驱动认知因素的个性化问答基准测试

Hang Su, Zequn Liu, Chen Hu, Xuesong Lu, Yingce Xia, Zhen Liu

机构 * East China Normal University(东华师范大学) Zhongguancun Academy(中关村学院)

AI总结 本文提出CoPA基准,通过挖掘社区-个体偏好分歧,提炼六个个性化因素,用于细粒度评估模型输出与用户认知偏好的匹配程度,提升个性化问答评估的全面性与区分度。

Comments Accepted to ACL. 30 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14768 2026-04-17 cs.AI

CoTEvol: Self-Evolving Chain-of-Thoughts for Data Synthesis in Mathematical Reasoning

CoTEvol:用于数学推理数据合成的自演化思维链

Zhuo Wang, Zhuo Zhang, Yafu Li, Yu Cheng, Lizhen Qu, Zenglin Xu

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) The Chinese University of Hong Kong(香港中文大学) Monash University(墨尔本大学) Independent Researcher(独立研究者) Shanghai Academy of AI for Science(上海人工智能科学研究院)

AI总结 本文提出CoTEvol,一种基于遗传算法的思维链生成框架,通过全局交叉和局部突变提升生成准确性和多样性,实验表明其在数学推理任务中效果优于传统方法。

Comments acl2026 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14749 2026-04-17 cs.CL cs.AI

Which bird does not have wings: Negative-constrained KGQA with Schema-guided Semantic Matching and Self-directed Refinement

没有翅膀的鸟:带有模式引导语义匹配和自导向细化的负约束知识图谱问答

Midan Shim, Seokju Hwang, Kaehyun Um, Kyong-Ho Lee

机构 * Department of Computer Science, Yonsei University(延世大学计算机科学系)

AI总结 本文提出负约束知识图谱问答任务NEST-KGQA,设计PyLF逻辑形式和CUCKOO框架,通过模式引导语义匹配和自导向细化提升负约束问题的解答能力。

Comments ACL 2026 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14672 2026-04-17 cs.CL

SPAGBias: Uncovering and Tracing Structured Spatial Gender Bias in Large Language Models

SPAGBias:揭示和追踪大型语言模型中的结构化空间性别偏见

Binxian Su, Haoye Lou, Shucheng Zhu, Weikang Wang, Ying Liu, Dong Yu, Pengyuan Liu

机构 * School of Information Science, Beijing Language and Culture University(北京语言大学信息科学学院) Libraries, Renmin University of China(中国人民大学图书馆) School of Humanities, Tsinghua University(清华大学人文学院) Shanghai University of Finance and Economics(上海财经大学) National Print Media Language Resources Monitoring & Research Center(国家印刷媒体语言资源监测与研究中心)

AI总结 本文提出SPAGBias框架,系统评估LLM中的空间性别偏见,通过62种城市微空间分类、提示库和三层诊断方法,揭示性别空间关联及偏见来源,扩展了偏见研究到空间领域。

Comments Accepted by ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14644 2026-04-17 cs.CL cs.LG

CURaTE: Continual Unlearning in Real Time with Ensured Preservation of LLM Knowledge

CURaTE:在实时中实现连续反学习以确保大语言模型知识的保留

Seyun Bae, Seokhan Lee, Eunho Yang

机构 * KT Corporation(KT公司) KAIST(韩国科学技术院)

AI总结 本文提出CURaTE方法,通过训练句子嵌入模型实现实时连续反学习,有效提升遗忘效果并保持知识完整性。

Comments Accepted to Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14631 2026-04-17 cs.CL cs.AI

StoryCoder: Narrative Reformulation for Structured Reasoning in LLM Code Generation

StoryCoder: 为LLM代码生成中的结构化推理提供叙述改写

Geonhui Jang, Dongyoon Han, YoungJoon Yoo

机构 * Dept. of Artificial Intelligence, Chung-Ang University(Chung-Ang 大学人工智能系) NAVER AI Lab(NAVER AI 实验室)

AI总结 StoryCoder通过将代码生成问题转化为连贯的自然语言叙述,提升模型推理和规划能力,实验显示在多个数据集上平均提升18.7%的零样本准确率,且改进了算法策略和代码结构。

Comments 21 pages, 12 figures. ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14602 2026-04-17 cs.CL cs.AI

CausalDetox: Causal Head Selection and Intervention for Language Model Detoxification

CausalDetox:语言模型去毒化的因果头部选择与干预

Yian Wang, Yuen Chen, Agam Goyal, Hari Sundaram

机构 * Department of Computer Science(计算机科学系)

AI总结 本文提出CausalDetox框架,通过因果分析识别并干预导致有毒生成的特定注意力头,利用PNS方法隔离必要且充分的头部,结合局部推理干预和PNS引导微调策略,有效提升去毒效果并保持语言流畅性。

Comments Accepted to ACL 2026. 22 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14564 2026-04-17 cs.AI cs.CL

MARS$^2$: Scaling Multi-Agent Tree Search via Reinforcement Learning for Code Generation

MARS$^2$:通过强化学习提升多智能体树搜索用于代码生成

Pengfei Li, Shijie Wang, Fangyuan Li, Yikun Fu, Kaifeng Liu, Kaiyan Zhang, Dazhi Zhang, Yuqiang Li, Biqing Qi, Bowen Zhou

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Innovation Institute(上海创新研究院) Harbin Institute of Technology(哈尔滨工业大学) Tsinghua University(清华大学)

AI总结 MARS$^2$通过多智能体协作与树搜索结合,提升强化学习在代码生成中的性能,实验表明其在多种模型和训练设置下均有效。

Comments Accepted by ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14528 2026-04-17 cs.AI cs.CL

Dissecting Failure Dynamics in Large Language Model Reasoning

解析大语言模型推理中的故障动态

Wei Zhu, Jian Zhang, Lixing Yu, Kun Yue, Zhiwen Tang

机构 * School of Information Science and Engineering, Yunnan University, Kunming, China(云南大学信息科学与工程学院,昆明,中国) Yunnan Key Laboratory of Intelligent Systems and Computing, Kunming, China(云南省智能系统与计算重点实验室,昆明,中国)

AI总结 研究揭示大语言模型推理错误多源于早期少量转换点,提出GUARD框架通过不确定性信号引导干预,提升推理可靠性。

Comments Accepted by ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14459 2026-04-17 cs.CL

Filling in the Mechanisms: How do LMs Learn Filler-Gap Dependencies under Developmental Constraints?

填补机制:语言模型如何在发育约束下学习填充-缺口依赖?

Atrey Desai, Sathvik Nair

机构 * University of Maryland(马里兰大学)

AI总结 研究通过DAS分析语言模型在不同数据量下的填充-缺口依赖表示,发现有限数据下存在共享但敏感的机制,但语言模型仍需更多数据才能达到人类水平,凸显语言特异性偏见的重要性。

Comments To be published in the 64th Annual Meeting of the Association for Computational Linguistics

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14362 2026-04-17 cs.CL cs.AI cs.IR

APEX-MEM: Agentic Semi-Structured Memory with Temporal Reasoning for Long-Term Conversational AI

APEX-MEM: 基于时序推理的代理半结构化记忆用于长期对话AI

Pratyay Banerjee, Masud Moshtaghi, Shivashankar Subramanian, Amita Misra, Ankit Chadha

机构 * Amazon(亚马逊)

AI总结 APEX-MEM通过结合属性图、只追加存储和多工具检索代理,解决大语言模型在长期对话记忆中的可靠性问题,实现88.88%的LOCOMO问答准确率和86.2%的LongMemEval表现。

Comments Accepted to ACL 2026 Mains

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14324 2026-04-17 cs.CL

Purging the Gray Zone: Latent-Geometric Denoising for Precise Knowledge Boundary Awareness

清除灰区:用于精确知识边界意识的潜在几何去噪

Hao An, Yibin Lou, Jiayi Guo, Yang Xu

机构 * Computational Linguistics and Consciousness Sciences Lab(计算语言学与意识科学实验室)

AI总结 本文提出GeoDe框架,通过几何去噪方法减少模型在决策边界附近的模糊性,提升模型的准确性和泛化能力。

Comments ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13592 2026-04-17 cs.CL

Foresight Optimization for Strategic Reasoning in Large Language Models

为大语言模型中的战略推理进行前瞻性优化

Jiashuo Wang, Jiawen Duan, Jian Wang, Kaitao Song, Chunpu Xu, Johnny K. W. Ho, Fenggang Yu, Wenjie Li, Johan F. Hoorn

机构 * Department of Computing, Hong Kong Polytechnic University(香港理工大学计算机系) Department of Language Science and Technology, Hong Kong Polytechnic University(香港理工大学语言科学与技术系) Apple(苹果公司) School of Design, Hong Kong Polytechnic University(香港理工大学设计学院) Research Institute for Quantum Technology, Hong Kong Polytechnic University(香港理工大学量子技术研究所) Department of Communication Science, Vrije Universiteit Amsterdam(阿姆斯特丹自由大学传播科学系)

AI总结 本文提出FoPO方法,通过整合对手建模原理提升大语言模型的战略推理能力,验证了其在不同规模和来源的LLM中的有效性及泛化能力。

Comments ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12452 2026-04-17 cs.CL

Latent-Condensed Transformer for Efficient Long Context Modeling

基于MLA的潜在压缩Transformer用于高效长上下文建模

Zeng You, Yaofo Chen, Qiuwu Chen, Ying Sun, Shuhai Zhang, Yingjian Li, Yaowei Wang, Mingkui Tan

机构 * South China University of Technology(南方科技大学) Pengcheng Laboratory(鹏城实验室) AIGCode Harbin Institute of Technology(哈尔滨工业大学) Pazhou Laboratory(琶洲实验室)

AI总结 本文提出Latent-Condensed Attention,通过在MLA的潜在空间内压缩上下文,减少计算成本和KV缓存,同时保持性能。

Comments Accepted by ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12210 2026-04-17 cs.AI cs.CL

Beyond Prompt: Fine-grained Simulation of Cognitively Impaired Standardized Patients via Stochastic Steering

超越提示:通过随机引导实现认知障碍标准化患者细粒度模拟

Weikang Zhang, Zimo Zhu, Zhichuan Yang, Chen Huang, Wenqiang Lei, See-Kiong Ng

机构 * School of Software, Xi’an Jiaotong University(西安交通大学软件学院) Institute of Data Science, National University of Singapore(新加坡国立大学数据科学研究所) College of Computer Science, Sichuan University(四川大学计算机学院) Engineering Research Center of Machine Learning and Industry Intelligence, Ministry of Education, China(教育部机器学习与工业智能工程研究中心,中国)

AI总结 本文提出StsPatient方法,通过提取对比指令与响应的引导向量,实现对认知障碍患者细粒度模拟,提升临床真实性与严重程度可控性。

Comments Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11600 2026-04-17 cs.CV

Geoparsing: Diagram Parsing for Plane and Solid Geometry with a Unified Formal Language

几何解析:一种统一形式语言用于平面和立体几何的图表解析

Peijie Wang, Ming-Liang Zhang, Jun Cao, Chao Deng, Dekang Ran, Hongda Sun, Pi Bu, Xuan Zhang, Yingyao Wang, Jun Song, Bo Zheng, Fei Yin, Cheng-Lin Liu

机构 * MAIS, Institute of Automation of Chinese Academy of Sciences(中国科学院自动化研究所MAIS) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Future Living Lab of Alibaba(阿里巴巴未来生活实验室)

AI总结 本文提出一种统一形式语言,结合平面和立体几何,构建了GDP-29K数据集,通过监督微调与可验证奖励的强化学习提升几何解析性能,提升MLLMs的几何推理能力。

Comments Accepted to ACL2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11427 2026-04-17 cs.CL cs.AI

METRO: Towards Strategy Induction from Expert Dialogue Transcripts for Non-collaborative Dialogues

METRO:面向非协作对话的专家对话 transcripts 中的策略诱导

Haofu Yang, Jiaji Liu, Chen Huang, Faguo Wu, Wenqiang Lei, See-Kiong Ng

机构 * National University of Singapore(新加坡国立大学) Nankai University(南开大学) Sichuan University(四川大学) School of Artificial Intelligence, Beihang University(北航人工智能学院) Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing(北京未来区块链与隐私计算高级创新中心) Key Laboratory of Mathematics, Informatics and Behavioral Semantics (LMIB)(数学、信息学与行为语义学重点实验室(LMIB)) Engineering Research Center of Machine Learning and Industry Intelligence, Ministry of Education, China(教育部机器学习与工业智能工程研究中心,中国)

AI总结 METRO 通过大规模语言模型从原始 transcripts 自动诱导策略动作和规划逻辑,提出策略森林结构,实验显示其在两个基准上性能优越,具有跨任务迁移能力。

Comments ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏