arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 5021 信号源:cs.CL, cs.AI, cs.LG

1. 复杂问题求解 5021 篇

2605.00891 2026-05-05 cs.CV cs.AI 57%

X2SAM: Any Segmentation in Images and Videos

X2SAM:图像和视频中的任意分割

Hao Wang, Limeng Qiao, Chi Zhang, Lin Ma, Guanglu Wan, Xiangyuan Lan, Xiaodan Liang

机构 * Sun Yat-Sen University(中山大学) Peng Cheng Laboratory(鹏城实验室)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

AI总结 X2SAM是一种统一的分割多模态大语言模型,能够将图像分割能力扩展到视频,结合LLM和Mask Memory模块,支持通用、开放词汇、指称、推理、基于视觉的对话生成及交互式分割。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00880 2026-05-05 cs.CV cs.AI 57%

Adversarial Flow Matching for Imperceptible Attacks on End-to-End Autonomous Driving

对抗流匹配用于端到端自动驾驶中的不可察觉攻击

Xinyu Zeng, Xiangkun He, Lei Tao, Chen Lv, Hong Cheng

机构 * Shenzhen Institute for Advanced Study, University of Electronic Science and Technology of China(深圳先进研究院,电子科技大学) School of Mechanical and Aerospace Engineering, Nanyang Technological University(南洋理工大学机械与航空航天工程学院) School of Mechanical and Electrical Engineering, University of Electronic Science and Technology of China(电子科技大学机械与电气工程学院)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

AI总结 本文提出对抗流匹配(AFM)框架,通过利用Transformer结构漏洞生成高效且视觉不可察觉的对抗样本,有效降级VLA和模块化自动驾驶代理性能,同时保持先进的视觉不可察觉性及跨模型迁移能力。

Comments 16 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13933 2026-05-04 cs.AI 57%

HyMem: Hybrid Memory Architecture with Dynamic Retrieval Scheduling

HyMem:混合内存架构与动态检索调度

Xiaochen Zhao, Kaikai Wang, Xiaowen Zhang, Chen Yao, Aili Wang

机构 * ZJU-UIUC Institute(浙大-伊利诺伊大学联合研究院) Ant Group(蚂蚁集团)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

AI总结 HyMem通过多粒度内存表示实现动态按需调度,结合轻量级模块和LLM深度模块,有效平衡效率与性能,在长时记忆管理中取得新突破。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00376 2026-05-01 cs.SE cs.AI 57%

In Line with Context: Repository-Level Code Generation via Context Inlining

与上下文一致:通过上下文内联实现仓库级代码生成

Chao Hu, Wenhao Zeng, Yuling Shi, Beijun Shen, Xiaodong Gu

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

AI总结 本文提出InlineCoder框架,通过内联未完成函数到调用图中,将仓库理解转化为更易处理的函数级编码任务,提升仓库级代码生成能力。

Comments Accepted to FSE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16496 2026-04-30 cs.CL 57%

AdaMem: Adaptive User-Centric Memory for Long-Horizon Dialogue Agents

AdaMem:面向长时对话代理的自适应用户导向记忆

Shannan Yan, Jingchen Ni, Leqi Zheng, Jiajun Zhang, Peixi Wu, Dacheng Yin, Jing Lyu, Chun Yuan, Fengyun Rao

机构 * Tsinghua University(清华大学) WeChat Vision, Tencent Inc.(腾讯微信视觉实验室)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

AI总结 AdaMem通过自适应用户导向记忆框架提升长时对话代理的长时推理与用户建模能力,采用统一框架整合工作记忆、事件记忆、人格记忆和图记忆,实现高效信息组织与推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11295 2026-04-30 cs.CL 57%

The Prompt Engineering Report Distilled: Quick Start Guide for Life Sciences

提示工程报告精简:生命科学领域的快速入门指南

Valentin Romanov, Steven A Niederer

机构 * National Heart & Lung Institute, Faculty of Medicine, Imperial College London(英国伦敦帝国学院医学院国家心脏和肺研究所)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

AI总结 本文总结了生命科学领域中6种核心提示工程技巧,包括零样本、少样本、思考生成等,旨在提升LLM在文献总结、数据提取等任务中的效率与质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25931 2026-04-30 cs.CL 57%

Anchored Confabulation: Partial Evidence Non-Monotonically Amplifies Confident Hallucination in LLMs

锚定编造:部分证据非单调放大LLM中的自信幻觉

Ashish Balkishan Lathkar

机构 * Florida State University(佛罗里达州立大学)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

AI总结 研究揭示了大语言模型中一种新校准特性:提供一个确认的中间事实可非单调放大自信错误答案率。通过六个证据线证明了参数幻觉信心(PHC)概念,并在RAG路由中应用,显著提升性能。

Comments 62 pages, 5 figures. Preprint under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05110 2026-04-29 cs.AI 57%

GlimpRouter: Efficient Collaborative Inference by Glimpsing One Token of Thoughts

GlimpRouter: 通过窥视一个思考标记实现高效的协作推理

Wenhao Zeng, Xuteng Zhang, Yuling Shi, Chao Hu, Yuting Chen, Beijun Shen, Xiaodong Gu

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

AI总结 本文提出GlimpRouter框架,通过分析推理步骤首个标记的熵值来决定是否调用大模型,从而减少推理延迟并保持精度。

Comments Accepted to ACL 2026 Findings. Code available at https://github.com/Zengwh02/GlimpRouter

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25506 2026-04-29 cs.NI cs.AI 57%

Assistants, Not Architects: The Role of LLMs in Networked Systems Design

助手,而非架构师:大语言模型在联网系统设计中的作用

Pratyush Sahu, Rahul Bothra, Venkat Arun, Brighten Godfrey, Akshay Narayan, Ahmed Saeed

机构 * Georgia Tech(佐治亚理工学院) UIUC(伊利诺伊大学香槟分校) UT Austin(得克萨斯大学奥斯汀分校) Brown University(布朗大学)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

AI总结 本文探讨了大语言模型在联网系统架构设计中的局限性,并提出Kepler框架,结合专家驱动的规范与SMT优化,实现可行的设计方案并支持可解释的设计探索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25296 2026-04-29 cs.CL 57%

Learning from Medical Entity Trees: An Entity-Centric Medical Data Engineering Framework for MLLMs

从医学实体树学习:一种以实体为中心的医疗数据工程框架用于多模态大语言模型

Jianghang Lin, Haihua Yang, Deli Yu, Kai Wu, Kai Ye, Jinghao Lin, Zihan Wang, Yuhang Wu, Liujuan Cao

机构 * Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University, China(中国教育部多媒体可信感知与高效计算重点实验室,厦门大学,中国) ByteDance(字节跳动) Northeastern University(东北大学)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

AI总结 本文提出以实体为中心的医疗数据工程框架,通过构建医学实体树,提升多模态大语言模型在医疗领域的表现,通过实体引导检索、双重过滤和知识感知数据合成等方法,增强模型处理复杂临床问题的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25256 2026-04-29 cs.AI 57%

AutoResearchBench: Benchmarking AI Agents on Complex Scientific Literature Discovery

AutoResearchBench:基于复杂科学文献发现的AI代理基准测试

Lei Xiong, Kun Luo, Ziyi Xia, Wenbo Zhang, Jin-Ge Yao, Zheng Liu, Jingying Shao, Jianlyu Chen, Hongjin Qian, Xi Yang, Qian Yu, Hao Li, Chen Yue, Xiaan Du, Yuyang Wang, Yesheng Liu, Haiyu Xu, Zhicheng Dou

机构 * AutoResearchBench Team(AutoResearchBench团队)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

AI总结 本文提出AutoResearchBench,用于评估AI代理在复杂科学文献发现中的能力,包含深度研究和广泛研究两种任务,相比现有代理网络浏览基准,其研究导向、文献聚焦和开放性特征使其更具挑战性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24320 2026-04-28 cs.CL 57%

DPEPO: Diverse Parallel Exploration Policy Optimization for LLM-based Agents

DPEPO:基于大语言模型代理的多样化并行探索策略优化

Junshuo Zhang, Chengrui Huang, Feng Guo, Zihan Li, Ke Shi, Menghua Jiang, Jiguo Yu, Shuo Shang, Shen Gao

机构 * University of Electronic Science and Technology of China(电子科技大学) DiDi(滴滴)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

AI总结 本文提出DPEPO算法,通过并行探索提升大语言模型代理在复杂任务中的性能,实验表明其在ALFWorld和ScienceWorld上达到最先进的成功率。

Comments Accepted by ACL 2026 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17855 2026-04-28 cs.CL 57%

Explaining Sources of Uncertainty in Automated Fact-Checking

解释自动事实核查中不确定性的来源

Jingyi Sun, Greta Warren, Irina Shklovski, Isabelle Augenstein

机构 * University of Copenhagen(哥本哈根大学)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

AI总结 本文提出CLUE框架,通过无监督方法识别文本跨度间的冲突与一致关系,生成更符合模型不确定性的自然语言解释,提升事实核查准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23325 2026-04-28 cs.CV cs.AI eess.IV 57%

EAD-Net: Emotion-Aware Talking Head Generation with Spatial Refinement and Temporal Coherence

EAD-Net:具有空间细化和时间一致性的情感感知说话头生成

Yahui Li, Yinfeng Yu, Liejun Wang, Shengjie Shen

机构 * School of Computer Science and Technology, Xinjiang University(新疆大学计算机科学与技术学院)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

AI总结 EAD-Net通过引入同步网络监督和时空方向注意力机制,提升情感感知说话头生成的唇同步精度和时间一致性,同时利用大语言模型增强情感语义控制。

Comments Main paper (10 pages). Accepted for publication by ICMR(International Conference on Multimedia Retrieval) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23106 2026-04-28 cs.SE cs.AI cs.MA 57%

No Test Cases, No Problem: Distillation-Driven Code Generation for Scientific Workflows

无测试用例,无问题:基于知识蒸馏的科学工作流代码生成

Siddeshwar Raghavan, Tanwi Mallick

机构 * Purdue University(普渡大学) Argonne National Laboratory(阿贡国家实验室)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

AI总结 本文提出MOSAIC框架,通过知识蒸馏和结构化问题分解实现无测试用例的科学代码生成,提升准确性和执行精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23069 2026-04-28 cs.CL 57%

ContextWeaver: Selective and Dependency-Structured Memory Construction for LLM Agents

ContextWeaver:面向LLM代理的选型与依赖结构化记忆构建

Yating Wu, Yuhao Zhang, Sayan Ghosh, Sourya Basu, Anoop Deoras, Jun Huan, Gaurav Gupta

机构 * UT Austin(得克萨斯大学奥斯汀分校) AWS AI Labs(AWS人工智能实验室)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

AI总结 本文提出ContextWeaver,通过构建推理步骤图谱,实现LLM代理的记忆选择与依赖结构化,提升长上下文交互性能,减少推理步骤与token消耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23027 2026-04-28 cs.AI 57%

A Systematic Approach for Large Language Models Debugging

大语言模型调试的系统方法

Basel Shbita, Anna Lisa Gentile, Bing Zhang, Sungeun An, Shailja Thakur, Shubhi Asthana, Yi Zhou, Saptha Surendran, Farhan Ahmed, Rohan Kulkarni, Yuya Jeremy Ong, Chad DeLuca, Hima Patel

机构 * IBM Research(IBM研究院)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

AI总结 本文提出系统化方法用于大语言模型调试,通过统一评估、可解释性和错误分析,帮助开发者迭代诊断模型弱点,优化提示和参数,并适应数据进行微调或评估,尤其在缺乏标准化基准时仍有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10139 2026-04-28 cs.CR cs.AI 57%

Anonymization-Enhanced Privacy Protection for Mobile GUI Agents: Available but Invisible

增强隐私保护的移动GUI代理:可用但不可见

Lepeng Zhao, Zhenhua Zou, Shuo Li, Zhuotao Liu

机构 * Tsinghua University(清华大学)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

AI总结 本文提出一种基于匿名化的隐私保护框架,通过检测敏感UI内容并替换为非识别性占位符,实现敏感信息在任务执行中可用但不可见,减少隐私泄露同时保持代理的无缝使用。

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25223 2026-04-23 cs.AI 57%

FELA: A Multi-Agent Evolutionary System for Feature Engineering of Industrial Event Log Data

FELA:一种用于工业事件日志数据特征工程的多智能体进化系统

Kun Ouyang, Haoyu Wang, Dong Fang

机构 * Department of Electronic Engineering, Tsinghua University LIGHTSPEED STUDIOS, China

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

AI总结 本文提出FELA,一种基于大语言模型的多智能体系统,通过协作生成、验证和实现新颖特征,提升工业事件日志数据的特征工程效率与性能。

Comments 14 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03323 2026-04-23 cs.CL 57%

Enhancing Agentic Textual Graph Retrieval with Synthetic Stepwise Supervision

通过合成的分步监督增强代理文本图检索

Ge Chang, Jinbo Su, Jiacheng Liu, Pengfei Yang, Yuhao Shang, Huiwen Zheng, Hongli Ma, Yan Liang, Yuanchun Li, Yunxin Liu

机构 * Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR),清华大学) Peking University(北京大学) School of Information, Renmin University of China(中国人民大学信息学院) Harbin Institute of Technology(哈尔滨工业大学) North China Electric Power University(华北电力大学) GDS Holdings Limited(GDS控股有限公司)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

AI总结 本文提出一种基于LLM的文本图检索框架,通过合成分步监督优化检索过程,提升复杂图基问答任务的准确性和F1分数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07849 2026-04-23 cs.SE cs.AI cs.IR 57%

SweRank: Software Issue Localization with Code Ranking

SweRank: 代码排名用于软件问题定位

Revanth Gangi Reddy, Tarun Suresh, JaeHyeok Doo, Ye Liu, Xuan Phi Nguyen, Yingbo Zhou, Semih Yavuz, Caiming Xiong, Heng Ji, Shafiq Joty

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Salesforce Research(Salesforce 研究) KAIST AI(韩国科学技术院人工智能研究所)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

AI总结 本文提出SweRank框架,通过高效的检索与重排序方法提升软件问题定位的准确性,实验表明其在SWE-Bench-Lite和LocBench上优于现有方法。

Comments ICLR 2026 Camera Ready Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03624 2026-04-23 cs.HC cs.CL 57%

LLAMADRS: Evaluating Open-Source LLMs on Real Clinical Interviews--To Reason or Not to Reason?

LLAMADRS:在真实临床访谈中评估开源大语言模型——理性推理还是不理性推理?

Gaoussou Youssouf Kebe, Jeffrey M. Girard, Einat Liebenthal, Justin Baker, Fernando De la Torre, Louis-Philippe Morency

机构 * Carnegie Mellon University, School of Computer Science(卡内基梅隆大学计算机学院) University of Kansas, Department of Psychology(堪萨斯大学心理学系) McLean Hospital, Harvard Medical School(麦肯纳医院哈佛医学院)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

AI总结 本文通过LLAMADRS基准测试,评估了25种开源大语言模型在结构化临床评估中的表现,发现理性推理模型在误差控制上并不总是更优,提示提示设计对模型性能有关键影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19278 2026-04-23 cs.AI cs.MA 57%

Explicit Trait Inference for Multi-Agent Coordination

显式特征推断用于多智能体协调

Suhaib Abdurahman, Etsuko Ishii, Katerina Margatina, Divya Bhargavi, Monica Sunkara, Yi Zhang

机构 * University of Southern California(南加州大学) AWS Agentic AI Labs(AWS 代理AI实验室)

专题命中 复杂问题求解 :CoT(abstract);分类 cs.AI

AI总结 本文提出显式特征推断方法,通过推断伙伴特征提升多智能体协调效率,在经济游戏和复杂多智能体场景中均取得显著效果。

Comments Accepted at ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12036 2026-04-23 cs.CL 57%

Composition-RL: Compose Your Verifiable Prompts for Reinforcement Learning of Large Language Models

Composition-RL:为大型语言模型的强化学习编纂可验证提示

Xin Xu, Clive Bai, Kai Yang, Tianhao Chen, Yangkun Chen, Weijie Liu, Hao Chen, Yang Wang, Saiyong Yang, Can Yang

机构 * The Hong Kong University of Science(香港科学与技术大学) HY, Tencent(HY,腾讯) The University of Hong Kong(香港大学)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

AI总结 Composition-RL通过自动组合多个问题生成新可验证问题,提升有限提示的利用效率,实验表明其能提升推理能力并支持跨领域强化学习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11793 2026-04-22 cs.CL 57%

MiroThinker: Pushing the Performance Boundaries of Open-Source Research Agents via Model, Context, and Interactive Scaling

MiroThinker:通过模型、上下文和交互扩展推动开源研究代理的性能边界

MiroMind Team, Song Bai, Lidong Bing, Carson Chen, Guanzheng Chen, Yuntao Chen, Zhe Chen, Ziyi Chen, Jifeng Dai, Xuan Dong, Wenhan Dou, Yue Deng, Yunjie Fu, Junqi Ge, Chenxia Han, Tammy Huang, Zhenhang Huang, Jerry Jiao, Shilei Jiang, Tianyu Jiao, Xiaoqi Jian, Lei Lei, Ruilin Li, Gen Luo, Tiantong Li, Xiang Lin, Ziyuan Liu, Zhiqi Li, Jie Ni, Qiang Ren, Pax Sun, Shiqian Su, Chenxin Tao, Bin Wang, Wenhai Wang, Haonan Wang, James Wang, Jin Wang, Jojo Wang, Letian Wang, Shizun Wang, Weizhi Wang, Zixuan Wang, Jinfan Xu, Sen Xing, Chenyu Yang, Hai Ye, Jiaheng Yu, Yue Yu, Muyan Zhong, Tianchen Zhao, Xizhou Zhu, Yanpeng Zhou, Yifan Zhang, Zhi Zhu

机构 * MiroMind Team(MiroMind团队)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

AI总结 MiroThinker通过模型、上下文和交互扩展提升开源研究代理性能,实现更深入的交互和更复杂的任务处理,其72B版本在多个基准测试中表现优异,接近商业模型。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19144 2026-04-22 cs.CL 57%

ReflectMT: Internalizing Reflection for Efficient and High-Quality Machine Translation

ReflectMT:内部化反思以实现高效且高质量的机器翻译

Kunquan Li, Yingxue Zhang, Fandong Meng, Jinsong Su

机构 * School of Informatics, Xiamen University, China(厦门大学信息学院) WeChat AI, Tencent Inc, China(腾讯公司微信AI部门)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

AI总结 ReflectMT通过强化学习提升机器翻译的反思与精炼能力,实现无需显式推理的高效高质量翻译,实验显示其在自动指标和GPT评估中优于多步推理模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17827 2026-04-21 cs.CL 57%

Learning to Seek Help: Dynamic Collaboration Between Small and Large Language Models

学习寻求帮助:小语言模型与大语言模型之间的动态协作

Hang Zeng, Xiangyu Liu, Yong Hu, Chaoyue Niu, Jiarui Zhang, Shaojie Tang, Fan Wu, Guihai Chen

机构 * Shanghai Jiao Tong University, Shanghai, China(上海交通大学) WeChat Tencent, Beijing, China(微信腾讯) State University of New York at Buffalo, New York, United States(纽约州立大学布法罗分校)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

AI总结 本文提出动态协作框架,使小模型主动请求大模型进行多步推理,大模型提供适应性反馈,通过系统研究协作策略受模型能力与效率隐私约束的影响,实验表明动态策略优于静态流程和独立推理,并能稳健迁移至未见的大模型。

Comments 8 content pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17274 2026-04-21 cs.CV cs.AI 57%

Instinct vs. Reflection: Unifying Token and Verbalized Confidence in Multimodal Large Models

本能与反思:统一令牌和 verbalized 自信在多模态大模型中

Yunkai Dang, Yifan Jiang, Yizhu Jiang, Anqi Chen, Wenbin Li, Yang Gao

机构 * School of Artificial Intelligence, Nanjing University(南京大学人工智能学院)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

AI总结 本文研究多模态大模型响应自信估计的本能-反思不一致问题,提出融合框架和均值对齐方法,提升校准和失败预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24635 2026-04-21 cs.SE cs.AI 57%

DynaFix: Iterative Automated Program Repair Driven by Execution-Level Dynamic Information

DynaFix:基于执行级动态信息的迭代自动程序修复

Zhili Huang, Ling Xu, Chao Liu, Weifeng Sun, Xu Zhang, Yan Lei, Meng Yan, Hongyu Zhang

机构 * Chongqing University(重庆大学)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI

AI总结 DynaFix通过迭代利用运行时动态信息改进程序修复,利用变量状态、控制流路径和调用栈等结构化提示引导LLM生成候选补丁,有效提升修复效率和准确性。

Comments 30 pages, 11 figures, preprint version

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15687 2026-04-20 cs.CL 57%

Preference Estimation via Opponent Modeling in Multi-Agent Negotiation

通过对手建模进行多智能体谈判中的偏好估计

Yuta Konishi, Kento Yamamoto, Eisuke Sonomoto, Rikuho Takeda, Ryo Furukawa, Yusuke Muraki, Takafumi Shimizu, Kazuma Fukumura, Yuya Kanemoto, Takayuki Ito, Shiyao Ding

机构 * Graduate School of Informatics, Kyoto University(京都大学信息学研究生院) Accenture Japan Ltd(Accenture日本公司)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL

AI总结 本文提出一种整合自然语言信息的结构化贝叶斯对手建模框架,提升多智能体谈判中的偏好估计准确性与一致性。

Comments This paper is accepted as a Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏