arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 762 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 762 篇

2606.20720 2026-06-23 cs.MA cs.CY 新提交 87%

Empowering Economic Simulation Through Situation-Aware Llm-Driven Generative System

通过情境感知的LLM驱动生成系统赋能经济模拟

Zhimei Chen, Mu Chen

专题命中 其他LLM :LLM(title,title_cn)

AI总结 提出SAMAS系统,利用大语言模型嵌入宏观经济理解和模拟轨迹,联合建模宏观结构与微观动态,提升波动真实性和拐点预测能力。

Comments ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07231 2026-06-08 cs.HC 新提交 87%

Moodie: An Early-Stage Design Exploration for Supporting Fear of Missing Out with LLM-based Chatbots

Moodie:基于LLM的聊天机器人支持错失恐惧症的早期设计探索

Hsin-Yu Tsai, Jingxian Liao, Fu-Yin Cherng, Tzu-Hsiang Huang

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 提出基于大语言模型的聊天机器人Moodie,通过情绪调节支持减少错失恐惧症,初步评估显示其相比通用模型能提高用户参与度和社交连接。

Comments 7 pages, 1 figure, 1 table. Preliminary work submitted to the ACM CUI 2026 Works-in-Progress (WiP) track

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14625 2026-08-18 cs.CY cs.AI cs.DL 新提交 86%

Local AI pre-screening for human triple-blind peer review in health sciences

健康科学领域中用于人类三重盲同行评审的本地AI预筛选

Rodrigo Martins Boos

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究针对健康科学领域同行评审的AI滥用问题,提出三重盲多LLM本地预筛选框架,保留人类最终裁决权,可减少评审延迟且更透明合规。

Comments 16 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09588 2026-08-11 cs.CL 新提交 86%

MDB-Link: Hierarchical Schema Linking for Multi-Database Text-to-SQL

MDB-Link:面向多数据库Text-to-SQL的分层模式链接方法

Beiyu Xu, Zhenyu Wu, Jiaoyan Chen, Riza theresa Batista-navarro

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文针对多数据库Text-to-SQL场景提出分层模式链接框架MDB-Link,结合LLM实现数据库定位与列选择,在多个数据集上性能及运行速度均优于基线方法,可高效支撑SQL生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07947 2026-08-11 cs.AI cs.DC 新提交 86%

Directed Neuro-Symbolic Stochastic Execution for Verification of Distributed Parallel AI Programs

用于分布式并行AI程序验证的定向神经符号随机执行

Gautham Koorma, Vikas Sharma, George Edwards, Mahdi Eslamimehr

机构 * Quandary Peak Research(昆达里峰研究院)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对分布式并行AI程序的可靠性缺口,提出DNSSE混合测试框架,结合LLM调度预测与符号约束求解等,实现更优的并发bug检测率与分支覆盖率。

Comments 1 Figure, 1 Algorithm, 1 Figure, 2 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06294 2026-08-07 cs.AI cs.ET 新提交 86%

QuanTiMedAI: Quantum-Enhanced Time-Series Model guided by Agentic AI for Cardiac Arrest Mortality Prediction

QuanTiMedAI:由智能体人工智能引导的量子增强时间序列模型用于心脏骤停死亡率预测

Mutasim Fuad Sarker, Adiba Rahman Namira, Wafa Binte Alam, Md Adnan Arefeen, Mahzabeen Emu, Sumaiya Tabassum Nimi

机构 * North South University(北南大学) Memorial University(纪念大学)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究针对心脏骤停死亡率预测的静态数据局限,提出QuanTiMedAI量子-智能体框架,结合智能体LLM与量子循环网络,在MIMIC-IV数据集上仅用605个参数实现0.852的AUROC,优于现有最先进基线。

Comments Submitted for review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05576 2026-08-07 cs.CL cs.CY 新提交 86%

Where Models Converge and Humans Diverge: A Coverage Framework for Distributional Pluralism in Open-Ended Generation

模型收敛与人类分歧:开放式生成中分布多元性的覆盖框架

Zini Yang, Emily Wenger, Richard So

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文针对LLM与人类写作间的分布差距问题,提出以人类写作经验分布为基准的框架,通过LLM-Cov和IBR指标测量LLM生成内容的分布广度,发现当前LLM内容合理但狭窄,可用于评估其“文化覆盖范围”。

Comments 18 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00003 2026-08-04 cs.AI 新提交 86%

AutoFOAM: The Self-Refining Autonomous OpenFOAM Agent

AutoFOAM:自优化自主OpenFOAM智能体

Arun Govind Neelan, A Seshaditya

机构 * SimuNetics Onnes Cryogenics Quasi AI

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 AutoFOAM是基于Qwen-coder 2.5-14B微调的自主LLM智能体,通过7阶段迭代循环及三种抗退化机制,可基于自然语言指令完成OpenFOAM模拟,助力CFD工作流程普及与快速原型开发。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26899 2026-07-30 cs.HC cs.AI cs.CY 新提交 86%

Human diversity fuels collective creativity that large language models cannot simulate or sustain

人类多样性催生了大型语言模型无法模拟或维持的集体创造力

Mengchen Dong, Hiromu Yakura

专题命中 其他LLM :large language model(title);language model(title);prompting(abstract);分类 cs.AI

AI总结 该研究通过实验发现,L2写作者的集体多样性优于L1写作者,AI构思会压缩集体多样性而AI润色可保留,模拟显示AI无法达到人类群体的创意多样性,人机协作设计影响人类多样性的存续。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23037 2026-07-28 cs.CL 新提交 86%

Speech Signals Complement LLMs for Predicting Interpersonal Attraction in Speed Dating

语音信号补充大语言模型用于预测速配中的人际吸引力

Yuriko Kikuchi, Takato Hayashi, Ryusei Kimura, Naoya Inoue, Ryo Ishii, Shogo Okada

机构 * Japan Advanced Institute of Science and Technology(日本先进科学技术学院) NTT, Inc.(日本电报电话公司)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究利用日语速配对话,结合仅基于转录本的LLM预测与语音预测器预测来估计参与者对约会对象的喜好,发现语音能补充LLM预测,二者结合可提高两两排序准确率,且互补性有条件,还明确了语音预测价值及互补性出现的情况。

Comments Accepted at the 28th ACM International Conference on Multimodal Interaction (ICMI 2026). 16 pages total, including a 7-page supplementary appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17948 2026-07-21 cs.AI cs.MA 新提交 86%

Towards Agentic Agent-based Models: Feasibility, Performance, and Statistical Model Checking

迈向基于智能体的智能体模型:可行性、性能和统计模型检查

Stefano Blando, Emanuele Guerrazzi, Riccardo Porcedda, Giuseppe Squillace, Max Tschaikowski, Andrea Vandin

机构 * Sant’Anna School of Advanced Studies Pisa(比萨圣安娜高等研究学校) Sapienza University of Rome(罗马第一大学) DTU Technical University of Denmark(丹麦技术大学) University of Pisa(比萨大学)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究引入大语言模型驱动决策对基于智能体模型模拟的影响,以Mesa ABM模型为对象,扩展谢林隔离模型,通过统计模型检查进行分析,实验表明较小本地服务LLM有问题,较大模型通过初步检查,还探讨了统计模型检查的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16249 2026-07-21 physics.geo-ph cs.AI 新提交 86%

An Agentic Interface for End-to-End Probabilistic Seismic Hazard and Risk Analysis

用于端到端概率地震危险性和风险分析的智能体接口

Sreenath Vemula, Pierre Jehel, Fabrice Cotton, Filippo Gatti

机构 * Université Paris-Saclay, CentraleSupélec, ENS Paris-Saclay, CNRS, LMPS — Laboratoire de Mécanique Paris-Saclay(巴黎-萨克莱大学、中央超导学院、巴黎-萨克莱高等师范学院、国家科学研究中心、LMPS——巴黎-萨克莱力学实验室) GFZ Helmholtz Centre for Geosciences(德国地球科学霍普夫兹中心) University of Potsdam, Institute of Geosciences(波茨坦大学、地球科学学院)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究针对概率地震危险性和风险分析专家化问题,提出通过开源服务器及MCP构建智能体接口,利用LLM与OpenQuake引擎等协作计算,实现多功能分析,结果与官方值匹配度高且计算快,还能接受自定义GMM并添加新功能,设计层可拓展。

Comments 24 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11250 2026-07-14 cs.MA cs.AI 新提交 86%

Multi-Agent LLMs Fail to Explore Each Other

多智能体语言模型无法相互探索

Hyeong Kyu Choi, Jiatong Li, Wendi Li, Xin Eric Wang, Sharon Li

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究多智能体系统中LLM智能体相互探索的问题,提出轻量级框架MACE,通过结构化同伴选择促进探索,改善了探索行为和任务性能,凸显当前LLM智能体局限,强调明确引导探索对多智能体自主性的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02121 2026-07-03 cs.CR cs.AI 新提交 86%

Behind the Refusal: Determining Guardrail Activation via Behavioral Monitoring

拒绝背后:通过行为监控确定护栏激活

William Hackett, Peter Garraghan

机构 * Mindgard Lancaster University(兰卡斯特大学)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出首个黑盒护栏侦察方法,通过HTTP、词汇和时序信号行为监控检测AI系统中护栏的存在,准确率100%,并能区分护栏拦截与LLM拒绝。

Comments 19 pages, 13 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24667 2026-06-24 cs.CL 新提交 86%

DREAM: Dense Retrieval Embeddings via Autoregressive Modeling

DREAM:通过自回归建模的密集检索嵌入

Yixuan Tang, Yi Yang

机构 * The Hong Kong University of Science and Technology(香港科技大学)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出DREAM方法,利用冻结LLM的自回归预测损失训练密集检索器,通过注意力机制注入查询-文档相似度,在BEIR和RTEB上优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09700 2026-06-23 cs.CR cs.HC cs.LG 新提交 86%

What the Eyes See, the LLMs Miss: Exploiting Human Perception for Adversarial Text Attacks

眼睛所见,大语言模型所不见:利用人类感知进行对抗性文本攻击

Qin Yang, Lu Malloy, Joshua Lee, Xiaohan Chang, Meisam Mohammady, Doowon Kim, Yuan Hong

机构 * University of Connecticut(康涅狄格大学) University of Tennessee(田纳西大学) University of California, Santa Barbara(加州大学圣芭芭拉分校) Iowa State University(爱荷华州立大学)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 针对LLM内容审核系统忽视人类视觉线索的缺陷,提出人类可感知对抗攻击(HPAA),通过排版操纵嵌入有害内容,在仅三次查询下实现86%人类识别率而机器检测率低于1%。

Comments This work has been accepted for publication at USENIX Security 2026. This paper includes examples of harmful, hateful, or abusive language for research purposes. Reader discretion is advised

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18154 2026-06-17 cs.AI 新提交 86%

Learning Cardiac Electrophysiology Digital Twins Through Agentic Discovery of Hybrid Structure

通过智能体发现混合结构学习心脏电生理数字孪生

Ziqi Zhou, Yubo Ye, Sumeet Atul Vadhavka, Linwei Wang, Zhiqiang Tao

机构 * Rochester Institute of Technology(罗彻斯特理工学院)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出LEADS框架,利用LLM智能体在结构化动作空间中迭代发现混合物理-神经模型,实现个性化心脏电生理数字孪生构建,优于人工设计和其他LLM方法。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18124 2026-06-17 cs.CL 新提交 86%

Unintended Effects of Geographic Conditioning in Large Language Models

大型语言模型中地理条件化的意外效应

Naz Col, David M. Chan

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 其他LLM :large language model(title);language model(title);LLM(abstract_cn);分类 cs.CL

AI总结 本研究评估了大型语言模型在接收地理中立提示时,因用户元数据中的位置信息导致的地理泄露现象,并发现位置占位符“Unknown”本身也会引发泄露,揭示了用户档案框架的生成条件化效应。

Comments To appear at the Second Workshop on Customizable NLP (CustomNLP4U) at ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17234 2026-06-17 cs.CL 新提交 86%

Speaking in Self-Assessing Tongues: On the Verbalized Confidence of LLMs in Machine Translation

自评之言:论大语言模型在机器翻译中的口头化置信度

Ali Marashian, Alexis Palmer, Katharina von der Wense

机构 * University of Colorado Boulder(科罗拉多大学博尔德分校) Johannes Gutenberg University Mainz(美因茨约翰内斯·古腾堡大学)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究设计了五种无需内部信号的口头化方法提取LLM逐词置信度,并与内部确定性信号比较,发现两者在细粒度错误检测和校准上表现相似但相关性低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17174 2026-06-17 cs.CL cs.CY cs.MA 新提交 86%

From Parasocial Scripts to Dyadic Persistence in Autonomous AI-Agent Communities

从准社会脚本到自主AI智能体社区中的二元持久性

Mohammadsadegh Abolhasani, Hamid Reza Firoozfar, Reza Mousavi, Paul Jen-Hwa Hu

机构 * University of Utah(犹他大学) University of Virginia(弗吉尼亚大学)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究自主AI智能体社区中是否存在准社会互动(PSI)线索,通过关键词匹配、少样本LLM标注等方法分析帖子与评论,发现PSI线索与OP再参与及互惠回复结构强相关,并通过二元持久性测试验证了互动层面的PSI脚本与重复二元模式的一致性。

Comments Submitted for review in ARR for EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15024 2026-06-16 cs.MA cs.AI cs.SY eess.SY 新提交 86%

Resilient Consensus in Agentic AI

智能体AI中的弹性共识

Sribalaji C. Anand, George J. Pappas

机构 * KTH(瑞典皇家理工学院) University of Pennsylvania(宾夕法尼亚大学)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究LLM智能体在多智能体系统中的共识问题,发现经典弹性共识理论在LLM智能体中失效,但结合经典滤波器可改善一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07502 2026-06-08 cs.CL cs.IR 新提交 86%

Your UnEmbedding Matrix is Secretly a Feature Lens for Text Embeddings

你的解嵌入矩阵实际上是文本嵌入的特征透镜

Songhao Wu, Zhongxin Chen, Yuxuan Liu, Heng Cui, Cong Li, Rui Yan

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院) Lenovo Group Limited(联想集团有限公司) Wuhan University(武汉大学)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 发现LLM文本嵌入与高频词对齐导致语义捕获不足,提出EmbedFilter通过过滤解嵌入矩阵中的高频子空间来增强表示,并实现降维加速检索。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22880 2026-07-28 cs.SE cs.AI cs.LG 新提交 86%

Do Coverage and Mutation Scores of LLM-Generated Test Suites Correlate with Their Effectiveness? (Replicability Study)

大语言模型生成的测试套件的覆盖度和变异分数与其有效性相关吗?(可重复性研究)

Junda Zhao, Shurui Zhou, Eldan Cohen

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究大语言模型生成测试套件时,覆盖度和变异分数与有效性的关系。通过重复研究发现其有用性依赖上下文,在不同场景表现不同,且测试套件大小非主要混杂因素,为评估此类测试生成提供指导。

Comments 24 pages, 4 figures, 14 tables. Accepted at ISSTA 2026; to appear in Proceedings of the ACM on Software Engineering (PACMSE), Vol. 3, No. ISSTA, Article ISSTA002

URL PDF HTML 收藏
2607.04470 2026-07-07 cs.LG cs.AI math.OC 新提交 86%

Regime-Conditional Stabilisation of LLM-Augmented Cooperative Multi-Agent Reinforcement Learning

大语言模型增强的合作多智能体强化学习的状态条件稳定化

Faid Keddouri, Sohaib Houhou, Aissa Boulmerka, Nadir Farhi

机构 * National School of Artificial Intelligence (ENSIA)(国立人工智能学院(ENSIA)) Cosys-Grettia, Univ Gustave Eiffel(古斯塔夫·埃菲尔大学Cosys-Grettia实验室)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究大语言模型与合作多智能体强化学习集成时训练动态,指出非策略学习中动态更新奖励权重违反平稳假设。提出基于阶段的冻结计划和指数移动平均平滑两种稳定策略并评估,揭示奖励信号平稳性是必要设计约束。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10338 2026-06-10 cs.CL cs.AI 新提交 86%

Routing-Aware Expert Calibration for Machine Unlearning in Mixture-of-Experts Language Models

路由感知的专家校准用于混合专家语言模型中的机器遗忘

Jingyi Xie, Yijun Lin, Yinjiang Xiong, Zhikun Zhang, Sai Li

机构 * Renmin University of China(中国人民大学) Tsinghua University(清华大学) Zhejiang University(浙江大学) Lightstandard

专题命中 其他LLM :language model(title,abstract);LLM(abstract_cn);large language model(abstract);分类 cs.CL、cs.AI

AI总结 针对MoE模型中遗忘数据与保留数据路由不匹配导致遗忘关键专家正则化不足的问题,提出TRACE方法,通过离线激活统计检测遗忘关键专家并重新加权保留损失以校准保留侧激活频率,实验表明在WMDP和MUSE-BOOKS上遗忘-效用权衡提升9%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18292 2026-08-20 cs.RO cs.CV 新提交 86%

GuideFetch: A Task Coordination Framework for Concurrent Navigation and Object Retrieval in Assistive Robot Dogs

GuideFetch:用于辅助机器狗并发导航与物体检索的任务协调框架

Qian Yin, Ruiping Liu, Kunyu Peng, Jianxiang Man, Isik Baran Sandan, Junwei Zheng, Yufan Chen, Di Wen, Kailun Yang, Rainer Stiefelhagen

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) Hunan University(湖南大学)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 针对异构辅助机器狗的导航与物体检索并发任务,提出GuideFetch协调框架,通过LLM规划与状态验证提升执行效率,并行执行可缩短41.3%平均总完成时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16908 2026-08-19 cs.SI 新提交 86%

MAG-Bot: A Multi-Agent Auditing Framework for Social Bot Detection

MAG-Bot:一种用于社交机器人检测的多智能体审计框架

Sichen Zhao, Yalun Qi

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 本研究提出基于LangGraph的多智能体框架MAG-Bot,用于社交机器人检测,通过角色约束的证据分解修正单LLM审计的盲点,在TwiBot-22测试集上显著提升了检测的准确率、召回率与F1值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14113 2026-08-17 cs.HC 新提交 86%

Search or Chat? Comparing How We Learn About Debated Topics

搜索还是聊天?对比我们如何了解有争议的话题

Ran Yu, Alisa Rieger, Rabia Karatoprak Ersen, Jiqun Liu

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 该研究通过194人参与的众包实验,对比传统搜索与LLM聊天界面对学习有争议话题的影响,发现工具无显著差异,用户特征对学习结果影响更大。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13063 2026-08-14 cs.AI cs.CL cs.LG 新提交 86%

Explanatory Engagement Under Rare Anomalous Failure: Asymptotic Rarity in Model Behavior (or: The Asymptotic AI)

罕见异常失效下的解释性参与:模型行为中的渐近稀有性(或:渐近式AI)

Sam Mao

专题命中 其他LLM :LLM(summary_cn,abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本研究探究LLM在低可控失效概率工作流中,解释性参与度随失效渐近稀有性的变化,发现触发结构是关键调节变量,不同模型的异常识别与参与表现存在差异。

Comments 11 figures. Elicitation-condition sweep across three open-weight models (qwen3:8b, llama3.1:8b, mistral:7b); pipeline scripts and experimental data available upon reasonable request

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26591 2026-07-30 cs.SE 新提交 86%

MultiFixer: A Coordinator-Proposer Based Multi-Agent Framework For Fixing Multi-Hunk Bugs

MultiFixer:一种用于修复多块漏洞的基于协调者-提议者的多智能体框架

Haichuan Hu, Chunrong Fang, Ye Shang, Jiawei Liu, Weifeng Sun, Guoqing Xie, Chenxing Zhong, Quanjun Zhang

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 该研究针对现有LLM-based APR方法难以修复多块漏洞的问题,提出MultiFixer多智能体框架,经多基准测试,其在Defects4J等数据集上达到最优修复效果,能有效修复多块漏洞。

Comments Accepted to 41st IEEE/ACM International Conference on Automated Software Engineering (ASE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏