arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-01-21 至 2026-01-21 共收录 9 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 软件智能体 9 篇

2601.12134 2026-01-21 cs.HC cs.AI 88%

Human-Human-AI Triadic Programming: Uncovering the Role of AI Agent and the Value of Human Partner in Collaborative Learning

人类-人类-人工智能三元编程:揭示人工智能代理和人类合作伙伴在协作学习中的作用

Taufiq Daryanto, Xiaohan Ding, Kaike Ping, Lance T. Wilhelm, Yan Chen, Chris Brown, Eugenia H. Rho

机构 * Virginia Tech(弗吉尼亚理工大学)

专题命中 软件智能体 :agent(title,abstract);AI agent(title,abstract);分类 cs.AI

AI总结 本文提出人类-人类-人工智能三元编程,通过实验表明三元协作能提升协作学习和社会存在感,且人类在AI建议前更注重理解,凸显AI辅助而非替代人类协作的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13933 2026-01-21 cs.SE 85%

VulnResolver: A Hybrid Agent Framework for LLM-Based Automated Vulnerability Issue Resolution

VulnResolver: 一种基于大语言模型的混合代理框架用于LLM驱动的自动漏洞问题解决

Mingming Zhang, Xu Wang, Jian Zhang, Xiangxin Meng, Jiayi Zhang, Chunming Hu

专题命中 软件智能体 :agent(title,abstract);autonomous agent(abstract);workflow(abstract);分类 cs.SE

AI总结 VulnResolver是一种基于大语言模型的混合代理框架,通过上下文预收集和安全属性分析代理,实现自动化漏洞问题的高效解决。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11672 2026-01-21 cs.SE cs.SY eess.SY 79%

From Everything-is-a-File to Files-Are-All-You-Need: How Unix Philosophy Informs the Design of Agentic AI Systems

从『万物皆文件』到『文件即一切』:Unix哲学如何影响代理AI系统的设计

Deepak Babu Piskala

专题命中 软件智能体 :agentic(title,abstract);分类 cs.SE

AI总结 本文探讨了Unix哲学中的『万物皆文件』理念如何影响代理AI系统的设计,通过统一文件和代码抽象,提升系统维护性、可审计性和操作稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11634 2026-01-21 cs.CV 78%

When Rules Fall Short: Agent-Driven Discovery of Emerging Content Issues in Short Video Platforms

当规则不足时:基于智能体的短视频平台新兴内容问题发现

Chenghui Yu, Hongwei Wang, Junwen Chen, Zixuan Wang, Bingfeng Deng, Zhuolin Hao, Hongyu Xiong, Yang Song

机构 * TikTok Inc.(TikTok公司)

专题命中 软件智能体 :agent(title,abstract)

AI总结 本文提出基于多模态大语言模型智能体的自动问题发现方法,有效提升短视频平台新兴内容问题的发现与治理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11688 2026-01-21 cs.SE cs.AI 76%

SpecMap: Hierarchical LLM Agent for Datasheet-to-Code Traceability Link Recovery in Systems Engineering

SpecMap:用于系统工程中datasheet到代码可追溯性链接恢复的分层LLM代理

Vedant Nipane, Pulkit Agrawal, Amit Singh

机构 * H2LooP.ai(H2LooP人工智能研究院)

专题命中 软件智能体 :agent(title);分类 cs.AI、cs.SE

AI总结 SpecMap通过分层LLM代理实现嵌入式系统datasheet到代码的可追溯性链接恢复,提升映射精度与效率,支持自动化分析与下游应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13112 2026-01-21 cs.CR 67%

CODE: A Contradiction-Based Deliberation Extension Framework for Overthinking Attacks on Retrieval-Augmented Generation

CODE:一种基于矛盾的 deliberation 延伸框架,用于对抗检索增强生成中的过度思考攻击

Xiaolei Zhang, Xiaojun Jia, Liquan Chen, Songze Li

专题命中 软件智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出 CODE 框架,通过构造污染样本引发 RAG 系统的过度思考攻击,导致推理标记消耗激增,同时不影响任务性能。

Comments 12 pages with 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11655 2026-01-21 cs.SE cs.CL 62%

Advances and Frontiers of LLM-based Issue Resolution in Software Engineering: A Comprehensive Survey

大语言模型在软件工程中的问题解决进展与前沿:一项全面的调查

Caihua Li, Lianghong Guo, Yanlin Wang, Daya Guo, Wei Tao, Zhenyu Shan, Mingwei Liu, Jiachi Chen, Haoyu Song, Duyu Tang, Hongyu Zhang, Zibin Zheng

机构 * Sun Yat-sen University(中山大学) Hangzhou Normal University(杭州师范大学) Zhejiang University(浙江大学) Huawei Technologies Co, Ltd(华为技术有限公司) Chongqing University(重庆大学)

专题命中 软件智能体 :agent(abstract);分类 cs.CL、cs.SE

AI总结 本文全面调查了大语言模型在软件工程中问题解决的进展与前沿,分析了数据构建、方法和技术挑战,并提供了开源资源。

Comments 26 pages, 4 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19825 2026-01-21 cs.LG cs.AI cs.DB 62%

Position: Foundation Models for Tabular Data within Systemic Contexts Need Grounding

位置:在系统性情境中为表格数据构建的基础模型需要接地

Tassilo Klein, Johannes Hoffart

专题命中 软件智能体 :autonomous agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出语义链接表和SLT基础模型,通过双阶段训练实现表格数据在操作上下文中的接地,强调操作知识对自主代理的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13754 2026-01-21 cs.SE 57%

On Autopilot? An Empirical Study of Human-AI Teaming and Review Practices in Open Source

自动驾驶?开源软件中人类与AI协作及审查实践的实证研究

Haoyu Gao, Peerachai Banyongrakkul, Hao Guan, Mansooreh Zahedi, Christoph Treude

专题命中 软件智能体 :agent(abstract);分类 cs.SE

AI总结 本研究通过分析开源项目中AI辅助PR的互动模式,发现非所有权贡献者提交的AI共同撰写的PR被快速合并且反馈极少,揭示了AI在软件工程中的协作与审查实践问题。

Comments accepted as MSR short paper

详情

展开后加载摘要…

URL PDF HTML 收藏