arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-01-07 至 2026-01-07 共收录 4 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 软件智能体 4 篇

2601.03178 2026-01-07 cs.CV 75%

DiffBench Meets DiffAgent: End-to-End LLM-Driven Diffusion Acceleration Code Generation

DiffBench 与 DiffAgent:端到端的 LLM 驱动扩散加速代码生成

Jiajun jiao, Haowei Zhu, Puyuan Yang, Jianghui Wang, Ji Liu, Ziqiong Liu, Dong Li, Yuejian Fang, Junhai Yong, Bin Wang, Emad Barsoum

专题命中 软件智能体 :agent(abstract);planning(abstract);workflow(abstract)

AI总结 本文提出DiffBench和DiffAgent,通过LLM驱动的闭环流程,实现端到端的扩散模型加速代码生成,显著提升生成策略的有效性。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02410 2026-01-07 cs.SE cs.AI cs.CY cs.GR 62%

The Vibe-Check Protocol: Quantifying Cognitive Offloading in AI Programming

Vibe-Check协议:量化AI编程中的认知卸载

Aizierjiang Aiersilan

机构 * The George Washington University(乔治·华盛顿大学)

专题命中 软件智能体 :AI agent(abstract);分类 cs.AI、cs.SE

AI总结 本文提出Vibe-Check协议,通过量化指标评估Vibe Coding在软件工程教学中的效果,探讨其对技能保留和概念理解的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09280 2026-01-07 cs.DC cs.LG cs.NA math.NA 57%

TTrace: Lightweight Error Checking and Diagnosis for Distributed Training

TTrace: 轻量级的分布式训练错误检查与诊断

Haitian Jiang, Shaowei Zhu, Zhen Zhang, Zhenyu Song, Xinwei Fu, Zhen Jia, Yida Wang, Jinyang Li

机构 * New York University(纽约大学) Amazon Web Services(亚马逊网络服务)

专题命中 软件智能体 :workflow(abstract);分类 cs.LG

AI总结 TTrace通过系统性的差分测试方法,有效检测和定位分布式训练中的无声bug,提升调试效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09143 2026-01-07 cs.CE cs.SI 50%

An Intrinsic Integrity-Driven Rating Model for a Sustainable Reputation System

一种内在完整性驱动的评级模型用于可持续的声誉系统

H. Wen, T. Huang, D. Xiao

专题命中 软件智能体 :agent(abstract)

AI总结 本文提出一种基于区块链的内在经济激励机制的可持续声誉系统,通过蒙特卡洛模拟验证其在现实世界复杂性中的有效性,并探讨其在隐私保护方面的未来应用。

Comments 36 pages,13 figures

Journal ref Expert Systems with Applications 249 (2024) 123804

详情

展开后加载摘要…

URL PDF HTML 收藏