arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 597 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 其他Agent 597 篇

2601.21204 2026-02-12 cs.CL cs.AI cs.LG 67%

Scaling Embeddings Outperforms Scaling Experts in Language Models

嵌入式扩展优于专家扩展在语言模型中

Hong Liu, Jiaqi Zhang, Chao Wang, Xing Hu, Linkun Lyu, Jiaqi Sun, Xurui Yang, Bo Wang, Fengcun Li, Yulei Qian, Lingtong Si, Yerui Sun, Rumei Li, Peng Pei, Yuchen Xie, Xunliang Cai

机构 * Meituan LongCat Team(美团LongCat团队)

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本研究提出通过嵌入式扩展而非专家扩展来提升语言模型的稀疏性,展示了LongCat-Flash-Lite在推理速度上的显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05311 2025-11-10 cs.AI cs.LG cs.RO cs.SE 67%

Cleaning Maintenance Logs with LLM Agents for Improved Predictive Maintenance

Valeriu Dimidov, Faisal Hawlader, Sasan Jafarnejad, Raphaël Frank

机构 * Interdisciplinary Centre for Security, Reliability Trust (SnT) University of Luxembourg 29 Avenue J.F. Kennedy L-1855, Luxembourg

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG、cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02208 2025-11-05 cs.AI cs.CL cs.LG 67%

Training Proactive and Personalized LLM Agents

Weiwei Sun, Xuhui Zhou, Weihua Du, Xingyao Wang, Sean Welleck, Graham Neubig, Maarten Sap, Yiming Yang

机构 * Carnegie Mellon University(卡内基梅隆大学) OpenHands

专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12856 2025-08-12 cs.CL cs.AI cs.CY cs.LG 67%

AI-AI Bias: large language models favor communications generated by large language models

Walter Laurito, Benjamin Davis, Peli Grietzer, Tomáš Gavenčiak, Ada Böhm, Jan Kulveit

专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL、cs.LG

Comments 8 pages, 4 figures

Journal ref Proc. Natl. Acad. Sci. U.S.A. 122 (31) e2415697122 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07161 2025-08-05 cs.CL cs.AI cs.HC cs.LG 67%

Towards Actionable Pedagogical Feedback: A Multi-Perspective Analysis of Mathematics Teaching and Tutoring Dialogue

Jannatun Naim, Jie Cao, Fareen Tasneem, Jennifer Jacobs, Brent Milne, James Martin, Tamara Sumner

机构 * University of Colorado Boulder(科罗拉多大学博尔德分校) University of Oklahoma(俄克拉荷马大学) University of Chittagong(奇塔格昂大学) Saga Education(Saga教育)

专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL、cs.LG

Comments Accepted to EDM'2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.01887 2025-06-10 cs.LG cs.AI cs.CL 67%

Beyond Numeric Rewards: In-Context Dueling Bandits with LLM Agents

Fanzeng Xia, Hao Liu, Yisong Yue, Tongxin Li

机构 * The Chinese University of Hong Kong Shenzhen(香港中文大学(深圳)) California Institute of Technology(加州理工学院)

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

Comments ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09024 2025-05-15 cs.AI cs.CL cs.LG 67%

Automated Meta Prompt Engineering for Alignment with the Theory of Mind

Aaron Baughman, Rahul Agarwal, Eduardo Morales, Gozde Akay

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

Comments 9 pages, 6 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11844 2025-04-17 cs.AI cs.CL cs.LG 67%

Evaluating the Goal-Directedness of Large Language Models

Tom Everitt, Cristina Garbacea, Alexis Bellot, Jonathan Richens, Henry Papadatos, Siméon Campos, Rohin Shah

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08640 2025-02-20 cs.LG cs.AI cs.CL cs.CV cs.CY 67%

Utility Engineering: Analyzing and Controlling Emergent Value Systems in AIs

Mantas Mazeika, Xuwang Yin, Rishub Tamirisa, Jaehyuk Lim, Bruce W. Lee, Richard Ren, Long Phan, Norman Mu, Adam Khoja, Oliver Zhang, Dan Hendrycks

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

Comments Website: https://www.emergent-values.ai

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10300 2024-06-21 cs.SE cs.CL cs.LG 67%

Large Language Models as Software Components: A Taxonomy for LLM-Integrated Applications

Irene Weber

专题命中 其他Agent :autonomous agent(abstract);分类 cs.CL、cs.LG、cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.04219 2024-05-08 cs.CL cs.AI cs.MA cs.SE 67%

Iterative Experience Refinement of Software-Developing Agents

Chen Qian, Jiahao Li, Yufan Dang, Wei Liu, YiFei Wang, Zihao Xie, Weize Chen, Cheng Yang, Yingli Zhang, Zhiyuan Liu, Maosong Sun

专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI、cs.CL、cs.SE

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.14717 2024-01-29 cs.CL cs.AI cs.LG cs.SD eess.AS 67%

Turn-taking and Backchannel Prediction with Acoustic and Large Language Model Fusion

Jinhan Wang, Long Chen, Aparna Khare, Anirudh Raju, Pranav Dheram, Di He, Minhua Wu, Andreas Stolcke, Venkatesh Ravichandran

专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL、cs.LG

Comments To appear in IEEE ICASSP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.07587 2023-11-17 cs.CL cs.AI cs.CY cs.LG 67%

Frontier Language Models are not Robust to Adversarial Arithmetic, or "What do I need to say so you agree 2+2=5?

C. Daniel Freeman, Laura Culp, Aaron Parisi, Maxwell L Bileschi, Gamaleldin F Elsayed, Alex Rizkowsky, Isabelle Simpson, Alex Alemi, Azade Nova, Ben Adlam, Bernd Bohnet, Gaurav Mishra, Hanie Sedghi, Igor Mordatch, Izzeddin Gur, Jaehoon Lee, JD Co-Reyes, Jeffrey Pennington, Kelvin Xu, Kevin Swersky, Kshiteej Mahajan, Lechao Xiao, Rosanne Liu, Simon Kornblith, Noah Constant, Peter J. Liu, Roman Novak, Yundi Qian, Noah Fiedel, Jascha Sohl-Dickstein

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.00416 2023-04-04 cs.AI cs.CL cs.CY cs.HC cs.LG 67%

Towards Healthy AI: Large Language Models Need Therapists Too

Baihan Lin, Djallel Bouneffouf, Guillermo Cecchi, Kush R. Varshney

专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.01134 2023-01-16 cs.AI cs.CL cs.LG 67%

Language and Culture Internalisation for Human-Like Autotelic AI

Cédric Colas, Tristan Karch, Clément Moulin-Frier, Pierre-Yves Oudeyer

专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI、cs.CL、cs.LG

Journal ref Nature Machine Intelligence 4, 1068-1076 (2022)

详情

展开后加载摘要…

URL PDF HTML 收藏
1909.06414 2019-09-17 cs.CL cs.AI cs.LG 67%

Learning Household Task Knowledge from WikiHow Descriptions

Yilun Zhou, Julie A. Shah, Steven Schockaert

专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL、cs.LG

Comments IJCAI 2019 Workshop on Semantic Deep Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
1909.04386 2019-09-11 cs.AI cs.CL 66%

Attesting Biases and Discrimination using Language Semantics

Xavier Ferrer Aran, Jose M. Such, Natalia Criado

专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL;autonomous agent(comments)

Comments Author's copy of the manuscript accepted in the Responsible Artificial Intelligence Agents workshop of the International Conference on Autonomous Agents and Multiagent Systems (AAMAS'19)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26418 2026-08-11 cs.AI cs.LG 版本更新 62%

Unbiased Canonical Set-Valued Oracles Via Lattice Theory

通过格论的无偏规范集值预言机

Jobst Heitzig

机构 * Pik-Potsdam(皮克-波茨坦)

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG

AI总结 针对预言机自指问题,提出基于Knaster-Tarski不动点定理的规范集值预言机,输出无偏且自洽的credal集,并证明其存在性与非空性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05490 2026-08-07 cs.AI cs.LG stat.ML 新提交 62%

Innovation-Residual Auditing of Autonomous Analysis Agents: Localization, Detection Limits, Error Control, and Identifiability

自主分析智能体的创新残差审计:定位、检测限、误差控制与可识别性

Ahmed Hassoon, Mark Dredze

机构 * Johns Hopkins University(约翰斯·霍普金斯大学)

专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI、cs.LG

AI总结 本文针对自主分析智能体的创新残差审计,分析了错误定位、分数选择、误差控制及审计极限,指出表示维度是关键约束。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21612 2026-07-27 cs.AI cs.LG 新提交 62%

Procedural Knowledge Is Not Low-Rank: Why LoRA Fails to Internalize Multi-Step Procedures

过程性知识不是低秩的:为什么LoRA无法内化多步骤过程

Simon Dennis, Kevin Shabahang, Hao Guo, Rivaan Patil

机构 * University of Melbourne(墨尔本大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG

AI总结 研究发现对于过程性知识,LoRA在保持效率优势的秩上无法与完全微调匹配。通过实验表明在旅行预订等任务中LoRA配置失败,跨域复制也证实其普遍不佳,分析指出完全微调权重变化的有效秩高,LoRA难以企及,这是智能体应用的基本限制。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17883 2026-07-21 cs.CL cs.AI 新提交 62%

Zero Hallucination, by Construction: Hallucination-Aware Layered Oversight for Trustworthy Enterprise AI

通过构建实现零幻觉:用于可信企业人工智能的幻觉感知分层监督

Bogdan Raduta, Horia Velicu, Alexandru Preda, Serban Chiricescu

专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL

AI总结 研究企业AI因幻觉难以被信任的问题时,提出HALO架构,通过六层防御将幻觉视为可控制故障模式,详细介绍各层并关注基于证据的置信度,以实现可信企业AI,在索赔提取工作负载上进行了架构说明。

Comments 12 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13162 2026-07-20 cs.CL cs.AI 版本更新 62%

What Models Express, Suppress, and Resist: Auditing Open-Weight LLMs with Persona Vectors

模型表达、抑制和抗拒的内容:使用角色向量审计开放权重语言模型

Winston Zeng, Ali Emami, Jinho D. Choi

机构 * Emory University(埃默里大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL

AI总结 研究通过大规模系统应用角色向量审计开放权重语言模型,编制特征清单并标记其性质,发现模型默认行为特点,引导在默认外特征效果好,且角色向量可探测行为组织。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14141 2026-07-17 cs.AI cs.LG 新提交 62%

Human AI Construction of Bayesian Networks for Operational Decision Support -- A Virtual Survey Approach

用于运营决策支持的贝叶斯网络的人工AI构建——一种虚拟调查方法

Kumar Rahul, Shovan Chowdhury

专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.LG

AI总结 研究如何构建贝叶斯网络用于运营决策支持,提出利用大语言模型的新方法,通过人工智能代理估计概率并去噪,开发六步框架,以客户咨询医生意图建模为例,揭示因素影响,得出有效策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30543 2026-07-07 cs.CL cs.AI 版本更新 62%

TRACE: Temporal Relationship-Aware Conversational Entrainment Detection in Dyadic Speech

TRACE: 双人语音中基于时间关系的对话韵律同步检测

Sathvik Manikantan Napa Ugandhar, Hao Zhang, Alison Gunzler, Yuzhe Wang, Thomas Thebaud, Georgi Tinchev, Venkatesh Ravichandran, Laureano Moro-Velázquez

机构 * Department of Computer Science, Johns Hopkins University(约翰霍普金斯大学计算机科学系) Department of Electrical and Computer Engineering, Johns Hopkins University(约翰霍普金斯大学电气与计算机工程系) Amazon Research(亚马逊研究院) Amazon(亚马逊)

专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL

AI总结 提出TRACE框架,通过窗口级声学嵌入建模双人交互的时间序列,结合对话上下文和关系信息,在DyadEE数据集上实现97.01%的情感韵律同步检测准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26071 2026-06-29 cs.LG cs.AI 新提交 62%

Model Forensics: Investigating Whether Concerning Behavior Reflects Misalignment

模型取证:调查令人担忧的行为是否反映对齐失败

Aditya Singh, Gerson Kroiz, Senthooran Rajamanoharan, Neel Nanda

机构 * MATS

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG

AI总结 提出一个两步基线协议,通过读取思维链生成假设并编辑环境测试假设,以区分模型行为是出于恶意意图还是良性原因,并在六个环境中验证了该方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24899 2026-06-25 cs.LG cs.AI quant-ph 新提交 62%

From Meta Idea to Advanced Mathematical Discovery -- Human-AI Co-Discovery of Sign-Embedding Quantum Algorithms

从元想法到高级数学发现——符号嵌入量子算法的人机协同发现

Yanqiao Wang, Jin-Peng Liu, Peng Li, Yang Liu

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG

AI总结 本研究通过符号嵌入量子算法的案例,展示了人机协同发现如何将模糊研究直觉转化为具体问题、可行路线和定理族,其中AI辅助探索(包括AIM系统)在路线扩展、方案比较和框架收敛中发挥关键作用,而人类保留最终科学判断。

Comments 35 pasges, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23094 2026-06-23 cs.AI cs.CL 新提交 62%

Cognitive Digital Twins: Ethical Risks and Governance for AI Systems That Model the Mind

认知数字孪生:模拟心智的AI系统的伦理风险与治理

Vamshi Krishna Bonagiri, Juan Nicolas Sepulveda-Arias, Abdoul Jalil Djiberou Mahamadou, Monojit Choudhury

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI、cs.CL

AI总结 本文定义认知数字孪生(CDT)为动态计算表示个体认知的系统,提出5A治理框架,识别CDT特有风险,并分析治理差距,强调需在认知表示层面进行治理。

Comments Work under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09563 2026-06-09 cs.AI cs.LG 新提交 62%

PRISM: Recovering Instruction Sets from Language Model Activations

PRISM:从语言模型激活中恢复指令集

Gilad Gressel, Rahul Pankajakshan, Julia Diament, Efim Hudis, Krishnashree Achuthan, Yisroel Mirsky

机构 * Center for Cybersecurity Systems & Networks, Amrita Vishwa Vidyapeetham(阿姆里塔·维什瓦·维迪亚佩瑟姆网络安全系统与网络中心) Microsoft(微软) Ben-Gurion University of the Negev(内盖夫本-古里安大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG

AI总结 提出PRISM方法,通过激活条件解码从冻结目标模型隐藏状态中恢复活跃指令集,利用法官引导的GRPO优化,在多种场景下优于基线方法。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04433 2026-06-04 cs.CV cs.CL cs.LG 62%

Stateful Visual Encoders for Vision-Language Models

用于视觉-语言模型的有状态视觉编码器

Zirui Wang, Junwei Yu, Adam Yala, David M. Chan, Joseph E. Gonzalez, Trevor Darrell

机构 * University of California, Berkeley(加州大学伯克利分校) UC Berkeley(加州大学伯克利分校)

专题命中 其他Agent :agentic(abstract);分类 cs.CL、cs.LG

AI总结 提出有状态视觉编码器,通过将每个视觉表示条件于先前的视觉特征,增强视觉-语言模型在多图像、多轮交互中的视觉变化感知能力,在跨图像空间聚合、多目标视觉差异和轨迹行为克隆等任务上取得一致改进。

Comments Project page: https://statefulvisualencoders.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01212 2026-06-04 cs.CL cs.AI cs.CR cs.IR 62%

DiscourseFlip: An Oblique Discourse-Level Opinion Manipulation Attack against Black-box Retrieval-Augmented Generation

DiscourseFlip: 面向黑盒检索增强生成的非直述式语篇级观点操纵攻击

Yuyang Gong, Miaokun Chen, Jiawei Liu, Zhuo Chen, Guoxiu He, Wei Lu, XiaoFeng Wang, Xiaozhong Liu

机构 * Wuhan University(武汉大学) East China Normal University(华东师范大学) Nanyang Technological University(南洋理工大学) Worcester Polytechnic Institute(沃思堡理工学院)

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL

AI总结 提出一种基于图引导的代理攻击方法DiscourseFlip,通过语义查询网络中的协同影响在有限预算下最大化语篇级观点偏差,实验证明其有效性和隐蔽性,并揭示现有防御的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏