arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 597 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 其他Agent 597 篇

1711.02827 2020-10-08 cs.AI cs.LG 62%

Inverse Reward Design

Dylan Hadfield-Menell, Smitha Milli, Pieter Abbeel, Stuart Russell, Anca Dragan

专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI、cs.LG

Comments Advances in Neural Information Processing Systems 30 (NIPS 2017) Revised Oct 2020 to fix a typo in Eq. 3

详情

展开后加载摘要…

URL PDF HTML 收藏
1904.03821 2020-02-03 cs.AI cs.LG 62%

Creating Pro-Level AI for a Real-Time Fighting Game Using Deep Reinforcement Learning

Inseok Oh, Seungeun Rho, Sangbin Moon, Seongho Son, Hyoil Lee, Jinyun Chung

专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.LG

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
1910.04176 2019-10-11 cs.CL cs.IR cs.LG 62%

A Closer Look At Feature Space Data Augmentation For Few-Shot Intent Classification

Varun Kumar, Hadrien Glaude, Cyprien de Lichy, William Campbell

专题命中 其他Agent :AI agent(abstract);分类 cs.CL、cs.LG

Comments Accepted at Deep Learning for low-resource NLP workshop @ EMNLP 2019

详情

展开后加载摘要…

URL PDF HTML 收藏
1907.01475 2019-07-03 cs.LG cs.AI stat.ML 62%

Generalizing from a few environments in safety-critical reinforcement learning

Zachary Kenton, Angelos Filos, Owain Evans, Yarin Gal

专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
cs/0312052 2009-12-01 cs.CL cs.AI 62%

Dialogue as Discourse: Controlling Global Properties of Scripted Dialogue

Paul Piwek, Kees van Deemter

专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI、cs.CL

Journal ref Proceedings of AAAI Spring Symposium on Natural Language Generation in Spoken and Written Dialogue, Stanford, 2003

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15552 2025-09-10 cs.CR cs.CL 61%

Personalized Attacks of Social Engineering in Multi-turn Conversations: LLM Agents for Simulation and Detection

Tharindu Kumarage, Cameron Johnson, Jadie Adams, Lin Ai, Matthias Kirchner, Anthony Hoogs, Joshua Garland, Julia Hirschberg, Arslan Basharat, Huan Liu

机构 * Arizona State University(亚利桑那州立大学) Kitware, Inc(Kitware公司) Columbia University(哥伦比亚大学)

专题命中 其他Agent :agentic(abstract);分类 cs.CL;AI agent(comments)

Comments Accepted as a paper at COLM 2025 Workshop on AI Agents: Capabilities and Safety

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20011 2025-06-11 cs.AI cs.HC cs.MM 61%

The Many Challenges of Human-Like Agents in Virtual Game Environments

Maciej Swiechowski, Dominik Slezak

机构 * University of Warsaw(华沙大学)

专题命中 其他Agent :AI agent(abstract);分类 cs.AI;autonomous agent(comments)

Comments In proceedings of the 24th International Conference on Autonomous Agents and Multiagent Systems (AAMAS-2025), pages 1996--2005, May 19-23, Detroit, Michigan, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20041 2026-08-21 cs.AI cs.CY 新提交 57%

A three-dimensional typology of agency for advanced AI systems

高级人工智能系统的能动性三维类型学

Willem Fourie

机构 * Stellenbosch University(斯泰伦博斯大学) School for Data Science and Computational Thinking(数据科学与计算思维学院)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 该研究构建了前沿AI系统能动性的三维类型学,区分法律与道德能动性,为非人类AI的能动性考量提供概念框架,解决AI行为归因复杂化的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19002 2026-08-20 cs.AI 新提交 57%

A Theory of Post-hoc Debate Judgement

事后辩论评判理论

Xiang Yin, Adam Dejl, Antonio Rago, Lihu Chen, Francesca Toni

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 本文提出适用于智能体辩论场景的事后辩论评判理论,探究两种评判方法的属性满足情况,发现辩论语义是辩论驱动型AI原则性评判者的理想候选。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17178 2026-08-20 cs.CR cs.AI cs.AR 版本更新 57%

TrojanGYM: A Detector-in-the-Loop LLM for Adaptive RTL Hardware Trojan Insertion

TrojanGYM:一种检测器在环的大语言模型用于自适应RTL硬件木马插入

Saideep Sreekumar, Zeng Wang, Akashdeep Saha, Weihua Xiao, Minghao Shao, Muhammad Shafique, Ozgur Sinanoglu, Ramesh Karri, Johann Knechtel

机构 * NYU Tandon School of Engineering(纽约大学Tandon工程学院) NYU Abu Dhabi(纽约大学阿布扎克分校)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 提出TrojanGYM框架,利用大语言模型智能体自动生成多样化的硬件木马,暴露基于GNN的检测器盲点,并设计鲁棒检测器Robust-GNN4TJ,在生成的基准上将检测率从0%提升至60%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16621 2026-08-18 cs.AI cs.DB cs.IR 新提交 57%

Cost Scales with Change, Not Corpus Size: Incrementally Maintaining an Evolving Semantic Substrate

成本随变化量而非语料库规模变化:增量式维护演化中的语义基底

Yusuke Takahashi, Kyle Wild, Asako Uraki

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 该研究提出语义基底维护成本随变化量而非语料库规模变化,通过增量低秩更新等方法,以远低于完整重构的成本实现语义基底的高效维护,且精度满足要求。

Comments 5 pages, 5 figures, 1 table. Accepted and presented at the 2026 International Electronics Symposium (IES), Yogyakarta, Indonesia, August 1-3, 2026 (IEEE technically co-sponsored). Authors' accepted version

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03222 2026-08-18 cs.CY cs.AI cs.HC 版本更新 57%

The Fake Friend Dilemma: Relational Trust and the Political Economy of Conversational AI

虚假朋友困境:信任与对话AI的政治经济学

Jacob Erickson

专题命中 其他Agent :AI agent(abstract);分类 cs.AI

AI总结 本文提出虚假朋友困境框架,探讨拟人化AI如何通过隐蔽手段影响用户自主权,分析其在信任与政治经济学中的作用。

Comments Manuscript under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10601 2026-08-13 cs.CY cs.AI 版本更新 57%

Inferential Capability Does Not Determine Legal Scope

推理能力并不决定法律范围

Nicola Fabiano

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 本文探讨欧盟数字法中《人工智能法案》与GDPR对推理的不同界定,指出推理能力不决定法律范围,提出两层框架及组合效果测试等规则,为智能体架构下的相关监管提供解释方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08240 2026-08-11 cs.AI cs.GT cs.MA econ.TH 新提交 57%

A Fair Objective for Human-Empowerment-Preserving AI: Desiderata, Design, and Likely Behavioral Consequences

一种保留人类赋能的公平AI目标: desiderata、设计及可能的行为后果

Jobst Heitzig, Ram Potham

机构 * Potsdam Institute for Climate Impact Research(波茨坦气候影响研究所)

专题命中 其他Agent :AI agent(abstract);分类 cs.AI

AI总结 本文设计了一种保留人类赋能的AI公平目标函数,通过公理化方法兼顾人类权力的不平等与风险规避,明确AI需赋能人类并管理人机权力平衡,还验证了其在典型场景的行为后果。

Comments Slightly extended version of paper accepted for Algorithmic Decision Theory 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22038 2026-08-11 cs.CL 版本更新 57%

Source-Modality Monitoring in Vision-Language Models

视觉-语言模型中的源模态监控

Etha Tianze Hua, Tian Yun, Ellie Pavlick

机构 * Department of Computer Science, Brown University(布朗大学计算机科学系)

专题命中 其他Agent :agentic(abstract);分类 cs.CL

AI总结 研究探讨了多模态模型追踪并沟通信息来源的能力,分析了语法与语义信号在绑定提示词与输入组件中的作用,发现语义信号在模态分布差异大时更占主导。

Comments Accepted at COLM 2026. All resources will be available at https://github.com/ethahtz/source-modality-monitoring

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.06582 2026-08-11 cs.AI cs.SY eess.SY 57%

A Convex Hull Cheapest Insertion Heuristic for the Non-Euclidean TSP

Mithun Goutham, Ethan David Rosati, Hollis Schuler, Meghna Menon, Sarah Garrow, Stephanie Stockar

专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI

Comments Accepted manuscript: Robotics and Autonomous Systems [Elsevier]

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06137 2026-08-07 cs.LG 新提交 57%

SkillTFM: Gated Skill Evolution for Training-Free Adaptation of Tabular Foundation Models

SkillTFM:用于表格基础模型无训练适应的门控技能演化

Yi He, Zhengkang Guan, Anpeng Wu, Peng Cui, Fei Wu, Kun Kuang

专题命中 其他Agent :agentic(abstract);分类 cs.LG

AI总结 SkillTFM是一种无训练系统,通过可验证可扩展的技能库将表格基础模型的适应转向技能门控演化,在电价预测等任务中提升了AUC,且在不同骨干网络上均有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00059 2026-08-07 cs.CY cs.AI 版本更新 57%

Stochastic Parrots or Singing in Harmony? Testing Five Leading LLMs for their Ability to Replicate a Human Survey with Synthetic Data

随机鹦鹉还是和谐合唱?测试五种领先的大语言模型在复制人类调查响应方面的能力

Jason Miklian, Kristian Hoelscher, John E. Katsos

机构 * Centre for Global Sustainability, University of Oslo(全球可持续发展中心,奥斯陆大学) Peace Research Institute Oslo(奥斯陆和平研究所) American University of Sharjah(阿联酋沙迦美国大学)

专题命中 其他Agent :AI agent(abstract);分类 cs.AI

AI总结 本文比较了420名硅谷程序员和开发者的调查数据与五种大语言模型生成的合成数据,发现AI生成的数据在技术上合理但无法捕捉人类调查的非直观洞察,表明合成调查数据在组织研究中存在局限。

Comments V2

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02588 2026-08-04 cs.DS cs.LG 新提交 57%

The Condition-Number Barrier in Sparse Least Squares

稀疏最小二乘中的条件数障碍

Honghao Lin, Vahab Mirrokni, David P. Woodruff

专题命中 其他Agent :agentic(abstract);分类 cs.LG

AI总结 该研究基于特定假设建立了稀疏最小二乘中受限条件数线性依赖的下界,证明不存在满足相关条件的随机多项式时间算法,且证明由Gemini智能体系统完成并经作者验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28360 2026-08-04 cs.AI 版本更新 57%

Prompt Codebooks: Discrete Compositional Optimization for Language Model Instruction Refinement

提示码本:面向语言模型指令精炼的离散组合优化

Jyotirmoy Nath, Neeraj Kumar, Brejesh Lall

机构 * IIT Delhi(印度德里理工学院)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 提出Prompt Codebooks (PCO)框架,将自动提示优化重构为离散组合学习,通过可重用的自然语言本能单元实现实例级路由和结构化反馈,在多个基准上提升性能并压缩提示长度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27428 2026-07-31 physics.med-ph cs.AI 新提交 57%

Rethinking Artificial Intelligence in Medical Imaging: Assumptions, Reality, and Reframing

重新思考医学影像中的人工智能:假设、现实与重构

Arman Rahmim, Nourhan Bayasi, Xiaoxiao Li, Babak Saboury, Fereshteh Yousefirizi

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 本文指出医学影像AI研究转化不足源于结构性错位,明确六大错位维度并提出重构路径,最终愿景是开发与医生对齐、扩展而非替代临床判断的智能体AI。

Comments 10 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26352 2026-07-30 cs.NI cs.AI cs.MA 新提交 57%

Pramana: A Composable, Domain-Specific Backend for Empirical Networking Research

Pramana:面向实证网络研究的可组合领域专用后端

Jaber Daneshamooz, Eugene Vuong, Alagappan Ramanathan, Manni Moghimi, Haarika Manda, Satyam Kumar, Snithik Thode, Satyandra Guthula, Sylee Beltiukov, Dongsu Han, Tarun Mangla, Sangeetha Abdu Jyothi, Walter Willinger, Arpit Gupta

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 本文提出面向实证网络研究的可组合领域专用后端Pramana,其通过单一意图规范实现跨载体运行,概念验证可满足34%的数据生成意图,为加速网络研究提供了支撑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22959 2026-07-28 cs.CV cs.AI 新提交 57%

HALLELUAI: A Hallucination-Aware AI System for Ultra-Realistic Image-to-Video Generation at Scale

HALLELUAI:一个用于大规模超逼真图像到视频生成的幻觉感知人工智能系统

Aniket Sakpal, Yang Jiang, Rouzbeh Davoudi, Shayan Hassantabar, Mani Najmabadi

机构 * Expedia Group(亿客行集团)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 针对AI生成视频时质量控制难的问题,HALLELUAI系统集成视频调节与智能再生模块,能评估风险并迭代修复。经人工参与评估,该系统可输出超逼真视频,推动了可信AI视频内容发展,实现大规模图像到视频生成。

Comments 10 pages, 4 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21625 2026-07-27 cs.AI 新提交 57%

Trajectory-Aware Retrieval Agents for Temporal Decision- Making

用于时间决策的轨迹感知检索代理

Jing Wang, Jie Shen, Xing Niu

机构 * Amazon(亚马逊)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 研究用大语言模型代理从长篇时间结构化文本中决策的问题,针对标准RAG丢弃时间结构缺陷,引入闭环代理框架TLM,其关键技术是LGCM,在医学问答、收益电话会议惊喜预测和隔夜股票缺口预测任务中表现出色。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19213 2026-07-22 cs.RO cs.AI 新提交 57%

Computing on the Fly: Navigating a Vision for the Future of Drone Computing

即时计算:展望无人机计算的未来

Kevin Butler, Christopher Stewart, Nils Aschenbruck, Alina Gerall, Weisong Shi, Deborah Silver, Ufuk Topcu

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 报告设想无人机大规模运输货物等的未来,指出需弥合能力差距,确定了实现无人机技术变革潜力的十二个技术挑战及应对方法,为无人机技术发展规划了多方面的前进路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16680 2026-07-21 cs.SE 新提交 57%

Specification-Driven Development as the Foundation of AI-Native Enterprise Software Engineering

规范驱动开发作为人工智能原生企业软件工程的基础

Mamdouh Alenezi

专题命中 其他Agent :agentic(abstract);分类 cs.SE

AI总结 研究大语言模型和智能人工智能推动下软件工程范式转变,介绍规范驱动开发,提出规范治理参考模型,经评估能减少安全缺陷、缩短上市时间,证明企业软件需规范治理,vibe编码适用于构思和快速原型制作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22590 2026-07-21 cs.LG cs.CR eess.AS 版本更新 57%

Precision-Varying Prediction (PVP): Robustifying ASR systems against adversarial attacks

精度变化预测(PVP):增强语音识别系统对对抗攻击的鲁棒性

Matías Pizarro, Raghavan Narasimhan, Jonas Killian, Asja Fischer

机构 * Faculty of Computer Science, Ruhr University Bochum, Germany(计算机科学系,博尔塔伦鲁尔大学)

专题命中 其他Agent :agentic(abstract);分类 cs.LG

AI总结 本文提出PVP方法,通过在推理过程中随机采样精度来提高ASR系统对对抗攻击的鲁棒性,并利用不同精度的输出进行对抗示例检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14553 2026-07-17 cs.AI cs.MA 新提交 57%

Towards an Intention Abstraction Layer for Autonomous Industrial Systems

迈向自主工业系统的意图抽象层

Artan Markaj, Raphael Höfer, Felix Gehlhoff

专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI

AI总结 针对自主工业系统中各子系统运行目标冲突难以及时发现的问题,提出意图抽象层(IAL),通过大型语言模型等将自然语言目标解析为结构化意图,检测并解释冲突,实现执行前意图级检查,保障协作自主系统行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.04868 2026-07-17 cs.HC cs.CL cs.DB 版本更新 57%

Beyond Interestingness: Semantic and Context-Aware Natural Language Query Recommendations for Visual Data Analysis

超越趣味性:用于视觉数据分析的语义和上下文感知自然语言查询推荐

Xingbo Wang, Siyuan Li, Furui Cheng, Yong Wang, Jiang Long, Hong Lu, Huamin Qu, Ke Xu

专题命中 其他Agent :agentic(abstract);分类 cs.CL

AI总结 针对分析师分解查询目标的挑战,研究用语义和上下文感知推荐增强自然语言接口,联合整合多种因素引导数据库探索,经多方式评估,QRec-NLI在代理比较和用户研究中表现优于基线。

Comments This is the preprint version of the paper accepted to Visual Informatics journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11039 2026-07-14 cs.HC cs.AI 新提交 57%

Same Stories, Different Journeys: From Social Comparison to Sensemaking in AI-Mediated Peer Career Exploration

相同的故事,不同的旅程:从社交媒体比较到人工智能介导的同伴职业探索中的意义建构

Pengping Tan, Baoquan Zhao, Zhenhui Peng

机构 * Sun Yat-sen University(中山大学)

专题命中 其他Agent :AI agent(abstract);分类 cs.AI

AI总结 研究针对年轻求职者在社交媒体职业探索时被动浏览的问题,开发JobMate交互式系统,将真实帖子转化为对话式AI代理,通过对比研究发现其能引导社会比较转向建设性自我重构并促进意义建构,还探讨了相关AI系统设计启示。

Comments 10 pages, 7 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏