Inverse Reward Design
专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI、cs.LG
Comments Advances in Neural Information Processing Systems 30 (NIPS 2017) Revised Oct 2020 to fix a typo in Eq. 3
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI、cs.LG
Comments Advances in Neural Information Processing Systems 30 (NIPS 2017) Revised Oct 2020 to fix a typo in Eq. 3
专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.LG
Comments 8 pages
专题命中 其他Agent :AI agent(abstract);分类 cs.CL、cs.LG
Comments Accepted at Deep Learning for low-resource NLP workshop @ EMNLP 2019
专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI、cs.LG
专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI、cs.CL
Journal ref Proceedings of AAAI Spring Symposium on Natural Language Generation in Spoken and Written Dialogue, Stanford, 2003
机构 * Arizona State University(亚利桑那州立大学) ; Kitware, Inc(Kitware公司) ; Columbia University(哥伦比亚大学)
专题命中 其他Agent :agentic(abstract);分类 cs.CL;AI agent(comments)
Comments Accepted as a paper at COLM 2025 Workshop on AI Agents: Capabilities and Safety
机构 * University of Warsaw(华沙大学)
专题命中 其他Agent :AI agent(abstract);分类 cs.AI;autonomous agent(comments)
Comments In proceedings of the 24th International Conference on Autonomous Agents and Multiagent Systems (AAMAS-2025), pages 1996--2005, May 19-23, Detroit, Michigan, USA
高级人工智能系统的能动性三维类型学
机构 * Stellenbosch University(斯泰伦博斯大学) ; School for Data Science and Computational Thinking(数据科学与计算思维学院)
专题命中 其他Agent :agentic(abstract);分类 cs.AI
AI总结 该研究构建了前沿AI系统能动性的三维类型学,区分法律与道德能动性,为非人类AI的能动性考量提供概念框架,解决AI行为归因复杂化的问题。
事后辩论评判理论
专题命中 其他Agent :agentic(abstract);分类 cs.AI
AI总结 本文提出适用于智能体辩论场景的事后辩论评判理论,探究两种评判方法的属性满足情况,发现辩论语义是辩论驱动型AI原则性评判者的理想候选。
TrojanGYM:一种检测器在环的大语言模型用于自适应RTL硬件木马插入
机构 * NYU Tandon School of Engineering(纽约大学Tandon工程学院) ; NYU Abu Dhabi(纽约大学阿布扎克分校)
专题命中 其他Agent :agentic(abstract);分类 cs.AI
AI总结 提出TrojanGYM框架,利用大语言模型智能体自动生成多样化的硬件木马,暴露基于GNN的检测器盲点,并设计鲁棒检测器Robust-GNN4TJ,在生成的基准上将检测率从0%提升至60%。
成本随变化量而非语料库规模变化:增量式维护演化中的语义基底
专题命中 其他Agent :agentic(abstract);分类 cs.AI
AI总结 该研究提出语义基底维护成本随变化量而非语料库规模变化,通过增量低秩更新等方法,以远低于完整重构的成本实现语义基底的高效维护,且精度满足要求。
Comments 5 pages, 5 figures, 1 table. Accepted and presented at the 2026 International Electronics Symposium (IES), Yogyakarta, Indonesia, August 1-3, 2026 (IEEE technically co-sponsored). Authors' accepted version
虚假朋友困境:信任与对话AI的政治经济学
专题命中 其他Agent :AI agent(abstract);分类 cs.AI
AI总结 本文提出虚假朋友困境框架,探讨拟人化AI如何通过隐蔽手段影响用户自主权,分析其在信任与政治经济学中的作用。
Comments Manuscript under review
推理能力并不决定法律范围
专题命中 其他Agent :agentic(abstract);分类 cs.AI
AI总结 本文探讨欧盟数字法中《人工智能法案》与GDPR对推理的不同界定,指出推理能力不决定法律范围,提出两层框架及组合效果测试等规则,为智能体架构下的相关监管提供解释方案。
一种保留人类赋能的公平AI目标: desiderata、设计及可能的行为后果
机构 * Potsdam Institute for Climate Impact Research(波茨坦气候影响研究所)
专题命中 其他Agent :AI agent(abstract);分类 cs.AI
AI总结 本文设计了一种保留人类赋能的AI公平目标函数,通过公理化方法兼顾人类权力的不平等与风险规避,明确AI需赋能人类并管理人机权力平衡,还验证了其在典型场景的行为后果。
Comments Slightly extended version of paper accepted for Algorithmic Decision Theory 2026
视觉-语言模型中的源模态监控
机构 * Department of Computer Science, Brown University(布朗大学计算机科学系)
专题命中 其他Agent :agentic(abstract);分类 cs.CL
AI总结 研究探讨了多模态模型追踪并沟通信息来源的能力,分析了语法与语义信号在绑定提示词与输入组件中的作用,发现语义信号在模态分布差异大时更占主导。
Comments Accepted at COLM 2026. All resources will be available at https://github.com/ethahtz/source-modality-monitoring
专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI
Comments Accepted manuscript: Robotics and Autonomous Systems [Elsevier]
SkillTFM:用于表格基础模型无训练适应的门控技能演化
专题命中 其他Agent :agentic(abstract);分类 cs.LG
AI总结 SkillTFM是一种无训练系统,通过可验证可扩展的技能库将表格基础模型的适应转向技能门控演化,在电价预测等任务中提升了AUC,且在不同骨干网络上均有效。
随机鹦鹉还是和谐合唱?测试五种领先的大语言模型在复制人类调查响应方面的能力
机构 * Centre for Global Sustainability, University of Oslo(全球可持续发展中心,奥斯陆大学) ; Peace Research Institute Oslo(奥斯陆和平研究所) ; American University of Sharjah(阿联酋沙迦美国大学)
专题命中 其他Agent :AI agent(abstract);分类 cs.AI
AI总结 本文比较了420名硅谷程序员和开发者的调查数据与五种大语言模型生成的合成数据,发现AI生成的数据在技术上合理但无法捕捉人类调查的非直观洞察,表明合成调查数据在组织研究中存在局限。
Comments V2
稀疏最小二乘中的条件数障碍
专题命中 其他Agent :agentic(abstract);分类 cs.LG
AI总结 该研究基于特定假设建立了稀疏最小二乘中受限条件数线性依赖的下界,证明不存在满足相关条件的随机多项式时间算法,且证明由Gemini智能体系统完成并经作者验证。
提示码本:面向语言模型指令精炼的离散组合优化
机构 * IIT Delhi(印度德里理工学院)
专题命中 其他Agent :agentic(abstract);分类 cs.AI
AI总结 提出Prompt Codebooks (PCO)框架,将自动提示优化重构为离散组合学习,通过可重用的自然语言本能单元实现实例级路由和结构化反馈,在多个基准上提升性能并压缩提示长度。
重新思考医学影像中的人工智能:假设、现实与重构
专题命中 其他Agent :agentic(abstract);分类 cs.AI
AI总结 本文指出医学影像AI研究转化不足源于结构性错位,明确六大错位维度并提出重构路径,最终愿景是开发与医生对齐、扩展而非替代临床判断的智能体AI。
Comments 10 pages, 2 figures
Pramana:面向实证网络研究的可组合领域专用后端
专题命中 其他Agent :agentic(abstract);分类 cs.AI
AI总结 本文提出面向实证网络研究的可组合领域专用后端Pramana,其通过单一意图规范实现跨载体运行,概念验证可满足34%的数据生成意图,为加速网络研究提供了支撑。
HALLELUAI:一个用于大规模超逼真图像到视频生成的幻觉感知人工智能系统
机构 * Expedia Group(亿客行集团)
专题命中 其他Agent :agentic(abstract);分类 cs.AI
AI总结 针对AI生成视频时质量控制难的问题,HALLELUAI系统集成视频调节与智能再生模块,能评估风险并迭代修复。经人工参与评估,该系统可输出超逼真视频,推动了可信AI视频内容发展,实现大规模图像到视频生成。
Comments 10 pages, 4 figures, 3 tables
用于时间决策的轨迹感知检索代理
机构 * Amazon(亚马逊)
专题命中 其他Agent :agentic(abstract);分类 cs.AI
AI总结 研究用大语言模型代理从长篇时间结构化文本中决策的问题,针对标准RAG丢弃时间结构缺陷,引入闭环代理框架TLM,其关键技术是LGCM,在医学问答、收益电话会议惊喜预测和隔夜股票缺口预测任务中表现出色。
即时计算:展望无人机计算的未来
专题命中 其他Agent :agentic(abstract);分类 cs.AI
AI总结 报告设想无人机大规模运输货物等的未来,指出需弥合能力差距,确定了实现无人机技术变革潜力的十二个技术挑战及应对方法,为无人机技术发展规划了多方面的前进路径。
规范驱动开发作为人工智能原生企业软件工程的基础
专题命中 其他Agent :agentic(abstract);分类 cs.SE
AI总结 研究大语言模型和智能人工智能推动下软件工程范式转变,介绍规范驱动开发,提出规范治理参考模型,经评估能减少安全缺陷、缩短上市时间,证明企业软件需规范治理,vibe编码适用于构思和快速原型制作。
精度变化预测(PVP):增强语音识别系统对对抗攻击的鲁棒性
机构 * Faculty of Computer Science, Ruhr University Bochum, Germany(计算机科学系,博尔塔伦鲁尔大学)
专题命中 其他Agent :agentic(abstract);分类 cs.LG
AI总结 本文提出PVP方法,通过在推理过程中随机采样精度来提高ASR系统对对抗攻击的鲁棒性,并利用不同精度的输出进行对抗示例检测。
迈向自主工业系统的意图抽象层
专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI
AI总结 针对自主工业系统中各子系统运行目标冲突难以及时发现的问题,提出意图抽象层(IAL),通过大型语言模型等将自然语言目标解析为结构化意图,检测并解释冲突,实现执行前意图级检查,保障协作自主系统行为。
超越趣味性:用于视觉数据分析的语义和上下文感知自然语言查询推荐
专题命中 其他Agent :agentic(abstract);分类 cs.CL
AI总结 针对分析师分解查询目标的挑战,研究用语义和上下文感知推荐增强自然语言接口,联合整合多种因素引导数据库探索,经多方式评估,QRec-NLI在代理比较和用户研究中表现优于基线。
Comments This is the preprint version of the paper accepted to Visual Informatics journal
相同的故事,不同的旅程:从社交媒体比较到人工智能介导的同伴职业探索中的意义建构
机构 * Sun Yat-sen University(中山大学)
专题命中 其他Agent :AI agent(abstract);分类 cs.AI
AI总结 研究针对年轻求职者在社交媒体职业探索时被动浏览的问题,开发JobMate交互式系统,将真实帖子转化为对话式AI代理,通过对比研究发现其能引导社会比较转向建设性自我重构并促进意义建构,还探讨了相关AI系统设计启示。
Comments 10 pages, 7 figures, 2 tables