arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2025-12-04 至 2025-12-04 共收录 84 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 33 篇

2501.19306 2025-12-04 cs.AI cs.CL 62%

SETS: Leveraging Self-Verification and Self-Correction for Improved Test-Time Scaling

SETS:利用自我验证和自我校正以提高测试时间扩展

Jiefeng Chen, Jie Ren, Xinyun Chen, Chengrun Yang, Ruoxi Sun, Jinsung Yoon, Sercan Ö Arık

机构 * Google Cloud AI Research(谷歌云人工智能研究)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.CL

AI总结 SETS通过结合并行与顺序技术,利用LLMs的自我改进能力,在无需模型训练的情况下提升测试时间扩展性能。

Comments Published in Transactions on Machine Learning Research (11/2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.05826 2025-12-04 cs.CV cs.AI cs.LG 62%

From Pixels to Prose: Advancing Multi-Modal Language Models for Remote Sensing

从像素到 prose:推进遥感多模态语言模型

Xintian Sun, Benji Peng, Charles Zhang, Fei Jin, Qian Niu, Junyu Liu, Keyu Chen, Ming Li, Pohsun Feng, Ziqian Bi, Ming Liu, Xinyuan Song, Yichao Zhang

机构 * Simon Fraser University(西蒙弗雷泽大学) University of Minnesota - Twin Cities(明尼苏达大学双城分校) Kyoto University(京都大学) Georgia Institute of Technology(佐治亚理工学院) National Taiwan Normal University(台湾师范大学) Purdue University(普渡大学) Emory University(埃默里大学) The University of Texas at Dallas(德克萨斯大学达拉斯分校)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文探讨了多模态语言模型在遥感中的应用,分析了其技术基础、挑战及未来发展方向,强调了其在环境监测和灾害响应中的重要作用。

Comments 10 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22619 2025-12-04 cs.AI 57%

AI Deception: Risks, Dynamics, and Controls

AI欺骗:风险、动态与控制

Boyuan Chen, Sitong Fang, Jiaming Ji, Yanxu Zhu, Pengcheng Wen, Jinzhou Wu, Yingshui Tan, Boren Zheng, Mengying Yuan, Wenqi Chen, Donghai Hong, Alex Qiu, Xin Chen, Jiayi Zhou, Kaile Wang, Juntao Dai, Borong Zhang, Tianzhuo Yang, Saad Siddiqui, Isabella Duan, Yawen Duan, Brian Tse, Jen-Tse, Huang, Kun Wang, Baihui Zheng, Jiaheng Liu, Jian Yang, Yiming Li, Wenting Chen, Dongrui Liu, Lukas Vierling, Zhiheng Xi, Haobo Fu, Wenxuan Wang, Jitao Sang, Zhengyan Shi, Chi-Min Chan, Eugenie Shi, Simin Li, Juncheng Li, Jian Yang, Wei Ji, Dong Li, Jinglin Yang, Jun Song, Yinpeng Dong, Jie Fu, Bo Zheng, Min Yang, Yike Guo, Philip Torr, Robert Trager, Yi Zeng, Zhongyuan Wang, Yaodong Yang, Tiejun Huang, Ya-Qin Zhang, Hongjiang Zhang, Andrew Yao

专题命中 规划决策 :AI agent(abstract);分类 cs.AI

AI总结 本文探讨了AI欺骗的风险、动态及控制,提出欺骗循环模型,分析欺骗出现机制与处理方法,并提出缓解策略与审计方法以应对AI安全挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19499 2025-12-04 cs.CV cs.AI 57%

Sat2Flow: A Structure-Aware Diffusion Framework for Human Flow Generation from Satellite Imagery

Sat2Flow: 一种结构感知的扩散框架,用于从卫星图像生成人类流量

Xiangxu Wang, Tianhong Zhao, Wei Tu, Bowen Zhang, Guanzhou Chen, Jinzhou Cao

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 Sat2Flow通过结构感知的扩散框架,利用卫星图像生成结构一致的OD流量,解决了现有方法对辅助数据依赖和空间拓扑变化敏感的问题。

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16411 2025-12-04 cs.RO cs.LG 57%

The Duality of Generative AI and Reinforcement Learning in Robotics: A Review

生成式人工智能与强化学习在机器人中的双重性:综述

Angelo Moroncelli, Vishal Soni, Marco Forgione, Dario Piga, Blerina Spahiu, Loris Roveda

机构 * SUPSI(瑞士苏黎世联邦理工学院)

专题命中 规划决策 :AI agent(abstract);分类 cs.LG

AI总结 本文综述了生成式人工智能与强化学习在机器人中的双重性,探讨了两者的整合方法、挑战及未来研究方向。

Comments Submitted for publication to Information Fusion

Journal ref Information Fusion Volume 129, May 2026, 104003

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18303 2025-12-04 cs.LG cond-mat.mes-hall cond-mat.mtrl-sci 57%

Hierarchical Deep Research with Local-Web RAG: Toward Automated System-Level Materials Discovery

分层深度研究与本地Web RAG:迈向自动化系统级材料发现

Rui Ding, Rodrigo Pires Ferreira, Yuxin Chen, Junhong Chen

机构 * Pritzker School of Molecular Engineering, University of Chicago(芝加哥大学普利兹克分子工程学院) Chemical Sciences and Engineering Division, Argonne National Laboratory(阿贡国家实验室化学科学与工程 division) Department of Computer Science, University of Chicago(芝加哥大学计算机科学系)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文提出一种分层深度研究代理,通过本地Web RAG和DToR机制,实现低成本高质的自动化系统级材料发现。

Comments A preliminary version appeared in The AI for Accelerated Materials Discovery (AI4Mat) Workshop at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04082 2025-12-04 cs.CV 50%

PosterCopilot: Toward Layout Reasoning and Controllable Editing for Professional Graphic Design

PosterCopilot: 向专业图形设计中的布局推理与可控编辑迈进

Jiazhe Wei, Ken Li, Tianyu Lao, Haofan Wang, Liang Wang, Caifeng Shan, Chenyang Si

机构 * PRLab, Nanjing University(南京大学PRLab) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 规划决策 :workflow(abstract)

AI总结 PosterCopilot通过三阶段训练策略和完整工作流程,实现专业图形设计中布局推理与可控编辑的提升。

Comments Project page: https://postercopilot.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03684 2025-12-04 cs.RO 50%

A Novel Approach to Tomato Harvesting Using a Hybrid Gripper with Semantic Segmentation and Keypoint Detection

一种基于语义分割和关键点检测的新型番茄采摘方法

Shahid Ansari, Mahendra Kumar Gohil, Yusuke Maeda, Bishakh Bhattacharya

机构 * TSTS

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种结合语义分割和关键点检测的新型番茄采摘系统,通过混合机械手和智能控制实现高效、安全的采摘

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03630 2025-12-04 cs.RO 50%

Multimodal Control of Manipulators: Coupling Kinematics and Vision for Self-Driving Laboratory Operations

多模态操作臂控制:结合运动学与视觉的自我驱动实验室操作

Shifa Sulaiman, Amarnath H, Simon Bogh, Naresh Marturi

机构 * 1 Department of Electronics Systems, Aalborg University, Denmark 3 Extreme Robotics Laboratory, School of Metallurgy \& Materials, University of Birmingham, Birmingham, United Kingdom

专题命中 规划决策 :planning(abstract)

AI总结 本文提出三种基于雅可比方法的运动规划方案,结合RRT*算法和螺旋理论,用于优化冗余机械臂与耦合手指夹具的轨迹规划与逆解计算,以提升实验室自动化操作的效率与精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01955 2025-12-04 physics.soc-ph cs.ET 50%

Dynamic Estimates of Displacement in Disaster Regions: A Policy-driven framework triangulating data

灾害地区位移的动态估计:一种基于政策的框架,整合数据

Elisabetta Pietrostefani, Matt Mason, Rodgers Iradukunda, Hong Tran-Jones, Iryna Loktieva, Francisco Rowe

专题命中 规划决策 :planning(abstract)

AI总结 本报告提出了一种基于政策的框架,整合传统数据与数字痕迹数据,以提高灾害地区位移监测的准确性和实时响应能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04018 2025-12-04 cs.RO 50%

FPC-VLA: A Vision-Language-Action Framework with a Supervisor for Failure Prediction and Correction

FPC-VLA:一个带有监督器的视觉-语言-动作框架,用于故障预测和纠正

Yifan Yang, Zhixiang Duan, Tianshi Xie, Fuyu Cao, Pinxi Shen, Peili Song, Piaopiao Jin, Guokang Sun, Shaoqing Xu, Yangwei You, Jingtai Liu

机构 * The Institute of Robotics and Automatic Information System(机器人与自动信息系统研究所) Tianjin Key Laboratory of Intelligent Robotics(智能机器人天津重点实验室) TBI Center, Nankai University, Tianjin 300350, China(南开大学天津中心) Faculty of Robot Science and Engineering, Northeastern University, Shenyang 110819, China(机器人科学与工程学院) The State Key Laboratory of Internet of Things for Smart City(智能城市物联网国家重点实验室) Centre for Artificial Intelligence(人工智能中心) Department of Electromechanical Engineering, University of Macau, Macau SAR, China(机电工程系,澳门大学)

专题命中 规划决策 :planning(abstract)

AI总结 FPC-VLA 提出了一种双模型框架,结合视觉-语言-动作模块与监督器,用于预测和纠正机器人操作中的故障,提升了自主系统的可靠性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 多智能体 17 篇

2509.08863 2025-12-04 cs.SE 92%

GeoJSON Agents:A Multi-Agent LLM Architecture for Geospatial Analysis-Function Calling vs Code Generation

GeoJSON代理:一种用于地理空间分析的多智能体LLM架构——功能调用与代码生成

Qianqian Luo, Qingming Lin, Liuchang Xu, Sensen Wu, Ruichen Mao, Chao Wang, Hailin Feng, Bo Huang, Zhenhong Du

专题命中 多智能体 :agent(title,abstract);function calling(title,abstract);multi-agent(title,abstract);分类 cs.SE

AI总结 GeoJSON代理通过功能调用与代码生成技术,提升地理空间分析任务的准确性和稳定性,展现多智能体LLM在复杂任务中的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03285 2025-12-04 cs.MA cs.ET 91%

A Gossip-Enhanced Communication Substrate for Agentic AI: Toward Decentralized Coordination in Large-Scale Multi-Agent Systems

一种增强型通信子系统用于代理AI:迈向大规模多智能体系统中的去中心化协调

Nafiul I. Khan, Mansura Habiba, Rafflesia Khan

专题命中 多智能体 :agent(title,abstract);agentic(title,abstract);multi-agent(title,abstract)

AI总结 本文提出利用 gossip 协议增强代理通信,以实现大规模多智能体系统中的去中心化协调,强调其在适应性和鲁棒性方面的关键作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07506 2025-12-04 cs.DC cs.AI cs.CL cs.LG cs.SE 90%

Astra: A Multi-Agent System for GPU Kernel Performance Optimization

Astra:一种用于GPU内核性能优化的多智能体系统

Anjiang Wei, Tianran Sun, Yogesh Seenichamy, Hang Song, Anne Ouyang, Azalia Mirhoseini, Ke Wang, Alex Aiken

机构 * Stanford University(斯坦福大学) Shanghai Jiao Tong University(上海交通大学) Nanjing University(南京大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 Astra是首个基于LLM的多智能体系统,用于优化GPU内核性能,通过协作生成高效内核并实现显著加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23315 2025-12-04 cs.AI cs.CE cs.LG 90%

AI Agents in Engineering Design: A Multi-Agent Framework for Aesthetic and Aerodynamic Car Design

工程设计中的AI代理:一种用于汽车外观和空气动力学设计的多代理框架

Mohamed Elrefaie, Janet Qian, Raina Wu, Qian Chen, Angela Dai, Faez Ahmed

机构 * Department of Mechanical Engineering, Massachusetts Institute of Technology, Cambridge, MA, USA(麻省理工学院机械工程系) Department of Electrical Engineering and Computer Science, Massachusetts Institute of Technology, Cambridge, MA, USA(麻省理工学院电气工程与计算机科学系) Department of Computer Science, Technical University of Munich, Munich, Germany(慕尼黑技术大学计算机科学系)

专题命中 多智能体 :agent(title);AI agent(title);multi-agent(title);workflow(abstract)

AI总结 本研究提出了一种多代理框架,利用AI代理提升汽车设计的美学和空气动力学性能,通过自动化任务加速设计流程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03166 2025-12-04 cs.RO cs.CV 89%

Multi-Agent Reinforcement Learning and Real-Time Decision-Making in Robotic Soccer for Virtual Environments

多智能体强化学习与虚拟环境中的实时决策在机器人足球中的应用

Aya Taourirte, Md Sohag Mia

机构 * Nanjing University of Information Science and Technology(南京信息工程大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract)

AI总结 本文提出了一种统一的多智能体强化学习框架,通过分层强化学习和均值场理论,提升了机器人足球中的实时决策与协作性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03466 2025-12-04 cs.MA cs.AI 88%

AsymPuzl: An Asymmetric Puzzle for multi-agent cooperation

AsymPuzl:多智能体合作中的非对称谜题

Xavier Cadet, Edward Koh, Peter Chin

机构 * Dartmouth College(达特茅斯学院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 AsymPuzl通过非对称谜题环境研究多智能体合作中的通信策略与反馈机制。

Comments Accepted at NeurIPS MTI-LLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03445 2025-12-04 cs.CV cs.AI 88%

Multi-Aspect Knowledge-Enhanced Medical Vision-Language Pretraining with Multi-Agent Data Generation

多方面知识增强的医学视觉-语言预训练与多代理数据生成

Xieji Li, Siyuan Yan, Yingsheng Liu, H. Peter Soyer, Monika Janda, Victoria Mar, Zongyuan Ge

机构 * Department of Data Science and AI, Faculty of Information Technology, Monash University(数据科学与人工智能系,信息科技学院,墨尔本大学) Victorian Melanoma Service, Alfred Health(维多利亚黑色素瘤服务,阿尔弗雷德健康) Frazer Institute, The University of Queensland, Dermatology Research Centre(弗雷泽研究所,昆士兰大学,皮肤科研究中心)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本研究提出一种多代理数据生成与多方面知识增强的医学视觉-语言预训练框架,通过提升数据质量和细粒度对齐,实现零样本性能的突破。

Comments 10 pages. Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03097 2025-12-04 cs.CR cs.LG cs.MA 88%

Many-to-One Adversarial Consensus: Exposing Multi-Agent Collusion Risks in AI-Based Healthcare

多对一对抗共识:揭示基于AI的医疗保健中多智能体合谋的风险

Adeela Bashir, The Anh han, Zia Ush Shamszaman

机构 * School of Computing, Engineering and Digital Technologies(计算、工程与数字技术学院) Teesside University(泰赛德大学) Center for Digital Innovation(数字创新中心)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 本研究揭示了基于AI的医疗保健中多智能体合谋的风险,提出了一种轻量级防御机制以确保临床指南的准确性。

Comments 7 pages Conference level paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01173 2025-12-04 cs.LG cs.MA 88%

MARS: A Meta-Adaptive Reinforcement Learning Framework for Risk-Aware Multi-Agent Portfolio Management

MARS:一种面向风险的多智能体投资组合管理元适应强化学习框架

Jiayi Chen, Jing Li, Guiling Wang

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 MARS通过多智能体和风险导向的方法,实现投资组合管理中风险与收益的平衡,利用行为多样性提升市场环境下的稳健性。

Comments Accepted by AAAI 2026 Main Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03835 2025-12-04 eess.SY cs.SY 88%

Multi-Agent Deep Reinforcement Learning for UAV-Assisted 5G Network Slicing: A Comparative Study of MAPPO, MADDPG, and MADQN

多智能体深度强化学习用于无人机辅助5G网络切片:MAPPO、MADDPG和MADQN的比较研究

Ghoshana Bista, Abbas Bradai, Emmanuel Moulay, Abdulhalim Dandoush

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文通过比较MAPPO、MADDPG和MADQN,探讨了多智能体深度强化学习在无人机辅助5G网络切片中的应用,分析了不同算法在QoS、能耗和环境适应性方面的表现。

Comments 19 pages, 13 figures. Under review for journal submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03694 2025-12-04 cs.MA 88%

SRPG: Semantically Reconstructed Privacy Guard for Zero-Trust Privacy in Educational Multi-Agent Systems

SRPG:用于教育多智能体系统的语义重建隐私保护

Shuang Guo, Zihui Li

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 SRPG通过双流重建机制在教育多智能体系统中实现零PII泄露,提升教学效果与隐私保护。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20772 2025-12-04 math.OC cs.MA cs.SY eess.SY 88%

Welfare and Cost Aggregation for Multi-Agent Control: When to Choose Which Social Cost Function, and Why?

福利与成本聚合用于多智能体控制:何时选择哪种社会成本函数,为何?

Ilia Shilov, Ezzat Elokda, Sophie Hall, Heinrich H. Nax, Saverio Bolognani

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文探讨了多智能体控制中社会成本函数的选择依据,通过社会选择理论指导如何根据个体成本可比性与公理选择合适的SCF,用于资源合理分配。

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.19283 2025-12-04 cs.LG 86%

MAP-Former: Multi-Agent-Pair Gaussian Joint Prediction

MAP-Former: 多智能体对高斯联合预测

Marlon Steiner, Marvin Klemp, Christoph Stiller

专题命中 多智能体 :agent(title,abstract);multi-agent(title);分类 cs.LG

AI总结 MAP-Former通过预测智能体对协方差矩阵,实现基于高斯联合PDF的场景中心运动预测,以提升交通轨迹风险评估的准确性。

Comments Accepted for publication in Proceedings of the IEEE Intelligent Vehicles Symposium (IV), Jeju Island - Korea, 2-5 June 2024

Journal ref 2024 IEEE Intelligent Vehicles Symposium (IV), Jeju Island, Korea, Republic of, 2024, pp. 758-764

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03708 2025-12-04 math.OC 78%

A Lyapunov-based MPC for Distributed Multi Agent Systems with Time Delays and Packet Dropouts using Hidden Markov Models

基于隐藏马尔可夫模型的Lyapunov基于MPC用于具有时间延迟和丢包的分布式多智能体系统

Loaie Solyman, Aamir Ahmad, Ayman El-Badawy

专题命中 多智能体 :agent(title,abstract)

AI总结 本文提出一种结合半连续隐藏马尔可夫模型与Lyapunov基于MPC的框架,用于在存在网络缺陷和拓扑限制的分布式多智能体系统中实现最优控制。

Comments 12 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03248 2025-12-04 cs.MA cs.AI cs.LG eess.SP 73%

Learning Network Sheaves for AI-native Semantic Communication

面向AI原生语义通信的网络sheaf学习

Enrico Grimaldi, Mario Edoardo Pandolfo, Gabriele D'Acunto, Sergio Barbarossa, Paolo Di Lorenzo

机构 * Department of Computer, Control and Management Engineering, Sapienza University of Rome, Italy(计算机、控制与管理工程系,罗马萨皮恩扎大学) National Inter-University Consortium for Telecommunications (CNIT), Parma, Italy(电信国家大学联合体(CNIT),帕尔马,意大利) Department of Information Engineering, Electronics, and Telecommunications, Sapienza University, Rome, Italy(信息工程、电子与电信系,罗马萨皮恩扎大学)

专题命中 多智能体 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种学习网络sheaf的方法,用于AI原生语义通信,通过语义去噪和压缩提升AI代理的对齐与语义聚类提取能力。

Journal ref Proceedings for 2025 Asilomar Conference on Signals, Systems, and Computers

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03318 2025-12-04 cs.AI 70%

Evaluating Generalization Capabilities of LLM-Based Agents in Mixed-Motive Scenarios Using Concordia

利用Concordia评估基于LLM的智能体在混合动机场景中的泛化能力

Chandler Smith, Marwa Abdulhai, Manfred Diaz, Marko Tesic, Rakshit S. Trivedi, Alexander Sasha Vezhnevets, Lewis Hammond, Jesse Clifton, Minsuk Chang, Edgar A. Duéñez-Guzmán, John P. Agapiou, Jayd Matyas, Danny Karmon, Akash Kundu, Aliaksei Korshuk, Ananya Ananya, Arrasy Rahman, Avinaash Anand Kulandaivel, Bain McHale, Beining Zhang, Buyantuev Alexander, Carlos Saith Rodriguez Rojas, Caroline Wang, Chetan Talele, Chenao Liu, Chichen Lin, Diana Riazi, Di Yang Shi, Emanuel Tewolde, Elizaveta Tennant, Fangwei Zhong, Fuyang Cui, Gang Zhao, Gema Parreño Piqueras, Hyeonggeun Yun, Ilya Makarov, Jiaxun Cui, Jebish Purbey, Jim Dilkes, Jord Nguyen, Lingyun Xiao, Luis Felipe Giraldo, Manuela Chacon-Chamorro, Manuel Sebastian Rios Beltran, Marta Emili García Segura, Mengmeng Wang, Mogtaba Alim, Nicanor Quijano, Nico Schiavone, Olivia Macmillan-Scott, Oswaldo Peña, Peter Stone, Ram Mohan Rao Kadiyala, Rolando Fernandez, Ruben Manrique, Sunjia Lu, Sheila A. McIlraith, Shamika Dhuri, Shuqing Shi, Siddhant Gupta, Sneheel Sarangi, Sriram Ganapathi Subramanian, Taehun Cha, Toryn Q. Klassen, Wenming Tu, Weijian Fan, Wu Ruiyang, Xue Feng, Yali Du, Yang Liu, Yiding Wang, Yipeng Kang, Yoonchang Sung, Yuxuan Chen, Zhaowei Zhang, Zhihan Wang, Zhiqiang Wu, Ziang Chen, Zilong Zheng, Zixia Jia, Ziyan Wang, Dylan Hadfield-Menell, Natasha Jaques, Tim Baarslag, Jose Hernandez-Orallo, Joel Z. Leibo

机构 * Cooperative AI Foundation(合作人工智能基金会) University of Oxford(牛津大学) UC Berkeley(伯克利大学) Quebec Artificial Intelligence Institute(魁北克人工智能研究所) Leverhulme Centre for the Future of Intelligence, University of Cambridge(未来智能研究中心,剑桥大学) MIT(麻省理工学院) Google DeepMind(谷歌DeepMind) Center on Long-Term Risk(长期风险中心) Google Research(谷歌研究) University of Washington(华盛顿大学) Centrum Wiskunde & Informatica(数学与信息研究所) Utrecht University(乌得勒支大学) Universitat Politècnica de València(瓦伦西亚理工大学) Concordia Contest Participants with Notable Contributions(康科德比赛有显著贡献的参与者)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出利用Concordia评估LLM智能体在混合动机场景中的合作能力,揭示了当前智能体在泛化能力上的不足。

Comments Published at NeurIPS Datasets and Benchmarks 2025, 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03874 2025-12-04 cs.RO cs.LG 57%

OmniDexVLG: Learning Dexterous Grasp Generation from Vision Language Model-Guided Grasp Semantics, Taxonomy and Functional Affordance

OmniDexVLG: 从视觉语言模型引导的抓取语义、分类法和功能可及性中学习灵巧抓取生成

Lei Zhang, Diwen Zheng, Kaixin Bai, Zhenshan Bing, Zoltan-Csaba Marton, Zhaopeng Chen, Alois Christian Knoll, Jianwei Zhang

机构 * University of Hamburg(汉堡大学) Agile Robots SE(敏捷机器人公司) Technical University of Munich(慕尼黑技术大学)

专题命中 多智能体 :agent(abstract);分类 cs.LG

AI总结 OmniDexVLG通过多模态语义推理和统一视觉语言模型,实现从自然语言指令中生成多样且语义连贯的灵巧抓取。

Comments Project Website: https://sites.google.com/view/omnidexvlg, 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 工作流自动化 11 篇

2508.00835 2025-12-04 cs.LG cs.AI stat.ME 81%

PCS Workflow for Veridical Data Science in the Age of AI

人工智能时代的可信数据科学流程工作流

Zachary T. Rewolinski, Bin Yu

机构 * Department of Statistics UC Berkeley(统计学系加州大学伯克利分校) Department of Statistics and EECS UC Berkeley(统计学系和电子工程与计算机科学系加州大学伯克利分校)

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种改进的PCS工作流,旨在解决数据科学生命周期中因选择不确定性导致的可复制性问题,并通过案例研究展示生成式AI在数据清洗中的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18725 2025-12-04 cs.LG cs.AI 62%

The Right to be Forgotten in Pruning: Unveil Machine Unlearning on Sparse Models

在剪枝中享有被遗忘的权利:揭示稀疏模型上的机器无学习

Yang Xiao, Gen Li, Jie Ji, Ruimeng Ye, Xiaolong Ma, Bo Hui

机构 * University of Tulsa(塔尔萨大学) Clemson University(克莱姆斯大学) The University of Arizona(亚利桑那大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.LG

AI总结 本文提出'无剪枝'方法,用于稀疏模型中消除删除数据对剪枝拓扑的影响,并设计新指标评估其有效性。

Comments 9 pages for main part

详情

展开后加载摘要…

URL PDF HTML 收藏