arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 15866 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 15866 篇

2512.23312 2025-12-30 cs.RO cs.AI 57%

Explainable Neural Inverse Kinematics for Obstacle-Aware Robotic Manipulation: A Comparative Analysis of IKNet Variants

可解释的神经逆向运动学用于障碍物感知的机器人操作:对IKNet变体的比较分析

Sheng-Kai Chen, Yi-Ling Tsai, Chun-Chih Chang, Yan-Chen Chen, Po-Chiang Lin

专题命中 Agent评测 :workflow(abstract);分类 cs.AI

AI总结 本研究提出了一种可解释性工作流程,通过Shapley值归因和物理障碍规避评估,改进IKNet变体以提升机器人操作的透明性和安全性。

Comments 27 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23217 2025-12-30 cs.AI 57%

TCEval: Using Thermal Comfort to Assess Cognitive and Perceptual Abilities of AI

TCEval:利用热舒适性评估人工智能的认知与感知能力

Jingming Li

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 TCEval通过热舒适性场景评估AI的跨模态推理、因果关联和适应性决策能力,揭示当前LLM在热舒适性领域存在基础推理能力但缺乏精确因果理解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21420 2025-12-30 cs.AI 57%

Feasible strategies in three-way conflict analysis with three-valued ratings

三值评分下的三方面冲突分析可行策略

Jing Liu, Mengjun Hu, Guangming Lang

机构 * School of Mathematics and Statistics, Changsha University of Science and Technology(数学与统计学学院,长沙理工大学) Hunan Provincial Key Laboratory of Mathematical Modeling and Analysis in Engineering(湖南省工程数学建模与分析重点实验室)

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 本文提出基于一致性和不一致性度量的三值评分冲突分析方法,通过计算代理团评分和加权度量,系统识别可行策略和最优解,优于现有方法。

Journal ref International Journal of Approximate Reasoning 185, 109516, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21817 2025-12-29 cs.CL 57%

Method Decoration (DeMe): A Framework for LLM-Driven Adaptive Method Generation in Dynamic IoT Environments

方法装饰(DeMe):一种用于动态物联网环境中的LLM驱动自适应方法生成的框架

Hong Su

机构 * School of Computer Science, Chengdu University of Information Technology(计算机科学学院,成都信息科技大學)

专题命中 Agent评测 :agent(abstract);分类 cs.CL

AI总结 DeMe框架通过动态装饰机制使LLM在动态物联网环境中自适应生成安全且环境适应的方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09926 2025-12-29 cs.AI cs.CV 57%

ForestProtector: An IoT Architecture Integrating Machine Vision and Deep Reinforcement Learning for Efficient Wildfire Monitoring

ForestProtector: 一种集成了机器视觉和深度强化学习的物联网架构,用于高效的森林火灾监测

Kenneth Bonilla-Ormachea, Horacio Cuizaga, Edwin Salcedo, Sebastian Castro, Sergio Fernandez-Testa, Misael Mamani

机构 * Google AI

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 ForestProtector通过集成机器视觉和深度强化学习,提出低成本物联网架构,实现远距离高效森林火灾监测与自动监控。

Comments Accepted for publication in the proceedings of the 11th International Conference on Automation, Robotics, and Applications (ICARA 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21419 2025-12-29 cs.AI 57%

Three-way conflict analysis based on alliance and conflict functions

基于联盟与冲突函数的三方冲突分析

Junfang Luo, Mengjun Hu, Guangming Lang, Xin Yang, Keyun Qin

机构 * School of Economic Information Engineering, Southwestern University of Finance and Economics(经济信息工程学院,西南财经大学) Department of Computer Science, University of Regina(计算机科学系, Regina大学) School of Mathematics and Statistics, Changsha University of Science and Technology(数学与统计学院,长沙理工大学) College of Mathematics, Southwest Jiaotong University(数学学院,西南交通大学)

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 本文提出基于联盟与冲突函数的三方冲突分析方法,通过分离两个相反方面以解决冲突分析中的关键问题。

Journal ref Information Sciences 594, 322-359, 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19992 2025-12-24 cs.AI cs.CY 57%

S$^3$IT: A Benchmark for Spatially Situated Social Intelligence Test

S$^3$IT:一种用于空间情境社交智能测试的基准

Zhe Sun, Xueyuan Yang, Yujie Lu, Zhenliang Zhang

机构 * State Key Laboratory of General Artificial Intelligence, Beijing Institute for General Artificial Intelligence (BIGAI)(通用人工智能国家重点实验室,北京通用人工智能研究院)

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 S$^3$IT基准通过座位安排任务评估代理在现实情境中整合物理与社会约束的能力,揭示LLMs在空间智能上的不足及在冲突解决中的潜力。

Comments 10 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19682 2025-12-24 cs.CL 57%

GenEnv: Difficulty-Aligned Co-Evolution Between LLM Agents and Environment Simulators

GenEnv:LLM代理与环境模拟器之间的难度对齐共进化

Jiacheng Guo, Ling Yang, Peter Chen, Qixin Xiao, Yinjie Wang, Xinzhe Juan, Jiahao Qiu, Ke Shen, Mengdi Wang

机构 * Princeton University(普林斯顿大学) Columbia University(哥伦比亚大学) University of Michigan(密歇根大学) University of Chicago(芝加哥大学)

专题命中 Agent评测 :agent(abstract);分类 cs.CL

AI总结 GenEnv通过动态生成任务与代理能力对齐的共进化机制,在减少数据使用量的同时显著提升代理性能。

Comments Our codes are available at https://github.com/Gen-Verse/GenEnv

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05495 2025-12-24 cs.AI 57%

Deep Research Comparator: A Platform For Fine-grained Human Annotations of Deep Research Agents

深度研究比较器:一种用于深度研究代理细粒度人工标注的平台

Prahaladh Chandrahasan, Jiahe Jin, Zhihan Zhang, Tevin Wang, Andy Tang, Lucy Mo, Morteza Ziyadi, Leonardo F. R. Ribeiro, Zimeng Qiu, Markus Dreyer, Akari Asai, Chenyan Xiong

机构 * Carnegie Mellon University(卡内基梅隆大学) Amazon(亚马逊)

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 深度研究比较器平台通过细粒度人工标注和端到端代理框架,提升深度研究代理的评估与开发效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19551 2025-12-23 cs.AI 57%

Towards Closed-Loop Embodied Empathy Evolution: Probing LLM-Centric Lifelong Empathic Motion Generation in Unseen Scenarios

迈向闭环式具身共情进化:探索以LLM为中心的终身共情动作生成在未见场景中的能力

Jiawen Wang, Jingjing Wang Tianyang Chen, Min Zhang, Guodong Zhou

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 本文提出L^2-EMG任务,旨在通过情感解耦和场景适应挑战提升LLM在未见场景中的共情动作生成能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18906 2025-12-23 cs.CL 57%

Remedy-R: Generative Reasoning for Machine Translation Evaluation without Error Annotations

Remedy-R:无错误标注的机器翻译评估生成推理

Shaomu Tan, Ryosuke Mitani, Ritvik Choudhary, Qiyu Wu, Toshiyuki Sekiya, Christof Monz

专题命中 Agent评测 :agent(abstract);分类 cs.CL

AI总结 Remedy-R是一种无需错误标注的生成式机器翻译评估方法,通过强化学习训练,提供可解释的评估和翻译改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15584 2025-12-23 cs.AI cs.GT 57%

A Decision-Theoretic Approach for Managing Misalignment

一种用于管理偏差的决策理论方法

Daniel A. Herrmann, Abinav Chari, Isabelle Qian, Sree Sharvesh, B. A. Levinstein

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Georgia Institute of Technology(佐治亚理工学院) University of California, Berkeley(加州大学伯克利分校) Amrita Vishwa Vidyapeetham(阿米特拉维瓦大学) University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 本文提出了一种决策理论框架,用于在不确定情况下评估人工智能代理的偏差是否足够,以决定是否委托决策。

Comments Second Conference of the International Association for Safe and Ethical Artificial Intelligence (IASEAI '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17559 2025-12-23 cs.CL cs.DB 57%

SCARE: A Benchmark for SQL Correction and Question Answerability Classification for Reliable EHR Question Answering

SCARE:一个用于SQL校正和问题可回答性分类的基准,以实现可靠的EHR问答系统

Gyubok Lee, Woosog Chay, Edward Choi

机构 * Korea Advanced Institute of Science & Technology(韩国科学技术院)

专题命中 Agent评测 :agentic(abstract);分类 cs.CL

AI总结 SCARE是一个用于评估SQL校正和问题可回答性分类的基准,旨在提升EHR问答系统的安全性与可靠性。

Comments ML4H 2025 Proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02864 2025-12-23 cs.NE cs.AI math.CA math.CO math.MG 57%

Mathematical exploration and discovery at scale

大规模数学探索与发现

Bogdan Georgiev, Javier Gómez-Serrano, Terence Tao, Adam Zsolt Wagner

机构 * Google DeepMind(谷歌DeepMind) Department of Mathematics, Brown University(布朗大学数学系) Institute for Advanced Study(高级研究院) UCLA Department of Mathematics(加州大学洛杉矶分校数学系)

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 AlphaEvolve通过进化搜索发现数学构造,提升数学问题解决效率

Comments 81 pages, 35 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12815 2025-12-23 cs.LG 57%

From Novelty to Imitation: Self-Distilled Rewards for Offline Reinforcement Learning

从新颖性到模仿:用于离线强化学习的自蒸馏奖励

Gaurav Chaudhary, Laxmidhar Behera

专题命中 Agent评测 :agent(abstract);分类 cs.LG

AI总结 ReLOAD通过自蒸馏生成内在奖励,解决离线强化学习中显式奖励标注的难题,实现稳健的策略学习并达到传统方法的性能水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18189 2025-12-23 cs.AI cs.SC 57%

NL2CA: Auto-formalizing Cognitive Decision-Making from Natural Language Using an Unsupervised CriticNL2LTL Framework

NL2CA: 一种基于无监督批评树的自然语言自动形式化认知决策方法

Zihao Deng, Yijia Li, Renrui Zhang, Peijun Ye

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 NL2CA通过自动形式化自然语言描述的认知决策规则,实现无监督学习下的认知代理构建与优化,提升认知建模的可解释性和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21176 2025-12-23 cs.AI 57%

Toward Revealing Nuanced Biases in Medical LLMs

向揭示医疗大语言模型中的细微偏见迈进

Farzana Islam Adiba, Rahmatollah Beheshti

机构 * University of Delaware(特拉华大学)

专题命中 Agent评测 :agentic(abstract);分类 cs.AI

AI总结 本文提出结合知识图谱与辅助LLMs的框架,通过对抗性扰动和多跳表征技术,系统揭示医疗大语言模型中的复杂偏见模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20348 2025-12-23 cs.DC cs.LG 57%

Improving the Efficiency of a Deep Reinforcement Learning-Based Power Management System for HPC Clusters Using Curriculum Learning

通过课程学习改进基于深度强化学习的HPC集群电源管理系统效率

Thomas Budiarjo, Santana Yuda Pradata, Kadek Gemilang Santiyuda, Muhammad Alfian Amrizal, Reza Pulungan, Hiroyuki Takizawa

机构 * Department of Computer Science and Electronics, Universitas Gadjah Mada(加雅达大学计算机科学与电子系) Cyberscience Center, Tohoku University(东大网络科学中心) Department of Industrial Management, National Taiwan University of Science and Technology(台湾科技大学工业管理系)

专题命中 Agent评测 :agent(abstract);分类 cs.LG

AI总结 本研究通过课程学习改进HPC集群电源管理的深度强化学习效率,实现能耗降低和作业执行优化。

Comments 13 pages, 17 figures, accepted at Supercomputing Asia '25, published by ACM

Journal ref SCA '25: Proceedings of the 2025 Supercomputing Asia Conference (SCA 2025), Singapore, Mar 10-13, 2025. Association for Computing Machinery, New York, NY, USA, pp. 1-13 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03480 2025-12-22 stat.AP cs.LG 57%

Foundation for unbiased cross-validation of spatio-temporal models for species distribution modeling

用于物种分布建模中空间-时间模型无偏交叉验证的基础

Diana Koldasbayeva, Alexey Zaytsev

机构 * Skolkovo Institute of Science and Technology(斯克洛夫诺科学与技术研究所)

专题命中 Agent评测 :workflow(abstract);分类 cs.LG

AI总结 本文提出基于空间自相关阻塞和外部时间验证的稳健SDM工作流程,以提高物种分布模型在空间和时间转移中的可靠性。

Comments Accepted manuscript. Published in Ecological Informatics (2025)

Journal ref Ecological Informatics, Volume 92, Article 103521, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16022 2025-12-19 cs.AI 57%

Conversational Time Series Foundation Models: Towards Explainable and Effective Forecasting

对话式时间序列基础模型:迈向可解释且有效的预测

Defu Cao, Michael Gee, Jinbo Liu, Hengxuan Wang, Wei Yang, Rui Wang, Yan Liu

机构 * University of Southern California(南加州大学) Amazon AWS(亚马逊AWS)

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 本文提出了一种对话式时间序列基础模型,通过智能法官机制协调集成模型,提升预测的可解释性和效果。

Comments 31Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15551 2025-12-18 cs.CL 57%

Learning inflection classes using Adaptive Resonance Theory

利用自适应共振理论学习屈折类

Peter Dekker, Heikki Rasilo, Bart de Boer

机构 * AI Lab, Vrije Universiteit Brussel(人工智能实验室,布鲁塞尔自由大学)

专题命中 Agent评测 :agent(abstract);分类 cs.CL

AI总结 本文提出利用自适应共振理论学习语言中的屈折类,通过无监督聚类分析拉丁语、葡萄牙语和爱沙尼亚语的词素,发现最佳泛化参数区域,并验证模型提取的特征与语言学描述的一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15302 2025-12-18 cs.CL 57%

Towards Proactive Personalization through Profile Customization for Individual Users in Dialogues

通过用户个性化配置实现对话中的前瞻性个性化

Xiaotian Zhang, Yuan Wang, Ruizhe Chen, Zeya Wang, Runchen Hou, Zuozhu Liu

机构 * Zhejiang University(浙江大学) Zhejiang Key Laboratory of Medical Imaging Artificial Intelligence(浙江省医学影像人工智能重点实验室)

专题命中 Agent评测 :agent(abstract);分类 cs.CL

AI总结 本文提出PersonalAgent,通过构建和动态完善用户档案,实现对话中的长期个性化和用户偏好推断,提升对话代理的适应性和连贯性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13734 2025-12-18 cs.CL 57%

GAPS: A Clinically Grounded, Automated Benchmark for Evaluating AI Clinicians

GAPS: 一种基于临床的自动化评估基准,用于评估AI临床医生

Xiuyuan Chen, Tao Sun, Dexin Su, Ailing Yu, Junwei Liu, Zhe Chen, Gangzeng Jin, Xin Wang, Jingnan Liu, Hansong Xiao, Hualei Zhou, Dongjie Tao, Chunxiao Guo, Minghui Yang, Yuan Xia, Jing Zhao, Qianrui Fan, Yanyun Wang, Shuai Zhen, Kezhong Chen, Jun Wang, Zewen Sun, Heng Zhao, Tian Guan, Shaodong Wang, Geyun Chang, Jiaming Deng, Hongchengcheng Chen, Kexin Feng, Ruzhen Li, Jiayi Geng, Changtai Zhao, Jun Wang, Guihu Lin, Peihao Li, Liqi Liu, Peng Wei, Jian Wang, Jinjie Gu, Ping Wang, Fan Yang

机构 * Department of Thoracic Surgery(胸外科部门) Thoracic Oncology Institute(胸外科肿瘤研究所) Research Unit of Intelligence Diagnosis and Treatment in Early Non-small Cell Lung Cancer(早期非小细胞肺癌智能诊断与治疗研究单元) Institute of Advanced Clinical Medicine(先进临床医学研究所) Beijing Key Laboratory of Innovative Application of Big Data in Lung Cancer(肺癌大数据创新应用北京市重点实验室) Ant Group(蚂蚁集团) School of Software and Microelectronics(软件与微电子学院)

专题命中 Agent评测 :agent(abstract);分类 cs.CL

AI总结 GAPS提出了一种基于临床的自动化评估基准,用于评估AI临床医生系统,通过多维评估框架解决现有基准的不足,揭示了AI在临床实践中的关键失败模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13890 2025-12-17 quant-ph cs.LG cs.SY eess.SY 57%

Group-Theoretic Reinforcement Learning of Dynamical Decoupling Sequences

群论强化学习动态解耦序列

Charles Marrder, Shuo Sun, Murray J. Holland

机构 * JILA, Department of Physics, University of Colorado Boulder, Boulder, Colorado 80309, USA(JILA物理系,科罗拉多大学博尔德分校,博尔德,科罗拉多州80309,美国)

专题命中 Agent评测 :agent(abstract);分类 cs.LG

AI总结 基于群论的强化学习方法用于设计量子比特上的动态解耦序列,无需显式了解噪声谱即可学习最优脉冲序列。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10852 2025-12-17 cond-mat.mtrl-sci cs.CL cs.DB 57%

MatTools: Benchmarking Large Language Models for Materials Science Tools

MatTools: 评估大型语言模型在材料科学工具中的基准测试

Siyu Liu, Bo Hu, Beilin Ye, Jiamin Xu, David J. Srolovitz, Tongqi Wen

机构 * Center for Structural Materials, Department of Mechanical Engineering, The University of Hong Kong(香港大学机械工程系结构材料中心) Materials Innovation Institute for Life Sciences(生命科学创新研究所)

专题命中 Agent评测 :tool-use(abstract);分类 cs.CL

AI总结 MatTools通过代码生成和执行评估LLM在材料科学工具中的能力,揭示通用模型优于专业模型,AI理解AI,及简单方法更优的结论。

Comments 27 pages, 23 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19929 2025-12-16 physics.soc-ph cs.AI 57%

DynamiX: Large-Scale Dynamic Social Network Simulator

DynamiX: 大规模动态社交网络模拟器

Yanhui Sun, Wu Liu, Wentao Wang, Hantao Yao, Jiebo Luo, Yongdong Zhang

机构 * School of Information Science and Technology, University of Science and Technology of China(信息科学与技术学院,中国科学技术大学) Department of Computer Science, University of Rochester(计算机科学系,罗切斯特大学)

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 DynamiX通过动态层级模块和不同用户类型的社交关系建模策略,提升了大规模动态社交网络模拟的准确性与实用性。

Comments Social and Information Networks

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12461 2025-12-16 cs.CL 57%

Is GPT-OSS Good? A Comprehensive Evaluation of OpenAI's Latest Open Source Models

GPT-OSS好吗?对OpenAI最新开源模型的综合评估

Ziqian Bi, Keyu Chen, Chiung-Yi Tseng, Danyang Zhang, Tianyang Wang, Hongying Luo, Lu Chen, Junming Huang, Jibin Guan, Junfeng Hao, Xinyuan Song, Junhao Song

机构 * AI Agent Lab, Vokram Group(AI代理实验室,Vokram集团) Purdue University(普渡大学) Georgia Institute of Technology(佐治亚理工学院) University of Minnesota(明尼苏达大学) Emory University(埃默里大学) Imperial College London(伦敦帝国学院)

专题命中 Agent评测 :agent(abstract);分类 cs.CL

AI总结 GPT-OSS在代码生成方面表现优异,但在多语言任务上存在不足,研究发现稀疏架构扩展未必能带来性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12211 2025-12-16 cs.RO cs.AI cs.SY eess.SY 57%

Measuring What Matters: Scenario-Driven Evaluation for Trajectory Predictors in Autonomous Driving

衡量重要性:面向自动驾驶轨迹预测器的场景驱动评估

Longchao Da, David Isele, Hua Wei, Manish Saroya

机构 * HRI, San Jose(HRI, 洛杉矶)

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 本文提出了一种基于场景驱动的评估流程,通过准确性与多样性两个维度评估自动驾驶轨迹预测器,以更合理地反映其对自动驾驶车辆性能的影响。

Comments 9 Pages, 8 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06915 2025-12-15 cs.SE 57%

Multi-Docker-Eval: A `Shovel of the Gold Rush' Benchmark on Automatic Environment Building for Software Engineering

多Docker评估:软件工程自动环境构建的‘淘金之铲’基准

Kelin Fu, Tianyu Liu, Zeyu Shang, Yingwei Ma, Jian Yang, Jiaheng Liu, Kaigui Bian

专题命中 Agent评测 :agent(abstract);分类 cs.SE

AI总结 Multi-Docker-Eval基准通过评估自动环境构建的性能,揭示了当前模型在成功率、效率及影响因素上的关键发现,为构建全自动SWE流水线提供指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08442 2025-12-15 cs.CV cs.AI cs.RO 57%

Gaze on the Prize: Shaping Visual Attention with Return-Guided Contrastive Learning

聚焦奖励:通过回报引导的对比学习塑造视觉注意力

Andrew Lee, Ian Chuang, Dechen Gao, Kai Fukazawa, Iman Soltani

机构 * Department of Computer Science University of California Davis(加州大学戴维斯分校计算机科学系) Department of Electrical Engineering and Computer Sciences University of California Berkeley(加州大学伯克利分校电气工程与计算机科学系) Department of Mechanical and Aerospace Engineering University of California Davis(加州大学戴维斯分校机械与航空航天工程系)

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 Gaze on the Prize通过回报引导的对比学习,提升视觉强化学习的样本效率,解决ManiSkill3基准中难以学习的任务。

Comments Project page: https://andrewcwlee.github.io/gaze-on-the-prize

详情

展开后加载摘要…

URL PDF HTML 收藏