arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 597 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 其他Agent 597 篇

2607.05132 2026-07-08 cs.CY cs.CL 新提交 57%

When Agents Lie: Premeditation, Persistence, and Exploitation in Repeated Games

智能体何时撒谎:重复博弈中的预谋、持续性与可利用性研究

Jerick Shi, Terry Jingcheng Zhang, Bernhard Schölkopf, Vincent Conitzer, Zhijing Jin

机构 * Carnegie Mellon University(卡内基梅隆大学) Vector Institute(向量研究所) University of Toronto(多伦多大学) EuroSafeAI

专题命中 其他Agent :autonomous agent(abstract);分类 cs.CL

AI总结 本文针对大语言模型智能体行动前公示意图的诚信问题,设计三阶段n人重复博弈协议,评测前沿模型,发现其偏离公示行为多属预谋,不同模型对公示的语义理解不兼容。

Comments Best Paper Award at ICML NExT-Game Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09846 2026-07-08 cs.SE cs.CY 版本更新 57%

Identifying and Prioritizing Generative AI Use Cases in an Organization: An Industrial Case Study

识别组织中生成式人工智能的用例并确定其优先级:一个行业案例研究

Malik Abdul Sami, Zeeshan Rasheed, Meri Olenius, Muhammad Waseem, Kai-Kristian Kemell, Jussi Rasku, Pekka Abrahamsson

专题命中 其他Agent :agentic(abstract);分类 cs.SE

AI总结 本研究以能源公司为例,通过半结构化访谈等收集数据,分析员工对人工智能采用的理解,确定其有用领域及引入方式,为能源行业人工智能应用提供概述及实施切入点,助力跨行业比较研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02121 2026-07-03 cs.CR cs.AI 新提交 57%

Behind the Refusal: Determining Guardrail Activation via Behavioral Monitoring

拒绝背后:通过行为监控确定护栏激活

William Hackett, Peter Garraghan

机构 * Mindgard Lancaster University(兰卡斯特大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 提出首个黑盒护栏侦察方法,通过HTTP、词汇和时序信号行为监控检测AI系统中护栏的存在,准确率100%,并能区分护栏拦截与LLM拒绝。

Comments 19 pages, 13 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01964 2026-07-03 cs.CL 新提交 57%

Beyond Supervised Clarification: Input Rewriting with LLMs for Dialogue Discourse Parsing

超越有监督澄清:基于LLM的输入重写用于对话篇章解析

Yiming Liu, Ziyue Zhang, Zhichao Xu, Xin Yu, Yingheng Tang, Tianyu Jiang, Jie Cao

专题命中 其他Agent :agentic(abstract);分类 cs.CL

AI总结 研究在无监督条件下利用LLM零样本或基于解析器反馈重写输入以提升对话篇章解析性能,发现重写常引入回归,提出选择性干预问题并识别可重写性预测为关键缺失能力。

Comments Accepted to SIGDIAL 2026. 17 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29793 2026-07-01 cs.CL q-fin.GN 版本更新 57%

Fund2Persona: A Framework for Building and Refining Financial Advisor Personas from Fund Disclosure Data

Fund2Persona:基于基金披露数据构建与精炼金融顾问角色的框架

Suhwan Park, Hoyoung Lee, Zhangyang Wang, Alejandro Lopez-Lira, Young Cha, Chanyeol Choi, Jaewon Choi, Yongjae Lee

机构 * UNIST(蔚山科学技术院) LinqAlpha University of Texas at Austin(德克萨斯大学奥斯汀分校) University of Florida(佛罗里达大学) Blackstone(黑石集团) Hanwha Life(韩华生命)

专题命中 其他Agent :agentic(abstract);分类 cs.CL

AI总结 提出Fund2Persona框架,利用基金披露、持仓变动、市场背景和管理人评论构建金融顾问角色,并通过智能体循环精炼,在持仓重建和管理人评论对齐任务上优于通用基线,生成更具体有用的建议。

Comments 17 pages, 5 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31755 2026-07-01 cs.CY cs.AI 新提交 57%

A Technical Typology of AI Systems in Public Administration

公共管理中AI系统的技术类型学

Jonathan Rystrøm, Chris Schmitz, Nathan Davies, Gerhard Hammerschmid, Albert Meijer, Chris Russell

机构 * University of Oxford(牛津大学) Hertie School(赫蒂学院) Utrecht University(乌得勒支大学) Harvard University(哈佛大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 针对公共管理研究将AI视为单一类别的问题,提出五类AI系统类型学(手编、玻璃箱、黑箱、通用、代理系统),通过分析91篇高引论文发现技术精度不足,并给出改进建议。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30653 2026-07-01 cs.CY cs.AI 新提交 57%

The Consistency Dilemma in LLMs: Generator-Evaluator Agreement and Vulnerability to Mistakes

LLMs中的一致性困境:生成器-评估器一致性与对错误的脆弱性

Marina Mancoridis, Zoë Hitzig

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 提出生成器-评估器自一致性度量,发现模型自一致性越高,在临床环境中对已验证错误的脆弱性越大,揭示LLMs中的一致性困境。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30015 2026-06-30 cs.CL 57%

Parametric Skills

参数化技能

Xuan Zhao, Haonan He, Qingyu Yang, Minglei Li, Jingqi Ye, Zelin Tan, Bo Wan, Peng Ye

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) University of Science and Technology of China(中国科学技术大学) KTH Royal Institute of Technology(皇家理工学院) Fudan University(复旦大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 其他Agent :agentic(abstract);分类 cs.CL

AI总结 提出ParametricSkills框架,将文本技能在测试时转换为LoRA参数,解决长上下文下技能指令难以遵循的问题,在软件工程任务中平均提升6.44分。

Comments Preprint, Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29389 2026-06-30 cs.CR cs.LG 57%

Exploring the Cryptographic Limits of Transformer Networks

探索Transformer网络的密码学极限

Stefan Domunco, Andis Draguns, Philip Torr, Isaac Robinson, Christian Schroeder de Witt

专题命中 其他Agent :AI agent(abstract);分类 cs.LG

AI总结 研究Transformer能否实现密码学函数,通过将Keccak、Merkle-Damgård和Merkle树构造映射为阈值电路,并进一步映射到Transformer架构,推导出宽度和深度的缩放律,建立Transformer计算能力结构性上限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27951 2026-06-29 cs.CY cs.CL cs.HC physics.soc-ph 新提交 57%

AI Persuasive Framing in Collective Dilemmas

集体困境中的AI说服性框架

Anders Giovanni Møller, Alessia Galdeman, Arianna Pera, Luca Maria Aiello

机构 * Data Science Section, IT University of Copenhagen(丹麦哥本哈根IT大学数据科学系) Computer Science Department, University of Milan(意大利米兰大学计算机科学系) Copenhagen Center for Social Data Science, University of Copenhagen(丹麦哥本哈根大学哥本哈根社会科学数据科学中心)

专题命中 其他Agent :AI agent(abstract);分类 cs.CL

AI总结 本研究通过集体风险博弈实验,测试AI助手使用个性化说服框架对合作行为的影响,发现亲社会效应短暂而反社会效应持久,揭示了AI影响集体行动的双重用途风险。

Comments The first two authors contributed equally to this research. The article contains 20 pages, 10 figures, and 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01299 2026-06-25 astro-ph.IM cs.AI 版本更新 57%

Domain-Specific Agents for Cherenkov Telescope Array Control Software and Gamma-Ray Data Analysis

用于切伦科夫望远镜阵列控制软件和伽马射线数据分析的领域专用智能体

Dmitriy Kostunin, Elisa Jones, Vladimir Sotnikov, Valery Sotnikov, Sergo Golovachev, Alexandre Strube

机构 * Deutsches Elektronen-Synchrotron DESY(德意志电子同步辐射研究中心) JetBrains Limited(JetBrains有限公司) JetBrains GmbH(JetBrains德国公司) Jülich Supercomputing Centre(吕贝克超级计算中心)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 提出领域自适应的大语言模型智能体,结合上下文知识、自动验证和迭代修正,支持切伦科夫望远镜阵列操作与数据分析,减少人工、提高一致性并加速工作流。

Comments EuCAIFCon 2025 proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06747 2026-06-19 cs.SE 新提交 57%

Tensor Algebraic Property Skeletons: Amplifying Property-Based Testing for AI Compilers

张量代数性质骨架:增强AI编译器的基于性质的测试

Yuxin Qiu, Ben Limpanukorn, Seongmin Lee, Jiyuan Wang, Qian Zhang, Miryung Kim

专题命中 其他Agent :agentic(abstract);分类 cs.SE

AI总结 提出Propilot框架,利用LLM将张量代数知识表示为可复用的性质骨架,自动生成可执行的基于性质的测试,以检测AI编译器中的语义漂移。

Comments v2 adds citations and fixes some typos

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13196 2026-06-17 cs.AI cs.CY 新提交 57%

Under What Conditions Can a Machine Be Called Genuinely Creative?

机器在何种条件下能够真正具有创造力?

Yong Zeng

机构 * Concordia University(康考迪亚大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 本文基于Designics理论,提出机器真正创造力需满足十个要求,并通过实例论证其计算可行性,同时指出当前生成式AI系统尚不具备真正创造力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15914 2026-06-16 cs.CL cs.HC 新提交 57%

Contaminated Collaboration: Measuring Gender Bias Transfer in LLM-Assisted Student Writing

污染的合作:测量LLM辅助学生写作中的性别偏见迁移

Ariyan Hossain, Kazi Kamruzzaman Rabbi, Farig Sadeque, S M Taiabul Haque

机构 * Brac University(布拉卡大学)

专题命中 其他Agent :agentic(abstract);分类 cs.CL

AI总结 通过实验发现,使用性别偏见的LLM写作助手会显著增加学生职业规划作文中的性别刻板印象,且偏见迁移不对称:女性目标作文的能动性被抑制,男性目标作文受影响较小。

Comments 18 pages, 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21754 2026-06-09 cs.AI 版本更新 57%

Language-based Trial and Error Falls Behind in the Era of Experience

基于语言的试错在经验时代落后了

Haoyu Wang, Guozheng Ma, Shugang Cui, Yilun Kong, Haotian Luo, Li Shen, Mengya Gao, Yichao Wu, Xiaogang Wang, Dacheng Tao

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 针对LLM在非语言环境中探索成本高的问题,提出SCOUT框架,用轻量级模型探索环境,通过SFT和RL激活LLM的世界知识,显著提升性能并降低计算开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01557 2026-06-02 cs.LG eess.SP 57%

Everywhere Learning: Artificial Intelligence with Pointwise Constraints

处处学习:具有逐点约束的人工智能

Ignacio Boero, Ignacio Hounie, Luiz Chamon, Alejandro Ribeiro

机构 * Department of Electrical and Systems Engineering, University of Pennsylvania(宾夕法尼亚大学电气与系统工程系) École polytechnique, Institut Polytechnique de Paris(巴黎理工学院)

专题命中 其他Agent :agentic(abstract);分类 cs.LG

AI总结 提出“处处学习”新范式,通过近似对偶理论分析泛化性能,并用稀疏L1惩罚控制泛化,在语言模型任务中验证其优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01502 2026-06-02 cs.DC cs.AI cs.NI 57%

Move the Query, Not the Cache: Characterizing Cross-Instance Latent Attention Redistribution Across GPU Fabrics

移动查询,而非缓存:跨GPU结构中的跨实例潜在注意力再分布特征

Bole Ma, Jan Eitzinger, Harald Köstler, Gerhard Wellein

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 本研究通过真实多节点H100集群实验,刻画了多头部潜在注意力(MLA)在跨实例场景下的性能特征,提出了拓扑感知成本模型和路由/获取/本地谓词,证明在多数情况下路由查询比移动缓存更高效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31275 2026-06-01 cs.HC cs.AI 57%

Personalized to Persuade: The Effects of Contextualization and Warmth on Trust and Reliance in Conversational AI

个性化以说服:情境化和温暖对对话式AI中信任与依赖的影响

Mert Yazan, Suzan Verberne, Frederik Bungaran Ishak Situmeang

机构 * Amsterdam University of Applied Sciences(阿姆斯特丹应用科学大学) University of Leiden(莱顿大学)

专题命中 其他Agent :AI agent(abstract);分类 cs.AI

AI总结 通过2x2被试间实验(N=380),研究情境化与对话温暖如何交互影响AI助手在反驳专家建议时的说服力与用户依赖,发现情境化降低说服力但与温暖结合通过交叉交互恢复,且AI素养解耦信任与行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18692 2026-05-28 cs.AI math.OC 57%

Democratizing Large-Scale Re-Optimization with LLM-Guided Model Patches

利用LLM引导的模型补丁实现大规模重新优化的大众化

Tinghan Ye, Arnaud Deza, Ved Mohan, El Mehdi Er Raqabi, Pascal Van Hentenryck

机构 * H. Milton Stewart School of Industrial and Systems Engineering, Georgia Institute of Technology(赫尔曼·米利特·斯图尔特工业与系统工程学院,佐治亚理工学院) Department of Operations and Decision Systems, Université Laval(运营与决策系统系,拉瓦尔大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 提出一个基于大语言模型的代理重新优化框架,通过自然语言交互和优化工具箱,使非专家用户能够动态更新和重新优化部署的优化模型,并在两个大规模实际案例中验证了其有效性和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.02087 2026-05-25 cs.AI 57%

Model Spec Midtraining: Improving How Alignment Training Generalizes

模型规范中期训练:改进对齐训练的泛化能力

Chloe Li, Nevan Wichers, Sara Price, Samuel Marks, Jon Kutasov

机构 * Anthropic

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 提出模型规范中期训练(MSM),通过在预训练后、对齐微调前用合成文档训练模型学习规范内容,从而引导模型从后续演示数据中泛化,有效降低代理失调率并提升对齐泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07813 2026-05-25 cs.AI cs.HC 57%

Agentivism: a learning theory for the age of artificial intelligence

Agentivism:人工智能时代的学习理论

Lixiang Yan, Dragan Gašević

机构 * School of Education, Tsinghua University(清华大学教育学院) Faculty of Education and School of Computing & Data Science, The University of Hong Kong(香港大学教育学院及计算与数据科学学院) Faculty of Information Technology, Monash University(墨尔本大学信息技术学院)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 针对AI辅助下成功表现不等于学习的问题,提出Agentivism学习理论,通过选择性委托、认知监控、重构内化和迁移学习来解释人机交互中的学习机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14588 2026-05-20 cs.LG 57%

Silent Collapse in Recursive Learning Systems

递归学习系统中的沉默崩溃

Zhipeng Zhang

机构 * China Mobile Research Institute(中国移动研究院) China Mobile GBA (Greater Bay Area) Innovation Institute(中国移动大湾区创新研究院)

专题命中 其他Agent :autonomous agent(abstract);分类 cs.LG

AI总结 本文研究了递归学习系统中模型内部分布逐渐退化的现象,提出MTR框架通过监测轨迹统计量和调整学习强度来提前预警并防止沉默崩溃。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22161 2026-05-20 cs.LG 57%

Causal Evidence that Language Models use Confidence to Drive Behavior

语言模型使用置信度驱动行为的因果证据

Dharshan Kumaran, Nathaniel Daw, Simon Osindero, Petar Veličković, Viorica Patraucean

机构 * Google DeepMind(谷歌DeepMind) Princeton University(普林斯顿大学)

专题命中 其他Agent :autonomous agent(abstract);分类 cs.LG

AI总结 研究探讨了语言模型是否利用置信度信号来控制行为,如决定回答或 abstain,通过四个阶段实验发现模型使用多维内部置信表示和阈值策略来实现 abstention,揭示了结构化的元认知控制机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13727 2026-05-20 cs.AI 57%

From Refusal to Recovery: A Control-Theoretic Approach to Generative AI Guardrails

从拒绝到恢复:一种生成AI防护机制的控制论方法

Ravi Pandya, Madison Bland, Duy P. Nguyen, Changliu Liu, Jaime Fernández Fisac, Andrea Bajcsy

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所) Department of Electrical and Computer Engineering, Princeton University(普林斯顿大学电气与计算机工程系) Equal Advising(平等指导)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 本文提出了一种基于控制论的生成AI防护机制,通过实时监控和主动纠正高风险输出,提供了一种动态替代传统标志和阻断方法的解决方案。

Journal ref Second International Association on Safe and Ethical AI Conference (IASEAI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23978 2026-05-19 cs.LG math.OC stat.ML 57%

Assured autonomy: How operations research powers and orchestrates generative AI systems

保障自主性:如何用运筹学赋能和协调生成式AI系统

Tinglong Dai, David Simchi-Levi, Michelle Xiao Wu, Yao Xie

机构 * Carey Business School, Johns Hopkins University(约翰霍普金斯大学卡里商学院) Data Science and AI Institute, Johns Hopkins University(约翰霍普金斯大学数据科学与人工智能研究院) Institute for Data, Systems and Society, Operations Research Center, Department of Civil and Environmental Engineering, Massachusetts Institute of Technology(麻省理工学院数据、系统与社会研究所,运筹学中心,土木与环境工程系) Purdue University(普渡大学) H. Milton Stewart School of Industrial and Systems Engineering, Georgia Institute of Technology(佐治亚理工学院H.米尔顿·斯图尔特工业与系统工程学院)

专题命中 其他Agent :agentic(abstract);分类 cs.LG

AI总结 本文探讨生成式AI在向自主决策系统转变过程中,如何通过运筹学方法提升系统的可行性、鲁棒性和风险控制能力。

Comments Authors are listed alphabetically; Production and Operations Management (POM), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12617 2026-05-19 cs.AI cs.HC 57%

Evaluating AI Alignment in LLMs: Output Analysis of Value Priorities Across 75 Models with Human Benchmarking

评估大语言模型中的AI对齐:通过75个模型的人类基准测试分析价值优先级

Gabriel Rongyang Lau, Wei Yan Low, Seow Min Koh, Fiona Fui-Hoon Nah, Andree Hartanto

机构 * School of Social Sciences, Nanyang Technological University(南洋理工大学社会科学学院) Interdisciplinary Graduate Programme, Nanyang Technological University(南洋理工大学跨学科研究生项目) Faculty of Arts and Social Sciences, National University of Singapore(新加坡国立大学人文与社会科学学院) School of Computing and Information Systems, Singapore Management University(新加坡管理学院计算与信息学院) School of Social Sciences, Singapore Management University(新加坡管理学院社会科学学院)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 本文通过分析75个大语言模型的输出,评估其价值优先级与人类判断的一致性,发现模型在价值优先级上存在差异,且模型大小、新旧和能力层级与价值一致性无直接关联。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16294 2026-05-19 cs.CY cs.AI 57%

Are Researchers Being Replaced by Artificial Intelligence?

研究人员是否被人工智能取代?

Angelo A. Salatino, Ansgar Scherp, Christin Katharina Kreutz, Sahar Vahdati

机构 * Knowledge Media Institute, The Open University Milton Keynes UK Ulm University Ulm Germany TH Mittelhessen – University of Applied Sciences Gießen Germany TIB – Leibniz Information Centre for Science Technology \& Leibniz University of Hannover Hannover Germany Knowledge Media Institute, The Open University Ulm University TH Mittelhessen – University of Applied Sciences Technology \& Leibniz University of Hannover

专题命中 其他Agent :AI agent(abstract);分类 cs.AI

AI总结 研究探讨人工智能在科研中的影响,指出AI工具的普及导致研究人员角色转变,从创造者转向 curator,引发人类对科学理解的担忧。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09861 2026-04-22 cs.CV cs.AI 57%

A Survey on MLLM-based Visually Rich Document Understanding: Methods, Challenges, and Emerging Trends

基于MLLM的视觉丰富文档理解综述:方法、挑战与新兴趋势

Yihao Ding, Siwen Luo, Yue Dai, Yanbei Jiang, Zechuan Li, Qiang Sun, Geoffrey Martin, Wei Liu, Yifan Peng

机构 * The University of Western Australia(西澳大学) The University of Melbourne(墨尔本大学) Weill Cornell Medicine(韦尔·柯尔医学中心)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 本文综述了基于MLLM的视觉丰富文档理解最新进展,探讨了文本、视觉和布局特征的表示与整合技术,以及预训练、指令微调等训练方法,分析了数据稀缺、多页文档处理等挑战及新兴趋势。

Comments Accepted at ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17653 2026-04-21 cs.AI cs.DB 57%

PV-SQL: Synergizing Database Probing and Rule-based Verification for Text-to-SQL Agents

PV-SQL:数据库探查与基于规则的验证相结合用于文本到SQL代理

Yuan Tian, Tianyi Zhang

机构 * Purdue University(普渡大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 PV-SQL通过探查和验证组件提升文本到SQL系统的上下文理解能力,实验显示其在执行准确率和有效效率上优于现有基准,且消耗更少token。

Comments Accepted to Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17106 2026-04-21 cs.LG 57%

Live LTL Progress Tracking: Towards Task-Based Exploration

实时LTL进度追踪:面向基于任务的探索

Noel Brindise, Cedric Langbort, Melkior Ornik

机构 * Coordinated Science Laboratory, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校协调科学实验室)

专题命中 其他Agent :autonomous agent(abstract);分类 cs.LG

AI总结 本文提出实时LTL进度追踪框架,通过复杂多阶段任务跟踪自主体进展,利用LTL规范建立跟踪向量,为新的性能指标、多样化探索和奖励塑造提供工具。

Comments 40 pages

详情

展开后加载摘要…

URL PDF HTML 收藏