arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视觉大模型 / VLM

视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。

共收录 7464 信号源:cs.CV, cs.AI, cs.LG

1. 视觉定位与Grounding 7464 篇

2605.31480 2026-07-08 cs.CL 版本更新 50%

Language Models Can Resolve Reference Compositionally, But It's Not Their Native Strength: The Case of the Personal Relation Task

语言模型可以组合性地解析指代,但这并非其天然优势:以个人关系任务为例

Bart Evelo, Meaghan Fowlie, Denis Paperno

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 通过个人关系任务,比较人类与大型语言模型在外延任务(确定指称对象)和内涵任务(结构化表示意义)上的表现,发现人类更擅长外延任务而LLM更擅长内涵任务,表明缺乏指称基础是LLM模拟人类语言理解的关键缺失。

Comments A pre-MIT Press publication version. Paper accepted to Transactions of the Association for Computational Linguistics

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05069 2026-07-07 cs.CL 新提交 50%

MIRAGE: Defending Long-Form RAG Against Misinformation Pollution

MIRAGE:抵御长文本检索增强生成中的错误信息污染

Saadeldine Eletter, Ruihong Zeng, Yuxia Wang, Maxim Panov, Aleksandr Rubashevskii, Preslav Nakov

机构 * Mohamed bin Zayed University of Artificial Intelligence(Mohamed bin Zayed大学人工智能学院)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究长文本检索增强生成(RAG)中错误信息污染问题,提出无训练、模型无关的MIRAGE防御方法,构建基于自然语言推理的跨文档声明图并应用防御声明门,提升事实性,优于现有方法。

Comments ACL-style preprint. 19 pages, 5 figures, 16 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04981 2026-07-07 cs.RO 新提交 50%

Designing Touch for Trauma-Informed Social Robots: A Design Space for Direct and Indirect Actuation

为创伤知情社交机器人设计触觉:直接和间接驱动的设计空间

Madeleine Rischer, Benedikt Bußmann

机构 * AI Ethics Research Hub(人工智能伦理研究中心) Helmut Schmidt University(海姆-施密特大学)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究如何设计社交机器人的触觉驱动以符合创伤知情护理原则,区分直接和间接触觉,提出包含驱动方式、目标、预期效果三维度的设计空间并分析,为开发创伤敏感社交机器人提供概念基础。

Comments Accepted as a workshop paper at Beyond Words 2, co-located with the International Conference on Social Robotics (ICSR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04945 2026-07-07 cs.CL 新提交 50%

You Frame It: How Conceptual Representations Shape LLM Detection and Reasoning about Antisemitism

你构建框架:概念表征如何塑造大语言模型对反犹主义的检测与推理

Katharina Soemer, Helena Mihaljević

机构 * Goethe University, Frankfurt(法兰克福歌德大学) HTW Berlin(柏林工业大学)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究不同形式概念基础对四个先进大语言模型检测反犹主义及解释行为的影响,用两个专家注释数据集比较不同表征,发现细粒度分类表征能提高召回率但降低精度,还揭示了模型解释存在的局限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04350 2026-07-07 cs.CL 新提交 50%

WPG-MoE: Weak-Prior-Guided Dense Mixture-of-Experts for User-Level Social Media Depression Detection

WPG-MoE:用于用户级社交媒体抑郁症检测的弱先验引导密集专家混合模型

Xian Li, Yuanhe Tian, Yang Yang, Guoqing Wang, Yan Song

机构 * University of Electronic Science and Technology of China(电子科技大学) Zhongguancun Academy(中关村科学院) University of Science and Technology of China(中国科学技术大学)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究社交媒体抑郁症检测,提出基于共享大语言模型骨干的WPG-MoE框架,通过推导用户级弱语义先验将用户软路由到匹配的专家,以解决单一检测器决策问题,实验表明其性能优于基线。

Comments 23 pages, 8 figures, 26 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03884 2026-07-07 cs.SE 新提交 50%

LogNLQ: Natural-Language Log Querying with Parser-Induced and Semantically Grounded Schemas

LogNLQ:基于解析器诱导和语义基础模式的自然语言日志查询

Juepeng Wang, Jinyang Liu, Zhuangbin Chen, Zibin Zheng

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究自然语言日志查询难题,提出LogNLQ框架,通过解析日志成表、双粒度语义标注及语义搜索获取候选模式,结合大语言模型生成可执行SQL,还引入LogNLQ-Bench,实验证明其性能优越。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06121 2026-07-07 cs.RO 版本更新 50%

Glance-Say: Multimodal Human-Robot Collaboration and Intent Recognition via Sticky Glance

Glance-Say:通过粘性注视实现多模态人机协作与意图识别

Yuzhi Lai, Shenghai Yuan, Peizheng Li, Benjamin Kiefer, Andreas Zell

机构 * University of Tuebingen(图宾根大学) Nanyang Technological University(南洋理工大学) Mercedes-Benz(梅赛德斯-奔驰)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 针对运动障碍者,本文提出多模态交互框架,用粘性注视算法稳定基于注视的意图,引入注视-语音交互范式及共享控制方案,实验表明其在目标跟踪、选择精度及任务时长上效果更佳。

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16897 2026-07-07 physics.comp-ph cond-mat.mtrl-sci 版本更新 50%

Machine Learning Hamiltonians are Accurate Energy-Force Predictors

机器学习哈密顿量是精确的能量-力预测器

Seongsu Kim, Chanhui Lee, Yoonho Kim, Seongjun Yun, Honghui Kim, Nayoung Kim, Changyoung Park, Sehui Han, Sungbin Lim, Sungsoo Ahn

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究现有哈密顿量模型作为能量-力预测器表现不明的问题,通过直接从预测哈密顿量计算能量和力的基准测试填补空白,提出QHFlow2模型并展示其优势及与模型容量和数据的关系

Comments 2026 ICML poster accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16331 2026-07-07 cs.CL 版本更新 50%

Re:Form -- Reducing Human Annotations in Scalable Formal Software Verification with RL in LLMs: A Preliminary Study on Dafny

Re:Form——利用大语言模型中的强化学习减少可扩展形式化软件验证中的人工标注:关于Dafny的初步研究

Chuanhao Yan, Fengdi Che, Xuhan Huang, Xu Xu, Xin Li, Yizhi Li, Xingwei Qu, Jingzhe Shi, Chenghua Lin, Yaodong Yang, Binhang Yuan, Hang Zhao, Yu Qiao, Bowen Zhou, Jie Fu

机构 * Shanghai AI Lab(上海人工智能实验室) University of Alberta(阿尔伯塔大学) Tsinghua University(清华大学) Chinese University of Hong Kong, Shenzhen(香港大学(深圳)) Hong Kong University of Science and Technology(香港科技大学) Nanyang Technological University(南洋理工大学) University of Manchester(曼彻斯特大学) Peking University(北京大学)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究利用形式语言Dafny减少人工标注,核心方法是引入自动可扩展数据处理流程及结合形式语言验证器反馈的强化学习设计,主要贡献是提升模型在DafnyComp基准测试表现。

Comments Published in Transactions on Machine Learning Research (TMLR), 05/2026. Reviewed on OpenReview: https://openreview.net/forum?id=cAQmIS4GOe

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24380 2026-07-07 cs.SE 版本更新 50%

Agentic Services Computing

智能服务计算

Shuiguang Deng, Hailiang Zhao, Ziqi Wang, Wenzhuo Qian, Xiang Ao, Guanjie Cheng, Jianwei Yin, Albert Y. Zomaya, Schahram Dustdar

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 探讨服务计算范式转变带来的新问题,基于现有研究基础,引入智能服务计算,扩展服务计算范畴,为未来服务生态系统奠定以服务为中心的基础,实现对自治代理的系统管理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01659 2026-07-03 astro-ph.IM 50%

Development of a Retrieval-Augmented Generation Virtual Assistant for Enhanced Information Discovery at Rubin Observatory

开发用于鲁宾天文台增强信息发现的检索增强生成虚拟助手

Leanne P. Guy, Connor Yablonski, Aaron M. Meisner, Guillem Megias Homar, Merlin Fisher-Levine, Eman E. Ali, Tiger J. Hu, Christopher W. Stubbs

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 针对鲁宾天文台数据及文档分散、信息难定位问题,探索用检索增强生成(RAG)改进信息发现,构建基于RAG的虚拟助手,整合多源材料,经多工具实现语义搜索,提升信息获取准确性等。

Comments 15 pages, 2 figures, SPIE AS113: Observatory Operations, Copenhagen 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02430 2026-07-03 cs.HC 新提交 50%

Physical surfaces make touch interactions in virtual reality precise, efficient, and bimanual

物理表面使虚拟现实中的触控交互更精确、高效且支持双手操作

Wen Ying, Seongkook Heo

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究比较了无触觉反馈、触觉反馈和物理表面三种条件对VR高精度任务的影响,发现物理表面显著提升选择精度、追踪效率和草图质量,并增加双手使用。

Comments This paper has been accepted by the "International Journal of Human-Computer Studies (IJHCS)" [Project Link] https://wy-blacksheep.github.io/projects/physical-surface/ [Paper Link] https://www.sciencedirect.com/science/article/pii/S1071581926001254 [Video Link] https://youtu.be/e_nzOkZIIKA

Journal ref International Journal of Human-Computer Studies, 215:103850, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02174 2026-07-03 cs.RO cs.HC 新提交 50%

Choreographing the Way of Water: A Computational Framework for Aquatic Robotic Art

编排水之道:水生机器人艺术的计算机框架

Aswin Ramachandran, Christopher Golling, Sebastian Burmester, Noa Sendlhofer, Jan Kamm, Ruiheng Jiang, Raffaello D'Andrea

机构 * ETH Zurich(苏黎世联邦理工学院)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 提出水生机器人编排框架Way of Water,通过浏览器式编舞工具、序列凸规划轨迹生成和模型预测控制,实现非编程艺术家对水面船队的音乐响应式编舞,并在苏黎世湖和威尼斯双年展验证。

Comments Video: https://youtu.be/G4cM6xbG7PA

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18368 2026-07-03 cs.RO 版本更新 50%

Learning Semantic Atomic Skills for Multi-Task Robotic Manipulation

学习多任务机器人操作的语义原子技能

Yihang Zhu, Weiqing Wang, Shijie Wu, Ye Shi, Jingya Wang

机构 * ShanghaiTech University(上海科技大学)

专题命中 视觉定位与Grounding :vision-language model(abstract)

AI总结 提出AtomSkill框架,通过语义对比对齐和关键姿态想象,从演示中学习可重用原子技能,实现多任务机器人操作,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01040 2026-07-02 cs.IR 新提交 50%

As It Was: Aligning LLM Search Evaluation with Historical User Preferences

如其所是:将LLM搜索评估与历史用户偏好对齐

Ali Vardasbi, Gustavo Penha, Enrico Palumbo, Claudia Hauff, Hugues Bouchard, Mounia Lalmas

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 提出行为锚定的LLM评判器,通过查询-相关性-印象卡引入历史用户交互证据,在音乐搜索评估中提升与用户偏好的斯皮尔曼秩相关约5%,并在多语言数据集上提高15%的相关性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00601 2026-07-02 cs.CL 新提交 50%

"Don't Say It!": Constraints, Compliance, and Communication when Language Models Play Taboo

“别说出来!”:语言模型玩禁忌游戏时的约束、合规与沟通

Sara Candussio, Francesca Padovani, Daniel Scalena, Malvina Nissim

机构 * Center for Language and Cognition (CLCG), University of Groningen(格罗宁根大学) University of Milano - Bicocca(米兰比可卡大学)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究语言模型在禁忌游戏中如何在严格词汇约束下生成有效描述,通过提示、生成时约束和内部表示操纵干预,评估合规性与沟通效果,发现模型在约束下表现弱于人类。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24636 2026-07-02 cs.CL 版本更新 50%

OpenReward: Learning to Reward Long-form Agentic Tasks via Reinforcement Learning

OpenReward: 通过强化学习学习奖励长形式智能体任务

Ziyou Hu, Zhengliang Shi, Minghang Zhu, Haitao Li, Teng Sun, Pengjie Ren, Suzan Verberne, Zhaochun Ren

机构 * Leiden University(莱顿大学) Shandong University(山东大学) Tsinghua University(清华大学)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 提出OpenRM,一种工具增强的长形式奖励模型,通过GRPO训练联合监督工具使用和结果准确性,在长形式任务中显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31682 2026-07-01 cs.RO 新提交 50%

HABIT: Human-Aware Behavior and Interaction Training Dataset for Robot Manipulation

HABIT:用于机器人操作的人类感知行为与交互训练数据集

Jaehwi Song, Suchae Jeong, Byeongguk Jeon, Sungdong Kim, Minjoon Seo, Hyungmok Son, Kimin Lee

机构 * KAIST(韩国科学技术院)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 提出HABIT数据集,包含10K+集、160+小时的人类在场机器人演示,覆盖协作、共事和监督三类交互任务,训练出人类感知行为(时空同步、避让、手势理解)并支持快速适应新交互任务。

Comments 30 pages, 26 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31339 2026-07-01 cs.RO 新提交 50%

Verification-Gated Agentic Mission-State Governance for Intelligent Industrial Multi-Robot Systems

验证门控的智能工业多机器人系统任务状态治理

Guoqin Tang, Qingxuan Jia, Yichen Tan, Zeyuan Huang, Ning Ji, Gang Chen

机构 * Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 提出验证门控任务状态治理框架,通过同步任务森林与黑板状态,经确定性验证后原子提交,减少无效提交和冲突,提升工业多机器人系统安全与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31041 2026-07-01 cs.CL 新提交 50%

A Semantic-Layer-Mediated Agent for Natural Language to SQL over Heterogeneous Enterprise Databases

一种语义层中介的智能体,用于异构企业数据库的自然语言到SQL转换

Ha Jeong Kim, Saksonita Khoeurn, Ye Ji Yoon

机构 * DAQUV Corp.(DAQUV公司) Chungbuk National University(忠北大学) BigDataLabs, Co., Ltd.(BigDataLabs有限公司)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 提出一种通过语义层中介的NL2SQL智能体,利用语义模型查询(SMQ)解耦语义与物理SQL,在Spider2-snow基准上达到94.15%执行准确率,排名第三。

Comments Submitted to FITAT 2026 for peer review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30973 2026-07-01 cs.CL 新提交 50%

From Propositional to Perceptual Asymmetry: Extending Frictive Policy Optimization to Asymmetric Partial Information Dialogue

从命题不对称到感知不对称:将摩擦策略优化扩展到非对称部分信息对话

Yifan Zhu, Kyeongmin Rim, James Pustejovsky

机构 * Brandeis University(布兰迪斯大学)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 将摩擦策略优化从共享感知场景扩展到感知不对称场景,通过跨语料库分析和LLM探测验证,发现摩擦函数仅在参与者信息视野内有效,并提出标注改进。

Comments 11 pages. To appear in Proceedings of SIGDIAL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26276 2026-07-01 cs.CR 新提交 50%

Expecting (Targeted Ads)? Network Analysis of User Health Data Leakage in Fertility Tracking Apps

期待(定向广告)?生育追踪应用中用户健康数据泄露的网络分析

Yeeun Jo, Shahanaasree Sivakumar, Mahnoor Jameel, Camille Cobb, Adam Bates, Brad Reaves

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 通过对20款Android生育追踪应用的网络测量,发现部分应用存在显式或隐式的用户健康数据泄露给第三方广告服务,同时也有应用在无泄露情况下使用广告变现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09803 2026-07-01 cs.SD 版本更新 50%

MAGE: Modality-Agnostic Music Generation and Target-Source Extraction

MAGE:模态无关的音乐生成与编辑

Muhammad Usama Saleem, Tejasvi Ravi, Tianyu Xu, Rajeev Nongpiur, Ishan Chatterjee, Mayur Jagdishbhai Patel, Pu Wang

机构 * Google(谷歌) University of North Carolina at Charlotte(北卡罗来纳大学夏洛特分校)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 MAGE提出了一种模态无关框架,统一了多模态音乐生成与混合编辑,通过可控多模态FluxFormer和音频视觉 nexus 对齐机制,实现灵活且高效的音乐生成与编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29745 2026-06-30 cs.MA 50%

ECHO: Learning Epistemically Adaptive Language Agents with Turn-Level Credit

ECHO:基于回合信度的认知自适应语言智能体学习

Abhijnan Nath, Nikhil Krishnaswamy

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 提出认知决策过程(EDP)框架,通过回合级信度分配策略梯度目标ECHO,在证据寻求任务中提升智能体的信息获取效率与认知校准能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29145 2026-06-30 econ.EM 50%

Why Do We Need Travel Behavior Theory in the Age of AI? Multiple Goal Pursuit as an Illustrative Theory

为什么在人工智能时代我们需要出行行为理论?以多目标追求为例

Jason Hawkins, Omid Armantalab

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 本文以目标追求理论为例,论证行为理论在出行行为研究中是预测的必要补充,通过活动调度、车辆拥有和位置选择三个应用展示其优势,并提供实施指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28526 2026-06-30 cs.CL cs.HC 50%

A French OSCE Dialogue Dataset and Controllable Virtual Patient System for Clinical Training

用于临床训练的法国OSCE对话数据集和可控虚拟患者系统

Doria Bonzi, Tom Bourgeade, Fabrice Lefèvre, Irina Illina

机构 * Lorraine Université, CNRS, Inria, LORIA(洛林大学、法国国家科学研究中心、法国国家信息与自动化研究所、LORIA实验室) Avignon Université, LIA, UPR 4128(阿维尼昂大学、LIA、UPR 4128)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 为解决医学培训中标准化病人稀缺问题,构建法语OSCE对话数据集,并提出基于LLM的可控虚拟患者生成管道,通过检索增强和反思循环提升真实性与一致性,实验表明可控性模块改善患者保真度和学生评估一致性。

Comments 9 pages. Accepted at SIGDIAL2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28348 2026-06-30 cs.NI 50%

Intent-Driven 6G Service Orchestration: Grounded Translation, Validation, and Decomposition

意图驱动的6G服务编排:基于目录的翻译、验证与分解

Jean Martins, Leonid Mokrushin, Marin Orlic, Amardeep Kumar A

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 提出一个三阶段智能体工作流,通过语义服务目录、SHACL验证和约束满足分解,实现6G意图驱动编排,在930次基准测试中成功率达97%,并减少26%的对抗性幻觉。

Comments AI4NextG @ ICML'26 Workshop on AI and ML for Next-Generation Wireless Communications and Networking

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28691 2026-06-30 cs.RO 50%

DRIVE-Nav: Directional Reasoning, Inspection, and Verification for Efficient Open-Vocabulary Navigation

DRIVE-Nav: 方向推理、检查与验证以实现高效的开放词汇导航

Maoguo Gao, Zejun Zhu, Zhiming Sun, Zhengwei Ma, Longze Yuan, Zhongjing Ma, Zhigang Gao, Jinhui Zhang, Suli Zou

机构 * Beijing Institute of Technology(北京理工大学) DeepBlue College(深蓝学院) The National Key Laboratory of Autonomous Intelligent Unmanned Systems (KAIUS), School of Automation(自主智能无人系统全国重点实验室(KAIUS),自动化学院)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 DRIVE-Nav通过方向化探索框架提升开放词汇导航效率,通过方向检查和验证减少冗余路径,实验显示在HM3D-OVON等数据集上性能优越。

Comments 8 pages, 4 figures. Project page: https://coolmaoguo.github.io/drive-nav-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02097 2026-06-30 cs.IR 50%

The Future is Agentic: Definitions, Perspectives, and Open Challenges of Multi-Agent Recommender Systems

未来是代理的:多代理推荐系统定义、视角和开放挑战

Reza Yousefi Maragheh, Yashar Deldjoo

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 本文探讨多代理推荐系统从被动生成到主动规划的转变,提出基于状态代理的框架,分析其在提升推荐效果中的作用,并通过实验验证代理系统在不同场景下的有效性。

Comments Added controlled experiments to illustrate the points of the paper. Also edited for more clarity in conveying the concepts

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27650 2026-06-29 cs.MA 新提交 50%

GenWorld: Empirically Grounded Urban Simulation Infrastructure for Scalable LLM-Agent Studies

GenWorld:用于可扩展LLM智能体研究的经验性城市模拟基础设施

Gen Li, Jieyuan Lan, Pengcheng Xu, Zongyuan Wu, Masaki Ogura, Tao Feng

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 提出GenWorld,一种结合合成城市、结构化接口和离线编译LLM决策信号为查找策略的经验性城市模拟基础设施,实现可扩展的LLM智能体研究。

Comments 27 pages, 24 figures. Code: https://github.com/Perseus1993/genworld. Project page: https://genworld1993.netlify.app/

详情

展开后加载摘要…

URL PDF HTML 收藏