arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2025-12-23 至 2025-12-23 共收录 9 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 9 篇

2512.18745 2025-12-23 cs.CV cs.CL cs.LG 79%

InSight-o3: Empowering Multimodal Foundation Models with Generalized Visual Search

InSight-o3: 通过通用视觉搜索增强多模态基础模型

Kaican Li, Lewei Yao, Jiannan Wu, Tiezheng Yu, Jierun Chen, Haoli Bai, Lu Hou, Lanqing Hong, Wei Zhang, Nevin L. Zhang

机构 * Hong Kong University of Science and Technology(香港科技大学) Huawei(华为)

专题命中 工具调用 :agent(abstract);AI agent(abstract);multi-agent(abstract);分类 cs.CL、cs.LG

AI总结 InSight-o3通过通用视觉搜索任务提升多模态基础模型的推理能力,解决复杂视觉信息整合问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17912 2025-12-23 cs.CL cs.AI 73%

Graph-O1 : Monte Carlo Tree Search with Reinforcement Learning for Text-Attributed Graph Reasoning

Graph-O1:基于强化学习的蒙特卡洛树搜索用于文本属性图推理

Lihui Liu

机构 * Wayne State University(韦恩州立大学)

专题命中 工具调用 :agent(abstract);agentic(abstract);分类 cs.AI、cs.CL

AI总结 Graph-O1通过整合蒙特卡洛树搜索与强化学习,实现文本属性图的分步交互推理,提升问答任务的准确性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10581 2025-12-23 cs.GR 67%

GraphTracer: Graph-Guided Failure Tracing in LLM Agents for Robust Multi-Turn Deep Search

GraphTracer: LLM代理中基于图的故障追踪以实现鲁棒多轮深度搜索

Heng Zhang, Yuling Shi, Xiaodong Gu, Haochen You, Zijian Zhang, Lubin Gan, Yilei Yuan, Jin Huang

专题命中 工具调用 :agent(abstract);multi-agent(abstract)

AI总结 GraphTracer通过信息流分析和依赖图构建,提升多代理系统在多轮深度搜索中的故障归因准确性与鲁棒性。

Comments This submission has been withdrawn by the authors due to a fundamental error in the methodology that affects the validity of the main results

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19155 2025-12-23 cs.AI 57%

Can We Test Consciousness Theories on AI? Ablations, Markers, and Robustness

我们能用人工智能测试意识理论吗?消融、标志和鲁棒性

Yin Jun Phua

机构 * Institute of Science Tokyo(东京科学研究所)

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 本文通过构建人工代理测试意识理论,发现GWT和HOT分别负责广播能力与质量控制,揭示了意识理论的互补性与功能层次。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14992 2025-12-23 q-fin.PM 50%

Multi-Objective Bayesian Optimization of Deep Reinforcement Learning for Environmental, Social, and Governance (ESG) Financial Portfolio Management

多目标贝叶斯优化深度强化学习用于环境、社会和治理(ESG)金融投资组合管理

M. Coronado-Vaca

专题命中 工具调用 :agent(abstract)

AI总结 本文提出利用多目标贝叶斯优化方法优化深度强化学习在ESG投资组合管理中的应用,通过帕累托集实现夏普比率与ESG评分的最佳权衡。

Comments arXiv admin comment: This version has been removed by arXiv administrators as the submitter did not have the rights to agree to the license at the time of submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18706 2025-12-23 cs.SD 50%

X-Talk: On the Underestimated Potential of Modular Speech-to-Speech Dialogue System

X-Talk:模块化语音到语音对话系统的被低估潜力

Zhanxun Liu, Yifan Duan, Mengmeng Wang, Pengchao Feng, Haotian Zhang, Xiaoyu Xing, Yijia Shan, Haina Zhu, Yuhang Dai, Chaochao Lu, Xipeng Qiu, Lei Xie, Lan Wang, Nan Yan, Zilong Zheng, Ziyang Ma, Kai Yu, Xie Chen

机构 * MoE Key Lab of Artificial Intelligence, X-LANCE Lab, Shanghai Jiao Tong University(人工智能基础理论重点实验室,X-LANCE实验室,上海交通大学) Shanghai Innovation Institute(上海创新研究院) Shanghai AI Laboratory(上海人工智能实验室) State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI) Audio, Speech and Language Processing Group, Northwestern Polytechnical University(语音与语言处理组,西北工业大学) Fudan University(复旦大学) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究院,中国科学院)

专题命中 工具调用 :tool use(abstract)

AI总结 X-Talk通过模块化设计和流水线优化,提升语音到语音对话系统的性能与灵活性,展示其在复杂语音任务中的潜力。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19111 2025-12-23 eess.SY cs.SY 50%

Radio Map Assisted Routing and Predictive Resource Allocation over Dynamic Low Altitude Networks

基于无线电地图的路由与预测资源分配在动态低空网络中的应用

Bowen Li, Junting Chen

专题命中 工具调用 :planning(abstract)

AI总结 本文提出基于动态空间-时间图模型的跨层优化框架,用于解决动态低空网络中的路由与预测资源分配问题,通过显式界限和二分搜索算法实现全局最优解,提升延迟敏感和大数据传输性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17967 2025-12-23 cs.DB 50%

Memelang: An Axial Grammar for LLM-Generated Vector-Relational Queries

Memelang:一种用于LLM生成向量关系查询的轴性语法

Bri Holt

专题命中 工具调用 :tool use(abstract)

AI总结 Memelang是一种紧凑的查询语言,通过轴性语法实现LLM生成的向量关系查询的结构化生成,支持坐标稳定引用、变量绑定和隐式上下文传递,以提高查询效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10200 2025-12-23 cs.CV 50%

LVAgent: Long Video Understanding by Multi-Round Dynamical Collaboration of MLLM Agents

LVAgent: 通过多轮动态协作的MLLM代理实现长视频理解

Boyu Chen, Zhengrong Yue, Siran Chen, Zikang Wang, Yang Liu, Peng Li, Yali Wang

机构 * Shenzhen Key Lab of Computer Vision and Pattern Recognition, Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳计算机视觉与模式识别重点实验室,深圳先进技术研究院,中国科学院) Institute for AI Industry Research (AIR), Tsinghua University, Beijing, China(人工智能产业研究院(AIR),清华大学,北京,中国) Dept. of Comp. Sci. & Tech., Institute for AI, Tsinghua University, Beijing, China(计算机科学与技术系,人工智能研究院,清华大学,北京,中国) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学)

专题命中 工具调用 :agent(abstract)

AI总结 LVAgent通过多轮动态协作的MLLM代理提升长视频理解性能,实现80%的准确率并在LongVideoBench上提升13.3%

Comments accepted in ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏