arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2025-12-09 至 2025-12-09 共收录 149 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 62 篇

2512.07819 2025-12-09 cs.RO 67%

Efficient and Compliant Control Framework for Versatile Human-Humanoid Collaborative Transportation

高效且合规的协作运输人机协作控制框架

Shubham S. Kumbhar, Abhijeet M. Kulkarni, Panagiotis Artemiadis

专题命中 规划决策 :agent(abstract);planning(abstract)

AI总结 本文提出了一种高效且合规的协作运输人机协作控制框架,通过交互线性倒立摆和动态可行步态计划实现人形机器人与人类的协同运输任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07646 2025-12-09 math.OC 67%

Energy-Aware Aggregation of Input Data for the Optimisation of Heat Supply of Municipal Districts

面向市政供暖优化的输入数据节能聚合

Patrik Schönfeldt, Elif Turhan

专题命中 规划决策 :planning(abstract);workflow(abstract)

AI总结 本文提出了一种基于地理位置和能源性能指标的建筑分组方法,以提高市政供热优化的计算效率和准确性。

Comments 25 pages, 13 figures (incl. appendix)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07528 2025-12-09 cs.LG cs.AI 62%

Model-Based Reinforcement Learning Under Confounding

基于模型的强化学习中的混杂问题

Nishanth Venkatesh, Andreas A. Malikopoulos

机构 * Department of Systems Engineering, Cornell University(系统工程系,康奈尔大学) School of Civil and Environmental Engineering, Cornell University(土木与环境工程学院,康奈尔大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种基于模型的强化学习方法,解决上下文不可观测导致的混杂问题,通过近似离策略评估和行为平均转移模型,实现一致的MDP构造和因果熵框架整合。

Comments 9 pages, 2 figures - decompressed draft

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07314 2025-12-09 cs.AI cs.LG 62%

M-STAR: Multi-Scale Spatiotemporal Autoregression for Human Mobility Modeling

M-STAR:多尺度时空自回归模型用于人类移动性建模

Yuxiao Luo, Songming Zhang, Sijie Ruan, Siran Chen, Kang Liu, Yang Xu, Yu Zheng, Ling Yin

机构 * Department of Land Surveying and Geo-informatics, The Hong Kong Polytechnic University(土地测量与地理信息学系,香港理工大学) Shenzhen Institutes of Advanced Technology (SIAT), Chinese Academy of Sciences(深圳先进技术研究所,中国科学院) Faculty of Computer Science and Control Engineering, Shenzhen University of Advanced Technology(计算机科学与控制工程学院,深圳先进技术大学) School of Computer Science and Technology, Beijing Institute of Technology(计算机科学与技术学院,北京理工大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 M-STAR通过多尺度时空自回归模型提升人类移动性长期轨迹生成的保真度和效率

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06259 2025-12-09 cs.SD cs.AI cs.LG 62%

Who Will Top the Charts? Multimodal Music Popularity Prediction via Adaptive Fusion of Modality Experts and Temporal Engagement Modeling

谁会登顶排行榜?通过适应性融合模态专家和时间参与建模的多模态音乐流行度预测

Yash Choudhary, Preeti Rao, Pushpak Bhattacharyya

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 GAMENet通过融合多模态数据和时间参与建模,提升了音乐流行度预测的准确性。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04416 2025-12-09 cs.AI cs.SE 62%

DataGovBench: Benchmarking LLM Agents for Real-World Data Governance Workflows

DataGovBench: 为现实世界数据治理工作流程评估LLM代理

Zhou Liu, Zhaoyang Han, Guochen Yan, Hao Liang, Bohan Zeng, Xing Chen, Yuanfeng Song, Wentao Zhang

机构 * Peking University(北京大学) ByteDance(字节跳动)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.SE

AI总结 DataGovBench通过150种现实任务评估LLM代理在数据治理中的表现,提出DataGovAgent框架提升复杂任务性能和调试效率。

Comments Equal contribution: Zhou Liu and Zhaoyang Han. Corresponding authors: Yuanfeng Song and Wentao Zhang

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03072 2025-12-09 cs.AI cs.LO 57%

Beyond the Black Box: A Cognitive Architecture for Explainable and Aligned AI

超越黑箱:可解释和对齐的AI认知架构

Hu Keyi

机构 * Tongji University(同济大学)

专题命中 规划决策 :workflow(abstract);分类 cs.AI

AI总结 本文提出'权重计算主义'认知架构,通过分解认知为逻辑原子和基本操作,实现可解释、普遍和可追溯的价值对齐,为通用人工智能的发展提供理论和实践基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00975 2025-12-09 cs.CV cs.LG cs.RO 57%

MM-ACT: Learn from Multimodal Parallel Generation to Act

MM-ACT: 从多模态并行生成中学习以行动

Haotian Liang, Xinyi Chen, Bin Wang, Mingkang Chen, Yitian Liu, Yuhao Zhang, Zanxin Chen, Tianshuo Yang, Yilun Chen, Jiangmiao Pang, Dong Liu, Xiaokang Yang, Yao Mu, Wenqi Shao, Ping Luo

机构 * Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) The University of Hong Kong(香港大学) University of Science and Technology of China(中国科学技术大学) Fudan University(复旦大学) Zhejiang University(浙江大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 MM-ACT通过多模态并行生成提升机器人任务执行能力,实现96.3%的成功率。

Comments 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14861 2025-12-09 cs.AI 57%

LabOS: The AI-XR Co-Scientist That Sees and Works With Humans

LabOS:能够看见并与人类协作的AI-XR共科学家

Le Cong, David Smerkous, Xiaotong Wang, Di Yin, Zaixi Zhang, Ruofan Jin, Yinkai Wang, Michal Gerasimiuk, Ravi K. Dinesh, Alex Smerkous, Lihan Shi, Joy Zheng, Ian Lam, Xuekun Wu, Shilong Liu, Peishan Li, Yi Zhu, Ning Zhao, Meenal Parakh, Simran Serrao, Imran A. Mohammad, Chao-Yeh Chen, Xiufeng Xie, Tiffany Chen, David Weinstein, Greg Barbone, Belgin Caglar, John B. Sunwoo, Fuxin Li, Jia Deng, Joseph C. Wu, Sanfeng Wu, Mengdi Wang

专题命中 规划决策 :AI agent(abstract);分类 cs.AI

AI总结 LabOS是一种通过多模态感知和增强现实实现人机协作的AI系统,能实时协助科学家进行实验,推动实验室向智能协作环境发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06859 2025-12-09 cs.AI 57%

JT-DA: Enhancing Data Analysis with Tool-Integrated Table Reasoning Large Language Models

JT-DA:利用工具集成的表格推理大语言模型提升数据分析

Ce Chi, Xing Wang, Zhendong Wang, Xiaofan Liu, Ce Li, Zhiyan Song, Chen Zhao, Kexin Yang, Boshen Shi, Jingjing Yang, Chao Deng, Junlan Feng

机构 * Jiutian Research, China Mobile, Beijing, China(钧天研究,中国移动,北京)

专题命中 规划决策 :workflow(abstract);分类 cs.AI

AI总结 JT-DA-8B通过工具集成的表格推理方法,提升复杂表格分析任务的性能和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06649 2025-12-09 cs.LG cs.CV cs.CY cs.ET 57%

Estimating Black Carbon Concentration from Urban Traffic Using Vision-Based Machine Learning

基于视觉机器学习的城市交通中黑碳浓度估计

Camellia Zakaria, Aryan Sadeghi, Weaam Jaafar, Junshi Xu, Alex Mariakakis, Marianne Hatzopoulou

机构 * University of Toronto(多伦多大学) University of Hong Kong(香港大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出基于视觉机器学习的方法,利用交通视频和天气数据估计街道层面的黑碳浓度,为污染控制和环境正义提供数据支持。

Comments 12 pages, 16 figures, 4 tables, 4 pages Appendix, in submission and under review for ACM MobiSys 2026 as of December 6th, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06417 2025-12-09 cs.LG cs.SD 57%

Hankel-FNO: Fast Underwater Acoustic Charting Via Physics-Encoded Fourier Neural Operator

Hankel-FNO:通过物理编码的傅里叶神经算子实现快速水下声学制图

Yifan Sun, Lei Cheng, Jianlong Li, Peter Gerstoft

机构 * College of Information Science and Electronic Engineering, Zhejiang University, Hangzhou, China(信息科学与电子工程学院,浙江大学,杭州,中国) Scripps Institution of Oceanography, University of California San Diego, La Jolla, California 92093, USA(Scripps 海洋研究所,加州大学圣地亚哥分校,La Jolla,加利福尼亚州 92093,美国)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 Hankel-FNO通过物理编码的傅里叶神经算子实现高效准确的水下声学制图,优于传统求解器和数据驱动方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06106 2025-12-09 cs.HC cs.AI 57%

Future You: Designing and Evaluating Multimodal AI-generated Digital Twins for Strengthening Future Self-Continuity

未来你:设计和评估多模态AI生成的数字双胞胎以加强未来自我连续性

Constanze Albrecht, Chayapatr Archiwaranguprok, Rachel Poonsiriwong, Awu Chen, Peggy Yin, Monchai Lertsutthiwong, Kavin Winson, Hal Hershfield, Pattie Maes, Pat Pataranutaporn

机构 * MIT Media Lab(MIT媒体实验室) Harvard University(哈佛大学) Stanford University(斯坦福大学) KASIKORN Labs(KASIKORN实验室)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本研究通过多模态AI生成的未来自我探索其对自我连续性、情绪和动机的影响,发现avatar效果最佳,但各模态无显著差异,互动质量是关键因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10680 2025-12-09 cs.LG stat.ML 57%

LAD-BNet: Lag-Aware Dual-Branch Networks for Real-Time Energy Forecasting on Edge Devices

LAD-BNet:面向边缘设备实时能源预测的时滞感知双分支网络

Jean-Philippe Lignier

机构 * University of La Réunion(留尼旺大学) PIMENT Laboratory(PIMENT实验室) Physics and Mathematical Engineering for Energy, Environment and Building(能源、环境与建筑的物理与数学工程)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 LAD-BNet通过时滞感知双分支网络在边缘设备上实现高效的实时能源预测,提升预测精度并降低推断时间,适用于智能电网和建筑领域。

Comments 27 pages, in French language. 10 tables, 26 references. Submitted to Energy and AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22634 2025-12-09 cs.RO cs.SE 57%

LabUtopia: High-Fidelity Simulation and Hierarchical Benchmark for Scientific Embodied Agents

LabUtopia:高保真模拟与分层基准用于科学具身智能体

Rui Li, Zixuan Hu, Wenxi Qu, Jinouwen Zhang, Zhenfei Yin, Sha Zhang, Xuantuo Huang, Hanqing Wang, Tai Wang, Jiangmiao Pang, Wanli Ouyang, Lei Bai, Wangmeng Zuo, Ling-Yu Duan, Dongzhan Zhou, Shixiang Tang

机构 * Shanghai AI Laboratory(上海人工智能实验室) Peking University(北京大学) Oxford(牛津大学) The Chinese University of Hong Kong(香港中文大学) Harbin Institute of Technology(哈尔滨工业大学) University of Science and Technology of China(中国科学技术大学)

专题命中 规划决策 :planning(abstract);分类 cs.SE

AI总结 LabUtopia通过高保真模拟和分层基准推动实验室环境中具身智能的发展。

Comments Accepted by NeurIPS 2025 Dataset and Benchmark Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07745 2025-12-09 cs.CV 50%

DiffusionDriveV2: Reinforcement Learning-Constrained Truncated Diffusion Modeling in End-to-End Autonomous Driving

DiffusionDriveV2: 结束到结束自动驾驶中的强化学习约束截断扩散建模

Jialv Zou, Shaoyu Chen, Bencheng Liao, Zhiyu Zheng, Yuehao Song, Lefei Zhang, Qian Zhang, Wenyu Liu, Xinggang Wang

机构 * School of Electronic Information and Communications, Huazhong University of Science & Technology(华中科技大学电子信息与通信学院) Institute of Artificial Intelligence, Huazhong University of Science & Technology(华中科技大学人工智能研究院) Horizon Robotics(地平线科技) School of Computer Science, Wuhan University(武汉大学计算机学院)

专题命中 规划决策 :planning(abstract)

AI总结 DiffusionDriveV2通过强化学习约束和探索,解决了自动驾驶中截断扩散模型在多样性和高质量之间的平衡问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07582 2025-12-09 cs.RO 50%

See Once, Then Act: Vision-Language-Action Model with Task Learning from One-Shot Video Demonstrations

一次观看,随后行动:基于单次视频示范的任务学习视觉-语言-行动模型

Guangyan Chen, Meiling Wang, Qi Shao, Zichen Zhou, Weixin Mao, Te Cui, Minzhao Zhu, Yinan Deng, Luojie Yang, Zhanqi Zhang, Yi Yang, Hua Chen, Yufeng Yue

机构 * Beijing Institute of Technology(北京理工大学) LimX Dynamics

专题命中 规划决策 :agent(abstract)

AI总结 ViVLA通过单次视频示范高效学习机器人操控任务,实现跨任务和跨身体的显著性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07574 2025-12-09 eess.IV cs.CR cs.CV 50%

Precise Liver Tumor Segmentation in CT Using a Hybrid Deep Learning-Radiomics Framework

使用混合深度学习-放射组学框架进行CT中肝肿瘤的精确分割

Xuecheng Li, Weikuan Jia, Komildzhon Sharipov, Alimov Ruslan, Lutfuloev Mazbutdzhon, Ismoilov Shuhratjon, Yuanjie Zheng

机构 * School of Information Science & Engineering, Shandong Normal University(信息科学与工程学院,山东师范大学) Tajik State University of Law, Business and Politics(塔吉克国立法律、商业与政治大学)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出混合深度学习-放射组学框架,用于CT中肝肿瘤的精确分割,结合注意力增强的U-Net与放射组学特征筛选,提升分割精度与稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07429 2025-12-09 stat.AP physics.ao-ph 50%

Bridging CORDEX and CMIP6: Machine Learning Downscaling for Wind and Solar Energy Droughts in Central Europe

弥合CORDEX与CMIP6:用于中欧风能和太阳能干旱的机器学习下推

Nina Effenberger, Maxim Samarin, Maybritt Schillinger, Reto Knutti

专题命中 规划决策 :planning(abstract)

AI总结 本研究利用机器学习模拟器弥合CORDEX与CMIP6,分析中欧风能和太阳能干旱的未来变化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07018 2025-12-09 cs.SC cs.LO 50%

Dynamic Boolean Synthesis with Zero-suppressed Decision Diagrams

动态布尔综合与零压制决策图

Yi Lin, Moshe Y. Vardi

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种基于零压制决策图的动态规划框架,用于布尔综合,解决了理论挑战并展示了算法在一般情况下的优势,为未来确定工业魔法数字提供了启发。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07001 2025-12-09 eess.SY cs.SY 50%

Synergies between AI Computing and Power Systems: Metrics, Scheduling, and Resilience

人工智能计算与电力系统之间的协同:指标、调度与韧性

Farzaneh Pourahmadi, Olivier Corradi, Pierre Pinson

专题命中 规划决策 :planning(abstract)

AI总结 本文提出通过标准化碳指标和协调架构,实现人工智能计算与电力系统之间的协同,提升调度效率和系统韧性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06336 2025-12-09 cs.CY 50%

The Role of Smart Cities in Ethical Design Framework

智能城市在伦理设计框架中的作用

Yijun Chen

专题命中 规划决策 :planning(abstract)

AI总结 本文探讨智能城市在伦理设计框架中的作用,通过理论分析和案例研究,提出监管沙盒、参与式治理等策略,以促进包容性和伦理化的城市发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04696 2025-12-09 cs.RO 50%

Building Gradient by Gradient: Decentralised Energy Functions for Bimanual Robot Assembly

通过梯度构建梯度:用于双臂机器人装配的去中心化能量函数

Alexander L. Mitchell, Joe Watson, Ingmar Posner

机构 * Applied AI Lab, University of Oxford(牛津大学应用人工智能实验室)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种去中心化基于梯度的框架,通过自适应势函数自动组合生成分段连续能量函数,以解决双臂机器人装配中的高层序列规划和快速重新规划问题。

Comments 8 pages, 7 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15803 2025-12-09 math.OC 50%

Linear-Quadratic Partially Observed Mean Field Stackelberg Stochastic Differential Game with Applications

线性二次部分观察均场斯塔克尔伯格随机微分博弈及其应用

Yu Si, Yueyang Zheng, Jingtao Shi

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种线性二次部分观察均场斯塔克尔伯格随机微分博弈模型,通过状态分解和逆向分离原理推导出分散策略,并应用于产品规划问题。

Comments 45 pages. arXiv admin note: substantial text overlap with arXiv:2503.15803

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00843 2025-12-09 cs.CV 50%

VLM-Assisted Continual learning for Visual Question Answering in Self-Driving

基于视觉语言模型的持续学习用于自动驾驶中的视觉问答

Yuxin Lin, Mengshi Qi, Liang Liu, Huadong Ma

机构 * State Key Laboratory of Networking and Switching Technology(网络与交换技术国家重点实验室) Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出结合视觉语言模型与持续学习的方法,以提升自动驾驶中视觉问答系统的性能和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06892 2025-12-09 cs.RO 50%

From Zero to High-Speed Racing: An Autonomous Racing Stack

从零到高速赛车:一个自主赛车栈

Hassan Jardali, Durgakant Pushp, Youwei Yu, Mahmoud Ali, Ihab S. Mohamed, Alejandro Murillo-Gonzalez, Paul D. Coen, Md. Al-Masrur Khan, Reddy Charan Pulivendula, Saeoul Park, Lingchuan Zhou, Lantao Liu

机构 * Luddy School of Informatics, Computing, and Engineering at Indiana University(印第安纳大学信息学院、计算与工程学院)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种自主赛车栈,通过模块化架构和多传感器数据集,实现了高速自主赛车的性能评估与技术突破。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06674 2025-12-09 cs.CV 50%

RunawayEvil: Jailbreaking the Image-to-Video Generative Models

RunawayEvil: 对图像到视频生成模型的劫持

Songping Wang, Rufan Qian, Yueming Lyu, Qinglong Liu, Linzhuang Zou, Jie Qin, Songhua Liu, Caifeng Shan

机构 * PRLab, Nanjing University(南京大学PRLab) Meituan(美团) Shanghai Jiao Tong University(上海交通大学)

专题命中 规划决策 :planning(abstract)

AI总结 RunawayEvil是一种针对图像到视频生成模型的多模态劫持框架,通过自我进化机制实现动态攻击策略,显著提升攻击成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06574 2025-12-09 cs.CG 50%

General Computation using Slidable Tiles with Deterministic Global Forces

利用确定性全局力的滑动瓷砖进行通用计算

Alberto Avila-Jimenez, David Barreda, Sarah-Laurie Evans, Austin Luchsinger, Aiden Massie, Robert Schweller, Evan Tomai, Tim Wylie

专题命中 规划决策 :planning(abstract)

AI总结 利用确定性全局力的滑动瓷砖模型实现通用计算,并证明相关问题的PSPACE完全性。

Comments Full version of paper in Proceedings of the 17th Innovations in Theoretical Computer Science (ITCS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06500 2025-12-09 cs.CR 50%

PDRIMA: A Policy-Driven Runtime Integrity Measurement and Attestation Approach for ARM TrustZone-based TEE

PDRIMA:一种基于策略的运行时完整性度量与认证方法用于ARM TrustZone基础的TEE

Jingkai Mao, Xiaolin Chang

专题命中 规划决策 :agent(abstract)

AI总结 PDRIMA是一种针对ARM TrustZone基础的TEE的运行时完整性保护方法,通过安全监控代理和远程认证代理实现基于策略的度量与认证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06287 2025-12-09 eess.SY cs.SY 50%

A Hybrid Physics-Based and Reinforcement Learning Framework for Electric Vehicle Charging Time Prediction

一种结合物理模型与强化学习的电动汽车充电时间预测框架

Praharshitha Aryasomayajula, Ting Bai, Andreas A. Malikopoulos

专题命中 规划决策 :planning(abstract)

AI总结 本文提出一种结合物理模型与强化学习的电动汽车充电时间预测框架,通过分析模型和RL方法提升预测精度与鲁棒性,实验显示其在电池老化下的性能提升显著。

详情

展开后加载摘要…

URL PDF HTML 收藏