arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2025-12-29 至 2025-12-29 共收录 80 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 4 篇

2512.20458 2025-12-29 cs.IR 87%

Laser: Governing Long-Horizon Agentic Search via Structured Protocol and Context Register

激光:通过结构化协议和上下文寄存器治理长 horizon 的代理搜索

Shuting Wang, Qiaolin Xia, Vich Wang, Herberttli, Bobsimons, Zhicheng Dou

专题命中 工具调用 :agentic(title,abstract);agent(abstract);tool use(abstract);planning(abstract)

AI总结 Laser通过结构化协议和上下文寄存器稳定并扩展代理搜索,提升多跳问答性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15144 2025-12-29 cs.CR 83%

MCPZoo: A Large-Scale Dataset of Runnable Model Context Protocol Servers for AI Agent

MCPZoo:大规模可运行模型上下文协议服务器数据集用于AI代理

Mengying Wu, Pei Chen, Geng Hong, Baichao An, Jinsong Chen, Binwang Wan, Xudong Pan, Jiarun Dai, Min Yang

专题命中 工具调用 :agent(title);AI agent(title)

AI总结 MCPZoo是一个大规模可运行模型上下文协议服务器数据集,用于支持AI代理与外部工具交互的实证研究和安全分析

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21720 2025-12-29 cs.LG cs.AI cs.CL cs.IT math.IT 82%

An Information Theoretic Perspective on Agentic System Design

从信息论角度看待代理系统设计

Shizhe He, Avanika Narayan, Ishan S. Khare, Scott W. Linderman, Christopher Ré, Dan Biderman

机构 * Department of Computer Science, Stanford University(斯坦福大学计算机科学系) Department of Statistics, Stanford University(斯坦福大学统计学系) Wu Tsai Neurosciences Institute, Stanford University(斯坦福大学吴泰教授神经科学研究所)

专题命中 工具调用 :agentic(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 从信息论角度研究代理系统设计,通过互信息估计器评估压缩质量,发现更大压缩器更准确且更高效,可显著降低资源消耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21346 2025-12-29 eess.SY cs.SY 50%

Multi-Day Scheduling for Electric Vehicle Routing: A Novel Model and Comparison Of Metaheuristics

多日电动汽车路线规划:一种新型模型与元启发式算法比较

Dominik Köster, Florian Porkert, Klaus Volbert

专题命中 工具调用 :planning(abstract)

AI总结 本文提出了一种多日电动汽车路线规划模型,通过比较多种元启发式算法来优化电动汽车的路线规划与充电安排。

Comments 6 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 28 篇

2512.21699 2025-12-29 cs.AI 85%

Towards Responsible and Explainable AI Agents with Consensus-Driven Reasoning

迈向负责任和可解释的AI代理:基于共识驱动的推理

Eranga Bandara, Tharaka Hewa, Ross Gore, Sachin Shetty, Ravi Mukkamala, Peter Foytik, Abdul Rahman, Safdar H. Bouk, Xueping Liang, Amin Hass, Sachini Rajapakse, Ng Wee Keong, Kasun De Zoysa, Aruna Withanage, Nilaan Loganathan

机构 * Old Dominion University, Norfolk, VA, USA(老奥本大学) Center for Wireless Communications, University of Oulu, Finland(无线通信中心,奥卢大学) Florida International University, USA(佛罗里达国际大学) Nanyang Technological University, Singapore(南洋理工大学) University of Colombo, Sri Lanka(科伦坡大学) Accenture Technology Labs, Arlington, VA, USA(Accenture技术实验室)

专题命中 规划决策 :AI agent(title,abstract);agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出了一种基于多模型共识和推理层治理的负责任和可解释的AI代理架构,通过结构化整合不同模型的输出以提升系统鲁棒性、透明度和责任性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21431 2025-12-29 cs.SE cs.LG 85%

Cerberus: Multi-Agent Reasoning and Coverage-Guided Exploration for Static Detection of Runtime Errors

Cerberus:多智能体推理与覆盖引导探索用于运行时错误的静态检测

Hridya Dhulipala, Xiaokai Rong, Tien N. Nguyen

机构 * University of Texas at Dallas(德克萨斯大学达拉斯分校)

专题命中 规划决策 :agent(title);multi-agent(title);分类 cs.LG、cs.SE

AI总结 Cerberus通过多智能体推理和覆盖引导探索,实现无执行的运行时错误静态检测,提高测试效率和错误发现能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19864 2025-12-29 cs.CL cs.AI 84%

HARMON-E: Hierarchical Agentic Reasoning for Multimodal Oncology Notes to Extract Structured Data

HARMON-E:多模态肿瘤病历的分层代理推理以提取结构化数据

Shashi Kant Gupta, Arijeet Pramanik, Jerrin John Thomas, Regina Schwind, Lauren Wiener, Avi Raju, Jeremy Kornbluth, Yanshan Wang, Zhaohui Su, Hrituraj Singh

机构 * Triomics University of Pittsburgh(匹兹堡大学) Ontada

专题命中 规划决策 :agentic(title,abstract);workflow(abstract);分类 cs.AI、cs.CL

AI总结 HARMON-E通过分层代理推理框架,实现对多模态肿瘤病历的结构化数据提取,达到高精度和大规模应用。

Comments 39 Pages, Supplementary Included

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05622 2025-12-29 cs.RO cs.AI 83%

CityNavAgent: Aerial Vision-and-Language Navigation with Hierarchical Semantic Planning and Global Memory

CityNavAgent:基于层次语义规划和全局记忆的空中视觉-语言导航

Weichen Zhang, Chen Gao, Shiquan Yu, Ruiying Peng, Baining Zhao, Qian Zhang, Jinqiang Cui, Xinlei Chen, Yong Li

机构 * Tsinghua University(清华大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 CityNavAgent通过层次语义规划和全局记忆模块,提升空中视觉-语言导航在复杂城市环境中的导航性能。

Journal ref Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21654 2025-12-29 cs.RO cs.AI 79%

Structural Induced Exploration for Balanced and Scalable Multi-Robot Path Planning

结构诱导探索用于平衡和可扩展的多机器人路径规划

Zikun Guo, Adeyinka P. Adedigba, Rammohan Mallipeddi, Heoncheol Lee

机构 * Department of Artificial Intelligence, School of Electronics Engineering, Kyungpook National University(人工智能系,电子工程学院,韩国庆北国立大学) Department of IT Convergence Engineering, Kumoh National Institute of Technology(IT融合工程系,木谷国立技术学院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出一种结构诱导探索框架,通过整合结构先验和负载感知目标,提升多机器人路径规划的效率与负载平衡能力。

Comments 20pages, 6Figues

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21613 2025-12-29 cs.AI 79%

AMS-IO-Bench and AMS-IO-Agent: Benchmarking and Structured Reasoning for Analog and Mixed-Signal Integrated Circuit Input/Output Design

AMS-IO-Bench 和 AMS-IO-Agent:用于模拟和混合信号集成电路输入/输出设计的基准测试与结构化推理

Zhishuai Zhang, Xintian Li, Shilong Liu, Aodong Zhang, Lu Jie, Nan Sun

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 本文提出 AMS-IO-Agent 和 AMS-IO-Bench,通过结构化推理提升模拟和混合信号集成电路输入/输出设计效率,实现高通过率和缩短设计周期。

Comments 8 pages, 5 figures. Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21343 2025-12-29 eess.SY cs.AI cs.MA cs.SY 79%

EcoNet: Multiagent Planning and Control Of Household Energy Resources Using Active Inference

EcoNet:利用主动推断进行多智能体家庭能源资源规划与控制

John C. Boik, Kobus Esterhuysen, Jacqueline B. Hynes, Axel Constant, Ines Hipolito, Mahault Albarracin, Alex B. Kiefer, Karl Friston

机构 * VERSES, Los Angeles, CA, USA(VERSES, 美国洛杉矶州) Spatial Web Foundation, Los Angeles, CA, USA(空间网络基金会, 美国洛杉矶州) Dept. of Engineering and Informatics, Univ. of Sussex, Brighton, UK(工程与信息学系, 英国苏塞克斯大学) Institut Sante et societe, UQAM, Montreal, CAN(健康与社会研究所, 加拿大蒙特利尔) Macquarie University, Sydney, AUS(麦考瑞大学, 澳大利亚悉尼) LearnableLoopAI.com, Custer, WA, USA(LearnableLoopAI.com, 美国华盛顿州) Queen Square Institute of Neurology, UCL, London, UK(queen square 神经学研究所, 英国伦敦大学学院)

专题命中 规划决策 :planning(title);agent(abstract);分类 cs.AI

AI总结 EcoNet通过主动推断方法,解决家庭能源管理中的不确定性及多目标冲突问题,提升能源调度与协调效率。

Comments 17 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21882 2025-12-29 cs.RO cs.SY eess.SY 78%

Optimal Trajectory Planning for Orbital Robot Rendezvous and Docking

轨道机器人对接与停靠的最优轨迹规划

Kenta Iizuka, Akiyoshi Uchida, Kentaro Uno, Kazuya Yoshida

机构 * Space Robotics Lab. (SRL) in the Department of Aerospace Engineering, Graduate School of Engineering, Tohoku University(空间机器人实验室(SRL)位于工程研究生院航空航天工程系,东北大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出基于非线性优化的轨迹规划方法,用于安全接近并引导旋转碎片目标进入机械臂工作空间,为后续捕获提供基础。

Comments Author's version of a manuscript accepted at the International Conference on Space Robotics 2025 (iSpaRo 2025). (c) IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10542 2025-12-29 cs.RO 78%

AORRTC: Almost-Surely Asymptotically Optimal Planning with RRT-Connect

AORRTC: 几乎确定性渐进最优规划与RRT-Connect

Tyler Wilson, Wil Thomason, Zachary Kingston, Jonathan Gammell

专题命中 规划决策 :planning(title,abstract)

AI总结 AORRTC通过扩展RRT-Connect实现几乎确定性渐进最优规划,以高效且可靠的方式解决高自由度机器人运动规划问题。

Comments IEEE Robotics and Automation Letters (RA-L). 8 pages, 4 figures, 1 table. A video of AORRTC can be found at https://www.youtube.com/watch?v=j1itxP3KuiM . Information on the implementation of AORRTC is available at https://robotic-esp.com/code/aorrtc/

Journal ref IEEE Robotics and Automation Letters, vol. 10 num. 12, (2025). Pages 13375-13382

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21438 2025-12-29 cs.RO 78%

Planetary Terrain Datasets and Benchmarks for Rover Path Planning

行星地形数据集与路径规划基准

Marvin Chancán, Avijit Banerjee, George Nikolakopoulos

机构 * Department of Computer Science, Electrical and Space Engineering (Robotics and AI Lab)(计算机科学与空间工程系(机器人与人工智能实验室))

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出两个行星地形基准数据集,评估经典和学习路径规划算法,揭示经典算法在复杂地形中的优越性能及学习模型的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21412 2025-12-29 cs.LG cs.SY eess.SY 77%

A Survey of Freshness-Aware Wireless Networking with Reinforcement Learning

面向新鲜度的无线网络调研:强化学习视角

Alimu Alibotaiken, Suyang Wang, Oluwaseun T. Ajayi, Yu Cheng

机构 * Department of Electrical and Computer Engineering, Illinois Institute of Technology(伊利诺伊理工学院电气与计算机工程系) School of Computer Science and Engineering, California State University(加州州立大学计算机科学与工程学院)

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.LG

AI总结 本文通过强化学习视角调研了面向新鲜度的无线网络,系统梳理了AoI及其变体分类,并提出策略分类法,综合了RL驱动的新鲜度控制进展,突出了延迟决策、随机变化和跨层设计等挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21723 2025-12-29 cs.RO cs.AI cs.LG 73%

HELP: Hierarchical Embodied Language Planner for Household Tasks

家庭任务的分层具身语言规划器HELP

Alexandr V. Korchemnyi, Anatoly O. Onishchenko, Eva A. Bakaeva, Alexey K. Kovalev, Aleksandr I. Panov

机构 * MIRAI Cognitive AI Systems Lab(认知人工智能系统实验室)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

AI总结 HELP通过分层结构的LLM智能体解决家庭任务中的复杂规划问题,结合自然语言处理与具身智能,实现高效任务执行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.02519 2025-12-29 cs.AI cs.LG 73%

Creative Agents: Empowering Agents with Imagination for Creative Tasks

创意代理:通过想象力赋能代理以完成创意任务

Penglin Cai, Chi Zhang, Yuhui Fu, Haoqi Yuan, Zongqing Lu

机构 * School of Computer Science Peking University(北京大学计算机学院)

专题命中 规划决策 :AI agent(abstract);planning(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出通过增强想象力的创意代理,首次在Minecraft生存模式中实现多样化建筑创建,利用大语言模型和扩散模型提升创造力表现。

Comments The first two authors contribute equally

Journal ref Proceedings of the 41st Conference on Uncertainty in Artificial Intelligence (UAI 2025), PMLR 244:471-496

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21586 2025-12-29 cs.LG 70%

Videos are Sample-Efficient Supervisions: Behavior Cloning from Videos via Latent Representations

视频是高效的监督:通过潜在表示从视频中进行行为克隆

Xin Liu, Haoran Li, Dongbin Zhao

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学)

专题命中 规划决策 :agent(abstract);autonomous agent(abstract);分类 cs.LG

AI总结 本文提出通过潜在表示从视频中进行行为克隆的方法,实现了高效样本的视觉策略学习,无需其他专家监督。

Journal ref NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21482 2025-12-29 cs.AI 70%

LogicLens: Visual-Logical Co-Reasoning for Text-Centric Forgery Analysis

LogicLens:面向文本导向伪造分析的视觉-逻辑协同推理

Fanwei Zeng, Changtao Miao, Jing Huang, Zhiya Tan, Shutao Gong, Xiaoming Yu, Yang Wang, Huazhe Tan, Weibin Yao, Jianshu Li

机构 * Ant Group(蚂蚁集团) Nanyang Technological University(南洋理工大学)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 LogicLens通过视觉-逻辑协同推理框架,提升文本导向伪造分析的准确性和鲁棒性,其在多个基准测试中表现优异。

Comments 11 pages, 5 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22038 2025-12-29 math.OC 67%

Mean-Field Analysis and Optimal Control of a Dynamic Rating and Matchmaking System

均场分析与动态评分和匹配系统的最优控制

Wataru Nozawa

专题命中 规划决策 :agent(abstract);multi-agent(abstract)

AI总结 本文研究了动态评分和匹配系统的均场分析与最优控制,揭示了技能漂移对长期准确性的影响、交互信息的不变性原理以及最优策略的分离特性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21766 2025-12-29 cs.CE 67%

UniLabOS: An AI-Native Operating System for Autonomous Laboratories

UniLabOS:面向自主实验室的AI原生操作系统

Jing Gao, Junhan Chang, Haohui Que, Yanfei Xiong, Shixiang Zhang, Xianwei Qi, Zhen Liu, Jun-Jie Wang, Qianjun Ding, Xinyu Li, Ziwei Pan, Qiming Xie, Zhuang Yan, Junchi Yan, Linfeng Zhang

专题命中 规划决策 :agent(abstract);planning(abstract)

AI总结 UniLabOS通过AI原生架构统一自主实验室的数字决策与物理实验,实现跨异构仪器的鲁棒调度与多节点协调,为可重复和可追溯的自主实验提供可扩展基础。

Comments 18 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20312 2025-12-29 cs.LG cs.AI 62%

TableGPT-R1: Advancing Tabular Reasoning Through Reinforcement Learning

TableGPT-R1: 通过强化学习推进表格推理

Saisai Yang, Qingyi Huang, Jing Yuan, Liangyu Zha, Kai Tang, Yuhang Yang, Ning Wang, Yucheng Wei, Liyao Li, Wentao Ye, Hao Chen, Tao Zhang, Junlin Zhou, Haobo Wang, Gang Chen, Junbo Zhao

机构 * Zhejiang University Institute of Computing Innovation(浙江大学计算创新研究院)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 TableGPT-R1通过强化学习框架提升表格推理能力,整合数据工程、奖励系统和多阶段训练框架,实现复杂表格任务的先进性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22010 2025-12-29 cs.CV cs.AI 57%

LongFly: Long-Horizon UAV Vision-and-Language Navigation with Spatiotemporal Context Integration

LongFly: 长航程无人机视觉与语言导航中的时空上下文整合

Wen Jiang, Li Wang, Kangyao Huang, Wei Fan, Jinyuan Liu, Shaoyu Liu, Hongwei Duan, Bin Xu, Xiangyang Ji

机构 * School of Mechanical Engineering, Beijing Institute of Technology(北京理工大学机械工程学院) Chongqing Innovation Center, Beijing Institute of Technology(北京理工大学重庆创新中心) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Department of Automation, Tsinghua University(清华大学自动化系) School of Software, Dalian University of Technology(大连理工大学软件学院) School of Artificial Intelligence, Xidian University(西安电子科技大学人工智能学院)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 LongFly通过整合时空上下文提升无人机长航程视觉与语言导航的准确性和稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21925 2025-12-29 cs.LG 57%

Hybrid Combinatorial Multi-armed Bandits with Probabilistically Triggered Arms

混合概率触发组合多臂老虎机

Kongchang Zhou, Tingyu Zhang, Wei Chen, Fang Kong

机构 * Southern University of Science and Technology(南方科技大学) Microsoft Research(微软研究院)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文提出混合概率触发组合多臂老虎机框架,结合离线数据与在线交互,通过混合CUCB算法提升探索效率并纠正数据偏差,实验证明其在高质量和低质量数据下的优越性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18564 2025-12-29 cs.AI 57%

Vox Deorum: A Hybrid LLM Architecture for 4X / Grand Strategy Game AI -- Lessons from Civilization V

Vox Deorum:一种用于4X/大战略游戏AI的混合LLM架构——来自《文明V》的启示

John Chen, Sihan Cheng, Can Gurkan, Ryan Lay, Moez Salahuddin

机构 * University of Arizona(亚利桑那大学) Northwestern University(西北大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Independent Researcher(独立研究者)

专题命中 规划决策 :agentic(abstract);分类 cs.AI

AI总结 Vox Deorum提出了一种混合LLM架构用于4X游戏AI,通过宏观战略推理与子系统协同,展示了LLM在复杂游戏中的应用潜力。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21456 2025-12-29 cs.LG 57%

Statistical vs. Deep Learning Models for Estimating Substance Overdose Excess Mortality in the US

统计学习与深度学习模型用于估计美国物质过量死亡率

Sukanya Krishna, Marie-Laure Charpignon, Maimuna Majumder

机构 * Harvard University(哈佛大学) Boston Children's Hospital(波士顿儿童医院) Broad Institute of MIT and Harvard(MIT和哈佛联合研究所) Massachusetts Institute of Technology(麻省理工学院) Harvard Medical School(哈佛医学院)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文比较了统计模型与深度学习模型在预测美国物质过量死亡率方面的性能,发现LSTM在预测结构变化时表现更优,而基于注意力的模型因过度拟合历史数据而表现不佳。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13710 2025-12-29 cs.LG 57%

Predictive Modeling of Flood-Prone Areas Using SAR and Environmental Variables

利用SAR和环境变量预测易发洪水区域

Edwin Oluoch Awino, Denis Machanda

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本研究利用SAR数据和机器学习方法预测肯尼亚Nyando流域的洪水易发区域,随机森林模型表现出最佳预测性能。

Comments There is an error with this document and I am checking to correct it and I will update it

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12759 2025-12-29 cs.CV 50%

A-TDOM: Active TDOM via On-the-Fly 3DGS

A-TDOM:通过实时3DGS进行主动TDOM

Yiwei Xu, Xiang Wang, Yifei Yu, Wentian Gan, Luca Morelli, Giulio Perda, Xin Wang, Zongqian Zhan, Fabio Remondino

机构 * Fondazione Bruno Kessler(布鲁诺·克塞勒基金会)

专题命中 规划决策 :planning(abstract)

AI总结 A-TDOM通过实时3DGS优化实现近实时TDOM生成,提升地理信息更新效率与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21667 2025-12-29 astro-ph.EP astro-ph.IM gr-qc physics.geo-ph 50%

Numerical simulation of lunar response to gravitational waves and its 3D topographic effect using the spectral-element method

利用频谱元方法对月球对引力波的响应及三维地形效应进行数值模拟

Lei Zhang, Han Yan, Jinhai Zhang, Xian Chen

专题命中 规划决策 :planning(abstract)

AI总结 本研究利用频谱元方法模拟月球对引力波的响应,发现地形效应在特定频率下增强引力波信号,为月球引力波探测提供理论支持。

Comments Accepted for publication in Physical Review D

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20619 2025-12-29 cs.CV 50%

SemanticGen: Video Generation in Semantic Space

SemanticGen: 语义空间中的视频生成

Jianhong Bai, Xiaoshi Wu, Xintao Wang, Xiao Fu, Yuanxing Zhang, Qinghe Wang, Xiaoyu Shi, Menghan Xia, Zuozhu Liu, Haoji Hu, Pengfei Wan, Kun Gai

机构 * Zhejiang University(浙江大学) Kling Team, Kuaishou Technology(快手科技 Kling 团队) CUHK(香港中文大学) DLUT(大连理工大学) HUST(华中科技大学)

专题命中 规划决策 :planning(abstract)

AI总结 SemanticGen通过在语义空间中生成视频,提高了长视频生成的效率和质量,优于现有方法。

Comments Project page: https://jianhongbai.github.io/SemanticGen/

详情

展开后加载摘要…

URL PDF HTML 收藏