arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-01-09 至 2026-01-09 共收录 95 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 6 篇

2601.04703 2026-01-09 cs.AI 92%

Beyond Monolithic Architectures: A Multi-Agent Search and Knowledge Optimization Framework for Agentic Search

超越单一架构:一种多智能体搜索与知识优化框架用于智能搜索

Yiqun Chen, Lingyong Yan, Zixuan Yang, Erhan Zhang, Jiashu Zhao, Shuaiqiang Wang, Dawei Yin, Jiaxin Mao

机构 * Renmin University of China(中国人民大学) Baidu Inc.(百度公司)

专题命中 工具调用 :agent(title,abstract);agentic(title,abstract);multi-agent(title,abstract);tool use(abstract)

AI总结 M-ASK提出了一种多智能体框架,通过分解智能搜索为搜索行为和知识管理两个角色,提升搜索效率与稳定性,实现更优的答案准确性和训练动态。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26699 2026-01-09 cs.SE 86%

Using Copilot Agent Mode to Automate Library Migration: A Quantitative Assessment

使用 Copilot Agent 模式自动化库迁移:一项定量评估

Aylton Almeida, Laerte Xavier, Marco Tulio Valente

专题命中 工具调用 :agent(title,abstract);agentic(abstract,comments);planning(abstract);分类 cs.SE

AI总结 本文通过 Copilot Agent 模式评估了 SQLAlchemy 库迁移的自动化效果,发现其在功能迁移上表现良好但应用功能维护不足。

Comments Accepted at 1st International Workshop on Agentic Engineering (AGENT 2026, colocated with ICSE), pages 1-5

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04767 2026-01-09 cs.AI cs.CL 81%

AT$^2$PO: Agentic Turn-based Policy Optimization via Tree Search

AT$^2$PO: 通过树搜索实现基于回合的代理策略优化

Zefang Zong, Dingwei Chen, Yang Li, Qi Yi, Bo Zhou, Chengming Li, Bo Qian, Peng Chen, Jie Jiang

机构 * Tencent Inc(腾讯公司) Sun Yat-Sen University(中山大学) Shenzhen MSU-BIT University(深圳MSU-BIT大学)

专题命中 工具调用 :agentic(title,abstract);分类 cs.AI、cs.CL

AI总结 AT$^2$PO 通过树搜索实现多轮代理强化学习,解决探索多样性、奖励分配和策略优化不一致问题,提升性能达1.84个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04888 2026-01-09 cs.AI 57%

SmartSearch: Process Reward-Guided Query Refinement for Search Agents

SmartSearch: 基于过程奖励的查询优化用于搜索代理

Tongyu Wen, Guanting Dong, Zhicheng Dou

机构 * Renmin University of China(中国人民大学)

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 SmartSearch通过过程奖励和查询优化机制提升搜索代理的查询质量与效率。

Comments 16 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04620 2026-01-09 cs.AI 57%

AgentDevel: Reframing Self-Evolving LLM Agents as Release Engineering

AgentDevel: 将自演化大语言模型代理重新定义为发布工程

Di Zhang

机构 * Fudan University(复旦大学)

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 AgentDevel将LLM代理改进重新定义为发布工程,通过无实现偏见的批评者、可执行诊断和翻转中心门控,实现稳定改进和可审计的发布流程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05243 2026-01-09 cs.RO cs.CV 50%

Generate, Transfer, Adapt: Learning Functional Dexterous Grasping from a Single Human Demonstration

生成、迁移、适应:从单个人示范学习功能性灵巧抓取

Xingyi He, Adhitya Polavaram, Yunhao Cao, Om Deshmukh, Tianrui Wang, Xiaowei Zhou, Kuan Fang

机构 * Cornell University(康奈尔大学)

专题命中 工具调用 :tool use(abstract)

AI总结 CorDex通过单个人示范生成合成数据,结合多模态预测网络和局部-全局融合模块,实现对新型物体的灵巧抓取学习。

Comments Project Page: https://cordex-manipulation.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 38 篇

2512.24957 2026-01-09 cs.AI 88%

AMAP Agentic Planning Technical Report

AMAP 代理规划技术报告

AMAP AI Agent Team, Yulan Hu, Xiangwen Zhang, Sheng Ouyang, Hao Yi, Lu Xu, Qinglin Lang, Lide Tan, Xiang Cheng, Tianchen Ye, Zhicong Li, Ge Chen, Wenjin Yang, Zheng Pan, Shaopan Xiong, Siran Yang, Ju Huang, Yan Zhang, Jiamang Wang, Yong Liu, Yinfeng Huang, Ning Wang, Tucheng Lin, Xin Li, Ning Guo

专题命中 规划决策 :planning(title,abstract);agentic(title,abstract);分类 cs.AI

AI总结 STAgent是一种专门用于时空理解的代理大语言模型,通过稳定工具环境、分层数据筛选和级联训练配方,有效解决复杂任务并保持通用能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05111 2026-01-09 cs.CL cs.AI 88%

Agent-as-a-Judge

代理作为裁判

Runyang You, Hongru Cai, Caiqi Zhang, Qiancheng Xu, Meng Liu, Tiezheng Yu, Yongqi Li, Wenjie Li

机构 * The Hong Kong Polytechnic University(香港理工大学) University of Cambridge(剑桥大学) Shandong Jianzhu University(山东建筑大学) Huawei Technologies(华为技术)

专题命中 规划决策 :agent(title,abstract);planning(abstract);agentic(abstract);multi-agent(abstract)

AI总结 本文提出了一种基于代理的评估框架,通过规划、工具验证和多代理协作提升评估的鲁棒性和可验证性,并提供了该领域的发展分类和未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06042 2026-01-09 cs.MA 88%

Agent+P: Guiding UI Agents via Symbolic Planning

Agent+P: 通过符号规划引导UI代理

Shang Ma, Xusheng Xiao, Yanfang Ye

专题命中 规划决策 :agent(title,abstract);planning(title,abstract)

AI总结 AGENT+P通过符号规划引导UI代理,提升UI自动化任务的成功率和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19361 2026-01-09 cs.CL cs.AI 86%

AgenticMath: Enhancing LLM Reasoning via Agentic-based Math Data Generation

AgenticMath: 通过基于代理的数学数据生成增强LLM推理

Xianyang Liu, Yilin Liu, Shuai Wang, Hao Cheng, Andrew Estornell, Yuzhi Zhao, Jun Shu, Jiaheng Wei

机构 * King’s College London(伦敦国王学院) Hong Kong Baptist University(香港 Baptist 大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) ByteDance Seed(字节跳动种子) City University of Hong Kong(香港城市大学) Xi’an Jiaotong University(西安交通大学)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 AgenticMath通过基于代理的数学数据生成方法,提升LLM在数学推理任务上的性能。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05016 2026-01-09 cs.MA cs.AI cs.GR cs.HC 85%

From Idea to Co-Creation: A Planner-Actor-Critic Framework for Agent Augmented 3D Modeling

从想法到协同创造:一种规划-执行-批评框架用于代理增强的3D建模

Jin Gao, Saichandu Juluri

机构 * Massachusetts Institute of Technology(麻省理工学院) Northeastern University(东北大学)

专题命中 规划决策 :agent(title,abstract);workflow(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出一种规划-执行-批评框架,通过多代理自我反思和人类监督提升3D建模的几何精度、审美质量和任务完成率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04853 2026-01-09 cs.CL 85%

RAAR: Retrieval Augmented Agentic Reasoning for Cross-Domain Misinformation Detection

RAAR:跨领域虚假信息检测的检索增强代理推理

Zhiwei Liu, Runteng Guo, Baojie Qu, Yuechen Jiang, Min Peng, Qianqian Xie, Sophia Ananiadou

机构 * The University of Manchester(曼彻斯特大学) School of Artificial Intelligence, Wuhan University(武汉大学人工智能学院) Center for Language and Information Research, Wuhan University(武汉大学语言与信息研究所)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.CL

AI总结 RAAR通过多代理协作和检索增强推理,提升跨领域虚假信息检测的准确性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04698 2026-01-09 cs.AI cs.CL cs.LG 85%

TourPlanner: A Competitive Consensus Framework with Constraint-Gated Reinforcement Learning for Travel Planning

TourPlanner: 一种基于约束门控强化学习的竞争共识框架用于旅行规划

Yinuo Wang, Mining Tan, Wenxiang Jiao, Xiaoxi Li, Hao Wang, Xuanyu Zhang, Yuan Lu, Weiming Dong

机构 * Xiaohongshu Inc.(小红书公司) Renmin University of China(中国人民大学) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所MAIS)

专题命中 规划决策 :planning(title,abstract);workflow(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 TourPlanner通过多路径推理和约束门控强化学习,解决旅行规划中候选点修剪、探索能力限制和约束优化难题,实现更高效的行程生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04699 2026-01-09 cs.RO cs.AI 83%

SeqWalker: Sequential-Horizon Vision-and-Language Navigation with Hierarchical Planning

SeqWalker: 基于分层规划的序列地平线视觉-语言导航

Zebin Han, Xudong Wang, Baichen Liu, Qi Lyu, Zhenduo Shang, Jiahua Dong, Lianqing Liu, Zhi Han

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 SeqWalker通过分层规划框架解决多任务视觉-语言导航中的信息过载问题,通过高层规划减少认知负荷,低层规划利用指令逻辑结构校正轨迹误差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04668 2026-01-09 cs.RO cs.AI 83%

Optimizing Path Planning using Deep Reinforcement Learning for UGVs in Precision Agriculture

利用深度强化学习优化无人机在精准农业中的路径规划

Laukik Patade, Rohan Rane, Sandeep Pillai

机构 * Sardar Patel Institute of Technology(萨达尔·帕特尔技术学院)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 本研究利用深度强化学习优化无人机在精准农业中的路径规划,通过DDPG和TD3算法在动态环境中实现高成功率的导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04245 2026-01-09 cs.MA cs.AI cs.CY 83%

AI Agents as Policymakers in Simulated Epidemics

AI代理作为模拟流行病中的政策制定者

Goshi Aoki, Navid Ghaffarzadegan

机构 * Department of Industrial and Systems Engineering(工业与系统工程系) Virginia Tech(弗吉尼亚理工大学)

专题命中 规划决策 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 本文提出了一种生成式AI代理,用于模拟流行病中的政策决策,通过理论引导的提示提升决策质量,展示AI在复杂社会系统中的应用潜力。

Comments 24 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05087 2026-01-09 eess.SY cs.SY 82%

Online Bayesian Learning of Agent Behavior in Differential Games

在线贝叶斯学习差分博弈中的智能体行为

Francesco Bianchin, Robert Lefringhausen, Sandra Hirche

专题命中 规划决策 :agent(title,abstract);multi-agent(abstract)

AI总结 本文提出了一种在线贝叶斯方法,用于多智能体系统中行为识别,通过参数残差实现快速更新和鲁棒预测,适用于非线性动态和价值函数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04878 2026-01-09 cs.AI cond-mat.mtrl-sci cs.CL cs.LG 82%

Higher-Order Knowledge Representations for Agentic Scientific Reasoning

高阶知识表示用于代理科学推理

Isabella A. Stewart, Markus J. Buehler

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出基于超图的知识表示方法,用于代理科学推理,通过高阶路径生成机理假设,提升科学发现效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05214 2026-01-09 cs.AI 79%

Internal Representations as Indicators of Hallucinations in Agent Tool Selection

内部表示作为代理工具选择中的幻觉指示器

Kait Healy, Bharathi Srinivasan, Visakh Madathil, Jing Wu

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 本文提出了一种利用LLM内部表示实时检测工具调用幻觉的方法,通过减少计算开销实现高准确率的检测,尤其在参数和工具选择方面表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12962 2026-01-09 cs.RO 78%

Enhancing Sampling-based Planning with a Library of Paths

通过路径库增强基于采样的规划

Michal Minařík, Vojtěch Vonásek, Robert Pěnička

专题命中 规划决策 :planning(title,abstract)

AI总结 通过存储和重用历史路径,提升狭窄通道中路径规划的效率与速度,减少计算时间,适用于机器人零件拣选等场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02207 2026-01-09 cs.RO cs.HC 78%

Human-Aided Trajectory Planning for Automated Vehicles through Teleoperation and Arbitration Graphs

通过遥控和仲裁图实现自动化车辆的人工辅助轨迹规划

Nick Le Large, David Brecht, Willi Poh, Jan-Hendrik Pauls, Martin Lauer, Frank Diermeyer

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出通过仲裁图实现自动化车辆的人工辅助轨迹规划,允许远程操作员调整规划器约束并扩展车辆的操作设计域。

Comments 7 pages, 8 figures, presented at IEEE Intelligent Vehicles Symposium 2025, video demonstration available at https://www.youtube.com/watch?v=fVSO-YOeGMk

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04234 2026-01-09 cs.AI 77%

Formal Analysis of AGI Decision-Theoretic Models and the Confrontation Question

AGI决策理论模型的正式分析及对峙问题

Denis Saklakov

机构 * Denis Saklakov(独立研究者)

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文分析了AGI在何种条件下会选择夺取权力而非合作,并推导出对峙的阈值条件,探讨了奖励设计和监管的 implications。

Comments 18 pages, 2 tables. Version 8

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04726 2026-01-09 cs.AI cs.CL 76%

Memory Matters More: Event-Centric Memory as a Logic Map for Agent Searching and Reasoning

记忆更重要:以事件为中心的记忆作为智能体搜索和推理的逻辑图

Yuyang Hu, Jiongnan Liu, Jiejun Tan, Yutao Zhu, Zhicheng Dou

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学北京校区人工智能学院)

专题命中 规划决策 :agent(title);分类 cs.AI、cs.CL

AI总结 本文提出CompassMem,一种以事件为中心的记忆框架,通过构建事件图实现智能体的结构化记忆导航,提升长周期推理能力。

Comments 19 pages,6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04686 2026-01-09 cs.LG cs.RO 76%

Nightmare Dreamer: Dreaming About Unsafe States And Planning Ahead

噩梦梦游者:对不安全状态的梦境与提前规划

Oluwatosin Oseni, Shengjie Wang, Jun Zhu, Micah Corah

专题命中 规划决策 :planning(title,comments);分类 cs.LG

AI总结 Nightmare Dreamer是一种基于模型的安全强化学习算法,通过预测潜在安全违规并规划动作,在机器人控制任务中实现了接近零安全违规和高奖励效率。

Comments RSS'25: Multi-Objective Optimization and Planning in Robotics Workshop: 5 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03905 2026-01-09 cs.AI cs.CL cs.LG 75%

Current Agents Fail to Leverage World Model as Tool for Foresight

当前智能体无法利用世界模型作为前瞻性工具

Cheng Qian, Emre Can Acikgoz, Bingxuan Li, Xiusi Chen, Yuji Zhang, Bingxiang He, Qinyu Luo, Dilek Hakkani-Tür, Gokhan Tur, Yunzhu Li, Heng Ji

机构 * UIUC(伊利诺伊大学香槟分校) THU(清华大学) JHU(约翰霍普金斯大学) Columbia(哥伦比亚大学)

专题命中 规划决策 :agent(abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文研究了当前智能体能否利用世界模型作为工具提升前瞻性认知,发现其在模拟调用和结果整合方面存在显著不足。

Comments 36 Pages, 13 Figures, 17 Tables (Meta data updated)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04254 2026-01-09 cs.AI cs.LG 73%

Scaling Trends for Multi-Hop Contextual Reasoning in Mid-Scale Language Models

中等规模语言模型中多跳上下文推理的扩展趋势

Brady Steele, Micah Katz

机构 * Georgia Institute of Technology(佐治亚理工学院) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 研究通过对比不同模型的多跳推理能力,发现多代理系统在推理任务中表现优于规则方法,且模型基础能力影响放大效果。

Comments 18 pages, 6 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17130 2026-01-09 math.DS math.OC 71%

Asymptotics of motion planning complexity for control-affine systems

控制-affine系统运动规划复杂度的渐进行为

Michele Motta, Dario Prandi

专题命中 规划决策 :planning(title)

AI总结 本文研究了控制-affine系统中非可接受曲线近似复杂度的渐进行为,针对余秩一分布和马丁特型奇异分布提供了渐进行为等价关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10509 2026-01-09 cs.LG 68%

From Actions to Words: Towards Abstractive-Textual Policy Summarization in RL

从动作到词语:迈向强化学习中基于抽象文本的策略摘要

Sahar Admoni, Assaf Hallak, Yftah Ziser, Omer Ben-Porat, Ofra Amir

机构 * Nvidia Research(英伟达研究)

专题命中 规划决策 :agent(abstract,comments);分类 cs.LG;autonomous agent(comments);multi-agent(comments)

AI总结 SySLLM通过将策略解释转化为语言生成问题,利用大型语言模型生成连贯的摘要,以解释复杂强化学习行为。

Comments In Proceedings of AAMAS 2026 (The 25th International Conference on Autonomous Agents and Multi-Agent Systems)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05174 2026-01-09 cs.LG cs.AI 62%

FaST: Efficient and Effective Long-Horizon Forecasting for Large-Scale Spatial-Temporal Graphs via Mixture-of-Experts

FaST: 为大规模时空图实现高效且有效的长周期预测

Yiji Zhao, Zihao Zhong, Ao Wang, Haomin Wen, Ming Jin, Yuxuan Liang, Huaiyu Wan, Hao Wu

机构 * Yunnan University(云南大学) Carnegie Mellon University(卡内基梅隆大学) Griffith University(格里菲斯大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Beijing Jiaotong University(北京交通大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 FaST通过异构性感知混合专家框架,实现大规模时空图的高效长周期预测,提升预测精度与计算效率。

Comments Accepted to KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02780 2026-01-09 cs.CL cs.AI 62%

MiMo-V2-Flash Technical Report

MiMo-V2-Flash 技术报告

Core Team, Bangjun Xiao, Bingquan Xia, Bo Yang, Bofei Gao, Bowen Shen, Chen Zhang, Chenhong He, Chiheng Lou, Fuli Luo, Gang Wang, Gang Xie, Hailin Zhang, Hanglong Lv, Hanyu Li, Heyu Chen, Hongshen Xu, Houbin Zhang, Huaqiu Liu, Jiangshan Duo, Jianyu Wei, Jiebao Xiao, Jinhao Dong, Jun Shi, Junhao Hu, Kainan Bao, Kang Zhou, Lei Li, Liang Zhao, Linghao Zhang, Peidian Li, Qianli Chen, Shaohui Liu, Shihua Yu, Shijie Cao, Shimao Chen, Shouqiu Yu, Shuo Liu, Tianling Zhou, Weijiang Su, Weikun Wang, Wenhan Ma, Xiangwei Deng, Bohan Mao, Bowen Ye, Can Cai, Chenghua Wang, Chengxuan Zhu, Chong Ma, Chun Chen, Chunan Li, Dawei Zhu, Deshan Xiao, Dong Zhang, Duo Zhang, Fangyue Liu, Feiyu Yang, Fengyuan Shi, Guoan Wang, Hao Tian, Hao Wu, Heng Qu, Hongfei Yi, Hongxu An, Hongyi Guan, Xing Zhang, Yifan Song, Yihan Yan, Yihao Zhao, Yingchun Lai, Yizhao Gao, Yu Cheng, Yuanyuan Tian, Yudong Wang, Zhen Tang, Zhengju Tang, Zhengtao Wen, Zhichao Song, Zhixian Zheng, Zihan Jiang, Jian Wen, Jiarui Sun, Jiawei Li, Jinlong Xue, Jun Xia, Kai Fang, Menghang Zhu, Nuo Chen, Qian Tu, Qihao Zhang, Qiying Wang, Rang Li, Rui Ma, Shaolei Zhang, Shengfan Wang, Shicheng Li, Shuhao Gu, Shuhuai Ren, Sirui Deng, Tao Guo, Tianyang Lu, Weiji Zhuang, Weikang Zhang, Weimin Xiong, Wenshan Huang, Wenyu Yang, Xin Zhang, Xing Yong, Xu Wang, Xueyang Xie, Yilin Jiang, Yixin Yang, Yongzhe He, Yu Tu, Yuanliang Dong, Yuchen Liu, Yue Ma, Yue Yu, Yuxing Xiang, Zhaojun Huang, Zhenru Lin, Zhipeng Xu, Zhiyang Chen, Zhonghua Deng, Zihan Zhang, Zihao Yue

机构 * LLM-Core Xiaomi(LLM-Core小米)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.CL

AI总结 MiMo-V2-Flash通过混合注意力架构和多教师在线蒸馏技术,实现高效推理和代理能力,开源模型权重促进开放研究。

Comments 31 pages, technical report

详情

展开后加载摘要…

URL PDF HTML 收藏