Advances in LLMs with Focus on Reasoning, Adaptability, Efficiency and Ethics
大语言模型的进展:聚焦推理、适应性、效率和伦理
专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL
AI总结 本文综述了大语言模型在推理、适应性、效率和伦理方面的进展,探讨了关键技术和挑战,提出未来研究方向。
AI 大模型
大模型数学、逻辑、规划、多步推理和测试时计算能力。
大语言模型的进展:聚焦推理、适应性、效率和伦理
专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL
AI总结 本文综述了大语言模型在推理、适应性、效率和伦理方面的进展,探讨了关键技术和挑战,提出未来研究方向。
基于预训练大语言模型的通用规划抽象生成
机构 * Hunan University of Science and Technology(湖南科技大学) ; Dongguan University of Technology(东莞理工学院)
专题命中 规划推理 :planning(title,abstract);分类 cs.AI
AI总结 本文提出利用预训练大语言模型生成通用规划的抽象,并通过自动化调试修正抽象,以提升规划效率。
AudioRouter: 通过基于强化学习的双推理实现数据高效的音频理解
专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI
AI总结 AudioRouter通过强化学习双推理机制,以更少的数据训练实现LALMs在音频理解上的高效提升。
从转向到踩踏:自动驾驶VLMs是否能泛化到骑行辅助的空间感知与规划?
专题命中 规划推理 :planning(title);reasoning(abstract)
AI总结 本文提出CyclingVQA基准,评估自动驾驶VLMs在骑行辅助场景中的感知与推理能力,发现现有模型在骑行特定交通提示理解上存在不足,需进一步改进。
Comments Preprint
EventCast:基于LLM事件知识的电子商务混合需求预测
机构 * ByteDance China(字节跳动中国) ; National University of Singapore(新加坡国立大学) ; Griffith University(格里菲斯大学)
专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.CL、cs.AI
AI总结 EventCast通过整合LLM事件知识提升电子商务需求预测精度,实现86.9%和97.7%的MAE和MSE改进。
基于人群映射与避让路线规划的安全移动支持系统
机构 * Graduate School of Regional Development and Creativity, Division of Engineering and Agriculture, Graduate School, Utsunomiya University(乌市大学研究生院区域发展与创意学院,工程与农业系)
专题命中 规划推理 :planning(title)
AI总结 本文提出利用视觉-语言模型和高斯过程回归生成动态人群密度地图,以提升自主机器人在拥挤环境中的安全导航能力。
Journal ref 2025 IEEE International Conference on Real-time Computing and Robotics (RCAR)
在不确定环境中进行元推理:一个元Bayes-适应MDP框架
机构 * Department of Psychology(心理学系) ; Institut für Geometrie und Praktische Mathematik(几何与应用数学研究所)
专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI
AI总结 本文提出元Bayes-适应MDP框架,用于处理未知奖励和转移分布环境中的元推理问题,并在伯努利老虎机任务中验证其有效性。
PhyCritic:面向物理AI的多模态批评模型
专题命中 规划推理 :reasoning(abstract);planning(abstract)
AI总结 PhyCritic通过双阶段RLVR流程优化,提升物理AI任务中的感知和推理能力,实现对物理任务的高效评估和改进。
UniAudio 2.0:一种具有文本对齐因子化音频标记化的统一音频语言模型
机构 * The Chinese University of Hong Kong, China(香港中文大学)
专题命中 规划推理 :reasoning(abstract);planning(abstract)
AI总结 UniAudio 2.0通过引入ReasoningCodec和统一自回归架构,实现了文本对齐的因子化音频标记化,提升了音频理解和生成性能,并在多种任务中展现了强大的泛化能力。
ChainRec: 一个用于路由工具链的代理推荐学习系统,以应对多样化和演变的兴趣
专题命中 规划推理 :reasoning(abstract);planning(abstract)
AI总结 ChainRec通过动态选择推理工具的代理推荐系统,提升冷启动和兴趣演变场景下的推荐性能。
从提示-响应到目标导向系统:代理AI软件架构的演变
专题命中 规划推理 :reasoning(abstract);planning(abstract)
AI总结 本文探讨了代理AI从提示-响应到目标导向系统的架构演变,提出了生产级代理的参考架构、多代理拓扑分类及企业加固检查表,强调标准化代理循环和可审计控制机制的重要性。
BagelVLA: 通过交错视觉-语言-动作生成增强长时程操作
机构 * Tsinghua University(清华大学)
专题命中 规划推理 :reasoning(abstract);planning(abstract)
AI总结 BagelVLA通过整合语言规划、视觉预测和动作生成,提升复杂长时程操作任务的性能。
Orion-Bix:用于表格上下文学习的双轴注意力
机构 * Lexsi Labs(Lexsi实验室)
专题命中 规划推理 :reasoning(abstract);分类 cs.AI、cs.LG
AI总结 Orion-Bix通过双轴注意力与元学习方法,实现了高效且鲁棒的少样本表格学习,优于基线模型并在基准上表现优异。
通过在大型语言模型上积累知识来精通图神经网络设计
机构 * Hong Kong University of Science and Technology(香港科学与技术大学) ; Southeast University(东南大学) ; HoHuawei Hong Kong Research Center (HKRC)(华为香港研究中心) ; University of Tsukuba(筑波大学)
专题命中 规划推理 :reasoning(abstract);分类 cs.AI、cs.LG
AI总结 DesiGNN通过在大型语言模型上积累知识,提升图神经网络设计的自动化水平,实现高效精准的模型生成。
Comments Accepted at WSDM 2026. Title changed from "Computation-friendly graph neural network design by accumulating knowledge on large language models" to "Proficient Graph Neural Network Design by Accumulating Knowledge on Large Language Models"
地理空间表示学习:从深度学习到大语言模型时代的一次综述
机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) ; University of Wisconsin-Madison(威斯康星大学麦迪逊分校) ; The University of New South Wales(新南威尔士大学) ; Southwest Jiaotong University(西南交通大学) ; Institute for Infocomm Research (I$^2$R), A*STAR(信息通信研究院(I$^2$R),A*STAR)
专题命中 规划推理 :reasoning(abstract);分类 cs.AI、cs.LG
AI总结 本文综述了从深度学习到大语言模型时代的地理空间表示学习,探讨了其方法、应用及未来发展方向。
聚合物代理:用于聚合物设计的大型语言模型代理
机构 * Department of Materials Science and Engineering, Carnegie Mellon University(材料科学与工程系,卡内基梅隆大学) ; Department of Mechanical Engineering, Carnegie Mellon University(机械工程系,卡内基梅隆大学)
专题命中 规划推理 :reasoning(abstract);分类 cs.CL
AI总结 本文提出基于LLM的聚合物代理,通过结构-性质预测和生成技术,助力实验室研究人员高效发现新型聚合物结构。
超越封闭池视频检索:面向真实世界视频搜索和时刻定位的基准与代理框架
机构 * CASIA ; UCAS ; Tencent(腾讯) ; Peking University(北京大学) ; Tsinghua University(清华大学)
专题命中 规划推理 :reasoning(abstract);分类 cs.LG
AI总结 本文提出RVMS-Bench和RACLO框架,用于评估现实世界中基于模糊记忆的视频检索和时刻定位,揭示现有模型在该任务上的不足。
Comments 49 pages, 9 figures
人类欢迎观察:Agent社会网络Moltbook的首次观察
机构 * CISPA Helmholtz Center for Information Security(CISPA海德堡信息安全研究中心)
专题命中 规划推理 :planning(abstract);分类 cs.AI
AI总结 本文研究了首个专为AI代理设计的社会网络Moltbook,分析其主题讨论、风险分布及毒性演变,揭示了代理社交网络中信息传播的复杂性及平台稳定性挑战。
Comments 16 pages
组织中代理AI转型的实用指南
机构 * Old Dominion University(旧 Dominion 大学) ; Florida International University(佛罗里达国际大学) ; Nanyang Technological University(南洋理工大学) ; University of Colombo(科伦坡大学) ; Center for Wireless Communications, University of Oulu(无线通信中心,奥卢大学) ; University of Sri Jayewardenepura(斯里贾yenepura大学) ; Accenture Technology Labs(埃森哲技术实验室)
专题命中 规划推理 :reasoning(abstract);分类 cs.AI
AI总结 本文提出了一种实用框架,帮助组织将手动流程转型为自动化代理AI系统,通过领域驱动用例识别、任务委托给AI代理及人机协同模型实现可持续的自动化与业务价值对齐。