arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-02-10 至 2026-02-10 共收录 192 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 19 篇

2510.00181 2026-02-10 cs.CR cs.AI cs.LG 62%

CHAI: Command Hijacking against embodied AI

CHAI:针对具身AI的命令劫持

Luis Burbano, Diego Ortiz, Qi Sun, Siwei Yang, Haoqin Tu, Cihang Xie, Yinzhi Cao, Alvaro A Cardenas

机构 * Johns Hopkins University(约翰霍普金斯大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 CHAI是一种针对具身AI的物理环境间接提示注入攻击,通过嵌入误导性自然语言指令,利用多模态语言解释能力,有效提升了攻击性能,凸显了对传统对抗鲁棒性之外的防御需求。

Comments This work has been accepted for publication at the IEEE Conference on Secure and Trustworthy Machine Learning (SaTML). The final version will be available on IEEE Xplore

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08837 2026-02-10 cs.IR cs.LG 57%

AMEM4Rec: Leveraging Cross-User Similarity for Memory Evolution in Agentic LLM Recommenders

AMEM4Rec: 利用跨用户相似性促进记忆演化以实现智能大语言模型推荐系统

Minh-Duc Nguyen, Hai-Dang Kieu, Dung D. Le

机构 * Center for AI Research, VinUniversity(越南 Vin 大学人工智能研究中心) College of Engineering and Computer Science, VinUniversity(越南 Vin 大学工程与计算机科学学院) Computer Science, VinUniversity(越南 Vin 大学计算机科学)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 AMEM4Rec通过跨用户记忆演化学习协作信号,提升智能大语言模型推荐系统的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08818 2026-02-10 cs.LG 57%

FlexMoRE: A Flexible Mixture of Rank-heterogeneous Experts for Efficient Federatedly-trained Large Language Models

FlexMoRE: 一种灵活的秩异质专家混合模型,用于高效联邦训练的大型语言模型

Annemette Brok Pirchert, Jacob Nielsen, Mogens Henrik From, Lukas Galke Poech, Peter Schneider-Kamp

机构 * University of Southern Denmark(南丹麦大学) Ordbogen A/S(Ordbogen公司)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 FlexMoRE通过灵活的秩异质专家混合模型,在联邦训练的大型语言模型中实现更高效的性能,使用低秩适配器替代完整专家,提升任务表现并减少参数量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08400 2026-02-10 cs.AI 57%

SCOUT-RAG: Scalable and Cost-Efficient Unifying Traversal for Agentic Graph-RAG over Distributed Domains

SCOUT-RAG:可扩展且成本效益高的代理图式检索框架用于分布式领域

Longkun Li, Yuanben Zou, Jinghan Wu, Yuqing Wen, Jing Li, Hangwei Qian, Ivor Tsang

机构 * A*STAR

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 SCOUT-RAG是一种分布式代理图式检索框架,通过跨领域检索和增量效用目标提升推理性能,同时降低成本和延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15586 2026-02-10 cs.CL 57%

Bolmo: Byteifying the Next Generation of Language Models

Bolmo:字节化下一代语言模型

Benjamin Minixhofer, Tyler Murray, Tomasz Limisiewicz, Anna Korhonen, Luke Zettlemoyer, Noah A. Smith, Edoardo M. Ponti, Luca Soldaini, Valentin Hofmann

机构 * Allen Institute for AI(艾伦人工智能研究所) University of Cambridge(剑桥大学) University of Washington(华盛顿大学) University of Edinburgh(爱丁堡大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 Bolmo通过两阶段转换将现有子词模型转换为字节级模型,实现性能和细粒度理解的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08048 2026-02-10 cs.CL 57%

TDGNet: Hallucination Detection in Diffusion Language Models via Temporal Dynamic Graphs

TDGNet: 通过时间动态图检测扩散语言模型中的幻觉

Arshia Hemmat, Philip Torr, Yongqiang Chen, Junchi Yu

机构 * Department of Computer Science, University of Oxford(牛津大学计算机科学系) Department of Engineering Science, University of Oxford(牛津大学工程科学系) Carnegie Mellon University(卡内基梅隆大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 TDGNet通过时间动态图框架,利用演进的token级注意力图进行学习,实现对扩散语言模型中幻觉的高效检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23936 2026-02-10 cs.CL 57%

Do Language Models Update their Forecasts with New Information?

语言模型是否会随着新信息更新其预测?

Zhangdie Yuan, Zifeng Ding, Andreas Vlachos

机构 * Department of Computer Science and Technology, University of Cambridge, Cambridge, United Kingdom(计算机科学与技术系,剑桥大学,剑桥,英国)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 研究发现语言模型在接收到新信息时更新预测不一致且保守,需改进机制以更准确整合外部知识。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08263 2026-02-10 cs.SE 50%

Specification Vibing for Automated Program Repair

基于规范的自动化程序修复

Taohong Zhu, Lucas C. Cordeiro, Mustafa A. Mustafa, Youcheng Sun

专题命中 其他推理 :reasoning(abstract)

AI总结 VibeRepair通过行为规范修复替代传统代码编辑,提升自动化程序修复的准确性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08211 2026-02-10 cs.CV 50%

Chain-of-Caption: Training-free improvement of multimodal large language model on referring expression comprehension

Chain-of-Caption: 无需训练提升多模态大语言模型的指称表达理解

Yik Lung Pang, Changjae Oh

机构 * Queen Mary University of London(伦敦女王学院)

专题命中 其他推理 :chain-of-thought(abstract)

AI总结 本文提出无需训练的Chain-of-Caption框架,通过结合多种上下文提升多模态大语言模型在指称表达理解任务中的性能。

Comments 4 pages, 5 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05825 2026-02-10 cs.HC 50%

ToMigo: Interpretable Design Concept Graphs for Aligning Generative AI with Creative Intent

ToMigo:可解释的设计概念图用于对齐生成式AI与创意意图

Lena Hegemann, Xinyi Wen, Michael A. Hedderich, Tarmo Nurmi, Hariharan Subramonyam

专题命中 其他推理 :reasoning(abstract)

AI总结 ToMigo通过设计概念图实现生成式AI与创意意图的对齐,提供可解释的交互方式提升用户控制力。

Comments 18 pages, 10 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23278 2026-02-10 cs.CV 50%

UniLiP: Adapting CLIP for Unified Multimodal Understanding, Generation and Editing

UniLiP: 适配CLIP以实现统一的多模态理解、生成与编辑

Hao Tang, Chenwei Xie, Xiaoyi Bao, Tingyu Weng, Pandeng Li, Yun Zheng, Liwei Wang

机构 * Center for Data Science, Peking University(北京大学数据科学中心) Alibaba Group(阿里巴巴集团) CASIA Center for Machine Learning Research, Peking University(北京大学机器学习研究中心) State Key Laboratory of General Artificial Intelligence, Peking University(北京大学通用人工智能国家重点实验室)

专题命中 其他推理 :reasoning(abstract)

AI总结 UniLIP通过两阶段训练和双条件架构,提升CLIP在多模态理解、生成和编辑任务中的性能,实现高效参数下的高表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07525 2026-02-10 cs.IR 50%

IGMiRAG: Intuition-Guided Retrieval-Augmented Generation with Adaptive Mining of In-Depth Memory

IGMiRAG: 基于直觉引导的检索增强生成与深度记忆适应性挖掘

Xingliang Hou, Yuyan Liu, Qi Sun, haoxiu wang, Hao Hu, Shaoyi Du, Zhiqiang Tian

专题命中 其他推理 :reasoning(abstract)

AI总结 IGMiRAG通过直觉引导的检索增强生成框架,结合超图和演绎路径,提升多粒度知识对齐和深度记忆挖掘,实现更高效有效的生成性能。

Comments 29 pages, Information Retrieval

详情

展开后加载摘要…

URL PDF HTML 收藏