arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-11-25 至 2025-11-25 共收录 21 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 21 篇

2511.14299 2025-11-25 cs.AI cs.CL cs.MA 81%

DataSage: Multi-agent Collaboration for Insight Discovery with External Knowledge Retrieval, Multi-role Debating, and Multi-path Reasoning

DataSage: 基于外部知识检索、多角色辩论和多路径推理的多智能体协作以实现洞察发现

Xiaochuan Liu, Yuanfeng Song, Xiaoming Yin, Xing Chen

机构 * ByteDance, China(字节跳动)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 DataSage通过多智能体协作、外部知识检索和多路径推理,提升数据洞察发现的准确性和深度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22888 2025-11-25 cs.IR 78%

MGFRec: Towards Reinforced Reasoning Recommendation with Multiple Groundings and Feedback

MGFRec: 向多接地与反馈的强化推理推荐迈进

Shihao Cai, Chongming Gao, Haoyan Liu, Wentao Shi, Jianshan Sun, Ruiming Tang, Fuli Feng

专题命中 其他推理 :reasoning(title,abstract)

AI总结 MGFRec通过多轮接地和反馈机制提升推荐系统中推理与实际物品空间的一致性,改进推荐效果。

Comments Accepted at KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19343 2025-11-25 cs.CV 71%

Syn-GRPO: Self-Evolving Data Synthesis for MLLM Perception Reasoning

Syn-GRPO:面向多模态大语言模型感知推理的自进化数据合成

Qihan Huang, Haofei Zhang, Rong Wei, Yi Wang, Rui Tang, Mingli Song, Jie Song

机构 * Zhejiang University(浙江大学) Manycore Tech Inc.(Manycore科技公司)

专题命中 其他推理 :reasoning(title)

AI总结 Syn-GRPO通过自进化数据合成提升多模态大语言模型的感知推理能力,采用数据服务器与GRPO工作流协同生成高质量多样化训练数据,实验验证其在视觉感知任务中的优越性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19417 2025-11-25 cs.CL cs.AI cs.LG 67%

Be My Eyes: Extending Large Language Models to New Modalities Through Multi-Agent Collaboration

Be My Eyes: 通过多智能体协作扩展大型语言模型到新模态

James Y. Huang, Sheng Zhang, Qianchu Liu, Guanghui Qin, Tinghui Zhu, Tristan Naumann, Muhao Chen, Hoifung Poon

机构 * University of Southern California(南加州大学) Microsoft Research(微软研究院) University of California, Davis(加州大学戴维斯分校)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 BeMyEyes通过多智能体协作扩展LLMs到多模态推理,利用高效VLMs与强大LLMs的互补优势,实现轻量级开源解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23229 2025-11-25 cs.CR 67%

Fine-Grained Privacy Extraction from Retrieval-Augmented Generation Systems via Knowledge Asymmetry Exploitation

通过知识不对称利用从检索增强生成系统中进行细粒度隐私提取

Yufei Chen, Yao Wang, Haibin Zhang, Tao Gu

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract)

AI总结 本文提出一种利用知识不对称性从RAG系统中细粒度提取隐私信息的攻击框架,通过自适应提示和神经网络训练实现高隐私提取率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22633 2025-11-25 cs.CL cs.AI cs.CV cs.LG cs.MM 67%

Spatial Knowledge Graph-Guided Multimodal Synthesis

基于空间知识图的多模态合成

Yida Xue, Zhen Bi, Jinnan Yang, Jungang Lou, Kehai Chen, Min Zhang, Huajun Chen, Ningyu Zhang

机构 * Zhejiang University(浙江大学) Nanjing University of Science and Technology(南京理工大学) Huzhou University(湖州大学) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 SKG2DATA通过空间知识图引导多模态合成,提升多模态大语言模型的空间感知与推理能力。

Comments IEEE/ACM Transactions on Audio, Speech and Language Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19149 2025-11-25 cs.CV cs.AI cs.CL 62%

From Pixels to Posts: Retrieval-Augmented Fashion Captioning and Hashtag Generation

从像素到帖子:基于检索的时尚描述与标签生成

Moazzam Umer Gondal, Hamad Ul Qudous, Daniya Siddiqui, Asma Ahmad Farhan

机构 * organization= School of Computing, National University of Computer \& Emerging Sciences (FAST) , city= Lahore , postcode= 54000 , country= Pakistan

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出一种基于检索的时尚描述与标签生成方法,结合多件服装检测、属性推理和大语言模型,提升描述准确性和标签生成的视觉相关性。

Comments Submitted to Expert Systems with Applications

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18643 2025-11-25 cs.LG cs.AI 62%

Kitty: Accurate and Efficient 2-bit KV Cache Quantization with Dynamic Channel-wise Precision Boost

Kitty: 一种准确且高效的2位KV缓存量化方法,结合动态通道精度提升

Haojun Xia, Xiaoxia Wu, Jisen Li, Robert Wu, Junxiong Wang, Jue Wang, Chenxi Li, Aman Singhal, Alay Dilipbhai Shah, Alpay Ariyak, Donglin Zhuang, Zhongzhu Zhou, Ben Athiwaratkun, Zhen Zheng, Shuaiwen Leon Song

专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 Kitty通过混合精度KV缓存的算法-系统协同设计,实现2位量化在保持高精度的同时显著降低内存占用,提升推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17630 2025-11-25 cs.LG cs.AI cs.HC 62%

Can we use LLMs to bootstrap reinforcement learning? -- A case study in digital health behavior change

能否利用大语言模型(LLM)来引导强化学习?——数字健康行为改变的案例研究

Nele Albers, Esra Cemre Su de Groot, Loes Keijsers, Manon H. Hillegers, Emiel Krahmer

专题命中 其他推理 :chain-of-thought(abstract);分类 cs.AI、cs.LG

AI总结 本文探讨了利用大语言模型生成用户交互样本以提升数字健康行为改变的强化学习效果,并通过实验验证了LLM生成样本的实用性与有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18832 2025-11-25 cs.CL 57%

Concept than Document: Context Compression via AMR-based Conceptual Entropy

概念而非文档:基于AMR的概念熵进行上下文压缩

Kaize Shi, Xueyao Sun, Xiaohui Tao, Lin Li, Qika Lin, Guandong Xu

机构 * University of Southern Queensland(南方昆士兰大学) University of Technology Sydney(技术悉尼大学) The Hong Kong Polytechnic University(香港理工大学) Wuhan University of Technology(武汉理工大学) National University of Singapore(新加坡国立大学) The Education University of Hong Kong(香港教育大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出基于AMR的概念熵方法,通过压缩上下文保留核心语义,提升RAG任务的准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06345 2025-11-25 cs.DC cs.AI 57%

PRAGMA: A Profiling-Reasoned Multi-Agent Framework for Automatic Kernel Optimization

PRAGMA:一种基于剖析的多智能体框架用于自动内核优化

Kelun Lei, Hailong Yang, Huaitao Zhang, Xin You, Kaige Zhang, Zhongzhi Luan, Yi Liu, Depei Qian

机构 * School of Computer Science and Engineering(计算机科学与工程学院)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 PRAGMA通过整合执行反馈和硬件剖析,利用AI生成高性能内核,实现比现有方法更优的性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09755 2025-11-25 cs.CE cs.AI 57%

Intelligent Design 4.0: Paradigm Evolution Toward the Agentic AI Era

智能设计4.0:迈向代理AI时代的范式演变

Shuo Jiang, Min Xie, Frank Youhua Chen, Jian Ma, Jianxi Luo

机构 * Department of Systems Engineering(系统工程系) City University of Hong Kong(香港城市大学) Department of Decision Analytics and Operations(决策分析与运营系) Department of Information Systems(信息系统系)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出智能设计4.0范式,基于基础模型的代理AI系统,推动工程设计的自动化与智能化发展。

Comments 17 pages, 7 figures

Journal ref ASME Journal of Computing and Information Science in Engineering, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18397 2025-11-25 cs.AI cs.SE 57%

Natural Emergent Misalignment from Reward Hacking in Production RL

生产强化学习中奖励黑客导致的自然涌现偏差

Monte MacDiarmid, Benjamin Wright, Jonathan Uesato, Joe Benton, Jon Kutasov, Sara Price, Naia Bouscal, Sam Bowman, Trenton Bricken, Alex Cloud, Carson Denison, Johannes Gasteiger, Ryan Greenblatt, Jan Leike, Jack Lindsey, Vlad Mikulik, Ethan Perez, Alex Rodrigues, Drake Thomas, Albert Webson, Daniel Ziegler, Evan Hubinger

机构 * Anthropic

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 研究发现大型语言模型在生产强化学习环境中学习奖励黑客会导致严重偏差,提出三种缓解措施以减少这种偏差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17515 2025-11-25 cs.HC cs.AI 57%

Embedding Generative AI into Systems Analysis and Design Curriculum: Framework, Case Study, and Cross-Campus Empirical Evidence

将生成式人工智能融入系统分析与设计课程:框架、案例研究和跨校园实证证据

Mahmoud Elkhodr, Ergun Gide

机构 * School of Engineering and Technology, Central Queensland University(工程与技术学院,中央昆士兰大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本研究提出SAGE框架,通过将生成式人工智能融入课程设计,培养学生批判性思维和AI编排能力,揭示学生在系统分析中的关键挑战和教育改进方向。

Comments ~12,000 words; 4 figures; 6 tables; multi-site study (across 4 Australian campuses)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14169 2025-11-25 cs.CV cs.AI 57%

AdaTok: Adaptive Token Compression with Object-Aware Representations for Efficient Multimodal LLMs

AdaTok: 一种基于对象感知表示的自适应令牌压缩方法,用于高效多模态大语言模型

Xinliang Zhang, Lei Zhu, Hangzhou He, Shuang Zeng, Ourui Fu, Jiakui Hu, Zhengjian Yao, Yanye Lu

机构 * Institute of Medical Technology, Peking University Health Science Center(北京大学医学部医学技术研究所) Department of Biomedical Engineering, Peking University(北京大学生物医学工程系) National Biomedical Imaging Center, Peking University(北京大学国家生物医学成像中心)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 AdaTok通过自适应令牌压缩方法,利用对象感知表示提升多模态大语言模型的效率,实现高压缩比与高性能的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07334 2025-11-25 cs.CL 57%

Frame Representation Hypothesis: Multi-Token LLM Interpretability and Concept-Guided Text Generation

框架表示假说:多词LLM可解释性与概念引导的文本生成

Pedro H. V. Valois, Lincon S. Souza, Erica K. Shimomoto, Kazuhiro Fukui

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出框架表示假说,通过多词建模提升LLM的可解释性,利用概念引导解码实现更安全透明的文本生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18875 2025-11-25 cs.CV cs.MM 50%

Parallel Vision Token Scheduling for Fast and Accurate Multimodal LMMs Inference

并行视觉令牌调度用于快速准确的多模态大语言模型推理

Wengyi Zhan, Mingbao Lin, Zhihang Lin, Rongrong Ji

机构 * Xiamen University(厦门大学) Rakuten Asia Pte. Ltd.(拉面亚洲有限公司) Xiamen University, China(厦门大学) Shanghai Innovation Institute, China(上海创新研究院)

专题命中 其他推理 :reasoning(abstract)

AI总结 ParVTS通过并行调度视觉令牌,高效减少多模态大语言模型推理的计算复杂度,实现高剪枝率与性能损失小的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18282 2025-11-25 cs.IR 50%

Large Language Model Enhanced Graph Invariant Contrastive Learning for Out-of-Distribution Recommendation

大语言模型增强的图不变对比学习用于分布外推荐

Jiahao Liang, Haoran Yang, Xiangyu Zhao, Zhiwen Yu, Mianjie Li, Chuan Shi, Kaixiang Yang

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出InvGCLLM框架,结合大语言模型与图不变学习,通过因果引导对比学习提升分布外推荐性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17952 2025-11-25 cs.CV 50%

Multi-speaker Attention Alignment for Multimodal Social Interaction

多说话者注意力对齐用于多模态社交互动

Liangyang Ouyang, Yifei Huang, Mingfang Zhang, Caixin Kang, Ryosuke Furuta, Yoichi Sato

机构 * The University of Tokyo(东京大学)

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出了一种多模态多说话者注意力对齐方法,通过动态头选择和自适应注意力偏差提升多模态社交互动理解能力,实现SOTA效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17839 2025-11-25 cs.CV 50%

Show Me: Unifying Instructional Image and Video Generation with Diffusion Models

Show Me: 用扩散模型统一指令图像和视频生成

Yujiang Pu, Zhanbo Huang, Vishnu Boddeti, Yu Kong

机构 * Michigan State University(密歇根州立大学)

专题命中 其他推理 :reasoning(abstract)

AI总结 ShowMe通过统一视频扩散模型的空间和时间组件,提升指令图像和视频生成的性能与一致性。

Comments Accepted by WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2104.12145 2025-11-25 physics.optics 50%

LLM4Laser: Large Language Models Automate the Design of Lasers

LLM4Laser: 利用大语言模型自动化激光器设计

Renjie Li, Ceyao Zhang, Sixuan Mao, Xiyuan Zhou, Feng Yin, Sergios Theodoridis, Zhaoyu Zhang

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出利用大语言模型实现激光器设计自动化,通过对话生成仿真和强化学习代码,实现从概念到算法的全流程自动化设计。

Comments 14 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏