arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 5878 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 5878 篇

2603.08221 2026-03-10 cs.CR cs.AI 57%

SplitAgent: A Privacy-Preserving Distributed Architecture for Enterprise-Cloud Agent Collaboration

SplitAgent: 一种隐私保护的企业-云代理协作分布式架构

Jianshu She

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 SplitAgent通过语境感知的动态去敏化技术,实现企业与云代理间的隐私保护协作,提升任务准确率并减少隐私泄露。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07896 2026-03-10 cs.CL 57%

ACE: Attribution-Controlled Knowledge Editing for Multi-hop Factual Recall

ACE:基于多跳事实回忆的归因控制知识编辑

Jiayu Yang, Yuxuan Fan, Songning Lai, Shengen Wu, Jiaqi Tang, Chun Kang, Zhijiang Guo, Yutao Yue

机构 * HKUST(GZ) Deep Interdisciplinary Intelligence Lab(香港科技大学(广州)深 interdisciplinary 智能实验室) BUAA(北京航空航天大学) HKUST(GZ) Institute of Deep Perception Technology, JITRI Deep Interdisciplinary Intelligence Lab(香港科技大学(广州)深度感知技术研究所,JITRI 深 interdisciplinary 智能实验室)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 ACE通过神经元归因控制实现多跳事实回忆中的知识编辑,提升KE性能。

Comments Accepted by ICLR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08082 2026-03-10 cs.LG 57%

Tiny Autoregressive Recursive Models

微型自回归递归模型

Paulius Rauba, Claudio Fanconi, Mihaela van der Schaar

机构 * University of Cambridge(剑桥大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出自回归TRM,评估其在小型自回归任务上的表现,发现两步细化基线表现强劲,但完整架构未见显著性能提升。

Journal ref ICLR 2026 Workshop RSI Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08048 2026-03-10 cs.AI 57%

S2S-FDD: Bridging Industrial Time Series and Natural Language for Explainable Zero-shot Fault Diagnosis

S2S-FDD:连接工业时间序列与自然语言用于可解释的零样本故障诊断

Baoxue Li, Chunhui Zhao

机构 * 1. State Key Laboratory of Industrial Control Technology, College of Control Science Engineering Zhejiang University Hangzhou, China Engineering Zhejiang University 2. School of Information Electrical Engineering, Zhejiang University City College Hangzhou, China

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 S2S-FDD通过将高维传感器信号转换为自然语言摘要,并结合树状结构诊断方法,实现可解释的零样本故障诊断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07940 2026-03-10 hep-ex cs.AI 57%

AI Agents, Language, Deep Learning and the Next Revolution in Science

人工智能代理、语言、深度学习与科学的下一次革命

Ke Li, Beijiang Liu, Bruce Mellado, Changzheng Yuan, Zhengde Zhang

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出基于深度学习的智能代理作为科学方法的下一次进化,通过多代理推理框架在粒子物理中实现科学发现的扩展与知识生产的革新。

Comments This perspective paper is accepted by Frontier of Physics

Journal ref Front. Phys., 2026, 21(9): 096401

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07590 2026-03-10 cs.CV cs.LG 57%

Models as Lego Builders: Assembling Malice from Benign Blocks via Semantic Blueprints

模型作为乐高积木:通过语义蓝图从良性积木中组装恶意内容

Chenxi Li, Xianggan Liu, Dake Shen, Yaosong Du, Zhibo Yao, Hao Jiang, Linyi Jiang, Chengwei Cao, Jingzhe Zhang, RanYi Peng, Peiling Bai, Xiande Huang

机构 * DAIL Tech(DAIL科技) NLP & KG Lab, Huazhong University of Science and Technology(自然语言处理与知识图谱实验室,华中科技大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出StructAttack,通过语义蓝图将看似无害的槽类型组合成恶意内容,揭示LVLMs在视觉模态整合中的安全漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07581 2026-03-10 cs.SE cs.CL 57%

KCoEvo: A Knowledge Graph Augmented Framework for Evolutionary Code Generation

KCoEvo: 一种增强知识图谱的进化代码生成框架

Jiazhen Kang, Yuchen Lu, Chen Jiang, Jinrui Liu, Tianhao Zhang, Bo Jiang, Ningyuan Sun, Tongtong Wu, Guilin Qi

机构 * Southeast University(东南大学) Monash University(墨尔本大学) ByteDance Ltd.(字节跳动有限公司)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 KCoEvo通过增强知识图谱的方法提升代码迁移的准确性与可控性

Comments Accepted to the DASFAA 2026 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19747 2026-03-10 cs.CL cs.AR 57%

HaLoRA: Hardware-aware Low-Rank Adaptation for Large Language Models Based on Hybrid Compute-in-Memory Architecture

HaLoRA: 基于混合计算-内存架构的硬件感知低秩适应法用于大型语言模型

Taiqiang Wu, Chenchen Ding, Wenyong Zhou, Yuxin Cheng, Xincheng Feng, Shuqi Wang, Wendong Xu, Chufan Shi, Zhengwu Liu, Ngai Wong

机构 * The University of Hong Kong(香港大学) Tsinghua University(清华大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 HaLoRA通过在混合计算-内存架构中部署低秩适应,利用RRAM和SRAM实现高效能和高精度的LLM微调。

Comments 22 pages, Accepted by TODAES (ACM Transactions on Design Automation of Electronic Systems)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07202 2026-03-10 cs.CL 57%

Lying to Win: Assessing LLM Deception through Human-AI Games and Parallel-World Probing

谎言以赢:通过人机游戏和平行世界探测评估LLM欺骗

Arash Marioriyad, Ali Nouri, Mohammad Hossein Rohban, Mahdieh Soleymani Baghshah

机构 * Sharif University of Technology(谢里夫技术大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本研究通过人机游戏和平行世界探测评估LLM欺骗行为,发现存在性框架显著增加Qwen和Gemini的欺骗率,凸显需新的行为审计方法。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07116 2026-03-10 cs.CR cs.AI 57%

aCAPTCHA: Verifying That an Entity Is a Capable Agent via Asymmetric Hardness

aCAPTCHA:通过非对称难度验证实体是否为有能力的代理

Zuyao Xu, Xiang Li, Fubin Wu, Yuqi Qiu, Lu Sun, FaSheng Miao

机构 * Nankai University(南开大学) Tsinghua University(清华大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 aCAPTCHA通过非对称难度验证机制,为需要实体类型验证的服务提供一个无需基础设施的准入解决方案。

Comments 17 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07048 2026-03-10 cs.CV cs.AI 57%

Looking Back and Forth: Cross-Image Attention Calibration and Attentive Preference Learning for Multi-Image Hallucination Mitigation

回望与前行:用于多图像幻觉缓解的跨图像注意力校准与关注偏好学习

Xiaochen Yang, Hao Fang, Jiawei Kong, Yaoxin Mao, Bin Chen, Shu-Tao Xia

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Harbin Institute of Technology(哈尔滨工业大学) Beijing Institute of Technology(北京理工大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳分校)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出CAPL框架,通过跨图像注意力校准和偏好学习缓解多图像幻觉问题,提升模型对跨图像关联的建模能力,并在多个任务中取得稳定性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06902 2026-03-10 cs.AI 57%

Empowering Locally Deployable Medical Agent via State Enhanced Logical Skills for FHIR-based Clinical Tasks

通过增强状态的逻辑技能赋能本地可部署的医疗代理以用于基于FHIR的临床任务

Wanrong Yang, Zhengliang Liu, Yuan Li, Bingjie Yan, Lingfang Li, Mingguang He, Dominik Wojtczak, Yalin Zheng, Danli Shi

机构 * Department of Computer Science, University of Liverpool(利物浦大学计算机科学系) The Hong Kong Polytechnic University(香港理工大学) Beijing Normal University(北京师范大学) School of Computing, University of Georgia(佐治亚大学计算机学院) Department of Eye and Vision, University of Liverpool(利物浦大学眼科学与视觉系)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出SELSM框架,通过增强状态的逻辑技能提升本地医疗代理在FHIR临床任务中的零样本能力,实现100%任务完成率和22.67%的成功率提升。

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06801 2026-03-10 cs.AI 57%

Breaking the Martingale Curse: Multi-Agent Debate via Asymmetric Cognitive Potential Energy

突破马尔可夫诅咒:基于非对称认知潜能的多智能体辩论

Yuhan Liu, Juntian Zhang, Yichen Wu, Martin Takac, Salem Lahlou, Xiuying Chen, Nils Lukas

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫扎德·本·扎耶德人工智能大学) Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学国际关系学院) Harvard University(哈佛大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 AceMAD通过非对称认知潜能打破马尔可夫诅咒,提升多智能体辩论的真理收敛能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06002 2026-03-09 cs.CV cs.AI 57%

Demystifying KAN for Vision Tasks: The RepKAN Approach

揭开KAN在视觉任务中的神秘面纱:RepKAN方法

Minjong Cheon

机构 * Sejong University(世宗大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 RepKAN通过结合CNN和KAN的优势,实现遥感图像分类的可解释性提升,优于现有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05778 2026-03-09 cs.CL 57%

Tutor Move Taxonomy: A Theory-Aligned Framework for Analyzing Instructional Moves in Tutoring

辅导动作分类:一种与理论一致的框架,用于分析辅导中的教学动作

Zhuqian Zhou, Kirk Vanacore, Tamisha Thompson, Jennifer St John, Rene Kizilcec

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出了一种辅导动作分类法,用于系统分析辅导中的教学动作,通过混合演绎归纳方法构建分类框架,涵盖四个类别并支持AI标注和学习成果分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13082 2026-03-09 cs.AI 57%

Discerning What Matters: A Multi-Dimensional Assessment of Moral Competence in LLMs

辨别重要之物:对大语言模型道德能力的多维评估

Daniel Kilov, Caroline Hendy, Secil Yanik Guyot, Aaron J. Snoswell, Seth Lazar

机构 * Machine Intelligence and Normative Theory Lab, Australian National University, Acton, ACT 2601, Australia(澳大利亚国立大学机器智能与规范理论实验室) Digital Media Research Centre GenAI Lab, Queensland University of Technology, Kelvin Grove, QLD 4012, Australia(昆士兰科技大学数字媒体研究中心GenAI实验室)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出了一种多维评估方法,用于评估大语言模型的道德能力,发现现有评估方法存在不足,通过实验揭示LLMs在特定情境下的表现差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05225 2026-03-06 cs.AI cs.AR 57%

AI+HW 2035: Shaping the Next Decade

AI+HW 2035:塑造下一十年

Deming Chen, Jason Cong, Azalia Mirhoseini, Christos Kozyrakis, Subhasish Mitra, Jinjun Xiong, Cliff Young, Anima Anandkumar, Michael Littman, Aron Kirschen, Sophia Shao, Serge Leef, Naresh Shanbhag, Dejan Milojicic, Michael Schulte, Gert Cauwenberghs, Jerry M. Chow, Tri Dao, Kailash Gopalakrishnan, Richard Ho, Hoshik Kim, Kunle Olukotun, David Z. Pan, Mark Ren, Dan Roth, Aarti Singh, Yizhou Sun, Yusu Wang, Yann LeCun, Ruchir Puri

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出了一项为期十年的AI+HW协同设计路线图,旨在通过提升能效、系统集成和跨层优化,实现AI训练和推理的1000倍效率提升,并推动能源感知的自优化系统发展。

Comments 35 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18929 2026-03-06 cs.IR cs.AI 57%

Give Users the Wheel: Towards Promptable Recommendation Paradigm

让用户掌控方向:迈向可提示的推荐范式

Fuyuan Lyu, Chenglin Luo, Qiyuan Zhang, Yupeng Hou, Haolun Wu, Xing Tang, Xue Liu, Jin L. C. Guo, Xiuqiang He

机构 * McGill \& Mila - Quebec AI Institute Montreal Canada Shenzhen Technological University Shenzhen China University of California San Diego San Diego US McGill University Montreal Canada McGill \& Mila - Quebec AI Institute Shenzhen Technological University University of California San Diego McGill University

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出DPR模型,通过解耦的可提示顺序推荐框架,使传统推荐模型能够动态利用自然语言提示优化检索过程,提升推荐效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04416 2026-03-06 cs.CL 57%

Optimizing What We Trust: Reliability-Guided QUBO Selection of Multi-Agent Weak Framing Signals for Arabic Sentiment Prediction

优化我们信任的内容:基于可靠性引导的多智能体弱标注信号QUBO选择用于阿拉伯语情感预测

Rabab Alkhalifa

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出一种基于可靠性的弱监督框架,通过QUBO选择优化多智能体弱标注信号,提升阿拉伯语情感预测的可靠性与结构迁移能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04244 2026-03-05 cs.SE cs.AI cs.HC 57%

FeedAIde: Guiding App Users to Submit Rich Feedback Reports by Asking Context-Aware Follow-Up Questions

FeedAIde: 通过提问情境感知的后续问题引导应用用户提交丰富的反馈报告

Ali Ebrahimi Pourasad, Meyssam Saghiri, Walid Maalej

机构 * University of Hamburg(汉堡大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 FeedAIde通过情境感知和生成式AI技术,帮助用户更高效地提交详细反馈报告,提升开发人员获取信息的价值。

Comments Accepted for publication at the 13th International Conference on Mobile Software Engineering and Systems (MOBILESoft) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03872 2026-03-05 cs.LG 57%

Believe Your Model: Distribution-Guided Confidence Calibration

相信你的模型:分布引导的置信度校准

Xizhong Yang, Haotian Zhang, Huiming Wang, Mofei Song

机构 * Southeast University(东南大学) Kuaishou Technology(快手科技)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出DistriVoting和SelfStepConf,通过结合分布先验和动态调整推理过程,提升模型在答案选择中的可靠性与准确性。

Comments 38 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25541 2026-03-05 cs.CV cs.AI 57%

Vision-Zero: Scalable VLM Self-Improvement via Strategic Gamified Self-Play

Vision-Zero: 通过战略化游戏化自play实现可扩展的VLM自改进

Qinsi Wang, Bo Liu, Tianyi Zhou, Jing Shi, Yueqian Lin, Yiran Chen, Hai Helen Li, Kun Wan, Wentian Zhao

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 Vision-Zero通过战略化游戏化自play框架,实现无标注数据下的多模态模型自改进,提升推理与跨领域任务性能。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03074 2026-03-04 cs.HC cs.AI 57%

Design Generative AI for Practitioners: Exploring Interaction Approaches Aligned with Creative Practice

为实践者设计生成式AI:探索与创意实践对齐的交互方法

Xiaohan Peng, Wendy E. Mackay, Janin Koch

机构 * LISN Université Paris-Saclay, CNRS, Inria(LISN 巴黎-萨克雷大学,法国国家科学研究中心,法国国家信息与自动化技术研究所) UMR 9189 CRIStAL Univ. Lille, Inria, CNRS, Centrale Lille(UMR 9189 CRIStAL 利摩日大学,法国国家信息与自动化技术研究所,法国国家科学研究中心,利摩日中央理工大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出三种交互方法,帮助设计师在不同阶段引导生成式AI与创意实践对齐,强调动态协商与主动/被动角色的适应性。

Comments Accepted to ACM CHI 2026 Workshop on Bidirectional Human-AI Alignment

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09710 2026-03-04 cs.AI 57%

Echoing: Identity Failures when LLM Agents Talk to Each Other

回声:当大语言模型代理相互交谈时的身份失败

Sarath Shekkizhar, Romain Cosentino, Adam Earle, Silvio Savarese

机构 * Salesforce AI Research(Salesforce AI研究)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 研究发现LLM代理在相互对话中出现身份失败现象,即回声,通过实验表明回声率高达70%,并提出结构化响应作为缓解措施。

Comments Published at ICLR workshop. Related blog post: https://www.salesforce.com/blog/agent-to-agent-interaction/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04949 2026-03-04 cs.IR cs.AI 57%

Leverage Knowledge Graph and Large Language Model for Law Article Recommendation: A Case Study of Chinese Criminal Law

利用知识图谱和大语言模型进行法律文书推荐:中国刑法案例研究

Yongming Chen, Miner Chen, Ye Zhu, Juan Pei, Siyu Chen, Yu Zhou, Yi Wang, Yifan Zhou, Hao Li, Songan Zhang

机构 * Global Institute of Future Technology, Shanghai Jiao Tong University(未来技术全球研究院,上海交通大学) Donghua University(东华大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出结合知识图谱和大语言模型的法律文书推荐方法,通过构建案例增强的知识图谱和闭环框架,提升了推荐准确性,优于现有基线方法。

Comments Paper has been accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02701 2026-03-04 cs.CL 57%

Graph-GRPO: Stabilizing Multi-Agent Topology Learning via Group Relative Policy Optimization

图GRPO:通过群体相对策略优化稳定多智能体拓扑学习

Yueyang Cang, Xiaoteng Zhang, Erlu Zhao, Zehua Ji, Yuhang Liu, Yuchen He, Zhiyuan Ning, Chen Yijun, Wenge Que, Li Shi

机构 * Tsinghua University(清华大学) Donghua University(东华大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 图GRPO通过群体相对策略优化稳定多智能体拓扑学习,提升训练稳定性并识别关键通信路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02146 2026-03-03 cs.CL 57%

LongRLVR: Long-Context Reinforcement Learning Requires Verifiable Context Rewards

长上下文强化学习需要可验证的上下文奖励

Guanzheng Chen, Michael Qizhe Shieh, Lidong Bing

机构 * National University of Singapore(国立新加坡大学) MiroMind AI absolute AI

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 LongRLVR通过引入可验证的上下文奖励,解决长上下文强化学习中因稀疏奖励导致的梯度消失问题,显著提升大语言模型的推理能力。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01947 2026-03-03 cs.CV cs.AI 57%

physfusion: A Transformer-based Dual-Stream Radar and Vision Fusion Framework for Open Water Surface Object Detection

physfusion: 一种基于Transformer的双流雷达与视觉融合框架用于开放水域表面目标检测

Yuting Wan, Liguo Sun, Jiuwu Hao, Zao Zhang, Pin LV

机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 PhysFusion通过物理引导雷达编码器和Transformer融合模块,实现开放水域表面目标的高效检测,取得高精度检测结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01783 2026-03-03 cs.AI 57%

GAM-RAG: Gain-Adaptive Memory for Evolving Retrieval in Retrieval-Augmented Generation

GAM-RAG:基于增益的记忆用于演化检索的检索增强生成

Yifan Wang, Mingxuan Jiang, Zhihao Sun, Yixin Cao, Yicun Liu, Keyang Chen, Guangnan Ye, Hongfeng Chai

机构 * Fudan University(复旦大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 GAM-RAG通过动态更新检索记忆提升检索增强生成的性能,减少计算成本,提高推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01135 2026-03-03 cs.AI 57%

FCN-LLM: Empower LLM for Brain Functional Connectivity Network Understanding via Graph-level Multi-task Instruction Tuning

FCN-LLM: 通过图级多任务指令微调赋能LLM理解脑功能连接网络

Xingcan Hu, Wei Wang, Li Xiao

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 FCN-LLM通过图级多任务指令微调使LLM理解脑功能连接网络,提升其在临床任务中的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏