Representing and Reasoning With Probabilistic Knowledge: A Bayesian Approach
专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI
Comments Appears in Proceedings of the Ninth Conference on Uncertainty in Artificial Intelligence (UAI1993)
AI 大模型
大模型数学、逻辑、规划、多步推理和测试时计算能力。
专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI
Comments Appears in Proceedings of the Ninth Conference on Uncertainty in Artificial Intelligence (UAI1993)
专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI
Comments arXiv admin note: substantial text overlap with arXiv:1211.5643
专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI
Journal ref Expert Systems with Applications 38, 5 (2011) 5145-5153
专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL
Comments To appear in Proc. of ACL-94. 8 pages, uuencoded compressed Postscript file; extract with Unix uudecode and uncompress. Contact Author for latex version
当AI代理像人类一样产生分歧:用于人机协作 moderation 的推理轨迹分析
专题命中 其他推理 :reasoning(title,abstract)
AI总结 本文研究AI代理在仇恨言论 moderation 中的分歧模式,通过推理轨迹分析发现分歧结构比幅度更能预测人类判断需求,提出从共识寻求转向不确定性揭示的多代理设计。
Comments Accepted to the ICLR 2026 Workshop on "From Human Cognition to AI Reasoning: Models, Methods, and Applications (HCAIR)
并非所有token都平等:面向智能体大语言模型系统的感知通胀路由
机构 * Stony Brook University(石溪大学) ; Wuhan University(武汉大学) ; Shanghai Jiao Tong University(上海交通大学)
专题命中 其他推理 :CoT(abstract,abstract_cn);reasoning(abstract);分类 cs.CL、cs.AI
AI总结 针对智能体LLM系统的token通胀问题,提出四阶段路由框架InflationAgent,通过测量通胀、引入CBE信号、最大化SER并采用新鲜升级策略,在GSM8K上优于FrugalGPT。
评估基于大语言模型的目标提取在需求工程中的应用:提示策略及其局限性
机构 * Department of Control and Computer Engineering(控制与计算机工程系)
专题命中 其他推理 :CoT(abstract,abstract_cn);chain-of-thought(abstract);分类 cs.CL、cs.AI
AI总结 本文探讨了通过三个阶段自动提取功能目标以实现目标导向的需求工程,提出基于工程提示的LLM链,实验表明反馈循环机制在零样本学习中表现更优,但提示策略仍是性能限制因素。
Comments 11 pages, 1 figure. This contribution will be published in the conference proceedings of EASE 2026 Conference (https://conf.researchr.org/home/ease-2026/prompt-se-2026)
OneReason 技术报告
机构 * OneRec Team(OneRec团队)
专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
AI总结 针对生成式推荐模型中推理能力难以激活的问题,提出 OneReason 方法,通过增强感知和认知能力实现有效推理。
Comments Work in progress
TOOLCAD: 探索用于文本到CAD生成的工具使用大型语言模型与强化学习
机构 * School of Computer Engineering & Science, Shanghai University(上海大学计算机工程与科学学院)
专题命中 其他推理 :CoT(abstract,abstract_cn);reasoning(abstract);分类 cs.CL、cs.AI
AI总结 本文提出TOOLCAD框架,利用LLM作为工具使用代理进行文本到CAD生成,并通过交互式CAD建模环境和强化学习提升模型性能。
Comments ACL2026
从优化角度纠正大语言模型的思维
机构 * Monash University(莫纳什大学) ; Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
AI总结 本文通过优化视角分析LLM推理过程,提出RePro方法改进推理性能,减少过度思考等亚优行为。
Comments Accepted by ICLR 2026
发现并重新激活已训练大语言模型的隐藏安全机制
机构 * Cranberry-Lemon University(蔓越莓柠檬大学)
专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
AI总结 本文研究了大语言模型在后训练过程中安全机制的退化原因,提出SafeReAct方法通过LoRA适配器恢复被抑制的安全行为,提升模型在有害提示下的安全性而不影响推理性能。
通过提示知识微调去偏大型语言模型在在线行为分析中的社会因素
机构 * George Mason University(乔治梅森大学)
专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
AI总结 本文研究了在社交情境中通过引入用户目标推断 dispositional 因果性和消息上下文推断 situational 因果性对 LLM 性能的影响,提出了一种通过增强指令提示来减少社会归因偏见的方法,提升零样本分类任务的性能。
Comments This is a preprint of the accepted paper for publication in IEEE Transactions on Computational Social Systems
为大型语言模型进行知识蒸馏
专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
AI总结 本文提出一种高效的压缩框架,结合引导的思维链强化学习,通过知识蒸馏和链式思维提示提升模型效率,实现更小规模的模型部署。
Comments Code and data are available at: https://github.com/AlejandroParedesLT/knowledge_distillLLM
GTPO和GRPO-S:基于策略熵的token和序列级奖励塑造
机构 * Northeastern University(东北大学)
专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
AI总结 本文提出GTPO和GRPO-S两种算法,通过引入熵权机制实现token和序列级的细粒度奖励塑造,提升大型语言模型在长链推理任务中的稳定性与性能。
SofT-GRPO:通过Gumbel-重新参数化软思考策略优化超越离散标记LLM强化学习
机构 * School of Computing, National University of Singapore, Singapore(新加坡国立大学计算机学院) ; Department of Statistics, University of Oxford, United Kingdom(英国牛津大学统计系) ; School of Intelligence Science(智能科学学院) ; Technology, Nanjing University, China(技术学院,南京大学,中国)
专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI、cs.LG
AI总结 SofT-GRPO通过引入Gumbel噪声和重新参数化技巧,在软思考模式下提升LLM推理性能,使其在Pass@1和Pass@32任务中分别优于离散标记GRPO。
机构 * Department of Psychiatry University of Toronto(精神病学系多伦多大学)
专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
Comments 4 pages,2 figures,EITCE 2025
专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
机构 * Department of Computer Systems Technical University of Madrid(计算机系统系马德里技术大学)
专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
Comments NAACL 2025 (Findings)
专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.LG
专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
Comments Accepted to EMNLP 2024 Findings. 9 pages, 4 figures, 7 tables
专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
Journal ref KBC-LM workshop@ ISWC 2023
专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
Comments 5 pages, 2 figures, 2 tables
留意沙发!通过弱到强任务向量注入激发多模态大语言模型在室内设计中的推理能力
专题命中 其他推理 :reasoning(title,abstract)
AI总结 针对MLLMs在室内设计中因模态对齐问题产生的空间碰撞与审美不和谐,本文提出DART-I机制,通过弱到强任务向量注入引导MLLMs推理,无需微调即可实现精确推理,且经实验验证有效。
识别条件推理:一种用于细粒度微动作理解的无训练多模态大语言模型流水线
机构 * Wuhan University(武汉大学)
专题命中 其他推理 :reasoning(title,abstract)
AI总结 该研究提出一种无训练的多模态大语言模型流水线,动态分配子任务至适配的模型,在2026年MAC微动作挑战赛MA-Bench赛道的开放式任务上获显著性能优势,取得第一名。
Comments Accept at ACM Multimedia 2026
聚焦推理:面向视觉语言模型的有状态、基于动作的视觉聚焦
机构 * AI Center -- Mountain View, Samsung Electronics(三星电子山景城人工智能中心)
专题命中 其他推理 :reasoning(title,abstract)
AI总结 本文提出Foveated Reasoner,通过整合聚焦与推理机制,提升视觉语言模型在高分辨率图像下的效率与准确性,实验证明其在多种基准测试中表现优异。
Comments ECCV 2026