arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-12-15 至 2025-12-15 共收录 8 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 8 篇

2508.11272 2025-12-15 cs.CV cs.AI 85%

Enhancing Supervised Composed Image Retrieval via Reasoning-Augmented Representation Engineering

通过推理增强的表示工程提升监督性复合图像检索

Jun Li, Hongjian Dou, Zhenyu Zhang, Kai Li, Shaoguo Liu, Tingting Gao

机构 * Jun Li(李俊) Hongjian Dou(董宏健) Zhenyu Zhang(张振宇) Kai Li(李凯) Shaoguo Liu(刘少国) Tingting Gao(高婷婷)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI

AI总结 本文提出PMTFR框架,通过推理增强的表示工程提升监督性复合图像检索性能,实验表明其优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11277 2025-12-15 cs.CL cs.LG 81%

When Actions Teach You to Think: Reasoning-Action Synergy via Reinforcement Learning in Conversational Agents

当行动教你思考:通过强化学习在对话代理中实现推理-行动协同

Mrinal Rawat, Arkajyoti Chakraborty, Neha Gupta, Roberto Pieraccini

机构 * Uniphore

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.LG

AI总结 通过强化学习实现对话代理中推理与行动的协同,提升模型推理质量和工具调用精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11099 2025-12-15 cs.CV 78%

VGent: Visual Grounding via Modular Design for Disentangling Reasoning and Prediction

VGent: 通过模块化设计实现视觉 grounding 的解耦推理与预测

Weitai Kang, Jason Kuen, Mengwei Ren, Zijun Wei, Yan Yan, Kangning Liu

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) Adobe(Adobe公司)

专题命中 其他推理 :reasoning(title,abstract)

AI总结 VGent 通过模块化设计实现视觉 grounding 的解耦推理与预测,利用冻结 MLLM 和解码器交叉注意力机制,提升多目标识别性能。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18234 2025-12-15 cs.AI cs.CL cs.LG 67%

The Illusion of Readiness in Health AI

健康AI中的“准备”幻觉

Yu Gu, Jingjing Fu, Xiaodong Liu, Jeya Maria Jose Valanarasu, Noel CF Codella, Reuben Tan, Qianchu Liu, Ying Jin, Sheng Zhang, Jinyu Wang, Rui Wang, Lei Song, Guanghui Qin, Naoto Usuyama, Cliff Wong, Hao Cheng, HoHin Lee, Praneeth Sanapathi, Sarah Hilado, Tristan Naumann, Javier Alvarez-Valle, Jiang Bian, Mu Wei, Khalil Malik, Lidong Zhou, Jianfeng Gao, Eric Horvitz, Matthew P. Lungren, Doug Burger, Eric Topol, Hoifung Poon, Paul Vozila

机构 * Scripps Research Translational Institute(斯克里普斯研究转化研究所)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文通过对抗性压力测试揭示了健康AI在现实应用中的鲁棒性和推理能力不足,强调了对AI系统责任和真实医疗需求的重视。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11282 2025-12-15 cs.CL cs.AI 62%

CIP: A Plug-and-Play Causal Prompting Framework for Mitigating Hallucinations under Long-Context Noise

CIP: 一种用于在长上下文噪声下缓解幻觉的即插即用因果提示框架

Qingsen Ma, Dianyun Wang, Ran Jing, Yujun Sun, Zhenbo Xu

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Northwestern University(西北大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 CIP通过因果推理框架提升大语言模型的可解释性、稳定性和效率,有效缓解长上下文噪声下的幻觉问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11458 2025-12-15 cs.CV cs.AI 57%

Boosting Skeleton-based Zero-Shot Action Recognition with Training-Free Test-Time Adaptation

通过无训练测试时适应提升基于骨架的零样本动作识别

Jingmin Zhu, Anqi Zhu, Hossein Rahmani, Jun Liu, Mohammed Bennamoun, Qiuhong Ke

机构 * Monash University(墨尔本大学) Lancaster University(兰卡斯特大学) University of Western Australia(西澳大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 通过引入Skeleton-Cache框架,利用LLM引导的语义先验实现无训练测试时适应,提升基于骨架的零样本动作识别性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10960 2025-12-15 cs.HC cs.AI 57%

Measuring skill-based uplift from AI in a real biological laboratory

在真实生物实验室中测量AI带来的基于技能的提升

Ethan Obie Romero-Severson, Tara Harvey, Nick Generous, Phillip M. Mach

机构 * Theoretical Biology and Biophysics Group, Los Alamos National Laboratory(理论生物学与生物物理学组,洛斯阿拉莫斯国家实验室) Biochemistry and Biotechnology Group, Los Alamos National Laboratory(生物化学与生物技术组,洛斯阿拉莫斯国家实验室) National Security AI Office, Los Alamos National Laboratory(国家安全人工智能办公室,洛斯阿拉莫斯国家实验室) National Security and Defense Program Office, Los Alamos National Laboratory(国家安全与防卫计划办公室,洛斯阿拉莫斯国家实验室)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本研究通过对比AI推理模型和互联网访问对生物实验室技能提升的影响,探讨AI在生物安全中的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11218 2025-12-15 cs.RO cs.CV 50%

Seeing to Act, Prompting to Specify: A Bayesian Factorization of Vision Language Action Policy

视觉与语言动作政策的贝叶斯分解:看见以行动,提示以指定

Kechun Xu, Zhenjie Zhu, Anzhe Chen, Shuqi Zhao, Qing Huang, Yifei Yang, Haojian Lu, Rong Xiong, Masayoshi Tomizuka, Yue Wang

机构 * Zhejiang University(浙江大学) UC Berkeley(伯克利大学)

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出BayesVLA,通过贝叶斯分解策略,解决VLA模型中因模态不平衡导致的灾难性遗忘问题,提升泛化能力和指令遵循性能。

详情

展开后加载摘要…

URL PDF HTML 收藏