arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-12-08 至 2025-12-08 共收录 2 信号源:cs.CL, cs.AI, cs.LG

1. 复杂问题求解 2 篇

2510.18526 2025-12-08 cs.AI cs.LG 81%

Counterfactual Reasoning for Steerable Pluralistic Value Alignment of Large Language Models

反事实推理用于可操控的多元价值观对齐大语言模型

Hanze Guo, Jing Yao, Xiao Zhou, Xiaoyuan Yi, Xing Xie

机构 * Renmin University of China(中国人民大学) Microsoft Research Asia(微软亚洲研究院) Engineering Research Center of Next-Generation Intelligent Search and Recommendation, MOE(下一代智能搜索与推荐工程研究中心,教育部)

专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.AI、cs.LG

AI总结 COUPLE通过反事实推理框架实现多元价值观对齐,解决现有方法在处理细粒度价值目标时的依赖性和优先级控制问题。

Comments NeurIPS 2025. 41 pages, 7 figures

Journal ref The Thirty-Ninth Annual Conference on Neural Information Processing Systems. (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03916 2025-12-08 cs.CL cs.AI 62%

Experiments with Large Language Models on Retrieval-Augmented Generation for Closed-Source Simulation Software

在闭源仿真软件上使用检索增强生成进行大型语言模型实验

Andreas Baumann, Peter Eberhard

机构 * Institute of Engineering and Computational Mechanics, University of Stuttgart(工程与计算力学研究所,斯图加特大学)

专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本研究测试了RAG系统在闭源仿真软件Pasimodo中的表现,发现定制信息提供能显著提升响应质量,凸显了改进闭源仿真模型信息检索的重要性。

Comments 16 pages, 6 tables, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏