arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-22 至 2025-12-22 共收录 14 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 14 篇

2512.17559 2025-12-22 cs.AI 90%

Towards Explainable Conversational AI for Early Diagnosis with Large Language Models

迈向具有大语言模型的可解释对话AI用于早期诊断

Maliha Tabassum, M Shamim Kaiser

机构 * Department of Information and Communication Technology(信息与通信技术系) Bangladesh University of Professionals(孟加拉专业大学) Institute of Information Technology(信息技术研究所) Jahangirnagar University(贾汗吉尔纳瓦德大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

AI总结 本研究提出基于大语言模型的可解释对话AI,用于提高早期诊断的透明性和互动性,实验显示其在诊断准确性上优于传统机器学习模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16442 2025-12-22 cs.CV cs.AI 88%

EDVD-LLaMA: Explainable Deepfake Video Detection via Multimodal Large Language Model Reasoning

EDVD-LLaMA: 通过多模态大语言模型推理进行可解释的深度伪造视频检测

Haoran Sun, Chen Cai, Huiping Zhuang, Kong Aik Lee, Lap-Pui Chau, Yi Wang

机构 * Department of Electrical and Electronic Engineering, The Hong Kong Polytechnic University(电子与电气工程系,香港理工大学) School of Electrical and Electronic Engineering, Nanyang Technological University(电子与电气工程学院,南洋理工大学) Shien-Ming Wu School of Intelligent Engineering, South China University of Technology(智能工程学院,华南理工大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 EDVD-LLaMA通过多模态大语言模型推理实现深度伪造视频检测的可解释性,结合时空特征提取和细粒度推理机制,提升检测准确性与解释可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.06813 2025-12-22 cs.AI cs.MA cs.SI 85%

Richelieu: Self-Evolving LLM-Based Agents for AI Diplomacy

Richelieu: 基于大语言模型的自进化AI外交代理

Zhenyu Guan, Xiangyu Kong, Fangwei Zhong, Yizhou Wang

机构 * Institute for Artificial Intelligence(人工智能研究院) Computer School(计算机学院) School of Artificial Intelligence(人工智能学院) Center on Frontiers of Computing Studies(计算前沿研究中心) State Key Laboratory of General Artificial Intelligence(通用人工智能国家重点实验室) Nat’l Eng. Research Center of Visual Technology(视觉技术国家工程研究中心) State Key Lab of General Artificial Intelligence(通用人工智能国家重点实验室) BIGAI

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 Richelieu通过整合战略规划、目标导向谈判和自我进化能力,开发出能执行复杂多代理任务的AI外交代理。

Journal ref NuerIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17062 2025-12-22 cs.RO 85%

Lang2Manip: A Tool for LLM-Based Symbolic-to-Geometric Planning for Manipulation

Lang2Manip: 一种基于LLM的符号到几何规划工具用于操作

Muhayy Ud Din, Jan Rosell, Waseem Akram, Irfan Hussain

机构 * Khalifa University Center for Autonomous Robotic Systems (KUCARS)(卡利法大学自主机器人系统中心) Khalifa University(卡利法大学) Institute of Industrial and Control Engineering (IOC)(工业与控制工程研究所) Universitat Politècnica de Catalunya(加泰罗尼亚理工大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 Lang2Manip通过结合LLM和Kautham框架,实现通用的符号到几何操作规划,适用于多种机器人和任务。

Comments Submitted to ICARA

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.10321 2025-12-22 cs.LG stat.ML 79%

Towards Human-Guided, Data-Centric LLM Co-Pilots

面向人类指导、数据导向的LLM协同助手

Evgeny Saveliev, Jiashuo Liu, Nabeel Seedat, Anders Boyd, Mihaela van der Schaar

机构 * University of Cambridge(剑桥大学) Tsinghua University(清华大学) Amsterdam University Medical Centers(阿姆斯特丹大学医学中心)

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.LG

AI总结 CliMB-DC是一种结合人类指导和数据导向工具的LLM协同助手框架,旨在提升领域专家在复杂数据处理中的能力。

Comments Saveliev, Liu & Seedat contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17060 2025-12-22 cs.MA cs.AI 79%

On the Role of Contextual Information and Ego States in LLM Agent Behavior for Transactional Analysis Dialogues

在交易分析对话中LLM代理行为中情境信息和自我状态的作用

Monika Zamojska, Jarosław A. Chudziak

机构 * Faculty of Electronics and Information Technology(电子与信息技术学院) Warsaw University of Technology(华沙技术大学)

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.AI

AI总结 本文提出了一种受交易分析理论启发的多代理系统,通过整合情境信息检索来增强LLM代理在交易分析对话中的行为真实性。

Comments Presented at the 39th Pacific Asia Conference on Language, Information and Computation (PACLIC 39)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17079 2025-12-22 cs.LG cs.AI 79%

Can Large Reasoning Models Improve Accuracy on Mathematical Tasks Using Flawed Thinking?

大推理模型能否通过错误推理提升数学任务的准确性?

Saraswathy Amjith, Mihika Dusad, Neha Muramalla, Shweta Shah

机构 * MIT(麻省理工学院)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI、cs.LG

AI总结 本研究通过训练模型处理故意错误推理轨迹,提升其在数学任务中的错误恢复能力,同时保持准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17227 2025-12-22 cs.CV 75%

Learning When to Look: A Disentangled Curriculum for Strategic Perception in Multimodal Reasoning

学习何时观察:一种解耦的课程学习框架,用于多模态推理中的战略感知

Siqi Yang, Zilve Gao, Haibo Qiu, Fanfan Liu, Peng Shi, Zhixiong Zeng, Qingmin Liao, Lin Ma

机构 * Meituan(美团) Tsinghua University(清华大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);SFT(abstract)

AI总结 本文提出了一种解耦课程学习框架,通过分阶段训练提升多模态推理中的抽象推理与战略视觉感知能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17532 2025-12-22 cs.CV cs.AI 70%

Robust-R1: Degradation-Aware Reasoning for Robust Visual Understanding

Robust-R1: 为鲁棒视觉理解的退化感知推理

Jiaqi Tang, Jianmin Chen, Wei Wei, Xiaogang Xu, Runtao Liu, Xiangyu Wu, Qipeng Xie, Jiafei Wu, Lei Zhang, Qifeng Chen

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 Robust-R1通过结构化推理链显式建模视觉退化,提升多模态大语言模型在现实世界退化下的鲁棒性与抗干扰能力。

Comments Accepted by AAAI2026 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17260 2025-12-22 cs.CL 70%

Seed-Prover 1.5: Mastering Undergraduate-Level Theorem Proving via Learning from Experience

Seed-Prover 1.5:通过经验学习掌握本科生级定理证明

Jiangjie Chen, Wenxiang Chen, Jiacheng Du, Jinyi Hu, Zhicheng Jiang, Allan Jie, Xiaoran Jin, Xing Jin, Chenggang Li, Wenlei Shi, Zhihong Wang, Mingxuan Wang, Chenrui Wei, Shufa Wei, Huajian Xin, Fan Yang, Weihao Gao, Zheng Yuan, Tianyang Zhan, Zeyu Zheng, Tianxi Zhou, Thomas Hanwen Zhu

机构 * ByteDance(字节跳动)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 Seed-Prover 1.5通过经验学习在形式定理证明中实现高效性能,解决大量本科生及更高难度的数学问题。

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15528 2025-12-22 cs.CV 67%

EmoCaliber: Advancing Reliable Visual Emotion Comprehension via Confidence Verbalization and Calibration

EmoCaliber: 通过置信度 verbalization 和校准推进可靠的视觉情绪理解

Daiqing Wu, Dongbao Yang, Can Ma, Yu Zhou

机构 * IIE, Chinese Academy of Sciences(中国科学院信息研究所) Nankai University(南开大学) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract)

AI总结 EmoCaliber通过置信度 verbalization 和校准提升视觉情绪理解的可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17455 2025-12-22 cs.SE 67%

An Investigation on How AI-Generated Responses Affect SoftwareEngineering Surveys

对AI生成响应如何影响软件工程调查的探究

Ronnie de Souza Santos, Italo Santos, Maria Teresa Baldassarre, Cleyton Magalhaes, Mairieli Wessel

专题命中 推理与问题求解 :large language model(abstract);language model(abstract)

AI总结 本研究探讨AI生成响应对软件工程调查的影响,通过分析发现49份回答存在合成作者身份的模式,强调需结合自动化与解释性验证以提升调查可信度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17206 2025-12-22 cs.CV 67%

Reasoning Palette: Modulating Reasoning via Latent Contextualization for Controllable Exploration for (V)LMs

推理调色板:通过潜在上下文化调节推理以实现可控探索用于(V)LMs

Rujiao Long, Yang Li, Xingyao Zhang, Weixun Wang, Tianqianjin Lin, Xi Zhao, Yuchi Xu, Wenbo Su, Junchi Yan, Bo Zheng

机构 * Alibaba Group(阿里巴巴集团) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学)

专题命中 推理与问题求解 :language model(abstract);SFT(abstract)

AI总结 Reasoning Palette通过引入潜在变量调节模型推理策略,提升可控探索和持续学习能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10501 2025-12-22 cs.AI cs.LG 62%

PASS: Probabilistic Agentic Supernet Sampling for Interpretable and Adaptive Chest X-Ray Reasoning

基于概率代理超网采样的可解释和自适应胸片推理系统

Yushi Feng, Junye Du, Yingying Hong, Qifan Wang, Lequan Yu

专题命中 推理与问题求解 :LLM(abstract);分类 cs.AI、cs.LG

AI总结 PASS通过概率代理超网采样实现可解释、自适应和多模态的胸片推理,提升医疗AI的安全性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏