arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-22 至 2025-12-22 共收录 117 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 12 篇

2506.22376 2025-12-22 cs.LG cs.AI cs.CL 75%

OptScale: Probabilistic Optimality for Inference-time Scaling

OptScale: 推断时间缩放的概率最优性

Youkang Wang, Jian Wang, Rubing Chen, Xiao-Yong Wei

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 OptScale通过概率框架和动态样本决策,提升LLMs推理性能并减少采样开销。

Comments Accepted by AAAI-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17250 2025-12-22 cs.AI 74%

Accelerating Multi-modal LLM Gaming Performance via Input Prediction and Mishit Correction

通过输入预测和误位修正加速多模态大语言模型游戏性能

Ziyang Lin, Zixuan Sun, Sanhorn Chen, Xiaoyang Chen, Roy Zhao

专题命中 效率与部署 :LLM(title);分类 cs.AI

AI总结 通过输入预测和误位修正方法,显著降低多模态大语言模型游戏性能的推理延迟,提升整体控制效果。

Comments UIUC 25 Fall CS 498

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10892 2025-12-22 cs.LG cs.AI cs.CL 67%

The Diffusion Duality

扩散对偶性

Subham Sekhar Sahoo, Justin Deschenaux, Aaron Gokaslan, Guanghan Wang, Justin Chiu, Volodymyr Kuleshov

机构 * School of Computer and Communication Sciences, EPFL(计算机与通信科学学院,瑞士洛桑联邦理工学院)

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 Duo通过结合高斯扩散技术提升训练和采样效率,实现离散扩散模型在文本生成中的性能突破。

Comments ICML 2025. We provide the code at: https://github.com/s-sahoo/duo [v3] includes improved theory, clearer presentation, and a new future work section

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17108 2025-12-22 cs.LG cs.MM 57%

Atom: Efficient On-Device Video-Language Pipelines Through Modular Reuse

Atom:通过模块化重用实现高效的设备端视频-语言流水线

Kunjal Panchal, Saayan Mitra, Somdeb Sarkhel, Haoliang Wang, Ishita Dasgupta, Gang Wu, Hui Guan

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 Atom通过模块化重用提升设备端视频-语言流水线效率,实现27-33%的执行速度提升,同时保持性能稳定。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17228 2025-12-22 cs.HC 50%

LUMIA: A Handheld Vision-to-Music System for Real-Time, Embodied Composition

LUMIA: 一种用于实时具身创作的手持视觉到音乐系统

Chung-Ta Huang, Connie Cheng, Vealy Lai

专题命中 效率与部署 :language model(abstract)

AI总结 LUMIA通过视觉到音乐的实时具身创作系统,将环境互动与生成式AI结合,实现基于感知的即兴音乐创作。

Comments 6 pages, 15 pages with appendix, NeurIPS 2025 Creative AI track

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 领域大模型 9 篇

2511.12817 2025-12-22 cs.LG 85%

Assessing Automated Fact-Checking for Medical LLM Responses with Knowledge Graphs

利用知识图谱评估医疗大语言模型响应的自动事实核查

Shasha Zhou, Mingyu Huang, Jack Cole, Charles Britton, Ming Yin, Jan Wolber, Ke Li

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出FAITH框架,利用医学知识图谱评估医疗大语言模型响应的事实性,证明其在医疗领域具有较高的可靠性与实用性。

Comments Accepted as a conference paper at AAAI'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17913 2025-12-22 cs.MA cs.AI cs.CY 85%

TACLA: An LLM-Based Multi-Agent Tool for Transactional Analysis Training in Education

TACLA: 基于LLM的多智能体工具用于教育中的交易分析训练

Monika Zamojska, Jarosław A. Chudziak

机构 * Faculty of Electronics and Information Technology(电子与信息技术学院)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 TACLA是一种基于LLM的多智能体工具,通过整合交易分析原理,实现教育场景中真实的情感状态转变和冲突模拟,提升AI在教育中的应用效果。

Comments Accepted for publication in the proceedings of ICTAI 2025

Journal ref IEEE 37th International Conference on Tools with Artificial Intelligence (ICTAI), Athens, Greece, 2025, pp. 313-320

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17121 2025-12-22 cs.LG 79%

The Effect of Negation on CLIP in Medical Imaging: Limitations of Contrastive Language-Image Pretraining

否定对CLIP在医学影像中的影响:对比语言-图像预训练的局限性

Jasmine Vu, Shivanand Sheshappanavar

机构 * Santa Clara University(圣克拉拉大学) University of Wyoming(怀俄明大学)

专题命中 领域大模型 :pretraining(title);language model(abstract);分类 cs.LG

AI总结 研究探讨CLIP在医学影像中处理否定短语的局限性,并通过调优方法提升其检索准确性与可靠性。

Comments 10 pages, 7 figures, submitted to WACV Pixels to Patients Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12146 2025-12-22 cs.CV cs.AI 79%

Multi Anatomy X-Ray Foundation Model

多解剖X光基础模型

Nishank Singla, Krisztian Koos, Farzin Haddadpour, Amin Honarmandi Shandiz, Lovish Chum, Xiaojian Xu, Qing Jin, Erhan Bas

机构 * GE HealthCare(通用电气医疗)

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.AI

AI总结 XR-0通过自监督学习在多解剖X光数据上训练,实现了在多种临床任务中的高性能表现,展示了解剖多样性对构建通用医学视觉模型的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21540 2025-12-22 cs.HC 78%

Designing an LLM-Based Behavioral Activation Chatbot for Young People with Depression: Insights from an Evaluation with Artificial Users and Clinical Experts

设计一个基于LLM的行为激活聊天机器人以帮助有抑郁症的青少年:基于人工用户和临床专家评估的见解

Florian Onur Kuhlmeier, Leon Hanschmann, Melina Rabe, Stefan Luettke, Eva-Lotta Brakemeier, Alexander Maedche

专题命中 领域大模型 :LLM(title,abstract)

AI总结 本文设计了一个基于LLM的行为激活聊天机器人,通过人工用户和临床专家评估,验证了其在抑郁症干预中的保真度和安全性,同时指出临床推理能力仍需改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17838 2025-12-22 cs.CV 75%

ReX-MLE: The Autonomous Agent Benchmark for Medical Imaging Challenges

ReX-MLE:医疗影像挑战的自主代理基准

Roshan Kenia, Xiaoman Zhang, Pranav Rajpurkar

机构 * Harvard Medical School(哈佛医学院) Department of Biomedical Informatics(生物医学信息学系)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 ReX-MLE是一个针对医学影像挑战的自主代理基准,通过评估端到端工作流程,揭示了现有代理在领域知识和工程能力上的不足。

Comments https://github.com/rajpurkarlab/ReX-MLE

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17154 2025-12-22 cs.SD 75%

InstructDubber: Instruction-based Alignment for Zero-shot Movie Dubbing

InstructDubber:基于指令的零样本电影配音对齐

Zhedong Zhang, Liang Li, Gaoxiang Cong, Chunshan Liu, Yuhan Gao, Xiaowan Wang, Tao Gu, Yuankai Qi

机构 * VIPL group, ICT, CAS(中国科学院信息科技研究所VIPL小组)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 InstructDubber通过指令生成和持续时间蒸馏模块,实现鲁棒的领域内和零样本电影配音对齐。

Comments Accepted by AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17774 2025-12-22 eess.IV cs.AI cs.CV cs.LG 62%

MedNeXt-v2: Scaling 3D ConvNeXts for Large-Scale Supervised Representation Learning in Medical Image Segmentation

MedNeXt-v2:用于医学图像分割的大规模监督表示学习中的3D ConvNeXt扩展

Saikat Roy, Yannick Kirchhoff, Constantin Ulrich, Maximillian Rokuss, Tassilo Wald, Fabian Isensee, Klaus Maier-Hein

机构 * German Cancer Research Center (DKFZ) Heidelberg, Division of Medical Image Computing(德国癌症研究中心(DKFZ)海德堡,医学影像计算部) Faculty of Mathematics and Computer Science, Heidelberg University(海德堡大学数学与计算机科学学院) HIDSS4Health - Helmholtz Information and Data Science School for Health, Karlsruhe/Heidelberg, Germany(HIDSS4Health - 欧洲信息与数据科学健康学校,卡尔斯鲁厄/海德堡,德国) Medical Faculty Heidelberg, Heidelberg University(海德堡大学医学学院) National Center for Tumor Diseases (NCT), Heidelberg, Germany(肿瘤国家研究中心(NCT),海德堡,德国) Helmholtz Imaging, German Cancer Research Center, Germany(海德堡成像,德国癌症研究中心,德国) Pattern Analysis and Learning Group, Department of Radiation Oncology, Heidelberg University Hospital(模式分析与学习组,放射肿瘤学部,海德堡大学医院)

专题命中 领域大模型 :pretraining(abstract);分类 cs.AI、cs.LG

AI总结 MedNeXt-v2通过改进的架构和扩展方法,在医学图像分割中实现最先进的监督表示学习性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17189 2025-12-22 cs.CV 50%

Anatomical Region-Guided Contrastive Decoding: A Plug-and-Play Strategy for Mitigating Hallucinations in Medical VLMs

解剖区域引导的对比解码:一种用于缓解医学视觉-语言模型幻觉的即插即用策略

Xiao Liang, Chenxi Liu, Zhi Ma, Di Wang, Bin Jing, Quan Wang, Yuanyuan Shi

专题命中 领域大模型 :language model(abstract)

AI总结 本文提出了解剖区域引导的对比解码策略,通过区域特定指导缓解医学视觉-语言模型的幻觉问题,提升诊断准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 知识编辑与模型理解 8 篇

2406.14862 2025-12-22 cs.LG cs.CL cs.CV 88%

LatentExplainer: Explaining Latent Representations in Deep Generative Models with Multimodal Large Language Models

LatentExplainer: 通过多模态大语言模型解释深度生成模型中的潜在表示

Mengdan Zhu, Raasikh Kanjiani, Jiahui Lu, Andrew Choi, Qirui Ye, Liang Zhao

机构 * Emory University(埃默里大学) University College London(伦敦大学学院)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

AI总结 LatentExplainer通过多模态大语言模型为深度生成模型的潜在变量生成语义解释,提升模型可解释性。

Comments Accepted to CIKM 2025 Full Research Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17385 2025-12-22 cs.CL 88%

UCoder: Unsupervised Code Generation by Internal Probing of Large Language Models

UCoder: 通过大型语言模型的内部探测实现无监督代码生成

Jiajun Wu, Jian Yang, Wei Zhang, Lin Jing, Yuqing Ma, Ensheng Shi, Yuchi Ma, Zhoujun Li, Xianglong Liu

机构 * Beihang University(北航大学) Huawei(华为)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 UCoder通过内部探测大型语言模型实现无监督代码生成,利用自一致性机制和表示质量估计训练,减少对标记数据的依赖,提升资源受限场景下的代码生成能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17172 2025-12-22 cs.HC cs.AI 85%

PILAR: Personalizing Augmented Reality Interactions with LLM-based Human-Centric and Trustworthy Explanations for Daily Use Cases

PILAR: 基于LLM的人本化和可信的增强现实交互个性化

Ripan Kumar Kundu, Istiak Ahmed, Khaza Anuarul Hoque

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 PILAR通过基于LLM的个性化解释提升AR交互的可信度和用户体验

Comments Published in the 2025 IEEE International Symposium on Mixed and Augmented Reality Adjunct (ISMAR-Adjunct)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17247 2025-12-22 cs.CL cs.AI 81%

Incorporating Error Level Noise Embedding for Improving LLM-Assisted Robustness in Persian Speech Recognition

融合误差等级噪声嵌入以提升波斯语音识别中LLM的鲁棒性

Zahra Rahmani, Hossein Sameti

机构 * Department of Computer Engineering(计算机工程系) Sharif University of Technology(谢赫·伊斯兰技术大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);分类 cs.CL、cs.AI

AI总结 本研究提出结合误差等级噪声嵌入的波斯语音识别鲁棒性提升方法,通过多假设和噪声感知建模降低WER,实验显示在噪声环境下显著提升识别准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08107 2025-12-22 cs.CR cs.HC 75%

Detecting Ambiguity Aversion in Cyberattack Behavior to Inform Cognitive Defense Strategies

检测网络攻击行为中的模糊厌恶以指导认知防御策略

Stephan Carney, Soham Hans, Sofia Hirschmann, Stacey Marsella, Yvonne Fonken, Peggy Wu, Nikolos Gurney

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本研究通过分析网络攻击行为中的模糊厌恶,提出了一种基于多模态数据和大语言模型的框架,用于实时推断攻击者倾向,以指导认知防御策略的开发。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11023 2025-12-22 cs.AI cs.SE 70%

OntoGSN: An Ontology-Based Framework for Semantic Management and Extension of Assurance Cases

OntoGSN:基于本体的保障案例语义管理和扩展框架

Tomas Bueno Momcilovic, Barbara Gallina, Ingmar Kessler, Jule Hendricks, Dian Balta

机构 * fortiss research institute(fortiss研究机构) Mälardalen University(马尔默达伦大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 OntoGSN通过本体和中间件实现保障案例的语义管理和扩展,提供知识表示和查询功能,并在对抗鲁棒性保障中展示实用性。

Comments Submitted to the ESWC 2026 Resources track

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15068 2025-12-22 cs.LG cs.AI cs.CL 67%

The Semantic Illusion: Certified Limits of Embedding-Based Hallucination Detection in RAG Systems

语义幻觉:基于嵌入的幻觉检测在RAG系统中的认证极限

Debu Sinha

机构 * Independent Researcher(独立研究者)

专题命中 知识编辑与模型理解 :RLHF(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究揭示了基于嵌入的幻觉检测在RAG系统中存在语义幻觉问题,通过符合预测方法发现真实幻觉检测的挑战,证明需通过推理而非表面语义解决。

Comments 12 pages, 3 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17677 2025-12-22 cs.CL 57%

Toward Ethical AI Through Bayesian Uncertainty in Neural Question Answering

通过贝叶斯不确定性实现伦理AI:神经问答中的贝叶斯推理

Riccardo Di Sipio

机构 * Dayforce

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

AI总结 本文通过贝叶斯不确定性方法改进神经问答系统的可解释性和伦理性,对比拉普拉斯近似与MAP估计以提升不确定性校准能力。

Comments 14 pages, 8 figures,

Journal ref AI Ethics 6, 38 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 其他LLM 5 篇

2512.17309 2025-12-22 cs.RO 89%

RecipeMasterLLM: Revisiting RoboEarth in the Era of Large Language Models

RecipeMasterLLM: 重新审视大语言模型时代的RoboEarth

Asil Kaan Bozcuoglu, Ziyuan Liu

机构 * Huawei Heisenberg Research Center (Munich)(华为海森堡研究中心(慕尼黑))

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 RecipeMasterLLM通过微调大语言模型实现自动化知识获取,提升机器人动作描述的准确性与一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20196 2025-12-22 cs.SE cs.AI cs.HC 87%

Understanding and supporting how developers prompt for LLM-powered code editing in practice

理解并支持开发者在实践中如何提示LLM赋能的代码编辑

Daye Nam, Ahmed Omran, Ambar Murillo, Saksham Thakur, Abner Araujo, Marcel Blistein, Alexander Frömmgen, Vincent Hellendoorn, Satish Chandra

机构 * University of California Irvine(加州大学尔布雷分校) Google(谷歌) Meta

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文研究开发者在使用LLM赋能代码编辑工具时的提示行为,发现频繁重新提示表明使用困难,并提出AutoPrompter工具通过推断缺失信息提升编辑正确性27%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17066 2025-12-22 cs.AI 77%

Realistic threat perception drives intergroup conflict: A causal, dynamic analysis using generative-agent simulations

现实威胁感知驱动群体冲突:基于生成代理模拟的因果动态分析

Suhaib Abdurahman, Farzan Karimi-Malekabadi, Chenxiao Yu, Nour S. Kteily, Morteza Dehghani

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过生成代理模拟研究现实威胁与象征威胁对群体冲突的因果影响,发现现实威胁直接提升敌意,而象征威胁的影响需通过群体内偏见中介,非敌对接触可缓解冲突升级。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16954 2025-12-22 cs.CV cs.AI 70%

Lights, Camera, Consistency: A Multistage Pipeline for Character-Stable AI Video Stories

灯光,摄像机,一致性:一种多阶段管道用于角色稳定的AI视频故事

Chayan Jain, Rishant Sharma, Archit Garg, Ishan Bhanuka, Pratik Narang, Dhruv Kumar

机构 * BITS Pilani, Pilani Campus, India(印度比斯汉尼学院帕利尼校区)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出了一种多阶段管道,通过生成详细剧本并利用视觉锚点来提升AI生成视频故事中角色的一致性。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10735 2025-12-22 hep-th 50%

Relative Rényi Entropy Under Local Quenches in 2D CFTs

二维CFT中局部淬火下的相对Rényi熵

Zi-Xuan Zhao, Song He, Hao Ouyang, Hong-an Zeng, Yu-Xuan Zhang

专题命中 其他LLM :prompting(abstract)

AI总结 研究局部淬火下二维CFT中相对Rényi熵的行为,揭示其与迹平方距离及纠缠补的关系,拓展量子信息度量的理解。

Comments v2, published version

详情

展开后加载摘要…

URL PDF HTML 收藏