arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-18 至 2025-12-18 共收录 138 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 9 篇

2512.15053 2025-12-18 cs.CL cs.AI cs.LG cs.SE 87%

The Meta-Prompting Protocol: Orchestrating LLMs via Adversarial Feedback Loops

元提示协议:通过对抗反馈循环 orchestrate LLMs

Fanzhe Fu

机构 * Zhejiang University(浙江大学)

专题命中 知识编辑与模型理解 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 元提示协议通过对抗反馈循环构建可编程自优化系统,解决LLM在关键任务中的确定性保证问题。

Comments 6 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14801 2025-12-18 cs.CL cs.AI cs.LG 80%

Incentives or Ontology? A Structural Rebuttal to OpenAI's Hallucination Thesis

激励还是本体?对OpenAI“幻觉假说”的结构反驳

Richard Ackermann, Simeon Emanuilov

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文反驳OpenAI关于幻觉源于激励不匹配的观点,指出幻觉是Transformer架构的必然结果,需通过外部验证模块消除,而非改变激励或微调。

Comments 17 pages, references to prior work arXiv:2509.16297 and arXiv:2511.06073

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15708 2025-12-18 cs.CV 78%

Multi-View Foundation Models

多视图基础模型

Leo Segre, Or Hirschorn, Shai Avidan

机构 * Tel Aviv University(特拉维夫大学)

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

AI总结 本文提出一种将基础模型转换为多视图基础模型的方法,通过引入3D感知注意力层提升多视角特征一致性,应用于表面法线估计和多视角分割任务,实验表明其在特征匹配上有显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24793 2025-12-18 cs.SD cs.AI cs.LG eess.AS 76%

Sparse Autoencoders Make Audio Foundation Models more Explainable

稀疏自编码器使音频基础模型更加可解释

Théo Mariotte, Martin Lebourdais, Antonio Almudévar, Marie Tahon, Alfonso Ortega, Nicolas Dugué

机构 * LIUM, Le Mans Université(利姆大学LIUM) VivoLab, I3A, University of Zaragoza(瓦沃拉实验室、I3A、萨拉戈萨大学)

专题命中 知识编辑与模型理解 :foundation model(title);分类 cs.AI、cs.LG

AI总结 本研究利用稀疏自编码器分析音频预训练模型的隐藏表示,揭示其在歌唱技巧分类中的可解释性提升及对自监督学习系统的作用。

Comments 5 pages, 5 figures, 1 table, submitted to ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14880 2025-12-18 cs.LG cs.CL cs.CV 73%

Task Matrices: Linear Maps for Cross-Model Finetuning Transfer

任务矩阵:用于跨模型微调转移的线性映射

Darrin O' Brien, Dhikshith Gajulapalli, Eric Xia

机构 * Algoverse AI Research(Algoverse AI研究院) Brown University(布朗大学)

专题命中 知识编辑与模型理解 :language model(abstract);prompting(abstract);分类 cs.CL、cs.LG

AI总结 本文提出任务矩阵,通过线性变换提升跨模型微调转移性能,验证了预训练与微调架构间的线性编码存在,并展示了高效可推广的数据近似方法。

Comments NeurIPS Unireps 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15410 2025-12-18 cs.CV 67%

Preserving Marker Specificity with Lightweight Channel-Independent Representation Learning

通过轻量级通道无关表征学习保持标记特异性

Simon Gutwein, Arthur Longuefosse, Jun Seita, Sabine Taschner-Mandl, Roxane Licandro

机构 * St. Anna Children’s Cancer Research Institute(圣安娜儿童癌症研究中心) TU Wien, Institute of Visual Computing and Human-Centered Technology, CVL(维也纳技术大学,视觉计算与人本技术研究所,CVL) Medical University of Vienna, Biomedical Imaging and Image-guided Therapy, Computational Imaging Research, ELIA Group(维也纳医学大学,生物医学成像与影像引导治疗,计算成像研究,ELIA小组) RIKEN Center for Integrative Medical Sciences(理化学研究所整合医学中心) Medical University of Vienna, Comprehensive Center for AI in Medicine(维也纳医学大学,医学人工智能综合中心) Medical University of Vienna, Christian Doppler Lab for Mathematical Modelling and Simulation of Next-Generation Medical Ultrasound Devices(维也纳医学大学,基督教多普勒实验室(下一代医学超声设备数学建模与模拟))

专题命中 知识编辑与模型理解 :foundation model(abstract);pretraining(abstract)

AI总结 本文提出轻量级通道无关模型CIM-S,通过保持标记独立性和浅层架构,在多路数据自监督学习中优于传统深度模型。

Comments 16 pages, 9 figures, MIDL 2026 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11963 2025-12-18 cs.LG 57%

QLENS: Towards A Quantum Perspective of Language Transformers

QLENS:迈向语言转换器的量子视角

Aditya Gupta, Kirandeep Kaur, Vinayak Gupta, Chirag Shah

机构 * Issaquah High School, Washington, USA(华盛顿州伊萨夸高中) University of Washington, Washington, USA(华盛顿大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

AI总结 QLENS从量子力学角度提出语言转换器的物理视角,通过将潜在激活转换为希尔伯特空间中的状态向量,利用单位ary算子和哈密顿量建模转换器生成过程,探索其概率分布和预测轨迹的演化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13522 2025-12-18 cs.LG cs.CV 57%

REAL: Representation Enhanced Analytic Learning for Exemplar-free Class-incremental Learning

REAL:基于表征增强的无实例类增量学习

Run He, Di Fang, Yizhu Chen, Kai Tong, Cen Chen, Yi Wang, Lap-pui Chau, Huiping Zhuang

机构 * Shien-Ming Wu School of Intelligent Engineering(申铭武智能工程学院) School of Future Technology(未来技术学院) Department of Electrical and Electronic Engineering(电气与电子工程系)

专题命中 知识编辑与模型理解 :pretraining(abstract);分类 cs.LG

AI总结 REAL通过双流预训练和表征增强蒸馏提升无实例类增量学习的表征能力,结合特征融合缓冲器更高效利用主干网络知识,实现更优的分类性能。

Comments 13 pages, 7 figures. This paper is published in Knowledge-based System

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15611 2025-12-18 cs.CV 50%

If you can describe it, they can see it: Cross-Modal Learning of Visual Concepts from Textual Descriptions

如果你能描述它,他们就能看到它:从文本描述中跨模态学习视觉概念

Carlo Alberto Barbano, Luca Molinaro, Massimiliano Ciranni, Emanuele Aiello, Vito Paolo Pastore, Marco Grangetto

机构 * University of Turin(都灵大学) University of Genoa(热那亚大学) Politecnico di Torino(都灵理工大学)

专题命中 知识编辑与模型理解 :language model(abstract)

AI总结 本文提出通过文本描述跨模态学习视觉概念的方法,利用知识迁移技术提升视觉-语言模型的零样本性能。

Comments 27 pages. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他LLM 9 篇

2504.18271 2025-12-18 cs.AI cs.ET cs.HC cs.SY eess.SY 89%

Large Language Model-Based Intelligent Antenna Design System

基于大语言模型的智能天线设计系统

Tao Wu, Kexue Fu, Qiang Hua, Xinxin Liu, Bo Liu

机构 * James Watt School of Engineering, University of Glasgow(格拉斯哥大学詹姆斯·瓦特工程学院) Department of Electrical Engineering, City University of Hong Kong(香港城市大学电子工程系) Department of Engineering and Technology, University of Huddersfield(赫尔德斯菲尔德大学工程与技术系)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出基于大语言模型的智能天线设计系统,通过文本和图像生成优化天线设计,提升超宽频带内增益稳定性。

Comments Code are available: https://github.com/TaoWu974/LEAM. Accepted by and will be presented in EuCAP 2026, Dublin

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01353 2025-12-18 cs.CR 85%

The Trojan Knowledge: Bypassing Commercial LLM Guardrails via Harmless Prompt Weaving and Adaptive Tree Search

恶意知识:通过无害提示编织和自适应树搜索绕过商业大语言模型的安全防护

Rongzhe Wei, Peizhi Niu, Xinjie Shen, Tony Tu, Yifan Li, Ruihan Wu, Eli Chien, Pin-Yu Chen, Olgica Milenkovic, Pan Li

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 通过无害提示编织和自适应树搜索,研究提出CKA-Agent攻击方法,成功绕过商业大语言模型的安全防护,揭示了知识分解攻击的严重性。

Comments Updated with new baselines and experimental results

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11921 2025-12-18 cs.CL cs.CY cs.HC 81%

Designing LLMs for cultural sensitivity: Evidence from English-Japanese translation

为文化敏感性设计LLMs:来自英语-日语翻译的证据

Helene Tenzer, Oumnia Abidi, Stefan Feuerriegel

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文通过分析英语-日语翻译中不同提示策略对文化敏感性的影响,提出通过定制提示提升多语言环境中LLM文化适应性的方法。

Comments Posted premature without permission of all authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22734 2025-12-18 cs.CY cs.AI 79%

Automated Formative Feedback for Short-form Writing: An LLM-Driven Approach and Adoption Analysis

短文写作的自动化形成性反馈:一种基于大语言模型的方法与采用分析

Tiago Fernandes Tavares, Luciano Pereira Soares

专题命中 其他LLM :LLM(title,abstract);分类 cs.AI

AI总结 本文提出一种基于大语言模型的短文写作自动化形成性反馈系统,通过分析采用情况发现初期参与度低,但有效利用该系统能提升学生报告质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14715 2025-12-18 cs.LG cs.AI 79%

How a Bit Becomes a Story: Semantic Steering via Differentiable Fault Injection

一位比特如何成为故事:通过可微分故障注入实现语义引导

Zafaryab Haider, Md Hafizur Rahman, Shane Moeykens, Vijay Devabhaktuni, Prabuddha Chakraborty

机构 * University of Maine(缅因大学) Illinois State University(伊利诺伊州立大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 通过可微分故障注入分析,研究比特级扰动对生成模型语义的影响,揭示低级变化如何引导高层语义。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14753 2025-12-18 cs.CR cs.AI 77%

CODE ACROSTIC: Robust Watermarking for Code Generation

CODE ACROSTIC: 为代码生成提供稳健的水印技术

Li Lin, Siyuan Xin, Yang Cao, Xiaochun Cao

机构 * Institude of Science Tokyo(东京科学研究院) Shanghai University(上海大学) Sun Yat-sen University(孙中山大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 CODE ACROSTIC通过利用Cue List区分代码熵,提升代码水印标记的可检测性和实用性,有效应对注释移除攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14876 2025-12-18 cs.CV 67%

Isolated Sign Language Recognition with Segmentation and Pose Estimation

孤立手语识别与分割和姿态估计

Daniel Perkins, Davis Hunter, Dhrumil Patel, Galen Flanagan

机构 * University of Tennessee, Knoxville(田纳西大学,诺克斯维尔)

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文提出了一种降低计算成本且具备鲁棒性的孤立手语识别模型,通过姿态估计、分割模块和ResNet-Transformer主干联合建模空间与时间依赖性,以提升对签署人变异的适应能力。

Comments 5 pages, 3 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06697 2025-12-18 cs.SE 50%

"Sorry for bugging you so much." Exploring Developers' Behavior Towards Privacy-Compliant Implementation

对不起,打扰您这么久。探索开发者对隐私合规实施的行为

Stefan Albert Horstmann, Sandy Hong, David Klein, Raphael Serafini, Martin Degeling, Martin Johns, Veelasha Moonsamy, Alena Naiakshina

专题命中 其他LLM :prompting(abstract)

AI总结 研究探讨开发者在隐私合规实施中的行为,发现即使有提示或专家支持,大多数开发者仍难以满足GDPR要求,且常依赖现有实现而非主动寻求帮助。

Journal ref 2025 IEEE Symposium on Security and Privacy (SP), 2025, pp. 1159-1177

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18461 2025-12-18 cond-mat.dis-nn 50%

A note on the dynamics of extended-context disordered kinetic spin models

关于扩展上下文无序动能自旋模型动力学的注记

Jacob A. Zavatone-Veth, Cengiz Pehlevan

专题命中 其他LLM :language model(abstract)

AI总结 本文提出扩展上下文无序动能自旋模型作为自回归序列生成的玩具模型,通过动态平均场理论分析其渐近统计特性。

Comments Semi-expository note; 33 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏