arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12193 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12193 篇

2505.21486 2026-01-21 cs.AI 79%

Hypothesis Generation via LLM-Automated Language Bias for ILP

通过LLM自动语言偏见进行假设生成

Yang Yang, Jiemin Wu, Yutao Yue

专题命中 其他LLM :LLM(title,abstract);分类 cs.AI

AI总结 本文提出通过LLM自动设计语言偏见,结合ILP求解器生成可解释的逻辑规则,提升假设生成的性能和鲁棒性。

Comments accepted by AAAI 2026 Bridge LMReasoning

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16681 2026-01-21 eess.AS cs.CL cs.SD 79%

Emotional Dimension Control in Language Model-Based Text-to-Speech: Spanning a Broad Spectrum of Human Emotions

基于语言模型的文本到语音情感维度控制:跨越人类情感的广泛光谱

Kun Zhou, You Zhang, Dianwen Ng, Shengkui Zhao, Hao Wang, Bin Ma

机构 * Tongyi Lab, Alibaba Group, Singapore(阿里云实验室,阿里巴巴集团,新加坡) University of Rochester, United States of America(罗切斯特大学,美国)

专题命中 其他LLM :language model(title,abstract);分类 cs.CL

AI总结 本文提出基于语言模型的TTS框架,通过PAD三维情感维度实现更广泛的情感表达,提升语音的自然度和多样性。

Comments ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16904 2026-01-19 cs.CR cs.CL 79%

How Good is Post-Hoc Watermarking With Language Model Rephrasing?

在语言模型重述中后置水印技术有多好?

Pierre Fernandez, Tom Sander, Hady Elsahar, Hongyan Chang, Tomáš Souček, Valeriu Lacatusu, Tuan Tran, Sylvestre-Alvise Rebuffi, Alexandre Mourachko

机构 * FAIR, Meta Superintelligence Labs(FAIR、Meta超智能实验室)

专题命中 其他LLM :language model(title);LLM(abstract);分类 cs.CL

AI总结 本文研究了语言模型重述中后置水印技术的效果,发现简单方法在某些情况下表现优异,但对可验证文本效果不佳。

Comments Code at https://github.com/facebookresearch/textseal

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09182 2026-01-15 cs.AI cs.CY cs.HC 79%

Position on LLM-Assisted Peer Review: Addressing Reviewer Gap through Mentoring and Feedback

LLM辅助同行评审的位置:通过指导与反馈解决评审缺口

JungMin Yun, JuneHyoung Kwon, MiHyeon Kim, YoungBin Kim

专题命中 其他LLM :LLM(title,abstract);分类 cs.AI

AI总结 本文提出通过LLM辅助指导和反馈系统解决评审缺口问题,旨在提升评审质量并促进学术生态可持续发展。

Comments Accepted to AAAI 2026 Workshop on AI for Scientific Research (AI4Research)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08871 2026-01-15 cs.SD cs.AI eess.AS 79%

Semantic visually-guided acoustic highlighting with large vision-language models

语义视觉引导的音频突出与大型视觉-语言模型

Junhua Huang, Chao Huang, Chenliang Xu

机构 * University of Rochester(罗切斯特大学)

专题命中 其他LLM :language model(title,abstract);分类 cs.AI

AI总结 本文提出利用大型视觉-语言模型提取视觉-语义特征,以提升音频混音质量,发现摄像机焦点、语气和场景背景对感知混音质量提升最显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08139 2026-01-14 cs.CV cs.AI 79%

Subspace Alignment for Vision-Language Model Test-time Adaptation

子空间对齐用于视觉-语言模型测试时适应

Zhichen Zeng, Wenxuan Bao, Xiao Lin, Ruizhong Qiu, Tianxin Wei, Xuying Ning, Yuchen Yan, Chen Luo, Monica Xiao Cheng, Jingrui He, Hanghang Tong

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Amazon(亚马逊)

专题命中 其他LLM :language model(title,abstract);分类 cs.AI

AI总结 SubTTA通过子空间对齐提升视觉-语言模型测试时适应性能,有效解决模态差距和视觉噪声问题。

Comments 17 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15862 2026-01-13 cs.MA cs.CL 79%

The Subtle Art of Defection: Understanding Uncooperative Behaviors in LLM based Multi-Agent Systems

缺陷的微妙艺术:理解基于大语言模型的多智能体系统中的不合作行为

Devang Kulshreshtha, Wanyu Du, Raghav Jain, Srikanth Doss, Hang Su, Sandesh Swamy, Yanjun Qi

机构 * AWS AI Labs(AWS人工智能实验室) UC San Diego(大学圣地亚哥)

专题命中 其他LLM :LLM(title,abstract);分类 cs.CL

AI总结 本文提出了一种用于分析基于大语言模型的多智能体系统中不合作行为的框架,通过实验发现不合作行为会迅速导致系统崩溃,同时指出现有防御方法存在检测不足的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05241 2026-01-09 cs.CV cs.AI cs.RO 79%

RoboVIP: Multi-View Video Generation with Visual Identity Prompting Augments Robot Manipulation

RoboVIP: 多视角视频生成与视觉身份提示增强机器人操作

Boyang Wang, Haoran Zhang, Shujie Zhang, Jinkun Hao, Mingda Jia, Qi Lv, Yucheng Mao, Zhaoyang Lyu, Jia Zeng, Xudong Xu, Jiangmiao Pang

机构 * Shanghai AI Laboratory(上海人工智能实验室) Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学) University of Michigan(密歇根大学)

专题命中 其他LLM :prompting(title,abstract);分类 cs.AI

AI总结 RoboVIP通过引入视觉身份提示和可扩展的视觉身份池,提升机器人操控数据的质量与多样性,从而增强视觉语言-动作和视觉-运动政策模型的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04388 2026-01-09 cs.AI 79%

LLM-Guided Lifecycle-Aware Clustering of Multi-Turn Customer Support Conversations

基于大语言模型的生命周期感知多轮客户支持对话聚类

Priyaranjan Pattnayak, Sanchari Chowdhuri, Amit Agarwal, Hitesh Laxmichand Patel

专题命中 其他LLM :LLM(title,abstract);分类 cs.AI

AI总结 本文提出基于大语言模型的生命周期感知多轮客户支持对话聚类方法,通过动态细化聚类提升聚类质量,实现高效实时分析。

Comments Accepted in AACL 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01211 2026-01-08 cs.CR cs.AI cs.MA 79%

Web Fraud Attacks Against LLM-Driven Multi-Agent Systems

针对基于大语言模型的多智能体系统 的网络欺诈攻击

Dezhang Kong, Hujin Peng, Yilun Zhang, Lele Zhao, Zhenhua Xu, Shi Lin, Changting Lin, Meng Han

机构 * Zhejiang University(浙江大学) Changsha University of Science and Technology(长沙理工大学) Purdue University(普渡大学) University of California San Diego(加州大学圣地亚哥分校) Zhejiang Gongshang University(浙江工商大学)

专题命中 其他LLM :LLM(title,abstract);分类 cs.AI

AI总结 本文提出了一种针对基于大语言模型的多智能体系统的新攻击类型,通过网络链接的独特结构欺骗系统,展示了其在不同架构中的破坏潜力及逃避优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00240 2026-01-07 cs.AI cs.CY 79%

When Agents See Humans as the Outgroup: Belief-Dependent Bias in LLM-Powered Agents

当代理将人类视为外群体:由信念驱动的LLM代理偏见

Zongwei Wang, Bincheng Gu, Hongyu Yu, Junliang Yu, Tao He, Jiayin Feng, Chenghua Lin, Min Gao

机构 * Chongqing University(重庆大学) The University of Queensland(昆士兰大学) Virginia Polytechnic Institute and State University(弗吉尼亚理工大学) The University of Manchester(曼彻斯特大学)

专题命中 其他LLM :LLM(title,abstract);分类 cs.AI

AI总结 本文研究了基于LLM的代理在身份信念影响下的群体偏见问题,提出信念污染攻击并设计防御措施,以提升人类交互代理的安全性。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24102 2026-01-01 cs.LG 79%

Autoregressivity in the Latent Space of a GP-VAE Language Model: An Empirical Ablation Study

在GP-VAE语言模型的潜在空间中的自回归性:一项经验消融研究

Yves Ruffenach

机构 * Conservatoire National des Arts et Métiers(法国国家艺术与工艺学院)

专题命中 其他LLM :language model(title,abstract);分类 cs.LG

AI总结 本文通过实验验证了GP-VAE中潜在自回归在组织长距离结构中的有效性,并展示了其与令牌级自回归建模的互补性。

Comments A focused ablation study analyzing the role of latent autoregression in GP-VAE models

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19949 2025-12-24 cs.CV cs.AI 79%

How Much 3D Do Video Foundation Models Encode?

视频基础模型编码多少三维信息?

Zixuan Huang, Xiang Li, Zhaoyang Lv, James M. Rehg

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Impossible, Inc(Impossible公司)

专题命中 其他LLM :foundation model(title,abstract);分类 cs.AI

AI总结 本文研究了视频基础模型对3D世界的理解程度,提出了一种模型无关的框架来评估不同模型的3D意识,并发现最先进的视频生成模型在无3D训练数据的情况下也能表现出超越专门3D任务模型的理解能力。

Comments Project Page: https://vidfm-3d-probe.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22734 2025-12-18 cs.CY cs.AI 79%

Automated Formative Feedback for Short-form Writing: An LLM-Driven Approach and Adoption Analysis

短文写作的自动化形成性反馈:一种基于大语言模型的方法与采用分析

Tiago Fernandes Tavares, Luciano Pereira Soares

专题命中 其他LLM :LLM(title,abstract);分类 cs.AI

AI总结 本文提出一种基于大语言模型的短文写作自动化形成性反馈系统,通过分析采用情况发现初期参与度低,但有效利用该系统能提升学生报告质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16396 2025-12-15 cs.LG 79%

GoalLadder: Incremental Goal Discovery with Vision-Language Models

GoalLadder: 基于视觉语言模型的增量目标发现

Alexey Zakharov, Shimon Whiteson

机构 * University of Oxford(牛津大学)

专题命中 其他LLM :language model(title,abstract);分类 cs.LG

AI总结 GoalLadder利用视觉语言模型在视觉环境中通过增量目标发现提升RL智能体性能,实现高成功率。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17090 2025-12-12 cs.CL 79%

Better Language Model Inversion by Compactly Representing Next-Token Distributions

通过紧凑表示下一项令牌分布来改进语言模型反向工程

Murtaza Nazir, Matthew Finlayson, John X. Morris, Xiang Ren, Swabha Swayamdipta

机构 * University of Southern California(美国南加州大学) Cornell University(康奈尔大学)

专题命中 其他LLM :language model(title,abstract);分类 cs.CL

AI总结 本文提出了一种通过紧凑表示下一项令牌分布来改进语言模型反向工程的方法,显著提升了隐藏提示的恢复率,并展示了其在复杂任务中的良好表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09894 2025-12-11 cs.LG 79%

Exploring Protein Language Model Architecture-Induced Biases for Antibody Comprehension

探索蛋白质语言模型架构引起的抗体理解偏差

Mengren, Liu, Yixiang Zhang, Yiming, Zhang

专题命中 其他LLM :language model(title,abstract);分类 cs.LG

AI总结 本研究探讨了蛋白质语言模型架构对抗体理解偏差的影响,通过对比不同模型在抗体靶向预测中的表现,揭示了架构选择对生物特征提取的关键作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07869 2025-12-10 q-bio.NC cs.AI 79%

Manifolds and Modules: How Function Develops in a Neural Foundation Model

流形与模块:神经基础模型中函数如何发展

Johannes Bertram, Luciano Dyballa, T. Anderson Keller, Savik Kinger, Steven W. Zucker

机构 * University of Tübingen(图宾根大学) School of Science & Technology(科学与技术学院) IE University(IE大学) The Kempner Institute for Natural and Artificial Intelligence(自然与人工智能研究所) Harvard University(哈佛大学) Department of Computer Science(计算机科学系) Yale University(耶鲁大学) Depts. of Computer Science and Biomedical Engineering(计算机科学与生物医学工程系) Wu Tsai Institute(吴士怀研究所)

专题命中 其他LLM :foundation model(title,abstract);分类 cs.AI

AI总结 本文通过分析神经基础模型中不同处理阶段的流形结构,揭示其在生物相关性方面的贡献。

Comments 25 pages, 10 figures, accepted at Data on the Brain & Mind Findings, NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07234 2025-12-09 cs.CV cs.AI 79%

Dropout Prompt Learning: Towards Robust and Adaptive Vision-Language Models

Dropout Prompt Learning: 向稳健和适应性强的视觉-语言模型迈进

Biao Chen, Lin Zuo, Mengmeng Jing, Kunbin He, Yuchen Wang

机构 * Biao Chen, Lin Zuo, Mengmeng Jing, Kunbin He, Yuchen Wang(作者)

专题命中 其他LLM :language model(title,abstract);分类 cs.AI

AI总结 Dropout Prompt Learning通过在视觉-语言模型中应用Dropout技术,提升模型的鲁棒性和适应性,实验表明其在低样本学习、长尾分类和分布外泛化等任务中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05222 2025-12-08 cs.LG 79%

Mitigating the Antigenic Data Bottleneck: Semi-supervised Learning with Protein Language Models for Influenza A Surveillance

缓解抗原数据瓶颈:基于蛋白质语言模型的半监督学习用于甲型流感A病毒监测

Yanhua Xu

机构 * Department of Computer Science, University of Liverpool, UK(利物浦大学计算机科学系)

专题命中 其他LLM :language model(title,abstract);分类 cs.LG

AI总结 本研究利用蛋白质语言模型与半监督学习缓解抗原数据瓶颈,提升流感A病毒监测的预测准确性。

Comments V0: initial draft uploaded

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15471 2025-12-04 cs.CL 79%

Bigram Subnetworks: Mapping to Next Tokens in Transformer Language Models

双元子网络:映射到下一个标记的Transformer语言模型

Tyler A. Chang, Benjamin K. Bergen

机构 * Department of Cognitive Science University of California San Diego(认知科学系,加州大学圣地亚哥分校)

专题命中 其他LLM :language model(title,abstract);分类 cs.CL

AI总结 研究发现Transformer语言模型中存在双元子网络,这些子网络能基于当前标记预测下一个标记,且对模型性能至关重要。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23623 2025-12-04 cs.CL 79%

Characterizing the Expressivity of Fixed-Precision Transformer Language Models

刻画固定精度变换器语言模型的表达能力

Jiaoda Li, Ryan Cotterell

专题命中 其他LLM :language model(title,abstract);分类 cs.CL

AI总结 本研究通过分析固定精度变换器的表达能力,发现其与线性时间逻辑中单一时间运算符的片段一致,并通过实验证明其在语言泛化中的表现。

Comments NeurIPS 2025 (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13339 2025-12-02 cs.LG 79%

Statistically Accurate and Robust Generative Prediction of Rock Discontinuities with A Tabular Foundation Model

基于表格基础模型的统计准确且鲁棒的岩体结构预测

Han Meng, Gang Mei, Hong Tian, Nengxiong Xu, Jianbing Peng

机构 * School of Engineering(工程学院) Technology, China University of Geosciences (Beijing)(技术学院,中国地质大学(北京)) School of Geological Engineering(地质工程学院) Geomatics, Chang'an University(测绘学,长安大学) School of Engineering, China University of Geosciences (Wuhan)(工程学院,中国地质大学(武汉))

专题命中 其他LLM :foundation model(title,abstract);分类 cs.LG

AI总结 本文提出利用表格基础模型实现对岩体结构的统计准确且鲁棒的生成预测,通过小数据学习有效捕捉复杂分布模式,实验表明优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21877 2025-12-01 cs.SE cs.AI 79%

LLM-Empowered Event-Chain Driven Code Generation for ADAS in SDV systems

基于大语言模型的事件链驱动的ADAS代码生成方法

Nenad Petrovic, Norbert Kroth, Axel Torschmied, Yinglei Song, Fengjunjie Pan, Vahid Zolfaghari, Nils Purschke, Sven Kirchner, Chengdong Wu, Andre Schamschurko, Yi Zhang, Alois Knoll

机构 * Federal Ministry of Research, Technology and Space of Germany(德国联邦研究、技术和空间部)

专题命中 其他LLM :LLM(title,abstract);分类 cs.AI

AI总结 本文提出基于事件链驱动和大语言模型的ADAS代码生成方法,通过RAG层提高代码生成的准确性和一致性,无需重新训练大语言模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20610 2025-11-26 cs.AI 79%

Building a Foundation Model for Trajectory from Scratch

从零开始构建轨迹基础模型

Gaspard Merten, Mahmoud Sakr, Gilles Dejaegere

机构 * Université libre de Bruxelles(布鲁塞尔自由大学)

专题命中 其他LLM :foundation model(title,abstract);分类 cs.AI

AI总结 本教程从零开始构建轨迹基础模型,通过GPT-2实现时空数据适应,并比较了TrajFM和TrajGPT等模型,为移动AI研究提供指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12842 2025-11-26 cs.RO cs.AI 79%

Vision Language Models Can Parse Floor Plan Maps

视觉语言模型可以解析平面图

David DeFazio, Hrudayangam Mehta, Meng Wang, Ping Yang, Jeremy Blackburn, Shiqi Zhang

机构 * School of Computing, Binghamton University(计算机学院,宾夕法尼亚州立大学)

专题命中 其他LLM :language model(title,abstract);分类 cs.AI

AI总结 本文研究了视觉语言模型在地图解析任务中的性能,展示了其在复杂室内导航中的高成功率,并指出在大型开放区域中性能下降的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24804 2025-11-20 cs.CV cs.CL 79%

Conflict Adaptation in Vision-Language Models

Xiaoyang Hu

机构 * Brown University(布朗大学)

专题命中 其他LLM :language model(title,abstract);分类 cs.CL

Comments Workshop on Interpreting Cognition in Deep Learning Models at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04530 2025-11-20 cs.CL 79%

Tomato, Tomahto, Tomate: Do Multilingual Language Models Understand Based on Subword-Level Semantic Concepts?

Crystina Zhang, Jing Lu, Vinh Q. Tran, Tal Schuster, Donald Metzler, Jimmy Lin

机构 * University of Waterloo(滑铁卢大学) Google DeepMind(谷歌DeepMind)

专题命中 其他LLM :language model(title,abstract);分类 cs.CL

Comments 8 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07463 2025-11-19 cs.RO cs.AI cs.CV 79%

DepthVision: Enabling Robust Vision-Language Models with GAN-Based LiDAR-to-RGB Synthesis for Autonomous Driving

Sven Kirchner, Nils Purschke, Ross Greer, Alois C. Knoll

机构 * Chair of Robotics, Artificial Intelligence and Real-time Systems, Technical University of Munich(机器人学、人工智能与实时系统教授会,慕尼黑技术大学) Computer Science and Engineering Department, University of California Merced(计算机科学与工程系,加州大学默塞德分校)

专题命中 其他LLM :language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07223 2025-11-11 cs.HC cs.AI 79%

NoteEx: Interactive Visual Context Manipulation for LLM-Assisted Exploratory Data Analysis in Computational Notebooks

Mohammad Hasan Payandeh, Lin-Ping Yuan, Jian Zhao

机构 * School of Computer Science\ of Waterloo Waterloo Ontario Canada The Hong Kong University of Science School of Computer Science\ of Waterloo

专题命中 其他LLM :LLM(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏