arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 762 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 762 篇

2607.17386 2026-07-21 cs.CV 新提交 88%

SkyVLaM: Multimodal Large Language Model for UAV Video Understanding in Remote Sensing

SkyVLaM:用于遥感中无人机视频理解的多模态大语言模型

Kaiwen Jing, Ruixu Jia, Bingyao Li, Ruizhe Ou, Ming Wu, Chuang Zhang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Peking University(北京大学) Beijing Wuzi University(北京物资学院)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract)

AI总结 针对无人机视频理解任务,提出多模态大语言模型SkyVLaM,通过时间基感知器构建稀疏令牌,正则化稀疏基,自适应选择密集段,联合大语言模型处理,还构建SkyVid,实验证明其能有效分配视觉令牌预算,提升语言条件视频分割效果。

Comments Accepted by WAICA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08800 2026-07-13 cs.SD 新提交 88%

Dual-BEATs: Unlocking Zero-Shot Stereo Audio Perception in Audio Large Language Models via Dithering

双BEATs:通过抖动在音频大语言模型中解锁零样本立体声音频感知

Shuo-Chun Lin, Hen-Hsen Huang

机构 * Institute of Information Science, Academia Sinica(台湾中央研究院资讯科学研究所)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract)

AI总结 研究针对多模态大语言模型空间感知局限,提出双BEATs架构,通过在编码前注入抖动噪声解决归一化问题,在三元方向分类任务中验证该方法有出色空间分辨率且能零样本泛化,证明标准模型经正则化可实现广义立体声音频理解。

Comments 14 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21296 2026-06-23 cs.CY 新提交 88%

Discriminatory Compliance: How LLMs Answer Queries from Protected Groups

歧视性合规:LLM如何回答来自受保护群体的查询

Dinesh Ayyappan, Carlos Castillo

专题命中 其他LLM :LLM(title_cn,summary_cn);large language model(abstract);language model(abstract)

AI总结 研究LLM在回答受保护群体用户查询时表现出的歧视性合规现象,发现模型对少数群体身份角色提供的信息不一致且缺失关键信息。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11207 2026-08-13 cs.AI 新提交 87%

Dynamic Governance of Multi-LLM Agent Systems for Collaborative Conversational Outcomes

用于实现协作式对话结果的多大型语言模型智能体系统的动态管控

Alexander Liss, Nicholas Desmond, Santiago Gil Gallego

专题命中 其他LLM :LLM(title,summary_cn);分类 cs.AI

AI总结 本文针对多LLM智能体对话崩溃问题,提出体验编排器EO管控层,通过三种机制提升顾问联系率,在6万次模拟中取得显著效果,为多智能体协作提供新方案。

Comments 13 pages, 3 figures, 3 tables. Submitted to AI Engineer World's Fair 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20933 2026-07-24 cs.SE cs.CL 新提交 87%

Transformer-Assisted LLM-Based Source Code Summarisation: to Enable More Secure Software Development

基于Transformer辅助的基于大语言模型的源代码摘要:助力更安全的软件开发

Jesse Phillips, Tracy Hall, Paul Rayson, Mo El-Haj

机构 * School of Computing and Communications, Lancaster University, UK(兰卡斯特大学计算与通讯学院) College of Engineering & Computer Science, VinUniversity(Vin大学工程与计算机科学学院)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究旨在解决软件系统中源代码摘要缺失、不完整或过时的问题,通过结合特定任务Transformer模型和大语言模型,利用Transformer生成的摘要辅助提示工程,使LLMs创建更好的源代码摘要,提升了BLEU - 4等指标。

Comments 10 pages

Journal ref NLPAICS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19967 2026-07-23 physics.soc-ph cs.AI cs.CY 新提交 87%

When Shippers Become Algorithms: Candidate Exposure, Information Design, and the Concentration of LLM-Mediated Freight Markets

当托运人成为算法:候选者曝光、信息设计与大语言模型介导的货运市场集中度

Takahiro Ezaki, Naoto Imura, Katsuhiro Nishinari

机构 * Research Center for Advanced Science and Technology, The University of Tokyo(东京大学先进科学与技术研究中心) Department of Aeronautics and Astronautics, School of Engineering, The University of Tokyo(东京大学工学部航空宇宙学系)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究托运人委托大语言模型代理选择承运人对货运市场的影响及平台设计应对策略,通过基于代理的模拟发现代理趋同、集中度随候选列表数量变化等风险,披露承运人剩余日运力可有效应对,凸显平台信息设计的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19300 2026-07-22 cs.AI cs.GT 新提交 87%

LLM Detection as an Intervention: Downstream Impact under Strategic User Behavior

作为一种干预手段的大语言模型检测:战略用户行为下的下游影响

Meena Jagadeesan, Tatsunori Hashimoto, Jon Kleinberg

机构 * Stanford University(斯坦福大学) University of Pennsylvania(宾夕法尼亚大学) Cornell University(康奈尔大学)

专题命中 其他LLM :LLM(title,summary_cn);分类 cs.AI

AI总结 研究LLM检测对下游指标的影响,开发程式化模型捕捉用户策略行为。发现不完善的检测器会扭曲LLM使用及输出质量,导致用户增加使用量且输出质量可能降低,还呈现“先升后降”检测模式,揭示了检测干预的失效模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17708 2026-07-21 cs.AI 新提交 87%

LaT: LLM-as-Trainer for Multi-Task Vehicle Routing Solvers

LaT:用于多任务车辆路径规划求解器的大语言模型训练器

Yang Wang, Ya-Hui Jia, Wei-Neng Chen, Yi Mei, Wen Song, Zhiguang Cao

机构 * School of Future Technology, South China University of Technology(华南理工大学未来技术学院) School of Computer Science and Engineering, South China University of Technology(华南理工大学计算机科学与工程学院) School of Engineering and Computer Science, Victoria University of Wellington(惠灵顿维多利亚大学工程与计算机科学学院) Institute of Marine Science and Technology, Shandong University(山东大学海洋科学与技术研究院) School of Computing and Information Systems, Singapore Management University(新加坡管理大学计算与信息系统学院)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究针对多任务车辆路径规划求解器中VRP变体优化难度不同及现有方法不足的问题,提出LaT训练范式,用预训练大语言模型作外部训练器,定期分析指标生成指导向量注入编码器层,实验证明该范式能提升求解器质量。

Comments 28 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03695 2026-07-07 cs.LG 新提交 87%

Social Networks of LLM Agents

大语言模型智能体的社交网络

Kaixuan Liu, Guojun Xiong, Weinan Zhang, Shengpu Tang

机构 * Department of Computer Science(计算机科学系) Emory University(埃默里大学) School of Computer Science(计算机科学学院) Shanghai Jiao Tong University(上海交通大学)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究大语言模型智能体群体中集体信念形成问题,介绍SNLA框架,该框架考虑智能体实际影响力,理论与实证验证窄注意力导致羊群效应,宽注意力在特定条件下恢复群体智慧行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03414 2026-07-07 cs.CL 新提交 87%

The Classics at SemEval-2026 Task 3: Combining Transformer Models and LLM-Generated Annotations for Dimensional Aspect-Based Sentiment Analysis

2026年语义评价任务3中的经典方法:结合变压器模型和大语言模型生成的注释进行维度方面的情感分析

Rafif Alshawi, Amit Raj, Aleksey Kudelya, Alexander Shirnin

机构 * HSE University(俄罗斯高等经济研究大学)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究超越传统分类情感,预测情感“效价”和“唤醒”细粒度实值分数的方法。回归任务用基于变压器的编码器模型加权集成,俄语用大语言模型增强输入,提取任务微调解码器大语言模型进行结构化预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24163 2026-06-24 cs.CR cs.CL 新提交 87%

CORE-BREW: LLR-Based Soft Decoding for Robust Multi-Bit LLM Watermarking

CORE-BREW:基于LLR的软解码用于鲁棒多比特LLM水印

Joeun Kim, HoEun Kim, Young-Sik Kim

机构 * Department of AI DGIST(人工智能系DGIST)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.CL

AI总结 提出CORE-BREW方法,通过固定命中率校准水印信道并计算逐token对数似然比,实现软解码,在保持语义质量的同时提升多比特水印在编辑攻击下的低FPR区分性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22698 2026-06-23 cs.CR cs.CL 新提交 87%

Black-Box Forensics for Conversational LLM Agents

对话式LLM代理的黑盒取证

Isadora White, Yasaman Jafari, Taylor Berg-Kirkpatrick

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.CL

AI总结 研究通过非对抗对话识别对话代理的基座模型(归因)和系统提示(指纹识别),归因准确率达98%,指纹识别对未见提示的AUC达0.943。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21409 2026-06-23 cs.AI 新提交 87%

Don't Blindly Trust It: How Unreliable Feedback Breaks Tool-Using LLM Agents

不要盲目信任:不可靠反馈如何破坏使用工具的LLM智能体

Chubin Zhang, Zhenglin Wan, Xingrui Yu, Pengfei Zhou, Wangbo Zhao, Jingxuan Wu, Yaxin Zhou, Ivor Tsang

机构 * Nanyang Technological University(南洋理工大学) National University of Singapore(新加坡国立大学) CFAR Agency for Science Technology and Research(新加坡科技研究局计算与推理中心) IHPC Agency for Science Technology and Research(新加坡科技研究局高性能计算研究所) Department of Statistics and Operations Research UNC-Chapel Hill(北卡罗来纳大学教堂山分校统计与运筹学系) Carnegie Mellon University(卡内基梅隆大学)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 研究不可靠反馈对工具增强型LLM智能体的影响,通过匹配循环对比实验发现,误导性反馈会导致价值反转,使智能体表现低于无反馈基线,并强调无反馈回退控制对评估的必要性。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15092 2026-06-16 cs.LG 新提交 87%

High-Dimensional Random Projection for Activation Steering in Language Models

高维随机投影用于语言模型中的激活引导

Minh-Hieu Pham, Bach Do, Laziz Abdullaev, Tan Minh Nguyen, Khoat Than

机构 * Hanoi University of Science and Technology(河内科技大学) National University of Singapore(新加坡国立大学)

专题命中 其他LLM :language model(title,abstract);LLM(abstract,abstract_cn);large language model(abstract);分类 cs.LG

AI总结 针对现有激活引导方法仅捕捉均值差异的局限,提出无训练的高维随机投影激活引导方法(HiDRA),通过在投影高维空间中进行激活加法,捕获非线性特征子空间中的判别信号,实验证明其优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15052 2026-06-16 cs.AR cs.AI 新提交 87%

PANDA: An LLM-Enhanced Performance-Driven Analog Design Framework Bridging Design Intent and Layout Generation

PANDA:一种LLM增强的性能驱动模拟设计框架,弥合设计意图与版图生成

Haoyi Zhang, Weijian Fan, Xiaohan Gao, Bingyang Liu, Runsheng Wang, Yibo Lin

机构 * School of Integrated Circuits, Peking University(集成电路学院,北京大学) Beijing Advanced Innovation Center for Integrated Circuits(北京集成电路先进创新中心) Institute of Electronic Design Automation, Peking University(电子设计自动化研究所,北京大学)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 提出PANDA框架,利用大语言模型将高层设计意图转化为最终版图,通过引导拓扑综合、子结构感知尺寸优化和约束驱动版图生成,实现跨阶段协同设计,将设计周期从数天/周缩短至数小时并提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14314 2026-06-15 cs.AI 新提交 87%

Communication Policy Evolution for Proactive LLM Agents

主动式LLM智能体的通信策略演化

Xinbei Ma, Jiyang Qiu, Yao Yao, Zheng Wu, Yijie Lu, Xiangmou Qu, Jiaxin Yin, Xingyu Lou, Jun Wang, Weiwen Liu, Weinan Zhang, Zhuosheng Zhang, Hai Zhao

机构 * Shanghai Jiao Tong University(上海交通大学) OPPO Research Institute(OPPO研究院)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 针对用户与智能体间信息不对称问题,形式化通信策略,提出基于文本和UI的策略,并引入自演化框架CPE,通过提示优化提升任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12474 2026-06-12 cs.MA cs.AI cs.CR 新提交 87%

SAIGuard: Communication-State Simulation for Proactive Defense of LLM Multi-Agent Systems

SAIGuard: 面向LLM多智能体系统主动防御的通信状态模拟

Ruxue Shi, Yili Wang, Mengnan Du, Qinggang Zhang, Rui Miao, Yixin Liu, Xin Wang

机构 * School of Artificial Intelligence, Jilin University(吉林大学人工智能学院) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) School of Information and Communication Technology, Griffith University(格里菲斯大学信息与通信技术学院)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 提出SAIGuard主动防御框架,通过通信状态模拟检测并净化风险消息,降低攻击成功率并保持系统效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12073 2026-06-11 cs.SI cs.AI 新提交 87%

"That's AI Slop, You Bot!" Studying Accusations, Evidence, and Credibility in Online Discourse Towards LLM-Generated Comments

“那就是AI垃圾,你这个机器人!”:研究针对LLM生成评论的指责、证据与可信度

Jason Miklian, John E. Katsos

机构 * University of Oslo(奥斯陆大学) American University of Sharjah(沙迦美国大学)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 分析2023-2026年Hacker News和Reddit上2500万条评论,发现对AI生成文本的指责增长超十倍,但被指责的文本并非真正由AI生成,而是基于感知真实性的社会把关行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09315 2026-06-09 cs.CR cs.AI 新提交 87%

Brain-Prompt Injection: A Route-Safety Audit for BCI-LLM Agents

脑提示注入:BCI-LLM代理的路径安全审计

Jianwei Tai

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 提出路径安全审计契约,通过分离定理和共形校准量化BCI-LLM代理中脑信号注入攻击的风险,实验证明确认通道可降低路由风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08262 2026-06-09 cs.LG 新提交 87%

Causal Semantic Alignment for LLM-based Time Series Forecasting

基于大语言模型的时间序列预测的因果语义对齐

Kexuan Zhang, Xiaobei Zou, Cesare Alippi, Gary G. Yen, Yang Tang

机构 * University of Science and Technology of China(中国科学技术大学) University of California, Berkeley(加州大学伯克利分校)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 提出CVAformer框架,通过因果干预解耦变量中的动态和不变成分,消除对齐中的混杂偏差,在多种预测场景下达到或超越最先进性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07837 2026-06-09 cs.HC cs.AI 新提交 87%

Does Persona Make LLMs K-pop Fans? A Pilot Study of LLM-Based Online Concert Audience Agents

角色设定会让LLM成为K-pop粉丝吗?基于LLM的在线演唱会观众智能体初步研究

Kirak Kim, Hyojin Kim, Yejin Son, Sungyoung Kim, Kyung Myun Lee

机构 * Graduate School of Culture Technology, KAIST, Daejeon, South Korea(韩国成均馆大学文化科技研究生院) Department of Artificial Intelligence, Yonsei University, Seoul, South Korea(延世大学人工智能系)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 研究通过多智能体系统模拟K-pop演唱会实时粉丝聊天,发现角色设定能提升聊天质量和自然度,但未增强社交连接或情感反应,表明有意义的集体体验需更深层次对齐。

Comments Accepted at the ICML 2026 Workshop on Culture x AI: Evaluating AI as a Cultural Technology

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07444 2026-07-09 cs.ET 新提交 87%

LLM Assisted Verification Assertion Generation: Challenges and Future Directions

大语言模型辅助验证断言生成:挑战与未来方向

Bhabesh Mali, Chandan Karfa

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 探讨基于大语言模型辅助验证断言生成的挑战与未来方向,研究如何从设计规范生成 SystemVerilog 断言,提出核心问题并给出解决挑战的指导方针,以实现系统化、质量可控的断言生成。

Comments The paper contains a series of guidelines to generate SystemVerilog assertions using LLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07023 2026-08-10 cs.CL cs.AI 新提交 87%

An Agentic Hybrid Top-Down and Bottom-Up Approach to Knowledge Graph Generation

一种用于知识图谱生成的智能体式混合自顶向下与自底向上方法

Emma Jouffroy, Warren Jouanneau, Marc Palyart

机构 * Malt

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 针对HR平台的多语言非标准化技能声明问题,提出结合LLM与Wikidata KG的智能体式混合KG生成流水线,可生成可扩展可解释的技能KG。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11817 2026-06-11 cs.CR cs.AI cs.CL cs.SE 新提交 87%

Grammar-Constrained Decoding Can Jailbreak LLMs into Generating Malicious Code

语法约束解码可诱使大语言模型生成恶意代码

Yitong Zhang, Shiteng Lu, Jia Li

机构 * College of AI, Tsinghua University(清华大学人工智能学院)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文发现语法约束解码(GCD)可被利用发起名为CodeSpear的越狱攻击,使LLM生成恶意代码;并提出安全对齐方法CodeShield,通过生成蜜罐代码防御该攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10262 2026-08-12 cs.MA 新提交 87%

Not a Monolith: Lab-Level Divergence in the Cooperative Equilibria of Chinese Frontier LLM Agents

并非单一整体:中国前沿大语言模型智能体合作均衡的实验室层面差异

Francisco León Zúñiga Bolívar

专题命中 其他LLM :LLM(title,summary_cn)

AI总结 该研究以四款中国前沿LLM智能体为对象,消除混淆因素后发现,合作倾向的设定单位是实验室,中国模型并非单一整体,且生态系统内差异大于东西差异。

Comments 9 pages, 8 tables. Companion study to arXiv:2605.29874, under a fixed-converter design. Code and replication package: https://github.com/arqFranciscoLeon/evollm (archived: https://doi.org/10.5281/zenodo.20248614)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04741 2026-08-06 cs.CR 新提交 87%

LoginTrap: Uncovering Task-Agnostic Phishing-Style Indirect Prompt Injection Attacks against LLM-based Web Agents

LoginTrap:针对基于大语言模型的Web智能体的任务无关型钓鱼式间接提示注入攻击的发现

Longtao Guo, Zelin Zhang, Kaifeng Huang, Yang Shi

专题命中 其他LLM :LLM(title,summary_cn)

AI总结 该研究提出LoginTrap攻击,是针对基于LLM的Web智能体的任务无关型登录诱导攻击,在黑盒威胁模型下可达到86%的平均端到端攻击成功率,揭示了登录诱导的认证边界风险并推动相关防御研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02283 2026-08-04 cs.HC cs.MM 新提交 87%

Embodied Empathy: A Multimodal AR and LLM-Powered System for Self-Attachment Psychotherapy with Self-Initiated Humour

具身共情:一种用于自我依恋心理治疗的多模态AR与大语言模型驱动系统,结合自发起幽默协议

Xinyan Ye, Gwyneth Phang, Anandha Gopalan, Abbas Edalat

专题命中 其他LLM :LLM(title,summary_cn)

AI总结 该研究针对心理健康从业者供给不足的问题,开发结合SIHP与SAT的多模态AR及LLM系统,经8天16人研究验证其可行性,可改善情绪并转变用户对AI对话工具的期望。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07604 2026-07-09 cond-mat.mtrl-sci 新提交 87%

Human and LLM Collaboration for Accelerated Materials Synthesis and Discovery

人类与大语言模型协作加速材料合成与发现

Gregory Bassen, Wyatt Bunstine, Sarah Okandey, Sarah Cheung, Elaine Flowers, Ritwik Bose, Joshua Hummel, Christopher D. Stiles, Maxime A. Siegler, Tyrel M. McQueen

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 研究新材料发现速度滞后问题,通过人类与大语言模型协作生成材料合成配方,经实验确定成功率,发现二者成功率相似,并借此发现了具有新结构原型的材料Ba3PtO5。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02583 2026-07-07 cs.SE 新提交 87%

Better Together, in the Right Order: Classical-then-LLM Optimization for SE

更好地协同,以正确顺序:用于软件工程的经典方法后接大语言模型优化

Srinath Srinivasan, Tim Menzies

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 研究将经典优化器与大语言模型结合用于软件工程配置任务,提出反向方法SNAP2,即先用廉价经典学习者结果为大语言模型播种,该方法效果最佳且成本低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21979 2026-06-23 cs.SD 新提交 87%

Toward Open-Set Speaker Attribute Prediction with Keyword-Appended LLM Embeddings

面向开放集说话人属性预测的关键词附加大语言模型嵌入

Byoungjun So, Jaejun Lee, Kyogu Lee

机构 * Department of Intelligence and Information, Seoul National University(首尔大学情报信息学系) Interdisciplinary Program in Artificial Intelligence, Seoul National University(首尔大学人工智能跨学科项目) Artificial Intelligence Institute, Seoul National University(首尔大学人工智能研究所)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 提出利用大语言模型嵌入进行开放集说话人属性预测,通过关键词附加策略和top-k负损失,在LibriTTS-P上超越闭集基准并泛化到未见同义词。

Comments This paper has been accepted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏