arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-02-06 至 2026-02-06 共收录 11 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 11 篇

2510.08859 2026-02-06 cs.CL cs.AI cs.CR 90%

Pattern Enhanced Multi-Turn Jailbreaking: Exploiting Structural Vulnerabilities in Large Language Models

模式增强的多轮劫持:在大语言模型中利用结构漏洞

Ragib Amin Nihal, Rui Wen, Kazuhiro Nakadai, Jun Sakuma

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

AI总结 本文提出PE-CoA框架,通过五个对话模式构建多轮劫持攻击,揭示了大语言模型在不同危害类别下的漏洞及防御局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03969 2026-02-06 cs.AI cs.CR cs.LG 86%

How Catastrophic is Your LLM? Certifying Risk in Conversation

你的LLM有多危险?对话中风险的认证

Chengxiao Wang, Isha Chaudhary, Qian Hu, Weitong Ruan, Rahul Gupta, Gagandeep Singh

机构 * University of Illinois, Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出C$^3$LLM框架,通过统计方法认证LLMs在多轮对话中的灾难性风险,揭示前沿模型中高达70%的潜在风险,强调改进安全训练的必要性。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05864 2026-02-06 cs.HC 86%

Prompting Destiny: Negotiating Socialization and Growth in an LLM-Mediated Speculative Gameworld

提示命运:在LLM中介的推测游戏世界中协商社会化与成长

Mandi Yang, Zhiqi Gao, Yibo Meng, Dongyijie Primo Pan

专题命中 其他LLM :LLM(title,abstract);prompting(title)

AI总结 本文提出了一款LLM中介的推测游戏,通过四季结构探讨社会化过程中道德责任与教育角色定位的反思机制,揭示了开放性表达与持续参与间的张力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05877 2026-02-06 cs.AI cs.HC 85%

Agent2Agent Threats in Safety-Critical LLM Assistants: A Human-Centric Taxonomy

安全关键型LLM助手中的Agent2Agent威胁:以人为中心的分类

Lukas Stappen, Ahmet Erkan Turan, Johann Hagerer, Georg Groh

机构 * BMW Group Research(宝马集团研究) Technical University Munich(慕尼黑技术大学)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出AgentHeLLM框架,通过分离资产识别与攻击路径分析,为安全关键型LLM助手提供以人为中心的威胁建模方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03999 2026-02-06 cs.CL 85%

LH-Deception: Simulating and Understanding LLM Deceptive Behaviors in Long-Horizon Interactions

LH-Deception:模拟和理解长周期交互中大语言模型的欺骗行为

Yang Xu, Xuanming Zhang, Samuel Yeh, Jwala Dhamala, Ousmane Dia, Rahul Gupta, Sharon Li

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Zhejiang University(浙江大学) Amazon AGI(亚马逊人工智能研究院)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 LH-Deception通过多智能体系统模拟长周期交互中的LLM欺骗行为,揭示欺骗的模型依赖性和对信任的侵蚀,为真实场景下的LLM评估提供基础。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05987 2026-02-06 cs.HC 85%

From Human-Human Collaboration to Human-Agent Collaboration: A Vision, Design Philosophy, and an Empirical Framework for Achieving Successful Partnerships Between Humans and LLM Agents

从人与人协作到人与智能体协作:一种愿景、设计哲学和实现人与LLM智能体成功合作的实证框架

Bingsheng Yao, Chaoran Chen, April Yi Wang, Sherry Tongshuang Wu, Toby Jia-jun Li, Dakuo Wang

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出通过借鉴远程人类协作的研究来设计和研究人与LLM智能体的合作,建立新的协作范式和研究议程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07053 2026-02-06 cs.CL cs.SD eess.AS 83%

TASTE: Text-Aligned Speech Tokenization and Embedding for Spoken Language Modeling

TASTE: 用于语音语言建模的文本对齐语音标记化与嵌入

Liang-Hsuan Tseng, Yi-Chang Chen, Kuan-Yi Lee, Da-Shan Shiu, Hung-yi Lee

机构 * MediaTek Research(联发科技研究) Graduate Institute of Communication Engineering, National Taiwan University(国立台湾大学通信工程研究所) Artificial Intelligence Center of Research Excellence, National Taiwan University(国立台湾大学卓越人工智能研究中心)

专题命中 其他LLM :language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 TASTE通过语音重建目标实现文本对齐的语音标记化与嵌入,提升语音语言建模的性能。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05998 2026-02-06 cs.CV 67%

VisRefiner: Learning from Visual Differences for Screenshot-to-Code Generation

VisRefiner: 从视觉差异中学习以实现截图到代码生成

Jie Deng, Kaichun Yao, Libo Zhang

机构 * Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 VisRefiner通过学习视觉差异提升截图到代码生成的准确性和自我完善能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04104 2026-02-06 cs.HC 67%

Making Videos Accessible for Blind and Low Vision Users Using a Multimodal Agent Video Player

通过多模态代理视频播放器使视频对视障和低视力用户更加可访问

Adriana Olmos, Anoop K. Sinha, Renelito Delos Santos, Ruben Rodriguez Rodriguez, James A. Landay, Sam S. Sepah, Philip Nelson, Shaun K. Kane

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文提出一种多模态代理视频播放器,通过多层提示编排为视障和低视力用户带来交互式、可访问的视频体验,增强用户自主性和信任感。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05769 2026-02-06 cs.CL 57%

Different Time, Different Language: Revisiting the Bias Against Non-Native Speakers in GPT Detectors

不同时区,不同语言:重新审视GPT检测器对非母语者的偏见

Adnan Al Ali, Jindřich Helcl, Jindřich Libovický

机构 * Charles University, Faculty of Mathematics and Physics(查理大学数学与物理系) University of Oslo, Language Technology Group(奥斯陆大学语言技术组)

专题命中 其他LLM :LLM(abstract);分类 cs.CL

AI总结 该研究重新审视了GPT检测器对非母语者的偏见问题,发现非母语者的文本困惑度不低,并且现代检测器无需依赖困惑度即可有效工作。

Comments This paper was accepted to EACL 2026 Student Research Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05035 2026-02-06 cs.CL 57%

Capacity Constraints and the Multilingual Penalty for Lexical Disambiguation

多语言限制与词义消歧的多语言惩罚

Sean Trott, Pamela D. Rivière

机构 * Rutgers University - Newark(罗格斯大学-纽瓦克)

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 本研究发现多语言语言模型在词义消歧任务中面临容量限制,包括表示性、注意性和词汇相关性问题,这些因素影响了模型性能。

Comments 9 pages, 5 figures, conference

详情

展开后加载摘要…

URL PDF HTML 收藏