arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-02-05 至 2026-02-05 共收录 223 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 15 篇

2505.17440 2026-02-05 cs.CV 85%

VEAttack: Downstream-agnostic Vision Encoder Attack against Large Vision Language Models

VEAttack: 面向大视觉语言模型的下游任务无关视觉编码器攻击

Hefei Mei, Zirui Wang, Shen You, Minjing Dong, Chang Xu

机构 * City University of Hong Kong(香港城市大学) University of Sydney(悉尼大学)

专题命中 其他LLM :language model(title,abstract);LLM(abstract);large language model(abstract)

AI总结 VEAttack是一种针对大视觉语言模型视觉编码器的简单有效攻击方法,通过优化图像令牌降低计算开销,实现对多种下游任务的泛化攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21752 2026-02-05 cs.CL cs.AI 84%

Semantics as a Shield: Label Disguise Defense (LDD) against Prompt Injection in LLM Sentiment Classification

语义作为盾牌:对抗大语言模型情感分类中提示注入的标签伪装防御(LDD)

Yanxi Li, Ruocheng Shan

机构 * Department of Computer Science, George Washington University(计算机科学系,乔治华盛顿大学)

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出LDD,一种通过语义伪装标签来防御大语言模型情感分类中提示注入攻击的方法,展示了其在不同模型上的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22208 2026-02-05 cs.CL cs.CV cs.LG 79%

Open-Source Multimodal Moxin Models with Moxin-VLM and Moxin-VLA

开源多模态Moxin模型:Moxin-VLM和Moxin-VLA

Pu Zhao, Arash Akbari, Xuan Shen, Zhenglun Kong, Yixin Shen, Sung-En Chang, Timothy Rupprecht, Lei Lu, Enfu Nan, Changdi Yang, Yumei He, Weiyan Shi, Xingchen Xu, Yu Huang, Wei Jiang, Wei Wang, Yue Chen, Yong He, Yanzhi Wang

机构 * Northeastern University(东北大学) Harvard University(哈佛大学) Cornell University(康奈尔大学) Tulane University(路易斯安那州立大学) University of Washington(华盛顿大学) Futurewei(未来通信) AIBAO LLC

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出开源多模态Moxin模型,通过Moxin-VLM、Moxin-VLA和Moxin-Chinese三种变体,提升视觉-语言、视觉-语言-动作及中文任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04726 2026-02-05 cs.SE cs.AI 77%

Supporting software engineering tasks with agentic AI: Demonstration on document retrieval and test scenario generation

用代理AI支持软件工程任务:文档检索与测试场景生成的演示

Marian Kica, Lukas Radosky, David Slivka, Karin Kubinova, Daniel Dovhun, Tomas Uhercik, Erik Bircak, Ivan Polasek

机构 * Gratex International(格拉特克斯国际) Department of Applied Informatics Faculty of Mathematics, Physics and Informatics Comenius University(应用信息学院数学、物理和信息学院康门ius大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出利用代理AI解决软件工程中的文档检索和测试场景生成问题,通过专用代理处理不同任务,提升软件开发效率。

Comments This is a preprint of a paper that was accepted at the International Conference on Artificial Intelligence, Computer, Data Sciences and Applications (ACDSA 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04489 2026-02-05 cs.CL 74%

Deconstructing sentence disambiguation by joint latent modeling of reading paradigms: LLM surprisal is not enough

通过联合潜在建模阅读范式解构句子消歧:LLM 惊喜值不足以解释

Dario Paape, Tal Linzen, Shravan Vasishth

机构 * Department of Linguistics, University of Potsdam(语言学系,波茨坦大学) Center for Data Science/Department of Linguistics, New York University(数据科学中心/语言学系,纽约大学)

专题命中 其他LLM :LLM(title);分类 cs.CL

AI总结 本文通过联合潜在建模阅读范式,提出了一种更准确的句子消歧模型,证明LLM的惊喜值不足以解释人类阅读行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04752 2026-02-05 cs.LG 70%

Decomposing Query-Key Feature Interactions Using Contrastive Covariances

通过对比协方差分解查询-键特征交互

Andrew Lee, Yonatan Belinkov, Fernanda Viégas, Martin Wattenberg

机构 * Harvard University(哈佛大学) Technion - Israel Institute of Technology(技术ion-以色列理工学院) Kempner Institute, Harvard University(凯普纳研究所,哈佛大学) Google DeepMind(谷歌DeepMind)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出通过对比协方差分解查询-键特征交互,以揭示Transformer中注意力机制的可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04570 2026-02-05 cs.CL 70%

Can LLMs capture stable human-generated sentence entropy measures?

大语言模型能否捕捉到稳定的人生成句子熵度量?

Estrella Pivel-Villanueva, Elisabeth Frederike Sterner, Franziska Knolle

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究通过实验证明大语言模型在捕捉人类生成句子熵方面的能力,发现GPT-4o与人类数据最一致,但LLMs无法完全替代稳定的人类分布。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04261 2026-02-05 cs.DB 67%

Data Agents: Levels, State of the Art, and Open Problems

数据代理:等级、现状与开放问题

Yuyu Luo, Guoliang Li, Ju Fan, Nan Tang

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文提出数据代理的分层分类体系,从无自主性到完全自主,探讨其现状、挑战及未来发展方向。

Journal ref SIGMOD 2026 Tutorial

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02388 2026-02-05 cs.CV cs.LG 57%

Personalized Image Generation via Human-in-the-loop Bayesian Optimization

通过人机协作的贝叶斯优化实现个性化图像生成

Rajalaxmi Rajagopalan, Debottam Dutta, Yu-Lin Wei, Romit Roy Choudhury

机构 * University of Illinois, Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 其他LLM :prompting(abstract);分类 cs.LG

AI总结 本文提出MultiBO方法,通过人类偏好反馈缩小生成图像与目标图像的差距,实现个性化图像生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01913 2026-02-05 cs.LG stat.ML 57%

Generalized Gradient Norm Clipping & Non-Euclidean $(L_0,L_1)$-Smoothness

广义梯度范数截断与非欧几里得$(L_0,L_1)$-平滑性

Thomas Pethick, Wanyun Xie, Mete Erdogan, Kimon Antonakopoulos, Antonio Silveti-Falls, Volkan Cevher

机构 * EPFL (LIONS)(苏黎世联邦理工学院(LIONS)) Université Paris-Saclay (CVN)(巴黎-萨克雷大学(CVN))

专题命中 其他LLM :language model(abstract);分类 cs.LG

AI总结 本文提出了一种结合最速下降与条件梯度的非欧几里得优化方法,通过广义$(L_0,L_1)$-平滑性实现梯度范数截断的扩展,并在深度学习中展示了其收敛性和应用效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04478 2026-02-05 cs.HC 50%

Informing Robot Wellbeing Coach Design through Longitudinal Analysis of Human-AI Dialogue

通过长期分析人机对话 informing 机器人幸福感教练设计

Keya Shah, Himanshi Lalwani, Zein Mukhanov, Hanan Salam

专题命中 其他LLM :LLM(abstract)

AI总结 本文通过分析长期人机对话数据,揭示用户与AI幸福感教练互动的动态模式,为设计支持用户自主性和伦理边界的新型机器人幸福感教练提供指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07673 2026-02-05 cs.HC 50%

Debugging Defective Visualizations: Empirical Insights Informing a Human-AI Co-Debugging System

调试缺陷可视化:经验洞察指导人机协同调试系统

Shuyu Shen, Sirong Lu, Leixian Shen, Yuyu Luo

专题命中 其他LLM :LLM(abstract)

AI总结 本文提出一种人机协同调试系统,结合LLM建议与论坛知识,有效解决可视化调试问题,解决率高达86%。

Comments 16 pages, 11 figures. Accepted to ACM CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04030 2026-02-05 cs.CV 50%

TiCLS : Tightly Coupled Language Text Spotter

TiCLS : 紧密耦合的语言文本定位器

Leeje Jang, Yijun Lin, Yao-Yi Chiang, Jerod Weinman

机构 * University of Minnesota(明尼苏达大学) Grinnell College(格林尼尔学院)

专题命中 其他LLM :language model(abstract)

AI总结 TiCLS通过整合字符级预训练语言模型的外部语言知识,实现了对模糊或碎片化文本的高效识别,验证了PLM引导的语言整合在场景文本定位中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏