arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-02-20 至 2026-02-20 共收录 15 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 15 篇

2511.18696 2026-02-20 cs.CL cs.AI 92%

Empathetic Cascading Networks: A Multi-Stage Prompting Technique for Reducing Social Biases in Large Language Models

共情级联网络:一种减少大型语言模型社会偏见的多阶段提示技术

Wangjiaxuan Xin

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);prompting(title,abstract);分类 cs.CL、cs.AI

AI总结 ECN通过多阶段提示技术减少大型语言模型的社会偏见,提升对话AI的共情与包容性。

Comments Further revision on experiments and pipeline design

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13469 2026-02-20 cs.HC cs.AI 88%

How Multimodal Large Language Models Support Access to Visual Information: A Diary Study With Blind and Low Vision People

多模态大语言模型如何支持视障人士获取视觉信息:一项与盲人和低视力人士的日记研究

Ricardo E. Gonzalez Penuela, Crescentia Jung, Sharon Y Lin, Ruiying Hu, Shiri Azenkot

机构 * Cornell University(康奈尔大学)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本研究探讨了多模态大语言模型如何通过视觉助手技能支持视障人士获取视觉信息,并发现其在实际应用中的表现及改进方向。

Comments 24 pages, 17 figures, 7 tables, appendix section, to appear main track CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17481 2026-02-20 cs.HC 85%

ShadAR: LLM-driven shader generation to transform visual perception in Augmented Reality

ShadAR: 基于大语言模型的着色器生成以在增强现实中转变视觉感知

Yanni Mei, Samuel Wendt, Florian Mueller, Jan Gugenheimer

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 ShadAR利用大语言模型生成着色器,实现增强现实中的视觉感知实时转变,提升包容性和创造性。

Journal ref 2025 IEEE International Symposium on Mixed and Augmented Reality Adjunct (ISMAR-Adjunct), Daejeon, Korea, Republic of, 2025, pp. 959-960

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17483 2026-02-20 cs.HC cs.AI cs.CL cs.CY 79%

What Do LLMs Associate with Your Name? A Human-Centered Black-Box Audit of Personal Data

LLMs与你的名字关联什么?对个人数据的人本黑盒审计

Dimitri Staufer, Kirsten Morehouse

机构 * Columbia University(哥伦比亚大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究通过LMP2工具审计LLMs对个人数据的关联,发现模型能准确生成用户特征,引发对数据隐私权在LLMs中的适用性讨论。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17293 2026-02-20 cs.CY 75%

Human attribution of empathic behaviour to AI systems

人类将共情行为归因于人工智能系统

Jonas Festor, Ivo Snels, Bennett Kleinberg

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 研究探讨了人类和AI生成建议在共情感知上的差异,发现LLM生成内容在共情方面表现更优,但作者标签对情感共情影响有限。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09201 2026-02-20 cs.LG cs.AI cs.CL 75%

Multimodal Prompt Optimization: Why Not Leverage Multiple Modalities for MLLMs

多模态提示优化:为何不利用多种模态为大语言模型服务

Yumin Choi, Dongki Kim, Jinheon Baek, Sung Ju Hwang

机构 * KAIST(韩国科学技术院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出多模态提示优化问题,提出MPO框架,通过联合优化和贝叶斯策略提升多模态提示效果,验证其在图像、视频等多模态任务中的优越性。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16997 2026-02-20 cs.SE cs.AI cs.CL 73%

Exploring LLMs for User Story Extraction from Mockups

探索LLMs用于从mockups中提取用户故事

Diego Firmenich, Leandro Antonelli, Bruno Pazos, Fabricio Lozada, Leonardo Morales

机构 * Departamento de Informática, Facultad de Ingeniería, Universidad Nacional de la Patagonia, Argentina(阿根廷国立巴塔哥尼亚大学计算机系) LIFIA, Facultad de Informática, Universidad Nacional de La Plata, Argentina(阿根廷国立拉普拉塔大学计算机学院) CAETI, Facultad de Tecnología Informática - Universidad Abierta Interamericana(拉丁美洲开放大学信息技术学院) Laboratorio de Ciencias de la Imágenes, DIEC, UNS(图像科学实验室) Instituto Patagónico de Ciencias Sociales y Humanas, CONICET-CENPAT(巴塔哥尼亚社会科学与人类科学研究所) UNIANDES, Universidad Regional Autónoma de los Andes, Ecuador(厄瓜多尔安第斯地区自治大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文探讨了利用LLMs结合LEL从mockups中自动提取用户故事,提升了生成准确性与适用性,推动AI在需求工程中的应用。

Comments 14 pages, 6 figures. Preprint of the paper published in the 28th Workshop on Requirements Engineering (WER 2025)

Journal ref Proceedings of the 28th Workshop on Requirements Engineering (WER2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17645 2026-02-20 cs.LG cs.AI cs.CL cs.CV 67%

Pushing the Frontier of Black-Box LVLM Attacks via Fine-Grained Detail Targeting

通过细粒度细节靶向推动大视觉-语言模型攻击的前沿

Xiaohan Zhao, Zhaoyi Li, Yaxin Luo, Jiacheng Cui, Zhiqiang Shen

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 通过细粒度细节靶向改进M-Attack,显著提升黑盒攻击效果,成功率达100%

Comments Code at: https://github.com/vila-lab/M-Attack-V2

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17526 2026-02-20 cs.LG cs.AI cs.CL 67%

The Anxiety of Influence: Bloom Filters in Transformer Attention Heads

影响的焦虑:变换器注意力头中的布洛姆过滤器

Peter Balogh

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究发现变换器注意力头中存在布洛姆过滤器功能,通过成员测试策略实现高效重复标记识别,且误报率随嵌入距离降低而减少。

Comments 13 pages, 8 figures, code at https://github.com/pbalogh/anxiety-of-influence v2: L3H0 reclassified as prefix-attention head following confound control. Capacity analysis updated. Duplicate-token head overlap experiment added v3: All experiments were independently validated on CPU to rule out hardware-specific computation artifacts. Results are consistent across backends

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16819 2026-02-20 cs.SE cs.CL cs.LG 62%

Hybrid-Gym: Training Coding Agents to Generalize Across Tasks

Hybrid-Gym: 训练能够跨任务泛化的编码代理

Yiqing Xie, Emmy Liu, Gaokai Zhang, Nachiket Kotalwar, Shubham Gandhi, Sathwik Acharya, Xingyao Wang, Carolyn Rose, Graham Neubig, Daniel Fried

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.LG

AI总结 Hybrid-Gym通过设计合成任务训练编码代理,提升其跨任务泛化能力,在多个基准测试中取得显著效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16444 2026-02-20 cs.RO cs.AI cs.LG 62%

RoboGene: Boosting VLA Pre-training via Diversity-Driven Agentic Framework for Real-World Task Generation

RoboGene: 通过多样性驱动的代理框架提升VLA预训练以生成现实任务

Yixue Zhang, Kun Wu, Zhi Gao, Zhen Zhao, Pei Ren, Zhiyuan Xu, Fei Liao, Xinhua Wang, Shichao Fan, Di Wu, Qiuxuan Feng, Meng Li, Zhengping Che, Chang Liu, Jian Tang

机构 * Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心) The School of Advanced Manufacturing and Robotics, Peking University(北京大学先进制造与机器人学院) Beijing Institute of Technology(北京理工大学) The School of Mechanical Engineering and Automation, Beihang University(北航机械工程与自动化学院) State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学多媒体信息处理国家重点实验室)

专题命中 其他LLM :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 RoboGene通过多样性驱动的代理框架生成多样化、物理合理的机器人操作任务,提升VLA预训练效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17654 2026-02-20 cs.IR cs.LG 57%

Mine and Refine: Optimizing Graded Relevance in E-commerce Search Retrieval

挖掘与精炼:优化电子商务搜索检索中的分级相关性

Jiaqi Xi, Raghav Saboo, Luming Chen, Martin Wang, Sudeep Das

机构 * DoorDash Inc.(DoorDash公司)

专题命中 其他LLM :LLM(abstract);分类 cs.LG

AI总结 本文提出一种两阶段框架,通过挖掘和精炼提升电子商务搜索检索的分级相关性,结合对比学习和多类圆损失优化嵌入空间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02973 2026-02-20 cs.CL 57%

A Bayesian account of pronoun and neopronoun acquisition

关于代词和新代词获取的贝叶斯视角

Cassandra L. Jacobs, Morgan Grobol

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 本文提出基于nCRFP的概率图模型,用于建模代词和新代词的灵活获取,以实现对queer人群的尊重与灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13065 2026-02-20 cond-mat.mtrl-sci 50%

Mystery of the 175 cm$^{-1}$ Raman Mode in MnTe Altermagnet

MnTe铁磁体中175 cm$^{-1}$拉曼模式之谜

Bishal Thapa, K. D. Belashchenko, Igor I. Mazin

专题命中 其他LLM :prompting(abstract)

AI总结 MnTe中175 cm$^{-1}$拉曼模式被证实为由空穴自掺杂引发的等离子体激发,而非原先认为的声子。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17018 2026-02-20 cs.SE 50%

Not Only for Developers: Exploring Plugin Maintenance for Knowledge-Centric Communities

不仅仅为开发者:探索知识导向社区的插件维护

Giovanni Rosa, David Moreno-Lumbreras, Raula Gaikovina Kula

专题命中 其他LLM :LLM(abstract)

AI总结 研究探讨了非开发者主导社区中插件生态系统的维护,通过分析Obsidian平台的插件发现六个知识管理相关主题,并揭示了其工程结构和可持续性问题。

Comments Accepted to SANER2026

详情

展开后加载摘要…

URL PDF HTML 收藏