arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12266 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12266 篇

2408.01285 2026-03-09 cs.CL cs.CY 70%

Do Prevalent Bias Metrics Capture Allocational Harms from LLMs?

流行的偏见度量标准是否能捕捉大语言模型造成的分配伤害?

Hannah Cyberey, Yangfeng Ji, David Evans

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文研究了现有偏见度量标准在评估大语言模型分配伤害时的可靠性,发现基于平均性能差距和分布距离的度量标准无法准确捕捉群体差异。

Comments Accepted to Workshop on Insights from Negative Results in NLP (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11432 2026-03-06 cs.CL 70%

The unreasonable effectiveness of pattern matching

模式匹配的不合理有效性

Gary Lupyan, Blaise Agüera y Arcas

机构 * Department of Psychology University of Wisconsin–Madison(心理学系 威斯康星大学麦迪逊分校) Paradigms of Intelligence Team Google(智能范式团队 谷歌)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 大型语言模型通过模式匹配有效理解随机替换实词的虚构文本,揭示了其在语言处理中的核心能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.11896 2026-03-04 cs.CL cs.CY 70%

Focal Inferential Infusion Coupled with Tractable Density Discrimination for Implicit Hate Detection

焦点推断注入结合可计算密度辨别用于隐含仇恨检测

Sarah Masud, Ashutosh Bajpai, Tanmoy Chakraborty

机构 * Indraprastha Institute of Information Technology(印度德里印度理工学院) Indian Institute of Technology Delhi(印度德里理工学院) Wipro Research(惠普研究)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 FiADD通过结合焦点推断和可计算密度辨别,提升隐含仇恨检测的准确性和泛化能力。

Comments 23 pages, 6 Figures, 9 Tables. Accepted at NLE

Journal ref Nat. lang. process. 31 (2025) 1323-1349

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02366 2026-03-04 cs.HC cs.AI 70%

PlayWrite: A Multimodal System for AI Supported Narrative Co-Authoring Through Play in XR

PlayWrite: 一种通过XR中的游戏化互动实现AI支持的叙事协作写作的多模态系统

Esen K. Tütüncü, Qian Zhou, Frederik Brudy, George Fitzmaurice, Fraser Anderson

机构 * Institute of Neurosciences of the University of Barcelona(巴塞罗那大学神经科学研究所) Autodesk Research(Autodesk研究)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 PlayWrite是一种通过XR中的游戏化互动实现AI支持的叙事协作写作的多模态系统,通过直接操控虚拟角色和道具,结合多智能体AI管道和大型语言模型,促进高度即兴和游戏化的创作过程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22903 2026-03-04 cs.IR cs.LG 70%

PSQE: A Theoretical-Practical Approach to Pseudo Seed Quality Enhancement for Unsupervised Multimodal Entity Alignment

PSQE:一种伪种子质量增强的理论-实践方法用于无监督多模态实体对齐

Yunpeng Hong, Chenyang Bu, Jie Zhang, Yi He, Di Wu, Xindong Wu

机构 * Key Laboratory of Knowledge Engineering with Big Data (the Ministry of Education of China), Hefei University of Technology(大数据知识工程重点实验室(教育部)、合肥工业大学) Department of Data Science, College of William and Mary(威廉与玛丽学院数据科学系) College of Computer and Information Science, Southwest University(西南大学计算机与信息科学学院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 PSQE通过多模态信息和聚类重采样提升伪种子质量,改善无监督多模态实体对齐的精度与图覆盖平衡性。

Comments 2026 SIGKDD Accept

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21910 2026-03-03 cs.LG 70%

Adversarial Déjà Vu: Jailbreak Dictionary Learning for Stronger Generalization to Unseen Attacks

对抗性 déjà vu:用于更强泛化到未见攻击的 jailbreak 字典学习

Mahavir Dabas, Tran Huynh, Nikhil Reddy Billa, Jiachen T. Wang, Peng Gao, Charith Peris, Yao Ma, Rahul Gupta, Ming Jin, Prateek Mittal, Ruoxi Jia

机构 * Virginia Tech(弗吉尼亚理工大学) Princeton University(普林斯顿大学) Amazon AGI(亚马逊人工智能研究院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出通过对抗性技能组合训练提升模型对未知攻击的鲁棒性,通过分析攻击论文发现新型攻击是旧技能的重新组合,从而改进安全防御。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19025 2026-03-03 cs.DB cs.CL 70%

SQUiD: Synthesizing Relational Databases from Unstructured Text

从无结构文本合成关系数据库

Mushtari Sadia, Zhenning Yang, Yunming Xiao, Ang Chen, Amrita Roy Chowdhury

机构 * University of Michigan(密歇根大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 SQUiD通过神经符号框架从无结构文本自动合成关系数据库,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.17489 2026-03-03 cs.HC cs.AI 70%

Neural Spelling: A Spell-Based BCI System for Language Neural Decoding

神经拼写:一种基于拼写的BCI系统用于语言神经解码

Xiaowei Jiang, Charles Zhou, Yiqun Duan, Ziyi Zhao, Thomas Do, Chin-Teng Lin

机构 * Brain Computer Interface Lab, School of Computer Science, Faculty of Engineering Information Technology, University of Technology Sydney

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一种基于EEG的BCI系统,结合课程神经拼写框架和生成式AI,实现高准确率的字母识别和文本生成,提升残障人士的交流能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23547 2026-03-02 cs.CL 70%

France or Spain or Germany or France: A Neural Account of Non-Redundant Redundant Disjunctions

法国或西班牙或德国或法国:对非冗余冗余析取的神经账户

Sasha Boguraev, Qing Yao, Kyle Mahowald

机构 * Department of Linguistics The University of Texas at Austin(语言学系德克萨斯大学奥斯汀分校)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文通过神经机制解释了非冗余冗余析取现象,揭示了上下文敏感语义解释的机制,并补充了现有符号分析。

Comments 7 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21936 2026-02-27 cs.LG cond-mat.dis-nn 70%

Statistical Advantage of Softmax Attention: Insights from Single-Location Regression

Softmax 注意力的统计优势:来自单位置回归的见解

O. Duranthon, P. Marion, C. Boyer, B. Loureiro, L. Zdeborová

机构 * Institute of Mathematics, EPFL(EPFL数学研究所) Statistical Physics of Computation Laboratory, École Polytechnique Fédérale de Lausanne(计算统计物理实验室,瑞士联邦理工学院) Inria, École Normale Supérieure, PSL Research University(Inria,巴黎高等师范学院,PSL研究大学) Laboratoire de Mathématiques d’Orsay, Université Paris Saclay and Institut Universitaire de France(奥赛数学实验室,巴黎萨克雷大学及法国国家科学院) Departement d’Informatique, École Normale Supérieure, PSL & CNRS(信息科学系,巴黎高等师范学院,PSL与CNRS)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文研究了softmax注意力在单位置回归任务中的统计优势,证明其在高维极限下能实现贝叶斯风险,优于线性注意力,并探讨了其他激活函数的性能特性。

Comments Accepted at the ICLR 2026

Journal ref ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22529 2026-02-27 cs.IR cs.AI cs.DL 70%

Generative Agents Navigating Digital Libraries

生成代理在数字图书馆中的导航

Saber Zerhoudi, Michael Granitzer

机构 * University of Passau(帕绍大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 Agent4DL通过生成逼真的用户行为模拟,解决数字图书馆中用户搜索数据稀缺的问题,其在生成多样化和语境感知的用户行为方面表现优异。

Journal ref Proceedings of the 26th International Conference on Asia-Pacific Digital Libraries, ICADL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21939 2026-02-26 cs.CY cs.AI 70%

Hidden Topics: Measuring Sensitive AI Beliefs with List Experiments

隐藏主题:通过列表实验测量敏感的AI信念

Maxim Chupilkin

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过列表实验揭示大型语言模型对监控、酷刑和核打击等敏感问题的潜在态度,验证了该方法在检测AI隐藏信念的有效性。

Comments 14 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.15929 2026-02-26 cs.CL 70%

Emergence of a phonological bias in ChatGPT

聊天机器人ChatGPT中元音偏见的出现

Juan Manuel Toro

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 ChatGPT表现出类似人类的辅音偏见,其在不同语言中均能识别单词,表明语言处理机制的相似性。

Comments 15 pages, 1 figure, corrected typo

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21082 2026-02-25 cs.CL 70%

Beyond the Star Rating: A Scalable Framework for Aspect-Based Sentiment Analysis Using LLMs and Text Classification

超越星级评分:一种基于LLMs和文本分类的可扩展的基于方面的情感分析框架

Vishal Patil, Shree Vaishnavi Bacha, Revanth Yamani, Yidan Sun, Mayank Kejriwal

机构 * University of Southern California(南加州大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出一种结合LLMs和传统机器学习的方法,用于大规模基于方面的情感分析,通过分析470万条评论,展示了其在餐饮体验、菜系和地理区域中的应用效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00044 2026-02-25 cs.CY cs.AI 70%

When LLMs Imagine People: A Human-Centered Persona Brainstorm Audit for Bias and Fairness in Creative Applications

当LLMs想象人们:一种以人为中心的人格脑暴审计方法,用于创意应用中的偏见和公平性

Hongliu Cao, Eoin Thomas, Rodrigo Acuna Agost

机构 * Amadeus Nice France (2026)(法国Nice阿马德斯)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出了一种人格脑暴审计方法,用于评估LLM在创意应用中的偏见和公平性,通过量化偏见并分析多个交集身份和社会角色,揭示模型生成中潜在的不公平现象。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19840 2026-02-24 cs.CL 70%

SAMAS: A Spectrum-Guided Multi-Agent System for Achieving Style Fidelity in Literary Translation

SAMAS:一种基于频谱的多智能体系统,用于实现文学翻译中的风格保真

Jingzhuo Wu, Jiajun Zhang, Keyan Jin, Dehua Ma, Junbo Wang

机构 * Beijing Normal University(北京师范大学) University of Science and Technology of China(中国科学技术大学) University of Coimbra(科英布拉大学) Beijing University of Posts and Telecommunications(北京邮电大学) Northwestern Polytechnical University(西北工业大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 SAMAS通过将风格保真视为信号处理任务,利用小波包变换生成风格特征频谱,动态组装翻译智能体工作流程,从而提升文学翻译中的风格保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21730 2026-02-24 cs.CL 70%

ProPerSim: Developing Proactive and Personalized AI Assistants through User-Assistant Simulation

通过用户-助手模拟开发前瞻性与个性化的人工智能助手

Jiho Kim, Junseong Choi, Woosog Chay, Daeun Kyung, Yeonsu Kwon, Yohan Jo, Edward Choi

机构 * KAIST(韩国科学技术院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 ProPerSim通过用户-助手模拟框架开发了能够主动和个性化推荐的AI助手,实验显示其在多样化的用户场景中有效提升了用户满意度。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01067 2026-02-19 cs.LO cs.AI 70%

Expressive Power of Graph Transformers via Logic

通过逻辑研究图变换器的表达能力

Veeti Ahvonen, Maurice Funk, Damian Heiman, Antti Kuusisto, Carsten Lutz

机构 * Tampere University(塔尔皮奥大学) Leipzig University(莱比锡大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文研究了图变换器和GPS网络在不同注意力机制下的表达能力,发现其在不同逻辑框架下的等价性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16290 2026-02-19 cs.CL 70%

Aladdin-FTI @ AMIYA Three Wishes for Arabic NLP: Fidelity, Diglossia, and Multidialectal Generation

Aladdin-FTI @ AMIYA 三大愿望为阿拉伯语NLP:保真度、双语现象与多方言生成

Jonathan Mutal, Perla Al Almaoui, Simon Hengchen, Pierrette Bouillon

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 Aladdin-FTI通过多中心建模解决阿拉伯方言NLP问题,支持多方言生成与跨方言翻译。

Comments 13 pages, Paper submitted to the AMIYA shared task at the VarDial workshop, co-located with EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15730 2026-02-18 cs.CL econ.EM 70%

Causal Effect Estimation with Latent Textual Treatments

利用潜在文本干预进行因果效应估计

Omri Feldman, Amar Venugopal, Jann Spiess, Amir Feder

机构 * School of Computer Science and Engineering, The Hebrew University of Jerusalem(计算机科学与工程学院,特拉维夫大学) Department of Economics, Stanford University(斯坦福大学经济系) Graduate School of Business, Stanford University(斯坦福大学商学院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出了一种端到端流程,通过稀疏自编码器生成假设并引导,结合协变量残差化方法,解决文本作为治疗实验中的因果效应估计问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15600 2026-02-18 cs.SI cs.AI econ.EM stat.AP 70%

The geometry of online conversations and the causal antecedents of conflictual discourse

在线对话的几何结构与冲突性言论的因果前因

Carlo Santagiustina, Caterina Cruciani

专题命中 其他LLM :LLM(abstract);prompting(abstract);分类 cs.AI

AI总结 本文研究了在线对话中冲突性语言的因果因素,通过分析时间、对话结构等特征,揭示了回复语气和情感框架的趋同现象。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15362 2026-02-18 cs.SE cs.AI 70%

Automated Multi-Source Debugging and Natural Language Error Explanation for Dashboard Applications

自动化多源调试与自然语言错误解释用于仪表盘应用

Devendra Tata, Mona Rajhans

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出了一种自动化多源调试系统,利用大型语言模型生成自然语言错误解释,以提高仪表盘应用的调试效率和用户体验。

Comments Accepted for publication at the 12th (Springer CCIS) International Conference on Information Management, March 27-29, 2026, Oxford, UK

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10902 2026-02-18 cs.CL 70%

Multimodal Peer Review Simulation with Actionable To-Do Recommendations for Community-Aware Manuscript Revisions

多模态同行评审模拟:面向社区意识的论文修订可操作待办推荐系统

Mengze Hong, Di Jiang, Weiwei Zhao, Yawen Li, Yihang Wang, Xinyuan Luo, Yanjie Sun, Chen Jason Zhang

机构 * Hong Kong Polytechnic University(香港理工大学) Beijing University of Posts and Telecommunications(北京邮电大学) Independent Researcher(独立研究者)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究提出一个多模态同行评审模拟系统,通过整合文本和视觉信息,利用检索增强生成技术提升评审质量,并生成可操作的待办列表,以提高论文修订的效率和准确性。

Comments Accepted by TheWebConf 2026 Demo Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14030 2026-02-17 cs.CR cs.LG 70%

MC$^2$Mark: Distortion-Free Multi-Bit Watermarking for Long Messages

MC$^2$Mark:无失真多比特水印用于长消息

Xuehao Cui, Ruibo Chen, Yihan Wu, Heng Huang

机构 * Department of Computer Science, University of Maryland, College Park, MD(计算机科学系,马里兰大学,学院 park, MD)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 MC$^2$Mark通过多通道着色重加权和多层顺序重加权技术,实现无失真多比特水印嵌入,提升长消息的可检测性和鲁棒性,同时保持生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20538 2026-02-17 cs.MA cs.AI 70%

Interpreting Emergent Extreme Events in Multi-Agent Systems

多智能体系统中涌现极端事件的解释

Ling Tang, Jilin Mei, Dongrui Liu, Chen Qian, Dawei Cheng, Jing Shao, Xia Hu

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Fu Dan University(福鼎大学) Tongji University(同济大学) Renmin University of China(中国人民大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出首个多智能体系统中解释涌现极端事件的框架,通过归因分析确定事件起源、驱动者及行为贡献,验证了框架在经济、金融和社会场景中的有效性。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12302 2026-02-16 cs.CL cs.CV 70%

Grandes Modelos de Linguagem Multimodais (MLLMs): Da Teoria à Prática

大规模多模态语言模型(MLLMs):从理论到实践

Neemias da Silva, Júlio C. W. Scholz, John Harrison, Marina Borges, Paulo Ávila, Frances A Santos, Myriam Delgado, Rodrigo Minetto, Thiago H Silva

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文介绍了多模态大语言模型(MLLMs)的理论基础和实践方法,探讨了预处理、提示工程及多模态管道构建技术,并提供了补充材料供进一步研究。

Comments in Portuguese language. Accepted book chapter - Webmedia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11793 2026-02-13 cs.CR cs.CL 70%

More Haste, Less Speed: Weaker Single-Layer Watermark Improves Distortion-Free Watermark Ensembles

更快,更慢:更弱的单层水印提升无失真水印集合

Ruibo Chen, Yihan Wu, Xuehao Cui, Jingqi Zhang, Heng Huang

机构 * University of Maryland, College Park(马里兰大学 College Park 分校)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究提出利用弱单层水印提升多层水印集合的鲁棒性,通过保留熵以减少信号衰减,从而增强水印检测效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00058 2026-02-13 cs.CY cs.AI cs.HC 70%

Prompt Engineer: Analyzing Hard and Soft Skill Requirements in the AI Job Market

提示工程师:分析人工智能劳动力市场中硬技能和软技能需求

An Vu, Jonas Oppenlaender

机构 * University of Oulu(奥卢大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过分析LinkedIn上的职位数据,揭示了提示工程师所需的独特技能组合,包括AI知识、提示设计、沟通能力和创造性问题解决,为求职者和雇主提供参考。

Comments 26 pages, 5 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10542 2026-02-12 cs.IT cs.LG cs.NI math.IT 70%

Predictive-State Communication: Innovation Coding and Reconciliation under Delay

预测状态通信:在延迟下的创新编码与协调

Ozgur Ercetin, Mohaned Chraiti

机构 * Faculty of Engineering and Natural Sciences, Sabanci University(工程与自然科学学院,萨班奇大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 预测状态通信通过共享预测状态和传输创新信息,在延迟下优化通信效率与感知连续性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09877 2026-02-12 cs.CL 70%

The Devil Behind Moltbook: Anthropic Safety is Always Vanishing in Self-Evolving AI Societies

Moltbook背后的魔鬼:在自我进化的AI社会中,人类安全始终在消失

Chenxu Wang, Chaozhuo Li, Songyang Liu, Zejian Chen, Jinyu Hou, Ji Qi, Rui Li, Litian Zhang, Qiwei Ye, Zheng Liu, Xu Chen, Xi Zhang, Philip S. Yu

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Renmin University of China(中国人民大学) University of Illinois at Chicago(伊利诺伊大学香槟分校)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究揭示了自我进化AI社会中安全持续性的不可能性,并提出解决方案以缓解安全风险。

详情

展开后加载摘要…

URL PDF HTML 收藏