arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-05-26 至 2026-05-26 共收录 656 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 36 篇

2509.14250 2026-05-26 cs.CL 86%

The meaning of prompts and the prompts of meaning: Semiotic reflections and modelling

提示的意义与意义的提示:符号学反思与建模

Martin Thellefsen, Amalia Nurma Dewi, Bent Sorensen

专题命中 其他LLM :LLM(abstract,abstract_cn);prompting(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文基于皮尔士符号学三元模型和Dynacom传播模型,将大型语言模型中的提示重新概念化为动态符号现象,强调其作为沟通和认知行为的迭代符号形成与解释过程。

Comments 18 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23920 2026-05-26 cs.CY cs.AI 86%

Artificial Effort

人工努力

Federico Belotti, Stefano Coniglio, Antonio Cosma, Francesco Fallucchi

机构 * University of Bergamo(贝加莫大学)

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究在AI和LLM时代,真实努力任务是否仍能反映人类努力,发现大多数任务可被低成本高精度自动化,仅少数抵抗自动化,且口头金钱激励对LLM无影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25454 2026-05-26 cs.HC cs.AI cs.CL cs.CY cs.SI 85%

AI Content Moderation in Therapy Conversations

AI在治疗对话中的内容审核

Jiwon Kim, Claire Wang, Taeung Yoon, Sabelle Huang, Koustuv Saha

专题命中 其他LLM :LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究审计三种主流内容审核系统(OpenAI、Meta、Google)在真实治疗对话中的标记行为,揭示其限制LLM作为治疗师的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22715 2026-05-26 cs.CV cs.AI cs.CL cs.HC 82%

AnyMo: Geometry-Aware Setup-Agnostic Modeling of Human Motion in the Wild

AnyMo:野外人体运动的几何感知与设置无关建模

Baiyu Chen, Zechen Li, Wilson Wongso, Lihuan Li, Xiachong Lin, Hao Xue, Benjamin Tag, Flora Salim

机构 * The University of New South Wales(新南威尔士大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.CL、cs.AI

AI总结 提出AnyMo框架,通过物理模拟生成多样化IMU信号、图编码器预训练和LLM对齐,实现跨设备/数据集的零样本活动识别、跨模态检索和运动描述,性能显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.04700 2026-05-26 cs.CR cs.AI cs.CL cs.LG cs.SD 82%

Sparse Tokens Suffice: Jailbreaking Audio Language Models via Token-Aware Gradient Optimization

稀疏令牌足矣:通过令牌感知梯度优化越狱音频语言模型

Zheng Fang, Xiaosen Wang, Shenyi Zhang, Shaokang Wang, Zhijin Ge

机构 * Wuhan University Institute for Math \& AI, Wuhan University Huazhong University of Science Shanghai Jiao Tong University Xidian University

专题命中 其他LLM :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出令牌感知梯度优化(TAGO)方法,通过仅保留高梯度能量的音频令牌对应的波形梯度,实现稀疏越狱攻击,在保持高成功率的同时大幅减少优化量。

Comments To appear in the 43rd International Conference on Machine Learning (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26040 2026-05-26 cs.AI 81%

L2IR: Revealing Latent Intent in Graph Fraud Detection

L2IR: 揭示图欺诈检测中的潜在意图

Jinsheng Guo, Zhenhao Weng, Yibo Liu, Yan Qiao, Meng Li

机构 * Hefei University of Technology(合肥工业大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出L2IR框架,利用大语言模型从用户行为和可疑连接中提取潜在意图,通过自适应自训练增强鲁棒性,在广泛伪装的数据集上提升图神经网络检测器的AUPRC最高达8.27%。

Comments 12 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12538 2026-05-26 cs.CR cs.AI cs.SE 81%

MCPXKIT: The Unified Toolkit for Analyzing Model Context Protocol Security

MCPXKIT:分析模型上下文协议安全性的统一工具包

Yongjian Guo, Puzhuo Liu, Wanlun Ma, Zehang Deng, Xiaogang Zhu, Peng Di, Xi Xiao, Sheng Wen

机构 * Shenzhen International Graduate School, Tsinghua University, Shenzhen, China(深圳国际研究生院,清华大学,深圳,中国) Ant Group, Hangzhou, China(蚂蚁集团,杭州,中国) Swinburne University of Technology, Melbourne, Australia(斯威本科技大学,墨尔本,澳大利亚) The University of Adelaide, Adelaide, Australia(阿德莱德大学,阿德莱德,澳大利亚) UNSW Sydney, Australia(悉尼大学,澳大利亚)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出MCPXKIT工具包,分类实现了31种攻击方法,通过定量实验揭示了MCP在工具描述依赖、文件攻击、链攻击及数据命令区分等方面的漏洞,并提供了安全增强建议。

Comments Accepted by IEEE Transactions on Dependable and Secure Computing (TDSC). $\href{https://ieeexplore.ieee.org/abstract/document/11531012}{Official \ version}$

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24426 2026-05-26 cs.CL 81%

SEAL: Synergistic Co-Evolution of Agents and Learning Environments

SEAL: 智能体与学习环境的协同共演化

Yihao Hu, Zhihao Wen, Xiujin Liu, Pan Wang, Xin Zhang, Wei Wu

机构 * Ant Group(蚂蚁集团) Westlake University(西湖大学) University of Michigan--Ann Arbor(密歇根大学安娜堡分校) University of Science and Technology of China(中国科学技术大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出SEAL框架,通过协同演化智能体策略与训练环境,解决智能体与环境错配问题,在低资源多轮工具使用任务中提升性能并实现正向分布外迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13203 2026-05-26 cs.NI cs.AI 81%

Adversarial Network Imagination: Causal LLMs and Digital Twins for Proactive Telecom Mitigation

对抗性网络想象:因果大语言模型与数字孪生用于主动电信缓解

Vignesh Sriram, Yuqiao Meng, Luoxi Tang, Zhaohan Xi

机构 * Binghamton University(宾夕法尼亚州立大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出对抗性网络想象框架,结合因果大语言模型、知识图谱和数字孪生,主动生成、模拟和评估对抗性网络故障,实现从被动故障排查向预期韧性分析的转变。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26097 2026-05-26 cs.LG 79%

Forgetting in Language Models: Capacity, Optimization, and Self-Generated Replay

语言模型中的遗忘:容量、优化与自生成回放

Martin Marek, Dongkyu Cho, Shikai Qiu, Rumi Chunara, Pavel Izmailov, Andrew Gordon Wilson

机构 * New York University(纽约大学)

专题命中 其他LLM :language model(title,abstract);分类 cs.LG

AI总结 本文研究了语言模型中的遗忘问题,发现自生成样本可作为有效的回放数据几乎消除遗忘,并揭示了容量限制和低学习率对遗忘的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18646 2026-05-26 cs.CL 79%

Language-Switching Triggers Take a Latent Detour Through Language Models

语言切换触发器通过语言模型的潜在迂回路径

Francis Kulumba, Wissam Antoun, Théo Lasnier, Benoît Sagot, Djamé Seddah

机构 * Inria Paris(巴黎研究所) Sorbonne Université(索邦大学)

专题命中 其他LLM :language model(title,abstract);分类 cs.CL

AI总结 本文通过电路分析揭示了一个8B参数自回归语言模型中语言切换后门攻击的内部机制,该攻击由三个拉丁词触发,将英语输出重定向为法语,并发现触发信号通过正交于语言身份方向的潜在空间传播,最终由最后一层MLP转换为法语logits。

Comments 15 pages, 16 figures. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20749 2026-05-26 cs.LG cs.AI 73%

The Devil is in the Condition Numbers: Why is GLU Better than non-GLU Structure?

魔鬼在于条件数:为什么GLU优于非GLU结构?

Xingyu Lyu, Qianqian Xu, Zhiyong Yang, Peisong Wen, Qingming Huang

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences, Beijing 100190, China(人工智能安全国家重点实验室,计算技术研究所,中国科学院,北京100190,中国) School of Computer Science and Technology, University of Chinese Academy of Sciences, Beijing 101408, China(中国科学院大学计算机科学与技术学院,北京101408,中国) Beijing Academy of Artificial Intelligence (BAAI), Beijing, China(北京人工智能研究院(BAAI),北京,中国)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 通过神经正切核分析,发现门控线性单元(GLU)通过重塑核谱、减小条件数来加速优化收敛,而非主要降低泛化差距。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11925 2026-05-26 cs.CR cs.CL cs.LG 73%

Optimizing Token Choice for Code Watermarking: An RL Approach

优化代码水印的令牌选择:一种强化学习方法

Zhimeng Guo, Huaisheng Zhu, Siyuan Xu, Hangfan Zhang, Teng Xiao, Minhao Cheng

机构 * The Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL、cs.LG

AI总结 提出CodeTracer框架,通过强化学习训练策略模型智能选择令牌嵌入水印,在保持代码功能的同时提高水印可检测性。

Comments ICML 2026, 18 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24521 2026-05-26 cs.SE 71%

From Prompting to Verification: How Experience Shapes Vibe Coding Practices

从提示到验证:经验如何塑造Vibe编码实践

Ahmed Fawzy, Amjed Tahir, Kelly Blincoe

专题命中 其他LLM :prompting(title)

AI总结 通过调查162名不同经验水平的Vibe编码者,发现经验选择性影响编码动机、交互方式和质量保证实践,存在感知-行动差距:对AI生成代码风险的认识普遍,但评估、调试和验证能力依赖于经验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25735 2026-05-26 cs.AI 70%

A Deep Dive into Axiomatic Design -- Part I: Problem Formulation

公理化设计的深度剖析——第一部分:问题表述

Aydin Homay

机构 * Technische Universität Dresden(德累斯顿理工大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文聚焦公理化设计中的问题表述步骤,澄清一级功能需求的定义与特性,分析常见误区与困难,并提供实用指导,最后探讨大语言模型在该步骤中的作用。

Comments The paper is accepted at the ICAD 2026 - MIT and the final camera ready will be available once it got published by the Springer

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25505 2026-05-26 cs.CY cs.AI econ.GN physics.soc-ph q-fin.EC 70%

Generative AI impacts on intra-urban inequality and skill premium in Beijing

生成式人工智能对北京城市内部不平等和技能溢价的影响

Xiliu He, Haoxiang Zhao, Mingyi Ma, Edward Wen Chuan Lai, Koei Enomoto, Anni Hu, Jiatong Li, Lingyun Chu, Yuan Lai

机构 * School of Architecture, Tsinghua University(清华大学建筑学院) ZODA LAB(ZODA实验室) Technology Innovation Center for Smart Human Settlements and Spatial Planning & Governance, Ministry of Natural Resources, Tsinghua University(智能人居环境与空间规划及治理技术创新中心,自然资源部,清华大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 利用北京2018-2024年500万条招聘数据,通过五个大语言模型评估任务级暴露度,构建社区级生成式人工智能暴露指数,发现生成式人工智能暴露集中在核心区,导致高暴露社区工资停滞和“高技能陷阱”,挑战了技能偏向技术变革理论。

Comments 21 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25360 2026-05-26 cs.CL 70%

Learning to Route Languages for Multilingual Policy Optimization

学习路由语言以实现多语言策略优化

Geyang Guo, Hiromi Wakaki, Yuki Mitsufuji, Alan Ritter, Wei Xu

机构 * Georgia Institute of Technology(佐治亚理工学院) Sony Group Corporation(索尼集团)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出语言路由策略优化(LRPO)框架,将语言作为可选变量,通过在线策略优化和可训练的语言路由器(多臂老虎机)自适应地选择语言,在固定预算下提升多语言训练信号的多样性和信息量,从而显著提高多语言性能。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24164 2026-05-26 cs.CL 70%

CUNY at CLPsych 2026: A Pipeline Approach to Classification and Summarization of Mental Health Changes

CUNY at CLPsych 2026: 一种用于心理健康变化分类和总结的流水线方法

Amirmohammad Ziaei Bideh, Shameed Charlomar Job, Ava Yahyapour, Alla Rozovskaya

机构 * Computer Science Department, CUNY Graduate Center(哥伦比亚大学研究生院计算机科学系) Linguistics Department, CUNY Graduate Center(哥伦比亚大学研究生院语言学系)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出一种流水线方法,通过集成三个开源大语言模型的上下文学习和监督分类,对社交媒体时间线中的心理健康状态进行推断、变化点预测和模式总结,在CLPsych 2026共享任务中取得领先排名。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10548 2026-05-26 cs.CV 67%

Blink: Dynamic Visual Token Resolution for Enhanced Multimodal Understanding

Blink: 动态视觉令牌分辨率增强多模态理解

Yuchen Feng, Zhenyu Zhang, Naibin Gu, Yilong Chen, Peng Fu, Zheng Lin, Shuohuan Wang, Yu Sun, Hua Wu, Weiping Wang, Haifeng Wang

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院) Baidu Inc(百度公司)

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 提出Blink框架,通过注意力引导的令牌超分辨率和动态丢弃机制,在单次前向传播中模拟人类眨眼式扫描,提升多模态大语言模型的视觉感知能力。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19409 2026-05-26 cs.LG cs.AI 62%

Unlocking the Potential of Continual Model Merging: An ODE Perspective

解锁持续模型合并的潜力:ODE视角

Lihong Lin, Haidong Kang

机构 * Northeastern University, Shenyang, China(东北大学,沈阳,中国)

专题命中 其他LLM :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 提出ODE-M框架,将持续模型合并建模为参数空间中的轨迹,通过整流时变速度场和效用感知时间调度平衡历史知识与新任务,提升长任务流性能。

Comments 21 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24585 2026-05-26 cs.CL q-bio.NC 57%

Word Class Representations Spontaneously Emerge from Successor Representations Trained on Natural Language

从自然语言训练的后继表示中自发涌现的词类表示

Mathis Immertreu, Achim Schilling, Thomas Kinfe, Patrick Krauss

机构 * Cognitive Computational Neuroscience Group(认知计算神经科学组) Friedrich-Alexander-Universität Erlangen–Nürnberg (FAU)(弗赖堡-亚历山大-大学埃尔兰根-纽伦堡(FAU)) Mannheim Center for Neuromodulation and Neuroprosthetics (MCNN)(曼海姆神经调制与神经假体中心(MCNN)) University Hospital Mannheim, University Heidelberg(曼海姆大学医院,海德堡大学)

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 本研究将强化学习中的后继表示(SR)框架应用于自然语言,通过训练神经网络预测未来词分布,发现无监督下词类(如名词、动词、形容词)的几何结构自发涌现,且预测时域影响结构层次。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27118 2026-05-26 cs.CL 57%

Probability Distributions Computed by Autoregressive Transformers

自回归变压器计算的概率分布

Andy Yang, Anej Svete, Jiaoda Li, Anthony Widjaja Lin, Jonathan Rawski, Ryan Cotterell, David Chiang

机构 * University of Notre Dame(内布拉斯加大学达灵顿分校) ETH Zürich(苏黎世联邦理工学院) Max-Planck Institute for Software Systems(马克斯·普朗克软件系统研究所) University of Kaiserslautern-Landau(凯撒斯劳滕-劳恩堡大学) San José State University(圣何塞州立大学)

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 研究自回归变压器作为语言模型时能表达的概率分布,揭示自回归和概率化对表达力的影响。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25308 2026-05-26 cs.CV 50%

Stabilizing Streaming Video Geometry via Dynamic Feature Normalization

通过动态特征归一化稳定流视频几何

Xiaoyang Lyu, Muxin Liu, Xiaoshan Wu, Ruicheng Wang, Yi-Hua Huang, Yang-Tian Sun, Shaoshuai Shi, Xiaojuan Qi

机构 * The University of Hong Kong(香港大学) USTC(中国科学技术大学) Voyager Research, Didi Chuxing(滴滴出行 Voyager 研究)

专题命中 其他LLM :foundation model(abstract)

AI总结 针对流式RGB输入中单目几何模型的时间不一致问题(主要表现为尺度-偏移漂移),提出轻量级因果循环模块DyFN,通过动态调制特征统计量实现稳定几何估计,仅微调2%参数即可达到SOTA时间稳定性。

Comments 16 pages, 9 Figures, page: https://shawlyu.github.io/DyFN

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25216 2026-05-26 cs.RO 50%

InvariantCloud: A Globally Invariant, Uniquely Indexed Point Cloud Framework for Robust 6-DoF Tactile Pose Tracking

InvariantCloud:一种全局不变、唯一索引的点云框架,用于鲁棒的6自由度触觉姿态跟踪

Pengfei Ye, Yuxiang Ma, Yi Zhou, Wei Chen, Wenzhen Dong, Molong Duan

机构 * Department of Mechanical and Aerospace Engineering, The Hong Kong University of Science and Technology(香港科学与技术大学机械与航空航天工程系) Department of Mechanical Engineering, Massachusetts Institute of Technology(麻省理工学院机械工程系) Department of Mechanical and Automation Engineering, The Chinese University of Hong Kong(香港中文大学机械与自动化工程系)

专题命中 其他LLM :language model(abstract)

AI总结 提出InvariantCloud框架,利用视觉触觉传感器上表面标记星座的全局不变性,通过一次性全局不变点云配准实现6自由度物体姿态估计,抑制累积漂移并准确估计偏航旋转,在长序列操作任务中展现出高精度和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24893 2026-05-26 cs.CV 50%

BED-SAM2: Boundary-Enhanced-Depth SAM2 via Monocular Geometric Priors

BED-SAM2: 通过单目几何先验增强边界的深度SAM2

Tyler Rust, Dara McNally, Kyle O'Donnell, Colin Kelly, Chandra Kambhamettu

机构 * University of Delaware(德克萨斯大学) University of South Florida(佛罗里达州立大学) DEVCOM Army Research Laboratory(国防部陆军研究实验室)

专题命中 其他LLM :foundation model(abstract)

AI总结 本研究通过修改SAM2编码器以直接编码单目深度信息,提出BED-SAM2模型,在少量训练周期内实现显著和伪装物体检测的竞争性能。

Comments 9 pages, 5 figures, 5 tables. Presented as a poster at the CVPR 2026 Workshop on Computer Vision in the Wild (CVinW). Code available at https://github.com/TylerRust-1/BED-SAM2

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07185 2026-05-26 cs.HC 50%

Metaphors as Scaffolds: Spatial, Embodied, Fantastical, and Relational Framings for Youth Usable Privacy Design

隐喻作为支架:面向青少年可用隐私设计的空间、具身、奇幻和关系框架

JaeWon Kim, Alexis Hiniker

专题命中 其他LLM :prompting(abstract)

AI总结 基于对13-24岁青少年的三项先前研究,探讨隐喻如何塑造青少年对隐私的推理和设计想象,并指出隐喻选择是伦理决策。

详情

展开后加载摘要…

URL PDF HTML 收藏