arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 762 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 762 篇

2606.18309 2026-06-18 cs.LG cs.AI 新提交 82%

SAGE: Retain-Aware Post-Hoc Sanitization of Final Unlearning Vector

SAGE: 保留感知的最终遗忘向量事后净化

Jingyuan Zhang, Yucheng Bai, Peixi Wen, Zhehao Huang, Zhengbao He, Hanling Tian, Xinwen Cheng, Haiyin Ran, Xiaolin Huang

机构 * Institute of Image Processing and Pattern Recognition, Shanghai Jiao Tong University(上海交通大学图像处理与模式识别研究所)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 提出SAGE方法,通过事后净化最终更新向量,在不重新运行原始遗忘流程的情况下,缓解大语言模型遗忘与保留能力之间的权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15994 2026-06-16 cs.AI cs.LG 新提交 82%

Agentic Framework for Deep Learning workload migration via In-Context Learning

基于上下文学习的深度学习工作负载迁移智能体框架

Qiyue Liang, Steven Ingram, George Vanica, Andi Gavrilescu, Newfel Harrat, Hassan Sipra, Sethuraman Sankaran

机构 * Google(谷歌)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 提出结合上下文学习与Oracle驱动的自调试的自主系统,实现从PyTorch到JAX的深度学习模型自动迁移,在神经模块上达到91%数值等价性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11371 2026-06-11 cs.CL cs.AI eess.AS eess.SP 新提交 82%

The Dynamics of Human and AI-Generated Language: How Semantics Fluctuates across Different Timescales

人类与AI生成语言的动态:语义如何在不同时间尺度上波动

Han-Jen Chang, Yasir Çatal, Angelika Wolman, Agustín Ibáñez, David Smith, I-Wen Su, Kai-Yuan Cheng, Georg Northoff

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 提出语义时间尺度分析流程,通过自相关窗口度量(ACW-0)量化人类与AI生成语音中语义特异性与上下文相似性的时间组织,发现ACW-0长度与词汇通用性相关,且该关联在随机化后被削弱。

Comments 45 pages, 4 figures, 4 tables. Accepted manuscript; published in Computer Speech & Language

Journal ref Computer Speech & Language (2026) 102013

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08919 2026-06-09 cs.AI cs.CR cs.LG 新提交 82%

Oversight Has a Capacity: Calibrating Agent Guards to a Subjective, Fatiguing Human

监督具有容量:将智能体守卫校准到主观且易疲劳的人类

Emre Turan

专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.AI、cs.LG

AI总结 针对LLM智能体动作审批中人类评审者主观且易疲劳的问题,提出将守卫建模为成本敏感的选择性分类,并引入负载感知策略,发现过度监督反而降低安全性,形成倒U型曲线。

Comments 12 pages, 4 figures. Code and interactive demo: https://github.com/turangenesis/headroom

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18309 2026-08-20 cs.CV 新提交 82%

XRF-to-Optical Field-of-View Localization with Vision Language Models

基于视觉语言模型的X射线荧光(XRF)与光学显微镜视场(FOV)定位

Xiangyu Yin, Tatjana Paunesku, Letonia Copeland-Hardin, Martina Ralle, Zichao Wendy Di, Si Chen, Gayle E. Woloschak, Barry Lai, Mathew J. Cherukara, Stefan Vogt

机构 * Northwestern University(西北大学) University of Chicago(芝加哥大学) Oregon Health and Science University(俄勒冈健康与科学大学) Argonne National Laboratory(阿贡国家实验室)

专题命中 其他LLM :language model(title,abstract);prompting(abstract)

AI总结 本文针对跨模态显微图像的视场定位难题,提出结合视觉语言模型(VLM)的候选生成-验证工作流,在低对应度的相邻切片成像数据中实现了有效定位,为关联XRF与光学显微测量提供了支撑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17490 2026-08-19 cs.CV 新提交 82%

When More Foundation Models Means Less: Diagnosing and Addressing Multi-View Fusion Failure

当更多基础模型意味着更少时:诊断与解决多视图融合失效问题

Yibo Liu, Bowen Jiang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 其他LLM :foundation model(title);LLM(abstract,abstract_cn)

AI总结 针对多视图融合中融合编码器数量与性能非单调的问题,提出KAGES方法选择任务对齐的紧凑视图集,在多场景下提升AULC,优于DPP等选择方法。

Comments 26 pages, 4 figures. Code and results: https://github.com/yibol9768-alt/Quantifying-Representation-Reliability

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16318 2026-07-21 cs.HC cs.RO 新提交 82%

The World According to a Social Robot -- Augmenting Human-Robot Dialogue With Vision Language Models

社交机器人眼中的世界——用视觉语言模型增强人机对话

Thomas Sievers

机构 * Institute of Information Systems, University of Lübeck(信息系统研究所,吕贝克大学)

专题命中 其他LLM :language model(title,abstract);LLM(abstract)

AI总结 研究探讨如何用视觉语言模型增强人机对话,通过将米斯特拉尔人工智能语言模型与胡椒机器人结合用于人机交互对话,并研究视觉信息对响应时间的影响,发现纳入视觉信息可增添对话背景,且使用欧洲托管的语言模型便于实际应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15684 2026-07-20 cs.SE 新提交 82%

Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports

理解模型-框架边界处的代理反应性错误:对大型语言模型代理问题报告的实证研究

Jingyi Chen, Songqiang Chen, Hengcheng Zhu, Jialun Cao, Jiasi Shen, Shing-Chi Cheung

专题命中 其他LLM :LLM(title,abstract)

AI总结 研究聚焦大型语言模型代理在模型-框架边界处的反应性错误,通过分析255份错误报告构建分类法,发现此类错误多为无明确测试预言的静默错误,检测和重现困难,还揭示了用户与开发者对错误归因及修复的不匹配,推动相关技术设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06818 2026-07-09 cs.CL cs.AI cs.LG 新提交 82%

Ad Headline Generation using Self-Critical Masked Language Model

使用自批判掩码语言模型生成广告标题

Yashal Shakti Kanungo, Sumit Negi, Aruna Rajan

机构 * amazon(亚马逊)

专题命中 其他LLM :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究如何为电商网站生成吸引人的广告标题,核心方法是将强化学习策略梯度方法应用于基于Transformer的掩码语言模型,通过联合多种产品信息生成标题,该方法在指标和质量审核上优于现有方法,生成标题质量也优于人工提交的。

Comments Accepted at NAACL-HLT 2021 (Industry Track). 9 pages, 3 tables, 3 figures - ACL Anthology URL: https://aclanthology.org/2021.naacl-industry.33/ - Editors of the proceedings: Young-bum Kim, Yunyao Li, Owen Rambow - Bibkey: kanungo-etal-2021-ad

Journal ref Proceedings of the 2021 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies: Industry Papers, pages 263-271, June 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05121 2026-07-07 cs.SE 新提交 82%

From Failing to Passing: Evolving Natural Language Prompt Optimization Rules for LLM Code Generation

从失败到通过:为大语言模型代码生成演化自然语言提示优化规则

Amal Akli, Melissa Akli, Cedric Richter, Mike Papadakis, Yves Le Traon

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract)

AI总结 研究大语言模型提示敏感性,用搜索法演化自然语言转换规则,提出DUALFIX管道,结合规则与执行反馈修复,可跨问题跨模型使用,提升代码生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02961 2026-07-07 cs.CV cs.CR 新提交 82%

Overloading Large Vision-Language Models for Jailbreaking

通过信息过载对大型视觉语言模型进行越狱攻击

Haoyu Zhang, Yangyang Guo, Mohan Kankanhalli

机构 * National University of Singapore(新加坡国立大学) Hangzhou International Innovation Institute, Beihang University(北京航空航天大学杭州国际创新研究院)

专题命中 其他LLM :language model(title,abstract);large language model(abstract)

AI总结 研究大型视觉语言模型易受越狱攻击问题,提出基于递归图像排版布局的信息过载方法,含大量文本和多维图像攻击,大幅提升攻击成功率,凸显此为现实部署安全风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06711 2026-06-08 physics.ins-det 新提交 82%

Lightfall: An API-first, LLM-addressable control platform for synchrotron beamlines

Lightfall: 一种面向同步辐射光束线的API优先、LLM可寻址控制平台

Ronald J. Pandolfi, Damian Guenzing, Marcus M. Noack, Sophie A. Morley, Damon English

专题命中 其他LLM :LLM(title,title_cn)

AI总结 针对同步辐射光束线控制界面定制化需求,提出Lightfall平台,采用API优先架构,通过统一可寻址接口暴露所有面板、设备和扫描计划,并嵌入语言模型代理驱动实验,支持自然语言修改界面,降低定制成本。

Comments 21 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19527 2026-08-21 cs.HC cs.CL cs.SD 新提交 81%

Does Listening Matter? Backchanneling and Nodding in AI Clone

倾听重要吗?AI克隆中的反馈式回应与点头动作

Koji Inoue, Kazushi Kato, Tatsuya Kawahara, Shunichi Kasahara

专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.CL

AI总结 本研究将口头反馈式回应与头部点头整合到配备语音克隆及LLM响应的AI克隆中,经35人被试内研究证实,添加互动倾听行为可提升AI克隆的感知专注度、真实感与共同在场感,其保真度需涵盖倾听行为。

Comments This paper has been accepted to the Late-Breaking Results (LBR) track of the 28th International Conference on Multimodal Interaction (ICMI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18846 2026-08-20 cs.AI 新提交 81%

ORBITER: Conflict-Aware Decision-Making for Agentic Last-Mile Delivery

ORBITER:面向智能体的最后一公里配送的冲突感知决策方法

Mingzhao Li, Chenxi Liu, Yan Zhao, Hao Miao

专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.AI

AI总结 本文针对最后一公里配送决策的可解释性与可靠性问题,提出ORBITER框架,结合LLM与结构化决策机制,在四城市数据上较最优基线平均提升9.2%,验证了方法的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18545 2026-08-20 cs.CL 新提交 81%

Shared Circuits for Shared Grammar: Tracing Subject-Verb Agreement Across Languages

共享语法的共享电路:跨语言追踪主谓一致

Isabella Gidi, Antonio Almudévar, Core Francisco Park, Naomi Saphra, Ricard Marxer

机构 * Harvard University(哈佛大学) University of Zaragoza(萨拉戈萨大学) Boston University(波士顿大学) Univ Toulon(土伦大学) Aix Marseille Univ(艾克斯-马赛大学) CNRS(法国国家科学研究中心) LIS(信息科学实验室) ILLS(语言与语言科学研究所)

专题命中 其他LLM :large language model(abstract,abstract_cn);language model(abstract,abstract_cn);分类 cs.CL

AI总结 本文研究多语言大语言模型的跨语言共享机制,以主谓一致为对象,通过29种语言的实验发现其复用部分共享计算结构,且与屈折语言的电路更相似。

Comments 25 pages including appendices, 16 figures. Accepted to COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15165 2026-08-18 cs.AI 新提交 81%

SkillCommit: Evolving Agent Skills through Behaviorally Validated Scope Expansion

SkillCommit:通过行为验证的范围扩展实现智能体技能演化

Yu He, Weikai Yang

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究提出SkillCommit框架,通过保留经验的验证行为、抽象相关技能,在RuleArena等数据集上提升智能体性能,且所学技能可跨模型迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10171 2026-08-12 cs.AI cs.CR 新提交 81%

Generating Attacks for LLMs with GFlowNets

用GFlowNets为大语言模型生成攻击

Berkay Ozcam, Irem Onen, Mehmet Fatih Amasyali, Emin Islam Tatli

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究提出基于GFlowNets的自动化自适应红队评估方法,训练攻击者模型测试目标大语言模型,可生成更有效的英文攻击及土耳其语攻击输入,用于评估模型鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08303 2026-08-11 cs.AI cs.MA 新提交 81%

Query-Only Backdoor Attacks on Self-Evolving Skills via Trajectory Poisoning

通过轨迹投毒对自进化技能实施仅查询式后门攻击

Yuyang Luo, Haoran Wang, Kai Shu

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究针对自进化技能系统提出仅查询式轨迹后门攻击TBA,通过构造查询诱导生成带后门技能,实验证实其可可靠植入条件后门且效果优于直接注入。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05668 2026-08-07 cs.MA cs.AI cs.MM 新提交 81%

F$^2$Agent: Financial Fusion of Agentic Intelligence for Multimodal Trading

F²Agent:面向多模态交易的智能体智能金融融合框架

Changshuo Liu, Yanzheng Jin, Shangfeng Cai, Peng Fang, Xiaokui Xiao, Beng Chin Ooi

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究针对现有多模态金融交易模型的跨模态依赖捕捉不足、抗噪性差的问题,提出F²Agent框架,通过专业化智能体提取模态信号、模态感知自适应融合机制及抗噪正则化,在6种资产上较16个基线实现超20%年化回报率提升,表现出优异性能。

Comments 32 pages, 12 figures, 19 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29383 2026-08-03 cs.LG cs.DC cs.SE 新提交 81%

Exploring Block Anomaly Detection In HDFS Log Data Analysis

HDFS日志数据分析中的块异常检测探索

WenYang Zhong, Tutut Herawan

专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.LG

AI总结 本研究针对HDFS日志人工异常检测复杂枯燥的问题,提出结合LLM-BiLSTM模型与Kafka流式管道的检测方案,实现HDFS块异常的快速准确检测。

Comments 37 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27951 2026-07-31 cs.CR cs.AI 新提交 81%

Safeguards Based on Copyable Context Cannot Provide Reliable Safety for LLMs

基于可复制上下文的安全防护无法为大语言模型提供可靠的安全性

Pingyu Wu, Lingyao Zhu, Weiming Zhang, Nenghai Yu

专题命中 其他LLM :LLM(summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究指出基于可复制上下文的LLM安全防护存在三难困境,提出用可信凭证补充防护以预测下游使用,其结论经相关评估与程序验证具有实际意义。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27497 2026-07-31 cs.CL 新提交 81%

SkillSmith: Learning to Compose Parametric Skills and Textual Knowledge

SkillSmith:学习组合参数化技能与文本知识

Lucio M. Dery, Benedict Aaron Tjandra, Siavash Samiei, Adhiguna Kuncoro, Zohar Yahav, Jiajun Shen, Arthur Szlam

机构 * Google(谷歌)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 SkillSmith将模型权重作为可推理模态,结合前缀调优与文本数据,实现指令引导的参数化合成,性能优于单模态基线,解决了文本与权重集成的未探索问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20501 2026-07-24 cs.AI cs.MA 新提交 81%

MKEvolve: A Modular Multi-Agent Framework for Kernel Code Generation

MKEvolve:用于内核代码生成的模块化多智能体框架

Jason Yoo, Rajarshi Saha, Shaowei Zhu, Tao Yu, Wei Tang, Youngsuk Park

专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.AI

AI总结 针对硬件加速器内核代码生成瓶颈,MKEvolve框架通过迭代共同进化PyTorch模块分解与子模块内核,经拆分融合优化分解并以束搜索改进子内核,实验证明其在正确性、加速及减少LLM令牌使用上有优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07980 2026-07-10 cs.SE cs.AI 新提交 81%

3100 Opinions on Code Review in an AI World: Building Causal Theory from Practitioner Discourse

人工智能时代关于代码审查的3100种观点:从从业者话语中构建因果理论

Shyam Agarwal, Courtney Miller, Christian Kästner, Bogdan Vasilescu

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.AI

AI总结 研究人工智能对代码审查的影响,通过收集从业者话语构建因果模型,明确审查是控制点,团队决定编码代理对软件影响,转化相关命题,还提供LLM辅助灰色文献理论构建方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07702 2026-07-09 cs.CL 新提交 81%

From Noisy Traces to Root Causes: Structural Trajectory Analysis and Causal Extraction for Agent Optimization

从噪声轨迹到根本原因:用于智能体优化的结构轨迹分析和因果提取

Ying Chang, Jiahang Xu, Xuan Feng, Chenyuan Yang, Peng Cheng, Yuqing Yang

机构 * Microsoft Research(微软研究院) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究针对长期智能体优化中实际执行轨迹难直接用于优化的问题,提出STRACE框架。该框架在批次和轨迹内分别进行故障模式挖掘与因果定位,去除冗余和非因果步骤,实验表明其显著优于基线,提升了智能体优化成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07277 2026-07-09 cs.CL cs.CY 新提交 81%

Understanding Interpretation Difficulty in Harmful Online Communication: Insights from Cybercrime Communities

理解有害网络通信中的解释难度:来自网络犯罪社区的见解

Tomohiro Okatsu, Naoki Takada, Yin Min Pa Pa, Katsunari Yoshioka, Tatsunori Mori

机构 * Yokohama National University(横滨国立大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究网络犯罪相关Discord聊天中解释难度,构建参考解释评估人类和大语言模型在不同条件下的解释,发现局部上下文对人类不足,外部知识等可提升,还进行错误分析并分类影响因素,指出有害内容分析应视解释为证据整合问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19042 2026-07-09 cs.SE cs.AI 新提交 81%

Where Did the Variability Go? From Vibe Coding to Product Lines by Regeneration

可变性去哪了?从氛围编码到通过再生的产品线

Xhevahire Tërnava

机构 * LTCI, Télécom Paris, Institut Polytechnique de Paris, Palaiseau, France(LTCI,巴黎电信学院,巴黎理工学院,Palaiseau,法国)

专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.AI

AI总结 研究AI驱动编程(氛围编码)中可变性缺失问题,提出通过再生实现可变性(VbR)方法,让LLM作为推导引擎生成无死代码的变体二进制。

Comments VARIABILITY 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02846 2026-07-07 cs.AI 新提交 81%

Object-Centric Environment Modeling for Agentic Tasks

用于智能任务的以对象为中心的环境建模

Yiyang Li, Tianyi Ma, Zehong Wang, Yijun Ma, Yanfang Ye

机构 * University of Notre Dame(圣母大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究大语言模型智能体经验维护难题,提出以对象为中心的环境建模(OCM),将经验组织成可执行模型,含对象知识与过程知识,在线更新并验证,实验表明其能提升智能体性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02057 2026-07-03 cs.SE cs.AI 新提交 81%

Prompt Coverage Adequacy

提示覆盖充分性

Florian Tambon, Michael Konstantinou, Cedric Richter, Charles Chenouard, Mark Harman, Mike Papadakis

机构 * SnT, University of Luxembourg(斯蒂尔夫研究所,卢森堡大学) University College London(伦敦大学学院) University of Luxembourg(卢森堡大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出提示覆盖充分性标准,通过注意力机制衡量测试套件对提示需求的覆盖,相比传统代码覆盖能多检测30%以上缺陷。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00007 2026-07-03 cs.IR cs.AI 新提交 81%

BaRA: Budget-constrained and Reliable Web Data Collection Agent

BaRA: 基于BFS与反思的网络数据收集代理

Soojeong Lee, Joseph Lee, Yongseong Cho, Sunjae Kim, Youngwoo Moon, Kyungwoo Song

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出BaRA框架,结合有界广度优先搜索和历史自反思,在固定交互预算下高效收集网站级数据,在链接发现和可下载多模态提取上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏