arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 762 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 762 篇

2608.03123 2026-08-05 cs.LG cs.AI 新提交 76%

Trajectory-Guided Forget-Recover Network for Continual LLM Unlearning

用于持续大语言模型遗忘的轨迹引导遗忘-恢复网络

Zezheng Wu, Xinghe Cheng, Qinggang Zhang, Haoran Luo, Jiapu Wang, Qing Yang, Jingwei Zhang

专题命中 其他LLM :LLM(title);分类 cs.AI、cs.LG

AI总结 针对持续大语言模型遗忘的两大挑战,提出TFR-Net,通过跟踪通道级风险抑制持久目标相关通道、恢复休眠通道,在四个数据集上取得更优的遗忘效果与保留性能权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19281 2026-08-21 cs.RO cs.HC 新提交 75%

APPROVE: Visual End-User-in-the-Loop Robot Programming with LLMs

APPROVE:结合大型语言模型的面向视觉端用户的机器人编程

Bijan Kavousian, Miray Özakkas, Josefine Monnet, Oliver Petrovic, Christian Brecher

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 APPROVE是一种结合LLMs的多模态端用户机器人编程框架,通过Blockly可视化程序并支持用户确认、修改或拒绝,还可存储复用已确认功能,解决了现有系统透明度不足、意图对齐差、复用有限的问题,提升了用户信任与编程灵活性。

Comments Accepted for publication in Procedia CIRP, Proceedings of the 20th CIRP Conference on Intelligent Computation in Manufacturing Engineering (ICME 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15115 2026-08-18 cs.CV 新提交 75%

Perspective-Invariant Attack with Enhanced Transferability of Adversarial Examples

具有增强对抗样本迁移性的视角不变攻击

Kaisheng Liang, Yiming Cao, Bin Xiao

机构 * The Hong Kong Polytechnic University(香港理工大学)

专题命中 其他LLM :LLM(abstract_cn);large language model(abstract);language model(abstract)

AI总结 针对对抗样本跨模型迁移性带来的安全威胁,提出视角不变攻击(PIA)及其扩展PIA-Mix,通过多自由度顶点采样策略提升对抗样本迁移性,实验显示其性能优于当前最优基于迁移的攻击方法。

Journal ref IEEE Transactions on Information Forensics and Security, vol. 21, pp. 6818-6831, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13913 2026-08-17 cs.CE 新提交 75%

AlphaSeek: Trajectory-Level Self-Iterative Factor Mining Framework for Multi-Source Financial Data

AlphaSeek:面向多源金融数据的轨迹级自迭代因子挖掘框架

Qilu Zhu, Zijun Lu, Jianmin Zhu, Ning Chen, Shuo Yin, Simon Fong

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 针对现有量化因子挖掘方法的缺陷,提出AlphaSeek框架,整合自动化方向发现等技术,在CSI300上取得优异策略性能,且因子具跨市场迁移性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06733 2026-08-10 physics.soc-ph 新提交 75%

Estimating GHG Emissions from AI Use: Framework for Corporate-Level Measurement

估算AI使用产生的温室气体排放:企业级测量框架

John Bistline, Shaena Ulissi, Steven J. Davis, Jonathan Glidden, James Joyce, Mo Li, Jackson Mohsenin, Sangwon Suh

专题命中 其他LLM :LLM(abstract_cn);large language model(abstract);language model(abstract)

AI总结 针对企业AI排放核算缺乏公认方法的问题,提出标准化企业级AI排放核算框架,以支撑减排目标设定与脱碳决策。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27726 2026-07-31 cs.AI cs.CL cs.LG 新提交 75%

Baikal: Structured Search for Deep Research over Data Lakes

Baikal:面向数据湖深度研究的结构化搜索框架

Dhruv Agarwal, Rishitha Guttapalle Mohan, Aarti Kumari, Ashi Sinha, Athulya Anil, Kavitha Srinivas, Horst Samulowitz, Andrew McCallum

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL、cs.AI、cs.LG

AI总结 Baikal是面向数据湖深度研究的结构化搜索框架,通过聚类证据为语义区域并自适应搜索,在HybridQA和TAT-QA数据湖上较基线方法提升报告得分28%和36%,展现了结构化语义探索的价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11387 2026-07-14 cs.SE 新提交 75%

From GUI Tests to Conversational Interaction: A New Perspective on App-Specific Voice Assistants

从图形用户界面测试到对话交互:特定应用语音助手的新视角

Xue Qin, Sumesh Surendran Letha

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 研究针对移动平台语音助手与应用行为契合度低的问题,提出由语言模型驱动、利用图形用户界面测试代码自动开发特定应用语音助手的方法,经安卓原型验证,可复用测试代码实现语音助手合成并指明相关研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09146 2026-07-13 cs.SE 新提交 75%

Exploring the Potential of Program Flowcharts on Code Generation Using Multimodal LLMs

利用多模态大语言模型探索程序流程图在代码生成中的潜力

Yuki Toi, Tao Xiao, Kazushi Tomoto, Masanari Kondo, Yasutaka Kamei

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 研究利用多模态大语言模型探索程序流程图对代码生成的潜力,通过从示例代码生成流程图并与问题陈述一起提供给模型进行代码生成实验,发现结合流程图可提升性能,不同细节程度的流程图效果有差异,还比较了与少样本学习的效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07461 2026-07-09 cs.CR cs.SE 新提交 75%

Mitigating Taint-Style Vulnerabilities in MCP Servers via Security-Aware Tool Descriptions

通过安全感知工具描述减轻MCP服务器中的污点式漏洞

Yang Shi, Jiaheng Fu, Yihe Huang, Ruixiang Wu, Chengyao Sun, Kaifeng Huang

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 研究MCP服务器污点式漏洞,提出SPELLSMITH,通过分析服务器高风险能力,结合工具描述等识别潜在风险,利用协议属性和大语言模型自我反思能力迭代优化输出,有效减轻污点式漏洞利用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06831 2026-07-09 cs.CL cs.AI cs.CV cs.LG 新提交 75%

Gradient-Based Speech-to-Text Alignment for Any ASR Model: From CTC to Speech LLMs

基于梯度的任意语音识别模型的语音到文本对齐:从连接主义时间分类到语音大语言模型

Albert Zeyer, Ralf Schlüter, Hermann Ney

机构 * Machine Learning and Human Language Technology Group, RWTH Aachen University(机器学习与人类语言技术组,亚琛工业大学) AppTek GmbH(AppTek公司)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究基于梯度的任意可微语音识别模型的语音到文本对齐方法,通过对教师强制令牌对数概率取梯度并解码,无需训练、改模型及对齐头,适用于各模型家族,在多模型上评估,结果显示该方法能产生可用对齐,有优有劣。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07162 2026-07-09 math.HO 新提交 75%

The Technological Turn in Mathematics

数学中的技术转向

Silvia De Toffoli, Fenner Tanswell

专题命中 其他LLM :LLM(abstract_cn);large language model(abstract);language model(abstract)

AI总结 探讨交互式定理证明器、自动定理证明器和大语言模型等技术对数学实践的影响,包括对数学知识创造与共享、社会层面如协作和信任关系的改变,以及引发的关于形式化本质和人机认知劳动分工等问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03929 2026-07-07 cs.CL cs.AI cs.LG 新提交 75%

Probe, Don't Prompt: A Hidden-State Probe for Metadata Filtering in Multi-Meta-RAG

探测而非提示:用于多元RAG中元数据过滤的隐藏状态探测器

Mykhailo Poliakov, Nadiya Shvai

机构 * National University of Kyiv-Mohyla Academy(基辅莫希拉学院国家大学)

专题命中 其他LLM :language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究改进多跳问答检索,用基于小型开源语言模型隐藏状态训练的确定性探测器取代专有提取器,探测器在准确率上有优势且输出空间固定,介绍了使其工作的设计选择及低成本输出方式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03238 2026-07-07 cs.SE 新提交 75%

An Empirical Study of Downstream Adaptation for Agent Skills

智能体技能下游适配的实证研究

Xinjian Wu, Jingzhi Gong, Gunel Jahangirova, Zhenpeng Chen, Jie M. Zhang

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 研究大语言模型智能体技能下游适配,分析六个技能库的1126个适配实例,构建含46种模式的分类法,揭示重用悖论,发现适配相互依赖及近五分之一适配引入安全敏感内容,为改进技能设计等提供启示。

Comments 10 pages, 3 figures, 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30942 2026-07-01 cs.HC cs.CY 新提交 75%

Anthropomorphism in AI Companion Communities: Age, Gender, and Emotional Correlates

AI伴侣社区中的拟人化:年龄、性别与情感相关性

Afia Mubashir, Boden Moraski, Stephanie Choi, Rose E. Guingrich

专题命中 其他LLM :large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本研究利用Reddit数据,分析AI伴侣社区中用户年龄、性别与拟人化倾向及情感表达的关系,发现成年人和女性更易拟人化,积极情感与拟人化正相关,且这些关系在成年人中更强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24060 2026-06-24 cs.SE 新提交 75%

Collaborative and AI-Supported Requirements Elicitation: An Empirical Study

协作与AI支持的需求获取:一项实证研究

Manoel Salgado Neto, Alan Araujo, Ronnie de Souza Santos

专题命中 其他LLM :LLM(abstract_cn);large language model(abstract);language model(abstract)

AI总结 通过混合方法控制实验,比较四种需求获取方法,发现结合协作与AI支持的方法产出质量最高,且被认为更清晰易执行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20595 2026-06-23 cs.HC 新提交 75%

Hybrid Intelligence in Cartoon Captioning: Evaluating AI as a Creative Writing Partner

卡通字幕中的混合智能:评估AI作为创意写作伙伴

Uğur Önal, Sanem Sariel, Metin Sezgin, Derya Akleman, Ergun Akleman

专题命中 其他LLM :large language model(abstract);language model(abstract);prompting(abstract)

AI总结 研究通过GPT-4o为IEEE计算机杂志卡通生成字幕,评估AI在幽默创作中的表现,发现AI能提供创意但需人类把控,建议作为辅助工具。

Comments 12 pages, 8 Figures, Accepted to AI Magazine

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17583 2026-08-19 cs.CL 新提交 74%

Auditing Exposure to Harmful Content on TikTok using Multimodal Language Models: A Cross-National, Age-Stratified Study

使用多模态语言模型对TikTok上的有害内容暴露情况进行审计:一项跨国、按年龄分层的研究

Hamidreza Saffari, Francesco Pierri

机构 * Politecnico di Milano(米兰理工大学)

专题命中 其他LLM :language model(title);分类 cs.CL

AI总结 本研究使用多模态大语言模型Gemini 2.5 Flash,在法、意、瑞三国对TikTok开展跨国年龄分层审计,发现关键词搜索会大幅提升有害内容占比,意国各年龄组有害内容占比最高,平台安全过滤器低估了明确有害内容。

Comments 20 pages, 16 figures, 14 tables. Accepted to Findings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17454 2026-08-19 cs.CL 新提交 74%

From Entity Mentions to Tone: An LLM-Based Pipeline for Media Bias Analysis

从实体提及到语气:基于大语言模型的媒体偏见分析流水线

Klesti Hoxha, Olti Qirici

机构 * University of Tirana(地拉那大学)

专题命中 其他LLM :LLM(title);分类 cs.CL

AI总结 该研究提出一种基于大语言模型的媒体偏见分析流水线,对8358篇阿尔巴尼亚新闻文章开展实验,验证了其在偏见分析中的有效性,适用于手动验证数据集或专用语言工具有限的场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28632 2026-08-03 cs.AI 新提交 74%

LLM Framework for Discovering Major Mathematical Conjectures: AI's Quest for the Next Riemann Hypothesis

用于发现重要数学猜想的大语言模型框架:AI对下一个黎曼猜想的探索

Alizer Wong, Zixin Zeng, Yi Tan, Wenyuan Li, Xuhang Chen, Xingru Lai, Yang Shi, Liangsi Lu, Yanhui Chen

专题命中 其他LLM :LLM(title);分类 cs.AI

AI总结 该研究提出一种三阶段大语言模型框架,用于系统发现重要数学猜想,经实验验证其在20个候选猜想上的形式化检查表现稳定,无重复问题。

Comments 25pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27617 2026-07-31 cs.AI 新提交 74%

Hidden APIs in Language Models: Discovering Reusable Causal Interfaces from Forked Futures

语言模型中的隐藏API:从分叉未来中发现可复用的因果接口

SiYuan Ma, Yiqin Luo, Zhangji, Canran Xiao, Albert Gao, Wei-Hsing Huang, Wei Wang, Qiwei Wu, Xinran Li, Jinfeng Wei, Qixin Zhang

机构 * Nanyang Technological University(南洋理工大学) Southern University of Science and Technology(南方科技大学) Tianjin University(天津大学) Sun Yat-sen University(中山大学) Carnegie Mellon University(卡内基梅隆大学) Georgia Institute of Technology(佐治亚理工学院) The Hong Kong Polytechnic University(香港理工大学) Shenzhen University(深圳大学) Tsinghua University(清华大学) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 其他LLM :language model(title);分类 cs.AI

AI总结 本研究从分叉未来采样后续操作以比较语言模型隐藏状态,发现共享接口在多模型评估中表现最优,支持测试操作库中存在可复用因果接口。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27308 2026-07-31 cs.LG q-bio.NC 新提交 74%

ZUNA1.1: A more flexible EEG foundation model for Denoising and Super-resolution

ZUNA1.1:一种更灵活的用于去噪和超分辨率的脑电图(EEG)基础模型

Christopher Warner, Jonas Mago, JR Huml, Beren Millidge

机构 * Zyphra

专题命中 其他LLM :foundation model(title);分类 cs.LG

AI总结 研究推出3.8亿参数的EEG基础模型ZUNA1.1,其灵活性远超原模型ZUNA1,在EEG去噪与重建任务中性能达标且显著优于MNE包的球形样条插值,已以Apache 2.0许可开源发布。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17420 2026-07-21 cs.CL cs.SE 新提交 74%

The Librarian Who Refused to Code: Model-Dependent Identity Enactment in LLM Code Generation

拒绝编码的图书管理员:大语言模型代码生成中依赖模型的身份设定

Shayell Aharon Salomon, Noam Israel, Ido Safruti, Amir Shaked

机构 * Bluebear Security(蓝熊安全公司)

专题命中 其他LLM :LLM(title);分类 cs.CL

AI总结 研究在可控条件下评估不同人物角色对代码生成的影响,测试了四种提示条件、两个模型等,发现角色影响因模型而异,如Claude Opus上图书管理员角色降低正确性,结果表明角色是依赖模型的行为策略偏差,还发布了相关数据和文档。

Comments 17 pages, 3 tables, no figures. Ancillary files include raw completions, derived scores, analysis scripts, persona texts, and preregistration

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18424 2026-06-18 stat.OT cs.AI cs.IT math.IT 新提交 74%

A Variational Framework for LLM Generator-Regulator Games

大语言模型生成器-调节器博弈的变分框架

Quanyan Zhu

机构 * Department of Electrical and Computer Engineering, Tandon School of Engineering, New York University, Brooklyn, NY, USA(电气工程系,工程学院,纽约大学,布鲁克林,纽约,美国)

专题命中 其他LLM :LLM(title);分类 cs.AI

AI总结 提出一个变分框架,将语言生成建模为熵正则化吉布斯分布,将调节建模为最优判别器,通过鞍点问题平衡效用、熵、调节一致性和有限长度可检测性,并通过审查过滤和钓鱼防御案例验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13515 2026-06-12 cs.CV cs.LG cs.RO 新提交 74%

MaskWAM: Unifying Mask Prompting and Prediction for World-Action Models

MaskWAM:统一掩码提示与预测的世界-动作模型

Hanyang Yu, Haitao Lin, Jingbo Zhang, Wenyao Zhang, Chenghao Gu, Heng Li, Ping Tan

机构 * The Hong Kong University of Science and Technology(香港科技大学) Tencent Robotics X(腾讯机器人X实验室) Tsinghua University(清华大学)

专题命中 其他LLM :prompting(title);分类 cs.LG

AI总结 提出MaskWAM,通过统一掩码输入与预测的混合Transformer架构,解决世界-动作模型的空间瓶颈,提升策略泛化能力,在LIBERO等任务上显著优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19875 2026-08-21 cs.CL cs.AI 新提交 73%

A knowledge-guided agentic framework for mitigating patient-context ambiguity in health queries

一种用于缓解医疗查询中患者上下文歧义的知识引导智能体框架

Mahyar Abbasian, Saba A. Farahani, Arshia Ilaty, Hung Cao, Ramesh Jain, Amir M. Rahmani

专题命中 其他LLM :language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 该研究提出知识引导智能体框架,通过解析医疗查询、构建假设、识别缺失上下文并提问,缓解患者上下文歧义,在诊断检索和饮食安全分类任务中显著提升了多种语言模型的性能。

Comments 48 pages, 3 figures, 6 tables, journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19220 2026-08-21 cs.CL cs.AI 新提交 73%

Can Conversational AI loosen Us-Versus-Them Boundaries? The Effects of Common, Dual, and Separate Identity Framings on Pro-Immigrant Intergroup Helping

对话式AI能否弱化“我们与他们”的界限?共同、双重及分离身份框架对支持移民的群体间帮助的影响

Oluwadamilola Jeboda, John F. Dovidio, Jonas R. Kunst

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 该研究通过与GPT-4o开展五轮对话的预先注册实验,发现强调共同或双重身份的AI对话可弱化群体间界限,提升行动意愿,且效应在各调节变量中基本一致。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12387 2026-08-14 cs.CL cs.AI 新提交 73%

Query Timing Produces Opposite Positional Biases Between LLMs and Humans

查询时机在大型语言模型(LLMs)与人类之间产生相反的位置偏差

Jasin Cekinmez, Addison J. Wu, Thomas L. Griffiths

机构 * Princeton University(普林斯顿大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 该研究探究查询时机对LLMs和人类位置偏差的影响,发现二者存在差异,且新LLMs的位置偏差比前代更显著。

Comments Entropic Award (Top 3 Paper), ICBINB @ ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11197 2026-08-12 cs.LG cs.CL 新提交 73%

Beyond a Bag of Features: Set-Level Instability in Sparse Autoencoders

超越特征袋:稀疏自编码器中的集合级不稳定性

Nikolai Bolik, Lennart Stöpler, Artur Andrzejak

机构 * Heidelberg University(海德堡大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL、cs.LG

AI总结 该研究以稀疏自编码器(SAE)隐集合重叠度为相似度度量,发现SAE特征不通过简单特征袋语义组合,其激活集合与人类概念判断存在显著不匹配。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08881 2026-08-11 cs.AI cs.CL 新提交 73%

Theory-Guided Deception Detection: A RAG-Based Artificial Intelligence Exploration

理论引导的欺骗检测:基于检索增强生成(RAG)的人工智能探索

David M. Markowitz, Timothy R. Levine

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 该研究基于欺骗理论开发7个RAG模型,对比4个大语言模型与基线模型的欺骗判断,发现RAG模型反应偏差更低但准确率无显著差异,理论引导AI判断当前参数下不可靠,优化后或有潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06779 2026-08-10 q-bio.QM cs.AI cs.CL 新提交 73%

Genotypic Triggers: Exposing Pharmacogenomic Blind Spots via Host-Specific Backdoors in Generative Antimicrobial Peptide Models

基因型触发器:通过生成抗菌肽模型中宿主特定后门暴露药物基因组学盲区

Doniyorkhon Obidov, Xiaolong Guo, Yonghui Li, Kaichen Yang

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 该研究提出基因型触发器后门攻击,操控抗菌肽生成模型使其针对特定HLA等位基因携带者生成高免疫原性风险肽,同时保留抗菌效力与低毒性,以暴露药物基因组学盲区。

详情

展开后加载摘要…

URL PDF HTML 收藏