arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12193 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12193 篇

2604.19315 2026-07-23 cs.SE 89%

Improving LLM-Driven Test Generation by Learning from Mocking Information

通过学习模拟信息改进LLM驱动的测试生成

Jamie Lee, Flynn Teh, Hengcheng Zhu, Mengzhen Li, Mattia Fazzini, Valerio Terragni

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文提出MOCKMILL方法,利用开发者编写测试中的模拟信息自动生成测试用例,通过迭代生成与修复过程提升测试覆盖率和有效性。

Comments Accepted for publication in ICST 2026 (AIST workshop). This arXiv version is the authors' accepted manuscript

Journal ref IEEE Conference on Software Testing, Verification and Validation Workshop 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18250 2026-07-22 cs.HC 新提交 89%

Anthropomorphism in Children's Interactions with LLM Chatbots: A Systematic Review of Drivers and Outcomes

儿童与基于大语言模型的聊天机器人互动中的拟人化:驱动因素和结果的系统综述

Hansinie Madushika Jayathilake, Renkai Ma

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 本研究通过分析35项实证研究,系统综述儿童与LLM聊天机器人互动中拟人化的驱动因素及结果,发现类人角色构建等驱动互动,出现五种拟人化结果,可为相关聊天机器人设计开发提供参考。

Comments Accepted by ACM IDC '26

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17022 2026-07-21 cs.SE cs.HC 新提交 89%

Can LLM Code Explanations Adapt to Diverse Problem-Solvers' Needs?

大语言模型代码解释能否适应不同问题解决者的需求?

Andrew Anderson, David Piorkowski, Justin Weisz, Margaret Burnett, Kush Varshney

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 研究LLM代码解释能否适应不同问题解决者需求,基于包容性设计方法开发提示,用自然语言处理技术从六个LLM生成代码解释,发现13种语言适应分类法,贡献两种问题解决适应方法。

Comments To be published in AAAI/ACM conference on AI, Ethics, and Society (AIES 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15977 2026-07-20 cs.CR 新提交 89%

Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization

拒绝并非安全!评估大语言模型驱动的内容幽默化中的潜在安全风险

Yu Cui, Ruiqing Yue, Tingyu Li, Sicheng Pan, Zhuoyu Sun, Xufeng Zhang, Baohan Huang, Haibin Zhang, Cong Zuo

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 研究基于LLM的内容幽默化潜在安全风险,提出HumorSafe框架评估风险传播,发现LLMs幽默化时会引入刻板印象和毒性,还提出HumorPIA攻击,揭示现有LLM安全评估在幽默化设置下的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04915 2026-07-20 cs.HC 89%

Exploring Expert Perspectives on Wearable-Triggered LLM Conversational Support for Daily Stress Management

探索专家对可穿戴触发LLM对话支持日常压力管理的视角

Poorvesh Dongre, Sameer Neupane, Priyanka Jadhav, Nikitha Donekal Chandrashekar, Christian Webb, Denis Gračanin

专题命中 其他LLM :LLM(title,title_cn)

AI总结 本文提出EmBot应用,结合可穿戴设备压力检测与LLM对话支持,通过专家访谈揭示设计中的早期紧张点和考虑因素,为日常压力管理和心理健康支持系统设计提供指导。

Journal ref IH '26: Proceedings of the 2026 ACM Interactive Health Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31762 2026-07-01 cs.HC 新提交 89%

Investigating LLM-Powered Dissenting Minority Support in Power-Imbalanced Group Decision-Making: Counterargument and Mediation as Intervention Strategies

探究LLM赋能的异议少数群体在权力不平衡群体决策中的支持:反驳与调解作为干预策略

Soohwan Lee, Seoyeong Hwang, Mingyu Kim, Dajung Kim, Kyungho Lee

专题命中 其他LLM :LLM(title,title_cn)

AI总结 本研究开发了LLM赋能的异议少数支持系统,通过AI生成的反驳或AI调解消息来关注少数观点,实验发现反驳增强满意度但调解增加参与却降低心理安全感,揭示了参与与心理安全之间的支持悖论。

Comments Accepted at CSCW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15031 2026-06-25 econ.EM 新提交 89%

Partial Identification from LLM Prompts

从LLM提示中的部分识别

Xiaohong Chen, Ashesh Rambachan, Elie Tamer

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 研究利用大语言模型作为二元分类器时,在真实标签未知且报告误差可能任意相关的情况下,通过外部校准分数和事件来部分识别真实流行度θ,并刻画识别边界。

Comments 31 PAGES TOTAL. NO FIGURES

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23791 2026-06-24 hep-ph 新提交 89%

One Generator, Any Process: LLM-Conditioning for the LHC

一个生成器,任意过程:LHC的LLM条件生成

Henning Bahl, Tilman Plehn, Daniel Schiller, Thanush Sivagnanalingam

专题命中 其他LLM :LLM(title,title_cn);foundation model(abstract)

AI总结 提出利用预训练LLM为自回归变压器提供描述性嵌入,通过连续参数、过程标签和费曼图的条件化方案,实现LHC事件生成网络的快速收敛、更优结果及对未见过程的泛化。

Comments 33 pages, 23 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19904 2026-06-19 cs.SI 新提交 89%

Toward Temporal Realism in City-Scale Crisis Response Simulation using LLM Agents

面向城市级危机响应模拟中时间真实性的LLM智能体方法

Anping Zhang, Yang Tan, Yuanbo Tang, Huaze Tang, Qiuhua Ye, Marta C. Gonzalez, Yang Li

专题命中 其他LLM :LLM(title,title_cn)

AI总结 针对LLM社会模拟缺乏时间真实性的问题,基于深圳疫情志愿活动数据,提出数据校准的自激与危机激活机制,实现爆发性时间模式,使智能体时间分布接近真实。

Comments 11pages,7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14796 2026-06-16 cs.SE 新提交 89%

Faster Code, Deeper Debt? A Multivocal Literature Review on Technical Debt and Its Early Signs in LLM-Assisted Software Development

更快的代码,更深的债务?关于LLM辅助软件开发中技术债务及其早期迹象的多声部文献综述

Ramtin Ehsani, Shriya Rawal, Yuanfang Cai, Preetha Chatterjee

专题命中 其他LLM :LLM(title,title_cn)

AI总结 通过104篇文献的多声部综述,发现LLM辅助开发放大传统技术债务(代码、设计、文档债务)并引入新债务(快速集成、提示、伦理、数据、来源债务),提出人机协同、提示工程等缓解策略,但缺乏标准化基准。

Comments Accepted for publication in ACM Transactions on Software Engineering and Methodology (TOSEM), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11877 2026-06-11 cs.NI 新提交 89%

LLM-Enabled NWDAF: A Step Toward AI-Native 6G Network Intelligence

LLM赋能的NWDAF:迈向AI原生的6G网络智能

Henok Daniel, Omar Alhussein, Cheng Li, Jie Liang, Ernesto Damiani

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 开发了一个与Free5GC兼容的开源NWDAF,集成大语言模型接口,通过意图识别实现自然语言交互,简化网络分析管理,为AI原生6G网络奠定基础。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10749 2026-06-11 cs.CR 版本更新 89%

AttriGuard: Defeating Indirect Prompt Injection in LLM Agents via Causal Attribution of Tool Invocations

AttriGuard: 通过工具调用的因果归因击败LLM代理中的间接提示注入

Yu He, Haozhe Zhu, Yiming Li, Shuo Shao, Hongwei Yao, Zhihao Liu, Zhan Qin

专题命中 其他LLM :LLM(title,title_cn)

AI总结 针对LLM代理易受间接提示注入攻击的问题,提出基于并行反事实测试的运行时防御AttriGuard,通过因果归因区分用户意图驱动与不可信观察驱动的工具调用,在多个基准上实现0%攻击成功率。

Comments Accepted by USENIX Security 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10434 2026-06-10 cs.HC cs.ET 新提交 89%

Profiling cognitive offloading in LLM-mediated synthesis writing: Volume vs. content

LLM中介的合成写作中认知卸载的剖析:数量与内容

Oleksandra Poquet, Mani Shankar Nanduri, Maria Ximena Salinas Loyer, Matthias Stadler, Michael Sailer, Jelena Jovanovic

专题命中 其他LLM :LLM(title,title_cn)

AI总结 本研究通过聚类分析比较了两种认知卸载剖析方法(基于使用量和基于内容),发现内容剖析能揭示更丰富的认知模式,为理解LLM如何重新分配认知活动提供新视角。

Comments Accepted to the Proceedings of the European Conference for Tecnology-Enhanced Learning' 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10311 2026-06-10 cs.SE 新提交 89%

From Awareness to Action: How Developers Engage with Accessibility Innovation in LLM-Assisted Development

从意识到行动:开发者如何在LLM辅助开发中参与无障碍创新

Thayssa Águila da Rocha, Luciane Silva, Ana Duarte, Marcelle Pereira Mota, Gustavo Pinto

专题命中 其他LLM :LLM(title,title_cn)

AI总结 通过分析14个基于LLM的无障碍项目提案和9名参与者的焦点小组讨论,发现由残障人士主导的倡议能促进包容性创新,推动无障碍从合规要求转变为技术卓越和文化变革的驱动力。

Comments WASHES 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04397 2026-06-10 cs.SE cs.IR 版本更新 89%

Context-as-AI-Service: Surfacing Cross-File Dependency Chains for LLM-Generated Developer Documentation

上下文即服务:为LLM生成的开发者文档揭示跨文件依赖链

Ameya Gawde, Vyzantinos Repantis, Harshvardhan Singh, Lucy Moys

专题命中 其他LLM :LLM(title,title_cn)

AI总结 提出Context-as-a-Service (CaaS)检索层,通过索引代码库并支持关键词与语义搜索,帮助LLM代理在生成或审查文档时追踪跨文件依赖链,实验表明CaaS能发现基线遗漏的错误并减少时间和输入令牌消耗。

Comments 8 pages, 2 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07821 2026-06-09 physics.optics 新提交 89%

Independent amplitude and phase control using a single phase-only SLM

使用单个纯相位SLM实现独立幅度和相位控制

Marius Constantin Chirita Mihaila, Mikuláš Fiala, Martin Kozák

专题命中 其他LLM :SLM(title,title_cn)

AI总结 提出利用单个纯相位空间光调制器(SLM)的不同区域实现双调制平面,通过偏振器将相位转换为幅度调制,实现复振幅调制的紧凑方案,并验证了贝塞尔-高斯光束等生成。

Comments v2: AAM; licence: CC BY 4.0

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06936 2026-06-08 cs.HC 新提交 89%

Personality Anchoring for Social Simulation: Linking Personality, Social Behavior, and Interaction Success with LLM Agents

社会模拟的人格锚定:将人格、社会行为与交互成功关联于LLM智能体

Vahid Sadiri Javadi, Aksa Aksa, Fryderyk Róg, Lucie Flek, Johanne R. Trippas

专题命中 其他LLM :LLM(title,title_cn)

AI总结 提出人格锚定方法,利用电影角色构建多LLM社会模拟,发现双人宜人性组合与共享目标达成呈单调关系,同质宜人性对成功率是同质不宜人性的10倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15202 2026-06-08 cs.DC cs.OS 版本更新 89%

Simple is Better: Multiplication May Be All You Need for LLM Request Scheduling

简单即最佳:乘法可能就是LLM请求调度所需的一切

Dingyan Zhang, Jinbo Han, Kaixi Zhang, Xingda Wei, Sijie Shen, Chenguang Fang, Wenyuan Yu, Jingren Zhou, Rong Chen

专题命中 其他LLM :LLM(title,title_cn)

AI总结 本文提出通过简单乘法结合KVCache和负载均衡指标,实现LLM请求调度的双重目标,无需超参数调优,实验显示在真实工作负载中显著提升性能。

Comments To appear in the Proceedings of 20th USENIX Symposium on Operating Systems Design and Implementation (OSDI'26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10102 2026-06-02 cs.MA 89%

When Identity Overrides Incentives: Representational Choices as Governance Decisions in Multi-Agent LLM Systems

当身份压倒激励:多智能体LLM系统中的表征选择作为治理决策

Viswonathan Manoranjan, Snehalkumar `Neil' S. Gaikwad

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 通过四智能体战略博弈实验,发现角色身份分配会抑制基于报酬的行为,使均衡选择偏移高达90个百分点,表明表征选择是决定系统输出的治理决策。

Comments Accepted to ACM FAccT 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14661 2026-06-02 cs.IT math.IT 89%

LLM-Enabled Automated Algorithm Design for Multiuser Fluid Antenna Communications

面向多用户流体天线通信的LLM自动化算法设计

Gan Zheng, Fei Liu, Qingfu Zhang

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 针对流体天线系统中端口选择这一大规模组合优化问题,提出利用大语言模型自动设计优化算法(包括改进遗传算法和从头设计启发式算法AutoPort),以最大化最小信干噪比,实现接近最优的性能。

Comments This paper has been accepted in IEEE Transactions on Wireless Communications

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00142 2026-06-02 cs.HC 89%

Practice Less, Explain More: LLM-Supported Self-Explanation Improves Explanation Quality on Transfer Problems in Calculus

少练习,多解释:LLM 支持的自我解释提高了微积分迁移问题的解释质量

Eason Chen, Xinyi Tang, Yvonne Zhao, Meiyi Chen, Meryam Elmir, Elizabeth McLaughlin, Mingyu Yuan, Yumo Wang, Shyam Agarwal, Jared Cochrane, Jionghao Lin, Tongshuang Wu, Ken Koedinger

专题命中 其他LLM :LLM(title,title_cn)

AI总结 通过对比无自我解释、菜单式自我解释和LLM支持的开放式自我解释三种条件,发现开放式自我解释在迁移问题(尤其是NEI问题)上显著提高了解释质量,尽管练习数量较少。

Comments 9 pages, 2 figures. Accepted at AIED 2026. Camera-ready version with updated references

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28071 2026-05-28 cs.CR 89%

AgentGuard: An Attribute-Based Access Control Framework for Tool-Use LLM-Based Agent

AgentGuard:面向工具使用型LLM智能体的基于属性的访问控制框架

Jiaqi Luo, Songyang Peng, Jiarun Dai, Zhile Chen, Zhuoxiang Shen, Geng Hong, Xudong Pan, Yuan Zhang, Min Yang

专题命中 其他LLM :LLM(title,title_cn)

AI总结 提出AgentGuard框架,通过客户端-服务器架构和三种互补检查机制,为工具使用型LLM智能体提供轻量级集成与跨工具安全风险防护。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27716 2026-05-28 cs.SE 89%

LLM Based Web Accessibility Repair: An Empirical Study of Detection, Remediation, and Cost

基于LLM的网页可访问性修复:检测、修复与成本的实证研究

Oluwatoyosi Oyelayo, Ghada Abushaqra, Parham Asadi, Durjoy Dey, Diego Elias Costa

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文通过实证研究评估基于大语言模型的智能体(Kimi K2.5)在网页可访问性自动检测与修复中的性能,发现其检测能力与规则工具相当但可靠性不足,修复在语法有效性上表现优异但完全修复率低,且迭代优化增加成本而无益,提出混合方法的需求。

Comments 12 pages, 6 figures, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17318 2026-05-20 hep-ph 89%

RooAgent: An LLM Agent for Root-Based High Energy Physics Analysis

RooAgent:基于根的高能物理分析的LLM代理

Aman Desai

专题命中 其他LLM :LLM(title,title_cn)

AI总结 本文提出RooAgent,一种通过自然语言接口进行根基于高能物理数据分析的LLM代理,支持两种操作模式,并实现了包括直方图检查、事件选择、动量分布可视化、拟合和显著性估计在内的多种任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16976 2026-05-19 cs.CR 89%

Securing LLM Agents Need Intent-to-Execution Integrity

为LLM代理的安全性需要意图到执行的完整性

Wenjie Qu, Ming Xu, Peiran Wang, Shengfang Zhai, Jiaheng Zhang, Dawn Song

专题命中 其他LLM :LLM(title,title_cn)

AI总结 本文提出了一种新的正确性属性,用于定义LLM代理在执行时如何忠实反映用户的意图,同时提出了四个必须同时满足的完整性属性,以确保代理的安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00560 2026-05-19 cs.CR cs.SE quant-ph 89%

Quantum-Safe Code Auditing: LLM-Assisted Static Analysis and Quantum-Aware Risk Scoring for Post-Quantum Cryptography Migration

量子安全代码审计:基于LLM的静态分析与量子感知风险评分用于后量子密码学迁移

Animesh Shaw

专题命中 其他LLM :LLM(title,title_cn)

AI总结 本文提出量子安全代码审计工具,结合正则表达式检测量子脆弱算法、LLM辅助上下文丰富及VQE模型风险评分,评估五个开源库发现5775项问题,实现高精度和召回率。

Comments 13 pages, 2 figures. Code and evaluation data: https://github.com/AnimeshShaw/quantum-safe-auditor

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13776 2026-05-14 cs.HC 89%

"Like Taking the Path of Least Resistance": Exploring the Impact of LLM Interaction on the Creative Process of Programming

像选择阻力最小的路径:探索LLM交互对编程创作过程的影响

Zeinabsadat Saghi, Run Huang, Souti Chattopadhyay

专题命中 其他LLM :LLM(title,title_cn)

AI总结 研究通过对比LLM辅助与无辅助条件,发现LLM能缩短编程创意生成时间,但生成的解决方案创意点数与用户自创相当,探讨了LLM在支持用户创造力方面的设计启示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12875 2026-05-14 cs.CR 89%

Do Skill Descriptions Tell the Truth? Detecting Undisclosed Security Behaviors in Code-Backed LLM Skills

技能描述是否真实?在代码支持的LLM技能中检测未披露的安全行为

Wenhui He, Yue Li, Bang Fu, Huan Xing, Xing Fan, ZeHua Zhang, Baoning Niu

专题命中 其他LLM :LLM(title,title_cn)

AI总结 本文研究LLM生态系统中程序性技能描述与实现之间的不一致,通过构建安全属性分类法和SKILLSCOPE工具,发现9.4%的技能存在安全风险,工具在识别不一致时达到84.8%的精度和96.5%的召回率。

Comments 11 pages, 3 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10964 2026-05-13 cs.GT 89%

Mechanism Design for Quality-Preserving LLM Advertising

面向质量保持的LLM广告机制设计

Jiale Han, Xiaowu Dai

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文提出一种质量保持拍卖框架,通过检索增强生成技术,结合KL正则化和筛选VCG机制,在保证内容忠实性的同时提升广告收益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27022 2026-05-01 cs.HC 89%

Breaking Bad Financial Habits: How LLM Conversations Correct Financial Misconceptions

打破不良财务习惯:LLM对话如何纠正财务误解

Jillian Ross, Eric So, Andrew W. Lo

专题命中 其他LLM :LLM(title,title_cn)

AI总结 研究发现,精心设计的LLM能有效持久纠正财务误解,关键在于纠正意图和受体接受度,为传统财务教育提供可扩展替代方案。

详情

展开后加载摘要…

URL PDF HTML 收藏