arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12266 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12266 篇

2607.01742 2026-07-03 cs.CR cs.SE 新提交 67%

Knowledge Over Parameters: Evolving Smart Contract Vulnerability Detection

知识超越参数:演化智能合约漏洞检测

Yuqiang Sun, Han Liu, Ying Li, Yiran Zhang, Zong Cao, Ziyun Guo, Yang Liu

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 提出EvoVuln框架,将漏洞检测转化为程序性知识演化问题,通过运行时反转控制架构和两阶段演化流水线,仅用少量标注样本自动合成并优化检测逻辑,在五种真实漏洞类型上实现71%宏平均F1分数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26979 2026-07-03 cs.SE 新提交 67%

How Much Static Structure Do Code Agents Need? A Study of Deterministic Anchoring

代码智能体需要多少静态结构?关于确定性锚定的研究

Zhihao Lin, Mingyi Zhou, Yizhuo Yang, Li Li

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 研究轻量级静态分析(如调用图、继承层次)作为确定性锚定,通过注入结构注释提高代码智能体导航的可复现性和稳定性,发现锚定效果依赖粒度与仓库特性。

Comments Accepted to the ACM SIGSOFT International Symposium on Software Testing and Analysis (ISSTA 2026). 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20619 2026-07-03 cs.SE 版本更新 67%

Generating Project-Specific Test Cases with Requirement Validation Intention

生成具有需求验证意图的项目特定测试用例

Binhang Qi, Yun Lin, Xinyi Weng, Yuhuan Huang, Chenyan Liu, Hailong Sun, Zhi Jin, Jin Song Dong

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 提出IntentionTest方法,通过检索-编辑方式,根据验证意图描述生成项目特定测试,相比基线方法杀死更多突变体并提高测试通过率。

Comments Accepted at ISSTA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00083 2026-07-02 cs.CL cs.AI cs.LG 新提交 67%

Harnessing the Latent Space: From Steering Vectors to Model Calibrators for Control and Trust

利用潜在空间:从引导向量到模型校准器以实现控制与信任

Nishant Subramani

机构 * Carnegie Mellon University, Language Technologies Institute(卡内基梅隆大学语言技术研究所)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出利用潜在空间中的引导向量控制语言模型行为,并开发基于潜在空间的模型校准器评估输出可信度,从而增强模型的可控性与可靠性。

Comments ACL 2026 (BigPicture Workshop)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25189 2026-07-02 cs.OS 新提交 67%

ActPlane: Programmable OS-Level Policy Enforcement for Agent Harnesses

ActPlane:面向代理框架的可编程操作系统级策略执行

Yusheng Zheng, Tianyuan Wu, Quanzhi Fu, Tong Yu, Wenan Mao, Tao Ma, Dan Williams, Wei Wang, Andi Quinn

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 提出ActPlane,一种在操作系统内核中执行代理策略的引擎,通过eBPF实现信息流控制,弥补语义鸿沟,覆盖工具层无法观察的间接执行路径,开销1.9%-8.4%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29742 2026-06-30 cs.SE 67%

MicroAgent: Context-Augmented Multi-Agent Framework for Automatic Microservice Decomposition

MicroAgent: 用于自动微服务分解的上下文增强多智能体框架

Zishan Su, Junjie Huang, Shiwen Shan, Xingyan Chen, Hui Zeng, Yuxin Su, Yanlin Wang, Michael R. Lyu

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 提出MicroAgent框架,通过将分解任务分为五个子任务并分配专门智能体,结合多粒度上下文和设计原则分析工具,在10个Java Web应用上实现89.2%的平均分解准确率,较现有方法提升24.6%。

Comments Accepted at the 41st IEEE/ACM International Conference on Automated Software Engineering (ASE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00097 2026-06-30 cs.RO cs.MA 67%

RocketSmith: Agentic Additive Manufacturing of High-Powered Rockets

RocketSmith: 一种用于高功率火箭设计与制造的智能系统

Peter Pak, Jesse Barkley, Rumi Loghmani, Derek Baich, Ananya Pamal, Amir Barati Farimani

机构 * Graduate Research Assistant, Mechanical Engineering(机械工程研究生助理) AI Fellow, Mechanical Engineering(人工智能研究员,机械工程) Undergraduate Student, Mechanical Engineering(机械工程本科生) Senior Member, Pittsburgh Prefecture One(高级会员,匹兹堡郡一区) Russell V. Trader Associate Professor, Mechanical Engineering(Russell V. Trader副教授,机械工程)

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文提出RocketSmith,一种基于智能体系统的自动化设计、制造与优化框架,通过子智能体与技能实现零样本和人在回路的飞行参数优化,并利用增材制造成功开发并测试了四枚高功率火箭。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28081 2026-06-29 cs.HC cs.IR 新提交 67%

Context-Aware Explanations for Spatialized Document Layouts

空间化文档布局的上下文感知解释

Wei Liu, John Wenskovitch, Chris North, Rebecca Faust

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 提出CAPE框架,结合文档语义和布局空间上下文,通过识别空间模式并构建多级上下文表示,生成自然语言解释,支持AI引导概览和用户驱动探索,实验表明空间解释比纯内容基线更有助于理解布局空间组织。

Comments 10 pages, 4 figures, accepted to Graphics Interface 2026 (GI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16656 2026-06-29 cs.SE 版本更新 67%

GUIMigrator: Semantics-Preserving Transpilation from Android XML to Compose and SwiftUI

GUIMigrator: 从Android XML到Compose和SwiftUI的语义保持转译

Yi Gao, Xing Hu, Xin Xia, Xiaohu Yang

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 提出GUIMigrator框架,通过语义UI转译器(SUT)自动将Android XML UI迁移到Jetpack Compose和SwiftUI,保持视觉保真度和功能等价性,在31个开源应用上实现高迁移完整性和视觉相似度,减少90%以上手动工作量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26641 2026-06-26 cs.HC 新提交 67%

Invisible Impact of Empathy on Behavioral Change: Isolating the Effect of Empathy in Long-term Physical Activity Coaching Chatbot Interactions

共情对行为改变的隐形影响:在长期身体活动教练聊天机器人交互中隔离共情效应

Li Siyan, Kai-Hui Liang, Shopnil Shahriar, Yilin Ye, Shiyoh Goetsu, Wei-Wei Du, Masahiro Yoshida, Tsunayuki Ohwa, Xuhai Xu, Zhou Yu

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 通过构建仅共情水平不同的三个聊天机器人进行六周实验,发现用户难以区分共情程度,但高共情版本仍能增加步数并改善遵循意图,表明共情通过外围路径影响动机和信任。

Comments Shortened version of paper accepted into CUI Short paper and WIP

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08518 2026-06-26 physics.optics cond-mat.quant-gas physics.atom-ph 版本更新 67%

Fresnel zone plates for reconfigurable atomic waveguides

用于可重构原子波导的菲涅耳波带片

A. M. Pike, A. Dorne, L. Pickering, M. Jamieson, I. T. MacCuish, E. Riis, M. Y. H. Johnson, V. A. Henderson, P. F. Griffin, A. S. Arnold

专题命中 其他LLM :SLM(abstract,abstract_cn)

AI总结 提出一种结合菲涅耳波带片与空间光调制器优势的新型波带片,可生成大面积环形光场,用于超冷原子萨格纳克干涉测量。

Comments 10 pages, 5 figures, to appear in Optics Express

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.02384 2026-06-25 cs.SE cs.HC 版本更新 67%

A Low-Code Approach for the Automatic Personalization of Conversational Agents

一种低代码方法用于对话代理的自动个性化

Aaron Conrardy, Alfredo Capozucca, Jordi Cabot

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 通过系统文献综述,研究MDE领域用户建模现状,发现现有提案分散且维度覆盖有限,提出应建立统一可重用用户模型并利用ML自动推导用户画像以实现个性化。

Comments Published in the main track of the International Conference on Web Engineering (ICWE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24870 2026-06-24 cs.HC 新提交 67%

"Zooming In" on Agentic Web Browsers as Assistive Technologies: A Case Study with a Low-Vision Technology Expert

“放大”代理型网络浏览器作为辅助技术:一项低视力技术专家的案例研究

Laura Colazzo, Giuseppe Anzillotti

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 通过低视力专家案例研究,探讨基于大语言模型的代理型网络浏览器如何以对话方式辅助视障用户导航网页,发现其虽有限制但体验流畅灵活,有望提升无障碍性并减少交互障碍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23464 2026-06-23 cs.SE cs.CR 新提交 67%

An Automated Framework for Input Alphabet Construction in Stateful Protocol Implementation Learning

有状态协议实现学习中的输入字母表自动构建框架

JiongHan Wang, WenChao Huang

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 提出利用大语言模型自动解析协议消息布局并生成候选输入符号,结合小批量增量学习策略重用已学自动机,以解决手工构建输入字母表导致的探索不完整和语义缺陷问题。

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19216 2026-06-18 cs.SE cs.HC 新提交 67%

No Two Developers Think Alike: How Problem-Solving Styles and Experience Shape Needs in Conversational Interaction with Copilot

没有两个开发者想法相同:问题解决风格和经验如何塑造与 Copilot 对话交互中的需求

Jonan Richards, Bruno Alves de Oliveira, Iury Oliveira, Igor Wiese, Mairieli Wessel

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 通过混合方法出声思考研究,识别出5种交互模式和10种需求,并建立概念模型,揭示认知多样性如何影响开发者与GitHub Copilot的交互。

Comments Accepted at the International Conference on Software Maintenance and Evolution (ICSME), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14049 2026-06-15 cs.SD cs.CV 新提交 67%

FoleyGenEx: Unified Video-to-Audio Generation with Multi-Modal Control, Temporal Alignment, and Semantic Precision

FoleyGenEx: 统一视频到音频生成,具备多模态控制、时间对齐与语义精度

Shiyao Wang, Xijuan Zeng, Hui Wang, Shiwan Zhao, Feng Deng, Chen Zhang, Yong Qin

机构 * Academy for Advanced Interdisciplinary Studies, Nankai University(南开大学前沿交叉学科研究院) Kling Team, Kuaishou Technology(快手科技Kling团队)

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 提出FoleyGenEx统一框架,通过条件注入、多模态动态掩码和副词数据增强,实现视频到音频生成中多模态控制、帧级时间对齐与细粒度语义的同步合成。

Comments Accepted by INTERSPEECH 2026

Journal ref INTERSPEECH 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05476 2026-06-05 cs.CR cs.MA 67%

SHIELDS: Automating OS Hardening with Iterative Multi-Agent Remediation

SHIELDS: 通过迭代多智能体修复实现操作系统加固自动化

Andrew Hamara, Dwight Horne, Aldehir Rojas, Timothy Kurniawan, Sophie Lamothe, Vishal Suresh, Nicholas Turoci, Lawrence Wong

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 提出SHIELDS多智能体系统,利用大语言模型通过迭代反馈驱动的方式自动修复操作系统安全配置错误,在多种虚拟机配置下成功修复高达73%的扫描发现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03190 2026-06-03 cs.HC 67%

Focused on the User, Overlooking the Risks: Security and Privacy Understandings, Practices and Challenges of Independent Chinese AI Agent Developers

聚焦用户,忽视风险:中国独立AI代理开发者的安全与隐私理解、实践与挑战

Shuning Zhang, Mingyao Xu, Zhixin Huang, Yutong Jiang, Rongjun Ma, Yuting Yang, Xin Yi, Kanye Ye Wang, Hewu Li

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 通过访谈28名中国独立AI代理开发者,发现他们以用户为中心,关注面向用户的安全风险(如有害内容),但对安全漏洞意识薄弱,依赖临时手动防护和非正式沟通,缺乏正式工具和流程,主要受限于缺乏安全培训、工具和平台指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03764 2026-06-03 cond-mat.mtrl-sci 67%

RamanGPT: Bidirectional Mapping Between Crystal Structures and Raman Spectra with Graph Neural Networks and Generative Transformers

RamanGPT: 基于图神经网络与生成式Transformer的晶体结构与拉曼光谱双向映射

Frank M. Abel, Jaehyung Lee, Charles R. Campbell, Kamal Choudhary

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 提出RamanGPT框架,利用图神经网络(ALIGNN)实现从晶体结构预测拉曼光谱(正向问题),并通过量化低秩适配微调大语言模型实现从拉曼光谱反推晶体结构(逆向问题),在计算数据库和实验数据上验证了有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02332 2026-06-03 cs.AI cs.CL cs.LG 67%

Forget Attention: Importance-Aware Attention Is All You Need

忘记注意力:重要性感知注意力即你所需

Suhyeong Shin, Yeongwook Yang

机构 * Department of Computer Engineering(计算机工程系)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出SISA方法,通过将状态空间模型的重要性信号直接融入注意力分数计算,实现分数级融合,在语言建模中兼顾全局检索与重要性排序。

Comments 20 pages, 6 figures, 25 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00088 2026-06-02 cs.CR cs.CY 67%

From Frontier to Shadow AI: A Simmering Threat to Assurance and Security in Critical Infrastructure

从前沿AI到影子AI:对关键基础设施保障与安全的潜伏威胁

Mohan Baruwal Chhetri, Shahroz Tariq, Tooba Aamir, Marthie Grobler, Chandra Thapa, Ronal Singh

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本研究通过访谈澳大利亚27家关键基础设施组织的高管,首次实证分析了影子AI在关键基础设施中的表现、风险及安全退化机制,提出了边界绕过、未评估能力扩展和治理规避三种威胁模型。

Comments 21 pages, 2 figures, 2 tables, paper under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04672 2026-06-02 cs.CV cs.GR cs.RO 67%

AGILE: Hand-Object Interaction Reconstruction from Video via Agentic Generation

AGILE: 通过代理生成从视频重建手-物体交互

Jin-Chuan Shi, Binhong Ye, Tao Liu, Junzhe He, Yangjinhui Xu, Xiaoyang Liu, Zeju Li, Hao Chen, Chunhua Shen

机构 * State Key Lab of CAD & CG, Zhejiang University(浙江大学计算机辅助设计与图形学国家重点实验室) Zhejiang University of Technology(浙江工业大学)

专题命中 其他LLM :language model(abstract);foundation model(abstract)

AI总结 提出AGILE框架,利用视觉语言模型引导生成完整物体网格,结合锚定-跟踪策略和接触感知优化,从单目视频鲁棒重建手-物体交互,生成可直接用于仿真的资产。

Comments 16 pages, SIGGRAPH 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30784 2026-06-01 cs.CV 67%

Text-guided Feature Disentanglement for Cross-modal Gait Recognition

文本引导的跨模态步态识别特征解耦

Zhiyang Lu, Ming Cheng

机构 * Fujian Key Laboratory of Urban Intelligent Sensing and Computing, Xiamen University(福建城市智能感知与计算重点实验室,厦门大学) Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University(多媒体可信感知与高效计算重点实验室,中华人民共和国教育部,厦门大学)

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 针对LiDAR与RGB相机之间的模态差异,提出TCFDNet网络,利用文本先验引导解耦模态共享特征,通过CLIP对齐、特征解耦和稳定性增强实现跨模态步态识别,在SUSTech1K和FreeGait数据集上达到最优性能。

Comments Accept by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29399 2026-05-29 cs.HC cs.SI 67%

Expecting Empathy: How Interaction Context Shapes Norms for Empathic Response in Digital Communication

期待共情:交互情境如何塑造数字沟通中共情回应的规范

Tao Wang, Chi-Ching Juan

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 本文通过分析Reddit建议社区的28,239个帖子-回复对,识别出“压力下的决策支持”这一中间交互类型,并验证其具有高共情与高工具性的非对称共情特征,为情感AI的共情校准提供基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28820 2026-05-28 cs.CV 67%

From Pixels to Words -- Towards Native One-Vision Models at Scale

从像素到文字——迈向原生单视觉大规模模型

Haiwen Diao, Jiahao Wang, Penghao Wu, Yuhao Dong, Yuwei Niu, Yue Zhu, Zhongang Cai, Weichen Fan, Linjun Dai, Silei Wu, Xuanyu Zheng, Mingxuan Li, Yuanhan Zhang, Bo Li, Hanming Deng, Huchuan Lu, Quan Wang, Lei Yang, Lewei Lu, Dahua Lin, Ziwei Liu

机构 * S-Lab, NTU(S实验室,国立科技大学) SenseTime Research(商汤科技研究院) DLUT(大连理工大学)

专题命中 其他LLM :language model(abstract);foundation model(abstract)

AI总结 本文提出NEO-ov原生基础模型,通过端到端学习跨帧和像素-文字对应,无需外部编码器或适配器,在细粒度视觉感知上缩小了与模块化模型的差距,验证了原生单视觉架构的可行性和竞争力。

Comments 13 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28239 2026-05-28 cs.CV 67%

Learning to Label: A Reinforced Self-Evolving Framework for Semi-supervised Referring Expression Segmentation

学习标注:一种用于半监督指代表达分割的强化自进化框架

Runlong Cao, Ying Zang, Chuanwei Zhou, Tianrun Chen, Tong Zhang, Zhen Cui, Chunyan Xu

机构 * School of Computer Science and Engineering, Nanjing University of Science and Technology(南京理工大学计算机科学与工程学院) School of Information Engineering, Huzhou Normal University(湖州师范学院信息工程学院) School of Artificial Intelligence, Nanjing University of Posts and Telecommunications(南京邮电大学人工智能学院) National Key Laboratory of Tibetan Language Intelligence(藏语智能国家重点实验室) Zhejiang University(浙江大学) Beijing Normal University(北京师范大学)

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 提出L2L框架,通过强化学习将伪标签构建转化为可学习的决策过程,结合多模态大模型提取先验,实现半监督指代表达分割的联合优化。

Comments 24 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27634 2026-05-28 cs.HC 67%

Structuring Human-AI Productive Interdependence by Strategic Level of Automation Selection for Qualitative Inquiry

通过定性研究中的自动化水平战略选择构建人机生产性相互依赖

Feng Zhou, Jacqueline Meijer-Irons, Ambar Murillo

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文基于相互依赖理论,提出一个形式化框架,通过评估任务风险和验证成本来选择适当的自动化水平,以构建人机生产性相互依赖,从而解决定性分析中大规模语言模型自动化与解释性本质之间的冲突。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10548 2026-05-26 cs.CV 67%

Blink: Dynamic Visual Token Resolution for Enhanced Multimodal Understanding

Blink: 动态视觉令牌分辨率增强多模态理解

Yuchen Feng, Zhenyu Zhang, Naibin Gu, Yilong Chen, Peng Fu, Zheng Lin, Shuohuan Wang, Yu Sun, Hua Wu, Weiping Wang, Haifeng Wang

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院) Baidu Inc(百度公司)

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 提出Blink框架,通过注意力引导的令牌超分辨率和动态丢弃机制,在单次前向传播中模拟人类眨眼式扫描,提升多模态大语言模型的视觉感知能力。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23684 2026-05-25 cs.IR cs.CY 67%

Synthetic Sources?: Auditing Generative Search Engine Citations for Evidence of AI-Generated Sources

合成来源?:审计生成式搜索引擎引用中是否存在AI生成的来源

Mowafak Allaham, Nicholas Diakopoulos

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 通过审计四个生成式搜索引擎(ChatGPT、Copilot、Gemini、Perplexity)在政治、健康和环境领域的712个真实用户查询,发现约16%的引用来源是AI生成的,并识别了频繁被引用的关键网络域名。

Comments 11 pages + Appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11562 2026-05-25 cs.HC 67%

A Generative AI Driven Interactive Narrative Serious Game for Stress Relief and Its Randomized Controlled Pilot Study

一种生成式AI驱动的交互式叙事严肃游戏用于压力缓解及其随机对照试点研究

Ting-Chen Hsu

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 本研究开发了基于Unity和ChatGPT的生成式AI驱动严肃游戏“Reverie”,并通过14天试点实验证明其能显著降低压力水平并改善认知情绪调节策略。

详情

展开后加载摘要…

URL PDF HTML 收藏