arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 762 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 762 篇

2608.12582 2026-08-14 cs.HC cs.AI 新提交 70%

Not All Nudges Land: Behavioral Controllability and Elaboration Quality in AI-Supported Journaling

并非所有助推都能落地:AI辅助日记中的行为可控性与阐述质量

Nadia Mehjabin, Henry Kautz, Subigya Nepal

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 该研究针对AI辅助日记,分析369篇条目后发现,涉及他人的行为改善率仅15%-22%,个人可独立实施的行为改善率达50%-63%,文本特征影响较小,为AI日记助推的适用方向提供了探索性结论。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12511 2026-08-14 cs.CR cs.CL 新提交 70%

SoK: From Generation to Consumption of Privacy Documents in Software Systems

SoK:软件系统中隐私文档的生成与使用

Shidong Pan, Clark LaChance, Zhen Tao, Sepideh Ghanavati

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 本SoK从软件工程视角,系统分析2010-2025年290篇论文,梳理隐私文档全生命周期研究,识别趋势与开放机会,为相关研究提供统一基础。

Comments This SoK paper has been accepted by NDSS 2027

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12361 2026-08-14 cs.CL cs.CY 新提交 70%

New Terms, New Toxicity: Consensus-based Chinese Neologism Toxicity Detection via Search-Augmented LLMs

新术语,新毒性:基于共识的新词毒性检测——通过搜索增强型大语言模型(LLMs)

Shiyao Cui, QingLin Zhang, Di Wang, Yida Lu, Zhexin Zhang, Jinhua Gao, Jinglin Yang, Min He, Han Qiu, Minlie Huang

机构 * Tsinghua University(清华大学) ICT, CAS(中国科学院计算技术研究所) National Computer Network Emergency Response Technical Team Coordination Center of China(国家计算机网络应急技术处理协调中心) IIE, CAS(中国科学院工程热物理研究所) School of Cyber Security, UCAS(中国科学院大学网络空间安全学院) JCSS, Tsinghua University(清华大学软件学院) Science City (Guangzhou) Digital Technology Group Co., Ltd.(广州科学城数字科技集团有限公司)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文针对毒性新词的检测问题,提出捕捉毒性新词起源与共识标准的分类法,构建风险词表,引入搜索增强型框架SeTox,实验显示3B规模的SeTox性能优于近期大规模模型。

Comments ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10050 2026-08-12 cs.LG 新提交 70%

Observational Policy Ranking for SMB Financial Guidance from Multi-Action Accounting Logs

基于多动作会计日志的中小企业财务指导观测策略排序

Shrutendra Harsola, Vignesh Subrahmaniam, Vikas Raturi, Kamalika Das, Xiang Gao, Kratika Gupta, Ruocheng Guo, Padmaja Jonnalagedda, Ananya Pramod, Sricharan Kumar

机构 * Foresight-AI(预见人工智能) Intuit(英图易公司)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.LG

AI总结 该研究针对中小企业财务指导的观测策略排序问题,提出CAR-PL方法,通过85078个公司-月度数据验证,其在毛利润等指标上表现优异,可实现多动作会计日志下的财务指导类别排序。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08510 2026-08-11 cs.CL 新提交 70%

From Speech to Interaction: Analyzing Multimodal Systems in Cocktail-Party Scenarios

从语音到交互:鸡尾酒会场景下多模态系统的分析

Thai-Binh Nguyen, Zhaolin Li, Jan Niehues, Alexander Waibel

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究分析了CHiME-9 MCoRec任务中不同多模态系统解决鸡尾酒会场景的策略,发现最优系统实现57%相对错误减少,且高语音重叠并非性能差异的主要原因。

Comments Accepted at ICMI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08026 2026-08-11 cs.AI 新提交 70%

The Authority Expectancy Effect in Multi-User Conflict

多用户冲突中的权威预期效应

Eunna Lee

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究在Claude、Gemini、GPT、Grok四个LLMs上开展三类实验,发现社会权威信号可重构模型判断,提出并表征了具有参考依赖、证据重新解释、方向敏感性特性的权威预期效应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07808 2026-08-11 cs.CR cs.AI 新提交 70%

The Anatomy of a Prompt Injection: A Component Model for Structured Analysis

提示注入的剖析:用于结构化分析的组件模型

Jeremy McHugh

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出七个组件的提示注入结构化分析模型,统一相关分类法,结合实例与CTI模式,助力标记、分析提示注入攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07541 2026-08-11 cs.CV cs.AI cs.MA 新提交 70%

NeuroPilot: An Agent-Driven Smart Pipeline for Processing, Quality Control, and Managing Neuroimages

NeuroPilot:一种用于神经影像处理、质量控制与管理的智能体驱动智能流程

Yiyao Chen, Yucheng Li, Jungong Tong, Shaoqi Wang, Kunhao Zhou, Ziquan Wei, Monica Murea, Marissa DiPiero, Tingting Dan, Guorong Wu

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 该研究提出NeuroPilot多智能体系统,整合神经影像处理、质控与管理流程,在17个超12.3万受试者的队列中验证,将传统2-3个月的工作压缩至一周,提升了可扩展性与效率。

Comments 21 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07283 2026-08-10 cs.CL 新提交 70%

Grammar Engineering Meets LLMs: Development of Cantonese and Irish ParGram Treebanks

语法工程与大语言模型(LLMs)的结合:粤语与爱尔兰语平行语法(ParGram)树库的开发

Chit-Fung Lam, Elaine Uí Dhonnchadha

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 该研究开发了粤语与爱尔兰语ParGram树库,探究多语言LLMs在语法工程中的应用,发现其翻译表现差、跨语言抽象任务效果不佳,但可提供参考,凸显其潜力与专家分析的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05732 2026-08-07 cs.LG 新提交 70%

CircuitSteer: Geometrically Aligned Multi-Layer Steering via Sparse Autoencoder Circuits

CircuitSteer:基于稀疏自编码器回路的几何对齐多层引导方法

Mehrshad Saadatinia, Parsa Razmara, Ardalan Aryashad, Ali Abbasi, Seyedarmin Azizi

机构 * University of Southern California(南加利福尼亚大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 CircuitSteer是利用SAEs识别多层语义回路的新型框架,通过几何对齐合成引导向量实现多点干预,在多任务多模型上,其引导效果优于牺牲流畅性或覆盖不足的对比方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05510 2026-08-07 cs.CL 新提交 70%

Different Perturbations, Different Mechanisms: Understanding Continued Pre-training for Zero-Shot Dialect Robustness

不同扰动,不同机制:理解用于零样本方言鲁棒性的持续预训练

Aarohi Srivastava, David Chiang

机构 * University of Notre Dame(圣母大学)

专题命中 其他LLM :LLM(abstract_cn);language model(abstract);分类 cs.CL

AI总结 本研究针对大型语言模型,系统对比6种训练条件下的6种扰动持续预训练策略,发现字符噪声CPT可提升零样本方言鲁棒性且保留标准性能,不同策略的鲁棒机制存在差异,为相关策略选择提供指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05233 2026-08-07 cs.AI cs.CV 新提交 70%

Coherence-Oriented Dream Scene Visualisation

面向连贯性的梦境场景可视化

Azra Açıl, Simon Colton

机构 * School of Electronic Engineering and Computer Science, Queen Mary University of London(伦敦玛丽女王大学电子工程与计算机科学学院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究提出DSV系统,通过大型语言模型拆分梦境描述为四部分,结合文本到图像模型生成连贯的四面板图像序列,经DreamBank数据集50次可视化评估,用CLIP等模型指标验证了其质量、保真度与连贯性。

Comments short paper accepted at ICCC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04554 2026-08-06 cs.CL cs.CV 新提交 70%

Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling

为题目难度预测表征视觉证据:视觉文本化与原生图像建模

Han Chen, Ming Li, Hong Jiao, Tianyi Zhou

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) University of Maryland(马里兰大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文针对题目难度预测的视觉证据表征问题,对比仅用文本、视觉文本化与原生图像建模三种方式,发现原生图像建模是有竞争力的替代方案,其有效性取决于VLMs的适配方式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04336 2026-08-06 cs.SE cs.AI 新提交 70%

COMPAS: Difficulty-Aware Joint Search for Optimizing Code Generation

COMPAS:面向优化代码生成的感知难度联合搜索

Jingzhi Gong, Jie M. Zhang, Gunel Jahangirova, Dong Huang, Mohammad Reza Mousavi, Mark Harman

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 本文提出感知难度的 COMPAS 方法,通过联合搜索模型、提示词和解码设置优化代码生成,在 LiveCodeBench 和 SWE-bench 上均实现性能提升且成本降低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02005 2026-08-04 cs.AI 新提交 70%

Evolving in the Agent Jungle via History-Informed Opponent Awareness

在智能体丛林中通过历史感知的对手意识进化

Zhaofeng Zhang, Linhan Xia, Rui Liu, Yihao Wang, Binrui Shen, Shengxin Zhu

机构 * University of Edinburgh(爱丁堡大学) University of Oklahoma(俄克拉荷马大学) Imperial College London(伦敦帝国学院) University of Michigan(密歇根大学) University of Southern California(南加州大学) Tencent(腾讯) Beijing Normal University(北京师范大学) Beijing Normal–Hong Kong Baptist University(北京师范大学-香港浸会大学联合国际学院)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 针对多智能体环境中对手策略持续进化导致静态技能修改方法失效的问题,提出OASE方法,通过历史快照锚定的配对比较选择有益技能修改,在两类场景中实现更低均衡距离与更少无效策略变更。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00119 2026-08-04 cs.CV cs.AI 新提交 70%

Counting the Cost of War Under Satellite Embargo: Zero-Shot Estimation of Impacted Infrastructure

卫星禁运下的战争损失统计:受影响基础设施的零样本估计

Saleh Sakib Ahmed, M. Sohel Rahman

机构 * Bangladesh University of Engineering and Technology(孟加拉国工程技术大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对冲突区人道主义救援中受影响建筑估计受卫星数据禁运阻碍的问题,提出基于打击前地图的零样本几何投影方法,引入两项技术创新,在2026年中东冲突数据上验证了深度增强大视觉语言模型的优势,确立了混合零样本危机映射范式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27529 2026-07-31 cs.LG 新提交 70%

Latent-Kernel Discrete Flow Maps for Few-Step Generation

用于少步生成的隐核离散流图

Mansoor Ahmed, Yue-Tsz Fan, Hemanth Venkateswara, Murray Patterson

专题命中 其他LLM :language model(abstract,abstract_cn);分类 cs.LG

AI总结 提出隐核离散流图(LKF)模型,通过共享隐变量绑定分解组件实现少步生成,在两个文本基准上较似然基线提升困惑度2.1-3.3倍,M=8时优于现有少步采样器

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27167 2026-07-30 cs.SE cs.CL 新提交 70%

SpecFirst: Behavioral Specification Elicitation as a First-Class Step in Agent-Based Program Synthesis from Scratch

SpecFirst:将行为规范提取作为从零开始的基于智能体的程序合成中的一等步骤

Yihao Chen, Shi Chang, Feng Lin, Khaled Chawa, Boyuan Chen, Shaowei Wang, Ahmed E. Hassan

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 SpecFirst是将行为规范提取设为独立前置阶段的两阶段框架,在ProgramBench上显著提升了从零开始的程序合成的测试通过率与二进制探索覆盖率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26735 2026-07-30 cs.CV cs.AI cs.MM 新提交 70%

Dual Inversion for Text-to-Image Diffusion Models: From Both Prompt and Noise Perspectives

文本到图像扩散模型的双重逆推:从提示与噪声双视角

Xiaolong Liu, Junjian Li, Yuan Xiao, Jiaqi Deng, Dayong Ye, Tianqing Zhu, Huan Huo

机构 * University of Technology Sydney(悉尼科技大学) Geely(吉利) City University of Hong Kong(香港城市大学) City University of Macau(澳门城市大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究针对现有文本到图像扩散模型提示逆推方法的局限,提出联合恢复语义提示与潜在噪声的Dualin方法,实现了高质量逆推提示与最优图像保真度,为可控图像编辑奠定基础。

Comments Accepted by ACM MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26726 2026-07-30 cs.CL 新提交 70%

AtmosERC: Modeling Dialogue-Level Affective Atmosphere for Emotion Recognition in Conversation

AtmosERC:面向对话情感识别的对话级情感氛围建模

Weijie Feng, Tongwei Zhang, Binbin Liu, Zhiyong Cheng

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 本文提出AtmosERC框架,通过建模对话级情感氛围提升对话情感识别性能,其可作为插件线索增强基于大语言模型的ERC,且在局部情感偏差下预测更稳定。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26340 2026-07-30 cs.NI cs.DC cs.LG 新提交 70%

Incast-Free MoE Rate-Based Scheduling

无内爆的MoE基于速率的调度

Evyatar Cohen, Jose Yallouz, Alexander Shpiner, Mark Silberstein, Sylvia Ratnasamy, Isaac Keslassy

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 针对MoE架构轮询调度引发的指数级内爆瓶颈,提出主动公平调度框架,可消除内爆、维持高链路利用率并降低集体完成时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25527 2026-07-29 cs.CV cs.AI 新提交 70%

Argus-Unified: Towards A Compact and Economical Unified Model for Image Understanding and Generation

阿格斯统一模型:迈向紧凑且经济的图像理解与生成统一模型

Weiming Zhuang, Jiabo Huang, Jingtao Li, Zhizhong Li, Chen Chen, Sina Sajadmanesh, Lingjuan Lyu

机构 * Sony AI(索尼人工智能公司)

专题命中 其他LLM :LLM(abstract);language model(abstract);分类 cs.AI

AI总结 研究旨在统一图像理解与生成,提出阿格斯统一模型,利用预训练视觉语言模型,引入混合视觉令牌,分两阶段训练,以最少数据和低成本实现良好性能,达当前最优,可作统一模型开发基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24539 2026-07-28 cs.AI cs.SY eess.SY 新提交 70%

Task-Conditional Faithfulness Auditing of Multimodal LLMs for Grid Diagnosis

用于电网诊断的多模态大语言模型的任务条件忠实性审计

Tianqiao Zhao, Meng Yue, Jianhui Wang

机构 * The University of Texas at Arlington(德克萨斯大学阿灵顿分校) Brookhaven National Laboratory(布鲁克海文国家实验室) Southern Methodist University(南卫理公会大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究针对多模态大语言模型用于电网诊断时答案准确性与证据使用的问题,提出通用框架进行任务条件忠实性审计,通过比较多种依赖并设计校正和重新审计机制,经案例研究验证了框架检测、诊断及纠正相关失败的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24425 2026-07-28 cs.LG 新提交 70%

Context Is King: How In-Context Specification Shapes the Geometry of Concepts

上下文为王:上下文规范如何塑造概念的几何结构

Elad David, Max Fomin

机构 * Zenity

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究大型语言模型中上下文规范对概念几何结构的塑造,发现上下文决定模型实际使用的结构,声明性规则可确定几何编码关系及拓扑类型,不同规模模型表现不同,同一模型家族中较大模型存在的机制在较小模型中可能不存在。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23142 2026-07-28 cs.CL 新提交 70%

Interview with Kalle Lyytinen on "Implications of Theories of Language for Information Systems"

关于《语言理论对信息系统的影响》的卡莱·利伊蒂宁访谈

Kalle J. Lyytinen, Pierre Maier, Paul Ackah Toffey

机构 * Case Western Reserve University(凯斯西储大学) University of Duisburg-Essen(杜伊斯堡-埃森大学) Louisiana State University(路易斯安那州立大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本次访谈中,利伊蒂宁反思《语言理论对信息系统的影响》论文起源与领域发展,结合大语言模型等最新趋势,讨论信息系统语言核心,并概述了从语言学角度研究信息系统的未来方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23002 2026-07-28 cs.SE cs.AI 新提交 70%

Adversarial Test-Hardening for AI-Written Code: An Instrument Autopsy and a Pre-Registered Causal Estimate of the Critic Loop

人工智能编写代码的对抗性测试强化:工具剖析与评论家循环的预注册因果估计

Jeff Otterson

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究大语言模型编写代码及测试用例的对抗性测试强化循环,通过机械预言机实现。实验发现早期跨谱系效应是工具工件,消除混淆因素后,同谱系评论家轮次有因果估计,跨供应商配置有差异,还发布了相关协议、记录和代码。

Comments 26 pages. Two pre-registered experiments; protocols, all run receipts, and analysis code at https://github.com/Jott2121/crucible

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24304 2026-07-28 physics.soc-ph cs.AI math.DS 新提交 70%

Teacher Knows It Best: Spontaneous Symmetry Breaking and Tipping Points in Networked Langevin Dynamics AI Sycophancy

教师最了解:网络朗之万动力学人工智能谄媚中的自发对称性破缺和临界点

Sayantari Ghosh, Saumik Bhattacharya, Partha Pratim Chakrabarti

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 构建统计物理框架研究网络随机动力系统的双稳态,用于理解和缓解AI妄想螺旋。通过划分网络节点,用度加权平均场近似简化方程,推导临界翻转时间,验证解析边界,优化干预策略,证明特定条件下集中快速干预优于分布式缓慢方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20916 2026-07-24 cs.AI cs.DL 新提交 70%

Traceable Scholarship: Page Anchors and Ariadne's Thread for Humanistic Inquiry in the Age of Generative AI

可追溯的学术研究:生成式人工智能时代人文探究的页面锚点与阿里阿德涅之线

Deyu Jing

机构 * Fudan University(复旦大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对生成式人工智能时代人文研究中解释缺乏明确依据的问题,提出可追溯学术研究,介绍页面锚点等方法及AIH-Infra参考实现,通过案例研究展示其作用,确保人文研究在该时代保持公开可反驳。

Comments 33 pages, 8 tables. This paper proposes a normative and infrastructural framework for traceable, AI-assisted humanistic research and presents an auditable Kant case study

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19830 2026-07-23 cs.CL 新提交 70%

VizRAG: Enhancing Retrieval-Augmented Generation with Hypergraph Visualization

VizRAG:通过超图可视化增强检索增强生成

Yanbin Wei, Yang Chen, Renling Gan, Ziru Liu, Xinyu Fu, Chun Kang, Ning Lu, Rui Liu, Yu Zhang, James Kwok

机构 * Southern University of Science and Technology(南方科技大学) Hong Kong University of Science and Technology(香港科技大学) Huawei Research(华为研究院) Beihang University(北京航空航天大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究旨在增强检索增强生成,核心方法是通过视觉线索将超图感知整合到RAG系统中,引入VizRAG支持视觉超图结构感知,实验证明该方法显著优于基线,验证了超图可视化用于RAG系统的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19767 2026-07-23 cs.AI 新提交 70%

Symbol and Footprint Database for Electronic Components by Agentic Recognition and Generation

基于智能识别与生成的电子元件符号与引脚封装数据库

Yichen Shi, Yuzhi Liu, Zhuofu Tao, Li Huang, Yuhao Gao, Ting-Jung Lin, Lei Hel

机构 * Ningbo Institute of Digital Twin, Eastern Institute of Technology(宁波数字孪生研究院,东方理工大学) Shanghai Jiao Tong University(上海交通大学) BTD Technology(BTD科技)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究利用多模态大语言模型开发电子元件符号和引脚封装智能识别与生成流程SFgen,其符号生成准确率86%,引脚封装生成准确率80%,并用此创建含1000个元件的SFnet数据库,为PCB设计自动生成奠定基础。

Comments Accepted by PRCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏