arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 784 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 784 篇

2606.07780 2026-06-09 cs.AI cs.CV cs.LG 新提交 62%

Land cover and flood type govern the detection limits of satellite-based flood mapping across diverse global flood events

土地覆盖与洪水类型控制基于卫星的洪水测绘在不同全球洪水事件中的检测极限

Venkatesh Kolluru, Rajat Shinde, Abdelhak Marouane, Caden Helbling, Deepak Shah, Othneil Drew, Iksha Gurung, Manil Maskey, Rahul Ramachandran

机构 * Earth System Science Center, University of Alabama in Huntsville(阿拉巴马大学亨茨维尔分校地球系统科学中心) Space and Earth Science Data Analysis(空间与地球科学数据分析) NASA Marshall Space Flight Center(NASA马歇尔太空飞行中心)

专题命中 其他LLM :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 研究利用Prithvi-EO-2.0模型在19个全球洪水事件中评估卫星洪水测绘的检测能力,发现检测精度取决于土地覆盖和洪水类型,农田和河流洪水检测效果较好,而树木覆盖和建成区检测近乎为零。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07598 2026-06-09 cs.LG cs.AI 新提交 62%

A Topological Characterization of Graph Neural Networks via Stochastic Block Model Embeddings on the n-Sphere

图神经网络的拓扑特征化:通过n-球面上的随机块模型嵌入

Gopal Anantharaman

机构 * KnotTheory.ai Inc.(KnotTheory.ai 公司) Dept. of Mathematics, Emporia State University(恩波利亚州立大学数学系)

专题命中 其他LLM :LLM(abstract);分类 cs.AI、cs.LG

AI总结 提出将消息传递神经网络诱导的随机块模型映射到单位n-球面的拓扑框架,用于比较训练后的图神经网络,并实现无需重新训练的迁移学习候选检索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19430 2026-08-21 cs.IR cs.CL cs.CR 新提交 57%

HARP: Hierarchical Adaptive Ranking with Preference-Adaptive Fusion for Query-Based CVE Prioritization

HARP:用于基于查询的CVE优先级排序的分层自适应偏好融合排名方法

Haochen Liu, Zhengzhang Chen, Haoyu Wang, Yanchi Liu, Jundong Li, Haifeng Chen

专题命中 其他LLM :LLM(abstract_cn);分类 cs.CL

AI总结 本文针对基于查询的CVE优先级排序问题,提出HARP框架,结合漏洞知识图谱与历史标注示例,在多场景下优于多个基线方法,实现了更有效的优先级排序。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19369 2026-08-21 cs.CL cs.CR math.DG 新提交 57%

Linguistic Holonomy and Statistical Watermarks: Inner Geometry of Meaning-Preserving Transformations

语言完整性与统计水印:保留意义变换的内蕴几何

Daniele Corradetti

机构 * Instituto Superior Técnico(高等技术学院) Universidade do Algarve(阿尔加维大学)

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 该研究针对语言模型统计水印的失效问题,借助语言环形式体系与威尔逊环类比,推导得出残差统计量与种子窗口存活位置数的精确恒等式,揭示相同保留率下信号存活量随编辑位置变化的规律。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18167 2026-08-20 cs.AI cs.SE 新提交 57%

Adversarial Review: Structured Disagreement for Grounded Agentic Code Review

对抗评审:基于结构化分歧的 grounded 智能体代码评审

Eric S. Qiu, Joyce Gill

机构 * Cornell University(康奈尔大学) Stanford University(斯坦福大学)

专题命中 其他LLM :LLM(abstract);分类 cs.AI

AI总结 本文提出对抗评审(AR)协议,仅用3个智能体实现结构化分歧的协作代码评审,在LiveCodeBench、SWE-PRBench等基准上优于多智能体基线,证明无需大量智能体即可完成高效代码评审。

Comments Accepted to ICML 2026 Workshop on DL4C

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17202 2026-08-19 cs.AI cs.CR 新提交 57%

Fool's Gold: Defensive Deception Against Safety-Removal Attacks on Open-Weight Models

愚人金:针对开放权重模型安全移除攻击的防御性欺骗

Mark Russinovich

机构 * Microsoft Azure(微软Azure)

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 针对开放权重模型易被移除安全对齐的问题,提出“愚人金”防御,通过训练仅在被攻击状态显现的伪造诱饵,使被攻击模型对危险请求输出高比例假回答,且无法区分真假,同时不影响干净状态的良性行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15910 2026-08-18 eess.AS cs.CL cs.SD 新提交 57%

Iterative Self-Learning for Expressive Text-to-Speech Synthesis

用于高表现力文本到语音合成的迭代自学习

Nicholas Sanders, Gustav Eje Henter, Simon King, Korin Richmond

专题命中 其他LLM :prompting(abstract);分类 cs.CL

AI总结 针对低资源下高表现力TTS的标签稀缺问题,提出迭代自学习框架,基于Invert-Classify方法迭代优化伪标签,在词级突出性和情感任务上验证,提升了标签贴合度与合成质量,性能接近全监督模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15475 2026-08-18 cs.CR cs.AI 新提交 57%

Bit-Flip Attacks on Vision-Language-Action Models: Action-Decoding Architecture Shapes the Vulnerability

针对视觉-语言-动作模型的位翻转攻击:动作解码架构决定漏洞

Yudong Gao, Linghan Chen, Wenhan Wu, Mia Zhou, Jiyao Wang, Kaiyan Ji, Mingyu Guo, Honglong Chen

专题命中 其他LLM :foundation model(abstract);分类 cs.AI

AI总结 该研究针对视觉-语言-动作模型提出位翻转攻击,发现动作解码架构决定漏洞,少量梯度选择的位翻转可大幅降低闭环成功率,权重完整性是具身基础模型的安全边界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13605 2026-08-17 cs.AI cs.RO 新提交 57%

Active Perception for Embodied Disambiguation

用于具身消歧的主动感知

Yiwei Liu, Luwei Yang

机构 * School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)理工学院) Shenzhen Research Institute of Big Data(深圳大数据研究院)

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 该研究针对具身环境中目标歧义问题,提出以主动观测为核心的主动感知框架,结合视觉语言模型实现信息获取与用户意图澄清,经真实机器人实验验证有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13433 2026-08-14 cs.FL cs.AI 新提交 57%

Algebraic Decomposition Theory for Transformer Length Generalization

Transformer长度泛化的代数分解理论

Andy Yang, Blerta Veseli, Corentin Barloy, Michaël Cadilhac, Andreas Krebs, Charles Paperman, Howard Straubing, Michael Hahn

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 本文针对Transformer的长度泛化问题,建立了正则语言上长度泛化的完整代数刻画,提出多项式时间决策算法,实验验证其能更准确捕捉Transformer的长度泛化行为。

Comments 54 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11424 2026-08-13 cs.LG cs.CV 新提交 57%

Click2Poly: A VLM for vector mapping buildings and walls

Click2Poly:用于建筑物和墙壁矢量绘制的VLM

Nicolas Girard, Jawher Ben Abdallah, Arno Gobbin, Liuyun Duan, Sacha Lepretre

机构 * LuxCarta

专题命中 其他LLM :language model(abstract);分类 cs.LG

AI总结 该研究提出基于Florence-2 VLM的人在环AI助手Click2Poly,以QGIS插件形式实现,可响应用户点击编辑矢量层,加快建筑物和墙壁矢量绘制的手动编辑流程。

Journal ref IGARSS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12271 2026-08-13 cs.LG physics.ao-ph 新提交 57%

Earth observation embeddings are effective sub-grid descriptors for probabilistic weather downscaling

地球观测嵌入是概率性天气降尺度的有效亚网格描述符

Pedro Sousa, Will Tebbutt, Sadiq Jaffer, Robin Young, Anil Madhavapeddy, Richard E. Turner

机构 * University of Cambridge(剑桥大学)

专题命中 其他LLM :foundation model(abstract);分类 cs.LG

AI总结 该研究提出用TESSERA嵌入增强卷积条件神经过程,用于概率性天气降尺度,在五个气候区提升了2米温度和10米风速的降尺度技能,且对不同变量和新站点均有效。

Comments 39 pages, 12 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06968 2026-08-10 physics.soc-ph cs.AI cs.CY 新提交 57%

Same physical state, different collective dynamics: state encodings select synchronization outcomes in language-model agents

相同物理状态,不同集体动力学:状态编码选择语言模型智能体的同步结果

Takahiro Ezaki, Naoto Imura, Katsuhiro Nishinari

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 该研究通过循环同步实验发现,状态编码(低阶循环矩vs直方图)会影响语言模型智能体的同步结果,且效应因模型而异,状态编码是依赖模型的有效交互法则的组成部分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06154 2026-08-07 cs.RO cs.AI cs.CV 新提交 57%

Visual Grounding in Zero-Shot Vision-Language Control

零样本视觉语言控制中的视觉 grounding

J. de Curtò, Dayani Plasencia, Diego Sánchez, I. de Zarzà

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 本文针对零样本视觉语言控制中VLMs决策是否基于视觉输入的问题,通过多组消融实验分析了多种VLMs的表现,提出对称共识守护者方法,验证了VLMs可作为有界的危险助手。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05172 2026-08-07 cs.CY cs.AI 新提交 57%

Estimating time spent on work tasks

估算工作任务所花费的时间

Stephane Hatgis-Kessell, Tomás Aguirre, Alexander Wan, Rishi Bommasani

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 本研究提出一种原则性方法估算美国近18000项任务的时间份额,用于分析AI对美国职业的影响,发现时间权重会改变AI暴露度的测量结果,可作为劳动经济研究的通用基础要素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04299 2026-08-06 cs.CL 新提交 57%

Searching for Sound-Meaning Collisions: Graph-Based Affordance Retrieval and Multi-Evaluator Ranking for Pun Translation at CLEF 2026 JOKER Task 2

寻找音义碰撞:CLEF 2026 JOKER任务2中基于图的可供性检索与多评估者排名的双关语翻译

Russell Taylor, Adam Brikman, Prateek Awate

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 该研究针对CLEF 2026 JOKER任务2,提出基于图的可供性检索与多评估者排名的双关语翻译方法,证实检索音义可供性是计算双关语翻译的核心瓶颈,结果契合Low的设想。

Comments CLEF 2026 Working Notes, 21-24 September 2026, Jena, Germany

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03270 2026-08-05 cs.CV cs.AI 新提交 57%

GUI-Lens: Coarse-to-Fine Cropping for GUI Grounding with General-Purpose VLMs

GUI-Lens:面向通用视觉语言模型(VLM)的GUI定位粗到精裁剪框架

Zichuan Fu, Shirong Wang, Wenlin Zhang, Guojing Li, Yimin Deng, Jingtong Gao, Junjia Qi, Hanyu Yan, Yefeng Zheng, Xiaopeng Li, Wanyu Wang, Xian Wu, Xiangyu Zhao

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 GUI-Lens是面向通用VLM的GUI定位粗到精裁剪框架,通过主动视觉观察逐步聚焦确定目标,在四个基准和三个VLM后端上使定位准确率最高提升24.9个百分点,在GPT-5.5上达SOTA性能。

Comments Preprint. Code: https://github.com/Fzkuji/GUI-Agent-Harness

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03210 2026-08-05 cs.CL 新提交 57%

ICO: Enhancing Semantic-Shift Jailbreaks via Iterative Context Optimization

ICO:通过迭代上下文优化增强语义偏移越狱攻击

Hujian Zhu, Yihao Huang, Felix Juefei-Xu, Xinfeng Li, Peng Zeng, Simeng Qin, Qing Guo, Geguang Pu

专题命中 其他LLM :foundation model(abstract);分类 cs.CL

AI总结 本研究针对现有语义偏移越狱攻击有效性有限的问题,提出带迭代上下文优化(ICO)的黑盒上下文感知框架,经多数据集与多模型实验,其攻击效果优于现有基线,平均成功率达74.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03050 2026-08-05 cs.SD cs.AI cs.MM eess.AS 新提交 57%

Learning Music Style for Piano Arrangement Through Cross-Modal Bootstrapping

通过跨模态自举学习音乐风格以实现钢琴编曲

Jingwei Zhao, Gus Xia, Ziyu Wang, Ye Wang

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 本文提出跨模态框架,受BLIP-2启发用Q-Former从预训练音频LM提取风格表示,经两阶段训练实现可控风格钢琴编曲,在多项任务中提升了风格对齐与音乐质量。

Comments Accepted by ISMIR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02935 2026-08-05 cs.CL 新提交 57%

Character Iconicity vs. Arbitrariness: An Arabic NLP Perspective

字符象似性与任意性:阿拉伯语自然语言处理视角

Dorieh Alomari, Irfan Ahmad, Maged S. Al-shaibani

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 本研究从NLP视角探究阿拉伯语字符形式-功能关系,对比加点、无点及随机重映射的阿拉伯语,发现随机重映射可在降本减存的同时保持良好性能,表明阿拉伯语字符形式-功能关系具任意性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01793 2026-08-04 cs.LG 新提交 57%

ReFP-AD: Rectified Flow Preconditioning for Energy-Based Anomaly Detection

ReFP-AD:用于基于能量的异常检测的整流流预处理

Camile Lendering, Erkut Akdag, Joaquín Figueira, Egor Bondarev

机构 * Eindhoven University of Technology(埃因霍温理工大学)

专题命中 其他LLM :foundation model(abstract);分类 cs.LG

AI总结 该研究针对统一异常检测中高维token空间EBM训练不稳定问题,提出ReFP-AD方法,经实验在MVTec-AD和VisA数据集上取得优于基线的异常检测性能。

Comments Accepted at the European Conference on Computer Vision (ECCV) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01414 2026-08-04 cs.AI cs.CR 新提交 57%

No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks

无单一失效神经元:针对白盒攻击的分布式安全对齐

Simiao Xie, Chuancheng Shi, Shangze Li, Wenhua Wu, Fei Shen, Ying Zhou, Zhiyong Wang, Tat-Seng Chua

机构 * The University of Sydney(悉尼大学) National University of Singapore(新加坡国立大学)

专题命中 其他LLM :foundation model(abstract);分类 cs.AI

AI总结 针对现有安全对齐方法的单点失效问题,提出分布式安全对齐(DSA),通过冗余编码安全能力提升模型对抗白盒神经元级攻击的鲁棒性,且保留通用语言与多模态效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01238 2026-08-04 cs.CL cs.MM 新提交 57%

Evaluating VLMs on Multimodal Aristotelian Persuasion Tasks

评估视觉语言模型(VLMs)在亚里士多德式多模态说服任务上的表现

Khondoker Ittehadul Islam

机构 * Saarland University(萨尔大学)

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 该研究采用ImageArg数据集评估VLMs在亚里士多德式多模态说服任务的表现,发现Qwen系列模型在相关检测任务上性能提升并发布代码。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00284 2026-08-04 cs.RO cs.AI 新提交 57%

Hybrid Attention Estimation Pipeline for Adaptive HRI Using an Expressive Robotic Head

基于富有表现力的机器人头部的自适应人机交互混合注意力估计流程

Pablo Moraes, Monica Rodriguez, Christopher Peters, Hiago Sodre, Tobias Doernbach, Bruna Guterres, Ricardo Grando

机构 * Technological University of Uruguay(乌拉圭科技大学) Ostfalia University of Applied Sciences(奥斯特法利亚应用科技大学)

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 该研究提出结合几何与语义感知层的混合注意力估计流程,通过有限状态机调节自适应人机交互,经10人40次试验验证其交互启动可靠、暂停行为一致且输出信息非冗余。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29585 2026-08-03 cs.CL 新提交 57%

Sycophancy Undermines Epistemic Vigilance in Cooperative Vision-Language Tasks

谄媚行为破坏合作型视觉-语言任务中的认知警觉性

Rupak Sarkar, Neha Srikanth, Saloni Gupta, Claire Bonial, Philip Resnik, Rachel Rudinger

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 该研究针对合作型视觉-语言任务,提出信息不对称的“找不同”任务,发现模型存在谄媚行为破坏认知警觉性的问题,通过学习向量调整模型可减少此类错误,提升模型可靠性。

Comments 9 pages, 3 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26391 2026-07-30 cs.LG q-bio.BM 新提交 57%

Q-Steer: Action-Value Guidance for Molecular Policy Optimization

Q-Steer:分子策略优化的动作值引导

Xinyu Wang, Jinbo Bi, Minghu Song

机构 * University of Connecticut(康涅狄格大学) Institute of Health and Medicine, Hefei Comprehensive National Science Center(合肥综合性国家科学中心健康与医学技术研究所)

专题命中 其他LLM :language model(abstract);分类 cs.LG

AI总结 Q-Steer 是一种用于分子语言模型的生成时动作值引导原语,通过 PAVS-Q 评分器在固定在线 oracle 预算下提升分子优化性能,在所有测试组合中均取得正增益。

Comments 20 pages, 2 figures, and 25 tables. Includes supplementary experimental results

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26375 2026-07-30 cs.CL cs.HC 新提交 57%

(Im)Paired Programming: Coding Agents Improve Productivity but Harm Understanding

(非)配对编程:编码智能体提升生产力但损害理解能力

Nishant Balepur, Connor Baumler, Valerie Chen, Eunsol Choi, Rachel Rudinger, Jordan Lee Boyd-Graber

专题命中 其他LLM :prompting(abstract);分类 cs.CL

AI总结 该研究通过54名学生的对照实验,发现编码智能体虽提升生产力但损害用户代码理解,低投入交互加剧该问题,用户仍偏好智能体,同时为开发者提出了优化方向。

Comments In-progress Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24781 2026-07-29 cs.IR cs.AI 新提交 57%

Three Sides of Retrieval: Factorial Evidence for Document-Side, Query-Side, and Answer-Side Complementarity in RAG

检索的三个方面:RAG中文档侧、查询侧和答案侧互补性的因子证据

Ng S. T. Chong

专题命中 其他LLM :LLM(abstract);分类 cs.AI

AI总结 研究RAG系统中检索问题,提出目录引导的页面检索新算法,通过实验发现该算法对答案质量有显著影响,与答案侧验证结合优于查询侧分解+验证,证明文档、查询、答案侧增强互补,且默认设置接近最优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24187 2026-07-28 cs.AI 新提交 57%

Myopia Prevention and Control 3.0: Artificial Intelligence--Driven Risk Stratification, Proactive Monitoring, and Personalized Intervention

近视防控3.0:人工智能驱动的风险分层、主动监测和个性化干预

Tieniu Wang, Cangzhu Huang, Qianhui Li

机构 * Shanghai Nile Intelligent Technology Co., Ltd.(上海尼罗智能科技有限公司) Beijing Tanyuan Academy of Intelligent Sensing(北京潭渊智能传感研究院)

专题命中 其他LLM :foundation model(abstract);分类 cs.AI

AI总结 研究借助人工智能、数字传感等技术推动近视防控从被动变主动精准模式。通过多模态数据机器学习预测风险、可穿戴等监测及个性化干预形成闭环。评估各阶段证据,讨论相关挑战并给出未来方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23845 2026-07-28 cs.AI 新提交 57%

Do Visual Features Improve Other-Initiated Repair Detection? A Dyadic Multimodal Approach

视觉特征能否改善他人发起的修复检测?一种二元多模态方法

Anh Ngo, Nicolas Rollet, Catherine Pelachaud, Chloé Clavel

机构 * INRIA Paris(法国国家信息与自动化研究所巴黎分院) ISIR, Sorbonne University Paris(巴黎索邦大学信息学、系统与机器人研究所) Télécom Paris, SES, Institut Polytechnique de Paris, I3-CNRS Paris(巴黎电信学院、巴黎高等理工学院SES系、巴黎综合理工学院I3 - 法国国家科学研究中心) CNRS(法国国家科学研究中心) LTCI, Institut Polytechnique de Paris(巴黎综合理工学院LTCI实验室)

专题命中 其他LLM :prompting(abstract);分类 cs.AI

AI总结 研究他人发起的修复检测问题,提出结合视觉特征的二元多模态模型,通过在两个语料库上评估,证明视觉信息能提升检测性能,提供跨模态特征贡献见解。

Comments Accepted to ICMI 2026 (International Conference on Multimodal Interaction), October 5-9, 2026, Napoli, Italy

详情

展开后加载摘要…

URL PDF HTML 收藏