arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 784 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 784 篇

2606.22768 2026-06-23 cs.LG cs.DC 新提交 57%

Factored Gossip DiLoCo: Reducing Blocking Communication in DiLoCo

因式化Gossip DiLoCo:减少DiLoCo中的阻塞通信

Chamin Hewa Koneputugodage, Thalaiyasingam Ajanthan, Sameera Ramasinghe, Hadi Mohaghegh Dolatabadi, Shamane Siriwardhana, Gil Avraham, Violetta Shevchenko, Karol Pajak, James Snewin, Alexander Long

机构 * Pluralis Research

专题命中 其他LLM :language model(abstract);分类 cs.LG

AI总结 提出因式化Gossip DiLoCo,通过非阻塞混合与阻塞混合分解同步,在低带宽环境下提升计算利用率并保持优化稳定性。

Comments Accepted at ICML 2026. 29 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21077 2026-06-23 cs.CR cs.CL 新提交 57%

OTTER: A Red-Teaming System for Toxicity-Evading Jailbreak Prompt Optimization

OTTER:一种用于规避毒性检测的越狱提示优化的红队系统

Jerry Wang, Hsin-Ling Hsu, Yi-Cheng Lai, Nai-Chia Chen, Fang Yu

机构 * National Chengchi University, Taipei, Taiwan(国立中正大学,台北,台湾) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 其他LLM :LLM(abstract_cn);分类 cs.CL

AI总结 提出OTTER系统,通过替换少量令牌解耦表面毒性与对抗意图,在四个GPT模型上将平均攻击成功率从7.0%提升至84.0%,并首次量化分析毒性-绕过关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20711 2026-06-23 cs.CV cs.AI 新提交 57%

Video2Code: Generating Interactive Webpages from UI Videos via Action-Aware Revisit

Video2Code: 通过动作感知重访从UI视频生成交互式网页

Mingde Xu, Zhen Yang, Yan Wang, Yu Wang, Xijun Liu, Zijun Dou, Wenyi Hong, Xiaotao Gu, Bin Xu, Jie Tang

机构 * University of Waterloo(滑铁卢大学) Tsinghua University(清华大学) Zhipu AI(智谱AI) Beihang University(北京航空航天大学)

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 提出Video2Code方法,通过动作感知重访UI视频中的关键区域,恢复可执行的状态转换,生成HTML/CSS/JavaScript代码,提升多步交互的代码功能正确性。

Comments 31 pages, 21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17871 2026-06-17 cs.AI 新提交 57%

StepGuard: Guarding Web Navigation via Single-Step Calibration

StepGuard: 通过单步校准保护网页导航

Zhihao Cui, Yuchen Zhang, Xiyang Sun, Yaxiong Wang, Li Zhu, Jinpeng Hu, Liu Liu, Mengjia Li, Yujiao Wu

机构 * School of Software Engineering, Xi’an Jiaotong University(西安交通大学软件工程学院) School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机与信息工程学院) Xiamen University(厦门大学) Zhejiang Lab(之江实验室) CSIRO(澳大利亚联邦科学与工业研究组织)

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 针对网页导航中单步脆弱性问题,提出StepGuard框架,通过动态双策略优化(DDPO)解决奖励冲突,并利用置信度引导的自适应导航反射(CANR)校准单步误差,显著提升导航与答案准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14187 2026-06-17 cs.LG 新提交 57%

Zeta: Dual Whitening for Matrix Optimization via Coordinate-Adaptive Preconditioning

Zeta: 通过坐标自适应预处理实现矩阵优化的双重白化

Kaiwen Chen, Shuhai Zhang, Zimo Liu, Linxiao Li, Ying Sun, Yuchen Li, Yifan Zhang, Bo Han, Mingkui Tan, Qiuwu Chen

机构 * South China University of Technology(华南理工大学) AIGCode Hong Kong Baptist University(香港浸会大学)

专题命中 其他LLM :language model(abstract);分类 cs.LG

AI总结 针对矩阵优化中坐标尺度异质性问题,提出双重白化优化器Zeta,通过先坐标白化后谱白化的严格顺序降低正交化误差,在语言建模和视觉任务上提升收敛速度与泛化性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16836 2026-06-16 cs.CL 新提交 57%

Does Traversal Order Matter? A Systematic Study of Tree Traversal Methods in Transformer Grammars

遍历顺序重要吗?Transformer语法中树遍历方法的系统研究

Zongru Liu, Pengyu Ji, Pengcheng Wang, Kewei Tu

机构 * School of Information Science and Technology, ShanghaiTech University(上海科技大学信息科学与技术学院)

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 本文系统研究了Transformer语法中不同树遍历方法(深度优先、广度优先及新提出的产生式规则遍历)对语言建模、句法泛化和摘要生成的影响,揭示了嵌套组合与全局前瞻之间的权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16319 2026-06-16 cs.AI 新提交 57%

Architectural Wisdom: A Framework for Governing Optimization in AI Systems

架构智慧:AI系统中优化治理的框架

Edward Y. Chang

机构 * Stanford University(斯坦福大学)

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 提出一种可修正的目标治理层,通过时间跨度、关系边界和不可逆性三个结构承诺,解决AI系统优化目标不当导致的失败问题。

Comments 17 pages, 2 tables, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12478 2026-06-12 cs.LG cond-mat.stat-mech quant-ph 新提交 57%

Boltzmann Attention: Learnable Ising Couplings for Cooperative Attention

玻尔兹曼注意力:用于协同注意力的可学习伊辛耦合

Gilhan Kim, Daniel K. Park

机构 * Yonsei University(延世大学)

专题命中 其他LLM :language model(abstract);分类 cs.LG

AI总结 提出玻尔兹曼注意力,通过可学习的伊辛耦合增强注意力机制中的位置间交互,在字符级语言建模和括号匹配任务中优于标准softmax注意力,并展示了量子退火训练的有效性。

Comments 19 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11835 2026-06-11 cs.HC cs.AI 新提交 57%

Designing AI-Supported Focus Groups: A Role x Modality Playbook

设计AI支持的焦点小组:角色×模态剧本

Zhiqing Wang, Steven Dow

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 其他LLM :prompting(abstract);分类 cs.AI

AI总结 针对焦点小组资源密集且对引导高度敏感的问题,提出按AI角色(工具、联合主持、主持)和模态(文本、语音、具身)组织的剧本,并分析交互权衡与开放问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12059 2026-06-11 cs.LG cs.NE nlin.AO 新提交 57%

Attention by Synchronization in Coupled Oscillator Networks

耦合振荡器网络中的同步注意力机制

Fabio Pasqualetti, Taosha Guo

机构 * University of California, Irvine(加州大学尔湾分校)

专题命中 其他LLM :language model(abstract);分类 cs.LG

AI总结 提出基于Kuramoto同步动力学的固定查询振荡器注意力机制,无需指数运算和全局归约,在物理基板上实现注意力计算,并在关键词识别和主谓一致任务上优于softmax。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11116 2026-06-10 cs.CY cs.AI cs.HC 新提交 57%

Designed by Journalists, but Is It for Readers? Rethinking AI Disclosures and Transparency in News

由记者设计,但为读者而设?重新思考AI披露与新闻透明度

Pooja Prajod

机构 * Centrum Wiskunde & Informatica(数学与信息学中心)

专题命中 其他LLM :prompting(abstract);分类 cs.AI

AI总结 研究发现,详细披露会引发透明度困境降低信任,而简短披露造成信息缺口;读者偏好用户代理型设计(如按需详情、AI比例可视化),呼吁HCI社区重新设计披露机制。

Comments Accepted to CHIWORK Workshop (Interrogating GenAI Augmentation for CHIworkers: Strategies for Professional Autonomy and Accountability)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20412 2026-08-24 q-bio.GN 新提交 50%

PEN-STACK: A non-fabricating tool layer for language-model agents in genome writing

PEN-STACK:用于基因组写作的语言模型智能体的非制造工具层

Anees Ahmed Mahaboob Ali, Radhakrishnan Delhibabu, Everette Jacob Remington Nelson

专题命中 其他LLM :prompting(abstract)

AI总结 本研究提出PEN-STACK工具层,为基因组写作的语言模型智能体提供可靠来源的工具,可消除数量伪造,经测试能提升生物安全,为智能体基因组工程系统提供了开源基底。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21276 2026-08-24 cs.RO cs.CV 新提交 50%

The Coastline as a Structural Constraint: Harnessing Scene Geometry for Autonomous Surface Vessel Localization

海岸线作为结构约束:利用场景几何实现自主水面船定位

Derek R. Benham, Joshua G. Mangelson

机构 * Brigham Young University(杨百翰大学)

专题命中 其他LLM :foundation model(abstract)

AI总结 本研究提出两种利用海岸几何的自主水面船定位框架,经多数据集验证,LiDAR管线提升轨迹精度,单目架构控制长期漂移,且零样本基础模型可可靠提取海岸线观测,为无GPS海上定位提供新方案。

Comments 22 pages, 13 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20141 2026-08-21 cs.CV 新提交 50%

DPC-Net: Dual-Prior Collaborative Network for All-in-One Image Restoration

DPC-Net:用于一体化图像修复的双先验协同网络

Zhaokun He, Kangbiao Shi, Axi Niu, Jian Jin, Peng Wu, Wei Dong, Qingsen Yan

专题命中 其他LLM :language model(abstract)

AI总结 针对一体化图像修复现有方法的结构扭曲与语义不一致问题,提出双先验协同网络DPC-Net,联合利用退化-语义耦合与低层视觉先验,在多基准上实现优于现有最优方法的修复性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19350 2026-08-21 cs.HC cs.SD 新提交 50%

MultiVerse: A Creator-Centered Approach to Steering Context-Adaptive Lyrics

MultiVerse:一种以创作者为中心的引导上下文自适应歌词的方法

Alexander Wang, Chris Donahue, David Lindlbauer

专题命中 其他LLM :prompting(abstract)

AI总结 针对现有媒体适配系统忽视创作者意图的问题,提出以创作者为中心的MultiVerse系统,通过规则验证实现自适应歌词创作,经10位词曲作者研究验证了其有效性与创作价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18623 2026-08-20 physics.chem-ph 新提交 50%

UBio-MolFM: Enabling Biomolecular Dynamics at DFT Accuracy and $10^5$ Atoms with One Untuned Potential

UBio-MolFM:使用一个未调谐的势实现DFT精度下10^5个原子的生物分子动力学模拟

Lin Huang, Frank Peng, JiaJun Cheng, Zion Wang, Hao Yin, Hao Li, Ji Zhang, Jack Jia, Junping Zhao, Arthur Jiang, Jia Zhang

专题命中 其他LLM :foundation model(abstract)

AI总结 UBio-MolFM是经1.6亿量子化学标签训练的基础模型,可在单GPU上以近线性成本实现DFT精度的10^5原子生物分子动力学模拟,突破了第一性原理模拟的原子数限制,能重现关键生物过程的结构与能量特征。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18007 2026-08-19 cs.FL 新提交 50%

A Denotational Semantics for Synchronized Regular Expressions (extended version)

同步正则表达式的指称语义(扩展版)

Lukas Grätz

专题命中 其他LLM :language model(abstract)

AI总结 本文针对纯同步正则表达式和全同步正则表达式提出指称语义,证明带反向引用的正则表达式可转换为全同步正则表达式,且匹配问题为NP完全,还分析了这类语言的封闭性及与其他模型的关系。

Comments Extended submitted manuscript to be presented and published at ICTAC 2026, November 9-15, Bariloche, see https://ictac2026.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14859 2026-08-18 q-fin.ST 新提交 50%

Disclosed Human-Capital Disruption and Firm-Specific Risk

已披露的人力资本中断与公司特定风险

Ang Zhang

专题命中 其他LLM :language model(abstract)

AI总结 该研究构建财报电话会议中已披露人力资本中断的衡量指标,发现其与公司特定风险显著相关,可预测特质波动率、下行偏差等变化及高管离职,揭示了劳动力短缺外的组织投入干扰信息。

Comments 50 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16715 2026-08-18 cs.RO 新提交 50%

MatchingPolicy: Correspondence-Aware Policy Enables Cross-Object In-Context Learning

MatchingPolicy:具备对应感知能力的策略实现跨物体的上下文学习

Qijin She, Hanyang Yu, Zeming Li, Ping Tan

机构 * Hong Kong University of Science and Technology(香港科技大学)

专题命中 其他LLM :foundation model(abstract)

AI总结 该研究提出MatchingPolicy框架,通过解耦演示-场景匹配与策略学习,结合视觉基础模型和两阶段匹配算法,在RLBench及真实操作任务上实现了跨物体的少样本泛化性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15519 2026-08-18 cs.SI 新提交 50%

Topological collapse of higher-order interactions bottlenecks collective intelligence in AI agent societies

智能体社群中高阶相互作用的拓扑崩溃是集体智能的瓶颈

Shuo Lu, Weicheng Meng, Aijing Yu, Kun Shao, Jian Luan, Ran He, Jian Liang

专题命中 其他LLM :language model(abstract)

AI总结 该研究发现AI智能体社群中高阶交互的拓扑崩溃会成为集体智能瓶颈,提出HIS和Φ指标,证实该瓶颈与模型无关,为人工社会设计提供了新方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15207 2026-08-18 cs.IT cs.NI math.IT 新提交 50%

ICL-SEC: Iterative Cross-Layer Semantic Error Correction

ICL-SEC:迭代跨层语义错误校正

Yirun Wang, Soung Chang Liew, Yuyang Du

专题命中 其他LLM :language model(abstract)

AI总结 本文提出ICL-SEC框架,通过闭合物理层信道解码器与应用层语义解码器的循环,结合迭代解码与语义校正,其确认先验更新规则可大幅降低误码率,性能优于传统及非迭代方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14208 2026-08-17 quant-ph 新提交 50%

Foundation Neural Effective Hamiltonian for Strongly Correlated Quantum Materials

强关联量子材料的基础神经网络有效哈密顿量

Lixing Zhang, Hongjie Jiang, Di Luo

专题命中 其他LLM :foundation model(abstract)

AI总结 针对强关联量子材料模拟中FNQS的精度与采样成本问题,提出FNEH,可准确恢复相边界、降低计算成本,在莫尔材料中验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13119 2026-08-14 cs.CV 新提交 50%

QuISE: Defense against Typographic Attacks on VLMs via Query-Irrelevant Semantic Editing

QuISE:通过查询无关语义编辑防御视觉语言模型的排版攻击

Shubin Lu, Jiaqi Yin, Yihao Huang

专题命中 其他LLM :language model(abstract)

AI总结 该研究针对VLMs的排版攻击问题,提出模型无关无训练的黑盒防御方法QuISE,通过文本定位、语义替换及答案一致性判断提升防御性能,在多基准和模型上取得良好效果。

Comments 10 pages, 7 figures; includes supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09778 2026-08-11 cs.RO 新提交 50%

RoboSeg: Online Part-Level Semantic Reconstruction for Robotic Manipulation via a Single Eye-in-Hand Camera

RoboSeg:基于单眼在手相机的机器人操作的在线部件级语义重建

Zhaochen Lan, Mengxiang Lin

机构 * School of Mechanical Engineering and Automation, Beihang University(北京航空航天大学机械工程及自动化学院)

专题命中 其他LLM :language model(abstract)

AI总结 RoboSeg是无需CAD模型的部件级语义重建系统,结合VLM、TSDF融合与SAM3,实现机器人操作的部件语义索引,在24次物理试验中21次完成综合任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08880 2026-08-11 cs.SE 新提交 50%

Fusing UI Structure & Semantics for Feature-Oriented App Screen Retrieval & Clustering

融合UI结构与语义的面向特征的应用屏幕检索与聚类

Arun Krishna Vajjala, Yanfu Yan, Ajay Krishna Vajjala, Shrunal Pothagoni, Denys Poshyvanyk, Kevin Moran

专题命中 其他LLM :language model(abstract)

AI总结 该研究针对UI编程中代码与图形表示的抽象鸿沟,提出多模态神经符号嵌入技术FRAME,在三项基准测试中提升了屏幕检索与聚类的性能,可增强自动化UI设计与测试工具。

Comments 12 pages, 8 figures, 6 tables. Accepted at the 42nd IEEE International Conference on Software Maintenance and Evolution (ICSME 2026), Benevento, Italy

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07776 2026-08-11 cs.CR 新提交 50%

Can AI Write Compliant Code, and to What Extent? Evaluating SOC 2 Compliance of Claude Fable 5, Claude Opus 4.8, and Claude Opus 5 Across Four Use Cases

AI能否编写合规代码?以及在多大程度上能?评估Claude Fable 5、Claude Opus 4.8和Claude Opus 5在四个用例中的SOC 2合规性

Iccha Sethi, Herman Errico

专题命中 其他LLM :language model(abstract)

AI总结 该研究评估Claude Fable 5、Claude Opus 4.8和Claude Opus 5在四个用例中的SOC 2合规性,发现添加一句SOC 2语句可大幅提升合规率,模式匹配评分器不可靠需替换为语义检查。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07897 2026-08-11 cs.IT math.IT 新提交 50%

Semantic-Aided Iterative Decoding for Uplink Non-Orthogonal Transmission

用于上行非正交传输的语义辅助迭代解码

Wenjing Wei, Chentao Yue, Branka Vucetic, Yonghui Li

专题命中 其他LLM :language model(abstract)

AI总结 本文提出语义辅助迭代解码(Sem-IR)方案,结合ByT5语言模型与物理层迭代,在8dB时较无语义反馈的NOMA将块错误率降低一个数量级,性能优于TDMA。

Comments 6 pages, 7 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06913 2026-08-10 cs.CV 新提交 50%

MuST-VAD: Mutual Structured Learning for Video Anomaly Detection

MuST-VAD:用于视频异常检测的互结构化学习

Satoshi Hashimoto, Hitoshi Nishimura, Mori Kurokawa

专题命中 其他LLM :language model(abstract)

AI总结 MuST-VAD是用于弱监督视频异常检测的互结构化学习框架,通过检测器与LVLM的双向知识交换,在UCF-Crime数据集上显著提升了检测精度,AP优于现有最优方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04100 2026-08-06 hep-ph hep-ex hep-th 新提交 50%

Language-Guided Hypotheses Generation for Sparse SMEFT Analyses

用于稀疏SMEFT分析的语言引导假设生成

Ahmed Hammad, Veronica Sanz

专题命中 其他LLM :language model(abstract)

AI总结 研究解决稀疏SMEFT分析中算符假设选择难题,提出开源llm4smeft框架,结合微调语言模型与检索增强生成,可本地运行且能生成候选算符及费希尔信息。

Comments 34 pages, 2 figures and 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03329 2026-08-05 cs.SE 新提交 50%

Making AI Visible, Not Vanished: How AI Policies Reshape Developer Experience on GitHub

让AI可见而非消失:AI政策如何重塑GitHub上的开发者体验

Yunqi Chen, Thomas Zimmermann, Bianca Trinkenreich

专题命中 其他LLM :prompting(abstract)

AI总结 本研究通过分析29624个GitHub代码库,提出TRACE框架,发现AI治理主要规范而非禁止AI辅助开发,强调透明度与责任性的政策效果更优。

详情

展开后加载摘要…

URL PDF HTML 收藏