arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 8057 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 8057 篇

2606.05376 2026-06-05 cs.LG 57%

SHALA-LLM: Smartly Handling Ambiguous Labels in Aligning LLMs

SHALA-LLM:在对齐LLM中智能处理模糊标签

Jingyao Wu, Ashley Wang, Keane Ong, Paul Pu Liang, Rosalind Picard

机构 * MIT Media Lab, Massachusetts Institute of Technology(麻省理工学院媒体实验室、麻省理工学院) National University of Singapore(新加坡国立大学)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 提出SHALA-LLM强化学习框架,通过从标注者分布中学习并动态优先处理高模糊样本,改善LLM对模糊标签的建模,在NLI和情感识别任务中提升与标注者分布的一致性及分类性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03785 2026-06-05 cs.CL 57%

Backdoor Unlearning Generalization: A Path Toward the Removal of Unknown Triggers in LLMs

后门遗忘泛化:走向移除大语言模型中未知触发器的路径

Lisa Bouger, Théo Lasnier, Philippe Loubet Moundi, Yannick Teglia, Djamé Seddah

机构 * Inria Paris(法国巴黎国家信息与自动化研究所) Sorbonne Université(索邦大学) Thales CDI(泰雷兹CDI)

专题命中 其他安全 :safety(abstract);分类 cs.CL

AI总结 本文通过实验证明,针对单个后门的遗忘训练可以泛化抑制其他未明确针对的后门,并引入交叉激活偏移距离量化不同训练引起的模型变化,为利用可控后门移除未知后门提供新方向。

Comments 22 pages, 28 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20628 2026-06-05 cs.CL 57%

Divide-Prompt-Refine: a Training-Free, Structure-Aware Framework for Biomedical Abstract Generation

Divide-Prompt-Refine:一种无需训练的、结构感知的生物医学摘要生成框架

Sylvey Lin, Joe Menke, Shufan Ming, Dongin Nam, Neil Smalheiser, Halil Kilicoglu

机构 * University of Washington(华盛顿大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 本文提出DPR-BAG框架,旨在生成具有完整文本但无摘要的生物医学文章的连贯且事实准确的摘要。该框架通过分解全文文档为结构化的修辞要素,进行并行LLM摘要生成,并应用最终的精炼阶段恢复全局话语连贯性。

Comments Accepted by BioNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00054 2026-06-05 cs.CV cs.AI 57%

HiDe: Rethinking The Zoom-IN method in High Resolution MLLMs via Hierarchical Decoupling

HiDe: 通过分层解耦重新思考高分辨率MLLMs中的Zoom-IN方法

Xianjie Liu, Yiman Hu, Yixiong Zou, Liang Wu, Jian Xu, Bo Zheng

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文提出HiDe框架,通过分层解耦方法解决高分辨率图像中背景干扰导致的视觉理解问题,提升多模态大语言模型在高分辨率图像任务中的性能。

Comments Accepted by ICML2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05109 2026-06-04 cs.LG 57%

RePercENT: Scaling Disentangled Representation Learning Beyond Two Modalities

RePercENT:将解耦表示学习扩展到两种模态之外

Vasiliki Rizou, Pascal Frossard, Dorina Thanou

机构 * EPFL(瑞士联邦理工学院)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 提出RePercENT框架,通过多模态即插即用架构和联合优化目标,实现超过两种模态的可扩展成对解耦,无需联合预训练并降低计算复杂度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04876 2026-06-04 cs.LG 57%

Towards Pretraining Text Encoders for TabPFN

面向TabPFN的文本编码器预训练

Mustafa Tajjar, Alexander Pfefferle, Lennart Purucker, Frank Hutter

机构 * University of California, Berkeley(加州大学伯克利分校) DeepMind(深度思维)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 提出TabPFN文本适配器,通过轻量级适配器将文本嵌入映射到TabPFN的嵌入空间,避免PCA瓶颈,保留TabPFN数值优势,训练效率更高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04780 2026-06-04 cs.CL 57%

PersonaTree: Structured Lifecycle Memory for Person Understanding in LLM Agents

PersonaTree: 面向LLM智能体人物理解的结构化生命周期记忆

Yubo Hou, Jingwei Song, Hongbo Zhang, Zhisheng Chen, Bang Xiao, Tao Wan, Zengchang Qin

机构 * School of ASEE, Beihang University, Beijing, China(北京航空航天大学航空科学与工程学院) The University of Hong Kong, Hong Kong, China(香港大学) Peking University, Beijing, China(北京大学) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学) School of BME, Beihang University, Beijing, China(北京航空航天大学生物医学工程学院) CAIR and CECS, VinUniversity, Hanoi, Vietnam(越南河内 Vin 大学 CAIR 和 CECS)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 提出PersonaTree,一种结构化生命周期记忆框架,通过三级人物树和显式支持路径,将交互证据抽象为人物理解,在多个基准上取得领先性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04599 2026-06-04 cs.AI cs.CE 57%

Plan First, Judge Later, Run Better: A DMAIC-Inspired Agentic System for Industrial Anomaly Detection

先计划,后评判,更优运行:一种受DMAIC启发的工业异常检测智能体系统

Yongzi Yu, Ao Li, Le Wang, Ziyue Li, Fugee Tsung, Yuxuan Liang, Man Li

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The Hong Kong University of Science and Technology(香港科技大学) Shanghai University of Finance and Economics(上海财经大学) Technische Universität München(慕尼黑技术大学) Southwestern University of Finance and Economics(西南财经大学)

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 提出受DMAIC启发的多智能体系统DMAIC-IAD,通过先制定标准化操作程序(SOP)再生成策略,并引入预训练的无执行评判模型来排序候选策略,无需昂贵运行时试验,在四种模态上平均检测性能提升37.76%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04296 2026-06-04 cs.AI 57%

The Saturation Trap and the Subjectivity of Intervention Timing: Why Affect-Based Triggers and LLM Judges Fail to Time Interventions on Autonomous Agents

饱和陷阱与干预时机的主观性:为什么基于情感的触发器和LLM评判者无法在自主智能体上把握干预时机

Manvendra Modgil

机构 * manvendramodgil.ai

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 本研究通过18维情感动力学引擎HEART诊断自主智能体干预时机问题,发现状态饱和陷阱、LLM评判者的能力与上下文门槛,以及人类标注者之间极低的干预时机一致性,表明干预时机是一个低可靠性构念。

Comments 11 pages, 5 tables. Code and data:https://github.com/2025eb1100268-tech/intervention-timing-saturation-trap

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04121 2026-06-04 cs.LO cs.LG cs.SE 57%

veriFIRE: an Industrial Case Study in Verifying Consistency Properties for a DNN-Based Wildfire Detection System

veriFIRE:基于DNN的野火检测系统一致性属性验证的工业案例研究

Idan Refaeli, Maya Swisa, Itay Buchnik, Alon Zada, Guy Amir, Elad Mandelbaum, Ziv Freund, Guy Katz

机构 * The Hebrew University of Jerusalem(海法大学) Elbit Systems - ISTAR & EW - Elisra L.T.D Cornell University(康奈尔大学)

专题命中 其他安全 :safety(abstract);分类 cs.LG

AI总结 本文提出一种端到端方法,通过将应用需求编码为求解器兼容查询,利用现有神经网络验证器验证野火检测系统中的单调性和有界响应等一致性属性,并在真实背景样本上评估,展示了工业系统可获得有意义的领域特定保证。

Comments To appear in The 9th International Symposium on AI Verification (SAIV)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03899 2026-06-04 cs.LG 57%

Denoise First, Orthogonalize Later: Understanding Momentum in Muon via Spectral Filtering

先降噪,后正交:通过谱滤波理解Muon中的动量

Xianliang Li, Zihan Zhang, Weiyang Liu, Han Bao

机构 * The Institute of Statistical Mathematics(统计数学研究所) The Graduate Institute for Advanced Studies, SOKENDAI(SOKENDAI高级研究院) National Institute of Informatics(国家信息研究所) The Chinese University of Hong Kong(香港中文大学) Tohoku University(东北大学) RIKEN AIP(理化学研究所AIP)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 本文通过谱滤波理论证明Muon优化器中的动量能抑制梯度扰动、扩大谱间隙,从而稳定正交化步骤,并证明先动量后正交化比相反顺序或去除动量更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03564 2026-06-04 cs.CV cs.AI 57%

CR-Seg: Attention-Guided and CoT-Enhanced Coarse-to-Refined Reasoning Segmentation

CR-Seg:注意力引导与CoT增强的由粗到精推理分割

Yifan Cao, Xiaocui Yang, Faxian Wan, Shi Feng, Daling Wang, Yifei Zhang

机构 * School of Computer Science and Engineering, Northeastern University(东北大学计算机科学与工程学院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 提出CR-Seg两阶段框架,通过注意力图提取和全局到局部思维链,实现由粗到精的推理分割,解决跨模态对齐和推理-答案不一致问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16331 2026-06-04 q-bio.BM cs.AI 57%

Retrieval and competition: how a protein foundation model starts a protein

检索与竞争:蛋白质基础模型如何启动蛋白质

Piotr Jedryszek, Oliver M. Crook

机构 * Department of Biology, University of Oxford, Oxford, UK(牛津大学生物学系) Kavli Institute for Nanoscience Discovery, University of Oxford, Oxford, UK(牛津大学纳科学发现研究所) Department of Chemistry, University of Oxford, Oxford, UK(牛津大学化学系)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 通过追踪ESM2-8M预测蛋白质起始甲硫氨酸的计算路径,发现模型依赖位置先验检索而非直接识别,揭示了模型置信度与生物学证据之间的脱节。

Comments updated figure 4

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00182 2026-06-04 cs.LG 57%

Towards A Generative Protein Evolution Machine with DPLM-Evo

迈向生成式蛋白质进化机器:DPLM-Evo

Xinyou Wang, Liang Hong, Jiasheng Ye, Zaixiang Zheng, Yu Li, Shujian Huang, Quanquan Gu

机构 * Nanjing University(南京大学) CUHK(香港大学) Fudan University(复旦大学) ByteDance(字节跳动)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 提出DPLM-Evo,一种显式建模替换、插入和删除操作的进化离散扩散框架,在单序列设置下实现蛋白质突变效应预测的最优性能,并支持变长模拟进化与蛋白质编辑优化。

Comments A peer-reviewed version was accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08665 2026-06-04 cs.CL 57%

Hint Tuning: Less Data Makes Better Reasoners

Hint Tuning:更少的数据造就更好的推理者

Siqi Fan, Minghao Li, Xiaoqian Ma, Xiusheng Huang, Zhuo Chen, Bowen Qin, Liujie Zhang, Shuo Shang, Weihang Chen

机构 * University of Electronic Science and Technology of China(电子科技大学) Xiaohongshu Inc.(小红书公司) National University of Singapore(新加坡国立大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 提出Hint Tuning方法,通过自动构建三种提示状态(无提示、稀疏提示、完整提示)的训练数据,使推理模型根据问题难度校准推理深度,仅用1K样本即可在多个主流推理模型上平均减少31.5%的token生成,同时保持竞争性准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19799 2026-06-04 stat.ML cs.LG math.OC 57%

Path-conditioned training: a principled way to rescale ReLU neural networks

路径条件训练:一种缩放ReLU神经网络的原则性方法

Arthur Lebeurrier, Titouan Vayer, Rémi Gribonval

机构 * Université de Lyon(里昂大学) CNRS(法国国家科学研究中心)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 本文提出一种基于路径提升框架的几何准则来缩放ReLU网络参数,通过最小化该准则实现核对齐,从而加速训练。

Journal ref Proceedings of the 43rd International Conference on Machine Learning (ICML 2026), Seoul, South Korea, PMLR 306 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17956 2026-06-04 cs.CL 57%

Towards Better Understanding of Program-of-Thought Reasoning in Cross-Lingual and Multilingual Environments

在跨语言和多语言环境中更好地理解程序思维推理

Patomporn Payoungkhamdee, Pume Tuchinda, Jinheon Baek, Samuel Cahyawijaya, Can Udomcharoenchaikit, Potsawee Manakul, Peerat Limkonchotiwat, Ekapol Chuangsuwanich, Sarana Nutanong

机构 * School of Information Science and Technology, VISTEC(信息科学与技术学院,VISTEC) KAIST(韩国科学技术院) Cohere SCB 10X AI Singapore(AI新加坡) Department of Computer Engineering, Chulalongkorn University(朱拉隆梭大学计算机工程系)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 通过分离推理与代码执行,提出评估程序思维提示的框架,发现微调显著提升多语言推理能力,且推理质量与答案准确性强相关。

Journal ref Findings of the Association for Computational Linguistics: ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03712 2026-06-03 cs.LG 57%

When Graph Tokens Sink: A Mechanistic Analysis of Graph Language Models

当图标记沉没:图语言模型的机制分析

Ding Zhang, Runtao Zhou, Wenqing Zheng, Rizal Fathony, Bayan Bruss, Chirag Agarwal

机构 * University of Virginia(弗吉尼亚大学) Capital One

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 本文通过分析图语言模型中图标记的内部行为,发现激活层面的显著性与图信息利用之间存在解耦,揭示了现有图标记构建、放置和对齐机制的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03569 2026-06-03 cs.CV cs.AI 57%

When Attention Collapses: Stage-Aware Visual Token Pruning from Structure to Semantics

当注意力崩溃时:从结构到语义的阶段性视觉令牌剪枝

Jiahui Wang, Kai Zhang, Mai Han, Huanghe Zhang

机构 * Shandong University(山东大学) National University of Singapore (Suzhou) Research Institute(新加坡国立大学(苏州)研究院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 针对视觉语言模型推理中视觉令牌剪枝因依赖单一注意力分数导致特征多样性下降的问题,提出两阶段剪枝框架STS,先通过排斥采样最大化结构多样性,再通过指令感知交叉注意力过滤语义无关令牌,从而提升保留令牌的结构多样性与细粒度任务对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03279 2026-06-03 cs.LG 57%

A Geometric Lens on Physics-Aligned Data Compression

物理对齐数据压缩的几何视角

Aleix Segui, Wesley Armour

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 本文通过局部几何理论揭示了物理信息损失函数在科学数据压缩中导致的率失真权衡,并提出了基于主特征空间重叠的对齐诊断方法。

Comments Proceedings of the 43rd International Conference on Machine Learning, Seoul, South Korea. PMLR 306, 2026

Journal ref Proceedings of the 43rd International Conference on Machine Learning, Seoul, South Korea. PMLR 306, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03234 2026-06-03 cs.LG 57%

Right Makes Might: Aligning Verified Hidden States Empowers RL Reasoning

正确即力量:对齐验证的隐藏状态增强强化学习推理

Ziyue Wang, Aomufei Yuan, Yongfu Zhu, Shuai Dong, Wenpu Liu, Yiran Yao, Weichu Xie, Yuqi Xu, Caoyuan Ma, Wenqi Shao, Xiaoying Zhang, Nan Duan, Jiaqi Wang

机构 * Peking University(北京大学) JINGDONG(京东) Shanghai Innovation Institute(上海创新研究院) The University of Tokyo(东京大学) Tianjin University(天津大学)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 提出Hidden-Align辅助损失函数,在强化学习训练中对齐正确rollout在锚点token处的最后一层隐藏状态,提升数学推理性能。

Comments 16 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02753 2026-06-03 cs.CV cs.AI 57%

MetaWorld: Scaling Multi-Agent Video World Model from Single-view Video Data

MetaWorld: 从单视角视频数据扩展多智能体视频世界模型

Teng Hu, Mingchun Lu, Yating Wang, Jiangning Zhang, Jinkun Hao, Ye Pan, Ran Yi, Lizhuang Ma, Dacheng Tao

机构 * Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 提出MetaWorld框架,通过单目世界状态展开、主体感知世界生成器和世界状态对齐机制,从单视角视频构建多智能体视频世界模型,解决数据稀缺和世界状态对齐问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02638 2026-06-03 cs.SD cs.AI eess.AS 57%

SegTune: Structured and Fine-Grained Control for Song Generation

SegTune:歌曲生成的结构化与细粒度控制

Yuejiao Wang, Zihao Ji, Pengfei Cai, Xu Li, Haorui Zheng, Zewen Song, Zhongliang Liu, Chen Zhang, Pengfei Wan

机构 * Kling Team, Kuaishou Technology(快手科技 Kling 团队) University of Science and Technology of China(中国科学技术大学) Peking University(北京大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 提出基于扩散Transformer的SegTune框架,通过用户或LLM指定局部音乐描述实现结构化细粒度控制,并引入LLM时长预测器实现精确歌词-音乐对齐,在音乐性和可控性上超越现有基线。

Comments This paper has been accepted to ACL 2026 as an oral presentation and has been nominated for the Best Paper Award. This work is a revised and extended version of an earlier technical report (arXiv:2510.18416). arXiv admin note: text overlap with arXiv:2510.18416

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30166 2026-06-03 cs.SI cs.LG 57%

SAHG: Sector-Anisotropic Hyperbolic Graph Model for Social Bot Detection

SAHG:用于社交机器人检测的扇区各向异性双曲图模型

Hanning Lu, Yingguang Yang, Jinwei Su, Yang Liu, Zhaoqian Yao, Yaoming Li, Taoran Liang, Ziyi Zhang, Ran Ran, Kefu Xu, Bin Chong

机构 * University of Leeds(利兹大学) University of Science and Technology of China(中国科学技术大学) South China Normal University(华南师范大学) Tsinghua University(清华大学) The Chinese University of Hong Kong(香港中文大学) Harbin University of Commerce(哈尔滨商业大学) Beijing University of Posts and Telecommunications(北京邮电大学) Peking University(北京大学) University of California, Berkeley(加州大学伯克利分校)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 提出扇区各向异性双曲图模型SAHG,通过方向依赖曲率场和扇区原型解决欧几里得GNN在层次无标度社交图中的失真问题以及异质连接导致的信号污染问题,在三个基准上取得最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00392 2026-06-03 cs.LG 57%

Localized, High-resolution Geographic Representations with Slepian Functions

基于Slepian函数的局部高分辨率地理表示

Arjun Rao, Ruth Crasto, Tessa Ooms, David Rolnick, Konstantin Klemmer, Marc Rußwurm

机构 * Department of Computer Science, University of Colorado Boulder(科罗拉多大学波德分校计算机科学系) Microsoft(微软公司) University College London(伦敦大学学院) McGill University(麦吉尔大学) Mila–Quebec AI Institute(魁北克AI研究所) University of Bonn, Germany(德国波恩大学) University of Wageningen, Netherlands(荷兰瓦赫宁根大学)

专题命中 其他安全 :safety(abstract);分类 cs.LG

AI总结 提出利用球面Slepian函数构建地理编码器,在感兴趣区域内集中表示能力,实现高分辨率且计算高效,并引入混合Slepian-球谐编码器平衡局部与全局性能,在分类、回归等任务中优于基线。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16882 2026-06-03 physics.chem-ph cond-mat.mtrl-sci cs.LG 57%

A Cartesian-3j Framework for Machine Learning Interatomic Potentials

机器学习原子间势的 Cartesian-3j 框架

Zemin Xu, Chenyu Wu, Wenbo Xie, P. Hu

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 提出基于Cartesian-3j符号和Cartesian广义Clebsch-Gordan系数的不可约Cartesian张量框架,构建MACE、NequIP和Allegro的Cartesian版本,并引入TACE-v1-OAM-M模型在Matbench Discovery上取得竞争性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21448 2026-06-03 cs.CL 57%

When Models Refuse: Political Steerability and Feature Richness as Measures of Ideological Depth

当模型拒绝时:政治可操控性与特征丰富度作为意识形态深度的度量

Shariar Kabir

机构 * Bangladesh University of Engineering and Technology(孟加拉工程与技术大学)

专题命中 其他安全 :safety(abstract);分类 cs.CL

AI总结 本文提出意识形态深度概念,通过可操控性和稀疏自编码器测量的特征丰富度,研究大语言模型拒绝遵循良性指令是否源于能力缺陷而非安全规则。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22854 2026-06-03 cs.CL 57%

Train Once, Reuse Everywhere: Generalizable Implicit In-Context Learning by Routing Attention

一次训练,随处重用:通过路由注意力实现可泛化的隐式上下文学习

Jiaqian Li, Yanshu Li, Ligong Han, Ruixiang Tang, Wenya Wang

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 提出In-Context Routing (ICR)方法,在注意力logits层面捕获可泛化的上下文学习模式,通过可学习的输入条件路由器调制注意力logits,实现高效的一次训练多次重用框架,在12个数据集上优于现有隐式ICL方法并展现强泛化能力。

Comments ICML 2026 Camera-ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02497 2026-06-02 cs.AI 57%

Bridging the Last Mile of Time Series Forecasting with LLM Agents

用LLM智能体弥合时间序列预测的最后一公里

Yuhua Liao, Zetian Wang, Qiangqiang Nie, Zhenhua Zhang

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 提出一个LLM智能体框架,通过检索上下文证据和结构化约束,将统计预测转化为业务就绪的预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01691 2026-06-02 cs.CR cs.LG 57%

IstGPT: LLM-based Anomaly Detection for Spatial-Temporal Graph in Industrial Systems

IstGPT:基于LLM的工业系统时空图异常检测

Yuchen Zhang, Ning Xi, Pengbin Feng, Shigang Liu, Jianfeng Ma, Yulong Shen, Yanan Sun, Xiaolin Zhou

机构 * School of Cyber Engineering, Xidian University(电子科技大学信息工程学院) School of Science, Computing and Engineering Technologies, Swinburne University of Technology(斯winburne技术大学科学与工程技术学院) School of Computer Science and Technology, Xidian University(电子科技大学计算机科学与技术学院)

专题命中 其他安全 :safety(abstract);分类 cs.LG

AI总结 提出IstGPT,首个结合大语言模型与图学习的工业异常检测工具,通过多模态知识提取传感器-执行器依赖图并利用改进的图神经网络实现实时异常检测,在9个数据集上取得最佳F1分数和eTaF1指标。

详情

展开后加载摘要…

URL PDF HTML 收藏