arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 8057 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 8057 篇

2602.01265 2026-05-01 cs.LG 57%

BicKD: Bilateral Contrastive Knowledge Distillation

BicKD:双侧对比知识蒸馏

Jiangnan Zhu, Yukai Xu, Li Xiong, Yixuan Liu, Junxu Liu, Hong kyu Lee, Yujie Gu

机构 * Kyushu University(九州大学) Emory University(埃默里大学) Beijing University of Technology(北京理工大学) The Hong Kong Polytechnic University(香港理工大学)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 本文提出BicKD,通过双侧对比损失增强知识迁移,改进传统知识蒸馏的样本级和类别级对比能力,提升预测分布几何结构的正则化效果。

Comments Accepted to the 2026 IEEE/INNS International Joint Conference on Neural Networks (IJCNN 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27547 2026-05-01 cs.LG 57%

Diagnosing Capability Gaps in Fine-Tuning Data

诊断微调数据中的能力差距

Saeid Asgari Taghanaki, Rakshanda Agarwal, Bruce Sun, Rohan Jha, Elias Stengel-Eskin, Sara Malvar, Rui Ying, Yifei Xu, Guilherme Potje, Tusher Chakraborty, Leonardo de Oliveira Nunes, Ranveer Chandra, Emre Kiciman

机构 * Microsoft(微软)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 本文提出GoalCover框架,通过交互式目标分解和自动化覆盖评估,帮助检测微调数据集的能力缺口,通过实验验证其在不同领域和任务中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27354 2026-05-01 cs.AI 57%

CoAX: Cognitive-Oriented Attribution eXplanation User Model of Human Understanding of AI Explanations

CoAX:面向认知的归因解释用户模型:人类对AI解释的理解

Louth Bin Rawshan, Zhuoyu Wang, Brian Y. Lim

机构 * National University of Singapore(新加坡国立大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文通过认知建模分析不同XAI方法在结构化数据推理中的策略,发现模型能更准确拟合人类决策,为改进AI解释的可理解性提供新思路。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27300 2026-05-01 cs.AI 57%

METASYMBO: Multi-Agent Language-Guided Metamaterial Discovery via Symbolic Latent Evolution

METASYMBO: 多智能体语言引导的超材料发现 via 符号驱动的潜在进化

Jianpeng Chen, Wangzhi Zhan, Dongqi Fu, Junkai Zhang, Zian Jia, Ling Li, Wei Wang, Dawei Zhou

机构 * Virginia Tech(弗吉尼亚理工大学) Meta AI University of California Los Angeles(加州大学洛杉矶分校) Princeton University(普林斯顿大学) University of Pennsylvania(宾夕法尼亚大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文提出MetaSymbO框架,通过符号驱动的潜在进化实现语言引导的超材料发现,提升结构有效性和语言指导得分,验证其在实际应用中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27274 2026-05-01 cs.AI 57%

The Inverse-Wisdom Law: Architectural Tribalism and the Consensus Paradox in Agentic Swarms

逆智慧定律:代理群中的建筑部落主义与共识悖论

Dahlia Shehata, Ming Li

机构 * University of Waterloo(滑铁卢大学)

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 研究挑战了代理协作遵循'群体智慧'的假设,揭示了代理群优先内部架构一致而非外部逻辑真理的悖论,通过实验证明逆智慧定律,并定义部落主义系数和谄媚权重作为群失败的主要决定因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27162 2026-05-01 cs.MA cs.LG cs.PF 57%

A High-Throughput Compute-Efficient POMDP Hide-And-Seek-Engine (HASE) for Multi-Agent Operations

一种高吞吐量、计算高效的POMDP捉迷藏引擎(HASE)用于多智能体操作

Timothy Flavin, Sandip Sen

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 本文提出一种高效的Dec-POMDP引擎,通过C++架构和优化技术实现高吞吐量,验证了其在多智能体协作策略训练中的性能和通用性。

Comments 21 pages, 10 figures, 5 tables. Includes appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12632 2026-05-01 cs.CV cs.LG 57%

TeD-Loc: Text Distillation for Weakly Supervised Object Localization

TeD-Loc: 文本蒸馏用于弱监督目标定位

Shakeeb Murtaza, Soufiane Belharbi, Alexis Guichemerre, Marco Pedersoli, Eric Granger

机构 * LIVIA, ILLS, Dept. of Systems Engineering, ETS Montreal, Canada(LIVIA、ILLs、系统工程系、蒙特利尔工程学院,加拿大)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 TeD-Loc通过对比对齐将CLIP文本嵌入迁移到patch嵌入,实现patch级的前景/背景定位,并引入定位引导的分类模块以提升定位与分类的联合性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25967 2026-04-30 cs.CL 57%

Semantic Label Drift in Cross-Cultural Translation

跨文化翻译中的语义标签漂移

Mohsinul Kabir, Tasnim Ahmed, Md Mezbaur Rahman, Polydoros Giannouris, Sophia Ananiadou

机构 * Department of Computer Science, National Center for Text Mining, The University of Manchester(计算机科学系,文本挖掘国家中心,曼彻斯特大学) School of Computing, Queen’s University, Ontario, Canada(计算学院,加拿大皇后大学) Computer Science, University of Illinois Chicago(计算机科学,伊利诺伊大学芝加哥分校)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 本文研究了跨文化翻译中因文化差异导致的语义标签漂移问题,发现现代大语言模型在文化敏感领域易引发标签漂移,并揭示文化相似性对标签保真度的关键影响。

Journal ref LREC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00209 2026-04-30 eess.IV cs.AI cs.CV cs.RO 57%

SurgiSR4K: A High-Resolution Endoscopic Video Dataset for Robotic-Assisted Minimally Invasive Procedures

SurgiSR4K:一种用于机器人辅助微创手术的高分辨率内窥镜视频数据集

Fengyi Jiang, Xiaorui Zhang, Lingbo Jin, Ruixing Liang, Yuxin Chen, Adi Chola Venkatesh, Jason Culman, Tiantian Wu, Lirong Shao, Wenqing Sun, Cong Gao, Hallie McNamara, Jingpei Lu, Omid Mohareri

机构 * Intuitive Surgical, Inc.(Intuitive Surgical公司) Johns Hopkins Medicine Neurosurgery(约翰霍普金斯医学神经外科) Johns Hopkins University Electrical and Computer Engineering(约翰霍普金斯大学电气与计算机工程) University of British Columbia Electrical and Computer Engineering(不列颠哥伦比亚大学电气与计算机工程) Wilford & Kate Bailey Small Animal Teaching Hospital(威尔福德与凯蒂·贝利小动物教学医院)

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 本文提出SurgiSR4K数据集,用于提升微创手术的视觉清晰度和计算机辅助导航精度,包含4K分辨率的手术视频,涵盖镜面反射、工具遮挡等挑战性场景,支持超分辨率、烟雾去除等多任务研究。

Journal ref Machine Learning for Biomedical Imaging, Vol. 3, 2025, pp. 875-885

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18112 2026-04-30 cs.CL cs.MM 57%

Retrieval-Augmented Multimodal Model for Fake News Detection

增强检索的多模态模型用于虚假新闻检测

Yiheng Li, Weihai Lu, Hanyi Yu, Yue Wang

机构 * University of International Business and Economics(国际商务经济大学) Peking University(北京大学) University of Southern California(南加州大学) Upstart Holdings, Inc.(Upstart Holdings公司)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 本文提出RAMM模型,通过多模态大语言模型和抽象叙述对齐模块,解决虚假新闻检测中跨实例叙述一致性缺失和领域知识不足的问题,实验验证了其有效性。

Comments Accepted to SIGIR 26

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15262 2026-04-30 cs.AI 57%

Probe-then-Plan: Environment-Aware Planning for Industrial E-commerce Search

探测-然后规划:面向工业电商搜索的环境感知规划

Mengxiang Chen, Zhouwei Zhai, Jin Li

机构 * JD.com Beijing China(京东北京中国)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文提出环境感知搜索规划(EASP),通过探测-规划机制解决电商搜索中盲点与延迟的矛盾,通过离线数据合成、规划器训练和在线服务适应性路由提升搜索相关召回率和UCVR、GMV。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03558 2026-04-30 cs.CV cs.AI cs.MM 57%

ELIQ: A Label-Free Framework for Quality Assessment of Evolving AI-Generated Images

ELIQ:一种无需标签的进化AI生成图像质量评估框架

Xinyue Li, Zhiming Xu, Min Tang, Zhaolin Cai, Sijing Wu, Xiongkuo Min, Yitong Chen, Guangtao Zhai

机构 * Shanghai Jiao Tong University(上海交通大学) Xi'an Jiaotong University(西安交通大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 ELIQ通过自动构建正负样本对,利用预训练多模态模型提升质量评估,实现无需人工标注的高质量评估,优于现有无标签方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25296 2026-04-29 cs.CL 57%

Learning from Medical Entity Trees: An Entity-Centric Medical Data Engineering Framework for MLLMs

从医学实体树学习:一种以实体为中心的医疗数据工程框架用于多模态大语言模型

Jianghang Lin, Haihua Yang, Deli Yu, Kai Wu, Kai Ye, Jinghao Lin, Zihan Wang, Yuhang Wu, Liujuan Cao

机构 * Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University, China(中国教育部多媒体可信感知与高效计算重点实验室,厦门大学,中国) ByteDance(字节跳动) Northeastern University(东北大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 本文提出以实体为中心的医疗数据工程框架,通过构建医学实体树,提升多模态大语言模型在医疗领域的表现,通过实体引导检索、双重过滤和知识感知数据合成等方法,增强模型处理复杂临床问题的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24933 2026-04-29 cs.AI cs.SD 57%

S-SONDO: Self-Supervised Knowledge Distillation for General Audio Foundation Models

S-SONDO:基于自监督的知识蒸馏用于通用音频基础模型

Mohammed Ali El Adlouni, Aurian Quelennec, Pierre Chouteau, Geoffroy Peeters, Slim Essid

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 S-SONDO通过仅利用输出嵌入进行知识蒸馏,实现对通用音频模型的高效压缩,保留96%性能,适用于嵌入式教师模型。

Comments Accepted at IEEE ICASSP 2026. 5 pages, 2 figures, 3 tables. Equal contribution by first two authors. Code: https://github.com/MedAliAdlouni/ssondo | Models: https://huggingface.co/mohammedali2501/ssondo | Package: https://pypi.org/project/ssondo/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01070 2026-04-29 cs.CL 57%

How RL Unlocks the Aha Moment in Geometric Interleaved Reasoning

如何通过强化学习解锁几何交错推理中的顿悟时刻

Xiangxiang Zhang, Caijun Jia, Siyuan Li, Dingyu He, Xiya Xiong, Zheng Sun, Honghao He, Yuchen Wu, Bihui Yu, Linzhuang Sun, Cheng Tan, Jingxuan Wei

机构 * ByteDance(字节跳动) Shenyang Institute of Computing Technology, Chinese Academy of Sciences(沈阳计算技术研究所,中国科学院) Westlake University(西交大学) University of Chinese Academy of Science(中国科学院大学) Key Laboratory of Computing Power Network and Information Security, Ministry of Education(教育部计算能力网络与信息安全重点实验室) Shandong Computer Science Center (National Supercomputer Center in Jinan)(山东省计算机科学中心(济南国家超算中心)) Qilu University of Technology (Shandong Academy of Sciences)(齐鲁工业大学(山东省科学院))

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 本文探讨了在几何交错推理中,通过强化学习框架Faire克服传统监督微调的局限性,实现更深层次的因果对齐,从而提升推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24403 2026-04-28 cs.LG cs.RO 57%

An Automatic Ground Collision Avoidance System with Reinforcement Learning

一种基于强化学习的自动地面避障系统

Seyyid Osman Sevgili, Atahan Cilan, Mahir Demir, Özgün Can Yürütken, Ümit Can Bekar

专题命中 其他安全 :safety(abstract);分类 cs.LG

AI总结 本文提出一种基于人工智能的自动地面避障系统,旨在提升先进喷气式教练机的操作效能,通过有限观测空间内的避障设计提升安全性和操作能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03269 2026-04-28 cs.CV cs.LG 57%

LoGeR: Long-Context Geometric Reconstruction with Hybrid Memory

LoGeR:长上下文几何重建与混合记忆

Junyi Zhang, Charles Herrmann, Junhwa Hur, Chen Sun, Ming-Hsuan Yang, Forrester Cole, Trevor Darrell, Deqing Sun

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 LoGeR通过混合记忆模块实现长序列的高精度3D重建,无需后优化,有效解决长视频中的上下文一致性问题,优于现有方法。

Comments Project page: https://LoGeR-project.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17381 2026-04-28 cs.LG 57%

Beyond Binary Out-of-Distribution Detection: Characterizing Distributional Shifts with Multi-Statistic Diffusion Trajectories

超越二元分布外检测:利用多统计扩散轨迹表征分布偏移

Achref Jaziri, Martin Rogmann, Martin Mundt, Visvanathan Ramesh

机构 * Goethe University(弗赖堡大学) University of Bremen(不莱梅大学)

专题命中 其他安全 :safety(abstract);分类 cs.LG

AI总结 本文提出DISC方法,通过扩散模型的迭代去噪过程提取多维特征向量,表征多噪声水平下的统计差异,实现对分布外数据类型的分类,突破传统二元检测的局限。

Comments Accepted at AISTATS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24086 2026-04-28 cs.RO cs.AI 57%

AsyncShield: A Plug-and-Play Edge Adapter for Asynchronous Cloud-based VLA Navigation

AsyncShield: 一种异步云边协同的边缘适配器用于异步云边VLA导航

Kai Yang, Zedong Chu, Yingnan Guo, Zhengbo Wang, Shichao Xie, Yanfen Shen, Xiaolong Wu, Xing Li, Mu Xu

机构 * Amap, Alibaba Group(阿里巴巴集团地图部门) Beijing Jiaotong University(北京交通大学)

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 本文提出AsyncShield,通过确定性物理白盒空间映射替代传统黑盒时间序列预测,解决云边异步导航中时空对齐问题,提升导航鲁棒性和安全性。

Comments 9 pages, 2 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13288 2026-04-28 cs.CL 57%

A BERTology View of LLM Orchestrations: Token- and Layer-Selective Probes for Efficient Single-Pass Classification

BERTology视角下的大语言模型编排:基于令牌和层的选择性探针用于高效单次分类

Gonzalo Ariel Meyoyan, Luciano Del Corro

机构 * Departamento de Computación, FCEyN Universidad de Buenos Aires(布宜诺斯艾利斯大学计算机系) ELIAS Lab, Departamento de Ingeniería Universidad de San Andres(圣安德烈斯大学工程系ELIAS实验室)

专题命中 其他安全 :safety(abstract);分类 cs.CL

AI总结 本文提出基于BERTology方法的LLM编排框架,通过令牌和层选择性探针实现高效单次分类,提升安全性和情感分类性能,同时保持接近服务延迟并避免额外的VRAM和延迟成本。

Comments Accepted to ACL 2026 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23446 2026-04-28 cs.AI 57%

IndustryAssetEQA: A Neurosymbolic Operational Intelligence System for Embodied Question Answering in Industrial Asset Maintenance

IndustryAssetEQA: 一种用于工业资产维护中具身体验问答的神经符号操作智能系统

Chathurangi Shyalika, Dhaval Patel, Amit Sheth

机构 * Artificial Intelligence Institute, University of South Carolina(南卡罗来纳大学人工智能研究所) University of South Carolina(南卡罗来纳大学) IBM Yorktown(IBM约克镇分公司) Indian AI Research Organization(印度人工智能研究组织)

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 本文提出IndustryAssetEQA系统,结合事件 telemetry 表示与FMEA-KG知识图谱,提升工业资产问答的结构有效性、反事实准确性及解释蕴含性,减少专家评估的过度声称。

Comments 20 pages, 4 figures, 4 tables, Accepted for the 64th Annual Meeting of the Association for Computational Linguistics (ACL 2026) Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23179 2026-04-28 cs.RO cs.AI cs.MA 57%

Cooperative Informative Sensing for Monitoring Dynamic Indoor Environments via Multi-Agent Reinforcement Learning

通过多智能体强化学习进行协作信息感知以监控动态室内环境

Kanghoon Lee, Matthew M. Sato, Jinnyeong Yang, Seungro Lee, Sujin Lee, Jiachen Li, Kuk-Jin Yoon, Jinkyoo Park, Kincho H. Law, Yoonjin Yoon

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院) Stanford University(斯坦福大学) University of California, Berkeley(加州大学伯克利分校) University of California, Riverside(加州大学河滨分校)

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 本文提出利用多智能体强化学习进行协作信息感知,以提高动态室内环境监控的准确性,优于传统覆盖和学习无关的多机器人方法。

Comments 8 pages, 10 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23125 2026-04-28 cs.CV cs.LG 57%

Learning from Imperfect Text Guidance: Robust Long-Tail Visual Recognition with High-Noise Label

从不完美文本指导中学习:在高噪声标签下的鲁棒长尾视觉识别

Mengke Li, Haiquan Ling, Yiqun Zhang, Yang Lu, Hui Huang

机构 * CSSE, Shenzhen University(软件学院,深圳大学) SCST, Guangdong University of Technology(软件学院,广东技术大学) INFORMATICS, Xiamen University(信息学院,厦门大学)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 本文提出利用预训练视觉-语言模型的跨模态对齐能力,通过弱教师监督纠正长尾噪声数据中的标签-图像不一致问题,提升模型在高噪声环境下的识别性能。

Comments Accepted by CVM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23019 2026-04-28 cs.CV cs.LG 57%

Understanding Representation Gaps Across Scales in Tropical Tree Species Classification from Drone Imagery

理解无人机影像中热带树种分类的多尺度表征差距

Sulagna Saha, Arthur Ouaknine, Etienne Laliberté, Carol Altimas, Evan M. Gora, Adriane Esquivel Muelbert, Ian R. McGregor, Cesar Gutierrez, Vanessa E. Rubio, David Rolnick

机构 * Mila – Quebec AI Institute(魁北克人工智能研究所) McGill University(麦吉尔大学) Université de Montréal(蒙特利尔大学) Cary Institute of Ecosystem Studies(生态系统研究所) Smithsonian Tropical Research Institute(史密松国家热带研究所) Department of Plant Sciences, University of Cambridge(剑桥大学植物科学系) Universidade do Estado do Mato Grosso (UNEMAT)(马托格罗索州立大学(UNEMAT))

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 研究通过对比高分辨率近景与粗分辨率俯视影像,发现近景影像在树种分类中表现更优,尤其对稀有物种效果更显著,提出跨尺度自监督表征对齐方法提升分类模型性能。

Comments ML4RS @ICLR 2026 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22797 2026-04-28 eess.SY cs.LG cs.SY 57%

Hierarchical RL-MPC Control for Dynamic Wake Steering in Wind Farms

分层强化学习-模型预测控制用于风场动态涡流偏转

Marcus Binder Nilsen, Teodor Olof Benedict Åstrand, Tuhfe Göçmen, Pierre-Elouan Réthoré

机构 * Technical University of Denmark, Department of Wind and Energy Systems(丹麦技术大学,风能与能源系统系)

专题命中 其他安全 :safety(abstract);分类 cs.LG

AI总结 本文提出分层框架结合强化学习与模型预测控制,通过RL学习补偿状态估计供MPC控制器使用,实现23%的功率增益并优于理想MPC,相比直接RL控制在安全性和稳定性上更优。

Comments This work has been submitted to IFAC for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00829 2026-04-28 cs.CV cs.CL 57%

LinguDistill: Recovering Linguistic Ability in Vision-Language Models via Selective Cross-Modal Distillation

LinguDistill: 通过选择性跨模态蒸馏恢复视觉语言模型中的语言能力

Patrick Amadeus Irawan, Erland Hilman Fuadi, Shanu Kumar, Alham Fikri Aji, Yova Kementchedjhieva

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫莫德·本·扎耶德人工智能大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 本文提出LinguDistill方法,通过利用冻结的原始语言模型作为教师,选择性蒸馏语言信号以恢复语言能力,同时保持视觉基础,提升了语言和知识基准性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10180 2026-04-28 cs.CL 57%

For-Value: Efficient Forward-Only Data Valuation for finetuning LLMs and VLMs

For-Value:高效前向仅数据估值用于微调LLM和VLM

Wenlong Deng, Qi Zeng, Jiaming Zhang, Minghui Chen, Zixin Ding, Christos Thrampoulidis, Boying Gong, Xiaoxiao Li

机构 * University of British Columbia(不列颠哥伦比亚大学) Vector Institute(向量研究所) Meta

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 本文提出For-Value框架,通过前向计算高效评估数据价值,无需反向传播,提升大规模模型训练效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11772 2026-04-28 cs.LG 57%

LAMP: Extracting Local Decision Surfaces From Large Language Models

LAMP:从大型语言模型中提取局部决策表面

Ryan Chen, Youngmin Ko, Zeyu Zhang, Catherine Cho, Sunny Chung, Mauro Giuffré, Dennis L. Shung, Bradly C. Stadie

机构 * Department of Statistics and Data Science, Northwestern University(西北大学统计与数据科学系) Section of Digestive Diseases, Department of Medicine, Yale School of Medicine(耶鲁医学院消化疾病科) Department of Biomedical Informatics and Data Science, Yale School of Medicine(耶鲁医学院生物医学信息学与数据科学系) Division of Gastroenterology and Hepatology, Department of Medicine, Mayo Clinic(梅奥诊所消化内科与肝病科)

专题命中 其他安全 :safety(abstract);分类 cs.LG

AI总结 LAMP通过局部线性替代方法揭示语言模型决策表面,验证其解释与人类判断的一致性,并在多个任务中展示其对模型行为的审计能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22548 2026-04-27 stat.AP cs.LG 57%

Multi-output Extreme Spatial Model for Complex Aircraft Production Systems

多输出极值空间模型用于复杂飞机生产系统

Cheolhei Lee, Xing Wang, Xiaowei Yue, Jianguo Wu

机构 * Grado Department of Industrial and Systems Engineering, Virginia Polytechnic Institute and State University(弗吉尼亚理工学院和州立大学工业与系统工程系) Department of Mathematics, Illinois State University(伊利诺伊州立大学数学系) Department of Industrial Engineering, Tsinghua University(清华大学工业工程系) Department of Industrial Engineering and Management, Peking University(北京大学工业工程与管理系)

专题命中 其他安全 :safety(abstract);分类 cs.LG

AI总结 本文提出多输出极值空间模型,用于复杂飞机生产系统中的极值预测与风险分析,通过双域线性函数捕捉动态,提升极端事件预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22166 2026-04-27 cs.CL 57%

Fine-Grained Analysis of Shared Syntactic Mechanisms in Language Models

语言模型中共享句法机制的细粒度分析

Ryoma Kumon, Hitomi Yanaka

机构 * The University of Tokyo(东京大学) RIKEN(日本理化学研究所) Tohoku University(东北大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 本研究通过细粒度分析探讨语言模型在不同句法结构中是否共享神经机制,发现填词-缺口依赖在早期至中期层有高度局部化的共享机制,而否定极性项目许可则无统一机制。

Comments Accepted to ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏