arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-02-20 至 2026-02-20 共收录 52 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 安全评测 19 篇

2602.13469 2026-02-20 cs.HC cs.AI 57%

How Multimodal Large Language Models Support Access to Visual Information: A Diary Study With Blind and Low Vision People

多模态大语言模型如何支持视障人士获取视觉信息:一项与盲人和低视力人士的日记研究

Ricardo E. Gonzalez Penuela, Crescentia Jung, Sharon Y Lin, Ruiying Hu, Shiri Azenkot

机构 * Cornell University(康奈尔大学)

专题命中 安全评测 :trustworthy(abstract);分类 cs.AI

AI总结 本研究探讨了多模态大语言模型如何通过视觉助手技能支持视障人士获取视觉信息,并发现其在实际应用中的表现及改进方向。

Comments 24 pages, 17 figures, 7 tables, appendix section, to appear main track CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17185 2026-02-20 cs.HC cs.AI 57%

The Bots of Persuasion: Examining How Conversational Agents' Linguistic Expressions of Personality Affect User Perceptions and Decisions

说服的机器人:探讨对话代理的语言性人格表达如何影响用户感知和决策

Uğur Genç, Heng Gu, Chadha Degachi, Evangelos Niforatos, Senthil Chandrasegaran, Himanshu Verma

机构 * Delft University of Technology(代尔夫特理工大学)

专题命中 安全评测 :trustworthy(abstract);分类 cs.AI

AI总结 研究探讨了对话代理通过语言表达的人格如何影响用户在慈善捐赠中的感知和决策,发现人格特征显著影响用户信任和捐赠行为。

Comments Accepted to be presented at CHI'26 in Barcelona

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16938 2026-02-20 cs.CL 57%

ConvApparel: A Benchmark Dataset and Validation Framework for User Simulators in Conversational Recommenders

ConvApparel:一种用于对话推荐系统中用户模拟器的基准数据集和验证框架

Ofer Meshi, Krisztian Balog, Sally Goldman, Avi Caciularu, Guy Tennenholtz, Jihwan Jeong, Amir Globerson, Craig Boutilier

机构 * Google(谷歌)

专题命中 安全评测 :alignment(abstract);分类 cs.CL

AI总结 ConvApparel通过双代理数据收集和反事实验证框架,评估对话推荐系统中用户模拟器的现实差距和泛化能力。

Comments EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21193 2026-02-20 cs.CL 57%

Estonian Native Large Language Model Benchmark

爱沙尼亚原生大语言模型基准

Helena Grete Lillepalu, Tanel Alumäe

机构 * Department of Software Science, Tallinn University of Technology, Estonia(软件科学系,塔林技术大学,爱沙尼亚)

专题命中 安全评测 :alignment(abstract);分类 cs.CL

AI总结 本文提出爱沙尼亚语言的大语言模型基准,通过七个多样化的数据集评估不同模型的性能,结合人类和LLM评判方法,验证了高性能模型在爱沙尼亚语言评估中的有效性。

Comments Accepted to LREC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17340 2026-02-20 cs.HC 50%

PersonaMail: Learning and Adapting Personal Communication Preferences for Context-Aware Email Writing

PersonaMail: 通过结构化沟通因素探索、细粒度编辑控制和适应性重用策略学习和适应个人通信偏好以实现情境感知的电子邮件写作

Rui Yao, Qiuyuan Ren, Felicia Fang-Yi Tan, Chen Yang, Xiaoyu Zhang, Shengdong Zhao

专题命中 安全评测 :alignment(abstract)

AI总结 PersonaMail通过结构化探索、细粒度编辑和适应性重用策略,提升电子邮件写作中对个人通信偏好的学习与适应能力,提高效率和用户满意度。

Comments 21 pages, 5 figures. Accepted to the 31st International Conference on Intelligent User Interfaces (IUI 26), March 23-26, 2026, Paphos, Cyprus

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14969 2026-02-20 q-bio.GN stat.ML 50%

Robust Machine Learning for Regulatory Sequence Modeling under Biological and Technical Distribution Shifts

在生物和技术分布偏移下鲁棒的机器学习用于调控序列建模

Yiyao Yang

专题命中 安全评测 :safety(abstract)

AI总结 本研究提出了一种鲁棒性框架,通过结合模拟和真实数据分析,评估机器学习模型在生物和技术分布偏移下的性能,发现传统i.i.d.评估无法察觉的鲁棒性缺口,并通过引入生物先验特征和不确定性感知预测提升模型的鲁棒性。

Comments 20 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16926 2026-02-20 cs.CE 50%

BEMEval-Doc2Schema: Benchmarking Large Language Models for Structured Data Extraction in Building Energy Modeling

BEMEval-Doc2Schema:用于建筑能耗建模的结构化数据提取的大型语言模型基准测试

Yiyuan Jia, Xiaoqin Fu, Liang Zhang

专题命中 安全评测 :alignment(abstract)

AI总结 BEMEval-Doc2Schema提出了一种用于评估大型语言模型在建筑能耗建模中结构化数据提取性能的基准测试框架,通过引入KVOR指标和跨模型比较,为未来研究提供了基础。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. AI治理与伦理 1 篇

2512.04334 2026-02-20 cs.HC 50%

Human-controllable AI: Meaningful Human Control

可受人类控制的AI:有意义的人类控制

Chengke Liu, Wei Xu

专题命中 AI治理与伦理 :alignment(abstract)

AI总结 本文提出有意义的人类控制(MHC)作为AI发展的重要原则,强调技术设计、治理和人类共同作用的重要性,旨在实现人类中心的AI发展。

Comments 52 pages

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 其他安全 14 篇

2602.17599 2026-02-20 cs.CV cs.MM cs.SD 78%

Art2Mus: Artwork-to-Music Generation via Visual Conditioning and Large-Scale Cross-Modal Alignment

Art2Mus: 通过视觉条件和大规模跨模态对齐进行艺术品到音乐生成

Ivan Rinaldi, Matteo Mendula, Nicola Fanelli, Florence Levé, Matteo Testi, Giovanna Castellano, Gennaro Vessio

机构 * University of Bari Aldo Moro(巴里大学阿尔多·莫罗大学) Catalonia's Telecommunications Technology Centre(加泰罗尼亚电信技术中心) University of Picardie Jules Verne(皮卡第大学朱利·瓦内大学)

专题命中 其他安全 :alignment(title,abstract)

AI总结 ArtToMus通过直接视觉条件生成音乐,无需图像到文本转换,实现艺术品到音乐的跨模态对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17271 2026-02-20 cs.IT cs.AI math.IT 74%

Federated Latent Space Alignment for Multi-user Semantic Communications

联邦潜在空间对齐用于多用户语义通信

Giuseppe Di Poce, Mario Edoardo Pandolfo, Emilio Calvanese Strinati, Paolo Di Lorenzo

机构 * DIAG Department, Sapienza University of Rome(罗马大学DIAG系) Consorzio Nazionale Interuniversitario per le Telecomunicazioni (CNIT)(国家跨大学电信研究会) CEA Leti, University Grenoble Alpes(CEA Leti,格勒诺布尔大学) DIET Department, Sapienza University of Rome(罗马大学DIET系)

专题命中 其他安全 :alignment(title);分类 cs.AI

AI总结 本文提出联邦潜在空间对齐方法,用于多用户语义通信中的潜在空间对齐,通过共享预均衡器和本地均衡器实现任务导向的高效通信。

Journal ref In 2025 IEEE 26th International Workshop on Signal Processing and Artificial Intelligence for Wireless Communications (SPAWC) (pp. 1-5). IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09201 2026-02-20 cs.LG cs.AI cs.CL 67%

Multimodal Prompt Optimization: Why Not Leverage Multiple Modalities for MLLMs

多模态提示优化:为何不利用多种模态为大语言模型服务

Yumin Choi, Dongki Kim, Jinheon Baek, Sung Ju Hwang

机构 * KAIST(韩国科学技术院)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出多模态提示优化问题,提出MPO框架,通过联合优化和贝叶斯策略提升多模态提示效果,验证其在图像、视频等多模态任务中的优越性。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16826 2026-02-20 cs.LG cs.AI 62%

HiVAE: Hierarchical Latent Variables for Scalable Theory of Mind

HiVAE:用于可扩展理论之心的层次潜在变量

Nigel Doering, Rahath Malladi, Arshia Sangwan, David Danks, Tauhidur Rahman

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 HiVAE通过层次化变分架构提升理论之心推理能力,解决现实时空领域中的心理状态推断问题,并提出自监督对齐策略以增强潜在表示的参照性。

Comments Accepted at the Workshop on Theory of Mind for AI (ToM4AI) at the 40th AAAI Conference on Artificial Intelligence (AAAI-26), Singapore, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16755 2026-02-20 q-bio.OT cs.AI cs.CL 62%

PREFER: An Ontology for the PREcision FERmentation Community

PREFER:一个用于精确发酵社区的本体

Txell Amigó, Shawn Zheng Kai Tan, Angel Luu Phanthanourak, Sebastian Schulz, Pasquale D. Colaianni, Dominik M. Maszczyk, Ester Milesi, Ivan Schlembach, Mykhaylo Semenov Petrov, Marta Reventós Montané, Lars K. Nielsen, Jochen Förster, Bernhard Ø. Palsson, Suresh Sudarsan, Alberto Santos

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 PREFER是一个开源本体,旨在为精确发酵社区建立统一标准,促进生物过程数据的互操作性和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17536 2026-02-20 physics.acc-ph cs.AI 57%

Toward a Fully Autonomous, AI-Native Particle Accelerator

迈向完全自主的、原生AI粒子加速器

Chris Tennant

机构 * Jefferson Laboratory(杰弗逊实验室)

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 本文提出通过AI共同设计构建完全自主的粒子加速器,旨在实现自主运行和最大化性能。

Comments 14 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12414 2026-02-20 cs.CL 57%

propella-1: Multi-Property Document Annotation for LLM Data Curation at Scale

propella-1:大规模LLM数据整理中的多属性文档标注

Maximilian Idahl, Benedikt Droste, Björn Plüster, Jan Philipp Harries

机构 * ellamind Leibniz University Hannover(汉诺威莱布尼茨大学)

专题命中 其他安全 :safety(abstract);分类 cs.CL

AI总结 propella-1通过多属性文档标注提升大规模LLM数据整理的效率和质量,揭示预训练数据集在质量、推理深度和内容组成上的显著差异。

Comments Release: https://hf.co/collections/ellamind/propella-1

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13582 2026-02-20 cs.LG cs.AR 57%

ArtNet: Hierarchical Clustering-Based Artificial Netlist Generator for ML and DTCO Application

ArtNet:基于层次聚类的人工网表生成器用于机器学习和设计-技术协同优化应用

Andrew B. Kahng. Seokhyeong Kang, Seonghyeon Park, Dooseok Yoon

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 ArtNet通过生成更接近目标参数的人工数据集,提升ML模型泛化能力并优化DTCO设计空间探索,实现PPA优化和设计能力提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15943 2026-02-20 cs.CV 50%

Boosting Medical Visual Understanding From Multi-Granular Language Learning

通过多粒度语言学习提升医学视觉理解

Zihan Li, Yiqing Wang, Sina Farsiu, Paul Kinahan

机构 * University of Washington(华盛顿大学) Duke University(杜克大学)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出MGLL框架,通过多粒度语言学习提升医学影像的视觉理解能力,改进多标签和跨粒度对齐,提升下游任务性能。

Comments Accepted by ICLR 2026. 40 pages

Journal ref The Fourteenth International Conference on Learning Representations (ICLR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07825 2026-02-20 cs.CV 50%

Point Linguist Model: Segment Any Object via Bridged Large 3D-Language Model

点语言模型:通过桥接大型3D语言模型实现任意对象分割

Zhuoxu Huang, Mingqi Gao, Jungong Han

机构 * Department of Computer Science, Aberystwyth University(计算机科学系,阿伯里斯特维斯大学) School of Computer Science, University of Sheffield(计算机科学学院,谢菲尔德大学) Department of Automation, Tsinghua University(自动化系,清华大学)

专题命中 其他安全 :alignment(abstract)

AI总结 点语言模型通过桥接大型3D语言模型与密集3D点云,解决表示不一致问题,提升3D对象分割的准确性和鲁棒性。

Comments Accepted by IEEE Transactions on Multimedia (TMM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17231 2026-02-20 cs.CV 50%

HiMAP: History-aware Map-occupancy Prediction with Fallback

HiMAP: 基于历史的无跟踪地图占用预测与回退

Yiming Xu, Yi Yang, Hao Cheng, Monika Sester

机构 * Institute of Cartography and Geoinformatics, Leibniz University Hannover(莱比锡大学汉诺威分校制图与地理信息学研究所) Institute of Information Processing, Leibniz University Hannover(莱比锡大学汉诺威分校信息处理研究所) Faculty of Geo-Information Science and Earth Observation, University of Twente(埃因霍温大学地球信息科学与地球观测系)

专题命中 其他安全 :safety(abstract)

AI总结 HiMAP通过无需跟踪的轨迹预测框架,在MOT失败时提供可靠预测,实现无ID的高精度未来轨迹生成。

Comments Accepted in 2026 IEEE International Conference on Robotics and Automation

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17193 2026-02-20 cs.SE 50%

The Case for HTML First Web Development

为HTML优先的网页开发辩护

Juho Vepsäläinen

专题命中 其他安全 :alignment(abstract)

AI总结 本文主张HTML优先的网页开发方法,强调在可能的情况下优先使用HTML,结合超媒体和服务器端逻辑,以提高开发效率和维护性。

Comments 28 pages, 5 figures, 5 tables, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17157 2026-02-20 eess.AS 50%

CC-G2PnP: Streaming Grapheme-to-Phoneme and prosody with Conformer-CTC for unsegmented languages

CC-G2PnP:基于Conformer-CTC的流式图形到语音及语调连接模型

Yuma Shirahata, Ryuichi Yamamoto

专题命中 其他安全 :alignment(abstract)

AI总结 CC-G2PnP通过Conformer-CTC架构实现流式图形到语音及语调预测,适用于无分隔语言,实验显示其在PnP标签预测准确率上优于基线模型。

Comments Accepted by ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16856 2026-02-20 cs.CV 50%

Analytic Score Optimization for Multi Dimension Video Quality Assessment

多维视频质量评估的分析评分优化

Boda Lin, Yongjie Zhu, Wenyu Qin, Meng Wang, Pengfei Wan

机构 * Department of XXX, University of YYY, Location, Country(XXX系,YYY大学,地点,国家) School of ZZZ, Institute of WWW, Location, Country(ZZZ学院,WWW研究所,地点,国家)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出多维视频质量评估数据集UltraVQA,并引入分析评分优化方法,通过理论支持的后训练目标提升质量评分精度,实验显示其在质量预测中表现优异。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏