arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2025-12-02 至 2025-12-02 共收录 79 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 19 篇

2512.00120 2025-12-02 cs.SD cs.AI cs.CV cs.LG cs.MM 81%

Art2Music: Generating Music for Art Images with Multi-modal Feeling Alignment

Art2Music: 通过多模态情感对齐生成艺术图像的音乐

Jiaying Hong, Ting Zhu, Thanet Markchom, Huizhi Liang

机构 * School of Computing Newcastle University(计算学院新castle大学) Department of Computer Science University of Reading(计算机科学系阅读大学)

专题命中 其他安全 :alignment(title,abstract);分类 cs.AI、cs.LG

AI总结 Art2Music通过多模态情感对齐生成艺术图像的音乐,利用轻量级跨模态框架提升音乐生成的感知自然性和频谱保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00641 2025-12-02 cs.CV cs.AI 79%

Graph-Attention Network with Adversarial Domain Alignment for Robust Cross-Domain Facial Expression Recognition

具有对抗域对齐的图注意力网络用于鲁棒跨域面部表情识别

Razieh Ghaedi, AmirReza BabaAhmadi, Reyer Zwiggelaar, Xinqi Fan, Nashid Alam

机构 * Manchester Metropolitan University(曼彻斯特 Metropolitan 大学) University of Tehran(泰姬大学) Aberystwyth University(阿伯里斯特维斯大学)

专题命中 其他安全 :alignment(title,abstract);分类 cs.AI

AI总结 GAT-ADA通过结合图注意力网络与对抗域对齐技术,提升跨域面部表情识别的鲁棒性,实现98.0%的准确率。

Comments 17 pages, 5 figures. Accepted at the 17th Asian Conference on Machine Learning (ACML 2025), Taipei, Taiwan, December 9-12, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01352 2025-12-02 cs.CV 67%

OpenBox: Annotate Any Bounding Boxes in 3D

OpenBox: 任意3D边界框的标注

In-Jae Lee, Mungyeom Kim, Kwonyoung Ryu, Pierre Musacchio, Jaesik Park

机构 * Seoul National University(首尔国立大学) POSTECH

专题命中 其他安全 :alignment(abstract);safety(abstract)

AI总结 OpenBox通过2D视觉基础模型实现无需自我训练的高质量3D边界框标注,提升自动驾驶中物体检测的准确性和效率。

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01081 2025-12-02 cs.AI cs.CL cs.LG cs.MA cs.NE q-bio.NC 67%

Testing the Machine Consciousness Hypothesis

检验机器意识假说

Stephen Fitz

机构 * California Institute for Machine Consciousness(加利福尼亚机器意识研究所)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出通过研究分布式系统中集体智能的对齐机制,探讨机器意识的产生源于交流而非建模。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17354 2025-12-02 cs.AI cs.LG 62%

Multi-Scenario Highway Lane-Change Intention Prediction: A Physics-Informed AI Framework for Three-Class Classification

多场景高速公路变道意图预测:一种融合物理的AI框架用于三类分类

Jiazhao Shi, Yichen Lin, Yiheng Hua, Ziyu Wang, Zijian Zhang, Wenjia Zheng, Yun Song, Kuan Lu, Shoufeng Lu

专题命中 其他安全 :safety(abstract);分类 cs.AI、cs.LG

AI总结 本文提出融合物理的AI框架,通过整合车辆动力学和交通安全指标,实现高速公路变道意图的三类分类预测,提升自动驾驶系统的安全性和决策能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00293 2025-12-02 cs.LG cs.AI 62%

FiCoTS: Fine-to-Coarse LLM-Enhanced Hierarchical Cross-Modality Interaction for Time Series Forecasting

FiCoTS: 细到粗的LLM增强层次跨模态交互用于时间序列预测

Yafei Lyu, Hao Zhou, Lu Zhang, Xu Yang, Zhiyong Liu

机构 * School of Advanced Interdisciplinary Sciences, University of Chinese Academy Sciences(中国科学院大学先进交叉学科学院) MAIS, Institute of Automation, Chinese Academy of Science(中国科学院自动化研究所MAIS) Great Bay University(大亚大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 FiCoTS通过细到粗的LLM增强层次跨模态交互框架,提升多模态时间序列预测的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00047 2025-12-02 cs.CL cs.AI 62%

Emergent Convergence in Multi-Agent LLM Annotation

多智能体大语言模型注释中的涌现收敛

Angelina Parfenova, Alexander Denzler, Juergen Pfeffer

机构 * Lucerne University of Applied Sciences and Arts(卢塞恩应用科学与艺术大学) Technical University of Munich(慕尼黑技术大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本研究通过模拟多智能体协作任务,揭示了大语言模型在无显式角色提示下涌现的协调策略,展示了词汇和语义上的收敛及不对称影响模式。

Journal ref EMNLP2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19405 2025-12-02 cs.LG 57%

Learning Robust Social Strategies with Large Language Models

利用大语言模型学习稳健的社会策略

Dereck Piche, Mohammed Muqeeth, Milad Aghajohari, Juan Duque, Michael Noukhovitch, Aaron Courville

机构 * Mila University of Montreal(蒙特利尔大学)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 本研究通过改进的对手学习算法,使大语言模型在多智能体协作中更稳健,提升集体收益并防止被贪婪智能体利用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00670 2025-12-02 cs.AI 57%

EDIT: Early Diffusion Inference Termination for dLLMs Based on Dynamics of Training Gradients

EDIT:基于训练梯度动态的早期扩散推理终止用于dLLMs

He-Yen Hsieh, Hong Wang, H. T. Kung

机构 * CISPA Harvard University(哈佛大学) Intel Corporation(英特尔公司)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 EDIT通过利用训练梯度动态,在保持准确性的同时减少dLLM推理步骤,提升效率。

Comments 22 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00389 2025-12-02 cs.LG cs.GT stat.ML 57%

Solving Neural Min-Max Games: The Role of Architecture, Initialization & Dynamics

解决神经最小-最大游戏:架构、初始化与动态的作用

Deep Patel, Emmanouil-Vasileios Vlatakis-Gkaragkounis

机构 * Department of Computer Science University of Wisconsin-Madison(计算机科学系 威斯康星大学麦迪逊分校)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 本文提出了一种理论框架,通过隐藏的凸性和过参数化解释神经最小-最大游戏中的全局收敛性,并首次为两层神经网络游戏提供了保证。

Comments Camera-ready for NeurIPS 2025 (including updated section on neural network initialization for experiments in Appendix C)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19217 2025-12-02 cs.CV cs.AI 57%

A Lightweight and Extensible Cell Segmentation and Classification Model for Whole Slide Images

一种轻量且可扩展的整张滑片图像细胞分割与分类模型

Nikita Shvetsov, Thomas K. Kilvaer, Masoud Tafavvoghi, Anders Sildnes, Kajsa Møllersen, Lill-Tove Rasmussen Busund, Lars Ailo Bongo

机构 * Department of Computer Science, UiT The Arctic University of Norway(计算机科学系,UiT北极大学) Department of Oncology, University Hospital of North Norway(肿瘤学系,北挪威大学医院) Department of Clinical Medicine, UiT The Arctic University of Norway(临床医学系,UiT北极大学) Department of Community Medicine, UiT The Arctic University of Norway(社区医学系,UiT北极大学) Department of Medical Biology, UiT The Arctic University of Norway(医学生物学系,UiT北极大学) Department of Clinical Pathology, University Hospital of North Norway(临床病理学系,北挪威大学医院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文提出了一种轻量且可扩展的细胞分割与分类模型,通过改进数据标注、利用H-Optimus基础模型和知识蒸馏,提升分割和分类性能,同时降低计算复杂度。

Comments 30 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00267 2025-12-02 cs.AI 57%

Trification: A Comprehensive Tree-based Strategy Planner and Structural Verification for Fact-Checking

Trification: 一种基于树的综合策略规划与结构验证事实核查系统

Anab Maulana Barik, Shou Ziyi, Yang Kaiwen, Yang Qi, Shen Xin

机构 * Huawei Celia Team(华为Celia团队)

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 Trification提出了一种基于树的综合策略规划与结构验证的事实核查框架,通过生成依赖图并动态调整验证策略,提高了事实核查的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00059 2025-12-02 cs.AR cs.LG 57%

SafeCiM: Investigating Resilience of Hybrid Floating-Point Compute-in-Memory Deep Learning Accelerators

SafeCiM: 探究混合浮点计算内存深度学习加速器的鲁棒性

Swastik Bhattacharya, Sanjay Das, Anand Menon, Shamik Kundu, Arnab Raha, Kanad Basu

机构 * Department of Electrical and Computer Engineering, University of Texas at Dallas(得克萨斯大学达拉斯分校电气与计算机工程系) Advanced Architecture Research Group at Intel Corporation(英特尔公司先进架构研究组) Department of Electrical, Computer and Systems Engineering, Rensselaer Polytechnic Institute(拉特格斯理工学院电气、计算机与系统工程系)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 SafeCiM通过引入位翻转故障分析,提升了混合浮点计算内存加速器在硬件故障下的鲁棒性,显著降低了LLM推理准确性下降的风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01950 2025-12-02 cond-mat.soft physics.bio-ph 50%

Order and shape dependence of mechanical relaxation in proliferating active matter

增殖活性物质中机械弛豫的有序性和形状依赖性

Jonas Isensee, Lukas Hupe, Philip Bittihn

专题命中 其他安全 :alignment(abstract)

AI总结 研究揭示了增殖活性物质中机械弛豫的有序性和形状依赖性,通过分析粒子形状对生长和对齐机制的影响,发现椭圆生长可逆转经典对齐并改变微域动态。

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01698 2025-12-02 cs.CE cs.NE math.OC 50%

Integrating Artificial Intelligence and Mixed Integer Linear Programming: Explainable Graph-Based Instance Space Analysis in Air Transportation

将人工智能与混合整数线性规划相结合:航空运输中的可解释图基实例空间分析

Artur Guerra Rosa, Felipe Tavares Loureiro, Marcus Vinicius Santos da Silva, Andréia Elizabeth Silva Barros, Silvia Araújo dos Reis, Victor Rafael Rezende Celestino

专题命中 其他安全 :safety(abstract)

AI总结 本文通过GCN和GAT模型分析航空运输中的MILP实例,发现GCN能有效捕捉实例拓扑结构,提升求解器性能。

Comments 25 pages, 6 figures, presented at XXII SITRAER 2025, in processes for submission to JATM

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01453 2025-12-02 q-bio.OT 50%

Reinventing Clinical Dialogue: Agentic Paradigms for LLM Enabled Healthcare Communication

重新定义临床对话:面向LLM赋能医疗沟通的代理范式

Xiaoquan Zhi, Hongke Zhao, Likang Wu, Chuang Zhao, Hengshu Zhu

专题命中 其他安全 :safety(abstract)

AI总结 本文提出一种新的分类法,通过知识源和代理目标的正交轴分析,揭示医疗AI从生成文本预测转向代理自主性的认知架构,并探讨四种范式在创造力与可靠性间的权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08512 2025-12-02 cs.CV cs.RO 50%

Have We Scene It All? Scene Graph-Aware Deep Point Cloud Compression

我们是否已经看到了一切?基于场景图的深度点云压缩

Nikolaos Stathoulopoulos, Christoforos Kanellakis, George Nikolakopoulos

机构 * Robotics and AI Group, Department of Computer, Electrical and Space Engineering, Luleå University of Technology(机器人与人工智能组,计算机、电子与航天工程系,卢勒阿大学技术学院)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出基于场景图的深度点云压缩框架,通过语义感知编码和结构化解码实现高效压缩,保留结构和语义信息,并支持多机器人系统中的下游应用。

Comments Please cite published version. 8 pages, 6 figures

Journal ref IEEE Robotics and Automation Letters, vol. 10, no. 12, pp. 12477-12484, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00292 2025-12-02 cond-mat.mtrl-sci cond-mat.dis-nn 50%

Interpretable Graph Neural Networks for Classifying Structure and Magnetism in Delafossite Compounds

可解释的图神经网络用于分类_delafossite_化合物的结构和磁性

Jovin Ryan Joseph, Do Hoon Kiem, Sinchul Yeom, Mina Yoon

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出了一种可解释的图神经网络,用于分类_delafossite_化合物的结构和磁性,通过堆叠序列和磁性状态预测,并揭示了驱动磁性行为的物理机制。

Comments 6 main figures, 9 SI figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00033 2025-12-02 cs.RO 50%

Intelligent Systems and Robotics: Revolutionizing Engineering Industries

智能系统与机器人:革新工程行业

Sathish Krishna Anumula, Sivaramkumar Ponnarangan, Faizal Nujumudeen, Ms. Nilakshi Deka, S. Balamuralitharan, M Venkatesh

专题命中 其他安全 :safety(abstract)

AI总结 本文探讨了智能系统与机器人技术如何提升工程行业的效率、精度和适应性,并分析了其对生产率、安全性和成本的影响。

Comments 9 Pages, 4 figures

Journal ref https://ijisae.org/index.php/IJISAE/article/view/7573/6591 ; 2025

详情

展开后加载摘要…

URL PDF HTML 收藏