arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 8057 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 8057 篇

2504.12339 2025-05-29 cs.CL cs.SD eess.AS 57%

GOAT-TTS: Expressive and Realistic Speech Generation via A Dual-Branch LLM

Yaodong Song, Hongjie Chen, Jie Lian, Yuxin Zhang, Guangmin Xia, Zehan Li, Genliang Zhao, Jian Kang, Jie Li, Yongxiang Li, Xuelong Li

机构 * Institute of Artificial Intelligence (TeleAI), China Telecom(人工智能研究院(TeleAI),中国电信)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22241 2025-05-29 cs.AI 57%

Agent-Centric Personalized Multiple Clustering with Multi-Modal LLMs

Ziye Chen, Yiqun Duan, Riheng Zhu, Zhenbang Sun, Mingming Gong

机构 * TikTok, Australia School of Mathematics and Statistics, University of Melbourne(墨尔本大学数学与统计学学院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04395 2025-05-29 cs.CL 57%

Shaping Shared Languages: Human and Large Language Models' Inductive Biases in Emergent Communication

Tom Kouwenhoven, Max Peeperkorn, Roy de Kleijn, Tessa Verhoef

机构 * Leiden Institute of Advanced Computer Science, Leiden University, Netherlands(莱顿高级计算机科学研究所,莱顿大学,荷兰) School of Computing, University of Kent, United Kingdom(计算学院,肯特大学,英国) Cognitive Psychology Unit, Institute of Psychology, Leiden, the Netherlands(认知心理学单元,心理学研究所,莱顿,荷兰)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

Comments Presented at IJCAI 2025 (Human-centred AI Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14191 2025-05-29 cs.AI cs.HC 57%

Addressing and Visualizing Misalignments in Human Task-Solving Trajectories

Sejin Kim, Hosung Lee, Sundong Kim

机构 * GIST(全南国立大学) KAIST(韩国科学技术院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

Comments KDD 2025 accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21378 2025-05-28 cs.CL 57%

Analyzing values about gendered language reform in LLMs' revisions

Jules Watson, Xi Wang, Raymond Liu, Suzanne Stevenson, Barend Beekhuizen

专题命中 其他安全 :alignment(abstract);分类 cs.CL

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21322 2025-05-28 cs.AI 57%

Assured Autonomy with Neuro-Symbolic Perception

R. Spencer Hallyburton, Miroslav Pajic

机构 * Duke University(杜克大学)

专题命中 其他安全 :safety(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20700 2025-05-28 cs.CL 57%

Beyond Templates: Dynamic Adaptation of Reasoning Demonstrations via Feasibility-Aware Exploration

Yong Wu, Weihang Pan, Ke Li, Chen Binhui, Ping Li, Binbin Lin

机构 * College of Software Technology, Zhejiang University(浙江大学软件技术学院) Fullong Technology, Ningbo, Zhejiang, China(宁波 fuller 技术有限公司) Ningbo Zhoushan Port Co., Ltd., Ningbo, Zhejiang, China(宁波舟山港股份有限公司) School of Computer Science and Technology, Hangzhou Dianzi University(杭州电子科技大学计算机科学与技术学院)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19406 2025-05-27 cs.AI 57%

Unveiling the Compositional Ability Gap in Vision-Language Reasoning Model

Tianle Li, Jihai Zhang, Yongming Rao, Yu Cheng

机构 * The Chinese University of Hong Kong(香港中文大学) Tencent Hunyuan Research(腾讯文言研究院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19186 2025-05-27 cs.CV cs.AI 57%

PosePilot: An Edge-AI Solution for Posture Correction in Physical Exercises

Rushiraj Gadhvi, Priyansh Desai, Siddharth

机构 * HTI Lab, Plaksha University(普拉克斯大学HTI实验室)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

Comments Accepted for publication at IBPRIA 2025 Conference in Coimbra, Portugal

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19003 2025-05-27 cs.AI 57%

Aligning LLM with human travel choices: a persona-based embedding learning approach

Tianming Liu, Manzi Li, Yafeng Yin

机构 * Department of Civil and Environmental Engineering, University of Michigan, Ann Arbor, United States(密歇根大学土木与环境工程系)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

Comments 32 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18880 2025-05-27 cs.CV cs.AI 57%

REGen: Multimodal Retrieval-Embedded Generation for Long-to-Short Video Editing

Weihan Xu, Yimeng Ma, Jingyue Huang, Yang Li, Wenye Ma, Taylor Berg-Kirkpatrick, Julian McAuley, Paul Pu Liang, Hao-Wen Dong

机构 * Duke University(杜克大学) University of California, San Diego(加州大学圣迭戈分校) MBZUAI(马克斯·普朗克人工智能研究所) MIT(麻省理工学院) University of Michigan(密歇根大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18695 2025-05-27 cs.AI 57%

AI for Regulatory Affairs: Balancing Accuracy, Interpretability, and Computational Cost in Medical Device Classification

Yu Han, Aaron Ceross, Jeroen H. M. Bergmann

机构 * Institute of Biomedical Engineering, Department of Engineering Science, University of Oxford(生物医学工程研究所,工程科学系,牛津大学) Birmingham Law School, University of Birmingham(伯明翰法学院,伯明翰大学)

专题命中 其他安全 :safety(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19095 2025-05-27 cs.CL 57%

Efficient Reasoning for LLMs through Speculative Chain-of-Thought

Jikai Wang, Juntao Li, Jianye Hou, Bowen Yan, Lijun Wu, Min Zhang

机构 * Soochow University(苏州大学) CUHK(香港中文大学) Meta Stone Shanghai AI Laboratory(上海人工智能实验室)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04405 2025-05-27 cs.IR cs.AI 57%

Universal Item Tokenization for Transferable Generative Recommendation

Bowen Zheng, Hongyu Lu, Yu Chen, Wayne Xin Zhao, Ji-Rong Wen

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.10187 2025-05-27 cs.LG cs.IR 57%

An Interpretable Deep-Learning Framework for Predicting Hospital Readmissions From Electronic Health Records

Fabio Azzalini, Tommaso Dolci, Marco Vagaggini

机构 * Department of Electronics, Information and Bioengineering(电子、信息与生物工程系) Politecnico di Milano(米兰理工大学) Lero – the Science Foundation Ireland Research Centre for Software(爱尔兰科学基金会软件研究中心) University of Limerick(利默ick大学)

专题命中 其他安全 :safety(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18032 2025-05-26 cs.LG cs.CV 57%

Mahalanobis++: Improving OOD Detection via Feature Normalization

Maximilian Mueller, Matthias Hein

专题命中 其他安全 :safety(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17426 2025-05-26 cs.SD cs.AI eess.AS 57%

UniTTS: An end-to-end TTS system without decoupling of acoustic and semantic information

Rui Wang, Qianguo Sun, Tianrong Chen, Zhiyun Zeng, Junlong Wu, Jiaxing Zhang

机构 * International Digital Economy Academy(国际数字经济学院) IDEA&Emdoor Collaborative Laboratory(IDEA与Emdoor协同实验室) Emdoor Information Co., Ltd(Emdoor信息有限公司) Shenzhen Yijiayiban Information Technology Co., Ltd(深圳艺佳iban信息技术有限公司)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.19099 2025-05-26 cs.LG 57%

Elucidating Subspace Perturbation in Zeroth-Order Optimization: Theory and Practice at Scale

Sihwan Park, Jihun Yun, SungYub Kim, Souvik Kundu, Eunho Yang

机构 * KAIST(韩国科学技术院) Intel Labs(英特尔实验室) AITRICS(人工智能与机器学习研究机构)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

Comments 49 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16314 2025-05-23 cs.CV cs.AI 57%

NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment

Shuhao Han, Haotian Fan, Fangyuan Kong, Wenjie Liao, Chunle Guo, Chongyi Li, Radu Timofte, Liang Li, Tao Li, Junhui Cui, Yunqiu Wang, Yang Tai, Jingwei Sun, Jianhui Sun, Xinli Yue, Tianyi Wang, Huan Hou, Junda Lu, Xinyang Huang, Zitang Zhou, Zijian Zhang, Xuhui Zheng, Xuecheng Wu, Chong Peng, Xuezhi Cao, Trong-Hieu Nguyen-Mau, Minh-Hoang Le, Minh-Khoa Le-Phan, Duy-Nam Ly, Hai-Dang Nguyen, Minh-Triet Tran, Yukang Lin, Yan Hong, Chuanbiao Song, Siyuan Li, Jun Lan, Zhichao Zhang, Xinyue Li, Wei Sun, Zicheng Zhang, Yunhao Li, Xiaohong Liu, Guangtao Zhai, Zitong Xu, Huiyu Duan, Jiarui Wang, Guangji Ma, Liu Yang, Lu Liu, Qiang Hu, Xiongkuo Min, Zichuan Wang, Zhenchen Tang, Bo Peng, Jing Dong, Fengbin Guan, Zihao Yu, Yiting Lu, Wei Luo, Xin Li, Minhao Lin, Haofeng Chen, Xuanxuan He, Kele Xu, Qisheng Xu, Zijian Gao, Tianjiao Wan, Bo-Cheng Qiu, Chih-Chung Hsu, Chia-ming Lee, Yu-Fan Lin, Bo Yu, Zehao Wang, Da Mu, Mingxiu Chen, Junkang Fang, Huamei Sun, Wending Zhao, Zhiyu Wang, Wang Liu, Weikang Yu, Puhong Duan, Bin Sun, Xudong Kang, Shutao Li, Shuai He, Lingzhi Fu, Heng Cong, Rongyu Zhang, Jiarong He, Zhishan Qiao, Yongqing Huang, Zewen Chen, Zhe Pang, Juan Wang, Jian Guo, Zhizhuo Shao, Ziyu Feng, Bing Li, Weiming Hu, Hesong Li, Dehua Liu, Zeming Liu, Qingsong Xie, Ruichen Wang, Zhihao Li, Yuqi Liang, Jianqi Bi, Jun Luo, Junfeng Yang, Can Li, Jing Fu, Hongwei Xu, Mingrui Long, Lulin Tang

机构 * NTIRE 2025 challenge on Text to Image Generation Model Quality Assessment(NTIRE 2025挑战)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03948 2025-05-23 cs.SD cs.AI cs.MM cs.NE eess.AS 57%

Long-Form Text-to-Music Generation with Adaptive Prompts: A Case Study in Tabletop Role-Playing Games Soundtracks

Felipe Marra, Lucas N. Ferreira

专题命中 其他安全 :alignment(abstract);分类 cs.AI

Comments Proceedings of the 1st Latin American Music Information Retrieval Workshop (LAMIR), pg 80

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15297 2025-05-22 cs.CL 57%

Chinese Toxic Language Mitigation via Sentiment Polarity Consistent Rewrites

Xintong Wang, Yixiao Liu, Jingheng Pan, Liang Ding, Longyue Wang, Chris Biemann

专题命中 其他安全 :safety(abstract);分类 cs.CL

Comments 14 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14701 2025-05-22 cs.CE cs.LG 57%

Deployment of Traditional and Hybrid Machine Learning for Critical Heat Flux Prediction in the CTF Thermal Hydraulics Code

Aidan Furlong, Xingang Zhao, Robert Salko, Xu Wu

机构 * Department of Nuclear Engineering, North Carolina State University(北卡罗来纳州立大学核工程系) Burlington Engineering Laboratories, 2500 Stinson Dr., Raleigh, NC 27695(伯灵顿工程实验室) Department of Nuclear Engineering, University of Tennessee, Knoxville, Zeanah Engineering Complex, 863 Neyland Dr., Knoxville, TN 37916(田纳西大学核工程系) Nuclear Energy and Fuel Cycle Division, Oak Ridge National Laboratory, 1 Bethel Valley Rd., Oak Ridge, TN, USA 37830(橡树岭国家实验室核能与燃料循环 division)

专题命中 其他安全 :safety(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14407 2025-05-21 cs.LG 57%

Explaining Unreliable Perception in Automated Driving: A Fuzzy-based Monitoring Approach

Aniket Salvi, Gereon Weiss, Mario Trapp

机构 * Engineering Resilient Cognitive Systems Technical University of Munich(技术大学慕尼黑) Automation Systems Fraunhofer Institute for Cognitive Systems IKS Munich, Germany(慕尼黑弗劳恩霍夫认知系统研究所)

专题命中 其他安全 :safety(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14356 2025-05-21 cs.SD cs.CL eess.AS 57%

PersonaTAB: Predicting Personality Traits using Textual, Acoustic, and Behavioral Cues in Fully-Duplex Speech Dialogs

Sho Inoue, Shai Wang, Haizhou Li

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Nanjing University, Suzhou(南京大学(苏州)) National University of Singapore(新加坡国立大学) School of Data Science(数据科学学院) School of Intelligence Science and Technology(智能科学与技术学院) Department of ECE(电子与计算机工程系)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

Comments This is accepted to Interspeech 2025; Added an extra page for supplementary figures; Project page: https://github.com/shinshoji01/Personality-Prediction-for-Conversation-Agents

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22577 2025-05-21 cs.CV cs.AI 57%

Breaking Language Barriers in Visual Language Models via Multilingual Textual Regularization

Iñigo Pikabea, Iñaki Lacunza, Oriol Pareras, Carlos Escolano, Aitor Gonzalez-Agirre, Javier Hernando, Marta Villegas

机构 * Barcelona Supercomputing Center(巴塞罗那超级计算中心) Universitat Politècnica de Catalunya(加泰罗尼亚理工大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

Comments v2: Expanded model merging experiments. Fix duplicated subsection on limitations

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13526 2025-05-21 cs.IR cs.AI 57%

Geography-Aware Large Language Models for Next POI Recommendation

Zhao Liu, Wei Liu, Huajie Zhu, Jianxing Yu, Jian Yin, Wang-Chien Lee, Shun Wang

机构 * Sun Yat-sen University(中山大学) The Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

Comments 9 pages, 7figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13520 2025-05-21 cs.IR cs.AI 57%

Beyond Retrieval: Joint Supervision and Multimodal Document Ranking for Textbook Question Answering

Hessa Alawwad, Usman Naseem, Areej Alhothali, Ali Alkhathlan, Amani Jamal

机构 * Faculty of Computing and Information Technology, King Abdulaziz University(计算机与信息科技学院,国王阿卜杜勒阿齐兹大学) College of Computer and Information Science, Imam Mohammad Ibn Saud Islamic University (IMSIU)(计算机与信息科学学院,伊玛目穆罕默德·本·萨乌德伊斯兰大学) School of Computing, Macquarie University(计算学院,麦考瑞大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

Comments 14 pages, 16 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13507 2025-05-21 cs.LG cs.CV 57%

Open Set Domain Adaptation with Vision-language models via Gradient-aware Separation

Haoyang Chen

专题命中 其他安全 :alignment(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14171 2025-05-21 cs.CL 57%

Enhancing Conversational Agents with Theory of Mind: Aligning Beliefs, Desires, and Intentions for Human-Like Interaction

Mehdi Jafari, Devin Yuncheng Hua, Hao Xue, Flora Salim

机构 * UNSW Sydney(新南威尔士大学悉尼分校)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

Comments Accepted to Findings of ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13079 2025-05-20 eess.AS cs.AI 57%

Cross-modal Knowledge Transfer Learning as Graph Matching Based on Optimal Transport for ASR

Xugang Lu, Peng Shen, Yu Tsao, Hisashi Kawai

专题命中 其他安全 :alignment(abstract);分类 cs.AI

Comments To appear in Interspeech 2025

详情

展开后加载摘要…

URL PDF HTML 收藏