arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2025-12-22 至 2025-12-22 共收录 7 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 7 篇

2410.18686 2025-12-22 cs.LG 79%

Hierarchical Multimodal LLMs with Semantic Space Alignment for Enhanced Time Series Classification

具有语义空间对齐的层次多模态大语言模型用于增强的时间序列分类

Xiaoyu Tao, Tingyue Pan, Mingyue Cheng, Yucong Luo, Qi Liu, Enhong Chen

机构 * State Key Laboratory of Cognitive Intelligence, University of Science and Technology of China(认知智能国家重点实验室,中国科学技术大学)

专题命中 其他安全 :alignment(title,abstract);分类 cs.LG

AI总结 HiTime通过层次多模态大语言模型和语义空间对齐,提升时间序列分类的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17154 2025-12-22 cs.SD 78%

InstructDubber: Instruction-based Alignment for Zero-shot Movie Dubbing

InstructDubber:基于指令的零样本电影配音对齐

Zhedong Zhang, Liang Li, Gaoxiang Cong, Chunshan Liu, Yuhan Gao, Xiaowan Wang, Tao Gu, Yuankai Qi

机构 * VIPL group, ICT, CAS(中国科学院信息科技研究所VIPL小组)

专题命中 其他安全 :alignment(title,abstract)

AI总结 InstructDubber通过指令生成和持续时间蒸馏模块,实现鲁棒的领域内和零样本电影配音对齐。

Comments Accepted by AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17117 2025-12-22 cs.HC 78%

Alignment, Exploration, and Novelty in Human-AI Interaction

对齐、探索与新颖性在人机交互中的体现

Halfdan Nordahl Fundal, Johannes Eide Rambøll, Karsten Olsen

专题命中 其他安全 :alignment(title,abstract)

AI总结 本研究探讨了人类与AI在协作叙事中的情感对齐、语义探索和创新贡献,发现人类输入在塑造叙事方向和创造性分歧中起关键作用。

Comments 28 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17027 2025-12-22 cs.IR cs.AI 57%

Unexpected Knowledge: Auditing Wikipedia and Grokipedia Search Recommendations

意外知识:审计维基百科和Grokipedia的搜索推荐

Erica Coppolillo, Simone Mungari

机构 * University of Calabria, ICAR-CNR(卡塔尼亚大学,ICAR-CNR) University of Southern California(南加州大学) University of Calabria, ICAR-CNR, Revelis s.r.l.(卡塔尼亚大学,ICAR-CNR,Revelis s.r.l.)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 研究通过比较维基百科和Grokipedia的搜索推荐,发现两者均存在意外结果,但主题分布和推荐差异显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14121 2025-12-22 cs.CV cs.AI 57%

SportsGPT: An LLM-driven Framework for Interpretable Sports Motion Assessment and Training Guidance

SportsGPT: 一种基于大语言模型的可解释性体育动作评估与训练指导框架

Wenbo Tian, Ruting Lin, Hongxian Zheng, Yaodong Yang, Geng Wu, Zihao Zhang, Zhang Zhang

机构 * School of Artificial Intelligence, UCAS, Beijing, China(人工智能学院) MAIS, NLPR, Institute of Automation, CAS, Beijing, China(自动化研究所) College of Education, Beijing Sport University, Beijing, China(北京体育大学) KuTi Sports Technology, Shaanxi, China(KuTi体育科技) Haoxiong Technology, Shanghai, China(浩鸿科技)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 SportsGPT通过结合大语言模型和运动分析技术,实现可解释的体育动作评估与专业训练指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17224 2025-12-22 cs.CV 50%

Any-Optical-Model: A Universal Foundation Model for Optical Remote Sensing

Any-Optical-Model: 一种通用的光学遥感基础模型

Xuyang Li, Chenyu Li, Danfeng Hong

专题命中 其他安全 :alignment(abstract)

AI总结 Any-Optical-Model提出了一种通用的光学遥感基础模型,能够适应任意波段配置、传感器类型和分辨率尺度,通过多尺度自适应补丁嵌入和语义对齐机制实现光谱-空间关系建模,有效提升遥感任务的泛化能力和实际应用性能。

Comments Accepted by AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17164 2025-12-22 cs.IR 50%

TCDE: Topic-Centric Dual Expansion of Queries and Documents with Large Language Models for Information Retrieval

基于大语言模型的查询与文档主题聚焦双扩展方法用于信息检索

Yu Yang, Feng Tian, Ping Chen

专题命中 其他安全 :alignment(abstract)

AI总结 TCDE通过大语言模型实现查询与文档的主题聚焦双扩展,提升信息检索的语义对齐效果。

详情

展开后加载摘要…

URL PDF HTML 收藏