arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Chinese Academy of Sciences(中国科学院大学)

2026-02-02 至 2026-02-02 共收录 11
2601.18292 2026-02-02 cs.LG cs.AI

TriPlay-RL: Tri-Role Self-Play Reinforcement Learning for LLM Safety Alignment

TriPlay-RL:三角色自我对抗强化学习用于大语言模型安全对齐

Zhewen Tan, Wenhan Yu, Jianfeng Si, Tongxin Liu, Kaiqi Guan, Huiyan Jin, Jiawen Tao, Xiaokun Yuan, Duohe Ma, Xiangzheng Zhang, Tong Yang, Lin Sun

机构 * Peking University(北京大学) Qiyuan Tech(启元科技) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 TriPlay-RL通过三角色自我对抗强化学习,实现LLM安全对齐的高效且可扩展范式,提升攻击有效性、安全性能和评估准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25801 2026-02-02 cs.LG cs.AI cs.CL cs.CV

Metis-SPECS: Decoupling Multimodal Learning via Self-distilled Preference-based Cold Start

Metis-SPECS: 通过基于偏好自我蒸馏的冷启动解耦多模态学习

Kun Chen, Peng Shi, Haibo Qiu, Zhixiong Zeng, Siqi Yang, Wenji Mao, Lin Ma

机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所MAIS) Meituan(美团)

AI总结 Metis-SPECS通过基于偏好的自我蒸馏冷启动框架解耦多模态学习,提升泛化能力和下游RL表现。

Comments Published as a conference paper at ICLR 2026!

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13926 2026-02-02 cs.CL

BioMedSearch: A Multi-Source Biomedical Retrieval Framework Based on LLMs

BioMedSearch: 基于LLMs的多源生物医学检索框架

Congying Liu, Xingyuan Wei, Peipei Liu, Yiqing Shen, Yanxu Mao, Tiehan Cui

机构 * University of Chinese Academy of Sciences(中国科学院大学) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) Johns Hopkins University(约翰霍普金斯大学) Henan University(河南大学)

AI总结 BioMedSearch基于LLMs构建多源生物医学检索框架,通过整合文献、蛋白质数据库和网络搜索,提升复杂生物医学问题的准确回答能力。

Journal ref Proceedings of the IEEE International Conference on Bioinformatics and Biomedicine (BIBM), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12260 2026-02-02 cs.IR cs.AI cs.CL

LightRetriever: A LLM-based Text Retrieval Architecture with Extremely Faster Query Inference

LightRetriever: 一种基于大语言模型的文本检索架构,具有极快的查询推理速度

Guangyuan Ma, Yongliang Ma, Xuanrui Gou, Zhenpeng Su, Ming Zhou, Songlin Hu

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院) Langboat Technology(兰舟科技)

AI总结 LightRetriever通过轻量级查询编码器显著提升检索效率,实现查询推理速度提升超1000倍,端到端吞吐量提升超10倍,且在多种任务中保持95%的检索性能。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22657 2026-02-02 cs.CL cs.AI

NAG: A Unified Native Architecture for Encoder-free Text-Graph Modeling in Language Models

NAG:一种用于语言模型中无编码文本图建模的统一原生架构

Haisong Gong, Zhibo Liu, Qiang Liu, Shu Wu, Liang Wang

机构 * New Laboratory of Pattern Recognition (NLPR), Institute of Automation, Chinese Academy of Sciences, Beijing, China School of Artificial Intelligence, University of Chinese Academy of Sciences (UCAS), Beijing, China School of Advanced Interdisciplinary Sciences, UCAS, Beijing, China

AI总结 NAG提出一种统一的原生架构,将图处理内化于语言模型,通过自注意力机制和位置ID校准实现结构依赖和等价性,提升文本图建模的连贯性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22630 2026-02-02 cs.CV

LINA: Linear Autoregressive Image Generative Models with Continuous Tokens

LINA: 基于连续令牌的线性自回归图像生成模型

Jiahao Wang, Ting Pan, Haoge Deng, Dongchen Han, Taiqiang Wu, Xinlong Wang, Ping Luo

机构 * The University of Hong Kong(香港大学) University of Chinese Academy of Sciences(中国科学院大学) Tsinghua University(清华大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

AI总结 LINA是一种基于线性注意力的高效文本到图像生成模型,通过改进归一化和门控机制,在计算效率和生成质量上取得平衡。

Comments 20 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22521 2026-02-02 cs.CL

One Ring to Rule Them All: Unifying Group-Based RL via Dynamic Power-Mean Geometry

一个环以统治它们全部:通过动态幂-均几何统一基于组的强化学习

Weisong Zhao, Tong Wang, Zichang Tan, Te Yang, Siran Peng, Haoyuan Zhang, Tianshuo Zhang, Haichao Shi, Meng Meng, Yang Yang, Xiangyu Zhu, Zhen Lei, Xiao-Yu Zhang, Xu Zhou

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院) Sangfor Technologies(Sangfor技术有限公司) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) CAIR, Hong Kong Institute of Science and Innovation, Chinese Academy of Sciences(中国科学院香港科学与创新研究院)

AI总结 PMPO通过动态调整幂-均几何指数统一基于组的强化学习方法,提升轨迹稳定性与效率。

Comments 17 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22468 2026-02-02 cs.CV cs.AI

Training-Free Representation Guidance for Diffusion Models with a Representation Alignment Projector

无需训练的表示引导用于扩散模型的表示对齐投影器

Wenqiang Zu, Shenghao Xie, Bo Lei, Lei Ma

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Peking University(北京大学) University of Chinese Academy of Sciences(中国科学院大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

AI总结 本文提出无需训练的表示引导方法,通过引入表示对齐投影器提升扩散模型的语义对齐与图像一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15522 2026-02-02 cs.CL

LLM Latent Reasoning as Chain of Superposition

LLM潜在推理作为叠加链

Jingcheng Deng, Liang Pang, Zihao Wei, Shicheng Xu, Zenghao Duan, Kun Xu, Yang Song, Huawei Shen, Xueqi Cheng

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences, Beijing, China(人工智能安全国家重点实验室,计算技术研究所,中国科学院,北京) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学,北京)

AI总结 本文提出Latent-SFT框架,通过约束隐藏状态、构建语义紧凑的链结构以及使用随机Gumbel-Softmax优化,实现LLM潜在推理的高效叠加,提升数学基准任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03370 2026-02-02 q-bio.QM cs.AI cs.CE

InstructPLM-mu: 1-Hour Fine-Tuning of ESM2 Beats ESM3 in Protein Mutation Predictions

InstructPLM-mu:在1小时内微调ESM2在蛋白质突变预测中优于ESM3

Junde Xu, Yapin Shi, Lijun Lang, Taoyong Cui, Zhiming Zhang, Guangyong Chen, Jiezhong Qiu, Pheng-Ann Heng

机构 * The Chinese University of Hong Kong(香港中文大学) Hangzhou Institute of Medicine, CAS(杭州医学研究所,中国科学院) Hangzhou Institute for Advanced Study, UCAS(杭州先进研究 institute,中国科学院大学) University of Chinese Academy of Sciences(中国科学院大学) Tianjin University(天津大学)

AI总结 InstructPLM-mu通过1小时微调ESM2在蛋白质突变预测中超越ESM3,揭示了结构输入对模型性能的关键影响。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09190 2026-02-02 cs.LG cs.AI

Multi-Level Safety Continual Projection for Fine-Tuned Large Language Models without Retraining

多级安全连续投影:无需重新训练的微调大语言模型安全增强方法

Bing Han, Feifei Zhao, Dongcheng Zhao, Guobin Shen, Ping Wu, Yu Shi, Yi Zeng

机构 * Beijing Key Laboratory of Safe AI and Superalignment(北京安全人工智能与超对齐重点实验室) Beijing Institute of AI Safety and Governance(北京人工智能安全与治理研究院) Brain-inspired Cognitive AI Lab, Institute of Automation, Chinese Academy of Sciences(脑启发认知人工智能实验室,中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) Long-term AI(长期人工智能)

AI总结 本文提出一种无需重新训练的微调后安全增强方法MSCP,通过多级表示对齐和安全方向投影,有效抑制有害输出并提升与人类偏好的对齐度。

详情

展开后加载摘要…

URL PDF HTML 收藏