arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Zhejiang University(浙江大学)

2026-02-06 至 2026-02-06 共收录 9
2602.05633 2026-02-06 cs.CL

CASTLE: A Comprehensive Benchmark for Evaluating Student-Tailored Personalized Safety in Large Language Models

CASTLE:一个评估大语言模型学生定制个性化安全性的综合基准

Rui Jia, Ruiyi Lan, Fengrui Liu, Zhongxiang Dai, Bo Jiang, Jing Shao, Jingyuan Chen, Guandong Xu, Fei Wu, Min Zhang

机构 * East China Normal University(华东师范大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Zhejiang University(浙江大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) The Education University of Hong Kong(香港教育大学)

AI总结 CASTLE基准通过评估学生定制个性化安全性,揭示大语言模型在不同学生属性下的安全缺陷。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05605 2026-02-06 cs.LG cs.AI cs.CV

Shiva-DiT: Residual-Based Differentiable Top-$k$ Selection for Efficient Diffusion Transformers

Shiva-DiT:基于残差的可微Top-k选择用于高效扩散变换器

Jiaji Zhang, Hailiang Zhao, Guoxuan Zhu, Ruichao Sun, Jiaju Wu, Xinkui Zhao, Hanlin Tang, Weiyi Lu, Kan Liu, Tao Lan, Lin Qu, Shuiguang Deng

机构 * AIOS, Alibaba Group(阿里云人工智能实验室,阿里巴巴集团) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Nanyang Technological University(南洋理工大学)

AI总结 Shiva-DiT通过基于残差的可微Top-k选择,在保持端到端可学习性的同时,实现了高效扩散变换器的剪枝,提升了计算效率并减少了硬件开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05429 2026-02-06 cs.AI cs.CV

M$^2$-Miner: Multi-Agent Enhanced MCTS for Mobile GUI Agent Data Mining

M$^2$-Miner: 多智能体增强的MCTS用于移动GUI智能体数据挖掘

Rui Lv, Juncheng Mo, Tianyi Chu, Chen Rao, Hongyi Jing, Jiajie Teng, Jiafu Chen, Shiqi Zhang, Liangzi Ding, Shuo Fang, Huaizhong Lin, Ziqiang Dang, Chenguang Ma, Lei Zhao

机构 * Ant Group(蚂蚁集团) Zhejiang University(浙江大学)

AI总结 M$^2$-Miner通过多智能体增强MCTS方法,实现了低成本、高效率的移动GUI智能体数据挖掘,提升了数据质量和挖掘效果。

Comments Accepted by ICLR 2026. Supplementary material is included at the end of the main paper (16 pages, 15 figures, 2 tables)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23646 2026-02-06 cs.CV

Active Perception Agent for Omnimodal Audio-Video Understanding

多模态音频视频理解的主动感知代理

Keda Tao, Wenjie Du, Bohan Yu, Weiqiang Wang, Jian Liu, Huan Wang

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学)

AI总结 OmniAgent通过动态规划和音频引导感知范式,实现多模态细粒度推理,无需训练即超越现有模型性能。

Comments Website:https://kd-tao.github.io/OmniAgent/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03999 2026-02-06 cs.CL

LH-Deception: Simulating and Understanding LLM Deceptive Behaviors in Long-Horizon Interactions

LH-Deception:模拟和理解长周期交互中大语言模型的欺骗行为

Yang Xu, Xuanming Zhang, Samuel Yeh, Jwala Dhamala, Ousmane Dia, Rahul Gupta, Sharon Li

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Zhejiang University(浙江大学) Amazon AGI(亚马逊人工智能研究院)

AI总结 LH-Deception通过多智能体系统模拟长周期交互中的LLM欺骗行为,揭示欺骗的模型依赖性和对信任的侵蚀,为真实场景下的LLM评估提供基础。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17001 2026-02-06 cs.LG

Should Bias be Eliminated? A General Framework to Use Bias for OOD Generalization

应该消除偏见吗?一种利用偏见进行OOD泛化的通用框架

Yan Li, Yunlong Deng, Zijian Li, Anpeng Wu, Zeyu Tang, Kun Zhang, Guangyi Chen

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫扎德·本·扎耶德人工智能大学) Carnegie Mellon University(卡内基梅隆大学) Zhejiang University(浙江大学)

AI总结 本文提出了一种通用框架,通过利用偏见来提升OOD泛化的性能,通过生成模型识别偏见因素并构建偏见感知预测器,结合不同环境的预测器以提高鲁棒性和适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05251 2026-02-06 cs.LG

TADS: Task-Aware Data Selection for Multi-Task Multimodal Pre-Training

TADS: 任务感知的数据选择用于多任务多模态预训练

Guanjie Cheng, Boyi Li, Lingyu Sun, Mengying Zhu, Yangyang Wu, Xinkui Zhao, Shuiguang Deng

机构 * School of Software Technology, Zhejiang University(浙江大学软件技术学院) School of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)

AI总结 TADS通过整合内在质量、任务相关性和分布多样性,提升多任务多模态预训练的数据效率,实现更高性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04893 2026-02-06 cs.LG cs.AI cs.CR

A Causal Perspective for Enhancing Jailbreak Attack and Defense

从因果视角提升对抗攻击与防御

Licheng Pan, Yunsheng Lu, Jiexi Liu, Jialing Tao, Haozhe Feng, Hui Xue, Zhixuan Chu, Kui Ren

机构 * The State Key Laboratory of Blockchain and Data Security, Zhejiang University(区块链与数据安全国家重点实验室,浙江大学) Alibaba Group(阿里巴巴集团) University of Chicago(芝加哥大学)

AI总结 本文提出Causal Analyst框架,通过因果分析提升大语言模型的对抗攻击与防御能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11007 2026-02-06 cs.CV cs.AI cs.LG

VisMem: Latent Vision Memory Unlocks Potential of Vision-Language Models

VisMem: 通过潜在视觉记忆解锁视觉-语言模型的潜力

Xinlei Yu, Chengming Xu, Guibin Zhang, Zhangquan Chen, Yudong Zhang, Yongbo He, Peng-Tao Jiang, Jiangning Zhang, Xiaobin Hu, Shuicheng Yan

机构 * National University of Singapore(新加坡国立大学) Fudan University(复旦大学) Tsinghua University(清华大学) Zhejiang University(浙江大学) University of Science and Technology of China(中国科学技术大学) vivo

AI总结 VisMem通过引入动态潜在视觉记忆模块,提升视觉-语言模型在复杂视觉任务中的性能,实现感知准确性和语义一致性之间的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏