arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Zhejiang University(浙江大学)

2026-02-09 至 2026-02-09 共收录 7
2602.06959 2026-02-09 cs.CV

CineScene: Implicit 3D as Effective Scene Representation for Cinematic Video Generation

CineScene:隐式3D作为电影视频生成的有效场景表示

Kaiyi Huang, Yukun Huang, Yu Li, Jianhong Bai, Xintao Wang, Zinan Lin, Xuefei Ning, Jiwen Yu, Pengfei Wan, Yu Wang, Xihui Liu

机构 * The University of Hong Kong(香港大学) Kling Team, Kuaishou Technology(快手技术 Kling 团队) Tsinghua University(清华大学) Zhejiang University(浙江大学) Microsoft Research Project Page(微软研究院项目页面)

AI总结 CineScene通过隐式3D场景表示实现电影视频生成,能生成动态主体且保持场景一致的高质量视频。

Comments Project website: https://karine-huang.github.io/CineScene/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03048 2026-02-09 cs.LG cs.AI

CoBA-RL: Capability-Oriented Budget Allocation for Reinforcement Learning in LLMs

CoBA-RL:面向大语言模型强化学习的基于能力的预算分配

Zhiyuan Yao, Yi-Kai Zhang, Yuxin Chen, Yueqing Sun, Zishan Xu, Yu Yang, Tianhao Hu, Qi Gu, Hui Su, Xunliang Cai

机构 * Zhejiang University(浙江大学) Nanjing University(南京大学) National University of Singapore(新加坡国立大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 CoBA-RL通过基于能力的价值函数和堆贪心策略,优化大语言模型强化学习中的预算分配,提升训练效率和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01539 2026-02-09 cs.AI cs.CL cs.LG cs.MA

MAGIC: A Co-Evolving Attacker-Defender Adversarial Game for Robust LLM Safety

MAGIC: 一种共进化攻击者-防御者对抗游戏用于鲁棒大语言模型安全

Xiaoyu Wen, Zhida He, Han Qi, Ziyu Wan, Zhongtian Ma, Ying Wen, Tianhang Zheng, Xingcheng Xu, Chaochao Lu, Qiaosheng Zhang

机构 * Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学)

AI总结 MAGIC通过共进化对抗游戏提升大语言模型的安全性,攻击者与防御者智能体在多轮强化学习中相互演化,有效识别并抵御未知攻击模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16690 2026-02-09 cs.CV

Spectral Compressive Imaging via Chromaticity-Intensity Decomposition

通过色度-强度分解实现光谱压缩成像

Xiaodong Wang, Zijun He, Ping Wang, Lishun Wang, Yanan Hu, Xin Yuan

机构 * Zhejiang University(浙江大学) School of Engineering, Westlake University(西湖大学工程学院) Chengdu Institute of Biology, Chinese Academy of Sciences(中国科学院成都生物研究所)

AI总结 本文提出了一种色度-强度分解框架,通过双相机CASSI系统实现超光谱图像的高效重建,结合混合Transformer和噪声估计模块,提升光谱和色度保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05017 2026-02-09 cs.CL

Scalable Multi-Stage Influence Function for Large Language Models via Eigenvalue-Corrected Kronecker-Factored Parameterization

通过特征值校正的克罗内克因子化参数化实现大规模语言模型的可扩展多阶段影响函数

Yuntai Bao, Xuhong Zhang, Tianyu Du, Xinkui Zhao, Jiang Zong, Hao Peng, Jianwei Yin

机构 * Zhejiang University(浙江大学) Universal Identification Technology (Hangzhou) Co.,Ltd.(universal identification technology (hangzhou) co., ltd.) Zhejiang Normal University(浙江师范大学)

AI总结 本文提出了一种基于特征值校正的克罗内克因子化参数化的多阶段影响函数,用于解释大规模语言模型在微调后的预测归因于预训练数据,展示了其在大规模模型中的可扩展性和解释能力。

Comments 17 pages, 4 figures; accepted by IJCAI 2025

Journal ref Proceedings of the Thirty-Fourth International Joint Conference on Artificial Intelligence Main Track (2025) 8022-8030

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01989 2026-02-09 cs.LG

VFScale: Intrinsic Reasoning through Verifier-Free Test-time Scalable Diffusion Model

VFScale: 通过无验证器的测试时可扩展扩散模型实现内在推理

Tao Zhang, Jia-Shu Pan, Ruiqi Feng, Tailin Wu

机构 * Zhejiang University(浙江大学) Department of Artificial Intelligence, School of Engineering, Westlake University(人工智能系,工程学院,西湖大学)

AI总结 VFScale通过无验证器的测试时可扩展扩散模型实现可扩展的内在推理,解决了扩散模型在复杂推理任务中的两大挑战。

Comments ICLR 2026. 30 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05885 2026-02-09 cs.IR cs.AI

An item is worth one token in Multimodal Large Language Models-based Sequential Recommendation

在基于多模态大语言模型的序列推荐中,一个项目相当于一个标记

Qiyong Zhong, Jiajie Su, Ming Yang, Yunshan Ma, Xiaolin Zheng, Chaochao Chen

机构 * Zhejiang University(浙江大学) Singapore Management University(新加坡国立管理学院)

AI总结 Speeder通过多模态表示压缩、模态感知渐进优化和序列位置感知增强,提升多模态大语言模型在序列推荐中的效率与效果。

详情

展开后加载摘要…

URL PDF HTML 收藏