arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Peking University(北京大学)

2025-12-09 至 2025-12-09 共收录 12
2512.07503 2025-12-09 cs.CV

SJD++: Improved Speculative Jacobi Decoding for Training-free Acceleration of Discrete Auto-regressive Text-to-Image Generation

SJD++: 改进的推测雅可比解码用于无训练加速离散自回归文本到图像生成

Yao Teng, Zhihuan Jiang, Han Shi, Xian Liu, Xuefei Ning, Guohao Dai, Yu Wang, Zhenguo Li, Xihui Liu

机构 * The University of Hong Kong(香港大学) Huawei Noah’s Ark Lab(华为诺亚实验室) Peking University(北京大学) xAI Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 SJD++通过概率并行解码算法提升自回归文本到图像生成的效率,实现2-3倍的推理延迟降低和2-7倍的步骤压缩,同时保持图像质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24452 2025-12-09 cs.LG

Stepsize anything: A unified learning rate schedule for budgeted-iteration training

学习率步长任意性:一种统一的学习率调度方案用于预算迭代训练

Anda Tang, Yiming Dong, Yutao Zeng, zhou Xun, Zhouchen Lin

机构 * State Key Lab of General AI, School of Intelligence Science and Technology, Peking University(人工智能通用基础研究国家重点实验室,智能科学与技术学院,北京大学) ByteDance Seed(字节跳动种子) Institute for Artificial Intelligence, Peking University(人工智能研究院,北京大学) Pazhou Laboratory (Huangpu), Guangzhou, Guangdong, China(琶洲实验室(黄埔),广州,广东,中国)

AI总结 本文提出了一种理论基础的学习率调度方案UBA,通过统一的预算感知框架,优化不同网络和任务下的训练效率,提升了在预算限制下的学习性能。

Journal ref NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04598 2025-12-09 cs.CL cs.AI cs.LG

HybridNorm: Towards Stable and Efficient Transformer Training via Hybrid Normalization

HybridNorm: 一种通过混合归一化实现稳定和高效Transformer训练的方法

Zhijian Zhuo, Yutao Zeng, Ya Wang, Sijun Zhang, Jian Yang, Xiaoqing Li, Xun Zhou, Jinwen Ma

机构 * School of Mathematical Sciences, Peking University(北京大学数学科学学院) Beihang University(北航) Capital University of Economics and Business(首都经济贸易大学)

AI总结 HybridNorm通过结合Pre-Norm和Post-Norm的优势,提升Transformer训练的稳定性与效率。

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06889 2025-12-09 cs.NI cs.RO

AQUILA: A QUIC-Based Link Architecture for Resilient Long-Range UAV Communication

AQUILA:一种基于QUIC的链路架构,用于可靠远距离无人机通信

Ximing Huang, Yirui Rao

机构 * Peking University(北京大学) Nanchang University(南昌大学)

AI总结 AQUILA通过基于QUIC的跨层通信架构,解决无人机远距离通信中的可靠性、带宽和延迟问题,实现低延迟、高可靠性和视频质量的提升。

Comments 13 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06810 2025-12-09 cs.CV cs.CL

MMDuet2: Enhancing Proactive Interaction of Video MLLMs with Multi-Turn Reinforcement Learning

MMDuet2:通过多轮强化学习增强视频MLLMs的主动交互

Yueqian Wang, Songxiang Liu, Disong Wang, Nuo Xu, Guanglu Wan, Huishuai Zhang, Dongyan Zhao

机构 * Wangxuan Institute of Computer Technology, Peking University(王宣计算机技术研究所,北京大学) State Key Laboratory of General Artificial Intelligence(通用人工智能国家重点实验室)

AI总结 MMDuet2通过多轮强化学习方法,实现了视频MLLMs在多轮对话中的主动交互,提升了回复时机和质量,达到ProactiveVideoQA基准的最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06750 2025-12-09 cs.CV

UARE: A Unified Vision-Language Model for Image Quality Assessment, Restoration, and Enhancement

UARE:面向图像质量评估、修复和增强的统一视觉-语言模型

Weiqi Li, Xuanyu Zhang, Bin Chen, Jingfen Xie, Yan Wang, Kexin Zhang, Junlin Li, Li Zhang, Jian Zhang, Shijie Zhao

机构 * School of Electronic and Computer Engineering, Peking University, 2 ByteDance Inc(1 电子与计算机工程学院,北京大学,2 字节跳动公司)

AI总结 UARE是首个统一视觉-语言模型,通过统一训练框架提升图像质量评估、修复和增强性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06424 2025-12-09 cs.CV

DragMesh: Interactive 3D Generation Made Easy

DragMesh: 交互式3D生成变得容易

Tianshan Zhang, Zeyu Zhang, Hao Tang

机构 * School of Computer Science, Peking University(北京大学计算机学院)

AI总结 DragMesh通过解耦运动学推理和运动生成,实现实时交互式3D生成,无需重新训练即可在新对象上生成合理运动。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06018 2025-12-09 cs.CY cs.AI

Uncovering Students' Inquiry Patterns in GenAI-Supported Clinical Practice: An Integration of Epistemic Network Analysis and Sequential Pattern Mining

揭示在生成式人工智能支持下的临床实践中的学生探究模式:一种整合认知网络分析和序列模式挖掘的方法

Jiameng Wei, Dinh Dang, Kaixun Yang, Emily Stokes, Amna Mazeh, Angelina Lim, David Wei Dai, Joel Moore, Yizhou Fan, Danijela Gasevic, Dragan Gasevic, Guanliang Chen

机构 * Monash University(墨尔本大学) University College London(伦敦大学学院) Peking University(北京大学)

AI总结 本研究通过整合认知网络分析和序列模式挖掘,揭示学生在GenAI支持下的临床实践中探究模式,发现高绩效者更注重临床相关信息识别,而低绩效者则停留在常规问题验证循环中。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04686 2025-12-09 cs.CV

Towards Cross-View Point Correspondence in Vision-Language Models

面向视觉-语言模型的跨视图点对应研究

Yipu Wang, Yuheng Ji, Yuyang Liu, Enshen Zhou, Ziqiang Yang, Yuxuan Tian, Ziheng Qin, Yue Liu, Huajie Tan, Cheng Chi, Zhiyuan Ma, Daniel Dajun Zeng, Xiaolong Zheng

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学先进交叉学科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Beihang University(北航大学) Jilin University(吉林大学) National University of Singapore(新加坡国立大学) Peking University(北京大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Huazhong University of Science And Technology(华中科技大学)

AI总结 本文提出跨视图点对应任务和 CrossPoint-Bench 基准,通过 CroPond 模型在 CrossPoint-Bench 上取得超越 Gemini-2.5-Pro 的准确率,推动跨视图对应研究发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04416 2025-12-09 cs.AI cs.SE

DataGovBench: Benchmarking LLM Agents for Real-World Data Governance Workflows

DataGovBench: 为现实世界数据治理工作流程评估LLM代理

Zhou Liu, Zhaoyang Han, Guochen Yan, Hao Liang, Bohan Zeng, Xing Chen, Yuanfeng Song, Wentao Zhang

机构 * Peking University(北京大学) ByteDance(字节跳动)

AI总结 DataGovBench通过150种现实任务评估LLM代理在数据治理中的表现,提出DataGovAgent框架提升复杂任务性能和调试效率。

Comments Equal contribution: Zhou Liu and Zhaoyang Han. Corresponding authors: Yuanfeng Song and Wentao Zhang

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06274 2025-12-09 cs.CR cs.AI

Enhancing LLM Watermark Resilience Against Both Scrubbing and Spoofing Attacks

增强LLM对 scrubbing 和 spoofing 攻击的鲁棒性

Huanming Shen, Baizhou Huang, Xiaojun Wan

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学计算机技术研究院) University of Electronic Science and Technology of China(电子科技大学)

AI总结 本文提出SEEK水印方案,通过等效纹理密钥机制提升LLM对scrubbing和spoofing攻击的鲁棒性,实验显示其在不同数据集上显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22634 2025-12-09 cs.RO cs.SE

LabUtopia: High-Fidelity Simulation and Hierarchical Benchmark for Scientific Embodied Agents

LabUtopia:高保真模拟与分层基准用于科学具身智能体

Rui Li, Zixuan Hu, Wenxi Qu, Jinouwen Zhang, Zhenfei Yin, Sha Zhang, Xuantuo Huang, Hanqing Wang, Tai Wang, Jiangmiao Pang, Wanli Ouyang, Lei Bai, Wangmeng Zuo, Ling-Yu Duan, Dongzhan Zhou, Shixiang Tang

机构 * Shanghai AI Laboratory(上海人工智能实验室) Peking University(北京大学) Oxford(牛津大学) The Chinese University of Hong Kong(香港中文大学) Harbin Institute of Technology(哈尔滨工业大学) University of Science and Technology of China(中国科学技术大学)

AI总结 LabUtopia通过高保真模拟和分层基准推动实验室环境中具身智能的发展。

Comments Accepted by NeurIPS 2025 Dataset and Benchmark Track

详情

展开后加载摘要…

URL PDF HTML 收藏