arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Peking University(北京大学)

2026-02-04 至 2026-02-04 共收录 11
2602.03690 2026-02-04 cs.LG cs.AI

LLM-Inspired Pretrain-Then-Finetune for Small-Data, Large-Scale Optimization

受大语言模型启发的小数据、大规模优化的预训练-微调方法

Zishi Zhang, Jinhui Han, Ming Hu, Yijie Peng

机构 * Guanghua School of Management, Peking University(北京大学光华管理学院) Rotman School of Management, University of Toronto(多伦多大学罗特曼管理学院)

AI总结 本文提出一种受大语言模型启发的预训练-微调方法,用于解决小数据下的大规模决策优化问题,通过预训练注入领域知识并利用合成数据,微调提升与真实数据的一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03529 2026-02-04 cs.NI cs.AI cs.MM

Morphe: High-Fidelity Generative Video Streaming with Vision Foundation Model

Morphe: 基于视觉基础模型的高保真生成视频流媒体

Tianyi Gong, Zijian Cao, Zixing Zhang, Jiangkai Wu, Xinggong Zhang, Shuguang Cui, Fangxin Wang

机构 * School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen(科学与工程学院,香港中文大学(深圳)) Shenzhen Future Network of Intelligence Institute(深圳未来网络智能研究院) Wangxuan Institute of Computer Technology, Peking University(王轩计算机技术研究所,北京大学)

AI总结 Morphe基于视觉基础模型,通过联合训练和智能分组丢弃技术,实现高保真度、低带宽的实时视频流媒体传输。

Comments Accepted by NSDI 2026 Fall

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20272 2026-02-04 cs.CV

Ground-R1: Incentivizing Grounded Visual Reasoning via Reinforcement Learning

Ground-R1: 通过强化学习激励基于地面的视觉推理

Meng Cao, Haoze Zhao, Can Zhang, Xiaojun Chang, Ian Reid, Xiaodan Liang

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫扎德·本·扎耶德人工智能大学) Peking University(北京大学) University of Science and Technology of China(中国科学技术大学) Sun Yat-sen University(中山大学)

AI总结 Ground-R1 通过 Scale Relative Policy Optimization 方法,解决 LVLM 在视觉证据 grounding 方面的偏差问题,提升推理准确性和证据 grounding 能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03510 2026-02-04 cs.CV

Semantic Routing: Exploring Multi-Layer LLM Feature Weighting for Diffusion Transformers

语义路由:探索多层LLM特征加权用于扩散变换器

Bozhou Li, Yushuo Guan, Haolin Li, Bohan Zeng, Yiyan Ji, Yue Ding, Pengfei Wan, Kun Gai, Yuanxing Zhang, Wentao Zhang

机构 * Peking University(北京大学) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Nanjing University(南京大学) Fudan University(复旦大学)

AI总结 本文提出深度-wise语义路由方法,通过多层LLM特征加权提升文本到图像生成的准确性与稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03496 2026-02-04 cs.LG

Lookahead Path Likelihood Optimization for Diffusion LLMs

前瞻路径似然优化用于扩散大语言模型

Xuejie Liu, Yap Vit Chun, Yitao Liang, Anji Liu

机构 * Institute for Artificial Intelligence, Peking University(人工智能研究院,北京大学) School of Computing, National University of Singapore(计算学院,新加坡国立大学) School of Intelligence Science and Technology, Peking University(智能科学与技术学院,北京大学)

AI总结 本文提出POKE-SMC方法,通过优化路径似然提升扩散大语言模型的解屏蔽路径准确性,实验表明在同等计算开销下,平均提升2%-3%的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03371 2026-02-04 cs.CV

Multi-Resolution Alignment for Voxel Sparsity in Camera-Based 3D Semantic Scene Completion

基于体素稀疏性的多分辨率对齐方法用于基于摄像头的3D语义场景补全

Zhiwen Yang, Yuxin Peng

机构 * Wangxuan Institute of Computer Technology, Peking University(王宣计算机技术研究所,北京大学)

AI总结 本文提出多分辨率对齐方法,通过多分辨率特征对齐和关键分布一致性损失缓解基于摄像头的3D语义场景补全中的体素稀疏性问题。

Comments 15 pages, 6 figures, accepted by TIP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03207 2026-02-04 cs.GR cs.CV cs.PF

WebSplatter: Enabling Cross-Device Efficient Gaussian Splatting in Web Browsers via WebGPU

WebSplatter: 通过WebGPU实现跨设备高效高斯溅射

Yudong Han, Chao Xu, Xiaodan Ye, Weichen Bi, Zilong Dong, Yun Ma

机构 * Institute for Artificial Intelligence, Peking University(北京大学人工智能研究所) Tongyi Lab, Alibaba Group(阿里集团通义实验室)

AI总结 WebSplatter通过WebGPU实现跨设备高效高斯溅射,采用无等待分层基数排序和不透明度感知的几何裁剪,提升渲染效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02548 2026-02-04 cs.LG cs.AI cs.CV cs.MA

ToolTok: Tool Tokenization for Efficient and Generalizable GUI Agents

ToolTok: 为高效且通用的GUI代理的工具标记化

Xiaoce Wang, Guibin Zhang, Junzhe Li, Jinzhe Tu, Chun Li, Ming Li

机构 * Department of Computer Science, Tsinghua University, Beijing, China(清华大学计算机科学系) Guangming Laboratory, Shenzhen, China(光明实验室) National University of Singapore, Singapore(新加坡国立大学) Peking University, Beijing, China(北京大学) MSU-BIT-SMBU Joint Research Center of Applied Mathematics, Shenzhen MSU–BIT University(MSU-BIT-SMBU应用数学联合研究中心)

AI总结 ToolTok通过多步路径寻找范式,利用语义锚定机制和易到难课程,实现高效且通用的GUI代理,以较少数据获得优异性能。

Comments 8 pages main paper, 18 pages total, 8 figures, 5 tables, code at https://github.com/ZephinueCode/ToolTok

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02545 2026-02-04 cs.LG cs.AI

Beyond Alignment: Expanding Reasoning Capacity via Manifold-Reshaping Policy Optimization

超越对齐:通过流形重塑策略优化扩展推理能力

Dayu Wang, Jiaye Yang, Weikang Li, Jiahui Liang, Yang Li

机构 * Baidu Inc.(百度公司) Peking University(北京大学)

AI总结 本文提出流形重塑策略优化方法,通过几何干预扩展LLM的推理能力,实验证明其在数学任务中优于现有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17878 2026-02-04 cs.CR cs.AI

Crypto-ncRNA: a bio-inspired post-quantum cryptographic primitive exploiting RNA folding complexity

Crypto-ncRNA:一种受生物启发的后量子密码原语,利用非编码RNA折叠复杂性

Xu Wang, Yiquan Wang, Tin-yeh Huang, Zhaorui Jiang, Kai Wei

机构 * Tsinghua University-Peking University Joint Center for Life Sciences, Tsinghua University(清华大学-北京大学联合生命科学中心,清华大学) Xinjiang Key Laboratory of Biological Resources and Genetic Engineering, College of Life Science and Technology, Xinjiang University(新疆生物资源与基因工程重点实验室,新疆大学生命科学与技术学院) College of Mathematics and System Science, Xinjiang University(新疆大学数学与系统科学学院) Department of Industrial and Systems Engineering, Faculty of Engineering, The Hong Kong Polytechnic University(工程学院工业与系统工程系,香港理工大学) School of Environment and Energy, Shenzhen Graduate School, Peking University(环境与能源学院,北京大学深圳研究生院)

AI总结 Crypto-ncRNA利用非编码RNA折叠的热力学复杂性,提出一种基于生物启发的后量子密码原语,具备高安全性和高效性。

Comments Accepted at the AI4NA workshop at ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12992 2026-02-04 cs.CL

MemoryFormer: Minimize Transformer Computation by Removing Fully-Connected Layers

MemoryFormer: 通过移除全连接层来减少Transformer计算

Ning Ding, Yehui Tang, Haochen Qin, Zhenli Zhou, Chao Xu, Lin Li, Kai Han, Heng Liao, Yunhe Wang

机构 * State Key Lab of General AI, School of Intelligence Science and Technology, Peking University(人工智能国家重点实验室,智能科学与技术学院,北京大学) Huawei Noah’s Ark Lab(华为诺亚实验室) Huawei HiSilicon(华为海思)

AI总结 MemoryFormer通过移除全连接层,利用内存查找表和哈希算法替代线性投影,显著降低Transformer计算复杂度并提升效率。

Comments NeurIPS 2024. Code available at https://github.com/ningding-o/MemoryFormer

详情

展开后加载摘要…

URL PDF HTML 收藏