arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Peking University(北京大学)

2026-08-17 至 2026-08-17 共收录 6
2608.14430 2026-08-17 cs.LG cs.CV stat.ML 新提交

Designing Reinforcement Learning for Diffusion Models: A Unified Path-Space View

为扩散模型设计强化学习:统一的路径空间视角

Yixian Xu, Yuanrui Zhang, Shengjie Luo, Liwei Wang, Di He

机构 * State Key Laboratory of General Artificial Intelligence(通用人工智能国家重点实验室) School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院) ByteDance(字节跳动)

AI总结 本文从路径空间视角统一了扩散模型RL算法的原理,推导得到降方差值梯度形式,提出多样本KDE估计器和尺度受限权重族,在SD3.5-M等模型上验证了方法有效性并优于基线。

Comments 29 pages, 9 figures, 4 tables; work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14420 2026-08-17 cs.LG 新提交

More Correct Mass, Worse Answers: Why Power Sampling Can Fail and How to Fix It

更多正确质量,更差答案:幂采样为何会失效及如何修复

Haohui Yang, Jiaxing Sun, Xiujun Ma

机构 * State Key Laboratory of General Artificial Intelligence, Peking University(北京大学通用人工智能 State Key Laboratory)

AI总结 研究发现幂采样存在悖论,即提升正确轨迹概率却降低下游推理性能,归因于剂量与覆盖不匹配,提出修复后的支持保留幂采样器可逆转损失并优于标准多采样推理。

Comments 16 pages, 8 figures, 1 table. Haohui Yang and Jiaxing Sun contributed equally. Xiujun Ma is the corresponding author

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14125 2026-08-17 cs.AI 新提交

Traj-LeWM: Path-Aware World-Model Planning via Latent Trajectory Cost

Traj-LeWM:通过潜在轨迹代价实现路径感知的世界模型规划

Xiaodi Huang, Ziyi Ding, Jingtian Wan, Yuchen Liu, Yuan Zhang, Xiao-Ping Zhang, Jiayu Chen, Zhang Zhang, Tao Huang

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Shanghai Jiao Tong University(上海交通大学) Tsinghua Shenzhen International Graduate School(清华大学深圳国际研究生院) The University of Hong Kong(香港大学) INFIFORCE University of Science and Technology of China(中国科学技术大学) Peking University(北京大学)

AI总结 本文针对LeWM的局限提出Traj-LeWM,通过引入潜在轨迹代价结合终点距离的联合评分,在多个机器人与导航任务上实现性能提升,验证了轨迹级信息的互补作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14085 2026-08-17 cs.CV 新提交

CoDS: Robust Collaborative Perception via Expert-driven Detection and BEV Segmentation

CoDS:基于专家驱动检测与BEV分割的鲁棒协同感知

Jinlong Wang, Yuang Jia, Junhong Lin, Nannan Li, Wei Gao

机构 * Peking University(北京大学) Macau University of Science and Technology(澳门科技大学)

AI总结 针对多源噪声导致协同感知性能下降的问题,提出CoDS框架,通过CoRM、S-MoE和BTCI模块提升鲁棒性,在公开数据集上优于基线且抗噪稳定。

Comments 10 pages, 6 figures

Journal ref ACMMM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14049 2026-08-17 cs.RO 新提交

FlatLab: A Unified Methodology Framework and Simulation-Based Benchmark for Robotic Manipulation of Flat Objects

FlatLab:面向扁平物体机器人操作的统一方法论框架及基于仿真的基准测试

Xingyu Zhu, Wenshuo Han, Zhouyu Wang, Yuran Wang, Ruihai Wu, Hao Dong, Fan Tang, Hechang Chen, Hyung Jin Chang, Yixing Gao

机构 * Jilin University(吉林大学) Peking University(北京大学) Chinese Academy of Sciences(中国科学院) University of Birmingham(伯明翰大学)

AI总结 该研究针对扁平物体机器人操作泛化能力有限的问题,提出含策略生成器与执行模块的统一框架,并构建FlatLab仿真基准,方法泛化效果优于现有基线。

Comments This paper is accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16298 2026-08-17 cs.CV 版本更新

Revisiting Shape and Texture Reliance with Category-Separability-Calibrated Suppression

用语义匹配抑制重新思考特征依赖评估

Ning Jiang, Tianyi Luo, Zhengyong Huang, Yao Sui

机构 * Institute of Medical Technology, Peking University Health Science Center(北京大学医学部医学技术研究所) National Institute of Health Data Science, Peking University(北京大学国家卫生数据科学研究院) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院)

AI总结 该研究重新审视视觉识别模型特征依赖问题,引入语义匹配评估框架,通过比较不同抑制下性能,发现卷积神经网络更依赖纹理,视觉Transformer更具鲁棒性,指出语义可比性对解释特征依赖很关键,其优势或与人类视觉皮层表征有关。

详情

展开后加载摘要…

URL PDF HTML 收藏