arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Peking University(北京大学)

2026-08-26 至 2026-08-26 共收录 10
2608.24885 2026-08-26 cs.RO cs.CV 新提交

Do Robotic World Models Really Follow Actions? Diagnosing and Aligning Action-Conditioned Generation for Policy Learning

机器人世界模型真的会遵循动作吗?面向策略学习的动作条件生成诊断与对齐

Sixiang Chen, Jiaming Liu, Jixian Wu, Yichen Guo, Tinghao Wang, Siyuan Qian, Hao Chen, Jiajun Cao, Jian Tang, Shanghang Zhang

机构 * Peking University(北京大学) Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心) New York University(纽约大学) University of Electronic Science and Technology of China(电子科技大学) Nanyang Technological University(南洋理工大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 本文针对动作条件世界模型的动作遵循问题,提出WorldEcho诊断工具与WorldSync改进方法,经实验验证WorldSync可提升动作遵循性能,作为可靠模拟器助力策略改进并提高任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24814 2026-08-26 cs.LG 新提交

Effective Learning Rate Governs Loss Dynamics in Language Model Pretraining

有效学习率支配语言模型预训练中的损失动态

Zihan Liu, Ruiheng Zheng, Shaobo Zhang, Changxin Tian, Kunlong Chen, Zhiqiang Zhang, Lei Wu

机构 * Peking University(北京大学) Ant Group(蚂蚁集团)

AI总结 该研究发现语言模型预训练中存在ELR崩溃现象,确定ELR是连接LR调度、范数控制与损失动态的共同坐标,提出的基于ELR的FSL可实现跨范数控制方法的迁移并解释延迟加速效应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24696 2026-08-26 cs.LG cs.AI 新提交

On-policy Distillation with Verifiable Reward

结合可验证奖励的在线蒸馏

Wenze Lin, Jiale Zhao, Xitai Jiang, Songde Rao, Yining Li, Shenzhi Wang, Bingxiang He, Gao Huang

机构 * LeapLab, Tsinghua University(清华大学LeapLab) Beihang University(北京航空航天大学) SMS, Peking University(北京大学SMS) NLPLab, Tsinghua University(清华大学NLPLab)

AI总结 本研究提出OPDVR方法,无缝结合OPD与RLVR且不增加超参数,经六个推理基准实验验证其性能优于标准OPD。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24521 2026-08-26 cs.CL 新提交

Beyond Information Seeking: Severity-Aware Question Supervision for Proactive Medical Dialogue

超越信息获取:面向主动医疗对话的严重度感知问题监督

Chenxuan Li, Xinrong Chen, Luyan Zhang, Peidong Jia, Zhongyu Zhao, Xuecheng Shang, Peixing Wan

机构 * Peking University(北京大学) Northeastern University(东北大学) School of Basic Medical Sciences, Peking University(北京大学基础医学院)

AI总结 本研究针对主动医疗对话提出ESR严重度感知问题监督目标,在DDxPlus数据集上提升了高严重度诊断准确率、降低了漏诊率,推动主动医疗对话向感知后果的证据获取方向发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24291 2026-08-26 cs.AI cs.SE 新提交

ReproAgent: Contract-Guided Paper-to-Code Reproduction

ReproAgent:基于合约引导的论文到代码复现

Xue Hu, Zewei Pan, Zhongyuan Wang, Zhou Liu, Zeli Su, Wentao Zhang

机构 * Beihang University(北京航空航天大学) Shanghai Jiao Tong University(上海交通大学) Peking University(北京大学) Minzu University of China(中央民族大学) Zhongguancun Academy(中关村科学院)

AI总结 ReproAgent是基于合约引导的四阶段论文到代码复现流水线,在PaperBench Code-Dev基准上,其在两种骨干模型的同架构支架中取得最高平均得分,相关产物已公开。

Comments Accepted to Findings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24252 2026-08-26 cs.AI cs.SE 新提交

SA-Bench: Evaluating Semantic Alignment in LLM-Based Paper Reproduction

SA-Bench:评估基于大语言模型的论文复现中的语义对齐

Xue Hu, Zewei Pan, Zeli Su, Zhou Liu, Wentao Zhang

机构 * Beihang University(北京航空航天大学) Shanghai Jiao Tong University(上海交通大学) Minzu University of China(中央民族大学) Peking University(北京大学) Zhongguancun Academy(中关村科学院)

AI总结 本研究推出SA-Bench基准,评估LLM复现论文时的语义对齐,发现现有模型复现准确率低,需优化脚手架以提升语义规范验证能力。

Comments Accepted to Findings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24169 2026-08-26 cs.CV cs.GR cs.HC 新提交

ViSculpt: Visual-Centric Agentic Geometry Editing

ViSculpt:以视觉为中心的智能体几何编辑

Bo Pang, Jiaqi Pan, Xiaocheng Zhang, Jiacheng Xu, Guoping Wang, Peng-Shuai Wang

机构 * Peking University(北京大学)

AI总结 该研究提出以视觉为中心的无训练多智能体系统ViSculpt,通过Blender GUI直接编辑现有三维网格,可遵循指令执行局部编辑并保留资产整体特征,为语言驱动的三维编辑提供了新范式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24155 2026-08-26 cs.RO 新提交

Coverage Planning for Robotic Tooth Preparation in Densely Constrained Environments

密集受限环境下机器人牙齿预备的覆盖规划

Yunwen Li, Chen Chen, Xiangjie Yan, Chang Shu, Jianxia Hou, Shiji Song, Xiang Li

机构 * Tsinghua University(清华大学) ETH Zürich(苏黎世联邦理工学院) Tsingscribe Medical Ltd.(清scribe医疗有限公司) Peking University School and Hospital of Stomatology(北京大学口腔医学院) Beijing National Research Center for Information Science and Technology(北京信息科学与技术国家研究中心)

AI总结 本文提出一种用于自主全冠牙齿预备的机器人系统,通过感知解剖结构的刀具路径规划算法和面向间隙的末端执行器偏航角分配策略,实现精准牙面铣削,平均几何偏差0.117mm,经仿真和头模实验验证其可行性与有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24119 2026-08-26 cs.CV cs.AI 新提交

TransPhy: Visual In-Context Learning for Physically Grounded Image Editing

TransPhy:面向物理基础图像编辑的视觉上下文学习

Siyi Xie, Xuanke Shi, Jinsheng Quan, Haoran Tang, Zukai Chen, Lei Yang, Quan Wang

机构 * Peking University(北京大学) SenseTime Research(商汤科技研究院) Zhejiang University(浙江大学)

AI总结 针对现有视觉上下文学习对物理基础图像变换支持不足的问题,提出TransPhy框架,通过分解为物理规则归纳和过渡对齐渲染,在PhysVICL-74基准上提升了相关性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23593 2026-08-26 cs.CV cs.AI 新提交

Fidelity Preference, Not Demographic Preference: A Pixel-Level Attribute-Sensitivity Audit of Image Aesthetic/Preference Scorers

保真度偏好,而非人口统计学偏好:图像美学/偏好评分器的像素级属性敏感性审计

Mingyang Xu

机构 * Peking University(北京大学)

AI总结 该研究通过像素级干预审计4种图像评分器,发现评分器的主导效应是保真度偏好,合成审计会误判偏见,仅真实数据的图像内因果隔离可区分真实人口统计学偏见与保真度偏好。

详情

展开后加载摘要…

URL PDF HTML 收藏