arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Southern California(南加州大学)

2026-08-24 至 2026-08-24 共收录 3
2608.20818 2026-08-24 cs.LG cs.AI cs.CV 新提交

Scaling Muon for Diffusion Transformers

针对扩散Transformer的Muon优化器的缩放研究

Chenghao Li, Xiao Han, Xinxin Huang, Wei Liu, Boyang Li, Bing Xiao, Heran Zhang, Juanma Perez Rua, Ke Xu, Kangning Liu, Linjun Kuang, Na Li, Tan Wang, Tian Xie, Wei Peng, Yang Pei, Yifan Xu, Yuanhao Zhai, Yuwei Lin, Zhe Wang, Zihao He, Daniel Li, Junbiao Tang, Ziyang Jiang, Dake Chen

机构 * University of Southern California(南加州大学) Meta

AI总结 该研究针对大型扩散Transformer的Muon优化器,提出周期性行级Muon,在保留其生成质量优势的同时,大幅降低训练的计算、通信开销与时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20569 2026-08-24 cs.AI cs.CL 新提交

Open-Weight Masked Introspection: Measuring What Language Models Can Report About Their Own Computation

开放权重掩码内省:测量语言模型可报告自身计算的能力

Emilio Ferrara

机构 * University of Southern California(南加州大学)

AI总结 本研究构建OWMI框架检验8个开放权重模型的内省能力,发现其无法区分真实干预与虚假运行,仅内部存在相关信息,失败源于内部状态到文本报告的路径,需对照内部参考验证模型证词。

Comments We release OWMI as a library so that this emerging ability can be measured as it develops. Hugging Face OWMI library: this https URL (https://huggingface.co/emilioferrara/owmi)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20556 2026-08-24 cs.RO cs.LO eess.SY 新提交

Logic-VLA: A Temporal Logic Conditioned Vision-Language-Action Model

Logic-VLA:一种时序逻辑条件下的视觉-语言-动作模型

Celina Shiyu Wang, Yiqi Zhao, Junjie Ye, Yue Wang, Jyotirmoy V. Deshmukh

机构 * University of Southern California(南加州大学)

AI总结 Logic-VLA是感知形式化需求的VLA模型,以STL规约为条件,经两阶段适配后,在四旋翼导航仿真中大幅提升STL满足率,仅小幅降低常规NL任务成功率,可适配不同形式化需求。

详情

展开后加载摘要…

URL PDF HTML 收藏