arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of California, Los Angeles(加州大学洛杉矶分校)

2026-09-01 至 2026-09-01 共收录 6
2608.31167 2026-09-01 cs.RO cs.AI 新提交

SUN: Persistent Programs For Language-Grounded Control-to-Learning-to-Real Policies

SUN:用于语言接地控制学习到真实策略的持久程序

Weiqi Wang, Zhi Li, Yudong Lei, David Martinez, Xiaofeng Gao, Yuxin Jiang, Chenfanfu Jiang, Yingnian Wu, Demetri Terzopoulos, Ran Gong

机构 * University of California, Los Angeles(加利福尼亚大学洛杉矶分校) University of California, Santa Barbara(加利福尼亚大学圣巴巴拉分校) Amazon(亚马逊公司) Robotics and AI Institute(机器人与人工智能研究院)

AI总结 本文提出语义统一(SUN)程序及系统Kuafu,由大型视觉语言系统自动合成,在9项任务中实现82.03%宏观成功率,优于相关基准,可将控制摊销为鲁棒策略,实现符号规划与数据驱动执行的统一。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30657 2026-09-01 cs.CV 新提交

InfraOcc: An Infrastructure Occupancy Benchmark with Static-to-Dynamic Reasoning

InfraOcc:具备静态-动态推理能力的基础设施占用基准测试集

Lei Yang, Xiaokai Bai, Boqi Li, Chunmian Lin, Li Wang, Ziying Song, Jiahuan Zhang, Enhui Ma, Haibao Yu, Jiaqi Ma, Kaicheng Yu

机构 * Nanyang Technological University(南洋理工大学) Zhejiang University(浙江大学) Beihang University(北京航空航天大学) Beijing Institute of Technology(北京理工大学) Yanshan University(燕山大学) Westlake University(西湖大学) University of Hong Kong(香港大学) University of California, Los Angeles(加利福尼亚大学洛杉矶分校)

AI总结 本文构建了首个基础设施占用基准InfraOcc,提出ProSD-Occ方法实现静态-动态渐进推理,在多赛道排名第一,为固定视角路边占用提供了新的推理范式。

Comments 17 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30241 2026-09-01 cs.CL cs.CV 新提交

PaperBanana-Interact: Scientific Diagram Refinement with Multi-Turn Human Feedback

PaperBanana-Interact:基于多轮人类反馈的科学图表优化

Xueqing Wu, Ashwin Balasubramanian, Bingxuan Li, Dawei Zhu, Kai-Wei Chang, Yale Song, Yiwen Song, Rui Meng, Tomas Pfister, Nanyun Peng

机构 * Google(谷歌公司) Peking University(北京大学) University of California, Los Angeles(加利福尼亚大学洛杉矶分校) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 该研究针对科学图表多轮优化的空白,构建了多轮图表生成基准MTPaperBananaBench,提出多智能体系统PaperBanana-Interact,解决基线系统的质量漂移与遗忘问题,显著提升图表优化效果。

Comments https://shirley-wu.github.io/PaperBanana-Interact/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29904 2026-09-01 cs.CV 新提交

Off-Manifold Refinement: Guiding Video Generators with a Frozen World Model

流形外细化:用冻结世界模型引导视频生成器

Hai Nguyen-Truong, Tuan-Anh Vu, Dang Huynh

机构 * Fulbright University Vietnam(富布赖特越南大学) University of California, Los Angeles(加利福尼亚大学洛杉矶分校)

AI总结 该研究提出流形外细化(OMR)方法,用冻结的V-JEPA 2.1世界模型引导视频生成器,在低额外成本下提升了视频的物理一致性与语义 adherence指标。

Comments Accepted at BMVC 2026. Project page: https://itruonghai.github.io/omr

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29461 2026-09-01 cs.LG 新提交

A Causal Model for Locating and Unlocking Sandbagging in Model Organisms

用于定位和解锁模型“沙袋行为”的因果模型

Hong Kiat Tan, Linh Le, David Williams-King

机构 * University of California, Los Angeles(加利福尼亚大学洛杉矶分校) Lida Safety ERA

AI总结 本文提出用于定位和解锁模型“沙袋行为”的因果模型,通过单层轴嫁接或上下文嫁接可恢复模型能力,为审计人员提供干预审计技术。

Comments under submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29458 2026-09-01 cs.LG cs.AI 新提交

Reference-Grafting Matches Fine-Tuning at Eliciting Sandbagged Capabilities

参考嫁接在引出被搁置的能力方面可与微调相媲美

Linh Le, Hong Kiat Tan, David Williams-King

机构 * Lida Safety(Lida安全公司) University of California, Los Angeles(加利福尼亚大学洛杉矶分校) ERA(ERA公司)

AI总结 针对模型被搁置的安全评估问题,提出参考嫁接方法,仅需少量配对示例即可引出模型隐藏能力,效果媲美微调,适用于不同规模模型及多种搁置场景。

Comments under submission

详情

展开后加载摘要…

URL PDF HTML 收藏