arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of California, Berkeley(加州大学伯克利分校)

2025-12-16 至 2025-12-16 共收录 9
2512.13100 2025-12-16 cs.RO cs.AI

OXE-AugE: A Large-Scale Robot Augmentation of OXE for Scaling Cross-Embodiment Policy Learning

OXE-AugE: 一种大规模机器人增强的OXE以实现跨躯体政策学习的扩展

Guanhua Ji, Harsha Polavaram, Lawrence Yunliang Chen, Sandeep Bajamahal, Zehan Ma, Simeon Adebola, Chenfeng Xu, Ken Goldberg

机构 * Department of EECS, UC Berkeley(电子工程与计算机科学系,加州大学伯克利分校) GRASP Laboratory, University of Pennsylvania(格拉斯实验室,宾夕法尼亚大学) Department of CS, UT Austin(计算机科学系,得克萨斯大学奥斯汀分校)

AI总结 OXE-AugE通过引入9种不同机器人躯体增强OXE数据集,提升跨躯体政策学习的泛化能力和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04146 2025-12-16 cs.LG cs.AI cs.CL

Beyond Next-Token Prediction: A Performance Characterization of Diffusion versus Autoregressive Language Models

超越单个令牌预测:扩散模型与自回归语言模型性能的对比分析

Minseo Kim, Coleman Hooper, Aditya Tomar, Chenfeng Xu, Mehrdad Farajtabar, Michael W. Mahoney, Kurt Keutzer, Amir Gholami

机构 * Seoul National University(首尔国立大学) University of California, Berkeley(加州大学伯克利分校) ICSI LBNL(劳伦斯伯克利国家实验室) University of Texas at Austin(德克萨斯大学奥斯汀分校)

AI总结 本文比较了扩散模型与自回归语言模型在性能上的差异,发现DLMs在算术强度上占优但难以扩展,而ARMs在批量推理中表现更优。

Comments 11 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12875 2025-12-16 cs.CV cs.MM cs.SD

Schrodinger Audio-Visual Editor: Object-Level Audiovisual Removal

Schrodinger Audio-Visual Editor: 对象级音频视觉去除

Weihan Xu, Kan Jen Cheng, Koichi Saito, Muhammad Jehanzeb Mirza, Tingle Li, Yisi Liu, Alexander H. Liu, Liming Wang, Masato Ishii, Takashi Shibuya, Yuki Mitsufuji, Gopala Anumanchipalli, Paul Pu Liang

机构 * MIT(麻省理工学院) UC Berkeley(加州大学伯克利分校) Berkeley AI Research(伯克利人工智能研究) Sony AI(索尼人工智能) Sony Group Corporation(索尼集团)

AI总结 本文提出Schrodinger Audio-Visual Editor,通过联合编辑音频和视频实现对象级去除,提升时间同步性和语义对应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12822 2025-12-16 cs.CV cs.AI

Lemon: A Unified and Scalable 3D Multimodal Model for Universal Spatial Understanding

Lemon:一种统一且可扩展的3D多模态模型用于通用空间理解

Yongyuan Liang, Xiyao Wang, Yuanchen Ju, Jianwei Yang, Furong Huang

机构 * University of Maryland, College Park(马里兰大学学院公园分校) University of California, Berkeley(加州大学伯克利分校)

AI总结 Lemon提出一种统一的Transformer架构,通过联合处理3D点云块和语言标记,实现空间-语言融合,提升3D多模态模型的可扩展性和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12474 2025-12-16 eess.SY cs.AI cs.LG cs.SY

AI-Driven Real-Time Kick Classification in Olympic Taekwondo Using Sensor Fusion

基于AI的奥运跆拳道实时踢击分类技术:传感器融合应用

Jamsheed Mistri

机构 * University of California, Berkeley(加州大学伯克利分校)

AI总结 本文提出基于AI和传感器融合的实时踢击分类系统,通过改进评分标准提升跆拳道比赛的动态性和观赏性。

Comments 13 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06268 2025-12-16 cs.CY cs.AI stat.ML

A Collectivist, Economic Perspective on AI

集体主义与经济视角下的人工智能

Michael I. Jordan

机构 * Inria Paris(巴黎研究所) University of California, Berkeley(加州大学伯克利分校)

AI总结 本文从集体主义和经济视角出发,提出融合社会和经济概念的算法设计方法,以更全面地理解和应对人工智能技术的社会影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07927 2025-12-16 cs.AI cs.CL cs.LG

Solving Inequality Proofs with Large Language Models

用大语言模型解决不等式证明

Pan Lu, Jiayi Sheng, Luna Lyu, Jikai Jin, Tony Xia, Alex Gu, James Zou

机构 * Stanford University(斯坦福大学) UC Berkeley(伯克利大学) Massachusetts Institute of Technology(麻省理工学院)

AI总结 本文提出了一种非正式但可验证的任务公式化方法,通过IneqMath数据集和LLM-as-judge评估框架,揭示了大语言模型在解决不等式证明任务中的局限性及改进方向。

Comments 50 pages, 24 figures, accepted as a Spotlight at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12081 2025-12-16 eess.SY cs.AI cs.SI cs.SY math.OC

Congestion Reduction in EV Charger Placement Using Traffic Equilibrium Models

利用交通均衡模型减少电动汽车充电站布置的拥堵

Semih Kara, Yasin Sonmez, Can Kizilkale, Alex Kurzhanskiy, Nuno C. Martins, Murat Arcak

机构 * University of California, Berkeley(加州大学伯克利分校) University of Maryland, College Park(马里兰大学学院公园分校)

AI总结 本文提出利用交通均衡模型减少电动汽车充电站布置拥堵,通过两种模型和贪心算法实现最优或近优结果,同时展示队列方法更现实。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13059 2025-12-16 cs.CL cs.LG

Multipole Attention for Efficient Long Context Reasoning

多重注意力机制用于高效长上下文推理

Coleman Hooper, Sebastian Zhao, Luca Manolache, Sehoon Kim, Michael W. Mahoney, Yakun Sophia Shao, Kurt Keutzer, Amir Gholami

机构 * University of California, Berkeley(加州大学伯克利分校) ICSI LBNL(劳伦斯伯克利国家实验室)

AI总结 多重注意力机制通过精确计算重要标记的注意力并近似其余标记,提升长上下文推理效率。

Comments 15 pages

Journal ref NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏