arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of California, Berkeley(加州大学伯克利分校)

2026-02-04 至 2026-02-04 共收录 9
2602.03767 2026-02-04 cs.LG cs.AI econ.GN physics.ao-ph q-fin.EC

Decision-oriented benchmarking to transform AI weather forecast access: Application to the Indian monsoon

面向决策的基准测试以转变AI天气预报访问:应用于印度季风

Rajat Masiwal, Colin Aitken, Adam Marchakitus, Mayank Gupta, Katherine Kowal, Hamid A. Pahlavan, Tyler Yang, Y. Qiang Sun, Michael Kremer, Amir Jina, William R. Boos, Pedram Hassanzadeh

机构 * Department of the Geophysical Sciences, University of Chicago(地球科学系,芝加哥大学) Development Innovation Lab, University of Chicago(创新发展实验室,芝加哥大学) Development Innovation Lab India, University of Chicago Trust(印度创新发展实验室,芝加哥大学信托) Data Science Institute, University of Chicago(数据科学研究所,芝加哥大学) Department of Earth and Planetary Science, University of California, Berkeley(地球与行星科学系,加州大学伯克利分校) NorthWest Research Associates, Boulder, CO(北西部研究协会,博尔德,科罗拉多) Department of Economics, University of Chicago(经济学系,芝加哥大学) Harris School of Public Policy, University of Chicago(哈里斯公共政策学院,芝加哥大学) Climate and Ecosystem Sciences Division, Lawrence Berkeley National Laboratory(气候与生态系统科学部,伯克利国家实验室)

AI总结 本文提出面向决策的基准测试框架,用于改进AI天气预测模型在印度季风预测中的应用,帮助农民应对气候变化带来的天气冲击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00755 2026-02-04 cs.MA cs.AI cs.NE

Evolving Interpretable Constitutions for Multi-Agent Coordination

为多智能体协调演化可解释的宪法

Ujwal Kumar, Alice Saito, Hershraj Niranjani, Rayan Yessou, Phan Xuan Tan

机构 * College of Engineering Shibaura Institute of Technology(Shibaura Institute of Technology 工程学院) Faculty of Arts and Sciences The University of Tokyo(东京大学 文理学部) Department of EECS University of California, Berkeley(加州大学伯克利分校 电子工程与计算机科学系) Department of Informatics Università degli Studi di Milano-Bicocca(米兰-比科卡大学 信息学系)

AI总结 本文提出通过进化算法自动发现多智能体协调的可解释宪法,通过实验展示进化宪法在提升社会稳定性方面的有效性。

Comments 23 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08951 2026-02-04 cs.CY cs.AI cs.CL

PluriHarms: Benchmarking the Full Spectrum of Human Judgments on AI Harm

PluriHarms:对AI危害全谱人类判断的基准测试

Jing-Jing Li, Joel Mire, Eve Fleisig, Valentina Pyatkin, Anne Collins, Maarten Sap, Sydney Levine

机构 * UC Berkeley(伯克利大学) Carnegie Mellon University(卡内基梅隆大学) Allen Institute for AI(人工智能研究院) New York University(纽约大学)

AI总结 PluriHarms通过系统研究人类对AI危害的判断,旨在推动更安全的AI发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03227 2026-02-04 cs.CV

Spiral RoPE: Rotate Your Rotary Positional Embeddings in the 2D Plane

Spiral RoPE: 在二维平面上旋转你的旋转位置嵌入

Haoyu Liu, Sucheng Ren, Tingyu Zhu, Peng Wang, Cihang Xie, Alan Yuille, Zeyu Zheng, Feng Wang

机构 * University of California, Berkeley(加州大学伯克利分校) University of California, Santa Cruz(加州大学圣克ruz分校) John Hopkins University(约翰霍普金斯大学)

AI总结 Spiral RoPE通过多方向位置编码改进视觉变换器在分类、分割和生成任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02903 2026-02-04 cs.LG cs.AI cs.SY eess.SY

Spatiotemporal Decision Transformer for Traffic Coordination

时空决策变压器用于交通协调

Haoran Su, Yandong Sun, Hanxiao Deng

机构 * New York University(纽约大学) UC Berkeley(伯克利大学)

AI总结 MADT通过引入图注意力机制、时间变压器编码器和返回到去的条件,实现了多智能体交通信号控制的序列建模,有效提升了交通协调性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02831 2026-02-04 cs.RO

Adaptive Linear Path Model-Based Diffusion

基于自适应线性路径模型的扩散

Yutaka Shimizu, Masayoshi Tomizuka

机构 * Department of Mechanical Engineering, University of California, Berkeley(加州大学伯克利分校机械工程系)

AI总结 本文提出LP-MBD和ALP-MBD,通过线性概率路径和强化学习提升扩散模型在机器人控制中的适应性和鲁棒性。

Comments ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02639 2026-02-04 cs.AI cs.LG

A Positive Case for Faithfulness: LLM Self-Explanations Help Predict Model Behavior

对忠实性的积极案例:LLM自我解释有助于预测模型行为

Harry Mayne, Justin Singh Kang, Dewi Gould, Kannan Ramchandran, Adam Mahdi, Noah Y. Siegel

机构 * University of Oxford(牛津大学) University of California, Berkeley(加州大学伯克利分校) University College London(伦敦大学学院) Google DeepMind(谷歌DeepMind)

AI总结 本文提出NSG度量标准,证明LLM自我解释能提升模型行为预测能力,且比外部生成解释更具预测价值,揭示了自我解释在AI监督中的积极作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04601 2026-02-04 cs.LG cs.CL

Natural Language Actor-Critic: Scalable Off-Policy Learning in Language Space

自然语言行为-批评者:在语言空间中可扩展的非策略学习

Joey Hong, Kang Liu, Zhan Ling, Jiecao Chen, Sergey Levine

机构 * University of California, Berkeley(加州大学伯克利分校)

AI总结 本文提出NLAC算法,利用生成式LLM批评者生成自然语言反馈,实现更高效稳定的LLM智能体训练。

Comments 21 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16964 2026-02-04 cs.CV cs.CL

MedFrameQA: A Multi-Image Medical VQA Benchmark for Clinical Reasoning

MedFrameQA: 一个多图像医学视觉问答基准用于临床推理

Suhao Yu, Haojin Wang, Juncheng Wu, Luyang Luo, Jingshen Wang, Cihang Xie, Pranav Rajpurkar, Carl Yang, Yang Yang, Kang Wang, Yannan Yu, Yuyin Zhou

机构 * University of Pennsylvania(宾夕法尼亚大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) UC Santa Cruz(加州大学圣克鲁兹分校) Harvard University(哈佛大学) UC Berkeley(加州大学伯克利分校) Emory University(埃默里大学) UC San Francisco(旧金山加州大学)

AI总结 MedFrameQA是一个多图像医学视觉问答基准,旨在评估多图像医学推理能力,揭示现有模型在处理复杂医学叙述时的不足。

Comments 27 pages, 15 Figures Benchmark data: https://huggingface.co/datasets/SuhaoYu1020/MedFrameQA

详情

展开后加载摘要…

URL PDF HTML 收藏