arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

2026-08-27 至 2026-08-27 共收录 3
2608.25832 2026-08-27 cs.CL cs.AI cs.GT cs.LG 新提交

Skill Issue: Are Skills Language-Invariant in LLMs?

技能问题:大型语言模型的技能是否具有语言不变性?

Bobby Cheng, Adam Gaber, Zhengyuan Liu, Catherine Arnett, Omer Goldman, Cheston Tan, Leshem Choshen

机构 * A*STAR(新加坡科技研究局) Weizmann Institute of Science(魏茨曼科学研究所) MIT-IBM Watson AI Lab(麻省理工学院-IBM沃森人工智能实验室) University of Cambridge(剑桥大学) EleutherAI

AI总结 该研究以多语言自博弈方法量化大型语言模型的跨语言技能不一致性,发现同一模型在不同语言下博弈实力差异显著,语言可影响决策阶段,技能差异是多语言模型开发的主要障碍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25061 2026-08-27 cs.CL cs.AI cs.DB cs.LG cs.PL 新提交

DataKernelBench: Can LLMs Optimize Database Queries on GPUs?

DataKernelBench:大语言模型能否在GPU上优化数据库查询?

Gokul Karthik Kumar, Yotam Perlitz, Corey Lammie, Andrea Giovannini, Katja Hose

机构 * IBM Research(IBM研究院) TU Wien(维也纳技术大学)

AI总结 本文提出DataKernelBench基准,评估LLM在GPU上优化数据库查询内核的能力,实验显示最强模型配置在TPC-H数据集上实现2.11倍加速,工作负载上下文对性能影响大于硬件上下文。

Comments Accepted at EMNLP 2026. Homepage: this https URL (https://kerneldf.github.io/datakernelbench)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25858 2026-08-27 cs.CV cs.LG physics.ao-ph 新提交

Precipitation Downscaling Using Foundation Model-Conditioned Diffusion

基于基础模型条件扩散的降水降尺度方法

Victor Nascimento Ribeiro, Jorge Guevara, Jorge Sebastian Moraga, Chris Lucas, Natalie Lord, Andrew Taylor, Edward Lockhart, Will Trojak, Johannes Schmude, Anne Jones

机构 * IBM Research(IBM研究院) Fathom STFC Hartree Centre(STFC哈特雷中心)

AI总结 该研究针对降水降尺度问题,探究三种扩散模型条件策略,发现交叉注意力条件优于通道拼接,且Prithvi WxC基础模型在数据有限场景下性能良好。

详情

展开后加载摘要…

URL PDF HTML 收藏