arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Massachusetts Institute of Technology(麻省理工学院)

2026-08-27 至 2026-08-27 共收录 10
2608.25832 2026-08-27 cs.CL cs.AI cs.GT cs.LG 新提交

Skill Issue: Are Skills Language-Invariant in LLMs?

技能问题:大型语言模型的技能是否具有语言不变性?

Bobby Cheng, Adam Gaber, Zhengyuan Liu, Catherine Arnett, Omer Goldman, Cheston Tan, Leshem Choshen

机构 * A*STAR(新加坡科技研究局) Weizmann Institute of Science(魏茨曼科学研究所) MIT-IBM Watson AI Lab(麻省理工学院-IBM沃森人工智能实验室) University of Cambridge(剑桥大学) EleutherAI

AI总结 该研究以多语言自博弈方法量化大型语言模型的跨语言技能不一致性,发现同一模型在不同语言下博弈实力差异显著,语言可影响决策阶段,技能差异是多语言模型开发的主要障碍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25548 2026-08-27 cs.LG q-bio.QM 新提交

Interpreting Protein Language Model Embeddings via Orthogonal Projection for Protein Fitness Prediction

通过正交投影解释蛋白质语言模型嵌入以用于蛋白质适应性预测

Paulo Yanez Sarmiento, Pia Francesca Rissom, Manuel Pfeuffer, Marco Simnacher, Jordan F. Safer, Sumaiya Iqbal, Henrike O. Heyne, Nadja Klein, Bernhard Y. Renard

机构 * Hasso Plattner Institute, University of Potsdam(波茨坦大学哈索·普拉特纳研究所) Broad Institute of MIT and Harvard(麻省理工学院及哈佛大学布罗德研究所) Humboldt University of Berlin(柏林洪堡大学) Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院)

AI总结 本研究提出通过正交投影技术去除蛋白质语言模型嵌入中的可解释生化特征效应,证明其编码与生化特性相关的模式并量化其对蛋白质适应性预测的贡献,该方法可迁移至其他问题场景。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24974 2026-08-27 cs.LG cs.AI eess.SP 新提交

Clearing the Underbrush: AI-Enhanced RF Interference Suppression

清除底层障碍:AI增强的射频干扰抑制

Rahul Jain, Pierre Trepagnier, Rick Gentile, Joey Botero, Alexia Schulz

机构 * MIT Lincoln Laboratory(麻省理工学院林肯实验室)

AI总结 该研究在自回归Transformer模型基础上添加FSQ分词器层,结合推理优化技术,在低延迟下提升了对OFDM数字电视干扰的抑制性能,通过PESQ指标验证优势并探索了相关应用场景。

Comments 7 pages, 10 figures, Accepted to the 2026 IEEE Military Communications Conference (MILCOM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24886 2026-08-27 cs.AI 新提交

VLM-based automatic multi-granularity graph representation of building layouts for design informatics

基于视觉语言模型的建筑布局多粒度图自动表示方法,用于设计信息学

Song Guo, Zhuoshi Chen, Maosu Li, Weimin Zhuang

机构 * Massachusetts Institute of Technology(麻省理工学院) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Tsinghua University(清华大学)

AI总结 本研究提出基于VLM的多粒度图自动构建方法,以147份高校图书馆平面图为案例,验证其生成的图与人工标注图一致性良好,可用于设计信息学相关任务,提升建筑全生命周期设计信息利用率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26081 2026-08-27 cs.AI cond-mat.mtrl-sci cs.CL 新提交

SwarmWorld: Stigmergic technological evolution in societies of language-model agents

SwarmWorld:语言模型智能体社会中的标记介导技术演化

Subhadeep Pal, Fiona Y. Wang, Markus J. Buehler

机构 * Laboratory for Atomistic and Molecular Mechanics (LAMM)(原子与分子力学实验室(LAMM)) Department of Civil and Environmental Engineering(土木与环境工程系) Department of Biological Engineering(生物工程系) Department of Mechanical Engineering(机械工程系) Center for Computational Science and Engineering(计算科学与工程中心) Schwarzman College of Computing(苏世民计算机学院) Massachusetts Institute of Technology(麻省理工学院)

AI总结 该研究提出SwarmWorld框架,让无角色的LLM智能体自组织成技术社会,其协作构建的技术组合比独立搜索更具韧性,揭示了标记介导的技术演化机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23322 2026-08-27 cs.LG 版本更新

Beyond Point Predictions: Uncertainty-Aware Satellite Poverty Mapping for Public Policy

超越点预测:面向公共政策的不确定性感知卫星贫困制图

Markus B. Pettersson, James Bailie, Mohammad Kakooei, Eagon Meng, Adel Daoud

机构 * Chalmers University of Technology(查尔姆斯理工大学) University of Gothenburg(哥德堡大学) Linköping University(林雪平大学) Karlstad University(卡尔斯塔德大学) Massachusetts Institute of Technology(麻省理工学院)

AI总结 该研究针对非洲高分辨率贫困数据不足的问题,提出不确定性感知的EO-ML贫困制图方法,生成统计可靠的预测区间,还开发了风险可控的援助分配程序,为政策制定提供可靠补充。

Comments This manuscript is currently under consideration at the Proceedings of the National Academy of Sciences (PNAS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19583 2026-08-27 cs.CV cs.AI 版本更新

VGI-Bench: Probing Visual Intelligence in Video Generation Models

VGI-BENCH:探究视频生成模型的视觉智能

Xuan He, Cong Wei, Yuhao Cheng, Linrui Ma, Yuxuan Zhang, Zuojun Li, Yuhao Wen, Jize Jiang, Zeyi Liu, Yuren Hao, Songcheng Cai, Keming Wu, Penghui Du, Kai Zou, Rui Yang, Chenkai Sun, Ke Yang, Ping Nie, Kelsey R Allen, Chenglong Wang, Michel Galley, Jianfeng Gao, ChengXiang Zhai

机构 * University of Illinois Urbana Champaign(伊利诺伊大学厄巴纳-香槟分校) Tsinghua University(清华大学) University of Waterloo(滑铁卢大学) Massachusetts Institute of Technology(麻省理工学院) University of British Columbia(不列颠哥伦比亚大学) Vector Institute(矢量研究所) Microsoft Research(微软研究院) Etude AI

AI总结 本研究推出VGI-bench基准,含27项任务810个实例,评估视频生成模型视觉推理能力,发现最强模型Seedance~2.0仅达51.0%,将推动下一代视频生成模型发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09590 2026-08-27 cs.CL cs.CR 版本更新

Clinically Grounded Privacy Evaluation of Medical LMs

临床导向的医学语言模型隐私评估

Sasha Ronaghi, Sana Tonekaboni, Lena Stempfle, Vivian Utti, Jordan Li Cahoon, Nathaniel Hendrix, Ayin Vala, Marzyeh Ghassemi, Emily Alsentzer

机构 * Stanford University(斯坦福大学) Massachusetts Institute of Technology(麻省理工学院) American Board of Family Medicine(家庭医学认证委员会)

AI总结 提出临床导向框架,按对抗访问等级评估医学语言模型隐私泄露,发现常规元数据可导致高比率逐字记忆和敏感诊断恢复,但部分记忆源于模板化文档。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01120 2026-08-27 cs.AI math.CO 版本更新

New Bounds for Zarankiewicz Numbers via Reinforced LLM Evolutionary Search

通过强化LLM进化搜索获得Zarankiewicz数的新界

Jay Bhan, Nicole Nobili, Patrick Langer

机构 * Massachusetts Institute of Technology(麻省理工学院) ETH Zürich(苏黎世联邦理工学院) Stanford University(斯坦福大学)

AI总结 本文首次确定三个Zarankiewicz数的精确值,并通过强化LLM进化搜索方法为41个数建立下界,展示了LLM引导的进化搜索在数学研究中的潜力。

Comments *Jay Bhan and Nicole Nobili contributed equally to this work as first authors, and their order was determined via coin flip

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14313 2026-08-27 cs.LG cs.AI 版本更新

AIRL-S: Unifying Reinforcement Learning and Search-Based Test-Time Scaling via Adversarial Inverse Reinforcement Learning

你的强化学习奖励函数是你的最佳搜索PRM:统一强化学习与基于搜索的文本生成

Can Jin, Yang Zhou, Qixin Zhang, Hongwu Peng, Di Zhang, Zihan Dong, Marco Pavone, Ligong Han, Zhang-Wei Hong, Tong Che, Dimitris N. Metaxas

机构 * Rutgers University(新泽西州立大学) Nanyang Technological University(南洋理工大学) University of Connecticut(康涅狄格大学) Fudan University(复旦大学) NVIDIA Research(NVIDIA研究) Red Hat AI Innovation(红帽AI创新) MIT-IBM Watson AI Lab(MIT-IBM沃森AI实验室) Massachusetts Institute of Technology(麻省理工学院)

AI总结 本文提出AIRL-S,通过强化学习与搜索技术的统一,利用奖励函数直接学习动态PRM,提升推理链扩展和跨任务泛化能力,实验显示性能提升9%并优于基线PRM。

详情

展开后加载摘要…

URL PDF HTML 收藏