arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Massachusetts Institute of Technology(麻省理工学院)

2026-08-25 至 2026-08-25 共收录 10
2608.23552 2026-08-25 cs.AI cs.CL cs.SE 新提交

Prime Agent: A Self-Improving RLM Harness

Prime Agent:一种自改进的RLM管控框架

Seth Karten, Alex L. Zhang, Kevin Thomas, Sebastian Müller, Elie Bakouch, Daniel Auras, Mika Senghaas, Fares Obeid, Konstantin Dunas, Johannes Hagemann, Sami Jaghouar

机构 * Princeton University(普林斯顿大学) MIT(麻省理工学院) Prime Intellect

AI总结 Prime Agent是一款开源RLM管控框架,通过标准化流程提升模型长周期能力,在ARC-AGI-3等任务中大幅提升性能,支持编码等工作流与并行化任务。

Comments 16 pages, 10 figures. Technical report. Code: this https URL (https://github.com/PrimeIntellect-ai/prime-agent)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23525 2026-08-25 cs.AI 新提交

EarthVerse: Benchmarking Scientific Agents Across Dynamic Earth Systems and Natural Hazards

EarthVerse:面向动态地球系统与自然灾害的科学智能体基准测试

Zhiqing Cui, Xinxiang Yin, Yihong Tang, Xinglang Zhang, Yuanzhe Hu, Siru Zhong, Weidong Tang, Yuxuan Liang, Weijia Li, Ming Jin, Shirui Pan, Yuhao Kang, Dingyi Zhuang, Jinhua Zhao

机构 * NUIST(南京信息工程大学) HKU(香港大学) McGill(麦吉尔大学) HKUST(GZ)(香港科技大学(广州)) Georgia Tech(佐治亚理工学院) NUS(新加坡国立大学) Tsinghua(清华大学) Griffith(格里菲斯大学) UT Austin(德克萨斯大学奥斯汀分校) MIT(麻省理工学院)

AI总结 EarthVerse是面向动态地球系统与自然灾害的科学智能体基准,含405项任务,评估25个智能体系统,发现其存在跨环节一致性不足问题,为科学可靠性测量提供可复现基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23322 2026-08-25 cs.LG 新提交

Beyond Point Predictions: Uncertainty-Aware Satellite Poverty Mapping for Public Policy

超越点预测:面向公共政策的不确定性感知卫星贫困制图

Markus B. Pettersson, James Bailie, Mohammad Kakooei, Eagon Meng, Adel Daoud

机构 * Chalmers University of Technology(查尔姆斯理工大学) University of Gothenburg(哥德堡大学) Linköping University(林雪平大学) Karlstad University(卡尔斯塔德大学) Massachusetts Institute of Technology(麻省理工学院)

AI总结 该研究针对非洲高分辨率贫困数据不足的问题,提出不确定性感知的EO-ML贫困制图方法,生成统计可靠的预测区间,还开发了风险可控的援助分配程序,为政策制定提供可靠补充。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22852 2026-08-25 cs.AI cs.CL q-fin.GN 新提交

Your AI, On a Dial: Controlling Investment Bias in LLMs with a Single Neuron

你的AI,可调节的旋钮:用单个神经元控制大语言模型的投资偏差

Sahong Park, Suhwan Park, Hoyoung Lee, Gakyung Kwon, Wonbin Ahn, Jaewon Choi, Alejandro Lopez-Lira, Yoon Kim, Chanyeol Choi, Hyeongwoo Kong, Yongjae Lee

机构 * Hankuk University of Foreign Studies(韩国外国语大学) UNIST(蔚山科学技术院) LG AI Research(LG AI研究院) Hanwha Life(韩华生命保险) University of Florida(佛罗里达大学) Massachusetts Institute of Technology(麻省理工学院) LinqAlpha

AI总结 本研究提出投资偏差旋钮这一推理时单个神经元干预方法,可在不修改提示或参数的情况下,稳定校准LLM的整体投资立场,且适用于不同场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22154 2026-08-25 cs.LG 新提交

More accurate behavioral predictions with hybrid Bayesian-connectionist models

结合贝叶斯-联结主义的混合模型实现更准确的行为预测

Brenden M. Lake, Akshay K. Jagadish, Guangyuan Jiang

机构 * Princeton University(普林斯顿大学) Princeton AI Lab(普林斯顿人工智能实验室) Massachusetts Institute of Technology(麻省理工学院)

AI总结 该研究提出带行为调优的贝叶斯蒸馏(BBT)混合模型,结合贝叶斯与神经网络模型优势,在人类概念学习案例中更准确预测人类行为并揭示心理学洞见。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21841 2026-08-25 cs.AI cs.HC 新提交

AI Watchdog: Agent Interfaces for Detecting and Defending Against Manipulative Dark Patterns in AI Conversations

AI 看门狗:用于检测和防御 AI 对话中操纵性黑暗模式的智能体接口

Rachel Poonsiriwong, Chayapatr (Pub) Archiwaranguprok, Constanze Albrecht, Monchai Lertsutthiwong, Pattie Maes, Pat Pataranutaporn

机构 * MIT Media Lab(麻省理工学院媒体实验室) KASIKORN Labs(Kasikorn实验室)

AI总结 本研究提出 AI Watchdog 浏览器智能体接口,可检测对话式 AI 的五类黑暗模式,实验发现无认知强制的即时警告能显著降低用户对含黑暗模式的 AI 引导建议的依从性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21544 2026-08-25 cs.CL cs.AI 新提交

Forgotten in Weights, Recovered by Tools: Agentic Tool Unlearning for LLM Agents

权重中遗忘,工具中恢复:面向大语言模型智能体的智能体工具遗忘

Baicheng Chen, Zheyuan Liu, Jingyu Zhang, Kaize Ding, Ningshan Ma, Yue Huang, Meng Jiang

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) University of Notre Dame(圣母大学) Johns Hopkins University(约翰斯·霍普金斯大学) Northwestern University(西北大学) MIT(麻省理工学院)

AI总结 该研究针对大语言模型智能体的工具介导恢复问题,提出两阶段的Agentic Tool Unlearning框架,在RWKU和MUSE数据集上实现了更好的遗忘与保留效用平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21584 2026-08-25 cs.AI cs.CE math.NA 新提交

Data-Driven Dynamic Algorithm Dispatch with Large Language Models

基于大语言模型的数据驱动动态算法调度

Rushil Shah, Emmanuel Lujan, Rabab Alomairy, Alan Edelman

机构 * Massachusetts Institute of Technology(麻省理工学院)

AI总结 该研究提出基于LLaMA 3等的LLM驱动方法,结合性能数据库生成线性代数动态算法调度启发式算法,经LU分解案例验证可复制专家策略,为算法发现及自适应线性代数软件开发提供新方向。

Comments 3 pages, 2 figures. Accepted at the 2025 IEEE High Performance Extreme Computing Conference (HPEC). Outstanding Short Paper Award

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21998 2026-08-25 cs.LG math.NA physics.ao-ph 新提交

DySCo: Dynamically consistent data-driven downscaling of extremes in climate projections

DySCo:气候预测中极端事件的动态一致数据驱动降尺度方法

S. Stamatelopoulos, M. Wang, I. Lopez-Gomez, L. Zepeda-Nunez, Z. Y. Wan, R. Carver, F. Sha, T. P. Sapsis

机构 * Massachusetts Institute of Technology(麻省理工学院) City University of Hong Kong(香港城市大学) Google Research(谷歌研究院)

AI总结 针对气候降尺度中动态一致性缺失的挑战,提出DySCo框架,通过数据驱动的张弛法重构训练动态配对轨迹,训练两阶段算子,在保持统计性能的同时提升动态一致性,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21752 2026-08-25 cs.LG cond-mat.dis-nn cs.IT 新提交

Width-Independent Compressibility of Deep Neural Networks

深度神经网络的与宽度无关的可压缩性

Hong-Yi Wang, Mingze Wang, Liu Ziyin

机构 * Princeton University(普林斯顿大学) Peking University(北京大学) Massachusetts Institute of Technology(麻省理工学院)

AI总结 该研究针对深度多层感知机证明了与原网络宽度无关的可压缩性定理,提出含导数匹配技术与逐层重加权的构造方法,得出压缩宽度量级公式,为神经网络压缩提供理论支撑。

Comments 11 pages main text, 28 pages total, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏