arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Learning Representations · 会议 · Machine Learning

2026-06-24 至 2026-06-24 共收录 8
2606.24543 2026-06-24 cs.LG 新提交

Reasoning as Attractor Dynamics: Latent Memory Retrieval via Gibbs-Weighted Energy Minimization

推理作为吸引子动力学:通过吉布斯加权能量最小化的潜在记忆检索

Kanishk Awadhiya

机构 * Independent Researcher(独立研究者)

AI总结 提出将大语言模型视为高维稠密联想记忆,通过吉布斯加权能量最小化从潜在吸引子中检索正确推理链,在GSM8K上提升Phi-3.5性能5.38%。

Comments Accepted at ICLR Workshop 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24408 2026-06-24 cs.LG 新提交

Natural Identifiers for Privacy and Data Audits in Large Language Models

大型语言模型中用于隐私和数据审计的自然标识符

Lorenzo Rossi, Bartłomiej Marek, Franziska Boenisch, Adam Dziedzic

机构 * CISPA Helmholtz Center for Information Security(CISPA 欧洲信息安全中心)

AI总结 提出自然标识符(NIDs)解决LLM隐私审计难题,无需重训练即可进行事后差分隐私审计和数据集推断。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24396 2026-06-24 cs.LG 新提交

Parallel Manifold Steering: Efficient Adaptation of Large Associative Memories via Residual Energy Shaping

并行流形引导:通过残差能量塑形实现大型联想记忆的高效适应

Kanishk Awadhiya

机构 * Independent Researcher(独立研究员)

AI总结 提出H-Res机制,通过残差能量塑形在不改变全局平衡或扩展序列长度的情况下调节Transformer的能量景观,实现高效任务适应,在联想检索任务上比全局权重修改提升26%并消除提示方法的计算开销。

Comments Accepted at ICLR Workshop 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24192 2026-06-24 cs.CV cs.AI cs.CL 新提交

Co-occurring associated retained concepts in Diffusion Unlearning

扩散模型遗忘中的共现关联保留概念

Miso Kim, Georu Lee, Yunji Kim, Hoki Kim, Jinseong Park, Woojin Lee

机构 * Dongguk University-Seoul(东国大学-首尔) Chung-Ang University(Chung-Ang 大学) Korea Institute for Advanced Study(韩国高级研究院)

AI总结 针对扩散模型遗忘中误删良性共现概念的问题,提出CARE评分量化保留程度,并设计ReCARE框架通过自动构建CARE集实现稳健遗忘,平衡概念擦除、整体效用与共现概念保留。

Comments Accepted as a poster at ICLR 2026. Code available at https://github.com/damilab/CARE

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05174 2026-06-24 cs.MA cs.AI

Emergent Coordination in Multi-Agent Language Models

多智能体语言模型中的涌现协调

Christoph Riedl

机构 * D’Amore-McKim School of Business(达莫-麦克金商学院) Khoury College of Computer Sciences(科里学院计算机科学学院) Network Science Institute(网络科学研究所) Northeastern University(东北大学)

AI总结 研究探讨多智能体系统是否形成更高层次结构,提出信息论框架通过数据驱动方法检测动态涌现,验证身份差异化与目标互补性,揭示交互模式与集体智慧原理的关联。

Journal ref International Conference on Learning Representations (ICLR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17388 2026-06-24 cs.CL cs.LG 版本更新

Selective Rotary Position Embedding

选择性旋转位置嵌入

Sajad Movahedi, Timur Carstensen, Arshia Afzal, Frank Hutter, Antonio Orvieto, Volkan Cevher

机构 * ELLIS Institute Tübingen(图宾根埃利斯研究所) LIONS, EPFL(日内瓦理工学院LIONS实验室) University of Freiburg(弗赖堡大学) Max-Planck-Institute for Intelligent Systems(智能系统马克斯·普朗克研究所) Prior Labs(Prior实验室)

AI总结 本文提出选择性RoPE,一种输入依赖的旋转嵌入机制,适用于线性和softmax变压器,通过任意角度旋转提升语言建模和复杂序列任务性能。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06802 2026-06-24 cs.AI 版本更新

Riemann-Bench: A Benchmark for Moonshot Mathematics

Riemann-Bench: 面向登月级数学的基准测试

Suhaas Garre, Erik Knutsen, Sushant Mehta, Edwin Chen

机构 * Surge AI

AI总结 提出Riemann-Bench基准,由专家设计研究级数学问题,评估AI系统超越奥数水平的推理能力,结果显示前沿模型得分低于10%。

Comments Accepted to Logical Reasoning of Large Language Models, ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04767 2026-06-24 cs.LG 版本更新

ParallelBench: Understanding the Trade-offs of Parallel Decoding in Diffusion LLMs

ParallelBench: 理解扩散大语言模型中并行解码的权衡

Wonjun Kang, Kevin Galim, Seunghyuk Oh, Minjae Lee, Yuchen Zeng, Shuibai Zhang, Coleman Hooper, Yuezhou Hu, Hyung Il Koo, Nam Ik Cho, Kangwook Lee

机构 * FuriosaAI UW-Madison(威斯康星大学麦迪逊分校) Microsoft Research(微软研究院) UC Berkeley(加州大学伯克利分校) Seoul National University(首尔国立大学) KRAFTON Ludo Robotics Project(Ludo机器人项目)

AI总结 针对扩散LLM并行解码导致生成质量下降的问题,通过信息论分析和合成实验揭示其根本限制,并提出首个专门基准ParallelBench,系统评估发现并行解码在现实任务中质量损失严重,且现有策略无法根据任务难度调整并行度。

Comments Accepted at ICLR 2026. Project Page: https://parallelbench.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏