When Scores Learn Geometry: Rate Separations under the Manifold Hypothesis
当分数学习几何:在流形假设下速率分离
AI总结 本文提出分数学习数据流形而非完整分布的观点,揭示小σ regime下流形信息强于分布信息,推动几何学习范式转变,通过扩散模型、流形均匀分布和贝叶斯逆问题验证理论。
Comments Accepted at ICLR 2026
期刊&会议
International Conference on Learning Representations · 会议 · Machine Learning
当分数学习几何:在流形假设下速率分离
AI总结 本文提出分数学习数据流形而非完整分布的观点,揭示小σ regime下流形信息强于分布信息,推动几何学习范式转变,通过扩散模型、流形均匀分布和贝叶斯逆问题验证理论。
Comments Accepted at ICLR 2026
突破SFT平台:面向图表到代码生成的多模态结构强化学习
AI总结 本文提出多模态结构强化学习(MSRL)以突破SFT平台,通过大规模实验构建最大训练语料库,并采用双阶段课程训练策略,提升图表到代码生成的高阶指标。
Comments Accepted to ICLR 2026
FingerTip 20K: 一个用于主动和个性化移动大语言模型代理的基准测试
AI总结 本文提出FingerTip 20K基准测试,通过收集20000个真实用户多步骤Android交互演示,评估主动任务建议和个性化任务执行的挑战,展示基于用户信息的移动LLM代理的潜力。
Comments ICLR 2026 Poster
MMSU:一个大规模多任务语音语言理解与推理基准
AI总结 MMSU基准通过整合语音的语义、语调和语音学特征,评估语音语言理解与推理能力,发现现有模型存在改进空间,为开发更高级的人机语音交互系统提供新标准。
Comments ICLR 2026. MMSU benchmark is available at https://huggingface.co/datasets/ddwang2000/MMSU. Project page https://github.com/dingdongwang/MMSU
从评估到防御:推进视频大语言模型的安全性
AI总结 本文提出VideoSafety-R1框架,通过创新方法提升视频大语言模型的安全性,实验显示其在多个安全数据集上取得显著提升。
Comments Accepted at ICLR 2026
宇宙路由:为何自我进化智能体需要认知控制
AI总结 本文提出宇宙路由问题,探讨智能体在不同信念空间中选择推理框架的挑战,发现硬路由到异构求解器在准确性和效率上优于软MoE,并展示语义推理优于表面推理,模块化认知架构更适应终身学习。
Comments 10 pages. Accepted at the LLA Workshop at ICLR 2026 (camera-ready version)
医学 MLLMs 如何失效?对医学图像中视觉语义关联的探讨
AI总结 本文研究了医学 MLLMs 在视觉关联上的不足,通过设计 VGMED 数据集和 VGRefine 方法,验证了其在医学图像任务中的性能瓶颈。
Comments Published as a conference paper at ICLR 2026
全天多场景终身视觉-语言导航与Tucker适应
AI总结 本文提出Tucker适应方法,解决视觉-语言导航在多场景下的持续学习问题,通过高阶张量分解实现知识解耦,提升长期部署灵活性。
Comments ICLR 2026
理解下一token预测器中看似无用特征的出现
AI总结 研究探讨了训练中的Transformer模型如何计算看似冗余的抽象特征,并提出方法分析梯度信号对特定特征形成的影响,通过玩具任务和小型模型验证,揭示了预训练语言模型中形式推理领域特征的产生机制。
Comments ICLR 2026
缺失质量用于差分隐私领域发现
AI总结 本文研究了差分隐私领域发现中的多个问题,提出基于加权高斯机制的WGM在Zipfian数据上具有近最优的ℓ1缺失质量保证,并为未知领域变体的隐私top-k和k-覆盖集算法提供了新的效用保证。
Comments ICLR 2026
Sat-JEPA-Diff: 联合自监督学习与生成扩散模型以实现遥感图像预测
AI总结 本文提出Sat-JEPA-Diff,结合自监督学习与隐藏扩散模型,解决遥感图像预测中结构准确与纹理细节的平衡问题,实现高精度纹理生成与结构预测的结合。
Comments ICLR 2026 Workshop ML4RS Main Track: https://openreview.net/forum?id=WBHfQLbgZR
Journal ref 4th ICLR 2026 Workshop on Machine Learning for Remote Sensing (Main Track)
验证多智能体协调:复杂查询解析的计划-执行-验证-重计划框架
AI总结 本文提出VMAO框架,通过验证驱动的迭代循环协调专用LLM代理,提升复杂查询解答的完整性和来源质量。
Comments ICLR 2026 Workshop on MALGAI
CHLU:作为深度学习的辛原初的因果哈密顿学习单元
AI总结 本文提出CHLU,一种基于物理的计算学习原初,通过 enforcing 相对论哈密顿结构和利用辛积分,严格保持相空间体积,以解决记忆稳定性权衡问题,并在MNIST数据集上展示其生成能力。
Comments Accepted as a short paper at ICLR 2026 (AI & PDE)
细粒度微调会削弱视觉语言代理的安全对齐
AI总结 研究发现细粒度微调在有害数据集上会导致广泛的任务和模态对齐偏差,且单模态安全基准可能低估视觉语言模型的对齐退化。
Comments 25 pages, 14 figures, Published at the Lifelong Agent Workshop at ICLR 2026
无穷尽:VAR和扩散T2I模型中的组合对齐
AI总结 本文评估了六种T2I模型在组合对齐上的表现,发现Infinity-8B在整体对齐上表现最佳,而Infinity-2B在多个类别中表现优异,揭示了高效性能的平衡。
Comments Accepted at the ICLR 2026 Workshop on Multimodal Intelligence: Next Token Prediction and Beyond
RESCUE:检索增强型安全代码生成
AI总结 RESCUE通过构建混合知识库和分层多维检索提升安全代码生成,实验显示其在SecurePass@1指标上平均提升4.8点,达到新水平。
Comments Accepted to ICLR'2026
迈向理解大型语言模型对齐的有价值偏好数据
AI总结 本文研究了大型语言模型对齐中偏好数据的质量问题,提出截断影响函数(TIF)评估数据质量,并引入两种计算更简单的评分函数以提高偏好数据选择的准确性。
Comments Accepted by ICLR 2026
Purrception:基于向量量化图像生成的变分流匹配
AI总结 Purrception结合连续方法的几何意识与离散监督的分类监督,通过学习代码本索引的类别后验和连续嵌入空间中的速度场,实现对潜在代码的不确定性量化和温度控制生成。
Comments Published as a conference paper at ICLR 2026
ExoPredicator:为机器人规划学习动态世界的抽象模型
AI总结 本文提出ExoPredicator框架,通过联合学习符号状态表示和因果过程,解决长周期具身规划中的外源性过程建模问题,实现对复杂任务的泛化能力。
Comments ICLR 2026. The last two authors contributed equally in co-advising
归纳签名不足:匹配计算下的上下文学习负载结构研究
AI总结 通过Bi-Induct研究上下文学习中归纳结构的负载能力,发现归纳头部活动增加但泛化能力未提升,揭示了归纳与反归纳的不对称性。
Comments Published as a paper at 3rd DATA-FM workshop @ ICLR 2026, Brazil
空域过滤用于无数据连续模型融合:保持稳定性,促进可塑性
AI总结 本文提出NUFILT框架,通过参数空间优化实现无数据连续模型融合,保持稳定性并促进可塑性,实验表明其在视觉和NLP基准上表现优异,减少遗忘并降低计算开销。
Comments Accepted by ICLR 2026
通过对抗强化学习学习生成单元测试
AI总结 本文提出UTRL框架,通过对抗强化学习训练LLM生成高质量单元测试,实验表明其优于监督微调和前沿模型。
Comments Accepted to ICLR 2026. Code is available at: https://github.com/dgjun32/UTRL
FeDaL:联邦数据学习用于通用时间序列基础模型
AI总结 本文提出FeDaL方法,通过联邦学习 paradigm 解决时间序列异质性问题,通过DBE和GBE机制消除偏差,验证了跨数据集泛化能力。
Comments Accepted by ICLR 2026
共奖励:用于大型语言模型中激发推理的稳定自监督强化学习
AI总结 本文提出Co-rewarding框架,通过引入互补监督提升训练稳定性,通过对比一致性和模型蒸馏方法,在多个数学推理基准上实现性能提升,尤其在Llama-3.2-3B-Instruct上表现突出。
Comments Accepted by ICLR 2026
Lumos-1:从统一模型视角看基于离散扩散的自回归视频生成
AI总结 Lumos-1提出一种基于LLM的统一模型,通过改进的MM-RoPE和离散扩散机制,在高效生成视频方面超越现有模型,适用于多种视频评估基准。
Comments ICLR 2026 Camera Ready Version. Code and Models: https://github.com/alibaba-damo-academy/Lumos
TRACED:基于共学习性的环境设计过渡感知 regrets 近似
AI总结 TRACED通过引入过渡预测误差和共学习性指标,改进了环境设计中的 regrets 近似方法,提升了零样本泛化能力。
Comments ICLR 2026
AMPED: 自适应多目标投影用于平衡探索与技能多样化
AI总结 本文提出AMPED方法,通过梯度手术投影平衡探索与多样性,在预训练和微调阶段均提升技能学习性能,实验表明其优于SBRL基线。
Comments ICLR 2026
基于块状不确定性的结构表示学习用于海底制图
AI总结 本文提出一种基于块状不确定性的方法,利用VQ-VAE架构在保持地形特征的同时,通过离散潜在表示实现空间自适应的置信度估计,提升海底制图的重建质量和不确定性估计可靠性。
Journal ref Tackling Climate Change with Machine Learning Workshop, ICLR 2025
贪心信息投影用于大语言模型数据选择
AI总结 本文提出贪心信息投影框架,通过最大化子集与任务查询信号的互信息,平衡质量与多样性,高效选择数据集进行微调。
Comments Published as a paper at 3rd DATA-FM workshop @ ICLR 2026, Brazil
LiveWeb-IE:一个在线网页信息提取的基准测试
AI总结 本文提出LiveWeb-IE基准测试,用于评估在线网页信息提取系统,通过活体网站和多阶段代理框架VGS,提升信息提取的准确性和鲁棒性。
Comments ICLR 2026