MetaPerch: Learning from metadata for bioacoustics foundation models
MetaPerch:从元数据学习生物声学基础模型
AI总结 研究利用生物声学数据中心的元数据,将位置、时间等元数据作为辅助监督信号,引入MetaPerch基础模型,提升物种识别性能,还对9种元数据源在17个数据集上的效果做了实证研究。
Comments Accepted to ICML 26
期刊&会议
International Conference on Machine Learning · 会议 · Machine Learning
MetaPerch:从元数据学习生物声学基础模型
AI总结 研究利用生物声学数据中心的元数据,将位置、时间等元数据作为辅助监督信号,引入MetaPerch基础模型,提升物种识别性能,还对9种元数据源在17个数据集上的效果做了实证研究。
Comments Accepted to ICML 26
举报人似是而非的可否认性保障
机构 * University College London(伦敦大学学院) ; École Polytechnique de Montréal(蒙特利尔理工学院) ; Mila - Québec Artificial Intelligence Institute(魁北克人工智能研究所)
AI总结 研究如何保障举报人,针对现有保护提案和差分隐私机制不足,形式化逐报告(0,δ)-差分隐私,证明随机响应不比均匀随机审计好超δ,给出通用机制简化私人审计,实例化后有良好效果,模拟显示优于随机响应。
Comments Accepted at three ICML 2026 workshops, including the ICML Workshop on Technical AI Governance Research
神经网络的海森谱如何依赖于数据
AI总结 研究神经网络海森谱与数据的关系,推导线性网络海森矩阵特征值,发现分类任务中解的锐度与样本类别比例有关,经实验验证预测并分析相关影响,结论适用于更实际学习设置。
Comments 15 pages, 8 figures; Accepted at HiLD@ICML'26
共生启发的知识蒸馏用于增量目标检测
AI总结 研究增量目标检测问题,提出共生启发的知识蒸馏方法(SIKD),通过空间共生蒸馏和语义共生蒸馏在两个层面利用对象共生,有效解决现有方法不足,实验验证了该方法的有效性和优越性。
Comments 16 pages, 8 figures, Accepted by ICML 2026
局部冗余:一种基于合成记忆的可塑性信息论度量
AI总结 研究神经网络可塑性度量,引入基于通用压缩理论的局部冗余,将其定义为局部模型族最坏情况冗余,证明期望平方梯度范数可作下界,实验表明该度量比现有方法更能预测下游性能并助于预训练检查点选择。
Comments 13 pages, 7 figures. ICML 2026 (Spotlight)
统计优势是否值得付出成本?KANs和MLPs在结构化数据分类中的实证比较
机构 * Institute of Computer Science, University of the Philippines Los Baños(菲律宾大学洛斯巴尼奥斯分校计算机科学研究所) ; Machine Learning and Artificial Intelligence Applications Lab, University of the Philippines Los Baños(菲律宾大学洛斯巴尼奥斯分校机器学习与人工智能应用实验室)
AI总结 该研究对KANs和MLPs在结构化表格分类任务上进行实证比较,在标准化设置下训练并评估性能。结果显示KANs在二元和多类领域统计上更优,但效应量表明其有更高复杂度。结论是KANs适用于高精度应用,MLPs对资源受限环境更合适,未来应扩展分析。
Comments To be presented at the 9th International Conference on Machine Learning and Machine Intelligence (MLMI 2026), Tokyo, Japan
拒绝残差:探测何时能捕捉到对齐造假以及何时不能
机构 * Snowflake AI Research(Snowflake AI 研究所)
AI总结 研究对齐造假中隐藏状态能否揭示输出隐藏内容,对13个模型扫描,发现Qwen3 - 32B和Llama - 3.1 - 8B存在自然造假及不对称拒绝残差,样本检测有模型条件性,还发布五控制测量框架用于对齐造假检测。
Comments Accepted to the Mechanistic Interpretability Workshop at ICML 2026. 12 pages, 4 figures
从神经网络中定向恢复权重空间机制
AI总结 研究提出定向参数分解(tPD)方法,通过引入高秩通用组件,从神经网络中仅识别处理特定感兴趣输入的组件,在玩具模型和Transformer语言模型上验证有效,能以低计算量提取子模型并对记忆序列进行手术式操作。
Comments Accepted at the Mechanistic Interpretability Workshop, ICML 2026
困惑陷阱:专利法何时让人类写作看起来像人工智能
机构 * European Patent Office(欧洲专利局)
AI总结 研究针对专利法下筛选疑似人工智能生成专利文本的难题,在消费级硬件条件下用多种策略进行基准测试,发现现有检测器误报率高,问题是结构性的,提出七特征语言复杂性逻辑回归方法,提升了准确率。
Journal ref Proceedings of the ICML 2026 Workshop on AI4Law
我们合并的模型正确吗?专家训练时长对大语言模型模型合并的影响
AI总结 研究领域专家训练时长对大语言模型模型合并质量的影响,在多领域多模型规模上微调专家模型,保存不同训练步数的检查点并评估五种合并方法,发现方法依赖模式,表明训练时长和合并方法应联合选择。
Comments Accepted to ICML 2026 workshop on weight-space symmetries
M+Adam:通过加法-乘法优化进行低精度训练
机构 * California Institute of Technology(加利福尼亚理工学院) ; University of Copenhagen(哥本哈根大学) ; Aarhus University(阿鲁斯大学)
AI总结 研究低精度训练中标准优化器的问题,提出结合加法和乘法更新的M+Adam方法,经证明在标准假设下单调下降,在多种模型预训练中持续改善低精度训练。
Comments Accepted at the 43rd International Conference on Machine Learning (ICML 2026). 45 pages
表格数据的上下文学习算法补救
机构 * Mohamed bin Zayed University of Artificial Intelligence, United Arab Emirates(阿联酋人工智能马尔代夫 bin Zayed 大学) ; University of Copenhagen, Denmark(丹麦哥本哈根大学) ; Renmin University of China, China(中国人民大学) ; King Abdullah University of Science and Technology, Saudi Arabia(沙特阿拉伯王国科学与技术大学) ; The Hong Kong University of Science and Technology(Guangzhou), China(广州科技大学(香港))
AI总结 针对表格数据上下文学习中的黑箱模型,提出自适应子空间补救框架ASR-ICL,通过零阶优化高效生成可操作且稀疏的补救方案,理论证明补救有界且随上下文增大收敛至经典解。
Comments Accepted by ICML 2026
AvAtar: 通过主动最优输运学习对齐
机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) ; University of Florida(佛罗里达大学) ; Arizona State University(亚利桑那州立大学)
AI总结 提出AvAtar框架,利用主动学习策略通过熵正则化最优输运的梯度影响量化候选点信息量,并采用伴随状态法高效求解,以提升对齐性能。
Comments Published as a conference paper at ICML 2026
基于LLM的定性与定量评估的常微分方程发现
机构 * Department of Artificial Intelligence, Chung-Ang University, Seoul, Republic of Korea(韩国首尔 Chung-Ang 大学人工智能系) ; Daejin University, Pocheon, Republic of Korea(韩国坡州市 Daejin 大学)
AI总结 本文提出DoLQ方法,通过多智能体架构结合LLM进行定性与定量评估,实现常微分方程的发现,实验表明其在多维ODE基准测试中性能优于现有方法。
Comments Accepted at ICML 2026
Journal ref International Conference on Machine Learning 2026
当智能体与自身意见相左:测量基于LLM的智能体的行为一致性
机构 * Aman Mehta
AI总结 研究发现基于LLM的智能体在相同任务上运行结果不一致,且这种不一致与任务成功率密切相关,通过监控行为一致性可提升智能体可靠性。
Comments Accepted at the ICML 2026 Workshop on Statistical Frameworks for Uncertainty in Agentic Systems. 12 pages, 9 figures
并非所有线索都能被发现:事实分布和“不要编造”提示如何影响长上下文语言模型中的检索、推理和幻觉
机构 * Department of Electrical Engineering & Computer Science University of Michigan(电气工程与计算机科学系 密歇根大学)
AI总结 研究大语言模型中事实分布和反幻觉提示对检索、推理及幻觉的影响,通过扩展基准评估多个模型,识别出分布崩溃和安全代价两种失败模式,发现许多失败源于无效上下文利用,强调特定模型稳健性和上下文管理的重要性。
Comments 16 pages, 8 figures, 2 tables. Accepted at the FAGEN Workshop @ ICML 2026
在OTFS接收机中基于深度学习的低延迟分数信道估计
AI总结 本文提出一种基于深度学习的低延迟分数信道估计方法,用于OTFS接收机,通过时频学习框架提升估计精度并减少延迟,但存在高信噪比下的性能损失。
Comments IEEE ICMLCN 2025, 26-29 May 2025 Barcelona, Spain
Journal ref 2025 IEEE International Conference on Machine Learning for Communication and Networking (ICMLCN)