arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

International Conference on Learning Representations · 会议 · Machine Learning

2026-04-29 至 2026-04-29 共收录 5
2604.25779 2026-04-29 cs.LG cs.AI

Sustained Gradient Alignment Mediates Subliminal Learning in a Multi-Step Setting: Evidence from MNIST Auxiliary Logit Distillation Experiment

持续的梯度对齐在多步骤设置中介导了潜意识学习:基于MNIST辅助logit蒸馏实验的证据

Chayanon Kitkana, Shivam Arora

机构 * Independent(独立) Equivariant labs(等变实验室)

AI总结 该研究通过MNIST辅助logit蒸馏实验发现,梯度对齐在多步骤训练中持续正向影响潜意识学习,提出liminal训练方法未能有效抑制特质获取。

Comments Published in ICLR 2026 Sci4DL Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25297 2026-04-29 cs.CL cs.AI

LegalMidm: Use-Case-Driven Legal Domain Specialization for Korean Large Language Model

LegalMidm: 面向韩国法律领域的用例驱动型法律领域专业化

Youngjoon Jang, Chanhee Park, Hyeonseok Moon, Young-kyoung Ham, Jiwon Moon, Jinhyeon Kim, JuKyung Jung, Heuiseok Lim

机构 * Department of Computer Science and Engineering, Korea University(韩国大学计算机科学与工程系) KT (Korea Telecom)(韩国电信)

AI总结 本文提出基于法律领域实际需求的系统训练框架,开发了韩国法律领域的LLM LegalMidm,并通过与法律专业人士合作和严格数据筛选,构建高质量的用例驱动型法律数据集和优化训练流程。

Comments ICLR 2026 DATA-FM Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24877 2026-04-29 cs.CV cs.AI cs.LG eess.IV

Learning Illumination Control in Diffusion Models

在扩散模型中学习光照控制

Nishit Anand, Manan Suri, Christopher Metzler, Dinesh Manocha, Ramani Duraiswami

机构 * University of Maryland College Park(马里兰大学学院公园分校)

AI总结 本文提出一个完全开源的管道,通过生成光照控制训练三元组来改进扩散模型的光照控制,实验显示在感知相似性、结构相似性和身份保持方面优于基线模型。

Comments Accepted to ICLR 2026 ReALM-GEN Workshop on Diffusion Models. Project Website: https://nishitanand.github.io/relighting-diffusion-website

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10946 2026-04-29 cs.LG math.OC

Learning to Adapt: In-Context Learning Beyond Stationarity

学习以适应:超越平稳性的上下文学习

Zhen Qin, Jiachen Jiang, Zhihui Zhu

机构 * Michigan Institute for Computational Discovery and Engineering(密歇根计算发现与工程研究所) Department of Electrical Engineering and Computer Science(电气工程与计算机科学系) Department of Statistics(统计学系) University of Michigan(密歇根大学) Department of Computer Science and Engineering(计算机科学与工程系) The Ohio State University(俄亥俄州立大学)

AI总结 本文研究了非平稳回归问题中上下文学习的理论机制,揭示了门控线性注意力机制在动态环境下的适应性优势。

Journal ref The Fourteenth International Conference on Learning Representations, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20941 2026-04-29 cs.LG

Revisiting the Past: Data Unlearning with Model State History

重访过去:利用模型状态历史的数据遗忘

Keivan Rezaei, Mehrdad Saberi, Abhilasha Ravichander, Soheil Feizi

机构 * Department of Computer Science, University of Maryland(大学马里兰大学计算机科学系) Max Planck Institute for Software Systems(马克斯·普朗克软件系统研究所)

AI总结 本文提出MSA算法,通过利用预训练过程中的模型检查点来估计并抵消特定数据点的影响,实验证明其在多个基准、模型和评估指标上表现优异,为更灵活的数据擦除大型语言模型提供有效方法。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏