arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

2026-06-25 至 2026-06-25 共收录 4
2606.26091 2026-06-25 cs.LG cs.AI 新提交

On-Policy Self-Distillation with Sampled Demonstrations Reduces Output Diversity

基于采样演示的在线自蒸馏降低了输出多样性

Andrei Liviu Nicolicioiu, Mohammad Pezeshki, Aaron Courville

机构 * Mila Université de Montréal(蒙特利尔大学) FAIR at Meta(Meta的FAIR) CIFAR AI Chair(CIFAR人工智能主席)

AI总结 本文发现在线自蒸馏虽提升pass@1准确率,但会降低输出多样性并导致pass@k曲线平坦,通过理论分析揭示了其放大概率差距的机制,并在路径规划与科学问答任务中验证了该问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25225 2026-06-25 cs.CV cs.LG 新提交

MJEPA: A Simple and Scalable Joint-Embedding Predictive Architecture for Audio-Visual Learning

MJEPA:一种简单且可扩展的音频-视觉联合嵌入预测架构

Revant Teotia, Adrien Bardes, Michael Rabbat, Sumit Chopra, Matthew J. Muckley, Nicolas Ballas

机构 * FAIR at Meta(Meta AI研究实验室) New York University(纽约大学)

AI总结 提出MJEPA,使用统一编码器和单一预测目标进行跨模态预测,在音频分类任务上超越先前方法,并减少视频数据需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25115 2026-06-25 cs.LG cs.NI 新提交

Forget to Improve: On-Device LLM-Agent Continual Learning via Budget-Curated Memory

遗忘以改进:通过预算策划内存的设备端LLM智能体持续学习

Beining Wu, Zihao Ding, Jun Huang, Yanxiao Zhao

机构 * Apple(苹果) Google(谷歌) Microsoft(微软) Meta Alibaba(阿里巴巴)

AI总结 提出净价值每字节评分机制,在设备端智能体内存中权衡价值与危害,实现预算约束下的记忆保留、共享与信任决策,降低内存和上行带宽并防御注入攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.01741 2026-06-25 cs.CR cs.AI cs.AR cs.LG 版本更新

PVF:Understanding AI Vulnerability Against SDCs

PVF:理解AI对SDC的脆弱性

Xun Jiao, Fred Lin, Harish D. Dixit, Joel Coburn, Sajin Nair, Abhinav Pandey, Han Wang, Venkat Ramesh, Jianyu Huang, Daniel Moore, Sriram Sankar

机构 * Meta Platforms, Inc(Meta平台)

AI总结 提出参数脆弱性因子(PVF)量化AI模型对参数损坏的脆弱性,应用于推荐、视觉和文本分类模型,并用于Meta AI芯片的错误管理设计。

详情

展开后加载摘要…

URL PDF HTML 收藏