arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Apple(苹果)

2026-04-28 至 2026-04-28 共收录 5
2604.24416 2026-04-28 cs.CL cs.AI cs.LG

Scaling Properties of Continuous Diffusion Spoken Language Models

连续扩散口语语言模型的可扩展性特性

Jason Ramapuram, Eeshan Gunesh Dhekane, Amitis Shidani, Dan Busbridge, Bogdan Mazoure, Zijin Gu, Russ Webb, Tatiana Likhomanenko, Navdeep Jaitly

机构 * Apple(苹果公司)

AI总结 本文研究连续扩散口语语言模型在性能上的可扩展性,提出基于音素Jensen-Shannon散度的评估指标,发现其在参数规模增加时生成质量提升,但长文本连贯性仍面临挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23888 2026-04-28 cs.LG cs.AI

Geometry Preserving Loss Functions Promote Improved Adaptation of Blackbox Generative Model

几何保持损失函数促进黑盒生成模型的改进适应

Sinjini Mitra, Constantine Kyriakakis, Shenyuan Liang, Anuj Srivastava, Pavan Turaga

机构 * Geometric Media Lab(几何媒体实验室) Arizona State University(亚利桑那州立大学) Department of Statistics(统计学系) Florida State University(佛罗里达州立大学) Department of Computer Science and Engineering(计算机科学与工程系) Seoul National University of Science and Technology(首尔科学技术大学) Amazon(亚马逊) Apple Inc.(苹果公司)

AI总结 本文提出基于几何保持损失函数的端到端管道,用于改进黑盒生成模型的领域适应,通过重新上下文化GAN反向过程来获得准确的潜在空间表示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23148 2026-04-28 cs.AI

PhySE: A Psychological Framework for Real-Time AR-LLM Social Engineering Attacks

PhySE: 一种用于实时AR-LLM社会工程攻击的心理学框架

Tianlong Yu, Yang Yang, Ziyi Zhou, Jiaying Xu, Siwei Li, Tong Guan, Kailong Wang, Ting Bi

机构 * Hubei University(湖北大学) Apple Inc(苹果公司) Huazhong University of Science and Technology(华中科技大学)

AI总结 PhySE通过视觉语言模型的社会上下文训练和自适应心理代理,解决AR-LLM社会工程攻击中的冷启动个性化和静态攻击策略问题,提升实时交互效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22985 2026-04-28 cs.CL

Uncertainty Quantification for LLM Function-Calling

大语言模型函数调用的不确定性量化

Zihuiwen Ye, Lukas Aichberger, Michael Kirchhof, Sinead Williamson, Luca Zappella, Yarin Gal, Arno Blaas, Adam Golinski

机构 * University of Oxford(牛津大学) Apple(苹果公司)

AI总结 本文研究了大语言模型函数调用中不确定性量化的关键问题,发现多样本方法在自然语言问答中表现优异,但在函数调用场景中不如单样本方法有效,并提出利用函数调出输出特性改进现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22782 2026-04-28 cs.LG cs.AI

Stochastic KV Routing: Enabling Adaptive Depth-Wise Cache Sharing

随机KV路由:实现自适应深度-wise缓存共享

Anastasiia Filippova, David Grangier, Marco Cuturi, João Monteiro

机构 * Apple(苹果公司)

AI总结 本文提出通过随机跨层注意力机制实现高效的深度-wise缓存共享,减少内存占用并提升推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏