arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Oracle(甲骨文)

2026-08-25 至 2026-08-25 共收录 3
2608.22761 2026-08-25 cs.CL cs.AI cs.LG 新提交

Don't Repeat Yourself: Stopping Verbatim Loops at Sampling Time

不要重复你自己:在采样时停止逐字循环

Philipp Emanuel Weidmann, Allen Roush, Judah Goldfeder, Sanjay Basu, Ravid Shwartz-Ziv

机构 * Thoughtworks Columbia University(哥伦比亚大学) Oracle(甲骨文公司) New York University(纽约大学)

AI总结 研究针对大语言模型的逐字循环问题,提出采样时的DRY对数几率调整方法,在多模型和研究中有效降低循环率并保持性能,已被开源LLM推理框架采用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22758 2026-08-25 cs.CL cs.AI cs.LG 新提交

XTC: Head-Aware Sampling by Excluding Top Choices

XTC:通过排除顶部选择的头感知采样

Philipp Emanuel Weidmann, Allen Roush, Judah Goldfeder, Sanjay Basu, Ravid Shwartz-Ziv

机构 * Thoughtworks(Thoughtworks公司) Columbia University(哥伦比亚大学) Oracle(甲骨文公司) New York University(纽约大学)

AI总结 XTC是一种轻量头感知解码算子,通过排除部分高概率词元改善自回归语言模型的多样性-重复帕累托前沿,在多项实验中提升创意生成效果且准确率损失极小,已被多个工具采用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21775 2026-08-25 cs.CL 新提交

No One Model Catches Every Harm: Benchmarking Content Moderation Across Safety Scenarios

没有一种模型能应对所有危害:跨安全场景的内容审核基准测试

Afshin Orojlooyjadid, Hitesh Patel

机构 * Oracle AI(甲骨文人工智能)

AI总结 该研究测试53个模型在11个数据集的四类安全场景下的表现,发现前沿模型在部分场景落后于专用模型,实际对话安全未解决,挑战规模即安全的假设并提供模型选择框架。

Comments EMNLP 2026 Main Track

详情

展开后加载摘要…

URL PDF HTML 收藏