arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

2026-08-31 至 2026-08-31 共收录 2
2510.00938 2026-08-31 cs.LG 版本更新

Large Reasoning Models Learn Better Alignment from Flawed Thinking

大规模推理模型通过 flawed thinking 学习更好的对齐

ShengYun Peng, Pin-Yu Chen, Eric Smith, Song Jiang, Hongyuan Zhan, Haozhu Wang, Mahesh Pasupuleti, Duen Horng Chau, Jianfeng Chi

机构 * Meta Superintelligence Labs(Meta超级智能实验室) IBM Research(IBM研究院)

AI总结 RECAP通过强化学习提升模型安全对齐能力,减少偏见并增强鲁棒性,同时保持推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08289 2026-08-31 cs.LG cs.AI q-bio.NC 版本更新

Attention as Conditioning: What Classical Learning Theory Predicts About Linear Transformers

作为条件的注意力:经典学习理论对线性Transformer的预测

Mu Qiao

机构 * Meta Platforms, Inc.(Meta公司)

AI总结 该研究将线性Transformer的注意力机制与经典动物学习理论模型对应,推导卡明阻塞闭式解,发现不同注意力的线索竞争差异及容量机制,提出PH-注意力规则。

详情

展开后加载摘要…

URL PDF HTML 收藏