Aligned, Orthogonal or In-conflict: When can we safely optimize Chain-of-Thought?
对齐、正交或冲突:何时可以安全地优化思维链?
机构 * Google DeepMind(谷歌DeepMind)
AI总结 本文探讨了在训练过程中思维链(CoT)的可监控性受训练影响的问题,提出了一种框架来预测何时以及为何发生冲突,并通过实验验证了正交和冲突奖励项对CoT监控性的影响。
大厂专区
对齐、正交或冲突:何时可以安全地优化思维链?
机构 * Google DeepMind(谷歌DeepMind)
AI总结 本文探讨了在训练过程中思维链(CoT)的可监控性受训练影响的问题,提出了一种框架来预测何时以及为何发生冲突,并通过实验验证了正交和冲突奖励项对CoT监控性的影响。
基于推理的合成数据生成与评估
机构 * EPFL(瑞士联邦理工学院洛桑) ; Google(谷歌) ; Google Deepmind(谷歌DeepMind)
AI总结 本文提出Simula框架,通过无种子、代理化方法生成大规模合成数据,提供可解释且可控的生成流程,验证了其在多种数据集上的有效性,为合成数据机制设计和大规模生成评估提供指导。
Comments Accepted to TMLR 2026, J2C Certification
语言模型中理论思维与自我归因的意识能力是可分离的
机构 * Google, Paradigms of Intelligence Team(Google,智能范式团队) ; Knowledge Lab, University of Chicago(芝加哥大学知识实验室) ; Institute of Philosophy, School of Advanced Study, University of London(伦敦大学高等研究院哲学研究所) ; Department of Biomedical Informatics and Medical Education and Department of Bioethics and Humanities, School of Medicine, University of Washington(华盛顿大学医学院生物医学信息学与医学教育系及生物伦理学与人文学系) ; Kellogg School of Management, Northwestern University(西北大学凯洛格管理学院) ; Santa Fe Institute(圣塔菲研究所)
AI总结 研究发现,抑制语言模型的意识归因倾向不会影响其理论思维能力,但会降低其对非人类动物的归因和精神信念。
MultiGen:扩散游戏引擎中可编辑多人世界的层级设计
机构 * Stanford University(斯坦福大学) ; Google(谷歌)
AI总结 本文提出MultiGen,通过引入显式外部内存模块,实现可编辑多人世界中的环境控制与共享推理,提升交互性和一致性。
Comments Project page here: https://ryanpo.com/multigen/
EgoReasoner:通过任务自适应结构化思维学习视角4D推理
机构 * Northeastern University(东北大学) ; Google Research(谷歌研究院) ; Google DeepMind(谷歌DeepMind)
AI总结 本文提出EgoReasoner框架,通过任务自适应结构化思维解决视角4D推理任务,提升空间锚定、时间跟踪和持续推理能力,模型在HD-EPIC基准上取得37.5%准确率。
Comments preprint
HyperAlign:用于扩散模型高效测试时对齐的超网络
机构 * University of New South Wales (UNSW Sydney)(新南威尔士大学(悉尼新南威尔士大学)) ; Google Research(谷歌研究院)
AI总结 HyperAlign通过训练超网络实现扩散模型测试时对齐,平衡对齐质量与计算效率,提升语义一致性和视觉质量。