arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

2026-04-06 至 2026-04-06 共收录 3
2604.03071 2026-04-06 cs.AI

Automatic Textbook Formalization

自动教科书形式化

Fabian Gloeckle, Ahmad Rammal, Charles Arnal, Remi Munos, Vivien Cabannes, Gabriel Synnaeve, Amaury Hayat

机构 * FAIR, Meta(Meta FAIR实验室) Korea Institute for Advanced Study(韩国高等研究院)

AI总结 论文研究了通过AI系统自动形式化超过500页的研究生级代数组合学教科书,采用13万行代码和5900个Lean声明,实现了教科书形式化的规模和专业性新突破。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02580 2026-04-06 cs.LG

VoxelCodeBench: Benchmarking 3D World Modeling Through Code Generation

VoxelCodeBench:通过代码生成进行3D世界建模的基准测试

Yan Zheng, Florian Bordes

机构 * FAIR at Meta(Meta FAIR) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

AI总结 本文提出VoxelCodeBench基准,通过代码生成评估3D空间推理能力,发现生成可执行代码易,但生成空间正确输出难,尤其在几何构造和多物体组合上挑战大。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15323 2026-04-06 cs.CL

Improving LLM First-Token Predictions in Multiple-Choice Question Answering via Output Prefilling

通过输出预填充改进多选问答中的LLM首词预测

Silvia Cappelletti, Tobia Poppi, Samuele Poppi, Zheng-Xin Yong, Diego Garcia-Olano, Marcella Cornia, Lorenzo Baraldi, Rita Cucchiara

机构 * University of Modena and Reggio Emilia(摩德纳大学与雷焦艾米利亚大学) University of Pisa(比萨大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Brown University(布朗大学) Meta

AI总结 本文提出预填充攻击,通过在模型输出前添加结构化自然语言前缀,提升多选问答中LLM首词预测的准确性与可靠性。

Comments 23 pages, 6 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏