arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-12-01 至 2025-12-01 共收录 4 信号源:cs.CL, cs.AI, cs.LG

1. 测试时计算 4 篇

2511.23262 2025-12-01 cs.AI 79%

Adapting Like Humans: A Metacognitive Agent with Test-time Reasoning

像人类一样适应:具有测试时推理的元认知代理

Yang Li, Zhiyuan He, Yuxuan Huang, Zhuhanling Xiao, Chao Yu, Meng Fang, Kun Shao, Jun Wang

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室) University of Oxford(牛津大学) Tsinghua University(清华大学) University of Liverpool(利物浦大学) University College London(伦敦大学学院)

专题命中 测试时计算 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出元认知测试时推理框架,通过元认知自我更新实现模型在测试时的高效适应,实验表明其在Atari游戏中表现出优于基线的适应能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23436 2025-12-01 cs.AI 70%

Towards Continuous Intelligence Growth: Self-Training, Continual Learning, and Dual-Scale Memory in SuperIntelliAgent

迈向持续智能增长:在SuperIntelliAgent中实现自我训练、持续学习和双尺度记忆

Jianzhe Lin, Zeyu Pan, Yun Zhu, Ruiqi Song, Jining Yang

专题命中 测试时计算 :reasoning(abstract);verifier(abstract);分类 cs.AI

AI总结 SuperIntelliAgent通过自我训练和双尺度记忆实现持续智能增长,利用可训练学习者与推理验证者配对,提升偏好对齐和学习效果。

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23115 2025-12-01 cs.CV 67%

Analyzing Image Beyond Visual Aspect: Image Emotion Classification via Multiple-Affective Captioning

超越视觉层面的图像分析:通过多情感描述进行图像情感分类

Zibo Zhou, Zhengjun Zhai, Huimin Chen, Wei Dai, Hansen Yang

机构 * School of Computer Science, Northwestern Polytechnical University(计算机科学学院,西北工业大学) School of Cybersecurity, Northwestern Polytechnical University(网络安全学院,西北工业大学) School of Electronics and Information, Northwestern Polytechnical University(电子与信息学院,西北工业大学)

专题命中 测试时计算 :reasoning(abstract);chain-of-thought(abstract)

AI总结 本文提出基于多情感描述的图像情感分类方法,通过文本捕捉图像情感信息,有效解决情感差距问题,提升分类性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01457 2025-12-01 cs.LG cs.AI cs.CL 67%

Beyond Introspection: Reinforcing Thinking via Externalist Behavioral Feedback

超越内省:通过外部主义行为反馈强化思维

Diji Yang, Linda Zeng, Kezhen Chen, Yi Zhang

机构 * University of California, Santa Cruz(加州大学圣克鲁兹分校)

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出DRR框架,通过外部主义行为反馈提升LLM推理质量,无需修改基础模型。

详情

展开后加载摘要…

URL PDF HTML 收藏