arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-12-19 至 2025-12-19 共收录 2 信号源:cs.CL, cs.AI, cs.LG

1. 测试时计算 2 篇

2512.16304 2025-12-19 cs.SD 82%

CogSR: Semantic-Aware Speech Super-Resolution via Chain-of-Thought Guided Flow Matching

CogSR: 通过思维链引导的流匹配实现语义感知的语音超分辨率

Jiajun Yuan, Xiaochen Wang, Yuhang Xiao, Yulin Wu, Chenhao Hu, Xueyang Lv

机构 * National Engineering Research Center for Multimedia Software, School of Computer Science, Wuhan University, Wuhan, China(多媒体软件国家工程研究中心、计算机科学学院、武汉大学、武汉) School of Artificial Intelligence, Jianghan University, Wuhan, China(人工智能学院、江汉大学、武汉) Xiaomi Corporation, Beijing, China(小米公司、北京)

专题命中 测试时计算 :chain-of-thought(title,abstract);reasoning(abstract)

AI总结 CogSR通过整合大型音频-语言模型和思维链推理,实现语义感知的语音超分辨率,提升低采样率录音的修复精度和语言准确性。

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02262 2025-12-19 cs.CV 50%

From Frames to Clips: Training-free Adaptive Key Clip Selection for Long-Form Video Understanding

从帧到片段:训练免费的自适应关键片段选择用于长形式视频理解

Guangyu Sun, Archit Singhal, Burak Uzkent, Mubarak Shah, Chen Chen, Garin Kessler

机构 * Amazon(亚马逊公司) University of Central Florida(中央佛罗里达大学)

专题命中 测试时计算 :reasoning(abstract)

AI总结 F2C通过自适应关键片段选择提升长视频理解,比均匀采样在多个基准上表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏