arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-01-05 至 2026-01-05 共收录 6 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 6 篇

2507.11407 2026-01-05 cs.CL cs.AI 81%

EXAONE 4.0: Unified Large Language Models Integrating Non-reasoning and Reasoning Modes

EXAONE 4.0:整合非推理与推理模式的统一大语言模型

Kyunghoon Bae, Eunbi Choi, Kibong Choi, Stanley Jungkyu Choi, Yemuk Choi, Kyubeen Han, Seokhee Hong, Junwon Hwang, Taewan Hwang, Joonwon Jang, Hyojin Jeon, Kijeong Jeon, Gerrard Jeongwon Jo, Hyunjik Jo, Jiyeon Jung, Euisoon Kim, Hyosang Kim, Jihoon Kim, Joonkee Kim, Seonghwan Kim, Soyeon Kim, Sunkyoung Kim, Yireun Kim, Yongil Kim, Youchul Kim, Edward Hwayoung Lee, Gwangho Lee, Haeju Lee, Honglak Lee, Jinsik Lee, Kyungmin Lee, Sangha Park, Young Min Paik, Yongmin Park, Youngyong Park, Sanghyun Seo, Sihoon Yang, Heuiyeen Yeen, Sihyuk Yi, Hyeongu Yun

机构 * LG AI Research(LG人工智能研究)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 EXAONE 4.0通过整合非推理与推理模式,实现了高性能与先进推理能力的统一,支持多语言并提供两种不同规模的模型版本。

Comments Technical Report, 30 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10684 2026-01-05 cs.CL cs.CY 70%

SpiderGen: Towards Procedure Generation For Carbon Life Cycle Assessments with Generative AI

SpiderGen:面向碳生命周期评估的流程生成方法

Anupama Sitaraman, Bharathan Balaji, Yuvraj Agarwal

机构 * Amazon(亚马逊)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL

AI总结 SpiderGen利用生成式AI生成碳生命周期评估的流程图,准确率达65%,显著降低评估成本和人力投入。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00339 2026-01-05 cs.AI cs.DC cs.ET cs.MA cs.NE 57%

Bio-inspired Agentic Self-healing Framework for Resilient Distributed Computing Continuum Systems

生物启发的代理自修复框架用于鲁棒分布式计算连续系统

Alaa Saleh, Praveen Kumar Donta, Roberto Morabito, Sasu Tarkoma, Anders Lindgren, Qiyang Zhang, Schahram Dustdar, Susanna Pirttikangas, Lauri Lovén

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 ReCiSt通过生物启发的代理自修复框架,实现分布式计算连续系统的快速自我修复与韧性提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03402 2026-01-05 cs.CL 57%

Dual LoRA: Enhancing LoRA with Magnitude and Direction Updates

Dual LoRA: 通过幅度和方向更新增强LoRA

Yixing Xu, Chao Li, Xuanwu Yin, Spandan Tiwari, Dong Li, Ashish Sirasao, Emad Barsoum

机构 * Advanced Micro Devices, Inc.(先进微器件公司)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 Dual LoRA通过引入幅度和方向更新机制,改进LoRA在参数高效微调中的性能,实验表明其在多个NLP任务上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07675 2026-01-05 cs.DB cs.AI 57%

QUITE: A Query Rewrite System Beyond Rules with LLM Agents

QUITE:超越规则的查询重写系统与LLM代理

Yuyang Song, Hanxu Yan, Jiale Lao, Yibo Wang, Yufei Li, Yuanchun Zhou, Jianguo Wang, Mingjie Tang

机构 * Sichuan University(四川大学) Cornell University(康奈尔大学) Purdue University(普渡大学) Hong Kong University of Science and Technology(香港科学与技术大学) Computer Network Information Center, Chinese Academy of Sciences(中国科学院计算机网络信息中心)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 QUITE利用LLM代理超越规则,通过多代理框架、中间件和提示注入技术实现更高效的SQL查询重写,提升性能并覆盖更广的查询模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00730 2026-01-05 cs.CV 50%

Grading Handwritten Engineering Exams with Multimodal Large Language Models

用多模态大语言模型评分手写工程考试

Janez Perš, Jon Muhovič, Andrej Košir, Boštjan Murovec

机构 * University of Ljubljana, Faculty of Electrical Engineering(卢布尔雅那大学电子工程学院)

专题命中 其他推理 :reasoning(abstract)

AI总结 本研究利用多模态大语言模型对斯洛文尼亚语手写工程考试进行自动评分,通过多阶段设计实现高可靠性,达到与人工评分约8分的均方差,验证了结构化提示和参考定位的重要性。

Comments 10 pages, 5 figures, 2 tables. Supplementary material available at https://lmi.fe.uni-lj.si/en/janez-pers-2/supplementary-material/

详情

展开后加载摘要…

URL PDF HTML 收藏