2505.13143 2025-12-29 cs.CY 85% Auditing Meta-Cognitive Hallucinations in Reasoning Large Language Models 审查推理大型语言模型中的元认知幻觉 Haolang Lu, Yilian Liu, Jingxin Xu, Guoshun Nan, Yuanlong Yu, Zhican Chen, Kun Wang 专题命中 复杂问题求解 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract) AI总结 本研究通过审查推理链轨迹,揭示了大型语言模型在长推理过程中如何通过错误反思强化偏见,提出黑盒审查方法以更有效地检测和归因幻觉问题。 Comments Accepted by NeurIPS 2025 (37 pages) 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2512.20312 2025-12-29 cs.LG cs.AI 81% TableGPT-R1: Advancing Tabular Reasoning Through Reinforcement Learning TableGPT-R1: 通过强化学习推进表格推理 Saisai Yang, Qingyi Huang, Jing Yuan, Liangyu Zha, Kai Tang, Yuhang Yang, Ning Wang, Yucheng Wei, Liyao Li, Wentao Ye, Hao Chen, Tao Zhang, Junlin Zhou, Haobo Wang, Gang Chen, Junbo Zhao 机构 * Zhejiang University Institute of Computing Innovation(浙江大学计算创新研究院) 纠错 专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.AI、cs.LG AI总结 TableGPT-R1通过强化学习框架提升表格推理能力,整合数据工程、奖励系统和多阶段训练框架,实现复杂表格任务的先进性能。 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2511.09109 2025-12-29 cs.CL cs.AI cs.IR 81% Thinking Forward and Backward: Multi-Objective Reinforcement Learning for Retrieval-Augmented Reasoning 正向与反向思考:用于检索增强推理的多目标强化学习 Wenda Wei, Yu-An Liu, Ruqing Zhang, Jiafeng Guo, Lixin Su, Shuaiqiang Wang, Dawei Yin, Maarten de Rijke, Xueqi Cheng 专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.CL、cs.AI AI总结 Bi-RAR通过双向信息距离和多目标强化学习框架,提升检索增强推理在复杂多步骤任务中的表现。 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2512.21837 2025-12-29 cs.CL 79% Knowledge Reasoning of Large Language Models Integrating Graph-Structured Information for Pest and Disease Control in Tobacco 基于图结构信息的大型语言模型知识推理用于烟草害虫和疾病控制 Siyu Li, Chenwei Song, Wan Zhou, Xinyi Liu 机构 * School of Information Science and Engineering(信息科学与工程学院) ; Chongqing Jiaotong University(重庆交通大学) 纠错 专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.CL AI总结 本文提出一种整合图结构信息的大型语言模型,用于提升烟草害虫和疾病控制的知识推理能力,通过构建领域知识图并结合图神经网络实现更准确的推理。 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2512.14693 2025-12-29 cs.AI 79% Universal Reasoning Model 通用推理模型 Zitian Gao, Lynx Chen, Yihao Xiao, He Xing, Ran Tao, Haoming Luo, Joey Zhou, Bryan Dai 机构 * Ubiquant 纠错 专题命中 复杂问题求解 :reasoning(title,abstract);分类 cs.AI AI总结 本文提出通用推理模型URM,通过引入短卷积和截断反向传播提升推理性能,在ARC-AGI任务中取得state-of-the-art结果。 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2512.21481 2025-12-29 cs.MA 75% The AI Committee: A Multi-Agent Framework for Automated Validation and Remediation of Web-Sourced Data AI委员会:一种多智能体框架,用于自动验证和修复网络来源的数据 Sunith Vallabhaneni, Thomas Berkane, Maimuna Majumder 专题命中 复杂问题求解 :reasoning(abstract);chain-of-thought(abstract);self-correction(abstract) AI总结 AI委员会是一种多智能体框架,通过自动化验证和修复网络数据集,提升数据质量和准确性。 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2512.22009 2025-12-29 cs.CV 67% iSHIFT: Lightweight Slow-Fast GUI Agent with Adaptive Perception iSHIFT: 轻量级慢-快 GUI 代理与自适应感知 Sarthak Mehrotra, Sairam V C Rebbapragada, Mani Hemanth Reddy Bonthu, Vineeth N Balasubramanian 机构 * Indian Institute of Technology, Bombay(印度理工学院,孟买) ; Indian Institute of Technology, Hyderabad(印度理工学院,海得拉巴) 纠错 专题命中 复杂问题求解 :reasoning(abstract);chain-of-thought(abstract) AI总结 iSHIFT是一种轻量级GUI代理,通过慢-快混合推理和灵活标记实现高效与精确的视觉交互。 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2512.07849 2025-12-29 cs.CY cs.CL cs.MA 57% AI Urban Scientist: Multi-Agent Collaborative Automation for Urban Research AI城市科学家:面向城市研究的多智能体协作自动化 Tong Xia, Jiankun Zhang, Ruiwen You, Ao Xu, Linghao Zhang, Tengyao Tu, Jingzhi Wang, Jinghua Piao, Yunke Zhang, Fengli Xu, Yong Li 机构 * Vanke School of Public Health, Tsinghua University, Beijing, China(范克学校公共卫生学院,清华大学,北京,中国) ; Zhongguancun Academy, Beijing, China(中关村学院,北京,中国) ; Department of Electronic Engineering, Tsinghua University, Beijing, China(电子工程系,清华大学,北京,中国) 纠错 专题命中 复杂问题求解 :reasoning(abstract);分类 cs.CL AI总结 本文提出AI城市科学家,通过多智能体协作自动化,整合异构数据生成城市研究的结构化知识,提升自主研究效率与准确性。 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2512.21354 2025-12-29 cs.CR cs.AI cs.SE 57% Reflection-Driven Control for Trustworthy Code Agents 基于反射的可信代码代理控制 Bin Wang, Jiazheng Quan, Xingrui Yu, Hansen Hu, Yuhao, Ivor Tsang 专题命中 复杂问题求解 :reasoning(abstract);分类 cs.AI AI总结 本文提出反射驱动控制方法,通过内部反思循环提升代码生成的安全性和合规性,实现自主、安全且可审计的AI代码代理。 Comments Accepted to AAAI 2026 Workshop on Trust and Control in Agentic AI (TrustAgent) 详情 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图
2504.00741 2025-12-29 cond-mat.mtrl-sci 50% Accelerated Inorganic Materials Design with Generative AI Agents 利用生成式AI代理加速无机材料设计 Izumi Takahara, Teruyasu Mizoguchi, Bang Liu 专题命中 复杂问题求解 :reasoning(abstract) AI总结 MatAgent通过结合生成模型和预测模型,利用大语言模型的推理能力,实现高效、可解释的无机材料设计与发现。 详情 DOI 10.1016/j.xcrp.2025.103019 展开后加载摘要… URL PDF HTML 收藏 复制 复制简介 复制详情 生成图片 生成简图 生成详图