From Illusion to Insight: Change-Aware File-Level Software Defect Prediction Using Agentic AI
从幻觉到洞察:利用代理AI的变更感知文件级软件缺陷预测
专题命中 推理评测 :reasoning(abstract)
AI总结 本文提出了一种基于代理AI的变更感知文件级软件缺陷预测方法,通过多代理辩论框架提升缺陷预测的准确性和敏感性。
AI 大模型
大模型数学、逻辑、规划、多步推理和测试时计算能力。
从幻觉到洞察:利用代理AI的变更感知文件级软件缺陷预测
专题命中 推理评测 :reasoning(abstract)
AI总结 本文提出了一种基于代理AI的变更感知文件级软件缺陷预测方法,通过多代理辩论框架提升缺陷预测的准确性和敏感性。
大推理模型高效推理的综述:语言、多模态与更远的探索
机构 * Shanghai AI Laboratory(上海人工智能实验室) ; Soochow University(苏州大学) ; Westlake University(西湖大学) ; Peking University(北京大学) ; Tongji University(同济大学) ; The Hong Kong University of Science and Technology(香港科技大学) ; Tsinghua University(清华大学) ; Huazhong University of Science and Technology(华中科技大学) ; The Chinese University of Hong Kong(香港中文大学)
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL
AI总结 本文综述了大推理模型在提升推理效率方面的最新研究,聚焦于语言、多模态及未来方向,旨在推动该领域的发展。
Comments Update recent RL papers. Project page: https://github.com/XiaoYee/Awesome_Efficient_LRM_Reasoning
嵌套学习:深度学习架构的幻觉
专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG
AI总结 本文提出嵌套学习范式,通过多级优化问题设计更高效的学习算法,展示持续学习模块Hope在语言建模等任务中的表现。
Comments A version of this work is published at Neural Information Processing Systems (NeurIPS) 2025
当智能失效:一项关于LLMs在密码破解中挣扎原因的实证研究
机构 * Future Data Minds Research Lab(未来数据智能研究实验室)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG
AI总结 本研究发现LLMs在密码破解任务中表现不佳,指出其在领域适应和记忆能力上的不足,强调需要改进的密码推断方法。
AstroReview: 一种基于大语言模型的多智能体框架用于望远镜提案同行评审与优化
机构 * The Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统重点实验室,自动化研究所,中国科学院) ; The School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 AstroReview通过多智能体框架实现望远镜提案的自动化评审与优化,显著提升评审效率和质量。
生成式AI增强的行业基于投资组合构建
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 本文探讨了生成式AI在量化行业投资组合构建中的应用,发现其在稳定市场中表现优异,但在波动市场中表现欠佳,强调了混合AI-量化框架的潜力。
RSAgent: 通过多轮工具调用学习推理与行动进行文本引导的分割
机构 * Shanghai Key Lab of Intelligent Information Processing, College of Computer Science and Artificial Intelligence, Fudan University(上海智能信息处理关键实验室,计算机科学与人工智能学院,复旦大学) ; Artificial Intelligence, Fudan University(人工智能,复旦大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 RSAgent通过多轮工具调用实现文本引导分割的推理与行动,采用两阶段框架提升分割性能,达到领域内和领域外基准的最先进水平。
Zoomer: 为黑盒大语言模型实现自适应图像聚焦优化
机构 * Microsoft(微软公司) ; Peking University(北京大学) ; University of Wisconsin Madison(威斯康星大学麦迪逊分校) ; University of Southern California(南加州大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 Zoomer通过自适应图像聚焦优化提升黑盒MLLM的多模态理解能力,显著提升准确性并减少token使用
Comments TMLR accepted
通过仅攻击编码器打破音频大语言模型:一种通用的目标潜在空间音频攻击
机构 * Ben Gurion University of the Negev(贝纳乔大学奈夫分校) ; Deepkeep
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 本文提出了一种针对音频大语言模型编码器的通用潜在空间攻击方法,通过操纵音频潜在表示实现目标输出,展示了编码器层面的安全漏洞。