arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-01 至 2025-12-01 共收录 52 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 52 篇

2511.22832 2025-12-01 cs.DB 90%

Structured Multi-Step Reasoning for Entity Matching Using Large Language Model

基于大语言模型的结构化多步推理实体匹配

Rohan Bopardikar, Jin Wang, Jia Zou

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

AI总结 本文提出基于结构化多步推理的实体匹配框架,通过分解匹配过程为多个推理阶段,提升大语言模型在实体匹配任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02583 2025-12-01 cs.AI cs.LG 90%

CAMA: Enhancing Mathematical Reasoning in Large Language Models with Causal Knowledge

CAMA: 通过因果知识增强大语言模型的数学推理

Lei Zan, Keli Zhang, Ruichu Cai, Lujia Pan

机构 * Huawei Noah’s Ark Lab France(华为诺亚实验室(法国)) Guangdong University of Technology Peng Cheng Laboratory(广东工业大学鹏城实验室) Huawei Noah’s Ark Lab China(华为诺亚实验室(中国))

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

AI总结 CAMA通过构建数学因果图并结合因果知识,提升大语言模型在数学推理任务中的性能。

Journal ref Main Track, AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21706 2025-12-01 cs.CL cs.AI 90%

A General Highly Accurate Online Planning Method Integrating Large Language Models into Nested Rollout Policy Adaptation for Dialogue Tasks

一种整合大语言模型的通用高精度在线规划方法用于对话任务的嵌套回滚策略适应

Hui Wang, Fafa Zhang, Xiaoyu Zhang, Chaoxu Mu

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

AI总结 本文提出NRPA-GD方法,利用大语言模型实现无需训练的对话策略规划,通过嵌套回滚策略适应在目标导向对话任务中取得优异表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12861 2025-12-01 cs.CL cs.CV 89%

From Perception to Reasoning: Deep Thinking Empowers Multimodal Large Language Models

从感知到推理:深度思考赋能多模态大语言模型

Wenxin Zhu, Andong Chen, Yuchen Song, Kehai Chen, Conghui Zhu, Ziyan Chen, Tiejun Zhao

机构 * Harbin Institute of Technology(哈尔滨工业大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Global Tone Communication Technology(全球语音通信技术)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);post-training(abstract);分类 cs.CL

AI总结 本文提出多模态链式思维方法,旨在提升多模态大语言模型的推理能力,通过系统性综述分析其理论基础、实现方法及未来发展方向。

Comments Survey; 7 figures, 3 tables, 44 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23136 2025-12-01 cs.CL cs.AI 88%

Multi-chain Graph Refinement and Selection for Reliable Reasoning in Large Language Models

多链图细化与选择用于大语言模型中的可靠推理

Yujiao Yang, Jing Lian, Linhui Li

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

AI总结 MGRS通过多链图细化与选择提升大语言模型的推理能力与效率,实现更高准确率和更快速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21753 2025-12-01 cs.CL cs.AI 88%

Extracting Disaster Impacts and Impact Related Locations in Social Media Posts Using Large Language Models

利用大型语言模型从社交媒体帖子中提取灾害影响及影响相关位置

Sameeah Noreen Hameed, Surangika Ranathunga, Raj Prasanna, Kristin Stock, Christopher B. Jones

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

AI总结 本文利用大型语言模型从社交媒体中提取灾害影响及受影响位置,提升灾害响应决策效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09947 2025-12-01 cs.LG cs.AI 88%

EEGAgent: A Unified Framework for Automated EEG Analysis Using Large Language Models

EEGAgent: 一种利用大语言模型进行自动化EEG分析的统一框架

Sha Zhao, Mingyi Peng, Haiteng Jiang, Tao Li, Shijian Li, Gang Pan

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

AI总结 EEGAgent利用大语言模型实现多任务EEG分析,提供灵活且可解释的自动化EEG处理与报告生成能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07984 2025-12-01 cs.CV 88%

SAMChat: Introducing Chain of Thought Reasoning and GRPO to a Multimodal Small Language Model for Small Scale Remote Sensing

SAMChat:引入链式推理和GRPO以增强小规模遥感遥感小语言模型

Aybora Koksal, A. Aydin Alatan

机构 * Center for the Image Analysis (OGAM) and Department of Electrical and Electronics Engineering of Middle East Technical University (METU)(图像分析中心(OGAM)和中东部技术大学(METU)电子与电气工程系)

专题命中 推理与问题求解 :language model(title,abstract);small language model(title);large language model(abstract)

AI总结 SAMChat通过引入链式推理和GRPO,专为遥感影像分析优化,实现了在开放描述和分类任务上的高精度表现。

Comments Accepted to Journal of Selected Topics in Applied Earth Observations and Remote Sensing (JSTARS) Special Issue on Foundation and Large Vision Models for Remote Sensing. Code and dataset are available at https://github.com/aybora/SAMChat

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22176 2025-12-01 cs.CL cs.AI 86%

Focused Chain-of-Thought: Efficient LLM Reasoning via Structured Input Information

聚焦式链式思考:通过结构化输入信息实现高效的LLM推理

Lukas Struppek, Dominik Hintersdorf, Hannah Struppek, Daniel Neider, Kristian Kersting

机构 * German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心) Technical University of Darmstadt(德累斯顿技术大学) University of Kassel(卡塞尔大学) TU Dortmund University(Dortmund技术大学) TU Center for Trustworthy Data Science and Security, University Alliance Ruhr(TU可信数据科学与安全中心,鲁尔大学联盟) Hessian Center for AI (Hessian.AI)(黑森人工智能中心(黑森.AI)) Centre for Cognitive Science, Technical University of Darmstadt(认知科学中心,德累斯顿技术大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出F-CoT方法,通过结构化输入减少LLM推理中的token使用和延迟,同时保持推理准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01584 2025-12-01 cs.AI cs.LG 85%

ReasoningWeekly: A General Knowledge and Verbal Reasoning Challenge for Large Language Models

ReasoningWeekly: 一个面向大语言模型的通用知识和逻辑推理挑战

Zixuan Wu, Francesca Lucchetti, Aleksander Boruch-Gruszecki, Jingmiao Zhao, Carolyn Jane Anderson, Joydeep Biswas, Federico Cassano, Arjun Guha

机构 * Northeastern University(东北大学) Wellesley College(韦尔斯利学院) University of Texas at Austin(德克萨斯大学奥斯汀分校) Cursor

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.AI、cs.LG

AI总结 ReasoningWeekly是一个基于NPR周日谜题挑战的通用知识和逻辑推理基准,揭示了现有评估中不明显的模型能力差距,并发现了新的推理失败类型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12099 2025-12-01 cs.CV 85%

TinyRS-R1: Compact Multimodal Language Model for Remote Sensing

TinyRS-R1:用于遥感的紧凑多模态语言模型

Aybora Koksal, A. Aydin Alatan

机构 * Center for the Image Analysis (OGAM) and Department of Electrical and Electronics Engineering of Middle East Technical University (METU)(图像分析中心(OGAM)和中欧技术大学(METU)电子与电气工程系)

专题命中 推理与问题求解 :language model(title,abstract);small language model(abstract);instruction tuning(abstract)

AI总结 TinyRS-R1是一种专为遥感设计的紧凑多模态语言模型,通过四阶段训练实现高效性能,兼具推理增强与低资源消耗。

Comments Accepted to IEEE Geoscience and Remote Sensing Letters (GRSL). Code, models, and the captions for datasets are available at https://github.com/aybora/TinyRS

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09222 2025-12-01 cs.CL 83%

Toward Honest Language Models for Deductive Reasoning

迈向演绎推理中的诚实语言模型

Jiarui Liu, Kaustubh Dhole, Yingheng Wang, Haoyang Wen, Sarah Zhang, Haitao Mao, Gaotang Li, Neeraj Varshney, Jingguo Liu, Xiaoman Pan

机构 * Carnegie Mellon University(卡内基梅隆大学) Amazon(亚马逊) Emory University(埃默里大学) Cornell University(康奈尔大学) UIUC(伊利诺伊大学厄巴纳-香槟分校)

专题命中 推理与问题求解 :language model(title,abstract);prompting(abstract);分类 cs.CL

AI总结 本文提出ACNCHOR方法,通过注入真实轨迹防止训练崩溃,提升语言模型在演绎推理中的诚实推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22441 2025-12-01 cs.CR cs.AI cs.CV cs.LG 81%

GEO-Detective: Unveiling Location Privacy Risks in Images with LLM Agents

GEO-Detective:利用LLM代理揭示图像中的位置隐私风险

Xinyu Zhang, Yixin Wu, Boyang Zhang, Chenhao Lin, Chao Shen, Michael Backes, Yang Zhang

机构 * CISPA Helmholtz Center for Information Security(CISPA赫尔姆霍茨信息安全中心) Xi’an Jiaotong University(西安交通大学)

专题命中 推理与问题求解 :LLM(title);language model(abstract);分类 cs.AI、cs.LG

AI总结 GEO-Detective利用LLM代理进行图像地理定位推断,通过自适应策略和专用工具提升定位精度并降低隐私风险。

Comments 15 pages with 7 figures and 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21688 2025-12-01 cs.CV cs.AI cs.CL 81%

G$^2$VLM: Geometry Grounded Vision Language Model with Unified 3D Reconstruction and Spatial Reasoning

G$^2$VLM:基于几何的视觉语言模型,实现统一的3D重建与空间推理

Wenbo Hu, Jingli Lin, Yilin Long, Yunlong Ran, Lihan Jiang, Yifan Wang, Chenming Zhu, Runsen Xu, Tai Wang, Jiangmiao Pang

机构 * Shanghai AI Lab(上海人工智能实验室) UCLA(加州大学洛杉矶分校) SJTU(上海交通大学) FDU(福建师范大学) ZJU(浙江大学) USTC(中国科学技术大学) HKU(香港大学) CUHK(香港中文大学)

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 G$^2$VLM通过统一3D重建与空间推理,提升视觉语言模型在空间智能任务中的性能。

Comments code are released at https://github.com/InternRobotics/G2VLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01943 2025-12-01 cs.CL cs.AI cs.CV cs.RO 81%

ROVER: Recursive Reasoning Over Videos with Vision-Language Models for Embodied Tasks

ROVER:基于视觉语言模型的视频递归推理用于具身任务

Philip Schroeder, Ondrej Biza, Thomas Weng, Hongyin Luo, James Glass

机构 * MIT CSAIL(麻省理工学院计算机科学与人工智能实验室) RAI Institute(RAI研究院)

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 ROVER通过递归分解视频轨迹提升具身任务中的视频推理能力,有效减少幻觉并提高准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23477 2025-12-01 cs.CV 80%

Video-CoM: Interactive Video Reasoning via Chain of Manipulations

Video-CoM:通过操作链进行交互式视频推理

Hanoona Rasheed, Mohammed Zumri, Muhammad Maaz, Ming-Hsuan Yang, Fahad Shahbaz Khan, Salman Khan

机构 * Mohamed bin Zayed University of AI(穆罕默德·本·扎耶德人工智能大学) University of California Merced(加州梅尔 Ced 大学) Google Research(谷歌研究院) Linköping University(林奈大学) Australian National University(澳大利亚国立大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);instruction tuning(abstract);SFT(abstract)

AI总结 Video-CoM通过操作链实现交互式视频推理,提升视频理解任务的性能和可解释性

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23387 2025-12-01 cs.AI 79%

Hierarchical AI-Meteorologist: LLM-Agent System for Multi-Scale and Explainable Weather Forecast Reporting

分层人工智能气象学家:用于多尺度和可解释性天气预报报告的LLM代理系统

Daniil Sukhorukov, Andrei Zakharov, Nikita Glazkov, Katsiaryna Yanchanka, Vladimir Kirilin, Maxim Dubovitsky, Roman Sultimov, Yuri Maksimov, Ilya Makarov

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.AI

AI总结 本文提出分层人工智能气象学家,通过多尺度推理和关键词生成提升天气预报的可解释性和鲁棒性。

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23112 2025-12-01 cs.CV cs.LG 79%

MathSight: A Benchmark Exploring Have Vision-Language Models Really Seen in University-Level Mathematical Reasoning?

MathSight: 一个探索视觉语言模型在大学级数学推理中是否真正看到的基准

Yuandong Wang, Yao Cui, Yuxin Zhao, Zhen Yang, Yangfu Zhu, Zhenzhou Shao

机构 * Capital Normal University(首都师范大学) Tsinghua University(清华大学)

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.LG

AI总结 MathSight基准测试通过对比不同视觉输入条件,探索视觉语言模型在大学级数学推理中视觉信息的真实贡献。

Comments Comments: 32 pages, 15 figures, 9 tables, includes appendix. Project page: https://cnu-bot-group.github.io/MathSight/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22173 2025-12-01 cs.CL 79%

RefineBench: Evaluating Refinement Capability of Language Models via Checklists

RefineBench: 通过检查表评估语言模型的细化能力

Young-Jun Lee, Seungone Kim, Byung-Kwan Lee, Minkyeong Moon, Yechan Hwang, Jong Myoung Kim, Graham Neubig, Sean Welleck, Ho-Jin Choi

机构 * KAIST(韩国科学技术院) Carnegie Mellon University(卡内基梅隆大学) NVIDIA(英伟达) Independent Researcher(独立研究者)

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL

AI总结 RefineBench通过检查表评估语言模型的细化能力,发现指导细化能显著提升响应质量,而自我细化则需进一步突破。

Comments Project website: https://passing2961.github.io/refinebench-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21743 2025-12-01 cs.CL 79%

Scaling Competence, Shrinking Reasoning: Cognitive Signatures in Language Model Learning

提升能力,缩减推理:语言模型学习中的认知特征

Mukul Singh, Ananya Singha, Arjun Radhakrishna, Sumit Gulwani

机构 * Microsoft(微软)

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL

AI总结 该研究通过分析语言模型推理标记的动态变化,揭示了模型在任务学习中的能力发展过程,并提出相关指标用于优化训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22570 2025-12-01 cs.AI cs.CL 79%

DeepSeekMath-V2: Towards Self-Verifiable Mathematical Reasoning

DeepSeekMath-V2:迈向自我验证的数学推理

Zhihong Shao, Yuxiang Luo, Chengda Lu, Z. Z. Ren, Jiewen Hu, Tian Ye, Zhibin Gou, Shirong Ma, Xiaokang Zhang

机构 * DeepSeek-AI

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 DeepSeekMath-V2通过自我验证机制提升数学推理能力,实现定理证明的高准确率和严谨性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21928 2025-12-01 cs.LG cs.AI 79%

Prompted Policy Search: Reinforcement Learning through Linguistic and Numerical Reasoning in LLMs

提示策略搜索:通过语言和数值推理在大语言模型中进行强化学习

Yifan Zhou, Sachin Grover, Mohamed El Mistiri, Kamalesh Kalirathnam, Pratyush Kerhalkar, Swaroop Mishra, Neelesh Kumar, Sanket Gaurav, Oya Aran, Heni Ben Amor

机构 * Interactive Robotics Lab, Arizona State University(亚利桑那州立大学交互机器人实验室) Research & Development, Procter & Gamble(普罗cter与 gamble 研究与发展)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 ProPS通过结合语言和数值推理,在大语言模型中实现高效的强化学习,展示了在多个任务中超越传统算法的性能。

Comments In The Thirty-ninth Annual Conference on Neural Information Processing Systems

Journal ref Advances in Neural Information Processing Systems (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14495 2025-12-01 cs.CL cs.AI cs.LG 78%

Temporal Consistency for LLM Reasoning Process Error Identification

LLM推理过程错误识别中的时序一致性

Jiacheng Guo, Yue Wu, Jiahao Qiu, Kaixuan Huang, Xinzhe Juan, Ling Yang, Mengdi Wang

机构 * Department of Electrical & Computer Engineering, Princeton University(普林斯顿大学电气与计算机工程系) AI Lab, Princeton University(普林斯顿大学人工智能实验室) Department of Computer Science & Engineering, University of Michigan(密歇根大学计算机科学与工程系)

专题命中 推理与问题求解 :LLM(title);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出了一种基于时序一致性的LLM推理过程错误识别方法,通过迭代自我反思提升验证准确性,在多个基准测试中实现了优于基线方法的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23476 2025-12-01 cs.AI 77%

Thinking by Doing: Building Efficient World Model Reasoning in LLMs via Multi-turn Interaction

通过多轮交互构建高效的LLM世界模型推理:WMAct

Bao Shu, Yan Cai, Jianjian Sun, Chunrui Han, En Yu, Liang Zhao, Jingcheng Hu, Yinmin Zhang, Haoran Lv, Yuang Peng, Zheng Ge, Xiangyu Zhang, Daxin Jiang, Xiangyu Yue

机构 * CUHK MMLab(香港中文大学MMLab) Peking University(北京大学) StepFun Tsinghua University(清华大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 WMAct通过高效交互和主动推理机制,使LLM在复杂环境中实现高效世界模型推理,提升任务解决能力和迁移性能。

Comments 17 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23408 2025-12-01 cs.CR cs.AI cs.SE 77%

Evaluating LLMs for One-Shot Patching of Real and Artificial Vulnerabilities

评估LLMs对真实和人工漏洞的一键补丁

Aayush Garg, Zanis Ali Khan, Renzo Degiovanni, Qiang Tang

机构 * Luxembourg Institute of Science and Technology(卢森堡科学与技术研究所)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究评估了LLMs在真实和人工漏洞修补中的有效性,发现其在真实漏洞上表现更佳,并揭示了不同LLMs在修补漏洞上的互补性和差异性。

Comments Pre-print - Extended version of the poster paper accepted at the 41st ACM/SIGAPP Symposium on Applied Computing (SAC) Smarter Engineering-Building AI and Building with AI (SEAI) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21705 2025-12-01 cs.CL cs.CV 77%

Insight-A: Attribution-aware for Multimodal Misinformation Detection

Insight-A: 多模态虚假信息检测中的归因意识

Junjie Wu, Yumeng Fu, Chen Gong, Guohong Fu

机构 * School of Computer Science and Technology, Soochow University(苏州大学计算机科学与技术学院) Institute of Artificial Intelligence, Soochow University(苏州大学人工智能研究院) School of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术学院)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

AI总结 Insight-A通过归因意识和分层推理提升多模态虚假信息检测效果,有效识别伪造来源并增强跨模态一致性检查。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21395 2025-12-01 cs.CV cs.AI 77%

Monet: Reasoning in Latent Visual Space Beyond Images and Language

Monet: 在图像和语言之外的潜在视觉空间推理

Qixun Wang, Yang Shi, Yifei Wang, Yuanxing Zhang, Pengfei Wan, Kun Gai, Xianghua Ying, Yisen Wang

机构 * Peking University(北京大学) Kling Team(Kling团队) Amazon AGI SF Lab(Amazon AGI SF实验室) MIT(麻省理工学院)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.AI

AI总结 Monet通过在潜在视觉空间中直接推理,提升多模态大语言模型的视觉推理能力,解决了潜在-视觉对齐和嵌入监督不足的问题,展示了在现实世界和抽象视觉任务中的优越表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18531 2025-12-01 cs.CR cs.PL 75%

LockForge: Automating Paper-to-Code for Logic Locking with Multi-Agent Reasoning LLMs

LockForge: 基于多智能体推理LLM的逻辑锁纸到代码自动化

Akashdeep Saha, Zeng Wang, Prithwish Basu Roy, Johann Knechtel, Ozgur Sinanoglu, Ramesh Karri

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 LockForge通过多智能体推理LLM自动化将逻辑锁论文描述转换为可执行代码,解决可重复性难题,提供系统化验证框架和基准测试。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04195 2025-12-01 cs.CR 75%

AutoPatch: Multi-Agent Framework for Patching Real-World CVE Vulnerabilities

AutoPatch:多智能体框架用于修补现实世界中的CVE漏洞

Minjae Seo, Wonwoo Choi, Myoungsung You, Seungwon Shin

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 AutoPatch通过多智能体框架高效修补LLM生成代码中的CVE漏洞,实现高准确率和低成本的漏洞修复

Comments 19 pages, double column, 9 figures. Under submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16901 2025-12-01 cs.CV 75%

R-AVST: Empowering Video-LLMs with Fine-Grained Spatio-Temporal Reasoning in Complex Audio-Visual Scenarios

R-AVST:通过细粒度时空推理增强视频大语言模型以应对复杂音频视觉场景

Lu Zhu, Tiantian Geng, Yangye Chen, Teng Wang, Ping Lu, Feng Zheng

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 R-AVST通过细粒度时空推理提升视频大语言模型,构建首个真实世界音频视觉时空推理数据集,并提出AVST-Zero模型增强推理能力。

Comments Accepted by AAAI 2026. Project page: https://github.com/zhlllau/R-AVST

详情

展开后加载摘要…

URL PDF HTML 收藏