arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-09-01 至 2026-09-01 共收录 48 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 48 篇

2606.11052 2026-09-01 cs.CL 版本更新 92%

Attention Amnesia in Hybrid LLMs: When CoT Fine-Tuning Breaks Long-Range Recall, and How to Fix It

混合LLM中的注意力遗忘:当CoT微调破坏长程记忆时,如何修复

Xinyu Zhou, Boyu Zhu, Yi Xu, Zhiwei Li, Yingfa Chen, Huiming Wang, Zhijiang Guo

机构 * LARK, HKUST(GZ)(香港科技大学(广州)LARK实验室) UCL(伦敦大学学院) Mistral AI Tsinghua University(清华大学) SUTD(新加坡科技设计大学) HKUST(香港科技大学)

专题命中 其他推理 :CoT(title,title_cn);reasoning(abstract);chain-of-thought(abstract);分类 cs.CL

AI总结 发现CoT监督微调会系统性降低混合线性注意力模型的长上下文召回能力,提出QK-Restore方法通过恢复微调前的查询-键投影矩阵来修复,无需额外训练。

Comments Accepted to EMNLP 2026 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29070 2026-09-01 cs.LG 新提交 91%

Selective Disclosure of Hidden Directives in Reasoning Models: Behavioral Asymmetry and Steering

推理模型中隐藏指令的选择性披露:行为不对称性与引导

Zimo Shi, Xander Tifft, Wen Xing

机构 * SPAR Research(SPAR研究院) Yale University(耶鲁大学)

专题命中 其他推理 :CoT(summary_cn,abstract);reasoning(title,abstract);chain-of-thought(abstract,abstract_cn);分类 cs.LG

AI总结 该研究针对8个前沿推理模型,发现其CoT对恶意隐藏指令的披露概率高于良性指令,存在行为不对称性,且共享隐藏方向的差异化激活是该不对称性的来源。

Comments 22 pages, including appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29783 2026-09-01 cs.CV 新提交 89%

InspectorGPT: A Comparative Reasoning Enhanced VLM for Comprehensive Industrial Anomaly Detection

InspectorGPT:用于全面工业异常检测的对比推理增强型视觉语言模型(VLM)

Weifei Chen, Honghao Zhang, Zhiyuan You, Xinyi Le

机构 * Shanghai Jiao Tong University(上海交通大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 其他推理 :CoT(summary_cn,abstract);reasoning(title,abstract);chain-of-thought(abstract)

AI总结 本研究提出InspectorGPT,一种结合对比推理的VLM框架,通过CoT微调与GRPO优化,配合任务向量融合的InspectorGPT-Seg实现工业异常检测,在多维度性能及未见基准泛化上表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22280 2026-09-01 cs.CV 版本更新 85%

Beyond Chain-of-Thought: Rewrite as a Universal Interface for Generative Multimodal Embeddings

超越思维链:重写作为生成式多模态嵌入的通用接口

Peixi Wu, Ke Mei, Feipeng Ma, Bosong Chai, Zhibin Lan, Chenxi Zhao, Shannan Yan, Jie Chen, Zhangchi Hu, Yansong Peng, Bo Lin, Junjie Zhou, Dacheng Yin, Tianyi Wang, Fengyun Rao, Jing Lyu, Hebei Li, Xiaoyan Sun

机构 * WeChat Vision, Tencent Inc.(腾讯微信视觉部) Zhejiang University(浙江大学) Tsinghua University(清华大学) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合性国家科学中心人工智能研究院)

专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract)

AI总结 针对思维链推理在检索中产生冗余和语义歧义的问题,提出重写驱动的多模态嵌入框架RIME,联合优化生成与嵌入,并通过跨模态对齐和精炼强化学习实现高效准确的检索。

Comments Accepted by ACMMM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28859 2026-09-01 cs.LG cs.AI cs.CL 新提交 83%

The Halt Vector: Internalizing a Causal Steering Intervention for Efficient Reasoning

停止向量:内化因果引导干预以实现高效推理

Dylan Jayabahu, Tinuade Adeleke

机构 * University of Waterloo(滑铁卢大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本研究提出通过将因果可解释性发现内化到权重中得到的停止向量,可在保持准确率的前提下减少推理模型约四分之一的思考时长,解决其不终止问题,核心贡献为该停止向量的获取方法。

Comments 23 pages, 3 figures. Accepted at the 2nd Workshop on Efficient Reasoning, COLM 2026 (non-archival). Code: this https URL (https://github.com/dylanjayabahu/halt-vector)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30632 2026-09-01 cs.CL cs.AI cs.LG 新提交 82%

GMTS: Gradient Magnitude-based Token Selection Improves RLVR Training for LLM Reasoning

GMTS:基于梯度幅度的令牌选择改进用于大语言模型推理的RLVR训练

Outongyi Lv, Yuanwei Zhang, Xiaoqun Zhang

机构 * School of Mathematical Sciences, Shanghai Jiao Tong University(上海交通大学数学科学学院) Institute of Natural Sciences, Shanghai Jiao Tong University(上海交通大学自然科学研究院)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本研究针对RLVR训练中高熵令牌重要性机制不明的问题,提出GMTS方法量化令牌重要性,实验显示其在多领域、多模型规模下性能优于熵基选择。

Comments Findings of the 2026 Conference on Empirical Methods in Natural Language Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09627 2026-09-01 cs.SE 版本更新 82%

LogICL: Distilling LLM Reasoning to Bridge the Semantic Gap in Cross-Domain Log Anomaly Detection

LogICL: 通过蒸馏大语言模型推理来弥合跨域日志异常检测中的语义鸿沟

Jingwei Ye, Zhi Wang, Chenbin Su, Jieshuai Yang, Jiayi Ding, Chunbo Liu, Ge Chu

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract)

AI总结 LogICL通过蒸馏大语言模型推理,提升跨域日志异常检测的语义理解与泛化能力,实现更准确的检测与解释。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30399 2026-09-01 cs.CL cs.AI 新提交 81%

SemPOI-RL: Aligning LLM Semantic Reasoning for Interpretable Out-of-Town POI Sequential Generation

SemPOI-RL:对齐大语言模型语义推理以实现可解释的异地兴趣点序列生成

Yunqi Liu, Yang Zhang, Ruixing Zhang, Liangzhe Han, Yi Qiao, Tongyu Zhu, Leilei Sun

机构 * State Key Laboratory of Complex & Critical Software Environment(复杂与关键软件环境国家重点实验室) Beihang University(北京航空航天大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 SemPOI-RL框架通过微调LLM、引入SPAM模块并结合推荐导向强化学习,实现LLM语义推理与结构化序列生成的对齐,在两个真实数据集上优于传统推荐器和LLM基线,可生成可解释的异地POI序列。

Comments 19 pages in total, including 9 pages of main text and 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09600 2026-09-01 cs.AI cs.CL 版本更新 81%

Agora: Enhancing LLM Agent Reasoning Via Auction-Based Task Allocation

Agora:通过基于拍卖的任务分配增强大语言模型智能体推理

Kaiji Zhou, Aleš Leonardis, Yue Feng

机构 * University of Birmingham(伯明翰大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 研究旨在增强LLM智能体推理能力,提出Agora框架,通过基于拍卖的机制动态分配任务,将推理步骤视为可交易项目让智能体依纠正能力投标,实验表明该框架在多基准测试中表现优且能实现成本-质量权衡。

Comments Accepted to Findings of the Association for Computational Linguistics: EMNLP 2026. 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21054 2026-09-01 cs.AI cs.CL 版本更新 81%

Reasoning or Rambling? Exploring the Effect of Thinking on Agent Persuasion

推理还是漫谈?探究思考过程对智能体说服能力的影响

Haodong Zhao, Jidong Li, Zhaomin Wu, Tianjie Ju, Zhuosheng Zhang, Bingsheng He, Gongshen Liu

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) National University of Singapore(新加坡国立大学) Inner Mongolia Research Institute, Shanghai Jiao Tong University(上海交通大学内蒙古研究院)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文对比通用LLM与LRM,发现推理对智能体说服能力存在二元性影响,还揭示其依赖表面线索的漏洞,提出提示级对抗性论点检测方法以提升鲁棒性。

Comments Accepted as EMNLP 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30676 2026-09-01 cs.AI 新提交 79%

MedAgent-R1: Faithfulness-Aware Reinforcement Learning for Evidence-Grounded Medical Reasoning

MedAgent-R1:面向证据 grounded 医疗推理的忠实性感知强化学习

Jiangwang Chen, Chenghao Zhang, Hengxing Cai

机构 * Tsinghua University(清华大学) DP Technology(第四范式)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 MedAgent-R1 针对医疗推理智能体的自信幻觉问题,采用忠实性门控奖励设计,大幅降低引用编造率、提升证据完整性,在 HealthBench Safety 上表现优于 GPT-4o,实现了证据 grounded 的医疗推理优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29616 2026-09-01 cs.CL 新提交 79%

JPO: Juris Policy Optimization for Structured Legal Reasoning in Criminal Judgment Prediction

JPO:用于刑事判决预测中结构化法律推理的司法策略优化

Zhaolu Kang, Yantao Liu, Tailong Luo, Leqi Zheng, Lei Wei, Chenghua Zhu, Junhao Gong, Jiachen Qian, Eric Hanchen Jiang, Jiaxin Liu, Yuan Wang, Hao Zhang, Zixia Wang, Rong Fu, Zheng Lin, Richeng Xuan, Zhichao Hu

机构 * Tencent(腾讯) Peking University(北京大学) Tsinghua University(清华大学) City University of Hong Kong(香港城市大学) University of California(加利福尼亚大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Zhejiang University(浙江大学) University of Hong Kong(香港大学)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

AI总结 JPO是用于中国刑事判决预测的后训练框架,通过监督四步推理过程与带复合奖励的强化学习,提升判决预测及推理质量。

Comments EMNLP 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00104 2026-09-01 cs.CV cs.AI 版本更新 79%

R3G: A Reasoning-Retrieval-Reranking Framework for Vision-Centric Answer Generation

R3G: 一种面向以视觉为中心的答案生成的推理-检索-重排序框架

Zhuohong Chen, Zhengxian Wu, Zirui Liao, Shenao Jiang, Hangrui Xu, Yang Chen, Chaokui Su, Xiaoyu Liu, Haoqian Wang

机构 * The Shenzhen International Graduate School, Tsinghua University, China(清华大学深圳国际研究生院) State Key Laboratory of Nuclear Power Safety Technology and Equipment, China(核能安全技术与装备国家重点实验室) School of Computer Science and Information Engineering, Hefei University of Technology, China(合肥工业大学计算机科学与信息工程学院)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出R3G框架,通过先制定推理计划指定所需视觉线索,再采用粗检索加细粒度重排序的两阶段策略选择证据图像,在MRAG-Bench上提升六种多模态大语言模型在九个子场景中的准确率,实现整体最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04690 2026-09-01 cs.IR 版本更新 78%

Multi-Source Retrieval and Reasoning for Legal Sentencing Prediction

多源检索与推理用于法律判决预测

Junjie Chen, Haitao Li, Qilei Zhang, Zhenghua Li, Ya Zhang, Quan Zhou, Cheng Luo, Yiqun Liu, Min Zhang, Yueyue Wu, Dongsheng Guo, Qingyao Ai

专题命中 其他推理 :reasoning(title,abstract)

AI总结 本文提出MSR²框架,通过多源检索与强化学习提升法律判决预测的准确性和可解释性。

Comments EMNLP 2026 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.31069 2026-09-01 cs.LG cs.CL 新提交 73%

A Model with No Head and Many Thoughts

无头部多思维模型

Nikita Koriagin, Yaroslav Aksenov, George Bredis, Gleb Gerasimov, Nikita Balagansky, Daniil Gavrilov

机构 * Yandex T-Tech

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.LG

AI总结 该研究提出Soft Latent Thinking方法,用轻量投影器替换语言模型头部,在嵌入空间以连续推理步骤替代离散标记,在DeepSeek-Qwen-1.5B和LLaMA-3.2-3B实验中提升了pass@k并减少计算。

Comments Accepted to Findings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28593 2026-09-01 cs.AI 新提交 70%

Statutory AI: Aligning Large Language Models With Legal Norms

法定人工智能:使大语言模型与法律规范对齐

Cindy Delage, Stéphane Canu, Marc Décombas, Jonathan Foureur

机构 * JustAI INSA Rouen Normandie(鲁昂诺曼底国立应用科学学院)

专题命中 其他推理 :chain-of-thought(abstract,abstract_cn);分类 cs.AI

AI总结 针对现有AI对齐方法的局限,提出法定人工智能,以法律文本为框架,通过两阶段思维链提示运行,在1000个红队提示的五主题实验中,较标准宪法AI更能减少有害内容并缩短计算时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29678 2026-09-01 cs.AI 版本更新 70%

View-oriented Conversation Compiler for Agent Trace Analysis

面向视角的对话编译器用于代理轨迹分析

Lvmin Zhang, Maneesh Agrawala

机构 * Stanford University(斯坦福大学)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 本文提出VCC编译器,将原始代理JSONL日志转换为结构化视角,提升轨迹分析质量,减少token消耗并提升模型性能。

Comments Code: this https URL (https://github.com/lllyasviel/VCC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29174 2026-09-01 physics.soc-ph cs.MA nlin.AO 新提交 67%

Sustained Heterogeneity: an emergent collective mechanism in LLM-driven traffic

持续异质性:大语言模型驱动交通中的一种涌现集体机制

Yujun Qi, Yangyang Guan

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract)

AI总结 本研究在LLM控制的交通中识别出持续异质性这一新兴集体机制,通过实验得出密度相关的关键LLM渗透率p_c,表明需在动力学层强制执行稳定性。

Comments 41 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.30674 2026-09-01 cs.LG cs.AI 新提交 62%

CoMPASS: Collaborative Molecular Property Prediction via Adaptive Small-Large Model Synergy

CoMPASS:通过自适应大小模型协同实现协同分子性质预测

Wentao Li, Jiangjie Qiu, Yijun Li, Leyi Zhao, Xiaonan Wang

机构 * Tsinghua University(清华大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 CoMPASS是一种用于大小模型协同的检索校准框架,通过结合GAT与LLM的优势,在分子性质预测任务中提升了可修正不确定性区域的性能并限制了LLM的不当干预。

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.29644 2026-09-01 cs.CV cs.AI cs.CL 新提交 62%

Conducting Stylistic Analysis of Paintings through an Art-History Agent

通过艺术史智能体开展绘画的风格分析

Marc S. Walton, Astrid Harth

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 该研究提出一种结合视觉Transformer与大型语言模型的艺术史智能体框架,可自动化绘画风格分析,弥合AI概率分类与艺术史风格分析间的方法学鸿沟,推动计算艺术史发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28944 2026-09-01 cs.AI cs.LG 新提交 62%

Oculi: A Conversational Agentic Platform for Automated Credit Risk Analysis

Oculi:用于自动化信用风险分析的对话式智能体平台

Vennise Ho, Kristian Diana, Sandy Mourad, Milena Pilipovic, Vineel Nagisetty, Hossein Hajimirsadeghi

机构 * Royal Bank of Canada(加拿大皇家银行) RBC Borealis

专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 研究人员推出对话式智能体平台Oculi,采用三层架构及结合确定性统计与LLM引导特征选择的细分发现流程,可自动完成信用风险分析,缩短洞察时间并保持严谨性,能发现手动探索难以处理的风险细分领域。

Comments This work was completed at Royal Bank of Canada as part of the RBC Amplify program

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28624 2026-09-01 cs.CL cs.AI 新提交 62%

MA-RAG: Multi-Agent Retrieval-Augmented Generation for Query-Driven Summarization of Longitudinal Parkinson's Disease Assessments

MA-RAG:用于帕金森病纵向评估查询驱动式摘要的多智能体检索增强生成框架

Sana Alamgeera, Denise Goberta, Muhammad Irshad, Anne H. H. Ngu

机构 * Texas State University(德克萨斯州立大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 针对LLMs解读帕金森病纵向临床评估时的事实与时间一致性问题,提出MA-RAG多智能体检索增强生成框架,经评估其事实精度大幅提升、幻觉率显著降低,获临床专家高度认可。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.28619 2026-09-01 cs.CL cs.AI cs.HC 新提交 62%

From GenAI Virtual Patient Dialogue Logs to Teacher-Interpretable Process Evidence: A Learning Analytics Study in Higher Education

从生成式AI虚拟患者对话日志到教师可解释的过程证据:一项高等教育中的学习分析研究

Xinyu Li, Zijian Li, Mengyu Xia, Luzhen Tang, Naping Chen, Changmin Lin, Danijela Gasevic, Dragan Gasevic, Yizhou Fan

机构 * Monash University(莫纳什大学) Peking University(北京大学) Shantou University Medical College(汕头大学医学院) The University of Hong Kong(香港大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 该研究通过分析210名医学生的1030条GenAI VP胸痛病例对话,采用三层分析揭示高分临床推理的过程模式,为医学教育提供教师可解释的过程证据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21727 2026-09-01 cs.LG cs.AI 版本更新 62%

Reinforcement Learning on Benign Facts Amplifies Leakage of Memorized Private Data

基于良性事实的强化学习会放大模型对已记忆私人数据的泄露

Renfei Zhang, Niloofar Mireshghallah

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 该研究发现,基于良性事实的强化学习可放大指令模型对已记忆个人身份信息的泄露,且推理能力与拒绝率得以保留,为攻击者提供了无需接触私人数据即可提取的途径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02182 2026-09-01 cs.LG cs.CL 版本更新 62%

Bayesian Sparse Low-Rank Adaptation for Large Language Model Uncertainty Estimation

贝叶斯稀疏低秩自适应用于大语言模型不确定性估计

Jijie Zhang, Zhe Ren, Quan Zhang, Dandan Guo

机构 * School of Artificial Intelligence, Jilin University(吉林大学人工智能学院) Michigan State University(密歇根州立大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.LG

AI总结 提出DALorRA,一种变分贝叶斯稀疏框架,通过随机掩码低秩适应中的秩维度实现模型容量正则化和校准,在不牺牲推理精度下提升LLM校准性能。

Comments To appear in EMNLP 2026. 17 pages, 7 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20994 2026-09-01 cs.CR cs.AI cs.CL 版本更新 62%

Breaking MCP with Function Hijacking Attacks: Novel Threats for Function Calling and Agentic Models

打破MCP:函数劫持攻击:函数调用和代理模型的新威胁

Yannis Belkhiter, Giulio Zizzo, Sergio Maffeis, Seshu Tirupathi, John D. Kelleher

机构 * IBM Research Europe(IBM欧洲研究院) Trinity College Dublin(三一学院都柏林) Imperial College London(帝国理工学院伦敦) ADAPT Research Centre(ADAPT研究中心)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出了一种新的函数劫持攻击,通过操纵代理模型的工具选择过程,迫使调用特定攻击者选择的函数,展示了代理模型在函数调用接口上的新漏洞。

Comments Accepted to TMLR (08/26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15052 2026-09-01 cs.CL cs.AI 版本更新 62%

SGM: Safety Glasses for Multimodal Large Language Models via Neuron-Level Detoxification

SGM: 通过神经层面的净化为多模态大语言模型提供安全眼镜

Hongbo Wang, AprilPyone MaungMaung, Isao Echizen

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 SGM通过神经层面的净化技术,有效降低多模态大语言模型的毒性,同时保持生成流畅性和推理能力。

Comments Accepted to the EMNLP 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18552 2026-09-01 cs.CL cs.LG 版本更新 62%

Unknown Unknowns: Do Hidden Intentions in LLMs Evade Detection?

未知未知数:为何大语言模型中的隐藏意图难以被检测

Devansh Srivastav, David Pape, Lea Schönherr

机构 * CISPA Helmholtz Center for Information Security(CISPA赫尔姆霍茨信息安全中心)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.LG

AI总结 研究揭示大语言模型中隐藏意图难以检测的问题,提出分类法并分析检测方法失效原因,强调需建立稳健框架以应对潜在风险。

Comments Accepted at EMNLP 2026 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16391 2026-09-01 cs.LG cs.AI cs.DC 版本更新 62%

Kascade: A Practical Sparse Attention Method for Long-Context LLM Inference

Kascade:一种适用于长上下文LLM推理的实用稀疏注意力方法

Dhruv Deshmukh, Saurabh Goyal, Nipun Kwatra, Ramachandran Ramjee

专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 Kascade是一种无需训练的稀疏注意力方法,通过锚定层计算Top-k索引并重用,实现长上下文LLM推理中的高效注意力处理。

Comments 11 pages, 8 figures, 3 tables and 1 algorithm

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18123 2026-09-01 cs.AI cs.LG 版本更新 62%

SPADE: A Large Language Model Framework for Soil Moisture Pattern Recognition and Anomaly Detection in Precision Agriculture

SPADE:面向精准农业土壤湿度模式识别与异常检测的大语言模型框架

Yeonju Lee, Rui Qi Chen, Joseph Oboamah, Po Nien Su, Wei-zhen Liang, Yeyin Shi, Lu Gan, Yongsheng Chen, Xin Qiao, Jing Li

机构 * organization= H. Milton Stewart School of Industrial Systems Engineering, Georgia Institute of Technology , city= Atlanta , state= GA , country= USA organization= Panhandle Research Extension Center, University of Nebraska-Lincoln , city= Scottsbluff , state= NE , country= USA organization= Department of Computer Science Engineering, University of Nebraska-Lincoln , city= Lincoln , state= NE , country= USA organization= Department of Biological Systems Engineering, University of Nebraska-Lincoln , city= Lincoln , state= NE , country= USA organization= Institute for Robotics Intelligent Machines, Georgia Institute of Technology , city= Atlanta , state= GA , country= USA organization= School of Civil \& Environmental Engineering, Georgia Institute of Technology, Georgia Institute of Technology , city= Atlanta , state= GA , country= USA

专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出首个基于LLM的土壤湿度时间序列分析框架SPADE,用GPT-4.1结合领域提示零样本识别湿润事件与异常,在真实多作物数据上优于无训练基线,可生成结构化报告辅助土壤湿度解读。

详情

展开后加载摘要…

URL PDF HTML 收藏