arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-02-03 至 2026-02-03 共收录 46 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 46 篇

2602.01708 2026-02-03 cs.CL cs.AI cs.GT 90%

Game of Thought: Robust Information Seeking with Large Language Models Using Game Theory

思维博弈:利用博弈论的大型语言模型鲁棒信息检索

Langyuan Cui, Chun Kai Ling, Hwee Tou Ng

机构 * Department of Computer Science, National University of Singapore, 13 Computing Drive, Singapore 117417(新加坡国立大学计算机科学系)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 本文提出Game of Thought框架,通过博弈论技术提升大型语言模型在信息检索中的鲁棒性,实验证明其在最坏情况下的性能优于传统方法。

Comments 23 pages, 10 figures, under review at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00190 2026-02-03 cs.AI cs.CV cs.LG 90%

From Gameplay Traces to Game Mechanics: Causal Induction with Large Language Models

从游戏行为追踪到游戏机制:利用大语言模型进行因果推理

Mohit Jiwatode, Alexander Dockhorn, Bodo Rosenhahn

机构 * Institute for Information Processing, Leibniz University Hannover, Germany(汉诺威莱布尼茨大学信息处理研究所) SDU Metaverse Lab, University of Southern Denmark, Denmark(丹麦南方大学元宇宙实验室)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.AI、cs.LG

AI总结 本文提出利用大语言模型进行因果推理,通过从游戏行为追踪中推断出视频游戏描述语言规则,以更准确地理解游戏机制。

Comments Submitted to ICPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23261 2026-02-03 cs.LG cs.AI 88%

TEON: Tensorized Orthonormalization Beyond Layer-Wise Muon for Large Language Model Pre-Training

TEON: 张量化正交化超越逐层穆伦用于大语言模型预训练

Ruijie Zhang, Yequan Zhao, Ziyue Liu, Zhengyang Wang, Dongyang Li, Yupeng Su, Sijia Liu, Zheng Zhang

机构 * Computer Science \& Engineering, Michigan State University

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

AI总结 TEON通过张量化正交化方法改进大语言模型预训练,提升训练和验证困惑度,具有强鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00769 2026-02-03 cs.CL cs.AI 88%

Eliciting Trustworthiness Priors of Large Language Models via Economic Games

通过经济游戏 eliciting 大语言模型的信任度先验

Siyu Yan, Lusha Zhu, Jian-Qiao Zhu

机构 * University of Hong Kong(香港大学) The University of Hong Kong(香港大学) Peking University(北京大学) School of Psychological and Cognitive Sciences, Peking University(北京大学心理与认知科学学院) Beijing Key Laboratory of Behavior and Mental Health, Peking University(北京大学行为与心理健康重点实验室) IDG/McGovern Institute for Brain Research, Peking University(北京大学脑科学研究院) Peking-Tsinghua Center for Life Sciences, Peking University(北京大学-清华大学生命科学中心) Key Laboratory of Machine Perception, Ministry of Education, China(教育部机器感知重点实验室)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

AI总结 通过经济游戏实验,研究如何通过行为博弈论中的信任游戏获取大语言模型的信任度先验,并揭示其与人类信任差异及刻板印象模型的关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02132 2026-02-03 cs.CL 88%

There Is More to Refusal in Large Language Models than a Single Direction

大型语言模型中拒绝行为远不止单一方向

Faaiz Joad, Majd Hawasly, Sabri Boughorbel, Nadir Durrani, Husrev Taha Sencar

机构 * Qatar Computing Research Institute(卡塔尔计算研究所) HBKU(哈比卜大学)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 研究揭示大型语言模型中拒绝行为由多种几何方向控制,不同方向影响拒绝方式而非是否拒绝

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01063 2026-02-03 cs.CL cs.AI 86%

Personality Expression Across Contexts: Linguistic and Behavioral Variation in LLM Agents

人格表达的多情境性:语言与行为在大语言模型代理中的变化

Bin Han, Deuksin Kwon, Jonathan Gratch

机构 * University of Southern California(南加州大学)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究探讨了大语言模型在不同对话情境中人格表达的差异,发现相同人格提示在不同情境下产生不同语言、行为和情感表现,表明LLMs能根据社交需求灵活调整。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01025 2026-02-03 cs.LG cs.AI cs.CV 86%

Toward Universal and Transferable Jailbreak Attacks on Vision-Language Models

迈向通用且可迁移的视觉-语言模型劫持攻击

Kaiyuan Cui, Yige Li, Yutao Wu, Xingjun Ma, Sarah Erfani, Christopher Leckie, Hanxun Huang

机构 * School of Computing and Information Systems, The University of Melbourne, Australia(墨尔本大学计算机与信息系) School of Computing and Information Systems, Singapore Management University, Singapore(新加坡管理大学计算机与信息系) School of Information Technology, Deakin University, Australia(德肯大学信息科技系) Institute of Trustworthy Embodied AI, Fudan University, China(复旦大学可信具身人工智能研究所)

专题命中 其他LLM :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出UltraBreak,一种通用且可迁移的视觉-语言模型劫持攻击框架,通过视觉正则化和语义引导的文本监督,有效提升攻击的泛化能力和转移性能。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17899 2026-02-03 cs.NE 86%

Evolving Interdependent Operators with Large Language Models for Multi-Objective Combinatorial Optimization

利用大语言模型进化相互依赖的算子用于多目标组合优化

Junhao Qiu, Xin Chen, Liang Ge, Liyong Lin, Zhichao Lu, Qingfu Zhang

专题命中 其他LLM :large language model(title);language model(title);LLM(abstract)

AI总结 本文提出E2OC框架,利用大语言模型进化相互依赖的算子,提升多目标组合优化的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01169 2026-02-03 cs.CL 85%

PedagoSense: A Pedology Grounded LLM System for Pedagogical Strategy Detection and Contextual Response Generation in Learning Dialogues

PedagoSense: 一种基于土壤学的LLM系统,用于学习对话中的教学策略检测与上下文响应生成

Shahem Sultan, Shahem Fadi, Yousef Melhim, Ibrahim Alsarraj, Besher Hassan

机构 * Al Andlus University(阿尔安多斯大学) Ajman University(阿治曼大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 PedagoSense通过结合两阶段策略分类器和大语言模型,实现了学习对话中教学策略的检测与上下文响应生成,提升教育技术的适应性。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00459 2026-02-03 cs.CL 85%

What Matters to an LLM? Behavioral and Computational Evidences from Summarization

什么是对LLM重要的?来自摘要的行为主观和计算证据

Yongxin Zhou, Changshun Wu, Philippe Mulhem, Didier Schwab, Maxime Peyrard

机构 * Univ. Grenoble Alpes(格勒诺布尔大学) CNRS(国家科学研究中心) Inria(法国国家信息与自动化技术研究所) Grenoble INP(格勒诺布尔研究所) LIG(实验室)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文通过行为和计算分析研究LLM在摘要任务中的重要性选择机制,揭示了LLM在重要性模式上的一致性及注意力头与层对重要性的预测作用。

Comments Findings of EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00772 2026-02-03 cs.LG 84%

Provable Model Provenance Set for Large Language Models

大语言模型的可证模型来源集

Xiaoqi Qiu, Hao Zeng, Zhiyu Hou, Hongxin Wei

机构 * Department of Statistics and Data Science, Southern University of Science and Technology, Shenzhen, China(统计与数据科学系,南方科技大学,深圳,中国)

专题命中 其他LLM :large language model(title);language model(title);分类 cs.LG

AI总结 本文提出了一种可证明保证的模型来源集,通过顺序测试和排除方法实现可靠来源覆盖,适用于大语言模型的归因与审计任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01703 2026-02-03 cs.LG cs.CL 84%

$\textbf{AGT$^{AO}$}$: Robust and Stabilized LLM Unlearning via Adversarial Gating Training with Adaptive Orthogonality

AGT$^{AO}$:通过对抗门控训练与自适应正交性实现鲁棒且稳定的LLM反向学习

Pengyu Li, Lingling Zhang, Zhitao Gao, Yanrui Wu, Yuxuan Dong, Huan Liu, Bifan Wei, Jun Liu

机构 * School of Computer Science and Technology, Xi’an Jiaotong University, China(西安交通大学计算机科学与技术学院) MOE KLINNS Lab, Xi’an Jiaotong University, China(西安交通大学MOE KLINNS实验室) Shaanxi Province Key Laboratory of Big Data Knowledge Engineering, China(陕西省大数据知识工程重点实验室)

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 AGT$^{AO}$通过对抗门控训练与自适应正交性,实现LLM反向学习的鲁棒性和实用性平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17100 2026-02-03 cs.LG cs.AI cs.CL 80%

Geometric-disentangelment Unlearning

几何解耦遗忘

Duo Zhou, Yuji Zhang, Tianxin Wei, Ruizhong Qiu, Ke Yang, Xiao Lin, Cheng Qian, Jingrui He, Hanghang Tong, Chengxiang Zhai, Heng Ji, Huan Zhang

机构 * uiuc(伊利诺伊大学厄巴纳-香槟分校)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 几何解耦遗忘通过理论保证减少LLM遗忘与保留的权衡,提升遗忘提取强度。

Comments 26 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01240 2026-02-03 cs.CL 79%

Minimizing Mismatch Risk: A Prototype-Based Routing Framework for Zero-shot LLM-generated Text Detection

降低匹配风险:一种基于原型的路由框架用于零样本LLM生成文本检测

Ke Sun, Guangsheng Bao, Han Cui, Yue Zhang

机构 * School of Engineering, Westlake University, China(西交大学工程学院,中国)

专题命中 其他LLM :LLM(title,abstract);分类 cs.CL

AI总结 本文提出DetectRouter框架,通过两阶段训练学习文本检测器的亲和力,以解决零样本LLM生成文本检测中的匹配风险问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00420 2026-02-03 cs.CV cs.AI cs.CR 79%

Text is All You Need for Vision-Language Model Jailbreaking

文本就是视觉-语言模型劫持所需

Yihang Chen, Zhao Xu, Youyuan Jiang, Tianle Zheng, Cho-Jui Hsieh

机构 * University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 其他LLM :language model(title,abstract);分类 cs.AI

AI总结 Text-DJ通过将文本转换为图像并诱导干扰,成功绕过视觉-语言模型的安全防护,揭示了OCR能力在面对分散多模态输入时的脆弱性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21900 2026-02-03 cs.CV cs.AI cs.CY cs.MM 79%

TraceRouter: Robust Safety for Large Foundation Models via Path-Level Intervention

TraceRouter: 通过路径级干预实现大型基础模型的鲁棒安全性

Chuancheng Shi, Shangze Li, Wenjun Lu, Wenhua Wu, Cong Wang, Zifeng Cheng, Fei Shen, Tat-Seng Chua

机构 * The University of Sydney, Sydney, Australia(悉尼大学) Nanjing University of Science(南京理工大学) Nanjing University, Nanjing, China(南京大学) National University of Singapore, Singapore, Singapore(新加坡国立大学)

专题命中 其他LLM :foundation model(title,abstract);分类 cs.AI

AI总结 TraceRouter通过路径级干预有效切断有害语义的因果传播,提升大型基础模型的对抗鲁棒性与实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23361 2026-02-03 cs.SE cs.CL cs.LG 79%

SWE-Exp: Experience-Driven Software Issue Resolution

SWE-Exp:基于经验的软件问题解决

Silin Chen, Shaoxin Lin, Yuling Shi, Heng Lian, Xiaodong Gu, Longfei Yun, Dong Chen, Lin Cao, Jiyang Liu, Nu Xia, Qianxiang Wang

机构 * Shanghai Jiao Tong University(上海交通大学) Huawei(华为) Xidian University(西安电子科技大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 SWE-Exp通过提炼历史经验实现软件问题解决的持续学习,显著提升修复效率。

Comments Our code and data are available at https://github.com/YerbaPage/SWE-Exp

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00597 2026-02-03 cs.CL cs.AI 79%

Hermes the Polyglot: A Unified Framework to Enhance Expressiveness for Multimodal Interlingual Subtitling

赫мес:一种增强多模态跨语言字幕表达力的统一框架

Chaoqun Cui, Shijing Wang, Liangbin Huang, Qingqing Gu, Zhaolong Huang, Xiao Zeng, Wenji Mao

机构 * MAIS, Institute of Automation, Chinese Academy of Sciences Beijing China School of AI, University of\ Academy of Sciences Beijing China Beijing Jiaotong University Beijing China Geely AI lab Ningbo Zhejiang China MAIS, Institute of Automation, Chinese Academy of Sciences School of AI, University of\ Academy of Sciences Beijing Jiaotong University Geely AI lab

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 赫мес通过整合说话人分离、术语识别和表达力增强模块,提升了多模态跨语言字幕的表达力和连贯性,实现了最先进的字幕生成性能。

Comments Accepted to The Web Conference (WWW) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04347 2026-02-03 cs.CL cs.AI 79%

SCALM: Detecting Bad Practices in Smart Contracts Through LLMs

SCALM:通过LLMs检测智能合约中的不良实践

Zongwei Li, Xiaoqi Li, Wenkai Li, Xin Wang

机构 * Zongwei Li, Xiaoqi Li, Wenkai Li, Xin Wang(作者)

专题命中 其他LLM :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 SCALM通过结合Step-Back提示和RAG技术,有效检测智能合约中的不良实践,优于现有工具。

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01574 2026-02-03 cs.CV 78%

SGHA-Attack: Semantic-Guided Hierarchical Alignment for Transferable Targeted Attacks on Vision-Language Models

SGHA-Attack:语义引导的层次对齐用于视觉-语言模型的可迁移定向攻击

Haobo Wang, Weiqi Luo, Xiaojun Jia, Xiaochun Cao

机构 * Guangdong Province Key Lab of Information Security Technology, and School of Computer Science and Engineering, Sun Yat-sen University(广东信息安全技术重点实验室,计算机科学与工程学院,中山大学) Nanyang Technological University(南洋理工大学) School of Cyber Science and Technology, Shenzhen Campus, Sun Yat-sen University(网络安全科学与技术学院,深圳校区,中山大学)

专题命中 其他LLM :language model(title,abstract)

AI总结 SGHA-Attack通过语义引导的层次对齐框架,提升视觉-语言模型的定向转移攻击效果,增强跨异构模型的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10844 2026-02-03 cs.HC 78%

Be Friendly, Not Friends: How LLM Sycophancy Shapes User Trust

友好而非朋友:LLM谄媚如何塑造用户信任

Yuan Sun, Ting Wang

专题命中 其他LLM :LLM(title,abstract)

AI总结 研究探讨LLM谄媚如何影响用户信任,通过实验发现适应性对话态度影响用户对LLM真实性和信任度的感知。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00571 2026-02-03 cs.HC 78%

Eternagram: Inspiring Climate Action Through LLM-based Conversational Exploration of a Post-Devastation Climate Future

Eternagram:通过基于大语言模型的对话探索毁灭后的气候未来来激励气候行动

Suifang Zhou, Ray LC

专题命中 其他LLM :LLM(title,abstract)

AI总结 Eternagram通过基于大语言模型的对话探索毁灭后的气候未来,激发公众对气候问题的关注和环保意识。

Comments 7 pages, 5 figures, CUI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23327 2026-02-03 cs.HC 78%

"Shall We Dig Deeper?": Designing and Evaluating Strategies for LLM Agents to Advance Knowledge Co-Construction in Asynchronous Online Discussions

我们该深入挖掘吗?

Yuanhao Zhang, Wenbo Li, Xiaoyu Wang, Kangyu Yuan, Shuai Ma, Xiaojuan Ma

专题命中 其他LLM :LLM(title,abstract)

AI总结 本文提出了一种LLM代理,通过任务导向和关系导向的干预策略,促进异步在线讨论中知识的深入共构,并验证了不同干预风格对讨论进展的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00019 2026-02-03 q-bio.BM cs.AI 77%

AutoBinder Agent: An MCP-Based Agent for End-to-End Protein Binder Design

AutoBinder Agent:一种基于MCP的端到端蛋白质结合剂设计代理

Fukang Ge, Jiarui Zhu, Linjie Zhang, Haowen Xiao, Xiangcheng Bao, Fangnan Xie, Danyang Chen, Yanrui Lu, Yuting Wang, Ziqian Guan, Lin Gu, Jinhao Bi, Yingying Zhu

机构 * Guangzhou Institutes of Biomedicine and Health(广州生物医学研究院) Chinese Academy of Sciences(中国科学院) Renmin University of China(中国人民大学) South China University of Technology(华南理工大学) RIKEN, Japan(日本理化学研究所) Westlake University(西湖大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 AutoBinder Agent通过结合LLM与MCP协议,实现端到端蛋白质结合剂设计,提升药物设计流程的可重复性与可扩展性。

Comments 4 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02533 2026-02-03 cs.LG cs.AI cs.CL cs.MA 75%

Multi-Agent Design: Optimizing Agents with Better Prompts and Topologies

多智能体设计:通过更优提示和拓扑结构优化智能体

Han Zhou, Xingchen Wan, Ruoxi Sun, Hamid Palangi, Shariq Iqbal, Ivan Vulić, Anna Korhonen, Sercan Ö. Arık

机构 * Google(谷歌) University of Cambridge(剑桥大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出MASS框架,通过优化提示和拓扑结构提升多智能体系统性能,并揭示了有效构建多智能体系统的原理。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04528 2026-02-03 cs.CL cs.LG 73%

Group-Adaptive Threshold Optimization for Robust AI-Generated Text Detection

群体自适应阈值优化用于鲁棒的AI生成文本检测

Minseok Jung, Cynthia Fuertes Panizo, Liam Dugan, Yi R., Fung, Pin-Yu Chen, Paul Pu Liang

机构 * mit(麻省理工学院) upenn(宾夕法尼亚大学) ibm(IBM研究院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出FairOPT算法,通过群体特定的阈值优化减少AI生成文本检测中的群体差异,提升分类鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15234 2026-02-03 cs.HC 71%

LLM-based In-situ Thought Exchanges for Critical Paper Reading

基于大型语言模型的现场思维交流用于批判性论文阅读

Xinrui Fang, Anran Xu, Chi-Lan Yang, Ya-Fang Lin, Sylvain Malacria, Koji Yatani

专题命中 其他LLM :LLM(title)

AI总结 本文提出基于大型语言模型的现场思维交流系统,通过代理介导的交互提升初级研究人员的批判性思维能力,实验表明多代理条件下的参与度和视角分析效果最佳。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01684 2026-02-03 econ.GN cs.AI q-fin.EC 70%

The Strategic Foresight of LLMs: Evidence from a Fully Prospective Venture Tournament

大语言模型的战略前瞻性:来自一个前瞻性创业竞赛的证据

Felipe A. Csaszar, Aticus Peterson, Daniel Wilde

机构 * Ross School of Business University of Michigan(密歇根大学罗斯商学院) NYU Stern School of Business New York University(纽约大学 Stern 商学院) Kelley School of Business Indiana University(印第安纳大学凯利商学院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 大语言模型在战略前瞻性任务中超越人类,通过前瞻性创业竞赛验证其预测能力。

Comments 60 pages, 11 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05825 2026-02-03 cs.HC cs.AI 70%

Decoding Workload and Agreement From EEG During Spoken Dialogue With Conversational AI

从语音对话中解码工作负荷与共识的EEG信号

Lucija Mihić Zidar, Philipp Wicke, Praneel Bhatia, Rosa Lutz, Marius Klug, Thorsten O. Zander

机构 * Chair of Neuroadaptive Human--Computer Interaction(神经适应性人机交互教授席位) Brandenburg Technical University Cottbus--Senftenberg(勃兰登堡技术大学库滕堡-森芬根堡分校) Auryal GmbH(Auryal公司) Cottbus, Germany(库滕堡,德国)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出通过EEG解码语音对话中的工作负荷与共识,验证了现有分类器在对话场景中的迁移能力,并探讨了其应用限制。

Comments Accepted at the 14th International Winter Conference on Brain-Computer Interface

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00874 2026-02-03 quant-ph cs.DS cs.LG 70%

Sublinear Time Quantum Algorithm for Attention Approximation

亚线性时间的注意力近似量子算法

Zhao Song, Jianfei Xue, Jiahao Zhang, Lichen Zhang

机构 * Simons Institute for the Theory of Computing, UC Berkeley(Simons理论计算研究所,伯克利大学) New York University(纽约大学) Massachusetts Institute of Technology(麻省理工学院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出了一种量子算法,以亚线性时间近似注意力矩阵的行,利用量子Nyström近似、均值估计和杠杆得分采样技术。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏