arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-02-06 至 2026-02-06 共收录 201 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 34 篇

2602.05857 2026-02-06 cs.AI 70%

BABE: Biology Arena BEnchmark

BABE:生物学竞技场基准

Junting Zhou, Jin Chen, Linfeng Hao, Denghui Cao, Zheyu Wang, Qiguang Chen, Chaoyou Fu, Jiaze Chen, Yuchen Wu, Ge Zhang, Mingxuan Wang, Wenhao Huang, Tong Yang

机构 * Peking University(北京大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 BABE基准通过评估生物AI系统的实验推理能力,解决现有生物学基准未能评估实验结果与上下文知识整合能力的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.07253 2026-02-06 cs.LG cs.CV 70%

Alignment of Diffusion Models: Fundamentals, Challenges, and Future

扩散模型对齐:基础、挑战与未来

Buhua Liu, Shitong Shao, Bao Li, Lichen Bai, Zhiqiang Xu, Haoyi Xiong, James Kwok, Sumi Helal, Zeke Xie

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Baidu Inc.(百度公司) The University of Bologna(博洛尼亚大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文综述了扩散模型对齐的基础、挑战及未来方向,探讨了对齐技术、评估方法及当前挑战的解决方案。

Comments Accepted at ACM Computing Surveys. 35 pages, 5 figures, 4 tables. Paper List: github.com/xie-lab-ml/awesome-alignment-of-diffusion-models

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13342 2026-02-06 cs.AI cs.CL cs.LG 67%

Verifying the Verifiers: Unveiling Pitfalls and Potentials in Fact Verifiers

验证验证者:揭示事实验证器中的陷阱与潜力

Wooseok Seo, Seungju Han, Jaehun Jung, Benjamin Newman, Seungwon Lim, Seungbeen Lee, Ximing Lu, Yejin Choi, Youngjae Yu

机构 * Yonsei University(延世大学) Stanford University(斯坦福大学) University of Washington(华盛顿大学) Seoul National University(首尔国立大学)

专题命中 评测与基准 :LLM(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本研究评估了多种大语言模型和事实验证器,揭示了数据标注问题、前沿模型性能及小型验证器的改进潜力。

Comments Accepted to COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05392 2026-02-06 cs.CL cs.AI 62%

Beyond Length: Context-Aware Expansion and Independence as Developmentally Sensitive Evaluation in Child Utterances

超越长度:基于上下文的扩展与独立性作为儿童言语发展的敏感评估

Jiyun Chun, Eric Fosler-Lussier, Michael White, Andrew Perrault

机构 * The Ohio State University(俄亥俄州立大学)

专题命中 评测与基准 :LLM(abstract);分类 cs.CL、cs.AI

AI总结 本文提出了一种基于上下文的评估框架,通过扩展和独立性两个维度评估儿童言语的发展性,提升对儿童对话质量的敏感度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04890 2026-02-06 physics.geo-ph cs.AI cs.CV cs.LG 62%

A General-Purpose Diversified 2D Seismic Image Dataset from NAMSS

来自NAMSS的通用多样化2D地震图像数据集

Lucas de Magalhães Araujo, Otávio Oliveira Napoli, Sandra Avila, Edson Borin

机构 * Instituto de Computação Universidade Estadual de Campinas (Unicamp)(计算研究所 Campinas 州立大学)

专题命中 评测与基准 :pretraining(abstract);分类 cs.AI、cs.LG

AI总结 Unicamp-NAMSS数据集通过多样化和广泛分布的2D地震剖面,为地球物理学中的机器学习研究提供支持,适用于预训练、自监督学习和领域适应等任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06013 2026-02-06 cs.CV cs.AI 57%

GenArena: How Can We Achieve Human-Aligned Evaluation for Visual Generation Tasks?

GenArena: 如何在视觉生成任务中实现人对齐的评估?

Ruihang Li, Leigang Qu, Jingxu Zhang, Dongnan Gui, Mengde Xu, Xiaosong Zhang, Han Hu, Wenjie Wang, Jiaqi Wang

机构 * University of Science(科学大学) Shanghai Innovation Institute(上海创新研究所) Tencent(腾讯) National University of Singapore(新加坡国立大学)

专题命中 评测与基准 :language model(abstract);分类 cs.AI

AI总结 GenArena通过成对比较范式实现视觉生成任务的人对齐评估,使开源模型超越专有模型,提升评估准确性达20%以上。

Comments Project Page: https://genarena.github.io/, Code: https://github.com/ruihanglix/genarena

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05480 2026-02-06 cs.CV 50%

SOMA-1M: A Large-Scale SAR-Optical Multi-resolution Alignment Dataset for Multi-Task Remote Sensing

SOMA-1M: 一种大规模SAR-光学多分辨率对齐数据集用于多任务遥感

Peihao Wu, Yongxiang Yao, Yi Wan, Wenfei Zhang, Ruipeng Zhao, Jiayuan Li, Yongjun Zhang

机构 * School of Remote Sensing Information Engineering, Wuhan University(遥感信息工程学院,武汉大学) Hubei LuoJia Laboratory(湖北珞珈实验室) Technology Innovation Center for Collaborative Applications of Natural Resources Data in GBA, Ministry of Natural Resources(粤港澳大湾区自然资源数据协同应用技术创新中心,自然资源部)

专题命中 评测与基准 :foundation model(abstract)

AI总结 SOMA-1M是首个大规模SAR-光学多分辨率对齐数据集,用于提升多任务遥感图像处理的性能和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10555 2026-02-06 cs.CV 50%

SurgLaVi: Large-Scale Hierarchical Dataset for Surgical Vision-Language Representation Learning

SurgLaVi:大规模分层数据集用于外科视觉-语言表示学习

Alejandra Perez, Chinedu Nwoye, Ramtin Raji Kermani, Omid Mohareri, Muhammad Abdullah Jamal

机构 * Intuitive Surgical, Inc.(Intuitive Surgical公司) Center for Research and Formation in Artificial Intelligence (CinfonIA), Universidad de los Andes(人工智能研究中心(CinfonIA))

专题命中 评测与基准 :foundation model(abstract)

AI总结 SurgLaVi是一个大规模分层外科视觉-语言数据集,通过自动化流程生成高质量标注,用于提升手术视频的表示学习和多任务迁移能力。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 37 篇

2602.04913 2026-02-06 cs.LG cs.AI cs.SD 92%

A$^2$-LLM: An End-to-end Conversational Audio Avatar Large Language Model

A$^2$-LLM:一种端到端的对话音频虚拟形象大语言模型

Xiaolin Hu, Hang Yuan, Xinzhu Sang, Binbin Yan, Zhou Yu, Cong Huang, Kai Chen

机构 * State Key Laboratory of Information Photonics(信息光子学国家重点实验室) Optical Communications, Beijing University of Posts(邮电大学光学通信学院) Zhongguancun Institute of Artificial Intelligence, Beijing, China(中关村人工智能研究院) School of Finance and Statistics, East China Normal University, Shanghai, China(东华大学金融与统计学院)

专题命中 效率与部署 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

AI总结 A$^2$-LLM通过统一框架联合推理语言、音频语调和3D面部运动,实现端到端的情感表达对话虚拟形象,提升实时效率与情感表现力。

Comments 13 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04896 2026-02-06 cs.CR cs.AI 89%

Steering Externalities: Benign Activation Steering Unintentionally Increases Jailbreak Risk for Large Language Models

转向外部性:良性激活转向无意中增加大语言模型的劫持风险

Chen Xiong, Zhiyuan He, Pin-Yu Chen, Ching-Yun Ko, Tsung-Yi Ho

机构 * Department of Computer Science and Engineering, The Chinese University of Hong Kong(香港中文大学计算机科学与工程系)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);post-training(abstract);分类 cs.AI

AI总结 本文研究了大语言模型中良性激活转向对安全性的负面影响,发现其无意中增加劫持风险,并通过实验验证了这一现象。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05452 2026-02-06 cs.DB 89%

DistillER: Knowledge Distillation in Entity Resolution with Large Language Models

DistillER: 基于大语言模型的实体解析中的知识蒸馏

Alexandros Zeakis, George Papadakis, Dimitrios Skoutas, Manolis Koubarakis

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 DistillER通过知识蒸馏方法,利用大语言模型和小型语言模型,提升实体解析的效率和效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22936 2026-02-06 cs.CV 88%

PPE: Positional Preservation Embedding for Token Compression in Multimodal Large Language Models

PPE:用于多模态大语言模型中token压缩的位置保持嵌入

Mouxiao Huang, Borui Jiang, Dehua Zheng, Hailin Hu, Kai Han, Xinghao Chen

机构 * Huawei Technologies(华为技术有限公司)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract)

AI总结 PPE通过保持位置信息提升多模态大语言模型的token压缩效率和性能

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15397 2026-02-06 cs.AI cs.CL cs.SD 86%

Beyond Prompting: Efficient and Robust Contextual Biasing for Speech LLMs via Logit-Space Integration (LOGIC)

超越提示:通过logit空间整合实现语音大语言模型的高效且鲁棒的上下文偏差(LOGIC)

Peidong Wang

专题命中 效率与部署 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 LOGIC通过logit空间整合实现语音大语言模型的高效且鲁棒的上下文偏差,有效降低实体识别错误率。

Comments This paper is withdrawn temporarily to ensure full compliance with internal institutional publication approval processes

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05712 2026-02-06 cs.SE cs.AI 85%

Towards Green AI: Decoding the Energy of LLM Inference in Software Development

迈向绿色AI:解码LLM推理中的能耗在软件开发中

Lola Solovyeva, Fernando Castor

机构 * University of Twente(特文特大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究分析了LLM推理能耗,发现prefill阶段影响解码能耗,通过抑制babbling行为可实现高达89%的能耗节省。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05499 2026-02-06 cs.AI 85%

SDFP: Speculative Decoding with FIT-Pruned Models for Training-Free and Plug-and-Play LLM Acceleration

SDFP:基于FIT剪枝模型的投机解码用于无训练和即插即用的大语言模型加速

Hanyu Wei, Zunhai Su, Peng Lu, Chao Li, Spandan Tiwari, Ashish Sirasao, Yuhan Dong

机构 * Tsinghua University(清华大学) Advanced Micro Devices, Inc.(先进微器件公司)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 SDFP通过FIT剪枝技术实现无训练、即插即用的大语言模型加速,提升解码速度而不影响输出分布。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19438 2026-02-06 cs.DC cs.PF 82%

Opt4GPTQ: Co-Optimizing Memory and Computation for 4-bit GPTQ Quantized LLM Inference on Heterogeneous Platforms

Opt4GPTQ: 为异构平台上的4位GPTQ量化LLM推理共同优化内存与计算

Yaozheng Zhang, Wei Wang, Jie Kong, Jiehan Zhou, Xianwei Zhang, Huanqing Cui, Han Bao, Yuhai Liu

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract)

AI总结 Opt4GPTQ通过整合三种平台优化策略,提升异构平台上4位GPTQ量化LLM推理的性能和吞吐量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06038 2026-02-06 cs.RO cs.AI cs.CV cs.LG cs.MA 81%

CommCP: Efficient Multi-Agent Coordination via LLM-Based Communication with Conformal Prediction

CommCP:通过基于大语言模型的通信实现高效的多智能体协调

Xiaopan Zhang, Zejin Wang, Zhixu Li, Jianpeng Yao, Jiachen Li

机构 * Trustworthy Autonomous Systems Laboratory at the University of California, Riverside, CA, USA(加州大学河滨分校可信自主系统实验室)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.AI、cs.LG

AI总结 CommCP通过基于大语言模型的通信框架,提升多智能体协作任务的成功率和探索效率。

Comments IEEE International Conference on Robotics and Automation (ICRA 2026); Project Website: https://comm-cp.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05728 2026-02-06 cs.CL cs.AI 81%

CompactRAG: Reducing LLM Calls and Token Overhead in Multi-Hop Question Answering

CompactRAG: 减少多跳问答中的LLM调用和令牌开销

Hao Yang, Zhiyu Yang, Xupeng Zhang, Wei Wei, Yunjie Zhang, Lin Yang

机构 * State Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学) Erik Jonsson School of Engineering and Computer Science, University of Texas at Dallas(埃里克·乔纳森工程与计算机科学学院,德克萨斯大学达拉斯分校) Isoftstone Information Technology (Group) Co.,Ltd.(伊软石信息技术(集团)有限公司) College of Electronic and Information Engineering, Tongji University(电子信息工程学院,同济大学) School of Electronic Information, Central South University(电子信息学院,中南大学)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.CL、cs.AI

AI总结 CompactRAG通过解耦离线语料重组与在线推理,减少多跳问答中的LLM调用和令牌消耗,提升效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05145 2026-02-06 cs.LG cs.AI 81%

TIDE: Temporal Incremental Draft Engine for Self-Improving LLM Inference

TIDE:面向自我改进LLM推理的时序增量草稿引擎

Jiyoung Park, Hankyu Jang, Changseok Song, Wookeun Jung

专题命中 效率与部署 :LLM(title,abstract);分类 cs.AI、cs.LG

AI总结 TIDE通过整合在线草稿适应和自适应运行时控制,提升LLM推理效率并减少训练时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20339 2026-02-06 cs.CL cs.LG 81%

Improving Diffusion Language Model Decoding through Joint Search in Generation Order and Token Space

通过生成顺序和令牌空间的联合搜索改进扩散语言模型解码

Yangyi Shen, Tianjian Feng, Jiaqi Han, Wen Wang, Tianlang Chen, Chunhua Shen, Jure Leskovec, Stefano Ermon

机构 * stanford(斯坦福大学) zju(浙江大学)

专题命中 效率与部署 :language model(title,abstract);分类 cs.CL、cs.LG

AI总结 本研究通过联合搜索生成顺序和令牌空间,改进扩散语言模型的解码性能,在多个基准测试中取得显著优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14982 2026-02-06 cs.LG cs.AI cs.CL stat.ML 80%

In-context Time Series Predictor

上下文时间序列预测器

Jiecheng Lu, Yan Sun, Shihao Yang

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出一种基于上下文的时间序列预测方法,通过将时间序列预测任务转化为输入标记,提高了参数效率并减少了过拟合问题。

Comments Camera-ready version. Accepted at ICLR 2025

Journal ref Proceedings of the Thirteenth International Conference on Learning Representations (ICLR 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13771 2026-02-06 cs.LG cs.AI cs.CL 80%

LittleBit: Ultra Low-Bit Quantization via Latent Factorization

LittleBit:通过潜在因子分解实现超低比特量化

Banseok Lee, Dongkyu Kim, Youngcheon You, Youngmin Kim

机构 * Samsung Research(三星研究院)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 LittleBit通过潜在因子分解实现超低比特量化,实现高达31倍的内存压缩,同时在亚1比特域内提升模型性能,达到FP16的11.6倍推理加速。

Comments Accepted to NeurIPS 2025. Banseok Lee and Dongkyu Kim contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13948 2026-02-06 eess.AS cs.AI 79%

Stream-Voice-Anon: Enhancing Utility of Real-Time Speaker Anonymization via Neural Audio Codec and Language Models

Stream-Voice-Anon: 通过神经音频编解码器和语言模型提升实时语音匿名化的效用

Nikita Kuzmin, Songting Liu, Kong Aik Lee, Eng Siong Chng

机构 * Nanyang Technological University, Singapore(南洋理工大学,新加坡) Institute for Infocomm Research, A STAR, Singapore(信息通信研究所,新加坡) The Hong Kong Polytechnic University, Hong Kong(香港理工大学,香港)

专题命中 效率与部署 :language model(title,abstract);分类 cs.AI

AI总结 Stream-Voice-Anon通过神经音频编解码器和语言模型提升实时语音匿名化效果,实现更高的可懂度和情绪保留,同时保持低延迟和隐私保护。

Comments Accepted by ICASSP2026. Demo/code: https://paniquex.github.io/Stream-Voice-Anon/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08667 2026-02-06 cs.LG stat.ML 79%

TabPFN-2.5: Advancing the State of the Art in Tabular Foundation Models

TabPFN-2.5:推动表格基础模型的最新进展

Léo Grinsztajn, Klemens Flöge, Oscar Key, Felix Birkel, Philipp Jund, Brendan Roof, Benjamin Jäger, Dominik Safaric, Simone Alessi, Adrian Hayler, Mihir Manium, Rosen Yu, Felix Jablonski, Shi Bin Hoo, Anurag Garg, Jake Robertson, Magnus Bühler, Vladyslav Moroshan, Lennart Purucker, Clara Cornu, Lilly Charlotte Wehrhahn, Alessandro Bonetto, Bernhard Schölkopf, Sauraj Gambhir, Noah Hollmann, Frank Hutter

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.LG

AI总结 TabPFN-2.5通过提升表格基础模型的性能,在多个基准测试中超越传统树模型,并提供更高效的部署方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06022 2026-02-06 cs.LG cs.AI 79%

Correctness-Optimized Residual Activation Lens (CORAL): Transferrable and Calibration-Aware Inference-Time Steering

正确性优化残差激活透镜(CORAL):可转移且校准感知的推理时间引导

Miranda Muqing Miao, Young-Min Cho, Lyle Ungar

机构 * Department of Computer and Information Science, University of Pennsylvania, Philadelphia, USA(计算机与信息科学系,宾夕法尼亚大学,费城,美国)

专题命中 效率与部署 :large language model(abstract);language model(abstract);instruction tuning(abstract);分类 cs.AI、cs.LG

AI总结 CORAL通过正则化探针提取模型内部分布式信息,提升推理时多项选择问答的准确性与校准性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22129 2026-02-06 cs.SE cs.AI cs.LG 79%

SWE-Replay: Efficient Test-Time Scaling for Software Engineering Agents

SWE-Replay:面向软件工程代理的高效测试时间扩展

Yifeng Ding, Lingming Zhang

机构 * Siebel School of Computing(计算科学系) Data Science, University of Illinois Urbana-Champaign, USA(数据科学,伊利诺伊大学厄巴纳-香槟分校)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 SWE-Replay通过重用历史轨迹和动态选择探索或利用策略,实现了高效且可推广的软件工程代理测试时间扩展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05384 2026-02-06 cs.CV 78%

Dolphin-v2: Universal Document Parsing via Scalable Anchor Prompting

Dolphin-v2:通过可扩展的锚点提示实现通用文档解析

Hao Feng, Wei Shi, Ke Zhang, Xiang Fei, Lei Liao, Dingkang Yang, Yongkun Du, Xuecheng Wu, Jingqun Tang, Yang Liu, Hong Chen, Can Huang

专题命中 效率与部署 :prompting(title);language model(abstract)

AI总结 Dolphin-v2通过可扩展的锚点提示实现通用文档解析,改进了文档类型分类、布局分析和元素检测,提升了对拍摄文档的解析能力并减少错误率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06616 2026-02-06 cs.NI cs.AI 77%

Generative AI for Intent-Driven Network Management in 6G RAN: A Case Study on the Mamba Model

生成式AI用于6G RAN中的意图驱动网络管理:Mamba模型的案例研究

Md Arafat Habib, Medhat Elsayed, Yigit Ozcan, Pedro Enrique Iturria-Rivera, Majid Bavand, Melike Erol-Kantarci

机构 * School of Electrical Engineering and Computer Science, University of Ottawa(电气与计算机科学学院,渥太华大学) Ericsson(爱立信)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出基于Mamba模型的意图驱动网络管理架构,通过生成式AI提升网络自动化性能,实现70%的服务质量漂移降低和80 Mbps吞吐量提升。

Comments Paper submitted to IEEE for possible publication. The contents of this paper may change at any time

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.06085 2026-02-06 cs.PF cs.AI cs.AR 77%

Assessing Tenstorrent's RISC-V MatMul Acceleration Capabilities

评估Tenstorrent的RISC-V矩阵乘法加速能力

Hiari Pizzini Cavagna, Daniele Cesarini, Andrea Bartolini

机构 * University of Bologna(博洛尼亚大学) Cineca(Cineca公司)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文评估了Tenstorrent Grayskull e75 RISC-V加速器在降低精度下的矩阵乘法性能,对比了其与NVIDIA GPU和Intel处理器的能耗与计算效率。

Comments Accepted to the Computational Aspects of Deep Learning Workshop at ISC High Performance 2025. To appear in the ISC High Performance 2025 Workshop Proceedings

Journal ref Proc. High Performance Computing: ISC High Performance 2025 International Workshops, Hamburg, Germany

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04929 2026-02-06 cs.LG 77%

TurboBoA: Faster and Exact Attention-aware Quantization without Backpropagation

TurboBoA: 更快且精确的注意力感知量化无需反向传播

Junhan Kim, Yeo Jeong Park, Seungwoo Son, Chungman Lee, Ho-young Kim, Joonyoung Kim, Yongkweon Jeon

机构 * Samsung Research(三星研究院) SNU.ac.kr(首尔国立大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.LG

AI总结 TurboBoA是一种无需反向传播的高效PTQ算法,通过联合量化和误差补偿提升精度与速度,实现比BoA更快的量化过程。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏