arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-01-12 至 2026-01-12 共收录 18 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 18 篇

2601.05271 2026-01-12 cs.CL cs.LG 91%

Enhancing Foundation Models in Transaction Understanding with LLM-based Sentence Embeddings

利用基于大语言模型的句子嵌入增强交易理解的基础模型

Xiran Fan, Zhimeng Jiang, Chin-Chia Michael Yeh, Yuzhong Chen, Yingtong Dou, Menghai Pan, Yan Zheng

机构 * Visa Research(Visa研究)

专题命中 效率与部署 :LLM(title,abstract);foundation model(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出一种结合大语言模型生成的句子嵌入与轻量级交易模型的混合框架,以提升交易理解任务的性能和效率。

Journal ref Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing: Industry Track (EMNLP 2025), pages 903-911

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18839 2026-01-12 cs.CL 87%

Detect, Explain, Escalate: Sustainable Dialogue Breakdown Management for LLM Agents

检测、解释、升级:面向LLM代理的可持续对话破裂管理

Abdellah Ghassel, Xianzhi Li, Xiaodan Zhu

机构 * Department of Electrical and Computer Engineering and Ingenuity Labs Research Institute, Queen’s University(电气与计算机工程系和Ingenuity Labs研究研究所,皇后大学)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文提出了一种可持续对话破裂管理框架,通过高效检测器和升级架构,在LLM代理中实现资源高效的对话破裂管理,提升对话AI的可靠性和成本效益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15779 2026-01-12 cs.CL 85%

Reservoir Computing as a Language Model

回声计算作为语言模型

Felix Köster, Atsushi Uchida

机构 * Department of Information and Computer Sciences, Saitama University(信息与计算机科学系,上野大学)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

AI总结 本文比较了回声计算与Transformer在字符级语言建模中的表现,发现Transformer在预测质量上更优,而回声计算在能效方面更具优势。

Comments 8 pages, 5 figures, 1 table Code available at: https://github.com/fekoester/Shakespeare_Res and https://github.com/fekoester/LAERC

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09713 2026-01-12 cs.SE 85%

A First Look at Bugs in LLM Inference Engines

对LLM推理引擎中bug的首次审视

Mugeng Liu, Siqi Zhong, Weichen Bi, Yixuan Zhang, Zhiyang Chen, Zhenpeng Chen, Xuanzhe Liu, Yun Ma

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文首次对LLM推理引擎中的bug进行实证研究,揭示了六种bug症状类型和28种根本原因,为研究人员和开发者提供了改进bug检测与修复的指导。

Comments Accepted by ACM Transactions on Software Engineering and Methodology

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05988 2026-01-12 cs.CR cs.LG 83%

CyberGFM: Graph Foundation Models for Lateral Movement Detection in Enterprise Networks

CyberGFM:用于企业网络横向移动检测的图基础模型

Isaiah J. King, Bernardo Trindade, Benjamin Bowman, H. Howie Huang

机构 * Cybermonic LLC(Cybermonic公司) The George Washington University(乔治·华盛顿大学)

专题命中 效率与部署 :foundation model(title,abstract);language model(abstract);分类 cs.LG

AI总结 CyberGFM通过结合随机游走方法的效率和深度学习的语义表示,实现了网络异常检测的高效检测。

Comments 17 pages; 11 figures; 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05684 2026-01-12 cs.LG 83%

FLRQ: Faster LLM Quantization with Flexible Low-Rank Matrix Sketching

FLRQ: 更快的LLM量化方法与灵活的低秩矩阵草图

Hongyaoxing Gul, Lijuan Hu, Shuzi Niu, Fangfang Liu

专题命中 效率与部署 :LLM(title);language model(abstract);post-training(abstract);分类 cs.LG

AI总结 FLRQ通过灵活的低秩矩阵草图技术,快速确定最优秩并提高LLM量化的效率和质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05531 2026-01-12 q-bio.GN cs.LG 83%

DNATokenizer: A GPU-First Byte-to-Identifier Tokenizer for High-Throughput DNA Language Models

DNATokenizer: 一种面向高吞吐量DNA语言模型的GPU优先字节到标识符分词器

Eliatan Niktab, Hardip Patel

专题命中 效率与部署 :language model(title,abstract);foundation model(abstract);分类 cs.LG

AI总结 DNATok是一种高效的GPU优先分词系统,通过字节查找表和重叠H2D管道加速DNA语言模型的分词过程,显著提升编码和传输吞吐量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05257 2026-01-12 cs.IR cs.AI 79%

KP-Agent: Keyword Pruning in Sponsored Search Advertising via LLM-Powered Contextual Bandits

KP-Agent:通过LLM驱动的上下文老虎机实现关键词剪枝

Hou-Wan Long, Yicheng Song, Zidong Wang, Tianshu Sun

机构 * The Chinese University of Hong Kong(香港中文大学) University of Minnesota(明尼苏达大学) Cheung Kong Graduate School of Business(长江商学院)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.AI

AI总结 KP-Agent通过LLM驱动的上下文老虎机框架,利用强化学习优化关键词剪枝,提升付费搜索广告的累计利润

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20171 2026-01-12 cs.DC cs.AI cs.NI 77%

Collective Communication for 100k+ GPUs

为10万+GPU的集体通信

Min Si, Pavan Balaji, Yongzhou Chen, Ching-Hsiang Chu, Adi Gangidi, Saif Hasan, Subodh Iyengar, Dan Johnson, Bingzhe Liu, Regina Ren, Deep Shah, Ashmitha Jeevaraj Shetty, Greg Steinbrecher, Yulun Wang, Bruce Wu, Xinfeng Xie, Jingyi Yang, Mingran Yang, Kenny Yu, Minlan Yu, Cen Zhao, Wes Bland, Denis Boyda, Suman Gumudavelli, Prashanth Kannan, Cristian Lumezanu, Rui Miao, Zhe Qu, Venkat Ramesh, Maxim Samoylov, Jan Seidel, Srikanth Sundaresan, Feng Tian, Qiye Tan, Shuqiang Zhang, Yimeng Zhao, Shengbao Zheng, Art Zhu, Hongyi Zeng

机构 * Meta

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出NCCLX框架,优化LLM全生命周期性能,提升大规模GPU训练和推理的通信效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05259 2026-01-12 cs.IR 75%

A Technical Report on the Second Place Solution for the CIKM 2025 AnalytiCup Competition

CIKM 2025 AnalytiCup竞赛第二名解决方案的技术报告

Haotao Xie, Ruilin Chen, Yicheng Wu, Zhan Zhao, Yuanyuan Liu

专题命中 效率与部署 :large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文提出基于提示工程与任务分解的单模型框架,通过低秩适应提升多语言电商搜索相关性判断效率,取得竞赛优异成绩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05792 2026-01-12 cs.LG cs.AI q-bio.BM 62%

Tensor-DTI: Enhancing Biomolecular Interaction Prediction with Contrastive Embedding Learning

张量-DTI:通过对比嵌入学习增强生物分子相互作用预测

Manel Gil-Sorribes, Júlia Vilalta-Mor, Isaac Filella-Mercè, Robert Soliva, Álvaro Ciudad, Víctor Guallar, Alexis Molina

机构 * Nostrum Biodiscovery Barcelona Supercomputing Center(巴塞罗那超级计算中心) Faculty of Pharmacy and Food Sciences, University of Barcelona(巴塞罗那大学药学与食品科学系) Catalan Institution for Research and Advanced Studies (ICREA)(加泰罗尼亚研究与高级研究机构) Data Science Dpt., Almirall S.A.(Almirall S.A.数据科学部门)

专题命中 效率与部署 :language model(abstract);分类 cs.AI、cs.LG

AI总结 Tensor-DTI通过整合多模态嵌入与对比学习,提升生物分子相互作用预测的准确性与可靠性。

Comments Accepted at the Generative and Experimental Perspectives for Biomolecular Design Workshop at ICLR 2025 and at the Learning Meaningful Representations of Life Workshop at ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12181 2026-01-12 cs.LG cs.CL 62%

Generative or Discriminative? Revisiting Text Classification in the Era of Transformers

生成式还是判别式?在Transformer时代的文本分类再审视

Siva Rajesh Kasa, Karan Gupta, Sumegh Roychowdhury, Ashutosh Kumar, Yaswanth Biruduraju, Santhosh Kumar Kasa, Nikhil Priyatam Pattisapu, Arindam Bhattacharya, Shailendra Agarwal, Vijay huddar

专题命中 效率与部署 :language model(abstract);分类 cs.CL、cs.LG

AI总结 本文在Transformer时代重新审视文本分类,比较生成式与判别式模型的性能,揭示不同架构下的表现差异并提供实际应用指导。

Comments 23 pages - received Outstanding Paper award at EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05170 2026-01-12 cs.CL 57%

Reverse-engineering NLI: A study of the meta-inferential properties of Natural Language Inference

反向工程NLI:自然语言推理的元推理属性研究

Rasmus Blanck, Bill Noble, Stergios Chatzikyriakidis

机构 * The Centre for Linguistic Theory and Studies in Probability (CLASP), Department of Philosophy, Linguistics and Theory of Science, University of Gothenburg(语言理论与概率研究所以及哲学、语言学和科学理论系,哥德堡大学) Computational Linguistics and Language Technology Lab (UCRC), Department of Philology, University of Crete(计算语言学与语言技术实验室(UCRC),文学系,希腊克里特大学)

专题命中 效率与部署 :language model(abstract);分类 cs.CL

AI总结 本文研究NLI任务的元推理属性,通过分析SNLI数据集中的项目,探讨模型在推理一致性上的表现及数据集所编码的逻辑关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05573 2026-01-12 cs.CV 50%

Orient Anything V2: Unifying Orientation and Rotation Understanding

Orient Anything V2:统一物体3D方向和旋转理解

Zehan Wang, Ziang Zhang, Jiayang Xu, Jialei Wang, Tianyu Pang, Chao Du, HengShuang Zhao, Zhou Zhao

机构 * Zhejiang University(浙江大学) Shanghai AI Lab(上海人工智能实验室) Sea AI Lab(海思人工智能实验室) The University of Hong Kong(香港大学)

专题命中 效率与部署 :foundation model(abstract)

AI总结 Orient Anything V2通过四个创新提升,实现了对物体3D方向和旋转的统一理解,显著提升了零样本性能和泛化能力。

Comments NeurIPS 2025 Spotlight, Repo: https://github.com/SpatialVision/Orient-Anything-V2

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05549 2026-01-12 cs.IR 50%

Efficient Temporal-aware Matryoshka Adaptation for Temporal Information Retrieval

高效的时间感知Matryoshka适应方法用于时间信息检索

Tuan-Luc Huynh, Weiqing Wang, Trung Le, Thuy-Trang Vu, Dragan Gašević, Yuan-Fang Li, Thanh-Toan Do

专题命中 效率与部署 :LLM(abstract)

AI总结 本文提出TMRL方法,通过时间感知Matryoshka嵌入提升时间信息检索效率,实现与传统方法相当的性能并支持灵活的精度-效率权衡。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05536 2026-01-12 cs.DB 50%

Task Cascades for Efficient Unstructured Data Processing

任务级联用于高效无结构数据处理

Shreya Shankar, Sepanta Zeighami, Aditya Parameswaran

专题命中 效率与部署 :LLM(abstract)

AI总结 任务级联通过分解和优化文档处理任务,有效降低无结构数据处理成本,提升效率和准确性。

Comments SIGMOD 2026. 21 pages, 8 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21986 2026-01-12 cs.CV 50%

Sprint: Sparse-Dense Residual Fusion for Efficient Diffusion Transformers

Sprint: 基于稀疏-密集残差融合的高效扩散变换器

Dogyun Park, Moayed Haji-Ali, Yanyu Li, Willi Menapace, Sergey Tulyakov, Hyunwoo J. Kim, Aliaksandr Siarohin, Anil Kag

机构 * Snap Inc.(Snap公司) Korea University(韩国大学) KAIST(韩国科学技术院)

专题命中 效率与部署 :pretraining(abstract)

AI总结 SPRINT通过稀疏-密集残差融合实现高效扩散变换器训练,实现高达75%的标记丢弃率,同时保持生成质量与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08635 2026-01-12 cs.CV 50%

Latent Diffusion Autoencoders: Toward Efficient and Meaningful Unsupervised Representation Learning in Medical Imaging

潜在扩散自编码器:迈向医学影像中高效且有意义的无监督表示学习

Gabriele Lozupone, Alessandro Bria, Francesco Fontanella, Frederick J. A. Meijer, Claudio De Stefano, Henkjan Huisman

机构 * Department of Electrical and Information Engineering (DIEI), University of Cassino and Southern Lazio(电气与信息工程系(DIEI),卡斯诺和南部拉齐亚大学) Diagnostic Image Analysis Group, Radboud University Medical Center(影像诊断分析组,拉德堡德大学医学中心) Department of Medical Imaging, Radboud University Medical Center(医学成像系,拉德堡德大学医学中心)

专题命中 效率与部署 :foundation model(abstract)

AI总结 LDAE通过在潜在空间中应用扩散过程,实现了高效且有意义的医学影像无监督学习,展示了在AD诊断和年龄预测中的高准确性及重建质量。

Comments 15 pages, 9 figures, 7 tables

Journal ref Medical Image Analysis (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏