arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-12 至 2025-12-12 共收录 135 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 32 篇

2504.21336 2025-12-12 cs.CV 85%

UniBiomed: A Universal Foundation Model for Grounded Biomedical Image Interpretation

UniBiomed: 一种用于 grounded 生物医学图像解释的通用基础模型

Linshan Wu, Yuxiang Nie, Sunan He, Jiaxin Zhuang, Luyang Luo, Tao Li, Zhuoyao Xie, Dexuan Chen, Yinghua Zhao, Neeraj Mahboobani, Varut Vardhanabhuti, Ronald Cheong Kin Chan, Yifan Peng, Pranav Rajpurkar, Hao Chen

专题命中 评测与基准 :foundation model(title,abstract);large language model(abstract);language model(abstract)

AI总结 UniBiomed是一种基于多模态大语言模型和Segment Anything Model的通用基础模型,能够同时生成诊断结果并分割生物医学目标,提升生物医学图像分析的可解释性与性能。

Comments A universal foundation model for grounded biomedical image interpretation

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10487 2025-12-12 cs.CR 85%

LLM-Assisted AHP for Explainable Cyber Range Evaluation

基于大语言模型的AHP可解释性网络评估

Vyron Kampourakis, Georgios Kavallieratos, Georgios Spathoulas, Vasileios Gkioulos, Sokratis Katsikas

专题命中 评测与基准 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出基于大语言模型的AHP方法,用于可解释性网络评估,通过多准则决策方法评估CR平台的技术真实性和其他关键因素,实现一致的评估标准和可重复的对比结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10065 2025-12-12 cs.AI cs.HC 84%

Linear socio-demographic representations emerge in Large Language Models from indirect cues

大语言模型中线性社会人口表示从间接线索中涌现

Paul Bouchaud, Pedro Ramaciotti

机构 * Complex Systems Institute of Paris Ile-de-France CNRS(巴黎法兰西大区复杂系统研究所 CNRS) médialab, Sciences Po(媒体实验室,巴黎政治学院) Learning Planet Institute, CY Cergy Paris University(学习星球研究所,CY塞quenes巴黎大学)

专题命中 评测与基准 :large language model(title);language model(title);分类 cs.AI

AI总结 研究揭示大语言模型通过间接线索形成社会人口统计学表示,并展示这些隐性偏见如何影响下游任务如职业推荐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12617 2025-12-12 q-bio.GN cs.LG 83%

Same model, better performance: the impact of shuffling on DNA Language Models benchmarking

同一体模型,更好表现:洗牌对DNA语言模型基准测试的影响

Davide Greco, Konrad Rawlik

机构 * Baillie Gifford Pandemic Science Hub(巴利尔·吉福德流行病科学中心) University of Edinburgh(爱丁堡大学)

专题命中 评测与基准 :language model(title,abstract);large language model(abstract);分类 cs.LG

AI总结 本研究发现数据洗牌对DNA语言模型基准测试性能有显著影响,提出预洗牌解决方案以提高基准可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10384 2025-12-12 cs.CV cs.AI 79%

Towards Fine-Grained Recognition with Large Visual Language Models: Benchmark and Optimization Strategies

基于大视觉语言模型的细粒度识别:基准测试与优化策略

Cong Pang, Hongtao Yu, Zixuan Chen, Lewei Lu, Xin Lou

机构 * ShanghaiTech University(上海科技大学) Southeast University(东南大学) SenseTime Research(商汤科技研究院)

专题命中 评测与基准 :language model(title,abstract);分类 cs.AI

AI总结 本文提出FROW基准测试和优化策略,通过马赛克数据和开放世界数据提升大视觉语言模型的细粒度识别性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21356 2025-12-12 cs.SD cs.LG eess.AS 79%

Towards Robust Assessment of Pathological Voices via Combined Low-Level Descriptors and Foundation Model Representations

通过结合低级描述符和基础模型表示实现病理声音的稳健评估

Whenty Ariyanti, Kuan-Yu Chen, Sabato Marco Siniscalchi, Hsin-Min Wang, Yu Tsao

机构 * Department of Computer Science and Information Engineering, National Taiwan University of Science and Technology(国家交通大学科学与信息工程系) Research Center for Information Technology Innovation, Academia Sinica(学术院资讯科技创新研究中心) University of Palermo(巴勒莫大学) Institute of Information Science, Academia Sinica(学术院资讯科学研究所) Department of Electrical Engineering, Chung Yuan Christian University(Chung Yuan Christian University电子工程系)

专题命中 评测与基准 :foundation model(title,abstract);分类 cs.LG

AI总结 本文提出VOQANet和VOQANet+,结合基础模型嵌入与低级声学特征,提升病理声音评估的准确性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.20145 2025-12-12 cs.CL 79%

Leveraging language models for summarizing mental state examinations: A comprehensive evaluation and dataset release

利用语言模型进行精神状态检查的摘要:全面评估和数据集发布

Nilesh Kumar Sahu, Manjeet Yadav, Mudita Chaturvedi, Snehil Gupta, Haroon R Lone

机构 * IISER Bhopal India(比哈尔印度IISER)

专题命中 评测与基准 :language model(title,abstract);分类 cs.CL

AI总结 本研究利用语言模型对MSE进行摘要生成,通过开发问卷和收集数据,评估多种模型性能,最终发布数据集和模型供心理健康研究使用。

Comments Appeared in: Proceedings of the 31st International Conference on Computational Linguistics (COLING 2025), Abu Dhabi, UAE. ACL Anthology ID: 2025.coling-main.182. (https://aclanthology.org/2025.coling-main.182/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10148 2025-12-12 cs.CL cs.AI 79%

PARAN: Persona-Augmented Review ANswering system on Food Delivery Review Dataset

PARAN:基于食品配送评论数据集的个性化评论回复系统

Moonsoo Park, Jeongseok Yun, Bohyung Kim

机构 * Lemong Research(Lemong研究)

专题命中 评测与基准 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 PARAN通过从短评论文本中推断用户个性,提升食品配送评论回复的个性化和相关性,无需模型微调。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01524 2025-12-12 cs.CL cs.AI 79%

V-VAE: A Variational Auto Encoding Framework Towards Fine-Grained Control over Human-Like Chat

V-VAE:一种面向人类样聊天的变分自编码框架

Qi Lin, Weikai Xu, Lisi Chen, Bin Dai

机构 * University of Electronic Science and Technology of China(电子科学与技术大学)

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 V-VAE通过细粒度控制空间和高质量数据集提升人类样聊天的响应质量与一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03403 2025-12-12 cs.CL cs.AI 79%

BoundingDocs: a Unified Dataset for Document Question Answering with Spatial Annotations

BoundingDocs: 一个用于文档问答的统一数据集,包含空间标注

Simone Giovannini, Fabio Coppini, Andrea Gemelli, Simone Marinai

机构 * Università degli Studi di Firenze(佛罗伦萨大学) LETXBE

专题命中 评测与基准 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 BoundingDocs数据集通过整合文档AI和视觉丰富文档理解任务,统一了文档问答任务,提供精确的边界框标注以提升大语言模型在文档理解中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10895 2025-12-12 cs.AI 77%

LLMs Can Assist with Proposal Selection at Large User Facilities

大语言模型可帮助大型用户设施进行提案选择

Lijie Ding, Janell Thomson, Jon Taylor, Changwoo Do

机构 * Neutron Scattering Division, Oak Ridge National Laboratory, Oak Ridge, TN 37831, USA(奥克力国家实验室中子散射部)

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 大语言模型通过高效且低成本的方式提升大型用户设施提案选择的准确性与一致性。

Comments 9 pages, 8figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05414 2025-12-12 cs.CL 77%

LMSpell: Neural Spell Checking for Low-Resource Languages

LMSpell:低资源语言的神经拼写检查

Akesh Gunathilake, Nadil Karunarathna, Tharusha Bandaranayake, Nisansa de Silva, Surangika Ranathunga

机构 * Department of Computer Science and Engineering, University of Moratuwa(穆塔瓦大学计算机科学与工程系) School of Mathematical and Computational Sciences, Massey University(马希大学数学与计算科学学院)

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 LMSpell通过对比不同预训练语言模型在低资源语言拼写纠正中的表现,提出了一种易于使用的工具包,并通过僧伽罗语案例研究揭示了该领域存在的挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09964 2025-12-12 q-bio.GN 75%

Development of an Agentic AI Model for NGS Downstream Analysis Targeting Researchers with Limited Biological Background

面向生物背景有限研究者的NGS下游分析代理AI模型开发

Donghyeon Lee, Dongseok Kim, Seokhwan Ko, Seo-Young Park, Junghwan Cho

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出了一种面向生物背景有限研究者的代理AI模型,通过自动化NGS下游分析、文献支持的解释和高级分析方法推荐,实现从基础数据处理到假设验证的无缝过渡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16528 2025-12-12 cs.LG 74%

Aligning ASR Evaluation with Human and LLM Judgments: Intelligibility Metrics Using Phonetic, Semantic, and NLI Approaches

对齐语音识别评估与人类和LLM判断:利用音系、语义和NLI方法的可理解性度量

Bornali Phukon, Xiuwen Zheng, Mark Hasegawa-Johnson

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系)

专题命中 评测与基准 :LLM(title);分类 cs.LG

AI总结 本文提出结合NLI、语义和音系相似性的新型语音识别评估度量,以提高对口吃和发音障碍语音的可理解性评估精度。

Comments 5 pages, 2 figures, Interspeech 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11375 2025-12-12 cs.AI cs.CL 73%

Benchmarking Multimodal LLMs on Recognition and Understanding over Chemical Tables

在化学表格上评估多模态大语言模型的基准测试

Yitong Zhou, Mingyue Cheng, Qingyang Mao, Yucong Luo, Qi Liu, Yupeng Li, Xiaohan Zhang, Deguang Liu, Xin Li, Enhong Chen

机构 * State Key Laboratory of Cognitive Intelligence(认知智能国家重点实验室) University of Science and Technology of China(中国科学技术大学) Artificial Intelligence Research Institute(人工智能研究院) iFLYTEK Co., Ltd(iFLYTEK公司)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出ChemTable基准,用于评估多模态模型在理解化学表格中的能力,揭示了现有模型在跨模态对齐和领域推理方面的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00597 2025-12-12 cs.CL cs.AI 73%

On the Consistency of Multilingual Context Utilization in Retrieval-Augmented Generation

在检索增强生成中多语言上下文利用的一致性

Jirui Qi, Raquel Fernández, Arianna Bisazza

机构 * Center for Language and Cognition (CLCG), University of Groningen(格罗宁根大学语言与认知中心) Institute for Logic, Language and Computation (ILLC), University of Amsterdam(阿姆斯特丹大学逻辑、语言与计算研究所)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究探讨LLMs在多语言RAG中利用不同语言上下文的一致性,发现其能提取异语言信息但难以生成正确语言答案。

Comments Best Paper Award at MRL Workshop 2025, colocated with EMNLP 2025. All codes and data are released at https://github.com/Betswish/mRAG-Context-Consistency

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10624 2025-12-12 cs.CL 70%

AgriGPT-Omni: A Unified Speech-Vision-Text Framework for Multilingual Agricultural Intelligence

AgriGPT-Omni: 一种统一的语音-视觉-文本框架用于多语言农业智能

Bo Yang, Lanfei Feng, Yunkui Chen, Yu Zhang, Jianyu Zhang, Xiao Xu, Nueraili Aierken, Shijian Li

机构 * Zhejiang University(浙江大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 AgriGPT-Omni提出了一种统一的语音-视觉-文本框架,通过数据合成、多阶段训练和三模态基准,提升多语言农业智能的性能和可重复性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10403 2025-12-12 cs.SD cs.CL 70%

BRACE: A Benchmark for Robust Audio Caption Quality Evaluation

BRACE:一种用于鲁棒音频描述质量评估的基准

Tianyu Guo, Hongyu Chen, Hao Liang, Meiyi Qiang, Bohan Zeng, Linzhuang Sun, Bin Cui, Wentao Zhang

机构 * Peking University(北京大学) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 评测与基准 :LLM(abstract);language model(abstract);分类 cs.CL

AI总结 BRACE基准用于评估参考自由环境下音频描述质量,揭示CLAP模型和LALM的局限性,推动未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05647 2025-12-12 cs.CL 70%

A Greek Government Decisions Dataset for Public-Sector Analysis and Insight

一个用于公共部门分析与洞察的希腊政府决策数据集

Giorgos Antoniou, Giorgos Filandrianos, Aggelos Vlachos, Giorgos Stamou, Lampros Kollimenos, Konstantinos Skianis, Michalis Vazirgiannis

机构 * National Technical University of Athens, Greece(希腊国家技术大学) University of Thessaly, Greece(希腊塞萨洛尼基大学) University of Ioannina, Greece(希腊伊奥安尼纳大学)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 该研究提出了一种大规模公共部门语料库,用于分析和生成公共决策信息,支持高级信息检索和透明度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10114 2025-12-12 cs.AI 70%

AgriRegion: Region-Aware Retrieval for High-Fidelity Agricultural Advice

AgriRegion: 基于区域意识的高保真农业建议检索

Mesafint Fanuel, Mahmoud Nabil Mahmoud, Crystal Cook Marshal, Vishal Lakhotia, Biswanath Dari, Kaushik Roy, Shaohu Zhang

机构 * North Carolina A\&T State University(北卡罗来纳A&T州立大学) The University of Alabama(阿拉巴马大学) North Carolina Agricultural and Technical State University(北卡罗来纳农业与技术州立大学) Amazon AWS(亚马逊AWS)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 AgriRegion通过区域意识检索增强生成框架,提升农业建议的本地准确性与可靠性。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10336 2025-12-12 cs.CL cs.AI 62%

Multilingual VLM Training: Adapting an English-Trained VLM to French

多语言视觉语言模型训练:将英语训练的VLM适应到法语

Jules Lahmi, Alexis Roger

机构 * Ecole Polytechnique(巴黎政治学院) Mila - Quebec AI Institute(魁北克人工智能研究所) McGill University(麦吉尔大学)

专题命中 评测与基准 :language model(abstract);分类 cs.CL、cs.AI

AI总结 本文研究了将英语训练的视觉语言模型适应到法语等其他语言的挑战,通过比较不同方法的性能和计算成本,发现数据翻译是多语言VLM性能的主要瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10863 2025-12-12 cs.CV cs.AI 57%

MMSI-Video-Bench: A Holistic Benchmark for Video-Based Spatial Intelligence

MMSI-Video-Bench: 一个面向视频基于空间智能的综合基准

Jingli Lin, Runsen Xu, Shaohao Zhu, Sihan Yang, Peizhou Cao, Yunlong Ran, Miao Hu, Chenming Zhu, Yiman Xie, Yilin Long, Wenbo Hu, Dahua Lin, Tai Wang, Jiangmiao Pang

机构 * Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiaotong University(上海交通大学) The Chinese University of Hong Kong(香港中文大学) Zhejiang University(浙江大学) Beihang University(北京航空航天大学) Xi’an Jiaotong University(西安交通大学) University of Hong Kong(香港大学) Fudan University(复旦大学) University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 评测与基准 :prompting(abstract);分类 cs.AI

AI总结 MMSI-Video-Bench是一个综合评估视频基于空间智能的基准,通过多任务和多数据集评估25个MLLMs,揭示了人机推理差距和模型泛化不足的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10596 2025-12-12 cs.CV cs.AI 57%

Beyond Pixels: A Training-Free, Text-to-Text Framework for Remote Sensing Image Retrieval

超越像素:一种无训练的文本到文本框架用于遥感图像检索

J. Xiao, Y. Guo, X. Zi, K. Thiyagarajan, C. Moreira, M. Prasad

机构 * Information Technology University of Technology Sydney Sydney, Australia(信息科技技术大学悉尼分校悉尼澳大利亚) Robotics Laboratory (SensR Lab) Centre for Advanced Manufacturing Technology Western Sydney University Sydney, Australia(机器人实验室(SensR实验室)先进制造技术中心西悉尼大学悉尼澳大利亚) The Data Science Institute Faculty of Engineering(数据科学学院工程学院)

专题命中 评测与基准 :language model(abstract);分类 cs.AI

AI总结 本文提出无训练的文本到文本框架TRSLLaVA,通过结构化文本实现高效遥感图像检索,实验表明其性能优于现有监督模型。

Comments 6 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10808 2025-12-12 cs.CV 50%

Graph Laplacian Transformer with Progressive Sampling for Prostate Cancer Grading

基于渐进采样的图拉普拉变换用于前列腺癌分级

Masum Shah Junayed, John Derek Van Vessem, Qian Wan, Gahie Nam, Sheida Nabavi

机构 * School of Computing, University of Connecticut (UConn)(计算学院,康涅狄格大学) Pathology and Laboratory Medicine, UConn Health(病理学与实验室医学,UConn健康)

专题命中 评测与基准 :foundation model(abstract)

AI总结 本文提出基于渐进采样的图拉普拉变换用于前列腺癌分级,通过改进的特征学习和空间一致性建模,提升分类性能。

Comments International Conference on Medical Image Computing and Computer-Assisted Intervention (MICCAI) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10619 2025-12-12 cs.CV 50%

DOCR-Inspector: Fine-Grained and Automated Evaluation of Document Parsing with VLM

DOCR-Inspector: 基于VLM的文档解析细粒度与自动化评估

Qintong Zhang, Junyuan Zhang, Zhifei Ren, Linke Ouyang, Zichen Wen, Junbo Niu, Yuan Qu, Bin Wang, Ka-Ho Chow, Conghui He, Wentao Zhang

机构 * Peking University(北京大学) Shanghai AI Laboratory(上海人工智能实验室) The University of HongKong(香港大学) Shanghai Jiaotong University(上海交通大学)

专题命中 评测与基准 :language model(abstract)

AI总结 DOCR-Inspector通过细粒度错误检测和分析,提供文档解析质量的自动化评估,优于现有商业和开源模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10286 2025-12-12 cs.CV 50%

ShotDirector: Directorially Controllable Multi-Shot Video Generation with Cinematographic Transitions

ShotDirector: 电影化可控多镜头视频生成

Xiaoxue Wu, Xinyuan Chen, Yaohui Wang, Yu Qiao

机构 * Fudan University(复旦大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 评测与基准 :prompting(abstract)

AI总结 ShotDirector通过整合参数级相机控制和分层编辑模式感知提示,实现了电影化可控的多镜头视频生成。

Comments Project Page: https://uknowsth.github.io/ShotDirector/

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 22 篇

2512.08609 2025-12-12 cs.AI 89%

CogMCTS: A Novel Cognitive-Guided Monte Carlo Tree Search Framework for Iterative Heuristic Evolution with Large Language Models

CogMCTS: 一种用于基于大语言模型的迭代启发式进化的大脑引导蒙特卡洛树搜索框架

Hui Wang, Yang Liu, Xiaoyu Zhang, Chaoxu Mu

机构 * School of Artificial Intelligence, Anhui University(安徽大学人工智能学院) Anhui Provincial Key Laboratory of Security Artificial Intelligence, Anhui University(安徽省安全人工智能重点实验室) Pengcheng Laboratory, Shenzhen, China(深圳鹏城实验室)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 CogMCTS通过整合大语言模型的认知引导机制与MCTS,实现高效的自动启发式优化,提升搜索多样性与解质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00791 2025-12-12 cs.CL cs.CV 89%

Vision-centric Token Compression in Large Language Model

以视觉为中心的标记压缩在大语言模型中

Ling Xing, Alex Jinpeng Wang, Rui Yan, Xiangbo Shu, Jinhui Tang

机构 * Nanjing University of Science and Technology(南京理工大学) Central South University(中南大学) Nanjing Forestry University(南京林业大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 Vist通过视觉与语言结合的压缩方法,在减少标记数量的同时保持模型准确性,提升了大语言模型的效率。

Comments NeurIPS 2025 spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01113 2025-12-12 cs.IR cs.AI cs.CL 86%

GFM-RAG: Graph Foundation Model for Retrieval Augmented Generation

基于图的检索增强生成模型:图基础模型

Linhao Luo, Zicheng Zhao, Gholamreza Haffari, Dinh Phung, Chen Gong, Shirui Pan

机构 * Monash University(墨尔本大学) Nanjing University of Science and Technology(南京理工大学) Shanghai Jiao Tong University(上海交通大学) Griffith University(格里菲斯大学)

专题命中 效率与部署 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 GFM-RAG是一种基于图的检索增强生成模型,通过创新的图神经网络捕捉复杂查询-知识关系,实现了在未见数据集上的高效性能和泛化能力。

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08001 2025-12-12 cs.LG cs.AI cs.CL 85%

Reparameterized LLM Training via Orthogonal Equivalence Transformation

通过正交等价变换重新参数化LLM训练

Zeju Qiu, Simon Buchholz, Tim Z. Xiao, Maximilian Dax, Bernhard Schölkopf, Weiyang Liu

机构 * Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所) The Chinese University of Hong Kong(香港中文大学)

专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 POET通过正交等价变换重新参数化神经元,提升LLM训练的稳定性与泛化能力,并验证了其在大规模神经网络训练中的有效性。

Comments NeurIPS 2025 (40 pages, 26 figures, project page: https://spherelab.ai/poet/, v4: added experiments of finetuning and larger-scale pretraining)

详情

展开后加载摘要…

URL PDF HTML 收藏