arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-03-03 至 2026-03-03 共收录 599 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 107 篇

2603.00483 2026-03-03 cs.CV cs.AI 57%

RAISE: Requirement-Adaptive Evolutionary Refinement for Training-Free Text-to-Image Alignment

RAISE:基于需求的进化精炼用于无训练文本到图像对齐

Liyao Jiang, Ruichen Chen, Chao Gao, Di Niu

机构 * Department of ECE, University of Alberta, Canada(阿尔伯塔大学电子工程系) Huawei Technologies, Canada(华为技术有限公司)

专题命中 效率与部署 :language model(abstract);分类 cs.AI

AI总结 RAISE是一种无训练、需求驱动的进化框架,通过动态调整生成过程实现高效且通用的文本到图像对齐。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07233 2026-03-03 cs.CL 57%

LAD-RAG: Layout-aware Dynamic RAG for Visually-Rich Document Understanding

LAD-RAG:面向视觉丰富文档的布局感知动态RAG

Zhivar Sourati, Zheng Wang, Marianne Menglin Liu, Yazhe Hu, Mengqing Guo, Sujeeth Bharadwaj, Kyu Han, Tao Sheng, Sujith Ravi, Morteza Dehghani, Dan Roth

专题命中 效率与部署 :LLM(abstract);分类 cs.CL

AI总结 LAD-RAG通过构建布局感知的文档图和动态检索机制,提升视觉丰富文档的检索与问答性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21835 2026-03-03 cs.LG 57%

On the $ε$-Free Inference Complexity of Absorbing Discrete Diffusion

关于吸收离散扩散的ε-免费推断复杂度

Xunpeng Huang, Yingyu Lin, Nishant Jain, Kaibo Wang, Difan Zou, Yian Ma, Tong Zhang

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) University of California San Diego(加州大学圣地亚哥分校) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) The University of Hong Kong(香港大学)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 本文提出AATU方法,通过吸收离散扩散的结构优势,实现了ε-TV收敛的O(d ln d)复杂度,消除了传统均匀化推理的分数限制假设,并在时间不变参数化中展示了更高效的推理策略。

Comments 48 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00136 2026-03-03 cs.CV cs.AI 57%

TinyVLM: Zero-Shot Object Detection on Microcontrollers via Vision-Language Distillation with Matryoshka Embeddings

TinyVLM:通过Matryoshka嵌入的视觉-语言蒸馏实现微控制器上的零样本目标检测

Bibin Wilson

机构 * Independent Researcher(独立研究者)

专题命中 效率与部署 :language model(abstract);分类 cs.AI

AI总结 TinyVLM通过Matryoshka嵌入和视觉-语言蒸馏,在微控制器上实现低内存的零样本目标检测

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00126 2026-03-03 cs.CV cs.AI cs.IR cs.MM cs.PF cs.SY eess.SY 57%

QuickGrasp: Responsive Video-Language Querying Service via Accelerated Tokenization and Edge-Augmented Inference

QuickGrasp: 通过加速分词和边缘增强推理实现响应式视频-语言查询服务

Miao Zhang, Ruixiao Zhang, Jianxin Shi, Hengzhi Wang, Hao Fang, Jiangchuan Liu

机构 * School of Computing Science, Simon Fraser University(计算科学学院,西蒙弗雷泽大学) Computer Science Department, University of Illinois Urbana-Champaign(计算机科学系,伊利诺伊大学厄巴纳-香槟分校) College of Cryptology and Cyber Science, Nankai University(密码学与网络科学学院,南开大学) College of Computer Science and Software Engineering, Shenzhen University(计算机科学与软件工程学院,深圳大学)

专题命中 效率与部署 :language model(abstract);分类 cs.AI

AI总结 QuickGrasp通过加速分词和边缘增强推理,实现响应式视频-语言查询服务,兼顾准确性和响应速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01476 2026-03-03 eess.AS eess.SP 50%

Entropy-Guided GRVQ for Ultra-Low Bitrate Neural Speech Codec

熵引导的GRVQ用于超低比特率神经语音编解码器

Yanzhou Ren, Noboru Harada, Daiki Takeuchi, Siyu Chen, Wei Liu, Xiao Zhang, Liyuan Zhang, Takehiro Moriya, Shoji Makino

专题命中 效率与部署 :language model(abstract)

AI总结 本文提出熵引导的组残差向量量化方法,用于超低比特率神经语音编解码器,以提升语音信号的重建质量和可懂度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23893 2026-03-03 cs.CV cs.RO 50%

AoE: Always-on Egocentric Human Video Collection for Embodied AI

AoE: 始终在线的以自身为中心的人类视频采集用于具身AI

Bowen Yang, Zishuo Li, Yang Sun, Changtao Miao, Yifan Yang, Man Luo, Xiaotong Yan, Feng Jiang, Jinchuan Shi, Yankai Fu, Ning Chen, Junkai Zhao, Pengwei Wang, Guocai Yao, Shanghang Zhang, Hao Chen, Zhe Li, Kai Zhu

机构 * Ant Digital Technologies, Ant Group(蚂蚁集团数字技术部) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Zhejiang University(浙江大学) Peking University(北京大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

专题命中 效率与部署 :foundation model(abstract)

AI总结 AoE系统通过利用人类和智能手机低成本采集以自身为中心的现实世界交互数据,解决具身AI的数据稀缺问题,提升现实世界泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01210 2026-03-03 cs.CV cs.RO 50%

OmniVLA: Physically-Grounded Multimodal VLA with Unified Multi-Sensor Perception for Robotic Manipulation

OmniVLA:具有统一多传感器感知的物理基础多模态VLA

Heyu Guo, Shanmu Wang, Ruichun Ma, Shiqi Jiang, Yasaman Ghasempour, Omid Abari, Baining Guo, Lili Qiu

机构 * Princeton University(普林斯顿大学) University of California, Los Angeles(加州大学洛杉矶分校) Microsoft Research Asia(微软亚洲研究院)

专题命中 效率与部署 :pretraining(abstract)

AI总结 OmniVLA通过整合多种传感器模态,提升机器人操作的感知能力与任务成功率。

Comments Accepted by ICRA'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03905 2026-03-03 cs.CV 50%

EchoMimicV3: 1.3B Parameters are All You Need for Unified Multi-Modal and Multi-Task Human Animation

EchoMimicV3:13亿参数足矣实现统一的多模态和多任务人类动画

Rang Meng, Yan Wang, Weipeng Wu, Ruobing Zheng, Yuming Li, Chenguang Ma

机构 * Terminal Technology Department, Alipay, Ant Group(蚂蚁集团支付宝终端技术部)

专题命中 效率与部署 :preference optimization(abstract)

AI总结 EchoMimicV3通过统一多任务和多模态人类动画,以13亿参数实现高效且稳定的多任务和多模态动画生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00682 2026-03-03 cs.CV 50%

CoLC: Communication-Efficient Collaborative Perception with LiDAR Completion

CoLC: 通信高效协同感知与激光雷达补全

Yushan Han, Hui Zhang, Qiming Xia, Yi Jin, Yidong Li

机构 * Key Laboratory of Big Data & Artificial Intelligence in Transportation, Ministry of Education(交通运输大数据与人工智能重点实验室,教育部) School of Computer Science and Technology, Beijing Jiaotong University(北京交通大学计算机科学与技术学院) Xiamen University(厦门大学)

专题命中 效率与部署 :prompting(abstract)

AI总结 CoLC通过激光雷达补全和早期融合技术,在稀疏传输下实现高效协同感知,提升感知与通信的平衡性能。

Comments Accepted by CVPR'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00466 2026-03-03 cs.CV 50%

DreamWorld: Unified World Modeling in Video Generation

DreamWorld: 视频生成中的统一世界建模

Boming Tan, Xiangdong Zhang, Ning Liao, Yuqing Zhang, Shaofeng Zhang, Xue Yang, Qi Fan, Yanyong Zhang

机构 * University of Science(科学技术大学) Shanghai Jiao Tong University, Shanghai, China.(上海交通大学) Nanjing University, Suzhou, China.(南京大学)

专题命中 效率与部署 :foundation model(abstract)

AI总结 DreamWorld通过联合世界建模范式和约束退火技术,提升视频生成的世界一致性,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 领域大模型 51 篇

2603.00076 2026-03-03 cs.CY cs.AI cs.LG 90%

The Value Sensitivity Gap: How Clinical Large Language Models Respond to Patient Preference Statements in Shared Decision-Making

价值敏感度缺口:临床大语言模型在共享决策中的患者偏好响应

Sanjay Basu

机构 * Waymark University of California, San Francisco(加州大学旧金山分校)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了临床大语言模型在共享决策中对患者偏好声明的响应,发现不同模型在价值敏感度和一致性上存在差异,通过实验验证了模型对患者价值的识别能力。

Comments 38 pages, 4 figures, supplementary appendix included

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13474 2026-03-03 cs.CL cs.AI cs.LG 87%

Language Agents for Hypothesis-driven Clinical Decision Making with Reinforcement Learning

用于强化学习的假设驱动临床决策制定语言代理

David Bani-Harouni, Chantal Pellegrini, Ege Özsoy, Nassir Navab, Matthias Keicher

机构 * Technical University of Munich(慕尼黑技术大学) Munich Center for Machine Learning(慕尼黑机器学习中心)

专题命中 领域大模型 :language agent(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出了一种基于强化学习的假设驱动语言代理LA-CDM,用于提升临床诊断的准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20095 2026-03-03 cs.CV cs.CL cs.LG 86%

BioCAP: Exploiting Synthetic Captions Beyond Labels in Biological Foundation Models

BioCAP: 利用合成描述性注释超越标签在生物基础模型中的应用

Ziheng Zhang, Xinyue Ma, Arpita Chowdhury, Elizabeth G. Campolongo, Matthew J. Thompson, Net Zhang, Samuel Stevens, Hilmar Lapp, Tanya Berger-Wolf, Yu Su, Wei-Lun Chao, Jianyang Gu

机构 * The Ohio State University(俄亥俄州立大学) Duke University(杜克大学) Boston University(波士顿大学)

专题命中 领域大模型 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 BioCAP通过生成合成描述性注释提升生物基础模型的性能,实现物种分类和文本-图像检索的高准确率。

Comments ICLR 2026; Project page: https://imageomics.github.io/biocap/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00451 2026-03-03 cs.AI cs.CL 86%

Confusion-Aware Rubric Optimization for LLM-based Automated Grading

面向混淆的评分标准优化:基于大语言模型的自动评分系统

Yucheng Chu, Hang Li, Kaiqi Yang, Yasemin Copur-Gencturk, Joseph Krajcik, Namsoo Shin, Jiliang Tang

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 CARO通过结构化分离错误信号,提升大语言模型自动评分系统的准确性和效率,有效解决评分逻辑冲突问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01557 2026-03-03 cs.AI 85%

Benchmarking LLM Summaries of Multimodal Clinical Time Series for Remote Monitoring

对多模态临床时间序列远程监测的LLM摘要进行基准测试

Aditya Shukla, Yining Yuan, Ben Tamo, Yifei Wang, Micky Nnamdi, Shaun Tan, Jieru Li, Benoit Marteau, Brad Willingham, May Wang

机构 * Georgia Institute of Technology(佐治亚理工学院) Shepherd Center(Shepherd中心)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文提出基于事件的评估框架,评估多模态临床时间序列摘要的可靠性,发现视觉方法在事件对齐上表现最佳。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00426 2026-03-03 cs.CL cs.CV 85%

LLM-Bootstrapped Targeted Finding Guidance for Factual MLLM-based Medical Report Generation

基于大语言模型的引导式目标发现指导:用于基于事实的多模态大语言模型医疗报告生成

Cunyuan Yang, Dejuan Song, Xiaotao Pang, Qianqian Shen, Wenjie Nie, Yifan Huang, Lei Wu, Wei Han, Haishuai Wang, Jiajun Bu

机构 * Zhejiang University(浙江大学) The Second Affiliated Hospital Zhejiang University School of Medicine(浙江大学医学院附属第二医院) Hangzhou Pu Jian Medical Technology Co., Ltd.(杭州普健医疗科技有限公司)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出Fact-Flow框架,通过引导大语言模型生成事实准确的医疗报告,利用LLM自动生成标注数据集,提升医疗报告生成的事实准确性。

Comments 10 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10066 2026-03-03 cs.SE cs.AI cs.PL 85%

OBsmith: LLM-Powered JavaScript Obfuscator Testing

OBsmith: 基于大语言模型的JavaScript混淆器测试

Shan Jiang, Chenguang Zhu, Sarfraz Khurshid

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 OBsmith利用大语言模型系统测试JavaScript混淆器,发现11个正确性错误,凸显其在混淆诱导误操作方面的有效性。

Comments Accepted, to appear in OOPSLA 2026

Journal ref Proc. ACM Program. Lang. 10, OOPSLA1, Article 96 (April 2026), 30 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12565 2026-03-03 cs.AI cs.CL cs.LG q-bio.QM 85%

mCLM: A Modular Chemical Language Model that Generates Functional and Makeable Molecules

mCLM:一种模块化化学语言模型,能够生成功能性强且可制造的分子

Carl Edwards, Chi Han, Gawon Lee, Thao Nguyen, Sara Szymkuć, Chetan Kumar Prasad, Bowen Jin, Jiawei Han, Ying Diao, Ge Liu, Hao Peng, Bartosz A. Grzybowski, Martin D. Burke, Heng Ji

机构 * Siebel School of Computing and Data Science, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校Siebel计算与数据科学学院) Department of Chemistry, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校化学系) Allchemy Inc.(Allchemy公司) Department of Chemical and Biomolecular Engineering, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校化学与生物分子工程系) Ulsan National Institute of Science and Technology(乌山国立科学技术研究院) Institute of Organic Chemistry, Polish Academy of Sciences(波兰科学院有机化学研究所)

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 mCLM是一种模块化化学语言模型,通过功能构建模块生成具有功能性和可制造性的分子,提升合成可行性和药物研发效率。

Comments Accepted to ICLR 2026 (Oral). Code: https://github.com/blender-nlp/mCLM Data and Model: https://huggingface.co/collections/language-plus-molecules/mclm

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01780 2026-03-03 cs.LG q-bio.GN 83%

D3LM: A Discrete DNA Diffusion Language Model for Bidirectional DNA Understanding and Generation

D3LM:一种用于双向DNA理解和生成的离散DNA扩散语言模型

Zhao Yang, Hengchang Liu, Chuan Cao, Bing Su

机构 * Gaoling School of Artificial Intelligence(人工智能学院)

专题命中 领域大模型 :language model(title,abstract);foundation model(abstract);分类 cs.LG

AI总结 D3LM通过掩码扩散统一双向DNA理解和生成,实现优于现有模型的性能。

Comments Accepted as a workshop paper at MLGenX 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01124 2026-03-03 cs.CV cs.AI 83%

ClinCoT: Clinical-Aware Visual Chain-of-Thought for Medical Vision Language Models

ClinCoT:面向医学视觉语言模型的临床感知视觉推理链

Xiwei Liu, Yulong Li, Xinlin Zhuang, Xuhui Li, Jianxu Chen, Haolin Yang, Imran Razzak, Yutong Xie

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) East China Normal University(东华大学)

专题命中 领域大模型 :language model(title,abstract);preference optimization(abstract);分类 cs.AI

AI总结 ClinCoT通过引入临床感知的视觉推理链框架,提升医学视觉语言模型在临床决策中的事实性支撑与多模态推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03906 2026-03-03 cs.AI 83%

Toward Clinically Explainable AI for Medical Diagnosis: A Foundation Model with Human-Compatible Reasoning via Reinforcement Learning

迈向临床可解释的AI:通过强化学习实现人友好的推理基础模型

Qika Lin, Yifan Zhu, Bin Pu, Ling Huang, Haoran Luo, Jingying Ma, Feng Wu, Kai He, Jiaxing Xu, Zhen Peng, Tianzhe Zhao, Fangzhi Xu, Jian Zhang, Zhonghong Ou, Erik Cambria, Swapnil Mishra, Mengling Feng

专题命中 领域大模型 :foundation model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 DeepMedix-R1通过强化学习实现临床可解释的AI,生成透明推理过程,优于现有模型,提升医学诊断的可解释性和实用性。

Comments 35 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00355 2026-03-03 cs.LG cs.SD eess.AS 83%

StethoLM: Audio Language Model for Cardiopulmonary Analysis Across Clinical Tasks

StethoLM:用于跨临床任务的心肺分析的音频语言模型

Yishan Wang, Tsai-Ning Wang, Mathias Funk, Aaqib Saeed

机构 * Eindhoven University of Technology(埃因霍温理工大学)

专题命中 领域大模型 :language model(title,abstract);preference optimization(abstract);分类 cs.LG

AI总结 StethoLM是首个用于心肺听诊的音频语言模型,能执行多种临床任务,通过多阶段训练提升性能和鲁棒性,为临床听诊提供新的AI解决方案。

Comments To be published in TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12282 2026-03-03 cs.AI cs.LG 82%

AISSISTANT: Human-AI Collaborative Review and Perspective Research Workflows in Data Science

AIssistant: 人机协作的数据科学科研与视角研究工作流

Sasi Kiran Gaddipati, Farhana Keya, Gollam Rabby, Sören Auer

机构 * TIB Leibniz Information Centre for Science and Technology(图灵信息科学与技术研究所) L3S Research Center(L3S研究中心)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 AIssistant通过人机协作框架提升数据科学科研与视角研究的效率和质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00675 2026-03-03 cs.CV 82%

Specializing Foundation Models via Mixture of Low-Rank Experts for Comprehensive Head CT Analysis

通过混合低秩专家专门化基础模型以实现全面头部CT分析

Youngjin Yoo, Han Liu, Bogdan Georgescu, Yanbo Zhang, Sasa Grbic, Michael Baumgartner, Thomas J. Re, Jyotipriya Das, Poikavila Ullaskrishnan, Eva Eibenberger, Andrei Chekkoury, Uttam K. Bodanapally, Savvas Nicolaou, Pina C. Sanelli, Thomas J. Schroeppel, Yvonne W. Lui, Eli Gibson

机构 * Digital Technology and Innovation, Siemens Healthineers, Princeton, NJ USA(西门子医疗数字化技术与创新部) Department of Computed Tomography, Siemens Healthineers, Forchheim, Germany(西门子医疗计算机断层扫描部) Department of Radiology, New York University, New York, NY USA(纽约大学放射科部) Department of Radiology, University of Maryland Medical Center, Baltimore, MD USA(马里兰大学医学中心放射科部) Department of Radiology, Vancouver General Hospital, Vancouver, BC Canada(温哥华总医院放射科部) Department of Radiology, Northwell Health, New York, NY USA(北well医疗放射科部) Department of Surgery, UCHealth Memorial Hospital, Colorado Springs, CO USA(UCHealth纪念医院外科部)

专题命中 领域大模型 :foundation model(title,abstract);pretraining(abstract)

AI总结 本文提出MoLRE框架,通过混合低秩专家提升基础模型在头部CT分析中的性能,实验显示在不同模型上均取得显著改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20677 2026-03-03 cs.LG cs.AI 81%

UrbanFM: Scaling Urban Spatio-Temporal Foundation Models

UrbanFM: 扩展城市时空基础模型

Wei Chen, Yuqian Wu, Junle Chen, Xiaofang Zhou, Yuxuan Liang

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.AI、cs.LG

AI总结 UrbanFM通过扩展城市时空数据和模型架构,实现大规模城市时空基础模型的初步突破。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00054 2026-03-03 cs.LG cs.AI 81%

Expert Divergence Learning for MoE-based Language Models

专家分歧学习用于基于混合专家的语言模型

Jiaang Li, Haibin Chen, Langming Liu, Yujin Yuan, Yadao Wang, Yizhen Zhang, Chengting Yu, Xin Tong, Weidong Zhang, Shilei Liu, Wenbo Su, Bo Zheng

机构 * Alibaba Group(阿里巴巴集团)

专题命中 领域大模型 :language model(title,abstract);分类 cs.AI、cs.LG

AI总结 专家分歧学习通过促进专家功能专业化,提升MoE模型的语言建模能力及下游任务性能。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19661 2026-03-03 cs.LG 79%

PaReGTA: An LLM-based EHR Data Encoding Approach to Capture Temporal Information

PaReGTA:基于LLM的EHR数据编码方法以捕捉时间信息

Kihyuk Yoon, Lingchao Mao, Catherine Chong, Todd J. Schwedt, Chia-Chun Chiang, Jing Li

机构 * Georgia Institute of Technology(佐治亚理工学院) Meta Mayo Clinic(梅奥诊所)

专题命中 领域大模型 :LLM(title,abstract);分类 cs.LG

AI总结 PaReGTA是一种基于LLM的EHR数据编码方法,通过模板文本生成、轻量级对比微调和混合时间池化,有效捕捉时间信息,提升偏头痛分类性能。

Comments 26 pages, 5 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00842 2026-03-03 cs.CL 79%

MedGPT-oss: Training a General-Purpose Vision-Language Model for Biomedicine

MedGPT-oss: 为生物医学训练一个通用的视觉-语言模型

Kai Zhang, Zhengqing Yuan, Cheng Peng, Songlin Zhao, Mengxian Lyu, Ziyi Chen, Yanfang Ye, Wei Liu, Ying Zhang, Kaleb E Smith, Lifang He, Lichao Sun, Yonghui Wu

机构 * Department of Computer Science and Engineering, Lehigh University(莱斯大学计算机科学与工程系) Department of Computer Science and Engineering, University of Notre Dame(圣母大学计算机科学与工程系) Department of Health Outcomes & Biomedical Informatics, University of Florida(佛罗里达大学健康结果与生物医学信息学系) Department of Radiation Oncology, Mayo Clinic(梅奥诊所放射肿瘤科) Research Computing, University of Florida(佛罗里达大学研究计算中心) AI Technology Center, NVIDIA(NVIDIA人工智能技术中心)

专题命中 领域大模型 :language model(title,abstract);分类 cs.CL

AI总结 MEDGPT-oss是一款开放式权重的200亿参数视觉-语言模型,通过优化训练课程实现多模态和文本推理能力,适用于隐私保护的临床AI研究。

Comments Technical report, work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00618 2026-03-03 cs.LG 79%

Multi-Domain Riemannian Graph Gluing for Building Graph Foundation Models

多领域黎曼图粘合用于构建图基础模型

Li Sun, Zhenhao Huang, Silei Chen, Lanxu Yang, Junda Ye, Sen Su, Philip S. Yu

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) North China Electric Power University(华北电力大学) University of Illinois Chicago(伊利诺伊大学香槟分校)

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.LG

AI总结 GraphGlue通过黎曼几何视角整合多领域图数据,构建统一流形以提升模型可转移性与性能。

Comments Accepted by ICLR'26, 41 pages

详情

展开后加载摘要…

URL PDF HTML 收藏