arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-02-05 至 2026-02-05 共收录 24 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 24 篇

2602.04392 2026-02-05 cs.CL 88%

Evaluating the Presence of Sex Bias in Clinical Reasoning by Large Language Models

通过大语言模型评估临床推理中的性别偏见存在性

Isabel Tsintsiper, Sheng Wong, Beth Albert, Shaun P Brennecke, Gabriel Davis Jones

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 研究发现大语言模型在临床推理中存在性别偏见,不同模型表现不同,需谨慎配置与监督以确保医疗应用的安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16419 2026-02-05 cs.CL cs.CV 88%

Learning Domain Knowledge in Multimodal Large Language Models through Reinforcement Fine-Tuning

通过强化微调学习多模态大语言模型中的领域知识

Qinglong Cao, Yuntian Chen, Chao Ma, Xiaokang Yang

机构 * MoE Key Lab of Artificial Intelligence, AI Institute, Shanghai Jiao Tong University, Shanghai, China(人工智能大规模并行计算实验室,人工智能研究院,上海交通大学,上海)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出通过强化微调框架在优化层面整合领域知识,提升多模态大语言模型在专门领域任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02794 2026-02-05 cs.CY 88%

Reshaping Perception Through Technology: From Ancient Script to Large Language Models

通过技术重塑感知:从古代文字到大语言模型

Parham Pourdavood, Michael Jacob

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract)

AI总结 本文探讨了大语言模型作为新媒介对人类认知和创造力的影响,提出应将AI视为促进艺术技能的媒介,而非竞争对手。

Comments 14 pages, 0 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11733 2026-02-05 cs.CY cs.AI cs.CL cs.HC 86%

LLM Agents for Education: Advances and Applications

教育中的LLM代理:进展与应用

Zhendong Chu, Shen Wang, Jian Xie, Tinghui Zhu, Yibo Yan, Jinheng Ye, Aoxiao Zhong, Xuming Hu, Jing Liang, Philip S. Yu, Qingsong Wen

机构 * Squirrel Ai Learning Fudan University(复旦大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Tsinghua University(清华大学) University of Illinois Chicago(伊利诺伊大学芝加哥分校)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文综述了LLM代理在教育中的应用进展,探讨了其技术实现、挑战及在不同教育领域的应用。

Comments Accepted by EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04206 2026-02-05 cs.CL cs.AI 86%

Enforcing Monotonic Progress in Legal Cross-Examination: Preventing Long-Horizon Stagnation in LLM-Based Inquiry

在法律质证中强制单调进展:防止基于LLM的探究中长周期停滞

Hsien-Jyh Liao

机构 * Taiwan, ROC(台湾,中华民国)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出Soft-FSM架构,通过外部确定性状态控制器在法律质证中强制单调进展,显著提升任务完成率至97%以上。

Comments Submitted to ICAIL 2026. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18506 2026-02-05 cs.LG cs.AI 86%

LLM-ABBA: Understanding time series via symbolic approximation

LLM-ABBA:通过符号近似理解时间序列

Xinye Chen, Erin Carson, Cheng Kang

机构 * Sorbonne Université, CNRS, LIP6(索邦大学、法国国家科学研究中心、LIP6实验室) Department of Numerical Mathematics, Charles University(数值数学系、查尔斯大学) Department of Cybernetics, Czech Technical University in Prague(控制论系、布拉格捷克技术大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 LLM-ABBA通过符号近似方法在时间序列任务中实现高性能,适用于分类、回归和预测等多种下游任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04039 2026-02-05 cs.CR 85%

Evaluating the Vulnerability Landscape of LLM-Generated Smart Contracts

评估LLM生成的智能合约漏洞图景

Hoang Long Do, Nasrin Sohrabi, Muneeb Ul Hassan

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本研究评估了LLM生成的智能合约的安全性,发现其存在严重漏洞,提出缓解措施和开发指南以提高区块链安全。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02164 2026-02-05 cs.LG cs.CR 83%

Co-RedTeam: Orchestrated Security Discovery and Exploitation with LLM Agents

Co-RedTeam: 基于LLM代理的协同安全发现与利用

Pengfei He, Ash Fox, Lesly Miculicich, Stefan Friedli, Daniel Fabian, Burak Gokturk, Jiliang Tang, Chen-Yu Lee, Tomas Pfister, Long T. Le

机构 * Google(谷歌) Google Cloud AI Research(谷歌云人工智能研究) Michigan State University(密歇根州立大学)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 Co-RedTeam通过整合安全知识、代码分析和执行反馈,提升漏洞发现与利用的自动化水平,实现超过60%的漏洞利用成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21639 2026-02-05 cs.CV 82%

OCRVerse: Towards Holistic OCR in End-to-End Vision-Language Models

OCRVerse: 向端到端视觉语言模型中的整体OCR迈进

Yufeng Zhong, Lei Chen, Xuanle Zhao, Wenkang Han, Liming Zheng, Jing Huang, Deyang Jiang, Yilin Cao, Lin Ma, Zhixiong Zeng

机构 * Meituan(美团)

专题命中 领域大模型 :language model(title,abstract);SFT(abstract)

AI总结 OCRVerse是一种端到端的全面OCR方法,通过多领域训练实现文本和视觉导向OCR的统一,提升跨领域数据处理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04116 2026-02-05 cs.LG cs.AI cs.SI 81%

Toward Effective Multimodal Graph Foundation Model: A Divide-and-Conquer Based Approach

迈向有效的多模态图基础模型:基于分而治之的方法

Sicheng Liu, Xunkai Li, Daohan Su, Ru Zhang, Hongchao Qin, Ronghua Li, Guoren Wang

机构 * Department of XXX, University of YYY, Location, Country(XXX系,YYY大学,地点,国家)

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.AI、cs.LG

AI总结 PLANET提出了一种基于分而治之的方法,通过解耦模态交互和对齐,提升多模态图基础模型的性能。

Comments 20 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04630 2026-02-05 cs.CL 79%

Mapping the Web of Science, a large-scale graph and text-based dataset with LLM embeddings

映射Web of Science:一个大规模图和文本数据集的LLM嵌入方法

Tim Kunt, Annika Buchholz, Imene Khebouri, Thorsten Koch, Ida Litzel, Thi Huong Vu

机构 * Tim Kunt Digital Data and Information for Society, Science, and Culture, Zuse Institute Berlin, Takustr. 7, 14195 Berlin, Germany(Zuse Institute Berlin) Annika Buchholz Digital Data and Information for Society, Science, and Culture, Zuse Institute Berlin, Takustr. 7, 14195 Berlin, Germany(Zuse Institute Berlin) Imene Khebouri Digital Data and Information for Society, Science, and Culture, Zuse Institute Berlin, Takustr. 7, 14195 Berlin, Germany(Zuse Institute Berlin) Thorsten Koch Software and Algorithms for Discrete Optimization, Technische Universität Berlin, Straße des 17. Juni 135, 10623 Berlin, Germany Applied Optimization, Zuse Institute Berlin, Takustr. 7, 14195 Berlin, Germany(Technische Universität Berlin, Zuse Institute Berlin) Ida Litzel Digital Data and Information for Society, Science, and Culture, Zuse Institute Berlin, Takustr. 7, 14195 Berlin, Germany(Zuse Institute Berlin) Thi Huong Vu Digital Data and Information for Society, Science, and Culture, Zuse Institute Berlin, Takustr. 7, 14195 Berlin, Germany(Zuse Institute Berlin) Institute of Mathematics, Vietnam Academy of Science and Technology, 10072 Hanoi, Vietnam(Vietnam Academy of Science and Technology)

专题命中 领域大模型 :LLM(title,abstract);分类 cs.CL

AI总结 通过LLM嵌入方法研究Web of Science数据集,揭示文本的自我结构化景观。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04547 2026-02-05 cs.CV cs.AI 79%

OmniRad: A Radiological Foundation Model for Multi-Task Medical Image Analysis

OmniRad:一种多任务医学图像分析的放射学基础模型

Luca Zedda, Andrea Loddo, Cecilia Di Ruberto

机构 * Department of Mathematics and Computer Science, University of Cagliari(数学与计算机科学系,卡利亚里大学)

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.AI

AI总结 OmniRad通过预训练医学图像数据,提升多任务医学图像分析的性能,尤其在分类和分割任务中表现出色。

Comments 19 pages, 4 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15610 2026-02-05 cs.AI cs.LG 79%

Transduction is All You Need for Structured Data Workflows

传递是构建结构化数据工作流的全部需求

Alfio Gliozzo, Naweed Khan, Christodoulos Constantinides, Nandana Mihindukulasooriya, Nahuel Defosse, Gaetano Rossiello, Junkyu Lee

机构 * IBM

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 Agentics通过智能体嵌入数据类型,实现结构化数据工作流的逻辑传递,提升数据建模和处理效率。

Comments 38 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20504 2026-02-05 cs.CV 78%

UniVRSE: Unified Vision-conditioned Response Semantic Entropy for Hallucination Detection in Medical Vision-Language Models

UniVRSE: 统一的视觉条件响应语义熵用于医学视觉语言模型中的幻觉检测

Zehui Liao, Shishuai Hu, Ke Zou, Mengyuan Jin, Yanning Zhang, Huazhu Fu, Liangli Zhen, Yong Xia

机构 * National Engineering Laboratory for Integrated Aero-Space-Ground-Ocean Big Data Application Technology, School of Computer Science and Engineering, Northwestern Polytechnical University(集成航空航天地面海洋大数据应用技术国家工程实验室,计算机科学与工程学院,西北工业大学)

专题命中 领域大模型 :language model(title,abstract)

AI总结 UniVRSE通过统一的视觉条件响应语义熵框架,有效检测医学视觉语言模型中的幻觉,提升临床应用的可靠性。

Comments Under Review. 12 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03305 2026-02-05 cs.LG 77%

medR: Reward Engineering for Clinical Offline Reinforcement Learning via Tri-Drive Potential Functions

medR:通过三驱动势函数实现临床离线强化学习中的奖励工程

Qianyi Xu, Gousia Habib, Feng Wu, Yanrui Du, Zhihui Chen, Swapnil Mishra, Dilruk Perera, Mengling Feng

机构 * National University of Singapore(新加坡国立大学) University of Helsinki(赫尔辛基大学) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 medR通过三驱动势函数实现临床离线强化学习中的自动化奖励设计,提升策略性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03849 2026-02-05 cs.HC cs.AI cs.CL cs.LG 75%

HybridQuestion: Human-AI Collaboration for Identifying High-Impact Research Questions

HybridQuestion: 人机协作识别高影响力研究问题

Keyu Zhao, Fengli Xu, Yong Li, Tie-Yan Liu

机构 * Department of Electronic Engineering, BNRist, Tsinghua University(电子工程系、北京理工大学、清华大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 HybridQuestion通过人机协作识别高影响力研究问题,利用AI处理数据与人类判断结合,验证了在科学突破和未来问题预测中的有效性。

Comments 16 pages, 6 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17442 2026-02-05 cs.AI cs.ET cs.LG 73%

Keeping Medical AI Healthy and Trustworthy: A Review of Detection and Correction Methods for System Degradation

保持医疗AI的健康与可信:对系统退化检测与纠正方法的综述

Hao Guan, David Bates, Li Zhou

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文综述了医疗AI系统退化检测与纠正方法,探讨了性能退化原因、检测技术、根本原因分析及纠正策略,旨在提升医疗AI的可靠性和安全性。

Comments 16 pages, 5 figures

Journal ref IEEE Transactions on Biomedical Engineering, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04617 2026-02-05 cs.CL 70%

LEAD: Layer-wise Expert-aligned Decoding for Faithful Radiology Report Generation

LEAD:逐层专家对齐解码以生成准确的放射学报告

Ruixiao Yang, Yuanhe Tian, Xu Yang, Huiqi Li, Yan Song

专题命中 领域大模型 :LLM(abstract);language model(abstract);分类 cs.CL

AI总结 LEAD通过逐层专家对齐解码方法,提升放射学报告生成的准确性并减少幻觉。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14132 2026-02-05 cs.HC cs.CL 70%

When Avatars Have Personality: Effects on Engagement and Communication in Immersive Medical Training

当虚拟角色有个性时:对沉浸式医学培训中参与度和沟通的影响

Julia S. Dollis, Iago A. Brito, Fernanda B. Färber, Pedro S. F. B. Ribeiro, Gustavo H. W. Barbosa, Andressa A. Bastos, Rafael T. Sousa, Arlindo R. Galvão Filho

机构 * Advanced Knowledge Center for Immersive Technologies (AKCIT)(沉浸式技术高级知识中心) University of Goiás (UFG)(戈亚斯大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出利用大型语言模型与模块化架构创建具有个性的虚拟患者,提升沉浸式医学培训中的参与度与沟通效果。

Comments 10 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04460 2026-02-05 cs.IR 67%

DOS: Dual-Flow Orthogonal Semantic IDs for Recommendation in Meituan

DOS: 基于双流正交语义ID的美团推荐系统

Junwei Yin, Senjie Kou, Changhao Li, Shuli Wang, Xue Wei, Yinqiu Huang, Yinhua Zhu, Haitao Wang, Xingxing Wang

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 DOS通过双流正交语义ID方法提升推荐系统效果,有效解决语义空间对齐与量化损失问题。

Comments Accepted by WWW2026 (short paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04511 2026-02-05 cs.CV 67%

DuGI-MAE: Improving Infrared Mask Autoencoders via Dual-Domain Guidance

DuGI-MAE:通过双域引导改进红外遮蔽自编码器

Yinghui Xing, Xiaoting Su, Shizhou Zhang, Donghao Chu, Di Xu

专题命中 领域大模型 :foundation model(abstract);pretraining(abstract)

AI总结 DuGI-MAE通过双域引导策略提升红外遮蔽自编码器性能,解决信息token遗漏、全局关联建模不足及非均匀噪声问题,展现强泛化能力。

Journal ref Proceedings of the 40th AAAI Conference on Artificial Intelligence (AAAI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04466 2026-02-05 cs.CL cs.AI 62%

Is Micro Domain-Adaptive Pre-Training Effective for Real-World Operations? Multi-Step Evaluation Reveals Potential and Bottlenecks

微领域适应预训练在现实操作中是否有效?多步骤评估揭示了潜力和瓶颈

Masaya Tsunokake, Yuta Koreeda, Terufumi Morishita, Koichi Nagatsuka, Hikaru Tomonari, Yasuhiro Sogawa

机构 * Research & Development Group, Hitachi, Ltd(日立株式会社研发部)

专题命中 领域大模型 :LLM(abstract);分类 cs.CL、cs.AI

AI总结 本文通过多步骤评估揭示了微领域适应预训练在生成任务中的潜力和瓶颈,发现其在信息提取方面有效但推理能力有待提升。

Comments 13 pages, 9 figures, Accepted by EACL2026 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18496 2026-02-05 cs.AI 57%

DEEPMED: Building a Medical DeepResearch Agent via Multi-hop Med-Search Data and Turn-Controlled Agentic Training & Inference

DEEPMED:通过多跳Med-Search数据和转向控制的代理训练与推理构建医疗深度研究代理

Zihan Wang, Hao Wang, Shi Feng, Xiaocui Yang, Daling Wang, Yiqun Zhang, Jinghao Lin, Haihua Yang, Xiaozhong Ji

机构 * Northeastern University(东北大学) ByteDance(字节跳动)

专题命中 领域大模型 :prompting(abstract);分类 cs.AI

AI总结 DeepMed通过多跳Med-Search数据和转向控制训练推理,提升医疗领域深度推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09025 2026-02-05 eess.IV cs.LG eess.SP 57%

Universal Latent Homeomorphic Manifolds: A Framework for Cross-Domain Representation Unification

通用潜在同胚流形:跨域表示统一的框架

Tong Wu, Tayab Uddin Wara, Daniel Hernandez, Sidong Lei

机构 * University of Central Florida(中央佛罗里达大学)

专题命中 领域大模型 :foundation model(abstract);分类 cs.LG

AI总结 该研究提出ULHM框架,通过同胚理论统一跨域表示,实现稀疏恢复、跨域迁移和零样本学习。

详情

展开后加载摘要…

URL PDF HTML 收藏