arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-01-30 至 2026-01-30 共收录 258 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 70 篇

2601.22061 2026-01-30 cs.CV 50%

BLO-Inst: Bi-Level Optimization Based Alignment of YOLO and SAM for Robust Instance Segmentation

BLO-Inst: 基于双层优化的YOLO和SAM对齐以实现鲁棒的实例分割

Li Zhang, Pengtao Xie

机构 * Electrical and Computer Engineering, University of California San Diego, CA, US(电子与计算机工程系,加州大学圣地亚哥分校)

专题命中 效率与部署 :prompting(abstract)

AI总结 BLO-Inst通过双层优化对齐YOLO和SAM,提升实例分割的鲁棒性和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27349 2026-01-30 cs.IT math.IT 50%

Cross-Band Channel Impulse Response Prediction: Leveraging 3.5 GHz Channels for Upper Mid-Band

跨频段通道冲击响应预测:利用3.5 GHz通道用于上中频段

Fan-Hao Lin, Chi-Jui Sung, Chu-Hsiang Huang, Hui Chen, Chao-Kai Wen, Henk Wymeersch

专题命中 效率与部署 :foundation model(abstract)

AI总结 本文提出CIR-UNext框架,利用3.5 GHz通道数据预测7 GHz通道冲击响应,提升6G网络中跨频段预测的效率与准确性。

Comments 6 pages, 5 figures, 4 tables, this work has been submitted to IEEE International Conference on Communications (ICC) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21673 2026-01-30 cs.CV 50%

Multimodal Visual Surrogate Compression for Alzheimer's Disease Classification

多模态视觉代理压缩用于阿尔茨海默病分类

Dexuan Ding, Ciyuan Peng, Endrowednes Kuantama, Jingcai Guo, Jia Wu, Jian Yang, Amin Beheshti, Ming-Hsuan Yang, Yuankai Qi

机构 * Macquarie University(麦考瑞大学) Federation University Australia(联邦大学澳大利亚) The Hong Kong Polytechnic University(香港理工大学) University of California at Merced(加州大学默塞德分校)

专题命中 效率与部署 :foundation model(abstract)

AI总结 MVSC通过压缩和适应大尺寸3D sMRI体积为紧凑的2D视觉代理,提升阿尔茨海默病分类性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21506 2026-01-30 cs.RO cs.SY eess.SY 50%

IROS: A Dual-Process Architecture for Real-Time VLM-Based Indoor Navigation

IROS: 一种用于实时基于视觉语言模型的室内导航的双过程架构

Joonhee Lee, Hyunseung Shin, Jeonggil Ko

机构 * Yonsei University(延世大学)

专题命中 效率与部署 :language model(abstract)

AI总结 IROS是一种结合视觉语言模型上下文推理与轻量级感知模块的双过程架构,实现低延迟的室内导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17138 2026-01-30 q-bio.BM 50%

AI Developments for T and B Cell Receptor Modeling and Therapeutic Design

人工智能在T细胞和B细胞受体建模及治疗设计中的发展

Linhui Xie, Aurelien Pelissier, Yanjun Shao, Maria Rodriguez Martinez

专题命中 效率与部署 :language model(abstract)

AI总结 本研究利用人工智能技术,通过预测和生成框架改进T和B细胞受体建模,提升治疗设计的效率和临床相关性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07720 2026-01-30 cs.CV 50%

ACDiT: Interpolating Autoregressive Conditional Modeling and Diffusion Transformer

ACDiT:插值自回归条件建模与扩散变换器

Jinyi Hu, Shengding Hu, Yuxuan Song, Yufei Huang, Mingxuan Wang, Hao Zhou, Zhiyuan Liu, Wei-Ying Ma, Maosong Sun

机构 * Tsinghua University(清华大学) ByteDance(字节跳动)

专题命中 效率与部署 :language model(abstract)

AI总结 ACDiT通过结合自回归和扩散范式,实现连续视觉信息的灵活插值生成,优于现有自回归基线,在视觉生成任务中表现最佳。

Comments TMLR camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 领域大模型 20 篇

2503.24289 2026-01-30 cs.IR cs.CL 91%

Rec-R1: Bridging Generative Large Language Models and User-Centric Recommendation Systems via Reinforcement Learning

Rec-R1: 通过强化学习连接生成式大语言模型与以用户为中心的推荐系统

Jiacheng Lin, Tian Wang, Kun Qian

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);SFT(abstract)

AI总结 Rec-R1通过强化学习连接生成式大语言模型与用户导向推荐系统,有效提升推荐性能并保留LLM通用能力。

Comments Published in the TMLR journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21340 2026-01-30 cs.AI 89%

EHR-RAG: Bridging Long-Horizon Structured Electronic Health Records and Large Language Models via Enhanced Retrieval-Augmented Generation

EHR-RAG: 通过增强检索增强生成连接长期结构电子健康记录和大型语言模型

Lang Cao, Qingyu Chen, Yue Guo

机构 * University of Illinois Urbana-Champaign, United States(伊利诺伊大学厄巴纳-香槟分校) Yale University, United States(耶鲁大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 EHR-RAG通过增强检索增强生成方法,提升长期结构电子健康记录在临床预测中的表现,实现宏F1平均提升10.76%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17865 2026-01-30 cs.CL 89%

D-Models and E-Models: Diversity-Stability Trade-offs in the Sampling Behavior of Large Language Models

D模型和E模型:大语言模型采样行为中的多样性-稳定性权衡

Jia Gu, Liang Pang, Huawei Shen, Xueqi Cheng

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(人工智能安全国家重点实验室,计算技术研究所,中国科学院) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 研究揭示了大语言模型中D模型与E模型在采样行为上的多样性-稳定性权衡,为任务应用中的模型选择提供了指导。

Comments 12 pages, 10 figures. Accepted by WWW'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02028 2026-01-30 cs.CL 88%

Are Large Language Models Good Classifiers? A Study on Edit Intent Classification in Scientific Document Revisions

大型语言模型是好的分类器吗?科学文档修订中的编辑意图分类研究

Qian Ruan, Ilia Kuznetsov, Iryna Gurevych

机构 * Ubiquitous Knowledge Processing Lab (UKP Lab)(通用知识处理实验室) Department of Computer Science(计算机科学系) Hessian Center for AI (hessian.AI)(黑森人工智能中心)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文研究了大型语言模型在科学文档修订中的编辑意图分类任务中的表现,通过实验和数据集构建探讨了其分类能力及应用价值。

Comments EMNLP2024 Main

Journal ref Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21802 2026-01-30 cs.AI 85%

A Unified XAI-LLM Approach for EndotrachealSuctioning Activity Recognition

面向气管吸引活动识别的统一XAI-LLM方法

Hoang Khang Phan, Quang Vinh Dang, Noriyo Colley, Christina Garcia, Nhat Tan Le

机构 * Dept. of Biomedical Engineering(生物医学工程系) Manning College of Information(信息与计算机科学学院) Faculty of Health Science(健康科学学院) Kyushu Institute of Technology(九州工业大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一种统一的XAI-LLM框架,用于气管吸引活动识别,通过LLM实现时空活动识别和可解释反馈,提升培训效率和患者安全。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21733 2026-01-30 cs.CL 85%

CE-GOCD: Central Entity-Guided Graph Optimization for Community Detection to Augment LLM Scientific Question Answering

CE-GOCD:基于社区检测的中心实体引导图优化用于增强LLM科学问答

Jiayin Lan, Jiaqi Li, Baoxin Wang, Ming Liu, Dayong Wu, Shijin Wang, Bing Qin, Guoping Hu

机构 * Harbin Institute of Technology, Harbin, China(哈尔滨工业大学) State Key Laboratory of Cognitive Intelligence, iFLYTEK Research, China(认知智能国家重点实验室)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 CE-GOCD通过构建和利用学术知识图谱的语义子结构,提升LLM在科学问答中的表现,通过中心实体引导的图优化和社区检测增强问答的准确性和全面性。

Comments Accepted by IEEE ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20900 2026-01-30 cs.CE 85%

When Experts Speak:Sequential LLM-Bayesian Learning for Startup Success Prediction

当专家发言时:用于初创企业成功预测的序列LLM-贝叶斯学习

Yidong Chai, Yanguang Liu, Xuan Tian, Jiaheng Xie, Yonghang Zhou

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出了一种基于LLM和贝叶斯学习的模型,通过分析专家对话预测初创企业成功,实验结果显示其在F1分数和投资回报率上均优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23471 2026-01-30 cs.CL cs.AI 84%

Discovering Multi-Scale Semantic Structure in Text Corpora Using Density-Based Trees and LLM Embeddings

利用基于密度的树和大语言模型嵌入发现文本语料库的多尺度语义结构

Thomas Haschka, Joseph Bakarji

机构 * E020-04 Service Unit of High Performance Computing, DataLab, Campus IT, Technische Universität Wien(技术大学维也纳高性能计算服务单元,数据实验室,校园IT) Department of Mechanical Engineering, American University of Beirut(贝鲁特美国大学机械工程系)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出了一种基于密度的树和大语言模型嵌入的方法,用于发现文本语料库的多尺度语义结构,通过层次密度建模揭示主题之间的结构关系。

Comments 23 pages, 10 figures, further interactive visualizations available on https:// genealogy.sematlas.com/

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.10692 2026-01-30 cs.LG cs.AI 79%

ACES: Generating Diverse Programming Puzzles with with Autotelic Generative Models

ACES: 用自激励生成模型生成多样化的编程谜题

Julien Pourcel, Cédric Colas, Gaia Molinaro, Pierre-Yves Oudeyer, Laetitia Teodorescu

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 ACES通过自激励生成模型生成多样且更具挑战性的Python编程谜题,提升谜题的多样性和难度。

Journal ref NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14224 2026-01-30 cs.CV 78%

Beyond Retraining: Training-Free Unknown Class Filtering for Source-Free Open Set Domain Adaptation of Vision-Language Models

超越再训练:用于无源开放集域适应的无训练未知类过滤

Yongguang Li, Jindong Li, Qi Wang, Qianli Xing, Runliang Niu, Shengsheng Wang, Menglin Yang

专题命中 领域大模型 :language model(title,abstract)

AI总结 VLM-OpenXpert通过无训练模块SUFF和BGAT实现无源开放集域适应,有效抑制未知类干扰并提升模型性能。

Comments Core methods unchanged; title updated and full-text narrative refined for clarity and logical coherence. No changes to key findings and conclusions

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16416 2026-01-30 cond-mat.mtrl-sci physics.comp-ph 75%

A Multi-agent Framework for Physical Laws Discovery

发现物理定律的多智能体框架

Bo Hu, Siyu Liu, Beilin Ye, Yun Hao, Yanhui Liu, Yang Lu, Ju Li, David J. Srolovitz, Tongqi Wen

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本研究提出基于大语言模型的多智能体框架,用于发现物理定律,通过整合文献引导的变量选择、假设形成、符号回归等技术,实现了对金属玻璃形成能力、化合物硬度和多组分合金杨氏模量的高精度预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21551 2026-01-30 cs.CL 70%

Note2Chat: Improving LLMs for Multi-Turn Clinical History Taking Using Medical Notes

Note2Chat: 通过医疗笔记提升LLM在多轮临床病史采集中的表现

Yang Zhou, Zhenting Sheng, Mingrui Tan, Yuting Song, Jun Zhou, Yu Heng Kwan, Lian Leng Low, Yang Bai, Yong Liu

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 Note2Chat通过医疗笔记训练LLM提升多轮临床病史采集的准确性和效率

Comments Accepted at AAAI-26

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21342 2026-01-30 cs.AI 70%

Ostrakon-VL: Towards Domain-Expert MLLM for Food-Service and Retail Stores

Ostrakon-VL:面向食品服务与零售商店的领域专家MLLM

Zhiyong Shen, Gongpeng Zhao, Jun Zhou, Li Yu, Guandong Kou, Jichen Li, Chuanlei Dong, Zuncheng Li, Kaimao Li, Bingkun Wei, Shicheng Hu, Wei Xia, Wenguo Duan

机构 * Rajax Network Technology (Taobao Shangou of Alibaba)(Rajax网络技术(淘宝商购的阿里巴巴))

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 Ostrakon-VL通过多阶段训练策略在FSRS场景中取得新突破,实现60.1的高分表现,超越现有模型并展示更高参数效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21165 2026-01-30 cs.AI cs.CY cs.LG 62%

FrontierScience: Evaluating AI's Ability to Perform Expert-Level Scientific Tasks

前沿科学:评估人工智能执行专家级科学任务的能力

Miles Wang, Robi Lin, Kat Hu, Joy Jiao, Neil Chowdhury, Ethan Chang, Tejal Patwardhan

机构 * OpenAI

专题命中 领域大模型 :language model(abstract);分类 cs.AI、cs.LG

AI总结 FrontierScience是一个评估人工智能执行专家级科学任务能力的基准,通过奥林匹克和研究两个赛道,涵盖多个科学领域,采用细致的评分框架评估模型能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16797 2026-01-30 cs.CL cs.AI 62%

MOSAIC: Masked Objective with Selective Adaptation for In-domain Contrastive Learning

MOSAIC:带选择性适应的领域对比学习中的掩码目标

Vera Pavlova, Mohammed Makhlouf

专题命中 领域大模型 :language model(abstract);分类 cs.CL、cs.AI

AI总结 MOSAIC通过联合优化掩码语言建模和对比目标,提升领域适应文本嵌入模型的性能,实现NDCG@10的显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15930 2026-01-30 cs.IR cs.AI 57%

MMGRid: Navigating Temporal-aware and Cross-domain Generative Recommendation via Model Merging

MMGRid: 通过模型融合实现时间感知和跨领域生成推荐

Tianjun Wei, Enneng Yang, Yingpeng Du, Huizhong Guo, Jie Zhang, Zhu Sun

机构 * Nanyang Technological University(南洋理工大学) Zhejiang University(浙江大学) Singapore University of Technology and Design(新加坡科技设计大学)

专题命中 领域大模型 :LLM(abstract);分类 cs.AI

AI总结 MMGRid通过模型融合解决跨领域生成推荐中的时间感知和上下文融合问题,揭示参数冲突和近期偏差的解决方法。

Comments https://github.com/Joinn99/MMGRid

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21296 2026-01-30 cs.LG 57%

An Evidence-Based Post-Hoc Adjustment Framework for Anomaly Detection Under Data Contamination

基于证据的后验调整框架用于数据污染下的异常检测

Sukanya Patra, Souhaib Ben Taieb

机构 * Department of Computer Science, University of Mons(蒙斯大学计算机科学系)

专题命中 领域大模型 :foundation model(abstract);分类 cs.LG

AI总结 EPHAD提出一种基于证据的后验调整框架,通过测试时收集的证据提升异常检测在数据污染下的性能。

Comments Accepted in the Thirty-ninth Annual Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13993 2026-01-30 eess.IV cs.AI cs.CV 57%

OrthoInsight: Rib Fracture Diagnosis and Report Generation Based on Multi-Modal Large Models

OrthoInsight:基于多模态大模型的肋骨骨折诊断与报告生成

Ningyong Wu, Jiangbo Zhang, Wenhong Zhao, Jinzhi Wang, Chenzhan Yu, Zhigang Xiu, Duwei Dai, Ziyu Xu, Yongli Yang

机构 * Organizational Management Department, School of Management, Xi’an Jiaotong University(管理学院组织管理部,西安交通大学) West China Longquan Hospital, Sichuan University(四川大学西部临床医学院) School of Electronic Science and Engineering, Xi’an Jiaotong University(西安交通大学电子科学与工程学院) Systems Engineering Institute, Xi’an Jiaotong University(西安交通大学系统工程研究院) Institute of Medical Artificial Intelligence, the Second Affiliated Hospital of Xi’an Jiaotong University(西安交通大学第二附属医院医学人工智能研究所) School of Human Settlements and Civil Engineering, Xi’an Jiaotong University(西安交通大学人居环境与土木工程学院) School of Life Science and Technology, Xi’an Jiaotong University(西安交通大学生命科学与技术学院)

专题命中 领域大模型 :language model(abstract);分类 cs.AI

AI总结 OrthoInsight通过多模态大模型实现肋骨骨折的自动诊断与报告生成,结合CT图像分析与医学知识图谱,提升诊断效率和临床实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19501 2026-01-30 cs.IR 50%

Masked Diffusion Generative Recommendation

掩码扩散生成推荐

Lingyu Mu, Hao Deng, Haibo Xing, Jinxin Hu, Yu Zhang, Xiaoyi Zeng, Jing Zhang

专题命中 领域大模型 :language model(abstract)

AI总结 MDGR通过改进生成推荐流程,采用并行代码本和两阶段解码策略,提升推荐性能和实时效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05428 2026-01-30 cs.MA cs.DC 50%

Empowering Scientific Workflows with Federated Agents

通过联邦代理赋能科学工作流

Alok Kamatar, J. Gregory Pauloski, Yadu Babuji, Ryan Chard, Mansi Sakarvadia, Daniel Babnigg, Kyle Chard, Ian Foster

专题命中 领域大模型 :LLM(abstract)

AI总结 Academy通过模块化中间件实现联邦研究生态系统中自主代理的部署,支持异构资源和高吞吐量数据流,提升科学计算的性能和可扩展性。

Comments To appear at the IEEE International Parallel & Distributed Processing Symposium (IPDPS '26)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 知识编辑与模型理解 11 篇

2506.01042 2026-01-30 cs.CL cs.AI 90%

Probing Neural Topology of Large Language Models

探测大型语言模型的神经拓扑

Yu Zheng, Yuan Yuan, Yue Zhuo, Yong Li, Gabriel Kreiman, Tomaso Poggio, Paolo Santi

机构 * Massachusetts Institute of Technology(麻省理工学院) New York University(纽约大学) Tsinghua University(清华大学) Harvard Medical School(哈佛医学院)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

AI总结 本研究提出图探测方法,通过分析LLM神经拓扑揭示其语言生成性能,发现拓扑信息比激活信息更丰富,可提升模型效率和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04443 2026-01-30 cs.CR cs.LG eess.SP 89%

Large Language Models for Detecting Cyberattacks on Smart Grid Protective Relays

用于检测智能电网继电保护装置网络攻击的大型语言模型

Ahmad Mohammad Saber, Saeed Jafari, Zhengmao Ouyang, Paul Budnarain, Amr Youssef, Deepa Kundur

机构 * Department of Electrical and Computer Engineering, University of Toronto(电气与计算机工程系,多伦多大学) Concordia Institute for Information Systems Engineering (CIISE), Concordia University(信息系统工程研究所(CIISE),康科迪亚大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 本文提出基于LLM的检测框架,用于检测智能电网继电保护装置的网络攻击,通过结构化自然语言提示实现高准确率的攻击检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21060 2026-01-30 cs.LG cs.CL cs.HC 86%

Human-LLM Collaborative Feature Engineering for Tabular Data

人类与大语言模型协作的表格数据特征工程

Zhuoyan Li, Aditya Bansal, Jinzhao Li, Shishuang He, Zhuoran Lu, Mutian Zhang, Qin Liu, Yiwei Yang, Swati Jain, Ming Yin, Yunyao Li

机构 * Purdue University(普渡大学) Adobe(Adobe公司) UIUC(伊利诺伊大学香槟分校) University of Washington(华盛顿大学) UC Davis(加州大学戴维斯分校)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出人类与大语言模型协作的表格数据特征工程框架,通过解耦操作提出与选择过程,结合人类专家反馈提升特征工程效率和效果。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22027 2026-01-30 cs.AI 85%

CAR-bench: Evaluating the Consistency and Limit-Awareness of LLM Agents under Real-World Uncertainty

CAR-bench: 评估在现实世界不确定性下LLM代理的一致性和限意识

Johannes Kirmayr, Lukas Stappen, Elisabeth André

机构 * BMW Group Research and Technology(宝马集团研究与技术) Augsburg University(艾希施泰特大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 CAR-bench旨在评估LLM代理在现实世界不确定性下的一致性、不确定性处理和能力意识,通过多轮对话和工具使用测试其可靠性和自我意识。

详情

展开后加载摘要…

URL PDF HTML 收藏