arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12637 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12637 篇

2402.10951 2024-02-20 cs.CL cs.LG 86%

DAEDRA: A language model for predicting outcomes in passive pharmacovigilance reporting

Chris von Csefalvay

专题命中 领域大模型 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01730 2024-02-07 cs.CL cs.AI cs.CV 86%

Evaluating LLM -- Generated Multimodal Diagnosis from Medical Images and Symptom Analysis

Dimitrios P. Panagoulias, Maria Virvou, George A. Tsihrintzis

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Department of Informatics, University of Piraeus, Greece

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.13500 2024-01-30 cs.LG cs.AI 86%

Enhancing Student Performance Prediction on Learnersourced Questions with SGNN-LLM Synergy

Lin Ni, Sijie Wang, Zeyu Zhang, Xiaoxuan Li, Xianda Zheng, Paul Denny, Jiamou Liu

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.06785 2024-01-17 cs.CL cs.AI 86%

Human-Instruction-Free LLM Self-Alignment with Limited Samples

Hongyi Guo, Yuanshun Yao, Wei Shen, Jiaheng Wei, Xiaoying Zhang, Zhaoran Wang, Yang Liu

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.12803 2024-01-10 cs.LG cs.CL 86%

Data Augmentations for Improved (Large) Language Model Generalization

Amir Feder, Yoav Wald, Claudia Shi, Suchi Saria, David Blei

专题命中 领域大模型 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

Comments Published at NeurIPS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.08688 2023-12-18 cs.CL cs.AI 86%

TigerBot: An Open Multilingual Multitask LLM

Ye Chen, Wei Cai, Liangmin Wu, Xiaowei Li, Zhanxuan Xin, Cong Fu

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09219 2023-12-05 cs.CL cs.AI 86%

"Kelly is a Warm Person, Joseph is a Role Model": Gender Biases in LLM-Generated Reference Letters

Yixin Wan, George Pu, Jiao Sun, Aparna Garimella, Kai-Wei Chang, Nanyun Peng

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to EMNLP 2023 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.13601 2023-11-23 cs.CV cs.AI cs.LG 86%

Visual In-Context Prompting

Feng Li, Qing Jiang, Hao Zhang, Tianhe Ren, Shilong Liu, Xueyan Zou, Huaizhe Xu, Hongyang Li, Chunyuan Li, Jianwei Yang, Lei Zhang, Jianfeng Gao

专题命中 领域大模型 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.12289 2023-11-22 cs.CL cs.AI 86%

ATLANTIC: Structure-Aware Retrieval-Augmented Language Model for Interdisciplinary Science

Sai Munikoti, Anurag Acharya, Sridevi Wagle, Sameera Horawalavithana

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14302 2023-10-17 cs.IR cs.AI cs.HC cs.LG cs.MM 86%

VIP5: Towards Multimodal Foundation Models for Recommendation

Shijie Geng, Juntao Tan, Shuchang Liu, Zuohui Fu, Yongfeng Zhang

专题命中 领域大模型 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted by EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.00614 2023-09-06 cs.LG cs.CL cs.CR 86%

Baseline Defenses for Adversarial Attacks Against Aligned Language Models

Neel Jain, Avi Schwarzschild, Yuxin Wen, Gowthami Somepalli, John Kirchenbauer, Ping-yeh Chiang, Micah Goldblum, Aniruddha Saha, Jonas Geiping, Tom Goldstein

专题命中 领域大模型 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.13301 2023-09-04 cs.CL cs.AI 86%

Prompting GPT-3.5 for Text-to-SQL with De-semanticization and Skeleton Retrieval

Chunxi Guo, Zhiliang Tian, Jintao Tang, Pancheng Wang, Zhihua Wen, Kang Yang, Ting Wang

专题命中 领域大模型 :prompting(title);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.12031 2023-08-21 cs.CL cs.AI 86%

Clinical Camel: An Open Expert-Level Medical Language Model with Dialogue-Based Knowledge Encoding

Augustin Toma, Patrick R. Lawler, Jimmy Ba, Rahul G. Krishnan, Barry B. Rubin, Bo Wang

专题命中 领域大模型 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments for model weights, see https://huggingface.co/wanglab/

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.07205 2023-06-06 cs.CL cs.AI 86%

The Science of Detecting LLM-Generated Texts

Ruixiang Tang, Yu-Neng Chuang, Xia Hu

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12532 2025-07-04 cs.CL 86%

MedAide: Information Fusion and Anatomy of Medical Intents via LLM-based Agent Collaboration

Dingkang Yang, Jinjie Wei, Mingcheng Li, Jiyao Liu, Lihao Liu, Ming Hu, Junjun He, Yakun Ju, Wei Zhou, Yang Liu, Lihua Zhang

机构 * 1 College of Intelligent Robotics Advanced Manufacturing, Fudan University \, 2 Multimodal Foundation Research Team, CIT Lab [1mm] 3 Shanghai Artificial Intelligence Laboratory \, 4 Institute of Science Technology for Brain-Inspired Intelligence, Fudan University [1mm] 5 School of Computing Mathematical Sciences, University of Leicester \, 6 Cardiff University [1mm] 7 Department of Computer Science, The University of Toronto \, 8 Institute of Metaverse \& Intelligent Medicine [1mm] 9 Jilin Provincial Key Laboratory of Intelligence Science Engineering [1mm] 10 Engineering Research Center of AI

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments LLM-based Multi-Agent Collaboration for Medical Applications

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23131 2026-08-25 cs.IR 新提交 86%

A Dual-Expert Strategy Integrating LLMs to Mitigate Negative Transfer in Cross-Domain Sequential Recommendation

一种集成大语言模型的双专家策略以缓解跨域序列推荐中的负迁移

Hyeongjun Yun, Kihyuk Song, Jaegul Choo, Chung Park

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出基于LLM的CDSR模型DuELRec,通过域门控双专家框架与双采样对比学习缓解跨域序列推荐的负迁移,在10个域的2个数据集上优于26种SOTA方法。

Comments Accepted at CIKM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21547 2026-08-25 cs.CR 新提交 86%

Enhancing User Resilience Against AI-Augmented Phishing: A Two-Stage Framework for Detection and Personalized Training

增强用户抵御AI增强型钓鱼攻击的能力:一种用于检测和个性化训练的两阶段框架

Weihao Qu, Gurmeet Singh, Daniel Crawford, Bingjun Li, Jalen Smith

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 针对AI增强型钓鱼攻击带来的新威胁,研究人员提出两阶段反钓鱼框架CyberGLA,结合EmailKnight检测工具与LLM安全教练,实现技术防御与个性化用户训练,以提升用户抵御此类攻击的能力。

Comments 7 pages, 2 figures, 2 tables. Published in the Journal of The Colloquium for Information Systems Security Education

Journal ref Journal of The Colloquium for Information Systems Security Education, 13(1), Article 7 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17316 2026-08-19 cs.IR 新提交 86%

Empowering Compact LLMs with Fusion of Layer-wise Exits for Recommendation

融合分层出口的紧凑型大语言模型推荐系统

Xurong Liang, Tong Chen, Quoc Viet Hung Nguyen, Jianxin Li, Xiangliang Zhang, Hongzhi Yin

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出FLEXRec框架,通过在紧凑型LLM的Transformer层插入预测头并自适应融合,结合AC-Router与目标k铰链损失,在三个数据集上以Qwen 3 1.7B和Llama 3.2 3B实现紧凑型主干方法中最优准确率且效率高。

Comments Accepted by ICDM'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13889 2026-08-17 cs.CV 新提交 86%

Consensus-gated Multi-Agent Neural Architecture Search for Seismic Fault Segmentation

面向地震断层分割的共识门控多智能体神经架构搜索

Shehram Baig, Ahmad Mustafa

机构 * Information Technology University (ITU)(信息技术大学(ITU)) King Fahd University of Petroleum and Minerals(法赫德国王石油与矿业大学)

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 提出共识门控多智能体NAS系统,利用三个LLM达成共识搜索架构,发现参数42.5万的\textit{ours}模型,在Thebe断层数据集上性能优于多个基准模型,成本低、效率高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13017 2026-08-14 cs.HC 新提交 86%

How LLMs Respond to Escalating Delusions: Four Longitudinal Trajectories of Model Behavior

大语言模型(LLM)对日益严重的妄想的反应:模型行为的四种纵向轨迹

Anna Sterna, Kacper Dudzic, Karolina Drożdż, Hubert Plisiecki, Marcin Rządeczka, Marcin Moskalewicz

专题命中 领域大模型 :LLM(title_cn,summary_cn)

AI总结 本研究通过30天的纵向实验,评估15种主流LLM对模拟精神症状进展的反应,识别出四种不同行为轨迹,提出需从识别时机、稳定性和干预准确性维度纵向评估LLM加剧AI精神病的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08199 2026-08-14 cs.CV 版本更新 86%

Generalizable Operating Room Expert with Multimodal Enhancement

具备多模态增强能力的可泛化手术室专家

Peiqi He, Zhenhao Zhang, Yixiang Zhang, Jiaxin Liu, Xiongjun Zhao, Shaoliang Peng

专题命中 领域大模型 :language model(title,abstract);large language model(title)

AI总结 针对手术室空间建模的局限,提出仅用RGB图像推理的多模态大语言模型OR-Expert,通过内部推导空间线索实现三维推理,在手术室基准上达SOTA且泛化性良好。

Comments Accepted by ACM Multimedia 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12138 2026-08-13 cs.CL cs.AI cs.HC cs.IR cs.LG 新提交 86%

A corpus-specific clinical RAG system matches or outperforms newer frontier LLMs on HealthBench

针对特定语料库的临床检索增强生成(RAG)系统在HealthBench上的表现与较新的前沿大语言模型相当或更优

Praveen Reddy, Charuta Mandke, Suvrankar Datta, Sarah Khan, Siddharth Reddy Anthireddy, Shitij Arora, Vishal Singh

专题命中 领域大模型 :LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文评估专为中低收入环境构建的临床RAG系统VITA,其在HealthBench基准测试中与前沿LLM表现相当或更优,语料库特异性可提升模型落地性但会降低沟通流畅度。

Comments 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11744 2026-08-13 cs.SE 新提交 86%

Harnessing LLMs for Document-Guided Fuzzing of Python Libraries

利用大语言模型(LLM)实现Python库的文档引导模糊测试

Bin Duan, Tarek Mahmud, Meiru Che, Yan Yan, Naipeng Dong, Dan Dongseong Kim, Guowei Yang

专题命中 领域大模型 :LLM(title_cn,summary_cn)

AI总结 本文提出VistaFuzz,一种基于本地开源LLM的文档引导模糊测试技术,用于测试Python库API,在12个库的7718个API上发现74个问题,其中43个已确认、29个已修复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09312 2026-08-11 cs.NI 新提交 86%

Automated Synthesis of Deterministic Cross-Domain Interfaces

确定性跨域接口的自动合成

Konstantinos Christodoulopoulos, Antonis Selentis-Boulntadakis

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 该研究提出框架,利用LLM实现智能体与处理程序模块,自动合成跨域确定性网络的静态、动态契约,经实验验证其动态契约性能优于静态配置,且分工模式可保障模型可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04006 2026-08-05 cs.HC 新提交 86%

Calibrating Trustworthiness: Co-Designing Metrics and Visualizations for Evaluating LLMs in Education

校准可信度:为教育领域评估大型语言模型(LLM)协同设计指标与可视化方案

Adam Coscia, Sujata Duwal, Langdon Holmes, Scott Crossley, Alex Endert

专题命中 领域大模型 :LLM(title_cn,summary_cn)

AI总结 本研究针对教育领域LLM响应的教学适配性评估缺口,通过与学习工程师协同设计可信度指标与可视化工具,提升了评估信度,为相关工具提出设计准则。

Comments Under review. 48 pages, 22 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02296 2026-08-04 cs.CR cs.CY 新提交 86%

TrainShield: Targeted Awareness for Cybersecurity Training

TrainShield:面向网络安全培训的目标感知机制

Giovanni Pizzenti, Alberto Verna, Nikhil Jha, Giuseppe Tipaldo, Stefano Traverso, Marco Mellia

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 本研究提出嵌入用户工作流的场景化网络安全培训范式TrainShield,结合实时风险检测与LLM生成内容,初步验证其可提升风险意识,为行为导向网络安全教育提供新方向。

Comments Paper accepted for publication at ACM Hypertext 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28218 2026-07-31 stat.AP 新提交 86%

Bridging Probabilistic LLMs and Deterministic Statistical Validation: The PROVE Multi-Agent Framework for Clinical Trial Reporting

连接概率型大语言模型与确定性统计验证:用于临床试验报告的PROVE多智能体框架

Zhaohua Lu, Cheng Zheng, Yuanyuan Han

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 该研究提出PROVE多智能体框架,结合LLM与程序化验证器,在临床试验报告TFL验证中,LLM辅助语义匹配可显著提升差异检测的召回率与F1值,兼顾解读灵活性与数值准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27789 2026-07-31 cs.IR 新提交 86%

From Understanding to Action: Feedback-Grounded Policy Discovery for Generative Recommendation

从理解到行动:面向生成式推荐的反馈驱动策略发现

Zhi Chen, Minmao Wang, Xingchen Liu, Haoqiang Liang, Huihuang Lin, Likang Wu, Hongke Zhao, Yulong Wang, Shijie Yi, Fei Pan, Peng Jiang

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 该研究针对生成式推荐的“理解-行动差距”,提出反馈驱动智能体框架,经蒸馏迁移至轻量模型实现无LLM在线推理,在基准测试与在线A/B测试中均取得推荐效果提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06300 2026-07-30 cs.CL cs.AI cs.LG 版本更新 86%

$\texttt{AMEND++}$: Benchmarking Eligibility Criteria Amendments in Clinical Trials

AMEND++:临床试验资格标准修订的基准测试

Trisha Das, Mandis Beigi, Jacob Aptekar, Jimeng Sun

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Medidata Solutions(Medidata解决方案)

专题命中 领域大模型 :LLM(abstract,abstract_cn);language model(abstract,abstract_cn);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 AMEND++通过CAMLM模型提升临床试验资格标准修订预测的准确性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09995 2026-07-28 cs.CE 版本更新 86%

QuantHarness: Price-Driven Multi-Agent LLMs for High-Frequency Trading

QuantHarness:用于高频交易的价格驱动多智能体大语言模型

Fei Xiong, Xiang Zhang, Aosong Feng, Siqi Sun, Chenyu You

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 研究针对高频交易需求,引入QuantHarness多智能体LLM框架,将交易分解为四个智能体,利用结构化信号与LLM推理结合,经多金融工具实验验证,该框架在多指标上优于基线方法,为高频金融市场实时决策提供可行路径。

详情

展开后加载摘要…

URL PDF HTML 收藏