arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12706 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12706 篇

2511.07107 2026-08-04 cs.AI cs.CL 版本更新 73%

MENTOR: A Metacognition-Driven Self-Evolution Framework for Uncovering and Mitigating Implicit Domain Risks in LLMs

MENTOR: 一种元认知驱动的自我进化框架,用于发现和缓解大语言模型中的隐式领域风险

Liang Shan, Kaicheng Shen, Wen Wu, Zhenyu Ying, Chaochao Lu, Yan Teng, Jingqi Huang, Qingshan Liu, Guangze Ye, Guoqing Wang, Jie Zhou, Liang He

机构 * School of Computer Science and Technology, East China Normal University(东华大学计算机科学与技术学院) Shanghai AI Lab, Shanghai Innovation Institute(上海人工智能实验室,上海创新研究院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 针对大语言模型在特定领域(如教育、金融、管理)中存在的隐式安全风险,提出基于元认知自我评估和动态规则知识图谱的MENTOR框架,通过激活级引导信号有效降低攻击成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28498 2026-07-31 cs.IR cs.AI cs.CL 新提交 73%

TCA-SIR: Learning Target-Conditioned Abstractions for Scientific Inspiration Retrieval

TCA-SIR:学习面向目标的抽象表示用于科学灵感检索

Yuto Suzuki, Farnoush Banaei-Kashani

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 TCA-SIR将科学灵感检索重新定义为面向目标的抽象学习,在ResearchBench上较MOOSE-Chem提升HitRate@top4%超10个百分点,实现更优检索与可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27955 2026-07-31 cs.DL cs.AI cs.CL cs.IR 新提交 73%

SciSchema.org: A Multidisciplinary Collection of Schemas for Structured Scientific Process Descriptions

SciSchema.org:用于结构化科学过程描述的多学科模式集合

Jennifer D'Souza, Sameer Sadruddin, Anisa Rula, Ana Bossler, Andrés Fullana, Enric Bas, Syed Ather, Defne Circi, Anlan Chen, L. Catherine Brinson, Alyssa Columbus, George Demetriou, Dongjun Jeong, Tarun Kumar, Frank Krüger, Sascha Genehr, Kai Budde-Sagert, Anamaria Leonescu, Francesco Lodola, Chiara Florindi, Gagana Balasubramanya Murthy, Samson Oluwapelumi Olagbile, Nazia Riasat, Yan Sha, Kevin Shen, Shaokai Yang

机构 * TIB Leibniz Information Centre for Science and Technology(莱布尼茨科学与技术信息中心(TIB)) University of Brescia(布雷西亚大学) University of Alicante(阿利坎特大学) Georgia Institute of Technology(佐治亚理工学院) Duke University(杜克大学) Johns Hopkins University(约翰霍普金斯大学) University of Manchester(曼彻斯特大学) Narnia Labs(纳尼亚实验室)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 SciSchema.org发布首个多学科科学过程模式集合,采用人在回路模式挖掘工作流构建,支持科学领域结构化标注等多项应用。

Comments 25 pages, 9 figures, Submitted for peer review to Nature Scientific Data

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27528 2026-07-31 cs.CR cs.AI cs.CL cs.SE 新提交 73%

ThreatForest: Multi-Agent Attack Tree Generation with Pluggable TTP Framework Mapping

ThreatForest:基于可插拔TTP框架映射的多智能体攻击树生成方法

Cristian Leo, Anton Dykyi, Danny Cortegaca, Daniel Begimher, Prakash Jha

机构 * Amazon Web Services, Inc.(亚马逊网络服务公司) Amazon Web Services EMEA SARL, UK Branch(亚马逊网络服务欧洲、中东及非洲有限责任公司英国分部)

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 ThreatForest是首个将代码仓库转化为带TTP映射攻击树及对应缓解措施的端到端多智能体系统,其嵌入编码器是TTP映射准确率的核心瓶颈,相关基准框架可用于同类系统测试。

Comments 20 pages, 12 tables, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10647 2026-07-30 cs.CL cs.AI cs.CY cs.HC 版本更新 73%

The Reliability of LLMs for Medical Diagnosis: An Examination of Consistency, Manipulation, and Contextual Awareness

大语言模型在医疗诊断中的可靠性:一致性、可操纵性与情境感知能力的检验

Krishna Subedi

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 该研究检验Google Gemini 2.0 Flash与OpenAI ChatGPT-4o的医疗诊断可靠性,发现二者虽一致性达100%,但易受无关信息操纵,且情境响应存在差异,提示其医疗应用需临床监督与结构化保障。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24768 2026-07-29 cs.AI cs.CL cs.CY cs.ET 新提交 73%

PATHFinder Agent for Tailored Prenatal Care

用于定制产前护理的PATHFinder智能体

Vaibhav Balloli, Carissa Samuel, Samia Abdelnabi, Alex Peahl, Elizabeth Bondi-Kelly

机构 * University of Michigan(密歇根大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究针对产前护理,提出PATHFinder智能体这一端到端对话系统,通过结构化对话收集信息并制定个性化计划,展示社区资源。经评估前沿大语言模型,GPT-5.2平均分最高,还发现检测建议差距,将开展人体研究和随机对照试验验证。

Comments Accepted as demo at ACM Interactive Health 2026. https://realize-lab.github.io/PATHFinder/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19341 2026-07-29 cs.LG cs.AI 版本更新 73%

Structured Scaling of AI Discovery Across Diverse Scientific Domains

基于评估的科学发现扩展

Haotian Ye, Haowei Lin, Jingyi Tang, Yizhen Luo, Rahul Thapa, Caiyin Yang, Chang Su, Rui Yang, Ruihua Liu, Rundao Li, Zeyu Li, Pengwei Sun, Chong Gao, Dachao Ding, Guangrong He, Miaolei Zhang, Lina Sun, Wenyang Wang, Yuchen Zhong, Zhuohao Shen, Puheng Li, Pan Lu, Bianxiao Cui, Di He, Jianzhu Ma, Junfeng Li, Hexi Baoyin, Yejin Choi, Stefano Ermon, Xiaowen Chu, Tongyang Li, Yuzhi Xu, James Zou

机构 * Wizard Intelligence Learning Lab, Stanford University(智能巫师学习实验室,斯坦福大学) Peking University(北京大学) Tsinghua University(清华大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 领域大模型 :LLM(abstract_cn);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出SimpleTES框架,通过并行探索、反馈驱动精炼和局部选择,提升评估驱动的发现循环效率,解决科学发现扩展问题,展示在21个科学问题上超越基线模型的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24371 2026-07-28 cs.CL cs.AI 新提交 73%

Closed-Loop Validation-Repair for Healthcare Interoperability: A Multi-Model Study of Schema Compliance in Clinical LLMs

医疗保健互操作性的闭环验证修复:临床大语言模型中模式合规性的多模型研究

Jianru Shen

机构 * University of Montana(蒙大拿大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究医疗大语言模型集成到电子健康记录系统面临的模式不合规问题,通过在多场景下部署三个开源模型并评估,发现模式不合规具有一致性,验证 - 修复框架可有效提高合规率,为医疗互操作性提供保障。

Comments Accepted at the 2026 IEEE International Conference on Systems, Man, and Cybernetics (SMC 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22683 2026-07-28 cs.AI cs.CL cs.PL 新提交 73%

Imprompt: A Language Framework for Prompt Programming

Imprompt:一种用于提示编程的语言框架

Chentian Wu, Shengyuan Yang, Adithya Murali

专题命中 领域大模型 :language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 该研究针对现有提示编程框架的问题,提出Imprompt语言框架。通过基础研究、结构化提示阐释、定义编译器、探索类型化概念等方法,实现编译器和类型检查器并评估,为提示编程领域贡献编程语言基础。

Comments 28 pages, 24 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18825 2026-07-22 cs.CL cs.AI cs.IR 新提交 73%

AILQA: Evaluating AI-Driven Legal Question Answering Systems for the Indian Legal System

AILQA:评估适用于印度法律体系的人工智能驱动的法律问答系统

Shubham Kumar Nigam, Shubham Kumar Mishra, Noel Shallum, Kripabandhu Ghosh, Arnab Bhattacharya

机构 * Indian Institute of Technology(印度理工学院) Symbiosis Law School(共生法学院) Indian Institute of Science Education and Research(印度科学教育与研究学院) University of Birmingham(伯明翰大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 该研究针对印度法律体系开发AILQA系统,利用多种模型应对挑战,通过严格评估强调RAG范式提升答案质量,评估其在标准化测试中的表现,讨论挑战并给出未来研究方向,为增强法律决策支持系统助力。

Comments Accepted in AI and Law Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18725 2026-07-22 cs.CL cs.AI cs.CR 新提交 73%

Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA

在微调之前进行评估:针对网络安全问答的小型语言模型诊断研究

Shaswata Mitra, Subash Neupane, Trisha Chakraborty, Himanshu Tripathi, Sudip Mittal, Aritran Piplai, Shahram Rahimi

机构 * The University of Alabama(阿拉巴马大学) Meharry Medical College(梅哈里医学院) Mississippi State University(密西西比州立大学) The University of Texas at El Paso(德克萨斯大学埃尔帕索分校)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 针对网络安全问答选择小型语言模型难的问题,提出FiT诊断框架,从三方面刻画模型。通过对五个模型在两种微调模式下研究发现微调利弊因模式而异,预微调FiT分数可预测变化,能筛选模型、避免不必要微调,支持安全部署。

Comments 8 pages, 5 figures, 4 tables, IEEE ICMLA

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02722 2026-07-21 cs.AI cs.LG 版本更新 73%

Enhancing LLMs' Clinical Reasoning with Real-World Data from a Nationwide Sepsis Registry

利用全国脓毒症登记处的真实世界数据增强大语言模型的临床推理能力

Junu Kim, Chaeeun Shim, Sungjin Park, Su Yeon Lee, Gee Young Suh, Chae-Man Lim, Seong Jin Choi, Song Mi Moon, Kyoung-Ho Song, Eu Suk Kim, Hong Bin Kim, Sejoong Kim, Chami Im, Dong-Wan Kang, Yong Soo Kim, Hee-Joon Bae, Sung Yoon Lim, Han-Gil Jeong, Edward Choi

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院) Microsoft(微软) Asan Medical Center, University of Ulsan College of Medicine(釜山大学医学院阿桑医疗中心) Samsung Medical Center, Sungkyunkwan University School of Medicine(成均馆大学医学院三星医疗中心) Seoul National University Bundang Hospital, Seoul National University College of Medicine(首尔国立大学医学院首尔国立大学医院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究旨在增强大语言模型临床推理能力,利用全国脓毒症登记处数据构建问题,通过强化学习微调模型得到C-Reason,该模型在域内测试集表现出色,推理能力能推广到不同任务和疾病,为开发通用临床推理模型提供思路。

Comments Accepted at MLHC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04593 2026-07-20 cs.IR cs.AI cs.CL 版本更新 73%

Ruling Out to Rule In: Contrastive Hypothesis Retrieval for Medical Question Answering

排除谬误以确认正确:面向医疗问答的对比假设检索

Byeolhee Kim, Min-Kyung Kim, Young-Hak Kim, Tae-Joon Jeon

机构 * Asan Medical Center(峨山医疗中心) Yonsei University(延世大学) University of Ulsan College of Medicine(蔚山大学医学院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出对比假设检索框架CHR,通过生成正确和错误假设来提升医疗问答系统检索效果,实验显示在多个基准测试中优于现有方法,有效减少硬负样本污染。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13572 2026-07-17 cs.CL cs.AI 版本更新 73%

ArogyaSutra: A Multi-Agent Framework for Multimodal Medical Reasoning in Indic Languages

ArogyaSutra:面向印度语言的多模态医学推理的多智能体框架

Tanmoy Kanti Halder, Akash Ghosh, Subhadip Baidya, Arijit Roy, Sriparna Saha

机构 * Indian Institute of Technology Patna(印度理工学院巴特那分校) Indian Institute of Technology Kanpur(印度理工学院坎普尔分校) Prasannadeb Women’s College(普拉萨纳德布女子学院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 针对印度语言医疗场景中多模态大语言模型性能不足的问题,提出多模态医学问答数据集ArogyaBodha和基于演员-评论家的多智能体框架ArogyaSutra,通过工具接地与双记忆机制提升多语言医学推理准确性。

Comments Accepted for publication in IJCAI,2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00761 2026-07-17 cs.AI cs.CL 版本更新 73%

L-MARS: Legal Multi-Agent System with Agentic Search and Citation-Faithfulness Audit

L-MARS:具有协调推理和代理搜索的法律多智能体工作流

Boqin Yuan, Ziqi Wang

机构 * University of Southern California(南加州大学) University of California, San Diego(加利福尼亚大学圣迭戈分校)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 L-MARS是一种多代理检索框架,通过分解查询为结构化子问题,利用代理网络搜索获取证据,并通过验证代理过滤结果,从而在法律问答中实现高准确率。

Comments Accepted at the AI4Law Workshop at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11464 2026-07-15 cs.IR cs.AI cs.CL cs.DB 交叉投稿 73%

FAIR GraphRAG: A Retrieval-Augmented Generation Approach for Semantic Data Analysis

公平的GraphRAG:一种用于语义数据分析的检索增强生成方法

Marlena Flüh, Soo-Yon Kim, Carolin Victoria Schneider, Sandra Geisler

机构 * RWTH Aachen University(亚琛RWTH大学) University Hospital RWTH Aachen(亚琛RWTH大学医院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究针对现有RAG方法缺乏结构化公平化的问题,引入公平的GraphRAG框架,以公平数字对象为基本单元,利用大语言模型支持相关构建与提取,应用于生物医学数据集,显著提升问答效果,展示了公平数据实践与图检索技术结合的可行性。

Comments Accepted at the IEEE International Conference on Knowledge Graph, 2025. Corrects an error in the published abstract: the evaluation dataset is RNA-sequencing data, not single-cell data

Journal ref 2025 IEEE International Conference on Knowledge Graph (ICKG), Limassol, Cyprus, 2025, pp. 90-97

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02208 2026-07-15 cs.CL cs.AI cs.IR cs.SE 73%

Towards AI Evaluation in Domain-Specific RAG Systems: The AgriHubi Case Study

面向领域特定RAG系统的AI评估:AgriHubi案例研究

Md. Toufique Hasan, Ayman Asad Khan, Mika Saari, Vaishnavi Bankhele, Pekka Abrahamsson

机构 * Faculty of Information Technology and Communication Sciences(信息科技与通讯科学学院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 AgriHubi通过整合芬兰农业文档与开放模型,结合来源 grounding 和用户反馈,提升了农业决策支持系统的回答完整性、语言准确性和可靠性。

Comments 6 pages, 2 figures, submitted to MIPRO 2026

Journal ref 2026 49th MIPRO ICT and Electronics Convention (MIPRO), Opatija, Croatia, pp. 989-994

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10390 2026-07-14 cs.CL cs.AI 新提交 73%

A Stepwise Questioning Expert-Editor Multi-Agent Framework for Long-Document Summarization

一种用于长文档摘要的逐步提问专家 - 编辑多智能体框架

Lingyun Shen, Xuejia Guo

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 针对大语言模型长文档摘要性能挑战,提出专家 - 编辑逐步提问多智能体方法,通过不同方面提问和提供修订线索完善摘要,经实验验证了该方法在长文档科学数据集上的有效性。

Comments 12 pages,3 figures,2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05510 2026-07-14 cs.AI cs.CL 版本更新 73%

Severity-Aware Curriculum Learning with Multi-Model Response Selection for Medical Text Generation

基于严重性感知的课程学习与多模型响应选择用于医疗文本生成

Ahmed Alansary, Molham Mohamed, Ali Hamdi

机构 * Faculty of Computer Science(计算机科学学院) MSA University(MSA大学) Giza, Egypt(埃及吉扎)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 提出一种结合课程学习策略和相关性响应选择的多模型框架,通过三阶段课程训练和五个大语言模型独立训练,在MAQA数据集上实现医疗文本生成性能提升。

Comments 6 pages, 3 figures, IMSA2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22294 2026-07-13 cs.CL cs.AI 版本更新 73%

SLIDERS: Systematic Reviews via Automated Evidence Synthesis and Reconciliation

上下文从不够长:用于长文档集可扩展问答的结构化推理

Harshit Joshi, Priyank Shethia, Jadelynn Dao, Monica S. Lam

机构 * Computer Science Department, Stanford University(斯坦福大学计算机科学系)

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 本文提出SLIDERS框架,通过结构化推理解决长文档集问答问题,利用关系数据库和SQL实现可扩展推理,优于现有基准。

Comments 53 pages (10 main), preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07974 2026-07-10 cs.CL cs.AI 新提交 73%

A Multi-cluster Boundary Learning Method for Out-of-Scope Intent Detection via MiniLM Embedding

一种基于MiniLM嵌入的多簇边界学习方法用于检测超出范围的意图

Yihong Xu, Mingyu Kang, Linyuan Lü

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 针对意图检测中超出范围意图检测的挑战,提出基于MiniLM嵌入的多簇边界学习方法,在单类分类工作流程中检测超出范围意图,实验表明该方法性能最优,所用MiniLM能更好适应相关要求。

Comments To submit

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10886 2026-07-10 cs.LG cs.AI 版本更新 73%

LoKA: Low-precision Kernel Applications for Recommendation Models At Scale

LoKA:大规模推荐模型中的低精度核应用

Liang Luo, Yinbin Ma, Quanyu Zhu, Vasiliy Kuznetsov, Yuxin Chen, Neng Shi, Jian Jiao, Jiecao Yu, Buyun Zhang, Tongyi Tang, Xiaohan Wei, Yanli Zhao, Zeliang Chen, Yuchen Hao, Venkatesh Ranganathan, Sandeep Parab, Yantao Yao, Maxim Naumov, Chunzhi Yang, Shen Li, Ellie Wen, Wenlin Chen, Santanu Kolay, Chunqiang Tang

机构 * Meta AI

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 LoKA通过三个原则实现低精度计算在大规模推荐模型中的应用,包括在真实分布下评估安全区域、与硬件协同设计提升效率、以及跨核库调度最大化收益。

Comments Accepted to ISCA'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10946 2026-07-10 cs.IT cs.AI cs.LG eess.SP math.IT 版本更新 73%

ToDMA: Large Model-Driven Massive Token Communications for Semantic Multiple Access

ToDMA:用于语义多址接入的大模型驱动海量令牌通信

Li Qiao, Mahdi Boloursaz Mashhadi, Zhen Gao, Robert Schober, Deniz Gündüz

机构 * The University of Hong Kong(香港大学) Beijing Institute of Technology(北京理工大学) University of Surrey(Surrey大学) Friedrich-Alexander-University Erlangen-Nurnberg(埃森哲-亚琛工业大学) Imperial College London(伦敦帝国理工学院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出ToDMA,一种大模型驱动的语义多址接入方案,将无源随机接入与上下文感知令牌处理结合,用于海量令牌通信。通过压缩感知检测令牌及估计信道状态信息,利用上下文模型恢复冲突令牌,能降低接入延迟并保持令牌恢复与语义重建质量。

Comments Submitted to IEEE journals

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12569 2026-07-08 cs.CL cs.AI 新提交 73%

eCREAM-MedCorpus A Large-Scale Corpus of Clinical Notes for Italian

EDEN:意大利语临床笔记的大规模语料库

Tiziano Labruna, Guido Bertolini, Pietro Ferrazzi, Bernardo Magnini

机构 * Fondazione Bruno Kessler(布鲁诺·凯斯勒基金会) Istituto di Ricerche Farmacologiche Mario Negri IRCCS(马里奥·内格里药理研究所IRCCS) University of Padua(帕多瓦大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文介绍EDEN,一个大规模意大利语急诊临床笔记语料库,包含约400万份匿名笔记及6000份专家标注数据,用于支持大语言模型在医疗中的应用,并提出了CRF填充作为新的结构化信息提取基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01800 2026-07-03 cs.LG cs.CL 新提交 73%

Do LLMs Truly Generalize in the Molecular Domain? A Perturbation-Based Analysis

LLMs 在分子领域真的能泛化吗?基于扰动的分析

Jiatong Li, Weida Wang, Changmeng Zheng, Shufei Zhang, Yatao Bian, Xiao-yong Wei, Qing Li

机构 * The Hong Kong Polytechnic University(香港理工大学) National University of Singapore(新加坡国立大学) Shanghai AI Lab(上海人工智能实验室) Fudan University(复旦大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 提出分子扰动框架,通过控制图编辑距离生成结构变体,揭示分子LLMs对微小结构变化敏感,局部信任区域狭窄;上下文调优可部分缓解脆弱性。

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17949 2026-07-03 cs.CL cs.AI 73%

CUICurate: A GraphRAG-based Framework for Automated Clinical Concept Curation for NLP applications

CUICurate:一种基于图RAG的框架,用于自然语言处理应用中的临床概念整理

Victoria Blake, Jamie Novak, Mathew Miller, Sze-yuan Ooi, Blanca Gallego

机构 * Centre for Big Data Research in Health, University of New South Wales(健康大数据研究中心,新南威尔士大学) Eastern Heart Clinic, Prince of Wales Hospital(东部心脏诊所,王室医院) NSW Ambulance Aeromedical Operations, Bankstown Helicopter Base(新南威尔士州急救航空医疗运作,班克stown直升机基地) Department of Anaesthesia, Saint George Hospital(麻醉科,圣乔治医院) Department of Cardiology, Prince of Wales Hospital(心内科,王室医院) School of Clinical Medicine, University of New South Wales(临床医学学院,新南威尔士大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出CUICurate框架,利用图RAG技术自动整理UMLS概念集,通过知识图谱和大语言模型实现高效准确的概念分类与过滤,提升临床NLP任务的实用性。

Comments 6 figures, 4 tables

Journal ref Journal of the American Medical Informatics Association, 2026;, ocag110

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29503 2026-06-30 cs.CL cs.AI 73%

The Verbose Context Problem in Medical Records

医疗记录中的冗长上下文问题

Shiva Kaul, Min-Gyu Kim, Anjum Khurshid, Sriram Vishwanath

机构 * Department of Population Medicine(人口医学部) Department of Biomedical Informatics(生物医学信息学部) School of Electrical and Computer Engineering(电气与计算机工程学院)

专题命中 领域大模型 :language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 针对群体健康分析中结构化概念导致的长文本瓶颈,提出PopMedQA基准,通过人工患者记录生成库neopatient构建任务,发现领域无关方法无法缓解该问题。

Comments SD4H ICML 2026 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29121 2026-06-30 cs.CL cs.AI cs.CY 73%

How Anthropomorphic Language Impacts Public Perceptions of AI

拟人化语言如何影响公众对人工智能的看法

Betty Li Hou, Sophie Hao, Sunoo Park, Tal Linzen

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究通过实验比较拟人化与非拟人化描述对公众AI认知的影响,发现拟人化语言在短期内对公众看法影响有限,但长期或自然情境下可能有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16065 2026-06-29 cs.LG cs.AI math.ST stat.ML stat.TH 版本更新 73%

Can Generative Artificial Intelligence Survive Data Contamination? Theoretical Guarantees under Contaminated Recursive Training

生成式人工智能能否在数据污染中幸存?污染递归训练下的理论保证

Kevin Wang, Hongqian Niu, Didong Li

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文首次严格证明在温和条件下,即使模型递归训练于自身生成的数据,仍能收敛到真实数据分布,并揭示了数据限制与模型限制之间的相变。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26118 2026-06-26 cs.CY cs.AI cs.LG 新提交 73%

The Open Source Economic Index of AI Adoption and Capability

AI采纳与能力的开源经济指数

Seamus Somerstep, Aritra Guha, Divesh Srivastava, Yuekai Sun

机构 * University of Michigan(密歇根大学) AT&T Chief Data Office(AT&T首席数据办公室) IFM-MBZUAI

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.AI、cs.LG

AI总结 通过公开聊天数据和O*NET任务构建开源经济指数,衡量AI在各职业的采纳率与任务执行能力,发现金融、计算机和艺术行业采纳率最高。

详情

展开后加载摘要…

URL PDF HTML 收藏