arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 461 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 461 篇

2603.16073 2026-06-15 cs.CL 版本更新 70%

ClaimFlow: Tracing the Evolution of Scientific Claims in NLP

ClaimFlow: 追踪自然语言处理中科学主张的演变

Aniket Pramanick, Yufang Hou, Saif M. Mohammad, Iryna Gurevych

机构 * Ubiquitous Knowledge Processing Lab (UKP Lab)(通用知识处理实验室) Department of Computer Science and Hessian Center for AI (hessian.AI)(计算机科学系和海斯曼人工智能中心) Technische Universität Darmstadt(德累斯顿技术大学) IT:U Interdisciplinary Transformation University Austria(奥地利跨学科转型大学) National Research Council Canada(加拿大国家研究委员会)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出ClaimFlow框架,通过标注1617篇论文中的5689个主张和4871个跨论文关系,定义主张关系分类任务,并分析NLP领域主张的演变模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07590 2026-06-12 cs.IR cs.AI 版本更新 70%

DCD: Domain-Oriented Design for Controlled Retrieval-Augmented Generation

DCD:面向领域的受控检索增强生成设计

Valerii Kovalskii, Nikita Belov, Nikita Miteyko, Igor Reshetnikov, Maksim Maksimov

机构 * red_mad_robot

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出DCD(领域-集合-文档)层次化设计,通过结构化知识表示和多阶段路由控制检索与生成范围,无需修改语言模型,提升RAG在异构语料和多步查询中的鲁棒性和准确性。

Comments 14 pages, 4 figures, 2 links, link to HF https://huggingface.co/datasets/redmadrobot-rnd/dcd, link to GIT https://github.com/redmadrobot-rnd/dcd

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08134 2026-06-10 cs.AI cs.CY 版本更新 70%

Position: The ML Community Must Build an AI-Augmented Peer-Review Ecosystem

立场:机器学习社区必须构建AI增强的同行评审生态系统

Qiyao Wei, Samuel Holt, Jing Yang, Markus Wulfmeier, Mihaela van der Schaar

机构 * University of Amsterdam(阿姆斯特丹大学) University of Cambridge(剑桥大学) ETH Zurich(苏黎世联邦理工学院) University of California, Berkeley(加州大学伯克利分校)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对ML领域稿件激增导致同行评审危机,本文主张将AI辅助评审作为优先研究课题,提出利用大语言模型作为协作工具,增强事实核查、评审指导、作者改进和决策支持,并强调需要更细粒度的评审数据。

Comments 18 pages, 3 figures. Accepted (Oral) at the ICML 2026 Position Paper Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.16092 2026-06-09 cs.CL 版本更新 70%

Chatlaw: A Multi-Agent Legal Assistant based on a Role-Aligned Mixture-of-Experts Architecture

Chatlaw: 基于角色对齐的混合专家架构的多智能体法律助手

Jiaxi Cui, Munan Ning, Zongjian Li, Bohua Chen, Yang Yan, Hao Li, Bin Ling, Yonghong Tian, Li Yuan

机构 * Shenzhen Graduate School, Peking University(北京大学深圳研究生院) Peng Cheng Laboratory(鹏城实验室) Law School, Peking University(北京大学法学院) Pandalla.ai

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出Chatlaw多智能体法律助手,采用角色对齐的混合专家架构模拟律所协作流程,在LawBench基准上准确率比GPT-4提升7.73%,并通过真实案例验证。

Comments Accepted manuscript. Updated to match the journal version and added DOI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07380 2026-06-08 cs.CL 版本更新 70%

Mining Useful General Data for Low-Resource Domain Adaptation

挖掘低资源领域适应的有用通用数据

Pingjie Wang, Hongcheng Liu, Yusheng Liao, Ziqing Fan, Yaxin Du, Shuo Tang, Yanfeng Wang, Yu Wang

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 针对低资源领域数据稀缺问题,提出NTK-Selector方法,利用神经正切核从通用数据中筛选有用样本,显著提升领域适应效果。

Comments 39 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05232 2026-06-08 cs.AI 版本更新 70%

ChemQuests: A Curated Chemistry Question-Answer Database Extracted from ChemRxiv papers

ChemQuests: 从ChemRxiv论文中提取的精选化学问答数据库

Mahmoud Amiri, Thomas Bocklitz

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出ChemQuests数据集,包含从155篇ChemRxiv论文中提取的952个高质量问答对,覆盖17个化学子领域,用于化学NLP研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25055 2026-08-18 cs.CY cs.SI physics.soc-ph 版本更新 67%

Building Digital Societies as Ecosystems: How Recognition and Repeat Relationships Sustain Cross-Community Work in Open Source

构建数字社会作为生态系统:认可与重复关系如何维持开源中的跨社区工作

Lucia Gomez Tejeiro, Thibaut Chataing, Julian Jang-Jaccard, Alain Mermoud, Thomas Maillart

专题命中 领域大模型 :LLM(abstract,abstract_cn)

AI总结 通过分析464个网络安全项目和11372名贡献者的二部图,利用Louvain社区检测和逻辑斯蒂轨迹,研究开源生态系统中跨边界协作的识别与重复关系机制。

Comments 52 pages (main text + supplementary material), 5 main figures, 13 supplementary figures, 2 main tables. Submitted to EPJ Data Science. Data and code: https://doi.org/10.17605/OSF.IO/5RWEK

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31032 2026-08-17 cs.SE cs.CY 版本更新 67%

Structuring license permissiveness from pairwise comparisons

软件许可证的部分排序

Hamidah Oderinwale, David Atkinson, Rachel Hong, Art Abal, Ben Laufer

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本文利用大语言模型对软件许可证进行成对比较,构建基于宽松度的部分排序,并结合现有分类法分析许可证选择,揭示更严格许可证的可解释属性及其对开源生态的法律影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11973 2026-08-14 cs.IR 版本更新 67%

Sci-Surf: Navigating Scientific Literature Discovery through Human Feedback and Intelligent Summarization

Sci-Surf:通过人类反馈与智能摘要实现科学文献发现

Fang Guo, Qi Zhu, Rongcan Pei, Shuqi He, Hui Chen, Yue Zhang

专题命中 领域大模型 :LLM(abstract,abstract_cn)

AI总结 针对现有学术发现平台支持不足的问题,提出以意图为中心的Sci-Surf系统,结合反馈驱动推荐与多模态论文消化,经评估推荐质量和消化质量有可测量提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11955 2026-08-14 cs.CY cs.HC 版本更新 67%

Philosophical vertigo with artificial intelligence

人工智能引发的哲学眩晕

Thomas A. Pollak, Hamilton Morrin, Murray Shanahan

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 该研究提出人工智能引发的哲学眩晕概念,分析其产生、传播路径,关联临床妄想案例,指出AI将参与重构人类认知环境,并提出哲学可修正性作为应对对策。

Comments 29 pages, no figures. Source formatting revised to improve arXiv HTML accessibility; article text unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07516 2026-08-14 cs.HC 版本更新 67%

Catch the Patient, Not the AI: Collective Sensemaking in an Online Health Community

关注患者,而非AI:在线健康社区中的集体意义建构

Feng He

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本研究以中国最大淋巴瘤在线社区House086为对象,分析337条ChatGPT后记录,发现社区不系统审核AI,而是将AI答案放回多判断来源,仍聚焦患者而非AI。

Comments 20 pages, 3 figures, 8 tables including appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02311 2026-08-11 econ.EM q-fin.RM q-fin.ST 版本更新 67%

AI Governance for Institutional Readiness in Finance

金融领域机构准备状态的AI治理

Irene Aldridge, Steve Krawciw

专题命中 领域大模型 :LLM(abstract,abstract_cn)

AI总结 针对金融领域智能体AI治理滞后于部署的问题,本文提出四层可计算AI治理框架,通过实证研究验证其有效性并给出90天实施序列,明确跨主体风险控制的可转移措施。

Comments 44 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03240 2026-08-11 cs.SI cs.DL 版本更新 67%

Generalization and the Rise of System-level Creativity in Science

泛化与科学中系统级创造力的兴起

Hongbo Fang, James Evans

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 研究通过分析科学出版物的引用网络,发现科学贡献可分为基础、扩展和泛化三种功能类型,揭示了科学生产模式从学科内部转向学科间接口的趋势,揭示了数字知识基础设施驱动的科学结构重组。

Comments 125 pages, 60 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02323 2026-08-06 cs.SE 版本更新 67%

ECLAIR: A Causally-Grounded AI Framework for Scientific Discovery in Empirical Software Engineering

ECLAIR:一种用于实证软件工程科学发现的因果基础AI框架

Alejandro Velasco, Daniel Rodriguez-Cardenas, Dipin Khati, David N. Palacio, Denys Poshyvanyk

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 该研究提出因果基础AI框架ECLAIR,将LLMs整合到软件工程科学过程各阶段,通过案例研究揭示提示设计对LLMs代码生成准确率的影响,为AI辅助软件工程实证研究提供方法论基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13099 2026-08-06 cs.CV 版本更新 67%

Industrial Synthetic Segment Pre-training

工业合成片段预训练

Shinichi Mae, Hirokatsu Kataoka, Ryousuke Yamada, Yoshihiro Fukuhara, Risa Shinoda, Christian Rupprecht

机构 * TICO-AIST Cooperative Research Lab for Advanced Logistics, Japan(TICO-AIST先进物流联合研究实验室,日本) National Institute of Advanced Industrial Science and Technology (AIST), Japan(日本国家先进工业科学与技术研究院) Visual Geometry Group, University of Oxford, UK(牛津大学视觉几何组)

专题命中 领域大模型 :foundation model(abstract,abstract_cn)

AI总结 该研究提出基于FDSL的InsCore合成数据集,在不使用真实图像的情况下预训练的分割模型,在5个领域的表现与ImageNet-21k预训练模型相当,解决了工业分割模型对真实图像的依赖问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05621 2026-08-04 cs.IR 版本更新 67%

ANCHOR: Agentic Noise Creation Framework for Human Simulation and Denoising Recommendation

ANCHOR: 用于人类模拟和去噪推荐的智能体噪声创建框架

Xiangming Li, Hua Chu, Jiaming Liang, Jianan Li, Yangtao Zhou

专题命中 领域大模型 :LLM(abstract,abstract_cn)

AI总结 提出ANCHOR框架,通过智能体模拟用户行为生成真实噪声标签,将推荐去噪转化为监督学习问题,实现高效噪声识别。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17310 2026-08-04 cs.CR 版本更新 67%

Cryptanalysis of LDPC-Based Pseudorandom Error-Correcting Codes

基于LDPC的伪随机纠错码的密码分析

Tianrui Wang, Anyu Wang, Tianshuo Cong, Delong Ran, Jinyuan Liu, Xiaoyun Wang

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 首次对LDPC-PRC进行密码分析,提出三种攻击破坏其不可检测性和安全性,在DeepSeek和Stable Diffusion等模型上验证有效,并给出防御建议。

Comments Accepted by USENIX Security 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08090 2026-08-04 cs.SE cs.HC 版本更新 67%

Crossing Margins: Intersectional Users' Ethical Concerns about Software

跨越边际:交叉性用户对软件的伦理关切

Lauren Olson, Tom P. Humbert, Ricarda Anna-Lena Fischer, Bob Westerveld, Florian Kunneman, Emitzá Guzmán

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本研究针对交叉性用户软件伦理关切研究空白,收集700多个交叉性Subreddits的36777条帖子,利用大语言模型等技术分析交叉性声音,构建反馈驱动框架评估软件对交叉性用户需求的满足度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08466 2026-07-31 cs.IR 版本更新 67%

ToolRec: Calibrated Preference Alignment for Query Recommendation in On-Device Assistants

ToolRec: 面向设备端助手的校准偏好对齐查询推荐

Zihan Luo, Lingkui Chen, Ruike Zhang, Hong Huang, Boyang Zhang, Ziniu Chen, Lizhong Wang, Chao Chen

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 提出ToolRec框架,通过构建系统工具库和双层校准机制优化点击数据,利用加权KTO对齐模型,在设备端助手查询推荐中提升点击率和相关性。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.11840 2026-07-31 cs.HC 版本更新 67%

AI-Assisted Data Extraction for Systematic Reviews in Education

教育领域系统综述的AI辅助数据提取

Noah L. Schroeder, Chris Davis Jaldi, Shan Zhang, Kweku Yamoah

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本研究针对教育领域系统综述中LLMs应用不足的问题,通过两项实证研究发现LLMs数据提取准确性不足,提出人在回路工作流程并开发相关开源工具,为AI辅助数据提取提供可行方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22693 2026-07-29 cs.DL 版本更新 67%

Detecting Hallucinated and Suspicious Citations: What Current Tools Can and Cannot Do

检测幻觉式和可疑引用:当前工具的能力与局限

Fidan Badalova, Philipp Mayr

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 研究针对大语言模型在学术写作中产生的幻觉式和可疑引用问题,评估了CheckIfExist等工具,指出其虽能预警,但受多种因素限制,强调此类引用对科学交流是个现实且渐趋严重的问题,需更完善的检测系统。

Comments 6 pages, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17675 2026-07-29 cs.SE cond-mat.mtrl-sci 版本更新 67%

Bridging the Gap on AI-Assisted Scientific Software Development Through Transparency and Traceability

通过透明性和可追溯性弥合人工智能辅助科学软件开发的差距

Chaitanya Bhave, Pierre-Clément A. Simon, Casey Icenhour, Lin Yang, Cody J. Permann, Daniel Schwen, Christopher S. Ritter

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本文探讨了在严格软件质量保证背景下如何负责任地使用人工智能辅助科学软件开发,提出了一种结构化框架用于AI辅助的验证与验证案例开发,以确保软件质量。

Comments 11 figures, 25 main pages (42 total pages including supplementary materials)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08377 2026-07-07 cs.CV 版本更新 67%

UniVideo: Unified Understanding, Generation, and Editing for Videos

UniVideo:视频的统一理解、生成与编辑

Cong Wei, Quande Liu, Zixuan Ye, Qiulin Wang, Xintao Wang, Pengfei Wan, Kun Gai, Wenhu Chen

机构 * University of Waterloo(多伦多大学) Kling Team, Kuaishou Technology(快手技术团队)

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 提出UniVideo框架,采用双流设计,结合多模态大语言模型与多模态DiT进行视频生成等任务。统一多种视频任务于单范式,实验表明其性能出色,还支持任务组合与能力迁移,且发布了模型和代码。

Comments Project Website https://congwei1230.github.io/UniVideo/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18176 2026-07-07 cs.CV 版本更新 67%

Atlas is Your Perfect Context: One-Shot Customization for Generalizable Foundational Medical Image Segmentation

图谱是理想上下文:用于可泛化基础医学图像分割的一次性定制

Ziyu Zhang, Yi Yu, Simeng Zhu, Ahmed Aly, Yunhe Gao, Ning Gu, Yuan Xue

机构 * Nanjing University(南京大学) The Ohio State University(俄亥俄州立大学) Stanford University(斯坦福大学)

专题命中 领域大模型 :foundation model(abstract);pretraining(abstract)

AI总结 研究医学图像中解剖结构分割问题,提出图谱引导框架AtlasSegFM,通过图谱查询配准生成提示,用冻结基础模型细化分割,经自适应融合模块结合图谱先验与模型输入及预测,实现一次性定制。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10448 2026-07-07 cs.IR cond-mat.mtrl-sci 版本更新 67%

MatSKRAFT: A framework for large-scale materials knowledge extraction from scientific tables

MatSKRAFT:一个用于从科学表格中大规模提取材料知识的框架

Kausik Hira, Mohd Zaki, Mausam, N. M. Anoop Krishnan

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 介绍MatSKRAFT框架,能从表格数据中自动提取整合材料科学知识。核心方法是转化表格为基于图的表示,用约束驱动GNN处理。贡献是性能超当代前沿模型,构建含大量条目的综合数据库,揭示新关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15427 2026-07-03 cs.SE 版本更新 67%

TVR: Automotive System Requirement Traceability Validation and Recovery Through Retrieval-Augmented Generation

TVR:通过检索增强生成实现汽车系统需求可追溯性验证与恢复

Feifei Niu, Rongqi Pan, Lionel C. Briand, Hanyang Hu

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 提出TVR方法,利用大语言模型和检索增强生成技术,验证和恢复汽车系统中利益相关者需求与系统需求之间的可追溯性链接,实验证明其在工业环境中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07221 2026-07-02 cs.CV 版本更新 67%

Histopathology Multi-modal Embedding for Pathology Composed Retrieval

病理学组合检索的组织病理学多模态嵌入

Qifeng Zhou, Wenliang Zhong, Thao M. Dang, Hehuan Ma, Saiyang Na, Yuzhi Guo, Junzhou Huang

机构 * The University of Texas at Arlington(德克萨斯大学阿灵顿分校)

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 提出HOMIE框架,将生成式多模态大语言模型适配为病理检索专家,解决组合查询中的架构、任务和领域不匹配问题,在病理组合检索基准上显著优于现有方法。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10938 2026-06-29 cs.CL cs.AI cs.LG 版本更新 67%

ELF: Embedded Language Flows

ELF:嵌入式语言流

Keya Hu, Linlu Qiu, Yiyang Lu, Hanhong Zhao, Tianhong Li, Yoon Kim, Jacob Andreas, Kaiming He

机构 * MIT(麻省理工学院)

专题命中 领域大模型 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出ELF,一种基于连续时间流匹配的连续嵌入空间扩散模型,通过最小调整即可在离散领域有效工作,实验显示其在生成质量与采样步骤上优于现有模型。

Comments Tech report. arXiv v2: add distillation results in Appendix B. https://linlu-qiu.github.io/assets/html/elf_pd.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18942 2026-06-26 cs.CY q-fin.RM 版本更新 67%

Advanced Applications of Generative AI in Actuarial Science: Case Studies Beyond ChatGPT

生成AI在精算科学中的高级应用:超越ChatGPT的案例研究

Simon Hatzesberger, Iris Nonneman

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本文通过四个案例研究探讨生成AI在精算实践中的潜力,涵盖从早期神经网络到现代Transformer生成AI系统的发展,展示其在索赔预测、市场比较、车辆损坏分类及代码迁移中的应用,同时讨论监管与安全挑战。

Comments v3: Minor revision in response to peer review. Methodological and reproducibility refinements across the case studies and the governance section

Journal ref European Actuarial Journal (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11197 2026-06-24 cs.CV 版本更新 67%

MedP-CLIP: Medical CLIP with Region-Aware Prompt Integration

MedP-CLIP:具有区域感知提示集成的医学CLIP

Jiahui Peng, He Yao, Jingwen Li, Yanzhou Su, Sibo Ju, Yujie Lu, Jin Ye, Hongchun Lu, Xue Li, Lincheng Jiang, Min Zhu, Junlong Cheng

机构 * Sichuan University(四川大学) Xinjiang University(新疆大学) Alibaba Group(阿里巴巴集团) Fuzhou University(福州大学) Shanghai AI Laboratory(上海人工智能实验室) Southwest Jiaotong University(西南交通大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 提出MedP-CLIP,一种区域感知医学视觉语言模型,通过特征级区域提示集成机制,支持多种提示形式,在保持全局上下文的同时聚焦局部区域,在零样本识别、交互式分割等任务中显著优于基线方法。

Comments Accepted by Medical Image Analysis (MedIA)

Journal ref Medical Image Analysis, 113 (2026), 104193

详情

展开后加载摘要…

URL PDF HTML 收藏