arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 925 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 925 篇

2606.10413 2026-06-10 cs.AI 新提交 70%

Soul Computing: A Theoretical Framework and Technical Architecture for Intelligent Agents with Independent Consciousness

灵魂计算:具有独立意识的智能体的理论框架与技术架构

Jinshan Zhang, Xishi Zhou, Qiu Peng, Jianwei Yin

机构 * Innovation and Management Center, School of Software Technology, Zhejiang University (Ningbo)(浙江大学(宁波)软件学院创新与管理中心) School of Software Technology, Zhejiang University, Ningbo(浙江大学软件学院(宁波))

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出“灵魂计算”范式,区分狭义与广义概念,构建以意向性核心为特征的智能体架构,实现AI从工具到生命体的转变。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09930 2026-06-10 cs.PL cs.LG cs.SC 新提交 70%

Compile Once, Differentiate Everywhere: A Differentiable Meta-Circular Interpreter

一次编译,处处微分:可微分元循环解释器

Lucas Sheneman

机构 * Institute for Interdisciplinary Data Sciences(交叉学科数据科学研究所) University of Idaho(爱达荷大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 提出一种将Scheme子集编译为可微分计算图的编译器,实现可微分元循环解释(DMCI),支持对包含闭包、递归和数据结构的程序进行反向模式自动微分,无需重新编译。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08855 2026-06-09 cs.AI cs.CV cs.CY 新提交 70%

Hybrid E-Assessment in Higher Education: Semi-Automated Grading of Paper-Based Written Examinations

高等教育中的混合电子评估:纸质笔试的半自动评分

Hartwig Grabowski, Michael Canz

机构 * Institute for Machine Learning and Analytics, Hochschule Offenburg(霍恩海姆应用技术大学机器学习与分析研究所) Hochschule Offenburg(霍恩海姆应用技术大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对完全数字化和部分数字化电子评估在总结性考试中的局限性,提出混合电子评估方法,保留纸质问题导向任务,通过结构化答案格式和手写字符识别实现半自动评分,结合视觉大语言模型和两遍验证提升评估有效性、公平性和可扩展性。

Comments 15 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08405 2026-06-09 cs.AI physics.flu-dyn 新提交 70%

Self-Evolving Scientific Agent Discovers Generalizable Physically-Reasoned Fluid Control

自进化科学智能体发现可泛化的物理推理流体控制

Boai Sun, Wenjin Guo, Zongmin Yu, Liu Yang

机构 * National University of Singapore(新加坡国立大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出一种由大语言模型驱动的自进化科学智能体工作流,通过迭代代码生成和物理仿真诊断,自动构建可解释的控制器,并在欠驱动双关节狗鲨游泳器目标到达任务中实现零样本泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07613 2026-06-09 cs.CV cs.AI 新提交 70%

Can You Trust What You See? Human and AI Detection of Synthetic Legal Evidence

你能相信你所见的吗?人类与AI对合成法律证据的检测

Jinzhe Tan, Ali Ekber Cinar, Karim Benyekhlef

机构 * Faculty of Law, McGill University(麦吉尔大学法学院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究人类和前沿多模态大模型在民事纠纷场景中区分真实照片与AI生成图像的能力,发现两者均不可靠,提出结合人工审查、MLLM筛查和来源认证的解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07113 2026-06-08 cs.AI 新提交 70%

Beyond Post-hoc Explanation: Toward Glassbox AI via Probabilistic Mediation

超越事后解释:通过概率中介迈向玻璃箱AI

Manuele Leonelli

机构 * Manuele Leonelli(曼努埃尔·莱奥内利)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对大语言模型在关键领域的不透明性,提出玻璃箱框架,利用贝叶斯网络作为事前中介层,实现可审计推理、不确定性量化和可争议输出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21341 2026-08-24 cs.SE 新提交 67%

Natural-Language Workflows Are Not Software Yet: Artifact-Driven Compilation for Reliable Agent Execution

自然语言工作流尚未成为软件:面向可靠智能体执行的工件驱动编译

Xiangzhe Xu, Hanxi Guo, Guangyu Shen, Siyuan Cheng, Xiangyu Zhang

专题命中 领域大模型 :LLM(abstract,abstract_cn)

AI总结 研究针对自然语言工作流智能体执行不可靠问题,提出Artic编译器将其转换为工件驱动工作流,经评估可提升任务解决率28个百分点,且跨模型、重复执行一致性分别提高32、56个百分点。

Comments The first two authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20097 2026-08-21 cs.CR cs.DC 新提交 67%

TrustRAG: Blockchain-Enhanced RAG via Committee-Based Credibility Scoring

TrustRAG:基于区块链的检索增强生成系统,通过委员会机制实现可信度评分

Baixiang Liu, Haotian Che, Yuan Li

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 针对RAG系统难以验证文档可信度的问题,提出TrustRAG,结合区块链与委员会机制,通过零知识协议、安全多方计算及哈希承诺实现可验证的文档信任评分,保障关键领域决策安全。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18565 2026-08-20 cs.SE 新提交 67%

SemaPLC: A Project-Grounded, Verification-Gated Agent Harness for PLC Code Generation

SemaPLC:一种基于项目、经验证门控的PLC代码生成智能体框架

Yanlun Tu, Huacan Wang, Ziyue Zhou, Jie Zhou, Ningyan Zhu, Ge Chen, Wangyi Chen, Tengfei Zhou, Yifan Zhou, Dasheng Yang, Xiaofeng Mou, Hui Zhang, Yi Xu

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 SemaPLC是基于项目、经验证门控的PLC代码生成智能体框架,通过外部检查确认任务完成,在多模型的POU任务及项目上下文任务中均表现最优,动态行为测试得分显著高于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16618 2026-08-18 cs.SE cs.PL 新提交 67%

The Specification Paradox: Rethinking Requirements Engineering in the Age of AI

规范悖论:人工智能时代的需求工程再思考

Tassio Sirqueira, Jessica Faciroli

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 该研究探讨大型语言模型普及下软件工程从代码中心转向规范驱动开发的趋势,提出规范悖论,指出AI生成软件能力越强,越依赖高质量人类规范,强调需求工程的核心地位。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14869 2026-08-18 cs.HC 新提交 67%

RaivenTracks: Branching Provenance for Conversational Visualization Workflows

RaivenTracks:面向对话式可视化工作流的分支溯源系统

Ella Hugie, Alexandra Irger, Grace Guo, Kenneth Moreland, David Pugmire, Scott Klasky, Hanspeter Pfister

专题命中 领域大模型 :LLM(abstract,abstract_cn)

AI总结 RaivenTracks是Raiven可视化管道的工作流感知扩展,通过两级状态管理架构实现可分支的版本树与细粒度撤销/重做,试点研究显示其支持可视化工作流的分支与恢复,为AI驱动科学工作流的溯源监督提供了新方向。

Comments *Ella Hugie and Alexandra Irger are co-first authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13369 2026-08-14 cs.CY 新提交 67%

Credible, Not Always Correct: How Reddit Users Verify AI-Generated Legal Advice

可信,未必正确:Reddit用户如何验证AI生成的法律建议

Rebecca Owens, Yusuf Mücahit Çetinkaya, Stergios Aidinlis, Dhyey Mehta, Tuğrulcan Elmas

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本文通过分析Reddit平台的用户叙事与社区反应,揭示AI生成法律建议的可信度源于社会建构而非准确性,多数用户仅凭其形式与情感安慰就采纳,少数采用分布式法律咨询的验证方式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13122 2026-08-14 cs.DC 新提交 67%

Validation-Centric AI-Assisted GPU Porting of a 250,000+ Line Legacy Weather Simulation Code

面向验证的25万行以上遗留气象模拟代码的AI辅助GPU移植

Tetsuya Hoshino, Masaya Kato, Kazuhisa Tsuboki, Daichi Mukunoki, Takahiro Katagiri, Toshihiro Hanawa

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本文以遗留Fortran气象模拟代码CReSS为例,提出面向验证的AI辅助GPU移植工作流,为162个内核生成经数值验证的GPU实现,获5.1倍应用级加速,还检测到5个内核的数值不一致。

Comments 11 pages, 1 figure, 3 tables. Submitted to AgenticAI4HPC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11090 2026-08-12 cs.CY 新提交 67%

Who Uses Open-Weight Models? China and the Shifting Geography of AI in Science

谁在使用开放权重模型?中国与科学领域AI的地理格局变迁

Zackary Okun Dunivin

专题命中 领域大模型 :LLM(abstract,abstract_cn)

AI总结 该研究分析2100万篇论文发现,GPT系列主导AI研究,开放权重模型使用量升至2026年的44.0%,中国机构研究人员采用率是其他机构的2.23倍,推动了开放权重模型的采用,反映AI模型生态的地缘文化重组。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10175 2026-08-12 cs.MA q-fin.PM 新提交 67%

Beyond Cash Flows: A Multi-Agent AI Framework for Valuing Clinical-Stage, Cross-Border Biotechnology

超越现金流:用于临床阶段跨境生物技术估值的多智能体AI框架

Yuhan Fang

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本文针对临床阶段生物技术估值的现金流假设失效问题,提出多智能体AI框架,其含估值层、跨市场协调层与冲突融合机制,基于作者过往实践确立智能体投资系统设计原则。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08844 2026-08-11 cs.CV 新提交 67%

Toward Mask Annotation-Free Surgical Instrument Segmentation from Endoscopic Images Using Text-Prompted Segment Anything Model 3 (SAM3)

基于文本提示的Segment Anything Model 3(SAM3)实现无掩码标注的内镜图像手术器械分割

Nakul Poudel, Richard Simon, Cristian A. Linte

机构 * Rochester Institute of Technology(罗切斯特理工学院)

专题命中 领域大模型 :language model(abstract);prompting(abstract)

AI总结 本文提出基于SAM3与微调Qwen的两阶段框架,无需标注即可实现内镜图像的手术器械实例级分割,在EndoVis数据集上性能优于直接使用SAM3,为无标注分割提供了新方向。

Comments Accepted at the Medical Image Understanding and Analysis (MIUA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08417 2026-08-11 cs.IR 新提交 67%

Personalized Communication Skills for Agentic Recommender Systems

面向智能体推荐系统的个性化沟通技能

Zongwei Wang, Min Gao, Guangyu Hu, Xinyi Gao, Junliang Yu

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 针对现有智能体推荐系统用户智能体视角狭窄的问题,提出AgentCom个性化沟通技能框架,通过「为什么-是什么-如何-谁」技能库及两种机制提升推荐性能,在三类推荐器中均有效。

Comments 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07407 2026-08-10 math.OC 新提交 67%

A Domain-Specific Harness for End-to-End Automation of Optimization Research

面向优化研究端到端自动化的领域专用工具链

Heechang Kim, Ernest K. Ryu, Shuvomoy Das Gupta

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 提出AutoOPT工具链,将优化研究自动化分为四阶段,通过两个案例研究验证其可发现新型加速梯度方法ITEM-f的解析描述,且相关定理已在Lean 4中形式化验证。

Comments 66 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05691 2026-08-07 cs.CV 新提交 67%

SciQNet: Two-Stage Multimodal Adaptation for Scientific Image Quality Assessment

SciQNet:面向科学图像质量评估的两阶段多模态适配框架

Yin-Loon Khor, Yi-Jie Wong, Jing Jie Tan, Ming Jie Lee

机构 * Universiti Malaya(马来亚大学) Universiti Tunku Abdul Rahman(拉曼大学) National University of Singapore(新加坡国立大学)

专题命中 领域大模型 :instruction tuning(abstract);pretraining(abstract)

AI总结 本研究提出SciQNet两阶段多模态适配框架,在ICME 2026科学图像质量评估挑战赛评分赛道获第2,模型在SIQA-S、SIQA-U等指标表现优异,证实预训练数据相关性的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03272 2026-08-05 cs.IR cs.CR cs.MA cs.SI 新提交 67%

Attacking and Defending Multi-Agent Collaborative Filtering Systems Through Connectivity

通过连通性对多智能体协同过滤系统发起攻击与防御

Anjun Hu, Hanting Xie, Saranya Govindan, Jas Kandola, Kurt Cutajar

专题命中 领域大模型 :LLM(abstract,abstract_cn)

AI总结 本研究将MAS的攻击与防御方法适配到AgentCF框架下的智能体CF场景,表征连通性对攻防结果的影响,还探索了流行病启发指标用于CF配置的健壮性评估。

Comments 10 pages, 10 figures, 20th ACM Conference on Recommender Systems (RecSys '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01846 2026-08-04 cs.IR 新提交 67%

HyperAgent4POI: Dynamic Semantic Message Passing on Multi-Agent Hypergraphs for Missing-Modality Recommendation

HyperAgent4POI:面向缺失模态推荐的多智能体超图上的动态语义消息传递

Jinze Wang, Yuze Liu, Tiehua Zhang, Jiong Jin, Zhu Sun

专题命中 领域大模型 :LLM(abstract,abstract_cn)

AI总结 HyperAgent4POI通过动态语义消息传递在多智能体超图中补全缺失模态,在三个LBSN数据集上较15个基线实现排序提升,60%模态缺失率下NDCG@20平均提升8.2%,且推理效率高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01346 2026-08-04 cs.CY 新提交 67%

Hybrid AI for Explainable and Accurate Conversational Agents in eGovernment

用于电子政务中可解释且准确的对话智能体的混合人工智能

Ilias Chalkidis, Vlad Paul Cosma, Søren Debois, Daniel Hershcovich, Thomas Hildebrandt, Hugo A. Lòpez, Amogh Raina, Konstantinos Varvoutas, Tilman Zuckmantel

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 该研究提出对话式混合人工智能(CHAI)架构,结合大型语言模型与基于规则的控制器,采用DCR图作为建模语言,构建电子政务领域可解释且准确的对话智能体,已在新冠聊天机器人及残疾学生助学金案件管理中应用。

Comments Presented at AIDA2J Workshop at ICAIL 2026, SMU, Singapore

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27298 2026-07-31 cs.LO 新提交 67%

From Lecture Notes to Lean: Formalizing a Textbook on Probability Theory

从讲义到Lean:形式化一本概率论教材

Shuo Deng, Kenneth W. Shum

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本文开展Lean形式化工作,对一本14章的概率论教材进行形式化,生成机器可验证配套资料,复用Mathlib结果并引入接口引理,为AI辅助数学构建形式化基础。

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26526 2026-07-30 cs.HC 新提交 67%

A Design Study on Voice-based Interaction for Immersive Network Visualization and Analysis

面向沉浸式网络可视化与分析的基于语音交互的设计研究

Sam Yu-Te Lee, Hsin-Ai Chen, Sarah Yuniar, David Bauer, Kwan-Liu Ma

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本研究通过研究驱动设计,设计了依托大语言模型的沉浸式网络可视化语音交互系统,经用户研究表明其可提升感知可用性、降低认知负荷,为沉浸式可视化提供设计启示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25901 2026-07-29 cs.IR 新提交 67%

RecoReward: Recommender-Guided Multimodal Description Generation for Recommendation

RecoReward:用于推荐的推荐器引导多模态描述生成

Guohong Mu, Yueyang Liu, Jiangxia Cao, Changxin Lao, Zijie Zhuang, Yuhui Zhang, Jiaqi Feng, Ruochen Yang, Shuang Yang, Zhaojie Liu, Qibin Hou

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 研究针对多模态推荐中传统方法不足,提出RecoReward,训练时用行为衍生奖励,保留仅内容推理。在直播推荐中利用用户历史等估计亲和力,通过推荐器亲和力分数提供反馈,实验表明该方法能提升MLLM性能,利于下游推荐且保留内容服务。

Comments 16 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22606 2026-07-28 cs.CY 新提交 67%

Auditing Institutional Heterogeneity for Generative AI in Patient Education: A Large-Scale Study of 102 US Transplant Handbooks

审核患者教育中生成式人工智能的机构异质性:对102本美国移植手册的大规模研究

Yubo Li, Rema Padman, Ramayya Krishnan

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 研究针对美国23个移植中心的102本手册及相关患者问题,用结构化输出大语言模型评判器审核。发现机构编辑风格超越器官类型界限,信息差距在特定主题突出,分歧主题聚类,且可由问题框架预测分歧,探讨了对移植护理中部署生成式人工智能的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21605 2026-07-27 cs.HC 新提交 67%

Natural Language Processing in Health Professions Education: A Scoping Review

卫生职业教育中的自然语言处理:一项范围综述

Javad Mohammad Alizadeh, Pegah Saebi, Mukesh Kumar Patel, Huanmei Wu

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 该范围综述遵循特定框架和指南,综合64项研究,梳理NLP和AI在卫生职业教育中的应用,确定七个主题领域,发现有技术前景但也有挑战,强调公共卫生教育是证据空白区及未来研究投资重点。

Comments This manuscript has been accepted at the 14th IEEE International Conference on Healthcare Informatics (ICHI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21513 2026-07-24 cs.HC cs.IR 新提交 67%

Transparent by Design, Usable in Practice? A Formative Usability Study of a Conversational Product Advisor

设计透明,实践可用?对话式产品顾问的形成性可用性研究

Kevin Schott, Dagmar Kern, Daniel Hienert

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 研究对话式产品顾问的可用性,通过对含受限自然语言生成等功能的笔记本搜索聊天机器人进行研究,发现设计透明不保证理解,排名解释有严重问题,参与者虽看重省力但希望有更多直接操作控件,贡献了可用性问题及设计建议。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18519 2026-07-22 cs.AR 新提交 67%

A Progressive Approach to Synthesizable RTL Design Generation Using LLMs

一种使用大语言模型生成可综合 RTL 设计的渐进式方法

Xiangfei Kong, Tasnim Tabassum, Marwan Abdelwahab, Hao Zheng

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 研究利用大语言模型从自然语言规范生成RTL设计时的问题,提出VeriRefine方法,将规范细化为明确描述并审核,生成代码后分类修复模拟失败,提升功能正确性,使可合成性成为结构属性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17251 2026-07-21 cs.CV 新提交 67%

VecFontLLM: Anchor-Guided Direct Synthesis of Chinese Vector Fonts

VecFontLLM:基于锚点引导的中文矢量字体直接合成

Hao Yuan, Yuxuan Luo, Xing Chen, Zhouhui Lian

机构 * Fuzhou University(福州大学) Peking University(北京大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 研究旨在解决直接生成中文矢量字体的难题,提出VecFontLLM这一基于锚点引导的多模态大语言模型,通过锚点预测、细化及贝塞尔控制点完成来合成矢量字形,实现高质量少样本合成,实验显示其相比现有方法有显著优势。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏