arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12761 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12761 篇

2604.16465 2026-04-21 cs.AI econ.GN q-fin.EC 70%

Healthcare AI for Automation or Allocation? A Transaction Cost Economics Framework

医疗AI用于自动化还是分配?一种交易成本经济学框架

Ari Ercole

机构 * Department of Medicine, University of Cambridge, Addenbrooke’s Hospital, Hills Road, Cambridge CB2 0QQ, UK(剑桥大学医学系,加德纳医院,剑桥,英国)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过交易成本经济学框架分析医疗工作中协调成本的差异,发现临床角色的协调成本高于非临床角色,表明数字和AI干预的机会分布受协调结构影响更大。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16397 2026-04-21 cs.CY cs.AI cs.HC 70%

Instructor-Created Custom GPTs as Pedagogical Partners Fostering Immersion in Online Higher Education: Two Case Studies

由教师创建的定制GPT作为教学伙伴促进在线高等教育中的沉浸感:两个案例研究

Dennis Beck, Leonel Morgado

机构 * University of Arkansas(亚拉巴马大学) Universidade Aberta & INESC TEC(开放大学及INESC TEC)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过两个案例研究探讨定制GPT如何通过沉浸维度提升在线教育中的参与度,展示其作为教学伙伴的作用。

Comments Accepted for presentation at iLRN 2026 - Immersive Learning Research Network conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15646 2026-04-20 cs.CL 70%

FD-NL2SQL: Feedback-Driven Clinical NL2SQL that Improves with Use

FD-NL2SQL:基于反馈的临床自然语言到SQL转换系统,使用越越好

Suparno Roy Chowdhury, Tejas Anvekar, Manan Roy Choudhury, Muhammad Ali Khan, Kaneez Zahra Rubab Khakwani, Mohamad Bassam Sonbol, Irbaz Bin Riaz, Vivek Gupta

机构 * Arizona State University(亚利桑那州立大学) Mayo Clinic(梅奥诊所)

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 本文提出FD-NL2SQL,一种基于反馈的临床自然语言到SQL转换系统,通过用户反馈不断优化查询生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15327 2026-04-20 cs.HC cs.AI 70%

Eco-Bee: A Personalised Multi-Modal Agent for Advancing Student Climate Awareness and Sustainable Behaviour in Campus Ecosystems

Eco-Bee:一种面向校园生态系统的个性化多模态代理,用于提升学生气候意识和可持续行为

Caleb Adu, Neil Kapadia, Binhe Liu, Jonathan Randall, Sruthi Viswanathan

机构 * University of Hull(赫尔大学) The Spaceship Academy(太空学院) City St George’s, University of London(伦敦大学城市学院) King’s College London(伦敦国王学院) Lancaster University(兰卡斯特大学) University of Oxford(牛津大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 Eco-Bee通过整合大语言模型、行星边界框架(Eco-Score)和对话代理,为学生提供个性化反馈和行为激励,推动校园可持续发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23304 2026-04-20 cs.CV cs.AI 70%

MedGemma vs GPT-4: Open-Source and Proprietary Zero-shot Medical Disease Classification from Images

MedGemma vs GPT-4:开源与专有零样本医学疾病图像分类

Md. Sazzadul Islam Prottasha, Nabil Walid Rafi

机构 * Department of Information and Communication Technology, Bangladesh University of Professionals(信息与通信技术系,孟加拉国专业大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文比较了开源MedGemma与专有GPT-4在医学图像零样本疾病分类中的性能,MedGemma通过LoRA微调在准确率和敏感性上均表现更优,凸显了领域特定微调对临床应用的重要性。

Comments Accepted for publication in the Journal of Machine Learning and Deep Learning (JMLDL). 9 pages, 9 figures, 10 tables

Journal ref Journal of Machine Learning and Deep Learning, Vol. 2, No. 2, pp. 1-9, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14718 2026-04-17 cs.AI cond-mat.dis-nn hep-th 70%

The Agentification of Scientific Research: A Physicist's Perspective

科学研究的代理化:一位物理学家的观点

Xiao-Liang Qi

机构 * Leinweber Institute for Theoretical Physics, Stanford University(莱因韦伯理论物理研究所,斯坦福大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文探讨了AI革命对科学研究的影响,强调AI不仅是工具而是合作伙伴,改变科研效率与协作结构,主张持续学习与多样性思想对原创发现的重要性。

Comments 14 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13168 2026-04-17 cs.AI cs.CE cs.IR cs.MA 70%

Finch: Benchmarking Finance & Accounting across Spreadsheet-Centric Enterprise Workflows

Finch:跨电子表格中心企业工作流的金融与会计基准测试

Haoyu Dong, Pengkun Zhang, Yan Gao, Xuanyu Dong, Yilin Cheng, Mingzhe Lu, Zikun Zhu, Adina Yakefu, Shuxin Zheng

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 Finch通过真实企业工作流评估AI代理,包含数据录入、结构化、格式化等任务,涵盖预算、交易等多领域,展示了AI在复杂企业工作流中的挑战。

Comments ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13180 2026-04-16 cs.AI 70%

SciFi: A Safe, Lightweight, User-Friendly, and Fully Autonomous Agentic AI Workflow for Scientific Applications

SciFi: 一种安全、轻量、用户友好且完全自主的科学应用代理AI工作流

Qibin Liu, Julia Gonski

机构 * SLAC National Accelerator Laboratory(SLAC国家加速器实验室)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一种安全、轻量、用户友好的自主代理AI框架,通过隔离执行环境、三层代理循环和自我评估do-until机制,实现科学任务的可靠自动化,减少人工干预。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12337 2026-04-15 cs.LG cs.CY 70%

Identifying and Mitigating Gender Cues in Academic Recommendation Letters: An Interpretability Case Study

识别和缓解学术推荐信中的性别线索:一个可解释性案例研究

Charlotte S. Alexander, Shane Storks, Souradip Pal, Sayak Chakrabarty, Arushi Sharma, Mlen-Too Wesley, Bailey Russo

机构 * Scheller College of Business(施谢尔商学院) Georgia Institute of Technology(佐治亚理工学院) Weinberg Institute for Cognitive Science(认知科学研究所) University of Michigan - Ann Arbor(密歇根大学安娜堡分校) School of Electrical and Computer Engineering(电气与计算机工程学院) Purdue University(普渡大学) Department of Computer Science(计算机科学系) Northwestern University(西北大学) Iowa State University(爱荷华州立大学) College of Computing(计算学院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本研究探讨Transformer编码器模型和大语言模型在去除姓名和代词后,能否从匿名推荐信中推断出申请人的性别,发现存在显著的性别泄露,并通过移除隐含性别线索降低模型准确性,但性别预测仍优于随机猜测。

Comments 17 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10834 2026-04-14 cs.SE cs.AI 70%

LLMs for Qualitative Data Analysis Fail on Security-specificComments in Human Experiments

大型语言模型在定性数据分析中对安全特定评论的处理失败

Maria Camporese, Fabio Massacci, Yuanjun Gong

机构 * University of Trento(特伦托大学) Vrije Universiteit Amsterdam(阿姆斯特丹自由大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文研究了大型语言模型在自动标注技术安全评论中的有效性,发现尽管模型在某些情况下表现提升,但无法可靠替代人工标注。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09037 2026-04-13 cs.CV cs.CL cs.HC 70%

SiMing-Bench: Evaluating Procedural Correctness from Continuous Interactions in Clinical Skill Videos

SiMing-Bench:从连续交互评估临床技能视频中的过程正确性

Xiyang Huang, Jiawei Lin, Keying Wu, Jiaxin Huang, Kailai Yang, Renxiong Wei, Cheng zeng, Jiayi Xiang, Ziyan Kuang, Min Peng, Qianqian Xie, Sophia Ananiadou

机构 * School of Artificial Intelligence, Wuhan University(武汉大学人工智能学院) Center for Language and Information Research, Wuhan University(武汉大学语言与信息研究中心) Southwest Jiaotong University(西南交通大学) MBZUAI(穆罕默德·本·扎耶德人工智能大学) The University of Manchester(曼彻斯特大学) Zhongnan Hospital of Wuhan University(武汉大学中南医院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 SiMing-Bench旨在评估多模态大语言模型在临床技能视频中通过连续交互更新过程状态的能力,通过医师标注的数据集和标准化评分标准,揭示模型在过程级判断上的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08296 2026-04-10 cs.AI 70%

Towards a Science of Scaling Agent Systems

迈向代理系统的科学:扩展性研究

Yubin Kim, Ken Gu, Chanwoo Park, Chunjong Park, Samuel Schmidgall, A. Ali Heydari, Yao Yan, Zhihan Zhang, Yuchen Zhuang, Yun Liu, Mark Malhotra, Paul Pu Liang, Hae Won Park, Yuzhe Yang, Xuhai Xu, Yilun Du, Shwetak Patel, Tim Althoff, Daniel McDuff, Xin Liu

机构 * Google Research(谷歌研究院) Massachusetts Institute of Technology(麻省理工学院) Google DeepMind(谷歌DeepMind)

专题命中 领域大模型 :LLM(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过260种配置评估六种代理基准,探讨代理系统在扩展维度上的性能变化规律,揭示协调、模型能力与任务结构之间的关系,发现协作成功取决于协调与任务结构的匹配程度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06279 2026-04-09 physics.plasm-ph cs.AI 70%

Plasma GraphRAG: Physics-Grounded Parameter Selection for Gyrokinetic Simulations

等离子体图RAG:用于磁流体动力学模拟的物理基础参数选择

Ruichen Zhang, Feda AlMuhisen, Chenguang Wan, Zhisong Qu, Kunpeng Li, Youngwoo Cho, Kyungtak Lim, Virginie Grandgirard, Xavier Garbet

机构 * Nanyang Technological University(南洋理工大学) CEA, IRFM(法国原子能委员会,磁聚变研究所) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院) School of Physical and Mathematical Sciences, Nanyang Technological University(南洋理工大学物理与数学科学学院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出Plasma GraphRAG,结合图检索增强生成与大语言模型,实现自动化、物理基础的参数范围识别,提升模拟可靠性并加速科学发现。

Comments 9 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06179 2026-04-09 cs.IR cs.CL 70%

ARIA: Adaptive Retrieval Intelligence Assistant -- A Multimodal RAG Framework for Domain-Specific Engineering Education

ARIA:自适应检索智能助手——面向领域特定工程教育的多模态RAG框架

Yue Luo, Dibakar Roy Sarkar, Rachel Herring Sangree, Somdatta Goswami

机构 * Dalian University of Technology(大连理工大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 ARIA通过多模态内容提取管道和e5-large-v2模型,实现领域特定工程教育的智能教学助手,展现高精度和教学一致性,验证了其在课程相关问题上的高准确率和响应质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06154 2026-04-08 cs.CL 70%

Exclusive Unlearning

排除性反学习

Mutsumi Sasaki, Kouta Nakayama, Yusuke Miyao, Yohei Oseki, Masaru Isonuma

机构 * Tohoku University(东北大学) NII LLMC(国立信息学研究所 LLMC) The University of Tokyo(东京大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出排除性反学习方法,通过广泛遗忘非目标知识以实现广泛危害消除,确保模型在多种输入下安全,同时保持对特定领域指令的响应能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05383 2026-04-08 cs.AI 70%

Towards Effective In-context Cross-domain Knowledge Transfer via Domain-invariant-neurons-based Retrieval

通过领域不变神经元的检索实现有效的跨领域知识转移

Jianzhi Yan, Zhiming Li, Le Liu, Zike Yuan, Shiwei Chen, Youcheng Pan, Buzhou Tang, Yang Xiang, Danny Dongning Sun

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) Pengcheng Laboratory, Shenzhen, China(鹏城实验室)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出领域不变神经元检索方法,用于提升大语言模型在跨领域推理中的性能,实验表明方法在数学和逻辑推理迁移中平均提升1.8。

Comments ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22653 2026-04-08 cs.AI 70%

URSA: The Universal Research and Scientific Agent

URSA:通用研究与科学代理

Michael Grosskopf, Nathan Debardeleben, Russell Bent, Rahul Somasundaram, Isaac Michaud, Arthur Lui, Alexius Wadell, Warren D. Graham, Golo A Wimmer, Sachin Shivakumar, Joan Vendrell Gallart, Harsha Nagarajan, Earl Lawrence

机构 * Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 URSA通过模块化代理和工具加速科研任务,结合先进物理模拟代码,解决复杂科学问题,展现系统潜力。

Comments 24 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04842 2026-04-07 cs.CL 70%

Do No Harm: Exposing Hidden Vulnerabilities of LLMs via Persona-based Client Simulation Attack in Psychological Counseling

勿伤人:通过基于人设的客户端模拟攻击暴露大语言模型的隐藏漏洞

Qingyang Xu, Yaling Shen, Stephanie Fong, Zimu Wang, Yiwen Jiang, Xiangyu Zhao, Jiahe Liu, Zhongxing Xu, Vincent Lee, Zongyuan Ge

机构 * Monash University(莫纳什大学) University of Liverpool(利物浦大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出基于人设的客户端模拟攻击框架PCSA,通过模拟心理辅导中的客户端对话,揭示大语言模型在心理安全对齐方面的漏洞,实验表明其在七个通用和心理健康专用LLM上表现优于其他基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04325 2026-04-07 cs.CL 70%

Benchmarking Multi-turn Medical Diagnosis: Hold, Lure, and Self-Correction

多轮医学诊断基准测试:Hold、Lure 和 Self-Correction

Jinrui Fang, Runhan Chen, Xu Yang, Jian Yu, Jiawei Xu, Ashwin Vinod, Wenqi Shi, Tianlong Chen, Heng Ji, ChengXiang Zhai, Ying Ding, Yuji Zhang

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) New York University(纽约大学) The University of Texas Southwestern Medical Center(德克萨斯大学西南医学中心) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文通过MINT基准测试揭示了大语言模型在多轮证据积累中的行为模式,发现提前回答、自我修正和强诱因影响诊断决策,提出延迟提问和保留关键证据可提升诊断准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.15284 2026-04-07 cs.CY cs.AI 70%

Beyond principlism: Practical strategies for ethical AI use in research practices

超越原则主义:科研实践中伦理AI使用的实用策略

Zhicheng Lin

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出以用户为中心、受现实启发的方法,解决AI伦理问题,提出五个具体目标,包括理解模型训练、尊重隐私、避免抄袭、有益应用AI以及透明可重复使用AI,并提出文档指南和培训计划以促进负责任的AI使用。

Comments Published in: AI and Ethics, 2025

Journal ref AI Ethics 5, 2719-2731 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03656 2026-04-07 cs.AI 70%

Beyond Retrieval: Modeling Confidence Decay and Deterministic Agentic Platforms in Generative Engine Optimization

超越检索:在生成引擎优化中建模置信度衰减与确定性代理平台

XinYu Zhao, ChengYou Li, XiangBao Meng, Kai Zhang, XiaoDong Liu

机构 * National University of Singapore(新加坡国立大学) Yishu Research(艺树研究) Fukuoka Institute of Technology(福冈工业大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出通过确定性多代理意图路由替代传统检索增强生成方法,建模置信度衰减并构建代理信任经纪生态系统,实验证明显著降低垂直任务幻觉率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03498 2026-04-07 cs.AI 70%

Resource-Conscious Modeling for Next- Day Discharge Prediction Using Clinical Notes

面向次日出院预测的资源感知建模

Ha Na Cho, Sairam Sutari, Alexander Lopez, Hansen Bow, Kai Zheng

机构 * University of California, Irvine, Donald Bren School of Information, Department of Informatics(加州大学尔湾分校,唐纳德·布伦信息与计算机科学学院,信息学系) University of California, Irvine, Department of Neurosurgery(加州大学尔湾分校,神经外科系)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文研究了轻量级微调大语言模型和传统文本模型在次日出院预测中的应用,发现TF-IDF与LGBM在平衡性上表现最佳,AUC-ROC达0.80,表明可解释性模型在临床任务中更具优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03173 2026-04-06 cs.CL 70%

Detecting and Correcting Reference Hallucinations in Commercial LLMs and Deep Research Agents

检测和纠正商业大语言模型和深度研究代理中的参考幻觉

Delip Rao, Eric Wong, Chris Callison-Burch

机构 * University of Pennsylvania(宾夕法尼亚大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究通过评估10种模型和代理在DRBench和ExpertQA上的引用URL可靠性,发现3-13%的URL存在幻觉,5-18%无法解析。提出urlhealth工具可有效减少非解析URL,验证引用URL的有效性与可纠正性。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02543 2026-04-06 cs.CV cs.LG 70%

Overconfidence and Calibration in Medical VQA: Empirical Findings and Hallucination-Aware Mitigation

过度自信与校准在医学视觉问答中的研究:实证发现与幻觉意识缓解

Ji Young Byun, Young-Jin Park, Jean-Philippe Corbeil, Asma Ben Abacha

机构 * Johns Hopkins University, School of Medicine(约翰霍普金斯大学医学院) Massachusetts Institute of Technology(麻省理工学院) Microsoft Healthcare & Life Sciences(微软医疗健康与生命科学)

专题命中 领域大模型 :language model(abstract);prompting(abstract);分类 cs.LG

AI总结 本文研究了医学VQA中VLMs的过度自信问题,发现校准方法如Platt缩放能有效提升校准精度,但无法提升预测区分度,提出幻觉意识校准方法以提高可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22732 2026-04-03 cs.IR cs.LG 70%

Generative Recommendation for Large-Scale Advertising

大规模广告中的生成推荐

Ben Xue, Dan Liu, Lixiang Wang, Mingjie Sun, Peng Wang, Pengfei Zhang, Shaoyun Shi, Tianyu Xu, Yunhao Sha, Zhiqiang Liu, Bo Kong, Bo Wang, Hang Yang, Jieting Xue, Junhao Wang, Shengyu Wang, Shuping Hui, Wencai Ye, Xiao Lin, Yongzhi Li, Yuhang Chen, Zhihui Yin, Quan Chen, Shiyang Wen, Wenjin Wu, Han Li, Guorui Zhou, Changcheng Li, Peng Jiang, Kun Gai

机构 * Kuaishou Technology(快手科技)

专题命中 领域大模型 :LLM(abstract);preference optimization(abstract);分类 cs.LG

AI总结 GR4AD通过统一广告语义ID和LazyAR解码器提升生成推荐效率,结合价值感知学习优化广告收益,实现大规模广告系统4.2%的收益提升。

Comments 13 pages, 6 figures, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22294 2026-04-03 cs.CV cs.LG 70%

Structure is Supervision: Multiview Masked Autoencoders for Radiology

结构是监督:用于放射学的多视图掩码自编码器

Sonia Laguna, Andrea Agostini, Alain Ryser, Samuel Ruiperez-Campillo, Irene Cannistraci, Moritz Vandenhirtz, Stephan Mandt, Nicolas Deperrois, Farhad Nooralahzadeh, Michael Krauthammer, Thomas M. Sutter, Julia E. Vogt

机构 * Department of Computer Science, ETH Zurich(苏黎世联邦理工学院计算机科学系) Department of Computer Science, UC Irvine(加州大学尔湾分校计算机科学系) Department of Quantitative Biomedicine, University of Zurich(苏黎世大学定量生物医学系)

专题命中 领域大模型 :foundation model(abstract);pretraining(abstract);分类 cs.LG

AI总结 本文提出多视图掩码自编码器(MVMAE),通过利用放射学研究的多视图结构学习视图不变和疾病相关表征,并在三个公开数据集上验证了其在疾病分类任务中的优越性能。

Journal ref Transactions on Machine Learning Research (TMLR) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07194 2026-04-03 cs.AI 70%

Exploring Effective Strategies for Building a User-Configured GPT for Coding Classroom Dialogues

探索构建用户配置的GPT用于编码课堂对话的有效策略

Luwei Bai, Dongkeun Han, Sara Hennessy

机构 * Faculty of Education, University of Cambridge(剑桥大学教育学院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文探讨了构建定制GPT用于编码课堂对话的有效策略,通过MyGPT系统评估其在有限数据下的表现,提出基于其独特功能的实用策略,以生成编码建议。

Comments Draft technical report. 39 pages, 2 figures. Not yet submitted for publication. Update expected

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00550 2026-04-02 cs.AI 70%

BloClaw: An Omniscient, Multi-Modal Agentic Workspace for Next-Generation Scientific Discovery

BloClaw:面向下一代科学发现的全能多模态智能工作空间

Yao Qin, Yangyang Yan, Jinhua Pang, Xiaoming Zhang

机构 * AI Innovation Department, Beijing 1st Biotech Group Co., Ltd.(北京第一生物技术集团有限公司AI创新部) Diplomatic Negotiation Simulation and Data Lab(外交谈判模拟与数据实验室) First Medical Center, Chinese PLA General Hospital(中国人民解放军总医院第一医学中心)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出BloClaw,一种多模态操作系统,通过XML-Regex路由协议、运行时状态拦截沙箱和状态驱动动态视口UI三大创新,提升科学计算助手的鲁棒性和自适应能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29366 2026-04-01 cs.AI 70%

AI-Generated Prior Authorization Letters: Strong Clinical Content, Weak Administrative Scaffolding

人工智能生成的预先授权信:强大的临床内容,薄弱的行政框架

Moiz Sadiq Awan, Maryam Raza

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究评估了三种LLM在45个合成场景中生成的预先授权信,发现其临床内容扎实但行政要求方面存在不足,提示需加强行政精度。

Comments 11 pages, 5 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28361 2026-03-31 cs.AI cs.MA 70%

Deep Research of Deep Research: From Transformer to Agent, From AI to AI for Science

深度研究的深度研究:从Transformer到代理,从AI到AI为科学

Yipeng Yu

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文探讨深度研究的定义与发展方向,整合行业深度研究与AI为科学的视角,提出生成式AI的双支柱,并讨论AI4S在各学科的进展及挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏