arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12597 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12597 篇

2606.06003 2026-06-05 cs.AI 81%

Beyond Vector Similarity: A Structural Analysis of Graph-Augmented Retrieval for Industrial Knowledge Graphs

超越向量相似性:面向工业知识图谱的图增强检索结构分析

Grama Chethan

机构 * Grama Chethan

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 本文通过对比八种检索架构,提出操作符词汇表论点,证明基于LLM的图推理瓶颈在于计算操作符而非模型智能,并引入LLM查询规划器,在工业知识图谱上实现优于定制处理器的性能。

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05535 2026-06-05 cs.CV cs.AI 81%

Noise-Aware Visual Representation Learning for Medical Visual Question Answering

面向医学视觉问答的噪声感知视觉表示学习

I Putu Adi Pratama, Bahadorreza Ofoghi, Atul Sajjanhar, Shang Gao

机构 * Deakin University(德克萨斯大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出一种噪声感知的医学视觉问答框架,通过去噪自编码器学习鲁棒的视觉表示,并利用低秩适配高效微调,在SLAKE和PathVQA基准上提升了抗噪性和性能。

Comments 15 pages, 2 figures. Conference submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05002 2026-06-04 cs.CL 81%

GARL: Game-Theoretic Reinforcement Learning for Multi-Agent Strategic Prioritisation

GARL:面向多智能体战略优先级排序的博弈论强化学习

Yuxiao Ye, Yiwen Zhang, Huiyuan Xie, Yuqin Huang, Zhiyuan Liu

机构 * Tsinghua University(清华大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.CL

AI总结 提出GARL框架,将多智能体战略优先级排序形式化为两阶段博弈,通过博弈论效用转化为角色特定强化信号,优化交互策略,在争议问题排序任务中提升性能并使小型开源LLM与强闭源LLM竞争。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04952 2026-06-04 cs.HC cs.CL 81%

Clinical Assistant for Remote Engagement Link (CARE-link): A Web-Based Electronic Health Records Software for Managing Diabetes

临床远程参与助手(CARE-link):一种用于管理糖尿病的基于网络的电子健康记录软件

Prince Ebenezer Adjei, Joshua Teye Tettey, Toufiq Musah, Audrey Agbeve, John Amuasi

机构 * Global One Health Research Group, Bernhard Nocht Institute of Tropical Medicine(全球健康研究组,伯恩哈德-诺克特热带医学研究所) Global Health and Infectious Diseases Research Group, Kumasi Centre for Collaborative Research in Tropical Medicine(全球健康与传染病研究组,库马西协作热带医学研究中心) Department of Computer Engineering, Kwame Nkrumah University of Science and Technology(计算机工程系,库马西大学科学与技术学院) Department of Global Health, School of Public Health, Kwame Nkrumah University of Science and Technology(全球健康系,公共卫生学院,库马西大学科学与技术学院)

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.CL

AI总结 CARE-link是一个开源、基于网络的临床支持平台,通过LLM介导的工作流程连接临床医生和患者,用于改善妊娠期糖尿病管理,系统汇总院外患者生成数据、提供临床决策支持,并通过WhatsApp界面为患者提供管理计划解释和生活方式指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04909 2026-06-04 cs.IR cs.CL 81%

BEATS: Bootstrapping E-commerce Attribute Taxonomies for Search through Iterative Human-AI Collaboration

BEATS: 通过迭代人机协作引导电商搜索属性分类

Yung-Yu Shih, Shang-Yu Su, Tzu-I Ho, Dongzhe Wang, Yun-Nung Chen

机构 * National Taiwan University(国立台湾大学) Rakuten Group, Inc.(拉肯集团) Taiwan Rakuten Ichiba, Inc.(台湾拉肯Ichiba公司) Rakuten Asia Pte. Ltd.(拉肯亚洲有限公司)

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.CL

AI总结 针对新兴市场电商平台缺乏结构化属性模式的问题,提出BEATS框架,利用人机协作的LLM流水线从零构建产品属性分类,并通过属性标注提升搜索系统性能。

Comments 6 pages, 1 figure, 5 tables. Accepted to SIGIR 2026 Industry Track. Official version: https://doi.org/10.1145/3805712.3808520

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03763 2026-06-03 econ.GN cs.AI q-fin.EC 81%

Merit or networks? What decides where research is published

功绩还是关系网?什么决定了研究成果的发表地点

Ning Li

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 利用经济学工作论文数据,通过LLM评估论文思想质量,结合执行质量、关系网络、作者能力和语言模型文本得分,构建五因素生产函数,揭示发表过程中功绩与关系的作用机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00370 2026-06-02 cs.HC cs.AI 81%

Agentic Authoring of Interactive Multiview Visualizations in Genomics

交互式多视图基因组学可视化的智能体创作

Astrid van den Brandt, Kiroong Choe, Sehi L'Yi, Devin Lange, Nils Gehlenborg

机构 * Harvard Medical School(哈佛医学院) Boston College(波士顿学院)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对基因组学可视化创作中定制化不足和编程门槛高的问题,提出基于大语言模型的智能体方案,通过结构化输出和迭代优化提升可视化质量。

Comments 11 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00087 2026-06-02 cs.CV cs.AI 81%

Structured Visual Evidence Decomposition for Evidence-Grounded Multimodal Screening of Obstructive Sleep Apnea-Hypopnea Syndrome

结构化视觉证据分解用于阻塞性睡眠呼吸暂停低通气综合征的证据驱动多模态筛查

Chen Zhan, Yingchen Wei, Xiaoyu Tan, Jingjing Huang, Xihe Qiu

机构 * School of Electronic and Electrical Engineering, Shanghai University of Engineering Science(上海工程技术大学电子与电气工程学院) Tencent Youtu Lab(腾讯云视频实验室) ENT Institute and Department of Otorhinolaryngology, Eye & ENT Hospital of Fudan University(复旦大学耳鼻喉科医院耳鼻喉科研究所) National University of Singapore(新加坡国立大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);foundation model(abstract);prompting(abstract)

AI总结 提出EviOSAHS框架,通过将面部图像分解为七个解剖查询并生成结构化证据卡,结合临床信息进行高灵敏度OSAHS筛查。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26305 2026-06-02 cs.AI cs.SY eess.SY hep-ph 81%

Experiments in Agentic AI for Science

科学领域中的自主AI代理实验

Judy Fox, Geoffrey Fox

机构 * School of Data Science, Department of Computer Science, and Biocomplexity Institute, University of Virginia(数据科学学院、计算机科学系和生物复杂性研究所,弗吉尼亚大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出两种基于本地体-远程脑架构的自主AI代理框架,通过系统工程技术克服上下文和推理限制,分别用于时间序列数据集的大规模自动整理和物理讲座的结构化报告生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23593 2026-06-02 cs.AI 81%

When AI reviews science: Can we trust the referee?

当AI评审科学:我们能信任审稿人吗?

Jialiang Wang, Yuchen Liu, Hang Xu, Kaichun Hu, Shimin Di, Wangze Ni, Linan Yue, Min-Ling Zhang, Kui Ren, Lei Chen

机构 * School of Electronic Engineering, Southeast University(东南大学电子工程学院) Zhejiang University(浙江大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对AI审稿的安全性和可靠性问题,本文通过分类攻击类型并实验验证声望框架、断言强度、反驳谄媚和上下文投毒对评分的影响,为评估AI同行评审的可靠性提供基线。

Journal ref The Innovation Informatics 2:100030 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01800 2026-06-02 cs.AI 81%

REBot: From RAG to CatRAG with Semantic Enrichment and Graph Routing

REBot: 从RAG到CatRAG——语义增强与图路由

Thanh Ma, Tri-Tam La, Lam-Thu Le Huu, Minh-Nghi Nguyen, Khanh-Van Pham Luu

机构 * CTU(越南科技大学)

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 提出REBot,一种基于CatRAG混合检索推理框架的LLM增强咨询聊天机器人,通过语义增强的分层类别知识图谱和图路由实现学术法规建议,在分类和问答任务上达到98.89%的F1分数。

Comments Published in Communications in Computer and Information Science (CCIS), Springer, 2025. DOI: 10.1007/978-981-95-4960-3_35

Journal ref Communications in Computer and Information Science (CCIS), Springer, 2025, pp. 435-447

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29786 2026-05-29 cs.AI 81%

Croissant Tasks: A Metadata Format for Reproducible Machine Learning Evaluations

Croissant Tasks:一种用于可重复机器学习评估的元数据格式

Omar Benjelloun, Leonardo Martins Bianco, Isabelle Guyon, Thanh Gia Hieu Khuong, Jonathan Lebensold, Sebastian Lobentanzer, Luis Oala, Benedictus Kent Rachmat, Ihsan Ullah, Peyman Vahidi, Joaquin Vanschoren

机构 * Google DeepMind(谷歌DeepMind) ChaLearn Université Paris-Saclay(巴黎-萨克雷大学) Jetty Mila, Quebec AI Institute(魁北克AI研究所) Inst. of Computational Biology, Helmholtz Munich(海德堡慕尼黑计算生物学研究所) German Center for Diabetes Research(德国糖尿病研究中心) School of CIT, TUM(技术大学 CIT 学校) Helmholtz AI(海德堡人工智能研究所) Brickroad Eindhoven Univ. of Technology(埃因霍温技术大学)

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 提出Croissant Tasks元数据格式,通过声明式规范解耦任务问题与解决方案,结合自动化LLM管道实现概念可重复性,使自主代理能从零生成可复现的评估流水线。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.10332 2026-05-29 cs.CY cs.AI 81%

Agent4Edu: Generating Learner Response Data by Generative Agents for Intelligent Education Systems

Agent4Edu:通过生成式智能体为智能教育系统生成学习者响应数据

Weibo Gao, Qi Liu, Linan Yue, Fangzhou Yao, Rui Lv, Zheng Zhang, Hao Wang, Zhenya Huang

机构 * State Key Laboratory of Cognitive Intelligence(认知智能国家重点实验室) University of Science and Technology of China(中国科学技术大学) Institute of Artificial Intelligence(人工智能研究院) Hefei Comprehensive National Science Center(合肥综合性国家科学中心)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出Agent4Edu,一种利用大语言模型构建生成式智能体模拟学习者行为,以解决智能教育系统中离线指标与在线性能差异的问题,并支持个性化学习算法评估与优化。

Comments Accepted by AAAI2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28843 2026-05-29 cs.DL cs.CY cs.LG 81%

The Biosecurity Blind Spot: Systematic Dual-use Detection in Open Science Infrastructure

生物安全盲点:开放科学基础设施中的系统性双重用途检测

Vasudha Sharma, Chakresh Kumar Singh, Jayesh Choudhari, Dharmit Nakrani

机构 * LophiLabs

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本研究通过混合词法过滤和大语言模型评估,系统分析了bioRxiv预印本中双重用途研究关注内容,揭示了开放获取摘要中普遍存在的潜在风险,并提出了结合元数据监控与开放科学原则的治理框架。

Comments Ongoing work

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27610 2026-05-28 cs.IR cs.AI cs.HC 81%

Eliot: Interactively $\underline{E}$xploring Fast-Changing Scientific $\underline{Li}$terature Trends with $\underline{O}$nline Da$\underline{t}$a and Learning

Eliot: 通过在线数据和学习交互式探索快速变化的科学文献趋势

Bernardo A. Denkvitts, Nitin Gupta, Biplav Srivastava

机构 * University of South Carolina(南卡罗来纳大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出Eliot系统,通过查询时聚类和时间可视化,帮助研究人员可追溯地探索快速变化的科学文献趋势。

Comments Under-review at CIKM Applied Research 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06054 2026-05-28 cs.CL 81%

Are We Truly Innovating? A Qualitative and Quantitative Study of Originality in AI Research Papers

我们真的在创新吗?AI研究论文原创性的定性与定量研究

Abeer Mostafa, Thi Huyen Nguyen, Zahra Ahmadi

机构 * Peter L. Reichertz Institute for Medical Informatics(汉诺威医学院彼得·L·里赫茨医学信息学研究所) L3S Research Center(L3S研究中心) Lower Saxony Center for Artificial Intelligence and Causal Methods in Medicine (CAIMed)(下萨克森人工智能与医学因果方法中心(CAIMed))

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 基于10万+同行评审报告,通过定性与定量方法分析AI研究论文原创性的感知维度,并评估大语言模型在原创性评估中的可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09544 2026-05-27 cs.CL 81%

MetaGraph: A Large-Scale Meta-Analysis of GenAI in Financial NLP (2022-2025)

MetaGraph:金融NLP中GenAI的大规模元分析(2022-2025)

Paolo Pedinotti, Peter Baumann, Nathan Jessurun, Leslie Barrett, Enrico Santus

机构 * Bloomberg(贝莱德)

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.CL

AI总结 提出MetaGraph方法,利用本体引导的LLM从科学语料中提取类型化知识图谱,对681篇GenAI在金融领域的论文进行结构化趋势分析,揭示了三个阶段:早期LLM驱动的任务和数据集扩展、对局限性和风险的日益关注、以及向模块化系统导向方法的转变。

Comments 8 pages, appendices, GEM, ACL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03771 2026-05-27 cs.CY cs.AI 81%

Trustworthiness of Legal Considerations for the Use of LLMs in Education

LLM在教育中使用的法律考量可信度

Sara Alaswad, Tatiana Kalganova, Wasan Awad

机构 * College of Information Technology(信息科技学院) Brunel University of London(伦敦布鲁内尔大学) Ahlia University(阿利亚大学)

专题命中 领域大模型 :LLM(title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过比较全球主要地区(欧盟、英国、美国、中国、海湾合作委员会国家)的AI监管框架,提出针对海湾合作委员会国家的合规中心AI治理框架,以促进教育中AI系统的合法、伦理和文化适应性部署。

Comments 11 pages, 3 figures, 6 tables

Journal ref Proc. IEEE DASA 2025, Manama, Bahrain, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26087 2026-05-26 stat.ML cs.LG 81%

DiscoverPhysics: Benchmarking LLMs for Out-of-the-Box Scientific Thinking

DiscoverPhysics: 基准测试LLMs的即用型科学思维

Matt L. Wiemann, Lindsay M. Smith, Peter Melchior, Siddharth Mishra-Sharma, Andrew Gordon Wilson, Pavel Izmailov, Carolina Cuesta-Lázaro

机构 * Princeton University(普林斯顿大学) Boston University(波士顿大学) New York University(纽约大学) Flatiron Institute(Flatiron研究所) Institute for Advanced Studies(高级研究研究所)

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.LG

AI总结 提出DiscoverPhysics交互式基准,通过让LLM代理探索物理定律偏离现实的模拟世界,评估其设计实验、修正假设和发现物理规律的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25489 2026-05-26 cs.AI cs.HC 81%

ATWL: A Formal Language for Representing, Comparing, and Reusing Visual Analytics Workflows

ATWL:一种用于表示、比较和重用可视化分析工作流的正式语言

Natalia Andrienko, Gennady Andrienko, Jürgen Bernard, Michael Sedlmair

机构 * Fraunhofer Institute IAIS(弗劳恩霍夫研究所IAIS) Lamarr Institute for Machine Learning and Artificial Intelligence(拉马尔机器学习与人工智能研究所) City St George’s, University of London(伦敦大学城市圣乔治学院) University of Zurich(苏黎世大学) University of Stuttgart(斯图加特大学)

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 提出ATWL语言,通过模块化本体和标准化意图形式化表示可视化分析工作流,结合LLM提取工作流,实现结构比较和重用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25101 2026-05-26 cs.SE cs.AI cs.SY eess.SY 81%

Multi-Agent Specification-based Metamorphic Testing of FMU-Based Simulations

基于多智能体规范的FMU仿真蜕变测试

Ashir Kulshreshtha, Abdullah Mughees, Gaadha Sudheerbabu, Tanwir Ahmad, Kristian Klemets, Dragos Truscan, Mikael Manngård

机构 * University of Turku, Finland(图尔库大学,芬兰) Novia University of Applied Sciences, Finland(诺维亚应用科学大学,芬兰)

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 针对FMU仿真模型中缺乏显式预期输出导致传统测试方法受限的问题,提出一种基于LLM的多智能体工作流,从规范和接口中自动提取蜕变关系并生成测试用例,在润滑油冷却系统FMU上验证了其有效性。

Comments Author version. 9 pages. Accepted for publication in the 10th International Workshop on Metamorphic Testing (MET 2026) of the IEEE Conference on Computers, Software, and Applications (COMPSAC2026), June 7-10, 2026 Madrid, Spain

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24180 2026-05-26 physics.soc-ph cs.AI cs.DL cs.HC 81%

Human-AI Collaboration in Science at Scale: A Global Large-scale Randomized Field Experiment

大规模人机协作科学:一项全球大规模随机现场实验

Binglu Wang, Weixin Liang, Jiahui Xue, Yuhui Zhang, Hancheng Cao, Dashun Wang, Yian Yin

机构 * Kellogg School of Management, Northwestern University(西北大学凯洛格管理学院) Center for Science of Science and Innovation, Northwestern University(西北大学科学与创新中心) Northwestern Institute on Complex Systems, Northwestern University(西北大学复杂系统研究所) Department of Computer Science, Stanford University(斯坦福大学计算机科学系) Goizueta Business School, Emory University(埃默里大学戈伊兹特亚商学院) Department of Information Science, Cornell University(康奈尔大学信息科学系)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 通过全球大规模随机现场实验,研究大型语言模型(LLMs)生成的定制化反馈能否提升科研人员的修订率并促进AI工具使用,尤其惠及资源受限的研究者。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24018 2026-05-26 cs.AI cs.MA 81%

EvoSci: A Bio-Inspired Multi-Agent Framework for the Evolution of Scientific Discovery

EvoSci: 一种受生物启发的多智能体框架用于科学发现的演化

Xiaoyu Xiong, Yuqi Ren, Deyi Xiong

机构 * TJUNLP Lab, School of Computer Science and Technology, Tianjin University, China(天津大学计算机科学与技术学院 TJUNLP 实验室)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出EvoSci框架,结合生物启发式演化与知识图谱建模,通过多角色智能体协作迭代生成、评估和优化研究想法,显著提升科学探索的连贯性和创造力。

Comments ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18850 2026-05-20 cs.IR cs.AI 81%

KadiAssistant: A conversational AI Agent for information retrieval in Kadi4Mat

KadiAssistant: 一种用于Kadi4Mat研究数据生态中信息检索的对话式AI代理

Adrian Cierpka, Mohammad Shafiqul Islam, Johannes Steinhülb, Eric Dietriche Sesso Domtchoueng, Michael Selzer, Arnd Koeppe

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出KadiAssistant,一种集成了隐私设计的AI助手,旨在帮助研究人员高效访问、聚合和整合异构且敏感的研究数据,通过结合自托管的大语言模型和隐私保护的语义搜索,提升信息检索效率并满足复杂的访问控制需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18831 2026-05-20 q-bio.QM cs.LG 81%

Towards Discovery of Polymers for Insulin Delivery via Physics-Grounded Agentic Workflows

通过物理基础的代理工作流发现胰岛素输送聚合物

Martins Otun

机构 * Algonix AI Ltd.(Algonix AI有限公司)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出了一种基于物理的代理工作流方法,用于发现胰岛素输送的聚合物,通过大规模语言模型和物理工具的结合,在有限预算内高效搜索离散的PSMILES空间,实现了优于强化学习和贝叶斯优化的胰岛素-聚合物相互作用能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18765 2026-05-20 cs.IR cs.AI 81%

STAR: Semantic-Tuned and Tail-Adaptive Retriever for Graph-Augmented Generation

STAR:用于图增强生成的语义调优和尾部适应检索器

Shuai Li, Chen Huang, Duanyu Feng, Wenqiang Lei, See-Kiong Ng

机构 * Shuai Li, Chen Huang, Duanyu Feng, Wenqiang Lei, See-Kiong Ng

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出STAR,一种用于图增强生成的语义调优和尾部适应检索器,通过结合token级交互学习和路径加权对比学习,解决图检索增强生成中的语义捷径偏差和长尾路径偏差问题,提升检索和生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17976 2026-05-19 cs.AI math.OC 81%

Unleashing LLMs in Bayesian Optimization: Preference-Guided Framework for Scientific Discovery

释放大语言模型于贝叶斯优化:用于科学发现的偏好引导框架

Xinzhe Yuan, Zhuo Chen, Jianshu Zhang, Huan Xiong, Nanyang Ye, Yuqiang Li, Qinying Gu

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Harbin Institute of Technology(哈尔滨工业大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出了一种基于大语言模型的贝叶斯优化框架LGBO,通过在优化循环中持续整合大语言模型的语义推理,提高了科学发现中的优化效率和收敛速度。

Comments Published as a conference paper at ICLR 2026. 10 pages main paper, 21 pages appendix, 26 figures

Journal ref International Conference on Learning Representations (ICLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04070 2026-05-19 cs.CL 81%

T-FIX: Text-Based Explanations with Features Interpretable to eXperts

T-FIX:基于文本的可解释性方法,具备可解释的专家特征

Shreya Havaldar, Weiqiu You, Chaehyeon Kim, Anton Xue, Helen Jin, Marco Gatti, Bhuvnesh Jain, Helen Qu, Amin Madani, Daniel A. Hashimoto, Gary E. Weissman, Rajat Deo, Sameed Khatana, Lyle Ungar, Eric Wong

机构 * Department of Computer and Information Science, University of Pennsylvania(宾夕法尼亚大学计算机与信息科学系) Department of Computer Science, University of Texas at Austin(德克萨斯大学奥斯汀分校计算机科学系) Department of Physics and Astronomy, University of Pennsylvania(宾夕法尼亚大学物理与天文学系) Flatiron Institute(Flatiron研究所) Department of Surgery, Perelman School of Medicine, University of Pennsylvania(宾夕法尼亚大学佩雷尔曼医学院外科系) Division of Pulmonary, Allergy, and Critical Care, Perelman School of Medicine, University of Pennsylvania(宾夕菲亚大学佩雷尔曼医学院呼吸、过敏与危重医学科) Division of Cardiovascular Medicine, Perelman School of Medicine, University of Pennsylvania(宾夕法尼亚大学佩雷尔曼医学院心血管医学科) Department of Surgery, University of Toronto(多伦多大学外科系) University Health Network(大学健康网络)

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.CL

AI总结 本文提出T-FIX框架,用于评估LLM生成的解释是否符合专家的推理方式,通过七个科学任务和三个领域进行验证,实现了自动且可定制的专家对齐评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23986 2026-05-19 cs.AI 81%

TusoAI: Agentic Optimization for Scientific Methods

TusoAI: 科学方法的代理优化

Alistair Turcan, Kexin Huang, Lei Li, Martin Jinye Zhang

机构 * Carnegie Mellon University(卡内基梅隆大学) Stanford University(斯坦福大学) Phylo

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 TusoAI通过整合领域知识和迭代优化,提升科学任务中计算方法的性能,优于现有专家方法和科学AI代理,在单细胞RNA测序数据去噪和卫星地球监测等任务中表现突出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16605 2026-05-19 cs.HC cs.AI 81%

PromptDecipher: Supporting AI Tutor Authoring Through Editable Simulated Interactions

PromptDecipher:通过可编辑的模拟交互支持AI辅导作者

Miina Koyama, Ruiwei Xiao, John Stamper

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 领域大模型 :prompting(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 PromptDecipher通过直接纠正交互重构作者流程,帮助教师成为学习设计师和QA工程师,提升AI辅导作者的质量与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏