arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-08-04 至 2026-08-04 共收录 713 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 48 篇

2608.01686 2026-08-04 cs.CV 新提交 85%

Generative AI and Foundation Models in Medical Image

医学影像中的生成式AI与基础模型

Masahiro Oda

机构 * Nagoya University(名古屋大学) Graduate School of Informatics, Nagoya University(名古屋大学信息学研究科)

专题命中 领域大模型 :foundation model(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文概述生成式AI相关的扩散模型、LLMs及基础模型,介绍其在医疗辅助中的应用,探讨基础模型的构建方法与医疗应用,并研究利用国家资源开发医疗辅助AI的路径。

Comments Review Article

Journal ref Radiological Physics and Technology, vol.18, pp.937-948, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00976 2026-08-04 cs.CV 新提交 85%

Location-Aware Fine-Grained Representation Learning for Medical Vision Foundation Models

面向医学视觉基础模型的位置感知细粒度表示学习

Myeongkyun Kang, Yanting Yang, Xiaoxiao Li

机构 * The University of British Columbia(不列颠哥伦比亚大学) Vector Institute(矢量研究所)

专题命中 领域大模型 :foundation model(title,abstract);large language model(abstract);language model(abstract)

AI总结 本研究提出基于位置感知细粒度表示学习的医学视觉基础模型LoFi,构建大规模医学定位数据集MedG,在多项医学视觉任务中性能优于现有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15631 2026-08-04 cs.HC cs.SE 版本更新 80%

Meflex: A Multi-agent Scaffolding System for Entrepreneurial Ideation Iteration via Nonlinear Business Plan Writing

Meflex:一种基于非线性商业计划写作的多智能体支架系统,用于创业构想迭代

Lan Luo, Dongyijie Primo Pan, Junhua Zhu, Muzhi Zhou, Pan Hui

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 Meflex通过非线性商业计划写作支架系统,支持创业构想的迭代发展,提升反思与元反思能力,降低认知负担。

Comments In Proceedings of The First Reflection in Creative Experience (RiCE) Workshop (RiCE W1) arXiv:2607.24558

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01725 2026-08-04 cs.NI cs.LG 新提交 79%

CENTILE: A Telemetry Foundation Model Evaluated by the Decisions It Drives

CENTILE:一种由其驱动的决策评估的遥测基础模型

Zifan Zhang, Zhichao Hou, Tingxiang Ji, Yuchen Liu

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.LG

AI总结 提出的\textbf{\textsc{Centile}}是首个经重放评估可改善HPC调度与网络配置决策的预训练遥测基础模型,可降低HPC回填平均有界减速约77%、违规率减半。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01361 2026-08-04 cs.AI 新提交 79%

High-Stakes Decisions with Language Models: Insights from Emergency Triage

基于语言模型的高风险决策:来自急诊分诊的见解

Khurram Yamin, Christopher Kelly, Bryan Wilder, Eric Horvitz

机构 * Microsoft(微软) Carnegie Mellon University(卡内基梅隆大学)

专题命中 领域大模型 :language model(title,abstract);分类 cs.AI

AI总结 本研究以急诊分诊为案例,将语言模型的高风险决策置于概率决策框架内,发现语言模型可根据效用调整建议,强调高风险场景下需将其作为概率决策系统评估。

Comments 29 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00932 2026-08-04 cs.CL 新提交 79%

Gaokerena: A Small Persian Medical Language Model Family

Gaokerena:一个小型波斯语医疗语言模型家族

Mehrdad Ghassabi, Hamidreza Baradaran Kashani, Pedram Rostami, Sadra Hakim, Zahra Kazemi, Audrina Ebrahimi

机构 * University of Isfahan(伊斯法罕大学) University of Tehran(德黑兰大学) University of Windsor(温莎大学) Alzahra University(阿勒扎哈拉大学) University of Texas at Dallas(德克萨斯大学达拉斯分校)

专题命中 领域大模型 :language model(title,abstract);分类 cs.CL

AI总结 针对波斯语医疗语言模型研究不足的问题,该研究推出Gaokerena家族,包含Gaokerena-V和Gaokerena-R两款模型,在医疗问答基准上取得性能提升,还配备不确定性头,为本地化数字医疗提供基础但仍需完善。

Comments 29 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00071 2026-08-04 cs.CV cs.AI 新提交 79%

Empirical investigation of 3D CT Foundation Models and Unsupervised Adaptation for Head and Neck Cancer Recurrence Prediction

3D CT 基础模型与无监督适应用于头颈癌复发预测的实证研究

Bilel Guetarni, Feryal Windal, David Pasquier, Halim Benhabiles

机构 * University of Lille(里尔大学) Academic Department of Radiation Oncology, Centre Oscar Lambret(奥斯卡·兰布雷特中心放射肿瘤学学术部) Junia(朱尼亚学院) Centrale Lille(里尔中央理工学院) IMT Nord Europe, Institut Mines-Télécom(北欧电信学院、矿业电信学院)

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.AI

AI总结 该研究通过两个含 3644 名患者的公开数据集,实证评估 3D CT 基础模型用于头颈癌复发预测的泛化能力,发现其跨场景泛化困难,影像与临床数据结合的预后方法最准确。

Comments Accepted at AIiH 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15249 2026-08-04 cs.CV cs.AI 79%

Intersectional Fairness in Vision-Language Models for Medical Image Disease Classification

视觉-语言模型在医学影像疾病分类中的交叉公平性

Yupeng Zhang, Adam G. Dunn, Usman Naseem, Jinman Kim

机构 * Biomedical Data Analysis and Visualisation (BDAV) Lab, School of Computer Science(生物医学数据分析与可视化实验室,计算机科学学院) Sydney School of Public Health(悉尼公共卫生学院) School of Computing(计算学院)

专题命中 领域大模型 :language model(title,abstract);分类 cs.AI

AI总结 本文提出CMAC-MMD框架,通过标准化交叉亚组的诊断确定性,减少医学影像疾病分类中的交叉偏见,提升诊断准确性和公平性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01711 2026-08-04 cs.AI 新提交 77%

Constructing Executable Analytical Knowledge Representations for Meta-Analysis Synthesis Using an Agentic Harness

使用智能体管控系统构建用于元分析综合的可执行分析知识表示

Lingbo Li, Anuradha Mathrani, Teo Susnjak

机构 * School of Mathematical and Computational Sciences(数学与计算科学学院) Massey University(梅西大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究提出EAKR,在智能体管控系统MetaSynDec中实施后,可高效构建元分析所需的可执行分析知识表示,其性能优于直接大型语言模型生成,验证了相关方法的可行性与优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29007 2026-08-04 q-bio.QM 版本更新 75%

EasyBCI Agent: Towards Universal Neural Data Preprocessing for Brain-Computer Interfaces

EasyBCI Agent:面向脑机接口的通用神经数据预处理

Yu Zhu, Runkai Zhao, Zhimin Zhou, Jinyu Cai, Zhouheng Yao, Chutian Zhang, Peiyuan Li, Xiaoxing Zhang, Qihao Zheng, Jiamin Wu, Mianxin Liu, Chi Zhang, Bin Min, Lei Bai, Chengyu Li, Jingpeng Wu, Chunfeng Song

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 EasyBCI是两阶段大语言模型智能体,可针对六种信号类型规划执行脑机接口预处理,经评估其在EEG任务中表现优于人工流程及通用编码智能体,可扩展至多模态并提升可复现性。

Comments 15 pages, 6 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07107 2026-08-04 cs.AI cs.CL 版本更新 73%

MENTOR: A Metacognition-Driven Self-Evolution Framework for Uncovering and Mitigating Implicit Domain Risks in LLMs

MENTOR: 一种元认知驱动的自我进化框架,用于发现和缓解大语言模型中的隐式领域风险

Liang Shan, Kaicheng Shen, Wen Wu, Zhenyu Ying, Chaochao Lu, Yan Teng, Jingqi Huang, Qingshan Liu, Guangze Ye, Guoqing Wang, Jie Zhou, Liang He

机构 * School of Computer Science and Technology, East China Normal University(东华大学计算机科学与技术学院) Shanghai AI Lab, Shanghai Innovation Institute(上海人工智能实验室,上海创新研究院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 针对大语言模型在特定领域(如教育、金融、管理)中存在的隐式安全风险,提出基于元认知自我评估和动态规则知识图谱的MENTOR框架,通过激活级引导信号有效降低攻击成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02599 2026-08-04 eess.SY cs.AI cs.SY 新提交 70%

Bridging Artificial Intelligence and Power Systems Education Using a Hands-On Executable Framework

使用可执行实践框架搭建人工智能与电力系统教育的桥梁

Junjie Yin, Buxin She, Xinyu Feng, Fangxing, Li

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出可执行实践框架,通过渐进式模块降低电力系统AI入门门槛,经IEEE网络研讨会验证,可满足跨学科学习者对电力专用AI实践课程的需求。

Comments 10 pages, 10 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01705 2026-08-04 cs.CY cs.AI cs.ET cs.HC 新提交 70%

Rethinking Generative AI Literacy: An Integrative, Developmental, and Dialectical Framework for K-12 Teacher Education

重新思考生成式AI素养:面向K-12教师教育的整合型、发展型与辩证型框架

Shahin Hossain, Sima Ahmadi, Leqi Li, Idowu David Awoyemi, Wei Huang, Chenxi Zhou, Jujia Li, Samaa Haniya, Shapla Khanam, Tasbirun Mashreka Subaha

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对GenAI素养滞后于技术扩散的问题,提出整合型、发展型、辩证型的RAIL-Ed框架,明确六大支柱与三级标准,为K-12教师教育及相关政策提供理论基础。

Comments 20 pages, 2 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00207 2026-08-04 cs.CL 新提交 70%

Bridging the English-Arabic Medical Knowledge Gap: Targeted Low-Rank Adaptation via Causal Layer Selection

缩小英阿医学知识鸿沟:通过因果层选择实现针对性低秩适配

Chaimae Abouzahir, Musa Khan, Hala Ali-Hassan, Congbo Ma, Khaled Saleh, Yousra Sadqi, Jihad Mallat, Walid Al-Eisawi, Nizar Habash, Farah E. Shamout

机构 * New York University Abu Dhabi(纽约大学阿布扎比分校) Cleveland Clinic Abu Dhabi(克利夫兰诊所阿布扎比分校)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 该研究针对阿拉伯语医学LLMs性能弱于英文的问题,提出TLoRA方法并构建阿拉伯医学对话基准,通过机制诊断实现针对性适配,提升了阿拉伯语医学任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18295 2026-08-04 cs.LG 版本更新 70%

On the Limits of Support-Preserving Alignment and Bounded Filtering

关于支持保持对齐和有界过滤的局限性

Aryan Dutt, Rui Mao, Anupam Chattopadhyay

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究在大语言模型中,重塑基础模型输出分布的对齐方案与有界安全过滤器结合能否消除有害行为。通过形式化设置并分析,发现有界过滤可能无法消除所有有害输出,实证评估显示有害输出率始终高于零。

Comments Withdrawn to allow a complete rewrite and substantial revision of the theoretical analysis and experiments

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27860 2026-08-04 cs.AI 版本更新 70%

C-MIG: Multi-view Information Gain-based Retrieval-Augmented Generation for Clinical Diagnosis Reasoning

C-MIG:基于多视角信息增益的检索增强生成用于临床诊断推理

Yuwei Miao, Gen Li, Yunsheng Zeng, Xiandong Li, Yujin Wang, Siyu Chen, Luning Wang, Yunhao Qiao, Junfeng Wang, Jianwei Lv, Bo Yuan

机构 * Baidu Inc(百度公司)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出C-MIG框架,通过多视角信息增益和多重子查询检索增强策略,解决检索增强生成中奖励信号丢失和异构推理监督问题,在临床诊断任务上取得最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27269 2026-08-04 cs.AI 版本更新 70%

Unifying biomedical knowledge in a modern multimodal graph

OptimusKG:统一生物医学知识的现代多模态图

Lucas Vittor, Ayush Noori, Iñaki Arango, Joaquín Polonuer, Sam Rodriques, Andrew White, David A. Clifton, Marinka Zitnik

机构 * Department of Biomedical Informatics, Harvard Medical School(哈佛医学院生物医学信息学系) Department of Engineering Science, University of Oxford(牛津大学工程科学系) Edison Scientific Inc.(Edison科学公司) Oxford Suzhou Centre for Advanced Research, University of Oxford(牛津大学苏格兰研究中心) Broad Institute of MIT and Harvard(MIT与哈佛大学Broad研究所) Kempner Institute for the Study of Natural and Artificial Intelligence, Harvard University(哈佛大学自然与人工智能研究所) Harvard Data Science Initiative(哈佛大学数据科学计划)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 OptimusKG通过整合结构化和半结构化资源,构建了多模态生物医学标记属性图,统一了分子、解剖、临床和环境领域的知识,验证了其在生物医学领域的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11804 2026-08-04 cs.CV cs.LG 版本更新 70%

OSMDA: OpenStreetMap-based Domain Adaptation for Remote Sensing VLMs

基于OpenStreetMap的领域自适应方法:为遥感VLMs的领域适应

Stefan Maria Ailuro, Mario Markov, Mohammad Mahdi, Delyan Boychev, Luc Van Gool, Danda Pani Paudel

机构 * INSAIT, Sofia University ``St. Kliment Ohridski''(INSAIT,索菲亚大学『圣克莱门特·奥赫里德斯』)

专题命中 领域大模型 :language model(abstract);foundation model(abstract);分类 cs.LG

AI总结 本文提出OSMDA方法,利用OpenStreetMap数据生成自标注数据,无需人工标注或强外部模型,通过细调基础VLM实现遥感领域适应,经10个基准测试显示其在文本生成任务中达到SOTA,且训练成本更低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01846 2026-08-04 cs.IR 新提交 67%

HyperAgent4POI: Dynamic Semantic Message Passing on Multi-Agent Hypergraphs for Missing-Modality Recommendation

HyperAgent4POI:面向缺失模态推荐的多智能体超图上的动态语义消息传递

Jinze Wang, Yuze Liu, Tiehua Zhang, Jiong Jin, Zhu Sun

专题命中 领域大模型 :LLM(abstract,abstract_cn)

AI总结 HyperAgent4POI通过动态语义消息传递在多智能体超图中补全缺失模态,在三个LBSN数据集上较15个基线实现排序提升,60%模态缺失率下NDCG@20平均提升8.2%,且推理效率高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01346 2026-08-04 cs.CY 新提交 67%

Hybrid AI for Explainable and Accurate Conversational Agents in eGovernment

用于电子政务中可解释且准确的对话智能体的混合人工智能

Ilias Chalkidis, Vlad Paul Cosma, Søren Debois, Daniel Hershcovich, Thomas Hildebrandt, Hugo A. Lòpez, Amogh Raina, Konstantinos Varvoutas, Tilman Zuckmantel

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 该研究提出对话式混合人工智能(CHAI)架构,结合大型语言模型与基于规则的控制器,采用DCR图作为建模语言,构建电子政务领域可解释且准确的对话智能体,已在新冠聊天机器人及残疾学生助学金案件管理中应用。

Comments Presented at AIDA2J Workshop at ICAIL 2026, SMU, Singapore

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05621 2026-08-04 cs.IR 版本更新 67%

ANCHOR: Agentic Noise Creation Framework for Human Simulation and Denoising Recommendation

ANCHOR: 用于人类模拟和去噪推荐的智能体噪声创建框架

Xiangming Li, Hua Chu, Jiaming Liang, Jianan Li, Yangtao Zhou

专题命中 领域大模型 :LLM(abstract,abstract_cn)

AI总结 提出ANCHOR框架,通过智能体模拟用户行为生成真实噪声标签,将推荐去噪转化为监督学习问题,实现高效噪声识别。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17310 2026-08-04 cs.CR 版本更新 67%

Cryptanalysis of LDPC-Based Pseudorandom Error-Correcting Codes

基于LDPC的伪随机纠错码的密码分析

Tianrui Wang, Anyu Wang, Tianshuo Cong, Delong Ran, Jinyuan Liu, Xiaoyun Wang

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 首次对LDPC-PRC进行密码分析,提出三种攻击破坏其不可检测性和安全性,在DeepSeek和Stable Diffusion等模型上验证有效,并给出防御建议。

Comments Accepted by USENIX Security 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08090 2026-08-04 cs.SE cs.HC 版本更新 67%

Crossing Margins: Intersectional Users' Ethical Concerns about Software

跨越边际:交叉性用户对软件的伦理关切

Lauren Olson, Tom P. Humbert, Ricarda Anna-Lena Fischer, Bob Westerveld, Florian Kunneman, Emitzá Guzmán

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本研究针对交叉性用户软件伦理关切研究空白,收集700多个交叉性Subreddits的36777条帖子,利用大语言模型等技术分析交叉性声音,构建反馈驱动框架评估软件对交叉性用户需求的满足度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00285 2026-08-04 cs.CL cs.AI 新提交 62%

Sixteen models, fewer than two voices: measuring ensemble dispersion where no answer is uniquely correct

十六种模型,不足两种声音:在无唯一正确答案的场景中测量集成模型的离散度

Mario Vega-Barbas, Lidia Mora-Valenciano, Iván Pau, Fernando Seoane, Farhad Abtahi

专题命中 领域大模型 :language model(abstract);分类 cs.CL、cs.AI

AI总结 该研究针对无唯一正确答案的心理治疗案例,以十六种语言模型为对象,定义模型异议贡献,发现集成模型离散度由临床内容组织,模型身份为异议的可检测结构因素。

Comments 34 pages (25 article + 9 supplementary), 3 figures. Supplementary material (S1-S11) included. Preregistered at OSF (osf.io/c5qk7), sealed 21 July 2026. Analysis code and data: https://doi.org/10.5281/zenodo.21718657

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16292 2026-08-04 cs.CV cs.AI cs.LG 版本更新 62%

Predicted Cortex Is Not a Domain-General Prior: A Matched-Control Audit of Brain-Encoding Features for Video Memorability

这取决于数据集:当大脑编码模型的预测响应在视频记忆性方面超过其视觉主干时

Carson Rodrigues

机构 * Celabe(赛拉贝)

专题命中 领域大模型 :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 研究大脑编码模型预测响应能否用于预测短视频记忆性,通过将视频片段投影到特定皮质空间并用岭回归预测,发现结果取决于数据集,大脑投影在VideoMem数据集表现更佳,且携带特定记忆信号,不是通用先验知识。

Comments 11 pages, 3 figures. v4: retitled; adds a dataset-by-representation interaction test (+0.097, 95% CI [+0.032,+0.160], p=0.001) and seed stability for both datasets, replacing the earlier claim that both within-dataset intervals excluded zero (the Memento10k bound was -0.0003); discloses that the pre-specified hypothesis returned NO-GO; adds a regularization-grid check

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03980 2026-08-04 cs.CL cs.AI 版本更新 62%

Transformers perform adaptive partial pooling

Transformer 实现自适应部分池化

Vsevolod Kapatsinski

专题命中 领域大模型 :language model(abstract);分类 cs.CL、cs.AI

AI总结 本文研究了Transformer模型在训练过程中自适应部分池化特性,发现其下一个词预测随着训练进行逐渐减少对外部观察的依赖,且受情境频率、数量和变化影响。

Comments 8 pages, Proceedings of the 48th Annual Meeting of the Cognitive Science Society, 48, 3050-3057

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01181 2026-08-04 econ.GN cs.AI q-fin.EC 新提交 57%

Talking to Digital Twins: Selective Disclosure and Belief Measurement in Financial Social Media

与数字孪生对话:金融社交媒体中的选择性披露与信念测量

Boone Bowles, Raymond Duch, Sorin Sorescu

专题命中 领域大模型 :LLM(abstract_cn);分类 cs.AI

AI总结 本研究通过对金融网红的X账号构建的数字孪生开展重复实时访谈,解决金融社交媒体中未披露信息的测量问题,其信息可预测大盘股收益横截面,避免了大语言模型的前瞻性偏差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02595 2026-08-04 cs.LG 新提交 57%

onepot-Bench 0: towards lab-aware in silico chemistry benchmarks

onepot-Bench 0:面向实验室实际场景的计算机化学基准测试

Brandon Wang, Andrei S. Tyrin, Daniil A. Boiko

专题命中 领域大模型 :language model(abstract);分类 cs.LG

AI总结 本研究推出专有基准测试onepot-Bench 0,通过三个互补评估衡量语言模型在湿实验室合成化学场景下的基础能力、可靠性等,弥补现有评估的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02218 2026-08-04 cs.AI 新提交 57%

PosterMELD: Multi-Agent Paper-to-Poster Generation for Controllable Design Diversity with Editable Print-Ready Outputs

PosterMELD:面向可编辑打印就绪输出的可控设计多样性多智能体论文转海报生成

Haojie Hu, Chenhao Dang, Yaojia Liu, Hengrui Kang, Conghui He, Weijia Li

专题命中 领域大模型 :language model(abstract);分类 cs.AI

AI总结 PosterMELD是模板条件化多智能体海报生成流水线,可导出可编辑PPTX和PNG,在621篇论文实验中PRR达81.3%,成本仅为Codex+Skill的3.5%,性能优于P2P、PosterGen等方法。

Comments 9 pages, 5 figures, and 4 tables. Code and resources are available at https://github.com/Shannon4Science/PosterMELD

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02101 2026-08-04 cs.CL 新提交 57%

Cross-Domain Hybrid OPD for Generalizable Search Agents

面向通用搜索智能体的跨域混合在线策略蒸馏

Hongzhan Chen, Xiaoyu Liu, Dengming Zhang, Minzhou Huang, Dongliang Xu, Jingcheng Xie, Dongxiang Fang, Bowen Qin, Minsheng Hao, Yaozong Shen, Xiaojun Quan, Mona Zhou, Haosheng Zou, Jeff Chen

机构 * Yuanbao Team, Tencent Shanghai Innovation Institute(腾讯上海研究院元宝团队)

专题命中 领域大模型 :language model(abstract);分类 cs.CL

AI总结 本研究提出基于混元3架构的元宝搜索智能体训练框架,通过跨域混合在线策略蒸馏联合优化搜索专业化与通用能力,缓解对齐损耗,在现实搜索场景中实现两者的良好平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏