arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12486 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12486 篇

2604.12919 2026-04-21 cs.CL 70%

MetFuse: Figurative Fusion between Metonymy and Metaphor

MetFuse:隐喻与隐喻之间的隐喻融合

Saptarshi Ghosh, Tianyu Jiang

机构 * University of Cincinnati(辛辛那提大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出MetFuse数据集,通过将字面句转换为三种隐喻变体,研究隐喻与隐喻融合的机制,实验表明融合数据能提升隐喻和隐喻分类性能。

Comments ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18361 2026-04-21 cs.CL 70%

Synthetic Data Generation for Training Diversified Commonsense Reasoning Models

为训练多样化常识推理模型生成合成数据

Tianhui Zhang, Bei Peng, Danushka Bollegala

机构 * University of Liverpool(利物浦大学) University of Sheffield(谢菲尔德大学) Amazon(亚马逊)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出两阶段方法生成首个合成数据集CommonSyn,提升生成多样性和质量,适用于不同规模的大语言模型。

Comments ACL2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14459 2026-04-17 cs.CL 70%

Filling in the Mechanisms: How do LMs Learn Filler-Gap Dependencies under Developmental Constraints?

填补机制:语言模型如何在发育约束下学习填充-缺口依赖?

Atrey Desai, Sathvik Nair

机构 * University of Maryland(马里兰大学)

专题命中 预训练与数据 :LLM(abstract_cn);language model(abstract);分类 cs.CL

AI总结 研究通过DAS分析语言模型在不同数据量下的填充-缺口依赖表示,发现有限数据下存在共享但敏感的机制,但语言模型仍需更多数据才能达到人类水平,凸显语言特异性偏见的重要性。

Comments To be published in the 64th Annual Meeting of the Association for Computational Linguistics

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13313 2026-04-16 cs.LG 70%

Concrete Jungle: Towards Concreteness Paved Contrastive Negative Mining for Compositional Understanding

具体丛林:迈向由具体性铺就的对比负样本挖掘以实现组合理解

Eun Woo Im, Dhruv Madhwal, Vivek Gupta

机构 * Arizona State University(亚利桑那州立大学)

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.LG

AI总结 本文提出ConcretePlant,通过增强具体性术语的修改来提升对比学习信号,解决负样本生成中的梯度失衡问题,提出Cement损失函数以动态校准惩罚,实现更有效的组合理解。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08639 2026-04-16 cs.CV cs.AI 70%

UNBOX: Unveiling Black-box visual models with Natural-language

UNBOX:通过自然语言揭示黑盒视觉模型

Simone Carnemolla, Chiara Russo, Simone Palazzo, Quentin Bouniot, Daniela Giordano, Zeynep Akata, Matteo Pennisi, Concetto Spampinato

机构 * University of Catania(卡塔尼亚大学) Technical University of Munich(慕尼黑技术大学) Helmholtz Munich(海德堡-慕尼黑马克斯·普朗克研究所)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 UNBOX在无数据、无梯度、无反向传播约束下,利用大语言模型和扩散模型生成可解释文本描述,揭示模型隐含概念与潜在偏见,通过实验验证其在ImageNet-1K等数据集上的有效性。

Comments Under review at IJCV

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11329 2026-04-16 cs.CL 70%

F-Actor: Controllable Conversational Behaviour in Full-Duplex Models

F-Actor:全双工模型中的可控对话行为

Maike Züfle, Ondrej Klejch, Nicholas Sanders, Jan Niehues, Alexandra Birch, Tsz Kin Lam

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) University of Edinburgh(爱丁堡大学) NatWest(国立西敏银行)

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL

AI总结 本文提出首个可训练的全双工对话语音模型,通过冻结音频编码器仅微调语言模型,在有限资源下实现高效训练,支持通过指令控制说话声音、话题和对话行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12335 2026-04-15 cs.CV cs.LG 70%

All in One: A Unified Synthetic Data Pipeline for Multimodal Video Understanding

一站式:一个多模态视频理解统一合成数据管道

Tanzila Rahman, Renjie Liao, Leonid Sigal

机构 * University of British Columbia(不列颠哥伦比亚大学) Vector Institute for AI(向量人工智能研究所)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出统一合成数据管道,用于生成多模态视频数据,支持多种任务格式,提升模型推理能力,并在视频物体计数、视觉问答和分割任务中验证了其有效性。

Comments 8 Pages, 4 Tables, 4 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23964 2026-04-14 cs.AI 70%

From Pixels to Digital Agents: An Empirical Study on the Taxonomy and Technological Trends of Reinforcement Learning Environments

从像素到数字代理:关于强化学习环境分类和技术趋势的实证研究

Lijing Luo, Yiben Luo, Alexey Gorbatovski, Sergey Kovalchuk, Xiaodan Liang

机构 * Sun Yat-sen University(中山大学) Yancheng Institute of Technology(盐城工学院) Central University Moscow(莫斯科中央大学) ITMO University(ITMO大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过大规模数据分析,研究强化学习环境从物理模拟到通用代理的演变,揭示领域分为语义优先和领域特定泛化两大生态,并提出设计下一代具身语义模拟器的路线图。

Comments 32 pages main text, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09270 2026-04-14 cs.CL 70%

MCGA: A Multi-task Classical Chinese Literary Genre Audio Corpus

MCGA:多任务古典中文文学体裁音频语料库

Yexing Du, Kaiyuan Liu, Bihe Zhang, Youcheng Pan, Bo Yang, Liangyu Huo, Xiyuan Zhang, Jian Xie, Daojing He, Yang Xiang, Ming Liu, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学) Pengcheng Laboratory(鹏城实验室) South China University of Technology(华南理工大学) Du xiaoman(杜小满)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出MCGA语料库,包含22000个音频样本,涵盖六个任务:ASR、S2TT、SEC、SQA、SU和SR,评估十种MLLM发现其在MCGA测试集上仍面临显著挑战,并引入领域特定的SEC指标和语音与文本一致性度量。

Comments Accepted in ACL 2026 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10391 2026-04-14 cs.CV cs.AI 70%

FishRoPE: Projective Rotary Position Embeddings for Omnidirectional Visual Perception

FishRoPE: 用于全方位视觉感知的投影旋转位置嵌入

Rahul Ahuja, Mudit Jain, Bala Murali Manoghar Sai Sudhakar, Venkatraman Narayanan, Pratik Likhar, Varun Ravi Kumar, Senthil Yogamani

机构 * Automated Driving, Qualcomm Technologies, Inc(高通技术公司自动驾驶部门) Automated Driving, Qualcomm India Private Limited(高通印度私人有限公司自动驾驶部门)

专题命中 预训练与数据 :foundation model(abstract);pretraining(abstract);分类 cs.AI

AI总结 本文提出FishRoPE,通过轻量框架将冻结的视觉基础模型适配到鱼眼几何,利用旋转位置嵌入重新参数化注意力机制,实现角分离而非像素距离的处理,提升全方位视觉感知性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10021 2026-04-14 cs.SD cs.LG 70%

Masked Contrastive Pre-Training Improves Music Audio Key Detection

掩码对比预训练改进音乐音频键检测

Ori Yonay, Tracy Hammond, Tianbao Yang

机构 * Department of Computer Science Engineering, Texas A\&M University

专题命中 预训练与数据 :foundation model(abstract);pretraining(abstract);分类 cs.LG

AI总结 本文通过掩码对比预训练提升音乐音频键检测性能,发现其能有效增强音高敏感性,并在监督学习中实现SOTA表现。

Comments Code and models available at github.com/echo-cipher/keymyna

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09089 2026-04-13 cs.SE cs.AI cs.CR 70%

DeepGuard: Secure Code Generation via Multi-Layer Semantic Aggregation

DeepGuard:通过多层语义聚合实现安全代码生成

Li Huang, Zhongxin Liu, Yifan Wu, Tao Yin, Dong Li, Jichao Bi, Nankun Mu, Hongyu Zhang, Meng Yan

机构 * Chongqing University(重庆大学) The State Key Laboratory of Blockchain and Data Security, Zhejiang University(区块链与数据安全全国重点实验室,浙江大学) Peking University(北京大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 DeepGuard通过多层语义聚合提升代码生成的安全性,实验表明其在安全性和功能性上均优于基线模型,有效检测并减少不安全模式。

Comments ACL 2026 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08762 2026-04-13 cs.CV cs.AI 70%

InstrAct: Towards Action-Centric Understanding in Instructional Videos

InstrAct:迈向指令视频中的动作中心理解

Zhuoyi Yang, Jiapeng Yu, Reuben Tan, Boyang Li, Huijuan Xu

机构 * Pennsylvania State University(宾夕法尼亚州立大学) Microsoft Research(微软研究院) Nanyang Technological University(南洋理工大学)

专题命中 预训练与数据 :foundation model(abstract);pretraining(abstract);分类 cs.AI

AI总结 本文提出InstrAction框架,通过数据驱动策略和辅助目标提升指令视频中动作识别与建模,建立InstrAct基准测试集,优于现有视频基础模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12686 2026-04-13 cs.CL 70%

Exploring Cross-lingual Latent Transplantation: Mutual Opportunities and Open Challenges

探索跨语言潜在移植:相互机会与开放挑战

Yangfan Ye, Xiaocheng Feng, Xiachong Feng, Libo Qin, Yichong Huang, Lei Huang, Weitao Ma, Qichen Hong, Zhirui Zhang, Yunfei Lu, Xiaohui Yan, Duyu Tang, Dandan Tu, Bing Qin

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出跨语言潜在移植框架,探讨其对多语言能力和文化适应性的双向影响,揭示注意力模块与前馈模块在多语言理解中的作用,发现当前LLM多语言潜力的严重未利用问题。

Comments IEEE Transactions on Audio, Speech and Language Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08156 2026-04-10 cs.CL 70%

Training Data Size Sensitivity in Unsupervised Rhyme Recognition

无监督押韵识别中的训练数据敏感性

Petr Plecháč, Artjoms Šeļa, Silvie Cinková, Mirella De Sisto, Lara Nugues, Neža Kočnik, Antonina Martynenko, Ben Nagy, Luca Giovannini, Robert Kolár

机构 * Institute of Czech Literature, Czech Academy of Sciences(捷克科学院捷克文学研究所) University of Tartu(塔尔图大学) Charles University(查理大学) Tilburg University(蒂尔堡大学) University of Basel(巴塞尔大学) University of Ljubljana(卢布尔雅那大学) Institute of Polish Language, Polish Academy of Sciences(波兰科学院波兰语言研究所) University of Potsdam(波茨坦大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究探讨了RhymeTagger在不同语言中识别押韵所需训练数据量,分析了语言差异和训练规模对准确率的影响,并对比了大型语言模型在缺乏音系表示时的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08124 2026-04-10 cs.AI 70%

Beyond Stochastic Exploration: What Makes Training Data Valuable for Agentic Search

超越随机探索:训练数据为何对代理搜索有价值

Chuzhan Hao, Wenfeng Feng, Guochao Jiang, Guofeng Quan, Guohua Liu, Yuewei Zhang

机构 * Alibaba Cloud Computing(阿里云)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出Hierarchical Experience框架,通过对比分析和多级聚类机制将原始推理轨迹转化为层次经验知识,提升搜索代理的性能和训练稳定性,实现更高效的策略驱动搜索。

Comments 15 pages, ACL2026 Findings Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08115 2026-04-10 cs.AI 70%

Revise: A Framework for Revising OCRed text in Practical Information Systems with Data Contamination Strategy

修订:一种在实际信息系统中利用数据污染策略修订OCR文本的框架

Gyuho Shim, Seongtae Hong, Heuiseok Lim

机构 * Department of Computer Science and Engineering, Korea University(高丽大学计算机科学与工程系) Human-inspired AI Research(人类启发人工智能研究)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出Revise框架,通过修正OCR文本的字符、词和结构层面错误,提升文档信息的结构化表示和管理能力,从而增强文档检索和问答任务的性能。

Comments Accepted to ACL 2025 Industry-Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07015 2026-04-09 cs.CL 70%

Corpora deduplication or duplication in Natural Language Processing of few resourced languages ? A case of study: The Mexico's Nahuatl

语料去重或重复在自然语言处理中少数资源语言的应用?一个案例研究:墨西哥的纳瓦特尔语

Juan-José Guzman-Landa, Juan-Manuel Torres-Moreno, Graham Ranger, Miguel Figueroa-Saavedra, Martha-Lorena Avendaño-Garrido, Elvys Linhares-Pontes, Luis-Gil Moreno-Jiménez

机构 * LIFAT, Université de Tours(图尔大学计算机科学、人工智能与图像处理实验室) Instituto de Investigaciones en Educación, Universidad Veracruzana(韦拉克鲁斯大学教育研究所) Trading Central(Trading Central公司) Independent Researcher(独立研究员)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文探讨在计算资源有限的语言中,语料重复是否有助于自然语言处理。通过纳瓦特尔语语料扩展实验,发现可控重复可提升嵌入学习效果。

Comments 8 pages, 1 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04892 2026-04-07 cs.LG 70%

Data Attribution in Adaptive Learning

自适应学习中的数据归因

Amit Kiran Rege

专题命中 预训练与数据 :language model(abstract);post-training(abstract);分类 cs.LG

AI总结 本文研究自适应学习中的数据归因问题,提出条件干预目标,证明回放信息无法一般性恢复归因,并识别出一个结构类以从日志数据中识别目标。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29221 2026-04-01 cs.CL 70%

SiPaKosa: A Comprehensive Corpus of Canonical and Classical Buddhist Texts in Sinhala and Pali

SiPaKosa:一篇全面的斯里兰卡语和巴利经典和古典佛教文本语料库

Ranidu Gurusinghe, Nevidu Jayatilleke

机构 * School of Computing, Informatics Institute of Technology, Sri Lanka(斯里兰卡信息理工学院计算学院)

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.CL

AI总结 SiPaKosa语料库包含约786万词和786千句,结合16份历史佛教文献和完整的巴利三藏文本,通过高质量OCR和网络爬虫构建,评估了10种预训练模型的性能,显示专有模型在开放源代码模型上表现优异,支持领域适应语言模型的预训练,促进历史语言分析和佛教研究信息检索系统的发展。

Comments 17 pages, 5 figures, 5 tables, Accepted paper at the 2nd Workshop on Challenges in Processing South Asian Languages (CHiPSAL) @ LREC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29176 2026-04-01 q-bio.NC cs.AI cs.CE cs.CV 70%

Predicting Neuromodulation Outcome for Parkinson's Disease with Generative Virtual Brain Model

利用生成虚拟脑模型预测帕金森病的神经调制疗效

Siyuan Du, Siyi Li, Shuwei Bai, Ang Li, Haolin Li, Mingqing Xiao, Yang Pan, Dongsheng Li, Weidi Xie, Yanfeng Wang, Ya Zhang, Chencheng Zhang, Jiangchao Yao

机构 * College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与技术学院) Shanghai AI Laboratory(上海人工智能实验室) University of Science and Technology of China(中国科学技术大学) Ruijin Hospital, Shanghai Jiao Tong University School of Medicine(上海交通大学医学院附属瑞金医院) Microsoft Research Asia(微软亚洲研究院) Zhongnan Hospital of Wuhan University(武汉大学中南医院) School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) Institute of Artificial Intelligence for Medicine, Shanghai Jiao Tong University School of Medicine(上海交通大学医学院人工智能医学研究所) Cooperative Medianet Innovation Center, Shanghai Jiao Tong University(上海交通大学协同媒体创新中心)

专题命中 预训练与数据 :foundation model(abstract);pretraining(abstract);分类 cs.AI

AI总结 本文提出一种基于生成虚拟脑模型的预训练-微调框架,通过静息态fMRI预测帕金森病患者接受颞叶干扰和深部脑刺激的疗效,利用生成模型提高个体化虚拟脑的准确性,并通过反事实估计预测临床反应,优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26211 2026-03-30 cs.CV cs.AI 70%

Towards GUI Agents: Vision-Language Diffusion Models for GUI Grounding

迈向GUI代理:用于GUI定位的视觉-语言扩散模型

Shrinidhi Kumbhar, Haofu Liao, Srikar Appalaraju, Kunwar Yashraj Singh

机构 * Arizona State University(亚利桑那州立大学) AWS Agentic AI

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.AI

AI总结 本文探讨了离散扩散视觉-语言模型在GUI定位中的应用,通过混合掩码策略提升定位精度,并在多个数据集上验证了其有效性。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10000 2026-03-27 cs.LG cond-mat.other 70%

Neural Scaling Laws for Deep Regression

深度回归的神经扩展定律

Tilen Cadez, Kyoung-Min Kim

机构 * Asia Pacific Center for Theoretical Physics(亚太理论物理中心) Department of Physics(物理系) Pohang University of Science and Technology(坡山科学技术大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究深度回归模型中神经扩展定律,通过参数估计模型探讨回归性能与训练数据量和模型容量的幂律关系,发现损失与这些因素呈1到2之间的幂律关系。

Comments Supplementary Information will be provided with the published manuscript

Journal ref Machine Learning: Science and Technology, 7 025011 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17490 2026-03-27 cs.LG stat.ML 70%

Revisit, Extend, and Enhance Hessian-Free Influence Functions

重新审视、扩展和增强Hessian-Free影响函数

Ziao Yang, Han Yue, Jian Chen, Hongfu Liu

机构 * Brandeis University(布兰迪大学) Tsinghua University(清华大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文重新审视TracIn方法,扩展其应用至公平性和鲁棒性,并通过集成策略增强其性能,通过合成数据和噪声标签检测等实验验证有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24556 2026-03-26 cs.IR cs.AI 70%

Evaluating Chunking Strategies For Retrieval-Augmented Generation in Oil and Gas Enterprise Documents

评估检索增强生成在石油和天然气企业文档中的分块策略

Samuel Taiwo, Mohd Amaluddin Yusoff

机构 * Digital and Innovation Department, Nigeria LNG Limited(尼日利亚LNG公司数字与创新部门)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文研究了四种分块策略在石油和天然气企业文档中的效果,发现结构感知分块在检索效果和计算成本上表现最佳,但对图表类文档仍有限。

Comments Presented at CCSEIT 2026. This version matches the published proceedings

Journal ref Computer Science and Information Technology (CS and IT), pp. 49-67, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22260 2026-03-24 cs.CL 70%

Greater accessibility can amplify discrimination in generative AI

更大的可及性可能放大生成AI中的歧视

Carolin Holtermann, Minh Duc Bui, Kaitlyn Zhou, Valentin Hofmann, Katharina von der Wense, Anne Lauscher

机构 * Trustworthy AI Lab, University of Hamburg(可信AI实验室,汉堡大学) NALA Group, JGU Mainz(NALA集团,吉森大学) Cornell University(康奈尔大学) Together AI Allen Institute for AI(人工智能研究院) CU Boulder(博尔德大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究发现语音交互虽提升可及性,但会因语音携带身份线索而加剧性别偏见,提出通过音调调节可缓解歧视问题。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21862 2026-03-24 cs.LG 70%

Holistic Scaling Laws for Optimal Mixture-of-Experts Architecture Optimization

整体缩放定律用于最优专家混合架构优化

Weilin Wan, Jingtao Han, Weizhong Zhang, Cheng Jin

机构 * College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院) Hi Lab, Xiaohongshu Inc.(小红书公司Hi实验室) Project Numina(项目Numina) School of Data Science, Fudan University(复旦大学数据科学学院)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出一种框架,通过联合约束三元组和代数约束,优化专家混合架构,实现鲁棒的缩放定律,为大规模计算预算提供完整最优架构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21630 2026-03-24 cs.AI 70%

EnterpriseLab: A Full-Stack Platform for developing and deploying agents in Enterprises

EnterpriseLab:企业中开发和部署代理的全栈平台

Ankush Agarwal, Harsh Vishwakarma, Suraj Nagaje, Chaitanya Devaguptapu

机构 * Fujitsu Research India(富士通印度研究)

专题命中 预训练与数据 :language model(abstract);small language model(abstract);分类 cs.AI

AI总结 本文提出EnterpriseLab,一个统一开发和部署企业代理的全栈平台,通过模块化环境、自动化数据生成和集成训练管道,提升企业代理的能力与隐私保护。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21529 2026-03-24 cs.CL 70%

SynSym: A Synthetic Data Generation Framework for Psychiatric Symptom Identification

SynSym:一种用于精神病症状识别的合成数据生成框架

Migyeong Kang, Jihyun Kim, Hyolim Jeon, Sunwoo Hwang, Jihyun An, Yonghoon Kim, Haewoon Kwak, Jisun An, Jinyoung Han

机构 * Sungkyunkwan University(成均馆大学) Samsung Medical Center(三星医疗中心) Indiana University(印第安纳大学)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出SynSym框架,通过生成高质量训练样本提升症状识别模型的泛化能力,实验表明合成数据能与真实数据表现相当,并通过微调进一步提升性能。

URL PDF HTML 收藏
2505.11404 2026-03-24 cs.CV cs.AI 70%

Patho-R1: A Multimodal Reinforcement Learning-Based Pathology Expert Reasoner

Patho-R1: 基于多模态强化学习的病理专家推理器

Wenchuan Zhang, Penghao Zhang, Jingru Guo, Tao Cheng, Jie Chen, Shuwan Zhang, Zhang Zhang, Yuhao Yi, Hong Bu

机构 * Department of Pathology, West China Hospital, Sichuan University(四川大学华西医院病理科部门) Institute of Clinical Pathology, West China Hospital, Sichuan University(四川大学华西医院临床病理科研究所) University of Toronto(多伦多大学) Business School, Sichuan University(四川大学商学院) Department of Pathology, Shengjing Hospital of China Medical University(中国医科大学盛京医院病理科部门)

专题命中 预训练与数据 :language model(abstract);pretraining(abstract);分类 cs.AI

AI总结 本文提出Patho-R1,通过构建高质量推理导向数据集,结合三阶段训练流程提升病理推理能力,实现跨模态任务的鲁棒性能。

Journal ref Proceedings of the AAAI Conference on Artificial Intelligence, 40(33): 28418-28426, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏