arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12761 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12761 篇

2602.16650 2026-02-19 cs.CE cs.AI 70%

Retrieval Augmented Generation of Literature-derived Polymer Knowledge: The Example of a Biodegradable Polymer Expert System

文献衍生聚合物知识的检索增强生成:生物降解聚合物专家系统的例子

Sonakshi Gupta, Akhlak Mahmood, Wei Xiong, Rampi Ramprasad

机构 * School of Computational Science and Engineering(计算科学与工程学院) Georgia Institute of Technology(佐治亚理工学院) Matmerize, Inc.(Matmerize公司)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出基于检索增强生成的聚合物知识系统,通过构建结构化知识图谱和语义向量方法,提升生物降解聚合物领域的文献检索与推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16273 2026-02-19 nlin.AO cs.CL 70%

Lyapunov Spectral Analysis of Speech Embedding Trajectories in Psychosis

精神分裂症患者与健康对照者语音嵌入轨迹的李雅普诺夫谱分析

Jelena Vasic, Branislav Andjelic, Ana Mancic, Dusica Filipovic Djurdjevic, Ljiljana Mihic, Aleksandar Kovacevic, Nadja P. Maric, Aleksandra Maluckov

机构 * Institute of Mental Health(心理健康研究所) Faculty of Technical Sciences, University of Novi Sad(技术科学学院,诺维萨德大学) Faculty of Philosophy, University of Belgrade(哲学学院,贝尔格莱德大学) Faculty of Medicine, University of Belgrade(医学学院,贝尔格莱德大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究通过分析语音嵌入轨迹的李雅普诺夫谱,揭示精神分裂症与健康个体在语音动态稳定性上的差异。

Comments 14 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15514 2026-02-18 cs.CL 70%

DependencyAI: Detecting AI Generated Text through Dependency Parsing

DependencyAI: 通过依存解析检测AI生成文本

Sara Ahmed, Tracy Hammond

机构 * Sketch Recognition Lab, Texas A&M University(德克萨斯大学阿姆斯特朗实验室)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 DependencyAI通过依存解析检测AI生成文本,利用语言依存关系标签实现高可解释性和跨语言性能,揭示语法结构差异并提升跨领域泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15005 2026-02-17 cs.CL cs.IR 70%

Learning User Interests via Reasoning and Distillation for Cross-Domain News Recommendation

通过推理和蒸馏学习用户兴趣以实现跨领域新闻推荐

Mengdan Zhu, Yufan Zhao, Tao Di, Yulan Yan, Liang Zhao

机构 * Microsoft(微软公司) Emory University(埃默里大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出通过推理和蒸馏学习用户兴趣的方法,提升跨领域新闻推荐的性能和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06855 2026-02-17 cs.AI 70%

AIRS-Bench: a Suite of Tasks for Frontier AI Research Science Agents

AIRS-Bench: 一个面向前沿人工智能研究科学代理的任务集

Alisia Lupidi, Bhavul Gauri, Thomas Simon Foster, Bassel Al Omari, Despoina Magka, Alberto Pepe, Alexis Audran-Reiss, Muna Aghamelu, Nicolas Baldwin, Lucia Cipolina-Kun, Jean-Christophe Gagnon-Audet, Chee Hau Leow, Sandra Lefdal, Hossam Mossalam, Abhinav Moudgil, Saba Nazir, Emanuel Tewolde, Isabel Urrego, Jordi Armengol Estape, Amar Budhiraja, Gaurav Chaurasia, Abhishek Charnalia, Derek Dunfield, Karen Hambardzumyan, Daniel Izcovich, Martin Josifoski, Ishita Mediratta, Kelvin Niu, Parth Pathak, Michael Shvartsman, Edan Toledo, Anton Protopopov, Roberta Raileanu, Alexander Miller, Tatiana Shavrina, Jakob Foerster, Yoram Bachrach

机构 * FAIR at Meta(Meta 的 FAIR 部门) University of Oxford(牛津大学) University College London(伦敦大学学院)

专题命中 领域大模型 :LLM(abstract);language model(abstract);分类 cs.AI

AI总结 AIRS-Bench通过20个任务评估代理在科研全生命周期中的能力,发现代理在部分任务中超越人类但未达理论上限,推动自主科研发展。

Comments 49 pages, 14 figures, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13758 2026-02-17 cs.CV cs.AI 70%

OmniScience: A Large-scale Multi-modal Dataset for Scientific Image Understanding

OmniScience: 一个大规模多模态数据集用于科学图像理解

Haoyi Tao, Chaozheng Huang, Nan Wang, Han Lyu, Linfeng Zhang, Guolin Ke, Xi Fang

机构 * DP Technology(DP技术)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 OmniScience是一个大规模多模态数据集,通过动态模型路由生成高信息密度的图像标题,提升多模态模型在科学图像理解上的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03490 2026-02-17 cs.CL 70%

Beyond Memorization: A Rigorous Evaluation Framework for Medical Knowledge Editing

超越记忆:面向医学知识编辑的严格评估框架

Shigeng Chen, Linhao Luo, Zhangchi Qiu, Yanan Cao, Carl Yang, Shirui Pan

机构 * School of Information and Communication Technology, Griffith University(格里菲斯大学信息与通信技术学院) Department of Data Science and AI, Monash University(莫纳什大学数据科学与人工智能系) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) Department of Computer Science, Emory University(埃默里大学计算机科学系)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出 MedEditBench 框架,评估医学知识编辑方法的有效性,发现现有方法仅能表面记忆信息,提出 SGR-Edit 方法提升泛化能力。

Comments Accepted to EACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13332 2026-02-17 cs.CV cs.AI 70%

MedScope: Incentivizing "Think with Videos" for Clinical Reasoning via Coarse-to-Fine Tool Calling

MedScope:通过粗到细的工具调用激励“通过视频思考”以进行临床推理

Wenjie Li, Yujie Zhang, Haoran Sun, Xingqi He, Hongcheng Gao, Chenglong Ma, Ming Hu, Guankun Wang, Shiyi Yao, Renhao Yang, Hongliang Ren, Lei Wang, Junjun He, Yankai Jiang

机构 * College of Health Science and Technology, Shanghai Jiao Tong University School of Medicine, Shanghai, China(上海交通大学医学院健康科学与技术学院) Fudan University, Shanghai, China(复旦大学) Shanghai Innovation Institute, Shanghai, China(上海创新研究院) Tsinghua University, Beijing, China(清华大学) Shanghai Artificial Intelligence Laboratory, Shanghai, China(上海人工智能实验室) The Chinese University of Hong Kong, Hong Kong, China(香港中文大学) Ruijin Hospital, Shanghai Jiaotong University, Shanghai, China(上海交通大学瑞金医院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 MedScope通过粗到细的工具调用机制,提升临床视频推理的准确性与可信度,实现基于时间局部化视觉证据的医疗AI代理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13253 2026-02-17 cs.CY cs.AI 70%

Implicit Bias in LLMs for Transgender Populations

LLMs对跨性别人群的隐性偏见

Micaela Hirsch, Marina Elichiry, Blas Radi, Tamara Quiroga, David Restrepo, Luciana Benotti, Veronica Xhardez, Jocelyn Dunstan, Enzo Ferrante

机构 * Instituto de Ciencias de la Computación (UBA-CONICET)(计算机科学研究所(UBA-CONICET)) Hospital Dr. Lucio Melendez(Lucio Melendez医院) Universidad de Buenos Aires(布宜诺斯艾利斯大学) Universidad Católica de Chile(智利天主大学) MICS, CentraleSupélec - Université Paris-Saclay(MICS,CentraleSupélec-巴黎萨克雷大学) Universidad Nacional de Córdoba(科迪利亚国家大学) Fundación Vía Libre(自由之路基金会) CIECTI

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究揭示了LLMs对跨性别人群的隐性偏见,通过词语关联测试和医疗预约分配任务发现LLMs在多个类别中存在负面关联,并指出需研究以减少LLMs中的刻板印象偏见,确保医疗应用中的公平性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23232 2026-02-17 cs.CV cs.AI 70%

ShotFinder: Imagination-Driven Open-Domain Video Shot Retrieval via Web Search

ShotFinder: 通过网络搜索驱动的开放域视频镜头检索

Tao Yu, Haopeng Jin, Hao Wang, Shenghua Chai, Yujia Yang, Junhao Gong, Jiaming Guo, Minghui Zhang, Xinlong Chen, Zhenghao Zhang, Yuxuan Zhou, Yufei Xiong, Shanbin Zhang, Jiabing Yang, Hongzhu Yi, Xinming Wang, Cheng Zhong, Xiao Ma, Zhang Zhang, Yan Huang, Liang Wang

机构 * CASIA(中国科学院自动化研究所) UCAS(中国科学院大学) Lenovo(联想集团) Peking University(北京大学) Tsinghua University(清华大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 ShotFinder通过网络搜索驱动开放域视频镜头检索,提出三阶段检索流程并揭示多模态大模型在开放域视频检索中的性能差距。

Comments 28 pages, 7 figures, Project website: https://github.com/yutao1024/ShotFinder

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11982 2026-02-13 cs.CL 70%

Automatic Simplification of Common Vulnerabilities and Exposures Descriptions

常见漏洞与暴露描述的自动简化

Varpu Vehomäki, Kimmo K. Kaski

机构 * Department of Computer Science Aalto University School of Science(计算机科学系 阿尔托大学 学校)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究探讨了利用大型语言模型对网络安全漏洞描述进行自动文本简化的方法,并发现现成模型在简化过程中难以保持原意。

Comments 8 pages, 1 figure, submitted to Nordic Machine Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11898 2026-02-13 cs.CL 70%

Benchmark Illusion: Disagreement among LLMs and Its Scientific Consequences

基准幻觉:大语言模型之间的分歧及其科学后果

Eddie Yang, Dashun Wang

机构 * Department of Political Science, Purdue University(政治学系,普渡大学) Kellogg School of Management, Center for Science of Science and Innovation, Northwestern Innovation Institute, Ryan Institute on Complexity, and McCormick School of Engineering(凯洛格管理学院、科学与创新中心、西北创新研究所、复杂性研究院以及麦科马克工程学院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究揭示大语言模型在基准测试中存在显著分歧,影响科学可重复性,指出模型选择对研究结果有重要影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11301 2026-02-13 cs.AI cs.CR 70%

The PBSAI Governance Ecosystem: A Multi-Agent AI Reference Architecture for Securing Enterprise AI Estates

PBSAI治理生态系统:一种多智能体AI参考架构,用于保障企业AI领地安全

John M. Willis

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 PBSAI提出了一种多智能体参考架构,用于保障企业AI领地的安全,通过十二个领域分类法和有限智能体家族实现责任划分,结合分析监控、协调防御等技术,确保系统安全与可追溯性。

Comments 43 pages, plus 12 pages of appendices. One Figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05941 2026-02-12 cs.SE cs.LG cs.MA 70%

Code2MCP: Transforming Code Repositories into MCP Services

Code2MCP: 将代码仓库转化为MCP服务

Chaoqian Ouyang, Ling Yue, Shimin Di, Libin Zheng, Linan Yue, Shaowu Pan, Jian Yin, Min-Ling Zhang

机构 * Sun Yat-sen University(中山大学) Rensselaer Polytechnic Institute(罗切斯特理工学院) Southeast University(东南大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 Code2MCP通过自动化将GitHub仓库转换为MCP兼容服务,解决现有MCP工具池不足的问题,促进MCP协议的普及与应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09372 2026-02-11 cs.CL 70%

AgentSkiller: Scaling Generalist Agent Intelligence through Semantically Integrated Cross-Domain Data Synthesis

AgentSkiller: 通过语义整合的跨领域数据合成提升通用智能代理能力

Zexu Sun, Bokai Ji, Hengyi Cai, Shuaiqiang Wang, Lei Wang, Guangxia Li, Xu Chen

机构 * AMU, Baidu Inc.(百度公司) School of Computer Science and Technology, Xidian University(西安电子科技大学计算机科学与技术学院) Singapore Management University(新加坡管理学院) Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 AgentSkiller通过语义整合的跨领域数据合成提升通用智能代理能力,生成高质量交互数据以增强模型功能调用性能。

Comments 33 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10919 2026-02-11 physics.flu-dyn cs.LG stat.ML 70%

A Physics-Informed Spatiotemporal Deep Learning Framework for Turbulent Systems

一种基于物理的时空深度学习框架用于湍流系统

Luca Menicali, Andrew Grace, David H. Richter, Stefano Castruccio

机构 * Department of Applied and Computational Mathematics and Statistics, University of University of Notre Dame(应用与计算数学与统计学系,诺特大学) Department of Environmental and Civil Engineering, University of Notre Dame(环境与土木工程系,诺特大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出了一种基于物理的时空深度学习框架,用于高效模拟湍流系统,结合卷积神经网络和递归架构,减少计算成本并提高物理可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21266 2026-02-10 cs.AI 70%

Rethinking Explainable Disease Prediction: Synergizing Accuracy and Reliability via Reflective Cognitive Architecture

重新思考可解释疾病预测:通过反思认知架构协同提升准确性和可靠性

Zijian Shao, Haiyang Shen, Mugeng Liu, Gecheng Fu, Yaoqi Guo, Yanfeng Wang, Yun Ma

机构 * Institute for Artificial Intelligence, Peking University School of Software \& Microelectronics, Peking University School of Computer Science, Peking University School of Life Sciences, Peking University Department of Comprehensive Oncology, National Cancer Center/National Clinical Research Center for Cancer/Cancer Hospital, Chinese Academy of Medical Sciences Peking Union Medical College Beijing, China

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出反思认知架构(RCA),通过经验与反思直接从表格数据学习,实现预测精度与解释可靠性的协同提升。

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04982 2026-02-10 cs.CL 70%

BioACE: An Automated Framework for Biomedical Answer and Citation Evaluations

BioACE: 一种用于生物医学答案和引用评估的自动化框架

Deepak Gupta, Davis Bartels, Dina Demner-Fushman

机构 * Division of Intramural Research(院内研究部) National Library of Medicine(国家医学图书馆)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 BioACE提出了一种自动化框架,用于评估生物医学答案和引用的质量,通过多方面指标和实验分析,提供最佳的评估方法。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06570 2026-02-09 cs.CL 70%

Baichuan-M3: Modeling Clinical Inquiry for Reliable Medical Decision-Making

Baichuan-M3:用于可靠医疗决策的临床查询建模

M3 Team, Chengfeng Dou, Fan Yang, Fei Li, Jiyuan Jia, Qiang Ju, Shuai Wang, Tianpeng Li, Xiangrong Zeng, Yijie Zhou, Hongda Zhang, Jinyang Tai, Linzhuang Sun, Peidong Guo, Yichuan Mo, Xiaochuan Wang, Hengfu Cui, Zhishou Zhang

机构 * Baichuan-M3 Team(Baichuan-M3团队)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 Baichuan-M3通过建模临床查询流程,实现了医疗决策支持的可靠性和准确性,优于现有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02071 2026-02-09 cs.AI 70%

Human-AI Co-Embodied Intelligence for Scientific Experimentation and Manufacturing

人类-人工智能协同具身智能用于科学实验与制造

Xinyi Lin, Yuyang Zhang, Yuanhang Gan, Juntao Chen, Hao Shen, Yichun He, Lijun Li, Ze Yuan, Shuang Wang, Chaohao Wang, Rui Zhang, Na Li, Jia Liu

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究提出人类-人工智能协同具身智能,通过智能体-物理实验系统提升科学实验与制造的精度与可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05930 2026-02-06 cs.DL cs.AI 70%

Compound Deception in Elite Peer Review: A Failure Mode Taxonomy of 100 Fabricated Citations at NeurIPS 2025

精英同行评审中的复合欺骗:100个2025年NeurIPS伪造引用的失败模式分类

Samar Ansari

机构 * School of Computing and Engineering Sciences University of Chester(计算与工程科学学院 英国切斯特大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究分析了NeurIPS 2025中100个伪造引用的失败模式,发现所有幻觉均表现出复合失败模式,揭示同行评审在验证引用时的不足,并提出强制自动引用验证的解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05692 2026-02-06 cs.CL 70%

MedErrBench: A Fine-Grained Multilingual Benchmark for Medical Error Detection and Correction with Clinical Expert Annotations

MedErrBench: 一种细粒度多语言基准,用于医疗错误检测与修正,带有临床专家注释

Congbo Ma, Yichun Zhang, Yousef Al-Jazzazi, Ahamed Foisal, Laasya Sharma, Yousra Sadqi, Khaled Saleh, Jihad Mallat, Farah E. Shamout

机构 * New York University Abu Dhabi(纽约大学阿布扎赫尔分校) New York University(纽约大学) University of Birmingham(伯明翰大学) Cleveland Clinic Abu Dhabi(克利夫兰医学中心阿布扎赫尔分校)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 MedErrBench是一个多语言医疗错误检测与修正基准,通过临床专家注释评估各类语言模型性能,揭示非英语环境中的性能差距,推动多语言临床NLP发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04617 2026-02-05 cs.CL 70%

LEAD: Layer-wise Expert-aligned Decoding for Faithful Radiology Report Generation

LEAD:逐层专家对齐解码以生成准确的放射学报告

Ruixiao Yang, Yuanhe Tian, Xu Yang, Huiqi Li, Yan Song

专题命中 领域大模型 :LLM(abstract);language model(abstract);分类 cs.CL

AI总结 LEAD通过逐层专家对齐解码方法,提升放射学报告生成的准确性并减少幻觉。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14132 2026-02-05 cs.HC cs.CL 70%

When Avatars Have Personality: Effects on Engagement and Communication in Immersive Medical Training

当虚拟角色有个性时:对沉浸式医学培训中参与度和沟通的影响

Julia S. Dollis, Iago A. Brito, Fernanda B. Färber, Pedro S. F. B. Ribeiro, Gustavo H. W. Barbosa, Andressa A. Bastos, Rafael T. Sousa, Arlindo R. Galvão Filho

机构 * Advanced Knowledge Center for Immersive Technologies (AKCIT)(沉浸式技术高级知识中心) University of Goiás (UFG)(戈亚斯大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出利用大型语言模型与模块化架构创建具有个性的虚拟患者,提升沉浸式医学培训中的参与度与沟通效果。

Comments 10 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02584 2026-02-04 cs.SE cs.AI cs.CR 70%

Constitutional Spec-Driven Development: Enforcing Security by Construction in AI-Assisted Code Generation

宪法式规范驱动开发:通过构建确保AI辅助代码生成中的安全

Srinivas Rao Marri

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究提出宪法规范驱动开发方法,通过在规范层嵌入不可协商的安全原则,有效减少AI生成代码中的安全缺陷,提升开发过程中的安全性。

Comments 15 pages, 2 figures, 5 tables, 11 code listings, 14 references. Includes reference implementation and compliance traceability matrix

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15113 2026-02-04 cs.CL 70%

Inferring Scientific Cross-Document Coreference and Hierarchy with Definition-Augmented Relational Reasoning

基于定义增强的 relational 推理进行科学跨文档指代与层次推断

Lior Forer, Tom Hope

机构 * The Hebrew University of Jerusalem(希伯来大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出基于定义增强的relational推理方法,用于科学文本中的跨文档指代和层次推断,通过生成上下文依赖的概念定义和关系定义,提升模型对复杂科学概念的推理能力。

Comments Accepted to TACL. Pre-MIT Press publication version

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23208 2026-02-03 cs.CL 70%

A Structured Framework for Evaluating and Enhancing Interpretive Capabilities of Multimodal LLMs in Culturally Situated Tasks

一种评估和增强多模态大语言模型在文化情境任务中解释能力的结构框架

Haorui Yu, Ramon Ruiz-Dolz, Qiufeng Yi

机构 * DJCAD, University of Dundee, United Kingdom(邓迪大学DJCAD部门) ARG-tech, SSEN, University of Dundee, United Kingdom(邓迪大学) School of Computer Science, University of Birmingham, United Kingdom(伯明翰大学计算机科学学院)

专题命中 领域大模型 :language model(abstract);prompting(abstract);分类 cs.CL

AI总结 本研究提出了一种结构框架,用于评估和增强多模态大语言模型在文化情境任务中生成中国绘画批评的能力,通过量化评价特征和人设引导提示,揭示了VLMs在艺术批评领域的表现与局限。

Comments EMNLP 2025 submission, 10 pages, 6 figures, 5 tables

Journal ref Findings of the Association for Computational Linguistics: EMNLP 2025, pages 1945-1971, Suzhou, China

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12985 2026-02-03 cs.CL 70%

Leveraging LLMs for Translating and Classifying Mental Health Data

利用大语言模型进行心理健康数据的翻译与分类

Konstantinos Skianis, A. Seza Doğruöz, John Pavlopoulos

机构 * Department of Computer Science and Engineering, University of Ioannina(计算机科学与工程系,希腊伊奥亚纳大学) LT3, IDLab, Universiteit Gent(LT3,IDLab,比利时根特大学) Department of Informatics, Athens University of Economics and Business(信息系,希腊经济与商业大学) Archimedes/AthenaRC, Greece(阿基米德/阿提卡RC,希腊)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究利用大语言模型在希腊语中检测抑郁症严重程度,发现GPT3.5-turbo在非英语语言中的表现不一致,强调了进一步研究和人类监督的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22948 2026-02-02 cs.AI 70%

Alignment among Language, Vision and Action Representations

语言、视觉和动作表征的一致性

Nicola Milano, Stefano Nolfi

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究通过训练Transformer智能体执行自然语言指令,发现语言、视觉和动作表征在跨模态中呈现部分共享的语义结构,支持模态无关的语义组织。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04213 2026-02-02 cs.CL 70%

AnimatedLLM: Explaining LLMs with Interactive Visualizations

AnimatedLLM: 用交互式可视化解释大语言模型

Zdeněk Kasner, Ondřej Dušek

机构 * Charles University Faculty of Mathematics and Physics Institute of Formal and Applied Linguistics(查尔斯大学数学与物理系形式与应用语言学研究所)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 AnimatedLLM通过交互式可视化帮助用户理解大语言模型的工作原理,提供分步的Transformer模型展示,适用于教学和自我学习。

Comments Accepted to TeachNLP @ EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏