arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视觉大模型 / VLM

视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。

共收录 7464 信号源:cs.CV, cs.AI, cs.LG

1. 视觉定位与Grounding 7464 篇

2607.17977 2026-08-03 cs.RO 版本更新 50%

RynnBrain 1.1: Towards More Capable and Generalizable Embodied Foundation Model

RynnBrain 1.1:迈向更具能力和通用性的具身基础模型

Kehan Li, Bohan Hou, Minghao Zhu, Tianyi Zhang, Zesen Cheng, Zhikai Wang, Sicong Leng, Xin Li, Xiao Lin, Biying Yao, Minghua Zeng, Jiangpin Liu, Ronghao Dang, Jiayan Guo, Siteng Huang, Haoyu Zhao, Heng Ping, Yaxi Zhao, Tong Zhao, Kexiang Wang, Tong Lu, Shengke Xue, Jiahao Tang, Yulei Wang, Zejing Wang, Jianwei Gao, Shijian Lu, Chengju Liu, Jianfei Yang, Mingxiu Chen, Deli Zhao

机构 * DAMO Academy, Alibaba Group(达摩院,阿里巴巴集团) Hupan Lab(湖畔实验室)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 介绍RynnBrain 1.1具身基础模型家族,其经统一框架训练,相比1.0版本有改进。开发RynnBrain - VLA并部署。该模型在多方面成果显著,初始化策略表现优,联合训练提升了得分和成功率。

Comments KL,BH,MZ,TZ,ZC,ZW,SL,XL,XL,BY,MZ,JL,RD contribute equally. Project Lead: Kehan Li and Xin Li project: https://alibaba-damo-academy.github.io/RynnBrain github: https://github.com/alibaba-damo-academy/RynnBrain huggingface: https://huggingface.co/collections/Alibaba-DAMO-Academy/rynnbrain-11 modelscope: https://modelscope.cn/collections/DAMO_Academy/RynnBrain-11

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28252 2026-07-31 stat.ME 新提交 50%

Improving Discrepancy Measures for Global Sensitivity Analysis

改进用于全局敏感性分析的差异度量方法

Samuele Lo Piano, Alessio Lachi, Razi Sheikholeslami, Arnald Puy, Pamphile Tupui Roy, Andrea Saltelli

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 本文提出一种调整后的替代差异度量方法,通过秩变换与摩尔邻域插补改进全局敏感性分析,经多基准测试,该方法在非光滑水文输出上实现完美秩一致性,且网格分辨率是性能变异性的核心驱动因素。

Comments 25 pages, 9 figures, 11 tables, two supplementary files

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27682 2026-07-31 cs.IR 新提交 50%

Restoring Collaborative Signals in Semantic-ID Generative Recommendation via Personalized Natural Language

通过个性化自然语言恢复语义-ID生成式推荐中的协同信号

Changjiang Han, Qingyang Li, Yaqiang Zang, Jikun Kang, Pinghua Gong, Xue Liu, Bowei He

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 该研究针对基于LLM的生成式推荐模型中SID丢失协同信号导致准确率受限的问题,提出个性化自然语言引导的框架,通过添加分层协同线索恢复信号,提升推荐准确率。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27212 2026-07-31 cs.HC cs.CL 新提交 50%

Digital Harf: A Clinically Integrated Multimodal AI System for Pervasive Arabic Speech and Language Therapy

Digital Harf:用于普及型阿拉伯语言语和语言治疗的临床整合多模态AI系统

Asif Azad, Mohammad Sadat Hossain, MD Sadik Hossain Shanto, Sabri Boughorbel, Abdulrhman Aljouie, Bdour Alwuqaysi, Yahya Bokhari, Ayah Othman Sindi, Ehsan Hoque

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 Digital Harf是专为阿拉伯语自闭症儿童设计的多模态AI治疗平台,其核心Agentic合成数据引擎解决阿拉伯语治疗内容短缺问题,获专家高接受率,为代表性语言环境构建AI治疗系统提供了思路。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02383 2026-07-31 cs.CL 版本更新 50%

MEDIAREF: A Public Knowledge Store for Media Background Checks

了解你的来源:用于媒体背景核查的公共知识库

Benjamin Nichols, Michael Schlichtkrull, Nedjma Ousidhoum

机构 * Cardiff University(卡迪夫大学) Queen Mary University of London(伦敦大学女王学院)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 针对检索增强生成中证据来源可靠性问题,提出公开知识库MEDIAREF,支持可复现的低成本媒体背景核查生成,评估多种大语言模型并证明其有效性。

Comments Code and Data: https://github.com/nedjmaou/mediaref

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12507 2026-07-31 cs.CL cs.CY 版本更新 50%

Towards Structurally Explainable Machine-Generated Text Detection: A Graph-Perspective Framework

面向结构可解释的机器生成文本检测:一种图视角框架

Xu Zheng, Zhuomin Chen, Esteban Schafir, Sipeng Chen, Hojat Allah Salehi, Haifeng Chen, Farhad Shirani, Mo Sha, Wei Cheng, Dongsheng Luo

机构 * Florida International University(佛罗里达国际大学) NEC Laboratories America(NEC美洲实验室)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 针对机器生成文本检测的黑箱局限,本文提出 \textsc{LM$^2$otifs} 图视角框架,通过词汇共现图与图神经网络实现检测,其结构基序的可解释性与性能均优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26409 2026-07-30 cs.NI 新提交 50%

Can We Trust AI in 6G? Verifiable and Auditable AI-Driven Trustworthy Wireless Networks

我们能信任6G中的AI吗?可验证且可审计的AI驱动可信无线网络

Genze Jiang, Yizhou Huang, Kezhi Wang

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 针对6G中AI在无线网络应用的信任问题,提出基于3GPP规范的机械审计方法与原生审计网络架构,支持AI功能的部署前认证和运行时审计,为AI驱动的可信无线网络提供解决方案。

Comments Submitted for possible journal publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26178 2026-07-30 cs.CL 新提交 50%

DuplexGen: Adaptive Synthesis of Human-AI Turn-Taking Dialogues

DuplexGen:人机交替对话的自适应合成

Takyoung Kim, Kang-wook Kim, Sang Hoon Woo, Julia Hirschberg, Gunhee Kim, Dilek Hakkani-Tür

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Seoul National University(首尔大学) Columbia University(哥伦比亚大学) University of California, Berkeley(加州大学伯克利分校) Georgia Institute of Technology(佐治亚理工学院)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 DuplexGen框架通过将LLM预测与少量槽级人类偏好标注校准,生成场景自适应交替发言对话,契合人类偏好的效果优于未校准方法,证明人类校准对交替发言合成场景特定性的关键作用。

Comments Manuscript under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12791 2026-07-30 eess.SY cs.SY 版本更新 50%

The GIST Korea Test System: A Public-Data Synthetic Model of the Korean Power Grid

GIST 2064节点测试系统:韩国电网的公开数据合成模型

Yun-Su Kim

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 基于公开数据构建韩国电网2064节点合成模型,采用多源最短路径重组OpenStreetMap电力层布局,校准线路长度至国家统计值,并验证了潮流收敛性。

Comments 14 pages, 5 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25329 2026-07-29 cs.IR 新提交 50%

Grevo: A Unified Generative Recommendation Framework with Evolutionary Item Indexing

Grevo:一种具有进化项索引的统一生成式推荐框架

Huanjie Wang, Liwei Guan, Zekai Sun, Hongwei Zhang, Honghui Bao

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究针对生成式推荐中语义标识符固定及端到端方法问题,提出Grevo框架,将SID分配当作可进化变量,基于单一多任务推荐器统一相关任务,用进化项索引重分配标识符,实验证明其性能优于现有生成式推荐方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24976 2026-07-29 quant-ph gr-qc hep-th 新提交 50%

Quantum reference frames beyond subsystems: a reconstruction and generalization of the perspective-neutral framework

超越子系统的量子参考系:视角中性框架的重构与推广

Stefan L. Ludescher, Manuel Mekonnen, Thomas D. Galley, Markus P. Mueller

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究将量子参考系概念推广到对应协变量子仪器的情况,开启多种物理应用,如标记框架、关系时钟等。重构并推广了视角中性方法,提供资源理论基础,澄清约束量子化,部分结果适用于其他框架,弥合相关研究差距。

Comments 36+6 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22669 2026-07-29 physics.chem-ph 版本更新 50%

DeepHartree: A Poisson-Coupled Neural Field for One-Shot Density Functional Theory

DeepHartree:一种与泊松方程耦合的神经场,用于可扩展的密度泛函理论

Jiankun Wu, Jinming Fan, Chao Qian, Shaodong Zhou

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 DeepHartree通过与泊松方程耦合的神经场,加速了线性组合原子轨道密度泛函理论的SCF求解,解决了计算瓶颈问题,实现了跨基组和系统的零样本迁移能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23340 2026-07-28 cs.DB 新提交 50%

ABISS: Evaluating Text-to-SQL Systems Through Agent Interaction

ABISS:通过代理交互评估文本到SQL系统

Giovanni Sullutrone, Luca Sala, Sania Aftar, Georgia Koutrika, Sonia Bergamaschi

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究针对文本到SQL系统在处理现实模糊问题的不足,提出统一分类法、多代理生成管道及动态模拟环境ABISS。通过实验揭示模型在子类别分类和澄清条件下SQL生成的瓶颈,提供真实类别虽有收益,但模糊问题执行率仍低,且发布相关代码。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23272 2026-07-28 cs.CR cs.SE 新提交 50%

From Signals to Behaviors: Evidence-Based Android Malware Detection

从信号到行为:基于证据的安卓恶意软件检测

Shiwen Song, Yiheng Xiong, Sen Chen, Xiaofei Xie

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究安卓恶意软件检测问题,提出Praxis方法,通过假设-确认-判断流程,从静态信号出发结合程序分析和上下文判断恶意行为。实验证明该方法检测性能优,能降低误报率并恢复细粒度行为,各阶段对性能均有贡献。

Comments 12 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22606 2026-07-28 cs.CY 新提交 50%

Auditing Institutional Heterogeneity for Generative AI in Patient Education: A Large-Scale Study of 102 US Transplant Handbooks

审核患者教育中生成式人工智能的机构异质性:对102本美国移植手册的大规模研究

Yubo Li, Rema Padman, Ramayya Krishnan

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究针对美国23个移植中心的102本手册及相关患者问题,用结构化输出大语言模型评判器审核。发现机构编辑风格超越器官类型界限,信息差距在特定主题突出,分歧主题聚类,且可由问题框架预测分歧,探讨了对移植护理中部署生成式人工智能的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24228 2026-07-28 cs.HC 50%

Sketch Bug: Using Sketch-Based Input for Interactive Code Debugging

Sketch Bug:使用基于草图的输入进行交互式代码调试

Helen Weixu Chen, Daniel Vogel

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究使用类似草图的笔输入作为交互式调试中执行控制的替代方式,通过手势识别与Python执行跟踪结合的原型系统,实验表明草图输入可支持断点设置、逐步执行等任务,但在精度、识别和手势记忆方面存在挑战。

Comments Accepted at Graphics Interface 2026 (GI 2026). 9 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22226 2026-07-27 cs.RO 新提交 50%

Offline Vision-Language Navigation with Geometric Goal Localization for Outdoor Environments

用于户外环境的基于几何目标定位的离线视觉语言导航

Ali Salmasi, Xianjia Yu, Tomi Westerlund

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究针对户外环境下的离线视觉语言导航,通过对17个可边缘部署的SLM与4个在线API进行基准测试,提出轻量级混合语义几何目标定位框架并集成到Edge-BehAV中,提升了性能,降低目标距离误差,实现无网络连接下的有效导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22082 2026-07-27 cs.MA 新提交 50%

When Language Models Meet NeuroGraphs: Exploring Enhanced Agentic LLM Framework Towards Brain Network Analysis

当语言模型遇上神经图谱:探索用于脑网络分析的增强型智能语言模型框架

Jiaxing Li, Rui Dong, Muyao Tang, Youyong Kong

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究针对脑网络分析中现有方法解释性有限等问题,提出BrainAgent智能语言模型框架,将连接组分类设为迭代过程,经特定工具转换、知识检索等步骤生成结构化预测,实验证明其优于基线,为脑网络分析提供实用路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22020 2026-07-27 cs.RO 新提交 50%

Embodying Multi-Hand Manipulation Policies by Searching the Assignment and Null Spaces

通过搜索分配空间和零空间来体现多手操作策略

Yorai Shaoul, Jiaoyang Li, Maxim Likhachev

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究多臂机器人执行操作策略的问题,基于冲突搜索构建框架,通过搜索轨迹分配空间和零空间,统一处理分配与零空间运动,有效解决多手操作策略执行难题,实现多臂机器人协调操作。

Comments Published in SoCS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21961 2026-07-27 cs.CL 新提交 50%

On Improving Faithfulness of Podcasts from Documents

论提高基于文档的播客忠实度

Soumya Dutta, Tejas Indulal Dhamecha, Pannaga Shivaswamy

机构 * Indian Institute of Science(印度科学研究所) Adobe Research(Adobe研究院)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究基于文档的播客生成中的忠实度问题,构建数据集并用多个大语言模型生成记录,引入轮次级评判框架。发现先进模型也常生成无根据内容,提出catch - n - repair框架,实验证明该框架能提升播客生成的忠实度。

Comments Under Submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21769 2026-07-27 cs.HC 新提交 50%

From Grasping to Speaking: Generative AI-Based Environment-Grounded VR Communication Training for Autistic Individuals

从抓握到说话:基于生成式人工智能的自闭症个体环境基础VR沟通训练

Ziming Li, Roshan L. Peiris

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究探索基于生成式人工智能的VR沟通训练对自闭症个体的作用,通过9名受训者和7名教练参与的三种模式实验发现,C+O+G模式更受青睐,可用性和工作量相当,有助于沟通实践融入任务执行,还讨论了相关设计考量。

Comments 14 pages, ASSETS2026

Journal ref The 28th International ACM SIGACCESS Conference on Computers and Accessibility (ASSETS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15591 2026-07-27 cs.IR 版本更新 50%

RecGPT-V3 Technical Report

RecGPT-V3技术报告

Bowen Zheng, Chao Yi, Dian Chen, Gaoyang Guo, Han Zhu, Jiakai Tang, Jian Wu, Mao Zhang, Wen Chen, Yifan Lu, Yujie Luo, Yuning Jiang, Zhujin Gao, Bo Zheng, Chenchi Zhang, Dixuan Wang, Hao Fang, Jiancai Liu, Jing Yu, Junjun Zheng, Ke Chen, Kewei Zhu, Mengyan Li, Mingke Xu, Wenjun Yang, Xiangheng Kong, Xinming Zhang, Xunke Xi, Zile Zhou

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究针对大规模运行RecGPT的挑战,提出RecGPT-V3这一有状态混合模态推荐系统。通过内存中心、混合模态基础模型和潜在意图推理等方法,在淘宝“猜你喜欢”推荐中取得多指标提升及资源消耗降低的成果。

Comments Technique Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21462 2026-07-24 cs.CY 新提交 50%

White Box Evidence Packages for Policy Audit Reports

政策审计报告的白盒证据包

Seunghyun Yoo

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究在政策审计中评审者如何判断报告有无证据支持,引入可控评估框架,在多种证据条件下生成报告让评审员评估。结果显示内部证据影响报告引用推理方式,混合接口最有用,随机控制揭示风险,还将内部模型访问重构为证据设计问题。

Comments 16 pages, 5 figures. Presented at the Second Workshop on Technical AI Governance Research (TAIGR) at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13357 2026-07-24 cs.HC 版本更新 50%

TANDE: Disentangling Verbal and Nonverbal Backchannels in Emotional AI-Avatar Conversations with Young Adults

TANDE:在与年轻人的情感人工智能-虚拟化身对话中区分言语和非言语反馈渠道

Ann-Kareen Gedeus, Jack Good, Nadine Wagener, Angelique Taylor

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究在与年轻人的情感人工智能-虚拟化身对话中反馈渠道模式的影响,引入TANDE这个由LLM驱动的ECA,通过实验探讨其对融洽关系、同理心和参与度的作用及性别差异,得出相关设计启示。

Comments This paper has been accepted for publication at the 28th ACM International Conference on Multimodal Interaction (ICMI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20310 2026-07-23 q-bio.NC 新提交 50%

Capturing Inner Experience At Scale: An AI Interviewer Co-Developed with the Founder of a Landmark Phenomenological Method

大规模捕捉内心体验:与一种具有里程碑意义的现象学方法的创始人共同开发的人工智能访谈者

Jona Carmon, Clara Bersch, Charles Fernyhough, Russell T. Hurlburt, Simone Kühn

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究聚焦于主观体验研究中深度与规模的权衡问题,核心方法是将描述性经验抽样法转化为人工智能访谈者的推理架构,主要贡献是开发出首个基于既定方法研究内心体验的人工智能访谈者及相关平台。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18557 2026-07-22 physics.geo-ph 新提交 50%

AGENTS4GEOS: agentic platform for open-source multi-physics simulation

AGENTS4GEOS:用于开源多物理场模拟的智能体平台

Adriano M. A. Côrtes, Roberto M. Velho, Fernando A. Rochinha, Alvaro L. G. A. Coutinho, Mauricio Araya-Polo, Hervé Gross

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究针对多物理场模拟计算需求及训练数据集瓶颈,提出基于模型上下文协议的Agents4GEOS智能体框架,借助52个领域感知工具及协调器,自动化日常任务,助力专家专注工作挑战。

Comments 14 pages, 11 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17538 2026-07-21 cs.AR cs.CL cs.DB cs.ET cs.IR 新提交 50%

D-NOVA: In-Storage Retrieval Accelerator via Dual-Bound 3D NAND-Optimized Similarity Search with Vector Adaptation

D-NOVA:通过具有向量适配的双边界3D NAND优化相似性搜索实现存储内检索加速器

Chang Eun Song, Sumukh Pinge, Tianqi Zhang, Sung Eun Kim, Tajana S. Rosing, Mingu Kang

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究针对RAG密集向量检索性能瓶颈,提出软硬件协同设计的存储内检索加速器D-NOVA。通过深度嵌入搜索功能、采用新距离度量及引入适配器,实现高效检索,相比CPU和现有加速器有显著性能和能效提升,展现全存储向量搜索加速RAG的潜力。

Comments Accepted at the 59th IEEE/ACM International Symposium on Microarchitecture (MICRO 2026), Athens, Greece. Chang Eun Song and Sumukh Pinge are co-first authors and contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01224 2026-07-21 cs.CL 版本更新 50%

Lost in the Tower of Babel: The Adverse Effects of Incidental Multilingualism in LLMs

迷失在巴别塔中:LLMs中偶然多语言主义的负面影响

Anjishnu Mukherjee, Chutong Meng, Antonios Anastasopoulos

机构 * Department of Computer Science(计算机科学系) George Mason University(乔治·马歇尔大学)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 本文指出当前多语言NLP陷入偶然多语言主义的脆弱且误导性范式,导致模型在多语言情境中表现不均、脆弱且不透明,需转向设计驱动的多语言主义。

Comments Published as a conference paper at COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08879 2026-07-21 cs.CL 版本更新 50%

GRASP: Grounded CoT Reasoning with Dual-Stage Optimization for Multimodal Sarcasm Target Identification

GRASP:基于双阶段优化的 grounded CoT 推理用于多模态讽刺目标识别

Faxian Wan, Xiaocui Yang, Yifan Cao, Shi Feng, Daling Wang, Yifei Zhang

机构 * School of Computer Science and Engineering, Northeastern University(东北大学计算机科学与工程学院)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 GRASP通过整合视觉定位与显式Co-T推理,解决多模态讽刺目标识别中的细粒度定位问题,提出MSTI-MAX数据集和双阶段联合优化策略,实验表明其在多模态讽刺目标识别中表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12921 2026-07-21 cs.CL 50%

When Words Don't Mean What They Say: Figurative Understanding in Bengali Idioms

当词语不表示其意义:孟加拉成语的隐喻理解

Adib Sakhawat, Shamim Ara Parveen, Md Ruhul Amin, Shamim Al Mahmud, Md Saiful Islam, Tahera Khatun

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 本文提出一个包含10361个孟加拉成语的数据集,评估30种LLMs在隐喻理解任务上的表现,发现模型在跨语言和文化推理上存在显著不足。

Comments 9 pages, 5 figures. Accepted for presentation at LREC 2026 (Language Resources and Evaluation Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏