FicSim: A Dataset for Multi-Faceted Semantic Similarity in Long-Form Fiction
FicSim:一个多维度语义相似性数据集用于长篇小说
AI总结 FicSim 是一个用于长篇小说多维度语义相似性评估的数据集,通过作者元数据和数字人文学者验证,评估了多种嵌入模型在表面特征与语义类别上的表现。
Comments Published in Findings of EMNLP 2025
期刊&会议
Conference on Empirical Methods in Natural Language Processing · 会议 · Natural Language Processing
FicSim:一个多维度语义相似性数据集用于长篇小说
AI总结 FicSim 是一个用于长篇小说多维度语义相似性评估的数据集,通过作者元数据和数字人文学者验证,评估了多种嵌入模型在表面特征与语义类别上的表现。
Comments Published in Findings of EMNLP 2025
Astra:面向具身指令跟随的高效Transformer架构与对比动态学习
机构 * Department of Computer Science and Engineering, The Chinese University of Hong Kong(计算机科学与工程系,香港中文大学) ; Huawei Noah’s Ark Lab(华为诺亚实验室)
AI总结 Astra通过引入轨迹注意力和对比动态学习目标,提升了具身指令跟随任务中多模态序列处理的效率与准确性。
Comments Accepted to EMNLP 2025 (main). Published version: https://aclanthology.org/2025.emnlp-main.688/ Code available at: https://github.com/yueen-ma/Astra
CulturalFrames: 评估文本到图像模型与评估指标中的文化期望一致性
机构 * Mila – Quebec AI Institute(魁北克AI研究院) ; Université de Montréal(蒙特利尔大学) ; McGill University(麦吉尔大学) ; Google Research(谷歌研究) ; Google DeepMind(谷歌DeepMind) ; Samsung - SAIT AI Lab(三星-SAIT人工智能实验室) ; ETH AI Center(苏黎世联邦理工学院人工智能中心)
AI总结 CulturalFrames研究了文本到图像模型在文化期望一致性方面的表现,发现模型在显性和隐性文化期望上均存在显著遗漏,揭示了现有评估指标与人类判断的相关性不足,提出了改进文化意识模型的方向。
Comments Accepted to EMNLP 2025 Findings