arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Cambridge(剑桥大学)

2026-08-28 至 2026-08-28 共收录 3
2608.01942 2026-08-28 cs.CV cs.CL cs.MM 版本更新

CultureVidBench: Benchmarking Cultural Understanding in Text-to-Video Generation

CultureVidBench:文本到视频生成中的文化理解基准测试

Xianjing Han, Yuhan Su, Yang Deng, Dong Ma, Wee Peng Tay, Bin Zhu

机构 * Nanyang Technological University(南洋理工大学) Centrale Supélec(中央高等电力学院) Singapore Management University(新加坡管理大学) University of Cambridge(剑桥大学)

AI总结 本研究推出CultureVidBench基准,评估7款T2V模型的文化理解能力,发现现有模型难捕捉细粒度文化细节,尤其针对代表性不足的文化区域与线索。

Comments EMNLP 2026 Main Conference, Project page: this https URL (https://hanxjing.github.io/CultureVidBench/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08000 2026-08-28 cs.CL cs.AI 版本更新

Summarization is Not Dead Yet

摘要生成尚未消亡

Dongqi Liu, Chenxi Whitehouse, Zheng Zhao, Zhuchen Cao, Jian Li, Yabiao Wang

机构 * Saarland University(萨尔大学) Max Planck Institute for Informatics(马克斯·普朗克信息学研究所) University of Cambridge(剑桥大学) University of Edinburgh(爱丁堡大学) Zhejiang University(浙江大学) Tencent YouTu Lab(腾讯优图实验室)

AI总结 通过多维度评估,发现人类参考摘要在信息量和忠实度上仍优于大语言模型,后者仅在表面连贯性和流畅性上占优,表明摘要生成研究仍有挑战。

Comments EMNLP 2026 Main & Long Conference Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15129 2026-08-28 cs.CL cs.AI cs.HC 版本更新

The BS-meter: Detecting Politics and Labour through ChatGPT's Language

BS-计:通过ChatGPT的语言检测政治与劳工相关议题

Alessandro Trevisan, Harry Giddens, Sarah Dillon, Alan F. Blackwell

机构 * University of Cambridge(剑桥大学)

AI总结 本文对比科学文献与ChatGPT生成文本的语言特征,构建扯淡的统计模型,探究其能否关联法兰克福式人工扯淡与政治、职场语境中的自然扯淡,相关成果可用于通过ChatGPT语言检测政治与劳工议题。

Comments 17 pages, 5 figures. Accepted for publication in AI&SOCIETY

详情

展开后加载摘要…

URL PDF HTML 收藏