arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

Conference on Empirical Methods in Natural Language Processing · 会议 · Natural Language Processing

2026-08-19 至 2026-08-19 共收录 2
2608.17583 2026-08-19 cs.CL 新提交

Auditing Exposure to Harmful Content on TikTok using Multimodal Language Models: A Cross-National, Age-Stratified Study

使用多模态语言模型对TikTok上的有害内容暴露情况进行审计:一项跨国、按年龄分层的研究

Hamidreza Saffari, Francesco Pierri

机构 * Politecnico di Milano(米兰理工大学)

AI总结 本研究使用多模态大语言模型Gemini 2.5 Flash,在法、意、瑞三国对TikTok开展跨国年龄分层审计,发现关键词搜索会大幅提升有害内容占比,意国各年龄组有害内容占比最高,平台安全过滤器低估了明确有害内容。

Comments 20 pages, 16 figures, 14 tables. Accepted to Findings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.11930 2026-08-19 cs.CL cs.AI cs.LG 版本更新

The Authenticity Gap in Human Evaluation

人类评估中的真实性差距

Kawin Ethayarajh, Dan Jurafsky

AI总结 该研究发现NLG评估的标准人工评分协议存在真实性差距,因隐含假设被违反导致无法准确反映人类偏好,提出适用于开放式任务的SPA协议,且SPA能更准确恢复GPT-3模型的排序。

Comments EMNLP 2022

详情

展开后加载摘要…

URL PDF HTML 收藏