UNIVID: Unified Vision-Language Model for Video Moderation
UNIVID:用于视频审核的统一视觉语言模型
机构 * Bytedance(字节跳动)
AI总结 提出UNIVID统一视觉语言模型,通过生成可解释的策略感知字幕,实现端到端视频审核,减少违规泄露42.7%和过度审核率37.0%。
Comments 7 pages, 3 figures. Accepted to ACL 2026 Industry Track
大厂专区
UNIVID:用于视频审核的统一视觉语言模型
机构 * Bytedance(字节跳动)
AI总结 提出UNIVID统一视觉语言模型,通过生成可解释的策略感知字幕,实现端到端视频审核,减少违规泄露42.7%和过度审核率37.0%。
Comments 7 pages, 3 figures. Accepted to ACL 2026 Industry Track
可微分高效算子搜索
机构 * The University of Sydney(悉尼大学) ; ByteDance(字节跳动) ; Shanghai Jiao Tong University(上海交通大学) ; University of California, Los Angeles(加州大学洛杉矶分校)
AI总结 提出可微分高效算子搜索框架,统一解释多种token缩减算子,通过联合搜索缩减位置、保留数量和算子行为,在预算约束下优化多模态模型性能。