arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Washington(华盛顿大学)

2026-02-05 至 2026-02-05 共收录 5
2602.04785 2026-02-05 cs.LG cs.AI

Team, Then Trim: An Assembly-Line LLM Framework for High-Quality Tabular Data Generation

团队后再修剪:一种用于高质量表格数据生成的流水线LLM框架

Congjing Zhang, Ryan Feng Lin, Ruoxuan Bao, Shuai Huang

机构 * Department of Industrial & Systems Engineering, University of Washington(华盛顿大学工业与系统工程系) Department of Management, Shanghai University(上海大学管理学院)

AI总结 Team-then-Trim框架通过协作LLMs生成高质量表格数据,并结合三阶段质量控制流程,有效解决表格数据稀缺和质量低的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22208 2026-02-05 cs.CL cs.CV cs.LG

Open-Source Multimodal Moxin Models with Moxin-VLM and Moxin-VLA

开源多模态Moxin模型:Moxin-VLM和Moxin-VLA

Pu Zhao, Arash Akbari, Xuan Shen, Zhenglun Kong, Yixin Shen, Sung-En Chang, Timothy Rupprecht, Lei Lu, Enfu Nan, Changdi Yang, Yumei He, Weiyan Shi, Xingchen Xu, Yu Huang, Wei Jiang, Wei Wang, Yue Chen, Yong He, Yanzhi Wang

机构 * Northeastern University(东北大学) Harvard University(哈佛大学) Cornell University(康奈尔大学) Tulane University(路易斯安那州立大学) University of Washington(华盛顿大学) Futurewei(未来通信) AIBAO LLC

AI总结 本文提出开源多模态Moxin模型,通过Moxin-VLM、Moxin-VLA和Moxin-Chinese三种变体,提升视觉-语言、视觉-语言-动作及中文任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04085 2026-02-05 cs.SD cs.CL

BASS: Benchmarking Audio LMs for Musical Structure and Semantic Reasoning

BASS:用于音乐结构和语义推理的音频语言模型基准测试

Min Jang, Orevaoghene Ahia, Nazif Tamer, Sachin Kumar, Yulia Tsvetkov, Noah A. Smith

机构 * University of Washington(华盛顿大学) The Ohio State University(俄亥俄州立大学) Allen Institute for AI(人工智能研究所)

AI总结 BASS通过评估音频语言模型在音乐结构和语义推理方面的性能,揭示了现有模型在高层次推理任务上的局限性,并为音乐推荐和搜索提供评估框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03973 2026-02-05 cs.RO cs.CV

VLS: Steering Pretrained Robot Policies via Vision-Language Models

VLS:通过视觉-语言模型引导预训练的机器人策略

Shuo Liu, Ishneet Sukhvinder Singh, Yiqing Xu, Jiafei Duan, Ranjay Krishna

机构 * University of Washington(华盛顿大学) University of Oxford(牛津大学) National University of Singapore(新加坡国立大学) Allen Institute for Artificial Intelligence(人工智能研究院)

AI总结 VLS通过视觉-语言模型在推理时引导预训练机器人策略,实现无需训练的适应,提升在不同环境下的表现。

Comments 11 Pages, Project page: https://vision-language-steering.github.io/webpage/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15605 2026-02-05 cs.CL cs.SI

ToxiTwitch: Toward Emote-Aware Hybrid Moderation for Live Streaming Platforms

ToxiTwitch:迈向面向表情的混合审核方法

Baktash Ansari, Elias Martin, Afra Mashhadi

机构 * University of Washington(华盛顿大学)

AI总结 ToxiTwitch通过结合LLM生成的文本和表情嵌入与传统机器学习分类器,提高Twitch直播平台对有毒行为的检测准确率。

Comments Exploratory study; prior versions submitted to peer review

详情

展开后加载摘要…

URL PDF HTML 收藏