arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Columbia University(哥伦比亚大学)

2026-02-16 至 2026-02-16 共收录 3
2602.13028 2026-02-16 cs.CV cs.CL

Human-Aligned MLLM Judges for Fine-Grained Image Editing Evaluation: A Benchmark, Framework, and Analysis

面向细粒度图像编辑评估的人类对齐MLLM评判:一个基准、框架和分析

Runzhou Liu, Hailey Weingord, Sejal Mittal, Prakhar Dungarwal, Anusha Nandula, Bo Ni, Samyadeep Basu, Hongjie Chen, Nesreen K. Ahmed, Li Li, Jiayi Zhang, Koustava Goswami, Subhojyoti Mukherjee, Branislav Kveton, Puneet Mathur, Franck Dernoncourt, Yue Zhao, Yu Wang, Ryan A. Rossi, Zhengzhong Tu, Hongru Du

机构 * University of Virginia(弗吉尼亚大学) Columbia University(哥伦比亚大学) Vanderbilt University(范德比大学) Adobe Research(Adobe研究) Dolby Laboratories(杜比实验室) Cisco Research(思科研究) University of Southern California(南加州大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校) University of Oregon(俄勒冈大学) Texas A&M University(德克萨斯大学)

AI总结 本文提出细粒度MLLM评判框架,通过分解十二个可解释因素,提升图像编辑评估的精度与实用性,为研究和改进图像编辑方法提供实用基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04166 2026-02-16 cs.LG stat.CO stat.ML

N$^2$: A Unified Python Package and Test Bench for Nearest Neighbor-Based Matrix Completion

N²:一种统一的Python包和测试平台,用于基于最近邻的矩阵补全

Caleb Chin, Aashish Khubchandani, Harshvardhan Maskara, Kyuseong Choi, Jacob Feitelberg, Albert Gong, Manit Paul, Tathagata Sadhukhan, Anish Agarwal, Raaz Dwivedi

机构 * Cornell University(康奈尔大学) Columbia University(哥伦比亚大学) University of Pennsylvania(宾夕法尼亚大学)

AI总结 本文提出N²,一种统一的Python包和测试平台,用于基于最近邻的矩阵补全,展示了新的NN变体和现实世界数据集的基准测试,证明NN方法在现实应用中的优越性。

Comments 21 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12631 2026-02-16 cs.AI cs.HC cs.LG

AI Agents for Inventory Control: Human-LLM-OR Complementarity

面向库存控制的AI代理:人类-大语言模型-运筹学互补性

Jackie Baek, Yaopeng Fu, Will Ma, Tianyi Peng

机构 * Stern School of Business, New York University(纽约大学斯特恩商学院) Columbia University(哥伦比亚大学) Graduate School of Business and Data Science Institute, Columbia University(哥伦比亚大学商学院与数据科学研究院)

AI总结 本文研究了人类、大语言模型和运筹学算法在库存控制中的互补性,通过实验发现人机协作能提升利润,且大量个体从中受益。

详情

展开后加载摘要…

URL PDF HTML 收藏