Efficient INT8 Single-Image Super-Resolution via Deployment-Aware Quantization and Teacher-Guided Training
高效INT8单图像超分辨率通过部署感知量化和教师引导训练
Pham Phuong Nam Nguyen, Nam Tien Le, Thi Kim Trang Vo, Nhu Tinh Anh Nguyen
机构
*
University of Information Technology(信息技术大学)
;
Ho Chi Minh City University of Technology(胡志明市技术大学)
;
Vietnam National University, Ho Chi Minh City(胡志明市国家大学)
Towards Reliable Human Evaluations in Gesture Generation: Insights from a Community-Driven State-of-the-Art Benchmark
迈向可靠的 gesture 生成人类评估:来自社区驱动的最新基准的见解
Rajmund Nagy, Hendric Voss, Thanh Hoang-Minh, Mihail Tsakov, Teodor Nikolov, Zeyi Zhang, Tenglong Ao, Sicheng Yang, Shaoli Huang, Yongkang Cheng, M. Hamza Mughal, Rishabh Dabral, Kiran Chhatre, Christian Theobalt, Libin Liu, Stefan Kopp, Rachel McDonnell, Michael Neff, Taras Kucherenko, Youngwoo Yoon, Gustav Eje Henter
机构
*
KTH Royal Institute of Technology(皇家理工学院)
;
Bielefeld University(比勒菲尔德大学)
;
University of Science – VNUHCM(越南胡志明市国家大学)
;
Independent Researcher(独立研究者)
;
Motorica AB(Motorica AB公司)
;
Peking University(北京大学)
;
Tsinghua University(清华大学)
;
Astribot(Astribot公司)
;
Max-Planck Institute for Informatics, SIC(马克斯·普朗克信息研究所,SIC)
;
Trinity College Dublin(都柏林大学)
;
University of California, Davis(加州大学戴维斯分校)
;
SEED – Electronic Arts(SEED–电子艺界)
;
Electronics and Telecommunications Research Institute (ETRI)(电子电信研究院)
AdaMMS: Model Merging for Heterogeneous Multimodal Large Language Models with Unsupervised Coefficient Optimization
AdaMMS: 为异构多模态大语言模型设计的模型融合方法
Yiyang Du, Xiaochen Wang, Chi Chen, Jiabo Ye, Yiru Wang, Peng Li, Ming Yan, Ji Zhang, Fei Huang, Zhifang Sui, Maosong Sun, Yang Liu
机构
*
Dept. of Comp. Sci. & Tech., Institute for AI, Tsinghua University(计算机科学与技术系,人工智能研究院,清华大学)
;
Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR),清华大学)
;
State Key Laboratory of Multimedia Information Processing, Peking University(多媒体信息处理国家重点实验室,北京大学)
;
School of Software Microelectronics, Peking University(软件微电子学院,北京大学)
;
Institute of Intelligent Computing, Alibaba Group(智能计算研究院,阿里巴巴集团)
;
Shanghai Artificial Intelligence Laboratory, Shanghai, China(上海人工智能实验室,上海,中国)
;
Jiangsu Collaborative Innovation Center for Language Competence, Jiangsu, China(江苏省语言能力协同创新中心,江苏,中国)
;
ModelTC Open Source Organization, Beijing, China(ModelTC开源组织,北京,中国)
CommentsAccepted at the 5th Workshop on Federated Learning for Computer Vision (FedVision), CVPR 2026. Sina Gholami and Abdulmoneam Ali contributed equally
GeoRelight: Learning Joint Geometrical Relighting and Reconstruction with Flexible Multi-Modal Diffusion Transformers
GeoRelight: 基于灵活多模态扩散变换器的联合几何重照明与重建
Yuxuan Xue, Ruofan Liang, Egor Zakharov, Timur Bagautdinov, Chen Cao, Giljoo Nam, Shunsuke Saito, Gerard Pons-Moll, Javier Romero
机构
*
Codec Avatars Lab, Meta(Meta编码器动画实验室)
;
University of Tübingen(图宾根大学)
;
Max Planck Institute for Informatics, Saarland Informatics Campus(马克斯·普朗克信息学院,萨尔兰信息校园)
机构
*
Zhejiang University(浙江大学)
;
State Key Laboratory of CAD & CG(计算机辅助设计与图形学国家重点实验室)
;
Ant Group(蚂蚁集团)
;
Westlake University(西湖大学)
;
Zhejiang University of Technology(浙江工业大学)