KiVA: Kid-inspired Visual Analogies for Testing Large Multimodal Models
KiVA:儿童启发的视觉类比用于测试大多模态模型
Eunice Yiu, Maan Qraitem, Anisa Noor Majhi, Charlie Wong, Yutong Bai, Shiry Ginosar, Alison Gopnik, Kate Saenko
机构
*
University of California, Berkeley(加州大学伯克利分校)
;
Boston University(波士顿大学)
;
Google DeepMind(谷歌DeepMind)
;
Toyota Technological Institute at Chicago(芝加哥丰田技术研究所)
Provable Memory Efficient Self-Play Algorithm for Model-free Reinforcement Learning
可证明的内存高效自博弈算法用于无模型强化学习
Na Li, Yuchen Jiao, Hangguan Shan, Shefeng Yan
机构
*
College of Information Science and Electronic Engineering(信息科学与电子工程学院)
;
Zhejiang University(浙江大学)
;
School of Information and Electronics(信息与电子学院)
;
Beijing Institute of Technology(北京理工大学)
;
Institute of Acoustics(声学研究所)
;
Chinese Academy of Sciences(中国科学院)
Gaussian Universality in Neural Network Dynamics with Generalized Structured Input Distributions
神经网络动力学中的高斯普遍性与广义结构输入分布
Jaeyong Bae, Hawoong Jeong
机构
*
Department of Physics, Korea Advanced Institute of Science and Technology(韩国科学技术院物理系)
;
Center of Complex Systems, Korea Advanced Institute of Science and Technology(韩国科学技术院复杂系统中心)
NeuroGaze-Distill: Brain-informed Distillation and Depression-Inspired Geometric Priors for Robust Facial Emotion Recognition
NeuroGaze-Distill:基于脑科学的蒸馏与抑郁启发的几何先验用于鲁棒面部情绪识别
Zilin Li, Weiwei Xu, Xuanqi Zhao, Yiran Zhu
机构
*
School of Information and Intelligent Science(信息与智能科学学院)
;
Department of Computer(计算机系)
;
North China Electric Power University (BaoDing)(华北电力大学(保定))
CommentsPreprint. Vision-only deployment; EEG used to form static prototypes. Includes appendix, 7 figures and 3 tables. Considering submission to ICLR 2026. Revision note: This version corrects inaccuracies in the authors' institutional affiliations. No technical content has been modified
Breaking the Likelihood-Quality Trade-off in Diffusion Models by Merging Pretrained Experts
通过合并预训练专家打破扩散模型中似然-质量权衡
Yasin Esfandiari, Stefan Bauer, Sebastian U. Stich, Andrea Dittadi
机构
*
Saarland University(萨尔兰大学)
;
Helmholtz AI(亥姆霍兹人工智能研究所)
;
Technical University of Munich(慕尼黑技术大学)
;
CISPA Helmholtz Center for Information Security(亥姆霍兹信息安全部分研究所)
;
MPI for Intelligent Systems, Tübingen(图宾根智能系统研究所)
Accelerating Goal-Conditioned RL Algorithms and Research
加速目标条件强化学习算法与研究
Michał Bortkiewicz, Władysław Pałucki, Vivek Myers, Tadeusz Dziarmaga, Tomasz Arczewski, Łukasz Kuciński, Benjamin Eysenbach
机构
*
Warsaw University of Technology(华沙技术大学)
;
University of Warsaw(华沙大学)
;
UC Berkeley(伯克利大学)
;
Jagiellonian University(雅盖隆大学)
;
Polish Academy of Sciences(波兰科学院)
;
IDEAS NCBR
;
Princeton University(普林斯顿大学)
Neurocircuitry-Inspired Hierarchical Graph Causal Attention Networks for Explainable Depression Identification
受神经回路启发的分层图因果注意网络用于可解释的抑郁症识别
Weidao Chen, Yuxiao Yang, Yueming Wang
机构
*
MOE Frontier Science Center for Brain Science and Brain-machine Integration(脑科学与脑机融合前沿科学中心)
;
Nanhu Brain-computer Interface Institute(南湖脑机接口研究院)
;
School of Computer Science and Technology(计算机科学与技术学院)
;
Qiushi Academy for Advanced Studies(启硕高级研究院)
;
State Key Laboratory of Brain-machine Intelligence(脑机智能国家重点实验室)
;
The Department of Neurosurgery, Second Affiliated Hospital, School of Medicine, Zhejiang University Hangzhou, China(浙江大学医学院附属第二医院神经外科)
SePer: Measure Retrieval Utility Through The Lens Of Semantic Perplexity Reduction
SePer:通过语义困惑度降低的视角衡量检索效用
Lu Dai, Yijie Xu, Jinhui Ye, Hao Liu, Hui Xiong
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))
;
The Hong Kong University of Science and Technology(香港科学与技术大学)
;
Carnegie Mellon University(卡内基梅隆大学)
SVBench: A Benchmark with Temporal Multi-Turn Dialogues for Streaming Video Understanding
Zhenyu Yang, Yuhang Hu, Zemin Du, Dizhan Xue, Shengsheng Qian, Jiahong Wu, Fan Yang, Weiming Dong, Changsheng Xu
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Kuaishou Technology(快手科技)
;
Zhengzhou University(郑州大学)
;
ShanghaiTech University(上海科技大学)
;
Peng Cheng Laboratory(鹏城实验室)
MMTEB: Massive Multilingual Text Embedding Benchmark
Kenneth Enevoldsen, Isaac Chung, Imene Kerboua, Márton Kardos, Ashwin Mathur, David Stap, Jay Gala, Wissam Siblini, Dominik Krzemiński, Genta Indra Winata, Saba Sturua, Saiteja Utpala, Mathieu Ciancone, Marion Schaeffer, Gabriel Sequeira, Diganta Misra, Shreeya Dhakal, Jonathan Rystrøm, Roman Solomatin, Ömer Çağatan, Akash Kundu, Martin Bernstorff, Shitao Xiao, Akshita Sukhlecha, Bhavish Pahwa, Rafał Poświata, Kranthi Kiran GV, Shawon Ashraf, Daniel Auras, Björn Plüster, Jan Philipp Harries, Loïc Magne, Isabelle Mohr, Mariya Hendriksen, Dawei Zhu, Hippolyte Gisserot-Boukhlef, Tom Aarsen, Jan Kostkan, Konrad Wojtasik, Taemin Lee, Marek Šuppa, Crystina Zhang, Roberta Rocca, Mohammed Hamdy, Andrianos Michail, John Yang, Manuel Faysse, Aleksei Vatolin, Nandan Thakur, Manan Dey, Dipam Vasani, Pranjal Chitale, Simone Tedeschi, Nguyen Tai, Artem Snegirev, Michael Günther, Mengzhou Xia, Weijia Shi, Xing Han Lù, Jordan Clive, Gayatri Krishnakumar, Anna Maksimova, Silvan Wehrli, Maria Tikhonova, Henil Panchal, Aleksandr Abramov, Malte Ostendorff, Zheng Liu, Simon Clematide, Lester James Miranda, Alena Fenogenova, Guangyu Song, Ruqiya Bin Safi, Wen-Ding Li, Alessia Borghini, Federico Cassano, Hongjin Su, Jimmy Lin, Howard Yen, Lasse Hansen, Sara Hooker, Chenghao Xiao, Vaibhav Adlakha, Orion Weller, Siva Reddy, Niklas Muennighoff
机构
*
Aarhus University(奥胡斯大学)
;
Individual Contributor(个人贡献者)
;
Esker(Esker公司)
;
INSA Lyon(里昂INSA)
;
University of Amsterdam(阿姆斯特丹大学)
;
MBZUAI(穆罕默德·本·拉希德智能技术研究院)
;
Jina AI(Jina AI公司)
;
Microsoft Research(微软研究院)
;
Wikit(Wikit公司)
DICE: Discrete Inversion Enabling Controllable Editing for Multinomial Diffusion and Masked Generative Models
Xiaoxiao He, Quan Dao, Ligong Han, Song Wen, Minhao Bai, Di Liu, Han Zhang, Martin Renqiang Min, Felix Juefei-Xu, Chaowei Tan, Bo Liu, Kang Li, Hongdong Li, Junzhou Huang, Faez Ahmed, Akash Srivastava, Dimitris Metaxas
机构
*
Rutgers University(新泽西罗格斯大学)
;
MIT-IBM Watson AI Lab(MIT-IBM沃森人工智能实验室)
;
Red Hat AI Innovation(红帽AI创新)
;
Google DeepMind(谷歌DeepMind)
;
NYU(纽约大学)
;
Walmart Global Tech(沃尔玛全球技术)
;
NEC Labs America(NEC美国实验室)
;
Massachusetts Institute of Technology(麻省理工学院)
;
ANU(澳大利亚国立大学)
;
UT Arlington(德克萨斯大学阿灵顿分校)
CommentsProject webpage: https://hexiaoxiao-cs.github.io/DICE/. This paper was accepted to CVPR 2025 but later desk-rejected post camera-ready, due to a withdrawal from ICLR made 14 days before reviewer assignment
Nova: Generative Language Models for Assembly Code with Hierarchical Attention and Contrastive Learning
Nan Jiang, Chengxiao Wang, Kevin Liu, Xiangzhe Xu, Lin Tan, Xiangyu Zhang, Petr Babkin
机构
*
Purdue University(普渡大学)
;
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Lynbrook High School(林布罗克高中)
;
J.P. Morgan AI Research(摩根大通人工智能研究)
CommentsPublished as a conference paper at ICLR 2025