LakeFM: Toward a Foundation Model for Aquatic Ecosystems Using Irregular Multivariate Multi-depth Time Series Data
LakeFM:基于不规则多变量多深度时间序列数据的水生生态系统基础模型
Abhilash Neog, Sepideh Fatemi, Medha Sawhney, Kazi Sajeed Mehrab, Aanish Pradhan, Bennett J. McAfee, Emma Marchisin, Arka Daw, Robert Ladwig, Cayelan C. Carey, Paul Hanson, Anuj Karpatne
机构
*
Virginia Tech(弗吉尼亚理工大学)
;
Grand Valley State University(大峡谷州立大学)
;
University of Wisconsin - Madison(威斯康星大学麦迪逊分校)
;
Amazon AGI(亚马逊AGI)
;
Aarhus University(奥胡斯大学)
RAIL: Rethinking Auditory Intelligence in Large Audio-Language Models with a CHC-Grounded Benchmark
RAIL: 基于CHC框架重新思考大型音频语言模型中的听觉智能
Hongyu Jin, Siyi Wang, Yang Xiao, Jiaheng Dong, Shihong Tan, Kaiyuan peng, Georgiana Juravle, Shanquan Chen, Gongping Huang, Hong Jia, Eun-Jung Holden, James Bailey, Ting Dang
机构
*
School of Computing and Information Systems, The University of Melbourne(墨尔本大学计算与信息系统学院)
;
Faculty of Psychology and Educational Sciences, Alexandru Ioan Cuza University of Iași(亚历山德鲁伊万库扎大学心理学与教育科学学院)
;
School of Electronic Information, Wuhan University(武汉大学电子信息学院)
;
School of Public Health, The University of Hong Kong(香港大学公共卫生学院)
;
School of Computer Science, The University of Auckland(奥克兰大学计算机科学学院)
;
Department of Data Science and Artificial Intelligence, Monash University(莫纳什大学数据科学与人工智能系)
Visual Prompting Meets Feature Reconstruction-Based Anomaly Detection with Dual-Teacher Supervision
视觉提示结合基于特征重建的双教师监督异常检测
Mateo Diaz-Bone, Daniel Caraballo, Florian Scheidegger, Thomas Frick, Mattia Rigotti, Andrea Bartezzaghi, Roy Assaf, Niccolo Avogaro, Yagmur G. Cinar, Brown Ebouky, Filip M. Janicki, Piotr S. Kluska, Cezary Skura, Cristiano Malossi
机构
*
Dwarkadas Jivanlal Sanghvi College of Engineering(达沃拉斯·吉万拉尔·桑格维工程学院)
;
King’s College London(伦敦国王学院)
;
Indian Institute of Technology Jodhpur(印度理工学院朱罗普尔)
MMBU: A Massive Multi-modal Biomedical Understanding Benchmark to Probe the Perception Capabilities of Vision-Language Models
MMBU: 大规模多模态生物医学理解基准,用于探测视觉语言模型的感知能力
Ryan D'Cunha, Alejandro Lozano, Xiaoxiao Sun, Daniel Vela Jarquin, Min Woo Sun, Josiah Aklilu, James Burgess, Yuhui Zhang, Ryan Nayebi, Paola Avila, Robayo, Jin Ye, Ming Hu, Zhongying Deng, Junjun He, Xin Chen, Yue Yao, Robert Tibshirani, Jeffrey J. Nirschl, Serena Yeung-Levy
机构
*
Stanford University(斯坦福大学)
;
University of Wisconsin–Madison(威斯康星大学麦迪逊分校)
;
Instituto Tecnológico de Monterrey(蒙特雷技术学院)
;
Monash University(墨尔本大学)
;
University of Cambridge(剑桥大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
Shandong University(山东大学)
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Tsinghua University(清华大学)
;
The Hong Kong University of Science and Technology(香港科技大学)
;
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
Lightspeed Studios, Tencent(腾讯光速工作室)
专题命中
评测与基准
:LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AnchorBench: A Multi-Pathway Benchmark for the Anchoring Effect in LLMs
AnchorBench:针对大语言模型中锚定效应的多路径基准测试
Yiderigun Borjigin, Alexander Hermann, Christian Cyron, Roland Aydin
机构
*
Saarland University(萨尔大学)
;
Hamburg University of Technology(汉堡工业大学)
;
Helmholtz-Zentrum Hereon(亥姆霍兹中心赫伦)
;
German Research Centre for Artificial Intelligence (DFKI)(德国人工智能研究中心(DFKI))
专题命中
评测与基准
:LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
On the Systematic Challenges of Culturally Loaded Machine Translation: Dream of the Red Chamber as the Cultural Lens
论文化负载机器翻译的系统性挑战:以《红楼梦》为文化视角
Yiming Wang, Jiayuan Di
机构
*
School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学与工程系)
;
School of Foreign Languages, East China University of Science and Technology(华东理工大学外国语学院)
;
Mejiro University(目白大学)
专题命中
评测与基准
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
WrAFT: a Modularized Automated Writing Evaluation System for Argumentative Essays
WrAFT:一种用于议论文的模块化自动写作评估系统
Adnan Labib, Yixuan Huang, Jiahui Wu, John Maurice Gayed, Zheng Yuan, Qiao Wang
机构
*
Department of Informatics, King’s College London(伦敦国王学院信息学系)
;
Waseda University(早稻田大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
University of Sheffield(谢菲尔德大学)
;
Hosei University(法政大学)
专题命中
评测与基准
:large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI
LessonBench-V1: A Benchmark Dataset for Evaluating AI Lesson Generation Agents
LessonBench-V1:用于评估人工智能课程生成代理的基准数据集
Ravidu Suien Rammuni Silva, Ahmad Lotfi, Isibor Kennedy Ihianle, Golnaz Shahtahmassebi, Jordan J. Bird
机构
*
Department of Computer Science, Nottingham Trent University, Nottingham, UK(计算机科学系,诺丁汉特伦特大学,诺丁汉,英国)
;
Department of Physics and Mathematics, Nottingham Trent University, Nottingham, UK(物理与数学系,诺丁汉特伦特大学,诺丁汉,英国)
专题命中
评测与基准
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
Journal refThe 13th ACM International Conference on Systems for Energy-Efficient Buildings, Cities, and Transportation (BuildSys 26), June 22-25, 2026, Banff, AB, Canada. ACM, New York, NY, USA, 11 pages
Are LLMs Ready to Assist Physicians? PhysAssistBench for Interactive Doctor-Patient-EHR Assistance
LLMs 是否已准备好辅助医生?PhysAssistBench:交互式医患-电子病历辅助基准
Tianming Du, Peijie Yu, Sihan Shang, Danli Shi, My Linh Nguyen, Shengbo Gao, Guangyuan Li, Yinghong Yu, Yan Jiang, Qianlong Zhao, Behzad Bozorgtabar, Shaoxiong Ji, Jiazhen Pan, Daniel Rueckert, Jiancheng Yang
机构
*
Aalto University(阿尔托大学)
;
Tencent(腾讯)
;
Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))
;
Hong Kong Polytechnic University(香港理工大学)
;
Aarhus University(奥胡斯大学)
;
Technical University of Munich(慕尼黑工业大学)