BioXArena: Benchmarking LLM Agents on Multi-Modal Biomedical Machine Learning Tasks
BioXArena:在多模态生物医学机器学习任务上评估LLM代理的基准测试
Loka Li, Duzhen Zhang, Xingbo Du, Leonard Song, Zixiao Wang, Assanali Aukenov, Noel Thomas, Shakhnazar Sailaukan, Yonghan Yang, Feilong Chen, Jiahua Dong, Kun Zhang, Bin Zhang, Le Song
专题命中
评测与基准
:LLM(title,title_cn);large language model(abstract);language model(abstract)
A Replicable Robotics Awareness Method Using LLM-Enabled Robotics Interaction: Evidence from a Corporate Challenge
一种利用LLM增强的机器人交互方法进行可复制的机器人意识:来自企业挑战的证据
S. A. Prieto, M. A. Gopee, Y. Ben Arab, B. García de Soto, J. Esteba, P. Olivera Brizzio
机构
*
KINESIS Core Technology Platform, New York University Abu Dhabi (NYUAD)(纽约大学阿布扎比分校KINESIS核心科技平台)
;
S.M.A.R.T. Construction Research Group, Division of Engineering, New York University Abu Dhabi (NYUAD)(纽约大学阿布扎比分校S.M.A.R.T.建筑研究小组)
;
AD Ports Group, Corporate Innovation Department(AD Ports集团企业创新部)
专题命中
评测与基准
:LLM(title,title_cn);large language model(abstract);language model(abstract)
DiTTO-LLM: Framework for Discovering Topic-based Technology Opportunities via Large Language Model
Wonyoung Kim, Sujeong Seo, Juhyun Lee
机构
*
Department of Library and Information Science(图书馆与信息科学系)
;
Chung-Ang University(Chung-Ang 大学)
;
Insurance Strategy Planning Team(保险战略规划团队)
;
Postal Savings & Insurance Development Institute(邮政储蓄与保险发展研究所)
;
Future Technology Analysis Center(未来技术分析中心)
;
Korea Institute of Science and Technology Information(韩国科学技术信息院)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);LLM(title);分类 cs.CL、cs.AI、cs.LG
An approach to measuring the performance of Automatic Speech Recognition (ASR) models in the context of Large Language Model (LLM) powered applications
How to Align Large Language Models for Teaching English? Designing and Developing LLM based-Chatbot for Teaching English Conversation in EFL, Findings and Limitations
Jaekwon Park, Jiyoung Bae, Unggi Lee, Taekyung Ahn, Sookbun Lee, Dohee Kim, Aram Choi, Yeil Jeong, Jewoong Moon, Hyeoncheol Kim
专题命中
评测与基准
:LLM(title,abstract);large language model(title,abstract);language model(title,abstract)