arXivDaily arXiv每日学术速递 周一至周五更新

科学与医疗

医学 AI

医学智能、临床 AI、医学影像、病理、诊断和医疗健康大模型。

共收录 2136 信号源:cs.CV, cs.LG, q-bio, eess.IV, eess.SP

1. 医学数据与评测 2136 篇

2405.05938 2024-10-22 cs.CL 50%

DOLOMITES: Domain-Specific Long-Form Methodical Tasks

Chaitanya Malaviya, Priyanka Agrawal, Kuzman Ganchev, Pranesh Srinivasan, Fantine Huot, Jonathan Berant, Mark Yatskar, Dipanjan Das, Mirella Lapata, Chris Alberti

专题命中 医学数据与评测 :diagnosis(abstract)

Comments Accepted to TACL; to be presented at EMNLP 2024. Dataset available at https://dolomites-benchmark.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12722 2024-10-17 cs.CL 50%

WorldMedQA-V: a multilingual, multimodal medical examination dataset for multimodal language models evaluation

João Matos, Shan Chen, Siena Placino, Yingya Li, Juan Carlos Climent Pardo, Daphna Idan, Takeshi Tohyama, David Restrepo, Luis F. Nakayama, Jose M. M. Pascual-Leone, Guergana Savova, Hugo Aerts, Leo A. Celi, A. Ian Wong, Danielle S. Bitterman, Jack Gallifant

专题命中 医学数据与评测 :medical image(abstract)

Comments submitted for review, total of 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05235 2024-10-10 cs.CL cs.AI 50%

CasiMedicos-Arg: A Medical Question Answering Dataset Annotated with Explanatory Argumentative Structures

Ekaterina Sviridova, Anar Yeginbergen, Ainara Estarrona, Elena Cabrio, Serena Villata, Rodrigo Agerri

专题命中 医学数据与评测 :diagnosis(abstract)

Comments 9 pages

Journal ref EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09581 2024-10-04 cs.CL 50%

DocLens: Multi-aspect Fine-grained Evaluation for Medical Text Generation

Yiqing Xie, Sheng Zhang, Hao Cheng, Pengfei Liu, Zelalem Gero, Cliff Wong, Tristan Naumann, Hoifung Poon, Carolyn Rose

专题命中 医学数据与评测 :radiology(abstract)

Comments ACL Camera Ready Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14302 2024-10-03 cs.CL cs.AI 50%

Reliable and diverse evaluation of LLM medical knowledge mastery

Yuxuan Zhou, Xien Liu, Chen Ning, Xiao Zhang, Ji Wu

专题命中 医学数据与评测 :diagnosis(abstract)

Comments 20 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.12547 2024-09-06 cs.CL 50%

Towards Evaluating and Building Versatile Large Language Models for Medicine

Chaoyi Wu, Pengcheng Qiu, Jinxin Liu, Hongfei Gu, Na Li, Ya Zhang, Yanfeng Wang, Weidi Xie

专题命中 医学数据与评测 :diagnosis(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03127 2024-08-07 cs.CL 50%

Lisbon Computational Linguists at SemEval-2024 Task 2: Using A Mistral 7B Model and Data Augmentation

Artur Guimarães, Bruno Martins, João Magalhães

专题命中 医学数据与评测 :biomedical(abstract)

Comments 8 pages, 1 figure, submitted and accepted into the "18th International Workshop on Semantic Evaluation (SemEval-2024)"

Journal ref Proceedings of the 18th International Workshop on Semantic Evaluation (SemEval-2024) (2024) 1280-1287

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.20564 2024-07-31 cs.CL 50%

CLR-Fact: Evaluating the Complex Logical Reasoning Capability of Large Language Models over Factual Knowledge

Tianshi Zheng, Jiaxin Bai, Yicheng Wang, Tianqing Fang, Yue Guo, Yauwai Yim, Yangqiu Song

专题命中 医学数据与评测 :biomedical(abstract)

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08554 2024-07-30 cs.AI cs.HC 50%

Establishing Rigorous and Cost-effective Clinical Trials for Artificial Intelligence Models

Wanling Gao, Yunyou Huang, Dandan Cui, Zhuoming Yu, Wenjing Liu, Xiaoshuang Liang, Jiahui Zhao, Jiyue Xie, Hao Li, Li Ma, Ning Ye, Yumiao Kang, Dingfeng Luo, Peng Pan, Wei Huang, Zhongmou Liu, Jizhong Hu, Gangyuan Zhao, Chongrong Jiang, Fan Huang, Tianyi Wei, Suqin Tang, Bingjie Xia, Zhifei Zhang, Jianfeng Zhan

专题命中 医学数据与评测 :diagnosis(abstract)

Comments 24 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.01686 2024-07-26 cs.CL cs.AI 50%

Automatically Extracting Numerical Results from Randomized Controlled Trials with Large Language Models

Hye Sun Yun, David Pogrebitskiy, Iain J. Marshall, Byron C. Wallace

专题命中 医学数据与评测 :biomedical(abstract)

Comments 25 pages, 7 figures, 6 tables, MLHC 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.02327 2024-07-15 cs.AI 50%

CausalLP: Learning causal relations with weighted knowledge graph link prediction

Utkarshani Jaimini, Cory Henson, Amit P. Sheth

专题命中 医学数据与评测 :diagnosis(abstract)

Comments 9 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06331 2024-07-04 cs.CL cs.AI 50%

MedExQA: Medical Question Answering Benchmark with Multiple Explanations

Yunsoo Kim, Jinge Wu, Yusuf Abdulle, Honghan Wu

专题命中 医学数据与评测 :pathology(abstract)

Comments Accepted to ACL2024 BioNLP Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.01896 2024-07-03 cs.CL cs.IR 50%

LogEval: A Comprehensive Benchmark Suite for Large Language Models In Log Analysis

Tianyu Cui, Shiyu Ma, Ziang Chen, Tong Xiao, Shimin Tao, Yilun Liu, Shenglin Zhang, Duoming Lin, Changchang Liu, Yuzhe Cai, Weibin Meng, Yongqian Sun, Dan Pei

专题命中 医学数据与评测 :diagnosis(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00764 2024-07-02 cs.CL cs.AI 50%

Characterizing Stereotypical Bias from Privacy-preserving Pre-Training

Stefan Arnold, Rene Gröbner, Annika Schreiner

专题命中 医学数据与评测 :diagnosis(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.12036 2024-07-02 cs.CL cs.AI 50%

MedCalc-Bench: Evaluating Large Language Models for Medical Calculations

Nikhil Khandekar, Qiao Jin, Guangzhi Xiong, Soren Dunn, Serina S Applebaum, Zain Anwar, Maame Sarfo-Gyamfi, Conrad W Safranek, Abid A Anwar, Andrew Zhang, Aidan Gilson, Maxwell B Singer, Amisha Dave, Andrew Taylor, Aidong Zhang, Qingyu Chen, Zhiyong Lu

专题命中 医学数据与评测 :diagnosis(abstract)

Comments Github link: https://github.com/ncbi-nlp/MedCalc-Bench HuggingFace link: https://huggingface.co/datasets/nsk7153/MedCalc-Bench

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00376 2024-07-02 cs.CL 50%

Small Language Models Learn Enhanced Reasoning Skills from Medical Textbooks

Hyunjae Kim, Hyeon Hwang, Jiwoo Lee, Sihyeon Park, Dain Kim, Taewhoo Lee, Chanwoong Yoon, Jiwoong Sohn, Donghee Choi, Jaewoo Kang

专题命中 医学数据与评测 :medical AI(abstract)

Comments Added new LLaMA-3-based models and experiments on NEJM case challenges

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03189 2024-06-10 cs.CL cs.AI 50%

The Probabilities Also Matter: A More Faithful Metric for Faithfulness of Free-Text Explanations in Large Language Models

Noah Y. Siegel, Oana-Maria Camburu, Nicolas Heess, Maria Perez-Ortiz

专题命中 医学数据与评测 :CT(abstract)

Comments To be published in ACL 2024. 19 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.17244 2024-06-10 physics.med-ph 50%

The status and challenges for prostate SBRT treatments in United States proton therapy centers: An NRG Oncology practice survey

Jiajian Shen, Paige A. Taylor, Carlos E. Vargas, Minglei Kang, Jatinder Saini, Jun Zhou, Peilong Wang, Wei Liu, Charles B. Simone, Ying Xiao, Liyong Lin

专题命中 医学数据与评测 :MRI(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.03699 2024-06-07 cs.CL 50%

M-QALM: A Benchmark to Assess Clinical Reading Comprehension and Knowledge Recall in Large Language Models via Question Answering

Anand Subramanian, Viktor Schlegel, Abhinav Ramesh Kashyap, Thanh-Tung Nguyen, Vijay Prakash Dwivedi, Stefan Winkler

专题命中 医学数据与评测 :biomedical(abstract)

Comments Accepted at ACL 2024 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.03181 2024-06-06 cs.CL 50%

Missci: Reconstructing Fallacies in Misrepresented Science

Max Glockner, Yufang Hou, Preslav Nakov, Iryna Gurevych

专题命中 医学数据与评测 :biomedical(abstract)

Comments ACL 2024 (main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.02908 2024-06-06 physics.med-ph 50%

The HS-CMU Dataset for Diagnosing Benign and Malignant Diseases through Hysteroscopy

Ruxue Han, Yuantao Xie, Kangze You, Lijun Cao, Hua Li

专题命中 医学数据与评测 :diagnosis(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.10893 2024-05-20 cs.CL cs.AI 50%

COGNET-MD, an evaluation framework and dataset for Large Language Model benchmarks in the medical domain

Dimitrios P. Panagoulias, Persephone Papatheodosiou, Anastasios P. Palamidas, Mattheos Sanoudos, Evridiki Tsoureli-Nikita, Maria Virvou, George A. Tsihrintzis

专题命中 医学数据与评测 :diagnosis(abstract)

Comments Technical Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2007.10609 2024-05-07 cs.HC 50%

SUBPLEX: Towards a Better Understanding of Black Box Model Explanations at the Subpopulation Level

Jun Yuan, Gromit Yeuk-Yin Chan, Brian Barr, Kyle Overton, Kim Rees, Luis Gustavo Nonato, Enrico Bertini, Claudio T. Silva

专题命中 医学数据与评测 :diagnosis(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13236 2024-05-06 cs.DC cs.ET 50%

LLMChain: Blockchain-based Reputation System for Sharing and Evaluating Large Language Models

Mouhamed Amine Bouchiha, Quentin Telnoff, Souhail Bakkali, Ronan Champagnat, Mourad Rabah, Mickaël Coustaty, Yacine Ghamri-Doudane

专题命中 医学数据与评测 :diagnosis(abstract)

Comments Paper accepted at IEEE 48th Annual Computers, Software, and Applications Conference (COMPSAC) IEEE, Osaka, Japan (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09135 2024-04-16 cs.CL 50%

Unveiling LLM Evaluation Focused on Metrics: Challenges and Solutions

Taojun Hu, Xiao-Hua Zhou

专题命中 医学数据与评测 :biomedical(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.06122 2024-04-10 physics.med-ph 50%

In-vivo imaging of the human thalamus: a comprehensive evaluation of structural magnetic resonance imaging approaches for thalamic nuclei differentiation at 7T

Cristina Sainz Martinez, José P. Marques, Gabriele Bonanno, Tom Hilbert, Constantin Tuleasca, Meritxell Bach Cuadra, João Jorge

专题命中 医学数据与评测 :MRI(abstract)

Comments 39 pages, 6 figures, 3 tables, 8 supplementary figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.04098 2024-04-08 cs.CR 50%

You Can Use But Cannot Recognize: Preserving Visual Privacy in Deep Neural Networks

Qiushi Li, Yan Zhang, Ju Ren, Qi Li, Yaoxue Zhang

专题命中 医学数据与评测 :medical image(abstract)

Comments 18 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03977 2024-04-08 cs.CL 50%

SEME at SemEval-2024 Task 2: Comparing Masked and Generative Language Models on Natural Language Inference for Clinical Trials

Mathilde Aguiar, Pierre Zweigenbaum, Nona Naderi

专题命中 医学数据与评测 :biomedical(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00998 2024-04-02 cs.CL cs.AI 50%

LLM-RadJudge: Achieving Radiologist-Level Evaluation for X-Ray Report Generation

Zilong Wang, Xufang Luo, Xinyang Jiang, Dongsheng Li, Lili Qiu

专题命中 医学数据与评测 :radiology(abstract)

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.16446 2024-03-26 cs.CL 50%

Towards Automatic Evaluation for LLMs' Clinical Capabilities: Metric, Data, and Algorithm

Lei Liu, Xiaoyan Yang, Fangzhou Li, Chenfei Chi, Yue Shen, Shiwei Lyu Ming Zhang, Xiaowei Ma, Xiangguo Lyu, Liya Ma, Zhiqiang Zhang, Wei Xue, Yiran Huang, Jinjie Gu

专题命中 医学数据与评测 :diagnosis(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏