◆ American Journal of Roentgenology2025-12-10· Medical diagnosis
Decoupling Visual Parsing and Diagnostic Reasoning for Vision-Language Models (GPT-4o and GPT-5): Analysis Using Thoracic Imaging Quiz Cases
Dae Hee Han, Eui Jin Hwang, Soon Ho Yoon, Hyungjin Kim, Taehee Lee
原始摘要(英文原文)· Original abstract
Background: Vision-language models (VLMs) have potential to identify findings on radiologic imaging (i.e., visual parsing) and translate findings into diagnoses (i.e., diagnostic reasoning). Current VLMs have shown insufficient performance to support clinical integration.