Comparative analysis of medical knowledge and inferential capabilities of modern LLMs
Muhammad Badruddin Khan, Abdul Khader Jilani Saudagar
In this paper: This paper presents an evaluation of four large language models (LLMs)—GPT-4o, Claude-3.5-Sonnet, Gemini-1.5-Pro, and Llama-3.1-405B-T based on word problems that were formulated to check LLMs level o...
