In Six Head-to-Head Tests, OpenAI’s Reasoning Model Diagnosed Patients Better Than the Doctors Treating Them
A Harvard and Beth Israel Deaconess study published in Science on April 30, 2026 found OpenAI's o1 model beat physicians in six diagnostic experiments, correctly diagnosing 78% of textbook cases versus 30% for doctors.