Internal medicine physician building open evaluation systems for medical AI safety and open source AI.
I created MedFailBench, an open clinical safety evaluation project with 44 clinician reviewed cases across 21 clinical domains. I also maintain the Türkiye Clinical AI Evidence Atlas, a bilingual public evidence map with a reproducible method, a 63 field schema, and a validated 25 record pilot.
The Repositories tab mixes original projects with contribution forks. Use the lists:
- Flagship — original public work (MedFailBench, TurKMedBench, evidence atlas, and related projects)
- Forks — copies used for upstream pull requests, not original projects
- MedFailBench repository
- Türkiye Clinical AI Evidence Atlas
- MedFailBench arXiv preprint
- MedFailBench versioned record



