Clinical Benchmarks

MedCode (Vals AI): current results

Vals AI (dataset with Protege) · 2,755 patient records · index updated August 16, 2026

Claude Opus 5 holds the top current result on MedCode (Vals AI), 63.57% as of 2026-08, per Vals AI MedCode leaderboard. ICD-10-CM diagnosis coding for entire hospital stays: models assign primary and secondary codes from discharge summaries plus progress/consult notes; ground truth double-annotated by certified professional coders.

Current results

Result detail

#modelscoreas of
1Anthropic logoClaude Opus 5 Anthropic63.57%2026-08
2Google logoGemini 3.1 Pro Preview (02/26) Google59.06%2026-08
3Anthropic logoClaude Fable 5 Anthropic56.07%2026-08
4Google logoGemini 3 Flash (12/25) Google55.92%2026-08
5Google logoGemini 3.5 Flash Google55.83%2026-08

Scores appear exactly as Vals AI MedCode leaderboard publishes them (independently run). Vals AI runs every model itself; 85 models on the board, last updated August 15, 2026. Vals AI pairs this board with MedScribe, and its writeup notes that coding accuracy lags documentation quality.

About the benchmark

publisherVals AI (dataset with Protege)
categorydocumentation and coding benchmarks
released2026-02
size2,755 patient records
scalepercentage accuracy 0-100, higher better
result basisindependently run
sourceVals AI MedCode leaderboard
last frontier result2026-08

What is MedCode (Vals AI)?

MedCode (Vals AI) is a documentation and coding benchmark from Vals AI, released 2026-02: 2,755 patient records, scored on a percentage accuracy 0-100 scale. ICD-10-CM diagnosis coding for entire hospital stays: models assign primary and secondary codes from discharge summaries plus progress/consult notes; ground truth double-annotated by certified professional coders.

Which model leads MedCode (Vals AI)?

Claude Opus 5 (Anthropic) holds the top current result on MedCode (Vals AI) at 63.57%, per Vals AI MedCode leaderboard, as of 2026-08.

Where do the MedCode (Vals AI) numbers come from?

From Vals AI MedCode leaderboard (independently run). Vals AI runs every model itself; 85 models on the board, last updated August 15, 2026. Vals AI pairs this board with MedScribe, and its writeup notes that coding accuracy lags documentation quality.

The rest of the field is on the index, and how sources qualify is on the methodology page. Model names in the table link to cross-benchmark pages.