NanoGPT Slowrun

NanoGPT Slowrun

Language modeling benchmark with fixed data

Description

Most training contests assume unlimited data and race for speed, but quality data is increasingly scarce. NanoGPT Slowrun is a benchmark for language modeling algorithms with fixed data and infinite compute.

Using 100M FineWeb tokens with no compute limit, lowest validation loss wins, rewarding data-efficient training.

Features



Fixed data:100M tokens.

Infinite compute:No time cap.

Metric:Lowest loss.