Benchmarking with the Retriever CLI
August 19, 2026 ยท View on GitHub
End-to-end experiments are maintained in the NeMo Retriever Benchmark (NRB)
repository.
The product CLI retains internal stage micro-benchmarks for focused development
measurements. For product workflows on your own inputs, use
retriever ingest and retriever query.
Stage Micro-Benchmarks
retriever benchmark measures individual actors rather than an end-to-end
Retriever result. It remains callable for development compatibility but is
hidden from root help.
retriever benchmark --help
retriever benchmark split --help
retriever benchmark extract --help
retriever benchmark audio-extract --help
retriever benchmark page-elements --help
retriever benchmark ocr --help
retriever benchmark all --help
The following example extracts from a directory of PDF files that you supply.
retriever benchmark extract /path/to/your/pdfs \
--pdf-extract-batch-size 8 \
--pdf-extract-actors 4
Stage commands report rows per second, or chunk rows per second for audio. They do not produce the NRB artifact contract and should not be used as retrieval quality evidence.