Benchmark Models

Retrieval accuracy (Recall@k / MRR) + latency + cost per embedding model.

Pure semantic retrieval (no keyword/RRF/reranker) — this isolates the embedding model's recall. The live search combines all layers on top.