Retrieval-Augmented Generation Benchmarks
Systematic evaluation of RAG architectures across domain-specific corpora
A comprehensive benchmarking study comparing chunking strategies, embedding models, and retrieval pipelines across legal, medical, and engineering domains.
- Hypothesis
- Domain-specific chunking outperforms generic strategies
- NLP · Information Retrieval
- Methodology
- 12 pipeline configurations across 3 domain corpora
- LangChain · ChromaDB · RAGAS
- Findings
- Semantic chunking + hybrid retrieval: 23% recall improvement
- Benchmark dataset published