Categorías

Inteligencia Artificial

RAG con Postgres y pgvector en producción: del PoC al SLO

Postgres con pgvector es la opción por defecto para RAG en producción hasta diez millones de vectores: un índice HNSW, una base de datos y un plan de backup. Con reranking de dos etapas, búsqueda híbrida BM25 y SLOs medibles (p95 menor de 700 ms, recall@10 mayor de 0,85), la pila escala sin infraestructura adicional.

Arquitectura

Cómo instalar PostgreSQL con pgvector paso a paso

Esta guía instala PostgreSQL 16 con pgvector en Debian o Ubuntu usando el repositorio oficial PGDG, crea un rol y una base de datos dedicados, ajusta la memoria para producción y explica cuándo conviene el índice HNSW frente a IVFFlat según el volumen de vectores y la ventana de mantenimiento disponible.

Arquitectura

pgvector en 2024: índices HNSW y escalado real

pgvector maduró en 2023-2024 con el tipo de índice HNSW y la construcción paralela que llegó en la versión 0.6. Para los proyectos que ya operan PostgreSQL, ya no hace falta una base vectorial dedicada en la mayoría de los casos: esta guía explica cuándo basta, cómo configurar el índice y dónde empieza a quedarse corto.

Arquitectura

pgvector: búsqueda semántica sin salir de Postgres

pgvector convierte PostgreSQL en una base vectorial completamente funcional, sin necesidad de añadir un servicio separado al stack. Extiende Postgres con el tipo vector, índices IVFFlat para búsqueda aproximada (ANN) y la capacidad de combinar filtros SQL relacionales con ranking vectorial en la misma query. Para la mayoría de proyectos RAG y chatbots internos, esos límites nunca se alcanzan.