Postgres con pgvector es la opción por defecto para RAG en producción hasta diez millones de vectores: un índice HNSW, una base de datos y un plan de backup. Con reranking de dos etapas, búsqueda híbrida BM25 y SLOs medibles (p95 menor de 700 ms, recall@10 mayor de 0,85), la pila escala sin infraestructura adicional.
Esta guía instala PostgreSQL 16 con pgvector en Debian o Ubuntu usando el repositorio oficial PGDG, crea un rol y una base de datos dedicados, ajusta la memoria para producción y explica cuándo conviene el índice HNSW frente a IVFFlat según el volumen de vectores y la ventana de mantenimiento disponible.
pgvector maduró en 2023-2024 con el tipo de índice HNSW y la construcción paralela que llegó en la versión 0.6. Para los proyectos que ya operan PostgreSQL, ya no hace falta una base vectorial dedicada en la mayoría de los casos: esta guía explica cuándo basta, cómo configurar el índice y dónde empieza a quedarse corto.
pgvector convierte PostgreSQL en una base vectorial completamente funcional, sin necesidad de añadir un servicio separado al stack. Extiende Postgres con el tipo vector, índices IVFFlat para búsqueda aproximada (ANN) y la capacidad de combinar filtros SQL relacionales con ranking vectorial en la misma query. Para la mayoría de proyectos RAG y chatbots internos, esos límites nunca se alcanzan.
7 min291
Usamos cookies propias y de terceros para analizar el tráfico del sitio. Puedes aceptarlas, rechazarlas o configurar tu elección.
Más información sobre las cookies
Preferencias de cookies
NecesariasImprescindibles para el funcionamiento del sitio. Siempre activas.
AnalíticasNos ayudan a entender cómo se usa el sitio (Google Analytics).