Postgres con pgvector es la opción por defecto para RAG en producción hasta diez millones de vectores: un índice HNSW, una base de datos y un plan de backup. Con reranking de dos etapas, búsqueda híbrida BM25 y SLOs medibles (p95 menor de 700 ms, recall@10 mayor de 0,85), la pila escala sin infraestructura adicional.
Tras la adquisición por Microsoft en 2019, Citus vivió un limbo comercial que terminó con Microsoft abriendo el código completo en 2022. Tres años después, la extensión de particionado para Postgres ha madurado y ofrece una ruta práctica para escalar sin abandonar el motor que ya conoces. Un repaso honesto.
Las bases de datos SQL distribuidas han pasado de promesa a realidad operativa. YugabyteDB y CockroachDB lideran el segmento desde ángulos distintos. Elegir una sobre la otra exige entender qué compromete cada diseño y qué se paga por escalar horizontalmente.
PostgreSQL 17 llegó en septiembre con mejoras silenciosas del planificador. Seis meses en producción confirman que los escaneos SAOP, el streaming I/O y los anti-joins han cambiado planes de consulta reales sin tocar una línea de SQL.
PostgreSQL 16 cierra las brechas históricas de la replicación lógica: apply paralelo casi 2x más rápido, slots lógicos servidos desde standbys físicos y el andamiaje para replicación bidireccional. El resultado es una herramienta de primera línea para migraciones entre versiones y flujos CDC.
Esta guía instala PostgreSQL 18.6 con pgvector 0.8.6 en Debian o Ubuntu desde el repositorio oficial PGDG, o en Docker. Crea un rol y una base de datos dedicados, ajusta la memoria para producción y explica cuándo conviene HNSW frente a IVFFlat, con recall y tiempos medidos sobre 99.000 embeddings.
pgvector maduró en 2023-2024 con el tipo de índice HNSW y la construcción paralela que llegó en la versión 0.6. Para los proyectos que ya operan PostgreSQL, ya no hace falta una base vectorial dedicada en la mayoría de los casos: esta guía explica cuándo basta, cómo configurar el índice y dónde empieza a quedarse corto.
PostgreSQL 16, publicado en septiembre de 2023, suma replicación lógica desde un standby, la vista pg_stat_io para desglosar el I/O por tipo de operación y contexto, y paralelismo en FULL OUTER JOIN. Migrar desde la 15 es sencillo; la 13 pierde soporte en noviembre de 2025, así que conviene planificar la actualización cuanto antes.
pgvector convierte PostgreSQL en una base vectorial sin añadir otro servicio al stack. Con la versión 0.8.6 y PostgreSQL 18, HNSW dio un 95,1 % de recall@10 en 1,15 ms sobre 99.000 embeddings reales. Los filtros SQL comparten consulta con el ranking vectorial, y los recorridos iterativos evitan que un filtro devuelva menos filas de las pedidas.
13 min301
Usamos cookies propias y de terceros para analizar el tráfico del sitio. Puedes aceptarlas, rechazarlas o configurar tu elección.
Más información sobre las cookies
Preferencias de cookies
NecesariasImprescindibles para el funcionamiento del sitio. Siempre activas.
AnalíticasNos ayudan a entender cómo se usa el sitio (Google Analytics).