Next-generation NPUs: the hardware moving AI in 2026

Las NPU dejaron de ser un accesorio para convertirse en el componente que define rendimiento real en portátiles, teléfonos y servidores pequeños. Repaso práctico del hardware que domina 2026, qué cargas compensan y dónde sigue ganando la GPU tradicional.

381 12 min March 17, 2026 4.9

Arquitectura

LLM caches: saving tokens without dropping quality

Un proxy con caché delante de un modelo de lenguaje puede reducir la factura de tokens de forma significativa, pero introduce riesgos sutiles si el diseño no es cuidadoso. Qué tipos de caché funcionan en producción, dónde están las trampas habituales y cómo integrarlos sin degradar la experiencia.

66 10 min November 29, 2025

Tecnología

Microsoft Garnet: a high-performance cache alternative

Garnet es el servidor de caché abierto por Microsoft Research que habla el protocolo de Redis pero está escrito en .NET 8 con un núcleo de almacenamiento orientado a hardware moderno. Tras casi dos años en público, muestra números interesantes y una arquitectura que merece mirarse con calma, aunque el ecosistema Redis siga siendo más maduro.

59 10 min November 14, 2025 4.5

Tecnología

Dragonfly: the modern cache inspired by Redis

Dragonfly lleva tres años como alternativa compatible con Redis, pero con arquitectura multihilo y sin fork para persistencia. En 2025 ya no es una curiosidad: hay despliegues serios que lo eligen por coste y latencia. Repaso de qué cambia y cuándo compensa mirarlo con calma.

58 13 min September 18, 2025 4.5

Desarrollo de Software

Python 3.13 with optional GIL: what it means for teams

Python 3.13 introduce de forma experimental la ejecución sin GIL mediante PEP 703. Tras unos meses de rodaje empiezan a verse pruebas reales fuera del laboratorio. Conviene entender bien qué ganas, qué pierdes y qué no cambia todavía.

60 11 min August 25, 2025 4.3

Arquitectura

Redis 8.2 and its vector support: when it actually makes sense

Redis 8.2 incorpora búsqueda vectorial como tipo de dato nativo. La pregunta no es si funciona, sino si sustituye a un motor dedicado como Qdrant, Weaviate o pgvector en cargas reales con millones de vectores y latencias exigentes.

62 12 min August 4, 2025 4.6

Desarrollo de Software

Qwik in production: resumable and cheap on the client

Qwik lleva dos años prometiendo aplicaciones que arrancan al instante porque no hidratan, sino que reanudan. Con la serie 1.x asentada y casos reales publicados, toca ver si la resumibilidad compensa la curva de aprendizaje y cuándo es el entorno adecuado.

69 14 min July 20, 2025 4.3

Tecnología

Apple M4 Pro on developer machines: real-world experience

Llevo seis meses usando un MacBook Pro con M4 Pro como equipo principal de desarrollo. Cuento qué ha cambiado de verdad respecto al M2 Pro anterior, dónde se nota el salto y dónde la inversión no se justifica si ya tienes un equipo reciente.

56 11 min June 20, 2025 4.5

Desarrollo de Software

Polars versus pandas in 2025: the real-world practice

Polars lleva dos años pidiendo relevo a pandas. Con Polars 1.x estable y una comunidad creciente, toca revisar dónde de verdad compensa migrar, dónde pandas sigue ganando y cómo convivir entre ambos sin pagar dos veces.

119 12 min June 17, 2025 4.3

Metodologías

Continuous profiling with eBPF in production

El profiling continuo ha salido del terreno experimental y se ha vuelto una herramienta habitual en sistemas con tráfico real. Repaso qué aporta eBPF frente a instrumentación clásica, qué cuesta y cuándo compensa instalarlo.

65 12 min June 8, 2025 4.6

Arquitectura

PostgreSQL 17: optimisations that change real queries

PostgreSQL 17 llegó en septiembre con mejoras silenciosas del planificador. Seis meses en producción confirman que los escaneos SAOP, el streaming I/O y los anti-joins han cambiado planes de consulta reales sin tocar una línea de SQL.

60 10 min April 30, 2025 4.3