Categorías

Categorías Jacar — explora los temas Un cohete cuyos ojos siguen el cursor.
Arquitectura

GraphRAG en empresa: patrones tras un año de adopción

Un año después de que GraphRAG saliera de laboratorio, queda una estadística clara: funciona donde la información corporativa tiene relaciones densas, falla donde solo hay documentos sueltos. Patrones, costes y decisiones de arquitectura que han sobrevivido.

Cómo Instalar

Cómo instalar un servidor MCP local para tu editor

Model Context Protocol ha pasado de propuesta a estándar de facto para conectar editores con herramientas. Guía práctica para levantar un servidor MCP local, conectarlo a VS Code o a tu cliente favorito y entender qué estás exponiendo realmente.

Arquitectura

Ecosistema MCP consolidado: mapa rápido para 2026

Veinte meses después del anuncio inicial, Model Context Protocol pasó de curiosidad a estándar de facto entre clientes y servidores de agentes. Qué hay disponible, qué servidores merecen la pena, qué problemas siguen abiertos y cómo se parece al mapa de protocolos anteriores.

Inteligencia Artificial

FinOps para cargas de IA en 2026: el dolor real

La factura de IA en las empresas ha dejado de ser anecdótica. Entre tokens de modelos frontera, GPUs reservadas que nadie usa y pipelines RAG con cachés mal configuradas, muchos equipos pagan diez veces lo que deberían. Guía de FinOps específico para IA sin relatos promocionales.

Inteligencia Artificial

Agentes que manejan el ordenador: patrones que funcionan

Tras dieciséis meses desde la primera versión de computer use de Anthropic y el empuje paralelo de browser-use, OpenAI Operator y Gemini Computer Use, los agentes que manejan navegador y escritorio han pasado de demo a flujos reales. Toca revisar qué patrones sobreviven cuando los ejecutas todos los días en producción.

Inteligencia Artificial

Corrección del mercado de startups de IA en 2026

Tres años de valoraciones vertiginosas han empezado a corregirse sin estrépito pero con firmeza: rondas abajo, despidos selectivos y consolidación en torno a propuestas con ingresos reales. Una lectura ordenada de qué sobrevive, qué se quema y qué aprende el ecosistema.

Inteligencia Artificial

Renacimiento del grafo de conocimiento con LLM

Los grafos de conocimiento llevaban dos décadas esperando su momento. Con los LLM como puente entre texto y ontología, y el patrón GraphRAG ya maduro, la tecnología vuelve al primer plano. Toca revisar por qué ahora sí encaja y dónde conviene usarla.

Experiencia de Usuario

UX para agentes: primer consenso de diseño

Después de dos años viendo cómo cada producto inventaba su propia interfaz para hablar con un agente, en enero de 2026 empieza a emerger un consenso estable sobre qué patrones funcionan, cuáles no y qué espera ya el usuario medio. Toca recoger lo que ha quedado.

Inteligencia Artificial

IA soberana en Europa: estado práctico

El discurso de la IA soberana europea lleva tres años alimentando titulares, inversiones públicas y acuerdos interestatales. Empezamos a ver qué parte de la promesa tiene sustancia técnica y qué parte sigue siendo narrativa política, con Mistral, Aleph Alpha y la red de supercomputación EuroHPC como ejes.

Arquitectura

Protocolos agente-a-agente: la próxima capa abierta

Con MCP resolviendo la conexión entre agente y herramientas, el siguiente cuello de botella aparece: cómo hablan entre sí dos agentes de distintos proveedores. Agent2Agent de Google, donado a la Linux Foundation en 2025, intenta ocupar ese hueco.

Inteligencia Artificial

Phi-3 en el edge: el SLM de Microsoft en 2025

Phi-3 es la familia de modelos pequeños de lenguaje que Microsoft viene puliendo desde abril de 2024 con variantes de 3.800 millones, 7.000 millones y 14.000 millones de parámetros. Después de año y medio, el panorama del edge con SLM abiertos se ha vuelto serio y Phi-3 ocupa un sitio claro.

Inteligencia Artificial

Guardrails en LLM: frameworks y su coste real

Los frameworks de guardrails prometen filtrar entradas y salidas de modelos de lenguaje para bloquear fugas de datos, contenido dañino o alucinaciones. Tras evaluar cuatro de los más populares en producción, repaso qué hacen realmente, qué coste en latencia y factura añaden y cuándo compensan frente a controles más simples.

Arquitectura

Cachés para LLM: ahorrar tokens sin tirar la calidad

Un proxy con caché delante de un modelo de lenguaje puede reducir la factura de tokens de forma significativa, pero introduce riesgos sutiles si el diseño no es cuidadoso. Qué tipos de caché funcionan en producción, dónde están las trampas habituales y cómo integrarlos sin degradar la experiencia.

Arquitectura

Enrutadores de inferencia: elegir modelo según la petición

Un enrutador de inferencia decide qué modelo atiende cada petición en función de coste, latencia y complejidad. Bien diseñados reducen la factura de tokens sin que el usuario perciba degradación; mal diseñados introducen fallos sutiles difíciles de depurar.

Inteligencia Artificial

Testing con IA: el problema del determinismo

Probar sistemas que incluyen modelos de lenguaje rompe la primera regla del testing: la misma entrada da la misma salida. Analizo las estrategias que han funcionado tras un año largo integrando IA en productos reales, por qué los tests deterministas tradicionales no bastan y cómo plantear un cinturón de pruebas que capture regresiones sin bloquearse en la varianza.

Arquitectura

Agent OS: el concepto que está moldeando la nueva capa

El término Agent OS lleva un año ganando tracción entre investigación y producto. Describe una capa que va más allá de una biblioteca de agentes: planificador, gestión de contexto, memoria persistente y aislamiento. Una lectura del estado real de ese concepto.

Arquitectura

Model Context Protocol en 2025: del anuncio al ecosistema

Model Context Protocol cumple diez meses desde su anuncio de Anthropic y ya no es una propuesta: hay cientos de servidores, implementaciones cruzadas entre proveedores y un registro público. Repaso de qué ha funcionado, qué sigue flojo y por qué 2025 marca el paso de curiosidad a infraestructura básica.

Arquitectura

Redis 8.2 y su soporte vectorial: cuándo tiene sentido

Redis 8.2 incorpora la búsqueda vectorial como tipo de dato nativo. La duda real es si sustituye a un motor dedicado como Qdrant, Weaviate o pgvector en cargas con millones de vectores y latencias exigentes, o si solo sirve como complemento del caché que ya tienes.

Inteligencia Artificial

RAG 2.0: grafos de conocimiento, vectores e híbrido

El RAG de 2023 era búsqueda vectorial con un LLM detrás. El de 2025 es un sistema híbrido que combina vectores, búsqueda léxica y grafos de conocimiento. Qué ha cambiado, dónde funciona cada pieza y qué decisiones marcan la diferencia entre un RAG útil y uno decepcionante.

Herramientas

Clientes MCP en editores: la IA se integra donde ya trabajas

Los editores de código han empezado a incorporar MCP como cliente nativo: VS Code, Zed, Cursor y varios forks de Neovim. Esto cambia la forma en que el agente accede al contexto del proyecto y abre preguntas prácticas sobre qué servidores activar y cómo configurarlos sin abrir puertas.

Inteligencia Artificial

Gemini 2.5: escalado de contexto y multimodalidad

Google publicó Gemini 2.5 Pro en vista previa en marzo y la versión general llegó en junio. El salto respecto a Gemini 2.0 no está solo en puntuaciones sino en dos frentes prácticos: ventana de contexto utilizable en serio y multimodalidad que deja de ser demostración para convertirse en herramienta.

Herramientas

Servidores MCP de la comunidad: cuáles merecen la pena

Revisión de septiembre de 2026 de los servidores MCP que uso a diario: filesystem, git, fetch y memory siguen siendo de referencia, y DBHub sustituye al servidor de Postgres archivado. El registro oficial verifica quién publica, no la seguridad del código, así que aplico cinco criterios y listo las herramientas con el MCP Inspector antes de conectar nada.

Inteligencia Artificial

La era del grafo de conocimiento renace con los LLM

Durante una década, los grafos de conocimiento fueron una idea académica con pocos casos de uso reales, frenada por el coste de construir y mantener el esquema. Los LLM han cambiado esa ecuación: ahora extraen entidades automáticamente y sirven para anclar respuestas, auditar razonamiento y sostener agentes sin alucinar.

Inteligencia Artificial

FinOps aplicado a IA: dónde se va el coste de verdad

En sistemas de IA el coste real no está en las instancias EC2, sino en los tokens de entrada de RAG y agentes, las llamadas de herramientas encadenadas y los reindexados frecuentes; esos vectores, sumados a los experimentos sin atribución, concentran la mayor parte de la factura mensual en producción.

Arquitectura

Aplicar RAG con grafos a un producto real

Desde que Microsoft abrió GraphRAG, el patrón de usar grafos sobre tus propios datos ha pasado de experimento académico a técnica con aplicaciones prácticas. Reflexión sobre cuándo compensa, cómo se monta y qué errores se repiten.