Categorías

Inteligencia Artificial

Qué es Docker Agent, el plugin para crear agentes de IA con YAML

Docker Agent es un complemento de la línea de comandos de Docker para crear y ejecutar agentes de inteligencia artificial sin escribir código: describes el modelo, las herramientas MCP y los subagentes en un fichero YAML, arrancas todo con docker agent run y distribuyes el agente por cualquier registro OCI. Compatible con OpenAI, Anthropic, Gemini, Bedrock y Mistral.

Inteligencia Artificial

Qué es Open GSD, el flujo Git-Ship-Done para agentes de programación

Open GSD (Git. Ship. Done.) es un conjunto de herramientas de código abierto con licencia MIT para dirigir agentes de programación sin que pierdan el contexto: estructura el trabajo en cinco fases (discutir, planificar, ejecutar, verificar y enviar) y delega la parte pesada en subagentes con contexto limpio. Su núcleo son el motor gsd-core y el agente de terminal gsd-pi.

Herramientas

Claude Code vs Cursor vs GitHub Copilot en 2026: comparativa con tareas medidas

Tres agentes de código (Claude Code, Cursor y GitHub Copilot) medidos sobre cinco tareas reales de un equipo de plataforma: endpoint REST, refactor multi-fichero, depuración de CI, revisión de PR de seguridad y ficheros de fixtures. Claude Code lidera en refactor y revisiones; Cursor brilla en exploración interactiva; Copilot sigue siendo el más ágil para autocompletado puntual.

Arquitectura

Skills y subagentes: patrón de reutilización agente

Skills empaquetan capacidades reutilizables que el agente carga según la tarea; subagentes aíslan la ejecución de trabajo acotado y devuelven un resultado sintetizado sin inflar el contexto del orquestador. Juntos forman el patrón de composición más sólido para construir agentes complejos y mantenibles en 2026.

Inteligencia Artificial

LLM-as-judge maduro: cuándo confiar y cuándo no

Usar un LLM como juez de otro LLM se generalizó en 2024 y sigue siendo, en 2026, la única forma escalable de evaluar calidad cualitativa en sistemas con LLM. Es fiable si la correlación juez-humano supera 0,7 en 30 casos y se recalibra cada trimestre; por debajo de ese umbral, no fiarse del número.

Inteligencia Artificial

LLM red teaming: manual práctico

El red teaming de modelos de lenguaje ha pasado de actividad esotérica a práctica obligatoria. Con OWASP Agentic Top 10 y CSA Agentic AI Red Teaming Guide convergiendo en un vocabulario común, este es el manual operativo que cualquier equipo que despliegue agentes necesita tener.

Arquitectura

Agent OS en producción: casos reales sin marketing

El concepto de Agent OS pasó del slide al despliegue en 2025. Seis meses en producción dejan patrones visibles: qué arquitecturas funcionan, dónde se rompe el modelo y qué aporta frente a correr agentes sobre pila existente.

Arquitectura

Ecosistema MCP consolidado: mapa rápido para 2026

Veinte meses después del anuncio inicial, Model Context Protocol pasó de curiosidad a estándar de facto entre clientes y servidores de agentes. Qué hay disponible, qué servidores merecen la pena, qué problemas siguen abiertos y cómo se parece al mapa de protocolos anteriores.

Experiencia de Usuario

UX para agentes: primer consenso de diseño

Después de dos años viendo cómo cada producto inventaba su propia interfaz para hablar con un agente, en enero de 2026 empieza a emerger un consenso estable sobre qué patrones funcionan, cuáles no y qué espera ya el usuario medio. Toca recoger lo que ha quedado.

Arquitectura

Protocolos agente-a-agente: la próxima capa abierta

Con MCP resolviendo la conexión entre agente y herramientas, el siguiente cuello de botella aparece: cómo hablan entre sí dos agentes de distintos proveedores. Agent2Agent de Google, donado a la Linux Foundation en 2025, intenta ocupar ese hueco.

Herramientas

Clientes MCP en editores: la IA se integra donde ya trabajas

Los editores de código han empezado a incorporar MCP como cliente nativo: VS Code, Zed, Cursor y varios forks de Neovim. Esto cambia la forma en que el agente accede al contexto del proyecto y abre preguntas prácticas sobre qué servidores activar y cómo configurarlos sin abrir puertas.

Herramientas

Servidores MCP de la comunidad: cuáles merecen la pena

Seis meses después de que MCP se volviera el protocolo común de integración de agentes, el catálogo comunitario supera el millar de servidores. Repaso cuáles uso a diario, cuáles son ruido y cómo separarlos sin caer en la trampa de la novedad.