La especificación OpenTelemetry GenAI semconv define en 2026 los atributos estándar para instrumentar llamadas a LLMs, ejecución de herramientas y operaciones de agentes. Se instrumenta una vez con el SDK de Anthropic, se recolectan trazas con OTel Collector y se consultan con TraceQL en Grafana Tempo. El resultado es un dashboard portable que sobrevive a cambios de modelo, proveedor y framework sin reescritura.
Los agentes que encadenan llamadas a modelos, herramientas y memoria son difíciles de depurar sin una instrumentación pensada para ellos. Después de un año largo operando agentes en producción, repaso qué hay que medir primero, qué estándares están consolidándose y qué errores caros evita tener trazas bien hechas desde el inicio.
Las aplicaciones basadas en LLM necesitan tres planos de observabilidad distintos: trazas de prompt y respuesta para depurar alucinaciones, seguimiento de costes por token y por función, y evaluación de calidad de respuesta. Herramientas como Langfuse, LangSmith y Helicone cubren estos planos con instrumentación específica.
8 min302
Usamos cookies propias y de terceros para analizar el tráfico del sitio. Puedes aceptarlas, rechazarlas o configurar tu elección.
Más información sobre las cookies
Preferencias de cookies
NecesariasImprescindibles para el funcionamiento del sitio. Siempre activas.
AnalíticasNos ayudan a entender cómo se usa el sitio (Google Analytics).