Categorías

Categorías Jacar — explora los temas Un cohete cuyos ojos siguen el cursor.
Agentes IA

Cómo usar Shieldstral como guardarraíl local de tu agente

Shieldstral es el clasificador de seguridad de 3B que Mistral publicó en agosto de 2026: responde sí o no a una política escrita en lenguaje natural. Convertido a GGUF Q8_0 con llama.cpp y servido en CPU, no bloqueó ninguno legítimo de los 100 prompts que preparé en español e inglés, pero dejó pasar 8 de 17 inyecciones.

Agentes IA

Cómo usar OpenCode con modelos locales en llama.cpp y Ollama

OpenCode usa un modelo local si declaras en opencode.json un proveedor @ai-sdk/openai-compatible con la URL de llama-server u Ollama y el límite de contexto del modelo. La versión 1.18.31 envía 7.516 tokens en su primer turno, así que los 4k que Ollama asigna por defecto sin GPU grande no bastan: reserva 32k.

Agentes IA

Cómo migrar Langfuse autoalojado de v3 a v4

Para migrar Langfuse de v3 a v4 con Docker Compose, sube primero ClickHouse a 26.4 sin tocar Langfuse, copia PostgreSQL y ClickHouse, arranca la v4 en modo de doble escritura, rellena el histórico y pasa a events_only cuando todos tus SDK sean compatibles. Lo probé con 45 931 trazas y tres versiones del SDK de Python.

Agentes IA

Cómo usar DeepSeek Harness con un modelo local

DeepSeek Harness (dsh) es el arnés de agentes de código abierto que DeepSeek publicó en agosto de 2026. Funciona con un modelo local si declaras en settings.yaml un proveedor openai-completions que apunte a llama-server, con una clave de relleno y el contexto real. Con Qwen3.5-4B en CPU dejó los tests en verde en 4 de 5 intentos, pero despacio.

Agentes IA

Cómo crear un agente con Dify Agent y un modelo local

Dify Agent, el agente con sandbox Linux de Dify 1.16, funciona con un modelo local si instalas el plugin de Ollama y activas las llamadas a herramientas. Con Dify 1.17.1 y Qwen3.5-4B en CPU, el agente publicado dio cifras correctas en tres de tres pruebas; el modo Build no terminó ninguna de sus tres sesiones.

Agentes IA

Engram: memoria persistente para agentes de código

Engram es un binario en Go con SQLite y FTS5 que da memoria persistente a los agentes de código a través de MCP. Guarda decisiones y convenciones entre sesiones, se sincroniza por git y no necesita Node, Python ni Docker. Su búsqueda es léxica, no semántica, y eso condiciona qué conviene guardar.

Agentes IA

Herdr: multiplexor de terminal para agentes de código

Herdr es un multiplexor de terminal escrito en Rust que ejecuta tus agentes de código dentro de un servidor en segundo plano. Marca cada panel como trabajando, bloqueado o inactivo, y ese estado sube hasta el espacio de trabajo, así que sabes de un vistazo cuál agente te está esperando.