Prompt engineering ha madurado de trucos virales a disciplina con patrones reproducibles: few-shot, chain-of-thought y salida estructurada con function calling. Los equipos que tratan los prompts como código (versionados, probados y monitorizados) obtienen resultados consistentemente mejores que los que improvisan.
Anthropic lanzó la familia Claude 3 el 4 de marzo de 2024 con tres modelos: Haiku, Sonnet y Opus, todos con 200k tokens de contexto. Haiku cuesta $0.25 por millón de tokens; Opus compite con GPT-4 Turbo en benchmarks. Esta comparativa explica cuándo elegir cada nivel y cómo combinarlos en producción para minimizar coste sin perder calidad donde importa.
Claude 2, lanzado por Anthropic en julio de 2023, ofrece una ventana de contexto de 100.000 tokens y seguridad basada en Constitutional AI. Frente a GPT-4, gana en analisis de documentos largos y codigo con contexto amplio; GPT-4 sigue adelante en razonamiento matematico complejo y en su ecosistema de herramientas.
Cinco meses después de su lanzamiento, GPT-4 destaca en razonamiento encadenado, escritura técnica y código de mediana complejidad, pero sigue fallando en aritmética, información posterior a su corte de datos y consistencia entre conversaciones. Claude 2 gana en contexto largo; LLaMA 2, en coste y privacidad.
5 min2764,7
Usamos cookies propias y de terceros para analizar el tráfico del sitio. Puedes aceptarlas, rechazarlas o configurar tu elección.
Más información sobre las cookies
Preferencias de cookies
NecesariasImprescindibles para el funcionamiento del sitio. Siempre activas.
AnalíticasNos ayudan a entender cómo se usa el sitio (Google Analytics).