Categorías

Inteligencia Artificial

Llama 3: el nuevo estándar abierto de Meta

Llama 3 es la familia de modelos abiertos que Meta lanzó el 18 de abril de 2024 en 8.000 y 70.000 millones de parámetros, entrenada con 15 billones de tokens. El 70B superó a Claude Sonnet, Mistral Medium y GPT-3.5 en la evaluación humana de Meta, y su licencia permite uso comercial gratuito hasta 700 millones de usuarios activos al mes.

Inteligencia Artificial

Elegir un LLM abierto para empresa en 2024

Elegir un LLM abierto para empresa en 2024 ya no se limita a Llama 2: Mistral, Mixtral, Qwen, Yi, DeepSeek y Phi-2 compiten con licencias y tamaños distintos. Los criterios que de verdad deciden son la licencia comercial, el hardware disponible, el soporte de idioma y una evaluación propia sobre casos de uso reales, no solo el benchmark de moda.

Herramientas

Cuantización de modelos y llama.cpp en tu portátil

Con cuantización, los pesos de un modelo se guardan con menos bits (4, 5 u 8 en vez de 16), así que Llama 2 13B pasa de 26 GB a unos 7,5 GB. Con llama.cpp corre en un portátil normal de 16 GB de RAM sin GPU dedicada, y la pérdida de calidad es menor de lo que la intuición sugiere.

Cómo Instalar

Cómo instalar Ollama para ejecutar LLM en tu ordenador

Ollama hace trivial ejecutar modelos como Llama 2 o Mistral en tu propio ordenador: un binario, un comando y los pesos cuantizados descargándose al disco sin compilar nada. Esta guía cubre la instalación en macOS, Linux y Windows, con una valoración honesta de lo que la inferencia local puede y no puede hacer frente a los modelos de frontera.

Inteligencia Artificial

LLaMA 2 y la nueva ola de modelos de lenguaje abiertos

Meta publicó LLaMA 2 el 18 de julio de 2023 con licencia comercial libre de royalties, en tres tamaños (7B, 13B, 70B parámetros). El modelo 70B iguala o supera a GPT-3.5 en benchmarks estándar. Para el 99,9 % de las organizaciones la licencia permite descargar, modificar y ejecutar el modelo en producción con privacidad total.