Llama: guía completa, noticias y análisis

Llama es el modelo de lenguaje grande (LLM) de código abierto creado por Meta. Su lanzamiento en 2023 cambió el acceso a la inteligencia artificial generativa: ahora cualquier equipo de investigación o empresa puede descargarlo, ejecutarlo en local y ajustarlo con sus propios datos. A diferencia de modelos cerrados como GPT-4, Llama permite inspeccionar su arquitectura y modificarlo sin restricciones de licencia para uso comercial. Por eso se convirtió en la base de cientos de proyectos, desde chatbots hasta herramientas de análisis de datos.

En Borderio cubrimos tanto inteligencia artificial como el mundo del vino. Por ejemplo, analizamos la fermentación del vino en este artículo, brindamos con Bellamarina en Coviñas y comparamos pinot noir de Borgoña y California en Grivot vs. Aubert. Esta página es el hub central sobre Llama: vas a encontrar la definición, su historia, productos, impacto y todos los artículos que publicamos sobre esta tecnología.

Llama es una familia de modelos de lenguaje grandes (LLM) de código abierto desarrollada por Meta AI, disponible para uso comercial bajo licencia específica desde 2023, con versiones que van de 7B a 405B parámetros y capacidades multimodales en su versión 3.2. Se ejecuta en hardware local, permite fine-tuning y se usa tanto en investigación como en entornos productivos.

En 30 segundos

  • Qué es: modelo de lenguaje de Meta, open source y gratuito para uso comercial (bajo licencia Llama).
  • Versiones clave (lista histórica): Llama 1 (febrero 2023), Llama 2 (julio 2023), Llama 3 (abril 2024), Llama 3.2 (septiembre 2024, multimodal), Llama 4 (abril 2025).
  • Tamaños: 7B, 8B, 13B, 70B, 405B parámetros (según versión).
  • Usos típicos: chatbots, asistentes, análisis de datos, generación de texto, y modelos especializados mediante fine-tuning.

Definición clara

Llama (Large Language Model Meta AI) es un modelo de lenguaje de código abierto desarrollado por Meta AI que se distribuye gratuitamente para fines de investigación y uso comercial. Su arquitectura es similar a la de GPT, pero con menor cantidad de parámetros para lograr eficiencia computacional, y está disponible en múltiples tamaños para adaptarse a distinto hardware y casos de uso.

Historia y evolución

Meta lanzó la primera versión de Llama en febrero de 2023. Era un modelo de solo inferencia, con tamaños de 7B, 13B, 33B y 65B parámetros. Su código se filtró rápidamente y la comunidad lo adoptó para tareas de investigación. En julio de 2023 llegó Llama 2, con licencia comercial gratuita y mejor rendimiento. En abril de 2024 Meta lanzó Llama 3, con versiones de 8B y 70B, y en julio de ese año lanzó el modelo gigante de 405B. Llama 3.2 (septiembre 2024) incorporó capacidades multimodales (visión). En abril de 2025 llegó Llama 4, el modelo más grande de Meta hasta la fecha. Cada versión trajo mejoras en precisión, velocidad y soporte de contexto largo (hasta 128K tokens en Llama 3).

Productos y servicios principales

  • Llama 4: el modelo más grande de Meta hasta la fecha, sucesor del 405B, con mejoras en razonamiento, eficiencia y soporte de contexto. Requiere hardware especializado.
  • Llama 3.1 405B: modelo de 405 mil millones de parámetros, usado para generación de texto complejo y razonamiento profundo. Requiere hardware especializado.
  • Llama 3.2 (multimodal): integra visión y texto, permitiendo análisis de imágenes además de texto. Disponible en tamaños 11B y 90B.
  • Llama 3 (8B y 70B): modelos más ligeros y rápidos, ideales para fine-tuning y despliegue en entornos productivos con GPU sencillas.
  • Llama 2 (7B, 13B, 70B): primera versión con licencia comercial, base de muchos proyectos open source.
  • Ollama: herramienta de la comunidad que simplifica la ejecución local de Llama y otros modelos. No es de Meta, pero es el método más usado para probar Llama en PC.

Impacto en la industria

Llama democratizó el acceso a modelos de lenguaje de alto rendimiento. Antes de 2023, los LLMs de calidad solo estaban disponibles mediante APIs caras (GPT-3, PaLM) o eran inaccesibles por su tamaño. Llama permitió que startups, universidades y equipos pequeños ejecutaran modelos avanzados en sus propios servidores, sin pagar por token. Su licencia comercial eliminó barreras legales. Hoy, cientos de modelos derivados (como Alpaca, Vicuna, Mistral) se basan en Llama. En empresas, se usa para automatizar atención al cliente, análisis de documentos y generación de informes. En investigación, ha acelerado el estudio de alineamiento, seguridad y eficiencia de IA.

Nuestros artículos sobre Llama

En Borderio publicamos contenido variado que incluye inteligencia artificial y vinos. Estos son todos los artículos relacionados con Llama (y el mundo del vino, que también cubrimos):

Vinos (contenido del blog)

Preguntas Frecuentes

¿Qué es Llama exactamente?

Llama es un modelo de lenguaje grande (LLM) de código abierto creado por Meta AI. Su principal diferencia con otros modelos es que podés descargarlo y ejecutarlo en tu propio hardware sin pagar por uso, siempre que cumplas con los términos de la licencia (que permite uso comercial para empresas con menos de 700 millones de usuarios activos mensuales).

¿Llama es gratis?

Sí, Llama se distribuye gratuitamente. No hay costo por descargarlo ni por usarlo. Los costos asociados son solo de infraestructura (hardware, electricidad) si lo ejecutás localmente, o de servicios cloud si lo alquilás. No hay pago por token como en APIs comerciales.

¿Cuáles son los requisitos de hardware para ejecutar Llama?

Depende del tamaño del modelo. Llama 3 8B puede correr en una GPU con 8 GB de VRAM (por ejemplo, RTX 3060), o incluso en CPU con cuantización. Llama 3 70B necesita una GPU con al menos 48 GB de VRAM, o varias GPUs. El modelo 405B requiere múltiples GPUs de alta gama (por ejemplo, 8x A100). También existen versiones cuantizadas que reducen los requisitos a cambio de menor precisión.

¿Qué diferencia hay entre Llama y GPT?

GPT es un modelo cerrado de OpenAI: solo se accede vía API y no se pueden ver sus pesos ni modificarlos. Llama es de código abierto: podés descargar los pesos, inspeccionar la arquitectura, hacer fine-tuning y redistribuirlo. En rendimiento, Llama 3 70B compite con GPT-4 en muchas tareas, mientras que Llama 3 405B supera a GPT-4 en benchmarks de razonamiento.

Fuentes oficiales

¿Querés vivir la experiencia? Visitá Borde Río: restaurante, viñedo y experiencias en Victoria, Entre Ríos
Scroll al inicio