xAI, la empresa de inteligencia artificial de Elon Musk, publicó el 17 de marzo de 2024 los pesos de Grok-1, un modelo de 314.000 millones de parámetros con arquitectura Mixture-of-Experts (MoE). La compañía lo liberó bajo licencia Apache 2.0, lo que permite descargarlo, modificarlo y usarlo con fines comerciales sin pedir permiso.
Qué es Grok-1 y qué hace
Grok-1 es un modelo de lenguaje base, entrenado desde cero por el equipo de xAI y sin ajuste fino para ninguna tarea concreta. A diferencia de lo que se le atribuyó en algunas coberturas iniciales, no es un modelo multimodal: trabaja con texto, no con imagen, audio ni vídeo. Su arquitectura MoE activa solo una parte de los 314.000 millones de parámetros en cada consulta (alrededor del 25%), lo que reduce el coste de inferencia frente a un modelo denso del mismo tamaño.
xAI construyó su propia pila de entrenamiento e inferencia con JAX y Rust, en lugar de depender de frameworks de terceros como PyTorch. La compañía explica que esta infraestructura propia le da más control sobre la eficiencia del entrenamiento a gran escala.
Frente a GPT-4 y los modelos abiertos de la época
En parámetros totales, Grok-1 supera a la mayoría de modelos abiertos disponibles en marzo de 2024, incluidos Llama 2 (70.000 millones) y Mixtral 8x7B. Frente a GPT-4, que OpenAI nunca ha confirmado en cifras pero que se estimaba muy por encima en parámetros totales, Grok-1 no pretendía competir en capacidad general, sino demostrar que xAI podía entrenar un modelo grande desde cero y liberarlo con las manos abiertas, algo que ni OpenAI ni Google hacían con sus modelos de frontera.
Para quién es Grok-1
Al ser un modelo base sin ajuste fino, Grok-1 interesa sobre todo a investigadores y equipos técnicos que quieran partir de una base grande para construir sus propios asistentes, en lugar de a quien busque un chatbot listo para usar. El asistente Grok que usan los usuarios de X se apoya en versiones posteriores y ajustadas del modelo, no en estos pesos base.
Limitaciones
314.000 millones de parámetros en formato de pesos crudos son varios cientos de gigabytes: hace falta hardware con mucha memoria de GPU para ejecutarlo, algo que descarta de entrada a la mayoría de usuarios individuales. Al no estar ajustado por instrucciones, tampoco sigue órdenes ni mantiene conversaciones con la soltura de un modelo comercial listo para usar, hay que entrenarlo o ajustarlo primero.
Disponibilidad
Los pesos y el código de Grok-1 están disponibles de forma gratuita en GitHub bajo licencia Apache 2.0. xAI siguió avanzando después con nuevas versiones, hasta el lanzamiento de Grok 4.5, ya orientado a programación y tareas agénticas tras la integración de xAI en SpaceX.
Preguntas frecuentes
¿Grok-1 es multimodal?
No. Grok-1 es un modelo de texto. Trabaja con lenguaje natural, no procesa imagen, audio ni vídeo.
¿Cuántos parámetros tiene Grok-1?
314.000 millones de parámetros con arquitectura Mixture-of-Experts, de los que solo una parte se activa en cada consulta.
¿Qué licencia tiene Grok-1?
Apache 2.0, que permite uso, modificación y explotación comercial sin pedir permiso a xAI.
¿Es lo mismo que el Grok que usan los usuarios de X?
No exactamente. El asistente que ven los usuarios de X usa versiones posteriores y ajustadas del modelo, mientras que los pesos publicados en GitHub son la base sin ese ajuste.
¿Puedo ejecutar Grok-1 en mi ordenador?
En la práctica no, salvo que dispongas de varias GPU con mucha memoria. El modelo ocupa varios cientos de gigabytes en pesos crudos.











