Cuando X (antes Twitter) publicó los pesos de Grok-1 en GitHub bajo licencia Apache 2.0, la comunidad de código abierto lo recibió como una buena noticia. Pocos días después llegó la letra pequeña: xAI, la empresa de Elon Musk detrás del modelo, no ha publicado ni los datos de entrenamiento ni el código del proceso que usó para construirlo. Solo los pesos.
Mientras tanto, la versión 1.5 de Grok quedó reservada a los usuarios de pago de X Premium, lo que deja a quien solo tiene acceso al modelo abierto un paso por detrás de quien paga la suscripción.
Pesos abiertos, datos cerrados
Massimiliano Maffulli, director ejecutivo de la Open Source Initiative (OSI), ha señalado que publicar los pesos de un modelo no lo convierte automáticamente en código abierto. Sin saber qué datos se usaron para entrenarlo, es imposible comprobar si hay contenido con derechos de autor, sesgos heredados de las fuentes o material que nunca debió entrar en el conjunto de entrenamiento. La periodista Pascale Davies apuntó en la misma dirección al cubrir el lanzamiento: la licencia Apache 2.0 cubre el código, no las decisiones que hay detrás del modelo.
La Free Software Foundation no se ha pronunciado formalmente sobre Grok-1, aunque el proyecto figura ya en su Free Software Directory, un listado que recoge software con licencia libre sin entrar a valorar la transparencia de sus datos de entrenamiento.
No es el único caso
El debate no es exclusivo de xAI. Otros laboratorios han recibido críticas similares por llamar «abiertos» a modelos que solo publican los pesos finales, sin los datos ni la receta completa de entrenamiento. La etiqueta vende bien de cara al público y a los desarrolladores, pero deja fuera justo lo que hace falta para auditar de dónde sale el conocimiento del modelo.
El caso llega en un momento en el que otras compañías de Musk han ido moviendo piezas alrededor de xAI, con SpaceX comprando xAI para llevar Grok a Starlink y Starship, lo que da a este debate sobre transparencia un peso mayor del que tenía cuando Grok-1 era solo un experimento aislado. Para quien tenga que elegir un modelo en producción, conviene mirar más allá de la etiqueta «open source» y consultar criterios como los de esta comparativa práctica de modelos open source para empresas.
Qué significa para quien quiere usar Grok-1
En la práctica, cualquiera puede descargar los pesos de Grok-1 y ejecutarlo bajo los términos de Apache 2.0, sin restricciones de uso comercial. El problema aparece si una empresa necesita justificar de dónde procede el conocimiento del modelo, por ejemplo por motivos de cumplimiento normativo o de gestión de riesgo legal. Ahí la falta de documentación sobre los datos de entrenamiento pesa más que la licencia del código.
Preguntas frecuentes
¿Grok-1 es realmente código abierto?
Los pesos del modelo son abiertos bajo licencia Apache 2.0, pero xAI no ha publicado los datos de entrenamiento ni el proceso completo, algo que organizaciones como la OSI consideran imprescindible para llamarlo código abierto en sentido estricto.
¿Puedo usar Grok-1 de forma comercial?
Sí, la licencia Apache 2.0 permite uso comercial sin restricciones sobre el código y los pesos publicados.
¿Qué diferencia hay entre Grok-1 y Grok 1.5?
Grok 1.5 es una versión mejorada reservada a usuarios de pago de X Premium, mientras que Grok-1 es la versión cuyos pesos se publicaron en abierto en GitHub.
¿Por qué importa la transparencia de los datos de entrenamiento?
Sin conocer las fuentes usadas para entrenar un modelo es difícil detectar sesgos, contenido con derechos de autor o problemas legales que puedan afectar a quien lo use en producción.












