OpenAI ha presentado una nueva generación de modelos de embeddings, dos versiones actualizadas de GPT-3.5 Turbo y GPT-4 Turbo con precios más bajos, un modelo de moderación renovado y herramientas de gestión de claves de API pensadas para equipos que gastan miles de dólares al mes en la plataforma.
Dos embeddings nuevos, hasta 5 veces más baratos
La compañía sustituye a text-embedding-ada-002 por dos modelos: text-embedding-3-small y text-embedding-3-large. El primero cuesta 0,00002 dólares por cada 1.000 tokens, un 80% menos que su predecesor, y mejora los resultados en los benchmarks MIRACL y MTEB pese a ser más barato. El segundo genera vectores de hasta 3.072 dimensiones, ofrece el rendimiento más alto del catálogo de OpenAI en búsqueda semántica y se factura a 0,00013 dólares por 1.000 tokens.
Ambos modelos incorporan una función que ya pedan desde hacía tiempo los equipos que construyen sistemas RAG: acortar el vector de salida sin perder la mayor parte de su capacidad de representación, para poder elegir entre precisión y coste de almacenamiento según el caso de uso, algo que antes obligaba a entrenar un modelo distinto para cada dimensión.
GPT-3.5 Turbo, más barato y sin el bug del texto no inglés
El nuevo GPT-3.5 Turbo (versión 0125) reduce el precio un 50% en tokens de entrada y un 25% en tokens de salida frente al modelo anterior. OpenAI también corrige un fallo de codificación que afectaba a textos en idiomas distintos del inglés en llamadas con function calling, y ajusta el modelo para que siga con más fidelidad las instrucciones del formato de respuesta pedido.
GPT-4 Turbo preview corrige la «pereza» del modelo
La vista previa actualizada de GPT-4 Turbo ataca directamente una queja habitual de los desarrolladores: el modelo dejaba tareas de generación de código a medias con comentarios del tipo «el resto del código va aquí». La nueva versión completa más código de principio a fin. OpenAI adelanta además que la disponibilidad general de GPT-4 Turbo con capacidad de visión, hasta ahora limitada a la vista previa, llegará en las próximas semanas, lo que permitirá combinar visión y function calling en el mismo modelo por primera vez.
Estos ajustes llegan mientras OpenAI sigue empujando generaciones sucesivas de GPT a un ritmo cada vez mayor, la misma dinámica que años después llevaría a GPT-5.6 a convertirse en el modelo con el lanzamiento más controlado de la historia de la compañía.
Moderación y control de claves de API
El modelo de moderación text-moderation-007 mejora la precisión al detectar contenido potencialmente dañino y sigue siendo gratuito a través del endpoint de moderación. En paralelo, OpenAI añade a su plataforma la posibilidad de asignar permisos específicos a cada clave de API (solo lectura, solo escritura, acceso a un modelo concreto) y un panel de uso que desglosa el consumo y el gasto por clave, algo que hasta ahora solo se podía ver a nivel de cuenta completa.
Preguntas frecuentes
¿Cuánto más barato es text-embedding-3-small que ada-002?
Cuesta un 80% menos: 0,00002 dólares por 1.000 tokens frente a los 0,0001 dólares del modelo anterior, y además puntua más alto en los benchmarks MIRACL y MTEB.
¿Qué dimensiones tiene text-embedding-3-large?
Genera vectores de hasta 3.072 dimensiones, aunque se pueden acortar sin perder la mayor parte de la capacidad de representación conceptual.
¿En cuánto baja el precio de GPT-3.5 Turbo?
Un 50% en tokens de entrada y un 25% en tokens de salida respecto al modelo anterior.
¿Qué problema corrige la nueva vista previa de GPT-4 Turbo?
Reduce los casos en los que el modelo dejaba a medias tareas de generación de código, completando más trabajo de principio a fin.
¿Qué permite hacer el nuevo panel de claves de API?
Asignar permisos específicos a cada clave y ver el consumo y gasto desglosado por clave, no solo a nivel de cuenta.













