OpenAI renueva sus embeddings y abarata GPT-3.5 y GPT-4 Turbo

OpenAI ha presentado una nueva generación de modelos de embeddings, dos versiones actualizadas de GPT-3.5 Turbo y GPT-4 Turbo con precios más bajos, un modelo de moderación renovado y herramientas de gestión de claves de API pensadas para equipos que gastan miles de dólares al mes en la plataforma.

Dos embeddings nuevos, hasta 5 veces más baratos

La compañía sustituye a text-embedding-ada-002 por dos modelos: text-embedding-3-small y text-embedding-3-large. El primero cuesta 0,00002 dólares por cada 1.000 tokens, un 80% menos que su predecesor, y mejora los resultados en los benchmarks MIRACL y MTEB pese a ser más barato. El segundo genera vectores de hasta 3.072 dimensiones, ofrece el rendimiento más alto del catálogo de OpenAI en búsqueda semántica y se factura a 0,00013 dólares por 1.000 tokens.

Ambos modelos incorporan una función que ya pedan desde hacía tiempo los equipos que construyen sistemas RAG: acortar el vector de salida sin perder la mayor parte de su capacidad de representación, para poder elegir entre precisión y coste de almacenamiento según el caso de uso, algo que antes obligaba a entrenar un modelo distinto para cada dimensión.

GPT-3.5 Turbo, más barato y sin el bug del texto no inglés

El nuevo GPT-3.5 Turbo (versión 0125) reduce el precio un 50% en tokens de entrada y un 25% en tokens de salida frente al modelo anterior. OpenAI también corrige un fallo de codificación que afectaba a textos en idiomas distintos del inglés en llamadas con function calling, y ajusta el modelo para que siga con más fidelidad las instrucciones del formato de respuesta pedido.

GPT-4 Turbo preview corrige la «pereza» del modelo

La vista previa actualizada de GPT-4 Turbo ataca directamente una queja habitual de los desarrolladores: el modelo dejaba tareas de generación de código a medias con comentarios del tipo «el resto del código va aquí». La nueva versión completa más código de principio a fin. OpenAI adelanta además que la disponibilidad general de GPT-4 Turbo con capacidad de visión, hasta ahora limitada a la vista previa, llegará en las próximas semanas, lo que permitirá combinar visión y function calling en el mismo modelo por primera vez.

Estos ajustes llegan mientras OpenAI sigue empujando generaciones sucesivas de GPT a un ritmo cada vez mayor, la misma dinámica que años después llevaría a GPT-5.6 a convertirse en el modelo con el lanzamiento más controlado de la historia de la compañía.

Moderación y control de claves de API

El modelo de moderación text-moderation-007 mejora la precisión al detectar contenido potencialmente dañino y sigue siendo gratuito a través del endpoint de moderación. En paralelo, OpenAI añade a su plataforma la posibilidad de asignar permisos específicos a cada clave de API (solo lectura, solo escritura, acceso a un modelo concreto) y un panel de uso que desglosa el consumo y el gasto por clave, algo que hasta ahora solo se podía ver a nivel de cuenta completa.

Preguntas frecuentes

¿Cuánto más barato es text-embedding-3-small que ada-002?

Cuesta un 80% menos: 0,00002 dólares por 1.000 tokens frente a los 0,0001 dólares del modelo anterior, y además puntua más alto en los benchmarks MIRACL y MTEB.

¿Qué dimensiones tiene text-embedding-3-large?

Genera vectores de hasta 3.072 dimensiones, aunque se pueden acortar sin perder la mayor parte de la capacidad de representación conceptual.

¿En cuánto baja el precio de GPT-3.5 Turbo?

Un 50% en tokens de entrada y un 25% en tokens de salida respecto al modelo anterior.

¿Qué problema corrige la nueva vista previa de GPT-4 Turbo?

Reduce los casos en los que el modelo dejaba a medias tareas de generación de código, completando más trabajo de principio a fin.

¿Qué permite hacer el nuevo panel de claves de API?

Asignar permisos específicos a cada clave y ver el consumo y gasto desglosado por clave, no solo a nivel de cuenta.

Scroll al inicio