Machine Learning

Mistral lanza Codestral: un modelo revolucionario para el desarrollo de software

La startup francesa de inteligencia artificial, Mistral, respaldada por Microsoft y valorada en 6 mil millones de dólares, ha lanzado su primer modelo de IA para programación, llamado Codestral. Este innovador modelo está diseñado para ayudar a los desarrolladores a escribir y trabajar con código de manera más eficiente. Codestral: Una herramienta versátil para múltiples lenguajes de programación Codestral ha

Grounding DINO 1.5: Avances en la detección de objetos con IA

La empresa de investigación IDEA Research ha presentado su nuevo conjunto de modelos de inteligencia artificial, Grounding DINO 1.5, que promete revolucionar la detección y el reconocimiento de objetos en imágenes y videos sin necesidad de entrenamiento específico. Detalles de los Modelos Grounding DINO 1.5 incluye dos versiones distintas: Pro y Edge. La versión Pro está diseñada para una amplia

Meta presenta Chameleon: Su nuevo modelo multimodal de IA

Meta, a través de su laboratorio de investigación en inteligencia artificial, ha anunciado el lanzamiento de Chameleon, una innovadora familia de modelos de inteligencia artificial «basados en tokens de fusión temprana» capaces de entender y generar texto e imágenes en cualquier orden. Detalles del Modelo A diferencia de otros modelos que procesan imágenes y texto por separado para luego combinarlos,

Vidu, el competidor chino de Sora en generación de vídeo

La firma china ShengShu ha presentado Vidu, un modelo de texto a vídeo que aspira a plantar cara a Sora de OpenAI, todavía sin lanzar al público en ese momento. Vidu genera clíps de hasta 16 segundos en 1080p a partir de una simple instrucción de texto. El desarrollo arrancó en 2022, con una arquitectura propia previa al flujo de

IA en medicina: ¿diagnósticos automáticos sin supervisión humana?

Un estudio reciente ha puesto sobre la mesa algo incómodo para la medicina: GPT-4, el modelo de OpenAI, iguala o incluso supera a oftalmólogos especialistas a la hora de evaluar problemas oculares y proponer tratamiento. No es un experimento de laboratorio aislado, sino una comparación directa contra profesionales con años de práctica clínica. El modelo no solo identificó patologías oculares

SenseTime lanza SenseNova 5.0 y dice superar a GPT-4 Turbo

SenseTime presentó en un evento en Shanghai la nueva versión de su modelo de IA, SenseNova 5.0, y asegura que supera a GPT-4 Turbo en varios benchmarks internos de conocimiento general, matemáticas, razonamiento y código. La compañía china no ha publicado las cifras exactas de esas pruebas, algo habitual cuando el anuncio llega directamente del fabricante y conviene tomar con

Apple lanza OpenELM, sus primeros modelos de lenguaje en abierto

Apple ha presentado OpenELM, una familia de ocho modelos de lenguaje pequeños y de código abierto pensados para funcionar directamente en iPhones y Mac, sin depender de servidores en la nube. Es un movimiento poco habitual en una compañía conocida por mantener en secreto casi todo lo relacionado con sus modelos de IA. Ocho modelos en cuatro tamaños OpenELM llega

Phi-3 Mini: el modelo ligero de Microsoft para móviles

Microsoft ha presentado Phi-3 Mini, un modelo de lenguaje de 3.800 millones de parámetros pensado para correr directamente en el móvil, sin pasar por la nube. Es el primero de tres modelos que la compañía tiene planeados bajo la familia Phi-3, y la apuesta es clara: llevar IA útil a organizaciones que no pueden permitirse infraestructura de nube ni suscripciones

Bellwether, la IA de Alphabet que predice incendios e inundaciones

X, la fábrica de moonshots de Alphabet, ha presentado Bellwether, un sistema de inteligencia artificial que calcula el riesgo de incendio forestal de una zona con hasta cinco años de antelación. El modelo cruza datos históricos del terreno con factores de riesgo concretos, como el tipo de vegetación, el régimen de vientos y la clase de infraestructura presente en la

VASA-1 de Microsoft anima retratos: así hace rapear a la Mona Lisa

Microsoft Research Asia ha presentado VASA-1, un modelo de inteligencia artificial capaz de generar caras humanas realistas que hablan y gesticulan a partir de una sola imagen y un archivo de audio. La demostración que ha dado la vuelta a la red muestra a la Mona Lisa de Leonardo da Vinci rapeando «Paparazzi», de Lady Gaga, con movimientos de labios

Scroll al inicio