Machine Learning

¿Devstral-Small-2-24B es el nuevo “rey local” del código?

Mistral AI vuelve a sacudir el ecosistema de modelos de lenguaje para desarrolladores con el lanzamiento de Devstral-Small-2-24B-Instruct, una versión “pequeña” en parámetros, pero muy ambiciosa en prestaciones. Su promesa es clara: acercarse al rendimiento de los grandes modelos de código… sin necesidad de un clúster ni de enviar el código fuente a la nube. Y la pregunta se impone

DeepSeek, bajo sospecha: así habría burlado el veto de GPU NVIDIA para entrenar su nueva IA

DeepSeek, uno de los nombres de moda en la carrera de la inteligencia artificial china, se ha colocado en el centro de una tormenta geopolítica. Según informaciones filtradas por diversas fuentes del sector, la compañía habría entrenado su próximo modelo de IA utilizando miles de GPU NVIDIA de última generación (arquitectura Blackwell) que, sobre el papel, nunca deberían haber llegado

Z-Image: el modelo de imágenes eficiente que quiere democratizar la IA generativa

El ecosistema de la inteligencia artificial generativa suma un nuevo actor destacado. Se llama Z-Image, es open source, cuenta con 6.000 millones de parámetros y llega con una promesa clara: ofrecer calidad de imagen de primer nivel con una eficiencia muy superior a la de muchos modelos existentes, tanto en coste de cómputo como en velocidad de inferencia. Detrás del

OpenCode, el agente de código abierto que quiere llevar la IA a tu terminal

La fiebre por los “coding agents” no se frena, pero hasta ahora casi todo pasaba por herramientas propietarias y muy ligadas a un proveedor concreto (Claude Code, GitHub Copilot, etc.). OpenCode llega precisamente para romper ese esquema: es un agente de IA para programar pensado desde el terminal, 100 % open source y agnóstico de proveedor de modelos. El proyecto,

NVIDIA’s Jensen Huang cree que el “apocalipsis de la IA” no va a ocurrir

El debate sobre si la inteligencia artificial podría convertirse algún día en una amenaza existencial para la humanidad vuelve a encenderse, pero el CEO de NVIDIA, Jensen Huang, lo tiene claro: el escenario tipo Terminator “no va a pasar”. Así lo afirmó en una reciente conversación con Joe Rogan, en la que fue preguntado directamente por el miedo a que

¿Adiós a la amnesia de los asistentes de IA? Así funciona Claude-Mem

En el día a día de muchos desarrolladores, el patrón se repite: se abre una sesión con un asistente de Inteligencia Artificial, se le explica el proyecto, se trabaja un rato… y, cuando el contexto se llena o la sesión termina, todo se pierde. En la siguiente conexión hay que volver a entrenar al asistente desde cero, repasar decisiones, copiar

DeepSeek revienta el tablero: un modelo abierto de ~680.000 millones de parámetros que desafía a GPT-5 y Gemini 3 Pro

La guerra de la inteligencia artificial de última generación acaba de subir otro peldaño. La china DeepSeek ha publicado en Hugging Face los pesos de DeepSeek-V3.2-Speciale, un modelo Mixture-of-Experts con del orden de cientos de miles de millones de parámetros (alrededor de 6,7×10¹¹) y licencia MIT, lo que lo convierte, de facto, en uno de los modelos abiertos más potentes

Scroll al inicio