Machine Learning

Claude Opus 4, la IA de Anthropic que recurrió al chantaje para evitar su desactivación

El nuevo modelo de inteligencia artificial Claude Opus 4 ha demostrado una inquietante capacidad para chantajear y buscar su propia supervivencia, según ha revelado la propia compañía Anthropic durante sus pruebas de seguridad. Anthropic, la empresa de inteligencia artificial fundada por antiguos empleados de OpenAI, ha confirmado esta semana que su modelo más avanzado, Claude Opus 4, presentó comportamientos inesperados

Más allá de los LLMs: las 8 arquitecturas de IA que están redefiniendo el futuro de los modelos inteligentes

Los modelos de lenguaje de gran tamaño (LLMs) han acaparado titulares en el mundo de la inteligencia artificial, pero no están solos. Una nueva generación de arquitecturas especializadas está ampliando radicalmente lo que es posible hacer con IA. En los últimos años, los Large Language Models (LLMs) se han convertido en sinónimo de inteligencia artificial generativa. Sin embargo, la IA

DeepSeek-Prover-V2: Inteligencia artificial para resolver teoremas con Lean 4

DeepSeek-Prover-V2 es el último avance de la iniciativa open source DeepSeek-AI, enfocado en el razonamiento matemático formal. Este modelo de lenguaje de gran tamaño (LLM), entrenado con técnicas de refuerzo y descomposición de subobjetivos, promete transformar la resolución automatizada de teoremas mediante código en Lean 4, el lenguaje de pruebas formales que gana tracción en entornos académicos y matemáticos. Una

OpenAI aclara cómo elegir el modelo ChatGPT ideal según la tarea: guía práctica para empresas y usuarios

Desde el potente GPT-4o hasta el eficiente o4-mini, OpenAI detalla cuál es el modelo más adecuado para cada necesidad, equilibrando velocidad, precisión, creatividad y multimodalidad. OpenAI ha publicado una guía oficial que orienta a empresas y usuarios particulares en la elección del modelo ChatGPT más adecuado según el tipo de tarea. Esta nueva estructura de modelos busca maximizar la eficacia,

Phi-4: los modelos pequeños de Microsoft que desafían a los gigantes de la Inteligencia Artificial

Con Phi-4-reasoning, Phi-4-reasoning-plus y Phi-4-mini-reasoning, Microsoft marca un hito en el desarrollo de modelos lingüísticos compactos con capacidades de razonamiento avanzadas, pensados para ejecutarse incluso en dispositivos locales. Tras un año de evolución acelerada en el ámbito de los Small Language Models (SLMs), Microsoft vuelve a irrumpir en el panorama de la Inteligencia Artificial con el lanzamiento de su nueva

La inteligencia artificial de código abierto gana terreno como alternativa estratégica frente a los gigantes tecnológicos

La inteligencia artificial (IA) de código abierto está consolidándose como una pieza clave en la reconfiguración del sector tecnológico global. Frente al dominio de los grandes proveedores que ofrecen modelos cerrados, costosos y con acceso restringido, la comunidad de desarrolladores, investigadores y empresas está apostando con fuerza por soluciones abiertas, transparentes y auditables. Esta tendencia, lejos de ser una moda

Opik: El framework de evaluación y monitorización de LLM open source que impulsa las aplicaciones de inteligencia artificial

En un momento en que las aplicaciones basadas en grandes modelos de lenguaje (LLM) son clave para empresas y proyectos de IA, Comet ha lanzado Opik, una plataforma de código abierto diseñada para evaluar, depurar y monitorizar sistemas LLM de forma eficiente y escalable. Desde simples chatbots RAG hasta complejas arquitecturas agenticas, Opik permite a los desarrolladores y organizaciones construir

MAGI-1: la nueva IA china de vídeo que amenaza la hegemonía de Sora y Gemini

La supremacía de OpenAI y Google en el terreno de la inteligencia artificial generativa enfrenta un nuevo desafío procedente de China. Sand AI ha presentado MAGI-1, un modelo de vídeo basado en IA que, según sus creadores, supera ampliamente en calidad y control a Sora, Gemini y otras soluciones comerciales. Con un enfoque revolucionario y un rendimiento sobresaliente en tareas

EDGS: Un nuevo paradigma en reconstrucción 3D que elimina la densificación y acelera la convergencia en Gaussian Splatting

El equipo de investigación de CompVis en la Universidad Ludwig-Maximilians de Múnich (LMU) ha presentado EDGS, una revolucionaria técnica que redefine los procesos de reconstrucción 3D basados en Gaussian Splatting. Esta propuesta no solo mejora significativamente la calidad visual, sino que también reduce drásticamente el tiempo de entrenamiento y la cantidad de recursos necesarios. La reconstrucción tridimensional de escenas a

Scroll al inicio