Apps y webs IA

Un modelo de 2,78 billones de parámetros ya funciona con 8 GB de RAM

Un proyecto de código abierto en C99 ha conseguido ejecutar Kimi K3, un modelo de 2,78 billones de parámetros, en un único procesador y con apenas 8,24 GB de memoria RAM medida. El truco no consiste en comprimir todo el modelo hasta hacerlo caber en un portátil: sus pesos siguen ocupando 1,56 TB en disco y el motor los va

Cómo usar Jev, el modelo de IA que solo toma decisiones

TypeSafe AI, el laboratorio fundado por el exinvestigador de OpenAI Diogo Almeida, presentó el 15 de septiembre Jev, un modelo que no escribe texto: recibe un contenido, contesta a preguntas cerradas sobre él y devuelve una respuesta tipada con probabilidades y un índice de confianza. Según la documentación de la compañía, cada llamada tarda entre 70 y 500 milisegundos y

Clonar una voz sin nube ni APIs de pago: Qwen3-TTS ya funciona en local

La clonación de voz con inteligencia artificial ya puede ejecutarse íntegramente en un ordenador doméstico sin enviar la grabación a servicios externos. Un proyecto publicado en GitHub por el desarrollador jceronch1 combina Qwen3-TTS 12Hz 1.7B, el formato GGUF y llama.cpp en una aplicación web que permite grabar una muestra de voz, escribir un texto y sintetizarlo posteriormente con características de

Avid lleva Media Composer al navegador e integra Gemini para editar vídeo con IA

Avid y Google Cloud han ampliado su alianza para llevar Media Composer al navegador Chrome y conectar la plataforma profesional de edición con Gemini Enterprise, BigQuery y nuevos agentes especializados en producción audiovisual. La propuesta permite trabajar con líneas de tiempo desde el navegador, buscar material mediante lenguaje natural y automatizar tareas como transcripción, sincronización, etiquetado u organización de proyectos.

El truco para que los agentes de IA lean de verdad la documentación de Apple

Los agentes de programación pueden escribir Swift, modificar proyectos completos y, con Xcode 27, utilizar herramientas, skills y servidores Model Context Protocol (MCP). Pero existe un problema bastante más básico: buena parte de la documentación de Apple en developer.apple.com se presenta mediante JavaScript y una petición automatizada puede encontrarse inicialmente con una página sin el contenido que ve un navegador.

vLLM en un Mac no funciona igual que vLLM sobre una GPU NVIDIA

vLLM se ha convertido en una de las piezas más conocidas para servir modelos de lenguaje a gran escala, pero hablar de «vLLM» como si ofreciera exactamente la misma arquitectura en cualquier hardware puede llevar a confusión. En NVIDIA, AMD o determinadas plataformas aceleradas, el proyecto se apoya en backends y kernels específicos para cada hardware. En Apple Silicon, vLLM-Metal

La KV cache explica por qué un LLM que cabe en tu GPU deja de caber con más contexto

Ejecutar un modelo de inteligencia artificial en local tiene una trampa que no siempre resulta evidente al mirar únicamente el tamaño de sus pesos: la memoria necesaria aumenta conforme crece el contexto, aunque el modelo siga ocupando exactamente lo mismo. Una de las principales responsables es la KV cache, la memoria temporal utilizada por los modelos Transformer durante la inferencia

NightRun arranca una IA desde un USB sin Linux, Windows ni conexión a Internet

NightRun propone una forma bastante distinta de ejecutar inteligencia artificial en local: el ordenador arranca directamente desde un USB, carga el modelo completo en la memoria RAM y abre un chat sin iniciar Linux, Windows ni otro sistema operativo convencional. Tampoco incorpora una pila de red. Una vez cargado el modelo, el almacenamiento queda bloqueado para nuevas lecturas y la

Adobe convierte Acrobat en una herramienta de IA para documentos, audio y presentaciones

Adobe está ampliando Acrobat mucho más allá de la lectura y edición de PDF con nuevas funciones de inteligencia artificial capaces de transformar documentos en informes visuales, presentaciones, resúmenes de audio y podcasts personalizados. Las novedades se apoyan en Adobe Productivity Agent e incluyen además herramientas empresariales para consultar y extraer información de grandes colecciones de archivos conectadas a repositorios

Scroll al inicio