
DeepSeek reduce el KV cache a 890 bytes por token y ataca un gran coste de la IA
DeepSeek ha llevado a 890 bytes por token el KV cache global de su nuevo DeepSeek-V4.1-Flash, frente a los 3.514 bytes de V4-Flash y los 389.120 bytes de su arquitectura V1 de 2023. La reducción, de unas 437 veces en menos de tres años según las cifras del propio fabricante, apunta directamente a uno de los problemas que aparecen al













