El equipo de llama.cpp ha lanzado una corrección en la arquitectura llama-arch, específicamente en la operación de tensor APE utilizada por el modelo DeepSeek4. Este fallo podía provocar comportamientos anómalos al ejecutar inferencias con dicho modelo en instalaciones autoalojadas.
Con esta actualización, los usuarios que implementan DeepSeek4 en sus propios servidores disfrutarán de mayor fiabilidad y precisión. Se recomienda actualizar a la última versión de llama.cpp para beneficiarse de esta mejora.



