Corrección de error en operación de tensor APE para DeepSeek4 en llama-arch

imagem 20

El equipo de llama.cpp ha lanzado una corrección en la arquitectura llama-arch, específicamente en la operación de tensor APE utilizada por el modelo DeepSeek4. Este fallo podía provocar comportamientos anómalos al ejecutar inferencias con dicho modelo en instalaciones autoalojadas.

Con esta actualización, los usuarios que implementan DeepSeek4 en sus propios servidores disfrutarán de mayor fiabilidad y precisión. Se recomienda actualizar a la última versión de llama.cpp para beneficiarse de esta mejora.

Deja un comentario

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *