Llama.cpp estrena kernel FWHT en el backend Metal para acelerar el rendimiento en Apple Silicon
La nueva versión de llama.cpp incorpora un kernel FWHT (Transformada Rápida de Walsh-Hadamard) en su backend Metal, optimizando el procesamiento en dispositivos con chips Apple Silicon. Este avance, desarrollado por YiChen Lv y Georgi Gerganov, permite aprovechar mejor las capacidades de la GPU en macOS e iOS, reduciendo los tiempos de inferencia en modelos de […]


