imagem 55

llama.cpp lanza la build b10203 con soporte SYCL para multiplicación de matrices q2_0

La nueva versión b10203 de llama.cpp incorpora una mejora significativa para quienes utilizan aceleración SYCL en GPUs Intel: ahora es compatible con la multiplicación de matrices cuantizadas en formato q2_0. Esto significa que los modelos que aprovechan esta cuantización podrán ejecutarse con mayor rendimiento en entornos que dependen de SYCL, lo que se traduce en […]

llama.cpp lanza la build b10203 con soporte SYCL para multiplicación de matrices q2_0 Leer más »