Apple GPU

imagem 23

Ollama 0.32.6-rc0: Más velocidad para Qwen3.5 en Apple, mejoras clave en la API y correcciones en la interfaz

La nueva versión preliminar de Ollama trae importantes mejoras de rendimiento y compatibilidad. En sistemas Apple, el motor MLX ahora utiliza automáticamente la cabeza MTP del modelo Qwen3.5 para decodificación especulativa, acelerando notablemente la inferencia en GPUs de Apple. Además, se han actualizado los motores MLX y llama.cpp, lo que garantiza un funcionamiento más fluido […]

Ollama 0.32.6-rc0: Más velocidad para Qwen3.5 en Apple, mejoras clave en la API y correcciones en la interfaz Leer más »

imagem 34

Ollama v0.32.4: Soporte para Laguna en GPUs Apple, mejoras en decodificación especulativa y MoE

La nueva versión de Ollama, la 0.32.4, incorpora compatibilidad con el modelo Laguna en GPUs de Apple a través del motor MLX. Esto significa que los usuarios con hardware Apple Silicon ahora pueden ejecutar este modelo de forma nativa y eficiente, aprovechando al máximo las capacidades de sus dispositivos. En el apartado de optimizaciones, se

Ollama v0.32.4: Soporte para Laguna en GPUs Apple, mejoras en decodificación especulativa y MoE Leer más »