La más reciente actualización de llama.cpp trae importantes mejoras para el modelo Qwen3, centradas en la interpretación de herramientas y llamadas a funciones. Se integró un analizador especializado que incluye un componente para etiquetas de pensamiento, junto con una refactorización que añade un ayudante de permutación. Además, se habilitó el soporte para la omisión de <tool_call>, se actualizaron los delimitadores de herramientas y se corrigió el patrón de activación para <function. Estos cambios optimizan la experiencia de chat cuando se emplean modelos de la familia Qwen3.
Descargas disponibles
Sitio web:
macOS/iOS:
- macOS Apple Silicon (arm64)
- macOS Apple Silicon (arm64, KleidiAI habilitado) DESHABILITADO
- macOS Intel (x64)
- iOS XCFramework
Linux:
- Ubuntu x64 (CPU)
- Ubuntu arm64 (CPU)
- Ubuntu s390x (CPU)
- Ubuntu x64 (Vulkan)
- Ubuntu arm64 (Vulkan)
- Ubuntu x64 (ROCm 7.2)
- Ubuntu x64 (OpenVINO)
- Ubuntu x64 (SYCL FP32)
- Ubuntu x64 (SYCL FP16)
Android:
Windows:
- Windows x64 (CPU)
- Windows arm64 (CPU)
- Windows arm64 (OpenCL Adreno)
- Windows x64 (CUDA 12) – CUDA 12.4 DLLs
- Windows x64 (CUDA 13) – CUDA 13.3 DLLs
- Windows x64 (Vulkan)
- Windows x64 (OpenVINO)
- Windows x64 (SYCL)
- Windows x64 (HIP)
openEuler:
- DESHABILITADO
- openEuler x86 (310p)
- openEuler x86 (910b, ACL Graph)
- openEuler aarch64 (310p)
- openEuler aarch64 (910b, ACL Graph)
Interfaz de usuario:



