Llama.cpp Update: Neuer Qwen3-Parser und Verbesserungen bei Tool Calls

imagem 3

Die neueste Version von llama.cpp bringt wesentliche Verbesserungen für die Chat-Funktionalität, insbesondere für das Qwen3-Modell. Ein neuer, spezialisierter Parser wurde hinzugefügt, der tagged thinking und Werkzeugaufrufe (Tool Calls) optimiert verarbeitet.

Konkret wurde ein Parser für getaggte Denkwerkzeuge integriert und die interne Struktur für Permutationen überarbeitet. Die Unterstützung für das Weglassen von -Tags macht die Nutzung flexibler, und die Begrenzungszeichen (Delimiter) wurden aktualisiert. Ein Fehler, der das Trigger-Muster für betraf, wurde behoben, und es gibt nun einen Kommentar für qwen3-coder, der die Handhabung weiter verfeinert.

Für selbst gehostete Nutzer bedeutet dies eine stabilere und konsistentere Interaktion mit Qwen3-Modellen, vor allem wenn diese Funktionen zum Aufrufen externer Werkzeuge nutzen. Die Änderungen stellen sicher, dass die Ausgaben des Modells korrekt geparst und dargestellt werden.

Wie gewohnt stehen vorkompilierte Binaries für alle gängigen Plattformen bereit, darunter macOS (Apple Silicon und Intel), Linux (x64, arm64, s390x) mit verschiedenen Backends wie CPU, Vulkan, ROCm, OpenVINO und SYCL, Windows (CPU, CUDA, Vulkan, OpenVINO, SYCL, HIP) sowie Android. Die UI und iOS-Frameworks sind ebenfalls verfügbar.

Schreibe einen Kommentar

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert