GLM tool calling

imagem 3

Llama.cpp Update: Neuer Qwen3-Parser und Verbesserungen bei Tool Calls

Die neueste Version von llama.cpp bringt wesentliche Verbesserungen für die Chat-Funktionalität, insbesondere für das Qwen3-Modell. Ein neuer, spezialisierter Parser wurde hinzugefügt, der tagged thinking und Werkzeugaufrufe (Tool Calls) optimiert verarbeitet. Konkret wurde ein Parser für getaggte Denkwerkzeuge integriert und die interne Struktur für Permutationen überarbeitet. Die Unterstützung für das Weglassen von -Tags macht die Nutzung […]

Llama.cpp Update: Neuer Qwen3-Parser und Verbesserungen bei Tool Calls Weiterlesen »

imagem 1

Neues llama.cpp Release: Tool-Aufrufe in der Denkphase für DS4-Modelle aktiviert

Das llama.cpp-Projekt hat eine neue Version veröffentlicht, die eine wichtige Neuerung für Nutzer von DS4-Modellen mit sich bringt: Tool-Aufrufe können nun auch während der Denkphase („Thinking“) des Modells erfolgen. Bisher waren solche Aufrufe von externen Werkzeugen oder APIs nur in der Antwortphase möglich. Diese Erweiterung verbessert die Fähigkeit des Modells, komplexe Aufgaben durch die Einbindung

Neues llama.cpp Release: Tool-Aufrufe in der Denkphase für DS4-Modelle aktiviert Weiterlesen »

imagem 24

Ollama v0.32.3-rc0: Feinschliff für GLM, Laguna und Apple Silicon

Die Vorabversion 0.32.3-rc0 von Ollama liefert wichtige Stabilitäts- und Kompatibilitätsverbesserungen für selbst gehostete Sprachmodelle. Entwickler und Betreiber profitieren von optimierten Modellschnittstellen und einer aktualisierten Hardware-Anbindung. Zuverlässigere Werkzeugnutzung und aktualisierte Modelle Bei GLM-Modellen kam es bislang zu unvollständigen Werkzeugaufrufen – dieser Fehler ist nun behoben. Tool Calls werden jetzt sauber abgeschlossen, was insbesondere für interaktive Anwendungen

Ollama v0.32.3-rc0: Feinschliff für GLM, Laguna und Apple Silicon Weiterlesen »