Neues llama.cpp Release: Tool-Aufrufe in der Denkphase für DS4-Modelle aktiviert

imagem 1

Das llama.cpp-Projekt hat eine neue Version veröffentlicht, die eine wichtige Neuerung für Nutzer von DS4-Modellen mit sich bringt: Tool-Aufrufe können nun auch während der Denkphase („Thinking“) des Modells erfolgen. Bisher waren solche Aufrufe von externen Werkzeugen oder APIs nur in der Antwortphase möglich. Diese Erweiterung verbessert die Fähigkeit des Modells, komplexe Aufgaben durch die Einbindung externer Ressourcen zu lösen, und eröffnet neue Anwendungsmöglichkeiten für eigene, selbst-gehostete KI-Installationen.

Für die neue Version stehen vorkompilierte Binärpakete für alle gängigen Plattformen zum Download bereit. Nutzer von macOS (Apple Silicon und Intel, inklusive iOS), Linux (Ubuntu in verschiedenen Architekturen sowie mit GPU-Unterstützung über Vulkan, ROCm, OpenVINO und SYCL), Windows (CPU- und GPU-Builds mit CUDA 12/13, Vulkan, OpenVINO, SYCL und HIP) sowie Android und openEuler können die passenden Dateien herunterladen. Zusätzlich wird ein separates UI-Paket angeboten. Alle Downloads sind über die offizielle Webseite llama.app und die GitHub-Releases zugänglich.

Schreibe einen Kommentar

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert