GPU acceleration

imagem 55

llama.cpp Build b10203: SYCL-Unterstützung für q2_mul_mat und plattformübergreifende Binärpakete

Das llama.cpp-Team hat Build b10203 veröffentlicht, der eine wichtige Erweiterung für SYCL-Nutzer bringt: Die Unterstützung von q2_0 in der mul_mat-Operation wurde hinzugefügt. Mit diesem Update können Modelle, die auf 2-Bit-Quantisierung basieren, effizienter auf SYCL-kompatiblen GPUs ausgeführt werden, was die Inferenzleistung und den Speicherverbrauch verbessert. Neben dieser Neuerung stehen vorkompilierte Binärpakete für eine Vielzahl von Plattformen […]

llama.cpp Build b10203: SYCL-Unterstützung für q2_mul_mat und plattformübergreifende Binärpakete Weiterlesen »

imagem 30

Ollama 0.32.3: Erweiterte GPU-Unterstützung und Modellverbesserungen

Das neueste Update der quelloffenen KI-Plattform Ollama behebt einen ärgerlichen Fehler, bei dem Modelldownloads vor der Datenübertragung hängen blieben. Außerdem wurden diverse Schnittstellen optimiert: So funktionieren die Claude Code Channels wieder wie gewohnt, die Verarbeitung von „Thinking Streams“ bei Anthropic-Modellen wurde korrigiert, und Hermes Desktop respektiert nun zuverlässig die –force-build-Option. Erweiterte GPU-Unterstützung ist ein weiterer

Ollama 0.32.3: Erweiterte GPU-Unterstützung und Modellverbesserungen Weiterlesen »