ollama

imagem 38

Ollama-Modelle jetzt direkt in ChatGPT Desktop nutzbar

Ollama-Modelle können nun direkt in ChatGPT Desktop verwendet werden. So behalten Sie Ihren gewohnten Arbeitsablauf bei und setzen gleichzeitig auf offene Modelle. Die Einrichtung erfolgt über die Ollama-App unter macOS. Dieses Update verbessert außerdem die Leistung bei strukturierten Ausgaben auf Apple Silicon und unterstützt die Tool-Suche sowie die Antwort-Komprimierung für OpenAI-kompatible Clients. Die vollständige Liste […]

Ollama-Modelle jetzt direkt in ChatGPT Desktop nutzbar Weiterlesen »

imagem 15

Ollama-Modelle direkt in ChatGPT Desktop nutzen

Ollama-Modelle lassen sich jetzt direkt in ChatGPT Desktop nutzen – so behalten Sie Ihren gewohnten Arbeitsablauf bei, während Sie offene Modelle ausführen. Die Einrichtung erfolgt über die Ollama-App auf macOS. Diese Version verbessert außerdem die Leistung bei strukturierten Ausgaben auf Apple Silicon, unterstützt die Werkzeugsuche und Antwortkomprimierung für OpenAI-kompatible Clients und sorgt dafür, dass Bilder

Ollama-Modelle direkt in ChatGPT Desktop nutzen Weiterlesen »

imagem 67

Ollama v0.33.2: Dunkelmodus kehrt zurück und Stabilitätsverbesserungen

Die Ollama-App übernimmt wieder die Darstellung des Systems, wodurch der Dunkelmodus erneut unterstützt wird. Zusätzlich wurde das Verhalten der macOS-App korrigiert: Sie übergibt nun ordnungsgemäß an eine bereits laufende Instanz, anstatt eine zweite zu starten – das spart Ressourcen und verhindert Konflikte. Der Proxy für Claude Desktop wurde stabilisiert. Laufende Anfragen werden nicht mehr unterbrochen,

Ollama v0.33.2: Dunkelmodus kehrt zurück und Stabilitätsverbesserungen Weiterlesen »

imagem 50

Ollama v0.33.0-rc2: Claude-Desktop-Integration und verbesserte Caching-Mechanismen

Claude Desktop Integration Die neueste Vorabversion von Ollama bringt eine direkte Integration mit Claude Desktop. Nutzer können nun einzelne Ollama-Modelle direkt über die Menüleiste für die Verwendung in Claude aktivieren oder deaktivieren. Innerhalb von Claude lassen sich die verfügbaren Ollama-Modelle bequem auswählen; Cloud-Modelle erscheinen nur, wenn man angemeldet ist. Eine neue Ansicht „Apps“ verwaltet die

Ollama v0.33.0-rc2: Claude-Desktop-Integration und verbesserte Caching-Mechanismen Weiterlesen »

imagem 30

Ollama v0.32.14-rc0: WebP-Transkodierung und tolerantere Qwen-Nachrichtenverarbeitung

Die Vorabversion v0.32.14-rc0 von Ollama bringt zwei Verbesserungen für selbst gehostete Instanzen mit. Zum einen werden WebP-Bilder nun automatisch in ein Format umgewandelt, das der llama-server verarbeiten kann. Dadurch lassen sich Bilddaten auch dann als Eingabe verwenden, wenn sie ursprünglich im WebP-Format vorliegen – ohne manuelle Konvertierung. Zum anderen wurde die Nachrichtenverarbeitung für Qwen-Modelle flexibler

Ollama v0.32.14-rc0: WebP-Transkodierung und tolerantere Qwen-Nachrichtenverarbeitung Weiterlesen »

imagem 23

Ollama 0.32.6-rc0: Qwen3.5-Beschleunigung auf Apple-GPUs und verfeinerte OpenAI-Streaming-Kompatibilität

Die neueste Vorabversion von Ollama bringt vor allem für Nutzer von Apple-Hardware spürbare Leistungssteigerungen. Die MLX-Engine nutzt jetzt automatisch den MTP-Head (Multi-Token Prediction) des Qwen3.5-Modells für spekulative Dekodierung – ein Verfahren, bei dem mehrere Tokens gleichzeitig vorhergesagt werden, um die Inferenz deutlich zu beschleunigen. Gleichzeitig wurden die zugrundeliegenden MLX- und llama.cpp-Engines auf den neuesten Stand

Ollama 0.32.6-rc0: Qwen3.5-Beschleunigung auf Apple-GPUs und verfeinerte OpenAI-Streaming-Kompatibilität Weiterlesen »

imagem 12

Ollama mit Podman auf Fedora Linux betreiben

Das lokale Ausführen von Large Language Models (LLMs) erfreut sich für Entwicklung, Datenschutz und Offline-Tests zunehmender Beliebtheit. Ollama macht dies bemerkenswert einfach, sodass Sie Modelle wie Llama 3 oder Mistral direkt auf Ihrem Rechner ausführen können. Durch den Einsatz von Podman auf Fedora Linux können Sie Ollama in einem Container isolieren. Dieser Ansatz hält Ihr

Ollama mit Podman auf Fedora Linux betreiben Weiterlesen »

imagem 40

Ollama 0.32.5 behebt Darstellungsfehler bei NVFP4-Modellen mit MLX Metal

Die neue Version 0.32.5 von Ollama beseitigt einen hartnäckigen Fehler in der MLX-Metal-Integration. Dieser konnte speziell bei NVFP4-Modellen – allen voran Laguna – zu spürbaren Qualitätseinbußen in der Ausgabe führen. Das Update stellt die gewohnte Präzision wieder her und sorgt für verlässliche Ergebnisse auf Apple-Hardware mit Metal-Beschleunigung. Anwender, die solche Modelle lokal betreiben, profitieren von

Ollama 0.32.5 behebt Darstellungsfehler bei NVFP4-Modellen mit MLX Metal Weiterlesen »

imagem 35

Ollama v0.32.5-rc0: MLX-Update optimiert lokale LLMs auf Apple Silicon

Mit dem neuen Release Candidate v0.32.5-rc0 verbessert Ollama die Unterstützung für Apples MLX-Framework. Diese Aktualisierung sorgt dafür, dass selbst gehostete Sprachmodelle auf Apple-Silicon-Macs reibungsloser und effizienter laufen. Nutzer profitieren von optimierter Hardwarebeschleunigung und besserer Kompatibilität mit neueren Betriebssystemversionen. Das Update ist vor allem für Entwickler und Unternehmen interessant, die große Sprachmodelle lokal betreiben möchten. Die

Ollama v0.32.5-rc0: MLX-Update optimiert lokale LLMs auf Apple Silicon Weiterlesen »

imagem 34

Ollama v0.32.4: Apple-GPU-Support mit MLX und optimierte Quantisierung für flüssigere Inferenz

Die neue Version Ollama v0.32.4 bringt Unterstützung für das Laguna-Modell auf Apple-Grafikchips über die MLX-Engine. Damit profitieren Mac-Nutzer mit Apple Silicon nun von beschleunigten KI-Berechnungen direkt auf ihren Geräten. Zudem wurde die Quantisierung der Ausgabeköpfe des Entwurfsmodells korrigiert: Beim Erzeugen von Entwürfen für die spekulative Dekodierung wird nun konsequent der angeforderte Datentyp verwendet. Ein Fehler

Ollama v0.32.4: Apple-GPU-Support mit MLX und optimierte Quantisierung für flüssigere Inferenz Weiterlesen »