KI & Machine Learning

imagem 34

LangChain-OpenAI: Umfassende Aktualisierung mit Fokus auf Responses API, Streaming und strukturierte Ausgaben

Neue API- und Modellunterstützung Die LangChain-OpenAI-Integration wurde grundlegend erweitert und unterstützt nun die OpenAI Responses API, das OpenAI SDK 3.0 sowie die neuesten Modellfamilien wie GPT-5, die o-Serie und Codex. Dadurch können Anwender von den modernsten Funktionen profitieren – darunter serverseitige Kompaktierung, explizites Prompt-Caching, die Nutzung von Reasoning-Modellen und die automatische Erkennung der optimalen API […]

LangChain-OpenAI: Umfassende Aktualisierung mit Fokus auf Responses API, Streaming und strukturierte Ausgaben Weiterlesen »

imagem 33

AWS Wochenrückblick: EC2-Anwendungsstatusprüfungen, IAM-Rollenmanager, OpenAI Daybreak auf Bedrock und mehr (17. August 2026)

Von Channy Yun (윤석찬) am 17. August 2026 Letzte Woche trafen sich AWS-Mitwirkende mit den OpenSearch- und Valkey-Communitys auf dem Open Source Summit Korea 2026 und dem MCP DevSummit Seoul 2026, um Open-Source-Entwickler und -Beitragende zu treffen. Während der viertägigen Veranstaltung kamen Community-Leiter und Nutzer dieser Linux-Foundation-Open-Source-Projekte zusammen, um Wissen auszutauschen, gemeinsam an Lösungen zu

AWS Wochenrückblick: EC2-Anwendungsstatusprüfungen, IAM-Rollenmanager, OpenAI Daybreak auf Bedrock und mehr (17. August 2026) Weiterlesen »

imagem 30

Ollama v0.32.14-rc0: WebP-Transkodierung und tolerantere Qwen-Nachrichtenverarbeitung

Die Vorabversion v0.32.14-rc0 von Ollama bringt zwei Verbesserungen für selbst gehostete Instanzen mit. Zum einen werden WebP-Bilder nun automatisch in ein Format umgewandelt, das der llama-server verarbeiten kann. Dadurch lassen sich Bilddaten auch dann als Eingabe verwenden, wenn sie ursprünglich im WebP-Format vorliegen – ohne manuelle Konvertierung. Zum anderen wurde die Nachrichtenverarbeitung für Qwen-Modelle flexibler

Ollama v0.32.14-rc0: WebP-Transkodierung und tolerantere Qwen-Nachrichtenverarbeitung Weiterlesen »

imagem 25

Transformers v5.15.0: Neue Modelle, Breaking Changes und Optimierungen

Neue Modelle Die Version 5.15.0 bringt mehrere neue Modelle. Hervorzuheben ist Meta Muse Glimmer, ein multimodales 30B-Modell unter Apache-2.0-Lizenz, das speziell für agentengestützte Anwendungen entwickelt wurde. Es besteht aus einem 2B-ViT-Bildencoder und einem 28B-Textdecoder. Ebenfalls neu sind die Granite-Modelle (granite-swa und granitemoe-swa) sowie die koreanischen Modelle A.X-K1 und A.X-K2. Für Videoverarbeitung wurde Cosmos3 Edge hinzugefügt.

Transformers v5.15.0: Neue Modelle, Breaking Changes und Optimierungen Weiterlesen »

imagem 23

Ollama 0.32.6-rc0: Qwen3.5-Beschleunigung auf Apple-GPUs und verfeinerte OpenAI-Streaming-Kompatibilität

Die neueste Vorabversion von Ollama bringt vor allem für Nutzer von Apple-Hardware spürbare Leistungssteigerungen. Die MLX-Engine nutzt jetzt automatisch den MTP-Head (Multi-Token Prediction) des Qwen3.5-Modells für spekulative Dekodierung – ein Verfahren, bei dem mehrere Tokens gleichzeitig vorhergesagt werden, um die Inferenz deutlich zu beschleunigen. Gleichzeitig wurden die zugrundeliegenden MLX- und llama.cpp-Engines auf den neuesten Stand

Ollama 0.32.6-rc0: Qwen3.5-Beschleunigung auf Apple-GPUs und verfeinerte OpenAI-Streaming-Kompatibilität Weiterlesen »

imagem 20

Langchain-OpenAI 1.4.2: Wichtige Fehlerbehebungen und Sicherheitsupdate

Die Version 1.4.2 der Langchain-OpenAI-Bibliothek bringt eine Reihe von Fehlerkorrekturen und Wartungsarbeiten, die insbesondere für selbst gehostete Umgebungen von Bedeutung sind. Fehlerbehebungen für stabileren Betrieb Ein zentraler Fix betrifft die Behandlung des ContextWindowExceededError. Bisher führte eine Überschreitung des Token-Limits oft zu unerwarteten Abbrüchen; nun wird der Fehler gezielt abgefangen, was die Robustheit der Anwendung erhöht.

Langchain-OpenAI 1.4.2: Wichtige Fehlerbehebungen und Sicherheitsupdate Weiterlesen »

imagem 12

Ollama mit Podman auf Fedora Linux betreiben

Das lokale Ausführen von Large Language Models (LLMs) erfreut sich für Entwicklung, Datenschutz und Offline-Tests zunehmender Beliebtheit. Ollama macht dies bemerkenswert einfach, sodass Sie Modelle wie Llama 3 oder Mistral direkt auf Ihrem Rechner ausführen können. Durch den Einsatz von Podman auf Fedora Linux können Sie Ollama in einem Container isolieren. Dieser Ansatz hält Ihr

Ollama mit Podman auf Fedora Linux betreiben Weiterlesen »

imagem 7

AWS Weekly Roundup: Preissenkung für GPT-Modelle in Bedrock, CloudWatch Managed Collectors für Prometheus-Metriken und mehr (3. August 2026)

Letzte Woche hatte ich die Freude, mit meinem 7-jährigen Sohn am „Bring-dein-Kind-zur-Arbeit-Tag“ von Amazon teilzunehmen. Wir fuhren gemeinsam ins New Yorker Büro – seine erste richtige Fahrt im Berufsverkehr – und verbrachten den Tag damit, zu erkunden, wie Amazon KI, maschinelles Lernen und Robotik einsetzt, um Pakete an Kunden auf der ganzen Welt zuzustellen. Zu

AWS Weekly Roundup: Preissenkung für GPT-Modelle in Bedrock, CloudWatch Managed Collectors für Prometheus-Metriken und mehr (3. August 2026) Weiterlesen »