GPU acceleration

imagem 30

Ollama v0.32.3: Correções de download, novas integrações e suporte expandido

A nova versão do Ollama corrige um problema crítico em que os downloads de modelos paravam antes de enviar dados, garantindo uma experiência mais estável. As integrações foram aprimoradas, com a restauração dos canais do Claude Code, correção nos fluxos de “thinking” do Anthropic e ajustes para que o Hermes Desktop respeite a flag –force-build. […]

Ollama v0.32.3: Correções de download, novas integrações e suporte expandido Read More »

imagem 25

Backend Metal do llama.cpp agora suporta f16 para leaky ReLU

O projeto llama.cpp acaba de receber uma atualização importante para quem utiliza dispositivos Apple: o backend Metal ganhou suporte ao tipo f16 (ponto flutuante de 16 bits) na operação leaky ReLU. Essa mudança permite que os cálculos sejam realizados com menor precisão numérica, mas com ganhos expressivos em consumo de memória e velocidade, algo especialmente

Backend Metal do llama.cpp agora suporta f16 para leaky ReLU Read More »