AI inference

imagem 3

Nova versão do llama.cpp adiciona parser especializado para modelos Qwen3

Foi lançada hoje a build b10227 do llama.cpp, um dos projetos mais populares para inferência local de grandes modelos de linguagem. A principal novidade desta versão é a introdução de um analisador (parser) adaptado para a família de modelos Qwen3, melhorando a capacidade da ferramenta de interpretar corretamente as respostas estruturadas desses modelos, especialmente em […]

Nova versão do llama.cpp adiciona parser especializado para modelos Qwen3 Read More »

imagem 1

Lançamento do llama.cpp b10217 traz chamada de ferramentas no modo de pensamento para DS4

Foi lançada a build b10217 do llama.cpp, trazendo uma melhoria significativa: a habilitação de chamadas de ferramentas (tool calls) durante o modo de pensamento para modelos DS4 (DeepSeek 4). Essa atualização permite que o assistente de chat possa interagir com ferramentas externas mesmo enquanto processa raciocínios internos, ampliando suas capacidades de execução de tarefas. Website:

Lançamento do llama.cpp b10217 traz chamada de ferramentas no modo de pensamento para DS4 Read More »

imagem 30

Ollama v0.32.3: Correções de download, novas integrações e suporte expandido

A nova versão do Ollama corrige um problema crítico em que os downloads de modelos paravam antes de enviar dados, garantindo uma experiência mais estável. As integrações foram aprimoradas, com a restauração dos canais do Claude Code, correção nos fluxos de “thinking” do Anthropic e ajustes para que o Hermes Desktop respeite a flag –force-build.

Ollama v0.32.3: Correções de download, novas integrações e suporte expandido Read More »