GLM tool calling

imagem 3

Nova versão do llama.cpp adiciona parser especializado para modelos Qwen3

Foi lançada hoje a build b10227 do llama.cpp, um dos projetos mais populares para inferência local de grandes modelos de linguagem. A principal novidade desta versão é a introdução de um analisador (parser) adaptado para a família de modelos Qwen3, melhorando a capacidade da ferramenta de interpretar corretamente as respostas estruturadas desses modelos, especialmente em […]

Nova versão do llama.cpp adiciona parser especializado para modelos Qwen3 Read More »

imagem 1

Lançamento do llama.cpp b10217 traz chamada de ferramentas no modo de pensamento para DS4

Foi lançada a build b10217 do llama.cpp, trazendo uma melhoria significativa: a habilitação de chamadas de ferramentas (tool calls) durante o modo de pensamento para modelos DS4 (DeepSeek 4). Essa atualização permite que o assistente de chat possa interagir com ferramentas externas mesmo enquanto processa raciocínios internos, ampliando suas capacidades de execução de tarefas. Website:

Lançamento do llama.cpp b10217 traz chamada de ferramentas no modo de pensamento para DS4 Read More »

imagem 24

Ollama v0.32.3-rc0 traz atualização do MLX e ajustes para modelos GLM e Laguna

O que há de novo na versão candidata A nova versão candidata a lançamento do Ollama, a v0.32.3-rc0, acaba de ser disponibilizada com ajustes importantes para quem utiliza modelos de linguagem em ambiente local. Entre as novidades, destaca-se a atualização do backend MLX, que melhora o desempenho em computadores Mac com Apple Silicon. Além disso,

Ollama v0.32.3-rc0 traz atualização do MLX e ajustes para modelos GLM e Laguna Read More »