A versão candidata a lançamento Ollama v0.32.2-rc0 acaba de ser disponibilizada, trazendo um conjunto robusto de novidades voltadas para a experiência com agentes, desempenho do backend e correções de integração. Esta prévia mostra um foco claro em tornar as interações com modelos locais e na nuvem mais fluidas e poderosas.
O destaque fica por conta do novo sistema de habilidades (skills) para agentes, que amplia o que os assistentes podem fazer de forma nativa. A interface de texto (TUI) também recebeu atenção especial: comandos com barra agora são completados automaticamente antes do envio, a renderização de negrito em markdown ficou consistente e o laço de eventos foi otimizado com a remoção de atualizações redundantes de janela de contexto. A experiência do agente foi simplificada com a remoção de comandos independentes e wrappers obsoletos, enquanto agora modelos na nuvem permitem rodadas ilimitadas de ferramentas por padrão. Tudo isso deixa o chat interativo mais responsivo e intuitivo.
Nos bastidores, o mecanismo de inferência foi atualizado: o llama.cpp e o backend MLX (para Apple Silicon) receberam melhorias, a toolchain do Linux foi elevada para GCC 13, e o suporte a CUDA v12 agora inclui arquitetura Compute Capability 10.0. Essas mudanças garantem maior compatibilidade e desempenho em ambientes auto-hospedados.
Entre as correções, a integração com o Claude Code mantém canais disponíveis, o provedor Anthropic corrige o fechamento de blocos de texto antes de iniciar o bloco de pensamento, e a integração Hermes foi atualizada. Pequenos ajustes como o roteamento do comando raiz do servidor pelo heartbeat contribuem para uma inicialização mais confiável. O changelog completo está disponível para quem quiser se aprofundar nos detalhes técnicos.



