IA e Machine Learning

imagem 40

Ollama v0.32.5 Corrige Bug do MLX Metal que Afetava Qualidade de Saída em Modelos NVFP4

Atualização Corretiva A nova versão do Ollama, v0.32.5, traz uma correção importante para um bug no MLX Metal que podia reduzir a qualidade da saída de modelos NVFP4, com destaque para o modelo Laguna. Essa falha, que impactava diretamente a precisão e a fidelidade das respostas geradas, foi solucionada para garantir que usuários de hardware […]

Ollama v0.32.5 Corrige Bug do MLX Metal que Afetava Qualidade de Saída em Modelos NVFP4 Read More »

imagem 39

Resumo Semanal da AWS: Zona Local em Atenas, Claude Opus 5 na AWS, execução durável do Lambda para .NET e mais (27 de julho de 2026)

Na semana passada, tive o privilégio de passar três dias em São Paulo com construtores técnicos de toda a América Latina, reunidos para um evento regional de tecnologia repleto de sessões aprofundadas, workshops práticos e conversas com clientes e parceiros. O que mais me impressionou não foi nenhuma sessão em particular, mas a energia de

Resumo Semanal da AWS: Zona Local em Atenas, Claude Opus 5 na AWS, execução durável do Lambda para .NET e mais (27 de julho de 2026) Read More »

imagem 37

Llama.cpp build b10149 já está disponível com otimização de testes e binários para diversas plataformas

Foi lançado o build b10149 do llama.cpp, trazendo binários atualizados para uma ampla gama de sistemas operacionais e arquiteturas. Essa versão inclui uma pequena melhoria nos testes internos, removendo uma sincronização desnecessária no teste de salvamento e carregamento de estado. Para quem utiliza a suíte de testes em ambientes de desenvolvimento, essa mudança resulta em

Llama.cpp build b10149 já está disponível com otimização de testes e binários para diversas plataformas Read More »

imagem 35

Ollama v0.32.5-rc0 traz atualização do MLX para melhor desempenho no Apple Silicon

O Ollama anuncia a versão candidata a lançamento v0.32.5-rc0, com destaque para uma atualização no componente MLX. Essa melhoria é especialmente relevante para quem executa modelos localmente em dispositivos Apple Silicon, já que o MLX é a estrutura que otimiza a inferência nesses hardwares. Espera-se que a atualização proporcione mais eficiência e estabilidade ao rodar

Ollama v0.32.5-rc0 traz atualização do MLX para melhor desempenho no Apple Silicon Read More »

imagem 34

Ollama 0.32.4 Chega com Suporte ao Modelo Laguna e Otimizações para Apple Silicon

Suporte ao Modelo Laguna via MLX A mais recente atualização do Ollama, versão 0.32.4, trouxe uma novidade aguardada pelos usuários de Mac: o modelo Laguna agora roda nativamente em GPUs da Apple utilizando o mecanismo MLX. Esse avanço permite que o modelo opere com muito mais eficiência nos chips Apple Silicon, abrindo portas para inferência

Ollama 0.32.4 Chega com Suporte ao Modelo Laguna e Otimizações para Apple Silicon Read More »

imagem 31

LangChain-OpenAI 1.4.1 chega com suporte ao LangSmith Gateway e correção de perfil de modelo

A versão 1.4.1 do pacote langchain-openai acaba de ser lançada, trazendo um novo recurso e uma correção importante para usuários que mantêm suas próprias instâncias. O grande destaque é a adição do suporte ao LangSmith Gateway por meio de uma variável de ambiente — funcionalidade que também foi implementada nos pacotes anthropic e fireworks. Com

LangChain-OpenAI 1.4.1 chega com suporte ao LangSmith Gateway e correção de perfil de modelo Read More »

imagem 30

Ollama v0.32.3: Correções de download, novas integrações e suporte expandido

A nova versão do Ollama corrige um problema crítico em que os downloads de modelos paravam antes de enviar dados, garantindo uma experiência mais estável. As integrações foram aprimoradas, com a restauração dos canais do Claude Code, correção nos fluxos de “thinking” do Anthropic e ajustes para que o Hermes Desktop respeite a flag –force-build.

Ollama v0.32.3: Correções de download, novas integrações e suporte expandido Read More »

imagem 25

Backend Metal do llama.cpp agora suporta f16 para leaky ReLU

O projeto llama.cpp acaba de receber uma atualização importante para quem utiliza dispositivos Apple: o backend Metal ganhou suporte ao tipo f16 (ponto flutuante de 16 bits) na operação leaky ReLU. Essa mudança permite que os cálculos sejam realizados com menor precisão numérica, mas com ganhos expressivos em consumo de memória e velocidade, algo especialmente

Backend Metal do llama.cpp agora suporta f16 para leaky ReLU Read More »

imagem 24

Ollama v0.32.3-rc0 traz atualização do MLX e ajustes para modelos GLM e Laguna

O que há de novo na versão candidata A nova versão candidata a lançamento do Ollama, a v0.32.3-rc0, acaba de ser disponibilizada com ajustes importantes para quem utiliza modelos de linguagem em ambiente local. Entre as novidades, destaca-se a atualização do backend MLX, que melhora o desempenho em computadores Mac com Apple Silicon. Além disso,

Ollama v0.32.3-rc0 traz atualização do MLX e ajustes para modelos GLM e Laguna Read More »

imagem 21

Lançamento do LangChain-Anthropic 1.5.0 com Novas Funcionalidades

Foi lançada a versão 1.5.0 do pacote langchain-anthropic, trazendo melhorias significativas para quem utiliza os modelos da Anthropic em ambientes auto-hospedados. A principal novidade é a adição do parâmetro reasoning_effort como uma opção padrão nos modelos de chat, permitindo ajustar o esforço de raciocínio empregado durante a inferência. Além disso, uma correção importante foi implementada

Lançamento do LangChain-Anthropic 1.5.0 com Novas Funcionalidades Read More »