IA e Machine Learning

imagem 5

llama.cpp b10240: Aviso de Mudança de Porta Padrão e Binários Multiplataforma

O time do llama.cpp lançou a build b10240, trazendo um aviso importante para os usuários do servidor: a porta padrão será alterada de 8080 para 9931 em uma versão futura. Embora a mudança ainda não tenha sido efetivada, esta notificação serve para que administradores de sistemas auto-hospedados se preparem para ajustar suas configurações. Além disso, […]

llama.cpp b10240: Aviso de Mudança de Porta Padrão e Binários Multiplataforma Read More »

imagem 3

Nova versão do llama.cpp adiciona parser especializado para modelos Qwen3

Foi lançada hoje a build b10227 do llama.cpp, um dos projetos mais populares para inferência local de grandes modelos de linguagem. A principal novidade desta versão é a introdução de um analisador (parser) adaptado para a família de modelos Qwen3, melhorando a capacidade da ferramenta de interpretar corretamente as respostas estruturadas desses modelos, especialmente em

Nova versão do llama.cpp adiciona parser especializado para modelos Qwen3 Read More »

imagem 1

Lançamento do llama.cpp b10217 traz chamada de ferramentas no modo de pensamento para DS4

Foi lançada a build b10217 do llama.cpp, trazendo uma melhoria significativa: a habilitação de chamadas de ferramentas (tool calls) durante o modo de pensamento para modelos DS4 (DeepSeek 4). Essa atualização permite que o assistente de chat possa interagir com ferramentas externas mesmo enquanto processa raciocínios internos, ampliando suas capacidades de execução de tarefas. Website:

Lançamento do llama.cpp b10217 traz chamada de ferramentas no modo de pensamento para DS4 Read More »

imagem 56

LangChain Core 1.5.3: Correção para Chave de API do Gateway

A versão 1.5.3 do LangChain Core traz uma correção importante para usuários de self-hosted: agora o sistema recorre à variável de ambiente LANGSMITH_API_KEY como fallback ao acessar o gateway. Essa mudança resolve problemas de autenticação que podiam ocorrer quando a chave não estava explicitamente configurada no código, melhorando a robustez da integração com o LangSmith.

LangChain Core 1.5.3: Correção para Chave de API do Gateway Read More »

imagem 55

llama.cpp lança suporte SYCL para quantização q2_0 e novas compilações multi-plataforma

O projeto llama.cpp acaba de disponibilizar a build b10203 com um avanço significativo para usuários que utilizam GPUs Intel ou outros aceleradores compatíveis: agora a operação mul_mat conta com suporte para quantização q2_0 via backend SYCL. A implementação, oriunda do pull request #26231, amplia as possibilidades de inferência eficiente com modelos extremamente compactos, reduzindo ainda

llama.cpp lança suporte SYCL para quantização q2_0 e novas compilações multi-plataforma Read More »

imagem 50

Nova build b10189 do llama.cpp remove operação customizada de CPU do gráfico M3

Foi lançada a build b10189 do llama.cpp com uma simplificação importante no backend M3: a remoção de uma operação customizada de CPU, que agora é expressa usando operações padrão. Essa mudança melhora a manutenção do código e pode trazer ganhos de desempenho para modelos que utilizam o grafo M3. A atualização está disponível para download

Nova build b10189 do llama.cpp remove operação customizada de CPU do gráfico M3 Read More »

imagem 46

LangChain Core 1.5.2 Corrige Tratamento de Variáveis de Ambiente e Atualiza Dependências

A nova versão langchain-core 1.5.2 acaba de ser lançada, trazendo uma correção específica e um conjunto de atualizações internas. O principal destaque é o ajuste no tratamento de variáveis de ambiente relacionadas ao gateway: agora, strings vazias são manipuladas corretamente, evitando comportamentos inesperados em configurações que dependem dessas variáveis. Essa mudança é especialmente relevante para

LangChain Core 1.5.2 Corrige Tratamento de Variáveis de Ambiente e Atualiza Dependências Read More »

imagem 45

Nova versão do llama.cpp: build b10176 adiciona tensor_memset ao RPC e libera binários para múltiplas plataformas

O projeto llama.cpp acaba de disponibilizar a build b10176, trazendo uma nova funcionalidade no componente RPC: a adição de tensor_memset. Esta atualização inclui também a distribuição de binários pré-compilados para as principais plataformas, facilitando a execução local por usuários autônomos. Website https://llama.app macOS / iOS macOS Apple Silicon (arm64) macOS Apple Silicon (arm64, KleidiAI enabled)

Nova versão do llama.cpp: build b10176 adiciona tensor_memset ao RPC e libera binários para múltiplas plataformas Read More »

imagem 42

LangChain Fireworks 1.5.2: Atualização de Perfis de Modelos

Uma nova versão do pacote langchain-fireworks foi lançada, a 1.5.2. Esta atualização concentra-se exclusivamente na renovação dos dados de perfil dos modelos. Para usuários que mantêm ambientes autogerenciados, isso significa que as informações sobre os modelos disponíveis foram atualizadas, garantindo compatibilidade e precisão na hora de selecionar e configurar os modelos de IA. Nenhuma mudança

LangChain Fireworks 1.5.2: Atualização de Perfis de Modelos Read More »

imagem 41

llama.cpp: Build b10159 adiciona kernel FWHT para Metal e renova builds para diversas plataformas

Uma nova versão do llama.cpp, identificada como build b10159, foi disponibilizada, trazendo uma importante adição: a inclusão de um kernel FWHT (Fast Walsh-Hadamard Transform) para o backend Metal. Esse aprimoramento visa acelerar o processamento em dispositivos Apple com suporte a Metal, beneficiando diretamente usuários de macOS e iOS. O desenvolvimento contou com contribuições da comunidade,

llama.cpp: Build b10159 adiciona kernel FWHT para Metal e renova builds para diversas plataformas Read More »