Qwen3 MoE

imagem 3

Nova versão do llama.cpp adiciona parser especializado para modelos Qwen3

Foi lançada hoje a build b10227 do llama.cpp, um dos projetos mais populares para inferência local de grandes modelos de linguagem. A principal novidade desta versão é a introdução de um analisador (parser) adaptado para a família de modelos Qwen3, melhorando a capacidade da ferramenta de interpretar corretamente as respostas estruturadas desses modelos, especialmente em […]

Nova versão do llama.cpp adiciona parser especializado para modelos Qwen3 Read More »

imagem 34

Ollama 0.32.4 Chega com Suporte ao Modelo Laguna e Otimizações para Apple Silicon

Suporte ao Modelo Laguna via MLX A mais recente atualização do Ollama, versão 0.32.4, trouxe uma novidade aguardada pelos usuários de Mac: o modelo Laguna agora roda nativamente em GPUs da Apple utilizando o mecanismo MLX. Esse avanço permite que o modelo opere com muito mais eficiência nos chips Apple Silicon, abrindo portas para inferência

Ollama 0.32.4 Chega com Suporte ao Modelo Laguna e Otimizações para Apple Silicon Read More »