self-hosted LLM

imagem 38

Utiliza modelos de Ollama en ChatGPT Desktop

Los modelos de Ollama ahora se pueden usar directamente en ChatGPT Desktop, lo que te permite mantener tu flujo de trabajo actual mientras ejecutas modelos abiertos. La configuración está disponible desde la aplicación de Ollama en macOS, e incluye una captura de pantalla que muestra cómo acceder a esta integración. Esta versión también mejora el […]

Utiliza modelos de Ollama en ChatGPT Desktop Leer más »

imagem 37

Lanzamiento de llama.cpp b10149: mejora en pruebas y paquetes multiplataforma

Se ha publicado la versión b10149 de llama.cpp, que trae una mejora menor pero útil para los desarrolladores que ejecutan el conjunto de pruebas. Se ha eliminado una sincronización innecesaria en la funcionalidad de guardar y cargar estados durante los tests, lo que agiliza la ejecución de las pruebas internas sin modificar el comportamiento de

Lanzamiento de llama.cpp b10149: mejora en pruebas y paquetes multiplataforma Leer más »

imagem 30

Ollama v0.32.3: Descargas más fiables, integraciones reforzadas y soporte GPU ampliado

La descarga de modelos se ha estabilizado, corrigiendo un problema que provocaba que se quedaran bloqueadas antes de empezar a transferir datos. Ahora, los modelos se obtienen de forma consistente y sin interrupciones inesperadas. Se han mejorado varias integraciones clave: se han restaurado los canales de Claude Code, se ha corregido el flujo de pensamiento

Ollama v0.32.3: Descargas más fiables, integraciones reforzadas y soporte GPU ampliado Leer más »

imagem 20

Corrección de error en operación de tensor APE para DeepSeek4 en llama-arch

El equipo de llama.cpp ha lanzado una corrección en la arquitectura llama-arch, específicamente en la operación de tensor APE utilizada por el modelo DeepSeek4. Este fallo podía provocar comportamientos anómalos al ejecutar inferencias con dicho modelo en instalaciones autoalojadas. Con esta actualización, los usuarios que implementan DeepSeek4 en sus propios servidores disfrutarán de mayor fiabilidad

Corrección de error en operación de tensor APE para DeepSeek4 en llama-arch Leer más »