Colibri - Motor Local de IA
Colibri - Motor de Inferência Local
Runtime open source escrito em Rust que permite rodar modelos MoE (Mixture of Experts) gigantes com streaming seletivo do armazenamento. Roda o GLM-5.2 (744B parâmetros) com apenas 25GB RAM sem GPU necessária.
GLM-5.2 - Modelo de IA Chinês
Modelo de inteligência artificial com 744 bilhões de parâmetros desenvolvido pela Z.ai. Compite com Claude Fable 5 e GPT-5.6, convertido para rodar eficientemente via Colibri.
Vídeo - Divisor de Águas dos LLMs Locais
Explicação de como o Colibri roda um modelo de 400GB em computador com 40GB RAM usando arquitetura mixture of experts, armazenando especialistas no SSD e carregando sob demanda.
Tutorial - Setup Colibri em Linux/Ubuntu
Guia passo a passo de instalação e configuração do Colibri engine em Ubuntu, incluindo download do modelo GLM-5.2 e otimização de RAM.
Artigo - Colibrì em Consumer Grade PC
Análise técnica de como Colibrì executa o GLM-5.2 MoE com 744B parâmetros em computador consumer-grade com 25GB RAM em Windows 11, macOS e Linux.
Guia Rápido (Quickstart)
Documentação oficial do repositório Colibri com instruções de setup rápido, download de modelo pré-convertido e comandos para iniciar conversa local.
Tutorial Español - Executar GLM-5.2 em Laptop
Guia em espanhol publicado em 2026 sobre como rodar GLM-5.2 localmente com Colibri em máquinas com apenas 25GB RAM, incluindo método com e sem GPU.
Artigo - Tom’s Hardware
Reportagem da Tom’s Hardware sobre Colibri PoC que agora suporta modelo frontier-level de 1.5TB, mostrando a viabilidade para setups de IA local.