Colibri - Motor Local de IA

#local-llm · #rust · #llm · #open-source

Colibri - Motor de Inferência Local

Runtime open source escrito em Rust que permite rodar modelos MoE (Mixture of Experts) gigantes com streaming seletivo do armazenamento. Roda o GLM-5.2 (744B parâmetros) com apenas 25GB RAM sem GPU necessária.

Acesse aqui

GLM-5.2 - Modelo de IA Chinês

Modelo de inteligência artificial com 744 bilhões de parâmetros desenvolvido pela Z.ai. Compite com Claude Fable 5 e GPT-5.6, convertido para rodar eficientemente via Colibri.

Acesse aqui

Vídeo - Divisor de Águas dos LLMs Locais

Explicação de como o Colibri roda um modelo de 400GB em computador com 40GB RAM usando arquitetura mixture of experts, armazenando especialistas no SSD e carregando sob demanda.

Acesse aqui

Tutorial - Setup Colibri em Linux/Ubuntu

Guia passo a passo de instalação e configuração do Colibri engine em Ubuntu, incluindo download do modelo GLM-5.2 e otimização de RAM.

Acesse aqui

Artigo - Colibrì em Consumer Grade PC

Análise técnica de como Colibrì executa o GLM-5.2 MoE com 744B parâmetros em computador consumer-grade com 25GB RAM em Windows 11, macOS e Linux.

Acesse aqui

Guia Rápido (Quickstart)

Documentação oficial do repositório Colibri com instruções de setup rápido, download de modelo pré-convertido e comandos para iniciar conversa local.

Acesse aqui

Tutorial Español - Executar GLM-5.2 em Laptop

Guia em espanhol publicado em 2026 sobre como rodar GLM-5.2 localmente com Colibri em máquinas com apenas 25GB RAM, incluindo método com e sem GPU.

Acesse aqui

Artigo - Tom’s Hardware

Reportagem da Tom’s Hardware sobre Colibri PoC que agora suporta modelo frontier-level de 1.5TB, mostrando a viabilidade para setups de IA local.

Acesse aqui