# Colibri - Motor Local de IA

- Publicado: 2026-07-24
- Resumo: Como o Colibri usa streaming seletivo para executar modelos MoE grandes em hardware comum.
- Tags: local-llm, rust, llm, open-source
- Página HTML: https://ronanrodrigo.dev/notes/2026/07/24/colibri-motor-local-ia/

---
## Colibri - Motor de Inferência Local
Runtime open source escrito em Rust que permite rodar modelos MoE (Mixture of Experts) gigantes com streaming seletivo do armazenamento. Roda o GLM-5.2 (744B parâmetros) com apenas 25GB RAM sem GPU necessária.

[Acesse aqui](https://github.com/JustVugg/colibri)

## GLM-5.2 - Modelo de IA Chinês
Modelo de inteligência artificial com 744 bilhões de parâmetros desenvolvido pela Z.ai. Compite com Claude Fable 5 e GPT-5.6, convertido para rodar eficientemente via Colibri.

[Acesse aqui](https://huggingface.co/zai-org/GLM-5.2)

## Vídeo - Divisor de Águas dos LLMs Locais
Explicação de como o Colibri roda um modelo de 400GB em computador com 40GB RAM usando arquitetura mixture of experts, armazenando especialistas no SSD e carregando sob demanda.

[Acesse aqui](https://www.youtube.com/watch?v=pQH5daGMUrI)

## Tutorial - Setup Colibri em Linux/Ubuntu
Guia passo a passo de instalação e configuração do Colibri engine em Ubuntu, incluindo download do modelo GLM-5.2 e otimização de RAM.

[Acesse aqui](https://www.youtube.com/watch?v=67PoawESiyE)

## Artigo - Colibrì em Consumer Grade PC
Análise técnica de como Colibrì executa o GLM-5.2 MoE com 744B parâmetros em computador consumer-grade com 25GB RAM em Windows 11, macOS e Linux.

[Acesse aqui](https://sakutto.ai/en/articles/colibri-local-llm-glm-5-2)

## Guia Rápido (Quickstart)
Documentação oficial do repositório Colibri com instruções de setup rápido, download de modelo pré-convertido e comandos para iniciar conversa local.

[Acesse aqui](https://raw.githubusercontent.com/JustVugg/colibri/master/docs/quickstart.md)

## Tutorial Español - Executar GLM-5.2 em Laptop
Guia em espanhol publicado em 2026 sobre como rodar GLM-5.2 localmente com Colibri em máquinas com apenas 25GB RAM, incluindo método com e sem GPU.

[Acesse aqui](https://arkaiacorp.com/blog/ejecutar-glm-5-2-laptop-colibri-tutorial-paso-a-paso-sin-gpu-2026)

## Artigo - Tom's Hardware
Reportagem da Tom's Hardware sobre Colibri PoC que agora suporta modelo frontier-level de 1.5TB, mostrando a viabilidade para setups de IA local.

[Acesse aqui](https://www.tomshardware.com/tech-industry/artificial-intelligence/colibri-proof-of-concept-gains-frontier-level-1-5-tb-ai-model-novel-approach-runs-on-only-25gb-of-ram-and-shows-promise-for-local-ai-setups)
