---
title: "Colibri - Motor Local de IA"
description: "Como o Colibri usa streaming seletivo para executar modelos MoE grandes em hardware comum."
canonical: "https://ronanrodrigo.dev/notes/colibri-motor-local-ia"
markdown: "https://ronanrodrigo.dev/notes/colibri-motor-local-ia.md"
last-updated: "2026-07-24"
---
## Colibri - Motor de Inferência Local
Runtime open source escrito em Rust que permite rodar modelos MoE (Mixture of Experts) gigantes com streaming seletivo do armazenamento. Roda o GLM-5.2 (744B parâmetros) com apenas 25GB RAM sem GPU necessária.

[Acesse aqui](https://github.com/JustVugg/colibri)

## GLM-5.2 - Modelo de IA Chinês
Modelo de inteligência artificial com 744 bilhões de parâmetros desenvolvido pela Z.ai. Compite com Claude Fable 5 e GPT-5.6, convertido para rodar eficientemente via Colibri.

[Acesse aqui](https://huggingface.co/zai-org/GLM-5.2)

## Vídeo - Divisor de Águas dos LLMs Locais
Explicação de como o Colibri roda um modelo de 400GB em computador com 40GB RAM usando arquitetura mixture of experts, armazenando especialistas no SSD e carregando sob demanda.

[Acesse aqui](https://www.youtube.com/watch?v=pQH5daGMUrI)

## Tutorial - Setup Colibri em Linux/Ubuntu
Guia passo a passo de instalação e configuração do Colibri engine em Ubuntu, incluindo download do modelo GLM-5.2 e otimização de RAM.

[Acesse aqui](https://www.youtube.com/watch?v=67PoawESiyE)

## Artigo - Colibrì em Consumer Grade PC
Análise técnica de como Colibrì executa o GLM-5.2 MoE com 744B parâmetros em computador consumer-grade com 25GB RAM em Windows 11, macOS e Linux.

[Acesse aqui](https://sakutto.ai/en/articles/colibri-local-llm-glm-5-2)

## Guia Rápido (Quickstart)
Documentação oficial do repositório Colibri com instruções de setup rápido, download de modelo pré-convertido e comandos para iniciar conversa local.

[Acesse aqui](https://raw.githubusercontent.com/JustVugg/colibri/master/docs/quickstart.md)

## Tutorial Español - Executar GLM-5.2 em Laptop
Guia em espanhol publicado em 2026 sobre como rodar GLM-5.2 localmente com Colibri em máquinas com apenas 25GB RAM, incluindo método com e sem GPU.

[Acesse aqui](https://arkaiacorp.com/blog/ejecutar-glm-5-2-laptop-colibri-tutorial-paso-a-paso-sin-gpu-2026)

## Artigo - Tom's Hardware
Reportagem da Tom's Hardware sobre Colibri PoC que agora suporta modelo frontier-level de 1.5TB, mostrando a viabilidade para setups de IA local.

[Acesse aqui](https://www.tomshardware.com/tech-industry/artificial-intelligence/colibri-proof-of-concept-gains-frontier-level-1-5-tb-ai-model-novel-approach-runs-on-only-25gb-of-ram-and-shows-promise-for-local-ai-setups)
