---
title: "Unstract para extração de documentos"
description: "Uma curadoria sobre transformar documentos não estruturados em dados estruturados usando prompts, LLMs e automações."
canonical: "https://ronanrodrigo.dev/notes/unstract-document-extraction"
markdown: "https://ronanrodrigo.dev/notes/unstract-document-extraction.md"
last-updated: "2026-08-14"
---
## Unstract

Uma plataforma voltada a transformar documentos não estruturados em dados estruturados. O fluxo apresentado combina documentos, prompts e modelos de linguagem para produzir resultados em JSON e apoiar automações de processamento documental.

## Documentação do Unstract

A documentação apresenta o Unstract como uma plataforma open source e no-code para automatizar processos com documentos longos, incluindo fluxos que recebem arquivos e devolvem JSON estruturado por API.

[Leia a documentação](https://docs.unstract.com/unstract/index.html)

## Quick start com documentos variados

O guia inicial usa extratos de cartão de crédito de emissores diferentes para mostrar como extrair campos e transações apesar das variações de formato. O mesmo fluxo pode ser implantado como API ou pipeline ETL.

[Experiment the quick start](https://docs.unstract.com/unstract/unstract_platform/quick_start/)

## Prompt Studio

O Prompt Studio oferece um ambiente para definir por linguagem natural os campos, o formato e o schema da extração. A proposta é lidar com diferentes variantes de um tipo documental sem depender de anotações manuais para cada modelo.

[Explore o Prompt Studio](https://docs.unstract.com/unstract/unstract_platform/features/prompt_studio/prompt_studio_intro/)

## Repositório open source

O repositório oficial reúne o código do Unstract e descreve o uso de LLMs para extrair JSON estruturado de PDFs, imagens e scans, com possibilidade de implantação como API ou pipeline ETL.

[Acesse o repositório no GitHub](https://github.com/Zipstack/unstract)
