arquivo filtrado
Notas: llm
36 notas marcadas com esse assunto.
Laya — alternativa local ao Jev para decisões classificadas
O pacote @receptron/laya executa o modelo Laya (Convai Innovations) via ONNX Runtime diretamente no Node.js, sem Python ou PyTorch no runtime. É uma alternativa ao Jev que roda localmente e já é usado no Linboto para classificar posts do LinkedIn.
MCP Events: o servidor que acorda o seu agente
A metade do MCP que quase ninguém cita — eventos, subscriptions e webhooks assinados, com o que já está implementado e o que continua sendo rascunho.
AI Engineering from Scratch: Currículo Aberto para Construir IA na Mão
Um currículo gratuito e open-source com 523 lições e 20 fases que implementa cada algoritmo central de IA do zero, do álgebra linear a agentes autônomos, com código rodável em Python, TypeScript, Rust e Julia.
Agent Beacon: histórico de sessão dos agentes de código em um formato único
Camada open source da Asymptote Labs que captura sessões de Claude Code, Cursor, Codex e OpenCode, normaliza tudo em eventos baseados em OpenTelemetry e entrega um dashboard local.
Nove lugares para usar Jev no lugar de um LLM
O guia visual do ByteByteGo mapeia nove decisões que hoje pagam o preço de um LLM de fronteira — roteamento, guardrails, triagem, reranking, evals — e as fontes oficiais da TypeSafe explicam o modelo de decisões tipadas por trás delas.
TypeSafe: a skill oficial do Jev para descobrir onde decisões tipadas substituem código frágil
A skill oficial da TypeSafe instala o contexto do Jev (System One) no seu agente de código, e um roteiro de auditoria em quatro etapas mapeia onde uma decisão tipada com probabilidade calibrada vale mais que parse frágil.
Shopify volta ao nativo: coding agents mudaram a conta de manter duas codebases
A Shopify abandona o React Native nos apps mobile e reconstrói tudo em Swift e Kotlin — porque agentes de código reduziram o custo que justificava a codebase compartilhada. Shop reconstruído nativamente em 12 semanas com o sistema Helix.
HarnessRouter: uma interface unificada para harnesses de agentes
Edição Community self-hosted do HarnessRouter roda Codex, Claude Code, Hermes e mais através de uma única API compatível com OpenAI Responses, sob o Unified Harness Protocol.
fast-jev-compaction: compaction sem resumo, com ferramenta e resultado verbatim
Plugin de Claude Code substitui o resumo de compaction por decisões do Jev: cada tool call e resultado é avaliado num request rápido, os obsoletos caem e tudo que fica permanece verbatim. Também serve como biblioteca npm.
Guides da Apple em Markdown e JSON para agentes
Duas edições na URL transformam qualquer guide da Apple — Human Interface Guidelines e referência de API — em Markdown ou JSON limpo, sem HTML e com muito menos tokens.
Dify: plataforma open source para agentes e fluxos de IA
Plataforma open source que combina workflow visual, pipeline de RAG, agentes, gestão de modelos e observabilidade para levar aplicações de IA do protótipo à produção.
VoxCPM: TTS multilíngue sem tokenizer
Síntese de voz open source do OpenBMB que gera fala contínua por difusão autorregressiva, com 30 idiomas, design de voz, clonagem controlável e áudio de 48 kHz.
TradingAgents: trading com múltiplos agentes de LLM
Framework open source que reproduz uma firma de investimentos com agentes especialistas — analistas, pesquisadores, trader e gestão de risco — debatendo cada decisão sobre dados de mercado.
10 repositórios open source que substituem ferramentas de IA pagas
Trading multi-agente, chat multi-modelo, geração de vídeo e voz, e-mail com agente e integrações de API: dez projetos no GitHub que rodam por conta própria em vez de assinatura mensal.
LibreChat: chat multimodelo self-hosted
Interface open source que conecta GPT, Claude, Gemini e outros modelos pela própria chave de API, com agentes, MCP, skills e gerenciamento de agentes por API.
DeepSeek-V4.1-Flash: arquitetura assimétrica, visão nativa e cache menor
Anúncio do DeepSeek-V4.1-Flash, o menor modelo da nova família de arquitetura da DeepSeek, com visão nativa, MoE de 552B parâmetros, cache KV muito menor e custo por token reduzido.
Open Notebook, OpenSEO, Book-to-Skill, AI Job Search e ComfyUI: 5 open source para agentes e IA aplicada
Alternativa open source ao NotebookLM, SEO com MCP, livro virando skill, framework de busca de emprego no Claude Code e geracao de imagem e video na propria GPU.
Zero: a linguagem de programação para agentes
Linguagem experimental do Vercel Labs desenhada para agentes de IA.
RTK: proxy CLI que reduz tokens em comandos dev
Proxy em Rust que corta 60 a 90 por cento do consumo de tokens em comandos comuns de desenvolvimento.
LLM-Usage-Bar: medidor de limites de plano na barra do macOS
Gauge SwiftUI para cotas de Claude, Codex, Grok e Antigravity em múltiplas contas.
Claude-GLM-Wrapper: alternar rápido entre Claude e GLM
Wrapper que troca configs para usar modelos GLM sem perder login ou resetar API.
Xirp e a camada de contexto para agentes de codigo
Uma curadoria sobre memoria institucional, documentacao viva e contexto organizacional para agentes de desenvolvimento.
Unstract para extração de documentos
Uma curadoria sobre transformar documentos não estruturados em dados estruturados usando prompts, LLMs e automações.
Stanford CME 295: currículo completo de LLM
Estrutura do curso CME 295 (Transformers & Large Language Models) com links para syllabus e materiais das aulas.
50 ML Projects To Understand LLMs
Curadoria de recursos sobre interpretabilidade e análise interna de modelos de linguagem através de projetos práticos
Memento: agentes LLM sem fine-tuning via memória
Curadoria do paper Memento, um framework memory-based para melhorar agentes LLM sem atualizar pesos do modelo, com links para arXiv e código.
17 Coisas Para Conhecer Sobre IA
Coleção selecionada de 17 conceitos essenciais de engenharia de IA cobrindo agentes, LLMs, RAG, bancos de dados vetoriais e design moderno de sistemas de IA.
Evaluations Framework — Avaliação sistemática de recursos com IA
Framework da Apple para medir qualidade de features com IA/LLM em Swift, integrando com testes de CI usando datasets, métricas e model-as-judge.
Unsloth - treinamento local de modelos de IA
Como usar Unsloth para treinar e executar modelos de IA localmente com menos memória.
llmfit - Otimize modelos de IA para seu hardware
Ferramenta que identifica quais modelos locais melhor combinam com o hardware disponível.
Árvore de Modelos do Claude
Guia visual para escolher entre modelos Claude conforme velocidade, complexidade e custo.
Kimi K3 local com Unsloth Dynamic
Requisitos e quantizações dinâmicas para executar o Kimi K3 localmente com Unsloth.
MarkItDown — convertendo documentos para Markdown
Como converter documentos em Markdown com MarkItDown para economizar tokens e preparar dados para LLMs.
AI Skills 10 Core Competencies for 2026
Framework com dez competências de IA, de prompt engineering a gestão de LLMs, com guias práticos.
OmniRoute - Gateway IA Gratuito
Gateway open source que unifica provedores de IA, oferece fallback e ajuda a reduzir custos de tokens.
Colibri - Motor Local de IA
Como o Colibri usa streaming seletivo para executar modelos MoE grandes em hardware comum.