Código aberto e pesos abertos

IAs open source e modelos abertos gratuitos

Diferente de serviços proprietários na nuvem sujeitos a alterações de preços, cortes de cotas e coleta de dados, as tecnologias de inteligência artificial de código aberto e modelos de pesos abertos pertencem à comunidade.

Aqui você encontra ferramentas que pode baixar, auditar, rodar no seu próprio computador ou instalar no seu servidor sem custos de licenciamento.

Modelos de IA local ainda são limitados e podem estar desatualizados em relação aos modelos de nuvem. Evite usá-los para decisões sobre saúde, finanças, questões jurídicas ou outros assuntos sensíveis — para esses casos, prefira fontes confiáveis ou profissionais qualificados.

Por que optar por IA Open Source?

1. Privacidade total: Suas conversas, arquivos e documentos confidenciais nunca saem do seu computador ou servidor.

2. Sem cotas arbitrárias: Você pode fazer quantas perguntas quiser e gerar quantas imagens precisar, limitado apenas pelo poder do seu hardware.

3. Funcionamento 100% offline: Continue trabalhando mesmo sem conexão com a internet.

Ferramentas e modelos abertos catalogados (25)

IDEs e assistentes de código

Cline

Agente de código open source (Apache 2.0) para VS Code e terminal: edita o projeto, roda comandos e aceita Ollama ou qualquer API (BYOK).

Grátis: Software 100% gratuito e open source. Sem assinatura do Cline: você traz a chave de API (OpenAI, Anthropic,…

Open source / localPT
Automação e agentes

CrewAI

Framework open-source para orquestrar múltiplos agentes de IA colaborando em uma tarefa.

Grátis: O framework open-source (MIT) é gratuito e sem limites ao rodar no seu próprio computador ou servidor com s…

Open source / localPT
Automação e agentes

Dify

Plataforma open-source para criar agentes de IA, workflows e apps com LLMs, com editor visual.

Grátis: A edição Community (self-hosted) é gratuita e sem limite artificial de uso — você banca a própria infraestr…

Open source / localPT
Famílias de modelos abertos

Falcon

Família open-weight do Technology Innovation Institute (Abu Dhabi): Falcon 2/3 com licença permissiva para pesquisa e produtos.

Grátis: Pesos gratuitos no Hugging Face (TII). Uso local ilimitado. Sem assinatura obrigatória para download.

Open source / localPT
Geração de imagem

FLUX

Família de modelos abertos de difusão latente de última geração com variantes schnell (Apache 2.0) e dev.

Grátis: O modelo FLUX.1 schnell é 100% de código aberto sob licença Apache 2.0 (uso comercial liberado e gratuito p…

Open source / localPT
Famílias de modelos abertos

Gemma

Família open-weight do Google DeepMind (Gemma 3 / 4): modelos compactos e multimodais para rodar localmente ou em Vertex / AI Studio.

Grátis: Pesos gratuitos no Kaggle, Hugging Face e Google AI. Uso local ilimitado. A geração Gemma 4 passou a ser di…

Open source / localPT
Famílias de modelos abertos

GLM / ChatGLM

Família open-weight da Zhipu AI (ChatGLM / GLM-4): chat, código e agentes com pesos publicados e chat Z.ai na nuvem.

Grátis: Pesos no GitHub/Hugging Face para uso local. Chat e API Z.ai têm camadas gratuitas/limitadas — confirme cot…

Open source / localPT limitado
Famílias de modelos abertos

Granite

Família open-weight da IBM (Granite 3.x): modelos de código e linguagem com licença Apache 2.0 voltados a uso empresarial e local.

Grátis: Pesos Apache 2.0 no Hugging Face / IBM. Uso local ilimitado. watsonx e APIs IBM têm planos próprios — esta…

Open source / localPT
Automação e agentes

Hermes Agent

Agente de IA open-source com memória persistente, agendamento de tarefas e integração com apps de mensagem.

Grátis: O núcleo do agente é gratuito e open-source (MIT), funcionando com modelos de IA gratuitos por padrão. Há u…

Open source / localPT
Famílias de modelos abertos

InternLM

Família open-weight do Shanghai AI Laboratory: chat web gratuito e pesos para rodar localmente ou em servidores próprios.

Grátis: Chat web gratuito no site oficial; pesos publicados no Hugging Face/GitHub. Uso local ilimitado (hardware).…

Open source / localPT limitado
IA local / self-hosted

Jan

Cliente de chat open-source para rodar modelos de IA 100% offline, com motor llama.cpp e servidor local embutido.

Grátis: 100% gratuito e de código aberto (AGPLv3) — sem contas, telemetria intrusiva ou limites artificiais de uso.

Open source / localPT
Famílias de modelos abertos

Llama

Família de LLMs open-weight da Meta (Llama 3.x / 4): roda localmente via Ollama/LM Studio ou em provedores de nuvem.

Grátis: Pesos disponíveis no Hugging Face / repositórios oficiais para download gratuito. Uso local ilimitado (só h…

Open source / localPT
IA local / self-hosted

LM Studio

Ambiente visual para baixar, testar e conversar com modelos GGUF locais no Windows, Mac e Linux com servidor local de 1 clique.

Grátis: Totalmente gratuito para uso pessoal e offline — sem contas obrigatórias, sem mensalidade e sem envio de da…

Open source / localPT
Famílias de modelos abertos

Mistral

Família open-weight da Mistral AI (Mistral Small/Nemo, Mixtral, Codestral…): ótima relação qualidade × tamanho para rodar localmente.

Grátis: Pesos Apache 2.0 (na maioria das variantes abertas) no Hugging Face / Ollama. Uso local ilimitado. O chat w…

Open source / localPT
Automação e agentes

n8n

Plataforma de automação de workflows com nós visuais, IA integrada e forte foco em self-hosting.

Grátis: A versão self-hosted (Community Edition) é gratuita e sem limite de execuções — você só paga o servidor ond…

Open source / localPT
Plataformas e hubs de IA

NVIDIA AI

Catálogo da NVIDIA para testar APIs hospedadas e executar contêineres NIM localmente.

Grátis: A API hospedada oferece créditos de avaliação. Contêineres NIM selecionados podem ser executados localmente…

Open source / localPT
IA local / self-hosted

Ollama

Servidor e ferramenta de linha de comando para rodar LLMs e modelos multimodais no seu próprio computador com API compatível com a OpenAI.

Grátis: 100% grátis e de código aberto (MIT) — sem assinaturas, cotas ou telemetria forçada; o único limite é o har…

Open source / localPT
Famílias de modelos abertos

OLMo

Família totalmente aberta do Allen Institute for AI: pesos, código, dados e logs de treino — referência em transparência científica.

Grátis: Tudo gratuito para download (pesos + artefatos de treino conforme release). Uso local ilimitado. Sem chat c…

Open source / localPT
Automação e agentes

OpenClaw

Assistente de IA autônomo open-source que roda localmente e executa tarefas reais via WhatsApp, Telegram, Discord ou Slack.

Grátis: Totalmente gratuito, sem assinatura e sem camada paga — o código é aberto (MIT) e roda no seu próprio compu…

Open source / localPT
IDEs e assistentes de código

OpenCode

Agente de código open source (MIT) no terminal, desktop ou IDE: LSP, multi-sessão e 75+ provedores — inclui modelos gratuitos no gateway Zen ou BYOK/local.

Grátis: O agente é 100% gratuito e open source (MIT). Caminho sem custo de API: modelos locais (ex.: Ollama) ou sua…

Open source / localPT
Famílias de modelos abertos

Phi

Família de SLMs da Microsoft (Phi-3 / Phi-4): modelos pequenos e capazes para CPU/GPU modesta, com pesos no Hugging Face e Azure.

Grátis: Pesos open-weight gratuitos (licença MIT nas linhas Phi-3/4 publicadas). Uso local ilimitado. Azure AI pode…

Open source / localPT
Geração de imagem

Stable Diffusion

Família de modelos de geração de imagens com variantes usadas em ferramentas locais e serviços.

Grátis: Pesos de variantes disponíveis e serviços de inferência. Consulte o site oficial para os limites gratuitos…

Open source / localPT
Geração de vídeo

Wan

Família de vídeo generativo com variantes publicadas para execução própria.

Grátis: Serviço web e repositórios de variantes abertas. Consulte o site oficial para os limites gratuitos atualiza…

Open source / localPT
Transcrição, TTS e tradução

Whisper

Modelo de reconhecimento de fala para transcrição multilíngue e tradução de fala para inglês.

Grátis: Código e pesos sob licença MIT; pode rodar localmente ou em infraestrutura própria. Consulte o site oficial…

Open source / localPT
Famílias de modelos abertos

Yi

Família open-weight da 01.AI (Yi-1.5 / Yi-Coder): modelos bilíngues (EN/ZH) fortes em raciocínio e código para uso local.

Grátis: Pesos gratuitos no Hugging Face / ModelScope. Uso local ilimitado. Chat/API oficiais, se disponíveis, têm c…

Open source / localPT limitado

Requisitos de memória (RAM/VRAM) e hardware

Para executar modelos de linguagem ou geradores de imagem no seu próprio computador:

Escala de memória e processamento

  • 8 GB de RAM / VRAM: Modelos compactos de 1B a 4B (Gemma 4, Qwen 3.6) e transcrição rápida de áudio com Whisper.
  • 16 GB de RAM / VRAM: Padrão ideal para modelos de 7B a 14B parâmetros em quantização Q4_K_M com boa velocidade.
  • 32 GB+ (Apple Silicon ou GPU 16 GB+): Modelos densos (14B a 32B) e janelas amplas de contexto.
  • Apple Silicon (M1/M2/M3/M4): A Memória Unificada permite carregar modelos grandes compartilhados entre CPU e GPU com altíssima eficiência energética.

Formatos de quantização explicados: GGUF vs AWQ vs EXL2

A quantização comprime os pesos matemáticos de 16 bits para 4 bits sem perda perceptível de raciocínio:

  • GGUF: O formato binário universal do llama.cpp; roda em CPUs (com instruções AVX/AMX), placas de vídeo e Mac.
  • AWQ: Otimizado para placas NVIDIA com núcleos tensores; preserva os pesos mais críticos da rede neural.
  • EXL2: Máxima taxa de tokens por segundo em GPUs dedicadas com taxas de bits intermediárias (ex.: 3.5 a 4.5 bits).

⚡ APIs Locais com compatibilidade OpenAI e RAG Offline

Ferramentas como o Ollama e o LM Studio criam servidores HTTP em http://localhost:11434/v1 compatíveis com a biblioteca oficial da OpenAI. Isso permite plugar modelos locais no LangChain, LiteLLM ou no Cursor a custo zero. Com bancos vetoriais embutidos como ChromaDB ou LanceDB e modelos como Nomic-Embed, você cria pipelines de RAG 100% offline para analisar contratos e relatórios confidenciais sem violar a LGPD.

⚖️ Governança e Auditoria de Licenças (Checkpoint Diligence)

"Aberto" no Hugging Face não significa automaticamente "liberado para qualquer uso". É indispensável auditar o arquivo LICENSE de cada variante de modelo antes de colocá-la em produção:

  • Licenças Permissivas (MIT e Apache 2.0): Garantem liberdade irrestrita para comercialização, monetização e modificação de código e pesos (ex.: DeepSeek-V4, Gemma 4, FLUX.1 schnell e Whisper).
  • Licenças Comunitárias com Teto (Llama Community License): Permitem uso comercial e acadêmico gratuito, mas impõem a solicitação de uma licença comercial formal à Meta caso o produto alcance mais de 700 milhões de usuários ativos mensais (MAU).
  • Armadilhas em Variantes Próximas: Modelos da mesma família podem ter termos opostos. Enquanto o FLUX.1 schnell é livre sob Apache 2.0, o FLUX.1 dev possui licença não-comercial restrita para pesquisa. Usar a versão dev em produtos comerciais gera passivo jurídico imediato.
🛡️ Ler Guia de Governança, Riscos Jurídicos e LGPD ➔🎓 Ver Ementa do Curso Prático de IA Local ➔💻 Guia Técnico de Hardware e Modelos GGUF ➔