Código aberto e pesos abertos
IAs open source e modelos abertos gratuitos
Diferente de serviços proprietários na nuvem sujeitos a alterações de preços, cortes de cotas e coleta de dados, as tecnologias de inteligência artificial de código aberto e modelos de pesos abertos pertencem à comunidade.
Aqui você encontra ferramentas que pode baixar, auditar, rodar no seu próprio computador ou instalar no seu servidor sem custos de licenciamento.
Modelos de IA local ainda são limitados e podem estar desatualizados em relação aos modelos de nuvem. Evite usá-los para decisões sobre saúde, finanças, questões jurídicas ou outros assuntos sensíveis — para esses casos, prefira fontes confiáveis ou profissionais qualificados.
Por que optar por IA Open Source?
1. Privacidade total: Suas conversas, arquivos e documentos confidenciais nunca saem do seu computador ou servidor.
2. Sem cotas arbitrárias: Você pode fazer quantas perguntas quiser e gerar quantas imagens precisar, limitado apenas pelo poder do seu hardware.
3. Funcionamento 100% offline: Continue trabalhando mesmo sem conexão com a internet.
Ferramentas e modelos abertos catalogados (25)
Cline
Agente de código open source (Apache 2.0) para VS Code e terminal: edita o projeto, roda comandos e aceita Ollama ou qualquer API (BYOK).
Grátis: Software 100% gratuito e open source. Sem assinatura do Cline: você traz a chave de API (OpenAI, Anthropic,…
Automação e agentesCrewAI
Framework open-source para orquestrar múltiplos agentes de IA colaborando em uma tarefa.
Grátis: O framework open-source (MIT) é gratuito e sem limites ao rodar no seu próprio computador ou servidor com s…
Automação e agentesDify
Plataforma open-source para criar agentes de IA, workflows e apps com LLMs, com editor visual.
Grátis: A edição Community (self-hosted) é gratuita e sem limite artificial de uso — você banca a própria infraestr…
Famílias de modelos abertosFalcon
Família open-weight do Technology Innovation Institute (Abu Dhabi): Falcon 2/3 com licença permissiva para pesquisa e produtos.
Grátis: Pesos gratuitos no Hugging Face (TII). Uso local ilimitado. Sem assinatura obrigatória para download.
Geração de imagemFLUX
Família de modelos abertos de difusão latente de última geração com variantes schnell (Apache 2.0) e dev.
Grátis: O modelo FLUX.1 schnell é 100% de código aberto sob licença Apache 2.0 (uso comercial liberado e gratuito p…
Famílias de modelos abertosGemma
Família open-weight do Google DeepMind (Gemma 3 / 4): modelos compactos e multimodais para rodar localmente ou em Vertex / AI Studio.
Grátis: Pesos gratuitos no Kaggle, Hugging Face e Google AI. Uso local ilimitado. A geração Gemma 4 passou a ser di…
Famílias de modelos abertosGLM / ChatGLM
Família open-weight da Zhipu AI (ChatGLM / GLM-4): chat, código e agentes com pesos publicados e chat Z.ai na nuvem.
Grátis: Pesos no GitHub/Hugging Face para uso local. Chat e API Z.ai têm camadas gratuitas/limitadas — confirme cot…
Famílias de modelos abertosGranite
Família open-weight da IBM (Granite 3.x): modelos de código e linguagem com licença Apache 2.0 voltados a uso empresarial e local.
Grátis: Pesos Apache 2.0 no Hugging Face / IBM. Uso local ilimitado. watsonx e APIs IBM têm planos próprios — esta…
Automação e agentesHermes Agent
Agente de IA open-source com memória persistente, agendamento de tarefas e integração com apps de mensagem.
Grátis: O núcleo do agente é gratuito e open-source (MIT), funcionando com modelos de IA gratuitos por padrão. Há u…
Famílias de modelos abertosInternLM
Família open-weight do Shanghai AI Laboratory: chat web gratuito e pesos para rodar localmente ou em servidores próprios.
Grátis: Chat web gratuito no site oficial; pesos publicados no Hugging Face/GitHub. Uso local ilimitado (hardware).…
IA local / self-hostedJan
Cliente de chat open-source para rodar modelos de IA 100% offline, com motor llama.cpp e servidor local embutido.
Grátis: 100% gratuito e de código aberto (AGPLv3) — sem contas, telemetria intrusiva ou limites artificiais de uso.
Famílias de modelos abertosLlama
Família de LLMs open-weight da Meta (Llama 3.x / 4): roda localmente via Ollama/LM Studio ou em provedores de nuvem.
Grátis: Pesos disponíveis no Hugging Face / repositórios oficiais para download gratuito. Uso local ilimitado (só h…
IA local / self-hostedLM Studio
Ambiente visual para baixar, testar e conversar com modelos GGUF locais no Windows, Mac e Linux com servidor local de 1 clique.
Grátis: Totalmente gratuito para uso pessoal e offline — sem contas obrigatórias, sem mensalidade e sem envio de da…
Famílias de modelos abertosMistral
Família open-weight da Mistral AI (Mistral Small/Nemo, Mixtral, Codestral…): ótima relação qualidade × tamanho para rodar localmente.
Grátis: Pesos Apache 2.0 (na maioria das variantes abertas) no Hugging Face / Ollama. Uso local ilimitado. O chat w…
Automação e agentesn8n
Plataforma de automação de workflows com nós visuais, IA integrada e forte foco em self-hosting.
Grátis: A versão self-hosted (Community Edition) é gratuita e sem limite de execuções — você só paga o servidor ond…
Plataformas e hubs de IANVIDIA AI
Catálogo da NVIDIA para testar APIs hospedadas e executar contêineres NIM localmente.
Grátis: A API hospedada oferece créditos de avaliação. Contêineres NIM selecionados podem ser executados localmente…
IA local / self-hostedOllama
Servidor e ferramenta de linha de comando para rodar LLMs e modelos multimodais no seu próprio computador com API compatível com a OpenAI.
Grátis: 100% grátis e de código aberto (MIT) — sem assinaturas, cotas ou telemetria forçada; o único limite é o har…
Famílias de modelos abertosOLMo
Família totalmente aberta do Allen Institute for AI: pesos, código, dados e logs de treino — referência em transparência científica.
Grátis: Tudo gratuito para download (pesos + artefatos de treino conforme release). Uso local ilimitado. Sem chat c…
Automação e agentesOpenClaw
Assistente de IA autônomo open-source que roda localmente e executa tarefas reais via WhatsApp, Telegram, Discord ou Slack.
Grátis: Totalmente gratuito, sem assinatura e sem camada paga — o código é aberto (MIT) e roda no seu próprio compu…
IDEs e assistentes de códigoOpenCode
Agente de código open source (MIT) no terminal, desktop ou IDE: LSP, multi-sessão e 75+ provedores — inclui modelos gratuitos no gateway Zen ou BYOK/local.
Grátis: O agente é 100% gratuito e open source (MIT). Caminho sem custo de API: modelos locais (ex.: Ollama) ou sua…
Famílias de modelos abertosPhi
Família de SLMs da Microsoft (Phi-3 / Phi-4): modelos pequenos e capazes para CPU/GPU modesta, com pesos no Hugging Face e Azure.
Grátis: Pesos open-weight gratuitos (licença MIT nas linhas Phi-3/4 publicadas). Uso local ilimitado. Azure AI pode…
Geração de imagemStable Diffusion
Família de modelos de geração de imagens com variantes usadas em ferramentas locais e serviços.
Grátis: Pesos de variantes disponíveis e serviços de inferência. Consulte o site oficial para os limites gratuitos…
Geração de vídeoWan
Família de vídeo generativo com variantes publicadas para execução própria.
Grátis: Serviço web e repositórios de variantes abertas. Consulte o site oficial para os limites gratuitos atualiza…
Transcrição, TTS e traduçãoWhisper
Modelo de reconhecimento de fala para transcrição multilíngue e tradução de fala para inglês.
Grátis: Código e pesos sob licença MIT; pode rodar localmente ou em infraestrutura própria. Consulte o site oficial…
Famílias de modelos abertosYi
Família open-weight da 01.AI (Yi-1.5 / Yi-Coder): modelos bilíngues (EN/ZH) fortes em raciocínio e código para uso local.
Grátis: Pesos gratuitos no Hugging Face / ModelScope. Uso local ilimitado. Chat/API oficiais, se disponíveis, têm c…
Requisitos de memória (RAM/VRAM) e hardware
Para executar modelos de linguagem ou geradores de imagem no seu próprio computador:
Escala de memória e processamento
- 8 GB de RAM / VRAM: Modelos compactos de 1B a 4B (Gemma 4, Qwen 3.6) e transcrição rápida de áudio com Whisper.
- 16 GB de RAM / VRAM: Padrão ideal para modelos de 7B a 14B parâmetros em quantização Q4_K_M com boa velocidade.
- 32 GB+ (Apple Silicon ou GPU 16 GB+): Modelos densos (14B a 32B) e janelas amplas de contexto.
- Apple Silicon (M1/M2/M3/M4): A Memória Unificada permite carregar modelos grandes compartilhados entre CPU e GPU com altíssima eficiência energética.
Formatos de quantização explicados: GGUF vs AWQ vs EXL2
A quantização comprime os pesos matemáticos de 16 bits para 4 bits sem perda perceptível de raciocínio:
- GGUF: O formato binário universal do llama.cpp; roda em CPUs (com instruções AVX/AMX), placas de vídeo e Mac.
- AWQ: Otimizado para placas NVIDIA com núcleos tensores; preserva os pesos mais críticos da rede neural.
- EXL2: Máxima taxa de tokens por segundo em GPUs dedicadas com taxas de bits intermediárias (ex.: 3.5 a 4.5 bits).
⚡ APIs Locais com compatibilidade OpenAI e RAG Offline
Ferramentas como o Ollama e o LM Studio criam servidores HTTP em http://localhost:11434/v1 compatíveis com a biblioteca oficial da OpenAI. Isso permite plugar modelos locais no LangChain, LiteLLM ou no Cursor a custo zero. Com bancos vetoriais embutidos como ChromaDB ou LanceDB e modelos como Nomic-Embed, você cria pipelines de RAG 100% offline para analisar contratos e relatórios confidenciais sem violar a LGPD.
⚖️ Governança e Auditoria de Licenças (Checkpoint Diligence)
"Aberto" no Hugging Face não significa automaticamente "liberado para qualquer uso". É indispensável auditar o arquivo LICENSE de cada variante de modelo antes de colocá-la em produção:
- Licenças Permissivas (MIT e Apache 2.0): Garantem liberdade irrestrita para comercialização, monetização e modificação de código e pesos (ex.: DeepSeek-V4, Gemma 4, FLUX.1 schnell e Whisper).
- Licenças Comunitárias com Teto (Llama Community License): Permitem uso comercial e acadêmico gratuito, mas impõem a solicitação de uma licença comercial formal à Meta caso o produto alcance mais de 700 milhões de usuários ativos mensais (MAU).
- Armadilhas em Variantes Próximas: Modelos da mesma família podem ter termos opostos. Enquanto o FLUX.1 schnell é livre sob Apache 2.0, o FLUX.1 dev possui licença não-comercial restrita para pesquisa. Usar a versão dev em produtos comerciais gera passivo jurídico imediato.