Famílias de modelos abertos

Llama

Open source / local

Família de LLMs open-weight da Meta (Llama 3.x / 4): roda localmente via Ollama/LM Studio ou em provedores de nuvem.

O que oferece grátis

Pesos disponíveis no Hugging Face / repositórios oficiais para download gratuito. Uso local ilimitado (só hardware). A Meta AI no WhatsApp/web é outro produto — esta ficha cobre a família de modelos.

Acessar site oficial (abre em nova aba)

Pontos positivos

  • Ecossistema enorme: quase todo runtime local (Ollama, LM Studio, llama.cpp) traz variantes Llama prontas
  • Faixas de tamanho do pequeno (1B–8B) ao MoE grande — dá para caber em notebook ou servidor
  • Bom suporte comunitário a português em fine-tunes e prompts bem estruturados

Limitações

  • Licença comunitária Llama tem condições (uso aceitável / restrições comerciais em escala) — leia o texto oficial
  • Modelos grandes exigem muita RAM/VRAM; quantização GGUF ajuda, mas qualidade cai um pouco
  • Não é um chat web da Meta: para conversar no navegador use Meta AI ou rode com Ollama/Jan

Desenvolvido por: Meta (Estados Unidos)

A família Llama é a base mais usada do ecossistema open-weight: assistentes locais, RAG, agentes e APIs self-hosted costumam começar por aqui.

Como usar de graça

  1. Instale Ollama, LM Studio ou Jan.
  2. Baixe uma variante compatível com sua máquina (ex.: 3B–8B em notebooks; 70B+ só com GPU forte).
  3. Converse na interface ou exponha endpoint OpenAI-compatible para scripts.

Quando preferir outra família

  • Quer licença MIT bem permissiva → DeepSeek (R1 destilado) ou OLMo.
  • Quer modelo Google open-weight → Gemma.
  • Quer chat web francês / Mistral → Le Chat (produto) ou pesos Mistral.

Melhor para

  • chat e código local
  • fine-tuning e pesquisa
  • APIs locais compatíveis com OpenAI

Alternativas gratuitas a Llama

Comunidade: ver canais cadastrados.

Ficha atualizada em: 23 de setembro de 2026

Informações verificadas em: 23 de setembro de 2026 · fonte oficial