Llama
Open source / localFamília de LLMs open-weight da Meta (Llama 3.x / 4): roda localmente via Ollama/LM Studio ou em provedores de nuvem.
O que oferece grátis
Pesos disponíveis no Hugging Face / repositórios oficiais para download gratuito. Uso local ilimitado (só hardware). A Meta AI no WhatsApp/web é outro produto — esta ficha cobre a família de modelos.
Pontos positivos
- Ecossistema enorme: quase todo runtime local (Ollama, LM Studio, llama.cpp) traz variantes Llama prontas
- Faixas de tamanho do pequeno (1B–8B) ao MoE grande — dá para caber em notebook ou servidor
- Bom suporte comunitário a português em fine-tunes e prompts bem estruturados
Limitações
- Licença comunitária Llama tem condições (uso aceitável / restrições comerciais em escala) — leia o texto oficial
- Modelos grandes exigem muita RAM/VRAM; quantização GGUF ajuda, mas qualidade cai um pouco
- Não é um chat web da Meta: para conversar no navegador use Meta AI ou rode com Ollama/Jan
Desenvolvido por: Meta (Estados Unidos)
A família Llama é a base mais usada do ecossistema open-weight: assistentes locais, RAG, agentes e APIs self-hosted costumam começar por aqui.
Como usar de graça
- Instale Ollama, LM Studio ou Jan.
- Baixe uma variante compatível com sua máquina (ex.: 3B–8B em notebooks; 70B+ só com GPU forte).
- Converse na interface ou exponha endpoint OpenAI-compatible para scripts.
Quando preferir outra família
Melhor para
- chat e código local
- fine-tuning e pesquisa
- APIs locais compatíveis com OpenAI
Alternativas gratuitas a Llama
Comunidade: ver canais cadastrados.