Gemma
Open source / localFamília open-weight do Google DeepMind (Gemma 3 / 4): modelos compactos e multimodais para rodar localmente ou em Vertex / AI Studio.
O que oferece grátis
Pesos gratuitos no Kaggle, Hugging Face e Google AI. Uso local ilimitado. A geração Gemma 4 passou a ser distribuída sob licença Apache 2.0; cotas de API/AI Studio mudam — confirme no site.
Pontos positivos
- Variantes pequenas rodam bem em hardware doméstico
- Mesma linhagem de pesquisa do Gemini, com pesos baixáveis
- A geração Gemma 4 é multimodal e distribuída sob licença Apache 2.0
- Disponível em Ollama, LM Studio, Hugging Face e Google AI
Limitações
- Gemma ≠ aplicativo Gemini: o chat web Gemini é outra ficha
- Modelos maiores exigem GPU com bastante VRAM para bom desempenho
- Em português puro, fine-tunes especializados (ex.: Sabiá) ainda podem vencer em certos casos
Desenvolvido por: Google / Google DeepMind
Gemma é a linha open-weight do Google: você baixa os pesos e roda no PC, sem depender do app Gemini. A geração Gemma 4 acrescenta suporte multimodal (com áudio em algumas variantes) e migrou para a licença Apache 2.0.
Como usar de graça
- Baixe via Ollama (
gemma3,gemma4, etc.) ou LM Studio. - Ou use o playground/API do Google AI Studio com cotas gratuitas (conta Google).
- Para produção local, prefira quantizações GGUF alinhadas à sua VRAM.
Quando preferir outra família
Melhor para
- notebooks com pouca VRAM
- experimentar modelos Google open-weight
- tarefas multimodais leves
Alternativas gratuitas a Gemma
Comunidade: ver canais cadastrados.