Famílias de modelos abertos

Gemma

Open source / local

Família open-weight do Google DeepMind (Gemma 3 / 4): modelos compactos e multimodais para rodar localmente ou em Vertex / AI Studio.

O que oferece grátis

Pesos gratuitos no Kaggle, Hugging Face e Google AI. Uso local ilimitado. A geração Gemma 4 passou a ser distribuída sob licença Apache 2.0; cotas de API/AI Studio mudam — confirme no site.

Acessar site oficial (abre em nova aba)

Pontos positivos

  • Variantes pequenas rodam bem em hardware doméstico
  • Mesma linhagem de pesquisa do Gemini, com pesos baixáveis
  • A geração Gemma 4 é multimodal e distribuída sob licença Apache 2.0
  • Disponível em Ollama, LM Studio, Hugging Face e Google AI

Limitações

  • Gemma ≠ aplicativo Gemini: o chat web Gemini é outra ficha
  • Modelos maiores exigem GPU com bastante VRAM para bom desempenho
  • Em português puro, fine-tunes especializados (ex.: Sabiá) ainda podem vencer em certos casos

Desenvolvido por: Google / Google DeepMind

Gemma é a linha open-weight do Google: você baixa os pesos e roda no PC, sem depender do app Gemini. A geração Gemma 4 acrescenta suporte multimodal (com áudio em algumas variantes) e migrou para a licença Apache 2.0.

Como usar de graça

  1. Baixe via Ollama (gemma3, gemma4, etc.) ou LM Studio.
  2. Ou use o playground/API do Google AI Studio com cotas gratuitas (conta Google).
  3. Para produção local, prefira quantizações GGUF alinhadas à sua VRAM.

Quando preferir outra família

  • Chat Gemini na nuvem → Gemini.
  • Ecossistema Meta → Llama.
  • Código open-weight forte → variantes Coder do Qwen.

Melhor para

  • notebooks com pouca VRAM
  • experimentar modelos Google open-weight
  • tarefas multimodais leves

Alternativas gratuitas a Gemma

Comunidade: ver canais cadastrados.

Ficha atualizada em: 26 de setembro de 2026

Informações verificadas em: 26 de setembro de 2026 · fonte oficial