IA local / self-hosted

LM Studio

Open source / local

Ambiente visual para baixar, testar e conversar com modelos GGUF locais no Windows, Mac e Linux com servidor local de 1 clique.

O que oferece grátis

Totalmente gratuito para uso pessoal e offline — sem contas obrigatórias, sem mensalidade e sem envio de dados.

Modelos de IA local ainda são limitados e podem estar desatualizados em relação aos modelos de nuvem. Evite usá-los para decisões sobre saúde, finanças, questões jurídicas ou outros assuntos sensíveis — para esses casos, prefira fontes confiáveis ou profissionais qualificados.

Acessar site oficial (abre em nova aba)

Pontos positivos

  • Interface visual moderna e amigável (estilo ChatGPT) sem necessidade de comandos de terminal
  • Buscador integrado com o Hugging Face para baixar qualquer modelo aberto e quantização (.gguf)
  • Controle visual de GPU offloading, tamanho da janela de contexto e temperatura de resposta
  • Servidor de inferência local embutido com compatibilidade total à API da OpenAI

Limitações

  • Código proprietário (gratuito para uso pessoal, mas não é open-source auditável como o Ollama ou Jan)
  • Modelos grandes exigem placas com boa VRAM dedicada ou Macs com Apple Silicon para bom desempenho

Desenvolvido por: Element Labs (Estados Unidos)

O LM Studio é uma das ferramentas visuais mais completas e elegantes para executar modelos de linguagem abertos no próprio computador. Ele combina uma interface de chat intuitiva com um buscador direto do ecossistema do Hugging Face.

Principais capacidades

  • Busca e download direto: Encontre milhares de variantes quantizadas (.gguf) de modelos como Llama 4, Qwen 3.6, DeepSeek-V4 e Mistral. O app avalia automaticamente a memória RAM e VRAM do seu sistema e indica se o modelo cabe no seu hardware.
  • Servidor Local OpenAI: Com um clique na aba de servidor, o LM Studio inicializa uma API HTTP local na porta 1234 compatível com o padrão v1/chat/completions. Isso permite plugar seus modelos locais no Cursor, Continue.dev ou scripts em Python sem alterar bibliotecas.
  • Suporte a RAG e Documentos: Permite anexar arquivos PDF e textos diretamente na conversa para análise documental 100% privada e offline.
  • Aceleração por Hardware: Aproveita aceleração por GPU dedicada (NVIDIA CUDA, AMD ROCm) e a arquitetura de Memória Unificada dos processadores Apple Silicon (M1/M2/M3/M4) com ajuste granular de camadas (GPU offload).

Para quem é

Usuários que desejam a experiência fluida de um ChatGPT nativo no desktop sem digitar comandos em terminal, além de desenvolvedores que precisam comparar rapidamente o comportamento de diferentes quantizações (Q4, Q6, Q8) de um mesmo modelo.

Melhor para

  • Conversar offline
  • Manter dados no computador
  • Testar modelos abertos

Alternativas gratuitas a LM Studio

Comparativos com LM Studio

Comunidade: ver canais cadastrados.

Ficha atualizada em: 22 de setembro de 2026

Informações verificadas em: 22 de setembro de 2026 · fonte oficial