LM Studio
Open source / localAmbiente visual para baixar, testar e conversar com modelos GGUF locais no Windows, Mac e Linux com servidor local de 1 clique.
O que oferece grátis
Totalmente gratuito para uso pessoal e offline — sem contas obrigatórias, sem mensalidade e sem envio de dados.
Modelos de IA local ainda são limitados e podem estar desatualizados em relação aos modelos de nuvem. Evite usá-los para decisões sobre saúde, finanças, questões jurídicas ou outros assuntos sensíveis — para esses casos, prefira fontes confiáveis ou profissionais qualificados.
Pontos positivos
- Interface visual moderna e amigável (estilo ChatGPT) sem necessidade de comandos de terminal
- Buscador integrado com o Hugging Face para baixar qualquer modelo aberto e quantização (.gguf)
- Controle visual de GPU offloading, tamanho da janela de contexto e temperatura de resposta
- Servidor de inferência local embutido com compatibilidade total à API da OpenAI
Limitações
- Código proprietário (gratuito para uso pessoal, mas não é open-source auditável como o Ollama ou Jan)
- Modelos grandes exigem placas com boa VRAM dedicada ou Macs com Apple Silicon para bom desempenho
Desenvolvido por: Element Labs (Estados Unidos)
O LM Studio é uma das ferramentas visuais mais completas e elegantes para executar modelos de linguagem abertos no próprio computador. Ele combina uma interface de chat intuitiva com um buscador direto do ecossistema do Hugging Face.
Principais capacidades
- Busca e download direto: Encontre milhares de variantes quantizadas (.gguf) de modelos como Llama 4, Qwen 3.6, DeepSeek-V4 e Mistral. O app avalia automaticamente a memória RAM e VRAM do seu sistema e indica se o modelo cabe no seu hardware.
- Servidor Local OpenAI: Com um clique na aba de servidor, o LM Studio inicializa uma API HTTP local na porta
1234compatível com o padrãov1/chat/completions. Isso permite plugar seus modelos locais no Cursor, Continue.dev ou scripts em Python sem alterar bibliotecas. - Suporte a RAG e Documentos: Permite anexar arquivos PDF e textos diretamente na conversa para análise documental 100% privada e offline.
- Aceleração por Hardware: Aproveita aceleração por GPU dedicada (NVIDIA CUDA, AMD ROCm) e a arquitetura de Memória Unificada dos processadores Apple Silicon (M1/M2/M3/M4) com ajuste granular de camadas (GPU offload).
Para quem é
Usuários que desejam a experiência fluida de um ChatGPT nativo no desktop sem digitar comandos em terminal, além de desenvolvedores que precisam comparar rapidamente o comportamento de diferentes quantizações (Q4, Q6, Q8) de um mesmo modelo.
Melhor para
- Conversar offline
- Manter dados no computador
- Testar modelos abertos
Alternativas gratuitas a LM Studio
Comparativos com LM Studio
Comunidade: ver canais cadastrados.