Como instalar o Ollama em uma VPS Ubuntu
O Ollama permite rodar modelos de linguagem (LLMs) localmente com um único comando. Este guia instala o binário nativo no Ubuntu — o método oficial recomendado — e configura a API REST para integração com Open WebUI, n8n e outras ferramentas.
Pré-requisitos
- VPS mínima: 4 vCPU · 8 GB RAM · 40 GB SSD (para modelos 7B). GPU NVIDIA recomendada para velocidade.
- Sistema: Ubuntu 24.04 LTS
- Acesso root ou usuário com sudo
- Para GPU: drivers NVIDIA instalados (opcional mas recomendado para velocidade)
- Espaço em disco: cada modelo ocupa 4-20 GB
Instalação passo a passo
- 1
Atualizar o sistema
Sincronize repositórios antes de instalar.
bashapt update && apt upgrade -y - 2
Instalar o Ollama
O instalador oficial detecta automaticamente o sistema operacional, arquitetura e presença de GPU NVIDIA ou AMD.
bashcurl -fsSL https://ollama.com/install.sh | shDicaO instalador configura o Ollama como serviço systemd automaticamente. Se houver GPU NVIDIA com drivers instalados, o suporte CUDA é configurado automaticamente. - 3
Verificar o serviço
Confirme que o Ollama está rodando como serviço systemd.
bashsystemctl status ollama # Verificar que a API responde na porta padrão curl http://localhost:11434/DicaA resposta esperada é: `Ollama is running` - 4
Baixar o primeiro modelo
Use `ollama pull` para baixar modelos do Ollama Library. O `llama3.2` (3B) é um bom ponto de partida por ser leve e capaz.
bash# Modelo leve: Llama 3.2 3B (~2 GB) ollama pull llama3.2 # Alternativas populares: # ollama pull mistral # 7B (~4.1 GB) # ollama pull gemma3:4b # 4B (~2.5 GB) # ollama pull qwen2.5:7b # 7B (~4.7 GB)DicaO download pode levar vários minutos dependendo do modelo e da velocidade da sua conexão. Os modelos ficam armazenados em /usr/share/ollama/.ollama/models. - 5
Testar a inferência via CLI
Execute uma consulta diretamente no terminal para confirmar que o modelo funciona.
bashollama run llama3.2 "Explique o que é o Ollama em uma frase"DicaPara sair do modo interativo do Ollama, digite `/bye` ou pressione Ctrl+D. - 6
Testar a API REST
O Ollama expõe uma API REST compatível com o padrão OpenAI na porta 11434.
bash# Listar modelos instalados curl http://localhost:11434/api/tags # Gerar texto via API curl http://localhost:11434/api/generate \ -d '{"model": "llama3.2", "prompt": "Olá! O que você pode fazer?", "stream": false}' - 7
Expor via Nginx com HTTPS (opcional)
Se precisar acessar a API Ollama externamente (ex.: para usar com Open WebUI em outro servidor), configure um reverse proxy com autenticação.
bashapt install -y nginx certbot python3-certbot-nginx # IMPORTANTE: Proteja a API com autenticação básica ou IP allowlist # A API do Ollama não tem autenticação nativa apt install -y apache2-utils htpasswd -c /etc/nginx/.htpasswd ollama_user cat > /etc/nginx/sites-available/ollama << 'NGINXEOF' server { listen 80; server_name ollama.seudominio.com.br; return 301 https://$host$request_uri; } server { listen 443 ssl; server_name ollama.seudominio.com.br; ssl_certificate /etc/letsencrypt/live/ollama.seudominio.com.br/fullchain.pem; ssl_certificate_key /etc/letsencrypt/live/ollama.seudominio.com.br/privkey.pem; location / { auth_basic "Ollama API"; auth_basic_user_file /etc/nginx/.htpasswd; proxy_pass http://127.0.0.1:11434; proxy_set_header Host $host; proxy_set_header X-Real-IP $remote_addr; proxy_read_timeout 3600s; } } NGINXEOF ln -s /etc/nginx/sites-available/ollama /etc/nginx/sites-enabled/ollama nginx -t certbot --nginx -d ollama.seudominio.com.br --non-interactive --agree-tos --email seu@email.com systemctl reload nginxAtençãoA API do Ollama não tem autenticação nativa. NUNCA a exponha publicamente sem autenticação básica, firewall IP ou VPN. - 8
Configurar firewall UFW
Bloqueie o acesso direto à porta 11434 — o acesso externo deve ocorrer apenas via Nginx.
bashufw allow 22/tcp comment 'SSH' ufw allow 80/tcp comment 'HTTP' ufw allow 443/tcp comment 'HTTPS' ufw deny 11434/tcp comment 'Ollama API - apenas acesso local' ufw --force enable ufw status verbose
$ runstack deploy --plan starter
Não quer configurar manualmente?
Não quer configurar manualmente? Implante o Ollama em menos de 3 minutos com a Runstack. Infraestrutura da OPEN DATACENTER, com servidores no Brasil.
Troubleshooting
Perguntas frequentes
[VERIFICAR antes de publicar]
- 1. Confirme a URL do instalador em ollama.com/download/linux — pode mudar entre versões.
- 2. Verifique o caminho atual de armazenamento de modelos (pode variar entre versões).
- 3. Confirme o nome do modelo `llama3.2` em ollama.com/library — nomes de modelos mudam com atualizações.