Tutoriais/Ollama

    Como instalar o Ollama em uma VPS Ubuntu

    O Ollama permite rodar modelos de linguagem (LLMs) localmente com um único comando. Este guia instala o binário nativo no Ubuntu — o método oficial recomendado — e configura a API REST para integração com Open WebUI, n8n e outras ferramentas.

    ~15 minjunho/2026 · Ubuntu 24.04 LTS

    Pré-requisitos

    • VPS mínima: 4 vCPU · 8 GB RAM · 40 GB SSD (para modelos 7B). GPU NVIDIA recomendada para velocidade.
    • Sistema: Ubuntu 24.04 LTS
    • Acesso root ou usuário com sudo
    • Para GPU: drivers NVIDIA instalados (opcional mas recomendado para velocidade)
    • Espaço em disco: cada modelo ocupa 4-20 GB

    Instalação passo a passo

    1. 1

      Atualizar o sistema

      Sincronize repositórios antes de instalar.

      bash
      apt update && apt upgrade -y
    2. 2

      Instalar o Ollama

      O instalador oficial detecta automaticamente o sistema operacional, arquitetura e presença de GPU NVIDIA ou AMD.

      bash
      curl -fsSL https://ollama.com/install.sh | sh
      Dica
      O instalador configura o Ollama como serviço systemd automaticamente. Se houver GPU NVIDIA com drivers instalados, o suporte CUDA é configurado automaticamente.
    3. 3

      Verificar o serviço

      Confirme que o Ollama está rodando como serviço systemd.

      bash
      systemctl status ollama
      
      # Verificar que a API responde na porta padrão
      curl http://localhost:11434/
      Dica
      A resposta esperada é: `Ollama is running`
    4. 4

      Baixar o primeiro modelo

      Use `ollama pull` para baixar modelos do Ollama Library. O `llama3.2` (3B) é um bom ponto de partida por ser leve e capaz.

      bash
      # Modelo leve: Llama 3.2 3B (~2 GB)
      ollama pull llama3.2
      
      # Alternativas populares:
      # ollama pull mistral          # 7B (~4.1 GB)
      # ollama pull gemma3:4b        # 4B (~2.5 GB)
      # ollama pull qwen2.5:7b       # 7B (~4.7 GB)
      Dica
      O download pode levar vários minutos dependendo do modelo e da velocidade da sua conexão. Os modelos ficam armazenados em /usr/share/ollama/.ollama/models.
    5. 5

      Testar a inferência via CLI

      Execute uma consulta diretamente no terminal para confirmar que o modelo funciona.

      bash
      ollama run llama3.2 "Explique o que é o Ollama em uma frase"
      Dica
      Para sair do modo interativo do Ollama, digite `/bye` ou pressione Ctrl+D.
    6. 6

      Testar a API REST

      O Ollama expõe uma API REST compatível com o padrão OpenAI na porta 11434.

      bash
      # Listar modelos instalados
      curl http://localhost:11434/api/tags
      
      # Gerar texto via API
      curl http://localhost:11434/api/generate \
        -d '{"model": "llama3.2", "prompt": "Olá! O que você pode fazer?", "stream": false}'
    7. 7

      Expor via Nginx com HTTPS (opcional)

      Se precisar acessar a API Ollama externamente (ex.: para usar com Open WebUI em outro servidor), configure um reverse proxy com autenticação.

      bash
      apt install -y nginx certbot python3-certbot-nginx
      
      # IMPORTANTE: Proteja a API com autenticação básica ou IP allowlist
      # A API do Ollama não tem autenticação nativa
      
      apt install -y apache2-utils
      htpasswd -c /etc/nginx/.htpasswd ollama_user
      
      cat > /etc/nginx/sites-available/ollama << 'NGINXEOF'
      server {
          listen 80;
          server_name ollama.seudominio.com.br;
          return 301 https://$host$request_uri;
      }
      
      server {
          listen 443 ssl;
          server_name ollama.seudominio.com.br;
      
          ssl_certificate /etc/letsencrypt/live/ollama.seudominio.com.br/fullchain.pem;
          ssl_certificate_key /etc/letsencrypt/live/ollama.seudominio.com.br/privkey.pem;
      
          location / {
              auth_basic "Ollama API";
              auth_basic_user_file /etc/nginx/.htpasswd;
      
              proxy_pass http://127.0.0.1:11434;
              proxy_set_header Host $host;
              proxy_set_header X-Real-IP $remote_addr;
              proxy_read_timeout 3600s;
          }
      }
      NGINXEOF
      
      ln -s /etc/nginx/sites-available/ollama /etc/nginx/sites-enabled/ollama
      nginx -t
      
      certbot --nginx -d ollama.seudominio.com.br --non-interactive --agree-tos --email seu@email.com
      systemctl reload nginx
      Atenção
      A API do Ollama não tem autenticação nativa. NUNCA a exponha publicamente sem autenticação básica, firewall IP ou VPN.
    8. 8

      Configurar firewall UFW

      Bloqueie o acesso direto à porta 11434 — o acesso externo deve ocorrer apenas via Nginx.

      bash
      ufw allow 22/tcp comment 'SSH'
      ufw allow 80/tcp comment 'HTTP'
      ufw allow 443/tcp comment 'HTTPS'
      ufw deny 11434/tcp comment 'Ollama API - apenas acesso local'
      ufw --force enable
      ufw status verbose

    $ runstack deploy --plan starter

    Não quer configurar manualmente?

    Não quer configurar manualmente? Implante o Ollama em menos de 3 minutos com a Runstack. Infraestrutura da OPEN DATACENTER, com servidores no Brasil.

    Troubleshooting

    Perguntas frequentes

    [VERIFICAR antes de publicar]

    • 1. Confirme a URL do instalador em ollama.com/download/linux — pode mudar entre versões.
    • 2. Verifique o caminho atual de armazenamento de modelos (pode variar entre versões).
    • 3. Confirme o nome do modelo `llama3.2` em ollama.com/library — nomes de modelos mudam com atualizações.