Correr modelos de IA no seu VPS com o Ollama: quando faz sentido

O Ollama é um programa de código aberto que descarrega modelos de IA abertos e os corre na sua própria máquina, sem enviar o texto a um fornecedor na nuvem. Faz sentido quando a privacidade dos dados ou a previsibilidade do custo pesam mais do que a qualidade máxima. Não faz sentido se o que quer é a melhor resposta possível com o mínimo de trabalho: para isso, uma API na nuvem continua a ser o caminho mais simples.

É um projecto de terceiros, que se instala num VPS com acesso root. A Interweb fornece o servidor; a instalação e a manutenção do Ollama e dos modelos são suas. Os passos de instalação e os modelos disponíveis estão no site oficial do Ollama, que muda com frequência.

Nuvem ou no seu servidor

API na nuvem Ollama no seu VPS
Para onde vai o texto Para o fornecedor do modelo Fica na sua máquina
Custo Por uso, cresce com o consumo O servidor, mais o trabalho de o manter. O gasto por pedido deixa de existir.
Qualidade Acesso aos modelos maiores e mais recentes Limitada aos modelos que a sua máquina aguenta
Velocidade Rápida e constante Depende do processador e da memória. Sem placa gráfica, pode ser lenta.
Manutenção Nenhuma da sua parte Actualizar o programa, os modelos e o sistema

Quando vale a pena

1 Dados que não podem sair. Documentos internos, contratos, listas de clientes. Se a regra da empresa ou a lei o impõe, correr no seu servidor evita enviá-los a terceiros. Veja protecção de dados pessoais.
2 Muito volume, tarefas simples. Classificar mensagens ou resumir textos curtos, todos os dias, a um custo fixo.
3 Experimentar sem gastar por pedido. Para aprender, um modelo pequeno num VPS de ensaio dá-lhe o essencial.
4 Um agente que não deve depender de ninguém. O OpenClaw pode usar modelos locais, mas é aí que se exige a máquina forte. Veja o que é e o que precisa.

O que decide se o seu servidor aguenta

O que manda é o tamanho do modelo. Um modelo maior pede mais memória, e se não couber na memória do servidor não corre, ou corre tão devagar que não serve. Cada modelo indica na sua página os requisitos de memória; leia-os antes de o descarregar. Para ver o que o seu VPS tem, use free -h e nproc. As especificações dos planos estão em VPS, Cloud e Dedicado; confirme aí se algum inclui placa gráfica, porque sem ela os modelos correm no processador.

Não abra o Ollama à internet. Por omissão costuma ouvir apenas na própria máquina; confirme na documentação. Se o expuser sem protecção, qualquer pessoa usa o seu servidor para correr modelos. Veja portas e firewall num VPS.
Um modelo local também inventa. Correr no seu servidor protege os dados, não garante respostas certas. Veja alucinações de IA.
Comece por um modelo pequeno e meça: quanto demora, quanta memória usa, se a qualidade chega para a tarefa. Só suba de tamanho se o resultado o justificar.

Quer um servidor com mais memória para experimentar modelos locais? Compare os planos.

Ver planos de VPS

VEJA TAMBÉM

O que é o OpenClaw e o que precisa para o correr

Um agente de IA precisa de um VPS, não de hospedagem partilhada

Que sistema operativo escolher para o VPS

Planos de VPS

PRODUTO RECOMENDADO

Servidor VPS com acesso root

Recursos só seus, o sistema que escolher, reinstalação quando quiser. desde 456,30 MT/mês (plano de 3 anos, com cupão)

Ver planos
  • 0 Utilizadores acharam útil
Esta resposta foi útil?