O Ollama é um programa de código aberto que descarrega modelos de IA abertos e os corre na sua própria máquina, sem enviar o texto a um fornecedor na nuvem. Faz sentido quando a privacidade dos dados ou a previsibilidade do custo pesam mais do que a qualidade máxima. Não faz sentido se o que quer é a melhor resposta possível com o mínimo de trabalho: para isso, uma API na nuvem continua a ser o caminho mais simples.
É um projecto de terceiros, que se instala num VPS com acesso root. A Interweb fornece o servidor; a instalação e a manutenção do Ollama e dos modelos são suas. Os passos de instalação e os modelos disponíveis estão no site oficial do Ollama, que muda com frequência.
Nuvem ou no seu servidor
|
API na nuvem |
Ollama no seu VPS |
| Para onde vai o texto |
Para o fornecedor do modelo |
Fica na sua máquina |
| Custo |
Por uso, cresce com o consumo |
O servidor, mais o trabalho de o manter. O gasto por pedido deixa de existir. |
| Qualidade |
Acesso aos modelos maiores e mais recentes |
Limitada aos modelos que a sua máquina aguenta |
| Velocidade |
Rápida e constante |
Depende do processador e da memória. Sem placa gráfica, pode ser lenta. |
| Manutenção |
Nenhuma da sua parte |
Actualizar o programa, os modelos e o sistema |
Quando vale a pena
| 1 |
Dados que não podem sair. Documentos internos, contratos, listas de clientes. Se a regra da empresa ou a lei o impõe, correr no seu servidor evita enviá-los a terceiros. Veja protecção de dados pessoais.
|
|
| 2 |
Muito volume, tarefas simples. Classificar mensagens ou resumir textos curtos, todos os dias, a um custo fixo.
|
|
| 3 |
Experimentar sem gastar por pedido. Para aprender, um modelo pequeno num VPS de ensaio dá-lhe o essencial.
|
|
| 4 |
Um agente que não deve depender de ninguém. O OpenClaw pode usar modelos locais, mas é aí que se exige a máquina forte. Veja o que é e o que precisa.
|
|
O que decide se o seu servidor aguenta
O que manda é o tamanho do modelo. Um modelo maior pede mais memória, e se não couber na memória do servidor não corre, ou corre tão devagar que não serve. Cada modelo indica na sua página os requisitos de memória; leia-os antes de o descarregar. Para ver o que o seu VPS tem, use free -h e nproc. As especificações dos planos estão em VPS, Cloud e Dedicado; confirme aí se algum inclui placa gráfica, porque sem ela os modelos correm no processador.
|
Não abra o Ollama à internet. Por omissão costuma ouvir apenas na própria máquina; confirme na documentação. Se o expuser sem protecção, qualquer pessoa usa o seu servidor para correr modelos. Veja portas e firewall num VPS.
|
|
Um modelo local também inventa. Correr no seu servidor protege os dados, não garante respostas certas. Veja alucinações de IA.
|
|
Comece por um modelo pequeno e meça: quanto demora, quanta memória usa, se a qualidade chega para a tarefa. Só suba de tamanho se o resultado o justificar.
|
|
Quer um servidor com mais memória para experimentar modelos locais? Compare os planos.
Ver planos de VPS
|
PRODUTO RECOMENDADO Servidor VPS com acesso root Recursos só seus, o sistema que escolher, reinstalação quando quiser. desde 7.560,00 Kz/mês (plano de 3 anos, com cupão) Ver planos |