Quanto custa
Rodar agente de IA em VPS: quanto custa de verdade (2026)
O aluguel do servidor é metade da conta, e a outra metade é o token que ninguém soma junto.
Preços conferidos em , na página de cada fornecedor.
Quem decide rodar o próprio agente de IA num servidor alugado costuma comparar o preço da máquina com a mensalidade de uma ferramenta pronta e concluir que sai muito mais barato. A conclusão é meio certa, porque a comparação está pela metade: o servidor não pensa, quem pensa é o modelo, e o modelo é cobrado à parte.
A conta inteira tem duas parcelas com comportamentos opostos. O aluguel é fixo e previsível, aparece igual todo mês e some quando a máquina é desligada. O token é variável e não tem teto, então uma semana intensa muda o total sem mudar nada na fatura do servidor.
As duas tabelas abaixo trazem as duas metades, cada uma com a data em que foi lida, e o bloco de soma junta as duas para um cenário declarado. A parcela de token é estimativa e está rotulada como tal, porque quantidade de uso não é preço de ninguém.
Uma terceira parcela não tem preço de tabela e por isso não entra em nenhuma conta desta página: as horas gastas instalando, atualizando e consertando. Elas existem, são reais, e costumam ser a diferença entre um arranjo que dura e um que é abandonado em dois meses.
Preços conferidos em , na página de cada fornecedor.
API: o preço por milhão de tokens
| fornecedor | modelo | entrada, por 1M de tokens | saída, por 1M de tokens | entrada em cache | lido em |
|---|---|---|---|---|---|
| Z.AI | GLM-5.3-Flash | US$ 0,15 | US$ 0,50 | não publica | |
| DeepSeek | deepseek-flash | US$ 0,30 | US$ 1,20 | US$ 0,006 | |
| Moonshot | kimi-k3 | US$ 3,00 | US$ 15,00 | US$ 0,30 | |
| DeepSeek | deepseek-v4-pro | US$ 1,32 | US$ 3,96 | US$ 0,044 | |
| Moonshot | kimi-k2.7-code | US$ 0,95 | US$ 4,00 | US$ 0,19 | |
| Z.AI | GLM-5.3 | US$ 1,40 | US$ 4,40 | não publica |
Quase toda grade de token é publicada em dólar, e esta tabela repete a moeda do fornecedor sem converter nada. O que sai do seu cartão depende da cotação do dia da fatura e do imposto que o banco cobra por cima, que são dois números que esta página não tem como saber.
As ressalvas que o valor sozinho esconde
- Preço de pico. Fora de pico a página publica metade: 0,15 de entrada e 0,60 de saída.
- A página avisa que o valor não inclui imposto, calculado no pagamento.
- Preço de pico. Fora de pico a página publica metade: 0,66 de entrada e 1,98 de saída.
Servidor próprio: o aluguel por mês
| fornecedor | plano | máquina | região | por mês | lido em |
|---|---|---|---|---|---|
| Hetzner | CX43 | 8 vCPU, 16 GB de memória, 160 GB de disco | Alemanha/Finlândia | € 16,49 | |
| Contabo | Cloud VPS 4 | 4 vCPU, 8 GB de memória, 100 GB de disco | global | € 5,50 | |
| Hetzner | CX23 | 2 vCPU, 4 GB de memória, 40 GB de disco | Alemanha/Finlândia | € 5,99 | |
| Contabo | Cloud VPS 6 | 6 vCPU, 12 GB de memória, 200 GB de disco | global | € 7,50 | |
| Hetzner | CX33 | 4 vCPU, 8 GB de memória, 80 GB de disco | Alemanha/Finlândia | € 8,99 | |
| Oracle Cloud | Always Free Arm Ampere A1 | 12 GB de memória | global | US$ 0,00 | |
| Vultr | Regular Performance 2 vCPU 4 GB | 2 vCPU, 4 GB de memória, 80 GB de disco | global | US$ 20,00 | |
| DigitalOcean | Basic 2 vCPU 4 GB | 2 vCPU, 4 GB de memória, 80 GB de disco | global | US$ 24,00 | |
| Akamai (Linode) | Linode 4 GB | 2 vCPU, 4 GB de memória, 80 GB de disco | São Paulo | US$ 33,60 | |
| Vultr | Regular Performance 4 vCPU 8 GB | 4 vCPU, 8 GB de memória, 160 GB de disco | global | US$ 40,00 | |
| DigitalOcean | Basic 4 vCPU 8 GB | 4 vCPU, 8 GB de memória, 160 GB de disco | global | US$ 48,00 | |
| Vultr | Regular Performance 1 vCPU 1 GB | 1 vCPU, 1 GB de memória, 25 GB de disco | global | US$ 5,00 | |
| DigitalOcean | Basic 1 vCPU 1 GB | 1 vCPU, 1 GB de memória, 25 GB de disco | global | US$ 6,00 | |
| Akamai (Linode) | Linode 8 GB | 4 vCPU, 8 GB de memória, 160 GB de disco | São Paulo | US$ 67,20 | |
| Akamai (Linode) | Nanode 1 GB | 1 vCPU, 1 GB de memória, 25 GB de disco | São Paulo | US$ 7,00 |
As ressalvas que o valor sozinho esconde
- Preço sem IPv4 e sem imposto (VAT), como a própria página publica; inclui 20 TB de tráfego, e cada TB extra custa 1 EUR à parte.
- A própria página chama de promoção dos primeiros 24 meses e diz que o imposto já está incluído.
- Promoção dos primeiros 24 meses, com imposto incluído, como a própria página diz.
- O teto publicado é de horas, não de máquina: 1.500 horas de núcleo e 9.000 horas de GB por mês. Passou disso, vira conta paga.
- Grade da região de São Paulo, que é mais cara que a lista global do mesmo fornecedor.
A conta de rodar por conta própria
Servidor mais tokens, por mês estimativa
US$ 31,30 por mês, somando as duas parcelas
- US$ 24,00 de servidor: DigitalOcean, plano Basic 2 vCPU 4 GB, região global. Preço de tabela lido em 18/09/2026.
- US$ 7,30 de tokens: 160 tarefas de código por mês no modelo deepseek-flash, de DeepSeek. Esta parcela é estimativa.
A suposição é uma tarefa de código com agente, que lê vários arquivos do projeto antes de propor a mudança e depois relê o que quebrou, com 120 mil tokens de entrada e 8 mil de saída por tarefa de código. A parcela do servidor é fixa e a de token não é: ela é a única das duas que pode dobrar num mês puxado, e é por isso que as duas aparecem separadas aqui em vez de num número só.
Fora da conta ficam as horas de quem instala, atualiza e conserta a máquina, que não têm preço de tabela em lugar nenhum.
Cada valor é o preço de tabela lido na página do fornecedor no dia indicado, e não o que você paga: promoção, plano antigo e preço herdado fazem a sua fatura ser outra. A grade completa, o histórico de reajuste e a fonte de cada leitura ficam na página de cada serviço.
O veredito
Some as duas parcelas antes de decidir, porque só o aluguel engana. O arranjo compensa para quem precisa de um agente de plantão ou de trabalho em lote, e compensa menos para quem quer uma ferramenta pronta funcionando bem em horário comercial.
Perguntas
Dá para rodar o modelo na própria VPS e não pagar token?
Dá com modelos pequenos, mas uma máquina barata de CPU não sustenta os modelos grandes, e alugar placa de vídeo custa bem mais que a chave de API equivalente.
Qual tamanho de servidor esse tipo de agente pede?
Quando o modelo roda por API, o servidor só coordena e escreve arquivos, então memória importa mais que processador. A tabela acima mostra o que cada fornecedor entrega por faixa de preço.
Quanto disto já está na sua fatura?
O lensub junta o que você assina em todos os cartões numa lista só, mostra o que está sendo pago duas vezes e avisa por e-mail antes de cada cobrança.
Grátis até cinco assinaturas, sem cartão.