−25%

no Windows com pagamento anual, até 31/10. Ver planos

EQVPS
Começar

Sandbox para agentes de IA: rode código não confiável numa microVM que sobe em um segundo

Seu agente escreve código que nunca foi executado. Uma sandbox em Firecracker microVM dá a esse código uma máquina Linux descartável, sem acesso ao seu servidor, às suas chaves ou à sua rede — inicia em cerca de um segundo, cobrança por segundo.

Todo agente que escreve código uma hora precisa executá-lo. É para isso que ele existe — e essa também é a parte desconfortável. O modelo acabou de gerar um script que nunca rodou: ele instala pacotes que ninguém revisou e mexe em arquivos que ninguém listou. Rodar isso ao lado das suas chaves SSH e do .env de produção é uma aposta que você faz muitas vezes por dia.

Uma sandbox deixa essa aposta barata. O código ganha a própria máquina Linux por alguns segundos ou minutos, e depois a máquina some.

O que o agente recebe

Cada sandbox é uma Firecracker microVM: kernel próprio, sistema de arquivos próprio, namespace de rede próprio. Não é um contêiner dividindo o seu kernel, nem uma pasta no seu servidor. Ela sobe em cerca de um segundo, o que faz diferença quando o agente cria uma por tarefa, e não uma por dia.

Lá dentro tem Python 3.12 com pip, Node.js 22 com npm, bash, git e curl. A internet de saída funciona — o agente pode rodar pip install pandas ou clonar um repositório. A de entrada, não: nenhuma porta aberta, nada de SSH. Comandos, arquivos e saídas passam pela nossa API, e essa é a única porta.

Três formas de acesso:

  • MCP — se o seu agente vive no Claude, Cursor, Cline ou em qualquer cliente compatível com MCP, ele recebe as ferramentas de sandbox ao lado das de VPS. Nenhum código do seu lado.
  • SDK de Python ou TypeScript — pip install eqvps ou npm i @eqvps/sdk, depois criar, executar, apagar.
  • REST puro — documentado na documentação de sandboxes e na especificação OpenAPI.

Um loop mínimo em Python:

from eqvps import Sandbox

with Sandbox.create(tariff="small") as sb:
    sb.upload("/root/task.py", agent_generated_code)
    result = sb.exec("python3 /root/task.py", timeout=55)
    print(result.exit_code, result.stdout[-2000:])
# the sandbox is deleted here, also if anything above raised

Um código de saída diferente de zero volta como resultado normal, não como exceção. É exatamente o que você quer quando o agente precisa ler o traceback e tentar de novo.

Os casos perigosos e o que acontece com eles

Um pacote hostil ou só quebrado. Ele roda numa VM que não guarda nada seu. Apagou a sandbox, acabou.

Segredos. Não coloque suas chaves de API principais no código que o agente escreve. Se uma tarefa realmente precisa de uma, passe como variável de ambiente da sandbox: os valores ficam criptografados, nunca vão para logs, e a API devolve só os nomes.

Loops infinitos. Cada comando para em 55 segundos, a menos que você o tenha iniciado em segundo plano. Uma sandbox efêmera ociosa se apaga sozinha depois do tempo limite de inatividade (5 minutos por padrão). Um limite de gasto diário ou mensal impede novas sandboxes quando o agente já gastou o bastante no dia.

Vazamento de dados. Aqui é preciso ser direto: a internet de saída está aberta, porque sem ela pip install não funciona. A sandbox protege a sua máquina; ela não impede o código de mandar para a internet tudo o que consegue ler dentro da sandbox. A regra é simples: só coloque lá dentro o que você aceita perder.

Escolhendo o plano

PlanovCPU / RAMPor horaBom para
micro0.25 / 512 MB$0.0165scripts avulsos, checagens de dados
small0.5 / 1 GB$0.033a maior parte do código de agente, pip install
standard1 / 2 GB$0.066pandas, suítes de testes
plus2 / 4 GB$0.132instalações pesadas (torch), builds

A cobrança é por segundo, com mínimo de 60 segundos, do mesmo saldo pré-pago dos nossos VPS. Uma tarefa típica de agente — criar, instalar dois pacotes, executar, apagar — fica abaixo de um minuto no small, então é cobrado o mínimo de 60 segundos: cerca de $0.0006. Sinceramente, para um agente que roda código algumas centenas de vezes por dia, a conta das sandboxes é a menor linha do orçamento; os tokens do LLM custam muito mais.

Quando a sandbox não é a ferramenta certa

Se o agente precisa servir algo — um app web, um receptor de webhooks, um bot que escuta mensagens —, a sandbox não serve, porque nada a alcança de fora. O mesmo vale para um serviço que deve rodar por meses. Isso é trabalho para um VPS: veja VPS para agentes de IA. Uma divisão comum: o agente mora num VPS pequeno e cria uma sandbox para cada pedaço de código que ainda não viu.

O outro limite é processamento pesado e contínuo. Uma sandbox com a CPU no máximo por mais de 15 minutos é tratada como abuso, então cálculos longos ficam melhor num servidor alugado por mês.

Por onde começar

Crie uma conta, pegue um token e rode a primeira sandbox — o guia de conexão mostra cada passo, e contas novas recebem $1 de tempo de sandbox para testar. Depois aponte o agente para a página de sandboxes ou para as ferramentas MCP, e deixe-o quebrar coisas onde quebrar é de graça.

Passo a passo: sua primeira tarefa de agente numa sandbox. Relacionados: testes de CI isolados, avaliação de LLMs e revisão de código e checagem de PRs.

Pronto para implantar? Pague com cripto, sem KYC — online em cerca de um minuto.

Implantar agora →

FAQ

Por que não rodar o código do agente no meu próprio servidor?

Porque o agente também não sabe o que esse código faz. Um pacote do pip com script de instalação hostil, um loop que enche o disco, um comando que lê ~/.ssh — na sua máquina, cada um deles alcança suas chaves e seus dados. Numa sandbox, o pior caso é uma sandbox quebrada que você apaga.

O que há dentro de uma sandbox?

Linux com Python 3.12 e pip, Node.js 22 e npm, bash, git e curl. A internet de saída funciona, então pip install, npm install e git clone vão bem. Não há portas de entrada nem SSH — comandos e arquivos passam pela API, pelo SDK ou pelo MCP.

Quanto tempo um comando pode rodar?

Até 55 segundos por chamada. Qualquer coisa mais longa — um script de treino, uma suíte de testes grande — começa como tarefa em segundo plano, e você consulta a saída. A tarefa pode rodar enquanto a sandbox viver (até 24 horas numa efêmera).

Quanto custa?

Você paga a vCPU e a RAM do plano, por segundo, com mínimo de 60 segundos. O menor plano (micro) custa $0.0165 por hora; o small, que dá conta da maior parte do código de agente, $0.033. Sai do mesmo saldo pré-pago dos VPS, e contas novas recebem $1 de tempo de sandbox para testar.

O agente pode criar sandboxes sozinho?

Sim. Pelo MCP, o agente recebe as ferramentas de sandbox diretamente; pelo código, são três linhas com o SDK de Python ou TypeScript. Você pode limitar o gasto por dia ou por mês, para que um agente preso num loop não esgote o saldo.

Comentários

Nenhum comentário ainda. Seja o primeiro.

Deixe um comentário

Os comentários são moderados antes de aparecerem.