Todo agente que escreve código uma hora precisa executá-lo. É para isso que ele existe — e essa também é a parte desconfortável. O modelo acabou de gerar um script que nunca rodou: ele instala pacotes que ninguém revisou e mexe em arquivos que ninguém listou. Rodar isso ao lado das suas chaves SSH e do .env de produção é uma aposta que você faz muitas vezes por dia.
Uma sandbox deixa essa aposta barata. O código ganha a própria máquina Linux por alguns segundos ou minutos, e depois a máquina some.
O que o agente recebe
Cada sandbox é uma Firecracker microVM: kernel próprio, sistema de arquivos próprio, namespace de rede próprio. Não é um contêiner dividindo o seu kernel, nem uma pasta no seu servidor. Ela sobe em cerca de um segundo, o que faz diferença quando o agente cria uma por tarefa, e não uma por dia.
Lá dentro tem Python 3.12 com pip, Node.js 22 com npm, bash, git e curl. A internet de saída funciona — o agente pode rodar pip install pandas ou clonar um repositório. A de entrada, não: nenhuma porta aberta, nada de SSH. Comandos, arquivos e saídas passam pela nossa API, e essa é a única porta.
Três formas de acesso:
- MCP — se o seu agente vive no Claude, Cursor, Cline ou em qualquer cliente compatível com MCP, ele recebe as ferramentas de sandbox ao lado das de VPS. Nenhum código do seu lado.
- SDK de Python ou TypeScript —
pip install eqvpsounpm i @eqvps/sdk, depois criar, executar, apagar. - REST puro — documentado na documentação de sandboxes e na especificação OpenAPI.
Um loop mínimo em Python:
from eqvps import Sandbox
with Sandbox.create(tariff="small") as sb:
sb.upload("/root/task.py", agent_generated_code)
result = sb.exec("python3 /root/task.py", timeout=55)
print(result.exit_code, result.stdout[-2000:])
# the sandbox is deleted here, also if anything above raised
Um código de saída diferente de zero volta como resultado normal, não como exceção. É exatamente o que você quer quando o agente precisa ler o traceback e tentar de novo.
Os casos perigosos e o que acontece com eles
Um pacote hostil ou só quebrado. Ele roda numa VM que não guarda nada seu. Apagou a sandbox, acabou.
Segredos. Não coloque suas chaves de API principais no código que o agente escreve. Se uma tarefa realmente precisa de uma, passe como variável de ambiente da sandbox: os valores ficam criptografados, nunca vão para logs, e a API devolve só os nomes.
Loops infinitos. Cada comando para em 55 segundos, a menos que você o tenha iniciado em segundo plano. Uma sandbox efêmera ociosa se apaga sozinha depois do tempo limite de inatividade (5 minutos por padrão). Um limite de gasto diário ou mensal impede novas sandboxes quando o agente já gastou o bastante no dia.
Vazamento de dados. Aqui é preciso ser direto: a internet de saída está aberta, porque sem ela pip install não funciona. A sandbox protege a sua máquina; ela não impede o código de mandar para a internet tudo o que consegue ler dentro da sandbox. A regra é simples: só coloque lá dentro o que você aceita perder.
Escolhendo o plano
| Plano | vCPU / RAM | Por hora | Bom para |
|---|---|---|---|
| micro | 0.25 / 512 MB | $0.0165 | scripts avulsos, checagens de dados |
| small | 0.5 / 1 GB | $0.033 | a maior parte do código de agente, pip install |
| standard | 1 / 2 GB | $0.066 | pandas, suítes de testes |
| plus | 2 / 4 GB | $0.132 | instalações pesadas (torch), builds |
A cobrança é por segundo, com mínimo de 60 segundos, do mesmo saldo pré-pago dos nossos VPS. Uma tarefa típica de agente — criar, instalar dois pacotes, executar, apagar — fica abaixo de um minuto no small, então é cobrado o mínimo de 60 segundos: cerca de $0.0006. Sinceramente, para um agente que roda código algumas centenas de vezes por dia, a conta das sandboxes é a menor linha do orçamento; os tokens do LLM custam muito mais.
Quando a sandbox não é a ferramenta certa
Se o agente precisa servir algo — um app web, um receptor de webhooks, um bot que escuta mensagens —, a sandbox não serve, porque nada a alcança de fora. O mesmo vale para um serviço que deve rodar por meses. Isso é trabalho para um VPS: veja VPS para agentes de IA. Uma divisão comum: o agente mora num VPS pequeno e cria uma sandbox para cada pedaço de código que ainda não viu.
O outro limite é processamento pesado e contínuo. Uma sandbox com a CPU no máximo por mais de 15 minutos é tratada como abuso, então cálculos longos ficam melhor num servidor alugado por mês.
Por onde começar
Crie uma conta, pegue um token e rode a primeira sandbox — o guia de conexão mostra cada passo, e contas novas recebem $1 de tempo de sandbox para testar. Depois aponte o agente para a página de sandboxes ou para as ferramentas MCP, e deixe-o quebrar coisas onde quebrar é de graça.
Passo a passo: sua primeira tarefa de agente numa sandbox. Relacionados: testes de CI isolados, avaliação de LLMs e revisão de código e checagem de PRs.
Comentários
Nenhum comentário ainda. Seja o primeiro.