에이전트 호스팅에서 가장 흔한 실수는 하나에 맞춰 사이징하는 것입니다. 누군가 단일 에이전트를 돌리고, 400 MB를 쓰는 걸 보고, 에이전트는 호스팅이 싸다고 결론짓습니다. 그다음 진짜 크루로 스케일하고, 박스가 새벽 3시에 스왑하기 시작합니다.
에이전트 하나는 정말 쌉니다. 그것은 흥미로운 경우가 아닙니다.
메모리는 실제로 어디로 가는가
모델로 API 호출만 쏘는 에이전트는 가볍습니다 — 대부분 네트워크를 기다립니다. 그런 것 열두 개를 작은 요금제에서 돌려도 알아채지 못할 겁니다.
RAM이 사라지는 것은 에이전트가 상태를 쥘 때입니다. 턴마다 자라는 내역. 여러 에이전트가 읽고 쓰는 작업 세트. 같은 프로세스의 장기 기억용 벡터 스토어. 아키텍처가 "API 호출, 잊기"이길 멈추고 "기억하기, 조율하기, 넘기기"가 되는 순간, 제약은 CPU가 아니라 메모리입니다. CrewAI, LangGraph, AutoGPT 방식 루프는 진지해질수록 모두 이 방향으로 기웁니다. RAM을 먹는 것은 프레임워크가 아니라 상태입니다. 우리는 여기서 숫자를 파고들었습니다.
대략적 사이징
- 가볍고 API 바운드인 에이전트 — Pro가 필요 없음; NAT나 전용 IP 요금제($3~20)로 충분. 이 페이지의 나머지는 건너뛰세요.
- 진짜 크루(5~10개) 에 공유 기억과 유용한 벡터 스토어 — Pro-32(32 GB)가 스위트 스폿. 대부분의 함대가 여기 착지합니다.
- 더 큰 함대, 더 긴 내역, 수백만의 기억 인덱스 — Pro-64(64 GB). 여기서 하나의 박스가 안 그러면 juggle할 세 개의 작은 것을 대체합니다.
- 함대 + 동거 서비스, 또는 에이전트 + 로컬 추론 — Pro-80(80 GB)까지.
필요하다고 생각하는 곳보다 아래에서 시작하고, 하루 htop을 보고, 스왑이 보이면 올리세요. 높게 짐작하는 건 그저 돈 낭비입니다.
왜 이 형태의 호스트인가
자신의 서버를 프로비저닝하거나 관리하는 함대는 사람 없이 몰 수 있는 API를 원하고 — 그리고 점점, 사람 없이 낼 수도 있길. 고메모리, 전용 IP, 암호화폐 결제, KYC 없음, 그리고 전체가 에이전트에 의해 MCP로 주문 가능: 그 조합은 드물고, 그것이 Pro 라인의 목적입니다. 기가바이트당 최저가는 아니고, 에이전트가 가볍다면 정말 필요 없습니다. 하지만 상태를 쥐고 프라이버시를 중시하는 진지한 시스템에는 알맞은 합입니다.
거기에 이르면, **Pro-32**가 진짜 크루를 커버하고; 함대가 자라면서 64나 80 GB로 크기를 올리세요.
댓글
아직 댓글이 없습니다. 첫 번째가 되세요.