−25%

Windows 연간 결제, 10월 31일까지. 요금제 보기

EQVPS

Open WebUI용 VPS: LLM을 위한 프라이빗 채팅 화면

Open WebUI를 VPS에 호스팅해 OpenAI 호환 API나 로컬 Ollama 모델을 위한 프라이빗 채팅 화면으로 쓰세요. Docker 설치, 안전한 접속, 사양 선택까지.

모델 제공사를 세 군데 쓰고 있고, 곳마다 채팅 창, 구독, 기록이 따로 있습니다. Open WebUI는 이들을 내가 호스팅하는 하나의 화면 뒤로 모아 줍니다. 대화마다 모델을 고르고, 기록은 전부 내 서버에 두고, 팀과 공유하고, 아무것도 밖으로 나가면 안 될 때는 로컬 모델을 연결하면 됩니다.

두 가지 사용 방식

API의 프런트엔드로. Open WebUI는 OpenAI 호환 API라면 무엇이든 연결됩니다. 호스팅형 제공사, LiteLLM 프록시, 자체 엔드포인트 등. 서버는 거의 일을 하지 않으니 작은 요금제로 넉넉합니다.

로컬 모델과 함께. 같은 서버에 Ollama를 올리고 오픈 웨이트 모델을 로컬에서 돌립니다. 이제 메모리가 제약이 되고, CPU 추론은 느립니다. 솔직한 맞교환은 완전한 프라이버시와 무난한 속도입니다.

구성요금제
API 프런트엔드, 개인용Micro — 1 vCPU, 2 GB, 월 $5 (SSH 터널)
API 프런트엔드, 팀이 HTTPS로 접속Micro-IP — 1 vCPU, 2 GB, 월 $10
Ollama로 로컬 3B 모델AI-Agent — 2 vCPU, 4 GB, 월 $10
로컬 7~8B 모델Medium — 4 vCPU, 6 GB, 월 $12, 더 큰 모델은 Pro 요금제

Docker로 설치하기

Docker가 설치된 서버에서:

docker run -d --name open-webui --restart always \
  -p 127.0.0.1:3000:8080 \
  -v open-webui:/app/backend/data \
  ghcr.io/open-webui/open-webui:main

127.0.0.1에 바인딩하면 공개 방식을 정할 때까지 공용 인터넷에서 보이지 않습니다. 채팅, 사용자, 설정은 open-webui 볼륨에 저장됩니다.

안전하게 접속하기

SSH 터널 — NAT를 포함한 모든 요금제에서 됩니다.

ssh -p 22 -N -L 3000:127.0.0.1:3000 you@203.0.113.10

http://localhost:3000을 여세요. NAT 요금제라면 개인 SSH 포트를 쓰세요.

내 도메인에서 HTTPS — 전용 IP 요금제에서 팀이 쓰는 경우. 서브도메인을 서버로 연결하고(가이드), WebSocket 헤더까지 포함해 nginx로 프록시합니다.

location / {
    proxy_pass http://127.0.0.1:3000;
    proxy_set_header Host $host;
    proxy_set_header Upgrade $http_upgrade;
    proxy_set_header Connection upgrade;
    proxy_read_timeout 300s;
}

그다음 certbot --nginx -d chat.example.com을 실행하세요. 읽기 타임아웃을 길게 잡는 데는 이유가 있습니다. 느린 모델은 답을 몇 분씩 스트리밍합니다.

들어가서 처음 할 일

  1. 바로 가입하세요. 첫 계정이 관리자가 됩니다. 막 설치한 상태로 공개해 두지 마세요. 다른 사람이 가로챌 수 있습니다.
  2. 가입을 닫으세요. 관리자 설정 → 신규 사용자의 기본 역할을 승인 대기로 두거나, 가입을 끄세요.
  3. 연결을 추가하세요. 설정 → 연결 → API 기본 URL과 키를 붙여 넣으세요. 해당 제공사의 모델이 모델 선택기에 나타납니다.

로컬 모델 추가하기

호스트에 Ollama를 설치하고(가이드), 작은 모델을 받은 뒤, Open WebUI가 거기에 닿도록 실행합니다.

ollama pull llama3.2:3b
docker rm -f open-webui
docker run -d --name open-webui --restart always \
  -p 127.0.0.1:3000:8080 --add-host=host.docker.internal:host-gateway \
  -e OLLAMA_BASE_URL=http://host.docker.internal:11434 \
  -v open-webui:/app/backend/data ghcr.io/open-webui/open-webui:main

볼륨 덕분에 재시작해도 채팅은 남습니다. CPU에서는 초당 몇 토큰 정도로 생각하세요. 요약이나 개인 메모에는 괜찮지만 긴 글에는 느립니다. 더 무거운 로컬 추론은 Ollama용 VPS를 보세요.

알아 둘 것

요금제 한도와 업그레이드는 요금제 문서에 있습니다.

배포할 준비가 되셨나요? 암호화폐로 결제, KYC 없음 — 약 1분 만에 온라인.

지금 배포 →

FAQ

Open WebUI에는 메모리가 얼마나 필요한가요?

Open WebUI 자체는 1 GB 정도로 돌아갑니다. 원격 API와만 대화한다면 2 GB 요금제로 충분합니다. 메모리를 먹는 건 Ollama를 통한 로컬 모델로, 3B 소형 모델은 4 GB, 7~8B 모델은 6 GB 이상이 필요합니다.

GPU 없는 VPS에서 로컬 모델을 돌릴 수 있나요?

네, 기대치를 현실적으로 잡는다면요. 양자화된 소형 모델은 CPU에서 초당 몇 토큰 속도로 답합니다. 짧은 작업과 개인 실험에는 괜찮지만, 긴 답을 빠르게 주고받는 채팅에는 맞지 않습니다.

NAT 요금제에서도 쓸 수 있나요?

네, 개인 SSH 포트를 통한 SSH 터널로 쓰면 됩니다. 팀이 브라우저로 여는 공개 HTTPS 주소가 필요하다면 전용 IP 요금제가 필요합니다.

계정은 누가 만들 수 있나요?

처음 가입한 계정이 관리자가 됩니다. 그다음 관리자 설정에서 신규 가입을 승인 대기로 두거나 꺼 두세요. 그러지 않으면 URL을 알아낸 누구나 계정을 만들 수 있습니다.

대화는 어디에 저장되나요?

서버의 Docker 볼륨에 저장됩니다. 연결한 모델 API로 보내는 프롬프트를 빼면 제3자에게 가는 것은 없습니다.

댓글

아직 댓글이 없습니다. 첫 번째가 되세요.

댓글 남기기

댓글은 표시되기 전에 검토됩니다.