Một web scraper theo các chỉ dẫn bạn viết. Một browser agent tự quyết định: nó nhìn trang đã render, suy luận bước tiếp theo, và click, gõ và cuộn một trình duyệt thật để đạt điều đó. Các công cụ như browser-use, Skyvern và computer-use của Anthropic biến một LLM thành thứ điều khiển một trình duyệt như một con người — điền biểu mẫu, đi qua các luồng, đọc kết quả, phục hồi khi bố cục dịch chuyển.
Điều đó chỉ hoạt động nếu trình duyệt chạy liên tục. Trên laptop của bạn nó dừng khoảnh khắc bạn đóng nắp. Trang này về việc đặt một browser agent lên một máy chủ, chọn kích cỡ đúng, để nó hoạt động suốt ngày đêm.
Scraper so với agent — chọn đúng công cụ
Hãy trung thực về cái bạn đang xây, vì mỗi cái muốn thứ khác nhau:
- Một scraper (httpx, Scrapy) lấy các URL đã biết và rút các trường cố định. Tất định, nhẹ, rẻ. Nếu đó là nhiệm vụ của bạn, trang đúng là hướng dẫn web scraping — đừng trả cho một trình duyệt bạn không cần.
- Một browser agent render trang trong một Chromium thật và để LLM quyết định mỗi hành động. Nó xử lý các trang mà scraper không thể — ứng dụng động, bố cục khó lường, luồng nhiều bước — với cái giá là một cỗ máy nặng hơn và các cuộc gọi mô hình mỗi bước.
Trang này về cái thứ hai.
Cỗ máy thực sự cần gì
Bản thân vòng lặp agent tí hon; cái ngốn tài nguyên là trình duyệt headless.
- RAM là ràng buộc. Một Chromium headless ~300-500 MB, và mỗi tab hoặc context thêm cộng 100-200 MB, cộng runtime của bạn. Một agent điều khiển một trình duyệt thoải mái trên Small ($8/tháng — 4 vCPU, 4 GB). Chạy vài context trình duyệt cùng lúc đẩy bạn tới Medium ($12).
- Không GPU. Mô hình chạy ở nhà cung cấp của bạn (Anthropic/OpenAI); máy chủ làm điều phối và render. Đó là CPU và RAM.
- NAT là đủ. Agent chỉ tạo các cuộc gọi đi ra — tới các trang nó điều khiển và API mô hình. IP riêng chỉ cho các dịch vụ đến.
Thiết lập
# Ubuntu 24.04
apt update && apt install -y python3-venv git
python3 -m venv ~/agent && source ~/agent/bin/activate
# browser-use + một Chromium cho Playwright
pip install browser-use
playwright install --with-deps chromium
Một vòng lặp tối thiểu đọc khóa mô hình từ môi trường, không bao giờ hard-code:
# run.py
import os, asyncio
from browser_use import Agent
from browser_use.llm import ChatAnthropic
async def main():
agent = Agent(
task="Open the status page and report which services are down.",
llm=ChatAnthropic(model="claude-sonnet-4-5", api_key=os.environ["ANTHROPIC_API_KEY"]),
)
await agent.run()
asyncio.run(main())
Giữ nó sống qua các lần sập và khởi động lại với một dịch vụ systemd — cùng mẫu giữ bất kỳ agent nào chạy 24/7, với Restart=always và khóa mô hình trong một EnvironmentFile, không phải trong unit.
Canh RAM. Một browser agent không bao giờ đóng tab sẽ dần ngốn cỗ máy — đóng các trang và context khi một nhiệm vụ kết thúc và giới hạn đồng thời. Một Chromium rò rỉ là nguyên nhân phổ biến nhất khiến các agent kiểu này ngã.
Phần thực sự của chúng tôi: agent có thể tự thuê cỗ máy của nó
Đây là chỗ EQVPS khác một host thông thường. Qua máy chủ MCP của chúng tôi một agent có thể đăng ký, nạp một số dư crypto và order_vps — tự đặt một cỗ máy mới, không con người ở trang thanh toán. Nên một browser agent cần một môi trường sạch cho một lần chạy có thể tự cấp phát máy chủ, điều khiển trình duyệt, và phá nó khi xong — tất cả từ một số dư trả trước.
Ghép điều đó với thanh toán crypto không KYC và cả vòng lặp ở lại ngoài mọi dấu vết danh tính: email để đăng ký, USDC hoặc USDT để thanh toán, root trong khoảng một phút.
Những giới hạn trung thực
- Chỉ CPU, một khu vực (Đức). Ổn cho điều khiển một trình duyệt và gọi một API; nếu bạn cần một GPU hoặc một địa lý cụ thể, biết điều đó trước.
- Chi phí mô hình riêng. Mỗi bước là một cuộc gọi mô hình; hóa đơn API của một agent nhiều lời thường làm lu mờ máy chủ $8. Cỗ máy là phần rẻ.
- Tôn trọng nơi bạn hướng nó. Một browser agent có thể đăng nhập, gửi và mua. Chỉ hướng nó tới các trang bạn có quyền điều khiển; lạm dụng, gian lận và từ chối dịch vụ vi phạm chính sách sử dụng hợp lý.
Trong đó, một browser agent trên máy chủ luôn-bật của riêng nó là một mẫu thực sự hữu ích — nó hoạt động trong khi bạn ngủ. Chọn một gói, thanh toán bằng crypto, và chạy một cái trong một phút. Nếu nhiệm vụ của bạn là trích xuất cố định thay vì suy luận, hướng dẫn web scraping là con đường rẻ hơn, đơn giản hơn.
Bình luận
Chưa có bình luận nào. Hãy là người đầu tiên.