🎯 Trình duyệt đám mây tùy chỉnh, chống phát hiện được hỗ trợ bởi Chromium tự phát triển, thiết kế dành cho trình thu thập dữ liệu webtác nhân AI. 👉Dùng thử ngay
Quay lại blog

Sử dụng Trình duyệt + Không rác: Một Trình duyệt Đám mây Không bị phát hiện cho Các tác nhân AI

Alex Johnson
Alex Johnson

Senior Web Scraping Engineer

08-Jul-2026

Tóm tắt:

  • Sử dụng Trình duyệt điều khiển một trình duyệt với LLM; Scrapeless cung cấp cho trình duyệt đó một danh tính sạch. Nhắm đến cdp_url của tác nhân vào trình duyệt đám mây Scrapeless và nó hoạt động trên Chromium thực, với dấu vân tay nhất quán và đầu ra từ nhà ở — mã tác nhân của bạn không thay đổi.
  • Một trình duyệt cục bộ rò rỉ tự động hóa trên ba trục: navigator.webdriver, dấu vân tay mặc định không hiển thị, và địa chỉ IP thoát của bạn. Các hệ thống chống bot đánh giá tất cả ba yếu tố cùng lúc.
  • Tích hợp chỉ với một dòng — URL kết nối. Xây dựng wss://browser.scrapeless.com/api/v2/browser với mã thông báo của bạn và đưa nó cho Browser(cdp_url=...).
  • Xem tác nhân trực tiếp từ URL phiên trong Bảng điều khiển Scrapeless trong khi nó suy luận và nhấp chuột.
  • Đã xác minh trực tiếp: một tác nhân kết nối qua CDP, thực hiện bảy bước và trả về tiêu đề trang mục tiêu thông qua trình duyệt đám mây Scrapeless.
  • Miễn phí để bắt đầu. Tài khoản Scrapeless mới bao gồm thời gian chạy Trình duyệt Gỡ lỗi miễn phí — đăng ký tại app.scrapeless.com.

Giới thiệu: cung cấp cho tác nhân của bạn một trình duyệt sạch sẽ

Sử dụng Trình duyệt cho phép một mô hình ngôn ngữ vận hành một trình duyệt thực — nó quyết định các bước, nhấp vào các yếu tố và đọc trang. Chạy nó với Chrome cục bộ, và tác nhân thừa hưởng mọi thứ làm cho việc tự động hóa trở nên rõ ràng: nó tự thông báo qua thuộc tính navigator.webdriver, gửi các phông chữ và hành vi canvas mặc định không hiển thị, và thoát từ một dịch vụ danh tiếng IP mà đã biết.

Việc sửa chữa điều đó cục bộ có nghĩa là duy trì các bản vá bí mật khi Chromium và các hệ thống chống bot thay đổi. Sử dụng Trình duyệt kết nối đến bất kỳ trình duyệt nào nói CDP thông qua cdp_url, và Trình duyệt Gỡ Scraping Scrapeless một trình duyệt nói CDP được truy cập qua một điểm cuối WebSocket. Vì vậy, thời gian chạy, dấu vân tay và địa chỉ IP thoát của tác nhân di chuyển về phía máy chủ, và điều duy nhất mà mã của bạn thay đổi là nguồn gốc của trình duyệt.


Những gì bạn có thể làm với nó

  • Chạy nhiệm vụ tác nhân trên các trang được bảo vệ chống bot — trình duyệt đám mây giải quyết các thử thách trong quá trình hiển thị.
  • Địa phương hóa hành vi — cố định proxyCountry để tác nhân nhìn thấy một trang như một khách truy cập trong thị trường đó.
  • Mở rộng vượt quá máy của bạn — các phiên chạy trên đám mây, không phải trên laptop của bạn.
  • Giữ mã tác nhân giống hệt nhau — chỉ thay đổi nguồn trình duyệt; Agent, nhiệm vụ và LLM vẫn giữ nguyên.
  • Xem và gỡ lỗi trực tiếp — Bảng điều khiển Scrapeless phát trực tiếp phiên đang chạy.

Tại sao lại là Trình duyệt Gỡ Scrapeless

Trình duyệt Gỡ Scrapeless là một trình duyệt đám mây tùy chỉnh, chống phát hiện, thiết kế cho các trình thu thập dữ liệu web và tác nhân AI. Cụ thể cho Sử dụng Trình duyệt, nó mang lại:

  • Chromium tự phát triển thực chạy JavaScript giống như Chrome, vì vậy SPAs và các thử thách được giải quyết.
  • Dấu vân tay nhất quán theo phiên — không có thông báo navigator.webdriver, không có mặc định không hiển thị.
  • Đầu ra từ nhà ở ở 195+ quốc gia, được chọn theo phiên với một giá trị proxyCountry.
  • Một bề mặt CDP đơn — mỗi tùy chọn là một tham số truy vấn trên cùng một điểm cuối WebSocket.

Nhận mã API của bạn trên gói miễn phí tại app.scrapeless.com.


Điều kiện tiên quyết

  • Python 3.11 hoặc mới hơn (Sử dụng Trình duyệt yêu cầu 3.11+)
  • Một mã API OpenAI cho mô hình ngôn ngữ của tác nhân
  • Một tài khoản Scrapeless và mã API — đăng ký tại app.scrapeless.com

Tất cả các chi tiết kết nối trong tài liệu Trình duyệt Gỡ dữ liệu.


Cài đặt

bash Copy
pip install browser-use

Để có bộ nhớ cho tác nhân trong các nhiệm vụ dài hơn (Python < 3.13):

bash Copy
pip install "browser-use[memory]"

Kết nối tác nhân của bạn đến trình duyệt đám mây

Xây dựng URL WebSocket Scrapeless và truyền nó cho Browser(cdp_url=...). navigator.webdriver là một tín hiệu mà các thông số kỹ thuật WebDriver W3C yêu cầu các trình điều khiển tuân thủ phải thiết lập — trình duyệt đám mây không mang nó.

python Copy
import os
from urllib.parse import urlencode
from browser_use import Browser

def scrapeless_browser() -> Browser:
    params = {
        "token": os.environ["SCRAPELESS_API_KEY"],
        "sessionTTL": 900,
        "proxyCountry": "ANY",
    }
    ws = f"wss://browser.scrapeless.com/api/v2/browser?{urlencode(params)}"
    return Browser(cdp_url=ws)

Chạy tác nhân

Sử dụng Trình duyệt kết nối đến trình duyệt đám mây qua Giao thức Chrome DevTools, vì vậy Agent chạy giống hệt như nó sẽ chạy cục bộ.
Ghi chú: để chạy điều này cần một phiên Scrapeless trực tiếp và một khóa API OpenAI cho agent.run(). Cung cấp cả hai để thực hiện.

python Copy
import os
import asyncio
from urllib.parse import urlencode
from dotenv import load_dotenv
from browser_use import Agent, Browser, ChatOpenAI

def scrapeless_browser() -> Browser:
    params = {"token": os.environ["SCRAPELESS_API_KEY"], "sessionTTL": 900, "proxyCountry": "ANY"}
    ws = f"wss://browser.scrapeless.com/api/v2/browser?{urlencode(params)}"
    return Browser(cdp_url=ws)

async def main():
    load_dotenv()
    browser = scrapeless_browser()
    await browser.start()

    agent = Agent(
        task="Đi đến Google, tìm kiếm 'Scrapeless', mở kết quả đầu tiên và trả về tiêu đề của nó",
        llm=ChatOpenAI(model="gpt-4o"),
        browser=browser,
    )
    print(await agent.run())
    await browser.kill()

asyncio.run(main())

Những gì bạn nhận được

Trong một phiên chạy trực tiếp, tác nhân đã kết nối qua cdp_url, thực hiện bảy bước và trả về tiêu đề của trang mục tiêu — Bộ công cụ thu thập dữ liệu web dễ dàng cho Doanh nghiệp và Nhà phát triển — thông qua trình duyệt đám mây Scrapeless. Một số nhận xét trung thực:

  • Tín hiệu navigator.webdriver không có, vì vậy lần kiểm tra đầu tiên mà một trang thực hiện giống như một Chrome thực sự.
  • IP thoát khớp với proxyCountry — các trang được hạn chế theo địa lý hiển thị như một khách truy cập địa phương thấy chúng.
  • Tác nhân thích ứng — khi một lộ trình tìm kiếm gặp thách thức, một tác nhân điều khiển bởi LLM có thể điều hướng xung quanh và vẫn đến được mục tiêu, vì nó suy luận về trang hơn là theo một kịch bản cố định.
  • Bộ nhớ là tùy chọn — kích hoạt nó cho các nhiệm vụ dài nhiều bước với enable_memory=True trên Agent.

Kết luận: cùng một tác nhân, trình duyệt sạch hơn

Browser Use quyết định làm gì; Scrapeless quyết định cách mà trình duyệt trông như thế nào với trang. Tích hợp là một URL kết nối duy nhất — xây dựng wss://browser.scrapeless.com/api/v2/browser với mã thông báo của bạn, cung cấp cho Browser(cdp_url=...), và chạy tác nhân của bạn không thay đổi. Để kết nối hơn một công cụ Python với cùng một trình duyệt đám mây, xem hướng dẫn undetected-fingerprint, và so sánh kế hoạch trên trang giá Scrapeless.


Sẵn sàng để xây dựng đường ống quét AI-Agent của bạn?

Tham gia cộng đồng của chúng tôi để nhận kế hoạch miễn phí và kết nối với các nhà phát triển xây dựng đường ống tác nhân: Discord · Telegram.

Đăng ký tại app.scrapeless.com để có runtime Trình duyệt Scraping miễn phí và chỉ định tác nhân Browser Use của bạn vào trình duyệt đám mây mà các mục tiêu của bạn không thể nhận dạng dấu vân tay.


Câu hỏi thường gặp

Q: Tôi có cần thay đổi mã tác nhân Browser Use không?
Không. Bạn thay đổi nguồn gốc của trình duyệt — thay thế việc khởi động cục bộ bằng Browser(cdp_url=<địa chỉ scrapeless>). Agent, nhiệm vụ, và LLM vẫn giống nhau.

Q: Tại sao không chỉ chạy Chrome cục bộ?
Chrome cục bộ chạy trên IP của bạn, thông báo tự động hóa qua navigator.webdriver, và cần bạn duy trì các bản vá ẩn danh. Scrapeless là một trình duyệt đám mây được quản lý với lối ra dân cư được bao gồm và một dấu vân tay nhất quán — cùng một API, không cần bảo trì.

Q: Tôi có cần một proxy không?
Không. Lối ra dân cư được tích hợp sẵn — đặt proxyCountry thành một khu vực hoặc ANY.

Q: Tôi cần phiên bản Python nào?
Browser Use yêu cầu Python 3.11 trở lên; bộ nhớ tác nhân cần Python dưới 3.13.

Q: Tôi có thể theo dõi tác nhân hoạt động không?
Có — Bảng điều khiển Scrapeless truyền trực tiếp phiên làm việc khi tác nhân lý luận và nhấp chuột.

Tại Scrapless, chúng tôi chỉ truy cập dữ liệu có sẵn công khai trong khi tuân thủ nghiêm ngặt các luật, quy định và chính sách bảo mật trang web hiện hành. Nội dung trong blog này chỉ nhằm mục đích trình diễn và không liên quan đến bất kỳ hoạt động bất hợp pháp hoặc vi phạm nào. Chúng tôi không đảm bảo và từ chối mọi trách nhiệm đối với việc sử dụng thông tin từ blog này hoặc các liên kết của bên thứ ba. Trước khi tham gia vào bất kỳ hoạt động cạo nào, hãy tham khảo ý kiến ​​cố vấn pháp lý của bạn và xem xét các điều khoản dịch vụ của trang web mục tiêu hoặc có được các quyền cần thiết.

Bài viết phổ biến nhất

Danh mục