Quay lại blog

Đại lý Hermes + MCP không lãng phí: Xây dựng một Trợ lý AI nhận thức web

James Thompson
James Thompson

Scraping and Proxy Management Expert

24-Aug-2026

TL;DR:

  • Đại lý Hermes có thể tải Scrapeless như một máy chủ stdio MCP cục bộ và khám phá các công cụ web của nó khi khởi động.
  • Một thiết lập đã được xác minh đã tiết lộ tám công cụ được chọn cho Hermes trong khi bài kiểm tra kết nối phát hiện hai mươi bốn công cụ trên máy chủ.
  • Danh sách cho phép công cụ giữ cho bề mặt hiển thị của đại lý tập trung vào tìm kiếm, trích xuất và quy trình duyệt được giới hạn.
  • Một cú đúp tay MCP thành công chứng minh khả năng kết nối và phát hiện lược đồ; một khóa Scrapeless hợp lệ vẫn cần thiết cho các cuộc gọi web trực tiếp.

Đại lý Hermes đã biết cách suy luận về các công cụ. Câu hỏi tích hợp hữu ích hơn hẹp: làm thế nào để nó có được chứng cứ web hiện tại mà không chôn vùi tự động hóa trình duyệt, tìm kiếm và logic trích xuất bên trong chính đại lý?

MCP cung cấp ranh giới. Hermes hoạt động như một khách hàng. Scrapeless chạy như một máy chủ công cụ. Mô hình thấy một tập hợp các hoạt động đã được lọc theo kiểu, và thông tin đăng nhập nằm trong môi trường máy chủ thay vì bên trong lời nhắc.

Những gì bạn có thể làm với Đại lý Hermes và Scrapeless MCP

Kết nối hỗ trợ một bộ công việc đại lý có nhận thức về web thực tiễn:

  • tìm kiếm Google và truyền kết quả có cấu trúc trở lại đại lý;
  • trích xuất nội dung trang dưới dạng Markdown cho nghiên cứu hoặc tóm tắt;
  • tạo một phiên duyệt đám mây cho các trang nặng JavaScript;
  • điều hướng, kiểm tra các yếu tố tương tác, nhấp chuột, gõ, và đọc văn bản hiển thị;
  • giữ dấu vết hoạt động web tách biệt với việc diễn giải của mô hình.

Hermes đăng ký các công cụ MCP bên cạnh các công cụ bản địa của nó. Hướng dẫn MCP của nó tài liệu các máy chủ stdio cục bộ và HTTP từ xa, phát hiện tự động và lọc theo máy chủ. Điều đó có nghĩa là không cần plugin Hermes tùy chỉnh cho một máy chủ đã nói chuyện với MCP.

Tại sao sử dụng Máy chủ Scrapeless MCP?

Một lệnh gọi HTTP thông thường hoạt động cho các trang tĩnh. Một đại lý nghiên cứu web trực tiếp sớm gặp các trang phụ thuộc vào JavaScript, các điều khiển tương tác, vị trí hoặc một phiên đã được duy trì. Máy chủ Scrapeless nhóm tìm kiếm, trích xuất, thu thập và các hành động duyệt web phía sau một kết nối MCP duy nhất.

Kho lưu trữ Scrapeless MCP Server chính thức ghi lại cả hai phương thức truyền tải stdio và Streamable HTTP. Hướng dẫn này sử dụng stdio vì nó cung cấp cho Hermes một quy trình con cục bộ với vòng đời rõ ràng và dấu chân cấu hình nhỏ.

Để kết nối trực tiếp trình duyệt qua CDP thay vì MCP, hãy sử dụng hướng dẫn Đại lý Hermes và Trình duyệt Scraping riêng biệt. Hai phương pháp giải quyết các vấn đề tích hợp khác nhau: CDP phơi bày một kết nối trình duyệt; MCP phơi bày các công cụ đã được ghi loại mà Hermes có thể khám phá và lọc.

Điều kiện tiên quyết

Chuẩn bị những điều này trước khi chỉnh sửa cấu hình Hermes:

  • Git, Node.js, và npx trên máy chạy Hermes;
  • Python trong khoảng phiên bản được hỗ trợ bởi bản phát hành Hermes hiện tại;
  • một tài khoản Scrapeless và khóa API;
  • một terminal nơi hermes được giải quyết cho cài đặt mong muốn.

Giữ khóa API ra khỏi Markdown, lịch sử shell và lời nhắc của đại lý. T tài liệu Scrapeless giải thích nơi tạo và quản lý thông tin đăng nhập.

Kết nối Đại lý Hermes với Scrapeless MCP

Cài đặt Hermes với hỗ trợ MCP

Trình cài đặt Hermes tiêu chuẩn đã bao gồm hỗ trợ MCP. Đối với một cài đặt nguồn tách biệt, chuỗi sau đây là hữu ích vì nó gán checkout và môi trường ảo vào một thư mục.

bash Copy
git clone https://github.com/NousResearch/hermes-agent
cd hermes-agent
python3.12 -m venv .venv
./.venv/bin/pip install -e '.[mcp]'
./.venv/bin/hermes --version

Chuỗi này đã được thực hiện trên Đại lý Hermes v0.20.5 với Python 3.12.13. Hướng dẫn cài đặt chính thức vẫn là con đường ưu tiên cho một cài đặt người dùng thông thường vì nó quản lý trình khởi chạy và các phụ thuộc hỗ trợ.

Cấu hình máy chủ stdio

Thêm một mục scrapeless dưới mcp_servers trong config.yaml Hermes đang hoạt động. Thay thế giá trị điều kiện tiên quyết bằng một khóa thực trong môi trường trước khi khởi động Hermes.

yaml Copy
mcp_servers:
  scrapeless:
    command: npx
    args: ["-y", "scrapeless-mcp-server"]
    env:
      SCRAPELESS_KEY: "${SCRAPELESS_KEY}"
    enabled: true
    tools:
      include:
        - google_search
        - scrape_markdown
        - browser_create
        - browser_goto
        - browser_snapshot
        - browser_click
        - browser_get_text
        - browser_close
      resources: false
      prompts: false

Các khóa command, args, env, và tools theo tham chiếu cấu hình MCP Hermes. Danh sách cho phép là có chủ đích. Nó cung cấp cho một trợ lý nghiên cứu tìm kiếm, trích xuất có thể đọc và một chu trình duyệt được giới hạn mà không lộ mọi hoạt động khả dụng.

Bắt đầu Thu thập với Scrapeless

Khởi động quy trình thu thập và tự động hóa web của bạn với Scrapeless!
Đăng ký ngay hôm nay và nhận 5 đô la tín dụng miễn phíkhông cần thẻ tín dụng.
Nhận tín dụng miễn phí của bạn ngay bây giờ trong Scrapeless Dashboard.
Scrapeless Dashboard hiển thị $5.00 trong tín dụng nhóm

Xác minh kết nối và khám phá công cụ

Hermes bao gồm một bài kiểm tra kết nối khởi động máy chủ đã cấu hình, thực hiện bắt tay MCP và liệt kê các công cụ đã được phát hiện.

bash Copy
hermes mcp list
hermes mcp test scrapeless

Chạy đã xác minh báo cáo tóm tắt này:

text Copy
scrapeless   node ...   8 selected   enabled
Connected
Tools discovered: 24

Hai số này mô tả các bề mặt khác nhau. “Tám được chọn” là danh sách cho phép được lưu trữ trong cấu hình Hermes. “Hai mươi bốn đã phát hiện” là toàn bộ danh mục công cụ được trả về trong bài kiểm tra kết nối. Tại thời điểm thực thi, danh sách cho phép là bề mặt dành cho mô hình.

Tên công cụ xuất hiện trong Hermes với một không gian tên MCP xác định máy chủ và công cụ bản địa. Định dạng chính xác được xử lý bởi Hermes; các tên bản địa của máy chủ trong tools.include vẫn là google_search, scrape_markdown và các tên hoạt động của trình duyệt. Trao đổi giao thức cơ sở theo đặc tả Giao thức Bối cảnh Mô hình.

Nếu cấu hình thay đổi trong khi Hermes đang chạy, hãy sử dụng /reload-mcp bên trong phiên. Kiểm tra kết nối và kiểm tra thông tin xác thực là riêng biệt. Việc bắt tay có thể thành công với các sơ đồ hợp lệ ngay cả khi một cuộc gọi web sau đó không thể xác thực, vì vậy hãy thực hiện một tìm kiếm chỉ đọc sau khi tải khóa thực.

Cách bạn thực sự sử dụng điều này: kêu gọi đại lý của bạn

Các lời kêu gọi tốt nhất mô tả tiêu chuẩn chứng cứ và lộ trình công cụ được phép, không phải là một chuỗi nhấp chuột mong manh.

Kêu gọi bạn có thể dán

Tìm kiếm trên web cho các yêu cầu cài đặt hiện tại của dự án đã nêu. Mở kết quả tài liệu chính thức, trích xuất phần liên quan dưới dạng Markdown và trả về một danh sách kiểm tra ngắn. Trích dẫn URL nguồn và phân biệt những sự thật đã được ghi lại với sự suy diễn của bạn. Đừng sử dụng các công cụ có khả năng viết.

Lời kêu gọi này cho Hermes không gian để chọn công cụ trong khi bảo lưu một kết quả có thể kiểm tra. Tìm kiếm phát hiện trang chính thức. Trích xuất Markdown cung cấp chứng cứ có thể đọc được. Câu trả lời mang theo URL và đánh dấu bất kỳ suy diễn nào.

Một lời kêu gọi dựa trên trình duyệt

Mở trang sản phẩm công khai, kiểm tra cấu trúc trang tương tác và báo cáo các tên kế hoạch hiển thị và đơn vị của chúng. Đừng đăng nhập, gửi biểu mẫu hoặc nhấp vào các điều khiển mua. Bao gồm URL trang cuối cùng và trích dẫn chỉ văn bản tối thiểu cần thiết để hỗ trợ bảng.

Phiên bản này thiết lập các ràng buộc tiêu cực xung quanh các hành động quan trọng. Danh sách cho phép cũng giúp ích: không có công cụ gửi biểu mẫu nào nhìn thấy trừ khi các hoạt động trình duyệt đã chọn có thể diễn đạt nó, và lời kêu gọi cấm hành động này.

Bề mặt công cụ Scrapeless MCP

Xây dựng máy chủ đã xác minh trả về hai mươi bốn công cụ được nhóm thành bốn gia đình hữu ích:

Gia đình Ví dụ Sử dụng trong Hermes
Tìm kiếm google_search, google_trends Khám phá các nguồn và dữ liệu xu hướng hiện tại
Trích xuất scrape_markdown, scrape_html, scrape_screenshot Biến một URL công khai thành chứng cứ có thể đọc được bởi mô hình
Craw crawl_start, crawl_result, crawl_cancel Duyệt qua một phạm vi trang công khai đã xác định
Trình duyệt công cụ phiên, điều hướng, ảnh chụp, đầu vào, đọc và đóng Vận hành các trang yêu cầu hiển thị hoặc tương tác

Đừng tiết lộ toàn bộ danh mục theo thói quen. Một đại lý viết báo có thể chỉ cần tìm kiếm và trích xuất Markdown. Một nhiệm vụ trình duyệt cần một vòng đời phiên và các hành động trang. Giữ các hồ sơ Hermes riêng biệt hoặc các mục máy chủ riêng biệt khi các tập quyền đó khác biệt một cách vật chất.

Bề mặt Scrapeless AI Agent cung cấp ngữ cảnh sản phẩm, và giá cả giúp lập bản đồ các hoạt động web mong đợi với kế hoạch tài khoản.

Những gì bạn nhận lại

Kết quả công cụ MCP vẫn là các thông điệp có cấu trúc chứ không phải trạng thái trình duyệt ẩn. Một tìm kiếm có thể trả về các bản ghi kết quả; trích xuất có thể trả về Markdown; ảnh chụp trình duyệt có thể trả về mô tả phần tử phù hợp cho quyết định mô hình tiếp theo. Hermes sau đó đặt kết quả đã chọn vào ngữ cảnh nhiệm vụ của nó.

Sự tách biệt đó cải thiện chẩn đoán. “Máy chủ không thể khởi động,” “khám phá công cụ không thành công,” “thông tin xác thực bị từ chối,” và “trang không trả về nội dung hữu ích” là các sự kiện khác nhau. Bộ điều hợp có thể báo cáo chính xác sự kiện thay vì biến mọi thất bại thành một lời xin lỗi mô hình mơ hồ.

Kết luận

Đại lý Hermes và MCP không có rác phù hợp với nhau ở một ranh giới sạch: Hermes sở hữu lý luận và phối hợp; máy chủ MCP sở hữu các hoạt động web đã được loại. Đường đi được xác minh là cài đặt, cấu hình một máy chủ stdio, áp dụng một danh sách cho phép hẹp, kiểm tra khám phá và thực hiện một cuộc gọi được cấp quyền bằng thông tin đăng nhập chỉ đọc.


Sẵn sàng xây dựng Đại lý Hermes nhận thức web?

Tham gia cộng đồng của chúng tôi để nhận một kế hoạch miễn phí và kết nối với các nhà phát triển xây dựng quy trình nghiên cứu đại lý: Discord · Telegram.

Đăng ký tại app.scrapeless.com và kết nối Hermes với bề mặt công cụ web hữu ích nhất.


Câu hỏi thường gặp

H: Đại lý Hermes có hỗ trợ máy chủ MCP không?

Có. Đại lý Hermes hỗ trợ các máy chủ MCP stdio cục bộ và từ xa, phát hiện các công cụ của chúng khi khởi động và có thể lọc các công cụ nhìn thấy được theo máy chủ.

H: Biến môi trường nào mà máy chủ stdio không có rác sử dụng?

Cấu hình stdio đã được tài liệu sử dụng SCRAPELESS_KEY. Đưa nó vào môi trường máy chủ và giữ giá trị khỏi các nhắc nhở và các tệp cấu hình đã được cam kết.

H: Tại sao bài kiểm tra kết nối lại cho thấy nhiều công cụ hơn danh sách cho phép?

Bài kiểm tra kết nối báo cáo danh mục phát hiện của máy chủ, trong khi danh sách cho phép định nghĩa tập con dự kiến cho mô hình. Trong cấu hình đã được xác minh, máy chủ đã trả về hai mươi bốn sơ đồ công cụ và cấu hình đã chọn tám.

H: Liệu một kết nối MCP thành công có chứng minh rằng khóa API hoạt động không?

Không. Một cái bắt tay thành công chứng minh rằng Hermes đã khởi động máy chủ và phát hiện các sơ đồ của nó. Chạy một hoạt động web chỉ đọc sau khi tải khóa thực để xác minh xác thực dịch vụ.

H: Có nên kích hoạt tất cả các công cụ MCP không có rác không?

Không. Chỉ kích hoạt các hoạt động cần thiết cho công việc của đại lý. Các bộ công cụ nhỏ hơn giảm thiểu sự mơ hồ trong lựa chọn và hạn chế tác động của các hành động sai lầm.

H: Đại lý Hermes có thể sử dụng Scrapeless mà không cần khung đại lý AI không?

Hermes chính nó là môi trường runtime của đại lý trong cấu hình này. Nó kết nối trực tiếp với máy chủ MCP không có rác, vì vậy không cần thêm khung đại lý nào khác.

H: Cấu hình có thể sử dụng HTTP thay vì stdio không?

Có. Cả hai sản phẩm đều tài liệu kết nối MCP có khả năng HTTP. Stdio thì tiện lợi cho một quy trình con cục bộ; HTTP từ xa thì hữu ích khi vòng đời máy chủ và thông tin đăng nhập được quản lý trung tâm.

H: MCP có ghi đè các quy tắc truy cập trang web không?

Không. MCP định nghĩa cách mà máy khách và máy chủ công cụ giao tiếp. Đại lý vẫn cần quyền truy cập vào mục tiêu, phải sử dụng dữ liệu công khai hoặc được ủy quyền, và nên tuân theo các điều khoản và luật áp dụng.

Tại Scrapless, chúng tôi chỉ truy cập dữ liệu có sẵn công khai trong khi tuân thủ nghiêm ngặt các luật, quy định và chính sách bảo mật trang web hiện hành. Nội dung trong blog này chỉ nhằm mục đích trình diễn và không liên quan đến bất kỳ hoạt động bất hợp pháp hoặc vi phạm nào. Chúng tôi không đảm bảo và từ chối mọi trách nhiệm đối với việc sử dụng thông tin từ blog này hoặc các liên kết của bên thứ ba. Trước khi tham gia vào bất kỳ hoạt động cạo nào, hãy tham khảo ý kiến ​​cố vấn pháp lý của bạn và xem xét các điều khoản dịch vụ của trang web mục tiêu hoặc có được các quyền cần thiết.

Bài viết phổ biến nhất

Danh mục