Scrapeless Weekly Changelog: 21–27 tháng 9, 2026
Scraping and Proxy Management Expert
TL;DR:
- Hướng dẫn SDK hoàn chỉnh cho Python, Node.js và Go hiện đã có. Mỗi ngôn ngữ có một tài liệu cài đặt, xác thực, phạm vi sản phẩm, cấu hình và tham khảo sử dụng riêng trong Scrapeless Docs được cấu trúc lại.
- Ba Trình Thu Thập Dữ Liệu AI có thể tạo liên kết chia sẻ. Perplexity, Google AI Overview và Google AI Mode chấp nhận
should_fetch_share_linkvà có thể trả vềshare_urlvới kết quả hoàn thành. - Kiểm Tra Tự Động Hóa Trình Duyệt Scrapeless hiện đang hoạt động và miễn phí sử dụng. Trang này chạy 16 kiểm tra môi trường trình duyệt, tạo ra một ID dấu vân tay môi trường và cho phép bạn tải xuống kết quả dưới dạng JSON.
- Tài liệu Scrapeless giờ có cấu trúc sản phẩm và công cụ phát triển rõ ràng hơn. Điều hướng hiện tại tách biệt các điểm khởi đầu, hướng dẫn sản phẩm, SDK, MCP, tích hợp và nội dung trợ giúp.
Bản phát hành từ ngày 21–27 tháng 9 tập trung vào các điểm truy cập cho lập trình viên rõ ràng hơn và dễ dàng hơn trong việc chia sẻ kết quả. Hướng dẫn SDK cho Python, Node.js và Go đã hoạt động, ba Trình Thu Thập Dữ Liệu AI đã công khai các điều khiển liên kết chia sẻ được tài liệu hóa, và một trang chẩn đoán trình duyệt mới biến các tín hiệu tự động hóa và dấu vân tay thông thường thành một báo cáo dễ đọc.
Tài Liệu Hoàn Chỉnh cho SDK Python, Node.js và Go
Scrapeless giờ đây cung cấp tài liệu SDK dành riêng cho Python, Node.js và Go. Mỗi hướng dẫn đề cập đến cài đặt, xử lý API-key, giới thiệu nhanh, phạm vi sản phẩm, ví dụ về cách sử dụng, cấu hình, biến môi trường và các liên kết đến kho mã nguồn tương ứng.
SDK Overview mới cung cấp cho các nhóm một điểm khởi đầu trước khi họ chọn hướng dẫn dành riêng cho ngôn ngữ:
| SDK | Gói | Tài liệu |
|---|---|---|
| Python | scrapeless |
Python SDK |
| Node.js | @scrapeless-ai/sdk |
Node.js SDK |
| Go | github.com/scrapeless-ai/sdk-go |
Go SDK |
Cả ba hướng dẫn đều tài liệu hóa việc tạo tác vụ Trình Thu Thập Dữ Liệu AI và việc truy xuất kết quả bên cạnh các dịch vụ Scrapeless khác được hỗ trợ. Điều này giữ cho lộ trình tích hợp gần gũi với ngôn ngữ mà một nhóm đã sử dụng, trong khi Giới thiệu Trình Thu Thập Dữ Liệu AI vẫn là nguồn cho hành vi cụ thể của diễn viên.
Liên Kết Chia Sẻ cho Ba Trình Thu Thập Dữ Liệu AI
Perplexity, Google AI Overview và Google AI Mode hiện đã tài liệu hóa cùng một mẫu yêu cầu và phản hồi liên kết chia sẻ. Thiết lập boolean tùy chọn should_fetch_share_link khi tạo tác vụ; một phản hồi hoàn thành đủ điều kiện có thể bao gồm liên kết được tạo trong share_url.
| Trình Thu Thập Dữ Liệu AI | Diễn viên | Tài liệu liên kết chia sẻ |
|---|---|---|
| Perplexity | scraper.perplexity |
Perplexity Scraper |
| Google AI Overview | scraper.overview |
Google AI Overview Scraper |
| Google AI Mode | scraper.aimode |
Google AI Mode Scraper |
Liên kết chia sẻ được trả về có thể đặt cạnh câu lệnh, câu trả lời và trích dẫn trong một bản ghi xem xét. Các nhóm có thể chuyển bản ghi đó vào quy trình xem xét biên tập, phân tích giám sát thương hiệu hoặc quy trình hỗ trợ khách hàng mà không cần xây dựng lại trang kết quả có thể chia sẻ.
Bắt Đầu Thu Thập Dữ Liệu với Scrapeless
Nâng cao quy trình thu thập dữ liệu web và tự động hóa của bạn với Scrapeless!
Đăng ký ngay hôm nay và nhận $5 tín dụng miễn phí — không cần thẻ tín dụng.Nhận tín dụng miễn phí của bạn ngay bây giờ trong Bảng điều khiển Scrapeless.
Tự Động Hóa Trình Duyệt Miễn Phí và Chẩn Đoán Dấu Vân Tay
Trình kiểm tra tự động hóa trình duyệt miễn phí Scrapeless Browser Automation Check cho thấy những gì trình duyệt hiện tại phơi bày trong một quan sát. Nó thực hiện 16 kiểm tra và trình bày từng kết quả dưới dạng rõ ràng, cần xem xét, thông tin, không có sẵn, hoặc một tín hiệu tự động hóa rõ ràng.
Các kiểm tra bao gồm các chỉ số tự động hóa, tính nhất quán môi trường trình duyệt, giá trị navigator và thời gian, Client Hints, dữ liệu phần cứng và hiển thị, API mạng, khả năng của trình duyệt, tín hiệu lưu trữ và quyền riêng tư, quyền và phương tiện, Canvas, WebGL, âm thanh, phông chữ và bố cục, ClientRects, khả năng thời gian chạy và WebRTC.
Nhiều bề mặt trong số này được định nghĩa bởi các tiêu chuẩn trình duyệt mở. Tiêu chuẩn WebDriver định nghĩa mô hình tự động hóa trình duyệt đằng sau navigator.webdriver; tiêu chuẩn HTML Canvas định nghĩa hành vi vẽ có thể lập trình; và tiêu chuẩn WebGL mô tả giao diện biên dịch được phơi bày cho các trang web.
Trang cũng tạo một ID dấu vân tay môi trường từ các đầu vào được quan sát, hỗ trợ một lần chạy mới và tải báo cáo đầy đủ dưới dạng JSON. Chẩn đoán chạy mà không yêu cầu quyền truy cập camera hoặc microphone, không sử dụng yêu cầu STUN bên ngoài cho kiểm tra WebRTC của nó, và tuyên bố rằng các báo cáo không được lưu trữ.
Kết quả mô tả quan sát hiện tại; nó không phải là bằng chứng về danh tính con người. Kết quả rõ ràng navigator.webdriver cũng không đảm bảo rằng mọi trang sẽ coi trình duyệt như là lưu lượng con người.
Cấu trúc Tài liệu Scrapeless Rõ ràng Hơn
Điều hướng Scrapeless Docs đã được tổ chức lại xung quanh cách mà các đội chọn và thực hiện sản phẩm. Platform Overview giờ đây định tuyến độc giả sang Browser & Crawl, AI Scraper, Web Unlocker, Proxies, Scraping API, Developer Tools, Integrations và Help.
Các SDK nằm dưới Developer Tools với các trang riêng biệt cho mỗi ngôn ngữ được hỗ trợ. Các hướng dẫn cụ thể cho sản phẩm vẫn được nhóm lại với hành vi yêu cầu và phản hồi của chúng, trong khi phần Help cung cấp các danh mục trực tiếp thay vì buộc các nhà phát triển qua một con đường xử lý sự cố dài.
Kết luận
Bản phát hành của tuần này thu hẹp khoảng cách giữa chức năng SDK có sẵn và tài liệu công khai của nó. Nó cũng cung cấp cho Perplexity, Google AI Overview và tích hợp Google AI Mode một hợp đồng liên kết chia sẻ nhất quán, trong khi Trình kiểm tra tự động hóa trình duyệt cung cấp một cách nhanh chóng để kiểm tra các tín hiệu trình duyệt mà các quy trình làm việc tự động hóa phơi bày.
AI Scraper có sẵn thông qua Universal Scraping API. Bản Scrapeless Weekly Changelog trước đó đề cập đến các phát hành SDK trước các hướng dẫn này. Xem pricing của Scrapeless khi lập kế hoạch sử dụng trong sản xuất.
Sẵn sàng để Xây dựng Với Scrapeless?
Tham gia vào cộng đồng Scrapeless với các nhà phát triển đang xây dựng quy trình tự động hóa trình duyệt và AI-answer: Discord · Telegram.
Đăng ký tại app.scrapeless.com để bắt đầu.
Câu hỏi thường gặp
H: Các nhà phát triển có thể tìm thấy các hướng dẫn SDK mới của Scrapeless ở đâu?
Tổng quan về SDK liên kết đến các trang dành riêng cho Python, Node.js và Go dưới Developer Tools trong điều hướng Scrapeless Docs hiện tại.
H: Những AI Scraper nào hỗ trợ các trường liên kết chia sẻ được tài liệu hóa?
Perplexity, Google AI Overview và Google AI Mode tài liệu should_fetch_share_link như là điều khiển yêu cầu và share_url như là liên kết chia sẻ được trả về.
H: Trình kiểm tra tự động hóa trình duyệt có chứng minh rằng một khách truy cập là con người không?
Không. Trình kiểm tra tự động hóa trình duyệt báo cáo các tín hiệu quan sát được từ môi trường hiện tại; kết quả là một bức tranh chẩn đoán, không phải là bằng chứng về danh tính con người hoặc đảm bảo rằng một trang khác sẽ phân loại trình duyệt như thế nào.
Tại Scrapless, chúng tôi chỉ truy cập dữ liệu có sẵn công khai trong khi tuân thủ nghiêm ngặt các luật, quy định và chính sách bảo mật trang web hiện hành. Nội dung trong blog này chỉ nhằm mục đích trình diễn và không liên quan đến bất kỳ hoạt động bất hợp pháp hoặc vi phạm nào. Chúng tôi không đảm bảo và từ chối mọi trách nhiệm đối với việc sử dụng thông tin từ blog này hoặc các liên kết của bên thứ ba. Trước khi tham gia vào bất kỳ hoạt động cạo nào, hãy tham khảo ý kiến cố vấn pháp lý của bạn và xem xét các điều khoản dịch vụ của trang web mục tiêu hoặc có được các quyền cần thiết.



