Lịch sử thay đổi hàng tuần Scrapeless: 31 tháng 8–6 tháng 9 năm 2026
Senior Web Scraping Engineer
TL;DR:
- Máy chủ MCP không rác 0.6.1 đã sẵn sàng. Phiên bản này cải thiện trải nghiệm thu thập dữ liệu dựa trên MCP cho quy trình công việc của đại lý và nhà phát triển.
- Trình thu thập AI đáng tin cậy hơn ở các vùng ít phổ biến hơn. Phạm vi vùng đã nhận được cải thiện tỷ lệ thành công có mục tiêu.
- Google Search API chấp nhận đầu vào URL. Các nhóm giờ đây có thể truyền URL tìm kiếm để xây dựng yêu cầu linh hoạt hơn.
- Google Search API hỗ trợ chuyển đổi liên kết
goto. Cập nhật này giúp các liên kết điều hướng dễ xử lý hơn ở phía hạ nguồn. - Chế độ thu thập dữ liệu AI của Google lại ổn định. Một sự gián đoạn do cập nhật nền tảng ở phía trên đã được giải quyết.
- Tự động gia hạn ISP có sẵn trong Bảng điều khiển. Người dùng proxy ISP có một tùy chọn mới để duy trì liên tục dịch vụ.
Phiên bản phát hành từ 31 tháng 8 đến 6 tháng 9 tập trung vào tính linh hoạt đầu vào và khả năng phục hồi dịch vụ. Máy chủ MCP không rác đã tiến tới phiên bản 0.6.1, Google Search API thêm hai khả năng liên quan đến URL, và Trình thu thập AI hoạt động đáng tin cậy hơn ở những vùng ít được yêu cầu hơn. Bảng điều khiển cũng giới thiệu tự động gia hạn ISP, trong khi một vấn đề gần đây với thu thập dữ liệu Chế độ AI của Google hiện đã được giải quyết.
⬆️ Máy chủ MCP không rác 0.6.1
Máy chủ MCP không rác 0.6.1 bao gồm các tối ưu hóa cho quy trình thu thập dữ liệu của máy chủ. Nó được thiết kế cho các nhà phát triển kết nối tìm kiếm web, tự động hóa trình duyệt, thu thập dữ liệu, thu thập thông tin, và thu thập câu trả lời AI tới các khách hàng tương thích với MCP.
Kho lưu trữ Máy chủ MCP không rác chính thức chứa các hướng dẫn cài đặt và cấu hình. Nếu môi trường của bạn cố định phiên bản gói, hãy xác minh phiên bản phát hành có sẵn và cập nhật phiên bản đã cấu hình một cách có chủ ý thay vì dựa vào một bản nâng cấp ngầm.
Các công cụ MCP có thể được tìm thấy theo tên và được mô tả với các sơ đồ đầu vào, theo đặc tả công cụ của Giao thức Bối cảnh Mô hình. Sau khi cập nhật, hãy làm mới hoặc khởi động lại khách hàng khi cần thiết để nó có thể đọc danh sách công cụ được máy chủ đã kết nối cung cấp.
Để có một giới thiệu rộng rãi hơn về sự tích hợp, hãy xem Hướng dẫn Máy chủ MCP không rác.
🌟 Google Search API Thêm Xử Lý URL Linh Hoạt Hơn
Hai bổ sung này làm cho Google Search API dễ dàng kết nối với các quy trình đã làm việc với URL tìm kiếm và các liên kết đã trích xuất.
Truyền URL Tìm Kiếm Làm Đầu Vào
Google Search API hiện hỗ trợ đầu vào url. Thay vì tái tạo lại một yêu cầu từ các tham số tìm kiếm riêng lẻ, một ứng dụng có thể truyền một URL Tìm kiếm Google được hỗ trợ khi liên kết đó đã đại diện cho ngữ cảnh truy vấn dự định.
Điều này hữu ích cho các kênh nhận URL tìm kiếm đầy đủ từ một hệ thống khác. Nó có thể giảm việc phân tích ở phía ứng dụng và bảo tồn các tham số đã được mã hóa sẵn trong liên kết. Khi xây dựng hoặc lưu trữ các giá trị này, hãy sử dụng một bộ phân tích URL tuân thủ tiêu chuẩn để chuỗi truy vấn vẫn nguyên vẹn. Tiêu chuẩn URL WHATWG định nghĩa hành vi phân tích tương tác cho các URL.
Chuyển Đổi goto Liên Kết
Google Search API giờ đây cũng hỗ trợ chuyển đổi liên kết goto. Điều này cung cấp cho các ứng dụng ở phía hạ nguồn một cách sạch hơn để xử lý các liên kết điều hướng được hỗ trợ mà được trả về cùng với dữ liệu tìm kiếm, giảm bớt lượng logic xử lý liên kết cần thiết sau khi thu thập.
Những bổ sung này bổ sung cho dữ liệu tìm kiếm Google có cấu trúc có sẵn thông qua Deep SerpApi. Hãy xem xét tài liệu Deep SerpApi trước khi thay đổi xác thực yêu cầu sản xuất, đặc biệt nếu tích hợp của bạn hiện yêu cầu một đầu vào dựa trên từ khóa.
Bắt Đầu Thu Thập Dữ Liệu Với Scrapeless
Tăng cường quy trình thu thập dữ liệu và tự động hóa web của bạn với Scrapeless!
Đăng ký ngay hôm nay và nhận $5 tín dụng miễn phí — không cần thẻ tín dụng.Nhận tín dụng miễn phí của bạn ngay bây giờ trong Bảng điều khiển Scrapeless.
📍 Độ Tin Cậy Của Trình Thu Thập AI Cải Thiện Ở Nhiều Vùng Hơn
Trình thu thập AI đã nhận công việc cải thiện độ tin cậy có mục tiêu cho các vùng ít phổ biến hơn. Cải thiện này nhằm nâng cao tỷ lệ thu thập thành công ở những khu vực có nhu cầu khu vực thấp hơn, giúp các nhóm thực hiện việc giám sát và nghiên cứu phân tán địa lý với kết quả nhất quán hơn.
Đây là một cải tiến dịch vụ định tính hơn là SLA mới. Kết quả vẫn có thể thay đổi theo động cơ AI, yêu cầu, khu vực và khả năng nguồn gốc. Các nhóm nên tiếp tục theo dõi trạng thái nhiệm vụ và xác định cách xử lý nhiệm vụ thất bại phù hợp trong quy trình sản xuất.
Vấn đề Google AI Mode Scraper đã được giải quyết
Một cập nhật nền tảng Google AI Mode đã tạm thời làm gián đoạn scraper trong tuần cuối tuần từ 5–6 tháng 9 và làm tăng số lượng yêu cầu thất bại. Scrapeless đã nâng cấp dịch vụ để đáp ứng và vấn đề đã được giải quyết.
Không cần di chuyển từ phía khách hàng cho việc phục hồi này. Nếu ứng dụng của bạn giữ lại các công việc thất bại từ thời gian bị ảnh hưởng, hãy gửi lại những công việc đó theo chính sách hoạt động bình thường của bạn và liên hệ với hỗ trợ nếu yêu cầu mới vẫn thất bại.
ISP Tự động gia hạn đã có mặt trong Bảng điều khiển
Bảng điều khiển Scrapeless giờ đây bao gồm tự động gia hạn ISP. Tùy chọn này nhằm giúp khách hàng proxy ISP duy trì sự liên tục mà không cần gia hạn thủ công mỗi chu kỳ.
Trước khi kích hoạt tự động gia hạn, hãy xem xét chi tiết gia hạn được hiển thị trong tài khoản của bạn và xác nhận rằng phương thức thanh toán và cài đặt dịch vụ phù hợp với yêu cầu hoạt động của bạn. Để biết thông tin về kế hoạch hiện tại, hãy truy cập giá cả Scrapeless.
💫 Kết luận
Phiên bản ra mắt tuần này cải thiện cách các nhà phát triển kết nối dữ liệu tìm kiếm với quy trình tự động: MCP Server 0.6.1 hoàn thiện lớp tích hợp, trong khi Google Search API có đầu vào URL và chuyển đổi goto liên kết. Những cải tiến về độ tin cậy mở rộng hiệu suất AI Scraper trên nhiều khu vực hơn, bộ sưu tập Google AI Mode lại ổn định và tự động gia hạn ISP giảm bớt công việc thường xuyên trên Bảng điều khiển.
Khám phá Bản cập nhật hàng tuần Scrapeless trước đó để có các cập nhật mới nhất về TikTok Scraper, MCP và Google AI Mode.
👀 Sẵn sàng xây dựng quy trình dữ liệu tiếp theo của bạn?
Kết nối với các nhà phát triển đang xây dựng dữ liệu web công khai và quy trình AI-agent trong cộng đồng Scrapeless: Discord · Telegram.
Đăng ký tại app.scrapeless.com để bắt đầu.
Tại Scrapless, chúng tôi chỉ truy cập dữ liệu có sẵn công khai trong khi tuân thủ nghiêm ngặt các luật, quy định và chính sách bảo mật trang web hiện hành. Nội dung trong blog này chỉ nhằm mục đích trình diễn và không liên quan đến bất kỳ hoạt động bất hợp pháp hoặc vi phạm nào. Chúng tôi không đảm bảo và từ chối mọi trách nhiệm đối với việc sử dụng thông tin từ blog này hoặc các liên kết của bên thứ ba. Trước khi tham gia vào bất kỳ hoạt động cạo nào, hãy tham khảo ý kiến cố vấn pháp lý của bạn và xem xét các điều khoản dịch vụ của trang web mục tiêu hoặc có được các quyền cần thiết.



