Scrapeless Weekly Changelog: Cập nhật từ 17–23 tháng 8 năm 2026
Senior Web Scraping Engineer
TL;DR:
- TikTok Scraper sẽ ra mắt sớm. Kế hoạch bao gồm hồ sơ người sáng tạo, danh sách công việc của người sáng tạo và chi tiết sản phẩm TikTok Shop.
- Dữ liệu truy vấn Fanout hiện đã được hỗ trợ trên ba động cơ AI. ChatGPT, Gemini và Perplexity hỗ trợ khả năng này, với tài liệu tương ứng hiện đã có sẵn.
- Máy chủ MCP Scrapeless có công cụ Crawl mới. Các đại lý kết nối MCP có thể khởi động quy trình thu thập crawling rộng hơn thông qua cùng một giao diện công cụ.
- Bộ sưu tập ChatGPT và Grok đáng tin cậy hơn. Các cải tiến phía dịch vụ tăng cường sự ổn định mà không cần thay đổi yêu cầu đối diện với khách hàng.
Phiên bản của tuần này mở rộng cách các nhóm có thể thu thập dữ liệu thương mại xã hội, phân tích các con đường trả lời AI và kết nối việc thu thập crawler với quy trình làm việc của đại lý. Từ ngày 17 đến 23 tháng 8, Scrapeless đã chuẩn bị TikTok Scraper cho việc phát hành, thêm hỗ trợ truy vấn fanout trên ba động cơ AI, giới thiệu Crawl trong Máy chủ MCP Scrapeless và cải thiện độ ổn định của ChatGPT và Grok.
💥 Sắp Ra Mắt: TikTok Scraper
TikTok Scraper là điểm nổi bật đầu tiên trong tuần này. Các diễn viên sắp tới được thiết kế để giúp các nhóm thu thập dữ liệu công khai về người sáng tạo và thương mại mà không cần duy trì một quy trình duyệt riêng biệt cho mỗi loại trang.
Kế hoạch bao gồm:
- Hồ sơ người sáng tạo để lấy thông tin chi tiết về tài khoản và hồ sơ công khai.
- Danh sách công việc của người sáng tạo để thu thập danh sách nội dung đã công bố của một người sáng tạo.
- Chi tiết sản phẩm TikTok Shop để trích xuất thông tin có cấu trúc từ các trang sản phẩm được hỗ trợ.
Tài liệu công khai vẫn đang được chuẩn bị, vì vậy các tham số yêu cầu, trường phản hồi và tính khả dụng chung sẽ được thông báo riêng. Các nhóm đánh giá các quy trình này nên chỉ thu thập dữ liệu công khai và áp dụng các chính sách tuân thủ, lưu trữ và truy cập của riêng họ.
💫 Hỗ Trợ Truy Vấn Fanout cho ChatGPT, Gemini và Perplexity
scraper.chatgpt, scraper.gemini và scraper.perplexity hiện hỗ trợ dữ liệu truy vấn fanout, và tài liệu tương ứng đã được xuất bản.
Dữ liệu fanout giúp các nhóm xem xét các con đường truy vấn liên quan được tạo ra trong một quy trình trả lời AI. Nó có thể hỗ trợ theo dõi động cơ trả lời, nghiên cứu prompt, phân tích khoảng trống nội dung và các quy trình khám phá hạ nguồn trên nhiều động cơ.
Vì tính khả dụng có thể phụ thuộc vào câu trả lời được trả về, các tích hợp nên kiểm tra rằng dữ liệu fanout có sẵn trước khi xử lý. Xem lại tài liệu LLM Chat Scraper liên quan trước khi cập nhật bộ phân tích sản xuất.
🌟 Một Công Cụ Crawl Mới cho Máy Chủ MCP Scrapeless
Máy chủ MCP Scrapeless hiện bao gồm một công cụ Crawl, mở rộng quy trình làm việc của đại lý ngoài việc lấy dữ liệu từ một trang duy nhất. Các ứng dụng kết nối MCP có thể sử dụng công cụ để khởi động các tác vụ crawling rộng hơn trong khi giữ việc thu thập dữ liệu bên trong cùng một tích hợp máy chủ.
Điều này phù hợp với mô hình công cụ MCP: các máy chủ công khai các chức năng được đặt tên mà các mô hình có thể khám phá và gọi, như đã mô tả trong tài liệu thông số công cụ MCP chính thức. Tài liệu cũng xác định các sơ đồ đầu vào cho các tham số công cụ và các sơ đồ đầu ra tùy chọn cho kết quả có cấu trúc. Các nhà phát triển xây dựng khách hàng có thể tham khảo tham chiếu sơ đồ MCP, trong khi các máy chủ mẫu chính thức trình bày các mẫu tích hợp phổ biến.
Bắt đầu thu thập dữ liệu với Scrapeless
Nâng cao công việc thu thập web và tự động hóa của bạn với Scrapeless!
Đăng ký ngay hôm nay và nhận $5 tín dụng miễn phí — không cần thẻ tín dụng.Nhận tín dụng miễn phí của bạn ngay bây giờ trong Bảng điều khiển Scrapeless.
⬆️ Cải Thiện Độ Tin Cậy Dịch Vụ
Bộ Sưu Tập ChatGPT Ổn Định Hơn
scraper.chatgpt nhận được các cải tiến về độ tin cậy phía dịch vụ làm giảm việc thu thập bị gián đoạn và cải thiện việc giao hàng kết quả thành công. Các tích hợp hiện tại không cần một tham số yêu cầu mới để hưởng lợi từ bản cập nhật.
Sửa Chữa Xử Lý Trạng Thái Grok
scraper.grok đã nhận được một bản sửa chữa xử lý trạng thái phía dịch vụ cho các phiên không hợp lệ. Thay đổi này cải thiện tính liên tục của việc thu thập và giảm thiểu các quy trình làm việc trống hoặc bị gián đoạn mà không thay đổi cuộc gọi diễn viên đối diện với khách hàng.
👀 Điều Này Có Nghĩa Gì Đối Với Các Nhà Phát Triển
Bản phát hành này tăng cường ba phần của quy trình làm việc dữ liệu hiện đại. TikTok Scraper sẽ thêm phạm vi thương mại xã hội tập trung, dữ liệu truy vấn fanout cung cấp một cách khác để nghiên cứu hành vi trả lời của AI, và công cụ MCP Crawl cung cấp khả năng thu thập rộng hơn cho các ứng dụng điều khiển bởi đại lý. Công việc đảm bảo độ tin cậy trên ChatGPT và Grok hỗ trợ các công việc định kỳ đáng tin cậy hơn.
Khám phá LLM Chat Scraper, xem năm cách sử dụng Scrapeless MCP Server, hoặc xem lại bảng giá Scrapeless khi lập kế hoạch cho một khối lượng công việc sản xuất.
Kết Luận
Bản phát hành từ 17–23 tháng 8 tóm tắt TikTok Scraper, thêm hỗ trợ truy vấn fanout trên ChatGPT, Gemini, và Perplexity, mang Crawl đến Scrapeless MCP Server, và cải thiện độ tin cậy của ChatGPT và Grok.
Sẵn Sàng Xây Dựng Quy Trình Làm Việc Dữ Liệu Tiếp Theo?
Tham gia vào các nhà phát triển xây dựng giám sát trả lời AI, tự động hóa đại lý, và các pipeline dữ liệu web công cộng trong cộng đồng Scrapeless: Discord · Telegram.
Đăng ký tại app.scrapeless.com và bắt đầu xây dựng với Scrapeless.
Tại Scrapless, chúng tôi chỉ truy cập dữ liệu có sẵn công khai trong khi tuân thủ nghiêm ngặt các luật, quy định và chính sách bảo mật trang web hiện hành. Nội dung trong blog này chỉ nhằm mục đích trình diễn và không liên quan đến bất kỳ hoạt động bất hợp pháp hoặc vi phạm nào. Chúng tôi không đảm bảo và từ chối mọi trách nhiệm đối với việc sử dụng thông tin từ blog này hoặc các liên kết của bên thứ ba. Trước khi tham gia vào bất kỳ hoạt động cạo nào, hãy tham khảo ý kiến cố vấn pháp lý của bạn và xem xét các điều khoản dịch vụ của trang web mục tiêu hoặc có được các quyền cần thiết.



