🎯 Trình duyệt đám mây tùy chỉnh, chống phát hiện được hỗ trợ bởi Chromium tự phát triển, thiết kế dành cho trình thu thập dữ liệu webtác nhân AI. 👉Dùng thử ngay
Quay lại blog

API Thuật Toán Tìm Kiếm Amazon: Kết Quả Tự Nhiên & Được Tài Trợ Dưới Dạng JSON

James Thompson
James Thompson

Scraping and Proxy Management Expert

16-Jul-2026

Tóm tắt:

  • Trình thu thập dữ liệu tìm kiếm Amazon là tác nhân scraper.amazon với type: "keywords" - nó biến một cụm từ tìm kiếm thành kết quả xếp hạng của Amazon dưới dạng JSON.
  • Một yêu cầu POST đã xác thực tới /api/v1/scraper/request sẽ trả về danh sách tự nhiên và danh sách tài trợ, mỗi danh sách có vị trí, ASIN, tiêu đề, giá, xếp hạng và số lượng đánh giá.
  • Kết quả tự nhiên và trả phí được tách riêng, vì vậy bạn có thể theo dõi vị trí xếp hạng của một sản phẩm và đối thủ nào đang mua các vị trí tài trợ ở trên nó.
  • Giá cả và xếp hạng được gửi dưới dạng chuỗi hiển thị ("$24.98", "4.9 trên 5 sao"), vì vậy hãy phân tích chúng thay vì chuyển đổi trực tiếp.
  • Bắt đầu miễn phí. Các tài khoản Scrapeless mới bao gồm tín dụng API thu thập miễn phí - đăng ký tại app.scrapeless.com.

Tìm kiếm trên Amazon là nơi khám phá sản phẩm diễn ra, và thứ tự của trang kết quả quyết định sản phẩm nào sẽ được nhìn thấy - đó là lý do mà người bán hàng trên Amazon theo dõi chặt chẽ xếp hạng từ khóa của họ. API Scraping của Scrapeless nắm bắt trang kết quả của từ khóa dưới dạng dữ liệu có cấu trúc: xếp hạng tự nhiên, vị trí tài trợ, và ASIN, giá, và xếp hạng của mỗi danh sách. Hướng dẫn này cho thấy yêu cầu, hình dạng phản hồi và các trường cần chú ý. Mỗi yêu cầu và trường bên dưới được ghi lại từ một lần chạy trực tiếp của tác nhân.

Những gì bạn có thể làm với Trình thu thập dữ liệu Tìm kiếm Amazon

Tác nhân lấy một từ khóa và trả về kết quả xếp hạng của Amazon dưới dạng JSON. Về cơ bản, điều đó cho phép bạn:

  • Theo dõi xếp hạng từ khóa - nắm bắt vị trí tự nhiên của sản phẩm bạn cho một cụm từ tìm kiếm và theo dõi sự thay đổi theo thời gian.
  • Giám sát lớp tài trợ - xem ASIN nào đang mua các vị trí trả phí ở trên kết quả tự nhiên cho các từ khóa của bạn.
  • Lên bản đồ cạnh tranh của một danh mục - lấy toàn bộ trang đầu tiên của ASIN, giá và xếp hạng cho một tìm kiếm và so sánh các lĩnh vực.
  • Cung cấp mô hình giá cả và sự lựa chọn - đưa kết quả có cấu trúc vào bảng điều khiển hoặc cảnh báo mà không cần phân tích HTML.

Tại sao chọn Tác nhân Amazon Scrapeless

Trang kết quả tìm kiếm của Amazon được render rộng rãi và bảo vệ chống bot, và HTML của nó liên tục thay đổi. Tác nhân Scrapeless thực hiện tìm kiếm và trả về một định dạng sạch, thân thiện với nhà phát triển, vì vậy mã của bạn đọc các trường thay vì duy trì các bộ chọn, luân phiên hạ tầng hoặc xử lý các khối. Tác nhân scraper.amazon cũng bao phủ chi tiết sản phẩm và trợ lý Rufus bằng cách thay đổi type.

Điểm cuối và Tham số

Tác nhân chạy trên điểm cuối API thu thập đồng bộ. Xác thực bằng mã thông báo của bạn trong tiêu đề x-api-token.

  • Điểm cuối: POST https://api.scrapeless.com/api/v1/scraper/request
  • Tác nhân: scraper.amazon
Trường đầu vào Loại Bắt buộc Mô tả
type chuỗi Đặt thành keywords cho một tìm kiếm.
keywords chuỗi Cụm từ tìm kiếm.
domain chuỗi Cửa hàng Amazon, ví dụ: www.amazon.com.

Kết quả được trả về đồng bộ trong một đối tượng result; bạn không cần phải kiểm tra lại.

Yêu cầu đã xác thực

Một yêu cầu tối thiểu trông như thế này (minh họa - thay thế mã thông báo):

bash Copy
curl 'https://api.scrapeless.com/api/v1/scraper/request' \
  --header 'Content-Type: application/json' \
  --header 'x-api-token: YOUR_API_TOKEN' \
  --data '{
    "actor": "scraper.amazon",
    "input": {
      "type": "keywords",
      "keywords": "tai nghe không dây",
      "domain": "www.amazon.com"
    }
  }'

Tích hợp Python

Ví dụ này đọc mã thông báo từ biến môi trường SCRAPELESS_API_KEY, thực hiện tìm kiếm và in các kết quả tự nhiên và tài trợ. Nó chỉ sử dụng thư viện chuẩn của Python.

python Copy
import json
import os
import urllib.request

API_URL = "https://api.scrapeless.com/api/v1/scraper/request"
API_TOKEN = os.environ["SCRAPELESS_API_KEY"]

payload = {
    "actor": "scraper.amazon",
    "input": {
        "type": "keywords",
        "keywords": "tai nghe không dây",
        "domain": "www.amazon.com",
    },
}

request = urllib.request.Request(
    API_URL,
    data=json.dumps(payload).encode("utf-8"),
    headers={"Content-Type": "application/json", "x-api-token": API_TOKEN},
    method="POST",
)

with urllib.request.urlopen(request, timeout=180) as response:
    data = json.loads(response.read().decode("utf-8"))

result = data.get("result", {})
listings = result.get("result", {})
organic = listings.get("organic") or []
paid = listings.get("paid") or []

print("từ khóa:", result.get("keyword"))
print("kết quả tự nhiên:", len(organic))
print("kết quả tài trợ:", len(paid))

for item in organic[:5]:
    print(f"  #{item.get('pos')} {item.get('asin')} {item.get('price')} {item.get('rating')}")
    print("    ", (item.get("title") or "")[:70])

Những gì bạn nhận lại

Kết quả được trả về trong result. Các trường dưới đây là những trường bạn sẽ thường xuyên sử dụng; giá trị là một mẫu minh họa từ một lần chạy thực tế, đã cắt ngắn để phù hợp với độ dài.

json Copy
// Mẫu minh họa từ một lần chạy scraper.amazon (gõ từ khóa) thực tế - tên các trường là thật, giá trị đã được cắt ngắn.
{
  "result": {
    "keyword": "tai nghe không dây",
    "current_page": 1,
    "total_results_count": 16,
    "result": {
      "organic": [
        {
          "pos": 3,
          "asin": "B0H3PSK8LR",
          "title": "HAOYUYAN Tai Nghe Không Dây, Tai Nghe Bluetooth Thể Thao ...",
          "price": "$24.98",
          "rating": "4.9 trên 5 sao",
          "reviews_count": "1,204",
          "is_prime": true,
          "best_seller": false,
          "is_sponsored": false,
          "url_image": "<URL hình ảnh sản phẩm>"
        }
      ],
      "paid": [
        {
          "pos": 1,
          "asin": "B0DGMHKDWQ",
          "title": "Gabba Goods Tai Nghe Bluetooth Trùm Tai ...",
          "price": "$19.99",
          "rating": "4.2 trên 5 sao",
          "is_sponsored": true
        }
      ]
    }
  }
}
Trường Kiểu Mô tả
keyword chuỗi Từ khóa tìm kiếm đã được chạy.
current_page số Số trang kết quả.
total_results_count số Số lượng kết quả được phân tích trên trang.
result.organic mảng Danh sách hữu cơ theo thứ tự xếp hạng.
result.paid mảng Danh sách tài trợ.
…[].pos số Vị trí của danh sách.
…[].asin chuỗi ASIN sản phẩm.
…[].title chuỗi Tiêu đề danh sách.
…[].price chuỗi Giá hiển thị, ví dụ: "$24.98".
…[].rating chuỗi Xếp hạng hiển thị, ví dụ: "4.9 trên 5 sao".
…[].reviews_count chuỗi Số lượng đánh giá dưới dạng chuỗi hiển thị.
…[].is_prime / best_seller / is_sponsored boolean Thẻ Prime, Best Seller và cờ tài trợ.
…[].url_image chuỗi URL hình ảnh sản phẩm.

Hữu cơ so với Tài trợ

Phản hồi tách biệt organic khỏi paid, và sự phân chia đó là điểm chính. Vị trí hữu cơ cho thấy sản phẩm xếp hạng theo giá trị; mảng paid cho thấy các ASIN nào đang mua được hiển thị ở trên. Theo dõi cả hai cho từ khóa của bạn cho bạn biết hai điều khác nhau — vị trí của danh sách của bạn và áp lực tài trợ bao nhiêu đang nằm ở trên nó. Mỗi mục cũng mang theo cờ is_sponsored, vì vậy bạn có thể đối chiếu hai cái nhìn.

Các Vấn đề Hình dáng Dữ liệu Thường gặp

  • Giá cả và đánh giá là chuỗi hiển thị. price"$24.98"rating"4.9 trên 5 sao", vì vậy hãy trích xuất các số bằng một bộ phân tích nhỏ thay vì cast trường. reviews_count ("1,204") cũng là một chuỗi.
  • Đọc từ result.result. Các danh sách nằm một cấp bên trong: result cấp cao nhất chứa siêu dữ liệu truy vấn, và result.result.organic / result.result.paid giữ các danh sách.
  • paid có thể trống. Một số từ khóa không có lớp tài trợ; hãy bảo vệ để nhận diện một mảng trống trước khi lặp qua.
  • Vị trí theo trang. pos là thứ hạng trong trang đã trả về, vì vậy hãy ghim current_page khi bạn so sánh các lần chạy theo thời gian.

Các Diễn viên Bạn Đồng hành

Loại keywords là một chế độ của diễn viên Amazon. Chuyển type thành product để biến một ASIN thành một bản ghi sản phẩm đầy đủ, hoặc thành rufus để bắt trợ lý mua sắm của Amazon — điểm cuối và xác thực vẫn giống nhau, chỉ cần thay đổi type và đầu vào của nó. Đối với một diễn viên khác trong cùng một gia đình Scraper API, hãy xem Hướng dẫn Scraper API ChatGPT. Amazon tài liệu chương trình Sponsored Products của riêng mình và đề cập đến phía bán lẻ trong phòng tin tức bán lẻ của họ.

Kết luận

Amazon Search Scraper biến một từ khóa thành các kết quả có cấu trúc, được xếp hạng với một yêu cầu xác thực: gửi một thuật ngữ và một cửa hàng, đọc lại các danh sách hữu cơ và tài trợ với ASIN, giá cả, xếp hạng và số lượng đánh giá. Phân tích giá cả và xếp hạng chuỗi hiển thị, đọc các danh sách từ result.result, và bạn có một nguồn tin cậy để theo dõi thứ hạng, giám sát tài trợ và phân tích cạnh tranh.

Sẵn sàng để thu thập tìm kiếm Amazon dưới dạng dữ liệu? Bắt đầu miễn phí từ bảng điều khiển Scrapeless, xem diễn viên này phù hợp ở đâu trên trang sản phẩm Scraping API, hoặc so sánh các gói trên bảng giá Scrapeless.

Câu hỏi thường gặp

Q: Scraper Tìm kiếm Amazon là gì?
A: Đây là actor API Scrapeless Scraping scraper.amazon với type: "keywords", gửi một thuật ngữ tìm kiếm đến Amazon và trả về các kết quả đã được xếp hạng dưới dạng JSON — các danh sách tự nhiên và được tài trợ với vị trí, ASIN, tiêu đề, giá, xếp hạng và số lượng đánh giá.

Q: Nó sử dụng endpoint và tham số nào?
A: POST https://api.scrapeless.com/api/v1/scraper/request với actor được đặt là scraper.amazon và một đối tượng input chứa type: "keywords", keywords, và domain. Xác thực bằng token của bạn trong x-api-token.

Q: Làm thế nào tôi có thể phân biệt kết quả tự nhiên và được tài trợ?
A: Phản hồi trả về hai mảng, result.organicresult.paid, và mỗi danh sách cũng mang một cờ is_sponsored, vì vậy bạn có thể tách xếp hạng theo giá trị từ xếp hạng trả phí.

Q: Giá và xếp hạng có phải là số không?
A: Không, chúng là chuỗi hiển thị — price như "$24.98"rating như "4.9 trên 5 sao". Trích xuất các số với một bộ phân tích nhỏ thay vì ép kiểu trường.

Q: Phản hồi có đồng bộ không?
A: Có. Đối tượng result được trả về trong cùng một phản hồi; bạn không cần truy vấn một endpoint riêng biệt.

Q: Có thể actor giống nhau quét một sản phẩm hoặc trợ lý Rufus không?
A: Có. Thay đổi type thành product để có một hồ sơ ASIN đầy đủ, hoặc thành rufus cho trợ lý mua sắm của Amazon — endpoint và xác thực vẫn giữ nguyên.

Tại Scrapless, chúng tôi chỉ truy cập dữ liệu có sẵn công khai trong khi tuân thủ nghiêm ngặt các luật, quy định và chính sách bảo mật trang web hiện hành. Nội dung trong blog này chỉ nhằm mục đích trình diễn và không liên quan đến bất kỳ hoạt động bất hợp pháp hoặc vi phạm nào. Chúng tôi không đảm bảo và từ chối mọi trách nhiệm đối với việc sử dụng thông tin từ blog này hoặc các liên kết của bên thứ ba. Trước khi tham gia vào bất kỳ hoạt động cạo nào, hãy tham khảo ý kiến ​​cố vấn pháp lý của bạn và xem xét các điều khoản dịch vụ của trang web mục tiêu hoặc có được các quyền cần thiết.

Bài viết phổ biến nhất

Danh mục