geekcomputers / geekcomputers/Python

Google search result scraper

Đang mở
#522 2 bình luận 0 reaction 0 người được giao Xem trên GitHub

Chưa có ai nhận issue này.

Ngôn ngữ chính
Python
Star
35.4k
Fork
12.9k
Merge trung bình
2 giờ 37 phút
Pull request đã merge (30 ngày)
1

Mô tả

I've noticed I can't seem to scrape the results anymore.
On my debug console:

soup.select('.r a') = []

An empty list. Despite the fact the results are under the class .r with links in the a element.
Anyone else having trouble?

Hướng dẫn đóng góp

Mở hướng dẫn đóng góp

Bắt đầu từ đâu

  1. Đọc hết issue, rồi đọc hướng dẫn đóng góp của dự án.
  2. Bình luận trên issue rằng bạn sẽ nhận — tránh hai người làm cùng một việc.
  3. Fork repository và làm thay đổi trên một nhánh.
  4. Mở pull request có tham chiếu số hiệu của issue.

Hướng nghiên cứu

Bắt đầu bằng cách xác định mã scraper gọi soup.select('.r a') và tái hiện hành vi trả về kết quả rỗng đối với các kết quả tìm kiếm của Google. Xác định selector liên kết kết quả hiện tại và xác minh rằng scraper trích xuất các liên kết thành công; issue không cung cấp đường dẫn tệp hoặc đường dẫn test nào.

Do mô hình lập chỉ mục viết ra từ nội dung của issue.

Đánh giá

Công nghệ
python
Lĩnh vực
search
Loại issue
Lỗi
Độ khó
3/5
Thời gian dự kiến
1-2 ngày
Mức độ hoạt động
Đình trệ
Độ rõ ràng
Cần làm rõ
Mức phù hợp với người mới
25/100

Nhận issue mới trong hộp thư của bạn

Bản tóm tắt ngắn những issue GitHub phù hợp với người mới.