geekcomputers / geekcomputers/Python
Google search result scraper
Đang mở
Chưa có ai nhận issue này.
- Ngôn ngữ chính
- Python
- Star
- 35.4k
- Fork
- 12.9k
- Merge trung bình
- 2 giờ 37 phút
- Pull request đã merge (30 ngày)
- 1
Mô tả
I've noticed I can't seem to scrape the results anymore.
On my debug console:
soup.select('.r a') = []
An empty list. Despite the fact the results are under the class .r with links in the a element.
Anyone else having trouble?
Hướng dẫn đóng góp
Bắt đầu từ đâu
- Đọc hết issue, rồi đọc hướng dẫn đóng góp của dự án.
- Bình luận trên issue rằng bạn sẽ nhận — tránh hai người làm cùng một việc.
- Fork repository và làm thay đổi trên một nhánh.
- Mở pull request có tham chiếu số hiệu của issue.
Hướng nghiên cứu
Bắt đầu bằng cách xác định mã scraper gọi soup.select('.r a') và tái hiện hành vi trả về kết quả rỗng đối với các kết quả tìm kiếm của Google. Xác định selector liên kết kết quả hiện tại và xác minh rằng scraper trích xuất các liên kết thành công; issue không cung cấp đường dẫn tệp hoặc đường dẫn test nào.
Do mô hình lập chỉ mục viết ra từ nội dung của issue.
Đánh giá
- Công nghệ
- python
- Lĩnh vực
- search
- Loại issue
- Lỗi
- Độ khó
- 3/5
- Thời gian dự kiến
- 1-2 ngày
- Mức độ hoạt động
- Đình trệ
- Độ rõ ràng
- Cần làm rõ
- Mức phù hợp với người mới
- 25/100