geekcomputers / geekcomputers/Python

Google search result scraper

オープン
#522 コメント 2 件 リアクション 0 件 担当者 0 名 GitHub で見る

まだ誰も着手していません。

主要言語
Python
スター
35.4k
フォーク
12.9k
平均マージ
2時間 37分
マージ済み PR(30日)
1

説明

I've noticed I can't seem to scrape the results anymore.
On my debug console:

soup.select('.r a') = []

An empty list. Despite the fact the results are under the class .r with links in the a element.
Anyone else having trouble?

コントリビューションガイド

コントリビューションガイドを開く

はじめの一歩

  1. issue を最後まで読み、次にプロジェクトのコントリビューションガイドを読みます。
  2. 着手することを issue にコメントします — 二人が同じ作業をするのを防げます。
  3. リポジトリをフォークし、ブランチを切って変更します。
  4. issue 番号を参照したプルリクエストを送ります。

調査の方向性

まず、soup.select('.r a')を呼び出している scraper コードを見つけ、Google の検索結果に対して空の結果になる挙動を再現します。現在の結果リンクセレクターを特定し、scraper がリンクを正常に抽出できることを確認します。issue にはファイルパスもテストパスも記載されていません。

索引モデルが issue の本文から書いたものです。

評価

技術スタック
python
領域
search
issue の種類
バグ
難易度
3/5
見積もり時間
1〜2日
活発さ
停滞
明瞭さ
説明が足りない
初心者へのやさしさ
25/100

新しい issue をメールで受け取る

初心者向けの GitHub issue を短くまとめたダイジェスト。