geekcomputers / geekcomputers/Python
Google search result scraper
オープン
まだ誰も着手していません。
- 主要言語
- Python
- スター
- 35.4k
- フォーク
- 12.9k
- 平均マージ
- 2時間 37分
- マージ済み PR(30日)
- 1
説明
I've noticed I can't seem to scrape the results anymore.
On my debug console:
soup.select('.r a') = []
An empty list. Despite the fact the results are under the class .r with links in the a element.
Anyone else having trouble?
コントリビューションガイド
はじめの一歩
- issue を最後まで読み、次にプロジェクトのコントリビューションガイドを読みます。
- 着手することを issue にコメントします — 二人が同じ作業をするのを防げます。
- リポジトリをフォークし、ブランチを切って変更します。
- issue 番号を参照したプルリクエストを送ります。
調査の方向性
まず、soup.select('.r a')を呼び出している scraper コードを見つけ、Google の検索結果に対して空の結果になる挙動を再現します。現在の結果リンクセレクターを特定し、scraper がリンクを正常に抽出できることを確認します。issue にはファイルパスもテストパスも記載されていません。
索引モデルが issue の本文から書いたものです。
評価
- 技術スタック
- python
- 領域
- search
- issue の種類
- バグ
- 難易度
- 3/5
- 見積もり時間
- 1〜2日
- 活発さ
- 停滞
- 明瞭さ
- 説明が足りない
- 初心者へのやさしさ
- 25/100