geekcomputers / geekcomputers/Python
add a stackoverflow web scrapper
まだ誰も着手していません。
- 主要言語
- Python
- スター
- 35.4k
- フォーク
- 12.9k
- 平均マージ
- 2時間 37分
- マージ済み PR(30日)
- 1
説明
Here's the source code of a web scrapper, Made to extract useful questions & answers in stackoverflow
``
import requests
from bs4 import BeautifulSoup
question = input('Type a question : ')
words = question.split(' ')
url = 'https://stackoverflow.com/search?q='+'+'.join(words)
page = requests.get(url)
soup = BeautifulSoup(page.content, 'html.parser')
items = soup.find_all('a',class_='question-hyperlink')
mylist = []
for item in items :
if item['href'].startswith('/questions/'):
mylist.append(item['href'])
link = 'https://stackoverflow.com'+mylist[0]
try:
page = requests.get(link)
soup = BeautifulSoup(page.content, 'html.parser')
items = soup.find_all('div', class_='post-text')
mylist = []
for item in items:
mylist.append(item)
print(mylist[1].text)
except:
print('No fu-----g clue!')
``
コントリビューションガイド
はじめの一歩
- issue を最後まで読み、次にプロジェクトのコントリビューションガイドを読みます。
- 着手することを issue にコメントします — 二人が同じ作業をするのを防げます。
- リポジトリをフォークし、ブランチを切って変更します。
- issue 番号を参照したプルリクエストを送ります。
調査の方向性
この Issue では、requests と BeautifulSoup を使用して Stack Overflow を検索し、回答を出力する Python コマンドラインエントリーポイントが提供されています。まず、リポジトリ内のスタンドアロン Python 例を配置すべき場所を特定し、次に提供されたスクリプトをサンプルの質問で実行します。スクレイパーが想定された場所に含まれ、意図した検索および表示の動作が機能すれば完了です。
索引モデルが issue の本文から書いたものです。
評価
- 技術スタック
- python
- 領域
- cli, web-dev
- issue の種類
- 機能追加
- 難易度
- 3/5
- 見積もり時間
- 1〜2日
- 活発さ
- 停滞
- 明瞭さ
- 説明が足りない
- 初心者へのやさしさ
- 35/100