geekcomputers / geekcomputers/Python

add a stackoverflow web scrapper

オープン
#761 コメント 0 件 リアクション 0 件 担当者 0 名 GitHub で見る

まだ誰も着手していません。

主要言語
Python
スター
35.4k
フォーク
12.9k
平均マージ
2時間 37分
マージ済み PR(30日)
1

説明

Here's the source code of a web scrapper, Made to extract useful questions & answers in stackoverflow
``
import requests
from bs4 import BeautifulSoup

question = input('Type a question : ')
words = question.split(' ')

url = 'https://stackoverflow.com/search?q='+'+'.join(words)

page = requests.get(url)

soup = BeautifulSoup(page.content, 'html.parser')

items = soup.find_all('a',class_='question-hyperlink')

mylist = []

for item in items :
if item['href'].startswith('/questions/'):
mylist.append(item['href'])

link = 'https://stackoverflow.com'+mylist[0]

try:
page = requests.get(link)

soup = BeautifulSoup(page.content, 'html.parser')

items = soup.find_all('div', class_='post-text')

mylist = []
for item in items:
	mylist.append(item)
print(mylist[1].text)

except:
print('No fu-----g clue!')
``

コントリビューションガイド

コントリビューションガイドを開く

はじめの一歩

  1. issue を最後まで読み、次にプロジェクトのコントリビューションガイドを読みます。
  2. 着手することを issue にコメントします — 二人が同じ作業をするのを防げます。
  3. リポジトリをフォークし、ブランチを切って変更します。
  4. issue 番号を参照したプルリクエストを送ります。

調査の方向性

この Issue では、requests と BeautifulSoup を使用して Stack Overflow を検索し、回答を出力する Python コマンドラインエントリーポイントが提供されています。まず、リポジトリ内のスタンドアロン Python 例を配置すべき場所を特定し、次に提供されたスクリプトをサンプルの質問で実行します。スクレイパーが想定された場所に含まれ、意図した検索および表示の動作が機能すれば完了です。

索引モデルが issue の本文から書いたものです。

評価

技術スタック
python
領域
cli, web-dev
issue の種類
機能追加
難易度
3/5
見積もり時間
1〜2日
活発さ
停滞
明瞭さ
説明が足りない
初心者へのやさしさ
35/100

新しい issue をメールで受け取る

初心者向けの GitHub issue を短くまとめたダイジェスト。