maniac-tech / maniac-tech/Web-Crawling-using-Python

get_text error in webCrawling.py

オープン
#2 コメント 0 件 リアクション 0 件 担当者 0 名 GitHub で見る

まだ誰も着手していません。

bug help wanted
主要言語
HTML
スター
0
フォーク
1
PR マージ指標
30日以内にマージされた PR はありません

説明

Traceback (most recent call last):
File "webCrawling.py", line 42, in
blog_posts = get_blog_posts(fp)
File "webCrawling.py", line 35, in get_blog_posts
'content': cleanHtml(content.value),
File "webCrawling.py", line 11, in cleanHtml
return BeautifulStoneSoup(get_text(html),
NameError: global name 'get_text' is not defined

コントリビューションガイド

このリポジトリのコントリビューションガイドは索引されていません

はじめの一歩

  1. issue を最後まで読み、次にプロジェクトのコントリビューションガイドを読みます。
  2. 着手することを issue にコメントします — 二人が同じ作業をするのを防げます。
  3. リポジトリをフォークし、ブランチを切って変更します。
  4. issue 番号を参照したプルリクエストを送ります。

調査の方向性

webCrawling.py の 11 行目と 35 行目から始め、HTML テキストの抽出がどのように動作する想定なのか、また get_text が定義またはインポートされているかを確認します。同じ入力で crawler を再実行し、NameError が発生せずに完了し、content フィールドが生成されることを確認します。

索引モデルが issue の本文から書いたものです。

評価

技術スタック
python
領域
web-dev
issue の種類
バグ
難易度
2/5
見積もり時間
1〜3時間
活発さ
停滞
明瞭さ
おおむね明確
初心者へのやさしさ
58/100

新しい issue をメールで受け取る

初心者向けの GitHub issue を短くまとめたダイジェスト。