aws-samples / aws-samples/amazon-textract-serverless-large-scale-document-processing

Serverless process on large PDF

オープン
#52 コメント 0 件 リアクション 0 件 担当者 0 名 GitHub で見る

まだ誰も着手していません。

主要言語
Python
スター
337
フォーク
159
PR マージ指標
30日以内にマージされた PR はありません

説明

Hi,
Will this solution also work on large PDF's as lambda have 15min timeout issue.
Going server-less might not be a good solution.

コントリビューションガイド

コントリビューションガイドを開く

はじめの一歩

  1. issue を最後まで読み、次にプロジェクトのコントリビューションガイドを読みます。
  2. 着手することを issue にコメントします — 二人が同じ作業をするのを防げます。
  3. リポジトリをフォークし、ブランチを切って変更します。
  4. issue 番号を参照したプルリクエストを送ります。

調査の方向性

まず、リポジトリの Lambda と Amazon Textract の処理フローを確認し、Lambda のタイムアウト内で大きな PDF がどのように処理されるかに注目してください。この issue ではファイルもテストも指定されておらず、実装や受け入れ基準も定義されていないため、必要なスコープと「完了」の意味は未解決のままです。

索引モデルが issue の本文から書いたものです。

評価

技術スタック
aws, python
領域
cloud
issue の種類
機能追加
難易度
5/5
見積もり時間
1週間以上
活発さ
停滞
明瞭さ
説明が足りない
初心者へのやさしさ
15/100

新しい issue をメールで受け取る

初心者向けの GitHub issue を短くまとめたダイジェスト。