aws-samples / aws-samples/amazon-textract-serverless-large-scale-document-processing
Serverless process on large PDF
オープン
まだ誰も着手していません。
- 主要言語
- Python
- スター
- 337
- フォーク
- 159
- PR マージ指標
- 30日以内にマージされた PR はありません
説明
Hi,
Will this solution also work on large PDF's as lambda have 15min timeout issue.
Going server-less might not be a good solution.
コントリビューションガイド
はじめの一歩
- issue を最後まで読み、次にプロジェクトのコントリビューションガイドを読みます。
- 着手することを issue にコメントします — 二人が同じ作業をするのを防げます。
- リポジトリをフォークし、ブランチを切って変更します。
- issue 番号を参照したプルリクエストを送ります。
調査の方向性
まず、リポジトリの Lambda と Amazon Textract の処理フローを確認し、Lambda のタイムアウト内で大きな PDF がどのように処理されるかに注目してください。この issue ではファイルもテストも指定されておらず、実装や受け入れ基準も定義されていないため、必要なスコープと「完了」の意味は未解決のままです。
索引モデルが issue の本文から書いたものです。
評価
- 技術スタック
- aws, python
- 領域
- cloud
- issue の種類
- 機能追加
- 難易度
- 5/5
- 見積もり時間
- 1週間以上
- 活発さ
- 停滞
- 明瞭さ
- 説明が足りない
- 初心者へのやさしさ
- 15/100