5sControl / 5sControl/5s-backend

Разработка AI AGENT для обработки изображений и текстовых промптов

オープン
#455 コメント 9 件 リアクション 0 件 担当者 1 名 @Dimskay1988 が担当を希望しています GitHub で見る
主要言語
Python
スター
2
フォーク
0
PR マージ指標
30日以内にマージされた PR はありません

説明

#### Цель:
Разработать AI AGENT, который принимает на вход изображение и текстовый промпт, а затем генерирует ответ на основе этих данных. В будущем могут быть добавлены дополнительные параметры.

#### Требования:
1. **Входные данные:**
- Изображение (формат: JPEG, PNG)
- Текстовый промпт (строка)

2. **Выходные данные:**
- Сгенерированный ответ на основе изображения и промпта

3. **Интерфейс:**
- Использовать Gradio для создания удобного пользовательского интерфейса

4. **Функциональность:**
- Загрузка изображения
- Ввод текстового промпта
- Обработка данных и генерация ответа
- Отображение результата пользователю

コントリビューションガイド

コントリビューションガイドを開く

調査の方向性

The issue describes building an AI agent that processes images and text prompts. Start by examining the existing project structure to understand how AI models are integrated, likely in a Django backend. Look for existing image processing or model inference code. The Gradio interface needs to be built and connected to the backend logic. 'Done' means a functional web interface where uploading an image and entering a prompt produces a generated response.

索引モデルが issue の本文から書いたものです。

評価

技術スタック
python
領域
ai, backend-api-design, machine-learning
issue の種類
機能追加
難易度
4/5
見積もり時間
3〜5日
活発さ
停滞
明瞭さ
おおむね明確
初心者へのやさしさ
35/100

新しい issue をメールで受け取る

初心者向けの GitHub issue を短くまとめたダイジェスト。