5sControl / 5sControl/5s-backend

Разработка AI AGENT для обработки изображений и текстовых промптов

Aperta
#455 9 commenti 0 reazioni 1 assegnatario Rivendicata da @Dimskay1988 Vedi su GitHub
Lingua principale
Python
Stelle
2
Fork
0
Metriche di merge delle PR
Nessuna PR unita negli ultimi 30g

Descrizione

#### Цель:
Разработать AI AGENT, который принимает на вход изображение и текстовый промпт, а затем генерирует ответ на основе этих данных. В будущем могут быть добавлены дополнительные параметры.

#### Требования:
1. **Входные данные:**
- Изображение (формат: JPEG, PNG)
- Текстовый промпт (строка)

2. **Выходные данные:**
- Сгенерированный ответ на основе изображения и промпта

3. **Интерфейс:**
- Использовать Gradio для создания удобного пользовательского интерфейса

4. **Функциональность:**
- Загрузка изображения
- Ввод текстового промпта
- Обработка данных и генерация ответа
- Отображение результата пользователю

Guida per i contributori

Apri la guida per i contributori

Direzione di ricerca

The issue describes building an AI agent that processes images and text prompts. Start by examining the existing project structure to understand how AI models are integrated, likely in a Django backend. Look for existing image processing or model inference code. The Gradio interface needs to be built and connected to the backend logic. 'Done' means a functional web interface where uploading an image and entering a prompt produces a generated response.

Scritto dal modello di indicizzazione a partire dal testo della issue.

Valutazione

Stack tecnologico
python
Ambito
ai, backend-api-design, machine-learning
Tipo di issue
Funzionalità
Difficoltà
4/5
Tempo stimato
3-5 giorni
Stato di attività
Ferma
Chiarezza
Abbastanza chiara
Idoneità per principianti
35/100

Ricevi le nuove issue nella tua casella

Un breve riepilogo di issue GitHub adatte ai principianti.