5sControl / 5sControl/5s-backend

Разработка AI AGENT для обработки изображений и текстовых промптов

Ouverte
#455 9 commentaires 0 réactions 1 personne assignée Réclamée par @Dimskay1988 Voir sur GitHub
Langage dominant
Python
Étoiles
2
Forks
0
Métriques de merge des PR
Aucune PR mergée en 30 j

Description

#### Цель:
Разработать AI AGENT, который принимает на вход изображение и текстовый промпт, а затем генерирует ответ на основе этих данных. В будущем могут быть добавлены дополнительные параметры.

#### Требования:
1. **Входные данные:**
- Изображение (формат: JPEG, PNG)
- Текстовый промпт (строка)

2. **Выходные данные:**
- Сгенерированный ответ на основе изображения и промпта

3. **Интерфейс:**
- Использовать Gradio для создания удобного пользовательского интерфейса

4. **Функциональность:**
- Загрузка изображения
- Ввод текстового промпта
- Обработка данных и генерация ответа
- Отображение результата пользователю

Guide de contribution

Ouvrir le guide de contribution

Piste de recherche

The issue describes building an AI agent that processes images and text prompts. Start by examining the existing project structure to understand how AI models are integrated, likely in a Django backend. Look for existing image processing or model inference code. The Gradio interface needs to be built and connected to the backend logic. 'Done' means a functional web interface where uploading an image and entering a prompt produces a generated response.

Rédigé par le modèle d'indexation à partir du texte de l'issue.

Évaluation

Stack technique
python
Domaine
ai, backend-api-design, machine-learning
Type d'issue
Fonctionnalité
Difficulté
4/5
Temps estimé
3-5 jours
Activité
À l'abandon
Clarté
Plutôt claire
Accessibilité débutants
35/100

Recevez les nouvelles issues par e-mail

Un résumé court des issues GitHub adaptées aux débutants.