5sControl / 5sControl/5s-backend

Разработка AI AGENT для обработки изображений и текстовых промптов

Abierto
#455 9 comentarios 0 reacciones 1 asignado Reclamado por @Dimskay1988 Ver en GitHub
Lenguaje dominante
Python
Estrellas
2
Forks
0
Métricas de merge de PR
Sin PR fusionados en 30 d

Descripción

#### Цель:
Разработать AI AGENT, который принимает на вход изображение и текстовый промпт, а затем генерирует ответ на основе этих данных. В будущем могут быть добавлены дополнительные параметры.

#### Требования:
1. **Входные данные:**
- Изображение (формат: JPEG, PNG)
- Текстовый промпт (строка)

2. **Выходные данные:**
- Сгенерированный ответ на основе изображения и промпта

3. **Интерфейс:**
- Использовать Gradio для создания удобного пользовательского интерфейса

4. **Функциональность:**
- Загрузка изображения
- Ввод текстового промпта
- Обработка данных и генерация ответа
- Отображение результата пользователю

Guía de contribución

Abrir la guía de contribución

Línea de trabajo

The issue describes building an AI agent that processes images and text prompts. Start by examining the existing project structure to understand how AI models are integrated, likely in a Django backend. Look for existing image processing or model inference code. The Gradio interface needs to be built and connected to the backend logic. 'Done' means a functional web interface where uploading an image and entering a prompt produces a generated response.

Escrito por el modelo de indexación a partir del texto del issue.

Evaluación

Stack tecnológico
python
Área
ai, backend-api-design, machine-learning
Tipo de issue
Nueva funcionalidad
Dificultad
4/5
Tiempo estimado
3-5 días
Estado de actividad
Estancado
Claridad
Bastante claro
Aptitud para principiantes
35/100

Recibe los nuevos issues en tu correo

Un resumen breve de issues de GitHub para principiantes.