5sControl / 5sControl/5s-backend

Разработка AI AGENT для обработки изображений и текстовых промптов

Open
#455 9 comments 0 reactions 1 assignee Claimed by @Dimskay1988 View on GitHub
Dominant language
Python
Stars
2
Forks
0
PR merge metrics
No merged PRs in 30d

Description

#### Цель:
Разработать AI AGENT, который принимает на вход изображение и текстовый промпт, а затем генерирует ответ на основе этих данных. В будущем могут быть добавлены дополнительные параметры.

#### Требования:
1. **Входные данные:**
- Изображение (формат: JPEG, PNG)
- Текстовый промпт (строка)

2. **Выходные данные:**
- Сгенерированный ответ на основе изображения и промпта

3. **Интерфейс:**
- Использовать Gradio для создания удобного пользовательского интерфейса

4. **Функциональность:**
- Загрузка изображения
- Ввод текстового промпта
- Обработка данных и генерация ответа
- Отображение результата пользователю

Contributor guide

Open the contributing guide

Research direction

The issue describes building an AI agent that processes images and text prompts. Start by examining the existing project structure to understand how AI models are integrated, likely in a Django backend. Look for existing image processing or model inference code. The Gradio interface needs to be built and connected to the backend logic. 'Done' means a functional web interface where uploading an image and entering a prompt produces a generated response.

Written by the indexing model from the issue text.

Assessment

Tech stack
python
Domain
ai, backend-api-design, machine-learning
Issue type
Feature
Difficulty
4/5
Estimated time
3-5 days
Activity status
Stale
Clarity
Mostly clear
Newbie friendliness
35/100

Get new issues in your inbox

A short digest of beginner-friendly GitHub issues.