NVIDIA / NVIDIA/Personal-AI-Router
[Feature]: Multiple ollama instances on single host support
Nadie ha tomado este issue todavía.
- Lenguaje dominante
- Go
- Estrellas
- 1.4k
- Forks
- 250
- Merge medio
- 23 h 27 min
- PR fusionados (30 d)
- 1
Descripción
Area
Routing and scheduling
User problem
I have a system with two GPUs from different vendors, one being a nvidia GPU. I've had to setup two ollama instances locally on different ports to get this to work with different settings. I'd like to be able to expose both ollama instances to the cluster
Desired outcome
Both ollama instances show up for a node (or it appears as two nodes)
Alternatives considered
No response
Compatibility and security implications
No response
Validation approach
Launch two ollama instances on different ports, ideally with specific GPUs enabled for each
Confirmations
- I searched existing issues for duplicates.
- I agree to follow the Code of Conduct.
Guía de contribución
Primeros pasos
- Lee el issue completo y luego la guía de contribución del proyecto.
- Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
- Haz un fork del repositorio y trabaja en una rama.
- Abre un pull request que haga referencia al número del issue.
Línea de trabajo
Comienza por los puntos de entrada de routing y scheduling que descubren y exponen las instancias de Ollama. Traza cómo se representan el endpoint de Ollama y la configuración de un nodo, y determina después si dos instancias deben exponerse como nodos separados o como endpoints en un solo nodo. Valídalo iniciando dos instancias de Ollama en puertos diferentes con configuraciones de GPU separadas y confirmando que ambas aparecen en el clúster.
Escrito por el modelo de indexación a partir del texto del issue.
Evaluación
- Stack tecnológico
- go, ollama
- Área
- ai, backend
- Tipo de issue
- Nueva funcionalidad
- Dificultad
- 4/5
- Tiempo estimado
- 3-5 días
- Estado de actividad
- Activo
- Claridad
- Bastante claro
- Aptitud para principiantes
- 52/100