AlibabaResearch / AlibabaResearch/flash-llm

Incorpopration with llama 2?

Abierto
#8 5 comentarios 0 reacciones 0 asignados Ver en GitHub
Lenguaje dominante
Cuda
Estrellas
247
Forks
24
Métricas de merge de PR
Sin PR fusionados en 30 d

Descripción

Is it possible to use this in llama 2? I'm interested in improving the inference speed so the accuracy loss doesn't matter right now

Guía de contribución

No hay ninguna guía de contribución indexada para este repositorio

Evaluación

Este issue todavía no se ha evaluado.

Recibe los nuevos issues en tu correo

Un resumen breve de issues de GitHub para principiantes.