AI-Hypercomputer / AI-Hypercomputer/maxtext
Support LoRA training
Offen
feature request
- Vorherrschende Sprache
- Python
- Sterne
- 2.4k
- Forks
- 607
- Ø Merge
- 2 T. 19 Std.
- Gemergte PRs (30 T.)
- 158
Beschreibung
Is there a plan to support PEFT methods like LoRA training in maxtext to support larger model fine-tuning / continue pretraining so that bigger models like LLaMA-3-70B can be trainined even with small amount of TPU/GPUs?
Beitragsleitfaden
Bewertung
Dieses Issue wurde noch nicht bewertet.