Propriétaire
AI-Hypercomputer
14 dépôts indexés · Voir sur GitHub
-
maxtext
A simple, performant, and scalable Jax LLM!
Python · 2420 étoiles
-
JetStream
JetStream is a throughput and memory optimized engine for LLM inference on XLA devices, starting with TPUs (and GPUs in future -- PRs wel...
Python · 457 étoiles
-
Python · 386 étoiles
-
Python · 226 étoiles
-
xpk
xpk (Accelerated Processing Kit, pronounced x-p-k,) is a software tool to help Cloud developers to orchestrate training jobs on accelerat...
Python · 193 étoiles
-
gpu-recipes
Recipes for reproducing training and serving benchmarks for large machine learning models using GPUs on Google Cloud.
Python · 140 étoiles
-
Shell · 126 étoiles
-
Python · 78 étoiles
-
Python · 41 étoiles
-
Python · 32 étoiles
-
Python · 24 étoiles
-
Python · 15 étoiles
-
resiliency
This project provides resilient training logic to improve the training efficiency of large-scale distributed workloads on Google Cloud.
Python · 14 étoiles
-
Python · 14 étoiles
-
AI-Hypercomputer/maxtext#1774 · 3 commentaires · 0 réactions · 1 personne assignée ·
-
AI-Hypercomputer/maxtext#1817 · 2 commentaires · 0 réactions · 1 personne assignée ·
-
[OOM] Huge memory usage in MoE Ouverte
AI-Hypercomputer/maxtext#1828 · 1 commentaire · 0 réactions · 1 personne assignée ·
-
[REQUEST] Qwen3 support Ouverte
AI-Hypercomputer/maxtext#1831 · 1 commentaire · 1 réaction · 1 personne assignée ·
-
bug
AI-Hypercomputer/maxtext#2147 · 4 commentaires · 0 réactions · 1 personne assignée ·
-
bug
AI-Hypercomputer/maxtext#2176 · 2 commentaires · 0 réactions · 2 personnes assignées ·
-
bug
AI-Hypercomputer/maxtext#2179 · 2 commentaires · 0 réactions · 1 personne assignée ·
-
bug
AI-Hypercomputer/maxtext#2193 · 4 commentaires · 0 réactions · 1 personne assignée ·
-
bug
AI-Hypercomputer/maxtext#2305 · 0 commentaires · 0 réactions · 1 personne assignée ·
-
feature request
AI-Hypercomputer/maxtext#2330 · 3 commentaires · 0 réactions · 1 personne assignée ·
-
bug
AI-Hypercomputer/maxtext#2374 · 1 commentaire · 0 réactions · 1 personne assignée ·
-
wandb logging support Ouvertefeature request
AI-Hypercomputer/maxtext#2434 · 5 commentaires · 0 réactions · 1 personne assignée ·
-
bug
AI-Hypercomputer/maxtext#2542 · 4 commentaires · 0 réactions · 2 personnes assignées ·
-
bug
AI-Hypercomputer/maxtext#2578 · 1 commentaire · 0 réactions · 1 personne assignée ·
-
AI-Hypercomputer/maxtext#2593 · 0 commentaires · 0 réactions · 1 personne assignée ·
-
bug
AI-Hypercomputer/maxtext#2664 · 1 commentaire · 0 réactions · 1 personne assignée ·
-
feature request
AI-Hypercomputer/maxtext#2861 · 1 commentaire · 0 réactions · 1 personne assignée ·
-
Gemma3 to hf mapping error Ouvertebug
AI-Hypercomputer/maxtext#2867 · 5 commentaires · 0 réactions · 1 personne assignée ·
-
Grain pool is exiting Ouvertebug
AI-Hypercomputer/maxtext#2878 · 3 commentaires · 0 réactions · 1 personne assignée ·
-
bug
AI-Hypercomputer/maxtext#3003 · 2 commentaires · 0 réactions · 1 personne assignée ·
-
bug
AI-Hypercomputer/maxtext#3231 · 2 commentaires · 0 réactions · 1 personne assignée ·
-
[Bug] Tunix GRPO VllmRollout.get_per_token_logps API mismatch and JAX concatenate type error Ouvertebug
AI-Hypercomputer/maxtext#3363 · 3 commentaires · 0 réactions · 1 personne assignée ·
-
bug
AI-Hypercomputer/maxtext#3381 · 0 commentaires · 0 réactions · 1 personne assignée ·
-
bug
AI-Hypercomputer/maxtext#3418 · 3 commentaires · 0 réactions · 1 personne assignée ·
-
bug
AI-Hypercomputer/maxtext#3520 · 2 commentaires · 0 réactions · 1 personne assignée ·
-
feature request
AI-Hypercomputer/maxtext#3646 · 1 commentaire · 0 réactions · 1 personne assignée ·
-
Qwen3-Next: sequential GDN paths (lax.scan recurrence, solve_triangular) bound TPU step time Ouverte
AI-Hypercomputer/maxtext#4347 · 1 commentaire · 0 réactions · 1 personne assignée ·
-
bug
AI-Hypercomputer/maxtext#4476 · 1 commentaire · 0 réactions · 1 personne assignée ·
-
AI-Hypercomputer/maxtext#4510 · 2 commentaires · 0 réactions · 1 personne assignée ·
-
docker-image-build-failure
AI-Hypercomputer/maxtext#4596 · 101 commentaires · 0 réactions · 1 personne assignée ·
-
bug
AI-Hypercomputer/maxtext#4611 · 1 commentaire · 0 réactions · 0 personnes assignées ·
-
bug
AI-Hypercomputer/maxtext#4612 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
AI-Hypercomputer/maxtext#4616 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
AI-Hypercomputer/maxtext#4690 · 0 commentaires · 0 réactions · 1 personne assignée ·
-
bug
AI-Hypercomputer/maxtext#4712 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
AI-Hypercomputer/maxtext#4888 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
AI-Hypercomputer/maxtext#4931 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
Multi-host config validation assumes 1 device, so global_batch_size_to_train_on is derived wrong Ouverte
AI-Hypercomputer/maxtext#4933 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
AI-Hypercomputer/maxtext#5106 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
AI-Hypercomputer/maxtext#5129 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
documentation
AI-Hypercomputer/maxtext#5157 · 0 commentaires · 0 réactions · 1 personne assignée ·
-
build failed
AI-Hypercomputer/maxtext#5190 · 19 commentaires · 0 réactions · 0 personnes assignées ·
-
bug
AI-Hypercomputer/maxtext#5195 · 2 commentaires · 0 réactions · 0 personnes assignées ·
-
AI-Hypercomputer/maxdiffusion#101 · 2 commentaires · 0 réactions · 0 personnes assignées ·
-
AI-Hypercomputer/maxdiffusion#138 · 7 commentaires · 0 réactions · 0 personnes assignées ·
-
AI-Hypercomputer/maxdiffusion#161 · 1 commentaire · 0 réactions · 0 personnes assignées ·
-
AI-Hypercomputer/maxdiffusion#279 · 3 commentaires · 0 réactions · 0 personnes assignées ·
-
AI-Hypercomputer/maxdiffusion#318 · 2 commentaires · 0 réactions · 0 personnes assignées ·
-
AI-Hypercomputer/maxdiffusion#343 · 1 commentaire · 0 réactions · 1 personne assignée ·
-
AI-Hypercomputer/maxdiffusion#362 · 3 commentaires · 0 réactions · 0 personnes assignées ·