Dans l'actualité
To Infinity and Beyond: ThunderKittens Now on NVIDIA Vera Rubin NVL72!
Together AI · Publié le · 3 min de lecture
En 30 secondes
- Ce qui s'est passé
- Together AI optimized ThunderKittens GEMM kernels for NVIDIA Vera Rubin NVL72, achieving over 22 PFLOPS on NVFP4 operations.
- Pourquoi ça compte
- Pertinent pour les ingénieurs développant des kernels de multiplication matricielle haute performance sur les GPU NVIDIA nouvelle génération nécessitant une optimisation ISA bas niveau.
- Vigilance
- Les optimisations sont très spécifiques à l'architecture Vera Rubin; les gains de chaque feature varient selon la taille des workloads et ne se transfèrent pas nécessairement.
The Agent Architect
Un pattern, un compromis, une panne de production racontée. Un brief hebdomadaire court pour ceux qui construisent des systèmes agentiques.
Un email par semaine, désinscription en un clic. Votre adresse ne sert qu'à envoyer le brief.