Triton Grouped Matrix Multiplication (Almost CUDA Performance!) A MyTorch Sidequest4просмотра5 месяцев назад
Can Speech Be Tokenized Like Text A Brief Exploration of Neural Codec Models6просмотров5 месяцев назад
2) The Autogradless Transformer Training a GPT2 Model With Nothing but Numpy!3просмотра5 месяцев назад
1) The Autogradless Transformer Training a GPT2 Model With Nothing but Numpy!5просмотров5 месяцев назад