Triton Grouped Matrix Multiplication (Almost CUDA Performance!) A MyTorch Sidequest4просмотра5 месяцев назад
Can Speech Be Tokenized Like Text A Brief Exploration of Neural Codec Models6просмотров6 месяцев назад
2) The Autogradless Transformer Training a GPT2 Model With Nothing but Numpy!3просмотра6 месяцев назад
1) The Autogradless Transformer Training a GPT2 Model With Nothing but Numpy!5просмотров6 месяцев назад