RT @karpathy: Highly amusing update, ~18 hours later:
llm.c is now down to 26.2ms/iteration, exactly matching PyTorch (tf32 forward pass).…
llm.c is now down to 26.2ms/iteration, exactly matching PyTorch (tf32 forward pass).…
Una entrada del archivo público.