Files
tinygrad/examples/mlperf
qazalandGitHub 22722ea2e7
Autogen / In-tree Autogen (comgr 2) (push) Successful in 45s
Unit Tests / Torch Backend Tests (push) Failing after 56s
Unit Tests / Linters (push) Failing after 1m25s
Unit Tests / Python Backend (push) Failing after 3m5s
Unit Tests / Fuzzing (push) Failing after 23s
Unit Tests / Docs (push) Successful in 3m32s
Unit Tests / Null Tests (push) Successful in 3m59s
Unit Tests / CL IMAGE Tests (push) Failing after 43s
Unit Tests / Unit Tests (push) Successful in 3m32s
Unit Tests / openpilot Compile Tests (push) Failing after 46s
Unit Tests / Test LLM (push) Failing after 15s
Deploy Docs / deploy (push) Successful in 4m35s
Unit Tests / SPEC=2 (1) (push) Successful in 3m49s
Unit Tests / Optimization Tests (push) Failing after 48s
Unit Tests / Linux (DEV=CL) (push) Failing after 36s
Unit Tests / SPEC=2 (2) (push) Successful in 3m50s
Unit Tests / Linux (DEV=CPU:X86) (push) Failing after 23s
Unit Tests / Linux (DSP) (push) Successful in 1m41s
Unit Tests / Models (push) Successful in 3m30s
Unit Tests / Linux (DEV=CPU:LVP) (push) Successful in 3m8s
Unit Tests / Linux (DEV=CPU:LLVM) (push) Successful in 3m20s
Unit Tests / hcq2 (push) Failing after 50s
Unit Tests / AMD ASM IDE (push) Failing after 2m45s
Unit Tests / Linux (DEV=CPU:CLANG) (push) Successful in 4m25s
Unit Tests / Linux (am) (push) Failing after 55s
Unit Tests / ONNX (CPU) Tests (push) Successful in 5m28s
Autogen / In-tree Autogen (push) Successful in 10m45s
Unit Tests / Linux (DEV=WEBGPU) (push) Failing after 5m4s
Unit Tests / Linux (amdllvm gfx1100) (push) Successful in 3m51s
Unit Tests / Linux (amd gfx1100) (push) Successful in 4m23s
Unit Tests / Compile-only (ir3) (push) Failing after 28s
Unit Tests / Linux (amdllvm gfx1201) (push) Successful in 3m53s
Unit Tests / Compile-only (nak) (push) Failing after 28s
Unit Tests / Linux (amd gfx1201) (push) Failing after 4m33s
Unit Tests / Linux (amdllvm gfx950) (push) Successful in 4m5s
Unit Tests / Linux (ptx) (push) Failing after 3m24s
Unit Tests / Linux (amd gfx950) (push) Successful in 5m55s
Unit Tests / Linux (nv) (push) Failing after 5m17s
Autogen / In-tree Autogen (macos) (push) Canceled after 0s
Benchmarks / Mac pytest (push) Canceled after 0s
Benchmarks / LLM (DEV=AMD) (push) Canceled after 0s
Benchmarks / LLM (DEV=METAL) (push) Canceled after 0s
Benchmarks / LLM (DEV=NV) (push) Canceled after 0s
Benchmarks / HLB-CIFAR10 (DEV=AMD) (push) Canceled after 0s
Benchmarks / HLB-CIFAR10 (DEV=METAL) (push) Canceled after 0s
Benchmarks / HLB-CIFAR10 (DEV=NV) (push) Canceled after 0s
Benchmarks / MLPerf (AMD) (push) Canceled after 0s
Benchmarks / MLPerf (NV) (push) Canceled after 0s
Benchmarks / Stable Diffusion (DEV=AMD) (push) Canceled after 0s
Benchmarks / Stable Diffusion (DEV=METAL) (push) Canceled after 0s
Benchmarks / Stable Diffusion (DEV=NV) (push) Canceled after 0s
Benchmarks / Tests (DEV=AMD) (push) Canceled after 0s
Benchmarks / Tests (DEV=METAL) (push) Canceled after 0s
Benchmarks / Tests (DEV=NV) (push) Canceled after 0s
Benchmarks / UsbGPU Benchmark (push) Canceled after 0s
Benchmarks / comma Benchmark (0.11.2) (push) Canceled after 0s
Benchmarks / comma Benchmark (0.11.0) (push) Canceled after 0s
Benchmarks / DSP Benchmark (push) Canceled after 0s
Benchmarks / UsbGPU Benchmark (comma) (push) Canceled after 0s
Benchmarks / PCI Driver Benchmark (DEV=AMD) (push) Canceled after 0s
Benchmarks / PCI Driver Benchmark (DEV=NV) (push) Canceled after 0s
Benchmarks / LLVM Speed (push) Canceled after 0s
Platform Tests / MacOS (unit) (push) Canceled after 0s
Platform Tests / MacOS (unit, mock) (push) Canceled after 0s
Platform Tests / MacOS (DEV=METAL) (1) (push) Canceled after 0s
Platform Tests / MacOS (DEV=METAL) (2) (push) Canceled after 0s
Platform Tests / MacOS (DEV=CPU:CLANG) (push) Canceled after 0s
Platform Tests / MacOS (DEV=CPU:LLVM) (push) Canceled after 0s
Platform Tests / MacOS (DEV=CPU:LVP) (push) Canceled after 0s
Platform Tests / MacOS (DEV=WEBGPU) (push) Canceled after 0s
Platform Tests / Windows (DEV=CPU:CLANG) (push) Canceled after 0s
Platform Tests / Windows (DEV=CPU:LLVM) (push) Canceled after 0s
Platform Tests / Windows (DEV=CPU:X86) (push) Canceled after 0s
Platform Tests / Windows (DEV=WEBGPU) (push) Canceled after 0s
Platform Tests / Compile-only (QCOM CL) (push) Canceled after 0s
llama: correct optim_dtype for mxfp4 (#17482)
2026-08-11 03:01:28 +09:00
..
2026-01-09 09:21:59 -05:00
2025-06-21 10:44:47 -04:00
2026-08-01 09:10:06 -07:00
2023-05-10 16:30:49 -07:00

Each model should be a clean single file.
They are imported from the top level `models` directory

It should be capable of loading weights from the reference imp.

We will focus on these 5 models:

# Resnet50-v1.5 (classic) -- 8.2 GOPS/input
# Retinanet
# 3D UNET (upconvs)
# RNNT
# BERT-large (transformer)

They are used in both the training and inference benchmark:
https://mlcommons.org/en/training-normal-21/
https://mlcommons.org/en/inference-edge-30/
And we will submit to both.

NOTE: we are Edge since we don't have ECC RAM