Compare commits

...
Author SHA1 Message Date
sirhcm 1babc5e7a9 test llm with --no_chat_template
Unit Tests / Linters (pull_request) Successful in 2m2s
Unit Tests / Models (pull_request) Successful in 1m29s
Unit Tests / Linux (DSP) (pull_request) Successful in 1m42s
Unit Tests / Docs (pull_request) Successful in 2m58s
Unit Tests / Test LLM (pull_request) Successful in 1m59s
Unit Tests / Python Backend (pull_request) Successful in 3m17s
Unit Tests / Null Tests (pull_request) Successful in 3m16s
Unit Tests / Torch Backend Training (pull_request) Successful in 3m25s
Unit Tests / Unit Tests (pull_request) Successful in 3m17s
Unit Tests / Fuzzing (pull_request) Successful in 2m57s
Check Line Counts / Check PR Branch status (pull_request_target) Successful in 13s
Unit Tests / openpilot Compile Tests (pull_request) Successful in 2m55s
Unit Tests / CL IMAGE Tests (pull_request) Successful in 3m14s
Unit Tests / AMD ASM IDE (pull_request) Successful in 2m35s
Unit Tests / Torch Backend Tests (pull_request) Successful in 4m17s
Unit Tests / hcq2 (pull_request) Successful in 2m40s
Check Line Counts / Core Library Line Difference (pull_request_target) Skipped
Unit Tests / SPEC=2 (1) (pull_request) Successful in 4m2s
Unit Tests / Linux (DEV=CPU:X86) (pull_request) Successful in 3m15s
Unit Tests / SPEC=2 (2) (pull_request) Successful in 3m55s
Unit Tests / Linux (DEV=CPU:LVP) (pull_request) Successful in 3m30s
Unit Tests / Linux (DEV=CPU:LLVM) (pull_request) Successful in 3m35s
Unit Tests / Optimization Tests (pull_request) Successful in 3m52s
Unit Tests / Linux (DEV=CL) (pull_request) Successful in 3m44s
Unit Tests / Compile-only (DEV=NULL:NAK:sm_120) (pull_request) Successful in 1m39s
Unit Tests / Linux (DEV=WEBGPU) (pull_request) Successful in 3m51s
Unit Tests / ONNX (CPU) Tests (pull_request) Failing after 4m17s
Unit Tests / Linux (DEV=CPU:CLANG) (pull_request) Successful in 4m22s
Unit Tests / Linux (am) (pull_request) Successful in 3m47s
Unit Tests / Linux (amdllvm gfx1100) (pull_request) Successful in 3m25s
Unit Tests / Compile-only (DEV=NULL:IR3:a630) (pull_request) Successful in 2m15s
Unit Tests / Linux (amd gfx1100) (pull_request) Successful in 3m48s
Unit Tests / Linux (amdllvm gfx1201) (pull_request) Successful in 3m18s
Unit Tests / Linux (amdllvm gfx950) (pull_request) Successful in 3m9s
Unit Tests / Linux (ptx) (pull_request) Successful in 3m1s
Unit Tests / Linux (amd gfx1201) (pull_request) Successful in 3m36s
Unit Tests / Linux (amd gfx950) (pull_request) Successful in 4m19s
Unit Tests / Linux (nv) (pull_request) Successful in 4m6s
Unit Tests / Compile-only (DEV=NULL:QCOMCL:a630) (pull_request) Successful in 3m55s
Platform Tests / MacOS (unit) (pull_request) Canceled after 0s
Platform Tests / MacOS (unit, mock) (pull_request) Canceled after 0s
Platform Tests / MacOS (DEV=METAL) (1) (pull_request) Canceled after 0s
Platform Tests / MacOS (DEV=METAL) (2) (pull_request) Canceled after 0s
Platform Tests / MacOS (DEV=CPU:CLANG) (pull_request) Canceled after 0s
Platform Tests / MacOS (DEV=CPU:LLVM) (pull_request) Canceled after 0s
Platform Tests / MacOS (DEV=CPU:LVP) (pull_request) Canceled after 0s
Platform Tests / MacOS (DEV=WEBGPU) (pull_request) Canceled after 0s
Platform Tests / Windows (DEV=CPU:CLANG) (pull_request) Canceled after 0s
Platform Tests / Windows (DEV=CPU:LLVM) (pull_request) Canceled after 0s
Platform Tests / Windows (DEV=CPU:X86) (pull_request) Canceled after 0s
Platform Tests / Windows (DEV=WEBGPU) (pull_request) Canceled after 0s
2026-08-27 15:11:36 -07:00
2 changed files with 6 additions and 5 deletions
+4 -4
View File
@@ -390,10 +390,10 @@ jobs:
run: |
parallel --link --tagstring '[{1}]' '{2}' \
::: llama 'llama q4' qwen3.5 qwen \
::: $'echo "What\'s a male chicken called? Answer with only one word." | python3 -m tinygrad.llm --model llama3.2:1b | tee /dev/stderr | grep -i rooster' \
$'echo "What\'s a male chicken called? Answer with only one word." | python3 -m tinygrad.llm --model llama3.2:1b-q4 | tee /dev/stderr | grep -i rooster' \
$'echo "What\'s a male chicken called? Answer with only one word." | python3 -m tinygrad.llm --model qwen3.5:0.8b | tee /dev/stderr | grep -i rooster' \
$'echo "What\'s a female chicken called? Answer with only one word." | python3 -m tinygrad.llm --model qwen3:0.6b | tee /dev/stderr | grep -i hen'
::: $'echo "What\'s a male chicken called? Answer with only one word." | python3 -m tinygrad.llm --no_chat_template --model llama3.2:1b | tee /dev/stderr | grep -i rooster' \
$'echo "What\'s a male chicken called? Answer with only one word." | python3 -m tinygrad.llm --no_chat_template --model llama3.2:1b-q4 | tee /dev/stderr | grep -i rooster' \
$'echo "What\'s a male chicken called? Answer with only one word." | python3 -m tinygrad.llm --no_chat_template --model qwen3.5:0.8b | tee /dev/stderr | grep -i rooster' \
$'echo "What\'s a female chicken called? Answer with only one word." | python3 -m tinygrad.llm --no_chat_template --model qwen3:0.6b | tee /dev/stderr | grep -i hen'
# NOTE: qwen is dumb and only knows about female chickens
# ****** Models Tests ******
+2 -1
View File
@@ -145,6 +145,7 @@ def main():
parser.add_argument("--serve", nargs='?', type=int, const=8000, metavar="PORT", help="Run OpenAI compatible API (optional port, default 8000)")
parser.add_argument("--warmup", action="store_true", help="warmup the JIT")
parser.add_argument("--benchmark", nargs='?', type=int, const=20, metavar="COUNT", help="Benchmark tok/s (optional count, default 20)")
parser.add_argument("--no_chat_template", action="store_true", help="Don't use the model's chat template, always use the fallback template")
args = parser.parse_args()
# load the model
@@ -160,7 +161,7 @@ def main():
# use the model's chat template if jinja2 is available (enables model-specific formatting)
template: jinja2.Template|FallbackTemplate = FallbackTemplate(tok)
if (ct := kv.get('tokenizer.chat_template')) is not None:
if not args.no_chat_template and (ct := kv.get('tokenizer.chat_template')) is not None:
try:
import jinja2
env = jinja2.Environment()