puding 🥣 — model results

LLM benchmark on a GB10 (Nvidia Spark GX10, 128GB unified memory). Each model gets the same coding prompts via an OpenAI-compatible API; I record speed and token usage, and keep the generated artifact (an SVG or a single-file app) so you can open it below. Github: https://github.com/polaroi8d/puding

Ornith-1.0-35B

PromptTTFTTotal TimePrompt TokCompletion TokTotal TokSpeed
SVG Pelican on a Bicycle0.381s106.251s653168323329.8 tok/s
Todo App0.702s77.964s11222305342729.6 tok/s

Qwen/Qwen-AgentWorld-35B-A3B

PromptTTFTTotal TimePrompt TokCompletion TokTotal TokSpeed
SVG Pelican on a Bicycle1.442s528.341s65155521561729.4 tok/s
Todo App1.923s336.832s112299091103129.4 tok/s

Qwen/Qwen3-Coder-30B-A3B-Instruct-FP8

PromptTTFTTotal TimePrompt TokCompletion TokTotal TokSpeed
SVG Pelican on a Bicycle0.241s16.496s6390096354.6 tok/s
Todo App0.645s29.208s10821525260752.2 tok/s

Qwen/Qwen3.6-35B-A3B

PromptTTFTTotal TimePrompt TokCompletion TokTotal TokSpeed
SVG Pelican on a Bicycle1.501s264.784s657720778529.2 tok/s
Todo App2.129s87.112s11222560368229.4 tok/s

Qwen3-Coder-Next-FP8

PromptTTFTTotal TimePrompt TokCompletion TokTotal TokSpeed
SVG Pelican on a Bicycle0.386s38.387s631822188547.5 tok/s
Todo App0.844s50.049s10822346342846.9 tok/s

mistralai/Codestral-22B-v0.1

PromptTTFTTotal TimePrompt TokCompletion TokTotal TokSpeed
SVG Pelican on a Bicycle0.835s80.331s654314965.4 tok/s
Todo App1.117s61.132s125432415785.3 tok/s

openai/gpt-oss-20b

PromptTTFTTotal TimePrompt TokCompletion TokTotal TokSpeed
SVG Pelican on a Bicycle2.99s12.262s12451163541.7 tok/s
Todo App9.476s36.043s11461613275944.8 tok/s

qwen38-27b-unsloth-nvfp4

PromptTTFTTotal TimePrompt TokCompletion TokTotal TokSpeed
SVG Pelican on a Bicycle1534.338s1735.15s103315953169818.2 tok/s
Todo App773.128s1007.585s1160197572091719.6 tok/s