AnalysisAI ModelsOctober 4, 2026

Local parkour sim built with GLM 5.3 Flash on 2x DGX Sparks

Read original source →reddit.com

A Reddit user built a fully local parkour simulation using GLM 5.3 Flash on two DGX Sparks, hitting ~1500 tokens/s prefill and ~40 tokens/s decode at 100k context. A vLLM TP2 recipe with NVFP4 weights was published to GitHub.

1 source

More stories today

Open the live feed