How-ToDevelopersSeptember 19, 2026

Tuning Qwen3.8-27B and Oh My Pi as a local coding agent on two RTX 3090s

Average wait per turn dropped from 28s to 7s after five omp setting changes: explicit effort level per role, a 6,000-7,500 token thinking budget, maxTokens raised from 8,192 to 32,768, tool output over 10 KB written to file, and at most 4 subagents.

1 source

More stories today

Open the live feed