AnalysisAI ModelsAugust 18, 2026

Qwen3.8-27B: slower tokens, faster and better results

Qwen3.8-27B, released Friday, delivers better wall-clock results despite slower tokens per second, making 32 GB VRAM useful. The author tested it on real codebases over three days, arguing that xhigh reasoning effort is not wasteful and that 8-bit quants beat 4-bit.

1 source

AI Models by email

Get an email when there's news on AI Models

No news that day, no email.

More stories today

Open the live feed
Qwen3.8-27B: slower tokens, faster and better results