Engineering 21. Juni 2026
Unser lokaler KI-Coding-Stack: Qwen3.6-35B auf vLLM — die echten Zahlen
Wie wir Qwen3.6-35B als Coding-Assistenten auf eigener Hardware betreiben — vLLM, FP8, 256K Kontext, Speculative Decoding. Mit echten Betriebs-Messwerten.
Weiterlesen →