Qwen 27B na Q3 kvantizaci napsal WebGL hlavu od nuly

Lokální model Qwen 27B na kvantizaci Q3 napsal z ničeho WebGL render lidské hlavy — bez knihoven, na dvou RTX 3060 Ti. Výsledek je vtipně děsivý, ale ukazuje, jak daleko malé lokální modely v kreativním kódování došly.

Co se stalo

Uživatel položil svému lokálnímu modelu jednoduchý úkol: „vyrob mi lidskou hlavu ve WebGL od nuly, bez knihoven”. Model Qwen 27B na kvantizaci Q3 (konkrétně Q3_K_M K6V4) to vzal doslova — a z bezmála nulového zadání vygeneroval kompletní WebGL scénu.

Výsledek? Trojrozměrná hlava, která vypadá přesně tak, jak byste čekali od modelu, který se nikdy na žádnou hlavu přímo nedíval. Komunita reagovala směsicí pobavení a respektu.

Hardware, na kterém to běželo, přitom není nijak výjimečný: dvě RTX 3060 Ti. Model tedy nepotřebuje datacentrové GPU, aby zvládl kreativní kód od nuly.

Proč je na tom Q3 kvantizace zajímavá

Kvantizace Q3 znamená, že váhy modelu jsou uložené s velkou úsporou paměti na úkor přesnosti. Pro 27B model to znamená běh na běžném herním GPU, které by plnou precizní verzi modelu neudržel ve VRAM.

Přesto Qwen 27B v Q3 zvládl úkol, který vyžaduje:

  • Znalost WebGL API a jeho render pipeline
  • Matematiku pro modelování 3D geometrie (mesh, vertex shader)
  • Dávku kreativity — napsat generický kód, který vyrobí něco rozpoznatelného
  • Kompletní samostatnost — bez frameworků a knihoven

Už samotný fakt, že model „ví”, jak se v prohlížeči skládá 3D scéna od nuly, je ukázka toho, kolik znalostí se vejde do relativně malého modelu.

Srovnání: jinde to bylo horší

Zajímavý kontext přinesl jeden uživatel, který porovnal výsledek s tím, co mu vygeneroval Qwen3.5 122B-A10B na stejný úkol:

„Ano, je to naprosto děsivé, ale rozhodně je to krok vpřed oproti tomu, když jsem to nechal udělat Qwen3.5 122B-A10B. Pokrok.” — TheWolfOfWalmart

Tedy: 27B model na Q3 kvantizaci podává na tuhle úlohu lepší výsledek než výrazně větší model z předchozí generace. Někdo zkoušel i Gemini Flash 3.7 — ale na ten samý požadavek to dopadlo podobně.

Jiná reakce to trefila přesně:

„vypadá to jako typický příspěvek ze začátečnické 3D sculpting skupiny, a Qwen je rozhodně začínající sochař, takže jsem ohromen” — baby_bloom

Reakce komunity

Vlákno se neslo v zábavném duchu, ale kromě vtipů se v něm objevily i postřehy k tomu, co to znamená:

  • „Teď to ukaž přátelům a rodině a uvidíš, jak snadno je přesvědčíš, že to je skutečný pokrok.” — synystar (114 bodů)
  • „Jak je to vtipné a děsivé zároveň, byl jsem docela ohromen.” — DontWinFrensWthSalad
  • Někdo obratem navrhl: „Teď ty vyrob lidskou hlavu ve WebGL od nuly, šampionu.” — createthiscom

Co si z toho odnést

Malé lokální modely umí kreativní kód. Nemusíte mít obří VRAM ani cloudové API — Qwen 27B v Q3 na dvou 3060 Ti vygeneroval funkční WebGL scénu od nuly. Pro experimenty s generováním kódu je to víc než dostatečný nástroj.

Kvantizace není jen „úspora” — je to dostupnost. Q3 sice ztrácí na přesnosti, ale umožňuje běh na běžném hardware. Pro úlohy, kde nezáleží na špičkové kvalitě, je to rozumný kompromis.

Výsledek odráží hranice modelu. Model ukázal, že „zná” WebGL, ale ne „vidí” reálnou hlavu. Kreativní kód od modelu je jako sochařství začátečníka — obdivuhodné, že to umí, ale výsledek je třeba brát s rezervou a dál iterovat.

Pro každého, kdo si chce lokálně vyzkoušet generování kódu bez velkých investic, je tahle kombinace (Qwen 27B + kvantizace + 8–12 GB VRAM) velmi dobrý výchozí bod.

Inspirace: Behold the power of 27B on Q3!

Leave a Reply