diff --git a/apps/game/tools/aiart/probe-b3/frame_16x24.png b/apps/game/tools/aiart/probe-b3/frame_16x24.png new file mode 100644 index 0000000..9b14c45 --- /dev/null +++ b/apps/game/tools/aiart/probe-b3/frame_16x24.png Binary files differ diff --git a/apps/game/tools/aiart/probe-b3/frame_16x24_x8.png b/apps/game/tools/aiart/probe-b3/frame_16x24_x8.png new file mode 100644 index 0000000..91ced5a --- /dev/null +++ b/apps/game/tools/aiart/probe-b3/frame_16x24_x8.png Binary files differ diff --git a/docs/plan.md b/docs/plan.md index 73fd437..819a9e3 100644 --- a/docs/plan.md +++ b/docs/plan.md @@ -28,9 +28,11 @@ ## Ограничения (читать первым) - **Машина разработки: Intel HD 620 (iGPU, нет CUDA), 15 ГБ RAM, 4 ядра CPU.** - Только CPU-инференс. Модели класса SDXL/FLUX/SANA/DreamLite отпадают либо - как «медленный офлайн-пакет» (десятки минут на картинку). Целевой класс — - компактные модели (< 1.5B параметров) и INT8/4-бит квантизация, CPU-рантаймы. + Только CPU-инференс (подтверждено пробой ускорителей, см. B3). Модели класса + SDXL/FLUX/SANA/DreamLite отпадают либо как «медленный офлайн-пакет» (десятки + минут на картинку). Целевой класс — компактные модели (< 1.5B параметров), + CPU-рантаймы; главный бесплатный рычаг скорости — меньше шагов диффузии, + а не квантизация и не iGPU. - **Стиль игры жёсткий**: палитра 32 цветов (`tools/pixelart/palette.mjs`), размеры спрайтов по `docs/art-style.md`, pixel-perfect. Любая AI-генерация — только как **сырьё** с обязательной пост-обработкой: даунскейл nearest, @@ -123,6 +125,18 @@ рабочий для разовых атласов (4 вида ≈ 30 мин/персонажа), но кадры-позы придётся дорабатывать руками; полный прогон — при потребности акта 2. Пробы: `apps/game/tools/aiart/probe-b3/`. Фолбэк — RD API или ручной арт. +- **B3-доп (ускорители, 2026-09-06)**: альтернативные пути разгона проверены и + **отвергнуты**, остаёмся на fp32-CPU (diffusers, 4 потока): + - **iGPU HD 620 (Vulkan/ggml)** — не готовился к прогону осознанно: стек + Vulkan в системе есть (Mesa ANV Gen9.5, glslc), но HD 620 — 24 EU и общая + с CPU память ~30 ГБ/с, т.е. на порядок слабее CPU в матмулах; ggml-Vulkan + на Gen9.5 обычно даёт 10–25 мин на SD1.5 512²×20 — сравнимо или хуже. + OpenCL мёртв: intel-compute-runtime 26.x — только Tiger Lake+ (Gen9.5 — + legacy-ветки). Оставлено как есть, без бенчмарка. + - **Квантование q8_0/q4** — отвергнуто ранее: на 7-м поколении без VNNI + ggml-ядра int8 медленнее fp32-oneDNN (34 мин против 11), VAE в q8 шумит. + - **Меньше шагов** — единственный рабочий рычаг: 25→15 шагов даёт 11→6.6 мин + без видимой деградации кадра; ниже 15 качество токен-ракурса падает. ---