Anton Gladkov · 2026-07-23 · source ↗ · whole document (6)
Вчера попросил Qwen поставить мне самые модные-сильные из существующих на рынке
Вчера попросил Qwen поставить мне самые модные-сильные из существующих на рынке бесплатных моделей для text-to-image и text-to-video генераций, которые идеально вывезет мой комп.
Сперва я думал что с видео я наверно схожу нахуй, потому что у меня как бы ноутбук. Окей у него 128GB памяти которая воспринимается так же как VRAM что великолепно для задачи, и M3 Max проц с 40 ядрами под видло, но это БЛЯДЬ НОУТБУК. Оказалось что даже самая мощная из моделей алибабашная wan2.2 вполне себе готова работать с таким железом. Причем не так что неделю будет генериться видос, а в 3-20 раз дольше чем самых топовых RTX, в зависимости от свойств запрошенного видео.
В итоге на самых максималках FP16 и макс параметрах видоса комп завис.
Однако на FP8 и средних параметрах уже заработало.
Вот этот видосик сгенерирован нахаляву у меня на компе на МИНИМАЛЬНЫХ настройках качества. Представляете какие тогда там максимальные?:))))
Хочу попробовать отдать % мощности ноута под пассивное изготовление моделями различного контента тупо в образовательных целях;)
Ну а по Text-to-image все предельно просто:
https://www.youtube.com/watch?v=OA4gchz1Zcs
Я попросил Qwen транскрибнуть этот видос локальным виспером, изучить транскрипт, понять все технологии максимально пиздатые для моего компа которые обсуждались в этом видео, и установить и настроить все так чтобы у меня тупо появился в докере ярлык который я могу нажать и попасть туда где все просто и очевидно.