Viggle выложила на Hugging Face ускоренную Qwen-Image-2.1.
Она рисует по тексту и правит картинки за 6 шагов вместо 40, в итоге примерно в 5 раз быстрее.
Это надстройка (LoRA) к исходной модели, весит 1,3 ГБ, есть облегчённый вариант на 680 МБ. Запускается через diffusers и ComfyUI.
На 96 запросах против полной модели:
1) разнообразие картинок почти то же, 0,98 от исходного 2) композиция и расположение объектов не поменялись 3) мелкий текст на картинке путается чаще
Но сложные правки выходят хуже: сборка из нескольких образцов, замена лица, сохранение внешности человека. И образцов для правки она берёт до 3, у полной модели до 10.
Лицензия прежняя, исследовательская: для коммерции нужна отдельная лицензия от Qwen.
Для черновиков и перебора идей 6 шагов хватает, а финальную картинку с надписями надёжнее отдать полной модели.
https://huggingface.co/Viggle/Qwen-Image-2.1-viggle-turbo
Комментарии
Комментариев пока нет. Будьте первым!