Обучение генеративной нейросети под стиль Джоанны Куинн на Deziiign
Исходный размер 1750x2480

Обучение генеративной нейросети под стиль Джоанны Куинн

Джоанна Куинн (Joanna Quinn) — британская художница-аниматор, режиссёр и иллюстратор.

Её работы запоминаются своеобразным стилем, похожим на быстрые и экспрессивные карикатурные наброски.

0

Работы Джоанны Куинн

Идея проекта

Как студентка направления «Анимация», я часто обращаю внимание на художественное решение работ различных режиссеров. Работы Джоанны Куинн поразили меня с первого взгляда. Стиль этой художницы очень смелый и экспрессивный: небрежные линии контура, текстура карандаша. Джоанна создает выразительных персонажей иногда слегка преувеличивая их черты. Можно также заметить, что она не боится экспериментировать с ракурсами и формами. Характерной особенностью стиля также являются приглушенные и слегка растушеванные цвета.

big
Исходный размер 2480x815

Кадры из мультфильма «Дела искусства», Джоанна Куинн, 2021

Мне стало интересно проанализировать основные особенности изобразительного стиля Джоанны Куинн и обучить им модель искусственного интеллекта, чтобы затем попробовать создать изображения в похожем стиле.

Так как сейчас в городе постепенно наступает весна, мне захотелось отразить её и в итоговой серии изображений. Таким образом, я постаралась показать в финальной версии картинок героиню, наслаждающуюся цветами и легкостью весенних дней.

big
Исходный размер 1152x648

Работа Джоанны Куинн

Обучение модели

Для обучения модели я взяла 73 изображения Джоанны Куинн. Некоторые иллюстрации были взяты с её сайта, а некоторые изображения были кадрами из её анимационных работ.

Обучение генеративной модели было выполнено в Google Colab.

Работу я начала с загрузки всех необходимых библиотек и обучающего скрипта с GITHUB

Исходный размер 3502x1814

фрагмент кода для проверки использования GPU

Исходный размер 3502x2017

фрагмент кода

Следующим шагом было создание директории и загрузка датасета для обучения модели. С помощью функции image_grid, я проверила успешно ли отображаются загруженные изображения

Исходный размер 3502x872

фрагмент кода

Исходный размер 3502x1801

фрагмент кода

Далее нейросеть должна была проанализировать изображения из датасета и написать для них промпты, для дальнейшего обучения. (Генерация описаний сделана с помощью модели BLIP)

Исходный размер 3502x1764

фрагмент кода

Исходный размер 3502x1476

фрагмент кода, проверка подписей к изображениям

После этого был выполнен сам процесс обучения модели. Он занял у меня около двух часов

Исходный размер 3502x1558

фрагмент кода

Перед обучением я ввела токен, созданный на Hugging Face для записи обучающей модели. И после окончания процесса тренировки, модель была сохранена на там.

Исходный размер 3502x2170

фрагмент кода

Исходный размер 3502x1638

фрагмент кода

Далее я приступила к процессу генерации изображений с помощью промптов

Исходный размер 3502x490

пример кода с промптом

Процесс генерации изображений

Исходный размер 2480x815

изображения, созданные обученной нейросетью

Поначалу нейросеть выдавала очень похожие и слишком гладкие изображения. Однако, в них узнавался характерный стиль Джоанны: округлые черты лица, маленькие глаза и большой пухлый нос, приоткрытый рот, очки и рыжие волосы.

Промпты: — a girl is studying — a young girl is talking on the phone — a woman is hugging a dog

Исходный размер 2480x1228

изображения, созданные обученной нейросетью

Некоторые изображения получались более экспрессивными.

Промпты: — a man is screaming — a woman is smiling

Поэкспериментировав с настройками модели lora, удалось немного скорректировать стиль рисовки.

Исходный размер 2480x1228

изображения, созданные обученной нейросетью

Обучение генеративной нейросети под стиль Джоанны Куинн
Проект создан 10.04.2025