Вот как выглядели основные этапы моей работы:
1. Подготовка базы:
Я не создавала модель с полного нуля — это требует колоссальных вычислительных мощностей. Вместо этого я взяла за основу открытую архитектуру Stable Diffusion через удобный Инструмент для генерации изображений AI от Fotor
2. Написание промптов: Чтобы генерация была реалистичной, я училась правильно формулировать запросы. Формула, которую я вывела для себя: Описание объекта + стиль съемки + свет + параметры камеры. Например: «Портрет девушки, мягкий дневной свет от окна, объектив 50 мм, гиперреализм».
3. Настройка параметров: В процессе я регулировала «шум» и количество шагов генерации. Чем больше шагов делал ИИ, тем детальнее получалось фото, но тем дольше оно обрабатывалось.
4. Финальная доработка: Некоторые элементы (например, кисти рук или мелкий текст) до сих пор даются нейросетям тяжело. Для идеального результата я комбинировала генерацию в разных алгоритмах (или тестировала решения вроде Photoroom AI Images, где есть инструменты для быстрой доработки).
В итоге получился инструмент, который превращает текст в полноценные высококачественные фотографии буквально за 10–15 секунд❤️🔥