Содержание
- 1. Май 2026: DALL·E ушёл в отставку — смена поколений в ИИ-генерации изображений
- 2. 8 главных инструментов с высоты птичьего полёта
- 3. По сильным сторонам — куда целиться
- 4. Модели оплаты — подписка против оплаты за изображение
- 5. По сценариям — гид «выбирайте это»
- 6. Типичные ловушки — коммерческое использование, авторское право, отрисовка текста
- Итоги
- FAQ
12 мая 2026 года DALL·E 2 / DALL·E 3 были отключены в API OpenAI (страница Deprecations OpenAI). Их преемник GPT Image 2 (вышел 21 апреля) уже 8 сентября обновился до ChatGPT Images 2.5. Google 17 августа закрыл Imagen 4 в Gemini API и перевёл генерацию изображений на Nano Banana 2 (Gemini 3.1 Flash Image). Midjourney 24 июля сделал моделью по умолчанию V8.2, Black Forest Labs выпустила FLUX.2, Ideogram выпустил 4.0 с открытыми весами, а Recraft дошёл до V4.1.
Вывод: на сентябрь 2026 года ни один ИИ для изображений больше не доминирует в одиночку. Это не 2024-й, когда Midjourney был единоличным лидером. И не 2023-й, когда SDXL царил среди бесплатных. Теперь выбор определяется тем, что вы делаете.
Сразу моё мнение: если можно оформить подписку только на один инструмент — берите Midjourney V8.2 ($10/мес.). По совокупности художественного и брендового визуала он всё ещё впереди. Для коммерческих работ с текстом внутри изображения — Ideogram 4.0 или генерация изображений в ChatGPT (GPT Image 2.5); для фото — Nano Banana 2 или FLUX.2; если на первом месте коммерческая безопасность — Adobe Firefly. В статье восемь главных инструментов на сентябрь 2026 года разобраны по сильным сторонам, ценам и сценариям использования по официальным ценам каждого поставщика (проверено 22 сентября 2026 года).
8 инструментов, 5 осей сильных сторон — единого «лучшего» больше нет
— Фото / Текст / Арт / Коммерчески безопасный / Дизайн — у каждой ниши свой король
2024: Midjourney в одиночку на вершине →
2026: расщепление на 5 лагерей по сценариям.
Правильный шаг сейчас — комбинировать 2–3 инструмента под задачи, а не выбирать только один.
1. Май 2026: DALL·E ушёл в отставку — смена поколений в ИИ-генерации изображений
12 мая 2026 года OpenAI отключила DALL·E 2 и DALL·E 3 в API (разработчиков предупредили 14 ноября 2025 года). В качестве замены указаны модели GPT Image, например gpt-image-2; GPT Image 2 вышла 21 апреля и пришла в ChatGPT как «ChatGPT Images 2.0». Затем, 8 сентября, вышел ChatGPT Images 2.5, а в API появились две новые модели — GPT-Image-2.5 Flare и Sunburst (анонс OpenAI). Примерно через четыре года после DALL·E 2 в 2022-м это смена поколений у инструмента, который сделал понятие «ИИ-генерация изображений» массовым.
У Google тоже сменилось поколение. Imagen 4 (Fast / стандартная / Ultra) отключили в Gemini API 17 августа 2026 года, а целью миграции назначили Gemini 3.1 Flash Image — известную как Nano Banana 2 (страница Deprecations Gemini API). Nano Banana 2 и старшая Nano Banana Pro (Gemini 3 Pro Image) стали общедоступными 28 мая. Midjourney прошёл путь от альфы V8 17 марта через V8.1 до того, что 24 июля моделью по умолчанию стала V8.2.
Двигались и остальные лагеря. Black Forest Labs выпустила FLUX.2 в ноябре 2025 года; в API FLUX.2 [pro] стоит от $0.03 за изображение. Ideogram выпустил 4.0 3 июня и открыл загрузку весов модели. Recraft выпустил V4.1 14 мая, а Adobe сделала Firefly Image Model 5 общедоступной к марту.
Поэтому привычная троица 2024 года «Midjourney, DALL·E и Stable Diffusion» больше не описывает реальность. 2026-й расщепился на 5 лагерей по сценариям использования.
2. 8 главных инструментов с высоты птичьего полёта
Сначала общая картина. Восемь главных инструментов на сентябрь 2026 года — с актуальными версиями, ценами и ключевыми сильными сторонами.
| Инструмент | Актуальная версия (сент. 2026) | Цена (минимальная) | Ключевая сильная сторона |
|---|---|---|---|
| Midjourney | V8.2 (по умолчанию с июля 2026) | $10/мес. (Basic, 200 минут Fast) | Арт, стилизация |
| OpenAI (ChatGPT / GPT Image) | GPT Image 2.5 (сентябрь 2026) | Доступен на бесплатном тарифе ChatGPT (с лимитами) / API с оплатой за токены | Точное редактирование по инструкции, вёрстка, текст |
| FLUX.2 (Black Forest Labs) | FLUX.2 (с ноября 2025) | От $0.03/изобр. ([pro], API) | Фотореализм по выгодной цене, есть открытая версия |
| Google Nano Banana 2 | Gemini 3.1 Flash Image (GA в мае 2026) | $0.067/изобр. (1K, Gemini API) | Фотореализм, правки в диалоге |
| Recraft | V4.1 (май 2026) | $0.035/изобр. (растр, API) | Векторный вывод, дизайн-системы |
| Ideogram | 4.0 (июнь 2026, открытые веса) | $15/мес. (Plus, при оплате за год) | Текст внутри изображения |
| Adobe Firefly | Firefly Image Model 5 | $9.99/мес. (Standard) | Коммерческая безопасность, интеграция с Adobe |
| Stable Diffusion | 3.5 (без обновлений с октября 2024) | Бесплатно (своя GPU, выручка до 1 млн $ в год) | Открытые веса, кастомизация |
Примечание: версии и цены проверены на официальных страницах поставщиков 22 сентября 2026 года: Midjourney / OpenAI API · ChatGPT / Black Forest Labs / Gemini API / Recraft / Ideogram / Adobe Firefly / Stability AI
Одной таблицы для решения недостаточно. Сначала нужно сформулировать собственную цель словами; иначе ни одна строка таблицы не покажется «правильной». В следующем разделе те же 8 инструментов сгруппированы по осям сильных сторон.
3. По сильным сторонам — куда целиться
Те же 8 инструментов, но перегруппированных в 5 лагерей по тому, в чём они лучше всего. Это практическая боевая карта на 2026 год.
Матрица выбора по сильным сторонам
Не пытайтесь сделать всё одним инструментом. Подпишитесь на 2–3 под сценарии — это ответ 2026 года.
Итоговая стоимость выходит около $20–40/мес. и легко окупается одним проектом.
Подробнее: фотореализм — Nano Banana 2 и FLUX.2
Google Nano Banana 2 (Gemini 3.1 Flash Image) стоит $0.067 за изображение 1K в Gemini API, $0.101 в 2K и $0.151 в 4K (страница цен Gemini API). Старшая Nano Banana Pro (Gemini 3 Pro Image) стоит $0.134 в 1K/2K. В приложении Gemini даже бесплатный тариф генерирует изображения с Nano Banana 2 (переделка с Nano Banana Pro — от Google AI Plus). В стороннем рейтинге Text to Image Arena от Artificial Analysis, построенном на голосах людей, Nano Banana 2 — самая высокая модель Google (общие первые места у моделей GPT Image 2.5 от OpenAI; просмотрено 22 сентября 2026 года). Учтите: у Midjourney нет публичного API, поэтому модели V8 в этот рейтинг не входят.
С другой стороны, FLUX.2 (Black Forest Labs) стоит от $0.03 за изображение через API для FLUX.2 [pro], от $0.07 для флагманской [max] и от $0.014 для лёгкой [klein] (страница цен BFL). Без месячной подписки — только оплата по факту через API, так что при «менее 100 изображений в месяц» FLUX.2 часто заметно дешевле. К тому же у FLUX.2 [dev] открытые веса — её можно запускать на своей GPU. 23 июля BFL анонсировала FLUX 3 с упором на видео, но его генерации изображений пока нет в публичном прайс-листе API (проверено 22 сентября 2026 года).
Отрисовка текста: дуополия Ideogram + GPT Image
До 2024 года «текст внутри изображения» был главной слабостью ИИ-генерации. Даже сейчас официальная документация Midjourney пишет, что текст «лучше всего работает со стандартным латинским алфавитом» и короткими словами или фразами.
Эту границу раздвинул Ideogram. Версия 4.0 от 3 июня делает ставку на многоязычную отрисовку текста, управление вёрсткой через рамки для логотипов и заголовков и вывод в 2K — и веса опубликованы (анонс Ideogram). Сентябрьский GPT Image 2.5 от OpenAI тоже выводит на первый план сложную вёрстку, включая прозрачный фон, и точные правки только указанной области. Обложки для соцсетей, рекламные баннеры и инфографика теперь — территория этих двоих.
4. Модели оплаты — подписка против оплаты за изображение
После сильных сторон следующая большая развилка — структура оплаты. Инструменты резко делятся на фиксированный месячный тариф и поштучную тарификацию. В зависимости от объёма ежемесячная стоимость может отличаться в 10 раз.
| Тип оплаты | Представители | Кому подходит |
|---|---|---|
| Месячный фикс (без лимита) | Midjourney Standard $30 (изображения без лимита в Relax), Adobe Firefly Standard $9.99 (генерация стандартных изображений без лимита) | Ежедневным пользователям; тем, кто хочет итерировать, не считая |
| Месячный фикс (кредиты) | Midjourney Basic $10 (200 минут Fast), Ideogram Plus $20 ($15 при оплате за год, 1000 кредитов/мес.) | Лёгким пользователям в диапазоне 100–200 изображений в месяц |
| Поштучно (API) | FLUX.2 [pro] от $0.03, Nano Banana 2 $0.067 (1K), Recraft V4.1 $0.035, Ideogram 4.0 $0.03–0.10, GPT Image 2.5 — за токены | Встраивание в приложения; нерегулярные, но объёмные пики |
| Бесплатно (своя GPU / бесплатные тарифы) | Stable Diffusion 3.5; бесплатные тарифы ChatGPT и приложения Gemini (с лимитами) | Умеющим разворачивать локально; данным, которые нельзя выпускать из сети; тем, кто хочет попробовать |
Конкретная арифметика. Частный пользователь генерирует 100 изображений в месяц:
- Midjourney Basic: $10/мес. (200 минут Fast ≈ 250 генераций SD / 1000 изображений-кандидатов, с запасом)
- FLUX.2 [pro]: $0.03 × 100 = от $3/мес.
- Nano Banana 2 (1K): $0.067 × 100 = $6.70/мес.
- Adobe Firefly Standard: $9.99/мес. (2000 кредитов + генерация стандартных изображений без лимита)
При 100 в месяц выигрывает оплата API по факту. Если посмотреть с другой стороны: $10 за Midjourney Basic — это около 333 изображений на FLUX.2 [pro] (по минимальной цене $0.03) или около 149 на Nano Banana 2 (1K, $0.067). Midjourney выдаёт четыре кандидата за запуск, поэтому если вы генерируете много, а потом выбираете, фикс выходит дешевле. Считать, «с какого месячного объёма окупается безлимит», — ценовая грамотность, необходимая в 2026 году.
5. По сценариям — гид «выбирайте это»
Сильные стороны и цены — у вас на руках. Так что подходит именно вашей задаче? Шесть распространённых паттернов с прямыми ответами.
Гид «выбирайте это»
Моя личная лучшая практика: Midjourney Basic ($10) + генерация изображений в ChatGPT. Начните ChatGPT с бесплатного тарифа и переходите на платный, только если не хватит.
Это покрывает ~80% повседневных задач. API — только для разовых коммерческих задач, где нужен текст или фото.
6. Типичные ловушки — коммерческое использование, авторское право, отрисовка текста
Вы выбрали по сильным сторонам и цене. Три ловушки, которые проявляются только после начала работы:
Ловушка ①: условия коммерческого использования варьируются от инструмента к инструменту
«ИИ-изображение = можно свободно использовать коммерчески» — заблуждение. Условия зависят от инструмента и тарифа. Midjourney разрешает коммерческое использование на всех платных тарифах, но компаниям с годовой выручкой более 1 млн $ нужен Pro или Mega, а генерации по умолчанию публичны (приватный режим Stealth — от Pro). Adobe Firefly указывает в своём FAQ, что результаты функций без пометки «бета» можно использовать коммерчески. Для Stable Diffusion 3.5 организациям с годовой выручкой более 1 млн $ нужна лицензия Enterprise для коммерческого использования. На странице цен Recraft сказано, что изображения бесплатного тарифа принадлежат Recraft и публичны, а право собственности и коммерческие права дают платные тарифы. Всегда читайте пункт о коммерческом использовании до оформления подписки.
Ловушка ②: риск по авторскому праву различается по интенсивности
На Midjourney в июне 2025 года подали иск о нарушении авторских прав Disney, Universal и другие, и на сентябрь 2026 года дело продолжается (Федеральный окружной суд США по Центральному округу Калифорнии, материалы дела). Решения пока нет. Для корпоративных задач стоит знать, что Adobe Firefly публично описывает свои обучающие данные как лицензированный контент плюс общественное достояние. Именно поэтому рекламные агентства и издательства тяготеют к Firefly.
Ловушка ③: текст внутри изображения по-прежнему различается для английского и японского
Улучшения отрисовки текста у всех поставщиков сначала касаются латиницы и цифр; японский, китайский, арабский и другие сложные письменности всё ещё отстают. Midjourney официально пишет, что лучше работает с латиницей, Ideogram 4.0 заявляет многоязычность, а OpenAI делает акцент на точности вёрстки в GPT Image 2.5. Для материалов с японским (или другим нелатинским) текстом проверьте свой реальный текст несколько раз в каждом инструменте-кандидате, прежде чем решать. Для многоязычных логотипов и постеров именно здесь выбор сужается.
Итоги
Подведём итоги:
- Май 2026: DALL·E ушёл из API, а генерация изображений OpenAI перешла на GPT Image (в сентябре — Images 2.5). Google тоже закрыл Imagen 4 и перешёл на Nano Banana 2, а моделью Midjourney по умолчанию стала V8.2
- 8 главных инструментов делятся на 5 лагерей сильных сторон — фото / текст / арт / коммерчески безопасный / дизайн-система.
- Цены делятся на месячный фикс и поштучную оплату; точка безубыточности лежит около нескольких сотен изображений в месяц.
- Частному пользователю связка Midjourney Basic ($10) + генерация изображений в ChatGPT (начиная с бесплатного тарифа) закрывает ~80% повседневных задач.
- Для коммерческих задач Adobe Firefly по-прежнему силён спокойствием, которое даёт его публичная позиция «обучен на лицензированных данных».
Вопрос ИИ-изображений в 2026 году — уже не «что лучше?», а «что подходит моему сценарию?» Не гонитесь за универсальностью. Комбинируйте 2–3 инструмента под задачу — это правильный ответ для рынка, расщепившегося на 5 лагерей.
FAQ
Если вы уже пользуетесь ChatGPT, можно сразу генерировать изображения, даже на бесплатном тарифе (модели GPT Image 2.5, с лимитами). Если нет — начните с Midjourney Basic ($10/мес.). Любой из них даст вам базовое ощущение ИИ для изображений уже в первый месяц.
Stable Diffusion 3.5 бесплатен при локальном запуске (включая коммерческое использование при выручке до 1 млн $ в год). Нужны RTX 3060 или выше и среда Python. Для удобства бесплатные тарифы ChatGPT и приложения Gemini тоже генерируют изображения (с лимитами). Бесплатные облачные варианты — см. гид по бесплатным ИИ-инструментам.
Adobe Firefly сейчас самый безопасный. Adobe описывает свои обучающие данные как «лицензированный контент, например Adobe Stock, плюс общественное достояние». Для рекламы, издательств и корпоративной работы с ИИ-изображениями начните с оценки Firefly. Midjourney разрешает коммерческое использование, но его спор об авторских правах с Disney, Universal и другими ещё продолжается — решение за каждой компанией.
У каждого инструмента свои приёмы. Midjourney любит «субъект, стиль, настроение, композиция» через запятую. GPT Image / Nano Banana лучше работают с длинными и конкретными описаниями на естественном языке, а полученное изображение можно поправить в диалоге фразой «исправь только эту часть». В Stable Diffusion ключевую роль играет negative prompt (что исключить). См. также общие советы по промптам.
Эта статья посвящена в основном инструментам для статичных изображений. Генерация видео идёт отдельным треком — Google Veo 3.1 / Kling 3.0 / Runway Gen-4.5 / видео в Midjourney (V1) среди заметных имён, а Black Forest Labs в июле анонсировала FLUX 3 с упором на видео. Adobe Firefly необычен тем, что позволяет выбирать такие сторонние видеомодели прямо в своём приложении. Видео развивается ещё быстрее, чем статичные изображения, так что картина меняется примерно раз в полгода.
По теме: ИИ-инструменты для геймдева.