Новости ИИ для генерации изображений и видео — 2026-09-09
Закрытый сегмент возглавляют Google Nano Banana Pro и OpenAI GPT Image 2; Sora сворачивается, тогда как open source-модели Qwen-Image, FLUX, Wan и HunyuanImage приближаются по качеству к закрытым решениям.
Сводка новостей ИИ для генерации изображений и видео — 2026-09-09
Ну что, собрал всё 🔥 Если коротко: в закрытом сегменте Google Nano Banana Pro (Gemini 3 Pro Image) и OpenAI GPT Image 2 — два главных соперника, а отдельное приложение Sora уже практически доживает последние дни. В видео главная арена — китайские Kling и Seedance вместе с Google Veo 😤 В open source же Qwen-Image, Z-Image, FLUX, Wan и HunyuanImage уже дошли до уровня «и это можно получить бесплатно?!», а сообщества ComfyUI и локального запуска по-прежнему полны энергии 💪 Но с X в этот раз вышел полный промах — честно об этом скажем.
Across platforms
Наблюдения по закрытым решениям (10) 🏢
- Nano Banana Pro (Gemini 3 Pro Image) называют моделью, которая «просто уничтожает конкурентов в генерации изображений»; она захватила внимание YouTube → https://www.youtube.com/watch?v=UV9GqinedQ8
- Появилась OpenAI GPT Image 2. Точность текста выше 99% более чем на 12 языках, до 8 изображений за один запрос в режиме Thinking, также развивается поддержка 4K → https://www.youtube.com/watch?v=blOlUnC75O4
- 17 августа 2026 года Google полностью завершила линейку Imagen и сосредоточилась на серии Nano Banana. Закрытая генерация изображений всё заметнее тяготеет к Google.
- OpenAI закрывает приложение Sora 26 апреля, а Sora API планируется вывести из эксплуатации 24 сентября. Бренд Sora фактически подходит к концу → https://lemmy.world/post/44721138
- Пользователь Bluesky dahara1 уже сообщил, что бесплатная Sora перестала работать после исчерпания кредитов → https://bsky.app/profile/dahara1.bsky.social/post/3miogq762u223
- Grok Imagine Image 2.0 от xAI, выпущенная 7 августа, заняла близкое второе место после GPT Image 2 в Arena — складывается трёхсторонняя гонка.
- ByteDance открыла общий доступ к API Seedance 2.5 7 августа; модель стала одним из ключевых игроков наряду с Veo 3.1 и Kling 3.0.
- Пользователи Reddit сравнили Seedance 2.5 и открытую Wan 3.0 на одном промпте — мнения резко разошлись → https://www.reddit.com/r/generativeAI/comments/1w60fip/
- Midjourney неожиданно разворачивается от генерации изображений к ультразвуковым медицинским сканерам, что вызвало скандал; звучат и сравнения с Theranos → Lemmy (через theregister.com)
- ByteDance и Голливудская ассоциация MPA достигли глобального соглашения о защите авторских прав в ИИ — работа с копирайтом становится серьёзнее → данные Pinterest
- На Reddit техника подделки «настоящего таймлапса ручного рисования» с помощью ИИ вызвала огромный скандал: 7 088 баллов, призывы обязать маркировать ИИ-контент → https://www.reddit.com/r/antiai/comments/1w81kdd/
- Только по Bluesky-аккаунту luok.ai с декабря 2025-го по февраль 2026-го подряд вышли модели Kling, Runway, PixVerse, Vidu, Seedance и Niji — импульс китайских компаний особенно заметен.
Наблюдения по open source (10) 🛠️
- Qwen-Image 2512 от Alibaba с лицензией семейства Apache и Z-Image Turbo стали двумя главными трендами; сравнительных видео появляется всё больше → https://www.youtube.com/watch?v=uAGH_yRZ2Gw
- Flux 2.0 проходит 15-пунктовый стресс-тест против Qwen-Image 2512 и Z-Image → https://www.youtube.com/watch?v=54zvSiAWz2Y
- LTX-2.3 от Lightricks — 22 млрд параметров, синхронизация аудио, 4K/50 fps — получает репутацию модели качества закрытых сервисов → https://www.youtube.com/watch?v=qQXzlk134Sw
- Практические видео утверждают, что Wan 2.5 от Alibaba превзошла закрытую Veo 3 → https://www.youtube.com/watch?v=yvD8TxNsR4Q
- Появился бесплатный агент WanGP, объединяющий несколько OSS-моделей — LTX-2.3, Qwen, Flux.2 Klein и Z-Image; экосистема движется к единым рабочим процессам → https://www.youtube.com/watch?v=h-k6xOEITx4
- HunyuanImage 3.0 от Tencent, MoE-модель более чем на 80 млрд параметров, всё ещё служит ориентиром среди крупных открытых моделей изображений.
- FLUX 3 от Black Forest Labs поддерживает изображения и 20-секундные видео с аудио в ограниченном релизе → https://bfl.ai/blog/flux-3
- Вышли облегчённая FLUX.2-klein-9b-kv-fp8 и программа FLUX Creator Program; даже режиссёр Мартин Скорсезе стал советником.
- Сообщество Stable Diffusion на Lemmy насчитывает около 5 000 участников, но каждый день продолжает публиковать работы в ComfyUI, SDXL и Krea2 — реальная практика впечатляет своей глубиной.
- Simon Willison в Bluesky сообщил, что запустил Qwen 3.7 27B локально на M5 MacBook в 17-ГБ GGUF и получил лучшего «пеликана на велосипеде» среди локальных моделей → https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z
- Продолжают постепенно обновляться и открытая видеомодель SkyReels V1 на базе HunyuanVideo, и бесплатный универсальный OSS-воркфлоу Open Creative Studio → https://bsky.app/profile/perilli.com/post/3mdddenkss22v
Ключевой вывод по всем платформам: противопоставление закрытых и открытых решений постоянно повторяется на Reddit, YouTube и Lemmy: «закрытые удобны, но цензурируются и стоят дорого» против «открытые свободны, но требуют усилий». Скепсис к инструментам, обещающим «бесплатно и безлимитно», тоже совпадает во многих сообществах 🙅♂️. Любопытно, что на Pinterest эта дихотомия почти не просматривается: там преобладают презентации инструментов и новостные обложки.
Platform by platform
Reddit: собрано 12 тредов. Анти-ИИ-тред с 7 088 баллами стал настолько вирусным, что заметнее всех технических обсуждений вместе взятых: сопротивление злоупотреблениям ИИ оказывается более заметным, чем разговоры о технологиях. Ключевые сабреддиты вроде r/StableDiffusion в выборку не попали, поэтому покрытие неполное.
X: если честно, здесь полный ноль 😅 Из-за того, что поисковые запросы воркера были вроде "Harvey" и "$LAPTOP" и не имели отношения к теме, среди 40 собранных публикаций не оказалось ни одной о генерации изображений или видео. Это единственный реальный пробел среди шести платформ, указанных в брифе.
YouTube: много обзоров и сравнений. В закрытом сегменте удалось охватить тройную гонку Google/OpenAI/xAI, в открытом — Qwen-Image, FLUX, Wan, LTX-2.3, HunyuanImage и интегрированные процессы WanGP. Однако просмотры и число подписчиков недоступны из-за JavaScript, поэтому количественно сравнить свежесть нельзя.
Bluesky: поисковый API searchPosts возвращал 403 для всех запросов, поэтому пришлось читать ленты аккаунтов. Материала по закрытым видеомоделям, особенно через luok.ai, много, а по открытым видео — заметно меньше. Из явных примеров удалось найти главным образом SkyReels V1.
Lemmy: в закрытом сегменте особенно заметны споры вокруг медицинского поворота Midjourney и сарказм по поводу закрытия Sora. В открытом сегменте доминирует Black Forest Labs с семейством FLUX и конкретными новостями почти каждый квартал.
Pinterest: просмотрены изображения всех 50 пинов. Доминируют неоновые новостные превью с роботами и инфографика с подборками инструментов; изображений, символизирующих саморазмещаемую open source-культуру вроде Stable Diffusion или ComfyUI, среди 50 результатов не оказалось. Метрики вовлечения в основном недоступны.
What to watch
- Закрытие OpenAI Sora API, запланированное на 24 сентября 2026 года — Lemmy https://lemmy.world/post/44721138
- Динамика рейтингов Arena: Grok Imagine Image 2.0 против GPT Image 2 — YouTube, сравнительные видео Marin Method
- Трёхсторонняя конкуренция Qwen-Image / Z-Image / FLUX в open source: какая модель станет стандартом — YouTube https://www.youtube.com/watch?v=uAGH_yRZ2Gw
- Сможет ли реально состояться бизнес Midjourney по ультразвуковым медицинским сканерам — Lemmy, через theregister.com
- Конкретные правила применения соглашения ByteDance × Голливуд по авторскому праву — данные Pinterest [24]
- Насколько широко распространятся OSS-интеграционные агенты вроде WanGP — YouTube https://www.youtube.com/watch?v=h-k6xOEITx4
Recommendations
- Для дополнительного сбора по X следует заменить запросы на напрямую связанные с темой: "Midjourney", "Stable Diffusion", "Sora", "Nano Banana", "Qwen-Image" и подобные.
- В следующем исследовании Reddit обязательно стоит включить крупные ключевые сабреддиты: r/StableDiffusion, r/midjourney, r/comfyui и другие.
- В качестве альтернативы Bluesky Search API с ошибкой 403 стоит превратить найденные ключевые аккаунты — luok.ai, simonwillison.net и другие — в список для регулярного мониторинга.
- Чтобы нагляднее показать противопоставление закрытых и открытых решений, стоит отдавать приоритет комментариям Reddit и Lemmy, где мнения выражены сильнее, чем на Pinterest.
- Закрытие Sora API 24 сентября и продолжение истории с поворотом Midjourney должны быть первоочередными пунктами следующего исследования.
Data quality
Из-за несоответствия поисковых запросов на X не было собрано ни одной тематической публикации, то есть фактически данных нет. В Bluesky и Pinterest не удалось получить поисковый API или показатели вовлечённости — просмотры и лайки, поэтому распространение тем нельзя надёжно подтвердить количественно. На YouTube также недоступны текст видео и просмотры из-за JavaScript, поэтому приходилось опираться на сниппеты WebSearch. По остальным платформам — Reddit и Lemmy — в целом удалось собрать достаточно материала и по объёму, и по качеству.
Сводка по платформам
Reddit — Новости ИИ для генерации изображений и видео
Где
Собранные 12 тредов распределены по восьми сабреддитам.
| Subreddit | Число участников | Число собранных тредов |
|---|---|---|
| r/generativeAI | 151,605 | 4 |
| r/antiai | 319,039 | 1 |
| r/RemoteWorkers | 75,979 | 1 |
| r/Seedance_AI | 20,508 | 1 |
| r/freetoolsAI | 7,942 | 1 |
| r/aivideomaking | 6,614 | 2 |
| r/AItips101 | 1,153 | 1 |
| r/Unrouted_AI | 517 | 1 |
Больше всего — четыре треда — у r/generativeAI, посвящённого генеративному ИИ в целом. Но по баллам и числу комментариев безусловно доминирует один тред из критически настроенного к ИИ r/antiai: его вовлечённость значительно превосходит все остальные вместе взятые.
Что говорят люди
- Растёт спрос на интегрированные платформы без цензуры с упором на свободу: тред 1 (r/AItips101, 81 балл, 2026-09-07, https://www.reddit.com/r/AItips101/comments/1w9yftp/) представляет "WildOwl.ai" — сервис без подписки, с оплатой по мере использования и доступом более чем к 35 моделям, включая Qwen Image, Flux, Seedream, Wan, Kling, Seedance, Veo и GPT Image. В комментариях u/reliablemicrophone84 положительно оценивает то, что не нужно выбирать между передовыми моделями и творческой свободой, тогда как u/Clear-Assistance449 предлагает Mage.space с безлимитной подпиской.
- Сильный скепсис к обещаниям «бесплатно и безлимитно»: в треде 2 (r/aivideomaking, 2 балла, 22 комментария, 2026-09-06, https://www.reddit.com/r/aivideomaking/comments/1w953eo/) и треде 5 (r/generativeAI, 1 балл, 2026-09-07, https://www.reddit.com/r/generativeAI/comments/1wa4k88/) преобладает мнение, что по-настоящему бесплатного и безлимитного продукта не бывает. u/ai_art_is_art в треде 5 резко замечает: «Безлимит — ложь. Вносишь $550, получаешь $200 и должен ждать 24 часа между генерациями».
- Просьба о 45-секундном видео вызывает насмешки: в треде 4 (r/aivideomaking, 13 баллов, 22 комментария, 2026-09-07, https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/) просьба бесплатно создать 45-секундное ИИ-видео только на смартфоне и iPad встречена скептически. u/NewLifeWares отмечает, что 45 секунд требуют ресурсов уровня дата-центра; максимум можно найти бесплатный 5-секундный генератор с водяным знаком.
- Подделка «настоящего ручного рисунка» с помощью ИИ вызвала огромный скандал: тред 3 (r/antiai, 7 088 баллов, 1 023 комментария, 2026-09-05, https://www.reddit.com/r/antiai/comments/1w81kdd/) посвящён возможности поручить LLM уровня GPT-6 управлять мышью и клавиатурой и сфабриковать «настоящий таймлапс» в графическом редакторе. Это самый высокооценённый тред во всей выборке. u/Nayutantantan выражает разочарование распространением фальшивых таймлапсов, а u/Soggy_Supermarket100 требует обязательной фильтрации ИИ во всех онлайн-пространствах.
- Дипфейки реальных знаменитостей сводятся к спору об ответственности пользователя: в треде 6 (r/Seedance_AI, 0 баллов, 22 комментария, 2026-09-07, https://www.reddit.com/r/Seedance_AI/comments/1w9zqac/) u/Jean_velvet объясняет, что недавние судебные дела возлагают ответственность на пользователя, а потенциальным преступлением становятся распространение и публикация. u/Alchemist42, напротив, намекает на использование других, менее регулируемых инструментов.
- Противостояние закрытых и открытых моделей: тред 10 (r/generativeAI, 110 баллов, 31 комментарий, 2026-09-03, https://www.reddit.com/r/generativeAI/comments/1w60fip/) сравнивает Seedance 2.5 — закрытую модель ByteDance — и Wan 3.0 — открытую модель Alibaba — на одинаковом промпте. u/SpecialistDragonfly9 считает Seedance намного лучше, но u/Positive-Key6640 сомневается в самой методике: одинаковый промпт скорее показывает, какой стиль промптов нравится конкретной модели, а не объективно лучшую модель.
- Новая модель изображений OpenAI стала тихой темой обсуждения: тред 7 (r/Unrouted_AI, 2 балла, 6 комментариев, 2026-09-08, https://www.reddit.com/r/Unrouted_AI/comments/1waxp14/) ссылается на официальный блог OpenAI "introducing-chatgpt-images-2-5". u/Ok_Homework_1859 особенно заинтересован функцией Sketch, позволяющей рисовать в ChatGPT для управления генерацией изображения.
- Недовольство ограничениями на генерацию персонажей под авторским правом: в треде 11 (r/generativeAI, 2 балла, 2 комментария, 2026-09-08, https://www.reddit.com/r/generativeAI/comments/1waapc1/) пользователь жалуется, что Grok не позволяет делать даже фан-арт с персонажами Disney для личного использования. u/frighten предлагает PixelForge для iOS как альтернативу без встроенных ограничений.
- Ностальгия и поправки к десятилетней истории ИИ-изображений: тред 9 (r/generativeAI, 15 баллов, 9 комментариев, 2026-09-06, https://www.reddit.com/r/generativeAI/comments/1w8gzt6/) прослеживает развитие от StackGAN 2016 года до изображений ChatGPT в 2026-м. u/noctalla указывает на упущенный исторический этап: Google DeepDream существовал примерно с 2015 года.
- Вокруг генерации изображений возникает новая «подработка в ИИ»: тред 8 (r/RemoteWorkers, 169 баллов, 787 комментариев, 2026-09-04, https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/) посвящён удалённой работе по $30 в час для проверки ИИ-генерируемых подписей. Комментариев много, но почти все сводятся к повторяющимся просьбам о ссылке для подачи заявки, поэтому содержательной дискуссии почти нет.
- Вопросы к устойчивости бесплатных генераторов: в треде 12 (r/freetoolsAI, 40 баллов, 50 комментариев, 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/) представлен aifreeforever.com, обещающий бесплатную безлимитную генерацию без регистрации. u/thecragmire спрашивает, как это может поддерживаться финансово, а u/Relevant_Syllabub895 недоволен строгостью NSFW-ограничений.
Сигналы
- Быстрый рост: в нескольких тредах прямо упоминаются агрегаторы с «без цензуры и множеством моделей» — WildOwl.ai, Venice, Mage.space, PixelForge. Вместо контрактов с отдельными моделями они предлагают свободу выбора и более мягкие фильтры.
- Отвергаемый тезис: сервисы генерации видео и изображений, обещающие «бесплатно и безлимитно», почти единодушно встречают скепсис или отрицание в r/aivideomaking, r/generativeAI и r/freetoolsAI. Общая позиция: в любом случае придётся платить либо за оборудование, либо напрямую за сервис.
- Разногласия: в сравнении Seedance и Wan из треда 10 мнения расходятся не только о том, какая модель лучше, но и о самом методе сравнения. В треде 6 также чувствуется разрыв между сторонниками ответственности пользователя и сторонниками ответственности сервиса.
- Неожиданность: среди 12 собранных тредов анти-ИИ-тред №3 с 7 088 баллами и 1 023 комментариями получил вовлечённость на порядок выше технических тем. Это почти сопоставимо с суммой баллов остальных тредов — около 7 600. Живая реакция Reddit показывает, что протест против злоупотреблений и обмана с ИИ заметнее, чем энтузиазм по поводу самих технологий.
- Открытые и закрытые решения: явное противопоставление представлено сравнением Wan с открытыми весами и закрытой Seedance, а также спором между локальной генерацией в ComfyUI/Civitai/Hugging Face и облачными платными сервисами. Открытые решения снова и снова описываются как свободные, но требующие усилий; закрытые — как удобные, но ограниченные цензурой и стоимостью.
Ограничения
- Собрано только 12 тредов, что не достигает требуемого в brief.md уровня «около 20». Использовался лишь один поисковый запрос — "Image and Video Generation AI News"; отдельных запросов для закрытых и open source-решений не выполнялось.
- В выборке вообще нет крупных ключевых сабреддитов генерации изображений и видео: r/StableDiffusion, r/midjourney, r/aivideo, r/comfyui. Это пробел в покрытии, поэтому результаты нельзя считать репрезентативными для всего Reddit.
- В треде 8 из r/RemoteWorkers верхние комментарии практически полностью состоят из повторяющегося слова «Images», поэтому информации для обсуждения там почти нет.
- Агент не мог напрямую просматривать Reddit и страницы результатов поиска из-за отказа WebFetch. Все выводы основаны только на данных, заранее собранных воркером в
output/reddit.threads.mdи.json; наличие других тредов или комментариев проверить нельзя.
X
X — Новости ИИ для генерации изображений и видео
Предисловие: результаты сбора не соответствуют теме
При проверке output/x.posts.md выяснилось, что на этом этапе воркер фактически искал
"Harvey", "#Crypto", "#sweepstakes", "#Chance", "#giveaways", "Serbia",
"$LAPTOP", "Arsenal", "Germans", "Nazis". Ни один из этих запросов не связан с генерацией изображений или видео ИИ, а среди 40 публикаций от 39 аккаунтов нет ни одной тематической. В собственном списке Explore X — трендах, геопривязанных к Хорватии, где находился сервер подключения, — также нет связанных с ИИ тем.
| # | Тренд | Где |
|---|---|---|
| 1 | Harvey | В тренде в Хорватии |
| 2 | #Crypto | Бизнес и финансы · В тренде |
| 3 | #sweepstakes | В тренде в Хорватии |
| 4 | #Chance | В тренде в Хорватии |
| 5 | #giveaways | В тренде в Хорватии |
| 6 | Serbia | Политика · В тренде |
| 7 | $LAPTOP | В тренде в Хорватии |
| 8 | Arsenal | Спорт · В тренде |
| 9 | Germans | Политика · В тренде |
| 10 | Nazis | Политика · В тренде |
Следуя правилу 7 о запрете выдумывать источники, нельзя выдавать нерелевантные публикации за тематические наблюдения. Ниже приведены только факты из реально собранного материала.
Аккаунты
39 собранных аккаунтов образуют несвязанные между собой кластеры: поклонники реалити-шоу о знакомствах, криптотрейдеры, аккаунты с розыгрышами и подарками, участники балканских политических споров, сообщества мемкоинов, болельщики Arsenal и участники дискуссий об историческом ревизионизме и антисемитизме. Не найдено ни одного аккаунта, обсуждающего ИИ для генерации изображений и видео или явно публикующего контент, созданный такими инструментами. У некоторых постов есть пометка "has an image", но в них нет упоминания генеративного ИИ или указания, что изображение сгенерировано. Наибольшая вовлечённость у @saintjupitr — 64 747 лайков — и @Kwin8675309 — 42 021 лайк; оба случая относятся к отдельным вирусным политическим постам и не имеют отношения к теме.
Публикации
Нет данных. Среди 40 публикаций не оказалось ни одной, соответствующей теме — ИИ для генерации изображений и видео, а также движению закрытых и открытых решений. Отдельные посты, например №21–24 о Сербии, №29–32 об Arsenal и №33–40 о Германии и нацизме, имеют высокие показатели вовлечённости, но не связаны с генерацией ИИ и не учитываются как выводы.
Сигналы
- Сигналы роста или спада по теме не обнаружены, потому что тематических данных нет.
- Единственный вывод о процессе сбора: Explore-результаты были геолокализованы на Хорватию, а сами запросы были зафиксированы на нерелевантных словах — "Harvey", "$LAPTOP" и других.
Ограничения
- Поисковые запросы не соответствуют теме: в
output/x.posts.mdвсе записи "Found by searching "…"" относятся к словам, не связанным с ИИ-генерацией изображений и видео: Harvey, #Crypto, #sweepstakes, #Chance, #giveaways, Serbia, $LAPTOP, Arsenal, Germans, Nazis. Вероятно, проблема в настройке запросов воркера. В соответствии с инструкцией плейбука о том, что воркер уже собрал материал, новый поиск самостоятельно не проводился; необходим повторный сбор с корректными запросами, например "AI image generation", "Midjourney", "Stable Diffusion", "Sora", "Veo", "オープンソース 画像生成AI". - Среди 40 публикаций найдено 0 наблюдений о закрытых или открытых решениях для генерации изображений и видео. Требование brief.md про анализ примерно 20 публикаций невозможно выполнить без тематических данных.
- Explore X, тренды 1–10, также содержал только общие хорватские тренды и ни одной ИИ-темы.
- Сессия была рабочей: сбор публикаций прошёл успешно, ошибок вроде "session expired" не было. Проблема заключается именно в выборе поисковых запросов.
YouTube
YouTube — актуальные тенденции ИИ для генерации изображений и видео: закрытые и открытые решения
Каналы
- AICodeKing — в основном практические обзоры ИИ-инструментов, включая ранний обзор Google Nano Banana Pro (Gemini 3 Pro Image). https://www.youtube.com/@AICodeKing
- Theo - t3.gg — канал с технологическими объяснениями для разработчиков; есть ролик о Nano Banana Pro. https://www.youtube.com/@t3dotgg
- ElevenLabs(официальный) — официальный канал компании в области голосового ИИ, который также объясняет новости генерации изображений, например GPT Image 2. https://www.youtube.com/@Elevenlabs
- AIOnTrend — канал сравнительных обзоров открытых моделей генерации изображений, включая Qwen-Image 2512. https://www.youtube.com/@aiontrend
- BMF MEDIA — обзоры открытых моделей генерации видео, например LTX-2.3. https://www.youtube.com/@BeerMoneyForum
- Marin Method — прямые сравнения закрытых видеомоделей Kling, Grok Imagine, Runway и Veo. https://www.youtube.com/@MarinMethod
- Jack Vs. AI — канал о практических воркфлоу, включая Wan 2.5. https://www.youtube.com/@JackVsAI
- Youri van Hofwegen — сравнительное тестирование новейших видеомоделей, включая Seedance 2.0. https://www.youtube.com/@Yourivanhofwegen
- AI Late to Class — объяснения open source-воркфлоу для локального запуска в ComfyUI и WanGP. https://www.youtube.com/@ailatetoclass
- AI大学【AI&ChatGPT最新情報】 — японский канал, объясняющий сравнения генераторов изображений вроде GPT Image 2 против Nano Banana. https://www.youtube.com/@AIAIChatGPT-cj4sh
- Для справки: Matt Wolfe(@mreflow) — крупный новостной ИИ-канал примерно с 965 тыс. подписчиков, который еженедельно собирает новости индустрии. В текущей выборке прямого попадания не было, но это один из заметных каналов в области.
Видео
-
«Google won image generation (it's not even close) NANO BANANA PRO BREAKDOWN»
Канал: Theo - t3.gg|Опубликовано: примерно 26 ноября 2025 года|https://www.youtube.com/watch?v=UV9GqinedQ8
→ Разбор с утверждением, что Google Nano Banana Pro (Gemini 3 Pro Image) превосходит остальные модели в генерации изображений. Показательный выпуск о переднем крае закрытого сегмента. -
«Nano Banana PRO (Gemini-3.0-Pro-Image): I GOT EARLY ACCESS...»
Канал: AICodeKing|https://www.youtube.com/watch?v=13AovEj4oDM
→ Обзор раннего доступа к Gemini 3 Pro Image. Много примеров; модель оценивается как впечатляющая. -
«GPT Image 2 Is Here — Everything You NEED to Know»
Канал: ElevenLabs|Опубликовано: 23 апреля 2026 года|https://www.youtube.com/watch?v=blOlUnC75O4
→ Объяснение OpenAI GPT Image 2, также называемой ChatGPT Images 2.0: точность текста выше 99% более чем на 12 языках, до 8 изображений на промпт в Thinking mode, поддержка 4K в API/бете. Представлена как одно из крупнейших улучшений моделей изображений года. -
【Превзошла Nano Banana】Что такое новая модель генерации изображений OpenAI «GPT Image 2»?
Канал: AI大学【AI&ChatGPT最新情報】, японский|https://www.youtube.com/watch?v=ZrO7tv-uv1E
→ Японское объяснение GPT Image 2 в сравнении с Nano Banana: производительность, использование и практические примеры. -
«Kling 3.0 vs Grok Imagine vs Runway Gen-4.5 vs Veo 3.1: The Ultimate AI Video Comparison»
Канал: Marin Method|Опубликовано: 10 марта 2026 года|https://www.youtube.com/watch?v=x5fMQvhKP60
→ Прямое сравнение четырёх закрытых видеомоделей. Kling 3.0 оценивается как лидер по совокупности качеств, а Grok Imagine — как сильная модель для image-to-video. -
«Seedance 2.0 Just Destroyed Kling 3.0, Sora 2 & VEO 3.1 - Comparison»
Канал: Youri van Hofwegen|https://www.youtube.com/watch?v=vw_Jk2-phsA
→ Сравнение, утверждающее, что Seedance 2.0 от ByteDance превосходит основные существующие закрытые модели. -
«New Qwen Image 2512: Better Than Z-Image? (Open Source & Free)»
Канал: AIOnTrend|Опубликовано: начало января 2026 года|https://www.youtube.com/watch?v=uAGH_yRZ2Gw
→ Сравнение открытой Qwen-Image 2512 от Alibaba и популярной Z-Image Turbo; рассматриваются преимущества бесплатной лицензии семейства Apache. -
«Is Flux 2.0 DEAD? Qwen image 2512 & Z-Image vs. The King (15 Stress Tests)»
https://www.youtube.com/watch?v=54zvSiAWz2Y
→ Семейство Flux от Black Forest Labs сравнивается с Qwen-Image 2512 и Z-Image по 15 стресс-тестам; делается вывод, что расстановка сил в open source-генерации изображений меняется. -
«LTX-2.3 Review: The Open-Source AI Video Model Built for Creators»
Канал: BMF MEDIA|Опубликовано: примерно месяц до поиска, около августа 2026 года|https://www.youtube.com/watch?v=qQXzlk134Sw
→ Обзор LTX-2.3 от Lightricks: 22 млрд параметров, синхронизация аудио, 4K/50 fps, open source. Свежий материал с точки зрения создателей контента. -
«WAN 2.5 CRUSHES VEO 3 (Higgsfield AI Workflow)»
Канал: Jack Vs. AI|https://www.youtube.com/watch?v=yvD8TxNsR4Q
→ Практический воркфлоу с утверждением, что open source-модель Wan 2.5 от Alibaba Tongyi даёт результат лучше закрытой Google Veo 3. -
«This AI Agent Can Make Movies WanGP Deepy - Open source free Agent for LTX 2.3 Qwen Klein Z-Image»
Канал: AI Late to Class|https://www.youtube.com/watch?v=h-k6xOEITx4
→ Демонстрация бесплатного агента WanGP, объединяющего LTX-2.3, Qwen, Flux.2 Klein, Z-Image и другие открытые модели для автоматизированного создания видео. Это признак интеграции open source-экосистемы. -
«HunyuanImage 3.0 : Open Source Text To Image Model (Forget Nano Banana & Seedream 4)»
https://www.youtube.com/watch?v=32lhiZKhgOY
→ Представление HunyuanImage 3.0 от Tencent — открытой MoE-модели изображений с более чем 80 млрд параметров и 13 млрд активных. Заявляется сопоставимость или превосходство над Nano Banana; первое появление видео относится к сентябрю 2025 года, но модель остаётся важной точкой отсчёта среди крупных open source-моделей.
Сигналы
Движение закрытого сегмента
- 17 августа 2026 года Google полностью закрыла линейку Imagen и объединила усилия вокруг Nano Banana, включая Gemini 3 Pro Image. Основные закрытые модели изображений концентрируются вокруг Gemini.
- OpenAI закрыла приложение Sora 26 апреля 2026 года, а Sora API планируется закрыть 24 сентября 2026 года. Sora как самостоятельный продукт для видео фактически сворачивается, а ресурсы OpenAI переходят к GPT Image 2 и интеграции в ChatGPT.
- GPT Image 2 от OpenAI, выпущенная в апреле 2026 года, относится к лидерам Arena в text-to-image и редактировании. Grok Imagine Image 2.0 от xAI, выпущенная 7 августа 2026 года, идёт почти впритык на втором месте: закрытая генерация изображений превратилась в тройную гонку OpenAI, Google и xAI.
- Seedance 2.5 от ByteDance получила общий доступ к API 7 августа 2026 года и быстро вышла в число основных вариантов наряду с Google Veo 3.1 и Kling 3.0.
- В сравнительных видео о закрытой генерации видео закрепляется разделение ролей: Kling 3.0 сильна в общем качестве, Veo 3.1 — в визуальной красоте, Runway Gen-4.5 — в творческой свободе.
Движение open source
- В генерации изображений Qwen-Image 2512 от Alibaba и Z-Image Turbo, работающая за 8 шагов и на 16 ГБ VRAM, стали двумя крупнейшими трендами; их популярность подтверждается множеством сравнительных роликов.
- Flux.2 Klein от Black Forest Labs — 4B, около 13 ГБ VRAM на уровне RTX 3090, Apache 2.0 — часто упоминается как лёгкий открытый вариант.
- HunyuanImage 3.0 от Tencent, MoE-модель более чем на 80 млрд параметров, остаётся ориентиром среди крупных открытых моделей изображений.
- В видео Alibaba Tongyi Wan 2.2/2.5 — MoE-диффузия, в том числе версия GGUF на 8 ГБ — и LTX-2.3 от Lightricks с синхронизацией аудио, 4K/50 fps и 22 млрд параметров получают оценки уровня закрытых решений.
- Растёт число видео об агентах и воркфлоу, объединяющих несколько открытых моделей, таких как ComfyUI и WanGP. Внимание смещается от сравнения отдельных моделей к интегрированным рабочим процессам.
- В целом обзоры и сравнительные ролики сходятся на том, что разрыв качества между открытыми и закрытыми решениями сокращается, и многие творческие команды сначала рассматривают open source.
Ограничения
- В текущей среде страницы поиска и сами видео YouTube рендерятся JavaScript, поэтому через WebFetch нельзя было напрямую получить просмотры, даты публикации и число подписчиков. Названия каналов удалось получить через YouTube oEmbed API, но и этот способ не даёт просмотры или подписчиков.
- Поэтому показатели просмотров и подписчиков отмечены как неизвестные; использовались только дата и контекст, попавшие в сниппеты WebSearch. Численно сравнить свежесть — например, просмотры за последние 60 дней — не удалось.
- Содержимое видео и верхние комментарии напрямую не читались из-за JavaScript. Выводы косвенно основаны на заголовках, сниппетах и сводках связанных материалов WebSearch, а не на дословных цитатах из видео.
- Видео о HunyuanImage 3.0 впервые появилось в сентябре 2025 года, за пределами рекомендованного окна в 60 дней; оно упомянуто только как постоянный ориентир среди крупных открытых моделей изображений.
- В выборке лишь один японский канал — AI大学, поэтому глубину обсуждения в японском YouTube-сегменте подтвердить нельзя.
Bluesky
Bluesky — актуальные тенденции ИИ для генерации изображений и видео
Аккаунты
- Simon Willison @simonwillison.net — известный разработчик ИИ. При выходе новых моделей часто публикует бенчмарк-изображение «пеликан едет на велосипеде» для сравнения качества генерации. У многих постов сотни лайков.
- Ethan Mollick @emollick.bsky.social — профессор Уортонской школы Университета Пенсильвании. Регулярно публикует эксперименты, в которых GPT-6 Astra и Fable 5.1 создают 3D-сцены в Blender.
- Alessandro Perilli @perilli.com — разработчик "Open Creative Studio", ранее AP Workflow: открытого универсального генеративного воркфлоу для ComfyUI, поддерживающего текст, изображения, видео и звук.
- luokai @luok.ai — аккаунт, последовательно публикующий обновления закрытых ИИ для видео: Kling, Runway, Vidu, PixVerse, Seedance, Niji и другие.
- dahara1 @dahara1.bsky.social — японский инженер, пишущий о практическом опыте с LLM и генеративным ИИ, в том числе о собственных инструментах машинного перевода. Отслеживает актуальные темы вроде закрытия Sora и сравнений Nano Banana. Небольшой аккаунт: 113 подписчиков.
- Midjourney Experience Newsletter @midjourneynews.bsky.social — неофициальный фанатский новостной аккаунт, а не официальный Midjourney. Публикует эксперименты с промптами и фрагменты новостей индустрии, с низкой вовлечённостью.
- Stable Diffusion online AI @stablediffusion.bsky.social — лента с работами SD/Midjourney. Свежие посты прекращаются в январе–феврале 2025 года, поэтому источником актуальных новостей она не является.
- Поиск официальных аккаунтов: официальные Bluesky-аккаунты Black Forest Labs, Runway, Stability AI и Civitai подтвердить не удалось — они либо отсутствуют, либо их хендлы неизвестны. Похожий на официальный
midjourney.bsky.social— пустой аккаунт без публикаций.
Публикации
-
«Закрытие Sora» — dahara1, 2026-04-28, 0 лайков/0 репостов
https://bsky.app/profile/dahara1.bsky.social/post/3mkjnla6hnk2m
Комментарий о завершении сервиса генерации видео OpenAI Sora: вероятно, к нему и не было особой привязанности. Подтверждено WebSearch: сообщалось, что OpenAI прекращает приложение Sora и API для разработчиков примерно в марте 2026 года. -
Бесплатная Sora перестала генерировать после исчерпания кредитов — dahara1, 2026-04-04
https://bsky.app/profile/dahara1.bsky.social/post/3miogq762u223
Сообщение о том, что видео не создаётся даже при одном оставшемся кредите. Это согласуется с новостями о завершении сервиса. -
Сравнение водяных знаков Nano Banana в бесплатной версии и ChatGPT Images 2.0 — dahara1, 2026-05-04, 1 лайк
https://bsky.app/profile/dahara1.bsky.social/post/3mkztj6phrk2l
Автор отмечает, что у ChatGPT Images 2.0, как и у бесплатной Nano Banana, нет заметного водяного знака, поэтому ею удобно пользоваться. -
Seedance 2 превосходит другие модели — luokai, 2026-02-10, 5 лайков
https://bsky.app/profile/luok.ai/post/3mehseuzlls2r
К оригинальному видео, сделанному за один день, приложена высокая оценка качества Seedance 2. -
Релиз Niji 7 — luokai, 2026-01-10, 3 лайка
https://bsky.app/profile/luok.ai/post/3mc2422hgck2m
Аниме-ориентированная модель генерации изображений Niji 7 заявляет более чёткие глаза, лучшую согласованность и более точное следование промптам. -
Runway Gen-4.5 — luokai, 2025-12-02, 4 лайка/1 репост
https://bsky.app/profile/luok.ai/post/3m6xsakpud226
Представлена как модель, повышающая стандарт движения, точности и контроля промпта, с акцентом на world modeling. -
Kling IMAGE O1 — luokai, 2025-12-03, 3 лайка
https://bsky.app/profile/luok.ai/post/3m72caiexw225
Полное обновление системы генерации изображений Kling с заявкой «принимать, понимать и создавать что угодно». -
Kling VIDEO 2.6 — luokai, 2025-12-05, 2 лайка
https://bsky.app/profile/luok.ai/post/3m7aio7hntk2f
Продвигается как генерация видео, ориентированная на историю, с синхронизацией звука, липсинком и согласованностью сцен. -
PixVerse V5.5 — luokai, 2025-12-02, 4 лайка/2 репоста
https://bsky.app/profile/luok.ai/post/3m6xrxnh47c27
Акцент на упрощении производства: генерация нескольких кадров одним касанием, автоматические звуковые эффекты и подобные функции. -
Модель изображений Vidu AI Q2 — luokai, 2025-12-02, 5 лайков/2 репоста
https://bsky.app/profile/luok.ai/post/3m6xrt43ll227
Заявлены «4K за 5 секунд» и кампания с безлимитной генерацией до 31 декабря. -
SkyReels V1, открытая базовая модель для видео — luokai, 2025-02-18, 3 лайка/1 репост
https://bsky.app/profile/luok.ai/post/3lihm6qiuyk27
Заявлена как первая открытая видеомодель, ориентированная на человека. HunyuanVideo дообучена на более чем 10 млн роликов, чтобы воспроизводить 33 выражения лица и свыше 400 естественных движений. Посту более года, но это единственное явное упоминание открытой видеомодели, найденное в этой ленте. -
Open Creative Studio v13.0, открытый интегрированный воркфлоу для ComfyUI — Alessandro Perilli, 2026-01-26, 0 лайков
https://bsky.app/profile/perilli.com/post/3mdddenkss22v
Представлен как наиболее функциональный универсальный воркфлоу ComfyUI, генерирующий текст, изображения, видео, аудио, музыку, эффекты и тексты песен; подчёркивается бесплатность и отсутствие лимитов. -
Локальная генерация изображений Qwen 3.7 27B: пеликан — Simon Willison, 2026-08-14, 183 лайка/14 репостов
https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z
На M5 Max MacBook Pro через LM Studio модель Qwen 3.7 27B в 17-ГБ GGUF, по словам автора, нарисовала лучшего пеликана на велосипеде среди моделей, работающих на его ноутбуке. Это пример силы локальных моделей с открытыми весами. -
Сетка сравнения пеликанов: GPT-6 Astra против серии GPT-5.6 — Simon Willison, 2026-09-04, 202 лайка/9 репостов
https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2i
Набор из 12 изображений, сопоставляющий GPT-6 Astra и четыре модели GPT-5.6 — Sol, Terra и Luna — в продолжающемся бенчмарке генерации изображений закрытыми моделями. -
Генерация 3D в Blender с GPT-6 Astra: архитектурная модель — Ethan Mollick, 2026-09-05, 163 лайка/17 репостов
https://bsky.app/profile/emollick.bsky.social/post/3murua22igs2i
По одному эскизу и описанию модель создала в Blender 3D-модель неосуществлённого здания XVIII века — кенотафа Булле — и даже прогулочный ролик с озвучкой. В другом посте того же аккаунта 7 сентября отмечается, что визуальная генерация становится способом для закрытых LLM обрести «ощутимое присутствие». -
«Midjourney стала частью Meta.ai» — Midjourney Experience Newsletter, 2026-02-03, 1 лайк
https://bsky.app/profile/midjourneynews.bsky.social/post/3mdxymie7pi25
⚠️ Важно: это пост неофициального фанатского аккаунта, который, вероятно, чрезмерно упрощает факты. Проверка WebSearch показывает, что в августе 2025 года Meta объявила о партнёрстве по лицензированию эстетических технологий Midjourney, а не о приобретении: Midjourney сохранила независимость (TechCrunch, implicator.ai).
Сигналы
- Закрытая генерация видео — поле ожесточённой конкуренции: только с декабря 2025-го по февраль 2026-го в одной ленте luok.ai последовательно появились как минимум семь новых моделей или версий: Runway Gen-4.5, Kling IMAGE O1/VIDEO 2.6/O1, PixVerse V5.5, Vidu AI Q2, Seedance 2 и Niji 7. Особенно заметен напор китайских моделей Kling, Vidu, PixVerse и Seedance.
- Sora теряет темп и идёт к закрытию: по постам dahara1, в апреле 2026 года кредиты бесплатной Sora уже не работали, а к концу месяца появилось прямое сообщение о закрытии. Это соответствует сообщениям о прекращении OpenAI приложения Sora и API для разработчиков примерно в марте 2026 года. Инициатива в видео, по-видимому, переходит к китайским моделям и функциям в универсальных продуктах Google/OpenAI.
- Генерация изображений становится функцией самих LLM и объектом бенчмарков: публикации Simon Willison и Ethan Mollick сравнивают уже не отдельные сервисы изображений, а визуальные и 3D-возможности универсальных LLM вроде GPT-6 Astra, Claude Fable 5.1 и Qwen 3.7/3.8 27B. Визуальная генерация GPT-6 Astra, включая 3D-реконструкции архитектуры в Blender, становится показателем силы модели в соцсетях.
- Разговоров об открытой генерации видео в Bluesky мало: в поиске и исследованных лентах найден только один ясный пост об открытой видеомодели — SkyReels V1 на базе HunyuanVideo, опубликованный в феврале 2025 года. Упоминаний Wan2.2, Qwen-Image, Z-Image и других открытых моделей, которые должны быть заметны в 2026 году, не найдено. ComfyUI появляется главным образом в регулярных анонсах одного проекта Open Creative Studio.
- Отношения Midjourney и Meta легко искажаются: неофициальный аккаунт свёл партнёрство к утверждению «Midjourney стала частью Meta.ai», хотя на деле это лицензирование технологии, а не покупка. Это наглядный пример необходимости осторожно относиться к точности соцсетевых сообщений.
Ограничения
- Официальный поисковый API Bluesky (
app.bsky.feed.searchPosts) возвращал 403 Forbidden на все запросы, поэтому поиск по ключевым словам был полностью недоступен. Другие публичные API —app.bsky.actor.getProfile,app.bsky.feed.getAuthorFeed,app.bsky.feed.getPostThread— работали, что указывает на возможное ограничение именно поисковых конечных точек. - Веб-поиск на
https://bsky.app/search?q=...также рендерится на стороне клиента, поэтому извлечь содержимое постов через fetch нельзя. - Взамен поиска по ключевым словам через WebSearch были найдены релевантные аккаунты, после чего читались их ленты через getAuthorFeed. Такой метод зависит от аккаунтов, случайно попавших в поисковик, а не от полного покрытия запросов; этим может объясняться перекос, особенно недостаток открытых видеомоделей.
- Поиск в интернете Bluesky-постов по Wan2.2, Qwen-Image, Z-Image и HunyuanVideo выдавал в основном arXiv и нерелевантные аккаунты; подходящих постов не нашлось.
- Не удалось подтвердить хендлы официальных Bluesky-аккаунтов Black Forest Labs, Runway, Stability AI и Civitai: результаты были либо 400, либо отсутствовали.
- Лента
stablediffusion.bsky.socialостановилась на январе–феврале 2025 года и не может служить источником свежих новостей. - Требование анализировать примерно 20 постов для каждой соцсети выполнено частично: из более чем 100 просмотренных публикаций в лентах шести аккаунтов были отобраны 16 тематически релевантных.
Lemmy
Lemmy — актуальные тенденции ИИ для генерации изображений и видео
Lemmy — децентрализованная часть Fediverse. Исследование опиралось главным образом на API-поиск lemmy.world (/api/v3/search) и lemmy.today, фактически отображающий сообщества lemmy.dbzer0.com, а также на WebSearch по site:lemmy.world. Всего проверено примерно 25 постов.
Сообщества
- !«メールアドレス» — около 5 050 подписчиков; ключевое сообщество по open source-генерации изображений семейства Stable Diffusion.
- !«メールアドレス» — на
lemmy.todayназывается "Stable Diffusion Art" — 2 362 подписчика. Ежедневно публикуются несколько работ, созданных в SDXL/ComfyUI/Krea2, часто со ссылками на civitai.com. - Stable Diffusion Anime, Stable Diffusion Abstraction, Stable Diffusion Witches, Stable Diffusion Furry, Stable Werewolves — нишевые тематические сообщества сети
lemmy.dbzer0.com. Число подписчиков не раскрывается, но в сентябре 2026 года публикации выходят ежедневно. - c/«メールアドレス» — общее техническое сообщество, куда попадают крупные новости закрытого сегмента: спор о медицинских сканерах Midjourney и сообщения о Sora.
- c/genart — 47 подписчиков; небольшое сообщество, прямо поддерживающее открытые и открыто лицензируемые генеративные ИИ-модели.
- c/«メールアドレス» — сообщество об анти-ИИ-настроениях. Оно не посвящено исключительно генерации изображений и видео, но пост о желании отказаться от зависимости от ИИ получил высокий балл 83.
- c/euroai — нишевое сообщество со списками европейских open source-ИИ и LLM.
Публикации
Ближе к закрытым решениям
- «Midjourney pivots from AI image generation to body scanning medical spa» (2026-06-18, 58 баллов, technology) https://lemmy.world/post/... через theregister.com — новость о том, что Midjourney отходит от генерации изображений и входит в бизнес ультразвуковых КТ-сканеров для медицины. The Register отмечает, что базовая технология реальна, но партнёры не раскрыты.
- «Midjourney AI pivots to Theranos: Ultrasonic CT» (2026-06-19, 40 баллов, techtakes) через pivot-to-ai.com — ироничная публикация, сравнивающая эту историю с Theranos.
- «I was wrong about the Midjourney ultrasound scanner» (2026-06-21, hackernews) https://twitter.com/MattZirwas/status/2068365802491834541 — автор, первоначально скептически отнёсшийся к новости, проверил факты и отозвал прежнюю критику.
- «Midjourney wants Hollywood studios to reveal details of their AI usage» (2026-07-05, 73 балла, technology) через techcrunch.com — в споре с тремя студиями Midjourney требует раскрыть, как Голливуд сам использует ИИ.
- Реакция на закрытие Sora от OpenAI: «OpenAI: decides to shut down their AI slop video generating model Sora» https://lemmy.world/post/44721138 — насмешка над закрытием отдельного приложения Sora: объявление 24 марта 2026 года, остановка 26 апреля, планируемое закрытие Sora 2 API 24 сентября 2026 года.
- «OpenAI collapses media reality with Sora AI video generator» https://lemmy.world/post/12056737 — репост статьи о снижении доверия к анонимным видео.
- «OpenAI's new Sora video generator to require copyright holders to opt out, WSJ reports» https://lemmy.world/post/36665644 — критика подхода, при котором правообладатели должны сами отказываться от использования их работ.
- «Elon Musk maakt complete AI-film met zijn versie van The Odyssey» (2026-07-22, films) через ad.nl — анонс Маска о производстве полнометражного ИИ-фильма «Одиссея» с Grok Imagine.
- Пост с анализом выручки ChatGPT (2026-07-15, ai_reddit) — утверждается, что большая часть выручки Grok/xAI приходится на платный NSFW-контент, созданный ИИ в изображениях и видео.
- «Video AI» — вопрос о бесплатном лимите Adobe Firefly для видео; в качестве альтернатив сравниваются Hailuo, Kling, Runway, Pixverse и Hunyuan.
Ближе к open source
- «Black Forest Labs launches FLUX 3 capable of generating images and 20-second video with audio» (2026-07-24, 1 балл, tech) https://bfl.ai/blog/flux-3 — ограниченный релиз мультимодальной FLUX 3, создающей изображения и 20-секундные видео с аудио.
- «FLUX.2-klein-9b-kv-fp8 optimized variant» (2026-03-14, 8 баллов, stable_diffusion) через huggingface.co — облегчённая производная FLUX.2 с поддержкой KV-кэша.
- «Black Forest Labs Opening up the first FLUX Creator Program» (2026-05-06, 3 балла, stable_diffusion) — анонс запуска программы для создателей.
- «Regisseur Martin Scorsese wordt adviseur bij AI-bedrijf» (2026-06-03, films) через nu.nl — режиссёр Мартин Скорсезе становится советником Black Forest Labs.
- «FLUX Chroma (The Perchance T2i model)» — около года назад, сообщество Perchance, huggingface.co(lodestones/Chroma) — производная модель с NAG, Normalized Attentive Guidance; в комментариях отмечается качество липсинка.
- Примеры ежедневных постов сообществ Stable Diffusion, 6–9 сентября 2026 года, всё создано локально в SDXL/ComfyUI/Krea2: «Erika - Mahouka Koukou No Rettousei» (16 баллов), «Colors in Quiet Water» (14), «Giant Wire Walker» (11), «Karin - Umi Monogatari» (13). Все сопровождаются ссылками на civitai.com.
- «Opendream = NEW! Stable Diffusion Automatic1111/ComfyUI alternative that uses nondestructive layering like Gimp» https://lemmy.world/post/3243205 — представление OSS-интерфейса с неразрушающим послойным редактированием в стиле GIMP.
- «Europäische KI- & LLM-Anbieter» (2026-02-15, euroai) — список европейских открытых ИИ с упором на технологический суверенитет и защиту данных; включает модели генерации изображений.
- «Your Lemmy Crash Course to Free Open-Source AI» https://lemmy.world/post/76020 — вводное руководство по локальным инструментам: text-generation-webui, Automatic1111, ComfyUI + Pinokio и другим.
Сигналы
- Главная тема закрытого сегмента — спор вокруг медицинского поворота Midjourney (40–73 балла): переход от основного бизнеса генерации изображений к ультразвуковым диагностическим устройствам вызывает полярные реакции в technology, hackernews и techtakes. Заметны саркастические сравнения с мошенничеством Theranos, но один из первоначальных критиков позже публично признал ошибку.
- OpenAI Sora постоянно служит мишенью как образец «ИИ-слопа». После прекращения приложения в марте–апреле 2026 года обсуждение продолжается вокруг запланированного закрытия Sora 2 API 24 сентября.
- В open source доминирует Black Forest Labs и FLUX. FLUX 3 с изображениями и 20-секундным видео со звуком, облегчённая FLUX.2-klein, Creator Program и назначение Скорсезе советником обеспечивают компании конкретные новости каждый квартал.
- Повседневные творческие сообщества Stable Diffusion Art/Anime/Abstraction и другие невелики — примерно 2–5 тыс. участников, — но в сентябре 2026 года продолжают ежедневно публиковать локальные работы SDXL, ComfyUI и Krea2. Это показывает плотность реального применения open source.
- Анти-ИИ-настроения тоже значимы: пост в c/fuck_ai о желании уйти от зависимости от ИИ получил 83 балла — больше большинства обычных ИИ-постов. Это указывает на устойчивое неприятие генерируемого ИИ-контента в Lemmy.
- Закрытые новости в Lemmy — это в основном не самостоятельные находки платформы, а репосты и реакции на уже опубликованные материалы TechCrunch, The Register, WSJ и других медиа. Первичные источники находятся за пределами Lemmy.
Ограничения
- По числу пользователей и постов Lemmy невелик по сравнению с Reddit; специализированные дискуссии о генерации изображений и видео здесь ограничены. Не удалось найти сообществ, глубоко обсуждающих именно видеогенерацию Sora, Veo, Kling или Runway.
- Полнотекстовый API-поиск
lemmy.worldнедостаточно точен: общие запросы наподобие "AI image generation" выдавали нерелевантные посты о карте мира ООН или размножении сов. Релевантные публикации удавалось находить при запросах по названиям моделей — Sora, Midjourney, FLUX и другим. - Некоторые страницы —
lemmy.world/post/44721138и публикация о DLSS 5lemmy.world/post/44347792— возвращали HTTP 500 или не позволяли получить содержимое. Оценки строились только по заголовкам и сниппетам WebSearch. - Поиск в Lemmy по Grok Imagine, Qwen Image, HunyuanVideo, Wan2.2, Nano Banana/Gemini и Veo дал очень мало прямых упоминаний; Grok Imagine встретилась лишь в одном посте о кино. Можно сказать, что на Lemmy эти модели почти не обсуждаются.
- Отдельные поиски по lemmy.ml и lemm.ee в основном давали дубликаты
lemmy.worldили зеркала одних и тех же федеративных постов; уникального дополнительного материала не нашлось.
Pinterest — Новости ИИ для генерации изображений и видео
Все 50 собранных пинов были открыты и проверены по изображениям. Они не разбиты на жанры и собраны одним поисковым запросом «Image and Video Generation AI News».
Визуальные темы(visual themes)
- Засилье шаблона «лицо робота + срочная новость»: постоянно повторяются обложки с крупным планом половины лица белого гуманоидного робота и неоновыми красно-синими надписями "AI NEWS" или "BREAKING NEWS". Варианты включают робота за столом ведущего новостей [22], коллаж с удивлённым мужчиной-ютубером и лицом робота [29], женщину-робота с текстом "THE FUTURE IS AI" [39]. Доминируют тёмно-синий фон и неоновые циан, маджента и оранжевый.
- Обложки с реакцией ютуберов: на фотографии удивлённого или подозрительно смотрящего белого мужчины размещают круглые иконки с неоновой окантовкой — OpenAI, Google, Meta, Anthropic, Grok, Notion и другие. Такой приём повторяется в нескольких пинах [4, 18] и, вероятно, связан с репостами YouTube-видео.
- Инфографика-подборки «N лучших»(listicle): самый частый формат — вертикальные инфографики в тёмной фиолетово-чёрной теме с пронумерованными карточками инструментов. Runway, Pika, Kling AI, Luma AI (Dream Machine), Canva AI и Hailuo AI почти всегда входят в один и тот же набор [9, 10, 27, 36, 50].
- Формат до/после и сравнительные тесты: заметны парные фото гор с вопросом "Which is AI?" [13], а также сетки, преобразующие исходное видео в персонажей из деревянных блоков, оригами, LEGO или цветов [11]. Они подчёркивают, насколько трудно отличить генерацию и насколько сильна трансформация материалов.
- Робот и человек сотрудничают, в том числе в медицине: часть изображений показывает фотореалистичный CG-робот рядом с медиком, работающим с голограммой [3, 33], либо иллюстрации врача со стетоскопом и робота [32]. У этих работ более спокойный тон сосуществования ИИ и людей.
- Технологичность через тёмные тона и неон: примерно 70% изображений используют тёмно-синий или чёрный фон с циановыми, маджентовыми и фиолетовыми неоновыми схемами, световыми частицами и линиями. Это выглядит как типичный Pinterest-стиль «технологических новостей».
- Реклама ИИ-видео с аватарами и иконками персонажей: есть реклама объясняющих ИИ-видео в стиле Fiverr с синтетическим изображением Джеффа Безоса [38], а также фотореалистичная демонстрация AMD Amuse 3.0 с лицом старого рыбака [46]. Лица известных людей и фотореалистичные портреты используются для демонстрации качества ИИ.
- Изображения о том, заметна ли ИИ-генерация: повторяются композиции с роботом, смартфоном, штампом "FAKE" и фото кота, силуэтами людей в масках [3], а также пины об инструментах обнаружения ИИ [37]. Они визуализируют тревогу о подлинности и дезинформации.
Заметные пины(notable pins)
- [11] Демонстрация преобразования материалов в стиле Luma AI: один исходный ролик — человек, плюшевая панда, автомобиль — показан в пяти преобразованных вариантах: деревянные блоки, оригами, LEGO, цветы и другие. Это самый конкретный пин, демонстрирующий способность видеогенерации менять фактуру.
- [24] Соглашение ByteDance и Голливуда об ИИ-авторском праве: скриншот новости с заголовком "ByteDance and Hollywood reach global deal on AI copyright". Сообщается, что ByteDance и Motion Picture Association достигли глобального соглашения об усилении защиты интеллектуальной собственности в инструментах генерации изображений и видео. Это почти первичный источник о подходе крупного закрытого игрока к авторскому праву.
- [35] Сводка ИИ-новостей от 12 августа 2026 года: три новости — "Grok 4.6 drops" с утверждением о десятках автономных шагов и самопроверке, "Gemini hits 1 billion users" с данными о самом быстром достижении 100 млн пользователей в истории Google, голосовом вводе у двух из трёх пользователей и 150 млн генерируемых изображений в день, а также "Honor's robot phone" с титановой рукой камеры, автоматически отслеживающей объект. Это редкий пин с датой и числами, близкий к первичной информации.
- [36] Рейтинг "Best AI Video Generators of 2026": Google Veo 3.1, Runway Gen 4.5 и Kling 3.0 отмечены как первая тройка, далее идут Adobe Firefly, Seedance 1.5 Pro, Pika 2.5 и HeyGen. Список содержит номера актуальных версий моделей.
- [42] Vidu S1 от ShengShu Technology: продуктовый визуал китайской модели для интерактивного ИИ-видео в реальном времени с заявкой "The World's Most Advanced Model for Real-Time AI Interaction". Это один из немногих примеров движения за пределами западных моделей.
- [45] Статья-анонс нового инструмента изображений OpenAI: изображение с заголовком "OpenAI's Secret Image Generation Tool to Debut Soon", подогревающее ожидание от ещё не представленного продукта.
- [25] Сводка Google I/O 2026: Gemini 3.5 Flash, Gemini Omni, Gemini Spark, переход к ИИ-поиску и конкуренция Apple и Google в XR-очках — обзор движения всей ИИ-индустрии по состоянию на 20 мая 2026 года, а не только генерации изображений.
- [9] Инфографика сравнения видеогенераторов "Just Nail It": Runway, Pika, Kling AI, Luma AI, Canva AI и Hailuo AI сопоставлены по функциям и целевой аудитории. Также указана статистика, что к 2026 году 80% онлайн-контента будет включать видео.
- [8] Набор иконок для ИИ-генерации стокового контента: изображение в стиле Adobe Stock "Ai Content Creation Concept" с иконками генерации текста, изображений, музыки и видео. Это скорее показатель спроса на такой визуальный материал, чем сама новость.
- [43] Инфографика-таймлайн истории генеративного ИИ: фиолетовая временная шкала от ELIZA 1950-х до GPT 2020-х, помещающая современный бум генеративного ИИ в исторический контекст.
Сигналы(signals)
- По одним изображениям трудно увидеть противопоставление open source и закрытых решений: пины Pinterest в основном посвящены инструментам, новостным обложкам и практическим подборкам; явных сравнений вроде «Seedance против Wan», характерных для Reddit или X, не найдено. Лишь Vidu S1 от китайской ShengShu [42] и Amuse 3.0, связанный с AMD и локальной генерацией [46], выделяются как альтернативы американским закрытым платформам Google Veo, OpenAI Sora и Runway.
- Преобладают подборки, сравнения и руководства, а не срочные новости: среди 50 пинов только [24], [25], [35] и [45] содержат дату или конкретное объявление. Большинство — evergreen-подборки в духе "Best AI Video Generators" или "10 Smart Ways", рассчитанные на сохранения и аффилиатный трафик.
- Видна тревога по поводу подлинности и проверки контента: несколько изображений — [3], [22], [37] — используют штамп "FAKE", роботов-репортёров или инструменты выявления ИИ. Это говорит о заметном интересе аудитории Pinterest к сомнениям и проверке достоверности генеративного контента.
- Поколения моделей обновляются быстро: [36] фиксирует актуальные на 2026 год Veo 3.1, Runway Gen 4.5, Kling 3.0 и Seedance 1.5 Pro. Вместе с Grok 4.6 и миллиардом пользователей Gemini из [35] это подтверждает, что обновления стали нормой почти поквартально.
- Отсутствие: среди 50 результатов нет ни одного изображения, символизирующего локальную open-weight-культуру Stable Diffusion, ComfyUI или Hugging Face, часто встречающуюся на Reddit. Pinterest сильно смещён к рекламным материалам коммерческих SaaS-инструментов и почти не показывает коммуникацию действительно open source-сообществ.
Ограничения
- Материал заранее собран воркером через headless-браузер; агент не просматривал Pinterest напрямую, в соответствии с плейбуком.
- Разделения на жанры — секций
## <genre> (n)— не было: все 50 результатов получены одним запросом. Сравнение тенденций по жанрам невозможно. - Пять пинов имеют заголовок "(untitled)" — [5, 13, 15, 20, 24]; у [24] заголовок формально пустой, но содержание удалось определить по изображению статьи.
- Для каждого пина указан URL вида pinterest.com/pin/..., но переход по ссылке и проверка первоисточника не выполнялись: выводы основаны только на изображениях и заголовках. Даты публикации и показатели вовлечённости не собраны; время можно установить лишь для пинов, где дата напечатана непосредственно на изображении, таких как [25] и [35].
- Критерий завершения — минимум 10 наблюдений отдельно для закрытого и open source-сегмента — невозможно выполнить только с Pinterest: конкретных open source-наблюдений почти нет, кроме китайской [42] и связанной с AMD [46]. Недостаток нужно компенсировать результатами с других платформ, например Reddit.
Рекомендуемые действия
- Повторить сбор по X с запросами, напрямую связанными с темой: Midjourney, Stable Diffusion, Sora, Nano Banana, Qwen-Image и другими.
- В следующий раз включить в исследование Reddit крупные ключевые сабреддиты r/StableDiffusion, r/midjourney и r/comfyui.
- В условиях недоступности Bluesky Search API использовать найденные ключевые аккаунты как список наблюдения для регулярного мониторинга.
- В следующем исследовании первоочередно отслеживать закрытие OpenAI Sora API 24 сентября 2026 года и продолжение истории с поворотом бизнеса Midjourney.
Собранные изображения


















































Примечание о качестве данных
Из-за несоответствия поисковых запросов на X не было собрано ни одной тематической публикации. В Bluesky, Pinterest и YouTube часть поисковых API и показателей вовлечённости недоступна, поэтому количественное подтверждение некоторых выводов остаётся слабым.



