Новости ИИ для генерации изображений и видео — 2026-09-22
Закрытие API Sora 2026-09-24 — главная история момента в мире закрытых моделей, тогда как MiniMax H3 и китайские лаборатории с открытыми весами (Alibaba/Qwen, ByteDance, Baidu, Tencent) формируют наиболее быстрорастущую экосистему open source вокруг ComfyUI.
Новости ИИ для генерации изображений и видео — 2026-09-22
Главная новость среди закрытых моделей — полное прекращение работы API OpenAI Sora для генерации видео 2026-09-24 (через два дня после этого отчёта). Приложение уже было закрыто в апреле; причиной стало ухудшение экономики продукта: около 1 млн долларов операционных расходов в день при суммарной выручке около 2,1 млн долларов. Тем временем GPT Image 2.5 и Nano Banana Pro/2 от Google DeepMind соревнуются в скорости и фотореализме, а гонка закрытых решений накаляется обновлениями каждые несколько недель. В open-source сегменте экосистема ComfyUI продолжает расти вокруг MiniMax H3, а новые модели от китайских лабораторий — Alibaba (Qwen), ByteDance, Baidu и Tencent — особенно заметны. На нескольких платформах также звучит мнение, что ощущаемая разница качества между закрытыми и открытыми решениями сокращается.
На разных платформах
- Завершение работы Sora API (2026-09-24) — главная общая тема закрытого сегмента. Пост Ed Zitron в Bluesky (3 572 лайка, наивысшая вовлечённость во всём сборе) сообщил эту новость, а она же обсуждалась в итоговом видео State of AI Video на YouTube и в публикации !ai_reddit на Lemmy. Три платформы независимо считают это событие ключевым; ухудшение соотношения выручки и затрат приводят как пример того, что в закрытом сегменте не действует простая логика «победитель забирает всё».
- MiniMax H3 — общий ключевой термин в open-source генерации видео. На Reddit подробно обсуждаются способы бесплатного использования Wan и MiniMax H3; Adina Yakup в Bluesky представила восьмишаговую ускоренную дистиллированную версию MiniMax H3 под названием HyperFlow; на Lemmy с августа по сентябрь 2026 года опубликовано более пяти связанных с MiniMax H3 нод для ComfyUI. Одно и то же название независимо появляется на трёх платформах, что позволяет назвать модель наиболее динамичной среди открытых видеомоделей.
- GPT Image 2.5 упоминается на трёх платформах как ведущая закрытая модель генерации изображений. В Reddit (тред r/ImagineAiArt с 92 баллами) её одновременно хвалят и отмечают, что субъективно она не отличается от KREA2; YouTube разбирает сокращение задержки генерации на 50% и функцию Sketch; Simon Willison в Bluesky создал на этой модели концепт-арт.
- Китайские лаборатории особенно заметны в open-source сегменте. В Bluesky (Adina Yakup), YouTube и Lemmy регулярно фигурируют открытые модели с лицензиями типа Apache-2.0 от Alibaba (Qwen-Image-2.1), ByteDance (Lance, Seedance), Baidu (ERNIE-Image) и Tencent (HunyuanVideo 1.5). Несколько платформ подтверждают картину, в которой главными действующими лицами open-source тренда стали китайские компании.
- ComfyUI стал фактической общей платформой. Почти все обзорные ролики на YouTube и большая часть постов !«メールアドレス» на Lemmy упоминают реализацию или рабочие процессы в ComfyUI; практическое использование open-source инструментов всё больше концентрируется там.
- Субъективный разрыв качества между закрытыми и открытыми моделями уменьшается. На Reddit есть комментарий, что «GPT Image 2.5 и KREA2 дают одинаковый результат», тогда как на Pinterest маркетинг закрытых решений заметно доминирует, а упоминаний open source почти нет. Вероятнее всего, это говорит не о слабости open source, а о его меньшей видимости для массового потребителя.
По платформам
Reddit: собрано 12 тредов из 7 сабреддитов. Спрос на бесплатную генерацию AI-видео столкнулся с настроением «поймите уже, что это невозможно», а рекомендации открытых моделей Wan и MiniMax H3 возникают органично и часто. Явным сигналом также стал рост пользователей DeepSeek (+66,7%) на фоне нехватки вычислительных мощностей. Одни и те же рекламные комментарии с реферальным кодом встречаются в нескольких тредах, поэтому к примесям рекламы в органических обсуждениях следует относиться осторожно.
X: из 32 собранных публикаций от 31 аккаунта ни одна не касалась ИИ для генерации изображений или видео. Использованные поисковые слова (Bitcoin, Zelensky, Zagreb и др.) были просто заимствованы из стандартных трендов Explore в X, предположительно региональных для Хорватии, и не имели отношения к теме. По X содержательных выводов по этой теме получить не удалось.
YouTube: через WebSearch найдено более 30 заголовков, из которых выбраны 13 показательных роликов. В закрытом сегменте стандартным форматом стали сравнения GPT Image 2.5, Nano Banana Pro/2, Sora 2, Veo 3.1 и Kling 3.0. В открытом сегменте продолжается тренд на облегчение моделей без потери качества: Z-Image Turbo, Qwen-Image-2.1, LTX-2, HunyuanVideo 1.5. Из-за JavaScript-рендеринга страниц нельзя было получить просмотры и точные даты, поэтому они считаются приблизительными.
Bluesky: поскольку поисковый API (searchPosts) постоянно возвращал 403, вместо него использовалось прямое чтение лент релевантных аккаунтов. Пост Ed Zitron о закрытии Sora получил наибольшую вовлечённость. Новости open source почти целиком зависят от одного аккаунта — Adina Yakup из Hugging Face; официальные аккаунты Civitai, ComfyUI и Stability AI в основном молчали или были неактивны.
Lemmy: проанализированы 16 публикаций из 8 сообществ. Почти все новости о закрытых моделях поступают из зеркал Reddit (!ai_reddit) или Hacker News (!hackernews) и имеют низкие оценки. Единственным вирусным сюжетом стал разворот Midjourney от генерации изображений к медицинскому ультразвуковому CT-сканеру (score 40). В open-source сегменте с августа по сентябрь регулярно появлялись публикации о нодах ComfyUI для MiniMax H3.
Pinterest: проанализировано 50 пинов. Большинство — карточки-подборки в духе «Best AI Video Generator» и типовые изображения AI-роботов; видно, что Kling AI и Hailuo AI вошли в верхний эшелон наряду с Runway, Pika и Luma. Упоминаний open source среди 50 пинов фактически нет: встречается лишь один заголовок "Open Models. Open weights.". Это само по себе важный вывод: на потребительских платформах open source почти невидим.
Из шести заданных в брифе платформ X (фактически 0 тематических публикаций из-за неверно выбранных запросов) и Reddit (12 тредов вместо целевых 20) не соответствуют критерию завершения «анализ около 20 публикаций». Эти пробелы явно отмечены; отсутствие иных, не указанных в брифе платформ в рамки анализа не входит.
За чем следить
- Куда перейдёт трафик после закрытия Sora API 2026-09-24 — Bluesky, пост Ed Zitron: https://bsky.app/profile/edzitron.com/post/3mhtesqgwxk2k
- Проблема «некоммерческой исследовательской лицензии» Qwen-Image-2.1 — спор о том, можно ли называть модель open source. YouTube: https://www.youtube.com/watch?v=tP_gGGJzEqg
- Темпы роста экосистемы MiniMax H3 × ComfyUI — Lemmy: https://lemmy.dbzer0.com/post/74279236
- Станет ли LTX-2 новым бенчмарком для open-source видео — YouTube: https://www.youtube.com/watch?v=27UAb_Tlv4E
- Последствия резкого роста спроса на DeepSeek (+66,7%) и нехватки вычислений — Reddit: https://www.reddit.com/r/DeepSeek/comments/1wmcgex/
- Дальнейшие новости о переходе Midjourney в медицинское оборудование — Lemmy: https://awful.systems/post/8731127
Рекомендации
- В следующем исследовании отследить, куда направится миграционный трафик сразу после закрытия Sora API: к Seedance 2.5, MiniMax H3 или Kling v3.
- Продолжать отслеживать официальные заявления Hugging Face и Alibaba: изменится ли лицензионная политика Qwen-Image-2.1.
- Наблюдать за частотой постов о нодах ComfyUI для MiniMax H3 как за опережающим индикатором развития open-source генерации видео.
- В следующем сборе данных по X отказаться от региональных трендов и использовать тематические запросы: "AI image generation", "Sora", "Midjourney" и т. п.
- Перейти на несколько поисковых запросов Reddit по названиям отдельных моделей вместо одного запроса, чтобы достичь критерия в 20 публикаций.
- Проверить поворот Midjourney к ультразвуковому CT по первоисточнику (midjourney.com/medical), отделив его от вирусной вторичной информации.
Качество данных
В X из-за неверного выбора поисковых терминов среди 32 публикаций не было ни одной тематической, поэтому платформа не дала содержательных сведений по теме. На Reddit использовался только один запрос, что привело лишь к 12 тредам вместо целевых 20. Поисковый API Bluesky постоянно был недоступен с ошибкой 403, поэтому выборка построена на прямом чтении лент аккаунтов, а не на полном поиске по ключевым словам. На YouTube из-за JavaScript-рендеринга нельзя было получить просмотры и точные даты публикации, поэтому даты приблизительны. Lemmy не позволяет выполнять сквозной поиск по распределённым инстансам, поэтому проверка ограничена шестью основными инстансами. На Pinterest удалось проанализировать 50 пинов, но почти полное отсутствие упоминаний open source смещает данные к закрытому сегменту.
Сводка по платформам
Reddit — Новости ИИ для генерации изображений и видео
Где
Собранные 12 тредов относятся к 7 сабреддитам.
| Сабреддит | Число участников | Число собранных тредов |
|---|---|---|
| r/generativeAI | 155,851 | 5 |
| r/ImagineAiArt | 19,415 | 1 |
| r/aivideomaking | 7,414 | 2 |
| r/DeepSeek | 140,403 | 1 |
| r/Purdue | 100,714 | 1 |
| r/aivideos | 123,539 | 1 |
| r/Instagramreality | 1,155,229 | 1 |
Больше всего тредов найдено в r/generativeAI; центральная тема там — сам спрос на «бесплатное AI-видео». Специализированные сообщества (r/aivideomaking, r/aivideos, r/ImagineAiArt) обсуждают конкретные инструменты и технологии; r/DeepSeek — новости одной модели; r/Purdue и r/Instagramreality (крупнейшее сообщество с более чем 1,15 млн участников) — случаи, когда AI-материалы попадали в реальный мир и вызывали скандалы.
Что говорят люди
- Спрос на бесплатную генерацию AI-видео остаётся сильным, но настроение сообщества всё больше склоняется к «поймите уже, что так не бывает». В треде №2 «Why do so many people expect to find a free AI video generator?» (39 баллов, 79 комментариев, 2026-09-21, https://www.reddit.com/r/generativeAI/comments/1wm2csy/) автор отмечает, что «Sora 2 был бесплатно доступен и привлёк множество пользователей, но в итоге OpenAI его закрыла», и заключает: "AI video generation is just expensive, and free is not a sustainable model".
- В комментариях к этому треду u/buttchuckjones (4 балла) сообщает, что перешёл от 10 ГБ VRAM к 5080 (16 ГБ) для локальной генерации, и пишет: "I very much wish that people on this subreddit would be more inclined to do local generation", поддерживая локальный/open-source подход.
- В треде №1 «Which AI video generator can still be used for free?» (20 баллов, 68 комментариев, 2026-09-16, https://www.reddit.com/r/generativeAI/comments/1whtesl/) u/RioMetal (4 балла) рекомендует открытые модели Wan и MiniMax: "If you can go local you have plenty of them, like Wan or Minimax". u/tuckken2 (3 балла) делится конкретным способом использования: "Wan 2.2 and Minimax H3 are free on cnaps studio, credit resets every 5 hours".
- В закрытом сегменте центральной темой стал GPT Image 2.5 Flare. В треде №3 «GPT Image 2.5 Flare — is this actually the best AI image generating model right now?» (92 балла, 62 комментария, 2026-09-16, https://www.reddit.com/r/ImagineAiArt/comments/1wi79wi/) u/oldboi777 (4 балла) восторженно пишет: "its really good, its an incredible upgrade I think". В то же время u/Dependent_Quit_3730 (3 балла) пишет: "É um modelo perfeito... mas eu ainda fico com o KREA 2" — модель хороша, но он остаётся на KREA 2. u/SeaworthinessFresh16 (2 балла) добавляет: "The result in Comfyui with Krea2 looks the same", то есть субъективной разницы с открытыми инструментами нет.
- DeepSeek (открытые веса) одновременно быстро растёт и испытывает дефицит ресурсов. В треде №6 «some deepseek news, if you care» (206 баллов, 36 комментариев, 2026-09-21, https://www.reddit.com/r/DeepSeek/comments/1wmcgex/) говорится, что число ежедневных активных пользователей выросло со 120 до 200 млн (+66,7%), тогда как вычислительные мощности увеличились лишь на 8,3%. Это связывают с падением качества и проблемами с повторной генерацией. В качестве меры упоминается заказ 160 тыс. Huawei Ascend 960DT. u/Equivalent-Grass-527 (6 баллов) комментирует: "The demand vs. compute mismatch is probably the most important part here".
- Мнения о мастерстве устранения «AI-вида» расходятся. Тред №8 «I stopped prompting for clean shots and my AI video finally stopped looking like AI» (63 балла, 56 комментариев, 2026-09-20, https://www.reddit.com/r/aivideos/comments/1wl6op9/; использовался Seedance 2.5) делится подробной техникой промптинга, но комментарии скептичны. u/TCristatus (9 баллов): "What a load of waffle, and the video is still obviously AI". u/Biscuits4u2 (6 баллов): "You need 5 percent uglier people to make it look realistic. Faces are too perfect." Проблемой оказывается не столько техника, сколько «слишком идеальные» лица.
- AI-изображения в реальном пространстве вызывают скандалы. В треде №7 «AI generated image on MSEE wall» (61 балл, 13 комментариев, 2026-09-21, r/Purdue, https://www.reddit.com/r/Purdue/comments/1wmq43f/) объектом критики стал бессмысленный макет печатной платы на AI-изображении, размещённом в университете. u/j909m (11 баллов) написал: "Whoever did the PCBA layout for that IC gets an F."
- Даже в огромном сабреддите с более чем 1,15 млн участников активно разоблачают AI-изображения. Тред №12 «AI generated images on Reddit with thousands of upvotes and comments» (2 109 баллов, 341 комментарий, 2026-09-18, r/Instagramreality, https://www.reddit.com/r/Instagramreality/comments/1wk0euk/) получил наибольшую вовлечённость среди всех собранных материалов. u/Smart-Membership-117 (405 баллов) указывает на противоречия в деталях: "The trim on the baseboard by her knee in pictures 2 and 3 is different and the greenery outside the window completely changes as well." u/Negative-Raise-8286 (275 баллов) жалуется, что не смог опубликовать подобное замечание в исходном треде.
- Есть и несколько мнений, что бесплатные кредиты весьма щедры. В треде №9 (r/aivideomaking, 3 балла, 26 комментариев, 2026-09-15, https://www.reddit.com/r/aivideomaking/comments/1wh80z3/) u/Chance-Business (2 балла) оценивает бесплатный лимит Google Flow (Veo): "google flow you get 50 free credits per day, each vid is 6-12 credits. I have most days not hit 50." В треде №4 (https://www.reddit.com/r/aivideomaking/comments/1wled0f/) u/MrBoondoggles (1 балл) аналогично пишет: "You can use Nanobanana and Veo in Google flow. They have very generous daily free credit allowance."
- Один и тот же реферальный код рекламируется в нескольких тредах. u/MeatStickMcFapperton и в треде №2 (4 балла), и в треде №5 (1 балл) оставил почти одинаковые комментарии, рекламирующие «1 млрд бесплатных токенов» по реферальному коду Meta «Muse» — "42JB8K".
Сигналы
- Рост: упоминания локальной генерации видео на открытых весах (Wan, MiniMax H3, FramePack, ComfyUI) органично возникают в большинстве тредов о желании получить что-то бесплатно. Резкий рост числа пользователей DeepSeek (+66,7%) — также явный сигнал роста.
- Скептицизм и жёсткая реакция: запросы на бесплатное AI-видео вызывают сильное раздражение. u/activematrix99 (2 балла) в треде №4 язвительно спрашивает: "Imagine showing up at a restaurant and demanding to eat for free... what makes YOU so important that they should just give it to you for free?" Высоко оценённые поучительные комментарии о «привычке требовать бесплатную генерацию» в нескольких тредах показывают изменение атмосферы сообщества.
- Неожиданный момент: один и тот же реферальный код ("42JB8K") и очень похожие рекламные формулировки повторяются в разных тредах. Вероятно, в органические дискуссии проникают рекламные или самопиарные комментарии; к числовым показателям следует относиться осторожно.
- Противостояние: сторонники позиции «бесплатная генерация видео — уже иллюзия» (несколько высокооценённых комментариев в тредах №2, №9 и №10) прямо противостоят тем, кто считает бесплатные лимиты Google Flow/Veo/Muse/Nanobanana вполне щедрыми (треды №4, №5, №9). Обе стороны опираются на личный опыт, поэтому нельзя просто объявить правой одну из них.
- Ощутимая разница между закрытыми и открытыми решениями невелика: в треде №3 GPT Image 2.5 Flare и KREA 2 на базе открытых инструментов описываются как дающие «одинаковый результат». Это указывает, что для пользователей разрыв качества в генерации изображений почти исчез.
Ограничения
- Инструмент сбора использовал лишь один поисковый запрос: "Image and Video Generation AI News". При целевом критерии брифа — около 20 публикаций в каждой соцсети — было найдено лишь 12 тредов из 7 сабреддитов. Дополнительные запросы по словам "Sora", "Veo", "Kling", "Stable Diffusion", "Flux", "open source" / "closed source" могли бы найти больше релевантных тредов.
- Для треда №9 в собранных данных отсутствует текст исходного поста; выводы основаны только на комментариях.
- По правилам этого этапа Reddit не просматривался и не искался напрямую: проверка ограничивалась уже собранными
output/reddit.threads.md/.json. Обсуждения, которых там нет, включая специализированные треды об отдельных моделях, не вошли в отчёт.
X
X — Новости ИИ для генерации изображений и видео
Аккаунты
В output/x.posts.md проверены 32 публикации от 31 аккаунта, но ни один аккаунт не был посвящён ИИ для генерации изображений или видео. Распределение выглядит так:
| Категория | Соответствующие аккаунты |
|---|---|
| Криптовалюты/акции ($SDOG, $AMD, Bitcoin) | @SDOGWITHSNAP, @DeItaone, @AJM_web, @S500ALERTS, @blackwidowbtc, @0xSweep, @USronaldcarter, @TedPillows |
| Украина и Россия | @dystoman, @sentdefender, @Polymarket, @Alex_Oloyede2, @bayraktar_1love, @AlaskanTzar, @SomaliSasuke, @gmanredux, @idkmypronouns, @Katauroraaa, @AbotGrenfield, @jaccocharite |
| Шоу-бизнес и политические сплетни (Lauren) | @Rach_delauren, @fvslaurs, @LimeriTweets, @karignejauregui |
| Спорт и единоборства (Muhammad) | @CylinderAnalyst, @bullyb170(2 публикации) |
| Религия | @TaymiFawaid |
| Личные аккаунты, связанные с трендом Zagreb | @slimey34, @AlphaGainer, @enafriedric2372, @Earldormancy |
Среди аккаунтов встречаются как те, кто набирает охват одной крупной публикацией (например, @AlaskanTzar получил 34 704 лайка на одном посте), так и те, кто накапливает его множеством небольших публикаций. Однако ни один из них не публиковал новости или инструменты для генерации изображений и видео — ни закрытые, ни открытые.
Публикации
Поскольку среди собранных материалов нет тематических публикаций, невозможно представить обычные «5–12 наблюдений» по ИИ для генерации изображений и видео. Для контекста:
- #8 @TedPillows (2 829 лайков, 293 репоста, около 486 000 просмотров, 2026-09-20, https://x.com/TedPillows/status/2101642897535762562) — "If Bitcoin breaks $83,000, the cycle bottom will be confirmed..." Анализ цены Bitcoin, не связанный с ИИ.
- #30 @AlaskanTzar (34 704 лайка, 1 083 репоста, около 1 500 000 просмотров, 2026-09-20, https://x.com/AlaskanTzar/status/2101819330703032636) — "Back in 2017 Russia and Ukraine were ratioing each other on twitter". Наибольшая вовлечённость во всём сборе, но это мем о России и Украине.
- #22 @Katauroraaa (2 840 лайков, около 309 000 просмотров, 2026-09-20, https://x.com/Katauroraaa/status/2101716186132087180) — шутка о России и странах Балтии.
Ни одна из этих публикаций никак не упоминает генерацию изображений или видео ИИ — ни закрытыми, ни открытыми моделями.
Сигналы
- Единственный вывод из собранных данных: поисковые термины на этом этапе не соответствовали теме. В качестве запросов использовались тренды Explore X (см. раздел Limits), поэтому результаты были посвящены криптовалютам, геополитике, сплетням и спорту.
- Никаких содержательных дискуссий о том, что в генерации изображений и видео ИИ «растёт» или вызывает скепсис, в этой выборке не было.
Ограничения
-
Поисковые термины не относились к теме: в начале
output/x.posts.mdуказаны запросы"$SDOG", "Bitcoin", "Zelensky", "Lauren", "Muhammad", "Russians", "Zagreb", "Ukraine", "Weeknd", "USSR". Это был прямой перенос «X's own Explore list» из таблицы ниже, без единого тематического запроса вроде "AI image generation", "AI video generation", "Sora", "Midjourney" или "Stable Diffusion".# Тренд Место (как указано в X) 1 $SDOG Trending in Croatia 2 Bitcoin Business & finance · Trending 3 Zelensky Politics · Trending 4 Lauren Trending in Croatia 5 Muhammad Politics · Trending 6 Russians Politics · Trending 7 Zagreb Trending in Croatia 8 Ukraine Politics · Trending 9 Weeknd Trending in Croatia 10 USSR Politics · Trending Этот список Explore географически привязан к расположению сервера сессии, предположительно к району Хорватии, и не отражает общемировые тренды.
-
Критерий завершения не выполнен: бриф требует «проанализировать и обобщить около 20 публикаций в каждой соцсети», но из 32 собранных публикаций тематическими оказались 0. Поэтому отчёт не даёт содержательных выводов о теме для X.
-
Сама сессия была рабочей: сбор производился в авторизованном состоянии и не возвращал сообщений вроде "no posts were collected". Проблема не в неисправности поиска X, а в выборе запросов на этапе сбора.
-
При следующем запуске нужны тематические запросы, такие как "AI image generation", "AI video generation", "Sora 2", "Midjourney", "Stable Diffusion", "Nano Banana", "Veo".
YouTube
YouTube — Новости ИИ для генерации изображений и видео (закрытые и открытые модели)
Каналы
- Matt Wolfe (@mreflow) — AI-новостной канал с более чем 925 000 подписчиков. Регулярно выпускает обзоры новостей о закрытых моделях, включая Nano Banana Pro / Nano Banana 2. (https://www.youtube.com/@mreflow)
- Theoretically Media — специализируется на обзорах и практических тестах open-source инструментов для AI-видео (LTX-2 / LTX-2.3, семейство HunyuanVideo). (https://theoreticallymedia.com/videos/)
- Aitrepreneur — силён в объяснении рабочих процессов ComfyUI и локального запуска новейших open-source видеомоделей, таких как LTX-2.3. (Связь с Patreon: https://www.patreon.com/aitrepreneur)
- Несколько других AI-каналов среднего размера, освещающих Z-Image Turbo / Flux.2 / HunyuanVideo 1.5 и другие модели; названия каналов удалось подтвердить только по заголовкам роликов, а число подписчиков неизвестно — см. Limits.
Видео
-
Google победил в генерации изображений (и это даже не близко) — РАЗБОР NANO BANANA PRO
date: 2025-11-26 | views: не подтверждено | https://www.youtube.com/watch?v=UV9GqinedQ8
В обзоре утверждается, что Nano Banana Pro (Gemini 3 Pro Image) от Google DeepMind превосходит существующие генераторы изображений на уровне, где «соревнования уже нет», с упором на точность текста и фотореализм. -
Nano Banana Pro от Google вызывает опасения из-за реалистичной генерации AI-изображений
date: конец ноября 2025 | views: не подтверждено | https://www.youtube.com/watch?v=RmmrVCUGYp8
Новостной ролик о рисках дипфейков и дезинформации из-за слишком высокого уровня фотореализма. -
GPT Image 2.5 ПОТРЯСАЮЩ: полный разбор новой модели изображений OpenAI
date: около 2026-09-08 (опубликовано 2 недели назад) | views: не подтверждено | https://www.youtube.com/watch?v=DY6TkI8XtkQ
Полный разбор GPT Image 2.5 от OpenAI: задержка генерации снижена на 50%, а функция Sketch превращает рисунки от руки в AI-изображения. Это последнее обновление закрытого лагеря. -
Рисование с ChatGPT Images 2.5
date: начало сентября 2026 | views: не подтверждено | https://www.youtube.com/watch?v=imPtIEAEHSU
Демонстрация новой функции: в ChatGPT можно ввести «@Sketch» и превратить нарисованный от руки эскиз в AI-изображение. -
Состояние AI-видео в 2026: Sora 2, Veo 3.1, Kling 3.0 и кинематографические рабочие процессы промптинга
date: 2026-03-20 | views: не подтверждено | https://www.youtube.com/watch?v=vtJzDgmWVWc
Итоговый ролик сравнивает тройку ведущих закрытых генераторов видео — Sora 2, Veo 3.1 и Kling 3.0 — и разбирает кинематографические техники промптинга. -
ОБЗОР Seedance 2.5: новая AI-видеомодель ByteDance
date: 2026-08-01 | views: не подтверждено | https://www.youtube.com/watch?v=LTAOvsH6cjM
Seedance 2.5 от ByteDance поддерживает 30-секундную генерацию одним кадром и до 50 референсных изображений; модель стала заметной благодаря большей длительности, чем у Sora 2 и Veo 3.1. Закрытая модель. -
Kling 2.6 Pro УНИЧТОЖАЕТ конкурентов — Veo 3.1 и Sora 2 Pro
date: 2025-12-19 | views: не подтверждено | https://www.youtube.com/watch?v=-vRsjX9seUU
Бенчмарк-ролик утверждает, что ещё до выхода Kling 3.0 Kling 2.6 Pro превосходил Veo 3.1 и Sora 2 Pro. Затем тренд продолжился с Kling 3.0, выпущенным 2026-02-05 и занявшим первое место с ELO 1 243. -
Z Image Turbo (БЕСПЛАТНО): эта open-source AI-модель навсегда изменила генерацию изображений! (как nano banana pro)
date: 2025-11-27 | views: не подтверждено | https://www.youtube.com/watch?v=sPQQPpQ9X4E
Модель команды Tongyi-MAI из Alibaba: 6 млрд параметров, лицензия Apache-2.0 и быстрая восьмишаговая генерация на потребительских GPU с 16 ГБ памяти. Её называют open-source ответом Nano Banana Pro. -
Новая open-source модель УНИЧТОЖАЕТ Flux 2 — туториал по Z-Image + Promptus
date: 2025-12-11 | views: не подтверждено | https://www.youtube.com/watch?v=JF4Q5hXh-_Q
Сравнительный туториал, утверждающий, что Z-Image превосходит Flux.2. -
FLUX.2 — ЛУЧШАЯ OPEN-SOURCE МОДЕЛЬ, ЛОКАЛЬНО И В GGUF
date: около ноября–декабря 2025 | views: не подтверждено | https://www.youtube.com/watch?v=t4eVxZPP0b0
Руководство по локальному запуску FLUX.2 (Pro/Flex/Dev и серии Klein с Apache-2.0) от Black Forest Labs в ComfyUI. Среди сильных сторон — вывод до 4 МП и согласованность до 10 референсов. -
Здесь «Святой Грааль» open-source AI-видео (LTX-2)
date: начало января 2026 | views: не подтверждено | https://www.youtube.com/watch?v=27UAb_Tlv4E
LTX-2, выпущенный Lightricks 2026-01-06, хвалят как первую «производственную» open-source видеомодель с нативным 4K, синхронизацией аудио, открытыми весами и опубликованным кодом обучения. -
Tencent HunyuanVideo 1.5 официально стал open source!
date: первая половина 2026 | views: не подтверждено | https://www.youtube.com/watch?v=MJShdc8tkkA
Tencent выпустила HunyuanVideo 1.5, сократив размер с 13 млрд до 8,3 млрд параметров без потери качества. Отдельно отмечается возможность работы на потребительских GPU. -
Qwen-Image 2.1 | Ранняя демонстрация доступа
date: около 2026-09-20 (опубликовано 2 дня назад) | views: не подтверждено | https://www.youtube.com/watch?v=tP_gGGJzEqg
Демонстрация раннего доступа к Qwen-Image-2.1 от Alibaba Qwen, опубликованной 2026-09-20: визуальный генератор сжат до 7 млрд параметров, генерация и редактирование объединены, поддерживается прозрачный вывод RGBA. Однако лицензия предназначена только для некоммерческих исследований.
Сигналы
- В закрытом сегменте усиливается гонка «скорость и фотореализм»: GPT Image 2.5 (2026-09-08, задержка генерации снижена на 50%) и Nano Banana Pro → Nano Banana 2 (2026, скорость вдвое выше) показывают, как OpenAI и Google соревнуются обновлениями каждые несколько недель. Для видео стандартным форматом стали сравнения Sora 2, Veo 3.1 и Kling 3.0.
- Sora закрывается вместе с API: веб-версия и приложение Sora уже закрылись 2026-04-26, а полный вывод API из эксплуатации запланирован на 2026-09-24, через два дня после отчёта. В качестве причины приводится экономика продукта: порядка 1 млн долларов операционных расходов в день при совокупной выручке около 2,1 млн долларов. Это пример того, что закрытая генерация видео не обязательно является рынком «победитель забирает всё».
- Open-source сегмент переходит к лёгким и быстрым моделям: Z-Image Turbo (6B, Apache-2.0), Qwen-Image-2.1 (визуальный генератор сжат до 7B), HunyuanVideo 1.5 (13B → 8,3B) — все релизы движутся к уменьшению числа параметров без потери качества и запуску на потребительских GPU.
- Граница между открытыми весами и коммерческой лицензией остаётся спорной: часть Flux.2 (Klein) полностью открыта по Apache 2.0, тогда как Qwen-Image-2.1 публикует веса, но использует «некоммерческую исследовательскую лицензию». В комментариях и обзорах обсуждают, допустимо ли называть это open source.
- LTX-2 становится бенчмарком open-source видео: сочетание «нативное 4K + синхронизация аудио + опубликованный код обучения» представлено впервые; несколько каналов сравнивают её с Wan 2.2 и HunyuanVideo 1.5 как с тремя ведущими моделями для локальной генерации видео.
- ComfyUI — фактическая общая платформа: для Flux.2, Z-Image, LTX-2, Wan и HunyuanVideo массово появляются ролики о поддержке в первый день и рабочих процессах ComfyUI; почти каждый обзор open-source решения включает практический тест в ComfyUI.
Ограничения
- Страницы результатов поиска YouTube (
/results?search_query=...) и видео (/watch?v=...) рендерятся JavaScript, поэтому через WebFetch удавалось получить только навигационные ссылки из футера. Точные просмотры, названия каналов, даты публикаций, субтитры и комментарии нельзя было извлечь прямо со страниц. Даты в отчёте оценочные, а просмотры для всех роликов отмечены как «не подтверждено». - Из-за этого нельзя было выполнить идеальный шаг плейбука — открыть и отдельно проанализировать около 20 публикаций. Вместо этого через WebSearch собирались заголовки, данные о каналах и периоде публикации. Всего найдено более 30 заголовков роликов, из которых 13 выбраны как показательные.
- Ролики о Qwen-Image-2.1 появились всего через два дня после релиза, поэтому обзоров ещё мало; в ближайшие недели их число, вероятно, вырастет.
Bluesky
Bluesky — Новости ИИ для генерации изображений и видео
Аккаунты
- Ed Zitron (
edzitron.com) — критик технологической и AI-индустрии (Where's Your Ed At); сообщил в Bluesky о закрытии Sora и получил резкий всплеск вовлечённости. - Simon Willison (
simonwillison.net) — независимый AI-исследователь; регулярно тестирует новые модели, включая генераторы изображений, в своих «pelican»-тестах и публикует созданный по ходу концепт-арт. - Adina Yakup (
adinayakup.bsky.social) — сторонница open-source ML из Hugging Face; безусловно самый активный хроникёр новых релизов моделей с открытыми весами в Bluesky, публикующий новости почти еженедельно. - useapi.net (
useapi.bsky.social) — реселлер REST API для AI-генерации видео, изображений и музыки (Veo, Kling, Seedance, Runway, MiniMax и др.); часто публикует сравнительные тесты моделей. - GPT Image Prompt (
gptimageprompt.bsky.social) — аккаунт с промптами вокруг инструментов OpenAI ChatGPT/GPT Image. - Stable Diffusion online AI (
stablediffusion.bsky.social) — давний общественный аккаунт с промптами Stable Diffusion и AI-арт-челленджами. - Stability AI (официальный) — с примерно ноября 2025 года почти не публикует ничего об изображениях или видео; свежие посты почти полностью посвящены Stable Audio и партнёрствам с музыкальными лейблами Warner и Universal, а не Stable Diffusion.
Публикации
-
Ed Zitron — OpenAI закрывает Sora (2026-03-24, 👍 3 572 · 🔁 984)
"Both the Wall Street Journal and The Information confirming that OpenAI is killing Sora - both the app and access to its video-generating model for developers. This is a huge move that suggests things are a bit desperate."
https://bsky.app/profile/edzitron.com/post/3mhtesqgwxk2k
(Это согласуется с сообщениями о закрытии приложения Sora 26 апреля 2026 года и запланированном прекращении работы API 24 сентября 2026 года — через два дня после данного исследования.) -
Simon Willison — создание с ChatGPT Images 2.5 (2026-09-10, 👍 56 · 🔁 5)
"Here's a Blender model of a Pluribus themed Fabergé egg I had GPT-6 Astra build - I generated the concept image using ChatGPT Images 2.5"
https://bsky.app/profile/simonwillison.net/post/3mv4su6pfzk24 -
Adina Yakup — HyperFlow (открытая дистилляция видео) (2026-09-19, 👍 6 · 🔁 1)
"HyperFlow⚡ New MiniMax-H3 variant from Video Rebirth — Open weight 8 step LoRA — 3× faster with data free self distillation — Video + stereo audio intact"
https://bsky.app/profile/adinayakup.bsky.social/post/3mvunely5222b -
Adina Yakup — Lance от ByteDance (2026-05-19, 👍 48 · 🔁 5)
"ByteDance dropped Lance👀 — This 3B model can generate images + edit images + generate videos + edit videos, and understand both images/videos."
https://bsky.app/profile/adinayakup.bsky.social/post/3mm6xqsryf22b -
Adina Yakup — ERNIE-Image от Baidu (2026-04-14, 👍 1)
"Baidu just released ERNIE-Image on Hugging Face🔥 — 8B DiT - Image/Image Turbo — Apache 2.0"
https://bsky.app/profile/adinayakup.bsky.social/post/3mjhrc3y7u22i -
Adina Yakup — Matrix-Game 3.0 от Skywork (2026-03-27, 👍 13 · 🔁 2)
"Matrix-Game 3.0🔥 real-time interactive world models from Skywork — ✨ 720p @ 40FPS with a 5B model"
https://bsky.app/profile/adinayakup.bsky.social/post/3mi2efsyp7k2x -
Adina Yakup — LongCat-Video-Avatar 1.5 (2026-05-22, 👍 16 · 🔁 3)
"LongCat-Video-Avatar 1.5🐱 an audio driven avatar video generation [model]"
https://bsky.app/profile/adinayakup.bsky.social/post/3mmglm72zn22i -
Adina Yakup — HiDream-O1-Image (2026-05-19, 👍 10 · 🔁 2)
"HiDream-O1-Image is getting a lot of attention🔥"
https://bsky.app/profile/adinayakup.bsky.social/post/3mm73u27jek26 -
useapi.net — альтернативы Sora 2 API (2026-09-21, 👍 0)
"Sora 2 API Alternatives Compared, With Code: Seedance 2.5, Omni Flash, MiniMax H3, Kling v3 #sora2 #seedance #kling #aivideo"
https://bsky.app/profile/useapi.bsky.social/post/3mvyugq6wgz27 -
useapi.net — MiniMax H3 против Seedance 2.0 (2026-07-31, 👍 0)
"MiniMax H3 head to head with Seedance 2.0 on identical omni references #minimax #seedance #ai #api"
https://bsky.app/profile/useapi.bsky.social/post/3mrw5xyd4zk2x -
GPT Image Prompt — публикация промпта для мема (2026-05-07, 👍 0)
"Theme: Text to Meme — Prompt put on comment — Welcome to our website:gptimageprompt.io #Chatgpt2 #GPTImagePropmt #AIPrompts"
https://bsky.app/profile/gptimageprompt.bsky.social/post/3mlaa6swzc226
Сигналы
- Закрытие Sora — главная история о закрытых моделях, которую действительно обсуждает Bluesky. Публикация Ed Zitron — единственный материал с наивысшей вовлечённостью во всей выборке (3,5 тыс. лайков), значительно превосходящий любые новости о запуске моделей. AI-аудитория Bluesky здесь скорее ориентирована на индустриальные сюжеты и критику, чем на маркетинг лабораторий.
- Новости open source в Bluesky фактически ведёт один человек. Почти все конкретные релизы открытых моделей — Baidu ERNIE-Image, ByteDance Lance, Skywork Matrix-Game 3.0, LongCat-Video-Avatar, HyperFlow, HiDream-O1-Image — были найдены у Adina Yakup из Hugging Face. Основной паттерн — китайские лаборатории (Baidu, ByteDance, Alibaba/Qwen, Ant Group, Skywork, Tencent), выпускающие модели по лицензиям типа Apache-2.0.
- Крупные лаборатории закрытых моделей не поддерживают активного присутствия в Bluesky для анонсов изображений и видео. Не обнаружены официальные аккаунты OpenAI, Google DeepMind, Adobe или Midjourney; новости о закрытых моделях приходят из вторых рук — от независимых тестировщиков вроде Simon Willison или сторонних API-реселлеров вроде useapi.net.
- Технические посты об инструментах почти не получают вовлечённости: сравнения useapi.net и большинство релизов Adina Yakup набирают 0–13 лайков, тогда как общий индустриальный нарратив о судьбе компании даёт тысячи лайков. На этой платформе вовлечённость определяется сюжетом индустрии, а не технической новизной.
- Несколько очевидных AI-арт-хабов в Bluesky мертвы или неактивны: официальные и бот-аккаунты Civitai, аккаунт ComfyUI и собственный аккаунт Stability AI, переключившийся на Stable Audio и темы музыкальных лейблов, не публикуют новостей об изображениях Stable Diffusion с середины 2025 года.
Ограничения
- Публичный API поиска по ключевым словам заблокирован.
app.bsky.feed.searchPostsпри каждой попытке возвращалHTTP 403 Forbidden— для запросов из нескольких слов, одного слова и разных формулировок через WebFetch. Веб-интерфейсbsky.app/searchтакже полностью рендерится на клиенте и не возвращал содержимое постов. Поэтому полноценный поиск «что сейчас говорят о X» был невозможен: данные собраны через поиск аккаунтов с помощьюsite:bsky.app, а затем чтение их историй через публичный API AT ProtocolgetAuthorFeed, который работал. - Несколько многообещающих аккаунтов оказались пустыми или неактивными:
civitai.bsky.social(пустая лента),civitai-bot.bsky.social(последняя публикация в мае 2024),real-comfyui.bsky.social(пустая лента),runwayml.bsky.social(ведёт на несвязанный личный аккаунт с одним постом 2024 года),midjourney-api.bsky.social(неофициальный реселлер, один пост от ноября 2024),qwen1.bsky.social(фан-аккаунт, один пост от февраля 2025). - Alibaba Qwen-Image-2.1 — унифицированная модель генерации и редактирования изображений с открытыми весами на 7B, предположительно выпущенная 2026-09-20 — не появилась ни в одном найденном посте Bluesky. Возможно, отслеживаемые аккаунты её ещё не подхватили, либо она находится вне охвата заблокированного поиска.
- Ethan Mollick (
emollick.bsky.social) и Tanishq Abraham (iscienceluvr.bsky.social) были проверены как возможные источники, но оказались сфокусированы соответственно на общих новостях текстовых LLM и старых академических работах, а не на текущих новостях генерации изображений и видео. - При заблокированном поиске целевая выборка примерно в 20 постов была достигнута суммарным чтением полных лент авторов — около 30 публикаций Adina Yakup, около 15 useapi.net, около 20 Stable Diffusion, а также свежих лент Simon Willison и Ed Zitron. Это целевая выборка по аккаунтам, а не исчерпывающий поиск по ключевым словам.
Lemmy
Lemmy — Последние тенденции ИИ для генерации изображений и видео
Сообщества
- !«メールアドレス» (5 713 участников) — главное сообщество для обсуждения open-source технологий генерации изображений и видео. Новые инструменты из GitHub/HuggingFace появляются почти ежедневно.
- !«メールアドレス» (2 361 участник) — место для публикации работ, созданных Stable Diffusion и другими моделями с открытыми весами.
- !«メールアドレス» (1 599 участников) — сообщество AI-аниме-арта, только SFW.
- !«メールアドレス» (52 участника, 157 активных в месяц) — зеркало AI-тредов Reddit. Новости о закрытых моделях, включая Sora и Midjourney, часто попадают сюда именно так.
- !«メールアドレス» (204 участника; смешаны и посты с инстанса lemmy.bestiver.se) — зеркало Hacker News. Сюда попадают статьи о релизах моделей, например Qwen-Image и Nano Banana.
- !«メールアドレス» — ироничное сообщество о AI-индустрии. Здесь возник вирусный сюжет о проблемах Midjourney.
- !«メールアドレス» (8 265 участников) — крупное сообщество критиков генеративного ИИ. Это не новостная площадка, но полезная точка отсчёта для оценки общего настроения Lemmy.
- !stable_diffusion_furry / _witches / _mycology / «メールアドレス» — нишевые тематические сообщества для SD-работ. Публикации есть, но оценки почти всегда однозначные или отрицательные.
Публикации
Связанные с закрытыми моделями
- OpenAI закрывает API Sora на следующей неделе, пока китайский конкурент только что привлёк 3 млрд долларов — !«メールアドレス», 2026-09-20, score 1. Сопоставление закрытия API Sora и крупного финансирования китайских конкурентов.
- Midjourney AI переходит к Theranos: ультразвуковой CT — !«メールアドレス», 2026-06-19, score 40. Сюжет о резком повороте Midjourney от AI-генерации изображений к медицинскому оборудованию для ультразвукового CT; самый успешный пост о Midjourney на Lemmy.
- Ультразвуковой CT-сканер Midjourney — !hackernews, 2026-06-18, score 2. Зеркало HN первоисточника выше (midjourney.com/medical).
- Midjourney хочет, чтобы голливудские студии раскрывали детали использования ИИ через публикацию — !«メールアドレス», 2026-07-05, score 73. Ссылка на статью TechCrunch с относительно высокой оценкой для технологического сообщества.
- Google тихо отключает функцию Earth AI через день после запуска, после того как пользователи создали неприемлемые изображения — !ai_reddit, 2026-08-07, score 1.
- Seedream 5.0 Pro уже здесь: честное сравнение и технический разбор — !ai_reddit, 2026-07-10, score 1. Проверка закрытой модели изображений ByteDance.
- Nano Banana 2 Lite — !hackernews, 2026-06-30, score 1. Анонс облегчённой модели генерации изображений Google DeepMind.
- MAI-Image-2.5 от Microsoft достигает уровня Nano Banana 2 от Google в бенчмарках — !ai_reddit, 2026-05-28, score 1.
Связанные с open source
- Qwen-Image-2.1: компактное, эффективное и единое создание изображений — !hackernews, 2026-09-20, score 1. Новейшая модель генерации изображений с открытыми весами от Alibaba Qwen.
- supElement/ComfyUI_MinimaxH3_AutoContext — !«メールアドレス», 2026-09-16, score 1. Нода для длинных видео в MiniMax H3, снимающая ограничение памяти.
- Adudeguyman/ComfyUI-Fantastic-MiniMaxH3-PromptBuilder — то же сообщество, 2026-09-16, score 3. Конструктор промптов для MiniMax H3.
- nazgut/ComfyUI-MiniMaxH3-CLSS — то же сообщество, 2026-09-01, score 0. Генерация видео произвольной длины со звуком на 16 ГБ VRAM.
- filliptm/ComfyUI-FL-MiniMaxH3 — то же сообщество, 2026-08-30, score 5.
- Luisacaotica/ComfyUI-MiniMaxH3Mod — то же сообщество, 2026-08-20, score 7. Адаптер сжатия референсных изображений и видео без обучения.
- Я тестировал Wan для генерации AI-видео — !«メールアドレス», 2026-09-10, score -9 (низкая оценка/конфликтное обсуждение). Обзор генерации видео в модели Wan с открытыми весами.
- Boogu-Image-0.1 — эффективная базовая модель генерации изображений — !«メールアドレス», 2026-06-17, score 5. Новая открытая базовая модель изображений.
Сигналы
- Экосистема ComfyUI вокруг MiniMax H3 стабильно растёт с августа по сентябрь. С 2026-08-07 по 09-16 в !«メールアドレス» вышло не менее пяти связанных нод и инструментов; публикации продолжаются без перерыва. В этом сообществе ключевым словом наиболее динамичной open-source генерации видео стал "MiniMax H3".
- Новости о закрытых моделях почти не обсуждаются нативно в Lemmy: почти все они — пересказы из зеркал Reddit (!ai_reddit) или Hacker News (!hackernews) с низкими оценками около 1–3. Самостоятельные первичные дискуссии практически отсутствуют.
- Единственная крупная закрытая история — переход Midjourney от генерации изображений к медицинскому ультразвуковому CT-сканеру (!techtakes, score 40). Она стала вирусной в сообществе с сильным сатирическим и критическим тоном.
- В сообществах для обмена работами (stable_diffusion_art, share_anime_art и др.) публикации появляются часто, почти ежедневно по несколько штук, но получают лишь единицы или десятки баллов. Там важнее обмен творческими результатами, а не новости.
- !«メールアドレス» (8 265 участников) больше положительного сообщества генеративного ИИ stable_diffusion (5 713 участников), что говорит о неблагоприятной для генеративного ИИ структуре сообществ Lemmy в целом.
Ограничения
- Поисковый API Lemmy поддерживает только полнотекстовый поиск по ключевым словам и слабо ранжирует результаты. Запросы "Sora" и "Veo" возвращали много не связанных политических новостей (latam, pravda_news и др.). Для фильтрации было просмотрено по 15–20 результатов для каждого ключевого слова, более 100 результатов всего, но релевантных постов оказалось лишь около десятка.
- Lemmy распределён по инстансам и не имеет средства сквозного поиска по всем из них. Поиск был сосредоточен на lemmy.world, lemmy.dbzer0.com, lemmy.durstig.online, awful.systems, lemmy.bestiver.se и lemmy.today; дискуссии на малых закрытых инстансах могли остаться невидимыми.
- Для Runway, Kling, Ideogram, Recraft, Grok Imagine, Flux.2, HunyuanImage и других заметных на иных платформах моделей в Lemmy не найдено значимых публикаций: результаты были нулевыми или нерелевантными.
- В целом Lemmy невелик как площадка для срочных новостей о генерации изображений и видео: он зависит от зеркал Reddit/Hacker News, а собственный контент сосредоточен в основном на инструментах для запуска моделей с открытыми весами в ComfyUI.
Pinterest — Новости ИИ для генерации изображений и видео
Визуальные темы
- Неоновая надпись «AI» / роботы и печатные платы — типичный визуальный шорткат Pinterest для «ИИ»: светящиеся чипы, голографические головы и руки роботов, частицы и схемы используются как общая обложка, а не иллюстрация конкретного инструмента или новости
[1, 2, 8, 22, 25, 28, 29, 31, 39, 49]. - Пронумерованные миниатюры-подборки «Лучшие генераторы AI-видео/изображений» — крупный заголовок и сетка логотипов приложений (Runway, Pika, Kling AI, Luma Dream Machine, Canva, Hailuo AI, Synthesia, HeyGen, D-ID, CapCut, InVideo, Adobe Firefly) — самый распространённый формат пинов во всей выборке
[7, 13, 20, 30, 32, 33, 41, 43]. - Миниатюры с реакцией безликого YouTube-автора — удивлённый бородатый мужчина, наушники, размытый фон со взрывом и логотипы бигтеха, используемые для продвижения роликов-дайджестов «AI NEWS»
[6, 19, 40]. - Карточки-дайджесты «Новости ИИ сегодня/на этой неделе», оформленные как мини-первые полосы или Instagram-карусели и суммирующие несколько реальных заголовков
[17, 35, 44, 47]. - Демонстрации «Угадайте, где ИИ» / реализма — фотореалистичный теннисист с подписью «This is AI», фото кота со штампом «FAKE»; они продают реализм сгенерированных медиа, а не конкретный продукт
[5, 23]. - Демонстрация переноса стиля при сохранении персонажа — пин Lumalabs превращает одно исходное видео в четыре стиля: деревянные блоки, оригами, игрушечные кирпичики и цветы; это тот же вирусный формат «сделай это из материала X», который встречается и в других каналах
[10]. - Реклама фриланс-услуг и подработки, предлагающая «AI-видео для вашего бренда», с номером WhatsApp и адресом Gmail прямо на графике
[24]. - Инфографика для начинающих, объясняющая процесс шаг за шагом (промпт → латентное пространство → денойзинг → кадры → результат) для людей, вообще не знакомых с работой генерации
[3, 36].
Заметные пины
- #9 — официальная продуктовая страница Veo 2 («Наша передовая модель генерации видео», призыв зарегистрироваться в VideoFX). Настоящий маркетинг закрытого продукта, а не подборка. https://www.pinterest.com/pin/716705728243313502/
- #10 — Lumalabs: «Сделано из деревянных блоков / сложенной бумаги оригами / разноцветных игрушечных кирпичиков / цветов»: одно исходное видео перерисовано в четырёх согласованных стилях. https://www.pinterest.com/pin/308144799526598925/
- #17 — «4 крупных обновления ИИ: реальные новости, реальное влияние» объединяет GPT-6 Astra от OpenAI, более агентный Gemini в Gmail/Drive/Docs/Slides/Chat, генеративное видео и звук прямо на таймлайне Adobe Premiere и раунд Cognition Series E на 2 млрд долларов при оценке 48 млрд долларов. https://www.pinterest.com/pin/982558843745608433/
- #20 — таблица выбора «AI Image Video: лучшее качество против лучшего бесплатного», наиболее понятная однокарточная карта платных инструментов (ChatGPT Plus, Gemini Advanced, Midjourney, Adobe Firefly, Recraft, Runway Gen-3, Luma, Pika Pro, Kaiber, Synthesia) и бесплатных (Ideogram, Gemini Free, SeaArt, Playground, Krea, Canva, Inkscape, CapCut, Pika Free, Runway Free). https://www.pinterest.com/pin/37295503160959330/
- #26 — новостная карточка «ByteDance и Голливуд заключают глобальное соглашение об AI-авторском праве»: ByteDance и Motion Picture Association договорились усилить защиту интеллектуальной собственности в инструментах ByteDance для генерации изображений и видео. https://www.pinterest.com/pin/1074530792376376121/
- #27 — инфографика об AI-этике и детекторе голоса, отмечающая результат анализа «97% likely AI-generated», рядом с блоками «AI video generators» и «AI ethics & prompt engineering»; это массовая тревога о доверии к сгенерированным медиа. https://www.pinterest.com/pin/951104015101996491/
- #32 — «22 лучших и бесплатных генератора AI-видео», самая крупная подборка инструментов; в её «Топ-5» Kling AI и Hailuo AI стоят выше Runway и Pika по реалистичности. https://www.pinterest.com/pin/128493395623874987/
- #35 — «Новости ИИ сегодня, 20 мая 2026»: обзор Google I/O 2026 — Gemini 3.5 Flash, Gemini Omni, агент Gemini Spark и умные очки Android XR. https://www.pinterest.com/pin/652670171044638578/
- #44 — макет газеты «На этой неделе в новостях ИИ» (15 августа 2026) с заголовочными темами «Open Models / Open weights», «Sovereign AI» и «Agent Harness». Это единственный пин во всей выборке, где вообще названы модели с открытыми весами, и только как короткий заголовок, без демонстрации. https://www.pinterest.com/pin/644577765463965693/
- #48 — запуск Amuse 3.0, инструмента локального AI-арта при поддержке AMD; один из немногих пинов, называющих конкретный новый продукт вместо общей подборки или новостной карточки с логотипами. https://www.pinterest.com/pin/4601060441986715264/
Сигналы
- Kling AI и Hailuo AI вошли в верхний эшелон вместе с Runway, Pika и Luma почти во всех собранных подборках (
[7, 13, 30, 32, 41, 43]). Набор «топовых» инструментов теперь заметно шире прежней дуополии Runway/Pika. - Продвижение Veo/Gemini от Google — наиболее заметная закрытая история на платформе: оно повторяется в независимых новостных пинах об ИИ — запуск Veo 2, Gemini 3.5/Omni/Spark и очки Android XR на I/O 2026, а не концентрируется в одном вирусном посте.
- OpenAI присутствует преимущественно как часть набора логотипов; единственное конкретное упоминание Sora-2 — #4, размытая запись экрана стороннего инструмента «zeely.ai» в режиме «sora-2-video-ad». Это значительно меньше обычного присутствия компании на других платформах.
- Тревога о дипфейках и подлинности повторяется регулярно, а не является единичным явлением: пин со штампом «FAKE», результат детектора голоса с вероятностью ИИ 97% и изображение «Human Journalism vs. Machine-Generated Media» встречаются независимо (
[5, 16, 27]). - Монетизация и подработка поданы прямо и открыто: объявления фрилансеров с контактами на самих пинах (#24), идеи «безликого канала» и контент-маркетинга (#23, #25). Аудитория AI-видео Pinterest больше похожа на создателей, желающих продавать или масштабировать контент, чем на исследователей.
- Open source практически отсутствует. Среди всех 50 пинов нет упоминаний Stable Diffusion, Flux, ComfyUI, Wan, HunyuanVideo, LTX, Mochi и нет ссылок на GitHub/HuggingFace. Единственный след — слова "Open Models. Open weights." в одной заголовочной строке макета новостной первой полосы (#44), но не отдельный пин, логотип инструмента или демонстрация. Для этой темы Pinterest почти полностью состоит из SaaS-маркетинга закрытых решений и SEO-подборок «лучшее из»; читатель, полагающийся только на эту платформу, не узнает, что существует целая сцена open-source генерации изображений и видео.
Ограничения
- Таблица
pinterest.pins.md, подготовленная сборщиком, не содержала разделов по жанрам: все 50 пинов были перечислены одним списком в рамках одного неявного жанра. Поэтому они анализировались вместе, а не по жанрам, как требует плейбук при запуске с несколькими жанрами. - Заголовки нескольких пинов не соответствовали тому, что фактически видно на изображениях; по правилам этапа Pinterest напрямую не открывался для проверки, поэтому это отмечено как неподтверждённое, а не как результат: #42 («Nvidia #NEW AI Tools») показывает лишь общее фото Дженсена Хуанга без читаемого текста об инструментах; #45 («Grok 5: Elon Musk's AI Revolution») и #50 («Discover how Grok is revolutionizing video») используют общие стоковые изображения/кадры новостей об ИИ без деталей Grok; #40 («GPT 5.2, realtime video editor...») показывает только стандартную реакционную миниатюру «huge AI news».
- Ряд пинов — почти дублирующиеся стоковые картинки без самостоятельного информационного содержания (
[2, 8, 22, 29, 39, 45, 49]); они включены в 50, но не считаются отдельными сигналами. - В Pinterest не найдено контента об open-source генерации изображений или видео. Это отсутствие — ключевой вывод для платформы, а не пробел исследования; см. раздел Signals выше.
Рекомендуемые действия
- Отслеживать, куда перейдёт трафик Sora API после 2026-09-24: к Seedance 2.5, MiniMax H3 или Kling v3.
- Наблюдать за изменениями некоммерческой исследовательской лицензии Qwen-Image-2.1 на фоне активного спора «можно ли назвать это open source».
- Использовать частоту публикаций нод MiniMax H3 для ComfyUI на Lemmy как опережающий индикатор внедрения видео с открытыми весами.
- Повторить этап сбора по X с тематическими запросами вместо региональных трендов.
- Повторить сбор Reddit с запросами по отдельным моделям, чтобы достигнуть целевых примерно 20 публикаций.
- Проверить заявленный переход Midjourney к медицинскому ультразвуковому CT по первичному источнику, прежде чем считать его подтверждённым.
Собранные изображения


















































Примечание о качестве данных
X не дал ни одной тематической публикации из 32 из-за несоответствия поисковых терминов, а Reddit собрал лишь 12 из целевых примерно 20 тредов по одному запросу. Поисковый API Bluesky был заблокирован (403), поэтому его пришлось обойти выборкой из лент аккаунтов; просмотры и точные даты YouTube не удалось подтвердить из-за страниц с JavaScript-рендерингом.



