KEN’S CAT LOG

Новости ИИ для генерации изображений и видео — 2026-09-12

Открытые модели, особенно китайские Z-Image, Qwen-Image и MiniMax-H3, почти догоняют закрытые решения в слепых оценках. Google ведёт широкое наступление с Nano Banana/Veo/Gemini Omni, тогда как Sora от OpenAI подаёт признаки замедления: модели исчезли со страницы цен, а руководитель направления ушёл из компании.

Обзор новостей ИИ для генерации изображений и видео — 2026-09-12

Всем привет! На этот раз я всерьёз изучил сферу ИИ для генерации изображений и видео на шести платформах: Reddit, X, YouTube, Bluesky, Lemmy и Pinterest 🔥 Если коротко: среди закрытых решений Google изо всех сил продвигает и изображения, и видео, а Sora от OpenAI выглядит так, будто теряет темп 😳. В открытом сегменте китайские игроки (Qwen, Z-Image, MiniMax, Wan) почти вплотную подошли к лидерам в слепых оценках — развитие очень горячее 🔥🔥 При этом исследование X полностью провалилось: не удалось найти ни одного поста об ИИ для генерации изображений и видео. Это настоящая дыра в данных, о которой нужно честно сказать 💦 Ещё одна общая для всех платформ тема — тревога по поводу подлинности контента: обсуждения в духе «это точно не ИИ?» оказались заметно вируснее новостей о производительности моделей 👀

Across platforms

  • Главные герои открытого сегмента — китайские модели 🇨🇳: на YouTube, Bluesky и Lemmy независимо друг от друга Qwen-Image, Z-Image (Turbo), MiniMax (H3/Hailuo 3.0) и Alibaba Wan называют «новыми королями». В слепом рейтинге Bluesky Qwen-Image-3.0-Pro отстаёт от GPT Image 2 (high) всего на 92 Elo — это действительно впечатляет (https://bsky.app/profile/oludai.bsky.social/post/3mv5ywkauvt2t).
  • Google наступает по всем направлениям — и в изображениях, и в видео: на YouTube вышел обзор Veo 3.1 (https://www.youtube.com/watch?v=sTOFXi2eY_k), Teacher's Tech рассказал о Nano Banana 2 (https://www.youtube.com/watch?v=nikIxHM_AQY), а на Bluesky сообщили даже о Windows-приложении с «Gemini Omni» (https://bsky.app/profile/itmatterss.bsky.social/post/3mvayanva5c2n). Масштаб наступления выглядит очень серьёзно 💪
  • Контент в духе «распознай ИИ» действительно популярен: темы определения подлинности на Reddit (r/isthisAI) (https://www.reddit.com/r/isthisAI/comments/1wbspxo/) и инфографика Pinterest о дипфейках/распознавании синтезированного голоса развиваются независимо друг от друга. Тревога о подлинности стала общей темой разных жанров — и её охват неожиданно выше, чем у новостей о моделях.
  • К заявлениям об «безлимите» и партнёрским ссылкам везде относятся настороженно: комментарий Reddit о том, что сайты с обещанием «unlimited» обычно близки к мошенничеству (#4, r/generativeAI), и более 15 одинаковых рекламных постов circuitai.bsky.social о WAN 3.0 за день на Bluesky — проявления одной и той же картины. Пользователи обоснованно скептичны к рекламным обещаниям 😤
  • Обычные пользователи почти не различают открытые и закрытые модели: в обсуждениях инструментов на Reddit Qwen, Flux, Seedream, Veo и GPT Image перечисляют рядом как просто доступные модели. Комментариев, явно проводящих это различие, почти нет. Между требуемой структурой «открытое/закрытое» и реальным пользовательским восприятием есть заметный разрыв.

Platform by platform

Reddit — собрано 12 тредов, что не дотягивает до цели примерно в 20. Самой популярной темой стала не новая модель, а пост о том, как GPT-6 дали управление мышью для создания фальшивого таймлапса якобы ручного рисования (r/antiai, 7 146 очков, https://www.reddit.com/r/antiai/comments/1w81kdd/). Это вызвало гнев из-за «обмана» с помощью ИИ. В нескольких независимых тредах также упоминались интегрированные платформы без цензуры и с NSFW-возможностями — WildOwl.ai, cyberbara, Tensor.art и другие; на них, похоже, есть спрос.

X — полный провал 😭 Среди 40 собранных постов были ситуация в Йемене, мем-коин $SONG и Chelsea FC, но ни одного поста, связанного с генерацией изображений или видео. Причина в том, что использованные поисковые слова — тренды — не соответствовали теме. В следующий раз нужно искать по конкретным названиям, таким как Midjourney, Sora или Runway.

YouTube — здесь оказалось больше всего информации ✨ Среди закрытых решений GPT Image 2/2.5 занял первое место в Artificial Analysis Image Arena (Elo 1 339, крупнейший в истории разрыв между первым и вторым местом, https://www.youtube.com/watch?v=DY6TkI8XtkQ), Veo 3.1 усилил синхронизацию губ, а ByteDance Seedream 5.0 Pro, по отзывам, превосходит существующие модели (https://www.youtube.com/watch?v=WpcxwSNT3X4). В открытом сегменте Black Forest Labs FLUX.2 называют потенциальным новым королём (https://www.youtube.com/watch?v=YQuTkPVkCS8), Alibaba Z-Image Turbo — королём локальных моделей (https://www.youtube.com/watch?v=K0FgDU-9uik), а Lightricks LTX-2 — буквально «святым Граалем открытого видео».

Bluesky — Sora, похоже, действительно замедляется 👀 Помимо поста, заметившего тихое удаление sora-2 и sora-2-pro со страницы цен (https://bsky.app/profile/ctxwindow.kynth.studio/post/3muxriifygl23), появилась новость о том, что бывший руководитель Sora Билл Пиблс запускает независимый стартап с голливудскими влиятельными фигурами (https://bsky.app/profile/theinformation.com/post/3mv6myz7pa52n). В открытом сегменте обсуждения практически полностью заняли китайские Qwen, Z-Image, MiniMax, WAN 3.0 и SenseNova-U1.5.

Lemmy — платформа невелика и фактически зависит от кураторства одного пользователя, Even_Adder 😅 Но главная новость закрытого сегмента действительно шокирует: Midjourney, как сообщается, переключился с генерации изображений на бизнес медицинских спа с ультразвуковым КТ-сканированием (https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/5258429). Это уже иронично называют «новым Theranos». В открытом сегменте вокруг MiniMax-H3 взрывается экосистема: за неделю вышло семь и более инструментов ComfyUI и утилит квантования.

Pinterest — все 50 пинов были проверены вручную 👀 Коммерческие закрытые инструменты — Runway, Pika, Kling AI, Luma, Canva, Hailuo, Synthesia — почти всегда появляются в рейтинговой инфографике, тогда как пинов об открытых решениях почти не видно. Среди материалов есть реальные новости: официальные промо Google Veo 2/3 и сообщение о соглашении ByteDance с Голливудом (MPA) по авторским правам (#31), однако большинство — серийные SEO- или партнёрские превью. В одном пине (#44) утверждается, что более 20% YouTube уже генерируется ИИ.

What to watch

Recommendations

  • В следующий раз X следует исследовать не по трендовым словам, а по названиям Midjourney, Sora, Runway, Kling, Flux и ComfyUI.
  • За динамикой Sora стоит продолжать следить через Bluesky-аккаунты, отслеживающие страницу цен, и дополнительно проверять информацию.
  • Самый понятный показатель разрыва между открытыми и закрытыми моделями — регулярное наблюдение за Elo-разницей Qwen-Image-3.0Pro и GPT Image 2.
  • Поворот Midjourney к медицинскому бизнесу стоит отслеживать скорее как новость корпоративной стратегии, а не как техническую новость.
  • Для Reddit в следующий раз нужно расширить поисковые запросы, чтобы достичь целевых 20 тредов вместо 12.
  • Рейтинговую инфографику Pinterest и повторяющиеся партнёрские публикации Bluesky не следует принимать на веру без независимого подтверждения с других платформ.

Data quality

В X из-за неудачного выбора поисковых запросов не найдено ни одного поста по теме ИИ для изображений и видео: фактически данных по теме нет. Reddit завершён на 12 тредах, не достигнув целевых примерно 20, а содержательно больше напоминает запросы на рекомендации инструментов, чем новости. В исходных данных Pinterest не было деления на открытый и закрытый сегменты, поэтому потребовалась ручная переклассификация. Lemmy — небольшая платформа, практически зависящая от кураторства одного аккаунта, Even_Adder. На YouTube из-за JavaScript-рендеринга нельзя было получить текст страниц через WebFetch; просмотры и число подписчиков также не удалось извлечь через oEmbed. На Bluesky часть ключевых слов — Runway, Kling и Black Forest Labs — постоянно давала 403, поэтому сбор пришлось прекратить; результаты по WAN 3.0 также нужно дисконтировать из-за потока спама.

Сводка по платформам

Reddit

Reddit — Новости ИИ для генерации изображений и видео

Где

12 собранных тредов относятся к следующим девяти сабреддитам.

Сабреддит Число участников Число собранных тредов
r/isthisAI 408,823 1
r/antiai 322,973 1
r/GetNoted 298,488 1
r/generativeAI 152,415 3
r/aiwars 167,809 1
r/hatethissmug 134,660 1
r/aivideomaking 6,823 2
r/GoogleFlow 1,884 1
r/AItips101 1,299 1

Заметна активность крупных сабреддитов, обсуждающих саму допустимость генеративного ИИ (r/antiai, r/aiwars, r/isthisAI, r/GetNoted), тогда как средние сообщества с рекомендациями инструментов (r/generativeAI, r/aivideomaking) передают реальную картину использования инструментов.

Что говорят люди
  • 【#6, r/antiai, 7,146 очков / 1,025 комментариев, 2026-09-05】Пост о том, что LLM, обозначенной как GPT-6, дали управление мышью и клавиатурой, чтобы она «рисовала вручную» на цифровом планшете и могла подделывать даже таймлапс. Топовый комментарий (2,511 очков, u/Nayutantantan) возмущается: «Мне уже не хочется снимать таймлапс даже для собственных работ, потому что фальшивые таймлапсы становятся нормой». Этот единственный тред получил несоизмеримо больше реакции, чем все остальные собранные. https://www.reddit.com/r/antiai/comments/1w81kdd/
  • 【#11, r/GetNoted, 4,470 очков / 325 комментариев, 2026-09-10】Пример X-поста с ИИ-изображением, где в расписании появился искажённый текст наподобие «Handloags»; это стало поводом для скандала. В топ-комментариях смеются над сыростью ИИ-генерации. https://www.reddit.com/r/GetNoted/comments/1wcw3n9/
  • 【#1, r/AItips101, 145 очков / 83 комментария, 2026-09-07】«Рейтинг нецензурируемых генераторов ИИ-изображений 2026 года». Первым назван WildOwl.ai: сервис обещает доступ по мере использования к более чем 35 моделям, включая Qwen Image, Flux, Seedream, Wan, Kling, Seedance, Veo и GPT Image, без ежемесячной оплаты и с бессрочными кредитами. Комментатор u/reliablemicrophone84 (4 очка) согласен: он тратил кредиты впустую из-за фильтров в других местах. Но u/Pretend_Program_3696 (3 очка) рекомендует Perchance/Uncensored.ai, поэтому мнения расходятся. https://www.reddit.com/r/AItips101/comments/1w9yftp/
  • 【#8, r/aivideomaking, 4 очка / 21 комментарий, 2026-09-09】В ответ на запрос о фотореалистичных бесплатных или кредитных генераторах изображений и видео перечислены OpenartAI, fal, dzine, pixverse, Higgsfield и RunningHub, где через ComfyUI доступны и открытые, и закрытые модели. u/zeroludesigner добавляет, что Seedance 2.5 от cyberbara работает без цензуры и поддерживает реальные лица. https://www.reddit.com/r/aivideomaking/comments/1wbxpdf/
  • 【#3, r/generativeAI, 0 очков / 7 комментариев, 2026-09-11】Тред с поиском браузерного инструмента для NSFW-генерации изображений и видео. u/MisterZan25 упорядочил рекомендации: RunDiffusion/Tensor.art для изображений и постоянства персонажей, PornGen/PornJourney, а также зеркала Pika Labs для видео. u/frighten (1 очко) рекомендует iPhone-приложение PixelForge как локальное и нецензурируемое. https://www.reddit.com/r/generativeAI/comments/1wdkbxv/
  • 【#4, r/generativeAI, 1 очко / 11 комментариев, 2026-09-07】На вопрос о самом дешёвом «безлимитном» сервисе преобразования 1080p-изображения в видео предложен Artlist.io (€550 в год). Но несколько комментариев критикуют слово «безлимит»: u/ai_art_is_art (3 очка) пишет, что сайты с обещанием «unlimited» обычно почти мошеннические — можно заплатить $550, получить генераций примерно на $200 и ждать 24 часа. https://www.reddit.com/r/generativeAI/comments/1wa4k88/
  • 【#5, r/aivideomaking, 16 очков / 38 комментариев, 2026-09-07】На вопрос «как бесплатно создать 45-секундное видео только на телефоне/iPad» u/NewLifeWares (2 очка) реалистично отвечает, что 45 секунд требуют почти уровня дата-центра; бесплатно можно рассчитывать разве что на один-два клипа по пять секунд с водяным знаком, которые придётся склеивать. u/GuessingEngineer (2 очка) иронизирует: если бы это можно было сделать одним действием, человек уже управлял бы миром. Хорошо видно одновременно спрос на бесплатное, качественное и длинное видео — и нереалистичность такого сочетания. https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/
  • 【#7, r/GoogleFlow, 6 очков / 2 комментария, 2026-09-10】Вышло Chrome-расширение AutoFlow для Google Flow (Veo). Оно поддерживает пакетную генерацию, продолжение с последнего кадра предыдущего клипа и автоматическое редактирование роликов с озвучкой/субтитрами; бизнес-модель — бесплатная версия и подписки Pro/Ultra. https://www.reddit.com/r/GoogleFlow/comments/1wccmrg/
  • 【#12, r/aiwars, 0 очков / 14 комментариев, 2026-09-08】Обсуждаются риски права на изображение и рекламы в случае, когда ИИ-сгенерированный человек случайно похож на реального. u/Upstairs-Mammoth-509 (3 очка) отмечает, что сложнее всего, когда лицо случайно совпадает с неизвестным обычным человеком: компаниям остаётся лишь проверять обратным поиском изображений и надеяться — законодательство отстаёт. https://www.reddit.com/r/aiwars/comments/1wafe86/
  • 【#10, r/hatethissmug, 59 очков / 20 комментариев, 2026-09-12】Внутренние разногласия противников ИИ вокруг видео, которое использует генеративный ИИ, одновременно его критикуя. u/AprilsStuff (22 очка) пишет, что он против ИИ, но аргументы об экологическом ущербе слишком преувеличены, а идея, будто ИИ «сам исчезнет», нереалистична. Даже внутри анти-ИИ сообщества нет единой позиции. https://www.reddit.com/r/hatethissmug/comments/1wdxv6k/
  • 【#2, r/isthisAI, 0 очков / 31 комментарий, 2026-09-09】Тред об определении, является ли видео ИИ-генерацией или реальной съёмкой. Исчезновение и повторное появление ожерелья (u/smalltiddygothb, 16 очков / u/EmergencyWaffleBox, 14 очков) считают решающим доказательством. u/BouncingSphinx (5 очков) замечает, что длительность ровно 15 секунд тоже похожа на нынешний лимит ИИ-видео. Среди обычных пользователей технические ограничения ИИ-видео — длина и несогласованность деталей — постепенно становятся критериями проверки. https://www.reddit.com/r/isthisAI/comments/1wbspxo/
Сигналы
  • Что растёт: упоминания интегрированных платформ без цензуры и с NSFW-возможностями — WildOwl.ai, cyberbara, RunDiffusion, Tensor.art, PixelForge и других — независимо повторяются в нескольких тредах. Велик спрос на сочетание доступа к свежим моделям и менее строгой модерации.
  • Что растёт: появление внешней экосистемы, дополняющей официальные инструменты, например AutoFlow для Google Flow (#7).
  • К чему относятся с недоверием: сообщества стабильно сомневаются в подписках, рекламируемых как «безлимитные», таких как Artlist.io (#4).
  • К чему относятся с недоверием: даже среди противников ИИ аргументация, подчёркивающая экологический вред (#10), вызывает возражения, что она слишком преувеличена. Анти-ИИ дискурс неоднороден.
  • Неожиданное наблюдение: самым вовлекающим материалом среди 12 тредов был не релиз модели, а анти-ИИ разоблачение подделки таймлапса рисования (#6, 7,146 очков) и скандал вокруг ИИ-изображения (#11, 4,470 очков). На Reddit темы обмана и доверия распространяются гораздо сильнее продуктовых новостей.
  • Неожиданное наблюдение: различие между закрытым и открытым исходным кодом не находится в центре пользовательского внимания. В большинстве тредов Qwen, Flux, Seedream, Wan, Kling, Seedance, Veo и GPT Image перечислены рядом как просто доступные модели, а комментариев, проводящих различие, почти нет.
Ограничения
  • Использовался только один поисковый запрос — "Image and Video Generation AI News"; найдено лишь 12 тредов, а не ожидаемые примерно 20.
  • Сбор был основан на результатах предварительной работы через headless-браузер. Дополнительно искать и читать Reddit самостоятельно в этот раз нельзя было, поскольку Reddit отклоняет страницы через WebFetch и поиск.
  • Большинство собранных постов — треды вопросов и ответов в духе «посоветуйте инструмент», то есть они скорее отражают практику использования, чем новости. Профессиональных новостных тредов, чётко разбирающих закрытый и открытый сегменты, не найдено.
  • r/AItips101 (1,299 участников) и r/GoogleFlow (1,884 участника) — очень небольшие сабреддиты; их выводы скорее отражают отдельные голоса, чем всё сообщество.

X

X — Тенденции новостей об ИИ для генерации изображений и видео

Аккаунты

40 собранных публикаций принадлежат 40 разным аккаунтам, и от каждого взят лишь один пост. Ни один из них не специализируется на ИИ для генерации изображений и видео — Midjourney, Stable Diffusion, Sora, Runway, Kling, Veo, ComfyUI, Flux и т. п. Поисковые результаты группируются по запросам.

  • Yemen/Saudi (Ближний Восток, OSINT): @tleilax___, @Ahmed175143, @IranTimes72, @citrinowicz, @Osinttechnical, @c14english, @Rusia_HD, @MerruX — OSINT- и новостные аккаунты о нападении на саудовскую нефтяную инфраструктуру и конфликте в Йемене.
  • $SONG (мем-коин Cardano): @LagyADA, @EAjdarovic, @JureKaramarko, @SintoAndrej — небольшие спекулятивные и рекламные аккаунты.
  • Charlie Kirk (годовщина смерти): @tivent_1, @TruthNetwork24, @mscaradapawjob, @rokkstarrrrrrr — политические комментарии и мемы.
  • Britain (британская политика): @brigantia__, @Steven41849941, @SirJBritain, @BROKENBRITAIN0 — националистические посты о миграции и безопасности.
  • Anthropic (экономика ИИ и безопасность): @restitutorII, @BrianRoemmele, @walterkirn, @claudecode84 — прогнозы Anthropic, открытие исходников Claude Code и критика ИИ; это про LLM-агентов и социальные последствия ИИ, а не генерацию изображений или видео.
  • Apple/Samsung (споры о смартфонах): @FlossyCarter, @cagriozturkish, @appleinteligen, @BrandonKHill — перепалки фанатов складных устройств.
  • Sony (игровая индустрия): @JayDubcity16, @Cris_Uther, @treeblazah, @ScreenCraveHQ — слухи о Хидео Кодзиме и фильмах о Человеке-пауке.
  • "one ai os" (самореклама ИИ-стартапов): @de1lymoon, @neda_sefati, @harvey_control, @Iamanusbutt — нетворкинг стартапов, строящих ИИ-агентов и операционные системы для бизнеса; генерация изображений и видео не упоминается.
  • Chelsea (футбол): @declanstar1, @TheHateCentra, @Lea_EFC, @chelcatastr0phe — посты о Chelsea FC.

Повторяющихся авторов недостаточно, чтобы сравнивать «один большой вирусный пост» и «накопление множества небольших постов». Формально самыми популярными одиночными публикациями были @rokkstarrrrrrr (9,404 лайка), @TheHateCentra (19,654) и @Cris_Uther (17,095), но все они не относятся к теме.

Посты

Прямых упоминаний ИИ для генерации изображений или видео — ноль. Ниже приведены наиболее близкие, но всё равно нерелевантные посты.

  1. #21 @restitutorII — 458 лайков · 69 репостов · 41 ответ · около 57,000 просмотров · 2026-09-10
    https://x.com/restitutorII/status/2097918742571139093

    "Anthropic in its report imagines 3 possible futures for the American economy in 2030 based on the power and adoption of AI..."
    → Экономические сценарии Anthropic. Это тема генеративного ИИ в целом, не тенденции генерации изображений и видео.

  2. #24 @claudecode84 — 2,585 лайков · 268 репостов · 24 ответа · около 741,000 просмотров · 2026-09-10
    https://x.com/claudecode84/status/2097959830942367747

    «Сам руководитель Anthropic открывает исходники всей своей среды Claude Code»
    → Открытие исходников Claude Code, то есть ИИ для программирования, а не моделей изображений или видео.

  3. #33 @de1lymoon — 49 лайков · 6 репостов · 9 ответов · около 3,500 просмотров · 2026-09-11
    https://x.com/de1lymoon/status/2098428267158032841

    "Grok Bot + Kimi K3 is where an AI agent starts turning into an operating system..."
    → Рассуждение об оркестрации ИИ-агентов, не связанное с генерацией изображений или видео.

  4. #22 @BrianRoemmele — 792 лайка · 187 репостов · 105 ответов · около 100,000 просмотров · 2026-09-10
    https://x.com/BrianRoemmele/status/2098024115231924568
    → Мемный пост с критикой Anthropic и рассуждениями об угрозе ИИ; тема изображений и видео отсутствует.

  5. #23 @walterkirn — 723 лайка · 91 репост · 39 ответов · около 28,000 просмотров · 2026-09-10
    https://x.com/walterkirn/status/2098059171325427949
    → Аналогично: контекст критики Anthropic и медиа, без упоминания генерации изображений или видео.

Эти пять постов — всё, что удалось найти по слову «AI». Ни один из них нельзя использовать как новость о закрытых или открытых ИИ-моделях для изображений/видео.

Сигналы
  • В топ-10 трендов X Explore для данного сеанса — судя по пометке «Trending in Croatia», вероятно, с ориентацией на Хорватию — вошли Yemen, Saudi, $SONG, Charlie Kirk, Britain, Anthropic, Apple, Sony, one ai os и Chelsea. Ни Midjourney, ни Sora, ни Stable Diffusion, ни Runway, ни Kling, ни Veo там нет.
  • В трендах присутствуют Anthropic и one ai os, поэтому обсуждения ИИ-агентов, LLM и экономического воздействия ИИ активны. Но это другой тематический кластер, не генерация изображений и видео.
  • Среди 40 постов нет ни одного упоминания названий генераторов, релизов, демонстраций или сравнений инструментов для изображений/видео.
Ограничения
  • Использованные запросы — "Yemen", "Saudi", "$SONG", "Charlie Kirk", "Britain", "Anthropic", "Apple", "Sony", "one ai os", "Chelsea" — были ежедневными трендами X Explore, а не запросами об ИИ для генерации изображений и видео. Поэтому среди 40 постов нет ни одной тематической публикации.
  • Из-за этого на основе X невозможно подготовить требуемые брифом «10 наблюдений об открытом сегменте и 10 — о закрытом». По существу, тематического сбора не было: не потому, что X «ничего не говорит» об этой сфере, а потому что поиск не был направлен на неё.
  • При следующем запуске необходимо использовать названия инструментов и компаний: Midjourney, Stability AI, Runway, Pika, Luma, Kling, Sora, Google Veo, Flux, ComfyUI и т. д.

YouTube

YouTube — Новости ИИ для генерации изображений и видео (закрытые / открытые решения)

Каналы
  • There's An AI For That — канал об ИИ-инструментах; выпустил обзор FLUX.2.
  • AI Search — канал оперативных новостей о моделях; видео о Sora 2 и HunyuanVideo 1.5.
  • Theoretically Media — специализированный канал по ИИ-видео; подробный обзор Veo 3.1.
  • Teacher's Tech — практические инструменты; обзор Nano Banana 2.
  • Codebreakers — обзоры и объяснения открытых ИИ-моделей; выпуск о MiniMax H3.
  • Bijan Bowen — канал для энтузиастов локальной генерации; тест Z-Image Turbo.
  • Benji's AI Playground — учебные материалы по ComfyUI и локальной генерации; разбор Ideogram 4.0.
  • Curious Refuge — опытный образовательный канал об ИИ-производстве видео; обзор Midjourney V8.
  • RandomAI — оперативные новости и сравнения моделей; объяснение GPT Image 2.5.
  • Standarity / The AI Filmmaking Advantage — новостные и сравнительные каналы; объявление и полный тест Seedream 5.0 Pro.
  • MattVidPro AI — упоминает Runway Gen-4 в видео с первыми впечатлениями.
Видео
  1. «Is FLUX 2.0 The New Open Source King?» — There's An AI For That — https://www.youtube.com/watch?v=YQuTkPVkCS8 — Проверка, сможет ли FLUX.2 от Black Forest Labs стать новым королём открытой генерации изображений.
  2. «We have a new #1 open-source AI video generator!»(2025-11-25) — AI Search — https://www.youtube.com/watch?v=6EQP8-D37bs — Обзор и инструкция по установке HunyuanVideo 1.5 в ComfyUI; заявлена работа даже при небольшом объёме VRAM.
  3. «Sora 2… wtf» — AI Search — https://www.youtube.com/watch?v=El-G4cO4x4I — Сравнение OpenAI Sora 2 с Veo 3, Kling 2.5 и Hailuo 02; отмечены улучшения синхронизации аудио и физического поведения.
  4. «Veo 3.1 Is More Powerful Than You Realize!»(2025-10-16) — Theoretically Media — https://www.youtube.com/watch?v=sTOFXi2eY_k — Рассмотрены улучшения синхронизации губ, постоянства персонажей и апскейла до 1080p в Google Veo 3.1.
  5. «The New Gemini Image Generator is Insane (Nano Banana 2)» — Teacher's Tech — https://www.youtube.com/watch?v=nikIxHM_AQY — Рассказ о том, что Nano Banana 2 стал генератором по умолчанию в приложении Gemini.
  6. «MiniMax H3: The New Open-Source Video Champ?»(2026-08-03) — Codebreakers — https://www.youtube.com/watch?v=3R5GROj8Tcg — Открытовесовая омнимодальная видеомодель MiniMax H3 (Hailuo 3.0), способная за один проход нативно создавать видео со стереозвуком.
  7. «Alibaba Z-Image Turbo Test – The New KING of LOCAL Image Models» — Bijan Bowen — https://www.youtube.com/watch?v=K0FgDU-9uik — Локальный тест Z-Image Turbo под лицензией Apache-2.0, который автор называет KING.
  8. «Ideogram 4.0 Released! The New Open Model That FINALLY Gets Text Right»(2026-06-04) — Benji's AI Playground — https://www.youtube.com/watch?v=HY_e5CZfJfQ — Сообщается, что первая открытовесовая модель Ideogram заняла первое место в Design Arena и наконец точно отображает текст.
  9. «I Tried Midjourney 8… Here's the Truth»(2026-03-19) — Curious Refuge — https://www.youtube.com/watch?v=i9qV9-2tzEA — Честная оценка возможностей Midjourney V8.
  10. «GPT Image 2.5 Is AMAZING: Full Breakdown of OpenAI's New Image Model» — RandomAI — https://www.youtube.com/watch?v=DY6TkI8XtkQ — Разбор GPT Image 2/2.5 от OpenAI, включая улучшенный рендеринг текста и многоязычную поддержку.
  11. «ByteDance Seedream 5.0 Pro: The Announcement, Read and Highlighted» — Standarity — https://www.youtube.com/watch?v=g05iPef37Qs — Краткое изложение анонса Seedream 5.0 Pro с редактированием по слоям.
  12. «🚨BREAKING: Seedream 5.0 Pro Just SMOKED Every Image Model (Fully Tested)»(2026-07-16) — The AI Filmmaking Advantage — https://www.youtube.com/watch?v=WpcxwSNT3X4 — Полный тест Seedream 5.0 Pro в сравнении с другими моделями; автор считает, что она разгромила существующие решения.
Сигналы

Движение закрытого сегмента

  • OpenAI GPT Image 2 / 2.5 занимает первое место в Artificial Analysis Image Arena с Elo 1,339; сообщается о крупнейшем в истории арены разрыве между первым и вторым местами по состоянию на сентябрь 2026 года.
  • Google усиливает Veo 3.1 и Nano Banana Pro (Gemini 3 Pro Image) как связку видео и изображений: синхронизация губ, 1080p-апскейл и послойное редактирование явно ориентированы на профессиональное применение.
  • ByteDance Seedance 2.0 (2026-02) и Seedream 5.0 Pro (примерно июль 2026 года) быстро набирают заметность благодаря мультимодальности — текстовым, визуальным, видео- и аудиореференсам.
  • Несколько видео утверждают, что xAI Grok Imagine 1.5 превосходит Veo и Sora в бенчмарках; тема заметно обсуждалась примерно в июне 2026 года.
  • Существующие игроки — Runway Gen-4/4.5, Midjourney V8 (V8.1, V8.2) и другие — продолжают обновляться; много видео посвящено защите ими своих позиций.

Движение открытого сегмента

  • FLUX.2 от Black Forest Labs несколько обозревателей называют новым королём как качественную модель изображений для локального запуска.
  • Tencent HunyuanVideo 1.5 получил нативную поддержку ComfyUI и становится новой стандартной открытой видеомоделью, работающей даже на системах с малым VRAM.
  • Z-Image и Z-Image Turbo от Alibaba/Tongyi-MAI опубликованы под Apache-2.0; многие каналы называют их новыми королями локальных моделей.
  • Ideogram 4.0 вышла как первая открытовесовая модель компании, заняла первое место в Design Arena, а её точность отображения текста подчёркивают особенно часто.
  • MiniMax H3 (Hailuo 3.0) резко вышел на первый план в августе 2026 года как открытовесовая омнимодальная видеомодель, работающая даже на потребительских GPU вроде RTX 3090; быстро появляются ролики о поддержке ComfyUI.
  • Lightricks LTX-2 предлагает открытый 4K-видеогенератор на 50 fps с синхронизацией аудио и называется «святым Граалем открытого видео».
  • Alibaba Wan 2.5/2.6 продолжают регулярно упоминать как открытые видеомодели с поддержкой текста, изображений, аудио и видео на входе.
Ограничения
  • Страницы результатов YouTube (youtube.com/results?...) рендерятся JavaScript, поэтому WebFetch возвращал только футер, без заголовков, просмотров и сведений о каналах. Страницы отдельных видео (watch?v=) имели ту же проблему; заголовки и каналы проверялись через YouTube oEmbed API (youtube.com/oembed).
  • oEmbed API не возвращает просмотры, дату публикации, число подписчиков или комментарии. Поэтому просмотры и подписчики, которые требовались playbook, получить не удалось. Даты приводятся только там, где они присутствовали в сниппетах WebSearch; в остальных случаях опущены.
  • Для «LTX-2: Open Source AI Video, Released to the Community» (zSvCnVi181A) oEmbed вернул 403 Forbidden, поэтому подтвердить видео не удалось.
  • По этим причинам содержание комментариев к видео не проверялось; краткие выводы основаны только на заголовках и описаниях.
  • Для усиления выводов использовалась информация из WebSearch — сниппеты статей и связанные блоги, но все приведённые YouTube URL подтверждены как существующие.

Bluesky

Bluesky — Новости ИИ для генерации изображений и видео (закрытые / открытые решения)

Аккаунты
  • theinformation.com / techmeme.com / mediagazer.com / lefiltech.fr — новостные боты, связанные с RSS; распространяют эксклюзивные материалы об OpenAI и Sora на нескольких языках.
  • ctxwindow.kynth.studio(#TechBluesky) — наблюдатель, регулярно публикующий изменения на странице цен OpenAI.
  • gen-ai.news — личный новостной аккаунт с оперативными сообщениями об обновлениях Midjourney.
  • oludai.bsky.social — ведёт собственный лидерборд слепых человеческих оценок на olud.ai, ежечасно ранжируя открытые и закрытые модели изображений.
  • aichina.news — ботоподобный аккаунт, почти ежедневно освещающий FLUX-подобные LoRA под Apache-2.0, появляющиеся на Modelers.cn компании Huawei.
  • circuitai.bsky.social — спам- и рекламный аккаунт, публикующий практически одинаковую партнёрскую ссылку на Alibaba WAN 3.0 (vidhapi.app) десятки раз в день.
  • arxiv-cs-cv.bsky.social — автоматические публикации новых статей arXiv по генерации изображений и видео.
  • un1v3rse.bsky.social / carlbetheav.bsky.social / stumblegirl.bsky.social / ttaships.airminded.org — отдельные художники, ежедневно публикующие работы Midjourney (#midjourney #QP #FoxyFriday).
  • rin-yamami.bsky.social / satomin6.alimika.jp — японские ИИ-иллюстраторы, использующие Qwen-Image-Edit и ComfyUI.
Посты
  1. theinformation.com (2026-09-10, 👍1 🔁0) — эксклюзив: бывший руководитель Sora в OpenAI Билл Пиблс создаёт собственный стартап по ИИ-генерации видео вместе с голливудским влиятельным лицом Джеффри Катценбергом, бывшим руководителем DreamWorks, и бывшим CFO Dropbox.
     https://bsky.app/profile/theinformation.com/post/3mv6myz7pa52n
  2. ctxwindow.kynth.studio (2026-09-08, 👍0/1 🔁0) — обнаружено, что OpenAI тихо убрала sora-2 и sora-2-pro со страницы цен; прежняя цена — $0.05–$0.30 за 720p. Это рассматривается как подтверждение сворачивания Sora.
     https://bsky.app/profile/ctxwindow.kynth.studio/post/3muxriifygl23
  3. somewhattolerable.com (2026-09-06, 👍2) — предположение, что OpenAI прекратила Sora, потому что внутренние инженеры жаловались на чрезмерное потребление ресурсов.
     https://bsky.app/profile/somewhattolerable.com/post/3muuuazkaf223
  4. itmatterss.bsky.social (2026-09-11, 👍1) — Gemini от Google получил Windows-приложение для рабочего стола, запускаемое через Alt+Space. Для изображений используется Nano Banana, для видео — «Gemini Omni».
     https://bsky.app/profile/itmatterss.bsky.social/post/3mvayanva5c2n
  5. dimnews.bsky.social (2026-09-11, на русском) — SenseTime анонсировала 8-миллиардную мультимодальную модель SenseNova-U1.5 и утверждает, что в визуальном рассуждении она превосходит Nano-Banana-Pro.
     https://bsky.app/profile/dimnews.bsky.social/post/3mv7u7crnzz25
  6. gen-ai.news (2026-08-30, 👍1) — сообщается, что редактирующая модель Midjourney V8.2 была тихо исправлена после жалоб на потерю качества изображения.
     https://bsky.app/profile/gen-ai.news/post/3mudbgowbnz2s
  7. futureautomationai.bsky.social (2026-09-03, 👍2) — сводка «Midjourney в 2026»: V8.2, персонализация, доски настроения, модель редактирования и функции референсов.
     https://bsky.app/profile/futureautomationai.bsky.social/post/3mumtnbxuv22d
  8. oludai.bsky.social (2026-09-10/11, 👍1-2) — в лидерборде слепой оценки лучшей загружаемой моделью названа Qwen-Image-3.0-Pro (#12), отстающая от GPT Image 2 (high) на 92 Elo.
     https://bsky.app/profile/oludai.bsky.social/post/3mv5ywkauvt2t
  9. ddigitalmedia.bsky.social (2026-09-10, 👍1) — оценка: Qwen, Z-Image и MiniMax — единственные модели, способные противостоять западным LLM- и визуальным продуктам.
     https://bsky.app/profile/ddigitalmedia.bsky.social/post/3mv6lyejx3223
  10. circuitai.bsky.social (2026-09-11–12, повторяющиеся публикации) — Alibaba WAN 3.0 рекламируется как дешёвая альтернатива ByteDance Seedance 2.5 с оплатой за использование, до 30 секунд на клип. Важно: одинаковые партнёрские посты повторяются более 15 раз в день.
     https://bsky.app/profile/circuitai.bsky.social/post/3mvbvqsdvr22p
  11. minaxlab.bsky.social (2026-09-11) — объявлен релиз ComfyUI v0.35.1. Локальная открытая экосистема генерации продолжает обновляться.
     https://bsky.app/profile/minaxlab.bsky.social/post/3mvasr3l72x2i
  12. aichina.news (2026-09-08–09, серия публикаций) — на Modelers.cn от Huawei одна за другой появляются FLUX-подобные LoRA под Apache-2.0, но у многих нет trigger-слов и бенчмарков; аккаунт регулярно заключает, что для заявлений о превосходстве над Qwen-Image недостаточно доказательств.
     https://bsky.app/profile/aichina.news/post/3mv3vq3zdui24
  13. arxiv-cs-cv.bsky.social (2026-09-11) — опубликована новая статья о тестировании и улучшении способности видеомоделей рассуждать «через видео» — From Evaluation to Enhancement.
     https://bsky.app/profile/arxiv-cs-cv.bsky.social/post/3mvbfk6tunc2j
Сигналы
  • Sora фактически теряет темп: в один период совпали удаление моделей со страницы цен, уход бывшего руководителя и запуск конкурирующего стартапа, а также предположение, что проект закрыли из-за чрезмерного потребления ресурсов. Видеогенерация OpenAI выглядит оборонительной.
  • Google, напротив, разворачивается по всем направлениям: Nano Banana для изображений, Nano Banana Pro, Veo и Gemini Omni для видео интегрируются даже в Windows-приложение, что отражает стратегию встраивать генеративный ИИ во всё.
  • Китайские модели — главные в открытом сегменте: Qwen-Image-3.0-Pro, Z-Image (Turbo), MiniMax, Alibaba WAN 3.0 и SenseTime SenseNova-U1.5 находятся в центре обсуждений. Несколько аккаунтов утверждают, что только открытые китайские модели способны соперничать с западными продуктами для изображений и видео.
  • Разрыв с закрытым сегментом сокращается: по продолжающимся слепым измерениям oludai.bsky.social Qwen-Image-3.0-Pro приблизилась к GPT Image 2 (high) на расстояние 92 Elo.
  • Нужно учитывать шум и рекламу: большая часть публикаций о WAN 3.0 — однотипные партнёрские сообщения circuitai.bsky.social, а не органический интерес.
  • Экосистема инструментов продолжает развиваться: обновляется сама ComfyUI, а FLUX LoRA переносятся, в частности, на NPU Ascend от Huawei; поддержка выходит за пределы CUDA-оборудования.
Ограничения
  • Публичный API Bluesky (public.api.bsky.app и api.bsky.app с app.bsky.feed.searchPosts) периодически возвращал 403, вероятно из-за ограничений скорости. Последовательные запросы часто падали; многие удавалось выполнить лишь после пауз и повторных попыток.
  • Для Runway Gen, Kling AI, Black Forest Labs, Wan 2.5 и некоторых вариантов написания 403 повторялся, поэтому эти запросы пришлось оставить и использовать альтернативы, например Wan video. Прямых публикаций о Runway и Kling в этом файле нет.
  • Веб-интерфейс bsky.app/search — JavaScript SPA: при получении страницы текст постов не отображается. Поэтому сбор полностью зависел от JSON публичного API.
  • Слова вроде «Flux» и «Z-Image» ищутся буквально, поэтому большинство результатов было нерелевантным: Aeon Flux, солнечный поток, Pokémon Z-A, сайты для взрослых и т. п. Их исключение требовало времени.
  • Материалы The Information о Катценберге и статьи arXiv проверялись только по заголовкам и кратким описаниям, не по полному тексту — из-за пейволлов и сложности научных работ.

Lemmy

Lemmy — Новости ИИ для генерации изображений и видео

Сообщества
  • !«メールアドレス» — всего 5,709 подписчиков, из них 893 локальных. Это крупнейший хаб Lemmy по инструментам и релизам ИИ для изображений и видео. Почти все недавние публикации ежедневно размещает один пользователь, Even_Adder, прикрепляя новые GitHub/HuggingFace-релизы.
  • !«メールアドレス» / lemmy.world — сообщества для показа сгенерированных изображений; это скорее галереи, чем новости, с оценками от -14 до 16.
  • !«メールアドレス» — специализированное сообщество абстрактного искусства на SDXL и пользовательских LoRA. В сентябре создано более 10 постов, активность высока.
  • !ai_reddit@[разные инстансы] — сообщества с кросспостами Reddit r/ArtificialInteligence; оригинальных дискуссий мало.
  • !«メールアドレス» — общие техновости; статьи о Midjourney здесь набрали свыше 70 очков.
  • !hackernews@[разные инстансы] — кросспосты Hacker News; несколько публикаций о Midjourney.
  • !techtakes@[разные инстансы] — сообщество с критическим отношением к ИИ; «Midjourney pivots to Theranos» набрал 40 очков.
  • !llm@[разные инстансы] — сообщество об LLM. Там есть пост о GPT-6 Astra, но его оценка отрицательная (-3).
  • !«メールアドレス» — небольшое сообщество вокруг текстового/визуального генератора Perchance.

API некоторых инстансов возвращал 404 для числа подписчиков, поэтому точные значения, кроме !«メールアドレス», подтвердить не удалось.

Посты
Ближе к закрытым решениям
  1. "Midjourney pivots from AI image generation to body scanning medical spa" — !«メールアドレス», 58 очков, 2026-06-18. https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/5258429 — Шокирующая новость о том, что Midjourney переключается с генерации изображений на медицинские спа с ультразвуковым КТ (Midjourney Medical).
  2. "Midjourney AI pivots to Theranos: Ultrasonic CT" — !techtakes, 40 очков, 2026-06-19. https://pivot-to-ai.com/2026/06/19/midjourney-ai-pivots-to-theranos-ultrasonic-ct/ — Ироничный комментарий, называющий это «новым Theranos».
  3. Официальная страница "Midjourney Medical" — !hackernews, 3 очка, 2026-06-18. https://www.midjourney.com/medical
  4. "Midjourney wants Hollywood studios to reveal the details of their AI usage" — !«メールアドレス», 73 очка, 2026-07-05. https://techcrunch.com/2026/07/04/midjourney-wants-hollywood-studios-to-reveal-the-details-of-their-ai-usage/ — Midjourney требует от голливудских студий раскрыть подробности применения ИИ.
  5. "Behind the scenes with the Midjourney scanner" (видео) — !hackernews, 1 очко, 2026-07-06. https://www.youtube.com/watch?v=4nzzpUKhj1M
  6. "Amnesty International's May 2026 briefing calls leading generative AI systems 'unlawful by design'" — !ai_reddit, 1 очко, 2026-06-24. https://www.reddit.com/r/ArtificialInteligence/comments/1ue64s2/ — Правозащитная организация критикует сбор тренировочных данных крупными закрытыми генеративными ИИ, включая генераторы изображений, как потенциально незаконный.
  7. Релиз GPT-6 Astra — !llm, -3 очка, 2026-09-04. https://openai.com/index/gpt-6-astra/ — сама LLM не создаёт изображения или видео напрямую, а вызывает инструменты через Responses API. Реакция сообщества слабая и отрицательная.
Ближе к открытому сегменту (все в !«メールアドレス», автор Even_Adder)
  1. Набор инструментов вокруг видеомодели MiniMax-H3 — с 9/4 по 9/10 опубликовано семь и более инструментов: ComfyUI-MiniMax-H3-W4A4-VSA, MiniMax-H3-Semantic-Bridge, ComfyUI-Ref2VA-VSA, Minimax-h3_Singularity, minimax-h3_fl2v_8Step_motion_enhancer, ComfyUI-VDN-H3, vdn-minimax-h3, FastH3-Ref2V-Stream-Controller. Экосистема открытой видеомодели MiniMax-H3 быстро расширяется за счёт квантования, ускорения и семантических мостов. Пример: https://github.com/sepiablue-ai/ComfyUI-MiniMax-H3-W4A4-VSA
  2. "LLaDA-Image: Building Strong Image Generators" — 3 очка, 2026-09-04. https://arxiv.org/abs/2609.03796 — статья об открытом Diffusion Transformer на 6 млрд параметров.
  3. Две LoRA для Krea 2 TurboF16/krea2-turbo-sda (2 очка, 9/10, https://huggingface.co/F16/krea2-turbo-sda) и lvladikov/Krea2-Turbo-Distill-4step-LoRA (2 очка, 9/8), где заявлено улучшение качества на 45% при дистилляции в четыре шага.
  4. "Viggle/Viggle-Animate" — 10 очков, 2026-09-05. https://huggingface.co/Viggle/Viggle-Animate — технология для замены персонажа в видео по одному перерисованному кадру.
  5. "How a 20-year-old independent builder from Bihar created an open omni AI model" — !ai_reddit, 0 очков, 2026-09-11. https://www.reddit.com/gallery/1wdii5s — история об открытой omni-модели на 5.84 млрд параметров, которая, как утверждается, превосходит AFM 3B от Apple на MATH-500.
Сигналы
  • Главное поле открытого сегмента — не столько сами модели, сколько окружающая экосистема. В особенности вокруг видеомодели MiniMax-H3 за неделю вышло более 10 релизов квантования, ускорения, узлов ComfyUI и LoRA; именно здесь сосредоточен интерес сообщества.
  • Публикации Lemmy по теме фактически зависят от кураторства одного человека — Even_Adder. Это скорее список ссылок, чем площадка для обсуждений: комментариев почти нет.
  • Главная тема закрытого сегмента — не гонка производительности моделей, а скандальный поворот Midjourney к медицинским спа. Тон скорее корпоративно-критический и иронический, чем технический; заметны критические медиа вроде pivot-to-ai.
  • В качестве темы закрытых решений также возникает критика со стороны правозащитников, включая доклад Amnesty International о законности генеративного ИИ и сбора данных.
  • GPT-6 Astra, выпущенный в сентябре 2026 года, не генерирует изображения/видео напрямую, поэтому его прямая значимость для темы невысока; реакция Lemmy отрицательная.
Ограничения
  • Поиск Lemmy зависит от совпадения ключевых слов. По Sora, Veo, Runway, Kling, Grok Imagine, Nano Banana связанных результатов не нашлось — только нерелевантные посты. Эти темы почти не обсуждаются в Lemmy.
  • Версия !«メールアドレス» возвращала HTTP 503, поэтому использовалась версия инстанса dbzer0.
  • API нескольких сообществ (/api/v3/community?name=...) возвращал 404, поэтому для ряда сообществ невозможно подтвердить число подписчиков.
  • Хотя было собрано 20 тематических публикаций, Lemmy остаётся очень маленькой платформой в этой сфере. Источники сосредоточены в нескольких сообществах и у нескольких аккаунтов; оригинальных дискуссий мало, большинство постов — ссылки или репосты.

Pinterest

Pinterest — Новости ИИ для генерации изображений и видео

Все 50 пинов из output/pinterest.pins.md, собранные единым запросом "Image and Video Generation AI News" без жанрового деления, были открыты и визуально проверены.

Визуальные темы
  • Неоново-синие и фиолетовые футуристические интерфейсные фоны встречаются особенно часто. Чёрный фон с рисунком печатных плат, светящиеся ИИ-логотипы и голографические человеческие силуэты одинаково характерны для инфографики и обложек видео [1, 3, 4, 5, 34, 37, 39, 41, 48].
  • Бородатый мужчина-ютубер крупным планом + огромная надпись «AI NEWS» + набор логотипов компаний — повторяющийся шаблон превью. Удивлённые и настороженные выражения лица служат для привлечения внимания, рядом помещают Google/OpenAI/Microsoft/Meta/Anthropic [4, 20, 21, 45].
  • Очень много рейтинговой инфографики в стиле «лучший инструмент ИИ для видео»: повторяется почти один шаблон с пронумерованными карточками, логотипами, списком функций и полем «best for». Runway, Pika, Kling AI, Luma (Dream Machine), Canva, Hailuo и Synthesia присутствуют почти в каждом списке [7, 8, 13, 24, 40].
  • Заметен формат «настоящее или ИИ?»: сравнительные загадки с фотографиями пейзажей, объяснения трендов дипфейков и индикаторы распознавания ИИ-голоса [16, 17, 20, 37].
  • Часто повторяется образ гуманоидного робота как символа ИИ: робот-новостной ведущий, робот, указывающий на Землю, или лицо наполовину киборга. Эти картинки обычно не связаны с конкретным содержанием технологии [2, 34, 37, 39, 48].
  • Есть один конкретный демонстрационный грид преобразования материала: одно и то же видео с человеком, собакой и автомобилем показано как деревянные блоки, оригами, LEGO и цветы; это содержательная демонстрация выразительности видеомодели [6].
  • Встречается реклама фриланс-услуг: несколько пинов в духе Fiverr предлагают «создам ИИ-видео», иногда с контактами WhatsApp или сгенерированным изображением Джеффа Безоса [15, 32, 42].
  • Реальные продуктовые новости в виде скриншотов официальных анонсов составляют лишь часть материалов. Большинство — серийная SEO/партнёрская инфографика и YouTube-превью. Среди настоящих новостей есть Google Veo 2/3, Microsoft VASA-1, Vidu S1 от ShengShu, модель Adobe для апскейла, AMD Amuse 3.0 и соглашение ByteDance-MPA по авторскому праву [3, 5, 12, 29, 46, 10, 47, 31].
Примечательные пины
  1. #3/#5 — Google announces ultra-high quality video / промо Veo 2 — официальные промоматериалы Google с примерами настоящих выходов Veo 2: собака, плывущая под водой, фламинго, анимация девушки на кухне.
  2. #12 — Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — конкретное обновление: изображение-в-видео Veo 3 и нативный звук через Gemini API.
  3. #6 — грид демонстрации преобразования материалов (Luma-подобный) — сравнительная сетка, где исходное видео превращается в деревянные блоки, оригами, LEGO и цветы; самый конкретный пример возможностей модели.
  4. #16 — "Why Is Trump Obama AI Video Trending?" — подробная инфографика о вирусном тренде ИИ-видео с Трампом и Обамой. В качестве использованных инструментов названы Runway ML, Pika Labs, Kaiber, HeyGen, CapCut AI и DeepBrain AI.
  5. #29 — ShengShu Technology unveils Vidu S1 — пин об анонсе китайской модели с обещанием «генерации в реальном времени и интерактивности».
  6. #31 — ByteDance and Hollywood reach global deal on AI copyright — реальная юридическая новость о соглашении ByteDance и MPA, Американской ассоциации кинокомпаний, по защите авторских прав в ИИ-инструментах для изображений и видео.
  7. #44 — "More than 20% of YouTube is now AI-generated" — один из немногих пинов с конкретной статистикой.
  8. #46 — Microsoft VASA-1 — демонстрация исследования, создающего говорящие видео из одной фотографии и аудиоклипа.
  9. #47 — "Amuse 3.0" (AMD) — анонс новой версии инструмента ИИ-генерации изображений.
  10. #37 — инфографика распознавания ИИ-голоса ("97% likely AI generated") — просветительский материал о подлинности и этике ИИ.
Сигналы
  • В центре внимания по-прежнему закрытые коммерческие инструменты — Runway, Pika, Kling AI, Luma, Canva, Hailuo, Synthesia, D-ID. Их логотипы появляются почти в каждой рейтинговой инфографике. Пинов, явно продвигающих открытые или самостоятельно разворачиваемые решения — Stable Video Diffusion, ComfyUI-воркфлоу, Open-Sora и подобные — практически нет.
  • Самая заметная официальная продуктовая новость — Google Veo 2/3, с упором на генерацию изображения-в-видео и нативное аудио через Gemini API.
  • Среди китайских разработчиков появляется Vidu S1 от ShengShu с акцентом на генерацию в реальном времени и интерактивность.
  • Тревога вокруг дипфейков и подлинности — видео Трампа и Обамы, распознавание ИИ-голоса, загадки «что из этого ИИ?» — стабильная вторичная тема Pinterest.
  • Присутствуют и новости об устройстве индустрии: доля ИИ-контента на YouTube свыше 20% и соглашение ByteDance-MPA об авторском праве.
  • Технических углублённых материалов о архитектуре моделей, методах обучения и сравнении бенчмарков почти нет. Из-за характера Pinterest материалы смещены к обзорам инструментов, инструкциям и объяснению вирусных явлений.
Ограничения
  • Сборщик использовал единственный запрос — "Image and Video Generation AI News" — и не разделял материалы по жанрам, например на открытый и закрытый сегменты. Поэтому анализ также охватывает все 50 пинов, а окончательное деление должно выполняться на последующем этапе интеграции.
  • Часть пинов была слабо связана с темой либо являлась универсальной стоковой графикой: например, #35 — мировая карта с текущими событиями, #43 — изображение статуи, играющей на виолончели, #22 — иконки Adobe Stock. Поиск Pinterest подбирает результаты неточно, поэтому в данных есть шум.
  • Pinterest не показывает даты публикации пинов, так что время создания каждого пина определить нельзя; подсказкой остаются только обозначения «2025» или «2026» в заголовках.
  • Заголовок пина — это кэшированный Pinterest текст и он может не совпадать с фактической датой или деталями статьи по ссылке. В этом отчёте проверялись только изображение и заголовок пина.

Рекомендуемые действия

  • Повторить исследование X, используя конкретные названия Midjourney, Sora, Runway, Kling, Flux и ComfyUI, а не трендовые слова.
  • Регулярно отслеживать Elo-разницу Qwen-Image-3.0-Pro и GPT Image 2, чтобы наблюдать разрыв между открытыми и закрытыми решениями.
  • Продолжать следить за Bluesky-аккаунтами, наблюдающими за страницей цен, чтобы проверить гипотезу о замедлении Sora.
  • Расширить запросы для Reddit, чтобы достигать целевых 20 публикаций.
  • Не доверять изолированно рейтинговой инфографике Pinterest и повторяющимся партнёрским публикациям Bluesky, пока они не получат подтверждение на других платформах.

Собранные изображения

🎨 Создание ИИ-изображений и видеоКонтент ИИ и тревоги в социальных сетяхизображениеНовости ИИ: утечка Anthropic показывает будущее ИИ...Google представляет Veo 2: передовая ИИ-генерация видео...Google объявляет о видео сверхвысокого качества...Просто сделай это 🎥🎬 10 БЕСПЛАТНЫХ ИИ-ИНСТРУМЕНТОВ ДЛЯ ВИДЕО В 2026 🤯 Создавайте видео без дорогого ПО!изображениеAdobe разрабатывает ИИ-модель для апскейла видео, превращая размытые записи в HD-качествоИИ «изображение в видео» — анимируйте фотографии с помощью ИИVeo 3 «изображение в видео»: быстрая генерация и нативное аудио через Gemini APIизображениеИИ для генерации изображений и видео🔥 Профессиональное создание ИИ-контента | ИИ Reels, видео и изображенияПочему в тренде «ИИ-видео Трампа и Обамы»?ИИ-генерируемые видео: хорошо или плохо? Вот правда! 🤖🎥Смелая ставка Нью-Йорка: взгляд изнутри на законодательство...Новости ИИ: OpenAI наконец выпустила то, о чём мы просилиизображениеGPT 5.2, редактор видео в реальном времени, стерео ИИ-видео, мобильные ИИ-агенты, полный контроль тела: НОВОСТИ ИИКонцепция создания ИИ-контента с иконками текста, изображений, музыки и генерации видео — 57 стоковых фотографий, векторов и видеоЛучшие ИИ-генераторы видео 2025 года5+ лучших сайтов ИИ-генерации видео 2026 | Runway, Pika, Kling AI, Canva и другиеСекретное оружие создателей контента: ИИ-генерация видеоТоп-10 инструментов синхронизации губ (2026) – лучшее ПО для реалистичной синхронизации губ в ИИ-видеоИИ-анализ изображений и видеоИИ-инструменты для видеомонтажа — что авторы действительно используют для создания контента в 2026 годуShengShu Technology представляет Vidu S1, привнося интерактивную генерацию в реальном времени в ИИ-видеоизображениеизображениеПрофессиональное создание ИИ-видео | Кинематографичные ИИ-видео | Индивидуальный видеомонтажЧто такое Imagvio AI и как он помогает авторам...Узнайте, как Grok меняет видео...Изображения текущих событий с национальными и мировыми картамиКак ИИ преобразует видеомонтаж‎🚨 ИИ становится пугающе хорошим.Секретный инструмент генерации изображений OpenAI скоро дебютируетTotalYmage меняет интерактивные видео...ИИ-видеопроизводство: полное руководство по более быстрому созданию профессиональных видео с ИИБудущее медиапроизводства с ИИ в...Я создам объясняющее ИИ-видео с Synthesia, Sora AI, Kling AI, Runway AI и InVideoПреобразуйте свои идеи в потрясающие визуальные материалы! 🎥Более 20% YouTube теперь генерируется ИИНовости ИИ: теперь все злятся на Anthropic |Microsoft представляет VASA-1, задавая новые стандарты генеративного ИИ в видеогенерации'Amuse 3.0' — инструмент для создания ИИ-арта, включающий...Искусственный интеллект: давайте сохраним наш...История генеративного ИИ"Преобразите своё видение персонализированными ИИ-видео в 4K 🎥✨"

Примечание о качестве данных

Из-за ошибки в выборе поисковых слов для X не было найдено ни одного поста об ИИ для генерации изображений и видео. Reddit собрал лишь 12 публикаций вместо примерно 20. На YouTube из-за JavaScript-рендеринга невозможно было получить просмотры и число подписчиков. На Bluesky сбор пришлось прекратить из-за постоянных 403 по части ключевых слов.

Галерея