KEN’S CAT LOG

Новости ИИ-генерации изображений и видео — 2026-10-02

Китайские модели с открытым исходным кодом (Qwen-Image-2.1, Z-Image Turbo) приближаются к закрытым лидерам, в то время как доверие к закрытым системам падает из-за ограничителей, злоупотреблений и экономики Sora.

Новости ИИ-генерации изображений и видео — 2026-10-02

Сейчас в сфере ИИ-генерации изображений и видео действительно творится нечто серьёзное 😤 У закрытых игроков (GPT Image 2.5 от OpenAI, Veo 3.1/Nano Banana 2.0 от Google, Kling 2.5, Seedance 2.5 и других) не прекращается гонка новых функций, но параллельно растут вопросы, подрывающие доверие: усиление ограничителей, дипфейки и огромные убытки Sora 💸. Тем временем открытое направление, особенно китайские модели Alibaba (Qwen-Image-2.1, Z-Image Turbo), набирает мощный темп, а культура локальной работы через ComfyUI заметна на Reddit, Lemmy и Bluesky 🔥. В этот раз были изучены шесть платформ — Reddit, X, YouTube, Bluesky, Lemmy и Pinterest, — однако X оказался полностью нерелевантным, и об этом ниже сказано прямо 👇.

На всех платформах

  • Китайские открытые модели поднимаются, причём их всё чаще называют «заменой закрытым» 🇨🇳 На YouTube говорят, что Z-Image Turbo (6 млрд параметров, работает на 6 ГБ VRAM) превосходит Flux 2 (https://www.youtube.com/watch?v=JF4Q5hXh-_Q), а Qwen-Image-Edit оценивают как модель уровня Nano Banana или лучше неё (https://www.youtube.com/watch?v=AIgYj5RG-FQ). На Lemmy в течение одной недели появились WebUI и LoRA вокруг Qwen-Image-2.1 (https://github.com/ogoun/fooocus-qwen-image-2.1), а на Bluesky Simon Willison тестирует Qwen-Image на реальном оборудовании (https://bsky.app/profile/simonwillison.net/post/3lvlvsxkzp223). Это одновременно происходит на нескольких платформах, поэтому тренд выглядит настоящим.
  • Усиление ограничителей отталкивает пользователей 🚪 На Reddit пользователи из-за отказов ChatGPT уходят к Midjourney, Grok и Venice AI (https://www.reddit.com/r/AI_Agents/comments/1wt7jqr/), а после ужесточения фильтров DreamFort.ai переходят на Seedream Unfiltered или MiniMax H3 (https://www.reddit.com/r/generativeAI/comments/1wtzefv/). На Bluesky эксперты предупреждают, что у открытых весов вроде GLM-5.3 почти нет ограничителей (https://bsky.app/profile/emollick.bsky.social/post/3mu5xtm24zk2o). Во всех соцсетях заметна поляризация между всё более жёстким регулированием и практически неограниченными инструментами.
  • Доверие к закрытым решениям одновременно расшатывается с нескольких сторон ⚠️ В расследовании TIME, распространённом через Bluesky, Veo 3 смог сгенерировать фальшивое видео поджога индуистского храма (https://bsky.app/profile/amanbatheja.bsky.social/post/3lqpalskjp22h). На Reddit обсуждают, как Photoshop и Apple Photos помечают даже обычную обрезку как «редактирование ИИ» и удаляют сведения об авторских правах (https://www.reddit.com/r/mildlyinfuriating/comments/1wsupkx/). Проблемы разные — злоупотребления и ошибочная маркировка, — но обе ведут к одному выводу: закрытым инструментам трудно доверять.
  • ComfyUI стал стандартной рабочей средой открытого сообщества 🛠️ Он появляется везде: на Reddit — нода для MiniMax-H3 (https://www.reddit.com/r/StableDiffusion/comments/1wtu82e/), на Lemmy — инпейтинг LanPaint (https://github.com/scraed/LanPaint/), на Bluesky — ежедневные иллюстрации с Krea2 (https://bsky.app/profile/ria-tatibana.bsky.social/post/3mwtrqf7glc2t), на YouTube — быстрые туториалы при выходе каждой новой модели.
  • Сравнения «лоб в лоб» стали базовым форматом контента 📊 Видео на YouTube с заголовками вроде «WAN 2.5 is Open Source Veo3», сравнение одной разворотной страницы «Берсерка» в четырёх моделях на Lemmy (https://www.reddit.com/gallery/1wfyqdy), неоновые таблицы «лучшее платное / лучшее бесплатное» на Pinterest. Людей интересует уже не отдельная новость, а то, какая модель сильнее.
  • Тезис о том, что потребительское ИИ-видео не приносит прибыли, подтверждается несколькими источниками 💰 На Bluesky опубликованы оценки: годовая стоимость работы Sora2 — около 5 млрд долларов при выручке примерно 1,4 млн долларов (https://bsky.app/profile/labuzamovies.com/post/3mek2c2xipk2o). На Lemmy анализируют прекращение API Sora 24 сентября и привлечение финансирования корпоративными игроками вроде Kling (https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/).

По платформам

Reddit 🟠 Проанализировано 12 тредов из 9 сабреддитов. Самым популярным закрытым примером стал ролик, где Seedance 2.5 через Higgsfield позволил одному человеку создать десятиминутный короткометражный фильм с устойчивыми персонажами (784 балла, https://www.reddit.com/r/accelerate/comments/1wqqr4p/). В открытом сегменте ноду ComfyUI для MiniMax-H3 назвали «лучшей нодой из всех, которыми доводилось пользоваться» (https://www.reddit.com/r/StableDiffusion/comments/1wtu82e/). Здесь же наиболее конкретно выражено недовольство ограничителями.

X ⚫️ Здесь получился полный промах 😅 Собранные 40 постов от 33 аккаунтов были посвящены футболу, K-pop, британской политике и реалити-шоу — ни одного материала о генерации изображений или видео ИИ. Рабочий процесс использовал трендовые запросы X вроде «Halloween», «Ronaldo» и «#bb28», а не запросы по ИИ. Поэтому этот этап не внёс в отчёт полезных данных.

YouTube 🔴 В закрытом сегменте почти одновременно вышли ролики о функции Sketch в GPT Image 2.5 (https://www.youtube.com/watch?v=LYUr4BY33h4), бесплатном доступе к Veo 3.1 (https://www.youtube.com/watch?v=uj6eD31OxkA) и Nano Banana 2.0 как «убийце Photoshop» (https://www.youtube.com/watch?v=u22-XoQvI4I), что показывает очень быстрый темп функциональной конкуренции. В открытом сегменте массово выходят туториалы по запуску FLUX.2, Z-Image и Qwen-Image-Edit в ComfyUI. Однако просмотры, число подписчиков и комментарии получить не удалось из-за JavaScript-рендеринга: анализ основан только на заголовках и oEmbed-данных.

Bluesky 🔵 Через API AT Protocol были отобраны релевантные посты из более чем 100 реальных записей. В закрытом сегменте больше всего откликов получили сообщения о расистском контенте, который способен создать Veo 3 (❤️842, https://bsky.app/profile/eliothiggins.bsky.social/post/3ls6ridsm4s2y), и об экономической несостоятельности Sora2 (❤️1,375). В открытом сегменте исследователи вроде Simon Willison и Ethan Mollick тестируют Qwen-Image и GLM-5.3 на практике. Также зафиксировано множество ежедневных публикаций, созданных через ComfyUI + Krea2.

Lemmy 🟢 Основной центр — !«メールアドレス», однако это небольшое сообщество с оценками обычно от 1 до 10. Тем не менее в одну и ту же неделю появлялись инструменты для Qwen-Image-2.1 — WebUI, LoRA и ControlNet, что указывает на заметную динамику. Новости о закрытых продуктах — остановке API Sora и отзыве функции Google Earth в Nano Banana 2 за злоупотребления https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature/ — в основном поступают через зеркальный бот Reddit !ai_reddit; собственных обсуждений Lemmy почти нет.

Pinterest 🟣 Из 50 пинов были вручную открыты и проверены 18. Подавляющее большинство — новостные изображения о закрытых игроках: OpenAI, Google, Meta и Grok, обычно с логотипами и удивлёнными лицами на миниатюрах. Среди открытых и локальных решений конкретно выделяется только AMD Amuse 3.0. Фотореалистичные портреты с тщательно проработанными морщинами и текстурами используются компаниями как общий визуальный бенчмарк. При этом показатели вовлечённости — сохранения и лайки — недоступны, а пины ограничены заранее собранным набором.

На что обратить внимание

  • Скорость расширения набора инструментов вокруг Qwen-Image-2.1 — на Lemmy в течение одной недели появились WebUI, LoRA и ControlNet (https://github.com/ogoun/fooocus-qwen-image-2.1). Стоит следить, что появится дальше.
  • Как экономические проблемы Sora2 повлияют на курс OpenAI — тема активно обсуждается и на Bluesky (https://bsky.app/profile/labuzamovies.com/post/3mek2c2xipk2o), и на Lemmy (остановка API Sora, https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/).
  • Поляризация между регулированием и отсутствием правил из-за ограничителей — одна и та же структурная проблема проявляется с разных сторон на Reddit (https://www.reddit.com/r/generativeAI/comments/1wtzefv/) и Bluesky (https://bsky.app/profile/emollick.bsky.social/post/3mu5xtm24zk2o).
  • FLUX 3 от Black Forest Labs — ограниченно доступная закрытая модель для изображений и 20-секундных видео со звуком, при том что открытые веса FLUX.2 выходят параллельно (https://bfl.ai/blog/flux-3). Это интересный пример размывания границы между открытым и закрытым.
  • Линия Z-Image / Qwen-Image для низкого VRAM — на YouTube Z-Image называют лучше Flux2 (https://www.youtube.com/watch?v=JF4Q5hXh-_Q), что может расширить аудиторию локальной генерации.
  • Необходимость повторного исследования X — этот запуск промахнулся из-за трендовой вкладки; повторный сбор по прямым ключевым словам вроде "Midjourney", "Sora" и "Nano Banana" может дать интересные результаты.

Рекомендации

  1. В следующий раз X (Twitter) следует собирать по прямым ИИ-ключевым словам: "Midjourney", "Sora", "Nano Banana", "ComfyUI", "Flux" и другим.
  2. Быстрорастущую экосистему Qwen-Image-2.1 следует продолжать наблюдать как индикатор развития открытого направления.
  3. Соотношение операционных затрат и выручки Sora2 стоит отслеживать как показатель рентабельности закрытых моделей генерации видео в целом.
  4. Следует постоянно составлять карту переходов пользователей из-за ограничителей: от каких инструментов к каким они уходят.
  5. Pinterest стоит либо расширить с выборки в 18 до всех 50 изображений, либо найти способ получать показатели вовлечённости.
  6. С учётом зависимости Lemmy от !ai_reddit, фактически являющегося репостами Reddit, собственный голос Lemmy лучше искать в сообществах типа !stable_diffusion.

Качество данных

X собрал данные, полностью не относящиеся к теме исследования, из-за ошибочного попадания в трендовую вкладку и не внёс вклад в этот отчёт. YouTube из-за JavaScript-рендеринга не позволил проверить просмотры, даты публикации, число подписчиков и комментарии, поэтому анализировались только заголовки и oEmbed-данные. На Pinterest вручную проверены лишь 18 из 50 пинов, а данные о сохранениях и лайках недоступны. На Lemmy сами публикации были подтверждены, но их оценки в целом низкие — от 0 до 10, поэтому уровень интереса ниже, чем на других платформах. Анализ Reddit и Bluesky основан на реальных собранных/API-данных и относительно более надёжен.

Сводка по платформам

Reddit

Reddit — Новости ИИ-генерации изображений и видео

Где

В собранном наборе тема присутствовала в 9 сабреддитах (всего 12 тредов, все найдены по единственному запросу "Image and Video Generation AI News"):

  • r/generativeAI — 159 938 участников — 3 треда (#1, #2, #7)
  • r/TopologyAI — 24 052 участника — 1 тред (#3)
  • r/StableDiffusion — 1 027 672 участника — 1 тред (#4)
  • r/LocalLLaMA — 838 632 участника — 1 тред (#5)
  • r/AI_Agents — 452 911 участников — 1 тред (#6)
  • r/accelerate — 93 680 участников — 2 треда (#8, #12)
  • r/aifails — 39 194 участника — 1 тред (#9)
  • r/VideoEditors — 81 700 участников — 1 тред (#10)
  • r/mildlyinfuriating — 12 610 232 участника — 1 тред (#11)
Что говорят люди
  • Бесплатная генерация видео закрытыми моделями — миф, по мнению сообщества — Тред #1, r/generativeAI, 71 балл, 46 комментариев, 2026-09-30 (https://www.reddit.com/r/generativeAI/comments/1wty6zj/). Автор утверждает, что облачные GPU не позволяют создать по-настоящему бесплатную безлимитную генерацию видео; u/opengradient подтверждает: «видео — не дешёвые LLM, никто не сможет раздавать это бесплатно» (5 баллов).
  • Фильтрация NSFW в закрытых моделях ужесточается, подталкивая пользователей к открытым или неотфильтрованным альтернативам — Тред #2, r/generativeAI, 7 баллов, 14 комментариев, 2026-09-30 (https://www.reddit.com/r/generativeAI/comments/1wtzefv/). DreamFort.ai ужесточил фильтры на базе WAN 3.0; u/opengradient отмечает, что «многие поставщики закрытых моделей недавно ввели более строгие ограничения, включая Alibaba, владеющую Wan 3.0», и указывает на Seedream 2.0 Unfiltered и MiniMax H3 как альтернативы.
  • Открытый процесс с Blender 3D подаётся как решение проблемы управляемости видеогенерации, но сообщество не уверено, что это реально — Тред #3, r/TopologyAI, 437 баллов, 19 комментариев, 2026-09-28 (https://www.reddit.com/r/TopologyAI/comments/1wsmvvm/). Несмотря на высокую оценку, верхние комментарии преимущественно выражают недоумение («Что это за “3d AI”?» — u/stevester911, 5 баллов) либо прямо отвергают показанное: «Это фейковый настоящий ИИ» — u/amon_de_no (5 баллов).
  • Открытый инструментарий устойчивости референсов для MiniMax-H3 получает исключительно хороший приём — Тред #4, r/StableDiffusion, 690 баллов, 51 комментарий, 2026-09-30 (https://www.reddit.com/r/StableDiffusion/comments/1wtu82e/). Бесплатная нода ComfyUI (Fantastic-MiniMaxH3-PromptBuilder) исправила смешение идентичностей при редактировании видео с референсными изображениями; u/ClassicUse2579: «Штука H3 media loader — одна из лучших нод Comfy, которыми я когда-либо пользовался. Она чертовски хороша!» (3 балла).
  • Открытые локальные стеки для изображений и чата уже достаточно зрелы, чтобы работать как технический аттракцион — Тред #5, r/LocalLLaMA, 194 балла, 96 комментариев, 2026-10-01 (https://www.reddit.com/r/LocalLLaMA/comments/1wuxzdg/). Компьютер Tandy 1000 из 1990-х по WiFi использует локально запущенные Qwen3.8-27B + Krea 2 (ComfyUI) для чата и генерации изображений. Однако верхний комментарий возражает против такой подачи: u/Aggravating-Push-207 (113 баллов): «На самом Tandy это не работает, он просто делает запросы внутри домашней сети».
  • Ограничители закрытых систем настолько раздражают обычных пользователей, что те уходят к альтернативам — Тред #6, r/AI_Agents, 0 баллов, 22 комментария, 2026-09-29 (https://www.reddit.com/r/AI_Agents/comments/1wt7jqr/). Пользователь не может заставить ChatGPT нарисовать супергероя из-за отказов ограничителей; комментаторы направляют его к Midjourney, Grok, VeniceAI и открытым «нецензурируемым SDXL» моделям.
  • В бесплатном и дешёвом сегменте закрытые сервисы с ежедневными кредитами всё ещё доминируют в рекомендациях для обычных пользователей — Тред #7, r/generativeAI, 4 балла, 59 комментариев, 2026-09-26 (https://www.reddit.com/r/generativeAI/comments/1wqfleb/). Рекомендации разделились: u/Scuzzy_Womack предлагает офлайн-ComfyUI (3 балла, открытый вариант), другие советуют Yodayo/MoescapeAI и Leonardo из-за ежедневных бесплатных кредитов (закрытые варианты).
  • Закрытое видео (Seedance 2.5 через Higgsfield) уже достаточно хорошо для десятиминутного сюжетного фильма, созданного одним человеком — Тред #8, r/accelerate, 784 балла, 196 комментариев, 2026-09-26 (https://www.reddit.com/r/accelerate/comments/1wqqr4p/). Референсы листов персонажей подаются в каждый кадр, чтобы сохранять Капитана Уокера одинаковым между сценами; u/JoseLunaArts (95 баллов) говорит, что формулировка «без бюджета» преуменьшает стоимость токенов, а u/Nabugu (7 баллов) отмечает повторяющуюся однообразную «красивую ИИ-лицевую» эстетику.
  • Генерация изображений всё ещё проваливается в глупых, мемных случаях — это воспринимается как развлечение, а не тренд — Тред #9, r/aifails, 526 баллов, 76 комментариев, 2026-09-28 (https://www.reddit.com/r/aifails/comments/1ws6jzs/). Запрос об анатомии курицы выдал анатомический абсурд; верхний комментарий u/kasimirvendom: «У всего есть конец, только у курицы их два» (52 балла).
  • Видеомонтажёрам прямо советуют пока не полагаться на ИИ-инструменты — Тред #10, r/VideoEditors, 4 балла, 39 комментариев, 2026-09-26 (https://www.reddit.com/r/VideoEditors/comments/1wqkx27/). Верхний комментарий (u/VisibleExplanation, 33 балла): «Забудьте про любые ИИ-инструменты. Скачайте Davinci Resolve и научитесь им пользоваться... Ни один ИИ-инструмент не даст хороших результатов без фундаментального знания основ».
  • Закрытые редакторы, незаметно переименовывающие небольшие правки в «Генеративный ИИ», вызывают кризис доверия — Тред #11, r/mildlyinfuriating, 1 268 баллов, 136 комментариев, 2026-09-28 (https://www.reddit.com/r/mildlyinfuriating/comments/1wsupkx/). Photoshop/Apple Photos, как сообщается, помечают простую обрезку как ИИ-редактирование и удаляют сведения об авторском праве; u/Kagevjijon (41 балл): «Нет никаких шансов, что это останется как есть. Это настоящее воровство». Возражение u/teh_maxh (135 баллов): «Я только что попробовал обрезать фото в Photoshop, и он не добавил метаданные, утверждающие, что я использовал GAI».
  • ИИ-моды для игр, создаваемые открытым сообществом, переживают подъём — Тред #12, r/accelerate, 193 балла, 35 комментариев, 2026-09-30 (https://www.reddit.com/r/accelerate/comments/1wuhyiw/). u/Chopstik0-0 (38 баллов) описывает, как VR-сабреддит перешёл от сопротивления к энтузиазму, когда стало ясно, что «никто другой по-настоящему не делает новые VR-игры».
Сигналы
  • Рост: Открытые инструменты для устойчивости референсов (нода ComfyUI из треда #4, локальный стек Qwen+Krea2 из треда #5) получают наиболее однозначную похвалу в выборке: высокие оценки сочетаются с искренне положительными техническими комментариями, а не только с хайпом.
  • Рост: Закрытая генерация видео перешла в область длинных сюжетных форм — десятиминутный фильм из треда #8 с повторяющимися согласованными персонажами стал тредом с наибольшей вовлечённостью (784 балла, 196 комментариев), а критика сообщества направлена на сценарий и озвучку, а не на визуал.
  • Отвергнуто: Идея «по-настоящему бесплатного» закрытого видеогенератора воспринимается как решённый и уже утомительный вопрос (тред #1): спор сместился от «какой бесплатный сайт» к «какую локальную открытую конфигурацию использовать».
  • Разногласие: Тред #3 показывает разрыв между поверхностным восторгом (437 баллов) и скепсисом/непониманием в комментариях по поводу того, что именно демонстрируется. Это напоминает, что расплывчатые посты о процессах «3D AI» способны набирать баллы, даже если никто не согласен, что это за инструмент.
  • Неожиданность — ограничители теперь регулярно заставляют менять платформу, а не просто раздражают: и тред #2 об ужесточении NSFW-фильтрации, и тред #6 об ограничителях ChatGPT, блокирующих неявное изображение супергероя, показывают уход пользователей из конкретного закрытого инструмента к другому закрытому решению (Grok, VeniceAI) или открытому (Seedream Unfiltered, нецензурируемый SDXL).
  • Неожиданность — в треде #11 кризис доверия к закрытым инструментам совсем не связан с фильтрами контента: речь идёт об атрибуции и метаданных — автоматической маркировке обычных правок как «Генеративный ИИ» и удалении авторской информации, что является отдельной проблемой от недовольства ограничителями в других тредах.
Ограничения
  • Сборщик использовал только один поисковый запрос — "Image and Video Generation AI News" — и нашёл 12 тредов в 9 сабреддитах, что меньше целевого порога около 20 постов на сеть. Согласно методике, использовался только уже собранный материал (output/reddit.threads.md), без дополнительного поиска Reddit, поскольку Reddit блокирует WebFetch и страницы, на которые ведёт веб-поиск.
  • У тредов #9, #11 и #12 не был захвачен начальный текст, только заголовки, поэтому выводы основаны исключительно на комментариях и оценках.
  • В выборке не появились крупные анонсы закрытых лабораторий — например, запуски именованных моделей OpenAI, Google или Midjourney; собранные материалы смещены в сторону пользовательского опыта, инструментария и трений вокруг ограничителей, а не продуктовых анонсов.

X

X — Новости ИИ-генерации изображений и видео

Аккаунты

Ни один аккаунт в собранных данных не обсуждает генерацию изображений или видео ИИ — ни закрытую, ни открытую. 33 собранных аккаунта (@Davesonude, @rcostadoazeite, @ChrisExcel102, @Louissaikyoo, @DlugoszMarcin, @khtaeverse и ещё 27) — это аккаунты футбольных мемов, K-pop-фандомов, фанатов Big Brother (#BB28), британской политики (Restore Britain), а также обычные мемные/щитпост-аккаунты. Никто из них не публикует материалы об ИИ-инструментах для изображений или видео, поэтому ответить, «кто двигает эту тему в X», по фактической теме исследования невозможно — см. ## Ограничения.

Посты

Ни один пост в output/x.posts.md (40 постов, 33 аккаунта) не упоминает ИИ-генерацию изображений, ИИ-генерацию видео, связанные продукты, компании или открытые проекты: нет упоминаний Midjourney, Sora, Stable Diffusion, Flux, Runway, Veo, Nano Banana, ComfyUI или аналогичных названий. Проверка наиболее вовлечённых постов это подтверждает:

Ни эти, ни остальные 36 постов не затрагивают тему исследования. Здесь не приводятся 5–12 «выводов» об ИИ-генерации изображений и видео, поскольку в собранном материале их нет: это означало бы их выдумывать, что прямо запрещено методикой этого запуска.

Сигналы

Из этого набора данных нельзя извлечь никаких сигналов об открытой или закрытой ИИ-генерации изображений/видео. Он показывает следующее: десять поисковых терминов, использованных для сбора — "Halloween", "Ronaldo", "Britain", "Yess", "JubJub", "Gold", "China", "#bb28", "Messi", "Balkans" — были трендовыми темами вкладки Explore в X для текущей сессии, а не темами генерации медиа ИИ. Таблица Explore в output/x.posts.md это подтверждает: 6 из 10 трендов явно помечены как "Trending in Croatia", а остальные — "Ronaldo", "Britain", "China", "Messi" — являются глобальными темами спорта и политики; ни одна не связана с ИИ или технологиями. Похоже на ошибку на этапе сбора: исполнитель взял тренды X вместо поиска терминов по ИИ-генерации, поэтому 40 постов оказались про футбол, британскую партию Restore Britain, спор в K-pop-фандоме, сезон реалити-шоу (#BB28) и несвязанные мемы.

Ограничения
  • Собранные данные не соответствуют исследовательскому заданию. Задание требует новости о закрытой и открытой ИИ-генерации изображений/видео; вместо этого десять запросов исполнителя были общими трендами X для этой сессии — преимущественно с геолокацией в Хорватии по таблице Explore, — а не ИИ-запросами. Все 40 постов были вручную проверены на соответствие теме, и ни один не подходит.
  • Согласно методике этого этапа, дополнительный просмотр X не проводился: анонимный просмотрщик ничего не видит в X, а использовались только уже собранные output/x.posts.md / output/x.posts.json.
  • Хотя критерий объёма («анализировать около 20 постов на соцсеть») формально выполнен — рассмотрено 40 постов, — он не выполнен по релевантности, поэтому этап X не может дать выводов о закрытой или открытой генерации изображений/видео. Этап стоит повторить с запросами вроде "Midjourney", "Sora", "Stable Diffusion", "Flux", "Runway", "Veo", "Nano Banana", "ComfyUI" и подобными вместо общих трендовых тем.

YouTube

YouTube — Новости ИИ-генерации изображений и видео (закрытые/открытые решения)

Каналы
  • AI WITH Rithesh (Rithesh Sreenivasan) — личный канал, в день выхода проверяющий релизы ChatGPT/OpenAI.
  • Bart Slodyczka — канал с обзорами того, что изменилось сразу после релиза новых моделей.
  • Learn with LEESI — канал, специализирующийся на туториалах Google Gemini/Veo/Flow.
  • WorldofAI(@intheworldofai) — еженедельные обзоры новостей о закрытом ИИ.
  • MattVidPro — крупный ИИ-канал, известный сравнениями и срочными новостями о моделях генерации видео.
  • There's An AI For That(@theresanaiforit) — новости и сравнения новых моделей.
  • Promptus AI(@promptusai) — специализируется на локальных туториалах по открытым моделям изображений/видео.
  • AI Late to Class(@ailatetoclass) — обзоры открытых моделей для редактирования изображений.
  • MaxonShire — специализируется на сравнении локальных моделей генерации видео (HunyuanVideo, Wan, LTX и др.).
  • smallzero(@webdot3) — использование открытых моделей в ComfyUI, включая Z-Image.
  • FlyMyAI — ежедневные и еженедельные новостные брифинги об ИИ.
  • Lev Selector(@lev-selector) — канал еженедельных сводок обновлений ИИ.

Число подписчиков не удалось проверить напрямую, поскольку HTML поисковой выдачи YouTube рендерится JavaScript (см. Ограничения).

Видео
Закрытые решения
  1. «ChatGPT Images 2.5 Is INSANE… 48 Hours Later, I'm Still Shocked!» — AI WITH Rithesh / начало сентября 2026 — проверка GPT Image 2.5, выпущенного OpenAI 8 сентября 2026 года: новая функция создания изображений из эскиза «Sketch» и ускорение генерации до 50%. https://www.youtube.com/watch?v=LYUr4BY33h4
  2. «ChatGPT Image 2.5 Just Dropped — Here's Everything That's New» — Bart Slodyczka / сентябрь 2026 — полный обзор новых функций GPT Image 2.5. https://www.youtube.com/watch?v=dvpQHWwuaIo
  3. «Google Just Made VEO 3.1 FREE for Everyone with Unlimited AI Video Generation» — Learn with LEESI — рассказ о бесплатном доступе к Veo 3.1 через Google Flow/Vids, включая преобразование изображения в видео и поддержку трёх референсных изображений. https://www.youtube.com/watch?v=uj6eD31OxkA
  4. «Google's Nano Banana 2.0: Best Text-To-Image Generation Model EVER! The Photoshop killer!» — WorldofAI — тест Nano Banana 2.0 от Google DeepMind, модели генерации изображений семейства Gemini, названной «лучше Photoshop». https://www.youtube.com/watch?v=u22-XoQvI4I
  5. «Kling 2.5 goes BEAST MODE for AI Video!» — MattVidPro — сообщение о значительном прогрессе Kling 2.5 в динамике движения. https://www.youtube.com/watch?v=SGUxHC1cI1c
  6. «AI Video Models Are Getting Out of Control! (WAN 2.5, Kling 2.5, Wanimate)» — MattVidPro — сопоставляет закрытый Kling и открытый Wan, отмечая обострение конкуренции. https://www.youtube.com/watch?v=vFXe3uXb75k
  7. «Your AI news brief for September 3, 2026.» — FlyMyAI — общий ИИ-новостной брифинг по состоянию на 3 сентября 2026 года, включая темы генерации изображений и видео. https://www.youtube.com/watch?v=JK6w9tA2jH8
  8. «Exciting AI Updates Weekly - September 25, 2026» — Lev Selector — еженедельная подборка ИИ-обновлений, включающая модели генерации изображений и видео. https://www.youtube.com/watch?v=iyZHPCNd8jI
Открытые решения
  1. «Is FLUX 2.0 The New Open Source King?» — There's An AI For That — FLUX.2 от Black Forest Labs оценивается как кандидат на звание лучшей модели с открытыми весами для изображений и редактирования. https://www.youtube.com/watch?v=YQuTkPVkCS8
  2. «New Open-Source Model DESTROYS Flux 2 — Z-Image + Promptus Tutorial»(в oEmbed заголовок: «Z-Image Open-Source Image Generator: Free Online and Local Setup») — Promptus AI — Z-Image Turbo от Tongyi-MAI компании Alibaba: 6 млрд параметров, работа на 6 ГБ VRAM и заявленное превосходство над Flux 2. https://www.youtube.com/watch?v=JF4Q5hXh-_Q
  3. «Z-Image Full Release: The New King of AI Influencers in ComfyUI?» — smallzero — тест полноценного недистиллированного релиза Z-Image (Base) в ComfyUI. https://www.youtube.com/watch?v=ClVY5ll1sDU
  4. «Qwen Image 2.1 best open source Image Editor. Better than Nano Banana» — AI Late to Class — новая версия Alibaba Qwen-Image-Edit с десятью референсными изображениями, прозрачным фоном и ускорением оценивается как сопоставимая с Nano Banana или превосходящая её. https://www.youtube.com/watch?v=AIgYj5RG-FQ
  5. «HunyuanVideo 1.5 vs Wan 2.7 Comparison: Which is The Best Free Local Video AI Generation Model?» — MaxonShire — сравнение HunyuanVideo 1.5 от Tencent и Wan 2.7 от Alibaba как локальных моделей генерации видео. https://www.youtube.com/watch?v=4GNT4-QYekg
Сигналы
  • Закрытые решения конкурируют скоростью появления функций: OpenAI (GPT Image 2.5 «Sketch», 2026-09-08), Google (бесплатный Veo 3.1 и интеграция с Google Vids/Flow) и обновление Kling 2.5 появились почти одновременно, поддерживая ежемесячную функциональную гонку.
  • Китайский открытый лагерь, особенно Alibaba Tongyi-MAI и Qwen, набирает силу: Z-Image Turbo и Qwen-Image-Edit постоянно рассматриваются через призму «работает на 6 ГБ/малой VRAM» и «качество уровня Nano Banana» и напрямую сравниваются с FLUX.2 от Black Forest Labs.
  • Видео «открытые против закрытых» сформировали отдельный жанр: очень много заголовков вроде «WAN 2.5 is Open Source Veo3» и «Z-Image vs Flux 2», где открытые модели обсуждаются как замена закрытым.
  • Локальные туториалы по ComfyUI от Promptus AI, MaxonShire и smallzero стали ключевым форматом контента для открытого сегмента: при выходе каждой новой модели почти сразу появляется ролик о том, как её установить в ComfyUI.
  • Каналы регулярных новостных брифингов вроде FlyMyAI и Lev Selector постоянно включают генерацию изображений и видео в обзоры, поэтому новости об отдельных моделях распространяются и через регулярные сводки.
Ограничения
  • Страница поисковой выдачи YouTube (youtube.com/results?search_query=...) и страницы видео (youtube.com/watch?v=...) рендерятся JavaScript, поэтому WebFetch не смог напрямую получить список видео или содержимое страниц — просмотры, даты публикации, число подписчиков и комментарии. Заголовки и названия каналов проверялись для отдельных роликов через JSON-эндпоинт youtube.com/oembed, а период публикации и контекст дополнялись сниппетами веб-поиска и связанными статьями.
  • Поэтому точные просмотры, даты публикации и число подписчиков каналов не подтверждены. Некоторые результаты веб-поиска показывали относительные даты вроде «N дней назад», но многие ролики были старше 60 дней — иногда более 300 дней. В отчёте приоритет получили темы, которые с достаточной уверенностью можно отнести к последним 60 дням: GPT Image 2.5 от 2026-09-08 и явно датированные еженедельные новостные ролики.
  • Были подтверждены связанные ролики о Runway Gen-4.5, Grok Imagine, Seedream 4.0 и Midjourney V8, но для них не удалось получить достаточно данных о периоде публикации или каналах, поэтому они не включены в раздел Видео.
  • Комментарии к видео проанализировать не удалось, поскольку содержимое страниц видео недоступно.

Bluesky

Bluesky — Новости ИИ-генерации изображений и видео (закрытые/открытые решения)

О методике: официальный сайт Bluesky (bsky.app) — это JavaScript SPA, в котором нельзя получить результаты поиска обычным способом, поэтому напрямую использовался открытый API AT Protocol (https://api.bsky.app/xrpc/app.bsky.feed.searchPosts), не требующий аутентификации. По ключевым словам «Nano Banana», «Sora 2», «Flux», «ComfyUI», «Z-Image», «Qwen Image», «open weights», «Veo 3» были собраны реальные данные постов — текст, автор, число лайков и время публикации. Проверено более 100 записей, из которых отобраны релевантные теме.

Аккаунты
  • Eliot Higgins(eliothiggins.bsky.social, основатель Bellingcat, подтверждённый Bluesky) — регулярно пишет о рисках дезинформации и дипфейков, создаваемых Veo 3.
  • Simon Willison(simonwillison.net, независимый исследователь ИИ, подтверждённый Bluesky) — запускает открытые модели Qwen-Image / Qwen-Image-Edit локально и публикует технические заметки.
  • Ethan Mollick(emollick.bsky.social, профессор Wharton, подтверждённый Bluesky) — регулярно комментирует риски и возможности моделей с открытыми весами.
  • Журналисты 404 Media (Jason Koebler jasonkoebler.bsky.social, Sam Cole samleecole.bsky.social) — проводят расследования о проблемах авторского права и модерации контента в Sora 2.
  • obeca(obeca.bsky.social, турецкоязычная аудитория) — личный аккаунт, почти ежедневно публикующий изображения, сгенерированные Nano Banana 2.
  • Ria_Tatibana(ria-tatibana.bsky.social, японский сегмент) — ежедневно публикует иллюстрации через ComfyUI + Krea2, открытую модель.
  • cubby.jpg(cubby-ai.bsky.social) — выпускает много ИИ-арта с открытыми моделями изображений Z-Image / Qwen-Image.
  • AlternativeTo(alternativeto.net) — автоматизированный аккаунт новостей ПО, публикующий срочные новости о релизах моделей вроде Qwen-Image-2.1.
Посты
Закрытые решения
  1. Проблема: Google Veo 3 способен создавать расистский контент — Eliot Higgins, 2025-06-22, ❤️842. «Google Veo 3 предоставляет новые и захватывающие способы заниматься расизмом». https://bsky.app/profile/eliothiggins.bsky.social/post/3ls6ridsm4s2y
  2. TIME смог создать в Veo 3 убедительные фальшивые ролики о мусульманах, поджигающих индуистский храм; Google добавил видимые водяные знаки после обращения журналистов — Aman Batheja, журналист TIME, 2025-06-03, ❤️431 · 🔁192 · цитат 107. https://bsky.app/profile/amanbatheja.bsky.social/post/3lqpalskjp22h
  3. Утверждение, что ежегодная стоимость работы Sora 2 составляет примерно 5 млрд долларов, а доход OpenAI пока около 1,4 млн долларов — Peter Labuza, 2026-02-10, ❤️1 375 · 🔁368 · цитат 192. https://bsky.app/profile/labuzamovies.com/post/3mek2c2xipk2o
  4. Критическая статья: Sora символизирует крах притворства ИИ-компаний, будто они не обучались на защищённых авторским правом материалах — Jason Koebler, 404 Media, 2025-10-01, ❤️1 508 · цитат 44. https://bsky.app/profile/jasonkoebler.bsky.social/post/3m25uzxbcak23
  5. Сообщение о том, что пользователи Sora 2 резко возмутились после запрета генерации персонажей, защищённых авторским правом — Sam Cole, 404 Media, 2025-10-08, ❤️435 · цитат 37. https://bsky.app/profile/samleecole.bsky.social/post/3m2ovizmqks2t
  6. Личный опыт: изображение Nano Banana (2) оказалось настолько убедительным, что автора удалось обмануть — furuakasaber.bsky.social, 2026-07-03, ❤️333. https://bsky.app/profile/furuakasaber.bsky.social/post/3mpr6djkzsk2e
  7. Усталость от инфографики Nano Banana — «каких-то ИИ-шных схем» — garrison.corporate.fm, 2026-03-15, ❤️73 · 🔁9. https://bsky.app/profile/garrison.corporate.fm/post/3mh4g5avqp22p
Открытые решения
  1. Alibaba Qwen выпустила первую модель генерации изображений Qwen-Image под лицензией Apache 2.0 — Simon Willison, 2025-08-04, ❤️46. https://bsky.app/profile/simonwillison.net/post/3lvlvsxkzp223
  2. Практический тест Qwen-Image-Edit: на Mac модель почти полностью потребляет 64 ГБ RAM и требует 54 ГБ дискового пространства — Simon Willison, 2025-08-19, ❤️77. https://bsky.app/profile/simonwillison.net/post/3lws3xfzhv22u
  3. Alibaba выпустила Qwen-Image-2.1, модель на 7 млрд параметров с открытыми весами, и изменила лицензию — AlternativeTo, 2026-09-24, ❤️6. https://bsky.app/profile/alternativeto.net/post/3mwaq75byhn2a
  4. Apple выпустила открытые веса Transformer-авторегрессионных flow-моделей STARFlow и STARFlow-V для генерации изображений и видео — Sung Kim, 2025-12-02, ❤️13. https://bsky.app/profile/sungkim.bsky.social/post/3m6xsab2zj22w
  5. Предупреждение: модель с открытыми весами GLM-5.3 мощная, но почти лишена ограничителей и имеет даже наступательные кибервозможности — Ethan Mollick, 2026-08-28, ❤️88. https://bsky.app/profile/emollick.bsky.social/post/3mu5xtm24zk2o
  6. Ежедневные иллюстрации, созданные ComfyUI + Krea2, с 50–80 ❤️ на пост — Ria_Tatibana, несколько публикаций 2026-09-28 — 10-01 (например, https://bsky.app/profile/ria-tatibana.bsky.social/post/3mwtrqf7glc2t, ❤️53). Большинство верхних результатов по тегу ComfyUI — это ежедневные работы авторов ИИ-иллюстраций.
  7. Ожидание и ирония вокруг релиза Z-Image, лёгкой открытой модели изображений Alibaba Tongyi — theophite.bsky.social, 2025-11-27, ❤️30. https://bsky.app/profile/theophite.bsky.social/post/3m6ldsilaz22f
Сигналы
  • Veo 3 закрепляется как «инструмент дезинформации»: Eliot Higgins, основатель Bellingcat, регулярно поднимает эту тему, а расследование TIME широко разошлось (❤️431, 107 цитат). Для закрытой генерации видео главным вопросом становится уже не качество, а злоупотребления.
  • Sora 2 испытывает трудности и экономически, и репутационно: оценка ежегодных расходов в 5 млрд долларов против выручки в 1,4 млн долларов получила большой охват (❤️1 375). Ужесточение ограничений на генерацию защищённых персонажей вызвало всплеск недовольства (❤️435): снова проявляется схема «изменение правил закрытого сервиса → возмущение пользователей».
  • Nano Banana от Google стала стандартным инструментом генерации изображений для обычных пользователей: пользователи вроде obeca.bsky.social публикуют изображения практически ежедневно, и инструмент закрепился не только в англоязычной, но и в турецкой и японской среде. В то же время сохраняются опасения, что изображения слишком сложно распознать как искусственные (❤️333).
  • В открытой генерации изображений Qwen-Image — центральная техническая тема: исследователи вроде Simon Willison проводят практические тесты вплоть до замеров VRAM и диска, а лицензия Apache 2.0 воспринимается положительно. Однако смена лицензии Qwen-Image-2.1 (упомянута в посте с ❤️6) создаёт напряжение и в открытом лагере: насколько модель действительно открыта?
  • ComfyUI остаётся де-факто стандартом открытого процесса генерации изображений: большая часть результатов поиска — ежедневные публикации ИИ-иллюстраций, сделанных в ComfyUI с конкретными моделями, Krea2, SDXL и т. д. Это показывает не только технологическую новость, а укоренение инструмента в повседневной практике.
  • Открытые веса означают высокую мощность, но отсутствие ограничителей — это всё чаще отмечают эксперты: заметные исследователи вроде Ethan Mollick начали говорить о наступательных возможностях и минимальном тестировании рисков у GLM-5.3. Крупные компании, такие как Apple со STARFlow, также входят в сферу открытых весов, расширяя её охват.
Ограничения
  • Официальный сайт Bluesky — SPA, и WebFetch не смог получить текст постов; поисковый эндпоинт public.api.bsky.app также возвращал 403. В итоге использовался идентичный API без public. — api.bsky.app, который отвечал без аутентификации и предоставил реальные данные.
  • Ключевые слова вроде «Flux», «Kling» и «Wan» пересекаются с общеупотребительными словами и другими темами — играми, погодой, именами, — поэтому содержат много шума и дали недостаточно релевантных записей. Поиск Flux дал 15 результатов, но фактически ни одного о генерации изображений ИИ. Обсуждений именно FLUX.2 от Black Forest Labs было недостаточно.
  • Для отдельных видеомоделей Kling 2.5, Wan 2.5, HunyuanVideo и Seedance по использованным запросам не нашлось достаточно публикаций, поэтому их обсуждаемость на Bluesky не подтверждена; на YouTube она может быть выше.
  • Даже с sort=top поисковый API не обязательно выдаёт настоящую сортировку по популярности, а при постраничной загрузке встречалось смешение дат. Поэтому приведённые «репрезентативные посты» — не строгий рейтинг популярности, а отрывок из реально существующих и релевантных публикаций.

Lemmy

Lemmy — Движение в ИИ-генерации изображений и видео (закрытые/открытые решения)

Сообщества
  • !«メールアドレス» — основной центр релизов новых открытых моделей и инструментов. Публикаций много, но оценки невелики — обычно от 1 до 10.
  • !«メールアドレス» / !«メールアドレス» — автоматические публикации, связанные с Civitai, ежедневно показывающие сгенерированные изображения Krea, SDXL и других моделей. Новостная ценность низкая, но это свидетельство повседневного использования открытых моделей.
  • !«メールアドレス» / !«メールアドレス» — сообщества с примерами абстрактного ИИ-арта, часто кросспостящими одни и те же изображения.
  • !«メールアドレス» — бот-сообщество, зеркалирующее ИИ-сабреддиты Reddit. Это главный канал появления новостей о закрытых решениях — Sora, Nano Banana, Seedream и др., — но оценки обычно 0–1, а обсуждения почти отсутствуют.
  • !«メールアドレス» / !«メールアドレス» / !tech — места единичных публикаций, например новостей FLUX от Black Forest Labs.
  • !«メールアドレス» / !casual_perchance — сообщества пользователей бесплатного браузерного сервиса генерации изображений Perchance.org.
  • Число подписчиков не удалось получить: страницы сообществ Lemmy.world (/c/<name>) постоянно возвращали ошибки 500/400, а API (/api/v3/community) не дал результата из-за неизвестных параметров (см. Ограничения).
Посты
Ближе к открытому сегменту
  1. scraed/LanPaint — высококачественный инпейтинг без обучения для любых моделей Stable Diffusion, с поддержкой ComfyUI / !«メールアドレス» / score 8 / 2026-09-29 / https://github.com/scraed/LanPaint/
  2. DenRakEiw/scumble — десктопный редактор ИИ-инпейтинга со слоями, текстовым выделением и пользовательскими кистями. Генерирует через собственный ComfyUI или API-провайдеров, поддерживает MCP / !«メールアドレス» / score 3 / 2026-09-29 / https://github.com/DenRakEiw/scumble
  3. ogoun/fooocus-qwen-image-2.1 — WebUI для Qwen-Image-2.1 / !«メールアドレス» / score 2 / 2026-09-27 / https://github.com/ogoun/fooocus-qwen-image-2.1
  4. PrunaAI/Pruna-Qwen-Image-2.1 — LoRA-адаптер с малым числом шагов для Qwen-Image-2.1; появился примерно одновременно с производным ControlNet union Kijai QwenImage_experimental, показывая резкий рост числа инструментов вокруг Qwen-Image-2.1 / !«メールアドレス» / score 0 / 2026-09-26 / https://huggingface.co/PrunaAI/Pruna-Qwen-Image-2.1
  5. black-forest-labs/FLUX.2-klein-9b-kv-fp8 — FP8-квантованная версия открытой 9B-модели Black Forest Labs / !«メールアドレス» / score 8 / 2026-03-14 / https://huggingface.co/black-forest-labs/FLUX.2-klein-9b-kv-fp8
  6. Alice v1: Distillation-Enhanced Video Generation Surpassing Closed-Source Models — открытая модель генерации видео, заявляющая превосходство над закрытыми видеомоделями благодаря улучшенной дистилляции / !«メールアドレス» / score 5 / 2026-05-13 / (прикреплён webm, lemmy.dbzer0.com pictrs)
Ближе к закрытому сегменту
  1. Black Forest Labs представила «FLUX 3» — умеет генерировать изображения и 20-секундные видео со звуком, первоначально доступна ограниченно / !«メールアドレス» / score 1 / 2026-07-24 / https://bfl.ai/blog/flux-3
  2. OpenAI прекращает API Sora на следующей неделе (24 сентября), тогда как китайские конкуренты привлекают 3 млрд долларов — анализ о нерентабельности потребительского ИИ-видео и о привлечении финансирования корпоративными игроками вроде Kling / !«メールアドレス» / score 1 / 2026-09-20 / https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/
  3. Google отозвала ИИ-функцию Google Earth (Nano Banana 2) всего через день — функцию отключили из-за злоупотреблений / !«メールアドレス» / score 1 / 2026-08-07 / https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature/
  4. Честное сравнение и технический разбор Seedream 5.0 Pro против Nano Banana Pro / !«メールアドレス» / score 1 / 2026-07-10 / https://www.reddit.com/gallery/1usc03q
  5. Сравнение раскраски одного разворота «Берсерка» четырьмя ИИ — ChatGPT Images 2.5 / Wan 2.7 Pro / Nano Banana Pro / Seedream 5.0 Pro; по мнению авторов, победил GPT / !«メールアドレス» / score 1 / 2026-09-14 / https://www.reddit.com/gallery/1wfyqdy
  6. Один и тот же промпт протестировали в шести моделях генерации видео, а около 40 человек оценили результаты вслепую — Google Veo заняла первое место, но три лидирующие модели показали близкий результат / !«メールアドレス» / score 1 / 2026-09-17 / https://www.reddit.com/r/ArtificialInteligence/comments/1wipgwa/
  7. ByteDance представила Seedance 2.5 — добавлены генерация одним дублем и гибкие референсы / !«メールアドレス» / score 3 / 2026-08-01 / https://seed.bytedance.com/en/blog/one-take-creation-flexible-referencing-introducing-seedance-2-5
  8. Runway заявляет, что её корпоративный бизнес удвоился, а NRR превысил 300% / !«メールアドレス» / score 0 / 2026-08-30 / https://www.reddit.com/r/ArtificialInteligence/comments/1w2hnea/
Сигналы
  • Qwen-Image-2.1 находится в центре открытого сегмента Lemmy: WebUI на базе Fooocus, ControlNet от Kijai и малошаговая LoRA от PrunaAI появились подряд в одну неделю, 26–27 сентября. Qwen-Image становится главным полем активности нынешнего сообщества ComfyUI/Stable Diffusion.
  • Закрытые решения сами размывают границу: Black Forest Labs, традиционно ориентированная на открытые веса, в FLUX 3 перешла к ограниченному закрытому доступу для функций видео и звука, но параллельно продолжает выпускать открытые веса вроде FLUX.2-klein-9b. Граница между открытым и закрытым становится менее чёткой.
  • Nano Banana 2 одновременно новость и источник проблем: интеграция в Google Earth и отзыв через день из-за злоупотреблений стали наиболее заметной историей по оценкам — score 6, тогда как у большинства постов оценки низкие.
  • В отношении ИИ-видео доминирует тезис «потребительский сегмент не приносит прибыли»: контраст между остановкой API Sora и фокусом Kling, Seedance и Runway на корпоративном рынке с финансированием и выручкой повторяется в нескольких зеркальных постах Reddit.
  • Много контента со сравнением моделей: Nano Banana Pro, Seedream 5.0 Pro, Wan 2.7 Pro и ChatGPT Images 2.5 неоднократно сравниваются в одинаковых условиях. Пользователей больше интересует «кто сильнее», чем отдельные новости.
  • Собственных дискуссий Lemmy почти нет: большинство найденных публикаций поступает через зеркальный бот !ai_reddit, оценки 0–1, комментарии почти не развиваются. Оригинальные аналитические или технические публикации Lemmy сосредоточены в !«メールアドレス».
Ограничения
  • У Lemmy нет крупного специализированного сообщества по ИИ-генерации изображений и видео. Темы распределены между небольшим !«メールアドレス» с инструментами и моделями, где оценки обычно однозначные, и бот-сообществом !ai_reddit с оценками 0–1. Последнее фактически повторяет Reddit и не отражает самостоятельное мнение Lemmy.
  • Число подписчиков сообществ получить не удалось. https://lemmy.world/c/<community> постоянно возвращал HTTP 500, а https://lemmy.world/api/v3/community?name=... — HTTP 400; возможно, параметры API на инстансе отличаются от обычной документации v3 или действуют ограничения.
  • По запросам «Grok Imagine», «Kling AI», «Runway Gen», «HunyuanVideo», отдельному «Flux» и другим почти не было релевантных публикаций — главным образом шум. В Lemmy упоминаний этих названий мало.
  • Поисковый API lemmy.world заявляет федеративный поиск между инстансами, но фактически выдавал главным образом публикации lemmy.world / lemmy.ml / lemmy.dbzer0.com / lemmy.today / lemmy.zip. На отдельный поиск по lemmy.ml и lemm.ee времени не хватило.
  • Оценки публикаций в целом низкие — большинство от 0 до 10, — поэтому нельзя говорить о высоком уровне активности. Это связано и с небольшим размером Lemmy, и с отсутствием специализированного сообщества по теме по сравнению с Reddit или X.

Pinterest

Pinterest — Новости ИИ-генерации изображений и видео

Собрано 50 пинов без жанрового разделения, в одном наборе. Были фактически открыты и проверены их заголовки и миниатюры.

Визуальные темы
  • Миниатюры «удивлённый ютубер + набор логотипов» — неоновые логотипы OpenAI, Google, Meta, Microsoft и Anthropic рядом с удивлённым мужчиной в шаблонных превью «AI NEWS». Новости закрытых игроков почти всегда используют этот формат [2, 7, 23, 41].
  • Робот как ведущий новостей — белые андроиды в костюмах сидят перед панелями «BREAKING NEWS», ИИ-ведущие как образ будущего, в котором ИИ захватывает новостную студию [23, 45].
  • Демонстрационные фотореалистичные портреты — лица пожилых мужчин с детально проработанными морщинами, бородой и текстурой повторяются как ключевые кадры анонсов новых моделей: AMD Amuse 3.0, крупный план глаза в Luma Dream Machine. Реализм стал актуальным бенчмарком [43, 47].
  • Сеточные изображения, превращающие один исходный ролик в разные стили — одно лицо или автомобиль пересозданы как деревянная резьба, оригами, LEGO, цветочная композиция и т. п.; наглядная демонстрация стилевой согласованности [4].
  • Неоновые футуристические интерфейсы — светящиеся иконки, силуэты головы с рисунком печатной платы, голографические панели, продающие идею единой генерации «изображение / видео / музыка / текст» [5, 9, 22, 50].
  • Инфографика и таблицы сравнения инструментов — логотипы ChatGPT, Midjourney, Gemini, Runway, Pika, Krea и других в неоновых кибер-таблицах «лучшее за деньги / лучшее бесплатно» [40].
  • Предупреждающие изображения о выявлении фейков и ИИ-этике — робот, анализирующий изображение кота с печатью «FAKE», инфографика с глазами до/после и посылом «не верьте только тому, что видите» [1, 20, 32, 37].
  • Встречаются пины, у которых заголовок и изображение не совпадают — например, заголовок о выходе Stability AI в видеогенерацию сопровождается коллажем фантазийных мудбордов. Складывается впечатление большого числа повторно используемых миниатюр ради кликов [29].
Примечательные пины
  1. [2] AI News: Anthropic Leak Shows Us The Future of AI... — типичная миниатюра «AI NEWS» с сияющими логотипами OpenAI, Google, Microsoft и Anthropic; ролик-сводка о закрытых игроках.
  2. [4] Google announces ultra-high quality video... — сетка, где один человек и автомобиль пересозданы в дереве, оригами, LEGO и цветах; понятная демонстрация стилевой согласованности.
  3. [5] Meta Unveils Muse Image and Muse Video Generative... — научно-фантастический баннер «Meta Muse Spark AI Model 2026», подчёркивающий направление персонального ИИ-ассистента.
  4. [23] Discover how Grok is revolutionizing video... — белый андроид-новостной ведущий перед панелью «BREAKING NEWS», образ будущего, в котором ИИ создаёт новости.
  5. [26] Google's Gemini Omni Turns Anything Into Video — в центре логотип «Omni», вокруг иконки изображений, видео, аудио и текста; акцент на мультимодальной интеграции.
  6. [38] Google Unveils Veo 2: Advanced AI Video Generation... — баннер в официальном стиле Veo2 с фразой «state-of-the-art video generation model» и рядом реалистичных и анимационных примеров.
  7. [43] Introducing Luma Dream Machine - Next Generation AI Video — крупный план глаза с типографикой "Dream Machine"; символический кадр, продвигающий фотореалистичность генерации.
  8. [47] 'Amuse 3.0', an AI art creation tool that includes... — локальный инструмент ИИ-арта от AMD. Демонстрация — фотореалистичный портрет пожилого рыбака, подчёркивающий серьёзную генерацию на GPU. Один из немногих конкретно названных локальных/открытых инструментов.
  9. [40] Top AI Video Generators of 2025 — неоновая таблица, распределяющая ChatGPT Plus, Midjourney, Runway, Pika, Kaiber и другие по категориям «приоритет качества» и «приоритет бесплатности». Практическая информация для выбора инструмента.
  10. [20] 'AI is getting scary good.' — предупреждающая инфографика о видеогенерации ИИ, обнаружении ИИ-голоса и промпт-инжиниринге с посылом «не доверяйте только внешнему виду».
Сигналы
  • На Pinterest среди «новостей ИИ-генерации изображений и видео» явно преобладают новостные миниатюры закрытых игроков — OpenAI, Google Veo/Gemini Omni, Meta Muse, Grok, Midjourney, Runway и Pika. Формат «удивлённое лицо + набор логотипов», похожий на перепубликацию YouTube-превью, доминирует; он больше ориентирован на клик, чем на глубину информации.
  • Тема открытой и локальной генерации представлена слабо. Конкретные названия появились только у Stability AI — но лишь в заголовке при нерелевантном мудборде — и AMD Amuse 3.0, локального GPU-инструмента. Не нашлось ни одного технического визуала о ComfyUI, Hugging Face, архитектуре диффузионных моделей или других материалах из сообщества.
  • Фотореалистичная генерация людей — лица с тщательно проработанными морщинами и текстурой — повторяется как общий у компаний визуальный бенчмарк «вот что теперь возможно». Это сигнал зрелости технологии.
  • Определённую долю составляют инфографики о недоверии к ИИ-контенту и его проверке: выявлении фейков, проверке голоса, этике. Наряду с самой генерацией заметен интерес к тому, как различать и правильно использовать такой контент.
  • Чего нет: пинов, прямо посвящённых конкретным открытым моделям — Stable Diffusion, FLUX, Wan, HunyuanVideo и др., — скриншотов GitHub или технических блогов, изображений с научными статьями и бенчмарками. По природе Pinterest здесь преобладают вторичные новостные подборки, сравнительные таблицы и рекламные баннеры, а не первичная техническая информация сообщества.
Ограничения
  • В output/pinterest.pins.md не было жанрового разделения (genre пуст), а все 50 пинов поступили единым набором. Поэтому невозможно было сделать предусмотренное методикой резюме по жанрам; весь набор анализировался как одна совокупность.
  • Из 50 пинов визуально проверены 18, выбранные с учётом конкретности заголовков и разнообразия тем. Остальные 32 не были открыты, однако в проверенной части повторяемость форматов была достаточно высокой, чтобы выявить паттерны.
  • У нескольких пинов заголовок не соответствует изображению — например, у [29] заголовок связан со Stability AI, а картинка представляет несвязанный мудборд. Такие пины упоминались по контексту заголовка, а не по визуальному содержанию.
  • Pinterest не просматривался напрямую: использовались только заранее собранные исполнителем изображения и заголовки. Поэтому нельзя проверить реальное число сохранений/лайков и содержимое материалов по ссылкам.

Рекомендованные действия

  • Повторить этап X с прямыми ИИ-ключевыми словами (Midjourney, Sora, Nano Banana, ComfyUI, Flux), а не общими трендовыми темами.
  • Продолжать наблюдать за экосистемой Qwen-Image-2.1 — WebUI, LoRA, ControlNet — как за опережающим индикатором открытого направления.
  • Отслеживать разрыв между затратами и выручкой Sora 2 как косвенный показатель рентабельности закрытой генерации видео.
  • Составлять карту того, на какие инструменты переходят пользователи, когда закрытые сервисы ужесточают ограничители.
  • Расширить выборку Pinterest с 18 пинов до более полного охвата 50 либо найти способ получать показатели вовлечённости.
  • При оценке данных рассматривать сообщество Lemmy !ai_reddit как зеркало Reddit, а не как независимый сигнал.

Собранные изображения

ИИ-контент и проблемы социальных сетейНовости ИИ: утечка Anthropic показывает будущее ИИ...Просто сделай это 🎥Google анонсирует видео сверхвысокого качества...Meta представляет генеративные Muse Image и Muse Video...изображениеGPT 5.2, видеоредактор в реальном времени, стерео-видео ИИ, мобильные ИИ-агенты, полный контроль тела: НОВОСТИ ИИСоздавайте видео из изображенийИИ для генерации изображений и видеоизображениеПроизводство ИИ-видео в Дубае | Быстрее, умнее контентИИ-инструмент для превращения текста в изображенияСовместное творчество человека и ИИ — режиссура видения саванныизображениеизображениеПревратите свои идеи в потрясающие визуальные образы! 🎥изображениеизображениеПрофессиональное создание ИИ-видео | Кинематографические ИИ-видео | Индивидуальный видеомонтаж‎🚨 ИИ становится пугающе хорош.изображениеКонцепция создания ИИ-контента с иконками генерации текста, изображений, музыки и видео — 68 стоковых фото, векторов и видеоУзнайте, как Grok революционизирует видео...искусственный интеллектизображениеGemini Omni от Google превращает что угодно в видеоизображениеКак создавать ИИ-видео: пошаговое руководство по созданию видео с ИИСоздатель Stable Diffusion от Stability AI теперь умеет создавать генеративное ИИ-видеоGoogle Flow AI получает голос: добавлена генерация речи для видеоизображение«Почему ИИ-чатботы не успевают за срочными новостями»ИИ-сгенерированные видео: хорошо или плохо? Вот правда! 🤖🎥ИИизображениеизображениеНовостные видео об ИИ стирают грань между настоящими и фальшивыми репортажамиGoogle представляет Veo 2: продвинутая генерация ИИ-видео...Чудеса ИИ, поразительные преимуществаЛучшие генераторы ИИ-видео 2025 годаНовости ИИ: OpenAI наконец выпустила то, о чём мы просилиКогда ИИ позволил людям вновь пережить собственные воспоминанияLuma Dream Machine — следующее поколение ИИ-видеобесконечный туннельИИ-ведущие новостей и освещение от создателей захватывают медиа США!Освоение видео и ИИ: ключевые тренды маркетинга в соцсетях 2025'Amuse 3.0', инструмент ИИ-арта, который включает...Превратите идеи в потрясающие визуальные образы с технологией ИИ-изображенийПерестаньте листать… эта история полностью изменит ваш взгляд на ИИ!Генерация ИИ-изображений и индустрия развлечений

Примечание о качестве данных

Этап X собрал посты по общим трендовым темам, а не по ИИ-запросам, поэтому не дал результата. YouTube и Pinterest не позволили подтвердить показатели вовлечённости — просмотры/подписчиков или сохранения/лайки — из-за JavaScript-рендеринга и ограничений выборки. Reddit и Bluesky основаны на реальных собранных/API-данных и являются наиболее надёжными источниками в этом материале.

Галерея