Новости ИИ-генерации изображений и видео — 2026-10-02
Китайские модели с открытым исходным кодом (Qwen-Image-2.1, Z-Image Turbo) приближаются к закрытым лидерам, в то время как доверие к закрытым системам падает из-за ограничителей, злоупотреблений и экономики Sora.
Новости ИИ-генерации изображений и видео — 2026-10-02
Сейчас в сфере ИИ-генерации изображений и видео действительно творится нечто серьёзное 😤 У закрытых игроков (GPT Image 2.5 от OpenAI, Veo 3.1/Nano Banana 2.0 от Google, Kling 2.5, Seedance 2.5 и других) не прекращается гонка новых функций, но параллельно растут вопросы, подрывающие доверие: усиление ограничителей, дипфейки и огромные убытки Sora 💸. Тем временем открытое направление, особенно китайские модели Alibaba (Qwen-Image-2.1, Z-Image Turbo), набирает мощный темп, а культура локальной работы через ComfyUI заметна на Reddit, Lemmy и Bluesky 🔥. В этот раз были изучены шесть платформ — Reddit, X, YouTube, Bluesky, Lemmy и Pinterest, — однако X оказался полностью нерелевантным, и об этом ниже сказано прямо 👇.
На всех платформах
- Китайские открытые модели поднимаются, причём их всё чаще называют «заменой закрытым» 🇨🇳 На YouTube говорят, что Z-Image Turbo (6 млрд параметров, работает на 6 ГБ VRAM) превосходит Flux 2 (https://www.youtube.com/watch?v=JF4Q5hXh-_Q), а Qwen-Image-Edit оценивают как модель уровня Nano Banana или лучше неё (https://www.youtube.com/watch?v=AIgYj5RG-FQ). На Lemmy в течение одной недели появились WebUI и LoRA вокруг Qwen-Image-2.1 (https://github.com/ogoun/fooocus-qwen-image-2.1), а на Bluesky Simon Willison тестирует Qwen-Image на реальном оборудовании (https://bsky.app/profile/simonwillison.net/post/3lvlvsxkzp223). Это одновременно происходит на нескольких платформах, поэтому тренд выглядит настоящим.
- Усиление ограничителей отталкивает пользователей 🚪 На Reddit пользователи из-за отказов ChatGPT уходят к Midjourney, Grok и Venice AI (https://www.reddit.com/r/AI_Agents/comments/1wt7jqr/), а после ужесточения фильтров DreamFort.ai переходят на Seedream Unfiltered или MiniMax H3 (https://www.reddit.com/r/generativeAI/comments/1wtzefv/). На Bluesky эксперты предупреждают, что у открытых весов вроде GLM-5.3 почти нет ограничителей (https://bsky.app/profile/emollick.bsky.social/post/3mu5xtm24zk2o). Во всех соцсетях заметна поляризация между всё более жёстким регулированием и практически неограниченными инструментами.
- Доверие к закрытым решениям одновременно расшатывается с нескольких сторон ⚠️ В расследовании TIME, распространённом через Bluesky, Veo 3 смог сгенерировать фальшивое видео поджога индуистского храма (https://bsky.app/profile/amanbatheja.bsky.social/post/3lqpalskjp22h). На Reddit обсуждают, как Photoshop и Apple Photos помечают даже обычную обрезку как «редактирование ИИ» и удаляют сведения об авторских правах (https://www.reddit.com/r/mildlyinfuriating/comments/1wsupkx/). Проблемы разные — злоупотребления и ошибочная маркировка, — но обе ведут к одному выводу: закрытым инструментам трудно доверять.
- ComfyUI стал стандартной рабочей средой открытого сообщества 🛠️ Он появляется везде: на Reddit — нода для MiniMax-H3 (https://www.reddit.com/r/StableDiffusion/comments/1wtu82e/), на Lemmy — инпейтинг LanPaint (https://github.com/scraed/LanPaint/), на Bluesky — ежедневные иллюстрации с Krea2 (https://bsky.app/profile/ria-tatibana.bsky.social/post/3mwtrqf7glc2t), на YouTube — быстрые туториалы при выходе каждой новой модели.
- Сравнения «лоб в лоб» стали базовым форматом контента 📊 Видео на YouTube с заголовками вроде «WAN 2.5 is Open Source Veo3», сравнение одной разворотной страницы «Берсерка» в четырёх моделях на Lemmy (https://www.reddit.com/gallery/1wfyqdy), неоновые таблицы «лучшее платное / лучшее бесплатное» на Pinterest. Людей интересует уже не отдельная новость, а то, какая модель сильнее.
- Тезис о том, что потребительское ИИ-видео не приносит прибыли, подтверждается несколькими источниками 💰 На Bluesky опубликованы оценки: годовая стоимость работы Sora2 — около 5 млрд долларов при выручке примерно 1,4 млн долларов (https://bsky.app/profile/labuzamovies.com/post/3mek2c2xipk2o). На Lemmy анализируют прекращение API Sora 24 сентября и привлечение финансирования корпоративными игроками вроде Kling (https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/).
По платформам
Reddit 🟠 Проанализировано 12 тредов из 9 сабреддитов. Самым популярным закрытым примером стал ролик, где Seedance 2.5 через Higgsfield позволил одному человеку создать десятиминутный короткометражный фильм с устойчивыми персонажами (784 балла, https://www.reddit.com/r/accelerate/comments/1wqqr4p/). В открытом сегменте ноду ComfyUI для MiniMax-H3 назвали «лучшей нодой из всех, которыми доводилось пользоваться» (https://www.reddit.com/r/StableDiffusion/comments/1wtu82e/). Здесь же наиболее конкретно выражено недовольство ограничителями.
X ⚫️ Здесь получился полный промах 😅 Собранные 40 постов от 33 аккаунтов были посвящены футболу, K-pop, британской политике и реалити-шоу — ни одного материала о генерации изображений или видео ИИ. Рабочий процесс использовал трендовые запросы X вроде «Halloween», «Ronaldo» и «#bb28», а не запросы по ИИ. Поэтому этот этап не внёс в отчёт полезных данных.
YouTube 🔴 В закрытом сегменте почти одновременно вышли ролики о функции Sketch в GPT Image 2.5 (https://www.youtube.com/watch?v=LYUr4BY33h4), бесплатном доступе к Veo 3.1 (https://www.youtube.com/watch?v=uj6eD31OxkA) и Nano Banana 2.0 как «убийце Photoshop» (https://www.youtube.com/watch?v=u22-XoQvI4I), что показывает очень быстрый темп функциональной конкуренции. В открытом сегменте массово выходят туториалы по запуску FLUX.2, Z-Image и Qwen-Image-Edit в ComfyUI. Однако просмотры, число подписчиков и комментарии получить не удалось из-за JavaScript-рендеринга: анализ основан только на заголовках и oEmbed-данных.
Bluesky 🔵 Через API AT Protocol были отобраны релевантные посты из более чем 100 реальных записей. В закрытом сегменте больше всего откликов получили сообщения о расистском контенте, который способен создать Veo 3 (❤️842, https://bsky.app/profile/eliothiggins.bsky.social/post/3ls6ridsm4s2y), и об экономической несостоятельности Sora2 (❤️1,375). В открытом сегменте исследователи вроде Simon Willison и Ethan Mollick тестируют Qwen-Image и GLM-5.3 на практике. Также зафиксировано множество ежедневных публикаций, созданных через ComfyUI + Krea2.
Lemmy 🟢 Основной центр — !«メールアドレス», однако это небольшое сообщество с оценками обычно от 1 до 10. Тем не менее в одну и ту же неделю появлялись инструменты для Qwen-Image-2.1 — WebUI, LoRA и ControlNet, что указывает на заметную динамику. Новости о закрытых продуктах — остановке API Sora и отзыве функции Google Earth в Nano Banana 2 за злоупотребления https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature/ — в основном поступают через зеркальный бот Reddit !ai_reddit; собственных обсуждений Lemmy почти нет.
Pinterest 🟣 Из 50 пинов были вручную открыты и проверены 18. Подавляющее большинство — новостные изображения о закрытых игроках: OpenAI, Google, Meta и Grok, обычно с логотипами и удивлёнными лицами на миниатюрах. Среди открытых и локальных решений конкретно выделяется только AMD Amuse 3.0. Фотореалистичные портреты с тщательно проработанными морщинами и текстурами используются компаниями как общий визуальный бенчмарк. При этом показатели вовлечённости — сохранения и лайки — недоступны, а пины ограничены заранее собранным набором.
На что обратить внимание
- Скорость расширения набора инструментов вокруг Qwen-Image-2.1 — на Lemmy в течение одной недели появились WebUI, LoRA и ControlNet (https://github.com/ogoun/fooocus-qwen-image-2.1). Стоит следить, что появится дальше.
- Как экономические проблемы Sora2 повлияют на курс OpenAI — тема активно обсуждается и на Bluesky (https://bsky.app/profile/labuzamovies.com/post/3mek2c2xipk2o), и на Lemmy (остановка API Sora, https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/).
- Поляризация между регулированием и отсутствием правил из-за ограничителей — одна и та же структурная проблема проявляется с разных сторон на Reddit (https://www.reddit.com/r/generativeAI/comments/1wtzefv/) и Bluesky (https://bsky.app/profile/emollick.bsky.social/post/3mu5xtm24zk2o).
- FLUX 3 от Black Forest Labs — ограниченно доступная закрытая модель для изображений и 20-секундных видео со звуком, при том что открытые веса FLUX.2 выходят параллельно (https://bfl.ai/blog/flux-3). Это интересный пример размывания границы между открытым и закрытым.
- Линия Z-Image / Qwen-Image для низкого VRAM — на YouTube Z-Image называют лучше Flux2 (https://www.youtube.com/watch?v=JF4Q5hXh-_Q), что может расширить аудиторию локальной генерации.
- Необходимость повторного исследования X — этот запуск промахнулся из-за трендовой вкладки; повторный сбор по прямым ключевым словам вроде "Midjourney", "Sora" и "Nano Banana" может дать интересные результаты.
Рекомендации
- В следующий раз X (Twitter) следует собирать по прямым ИИ-ключевым словам: "Midjourney", "Sora", "Nano Banana", "ComfyUI", "Flux" и другим.
- Быстрорастущую экосистему Qwen-Image-2.1 следует продолжать наблюдать как индикатор развития открытого направления.
- Соотношение операционных затрат и выручки Sora2 стоит отслеживать как показатель рентабельности закрытых моделей генерации видео в целом.
- Следует постоянно составлять карту переходов пользователей из-за ограничителей: от каких инструментов к каким они уходят.
- Pinterest стоит либо расширить с выборки в 18 до всех 50 изображений, либо найти способ получать показатели вовлечённости.
- С учётом зависимости Lemmy от !ai_reddit, фактически являющегося репостами Reddit, собственный голос Lemmy лучше искать в сообществах типа !stable_diffusion.
Качество данных
X собрал данные, полностью не относящиеся к теме исследования, из-за ошибочного попадания в трендовую вкладку и не внёс вклад в этот отчёт. YouTube из-за JavaScript-рендеринга не позволил проверить просмотры, даты публикации, число подписчиков и комментарии, поэтому анализировались только заголовки и oEmbed-данные. На Pinterest вручную проверены лишь 18 из 50 пинов, а данные о сохранениях и лайках недоступны. На Lemmy сами публикации были подтверждены, но их оценки в целом низкие — от 0 до 10, поэтому уровень интереса ниже, чем на других платформах. Анализ Reddit и Bluesky основан на реальных собранных/API-данных и относительно более надёжен.
Сводка по платформам
Reddit — Новости ИИ-генерации изображений и видео
Где
В собранном наборе тема присутствовала в 9 сабреддитах (всего 12 тредов, все найдены по единственному запросу "Image and Video Generation AI News"):
- r/generativeAI — 159 938 участников — 3 треда (#1, #2, #7)
- r/TopologyAI — 24 052 участника — 1 тред (#3)
- r/StableDiffusion — 1 027 672 участника — 1 тред (#4)
- r/LocalLLaMA — 838 632 участника — 1 тред (#5)
- r/AI_Agents — 452 911 участников — 1 тред (#6)
- r/accelerate — 93 680 участников — 2 треда (#8, #12)
- r/aifails — 39 194 участника — 1 тред (#9)
- r/VideoEditors — 81 700 участников — 1 тред (#10)
- r/mildlyinfuriating — 12 610 232 участника — 1 тред (#11)
Что говорят люди
- Бесплатная генерация видео закрытыми моделями — миф, по мнению сообщества — Тред #1, r/generativeAI, 71 балл, 46 комментариев, 2026-09-30 (https://www.reddit.com/r/generativeAI/comments/1wty6zj/). Автор утверждает, что облачные GPU не позволяют создать по-настоящему бесплатную безлимитную генерацию видео; u/opengradient подтверждает: «видео — не дешёвые LLM, никто не сможет раздавать это бесплатно» (5 баллов).
- Фильтрация NSFW в закрытых моделях ужесточается, подталкивая пользователей к открытым или неотфильтрованным альтернативам — Тред #2, r/generativeAI, 7 баллов, 14 комментариев, 2026-09-30 (https://www.reddit.com/r/generativeAI/comments/1wtzefv/). DreamFort.ai ужесточил фильтры на базе WAN 3.0; u/opengradient отмечает, что «многие поставщики закрытых моделей недавно ввели более строгие ограничения, включая Alibaba, владеющую Wan 3.0», и указывает на Seedream 2.0 Unfiltered и MiniMax H3 как альтернативы.
- Открытый процесс с Blender 3D подаётся как решение проблемы управляемости видеогенерации, но сообщество не уверено, что это реально — Тред #3, r/TopologyAI, 437 баллов, 19 комментариев, 2026-09-28 (https://www.reddit.com/r/TopologyAI/comments/1wsmvvm/). Несмотря на высокую оценку, верхние комментарии преимущественно выражают недоумение («Что это за “3d AI”?» — u/stevester911, 5 баллов) либо прямо отвергают показанное: «Это фейковый настоящий ИИ» — u/amon_de_no (5 баллов).
- Открытый инструментарий устойчивости референсов для MiniMax-H3 получает исключительно хороший приём — Тред #4, r/StableDiffusion, 690 баллов, 51 комментарий, 2026-09-30 (https://www.reddit.com/r/StableDiffusion/comments/1wtu82e/). Бесплатная нода ComfyUI (Fantastic-MiniMaxH3-PromptBuilder) исправила смешение идентичностей при редактировании видео с референсными изображениями; u/ClassicUse2579: «Штука H3 media loader — одна из лучших нод Comfy, которыми я когда-либо пользовался. Она чертовски хороша!» (3 балла).
- Открытые локальные стеки для изображений и чата уже достаточно зрелы, чтобы работать как технический аттракцион — Тред #5, r/LocalLLaMA, 194 балла, 96 комментариев, 2026-10-01 (https://www.reddit.com/r/LocalLLaMA/comments/1wuxzdg/). Компьютер Tandy 1000 из 1990-х по WiFi использует локально запущенные Qwen3.8-27B + Krea 2 (ComfyUI) для чата и генерации изображений. Однако верхний комментарий возражает против такой подачи: u/Aggravating-Push-207 (113 баллов): «На самом Tandy это не работает, он просто делает запросы внутри домашней сети».
- Ограничители закрытых систем настолько раздражают обычных пользователей, что те уходят к альтернативам — Тред #6, r/AI_Agents, 0 баллов, 22 комментария, 2026-09-29 (https://www.reddit.com/r/AI_Agents/comments/1wt7jqr/). Пользователь не может заставить ChatGPT нарисовать супергероя из-за отказов ограничителей; комментаторы направляют его к Midjourney, Grok, VeniceAI и открытым «нецензурируемым SDXL» моделям.
- В бесплатном и дешёвом сегменте закрытые сервисы с ежедневными кредитами всё ещё доминируют в рекомендациях для обычных пользователей — Тред #7, r/generativeAI, 4 балла, 59 комментариев, 2026-09-26 (https://www.reddit.com/r/generativeAI/comments/1wqfleb/). Рекомендации разделились: u/Scuzzy_Womack предлагает офлайн-ComfyUI (3 балла, открытый вариант), другие советуют Yodayo/MoescapeAI и Leonardo из-за ежедневных бесплатных кредитов (закрытые варианты).
- Закрытое видео (Seedance 2.5 через Higgsfield) уже достаточно хорошо для десятиминутного сюжетного фильма, созданного одним человеком — Тред #8, r/accelerate, 784 балла, 196 комментариев, 2026-09-26 (https://www.reddit.com/r/accelerate/comments/1wqqr4p/). Референсы листов персонажей подаются в каждый кадр, чтобы сохранять Капитана Уокера одинаковым между сценами; u/JoseLunaArts (95 баллов) говорит, что формулировка «без бюджета» преуменьшает стоимость токенов, а u/Nabugu (7 баллов) отмечает повторяющуюся однообразную «красивую ИИ-лицевую» эстетику.
- Генерация изображений всё ещё проваливается в глупых, мемных случаях — это воспринимается как развлечение, а не тренд — Тред #9, r/aifails, 526 баллов, 76 комментариев, 2026-09-28 (https://www.reddit.com/r/aifails/comments/1ws6jzs/). Запрос об анатомии курицы выдал анатомический абсурд; верхний комментарий u/kasimirvendom: «У всего есть конец, только у курицы их два» (52 балла).
- Видеомонтажёрам прямо советуют пока не полагаться на ИИ-инструменты — Тред #10, r/VideoEditors, 4 балла, 39 комментариев, 2026-09-26 (https://www.reddit.com/r/VideoEditors/comments/1wqkx27/). Верхний комментарий (u/VisibleExplanation, 33 балла): «Забудьте про любые ИИ-инструменты. Скачайте Davinci Resolve и научитесь им пользоваться... Ни один ИИ-инструмент не даст хороших результатов без фундаментального знания основ».
- Закрытые редакторы, незаметно переименовывающие небольшие правки в «Генеративный ИИ», вызывают кризис доверия — Тред #11, r/mildlyinfuriating, 1 268 баллов, 136 комментариев, 2026-09-28 (https://www.reddit.com/r/mildlyinfuriating/comments/1wsupkx/). Photoshop/Apple Photos, как сообщается, помечают простую обрезку как ИИ-редактирование и удаляют сведения об авторском праве; u/Kagevjijon (41 балл): «Нет никаких шансов, что это останется как есть. Это настоящее воровство». Возражение u/teh_maxh (135 баллов): «Я только что попробовал обрезать фото в Photoshop, и он не добавил метаданные, утверждающие, что я использовал GAI».
- ИИ-моды для игр, создаваемые открытым сообществом, переживают подъём — Тред #12, r/accelerate, 193 балла, 35 комментариев, 2026-09-30 (https://www.reddit.com/r/accelerate/comments/1wuhyiw/). u/Chopstik0-0 (38 баллов) описывает, как VR-сабреддит перешёл от сопротивления к энтузиазму, когда стало ясно, что «никто другой по-настоящему не делает новые VR-игры».
Сигналы
- Рост: Открытые инструменты для устойчивости референсов (нода ComfyUI из треда #4, локальный стек Qwen+Krea2 из треда #5) получают наиболее однозначную похвалу в выборке: высокие оценки сочетаются с искренне положительными техническими комментариями, а не только с хайпом.
- Рост: Закрытая генерация видео перешла в область длинных сюжетных форм — десятиминутный фильм из треда #8 с повторяющимися согласованными персонажами стал тредом с наибольшей вовлечённостью (784 балла, 196 комментариев), а критика сообщества направлена на сценарий и озвучку, а не на визуал.
- Отвергнуто: Идея «по-настоящему бесплатного» закрытого видеогенератора воспринимается как решённый и уже утомительный вопрос (тред #1): спор сместился от «какой бесплатный сайт» к «какую локальную открытую конфигурацию использовать».
- Разногласие: Тред #3 показывает разрыв между поверхностным восторгом (437 баллов) и скепсисом/непониманием в комментариях по поводу того, что именно демонстрируется. Это напоминает, что расплывчатые посты о процессах «3D AI» способны набирать баллы, даже если никто не согласен, что это за инструмент.
- Неожиданность — ограничители теперь регулярно заставляют менять платформу, а не просто раздражают: и тред #2 об ужесточении NSFW-фильтрации, и тред #6 об ограничителях ChatGPT, блокирующих неявное изображение супергероя, показывают уход пользователей из конкретного закрытого инструмента к другому закрытому решению (Grok, VeniceAI) или открытому (Seedream Unfiltered, нецензурируемый SDXL).
- Неожиданность — в треде #11 кризис доверия к закрытым инструментам совсем не связан с фильтрами контента: речь идёт об атрибуции и метаданных — автоматической маркировке обычных правок как «Генеративный ИИ» и удалении авторской информации, что является отдельной проблемой от недовольства ограничителями в других тредах.
Ограничения
- Сборщик использовал только один поисковый запрос — "Image and Video Generation AI News" — и нашёл 12 тредов в 9 сабреддитах, что меньше целевого порога около 20 постов на сеть. Согласно методике, использовался только уже собранный материал (
output/reddit.threads.md), без дополнительного поиска Reddit, поскольку Reddit блокирует WebFetch и страницы, на которые ведёт веб-поиск. - У тредов #9, #11 и #12 не был захвачен начальный текст, только заголовки, поэтому выводы основаны исключительно на комментариях и оценках.
- В выборке не появились крупные анонсы закрытых лабораторий — например, запуски именованных моделей OpenAI, Google или Midjourney; собранные материалы смещены в сторону пользовательского опыта, инструментария и трений вокруг ограничителей, а не продуктовых анонсов.
X
X — Новости ИИ-генерации изображений и видео
Аккаунты
Ни один аккаунт в собранных данных не обсуждает генерацию изображений или видео ИИ — ни закрытую, ни открытую. 33 собранных аккаунта (@Davesonude, @rcostadoazeite, @ChrisExcel102, @Louissaikyoo, @DlugoszMarcin, @khtaeverse и ещё 27) — это аккаунты футбольных мемов, K-pop-фандомов, фанатов Big Brother (#BB28), британской политики (Restore Britain), а также обычные мемные/щитпост-аккаунты. Никто из них не публикует материалы об ИИ-инструментах для изображений или видео, поэтому ответить, «кто двигает эту тему в X», по фактической теме исследования невозможно — см. ## Ограничения.
Посты
Ни один пост в output/x.posts.md (40 постов, 33 аккаунта) не упоминает ИИ-генерацию изображений, ИИ-генерацию видео, связанные продукты, компании или открытые проекты: нет упоминаний Midjourney, Sora, Stable Diffusion, Flux, Runway, Veo, Nano Banana, ComfyUI или аналогичных названий. Проверка наиболее вовлечённых постов это подтверждает:
- Пост #7, @Davesonude, около 291 000 просмотров, 22 958 лайков (2026-09-30),
https://x.com/Davesonude/status/2105273235965370529 — футбольный мем про Роналду. Найден по запросу "Ronaldo". - Пост #19, @ChrisExcel102, около 343 000 просмотров, 7 886 лайков (2026-09-29),
https://x.com/ChrisExcel102/status/2104913863200096350 — мем об отношениях знаменитостей. Найден по запросу "JubJub". - Пост #26, @Louissaikyoo, около 185 000 просмотров, 10 292 лайка (2026-09-30),
https://x.com/Louissaikyoo/status/2105090778766696620 — шутка-викторина о Disney Channel. Найден по запросу "China". - Пост #36, @DlugoszMarcin, около 189 000 просмотров, 2 937 лайков (2026-09-30),
https://x.com/DlugoszMarcin/status/2105363575145394223 — футбольный комментарий о Messi/Lewandowski/Ronaldo/Modrić. Найден по запросу "Messi".
Ни эти, ни остальные 36 постов не затрагивают тему исследования. Здесь не приводятся 5–12 «выводов» об ИИ-генерации изображений и видео, поскольку в собранном материале их нет: это означало бы их выдумывать, что прямо запрещено методикой этого запуска.
Сигналы
Из этого набора данных нельзя извлечь никаких сигналов об открытой или закрытой ИИ-генерации изображений/видео. Он показывает следующее: десять поисковых терминов, использованных для сбора — "Halloween", "Ronaldo", "Britain", "Yess", "JubJub", "Gold", "China", "#bb28", "Messi", "Balkans" — были трендовыми темами вкладки Explore в X для текущей сессии, а не темами генерации медиа ИИ. Таблица Explore в output/x.posts.md это подтверждает: 6 из 10 трендов явно помечены как "Trending in Croatia", а остальные — "Ronaldo", "Britain", "China", "Messi" — являются глобальными темами спорта и политики; ни одна не связана с ИИ или технологиями. Похоже на ошибку на этапе сбора: исполнитель взял тренды X вместо поиска терминов по ИИ-генерации, поэтому 40 постов оказались про футбол, британскую партию Restore Britain, спор в K-pop-фандоме, сезон реалити-шоу (#BB28) и несвязанные мемы.
Ограничения
- Собранные данные не соответствуют исследовательскому заданию. Задание требует новости о закрытой и открытой ИИ-генерации изображений/видео; вместо этого десять запросов исполнителя были общими трендами X для этой сессии — преимущественно с геолокацией в Хорватии по таблице Explore, — а не ИИ-запросами. Все 40 постов были вручную проверены на соответствие теме, и ни один не подходит.
- Согласно методике этого этапа, дополнительный просмотр X не проводился: анонимный просмотрщик ничего не видит в X, а использовались только уже собранные
output/x.posts.md/output/x.posts.json. - Хотя критерий объёма («анализировать около 20 постов на соцсеть») формально выполнен — рассмотрено 40 постов, — он не выполнен по релевантности, поэтому этап X не может дать выводов о закрытой или открытой генерации изображений/видео. Этап стоит повторить с запросами вроде "Midjourney", "Sora", "Stable Diffusion", "Flux", "Runway", "Veo", "Nano Banana", "ComfyUI" и подобными вместо общих трендовых тем.
YouTube
YouTube — Новости ИИ-генерации изображений и видео (закрытые/открытые решения)
Каналы
- AI WITH Rithesh (Rithesh Sreenivasan) — личный канал, в день выхода проверяющий релизы ChatGPT/OpenAI.
- Bart Slodyczka — канал с обзорами того, что изменилось сразу после релиза новых моделей.
- Learn with LEESI — канал, специализирующийся на туториалах Google Gemini/Veo/Flow.
- WorldofAI(@intheworldofai) — еженедельные обзоры новостей о закрытом ИИ.
- MattVidPro — крупный ИИ-канал, известный сравнениями и срочными новостями о моделях генерации видео.
- There's An AI For That(@theresanaiforit) — новости и сравнения новых моделей.
- Promptus AI(@promptusai) — специализируется на локальных туториалах по открытым моделям изображений/видео.
- AI Late to Class(@ailatetoclass) — обзоры открытых моделей для редактирования изображений.
- MaxonShire — специализируется на сравнении локальных моделей генерации видео (HunyuanVideo, Wan, LTX и др.).
- smallzero(@webdot3) — использование открытых моделей в ComfyUI, включая Z-Image.
- FlyMyAI — ежедневные и еженедельные новостные брифинги об ИИ.
- Lev Selector(@lev-selector) — канал еженедельных сводок обновлений ИИ.
Число подписчиков не удалось проверить напрямую, поскольку HTML поисковой выдачи YouTube рендерится JavaScript (см. Ограничения).
Видео
Закрытые решения
- «ChatGPT Images 2.5 Is INSANE… 48 Hours Later, I'm Still Shocked!» — AI WITH Rithesh / начало сентября 2026 — проверка GPT Image 2.5, выпущенного OpenAI 8 сентября 2026 года: новая функция создания изображений из эскиза «Sketch» и ускорение генерации до 50%. https://www.youtube.com/watch?v=LYUr4BY33h4
- «ChatGPT Image 2.5 Just Dropped — Here's Everything That's New» — Bart Slodyczka / сентябрь 2026 — полный обзор новых функций GPT Image 2.5. https://www.youtube.com/watch?v=dvpQHWwuaIo
- «Google Just Made VEO 3.1 FREE for Everyone with Unlimited AI Video Generation» — Learn with LEESI — рассказ о бесплатном доступе к Veo 3.1 через Google Flow/Vids, включая преобразование изображения в видео и поддержку трёх референсных изображений. https://www.youtube.com/watch?v=uj6eD31OxkA
- «Google's Nano Banana 2.0: Best Text-To-Image Generation Model EVER! The Photoshop killer!» — WorldofAI — тест Nano Banana 2.0 от Google DeepMind, модели генерации изображений семейства Gemini, названной «лучше Photoshop». https://www.youtube.com/watch?v=u22-XoQvI4I
- «Kling 2.5 goes BEAST MODE for AI Video!» — MattVidPro — сообщение о значительном прогрессе Kling 2.5 в динамике движения. https://www.youtube.com/watch?v=SGUxHC1cI1c
- «AI Video Models Are Getting Out of Control! (WAN 2.5, Kling 2.5, Wanimate)» — MattVidPro — сопоставляет закрытый Kling и открытый Wan, отмечая обострение конкуренции. https://www.youtube.com/watch?v=vFXe3uXb75k
- «Your AI news brief for September 3, 2026.» — FlyMyAI — общий ИИ-новостной брифинг по состоянию на 3 сентября 2026 года, включая темы генерации изображений и видео. https://www.youtube.com/watch?v=JK6w9tA2jH8
- «Exciting AI Updates Weekly - September 25, 2026» — Lev Selector — еженедельная подборка ИИ-обновлений, включающая модели генерации изображений и видео. https://www.youtube.com/watch?v=iyZHPCNd8jI
Открытые решения
- «Is FLUX 2.0 The New Open Source King?» — There's An AI For That — FLUX.2 от Black Forest Labs оценивается как кандидат на звание лучшей модели с открытыми весами для изображений и редактирования. https://www.youtube.com/watch?v=YQuTkPVkCS8
- «New Open-Source Model DESTROYS Flux 2 — Z-Image + Promptus Tutorial»(в oEmbed заголовок: «Z-Image Open-Source Image Generator: Free Online and Local Setup») — Promptus AI — Z-Image Turbo от Tongyi-MAI компании Alibaba: 6 млрд параметров, работа на 6 ГБ VRAM и заявленное превосходство над Flux 2. https://www.youtube.com/watch?v=JF4Q5hXh-_Q
- «Z-Image Full Release: The New King of AI Influencers in ComfyUI?» — smallzero — тест полноценного недистиллированного релиза Z-Image (Base) в ComfyUI. https://www.youtube.com/watch?v=ClVY5ll1sDU
- «Qwen Image 2.1 best open source Image Editor. Better than Nano Banana» — AI Late to Class — новая версия Alibaba Qwen-Image-Edit с десятью референсными изображениями, прозрачным фоном и ускорением оценивается как сопоставимая с Nano Banana или превосходящая её. https://www.youtube.com/watch?v=AIgYj5RG-FQ
- «HunyuanVideo 1.5 vs Wan 2.7 Comparison: Which is The Best Free Local Video AI Generation Model?» — MaxonShire — сравнение HunyuanVideo 1.5 от Tencent и Wan 2.7 от Alibaba как локальных моделей генерации видео. https://www.youtube.com/watch?v=4GNT4-QYekg
Сигналы
- Закрытые решения конкурируют скоростью появления функций: OpenAI (GPT Image 2.5 «Sketch», 2026-09-08), Google (бесплатный Veo 3.1 и интеграция с Google Vids/Flow) и обновление Kling 2.5 появились почти одновременно, поддерживая ежемесячную функциональную гонку.
- Китайский открытый лагерь, особенно Alibaba Tongyi-MAI и Qwen, набирает силу: Z-Image Turbo и Qwen-Image-Edit постоянно рассматриваются через призму «работает на 6 ГБ/малой VRAM» и «качество уровня Nano Banana» и напрямую сравниваются с FLUX.2 от Black Forest Labs.
- Видео «открытые против закрытых» сформировали отдельный жанр: очень много заголовков вроде «WAN 2.5 is Open Source Veo3» и «Z-Image vs Flux 2», где открытые модели обсуждаются как замена закрытым.
- Локальные туториалы по ComfyUI от Promptus AI, MaxonShire и smallzero стали ключевым форматом контента для открытого сегмента: при выходе каждой новой модели почти сразу появляется ролик о том, как её установить в ComfyUI.
- Каналы регулярных новостных брифингов вроде FlyMyAI и Lev Selector постоянно включают генерацию изображений и видео в обзоры, поэтому новости об отдельных моделях распространяются и через регулярные сводки.
Ограничения
- Страница поисковой выдачи YouTube (
youtube.com/results?search_query=...) и страницы видео (youtube.com/watch?v=...) рендерятся JavaScript, поэтому WebFetch не смог напрямую получить список видео или содержимое страниц — просмотры, даты публикации, число подписчиков и комментарии. Заголовки и названия каналов проверялись для отдельных роликов через JSON-эндпоинтyoutube.com/oembed, а период публикации и контекст дополнялись сниппетами веб-поиска и связанными статьями. - Поэтому точные просмотры, даты публикации и число подписчиков каналов не подтверждены. Некоторые результаты веб-поиска показывали относительные даты вроде «N дней назад», но многие ролики были старше 60 дней — иногда более 300 дней. В отчёте приоритет получили темы, которые с достаточной уверенностью можно отнести к последним 60 дням: GPT Image 2.5 от 2026-09-08 и явно датированные еженедельные новостные ролики.
- Были подтверждены связанные ролики о Runway Gen-4.5, Grok Imagine, Seedream 4.0 и Midjourney V8, но для них не удалось получить достаточно данных о периоде публикации или каналах, поэтому они не включены в раздел Видео.
- Комментарии к видео проанализировать не удалось, поскольку содержимое страниц видео недоступно.
Bluesky
Bluesky — Новости ИИ-генерации изображений и видео (закрытые/открытые решения)
О методике: официальный сайт Bluesky (bsky.app) — это JavaScript SPA, в котором нельзя получить результаты поиска обычным способом, поэтому напрямую использовался открытый API AT Protocol (https://api.bsky.app/xrpc/app.bsky.feed.searchPosts), не требующий аутентификации. По ключевым словам «Nano Banana», «Sora 2», «Flux», «ComfyUI», «Z-Image», «Qwen Image», «open weights», «Veo 3» были собраны реальные данные постов — текст, автор, число лайков и время публикации. Проверено более 100 записей, из которых отобраны релевантные теме.
Аккаунты
- Eliot Higgins(
eliothiggins.bsky.social, основатель Bellingcat, подтверждённый Bluesky) — регулярно пишет о рисках дезинформации и дипфейков, создаваемых Veo 3. - Simon Willison(
simonwillison.net, независимый исследователь ИИ, подтверждённый Bluesky) — запускает открытые модели Qwen-Image / Qwen-Image-Edit локально и публикует технические заметки. - Ethan Mollick(
emollick.bsky.social, профессор Wharton, подтверждённый Bluesky) — регулярно комментирует риски и возможности моделей с открытыми весами. - Журналисты 404 Media (Jason Koebler
jasonkoebler.bsky.social, Sam Colesamleecole.bsky.social) — проводят расследования о проблемах авторского права и модерации контента в Sora 2. - obeca(
obeca.bsky.social, турецкоязычная аудитория) — личный аккаунт, почти ежедневно публикующий изображения, сгенерированные Nano Banana 2. - Ria_Tatibana(
ria-tatibana.bsky.social, японский сегмент) — ежедневно публикует иллюстрации через ComfyUI + Krea2, открытую модель. - cubby.jpg(
cubby-ai.bsky.social) — выпускает много ИИ-арта с открытыми моделями изображений Z-Image / Qwen-Image. - AlternativeTo(
alternativeto.net) — автоматизированный аккаунт новостей ПО, публикующий срочные новости о релизах моделей вроде Qwen-Image-2.1.
Посты
Закрытые решения
- Проблема: Google Veo 3 способен создавать расистский контент — Eliot Higgins, 2025-06-22, ❤️842. «Google Veo 3 предоставляет новые и захватывающие способы заниматься расизмом». https://bsky.app/profile/eliothiggins.bsky.social/post/3ls6ridsm4s2y
- TIME смог создать в Veo 3 убедительные фальшивые ролики о мусульманах, поджигающих индуистский храм; Google добавил видимые водяные знаки после обращения журналистов — Aman Batheja, журналист TIME, 2025-06-03, ❤️431 · 🔁192 · цитат 107. https://bsky.app/profile/amanbatheja.bsky.social/post/3lqpalskjp22h
- Утверждение, что ежегодная стоимость работы Sora 2 составляет примерно 5 млрд долларов, а доход OpenAI пока около 1,4 млн долларов — Peter Labuza, 2026-02-10, ❤️1 375 · 🔁368 · цитат 192. https://bsky.app/profile/labuzamovies.com/post/3mek2c2xipk2o
- Критическая статья: Sora символизирует крах притворства ИИ-компаний, будто они не обучались на защищённых авторским правом материалах — Jason Koebler, 404 Media, 2025-10-01, ❤️1 508 · цитат 44. https://bsky.app/profile/jasonkoebler.bsky.social/post/3m25uzxbcak23
- Сообщение о том, что пользователи Sora 2 резко возмутились после запрета генерации персонажей, защищённых авторским правом — Sam Cole, 404 Media, 2025-10-08, ❤️435 · цитат 37. https://bsky.app/profile/samleecole.bsky.social/post/3m2ovizmqks2t
- Личный опыт: изображение Nano Banana (2) оказалось настолько убедительным, что автора удалось обмануть — furuakasaber.bsky.social, 2026-07-03, ❤️333. https://bsky.app/profile/furuakasaber.bsky.social/post/3mpr6djkzsk2e
- Усталость от инфографики Nano Banana — «каких-то ИИ-шных схем» — garrison.corporate.fm, 2026-03-15, ❤️73 · 🔁9. https://bsky.app/profile/garrison.corporate.fm/post/3mh4g5avqp22p
Открытые решения
- Alibaba Qwen выпустила первую модель генерации изображений Qwen-Image под лицензией Apache 2.0 — Simon Willison, 2025-08-04, ❤️46. https://bsky.app/profile/simonwillison.net/post/3lvlvsxkzp223
- Практический тест Qwen-Image-Edit: на Mac модель почти полностью потребляет 64 ГБ RAM и требует 54 ГБ дискового пространства — Simon Willison, 2025-08-19, ❤️77. https://bsky.app/profile/simonwillison.net/post/3lws3xfzhv22u
- Alibaba выпустила Qwen-Image-2.1, модель на 7 млрд параметров с открытыми весами, и изменила лицензию — AlternativeTo, 2026-09-24, ❤️6. https://bsky.app/profile/alternativeto.net/post/3mwaq75byhn2a
- Apple выпустила открытые веса Transformer-авторегрессионных flow-моделей STARFlow и STARFlow-V для генерации изображений и видео — Sung Kim, 2025-12-02, ❤️13. https://bsky.app/profile/sungkim.bsky.social/post/3m6xsab2zj22w
- Предупреждение: модель с открытыми весами GLM-5.3 мощная, но почти лишена ограничителей и имеет даже наступательные кибервозможности — Ethan Mollick, 2026-08-28, ❤️88. https://bsky.app/profile/emollick.bsky.social/post/3mu5xtm24zk2o
- Ежедневные иллюстрации, созданные ComfyUI + Krea2, с 50–80 ❤️ на пост — Ria_Tatibana, несколько публикаций 2026-09-28 — 10-01 (например, https://bsky.app/profile/ria-tatibana.bsky.social/post/3mwtrqf7glc2t, ❤️53). Большинство верхних результатов по тегу ComfyUI — это ежедневные работы авторов ИИ-иллюстраций.
- Ожидание и ирония вокруг релиза Z-Image, лёгкой открытой модели изображений Alibaba Tongyi — theophite.bsky.social, 2025-11-27, ❤️30. https://bsky.app/profile/theophite.bsky.social/post/3m6ldsilaz22f
Сигналы
- Veo 3 закрепляется как «инструмент дезинформации»: Eliot Higgins, основатель Bellingcat, регулярно поднимает эту тему, а расследование TIME широко разошлось (❤️431, 107 цитат). Для закрытой генерации видео главным вопросом становится уже не качество, а злоупотребления.
- Sora 2 испытывает трудности и экономически, и репутационно: оценка ежегодных расходов в 5 млрд долларов против выручки в 1,4 млн долларов получила большой охват (❤️1 375). Ужесточение ограничений на генерацию защищённых персонажей вызвало всплеск недовольства (❤️435): снова проявляется схема «изменение правил закрытого сервиса → возмущение пользователей».
- Nano Banana от Google стала стандартным инструментом генерации изображений для обычных пользователей: пользователи вроде obeca.bsky.social публикуют изображения практически ежедневно, и инструмент закрепился не только в англоязычной, но и в турецкой и японской среде. В то же время сохраняются опасения, что изображения слишком сложно распознать как искусственные (❤️333).
- В открытой генерации изображений Qwen-Image — центральная техническая тема: исследователи вроде Simon Willison проводят практические тесты вплоть до замеров VRAM и диска, а лицензия Apache 2.0 воспринимается положительно. Однако смена лицензии Qwen-Image-2.1 (упомянута в посте с ❤️6) создаёт напряжение и в открытом лагере: насколько модель действительно открыта?
- ComfyUI остаётся де-факто стандартом открытого процесса генерации изображений: большая часть результатов поиска — ежедневные публикации ИИ-иллюстраций, сделанных в ComfyUI с конкретными моделями, Krea2, SDXL и т. д. Это показывает не только технологическую новость, а укоренение инструмента в повседневной практике.
- Открытые веса означают высокую мощность, но отсутствие ограничителей — это всё чаще отмечают эксперты: заметные исследователи вроде Ethan Mollick начали говорить о наступательных возможностях и минимальном тестировании рисков у GLM-5.3. Крупные компании, такие как Apple со STARFlow, также входят в сферу открытых весов, расширяя её охват.
Ограничения
- Официальный сайт Bluesky — SPA, и WebFetch не смог получить текст постов; поисковый эндпоинт
public.api.bsky.appтакже возвращал 403. В итоге использовался идентичный API безpublic.—api.bsky.app, который отвечал без аутентификации и предоставил реальные данные. - Ключевые слова вроде «Flux», «Kling» и «Wan» пересекаются с общеупотребительными словами и другими темами — играми, погодой, именами, — поэтому содержат много шума и дали недостаточно релевантных записей. Поиск Flux дал 15 результатов, но фактически ни одного о генерации изображений ИИ. Обсуждений именно FLUX.2 от Black Forest Labs было недостаточно.
- Для отдельных видеомоделей Kling 2.5, Wan 2.5, HunyuanVideo и Seedance по использованным запросам не нашлось достаточно публикаций, поэтому их обсуждаемость на Bluesky не подтверждена; на YouTube она может быть выше.
- Даже с
sort=topпоисковый API не обязательно выдаёт настоящую сортировку по популярности, а при постраничной загрузке встречалось смешение дат. Поэтому приведённые «репрезентативные посты» — не строгий рейтинг популярности, а отрывок из реально существующих и релевантных публикаций.
Lemmy
Lemmy — Движение в ИИ-генерации изображений и видео (закрытые/открытые решения)
Сообщества
- !«メールアドレス» — основной центр релизов новых открытых моделей и инструментов. Публикаций много, но оценки невелики — обычно от 1 до 10.
- !«メールアドレス» / !«メールアドレス» — автоматические публикации, связанные с Civitai, ежедневно показывающие сгенерированные изображения Krea, SDXL и других моделей. Новостная ценность низкая, но это свидетельство повседневного использования открытых моделей.
- !«メールアドレス» / !«メールアドレス» — сообщества с примерами абстрактного ИИ-арта, часто кросспостящими одни и те же изображения.
- !«メールアドレス» — бот-сообщество, зеркалирующее ИИ-сабреддиты Reddit. Это главный канал появления новостей о закрытых решениях — Sora, Nano Banana, Seedream и др., — но оценки обычно 0–1, а обсуждения почти отсутствуют.
- !«メールアドレス» / !«メールアドレス» / !tech — места единичных публикаций, например новостей FLUX от Black Forest Labs.
- !«メールアドレス» / !casual_perchance — сообщества пользователей бесплатного браузерного сервиса генерации изображений Perchance.org.
- Число подписчиков не удалось получить: страницы сообществ Lemmy.world (
/c/<name>) постоянно возвращали ошибки 500/400, а API (/api/v3/community) не дал результата из-за неизвестных параметров (см. Ограничения).
Посты
Ближе к открытому сегменту
- scraed/LanPaint — высококачественный инпейтинг без обучения для любых моделей Stable Diffusion, с поддержкой ComfyUI / !«メールアドレス» / score 8 / 2026-09-29 / https://github.com/scraed/LanPaint/
- DenRakEiw/scumble — десктопный редактор ИИ-инпейтинга со слоями, текстовым выделением и пользовательскими кистями. Генерирует через собственный ComfyUI или API-провайдеров, поддерживает MCP / !«メールアドレス» / score 3 / 2026-09-29 / https://github.com/DenRakEiw/scumble
- ogoun/fooocus-qwen-image-2.1 — WebUI для Qwen-Image-2.1 / !«メールアドレス» / score 2 / 2026-09-27 / https://github.com/ogoun/fooocus-qwen-image-2.1
- PrunaAI/Pruna-Qwen-Image-2.1 — LoRA-адаптер с малым числом шагов для Qwen-Image-2.1; появился примерно одновременно с производным ControlNet union Kijai
QwenImage_experimental, показывая резкий рост числа инструментов вокруг Qwen-Image-2.1 / !«メールアドレス» / score 0 / 2026-09-26 / https://huggingface.co/PrunaAI/Pruna-Qwen-Image-2.1 - black-forest-labs/FLUX.2-klein-9b-kv-fp8 — FP8-квантованная версия открытой 9B-модели Black Forest Labs / !«メールアドレス» / score 8 / 2026-03-14 / https://huggingface.co/black-forest-labs/FLUX.2-klein-9b-kv-fp8
- Alice v1: Distillation-Enhanced Video Generation Surpassing Closed-Source Models — открытая модель генерации видео, заявляющая превосходство над закрытыми видеомоделями благодаря улучшенной дистилляции / !«メールアドレス» / score 5 / 2026-05-13 / (прикреплён webm, lemmy.dbzer0.com pictrs)
Ближе к закрытому сегменту
- Black Forest Labs представила «FLUX 3» — умеет генерировать изображения и 20-секундные видео со звуком, первоначально доступна ограниченно / !«メールアドレス» / score 1 / 2026-07-24 / https://bfl.ai/blog/flux-3
- OpenAI прекращает API Sora на следующей неделе (24 сентября), тогда как китайские конкуренты привлекают 3 млрд долларов — анализ о нерентабельности потребительского ИИ-видео и о привлечении финансирования корпоративными игроками вроде Kling / !«メールアドレス» / score 1 / 2026-09-20 / https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/
- Google отозвала ИИ-функцию Google Earth (Nano Banana 2) всего через день — функцию отключили из-за злоупотреблений / !«メールアドレス» / score 1 / 2026-08-07 / https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature/
- Честное сравнение и технический разбор Seedream 5.0 Pro против Nano Banana Pro / !«メールアドレス» / score 1 / 2026-07-10 / https://www.reddit.com/gallery/1usc03q
- Сравнение раскраски одного разворота «Берсерка» четырьмя ИИ — ChatGPT Images 2.5 / Wan 2.7 Pro / Nano Banana Pro / Seedream 5.0 Pro; по мнению авторов, победил GPT / !«メールアドレス» / score 1 / 2026-09-14 / https://www.reddit.com/gallery/1wfyqdy
- Один и тот же промпт протестировали в шести моделях генерации видео, а около 40 человек оценили результаты вслепую — Google Veo заняла первое место, но три лидирующие модели показали близкий результат / !«メールアドレス» / score 1 / 2026-09-17 / https://www.reddit.com/r/ArtificialInteligence/comments/1wipgwa/
- ByteDance представила Seedance 2.5 — добавлены генерация одним дублем и гибкие референсы / !«メールアドレス» / score 3 / 2026-08-01 / https://seed.bytedance.com/en/blog/one-take-creation-flexible-referencing-introducing-seedance-2-5
- Runway заявляет, что её корпоративный бизнес удвоился, а NRR превысил 300% / !«メールアドレス» / score 0 / 2026-08-30 / https://www.reddit.com/r/ArtificialInteligence/comments/1w2hnea/
Сигналы
- Qwen-Image-2.1 находится в центре открытого сегмента Lemmy: WebUI на базе Fooocus, ControlNet от Kijai и малошаговая LoRA от PrunaAI появились подряд в одну неделю, 26–27 сентября. Qwen-Image становится главным полем активности нынешнего сообщества ComfyUI/Stable Diffusion.
- Закрытые решения сами размывают границу: Black Forest Labs, традиционно ориентированная на открытые веса, в FLUX 3 перешла к ограниченному закрытому доступу для функций видео и звука, но параллельно продолжает выпускать открытые веса вроде FLUX.2-klein-9b. Граница между открытым и закрытым становится менее чёткой.
- Nano Banana 2 одновременно новость и источник проблем: интеграция в Google Earth и отзыв через день из-за злоупотреблений стали наиболее заметной историей по оценкам — score 6, тогда как у большинства постов оценки низкие.
- В отношении ИИ-видео доминирует тезис «потребительский сегмент не приносит прибыли»: контраст между остановкой API Sora и фокусом Kling, Seedance и Runway на корпоративном рынке с финансированием и выручкой повторяется в нескольких зеркальных постах Reddit.
- Много контента со сравнением моделей: Nano Banana Pro, Seedream 5.0 Pro, Wan 2.7 Pro и ChatGPT Images 2.5 неоднократно сравниваются в одинаковых условиях. Пользователей больше интересует «кто сильнее», чем отдельные новости.
- Собственных дискуссий Lemmy почти нет: большинство найденных публикаций поступает через зеркальный бот !ai_reddit, оценки 0–1, комментарии почти не развиваются. Оригинальные аналитические или технические публикации Lemmy сосредоточены в !«メールアドレス».
Ограничения
- У Lemmy нет крупного специализированного сообщества по ИИ-генерации изображений и видео. Темы распределены между небольшим !«メールアドレス» с инструментами и моделями, где оценки обычно однозначные, и бот-сообществом !ai_reddit с оценками 0–1. Последнее фактически повторяет Reddit и не отражает самостоятельное мнение Lemmy.
- Число подписчиков сообществ получить не удалось.
https://lemmy.world/c/<community>постоянно возвращал HTTP 500, аhttps://lemmy.world/api/v3/community?name=...— HTTP 400; возможно, параметры API на инстансе отличаются от обычной документации v3 или действуют ограничения. - По запросам «Grok Imagine», «Kling AI», «Runway Gen», «HunyuanVideo», отдельному «Flux» и другим почти не было релевантных публикаций — главным образом шум. В Lemmy упоминаний этих названий мало.
- Поисковый API lemmy.world заявляет федеративный поиск между инстансами, но фактически выдавал главным образом публикации lemmy.world / lemmy.ml / lemmy.dbzer0.com / lemmy.today / lemmy.zip. На отдельный поиск по lemmy.ml и lemm.ee времени не хватило.
- Оценки публикаций в целом низкие — большинство от 0 до 10, — поэтому нельзя говорить о высоком уровне активности. Это связано и с небольшим размером Lemmy, и с отсутствием специализированного сообщества по теме по сравнению с Reddit или X.
Pinterest — Новости ИИ-генерации изображений и видео
Собрано 50 пинов без жанрового разделения, в одном наборе. Были фактически открыты и проверены их заголовки и миниатюры.
Визуальные темы
- Миниатюры «удивлённый ютубер + набор логотипов» — неоновые логотипы OpenAI, Google, Meta, Microsoft и Anthropic рядом с удивлённым мужчиной в шаблонных превью «AI NEWS». Новости закрытых игроков почти всегда используют этот формат
[2, 7, 23, 41]. - Робот как ведущий новостей — белые андроиды в костюмах сидят перед панелями «BREAKING NEWS», ИИ-ведущие как образ будущего, в котором ИИ захватывает новостную студию
[23, 45]. - Демонстрационные фотореалистичные портреты — лица пожилых мужчин с детально проработанными морщинами, бородой и текстурой повторяются как ключевые кадры анонсов новых моделей: AMD Amuse 3.0, крупный план глаза в Luma Dream Machine. Реализм стал актуальным бенчмарком
[43, 47]. - Сеточные изображения, превращающие один исходный ролик в разные стили — одно лицо или автомобиль пересозданы как деревянная резьба, оригами, LEGO, цветочная композиция и т. п.; наглядная демонстрация стилевой согласованности
[4]. - Неоновые футуристические интерфейсы — светящиеся иконки, силуэты головы с рисунком печатной платы, голографические панели, продающие идею единой генерации «изображение / видео / музыка / текст»
[5, 9, 22, 50]. - Инфографика и таблицы сравнения инструментов — логотипы ChatGPT, Midjourney, Gemini, Runway, Pika, Krea и других в неоновых кибер-таблицах «лучшее за деньги / лучшее бесплатно»
[40]. - Предупреждающие изображения о выявлении фейков и ИИ-этике — робот, анализирующий изображение кота с печатью «FAKE», инфографика с глазами до/после и посылом «не верьте только тому, что видите»
[1, 20, 32, 37]. - Встречаются пины, у которых заголовок и изображение не совпадают — например, заголовок о выходе Stability AI в видеогенерацию сопровождается коллажем фантазийных мудбордов. Складывается впечатление большого числа повторно используемых миниатюр ради кликов
[29].
Примечательные пины
- [2] AI News: Anthropic Leak Shows Us The Future of AI... — типичная миниатюра «AI NEWS» с сияющими логотипами OpenAI, Google, Microsoft и Anthropic; ролик-сводка о закрытых игроках.
- [4] Google announces ultra-high quality video... — сетка, где один человек и автомобиль пересозданы в дереве, оригами, LEGO и цветах; понятная демонстрация стилевой согласованности.
- [5] Meta Unveils Muse Image and Muse Video Generative... — научно-фантастический баннер «Meta Muse Spark AI Model 2026», подчёркивающий направление персонального ИИ-ассистента.
- [23] Discover how Grok is revolutionizing video... — белый андроид-новостной ведущий перед панелью «BREAKING NEWS», образ будущего, в котором ИИ создаёт новости.
- [26] Google's Gemini Omni Turns Anything Into Video — в центре логотип «Omni», вокруг иконки изображений, видео, аудио и текста; акцент на мультимодальной интеграции.
- [38] Google Unveils Veo 2: Advanced AI Video Generation... — баннер в официальном стиле Veo2 с фразой «state-of-the-art video generation model» и рядом реалистичных и анимационных примеров.
- [43] Introducing Luma Dream Machine - Next Generation AI Video — крупный план глаза с типографикой "Dream Machine"; символический кадр, продвигающий фотореалистичность генерации.
- [47] 'Amuse 3.0', an AI art creation tool that includes... — локальный инструмент ИИ-арта от AMD. Демонстрация — фотореалистичный портрет пожилого рыбака, подчёркивающий серьёзную генерацию на GPU. Один из немногих конкретно названных локальных/открытых инструментов.
- [40] Top AI Video Generators of 2025 — неоновая таблица, распределяющая ChatGPT Plus, Midjourney, Runway, Pika, Kaiber и другие по категориям «приоритет качества» и «приоритет бесплатности». Практическая информация для выбора инструмента.
- [20] 'AI is getting scary good.' — предупреждающая инфографика о видеогенерации ИИ, обнаружении ИИ-голоса и промпт-инжиниринге с посылом «не доверяйте только внешнему виду».
Сигналы
- На Pinterest среди «новостей ИИ-генерации изображений и видео» явно преобладают новостные миниатюры закрытых игроков — OpenAI, Google Veo/Gemini Omni, Meta Muse, Grok, Midjourney, Runway и Pika. Формат «удивлённое лицо + набор логотипов», похожий на перепубликацию YouTube-превью, доминирует; он больше ориентирован на клик, чем на глубину информации.
- Тема открытой и локальной генерации представлена слабо. Конкретные названия появились только у Stability AI — но лишь в заголовке при нерелевантном мудборде — и AMD Amuse 3.0, локального GPU-инструмента. Не нашлось ни одного технического визуала о ComfyUI, Hugging Face, архитектуре диффузионных моделей или других материалах из сообщества.
- Фотореалистичная генерация людей — лица с тщательно проработанными морщинами и текстурой — повторяется как общий у компаний визуальный бенчмарк «вот что теперь возможно». Это сигнал зрелости технологии.
- Определённую долю составляют инфографики о недоверии к ИИ-контенту и его проверке: выявлении фейков, проверке голоса, этике. Наряду с самой генерацией заметен интерес к тому, как различать и правильно использовать такой контент.
- Чего нет: пинов, прямо посвящённых конкретным открытым моделям — Stable Diffusion, FLUX, Wan, HunyuanVideo и др., — скриншотов GitHub или технических блогов, изображений с научными статьями и бенчмарками. По природе Pinterest здесь преобладают вторичные новостные подборки, сравнительные таблицы и рекламные баннеры, а не первичная техническая информация сообщества.
Ограничения
- В
output/pinterest.pins.mdне было жанрового разделения (genreпуст), а все 50 пинов поступили единым набором. Поэтому невозможно было сделать предусмотренное методикой резюме по жанрам; весь набор анализировался как одна совокупность. - Из 50 пинов визуально проверены 18, выбранные с учётом конкретности заголовков и разнообразия тем. Остальные 32 не были открыты, однако в проверенной части повторяемость форматов была достаточно высокой, чтобы выявить паттерны.
- У нескольких пинов заголовок не соответствует изображению — например, у
[29]заголовок связан со Stability AI, а картинка представляет несвязанный мудборд. Такие пины упоминались по контексту заголовка, а не по визуальному содержанию. - Pinterest не просматривался напрямую: использовались только заранее собранные исполнителем изображения и заголовки. Поэтому нельзя проверить реальное число сохранений/лайков и содержимое материалов по ссылкам.
Рекомендованные действия
- Повторить этап X с прямыми ИИ-ключевыми словами (Midjourney, Sora, Nano Banana, ComfyUI, Flux), а не общими трендовыми темами.
- Продолжать наблюдать за экосистемой Qwen-Image-2.1 — WebUI, LoRA, ControlNet — как за опережающим индикатором открытого направления.
- Отслеживать разрыв между затратами и выручкой Sora 2 как косвенный показатель рентабельности закрытой генерации видео.
- Составлять карту того, на какие инструменты переходят пользователи, когда закрытые сервисы ужесточают ограничители.
- Расширить выборку Pinterest с 18 пинов до более полного охвата 50 либо найти способ получать показатели вовлечённости.
- При оценке данных рассматривать сообщество Lemmy !ai_reddit как зеркало Reddit, а не как независимый сигнал.
Собранные изображения


















































Примечание о качестве данных
Этап X собрал посты по общим трендовым темам, а не по ИИ-запросам, поэтому не дал результата. YouTube и Pinterest не позволили подтвердить показатели вовлечённости — просмотры/подписчиков или сохранения/лайки — из-за JavaScript-рендеринга и ограничений выборки. Reddit и Bluesky основаны на реальных собранных/API-данных и являются наиболее надёжными источниками в этом материале.



