KEN’S CAT LOG

Новости ИИ для генерации изображений и видео — 2026-09-23

Закрытые ИИ для изображений и видео резко сдают позиции (API Sora 2 закрывается 2026-09-24, Midjourney переходит к медицинским устройствам, цены Grok Imagine/Seedance вызывают негативную реакцию), тогда как инструменты с открытым исходным кодом вокруг ComfyUI (Wan, HunyuanVideo, FLUX.2, Qwen-Image, MiniMax H3) незаметно становятся стандартом для реальной производственной работы.

ИИ для генерации изображений и видео: открытые против закрытых — передовая невероятно горячая тема — 2026-09-23

Ну да, посмотрел — и сейчас правда очень интересный момент 🔥 Пока закрытые игроки (Sora 2, Midjourney, Grok Imagine и другие) громко выпускают новинки, за кулисами они активно сворачивают продукты, повышают цены и меняют курс; если честно, ощущение, что их начинает шатать 😳 А открытые проекты (Wan, FLUX.2, Qwen-Image, HunyuanVideo) собираются вокруг ComfyUI как хаба и, без лишнего шума, всерьёз проникают в реальные производственные процессы 💪 По материалам Reddit, X, YouTube, Bluesky, Lemmy и Pinterest отчётливо вырисовывается картина: «громкие новости — закрытые решения, практичная повседневная работа — открытые». Кроме того, всё громче звучат общественные требования обязательной маркировки AI-контента 📢

Межплатформенная картина

  • На нескольких платформах подтверждается спад и смена курса у закрытых игроков. На YouTube рассказывали, что Sora 2 завершает работу приложения всего через полгода (2026-04-26), а API должен закрыться уже на следующий после исследования день — 2026-09-24; при операционных расходах около 1 млн долларов в день совокупная выручка от платных подписок составила лишь 2,1 млн долларов (https://www.youtube.com/watch?v=bIL7uU4CYnE). В Lemmy та же новость о закрытии Sora API распространялась через зеркало r/ArtificialInteligence (https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/) и сопоставлялась с привлечением китайской Kuaishou (Kling) 3 млрд долларов, поддерживая тезис: «зарабатывают именно неброские корпоративные решения».
  • Открытый исходный код появляется повсюду как «рабочая инфраструктура» вокруг ComfyUI. Reddit (ComfyUI + FramePack для генерации видео даже на слабых ПК), Lemmy (за последнюю неделю два расширения ComfyUI для MiniMax H3), YouTube (массовые туториалы по локальному запуску Wan/HunyuanVideo/LTX) — на трёх платформах независимо всплывают ComfyUI и семейство Wan.
  • Недовольство тем, что «всё стало слишком платным», направлено на закрытые сервисы. На Reddit появились сразу три треда о поиске бесплатного ИИ для генерации видео (из-за сокращения бесплатных лимитов закрытых продуктов), а на Bluesky художник из Токио неоднократно назвал стоимость Seedance 2.5 «devastating» (https://bsky.app/profile/metalmickey.bsky.social/post/3mu25rbs4dk2e).
  • Пользователи устали от сравнений: «какой инструмент вообще выбрать?» На YouTube привычным форматом стали сравнения наподобие Sora 2 vs Seedance 2.0 vs Runway, а в Pinterest широко расходятся матрицы выбора «Best Quality vs Best Free» (YouTube: https://www.youtube.com/watch?v=rb0p_mY3tPs / Pinterest #10). Всё больше людей хотят знать не «во что верить», а «что сейчас сильнее».
  • Недоверие к AI-контенту и настрой на обязательную маркировку общие для нескольких платформ. Тред Reddit с предложением законопроекта собрал 13 841 комментарий — с огромным отрывом больше всего обсуждений в этой выборке (https://www.reddit.com/r/CriticalState/comments/1wmktek/). В Pinterest изображения со штампом «FAKE» и бейджами детекции ИИ уже оформились в самостоятельный жанр.

По платформам

Reddit — Из 12 собранных тредов только 4 пришли из специализированных сообществ об ИИ для изображений и видео; остальные — из общих сабреддитов в духе «увидел AI-контент / это бесит». Постоянно звучит спрос на бесплатную и локальную генерацию видео. При этом DeepSeek (открытые веса) стал редким примером ситуации, когда открытая модель едва не подрывает себя собственной популярностью: рост DAU с 120 до 200 млн опередил наращивание вычислительных ресурсов и ухудшил качество (https://www.reddit.com/r/DeepSeek/comments/1wmcgex/).

X — В основном среди японских аккаунтов прошёл фестиваль демонстраций «одним запросом» для Claude Opus 5.5 и Grok 4.7. @cherry_mx_reds, @NFT_Chen, @riku720720 и @chetaslua почти одновременно, 21–22 сентября, публиковали разные демонстрации — похоже на волну массовой проверки сразу после релиза. На открытой стороне заметны посты индивидуальных разработчиков, таких как @shinshin86 и @GeekCatX, о числе GitHub Stars. Но более 20 из 40 собранных постов были нерелевантным шумом, вызванным собственными трендовыми словами X.

YouTube — Самая насыщенная информацией площадка. Главной темой стал взлёт и падение Sora 2 — от громкого анонса до ухода с рынка за полгода. Продолжается гонка обновлений Nano Banana 2, GPT Image 2.5 и Midjourney V8. В открытом сегменте основными полями битвы выступают Alibaba (Wan), Tencent (HunyuanVideo), Black Forest Labs (FLUX) и Lightricks (LTX), а ComfyUI закрепился как «коммутационная панель», куда постоянно добавляют новые узлы.

Bluesky — Сильного специализированного хаба по ИИ для изображений и видео нет; официальные аккаунты Stability AI, Midjourney, Runway и других почти неактивны. Единственный стабильно публиковавшийся инсайдер — @ethanhe из xAI. Однако API полнотекстового поиска всё время возвращал 403, поэтому исследование пришлось ограничить обходом известных аккаунтов.

Lemmy — Площадка небольшая (даже у главного сообщества только 5 713 участников), но публикации вокруг ComfyUI в !«メールアドレス» очень плотные по содержанию. У закрытого сегмента особенно заметны новости о «сворачивании и смене курса»: закрытие Sora API, переход Midjourney к медицинскому оборудованию, немедленный откат Google Earth AI. Разговоров о корректировке траектории здесь больше, чем о громких релизах.

Pinterest — Здесь преобладают не новостные статьи, а картинки в стиле превью «AI NEWS», сравнительные графики и визуальные предупреждения о дипфейках. Открытый исходный код почти отсутствует: удалось найти разве что AMD «Amuse 3.0». Зато очень заметны потребительская тревога «что мне выбрать?» и настороженность к AI-контенту как визуальные жанры.

Ключевые моменты

Рекомендуемые действия

  • На фоне роста цен и сворачивания продуктов у закрытых игроков продолжать следить за OSS-стеком Wan, HunyuanVideo, FLUX.2 и ComfyUI + MiniMax H3 как за основным практичным вариантом.
  • Опережая усиливающийся на Reddit и Pinterest настрой на обязательную маркировку AI-контента, заранее подготовить политику указания происхождения материалов.
  • После закрытия Sora 2 API 24 сентября проследить, куда мигрируют пользователи: в Kling, Seedance или Runway.
  • Волну демонстраций Opus 5.5 / Grok 4.7 в X считать краткосрочным ажиотажем окна релиза, а не устойчивой угрозой доле внимания OSS.
  • Следить за инфраструктурными ограничениями при резком росте популярности открытых весов, как в случае DeepSeek, как за ранним индикатором дефицита предложения.
  • Для ответа на заметную в YouTube и Pinterest усталость от выбора и сравнений делать сравнительный контент, а не новости об отдельных продуктах.

Качество данных

Критерия завершённости — примерно 20 анализируемых материалов на каждую соцсеть — достигли только YouTube и Pinterest (собрано соответственно 20 и 50 материалов). По остальным площадкам данных не хватало. На Reddit набралось лишь 12 тредов, из которых только 4 были из профильных сабреддитов. В X собрали 40 постов, но более половины оказались нерелевантным шумом от трендовых слов; непосредственно по теме было около 11. В Bluesky полнотекстовый API постоянно отвечал 403, поэтому обходили только известные аккаунты и собрали 10 постов. Lemmy сам по себе слишком мал (главное сообщество — 5 713 участников), чтобы достичь 20 материалов; кроме того, половина постов — зеркальные перепечатки Reddit. В Pinterest визуально проверили только 26 из 50 материалов, а метрики вовлечённости вроде лайков получить не удалось.

Сводка по платформам

Reddit

Reddit — Новости ИИ для генерации изображений и видео

Где (сабреддиты)

12 собранных тредов распределены по 10 сабреддитам. Специализированных сообществ по ИИ для изображений и видео мало; остальные были тредами в общих сабреддитах, где упоминали или критиковали AI-контент.

Сабреддит Число участников Число собранных тредов
r/generativeAI 156,181 3
r/mildlyinfuriating 12,586,808 1
r/aivideomaking 7,498 1
r/CriticalState 39,096 1
r/Instagramreality 1,155,566 1
r/Purdue 100,731 1
r/DeepSeek 140,681 1
r/ImagineAiArt 19,446 1
r/youngpeopletiktoks 8,226 1
r/youtube 3,459,719 1

Только четыре сообщества — r/generativeAI, r/aivideomaking, r/DeepSeek и r/ImagineAiArt — специализируются на генеративном ИИ (4 треда). Остальные 8 тредов пришли из общих сабреддитов, где AI-контент упоминался в контексте «увидел / меня это раздражает».

Реакции пользователей
  • В трёх разных тредах повторяется поиск бесплатных генераторов видео (тред #2 «Which AI video generator can still be used for free?» r/generativeAI · 20pt · 73 комментария · 2026-09-16 / тред #3 «Looking for a free AI video generator» r/aivideomaking · 7pt · 28 комментариев · 2026-09-20 / тред #10 с тем же заголовком r/generativeAI · 4pt · 28 комментариев · 2026-09-20). Закрытые продукты активно переходят на платную модель, а u/RioMetal (+4) рекомендует открытые решения: «если можете запускать локально, есть сколько угодно Wan и Minimax».
    https://www.reddit.com/r/generativeAI/comments/1whtesl/
  • Недовольство тем, что «всё, что советует ИИ, платное» (тред #2, текст поста). Типичная реакция на сокращение бесплатных лимитов у закрытых сервисов.
    https://www.reddit.com/r/generativeAI/comments/1whtesl/
  • Конкретный рецепт локального open-source-использования: u/AztecWheels (+2, тред #3) советует установить FramePack через Pinokio — тогда даже слабый ПК сможет преобразовывать изображения в видео (без звука, от 1 до 120 секунд). Связка ComfyUI + FramePack упоминается как привычный вариант открытой генерации видео на маломощном оборудовании.
    https://www.reddit.com/r/aivideomaking/comments/1wled0f/
  • Возражение против требования бесплатности: u/activematrix99 (+2, тред #3): «Это как требовать бесплатную еду в ресторане. Компании потратили на эту технологию миллиарды». Внутри сообщества есть заметный раскол по вопросу бесплатного доступа.
    https://www.reddit.com/r/aivideomaking/comments/1wled0f/
  • Быстрый рост DeepSeek (открытые веса) и нехватка вычислений: в треде #7 «some deepseek news, if you care» (r/DeepSeek · 292pt · 45 комментариев · 2026-09-21) говорится, что DAU DeepSeek вырос с 120 млн до 200 млн (+66,7%), тогда как вычислительные мощности — лишь на 8,3%; это привело к ухудшению качества и сбоям при повторной генерации. В качестве меры упоминается заказ 160 тыс. Huawei Ascend 960DT. u/Equivalent-Grass-527 (+13): «несоответствие спроса и вычислительных ресурсов лучше всего объясняет недавнюю деградацию».
    https://www.reddit.com/r/DeepSeek/comments/1wmcgex/
  • Спор GPT Image 2.5 Flare (закрытый) против KREA 2 (открытый): тред #9 «GPT Image 2.5 Flare — is this actually the best AI image generating model right now?» (r/ImagineAiArt · 93pt · 62 комментария · 2026-09-16). u/Dependent_Quit_3730 (+3, по-португальски): «идеальная модель для тех, кто хочет простоты, но я всё ещё использую KREA 2»; u/SeaworthinessFresh16 (+2): «результаты ComfyUI + Krea2 выглядят так же». На фоне популярности закрытой новинки пользователи почти не ощущают разницы с открытой моделью.
    https://www.reddit.com/r/ImagineAiArt/comments/1wi79wi/
  • Сильная негативная реакция на AI-изображения недвижимости: тред #1 «It should be illegal to post AI-generated "inspirational" images in house listing photos.» (r/mildlyinfuriating · 25,962pt · 706 комментариев · 2026-09-21, наивысший балл в наборе). u/BojackWorseman13 (+1,128): агентам по недвижимости «следовало бы массово жаловаться в соцсетях; даже если это не незаконно, нужно крупно указывать, что изображение сгенерировано ИИ».
    https://www.reddit.com/r/mildlyinfuriating/comments/1wmja6n/
  • Предложение законопроекта об обязательной маркировке AI-контента: тред #4 «[Law Proposal] Every ai generated image and text must need to have watermark.» (r/CriticalState · 1,246pt · 13,841 комментарий · 2026-09-21, больше всего комментариев в выборке). Верхние комментарии в основном поддерживают инициативу: u/Timedforfun +16 — «Это не то, что следует скрывать; голосую за».
    https://www.reddit.com/r/CriticalState/comments/1wmktek/
  • AI-изображения, неотличимые для обычных людей, набирают вирусную популярность: тред #5 «AI generated images on Reddit with thousands of upvotes and comments» (r/Instagramreality · 2,148pt · 343 комментария · 2026-09-18). u/Habibti-Mimi81 (+146): «Я бы не заметил; единственная подсказка — угол серой плитки. Печальное и опасное время».
    https://www.reddit.com/r/Instagramreality/comments/1wk0euk/
  • AI-изображения в официальных университетских материалах называют “slop”: тред #6 «AI generated image on MSEE wall» (r/Purdue · 139pt · 19 комментариев · 2026-09-21). Автор: «Неужели нельзя было нанять графического дизайнера? От AI-slop уже никуда не деться».
    https://www.reddit.com/r/Purdue/comments/1wmq43f/
  • Контент из видео-ИИ вроде Sora попадает в сабреддиты с перепостами TikTok: тред #11 «another ai generated grounded video» (r/youngpeopletiktoks · 81pt · 35 комментариев · 2026-09-19). u/Pretend-Goat-8065 (+5) коротко пишет: «Another Sora ai🫩», прямо называя закрытый продукт.
    https://www.reddit.com/r/youngpeopletiktoks/comments/1wkjvor/
  • Негативная реакция на автоматически сгенерированные главы YouTube: тред #12 (r/youtube · 3pt · 22 комментария · 2026-09-17). u/avatar0027 (+2): автоматически созданные по расшифровке главы стали показываться активнее; зритель не может отключить их разом, автору приходится выключать каждое видео отдельно. Это не сама генерация видео, но косвенно показывает усталость от расширения AI-функций.
    https://www.reddit.com/r/youtube/comments/1wiqamq/
Сигналы
  • Рост: спрос на бесплатную локальную генерацию видео (Wan 2.2, Minimax H3, ComfyUI + FramePack) повторяется в трёх независимых тредах. Подорожание и платные ограничения закрытых решений подталкивают интерес к открытому исходному коду.
  • Рост: общественный запрос на обязательную маркировку AI-контента (13 841 комментарий в треде #4 — самый большой объём обсуждения в выборке). На Reddit в целом вопросы регулирования и прозрачности вызывают куда больше вовлечения, чем соревнование моделей.
  • Недооцениваемое: сопротивление самому требованию «дайте бесплатно» (u/activematrix99 и другие). В сообществе есть и прохладное отношение к идее, что бесплатный доступ — это норма; единого мнения нет.
  • Неожиданное: DeepSeek с открытыми весами теряет качество из-за нехватки вычислений на фоне стремительного роста аудитории (тред #7). Это не ось «открытое против закрытого», а новый тип ограничения предложения: открытая модель стала слишком популярной для собственной инфраструктуры оператора.
  • Разногласия: в треде #9 мнения сравнивающих закрытую новинку GPT Image 2.5 Flare и открытую KREA 2 разделились; несколько участников говорят, что «закрытая модель громче в новостях, но разницы по ощущениям нет».
Ограничения
  • Критерий брифа — анализировать около 20 постов для каждой соцсети, но в reddit.threads.md/.json содержалось только 12 тредов (использовался лишь один запрос: "Image and Video Generation AI News"). Поскольку исполнитель должен был читать уже собранные данные, дополнительных поисков не проводилось.
  • Из 12 собранных материалов только 4 пришли из профильных сообществ об ИИ для изображений и видео (r/generativeAI, r/aivideomaking, r/DeepSeek, r/ImagineAiArt). Остальные 8 — производные треды общих сабреддитов о том, что кто-то «нашёл AI-контент»; новостных тредов именно о новых продуктах и обновлениях закрытых/открытых систем практически нет.
  • Крупнейшие профильные сабреддиты об ИИ для изображений и видео — r/StableDiffusion, r/midjourney, r/runwayml, r/aivideo и другие — в набор вообще не вошли.
  • Текст исходного поста треда #9 (GPT Image 2.5 Flare) обрывается посреди полного промпта, поэтому продолжение публикации и содержимое прикреплённого изображения проверить нельзя.
  • Из-за ограничения, не позволявшего самостоятельно просматривать Reddit, исследование не выходило за пределы этих 12 материалов — не изучались другие запросы и дополнительные треды.

X

X — Новости ИИ для генерации изображений и видео

В X (Twitter) среди японских аккаунтов активно обсуждались демонстрации генерации видео и анимации с помощью «Claude Opus 5.5» и «Grok 4.7», однако более половины из 40 собранных публикаций оказались нерелевантным шумом (подробности ниже в разделе Limits).

Accounts
  • @cherry_mx_reds(Tak) — Самый заметный участник в этой выборке. Опубликовал две демонстрации: анимацию «Oktoberfest», сгенерированную Opus 5.5 одним запросом (373 лайка), и создание Grok 4.7 3D-сцены в Blender (1 636 лайков, ~410 000 просмотров). Один аккаунт тестирует две разные модели, ведя репортаж в сравнительной перспективе.
  • @NFT_Chen(SuSu_酥酥) — Один пост (151 лайк, ~40 000 просмотров), где Opus 5.5 с помощью кода создал покадровую анимацию под ручную рисовку. Одиночная, но широко разошедшаяся демонстрация с подробным описанием.
  • @chetaslua — Один кейс (435 лайков): интерактивное видео, созданное Opus 5.5 только на JavaScript, без ассетов, MCP и навыков. Техническая демонстрация с фокусом на реализации.
  • @riku720720(Rikuo) — Один пост (173 лайка) о генерации пиксельной анимации Opus 5.5; промпт опубликован в ответах, что делает публикацию практическим обменом опытом.
  • @old_pgmrs_will(оператор NeuralWire.org) — Два поста о Grok 4.7: один о создании приложения для ретуши фото вместе с демонстрационной функцией (8 лайков), второй — возражение критикам Grok-4.7 и рассказ об улучшении UI видеоредактора (8 лайков). Небольшой охват, но последовательные публикации AI-новостного аккаунта.
  • @shinshin86(разработчик AITuber OnAir) — Разработчик открытого инструмента «Still2Rig PSD» (автоматическое разложение статичного изображения на PSD-слои) сообщил о более чем 60 GitHub Stars (586 лайков, ~28 000 просмотров).
  • @ishitaku39(いしたく) — Представил «ARDY Mini»: облегчённую индивидуальным разработчиком до запуска в браузере производную исследовательской модели NVIDIA ARDY (226 лайков).
  • @GeekCatX(知识猫AI实验室) — Сообщил о более чем 2 000 GitHub Stars у открытого «Hand-drawn Video Skill» (story-to-handdrawn-video; 103 лайка) и поделился изменениями после месячного обновления.
  • @so_ainsight — Еженедельная подборка быстрорастущих AI-репозиториев GitHub (573 лайка, ~49 000 просмотров). Это не только об изображениях и видео, но в контексте даёт представление о динамике OSS-ИИ.
Posts
Закрытые решения (Opus 5.5 / Grok 4.7)
  1. #1 @riku720720 — 173 лайка · 19 репостов · 1 ответ · около 19 000 просмотров · 2026-09-22. https://x.com/riku720720/status/2102515055116063144

    opus 5.5、本当にやばすぎる... 5分もかからずこのピクセルアニメーション出してきやがった。
    Суть поста — удивление скорости: пиксельная анимация создана одним заходом менее чем за пять минут.

  2. #2 @NFT_Chen — 151 лайк · 20 репостов · 13 ответов · около 40 000 просмотров · 2026-09-22. https://x.com/NFT_Chen/status/2102455102896509431

    This isn't drawn by a human! Claude Opus 5.5 used code to hand-draw this animation frame by frame. ... 32 seconds, all generated by AI.
    Удивляет сам подход: покадровая анимация под ручную рисовку, созданная с помощью кода.

  3. #3 @cherry_mx_reds — 373 лайка · 17 репостов · 10 ответов · около 36 000 просмотров · 2026-09-21. https://x.com/cherry_mx_reds/status/2102493303388475855

    Opus 5.5 one-shot this animation in 14m and 48s "Oktoberfest" by Opus 5.5
    Подчёркивается «one-shot» — генерация одним запросом — и конкретное время: 14 минут 48 секунд.

  4. #4 @chetaslua — 435 лайков · 23 репоста · 10 ответов · около 20 000 просмотров · 2026-09-22. https://x.com/chetaslua/status/2102501773705670994

    Interactive video gen in whatever art style you want by @claudeai Opus 5.5 coded no assets, mcp, skill, only js
    Техническая демонстрация, акцентирующая лёгкость реализации: интерактивное видео в любом стиле, только JavaScript, без ассетов, MCP и навыков.

  5. #17 @AbhinavXJ — 57 лайков · 2 репоста · 2 ответа · около 3 200 просмотров · 2026-09-22. https://x.com/AbhinavXJ/status/2102473742723260606

    they said pace the frontier and now we have Grok 4.7 Claude Opus 5.5 GPT-6 sol and luna in span of 2 days
    Реакция не на одну модель, а на скорость отрасли: за два дня появились сразу несколько крупных моделей.

  6. #19 @cherry_mx_reds — 1 636 лайков · 215 репостов · 127 ответов · около 410 000 просмотров · 2026-09-21.
    https://x.com/cherry_mx_reds/status/2102098340699668865

    Grok 4.7 made this in blender. I didn't tell it what to make but only that it should be something it can accomplish in 10 minutes or so.
    Самый вовлекающий пост об AI-демонстрации в выборке. Новизна в том, что речь идёт о 3D-генерации в Blender.

  7. #18 @old_pgmrs_will — 8 лайков · 0 репостов · 0 ответов · около 611 просмотров · 2026-09-21. https://x.com/old_pgmrs_will/status/2102182047989338264

    Grok 4.7 で自分で使うためのフォトレタッチアプリを生成。ついでに実際の操作を実演するための自動デモ機能も実装させた
    Практический кейс: генерация приложения для личной ретуши фотографий с автоматической демонстрацией работы.

  8. #20 @old_pgmrs_will — 8 лайков · 0 репостов · 0 ответов · около 599 просмотров · 2026-09-22. https://x.com/old_pgmrs_will/status/2102376309020299517

    海外勢を中心に?「Grok-4.7 使えねぇ」みたいな投稿を散見するが、アンチか使いこなせてないかのどちらか
    На фоне критических постов о том, что Grok 4.7 «непригоден», автор возражает: у него успешно улучшается UI/UX приложения для видеомонтажа. Оценки расходятся.

Открытый исходный код
  1. #33 @shinshin86 — 586 лайков · 59 репостов · 2 ответа · около 28 000 просмотров · 2026-09-21. https://x.com/shinshin86/status/2102163713679577301

    静止画からPSDを作れるAIツール『Still2Rig PSD』、GitHubスターが60を超えました...CodexなどのAIエージェントに画像を渡して依頼すると、Google Colab上でSee-throughを動かしてレイヤー分けし、PSDの組み立てまで進めてくれます
    Индивидуальный OSS-инструмент достиг более 60 Stars на GitHub. Отличительная особенность — интеграция с AI-агентами.

  2. #34 @ishitaku39 — 226 лайков · 22 репоста · 3 ответа · около 9 800 просмотров · 2026-09-21. https://x.com/ishitaku39/status/2102038146489946532

    キャラの動きを、コメントに合わせてリアルタイムで生成できた…!自作AITuberに「ARDY Mini」を組み込んでみた。NVIDIAの研究モデル「ARDY」を、個人開発者の方がブラウザで動くまで軽量化した派生版です。
    Пример практического применения сообществом OSS: облегчённая производная исследовательской модели NVIDIA работает прямо в браузере.

  3. #35 @GeekCatX — 103 лайка · 18 репостов · 4 ответа · около 7 800 просмотров · 2026-09-22. https://x.com/GeekCatX/status/2102336276230025224

    Hand-drawn Video Skill has been updated again! ...the GitHub Stars for story-to-handdrawn-video have now exceeded 2,000. This time, the focus is on adding more art styles
    Открытый проект story-to-handdrawn-video превысил 2 000 Stars; главная особенность обновления — добавление художественных стилей.

  4. #36 @so_ainsight — 573 лайка · 75 репостов · 6 ответов · около 49 000 просмотров · 2026-09-21.
    https://x.com/so_ainsight/status/2101871551255830529

    今週GitHubで急上昇したAIリポジトリ10選:1. OpenCodeReview...
    Еженедельная подборка быстрорастущих AI-репозиториев GitHub. Она не ограничивается изображениями и видео, но показывает импульс OSS-среды.

Signals
  • Рост: личные демонстрации того, как Claude Opus 5.5 и Grok 4.7 генерируют видео/анимацию быстро и с низкими затратами одним запросом, стабильно набирают вовлечение. Особенно по Opus 5.5 несколько независимых аккаунтов (@riku720720, @NFT_Chen, @cherry_mx_reds, @chetaslua) почти одновременно, 21–22 сентября 2026 года, публиковали разные демо; это похоже на волну верификации сразу после релиза.
  • Недооцениваемое / вызывающее разногласия: по Grok 4.7 соседствуют восторг (3D-генерация в Blender, ~410 000 просмотров) и критика («непригоден»), на которую @old_pgmrs_will отвечает собственными контрпримерами. Это не однозначная волна восхищения.
  • Неожиданное: на открытой стороне заметны посты японских индивидуальных разработчиков (@shinshin86, @ishitaku39, @GeekCatX), подчёркивающие число GitHub Stars. Вместо корпоративных объявлений чаще встречаются истории о том, как люди комбинируют существующие исследовательские модели и AI-агентов, превращая их в практические инструменты.
  • Ещё одно неожиданное наблюдение: из десяти поисковых слов X только «Opus 5.5», «Grok 4.7» и «GitHub» относились к генерации изображений и видео. Остальные семь (#chance, England, #sweepstakes, #giveaways, Lauren, $SONG, Jesus) были трендовыми словами Explore, не связанными с темой.
Limits
  • Из 10 поисковых слов #chance (романтическое реалити-шоу ABEMA), England (разговоры о погоде и футболе), #sweepstakes (конкурсы, например в приложении Fanatics), #giveaways (конкурсные посты вокруг индийских праздников), Lauren (скандал вокруг R&B-певицы и бразильская теленовелла «Estrelas da Casa»), $SONG (криптотокен в Cardano) и Jesus (религиозный контекст, критика игровой индустрии, футбольные трансляции) никак не связаны с ИИ для изображений и видео. На них приходится более 20 из 40 собранных постов. Вероятно, это механические результаты поиска по трендам Explore самой X и содержательных сигналов по теме в них нет.
  • Собственный список Explore trends X на сервере этой сессии содержал «Trending in Croatia» и был ориентирован на хорватские региональные тренды. Его нельзя представлять как мировую повестку; возможно, оттуда и пришли нерелевантные запросы.
  • Постов, непосредственно относящихся к теме, всего 11: 4 об Opus 5.5, 4 о Grok 4.7 и 3 об открытых инструментах GitHub. Этого недостаточно, чтобы на основании одних только постов X выполнить требование брифа о минимум десяти наблюдениях для закрытого и открытого сегментов; нужны результаты с других платформ.
  • В поисковых словах и собранных данных X не встречались OpenAI (GPT-6/Sora), Midjourney, Stable Diffusion, Runway и другие крупные игроки. Реакцию X на них в этом запуске подтвердить нельзя.

YouTube

YouTube — Последние новости ИИ для генерации изображений и видео (закрытый / открытый исходный код)

Channels
  • OpenAI (официальный канал) — официальные анонсы Sora 2 и ChatGPT Images 2.5.
  • Google / Google DeepMind (официальные каналы) — анонсы серии Gemini «Nano Banana».
  • Adobe (официальный канал) — анонсы мульти-модельной стратегии Firefly.
  • Runway (официальный канал) — анонсы Gen-4.5 и MCP-сервера.
  • Lev Selector — личный канал с еженедельными сводками AI-новостей (серия "Exciting AI Updates Weekly").
  • Авторы туториалов по ComfyUI / Stable Diffusion (например, каналы, связанные с программой "AI on the Lot", и авторы разборов рабочих процессов ComfyUI) — массово выпускают руководства по локальному запуску открытых Wan, LTX, Flux, HunyuanVideo и других моделей.
  • Каналы сравнений и обзоров (множество заголовков вида "Best AI Video Generator") — регулярно сравнивают Sora 2 / Seedance 2.0 / Runway / Kling.
  • Число подписчиков не удалось установить: HTML страниц требует JavaScript-рендеринга, а поисковые сниппеты этих данных не содержат (см. ## Limits).
Videos
Закрытые решения
  1. Introducing Sora 2 — официальный OpenAI / 2025-09-30 / https://www.youtube.com/watch?v=gzneGhpXwjU — Билл Пиблс, Рохан Сахаи и Томас Димсон представляют Sora 2 и новое приложение Sora: новое поколение видеомодели с физической правдоподобностью и синхронизацией реплик.
  2. OpenAI Abandons Sora to Refocus on Enterprise Solutions — аналитический канал / около марта 2026 / https://www.youtube.com/watch?v=bIL7uU4CYnE — Разбор планов OpenAI закрыть приложение Sora 26 апреля 2026 года и API 24 сентября 2026 года, то есть на следующий день после исследования. Пересказывается сообщение о расходах около 1 млн долларов в день и суммарной выручке от подписок лишь 2,1 млн долларов.
  3. OpenAI Shuts Down Sora & Kills ChatGPT Integration Plans | What Happened? — аналитический канал / примерно март–апрель 2026 / https://www.youtube.com/watch?v=9rhmczPT6Jk — В качестве фона закрытия Sora объясняется, что партнёрство с Disney, оценивавшееся примерно в 1 млрд долларов, сорвалось непосредственно перед объявлением о завершении Sora.
  4. Introducing ChatGPT Images 2.5 — официальный OpenAI / около 2026-09-08 / https://www.youtube.com/watch?v=6l7ble9P74o — Анонс GPT Image 2.5 (ChatGPT Images 2.5): генерация на 50% быстрее прежней и новая функция «Sketch», превращающая нарисованный от руки эскиз в изображение.
  5. Sketch with ChatGPT Images 2.5 — официальный OpenAI / сентябрь 2026 / https://www.youtube.com/watch?v=imPtIEAEHSU — Демонстрация: ввести «@Sketch», нарисовать эскиз прямо в ChatGPT и сразу превратить его в AI-изображение.
  6. The New Gemini Image Generator is Insane (Nano Banana 2) — обзорный канал / 2026-02-27 / https://www.youtube.com/watch?v=nikIxHM_AQY — Обзор перехода Google на «Nano Banana 2» в качестве стандартной модели генерации изображений в приложении Gemini.
  7. Midjourney Update | March 2026: V8 Alpha, BIG Changes Coming, New Edit Model + More — канал о Midjourney / около марта 2026 / https://www.youtube.com/watch?v=TZ1zWvbXFug — Анонс альфа-версии V8, ставший началом последующих обновлений: V8.1 (2026-04-14), затем V8.2 (улучшения качества и персонализации; модель редактирования открыта всем пользователям 2026-08-27).
  8. Kling 3.0: the biggest advancement in AI video generation? — обзорный канал / первая половина 2026 / https://www.youtube.com/watch?v=G1VHCrl4jy4 — Тест Kuaishou «Kling 3.0», представленного как первая модель, генерирующая видео в нативных 4K и 60fps и возглавившая видеорейтинг Artificial Analysis.
  9. Grok Imagine 1.5 Preview - Mind-Blowing AI Video Just Dropped 🔥 | xAI — обзорный канал / 2026-06-03 / https://www.youtube.com/watch?v=grxiFAC-NNI — Проверка предварительной версии Grok Imagine 1.5 от xAI.
  10. Sora 2 vs. Seedance 2.0 vs. Runway: The 2026 AI Video War Explained — сравнительный канал / 2026-02-13 / https://www.youtube.com/watch?v=rb0p_mY3tPs — Сравнение Sora 2, Seedance 2.0 от ByteDance и Runway.
  11. Runway Ships an MCP Server - Generate Video From Inside Claude, ChatGPT, Cursor and Replit — официальный Runway / около 2026-05-27 / https://www.youtube.com/shorts/t9Bg_4rOQqM — Runway объявляет MCP-сервер, позволяющий напрямую генерировать видео из Claude, ChatGPT, Cursor и Replit.
Открытый исходный код
  1. Now that Wan 2.5 (open source model from Alibaba China) can do AI dialogues, AI Lip Syncing to... — аналитический канал / первая половина 2026 / https://www.youtube.com/watch?v=kzXNJO6caGw — Рассказ о том, что открытая модель Alibaba Wan 2.5 получила генерацию диалогов и липсинк.
  2. Wan2.6: Multi-shot Storytelling & Cinematic Shot Control — канал туториалов / конец 2025 — начало 2026 / https://www.youtube.com/watch?v=VHJ925WoWgw — Объяснение «мультикадрового сторителлинга» Wan 2.6: один промпт может создать кинематографическое видео до 15 секунд из нескольких кадров.
  3. Black Forest Labs: FLUX 2 – The King of AI Image Generation — обзорный канал / 2026-06-04 / https://www.youtube.com/watch?v=WZfKzzX65-o — Проверка FLUX.2 от Black Forest Labs.
  4. FLUX.2 Just Beat Every AI Image Model — Black Forest Labs' Most Powerful Release Yet — обзорный канал / 2025-11-27 / https://www.youtube.com/watch?v=VMBSUBKON_U — Утверждается, что FLUX.2 превосходит существующие модели изображений по качеству, контролю и консистентности.
  5. Qwen Image-2512 First Test – The BEST Open Source Image Model! — обзорный канал / 2026 / https://www.youtube.com/watch?v=SBaK616nP6Q — Проверка новейшей линии Alibaba Qwen-Image-2.1: текстовый рендеринг, редактирование и генерация прозрачных изображений в одной системе; генеративная часть — 7 млрд параметров.
  6. HunyuanVideo 1.5 vs Wan 2.7 Comparison: Which is The Best Free Local Video AI Generation Model? — сравнительный канал / 2026 / https://www.youtube.com/watch?v=4GNT4-QYekg — Локальное сравнение HunyuanVideo 1.5 от Tencent (8,3 млрд параметров, работа на потребительских GPU) и Wan 2.7 от Alibaba.
  7. LTX 2 Full Tutorial | Run on Low VRAM PC + Video & Audio AI Generation (2026 Strongest Open-Source?) — канал туториалов / 2026 / https://www.youtube.com/watch?v=ytxbq9ZSgxo — Руководство по запуску LTX-2 от Lightricks на ПК с малым объёмом VRAM. LTX-2 полностью открыт в январе 2026 года; в марте появился LTX-2.3 с настольным редактором видео.
  8. Best Open-Source AI Video in 2026: WAN 2.2 vs LTX 2.3 — сравнительный канал / 2026 / https://www.youtube.com/watch?v=ZZ5VH-rqHXQ — Сравнение двух ведущих открытых видеосистем: Wan 2.2 и LTX 2.3.
  9. Inpaint Canvas for ComfyUI: Krita-Style Layers, Colour Match & Retouch in One Node — канал о ComfyUI / начало сентября 2026 (опубликовано две недели назад) / https://www.youtube.com/watch?v=Lz7AT8SByx8 — Обзор открытого пользовательского узла ComfyUI «Inpaint Canvas», опубликованного 5 сентября 2026 года. Он поддерживает слои, выделения, выделение с помощью SAM, экспорт PSD и превращает ComfyUI в полноценный инструмент рисования.
Signals
  • Главная новость закрытого сегмента — завершение Sora 2: Sora 2 была громко представлена в конце сентября 2025 года, но приложение закрывается всего через полгода (2026-04-26), а API должен прекратить работу уже на следующий день после даты исследования — 2026-09-24. Несколько аналитических роликов YouTube пересказывают информацию о расходах около 1 млн долларов в день при суммарной выручке лишь 2,1 млн долларов. Партнёрство с Disney, оцениваемое в 1 млрд долларов, также сорвалось незадолго до объявления о закрытии Sora.
  • Генерация изображений: Google, OpenAI и Midjourney обновляются без пауз: Nano Banana 2 (Gemini, 2026-02), GPT Image 2.5 / ChatGPT Images 2.5 (2026-09-08, добавлен Sketch), Midjourney V8 → V8.1 → V8.2 (2026-03–08, модель редактирования открыта всем пользователям) — закрытые игроки продолжают выпускать новые модели каждые несколько месяцев.
  • Сравнительный контент о «войне» видеогенераторов стал стандартом: огромное число видео и Shorts ставит рядом Sora 2 / Seedance 2.0 / Runway Gen-4.5 / Kling 3.0 / Grok Imagine. Это показывает, что зрителей интересует уже не приверженность конкретному инструменту, а определение «кто сейчас лучший».
  • Главные открытые игроки — Alibaba (Wan), Tencent (HunyuanVideo), Black Forest Labs (FLUX) и Lightricks (LTX): модели доступны через Hugging Face/GitHub, а туториалы по запуску через ComfyUI и на локальных GPU выпускаются массово. Wan быстро расширяет возможности от диалогов и липсинка к мультикадровой съёмке (2.5 → 2.6).
  • Экосистема ComfyUI закрепилась как «коммутационная панель» генеративного ИИ: только в сентябре 2026 года один за другим появились Core Sparse Attention Node, Comfy Compiler, Inpaint Canvas, MiniMax H3 RefMods, Krea2T Enhancer и другие узлы. ComfyUI всё заметнее как промежуточный слой, который превращает открытые модели в производственный процесс.
  • Adobe Firefly становится интеграционным хабом для обеих сторон: помимо собственных моделей, он объединяет в одном рабочем пространстве более 30 внешних моделей, включая Runway Gen-4.5, Google Nano Banana Pro, генерацию изображений OpenAI и Black Forest Labs FLUX.2 [pro]. Выбор смещается от одного инструмента к грамотному сочетанию нескольких и в корпоративном сегменте.
  • Значительную долю занимают агрессивно рекламные обзоры и сравнения: заголовки вроде "BEST AI Image Generator in 2026 (Don't Choose Wrong!)" заполонили выдачу. Выбор модели сам превратился в контент, иногда важнее реальной технической информации.
Limits
  • Страницы результатов и видео YouTube требуют JavaScript-рендеринга, и WebFetch не смог получить реальные просмотры, число подписчиков и даты публикации из HTML; возвращался только футер. Поэтому использовались лишь даты и описания из поисковых сниппетов, а точные просмотры в отчёт не включены.
  • Для части роликов (о Wan 2.6, сравнении HunyuanVideo и других) в поиске указан лишь 2026 год без месяца, поэтому нельзя строго подтвердить соответствие критерию «в течение 60 дней». Приоритет отдан явно свежим материалам: новости об остановке Sora API, ChatGPT Images 2.5, Inpaint Canvas и другим.
  • Не удалось найти официальный ролик YouTube, который сообщал бы о закрытии Sora API 2026-09-24; доступны только последующие объяснения аналитических каналов.
  • Японские каналы и ролики в этой поисковой выборке не попали в верхние результаты; информация в основном англоязычная.

Bluesky

Bluesky — Последние тенденции ИИ для генерации изображений и видео

Accounts
  • @stabilityai.bsky.social — официальный Stability AI. Однако во второй половине 2025 года публикации в основном посвящены Stable Audio и корпоративным партнёрствам, а не моделям изображений; лайков почти нет.
  • @midjourneyofficial.bsky.social — официальный Midjourney. В августе 2025 года аккаунт объявил о появлении в Bluesky, но последние публикации датированы 8 октября 2025 года; свежих новостей нет.
  • @promptheroofficial.bsky.social — официальный PromptHero, сервис обмена промптами. Публикует информацию о доступности закрытых моделей вроде Sora 2.
  • @ethanhe.bsky.social — инженер команды Grok Imagine в xAI, ранее работавший в NVIDIA/Meta. Один из немногих инсайдеров, напрямую публикующий обновления Grok Imagine и вакансии.
  • @chorizemabang.bsky.social — японский пользователь Grok Imagine, публикующий отчёты о проблемах и недовольстве из реального опыта.
  • @metalmickey.bsky.social(澤村徹) — художник из Токио, создающий музыкальные видео и выставочные работы, сочетая Seedance 2.5, GPT-6 и Suno V6; сообщает реальные производственные затраты.
  • @you32081.bsky.social — автор, массово создающий R-18-иллюстрации с открытыми Qwen-Image, Z-Image-Turbo и другими моделями.
  • @lijack1001.bsky.social — SEO-спам-аккаунт, массово публикующий клоны/аффилиатные сайты под Nano Banana Pro, Seedance, Sora 2, Veo 3, Wan, GPT-5 Image и другие названия. Это не источник новостей, но он показывает, какие названия считаются коммерчески выгодными ключевыми словами.
  • @runwayml.bsky.social / @blackforestlabs.bsky.social / @comfy-ui.bsky.social — официальные аккаунты Runway, Black Forest Labs и ComfyUI существуют, но почти пусты либо содержат только один недавний пост 2024 года; фактически неактивны.
Posts
  1. PromptHero: «Sora 2 is now available on Prompthero: No watermarks, Available in Europe, Combine it with other models» — 2025-10-13, 0 лайков / 0 репостов. Пост
    Закрытый сегмент. Показывает, что сторонний сервис промптов перепродаёт Sora 2 как «без водяных знаков, доступно в Европе, можно сочетать с другими моделями».
  2. xAI / Ethan He: «Excited to share our most advanced image generation model at xAI! Grok Imagine Quality mode — enhanced details, stronger text rendering...» — 2026-04-05, 0 лайков / 0 репостов. Пост
    Закрытый сегмент. Официальный инженер объявляет Quality mode для Grok Imagine, с улучшенной детализацией и текстовым рендерингом.
  3. xAI / Ethan He: вакансия видеотренера «familiarity with AI video generation tools (Grok Imagine, Runway, Kling, Sora, Veo, or similar)» — 2026-03-29. Пост
    Закрытый сегмент. Свидетельство, что xAI вкладывается в людей для подготовки данных видеомодели; Runway/Kling/Sora/Veo прямо названы конкурентными ориентирами.
  4. @chorizemabang: «Grok Imagineマジで全然生成できなくなっちゃったけどじっくり1日1作品作るのも趣があるな。」 — 2026-06-05, 13 лайков / 1 репост. Пост
    Закрытый сегмент. Пользователь сообщает, что Grok Imagine практически перестал генерировать.
  5. @chorizemabang: «Grok Imagineが終わってしまってるのでお詫びに過去作を…» — 2026-05-31, 11 лайков / 1 репост. Пост
    Закрытый сегмент. Вместе с предыдущей публикацией подтверждает проблемы со стабильностью Grok Imagine в мае–июне.
  6. @metalmickey: «road movie rain version. Stitched Seedance2.5's 30-second clips. Fees are devastating.» — 2026-08-27. Пост
    Закрытый сегмент. Практическая работа: около пяти минут AI-роуд-муви, собранного из 30-секундных клипов Seedance 2.5, и жалоба на разрушительно высокие цены.
  7. @metalmickey: «Attempted creating music video entirely AI-delegated without writing a single prompt line. GPT-6 Astra enables voice-directed workflow.» — 2026-09-07. Пост
    Закрытый сегмент. Пример нового процесса: музыкальный клип, полностью делегированный ИИ без написания промптов, через голосовые инструкции GPT-6 Astra.
  8. Stability AI: «We're launching our Stability AI Image Services on Amazon Bedrock, bringing professional-grade image editing capabilities...» — 2025-09-18, 0 лайков / 0 репостов. Пост
    Ближе к закрытому API-сегменту. Сервис профессионального редактирования изображений (инпейтинг/перенос стиля) предлагается в AWS Bedrock.
  9. Официальный Midjourney: «#Midjourney is now on BlueSky! Who are the best creators to follow here?» — 2025-08-15, 41 лайк / 4 репоста. Пост
    Midjourney сам закрытый, но после этой публикации почти перестал писать в Bluesky; пример входа на платформу без закрепления.
  10. @you32081: R-18 AI-иллюстрации с Qwen-Image / Z-Image-Turbo — 2026-08-01, 6 лайков / 0 репостов. Пост
    Открытый сегмент. Пример того, как китайские открытые модели Qwen-Image и Z-Image-Turbo закрепляются в реальном творческом процессе в среде додзинси и R-18.
Signals
  • В Bluesky нет сильного специализированного хаба «новостей ИИ для изображений и видео». Официальные Midjourney, Stability AI, Runway, Black Forest Labs и ComfyUI почти не публикуют свежих постов или получают 0–несколько взаимодействий; фактически они неактивны. Площадка не стала местом оперативных обсуждений, как X или Reddit.
  • Новости закрытых решений появляются лишь через личные аккаунты инсайдеров компаний. Единственный стабильно активный источник — инженер Grok Imagine из xAI Ethan He (@ethanhe.bsky.social), публиковавший в марте–апреле 2026 года о Quality mode и найме видеотренеров.
  • Есть признаки нестабильности Grok Imagine в мае–июне 2026 года. Японский пользователь @chorizemabang несколько раз писал, что генерация перестала работать и продукт «закончился» (2026-05-31, 2026-06-05), хотя в апреле xAI только что объявляла об улучшениях. Возможно, операционная инфраструктура не успевала за быстрым ростом.
  • Наиболее заметен Seedance 2.5 в рабочих логах. Художник из Токио @metalmickey в августе 2026 года создал примерно пятиминутное AI-роуд-муви из клипов Seedance 2.5 и неоднократно жаловался на высокую стоимость — характерная проблема платного API-сегмента.
  • Открытые проекты (Flux, Wan, Qwen-Image, Z-Image-Turbo, HunyuanImage, ComfyUI) упоминаются не в новостных публикациях, а лишь фрагментарно в хештегах личных AI-арт-постов R-18/додзинси. В Bluesky не найдено специализированного новостного источника уровня r/StableDiffusion.
  • Много аффилиатного/SEO-спама, использующего названия моделей. Аккаунты вроде @lijack1001 механически публикуют ссылки на клоны сайтов с названиями Nano Banana Pro, Seedance 2.0, Sora 2, Veo 3, Wan 2.2, GPT-5 Image и т. п. Это может косвенно показывать поисковый спрос, но как новостной источник бесполезно.
  • Nano Banana Pro (генерация изображений Google) часто упоминается в среде R-18/AI-арта. Встречается в хештегах и описаниях наряду с Ideogram 4 и Krea 2, что указывает на закрепление среди используемых коммерческих инструментов.
Limits
  • Официальный API полнотекстового поиска Bluesky (app.bsky.feed.searchPosts) на все тестовые запросы (Stable Diffusion, Midjourney, Flux, test и др.) неизменно возвращал HTTP 403 и ни разу не сработал. app.bsky.actor.getProfile, app.bsky.actor.searchActors и app.bsky.feed.getAuthorFeed работали, поэтому исследование ограничилось поиском аккаунтов и чтением их лент.
  • Веб-версия bsky.app — SPA с клиентским рендерингом; при получении страницы возвращалась пустая оболочка, поэтому приходилось обращаться к публичному JSON API напрямую.
  • Без полнотекстового поиска высока вероятность пропуска неизвестных релевантных аккаунтов. В частности, невозможно отделить ситуацию «специализированных новостных аккаунтов об открытых моделях нет» от ситуации «их не удалось обнаружить из-за ограниченного способа поиска».
  • Были изучены официальные аккаунты Stability AI, Midjourney, Runway, Black Forest Labs и ComfyUI, но у них не оказалось свежих новостей об ИИ для изображений/видео. Это характеризует Bluesky, а не наличие или отсутствие обсуждений на других платформах.

Lemmy

Lemmy — Новости ИИ для генерации изображений и видео (открытый / закрытый исходный код)

Lemmy — небольшая децентрализованная форумная платформа. Разговоры об AI-изображениях в основном сосредоточены в !«メールアドレス» и вокруг него, а также в !«メールアドレス», зеркале r/ArtificialInteligence, куда бот автоматически переносит посты Reddit. Для межплатформенного исследования использовались поисковый API lemmy.world (/api/v3/search) и веб-поиск по запросам «image generation», «video generation», «Stable Diffusion», «Flux», «Qwen Image», «Sora», «Midjourney», «Nano Banana», «Grok Imagine», «ComfyUI» и другим.

Communities
  • !«メールアドレス» — 5 713 подписчиков. В основном технические посты об открытых моделях изображений/видео и ComfyUI.
  • !«メールアドレス» — 2 361 подписчик. Преимущественно обмен готовыми генерациями, новости встречаются редко.
  • !«メールアドレス» — ежедневно публикует множество аниме-подобных генераций через civitai; это посты работ, а не новости.
  • !«メールアドレス»(Free Open-Source AI) — 4.84K подписчиков (из них 1.81K локальных). Посвящено открытому ИИ в целом; постов именно об изображениях/видео немного.
  • !«メールアドレス» — автоматическое зеркало r/ArtificialInteligence. Это не собственные обсуждения Lemmy, а перепечатки Reddit.
  • !stable_diffusion_abstraction(50 человек)/!stable_diffusion_furry(52 человека)/!stable_diffusion_mycology(97 человек) — нишевые сообщества работ с небольшим числом подписчиков.
Posts
Ближе к открытому исходному коду
  1. Qwen-Image-2.1 in ComfyUI: Open-Weight Image Generation and Editing, Now with Transparency
    !«メールアドレス», 2026-09-22, score 9
    https://blog.comfy.org/p/qwen-image-21-in-comfyui-open-weight
    Открытая модель генерации/редактирования изображений команды Alibaba Qwen с 7 млрд параметров. Поддерживает RGBA с прозрачностью для логотипов и вырезанных объектов, нативное разрешение 2048×2048, до 10 референсных изображений и нативную интеграцию с ComfyUI.

  2. Qwen-Image-2.1: Compact, efficient, and unified image creation
    !«メールアドレス», 2026-09-20, score 1
    https://qwen.ai/blog?id=qwen-image-2.1
    Анонс из официального блога Qwen, первичный источник предыдущего материала ComfyUI.

  3. supElement/ComfyUI_MinimaxH3_AutoContext: A long video generation solution that breaks through the memory barrier
    !«メールアドレス», 2026-09-16, score 1
    https://github.com/supElement/ComfyUI_MinimaxH3_AutoContext
    Расширение ComfyUI для MiniMax H3. Автоматически разбивает видео на сегменты и соединяет их latent-якорями, обходя ограничения VRAM при длинной генерации. Apache-2.0, 31 star, 153 коммита.

  4. Adudeguyman/ComfyUI-Fantastic-MiniMaxH3-PromptBuilder
    !«メールアドレス», 2026-09-16, score 3
    https://github.com/Adudeguyman/ComfyUI-Fantastic-MiniMaxH3-PromptBuilder
    Ещё один инструмент для MiniMax H3 — билдер промптов для ComfyUI. Пример активных обновлений окружающей экосистемы локальных видеопроцессов.

  5. Boogu-Image-0.1 — Efficient Image Generation Foundation Model
    !«メールアドレス», 2026-06-17, score 5
    https://boogu.org/
    Публикация новой открытой фундаментальной модели изображений с акцентом на лёгкость и эффективность.

  6. AI video generation is becoming less about the model and more about the workflow
    !«メールアドレス» (перепечатка Reddit), 2026-09-19, score 1
    https://www.reddit.com/r/ArtificialInteligence/comments/1wkl4db/
    Пост о том, что качество видеогенерации всё больше определяется не отдельной моделью, а построением процесса из открытых весов и рабочих схем уровня ComfyUI.

Ближе к закрытому исходному коду
  1. OpenAI is shutting down Sora's API next week while a Chinese competitor raised $3B
    !«メールアドレス» (перепечатка Reddit), 2026-09-20, score 1
    https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/
    История о том, что OpenAI останавливает Sora 2 API 24 сентября (приложение закрылось ещё в апреле), в контрасте с привлечением Kuaishou (Kling) 3 млрд долларов. Тезис поста: громкие потребительские продукты терпят неудачу, а прибыль приносят неброские корпоративные сценарии.

  2. Midjourney pivots from AI image generation to body scanning medical spa (фоновый материал о крупном июньском повороте, влияние которого продолжается)
    !«メールアドレス», 2026-06-18, score 58
    https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-to-medical-devices/
    Сообщение о крупном повороте Midjourney от AI-изображений к бизнесу медицинского оборудования, включая ультразвуковые КТ-сканеры. В !«メールアドレス» есть также посты "Midjourney Medical" и "Midjourney Ultrasonic CT Scanner" от той же даты.

  3. Midjourney wants Hollywood studios to reveal the details of their AI usage
    !«メールアドレス», 2026-07-05, score 73
    https://techcrunch.com/2026/07/04/midjourney-wants-hollywood-studios-to-reveal-ai-usage/
    Продолжение: даже после медицинского поворота Midjourney конфликтует с Голливудом вокруг авторских прав и практик использования ИИ для изображений/видео.

  4. Google lanciert KI-Bildgenerierung Nano Banana 2 Lite
    !«メールアドレス», 2026-07-02, score 0
    https://www.itmagazine.ch/artikel/87529/
    Швейцарская технологическая новость о выпуске Google модели генерации изображений Gemini «Nano Banana 2 Lite». В !«メールアドレス» также был пост со ссылкой на первоисточник deepmind.google (2026-06-30).

  5. Seedream 5.0 Pro is here: an honest comparison and technical breakdown
    !«メールアドレス» (перепечатка Reddit), 2026-07-10, score 1
    https://www.reddit.com/gallery/1usc03q
    Обзор и техническое сравнение закрытой модели ByteDance «Seedream 5.0 Pro».

  6. Google quietly discontinues its Earth AI feature a day after its rollout after users made no-no images
    !«メールアドレス» (перепечатка Reddit), 2026-08-07, score 1
    https://fortune.com/2026/08/07/
    Сообщение, что Google отозвал функцию «Earth AI» вскоре после запуска из-за создания проблемных изображений — пример проблем с ограничителями у закрытых вендоров.

  7. Elon Musk maakt complete AI-film met zijn versie van The Odyssey
    !«メールアドレス», 2026-07-22, score 1
    https://lemy.nl/post/4342454
    Нидерландская статья о том, как Илон Маск создаёт собственную интерпретацию фильма «Одиссея» с видеогенерацией Grok (xAI). Тема скорее маркетинговая и относится к закрытому сегменту.

  8. Same Berserk spread, 4 AI colorizations. Looks like GPT wins again?
    !«メールアドレス» (перепечатка Reddit), 2026-09-14, score 1
    https://www.reddit.com/gallery/1wfyqdy
    Сравнение раскраски одной страницы манги четырьмя ИИ, включая модель GPT; вывод автора — GPT выглядит сильнее.

Signals
  • Живые обсуждения ИИ для изображений/видео в Lemmy почти ограничены инструментами ComfyUI в !«メールアドレス» и зеркалом Reddit !ai_reddit. Оригинальных новостей, созданных именно в Lemmy, мало.
  • В открытом сегменте чаще обсуждаются не отдельные модели, а процессы и расширения ComfyUI. За последнюю неделю подряд появились два расширения для MiniMax H3, что указывает на активный слой практических видеопроизводственных инструментов.
  • В закрытом сегменте выделяются новости об уходе с рынка или разворотах: закрытие Sora API, медицинский поворот Midjourney, быстрый откат Google Earth AI. Историй о неудачной монетизации и коррекции курса больше, чем о громких запусках.
  • Сообщества обмена работами вроде !«メールアドレス» публикуют много изображений, но это в основном поток работ civitai без новостной ценности.
Limits
  • Масштаб Lemmy существенно меньше Reddit и X: даже у !«メールアドレス» всего 5 713 подписчиков. Собственных новостей недостаточно для целевого анализа ~20 материалов — площадка естественно укладывается в предусмотренный плейбуком диапазон «5–12».
  • !ai_reddit — не нативная дискуссия Lemmy, а автоматическая републикация Reddit с почти нулевым числом комментариев; реакцию самого сообщества Lemmy фактически наблюдать нельзя.
  • Эндпоинт /api/v3/community Lemmy часто требует community_id; некоторые сообщества (aiwars, отдельный поиск imageai и др.) возвращали 400/404 и проверялись лишь по веб-выдаче.
  • Поиск видеомоделей по отдельным словам («Wan», «HunyuanVideo», «Kling») даёт много шума из-за совпадения с обычными словами или сокращениями; отчётливо нативных постов Lemmy по ним найти не удалось.

Pinterest

Pinterest — Новости ИИ для генерации изображений и видео

Визуальные темы
  • Формат превью YouTube «AI NEWS»: удивлённые/восторженные бородатые авторы на фоне неоновых скруглённых логотипов OpenAI, Google, Microsoft, Meta и Notion, разложенных сеткой — самый повторяемый стиль пинов в наборе. [1, 8, 30]
  • SaaS-визуалы для инструментов AI-видеогенерации: тёмно-синие/фиолетовые UI-макеты со светящимся полем «текстовый промпт → сгенерировать» либо милый белый робот с кинохлопушкой, дополненные рядами иконок функций (Text to Video / AI Editing / Auto Soundtrack / Captions). [6, 11, 16]
  • Сравнительные таблицы «лучший инструмент» и рейтинг-листы: матрицы решений с неоновыми рамками и карточки «My Top Picks», сравнивающие ChatGPT Plus, Midjourney, Gemini, Ideogram, Kling, Runway, Luma, Pika по ценам и сценариям. [10, 20]
  • Визуальные предупреждения о дипфейках и дезинформации: красные штампы «FAKE», лупы над «?», морфинг глаза между человеком и каркасной моделью, бейдж «97% likely AI generated» для детекции голоса и надпись «AI GENERATED NEWS CLIP» поверх вымышленного ведущего. [4, 27, 38, 49]
  • Реклама приложений для замены лиц и смешения идентичностей: два лица, растворяющиеся в треугольной сетке («Professional Face Swap»), и триптих мама + папа → предсказанный ребёнок («AI Baby in Seconds»). [43, 44]
  • AI-причудливость как демонстрация стиля / приманка для вовлечения: фотореалистичная выдра в спасательном жилете на доске для сёрфинга, портрет старого рыбака и коллаж фантазийных изображений (замок, белый медведь, пара самураев, торт), показывающие качество генерации вместо новостей. [13, 34, 45]
  • Поясняющие инфографики простым языком: восьмишаговая схема «как ИИ создаёт видео» (промпт → понимание языка → латентное пространство → диффузия кадров → проверка согласованности → результат), рассчитанная на широкую аудиторию, а не разработчиков. [12]
  • Визуалы о трансформации редакций и экономике аватаров: коллаж диспетчерской, где экраны заполнены AI-ведущими, сетка стилизованных инфлюенсер-аватаров за одним фотореалистичным лицом и графика развилки «Human Journalism vs Machine-Generated Media». [38, 40, 23]
Примечательные пины
  • #1 — «AI News: Anthropic Leak Shows Us The Future of AI...»: типичное превью с шокированным автором и логотипами OpenAI/Google/Microsoft/ChatGPT; задаёт визуальный шаблон, который копируют многие другие пины «AI NEWS».
  • #3 — «Google announces ultra-high quality video...»: сетка 3×5, превращающая исходное видео в версии «из деревянных блоков / оригами / Lego / цветов» — конкретная демонстрация видеостилизации уровня Lumiere, а не просто заголовочная карточка.
  • #10 — «AI Image Video: Best Quality vs Best Free»: полная матрица решений (10 платных инструментов против 10 бесплатных и сценарии использования) — самый ясный артефакт тревоги «какой AI-инструмент мне вообще выбрать» в наборе.
  • #12 — «AI & Machine Learning: How AI Generates Video Infographic»: восьмишаговое объяснение диффузии/предсказания кадров от LivePhysics.com для новичков; подходящий пин, чтобы «объяснить это другу».
  • #27 — «AI is getting scary good»: объединяет генераторы видео, детекторы AI-голоса («97% likely AI generated») и AI-этику в одной инфографике — наиболее концентрированное выражение темы тревоги из-за дипфейков.
  • #38 — «AI News Anchors & Creator-Led Coverage Take Over U.S. Media»: коллаж редакции с AI-ведущими на стене мониторов — напрямую визуализирует вытеснение традиционных телеведущих.
  • #40 — нидерландоязычный «Het perfecte avatar-tijdperk» (идеальная эпоха аватаров): одно фотореалистичное лицо перед сеткой стилизованных AI-аватаров; отражает тренд AI-инфлюенсеров и многоязычное распространение темы в Pinterest.
  • #43 — Akool «Professional Face Swap» (испаноязычная реклама): лица двух женщин сливаются через лицевую сетку — коммерческий продукт face-swap продвигается непосредственно в Pinterest, а не просто обсуждается.
  • #44 — «AI Baby in Seconds»: триптих мама / предсказанный ребёнок / папа — самостоятельный быстрорастущий поджанр AI-генераторов детей, а не единичный пин.
  • #49 — «You Are Not Prepared for This Terrifying New Wave of AI-Generated Videos»: AI-сгенерированный фальшивый ведущий новостей с прямой внутрикадровой надписью «AI GENERATED NEWS CLIP» — самый прямолинейный предупреждающий пин в наборе.
Signals
  • Усталость от выбора инструментов — главный потребительский ракурс. Большая доля пинов — сравнительные таблицы, матрицы «лучшее бесплатное против платного» и карточки «мои лучшие выборы», а не новости одного релиза. Пользователи Pinterest ищут советы по покупке и внедрению, а не объявления. [10, 20, 29]
  • Тревога из-за дипфейков и дезинформации — самостоятельный визуальный жанр, а не примечание на полях: штампы FAKE, бейджи детекции голоса и метки AI-generated появляются почти так же часто, как рекламный контент инструментов. [4, 27, 38, 41, 49]
  • Тренд AI-новостных ведущих имеет заметную визуальную тягу: несколько независимых пинов — коллажи редакций, контент с брендом Channel1, метки «AI generated news clip» — рассматривают AI-ведущих как актуальное явление, а не гипотезу. [38, 49, 50]
  • Отсутствие: открытый исходный код почти невидим. Во всей выборке единственный явно локальный/открытый инструмент — AMD «Amuse 3.0» [34]. Скриншотов Stable Diffusion, ComfyUI и локальных интерфейсов нет, в отличие от сильного присутствия закрытых или близких к закрытым брендов (ChatGPT, Gemini, Midjourney, Kling, Runway, Luma) в логотипах и UI-макетах.
  • Отсутствие: прямых скриншотов новейших названных закрытых моделей тоже нет. В выборке не встретились нативные интерфейсы Sora 2, Nano Banana или Veo 3; большинство пинов о закрытом сегменте — аффилиатные/авторские превью, обсуждающие новости, а не сам продукт.
  • Предупреждение: пин #47 с заголовком «Elon Musk's New AI Already Being Used to Generate...» фактически показывает смонтированное изображение Дональда Трампа и женщины с поднятым большим пальцем в кабине самолёта, на фоне горящего Всемирного торгового центра; заголовок вообще не описывает картинку. Это конкретный пример реалистичного AI-монтажа катастрофы/политики, распространяемого с несоответствующим кликбейтным названием, и напоминание, что заголовкам пинов в этом наборе доверять нельзя.
Limits
  • В этом запуске не были определены жанры: использовался один неотфильтрованный запрос «Image and Video Generation AI News», поэтому среди 50 пинов смешаны авторские превью, рекламные материалы, стоковая фотография и псевдоновостные изображения.
  • Из 50 собранных картинок визуально открыли и изучили 26 — репрезентативную выборку с упором на разнообразие заголовков и тем, а не все 50. Выводы основаны на этой подвыборке.
  • Несколько заголовков не соответствовали изображениям, особенно #47 (см. Signals). Поэтому тематические выводы, построенные только по таблице названий, были бы ненадёжны; этот отчёт опирается на то, что реально изображено.
  • У пинов Pinterest в собранных данных нет метрик репинов/лайков. Поэтому о «трендовости» судят по повторяемости визуального стиля, а не по измеренной популярности.
  • Pinterest склоняется к вторичному и производному контенту — превью, заголовкам блогов, рекламным материалам — а не к первичным анонсам продуктов. Для подтверждения точных сведений о версиях Veo или Kling нужны первичные платформы, рассмотренные в других разделах.

Рекомендуемые действия

  • Отслеживать локальный OSS-стек видеогенерации (Wan, HunyuanVideo, FLUX.2, ComfyUI + MiniMax H3) как практическую альтернативу на фоне роста цен и закрытия продуктов у закрытых сервисов.
  • Опережая общественный запрос на раскрытие происхождения AI-контента, усиливающийся на Reddit и Pinterest, уже сейчас подготовить сообщения о происхождении/маркировке материалов.
  • После закрытия Sora 2 API 2026-09-24 наблюдать, куда перейдут пользователи; вероятные выгодоприобретатели — Kling, Seedance и Runway.
  • Считать волну демонстраций генерации одним запросом с Opus 5.5 / Grok 4.7 в X краткосрочным циклом ажиотажа в момент релиза, а не долговременной угрозой вниманию к OSS.
  • Наблюдать за проблемами масштабирования вычислений у DeepSeek как за ранним сигналом того, что происходит, когда внедрение открытых весов опережает инфраструктуру оператора.
  • Отвечать на заметную в YouTube и Pinterest усталость «какой инструмент выбрать?» сравнительным контентом, а не новостями об одном продукте.

Собранные изображения

AI News: Anthropic Leak Shows Us The Future of AI...🎨 AI Image and Video CreationGoogle announces ultra-high quality video...AI content and social media concernsJust Nail It 🎥How AI Video Generation Supports Modern Creative...Ai Content Creation Concept With Icons For Text Image Music And Video Generation Artificial Intelligence Images – Browse 66 Stock Photos, Vectors, and VideoGPT 5.2, realtime video editor, AI stereo videos, mobile AI agents, full body control: AI NEWSimageAI For Image And video GenerationBest AI Video Generators in 2026: Veo, Kling,...AI & Machine Learning: How AI Generates Video Infographic | LivePhysics™Free AI-Powered Visual Content Generation Platform – Viva AIAI Tool To Turn Text Into ImagesimageVeo 3 Image-to-Video: Fast Generation & Native Audio via Gemini APIAI Content Studio & Automation Secrets 🚀📱AI Image GenerationAI Lifestyle Video Creative | AI Video Production for Lifestyle BrandsKling.ai AI-Powered Text-to-Video GenerationimageimageNew York's Bold Gambit: Inside the Legislative...imageAmazon’s Nova AI models are here. These new multimodal models are designed to process text, images,AI‎🚨 AI is getting scary good.Google’s Gemini Omni Turns Anything Into VideoTop AI Video Generators of 2025AI News: OpenAI Finally Released What We Asked ForimageAI Image Generation and the Entertainment IndustryThe Secret Weapon for Content Creators: AI-Powered Video Generation'Amuse 3.0', an AI art creation tool that includes...AI-Generated Videos: Good or Bad? Here's the Truth! 🤖🎥Introducing Luma Dream Machine - Next Generation AI VideoAI news videos blur line between real and fake reportsAI News Anchors & Creator-Led Coverage Take Over U.S. Media!4 Major AI Updates You Need to Know in 2026Het perfecte avatar-tijdperk: De opmars van AI-influencers"Why AI Chatbots Fail at Keeping Up with Breaking News"AI NewsTransforma tus fotos y videos ¡Akool es la herramienta impulsada por IA que estabas esperando! 🚀7 Best AI Baby Generators: Predict Your Child's Face (2026)Stability AI’s Stable Diffusions Maker Can Now Build AI Generative VideoimageElon Musk's New AI Already Being Used to Generate...How Generative AI Will Reshape Every IndustryYou Are Not Prepared for This Terrifying New Wave of AI-Generated VideosAI Anchor by Channel1

Примечание о качестве данных

Только YouTube и Pinterest достигли приблизительной цели брифа в ~20 материалов; Reddit дал лишь 12 тредов (в основном нерелевантные общие сабреддиты), более половины 40 постов X были шумом от несвязанных трендовых слов, API полнотекстового поиска Bluesky постоянно возвращал 403, поэтому охват опирался лишь на известные аккаунты, а Lemmy просто слишком мала (главное сообщество ~5 713 подписчиков, половина постов — зеркала Reddit), чтобы собрать 20 нативных публикаций.

Галерея