Новости ИИ для генерации изображений и видео — 2026-09-23
Закрытые ИИ для изображений и видео резко сдают позиции (API Sora 2 закрывается 2026-09-24, Midjourney переходит к медицинским устройствам, цены Grok Imagine/Seedance вызывают негативную реакцию), тогда как инструменты с открытым исходным кодом вокруг ComfyUI (Wan, HunyuanVideo, FLUX.2, Qwen-Image, MiniMax H3) незаметно становятся стандартом для реальной производственной работы.
ИИ для генерации изображений и видео: открытые против закрытых — передовая невероятно горячая тема — 2026-09-23
Ну да, посмотрел — и сейчас правда очень интересный момент 🔥 Пока закрытые игроки (Sora 2, Midjourney, Grok Imagine и другие) громко выпускают новинки, за кулисами они активно сворачивают продукты, повышают цены и меняют курс; если честно, ощущение, что их начинает шатать 😳 А открытые проекты (Wan, FLUX.2, Qwen-Image, HunyuanVideo) собираются вокруг ComfyUI как хаба и, без лишнего шума, всерьёз проникают в реальные производственные процессы 💪 По материалам Reddit, X, YouTube, Bluesky, Lemmy и Pinterest отчётливо вырисовывается картина: «громкие новости — закрытые решения, практичная повседневная работа — открытые». Кроме того, всё громче звучат общественные требования обязательной маркировки AI-контента 📢
Межплатформенная картина
- На нескольких платформах подтверждается спад и смена курса у закрытых игроков. На YouTube рассказывали, что Sora 2 завершает работу приложения всего через полгода (2026-04-26), а API должен закрыться уже на следующий после исследования день — 2026-09-24; при операционных расходах около 1 млн долларов в день совокупная выручка от платных подписок составила лишь 2,1 млн долларов (https://www.youtube.com/watch?v=bIL7uU4CYnE). В Lemmy та же новость о закрытии Sora API распространялась через зеркало r/ArtificialInteligence (https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/) и сопоставлялась с привлечением китайской Kuaishou (Kling) 3 млрд долларов, поддерживая тезис: «зарабатывают именно неброские корпоративные решения».
- Открытый исходный код появляется повсюду как «рабочая инфраструктура» вокруг ComfyUI. Reddit (ComfyUI + FramePack для генерации видео даже на слабых ПК), Lemmy (за последнюю неделю два расширения ComfyUI для MiniMax H3), YouTube (массовые туториалы по локальному запуску Wan/HunyuanVideo/LTX) — на трёх платформах независимо всплывают ComfyUI и семейство Wan.
- Недовольство тем, что «всё стало слишком платным», направлено на закрытые сервисы. На Reddit появились сразу три треда о поиске бесплатного ИИ для генерации видео (из-за сокращения бесплатных лимитов закрытых продуктов), а на Bluesky художник из Токио неоднократно назвал стоимость Seedance 2.5 «devastating» (https://bsky.app/profile/metalmickey.bsky.social/post/3mu25rbs4dk2e).
- Пользователи устали от сравнений: «какой инструмент вообще выбрать?» На YouTube привычным форматом стали сравнения наподобие Sora 2 vs Seedance 2.0 vs Runway, а в Pinterest широко расходятся матрицы выбора «Best Quality vs Best Free» (YouTube: https://www.youtube.com/watch?v=rb0p_mY3tPs / Pinterest #10). Всё больше людей хотят знать не «во что верить», а «что сейчас сильнее».
- Недоверие к AI-контенту и настрой на обязательную маркировку общие для нескольких платформ. Тред Reddit с предложением законопроекта собрал 13 841 комментарий — с огромным отрывом больше всего обсуждений в этой выборке (https://www.reddit.com/r/CriticalState/comments/1wmktek/). В Pinterest изображения со штампом «FAKE» и бейджами детекции ИИ уже оформились в самостоятельный жанр.
По платформам
Reddit — Из 12 собранных тредов только 4 пришли из специализированных сообществ об ИИ для изображений и видео; остальные — из общих сабреддитов в духе «увидел AI-контент / это бесит». Постоянно звучит спрос на бесплатную и локальную генерацию видео. При этом DeepSeek (открытые веса) стал редким примером ситуации, когда открытая модель едва не подрывает себя собственной популярностью: рост DAU с 120 до 200 млн опередил наращивание вычислительных ресурсов и ухудшил качество (https://www.reddit.com/r/DeepSeek/comments/1wmcgex/).
X — В основном среди японских аккаунтов прошёл фестиваль демонстраций «одним запросом» для Claude Opus 5.5 и Grok 4.7. @cherry_mx_reds, @NFT_Chen, @riku720720 и @chetaslua почти одновременно, 21–22 сентября, публиковали разные демонстрации — похоже на волну массовой проверки сразу после релиза. На открытой стороне заметны посты индивидуальных разработчиков, таких как @shinshin86 и @GeekCatX, о числе GitHub Stars. Но более 20 из 40 собранных постов были нерелевантным шумом, вызванным собственными трендовыми словами X.
YouTube — Самая насыщенная информацией площадка. Главной темой стал взлёт и падение Sora 2 — от громкого анонса до ухода с рынка за полгода. Продолжается гонка обновлений Nano Banana 2, GPT Image 2.5 и Midjourney V8. В открытом сегменте основными полями битвы выступают Alibaba (Wan), Tencent (HunyuanVideo), Black Forest Labs (FLUX) и Lightricks (LTX), а ComfyUI закрепился как «коммутационная панель», куда постоянно добавляют новые узлы.
Bluesky — Сильного специализированного хаба по ИИ для изображений и видео нет; официальные аккаунты Stability AI, Midjourney, Runway и других почти неактивны. Единственный стабильно публиковавшийся инсайдер — @ethanhe из xAI. Однако API полнотекстового поиска всё время возвращал 403, поэтому исследование пришлось ограничить обходом известных аккаунтов.
Lemmy — Площадка небольшая (даже у главного сообщества только 5 713 участников), но публикации вокруг ComfyUI в !«メールアドレス» очень плотные по содержанию. У закрытого сегмента особенно заметны новости о «сворачивании и смене курса»: закрытие Sora API, переход Midjourney к медицинскому оборудованию, немедленный откат Google Earth AI. Разговоров о корректировке траектории здесь больше, чем о громких релизах.
Pinterest — Здесь преобладают не новостные статьи, а картинки в стиле превью «AI NEWS», сравнительные графики и визуальные предупреждения о дипфейках. Открытый исходный код почти отсутствует: удалось найти разве что AMD «Amuse 3.0». Зато очень заметны потребительская тревога «что мне выбрать?» и настороженность к AI-контенту как визуальные жанры.
Ключевые моменты
- Закрытие Sora 2 API (2026-09-24) — YouTube: https://www.youtube.com/watch?v=bIL7uU4CYnE
- Резкий рост DAU DeepSeek и ухудшение качества из-за дефицита вычислений — Reddit: https://www.reddit.com/r/DeepSeek/comments/1wmcgex/
- Предложение законопроекта об обязательной маркировке AI-контента (13 841 комментарий) — Reddit: https://www.reddit.com/r/CriticalState/comments/1wmktek/
- Появление расширений ComfyUI + MiniMax H3 для длинных видео — Lemmy: https://github.com/supElement/ComfyUI_MinimaxH3_AutoContext
- Grok 4.7 автоматически создаёт 3D-сцены в Blender (410 тыс. просмотров) — X: https://x.com/cherry_mx_reds/status/2102098340699668865
- Midjourney радикально переходит от генерации изображений к медицинским устройствам (ультразвуковой КТ-сканер) — Lemmy: https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-to-medical-devices/
Рекомендуемые действия
- На фоне роста цен и сворачивания продуктов у закрытых игроков продолжать следить за OSS-стеком Wan, HunyuanVideo, FLUX.2 и ComfyUI + MiniMax H3 как за основным практичным вариантом.
- Опережая усиливающийся на Reddit и Pinterest настрой на обязательную маркировку AI-контента, заранее подготовить политику указания происхождения материалов.
- После закрытия Sora 2 API 24 сентября проследить, куда мигрируют пользователи: в Kling, Seedance или Runway.
- Волну демонстраций Opus 5.5 / Grok 4.7 в X считать краткосрочным ажиотажем окна релиза, а не устойчивой угрозой доле внимания OSS.
- Следить за инфраструктурными ограничениями при резком росте популярности открытых весов, как в случае DeepSeek, как за ранним индикатором дефицита предложения.
- Для ответа на заметную в YouTube и Pinterest усталость от выбора и сравнений делать сравнительный контент, а не новости об отдельных продуктах.
Качество данных
Критерия завершённости — примерно 20 анализируемых материалов на каждую соцсеть — достигли только YouTube и Pinterest (собрано соответственно 20 и 50 материалов). По остальным площадкам данных не хватало. На Reddit набралось лишь 12 тредов, из которых только 4 были из профильных сабреддитов. В X собрали 40 постов, но более половины оказались нерелевантным шумом от трендовых слов; непосредственно по теме было около 11. В Bluesky полнотекстовый API постоянно отвечал 403, поэтому обходили только известные аккаунты и собрали 10 постов. Lemmy сам по себе слишком мал (главное сообщество — 5 713 участников), чтобы достичь 20 материалов; кроме того, половина постов — зеркальные перепечатки Reddit. В Pinterest визуально проверили только 26 из 50 материалов, а метрики вовлечённости вроде лайков получить не удалось.
Сводка по платформам
Reddit — Новости ИИ для генерации изображений и видео
Где (сабреддиты)
12 собранных тредов распределены по 10 сабреддитам. Специализированных сообществ по ИИ для изображений и видео мало; остальные были тредами в общих сабреддитах, где упоминали или критиковали AI-контент.
| Сабреддит | Число участников | Число собранных тредов |
|---|---|---|
| r/generativeAI | 156,181 | 3 |
| r/mildlyinfuriating | 12,586,808 | 1 |
| r/aivideomaking | 7,498 | 1 |
| r/CriticalState | 39,096 | 1 |
| r/Instagramreality | 1,155,566 | 1 |
| r/Purdue | 100,731 | 1 |
| r/DeepSeek | 140,681 | 1 |
| r/ImagineAiArt | 19,446 | 1 |
| r/youngpeopletiktoks | 8,226 | 1 |
| r/youtube | 3,459,719 | 1 |
Только четыре сообщества — r/generativeAI, r/aivideomaking, r/DeepSeek и r/ImagineAiArt — специализируются на генеративном ИИ (4 треда). Остальные 8 тредов пришли из общих сабреддитов, где AI-контент упоминался в контексте «увидел / меня это раздражает».
Реакции пользователей
- В трёх разных тредах повторяется поиск бесплатных генераторов видео (тред #2 «Which AI video generator can still be used for free?» r/generativeAI · 20pt · 73 комментария · 2026-09-16 / тред #3 «Looking for a free AI video generator» r/aivideomaking · 7pt · 28 комментариев · 2026-09-20 / тред #10 с тем же заголовком r/generativeAI · 4pt · 28 комментариев · 2026-09-20). Закрытые продукты активно переходят на платную модель, а u/RioMetal (+4) рекомендует открытые решения: «если можете запускать локально, есть сколько угодно Wan и Minimax».
https://www.reddit.com/r/generativeAI/comments/1whtesl/ - Недовольство тем, что «всё, что советует ИИ, платное» (тред #2, текст поста). Типичная реакция на сокращение бесплатных лимитов у закрытых сервисов.
https://www.reddit.com/r/generativeAI/comments/1whtesl/ - Конкретный рецепт локального open-source-использования: u/AztecWheels (+2, тред #3) советует установить FramePack через Pinokio — тогда даже слабый ПК сможет преобразовывать изображения в видео (без звука, от 1 до 120 секунд). Связка ComfyUI + FramePack упоминается как привычный вариант открытой генерации видео на маломощном оборудовании.
https://www.reddit.com/r/aivideomaking/comments/1wled0f/ - Возражение против требования бесплатности: u/activematrix99 (+2, тред #3): «Это как требовать бесплатную еду в ресторане. Компании потратили на эту технологию миллиарды». Внутри сообщества есть заметный раскол по вопросу бесплатного доступа.
https://www.reddit.com/r/aivideomaking/comments/1wled0f/ - Быстрый рост DeepSeek (открытые веса) и нехватка вычислений: в треде #7 «some deepseek news, if you care» (r/DeepSeek · 292pt · 45 комментариев · 2026-09-21) говорится, что DAU DeepSeek вырос с 120 млн до 200 млн (+66,7%), тогда как вычислительные мощности — лишь на 8,3%; это привело к ухудшению качества и сбоям при повторной генерации. В качестве меры упоминается заказ 160 тыс. Huawei Ascend 960DT. u/Equivalent-Grass-527 (+13): «несоответствие спроса и вычислительных ресурсов лучше всего объясняет недавнюю деградацию».
https://www.reddit.com/r/DeepSeek/comments/1wmcgex/ - Спор GPT Image 2.5 Flare (закрытый) против KREA 2 (открытый): тред #9 «GPT Image 2.5 Flare — is this actually the best AI image generating model right now?» (r/ImagineAiArt · 93pt · 62 комментария · 2026-09-16). u/Dependent_Quit_3730 (+3, по-португальски): «идеальная модель для тех, кто хочет простоты, но я всё ещё использую KREA 2»; u/SeaworthinessFresh16 (+2): «результаты ComfyUI + Krea2 выглядят так же». На фоне популярности закрытой новинки пользователи почти не ощущают разницы с открытой моделью.
https://www.reddit.com/r/ImagineAiArt/comments/1wi79wi/ - Сильная негативная реакция на AI-изображения недвижимости: тред #1 «It should be illegal to post AI-generated "inspirational" images in house listing photos.» (r/mildlyinfuriating · 25,962pt · 706 комментариев · 2026-09-21, наивысший балл в наборе). u/BojackWorseman13 (+1,128): агентам по недвижимости «следовало бы массово жаловаться в соцсетях; даже если это не незаконно, нужно крупно указывать, что изображение сгенерировано ИИ».
https://www.reddit.com/r/mildlyinfuriating/comments/1wmja6n/ - Предложение законопроекта об обязательной маркировке AI-контента: тред #4 «[Law Proposal] Every ai generated image and text must need to have watermark.» (r/CriticalState · 1,246pt · 13,841 комментарий · 2026-09-21, больше всего комментариев в выборке). Верхние комментарии в основном поддерживают инициативу: u/Timedforfun +16 — «Это не то, что следует скрывать; голосую за».
https://www.reddit.com/r/CriticalState/comments/1wmktek/ - AI-изображения, неотличимые для обычных людей, набирают вирусную популярность: тред #5 «AI generated images on Reddit with thousands of upvotes and comments» (r/Instagramreality · 2,148pt · 343 комментария · 2026-09-18). u/Habibti-Mimi81 (+146): «Я бы не заметил; единственная подсказка — угол серой плитки. Печальное и опасное время».
https://www.reddit.com/r/Instagramreality/comments/1wk0euk/ - AI-изображения в официальных университетских материалах называют “slop”: тред #6 «AI generated image on MSEE wall» (r/Purdue · 139pt · 19 комментариев · 2026-09-21). Автор: «Неужели нельзя было нанять графического дизайнера? От AI-slop уже никуда не деться».
https://www.reddit.com/r/Purdue/comments/1wmq43f/ - Контент из видео-ИИ вроде Sora попадает в сабреддиты с перепостами TikTok: тред #11 «another ai generated grounded video» (r/youngpeopletiktoks · 81pt · 35 комментариев · 2026-09-19). u/Pretend-Goat-8065 (+5) коротко пишет: «Another Sora ai», прямо называя закрытый продукт.
https://www.reddit.com/r/youngpeopletiktoks/comments/1wkjvor/ - Негативная реакция на автоматически сгенерированные главы YouTube: тред #12 (r/youtube · 3pt · 22 комментария · 2026-09-17). u/avatar0027 (+2): автоматически созданные по расшифровке главы стали показываться активнее; зритель не может отключить их разом, автору приходится выключать каждое видео отдельно. Это не сама генерация видео, но косвенно показывает усталость от расширения AI-функций.
https://www.reddit.com/r/youtube/comments/1wiqamq/
Сигналы
- Рост: спрос на бесплатную локальную генерацию видео (Wan 2.2, Minimax H3, ComfyUI + FramePack) повторяется в трёх независимых тредах. Подорожание и платные ограничения закрытых решений подталкивают интерес к открытому исходному коду.
- Рост: общественный запрос на обязательную маркировку AI-контента (13 841 комментарий в треде #4 — самый большой объём обсуждения в выборке). На Reddit в целом вопросы регулирования и прозрачности вызывают куда больше вовлечения, чем соревнование моделей.
- Недооцениваемое: сопротивление самому требованию «дайте бесплатно» (u/activematrix99 и другие). В сообществе есть и прохладное отношение к идее, что бесплатный доступ — это норма; единого мнения нет.
- Неожиданное: DeepSeek с открытыми весами теряет качество из-за нехватки вычислений на фоне стремительного роста аудитории (тред #7). Это не ось «открытое против закрытого», а новый тип ограничения предложения: открытая модель стала слишком популярной для собственной инфраструктуры оператора.
- Разногласия: в треде #9 мнения сравнивающих закрытую новинку GPT Image 2.5 Flare и открытую KREA 2 разделились; несколько участников говорят, что «закрытая модель громче в новостях, но разницы по ощущениям нет».
Ограничения
- Критерий брифа — анализировать около 20 постов для каждой соцсети, но в reddit.threads.md/.json содержалось только 12 тредов (использовался лишь один запрос: "Image and Video Generation AI News"). Поскольку исполнитель должен был читать уже собранные данные, дополнительных поисков не проводилось.
- Из 12 собранных материалов только 4 пришли из профильных сообществ об ИИ для изображений и видео (r/generativeAI, r/aivideomaking, r/DeepSeek, r/ImagineAiArt). Остальные 8 — производные треды общих сабреддитов о том, что кто-то «нашёл AI-контент»; новостных тредов именно о новых продуктах и обновлениях закрытых/открытых систем практически нет.
- Крупнейшие профильные сабреддиты об ИИ для изображений и видео — r/StableDiffusion, r/midjourney, r/runwayml, r/aivideo и другие — в набор вообще не вошли.
- Текст исходного поста треда #9 (GPT Image 2.5 Flare) обрывается посреди полного промпта, поэтому продолжение публикации и содержимое прикреплённого изображения проверить нельзя.
- Из-за ограничения, не позволявшего самостоятельно просматривать Reddit, исследование не выходило за пределы этих 12 материалов — не изучались другие запросы и дополнительные треды.
X
X — Новости ИИ для генерации изображений и видео
В X (Twitter) среди японских аккаунтов активно обсуждались демонстрации генерации видео и анимации с помощью «Claude Opus 5.5» и «Grok 4.7», однако более половины из 40 собранных публикаций оказались нерелевантным шумом (подробности ниже в разделе Limits).
Accounts
- @cherry_mx_reds(Tak) — Самый заметный участник в этой выборке. Опубликовал две демонстрации: анимацию «Oktoberfest», сгенерированную Opus 5.5 одним запросом (373 лайка), и создание Grok 4.7 3D-сцены в Blender (1 636 лайков, ~410 000 просмотров). Один аккаунт тестирует две разные модели, ведя репортаж в сравнительной перспективе.
- @NFT_Chen(SuSu_酥酥) — Один пост (151 лайк, ~40 000 просмотров), где Opus 5.5 с помощью кода создал покадровую анимацию под ручную рисовку. Одиночная, но широко разошедшаяся демонстрация с подробным описанием.
- @chetaslua — Один кейс (435 лайков): интерактивное видео, созданное Opus 5.5 только на JavaScript, без ассетов, MCP и навыков. Техническая демонстрация с фокусом на реализации.
- @riku720720(Rikuo) — Один пост (173 лайка) о генерации пиксельной анимации Opus 5.5; промпт опубликован в ответах, что делает публикацию практическим обменом опытом.
- @old_pgmrs_will(оператор NeuralWire.org) — Два поста о Grok 4.7: один о создании приложения для ретуши фото вместе с демонстрационной функцией (8 лайков), второй — возражение критикам Grok-4.7 и рассказ об улучшении UI видеоредактора (8 лайков). Небольшой охват, но последовательные публикации AI-новостного аккаунта.
- @shinshin86(разработчик AITuber OnAir) — Разработчик открытого инструмента «Still2Rig PSD» (автоматическое разложение статичного изображения на PSD-слои) сообщил о более чем 60 GitHub Stars (586 лайков, ~28 000 просмотров).
- @ishitaku39(いしたく) — Представил «ARDY Mini»: облегчённую индивидуальным разработчиком до запуска в браузере производную исследовательской модели NVIDIA ARDY (226 лайков).
- @GeekCatX(知识猫AI实验室) — Сообщил о более чем 2 000 GitHub Stars у открытого «Hand-drawn Video Skill» (story-to-handdrawn-video; 103 лайка) и поделился изменениями после месячного обновления.
- @so_ainsight — Еженедельная подборка быстрорастущих AI-репозиториев GitHub (573 лайка, ~49 000 просмотров). Это не только об изображениях и видео, но в контексте даёт представление о динамике OSS-ИИ.
Posts
Закрытые решения (Opus 5.5 / Grok 4.7)
-
#1 @riku720720 — 173 лайка · 19 репостов · 1 ответ · около 19 000 просмотров · 2026-09-22. https://x.com/riku720720/status/2102515055116063144
opus 5.5、本当にやばすぎる... 5分もかからずこのピクセルアニメーション出してきやがった。
Суть поста — удивление скорости: пиксельная анимация создана одним заходом менее чем за пять минут. -
#2 @NFT_Chen — 151 лайк · 20 репостов · 13 ответов · около 40 000 просмотров · 2026-09-22. https://x.com/NFT_Chen/status/2102455102896509431
This isn't drawn by a human! Claude Opus 5.5 used code to hand-draw this animation frame by frame. ... 32 seconds, all generated by AI.
Удивляет сам подход: покадровая анимация под ручную рисовку, созданная с помощью кода. -
#3 @cherry_mx_reds — 373 лайка · 17 репостов · 10 ответов · около 36 000 просмотров · 2026-09-21. https://x.com/cherry_mx_reds/status/2102493303388475855
Opus 5.5 one-shot this animation in 14m and 48s "Oktoberfest" by Opus 5.5
Подчёркивается «one-shot» — генерация одним запросом — и конкретное время: 14 минут 48 секунд. -
#4 @chetaslua — 435 лайков · 23 репоста · 10 ответов · около 20 000 просмотров · 2026-09-22. https://x.com/chetaslua/status/2102501773705670994
Interactive video gen in whatever art style you want by @claudeai Opus 5.5 coded no assets, mcp, skill, only js
Техническая демонстрация, акцентирующая лёгкость реализации: интерактивное видео в любом стиле, только JavaScript, без ассетов, MCP и навыков. -
#17 @AbhinavXJ — 57 лайков · 2 репоста · 2 ответа · около 3 200 просмотров · 2026-09-22. https://x.com/AbhinavXJ/status/2102473742723260606
they said pace the frontier and now we have Grok 4.7 Claude Opus 5.5 GPT-6 sol and luna in span of 2 days
Реакция не на одну модель, а на скорость отрасли: за два дня появились сразу несколько крупных моделей. -
#19 @cherry_mx_reds — 1 636 лайков · 215 репостов · 127 ответов · около 410 000 просмотров · 2026-09-21.
https://x.com/cherry_mx_reds/status/2102098340699668865Grok 4.7 made this in blender. I didn't tell it what to make but only that it should be something it can accomplish in 10 minutes or so.
Самый вовлекающий пост об AI-демонстрации в выборке. Новизна в том, что речь идёт о 3D-генерации в Blender. -
#18 @old_pgmrs_will — 8 лайков · 0 репостов · 0 ответов · около 611 просмотров · 2026-09-21. https://x.com/old_pgmrs_will/status/2102182047989338264
Grok 4.7 で自分で使うためのフォトレタッチアプリを生成。ついでに実際の操作を実演するための自動デモ機能も実装させた
Практический кейс: генерация приложения для личной ретуши фотографий с автоматической демонстрацией работы. -
#20 @old_pgmrs_will — 8 лайков · 0 репостов · 0 ответов · около 599 просмотров · 2026-09-22. https://x.com/old_pgmrs_will/status/2102376309020299517
海外勢を中心に?「Grok-4.7 使えねぇ」みたいな投稿を散見するが、アンチか使いこなせてないかのどちらか
На фоне критических постов о том, что Grok 4.7 «непригоден», автор возражает: у него успешно улучшается UI/UX приложения для видеомонтажа. Оценки расходятся.
Открытый исходный код
-
#33 @shinshin86 — 586 лайков · 59 репостов · 2 ответа · около 28 000 просмотров · 2026-09-21. https://x.com/shinshin86/status/2102163713679577301
静止画からPSDを作れるAIツール『Still2Rig PSD』、GitHubスターが60を超えました...CodexなどのAIエージェントに画像を渡して依頼すると、Google Colab上でSee-throughを動かしてレイヤー分けし、PSDの組み立てまで進めてくれます
Индивидуальный OSS-инструмент достиг более 60 Stars на GitHub. Отличительная особенность — интеграция с AI-агентами. -
#34 @ishitaku39 — 226 лайков · 22 репоста · 3 ответа · около 9 800 просмотров · 2026-09-21. https://x.com/ishitaku39/status/2102038146489946532
キャラの動きを、コメントに合わせてリアルタイムで生成できた…!自作AITuberに「ARDY Mini」を組み込んでみた。NVIDIAの研究モデル「ARDY」を、個人開発者の方がブラウザで動くまで軽量化した派生版です。
Пример практического применения сообществом OSS: облегчённая производная исследовательской модели NVIDIA работает прямо в браузере. -
#35 @GeekCatX — 103 лайка · 18 репостов · 4 ответа · около 7 800 просмотров · 2026-09-22. https://x.com/GeekCatX/status/2102336276230025224
Hand-drawn Video Skill has been updated again! ...the GitHub Stars for story-to-handdrawn-video have now exceeded 2,000. This time, the focus is on adding more art styles
Открытый проект story-to-handdrawn-video превысил 2 000 Stars; главная особенность обновления — добавление художественных стилей. -
#36 @so_ainsight — 573 лайка · 75 репостов · 6 ответов · около 49 000 просмотров · 2026-09-21.
https://x.com/so_ainsight/status/2101871551255830529今週GitHubで急上昇したAIリポジトリ10選:1. OpenCodeReview...
Еженедельная подборка быстрорастущих AI-репозиториев GitHub. Она не ограничивается изображениями и видео, но показывает импульс OSS-среды.
Signals
- Рост: личные демонстрации того, как Claude Opus 5.5 и Grok 4.7 генерируют видео/анимацию быстро и с низкими затратами одним запросом, стабильно набирают вовлечение. Особенно по Opus 5.5 несколько независимых аккаунтов (@riku720720, @NFT_Chen, @cherry_mx_reds, @chetaslua) почти одновременно, 21–22 сентября 2026 года, публиковали разные демо; это похоже на волну верификации сразу после релиза.
- Недооцениваемое / вызывающее разногласия: по Grok 4.7 соседствуют восторг (3D-генерация в Blender, ~410 000 просмотров) и критика («непригоден»), на которую @old_pgmrs_will отвечает собственными контрпримерами. Это не однозначная волна восхищения.
- Неожиданное: на открытой стороне заметны посты японских индивидуальных разработчиков (@shinshin86, @ishitaku39, @GeekCatX), подчёркивающие число GitHub Stars. Вместо корпоративных объявлений чаще встречаются истории о том, как люди комбинируют существующие исследовательские модели и AI-агентов, превращая их в практические инструменты.
- Ещё одно неожиданное наблюдение: из десяти поисковых слов X только «Opus 5.5», «Grok 4.7» и «GitHub» относились к генерации изображений и видео. Остальные семь (#chance, England, #sweepstakes, #giveaways, Lauren, $SONG, Jesus) были трендовыми словами Explore, не связанными с темой.
Limits
- Из 10 поисковых слов #chance (романтическое реалити-шоу ABEMA), England (разговоры о погоде и футболе), #sweepstakes (конкурсы, например в приложении Fanatics), #giveaways (конкурсные посты вокруг индийских праздников), Lauren (скандал вокруг R&B-певицы и бразильская теленовелла «Estrelas da Casa»), $SONG (криптотокен в Cardano) и Jesus (религиозный контекст, критика игровой индустрии, футбольные трансляции) никак не связаны с ИИ для изображений и видео. На них приходится более 20 из 40 собранных постов. Вероятно, это механические результаты поиска по трендам Explore самой X и содержательных сигналов по теме в них нет.
- Собственный список Explore trends X на сервере этой сессии содержал «Trending in Croatia» и был ориентирован на хорватские региональные тренды. Его нельзя представлять как мировую повестку; возможно, оттуда и пришли нерелевантные запросы.
- Постов, непосредственно относящихся к теме, всего 11: 4 об Opus 5.5, 4 о Grok 4.7 и 3 об открытых инструментах GitHub. Этого недостаточно, чтобы на основании одних только постов X выполнить требование брифа о минимум десяти наблюдениях для закрытого и открытого сегментов; нужны результаты с других платформ.
- В поисковых словах и собранных данных X не встречались OpenAI (GPT-6/Sora), Midjourney, Stable Diffusion, Runway и другие крупные игроки. Реакцию X на них в этом запуске подтвердить нельзя.
YouTube
YouTube — Последние новости ИИ для генерации изображений и видео (закрытый / открытый исходный код)
Channels
- OpenAI (официальный канал) — официальные анонсы Sora 2 и ChatGPT Images 2.5.
- Google / Google DeepMind (официальные каналы) — анонсы серии Gemini «Nano Banana».
- Adobe (официальный канал) — анонсы мульти-модельной стратегии Firefly.
- Runway (официальный канал) — анонсы Gen-4.5 и MCP-сервера.
- Lev Selector — личный канал с еженедельными сводками AI-новостей (серия "Exciting AI Updates Weekly").
- Авторы туториалов по ComfyUI / Stable Diffusion (например, каналы, связанные с программой "AI on the Lot", и авторы разборов рабочих процессов ComfyUI) — массово выпускают руководства по локальному запуску открытых Wan, LTX, Flux, HunyuanVideo и других моделей.
- Каналы сравнений и обзоров (множество заголовков вида "Best AI Video Generator") — регулярно сравнивают Sora 2 / Seedance 2.0 / Runway / Kling.
- Число подписчиков не удалось установить: HTML страниц требует JavaScript-рендеринга, а поисковые сниппеты этих данных не содержат (см.
## Limits).
Videos
Закрытые решения
- Introducing Sora 2 — официальный OpenAI / 2025-09-30 / https://www.youtube.com/watch?v=gzneGhpXwjU — Билл Пиблс, Рохан Сахаи и Томас Димсон представляют Sora 2 и новое приложение Sora: новое поколение видеомодели с физической правдоподобностью и синхронизацией реплик.
- OpenAI Abandons Sora to Refocus on Enterprise Solutions — аналитический канал / около марта 2026 / https://www.youtube.com/watch?v=bIL7uU4CYnE — Разбор планов OpenAI закрыть приложение Sora 26 апреля 2026 года и API 24 сентября 2026 года, то есть на следующий день после исследования. Пересказывается сообщение о расходах около 1 млн долларов в день и суммарной выручке от подписок лишь 2,1 млн долларов.
- OpenAI Shuts Down Sora & Kills ChatGPT Integration Plans | What Happened? — аналитический канал / примерно март–апрель 2026 / https://www.youtube.com/watch?v=9rhmczPT6Jk — В качестве фона закрытия Sora объясняется, что партнёрство с Disney, оценивавшееся примерно в 1 млрд долларов, сорвалось непосредственно перед объявлением о завершении Sora.
- Introducing ChatGPT Images 2.5 — официальный OpenAI / около 2026-09-08 / https://www.youtube.com/watch?v=6l7ble9P74o — Анонс GPT Image 2.5 (ChatGPT Images 2.5): генерация на 50% быстрее прежней и новая функция «Sketch», превращающая нарисованный от руки эскиз в изображение.
- Sketch with ChatGPT Images 2.5 — официальный OpenAI / сентябрь 2026 / https://www.youtube.com/watch?v=imPtIEAEHSU — Демонстрация: ввести «@Sketch», нарисовать эскиз прямо в ChatGPT и сразу превратить его в AI-изображение.
- The New Gemini Image Generator is Insane (Nano Banana 2) — обзорный канал / 2026-02-27 / https://www.youtube.com/watch?v=nikIxHM_AQY — Обзор перехода Google на «Nano Banana 2» в качестве стандартной модели генерации изображений в приложении Gemini.
- Midjourney Update | March 2026: V8 Alpha, BIG Changes Coming, New Edit Model + More — канал о Midjourney / около марта 2026 / https://www.youtube.com/watch?v=TZ1zWvbXFug — Анонс альфа-версии V8, ставший началом последующих обновлений: V8.1 (2026-04-14), затем V8.2 (улучшения качества и персонализации; модель редактирования открыта всем пользователям 2026-08-27).
- Kling 3.0: the biggest advancement in AI video generation? — обзорный канал / первая половина 2026 / https://www.youtube.com/watch?v=G1VHCrl4jy4 — Тест Kuaishou «Kling 3.0», представленного как первая модель, генерирующая видео в нативных 4K и 60fps и возглавившая видеорейтинг Artificial Analysis.
- Grok Imagine 1.5 Preview - Mind-Blowing AI Video Just Dropped 🔥 | xAI — обзорный канал / 2026-06-03 / https://www.youtube.com/watch?v=grxiFAC-NNI — Проверка предварительной версии Grok Imagine 1.5 от xAI.
- Sora 2 vs. Seedance 2.0 vs. Runway: The 2026 AI Video War Explained — сравнительный канал / 2026-02-13 / https://www.youtube.com/watch?v=rb0p_mY3tPs — Сравнение Sora 2, Seedance 2.0 от ByteDance и Runway.
- Runway Ships an MCP Server - Generate Video From Inside Claude, ChatGPT, Cursor and Replit — официальный Runway / около 2026-05-27 / https://www.youtube.com/shorts/t9Bg_4rOQqM — Runway объявляет MCP-сервер, позволяющий напрямую генерировать видео из Claude, ChatGPT, Cursor и Replit.
Открытый исходный код
- Now that Wan 2.5 (open source model from Alibaba China) can do AI dialogues, AI Lip Syncing to... — аналитический канал / первая половина 2026 / https://www.youtube.com/watch?v=kzXNJO6caGw — Рассказ о том, что открытая модель Alibaba Wan 2.5 получила генерацию диалогов и липсинк.
- Wan2.6: Multi-shot Storytelling & Cinematic Shot Control — канал туториалов / конец 2025 — начало 2026 / https://www.youtube.com/watch?v=VHJ925WoWgw — Объяснение «мультикадрового сторителлинга» Wan 2.6: один промпт может создать кинематографическое видео до 15 секунд из нескольких кадров.
- Black Forest Labs: FLUX 2 – The King of AI Image Generation — обзорный канал / 2026-06-04 / https://www.youtube.com/watch?v=WZfKzzX65-o — Проверка FLUX.2 от Black Forest Labs.
- FLUX.2 Just Beat Every AI Image Model — Black Forest Labs' Most Powerful Release Yet — обзорный канал / 2025-11-27 / https://www.youtube.com/watch?v=VMBSUBKON_U — Утверждается, что FLUX.2 превосходит существующие модели изображений по качеству, контролю и консистентности.
- Qwen Image-2512 First Test – The BEST Open Source Image Model! — обзорный канал / 2026 / https://www.youtube.com/watch?v=SBaK616nP6Q — Проверка новейшей линии Alibaba Qwen-Image-2.1: текстовый рендеринг, редактирование и генерация прозрачных изображений в одной системе; генеративная часть — 7 млрд параметров.
- HunyuanVideo 1.5 vs Wan 2.7 Comparison: Which is The Best Free Local Video AI Generation Model? — сравнительный канал / 2026 / https://www.youtube.com/watch?v=4GNT4-QYekg — Локальное сравнение HunyuanVideo 1.5 от Tencent (8,3 млрд параметров, работа на потребительских GPU) и Wan 2.7 от Alibaba.
- LTX 2 Full Tutorial | Run on Low VRAM PC + Video & Audio AI Generation (2026 Strongest Open-Source?) — канал туториалов / 2026 / https://www.youtube.com/watch?v=ytxbq9ZSgxo — Руководство по запуску LTX-2 от Lightricks на ПК с малым объёмом VRAM. LTX-2 полностью открыт в январе 2026 года; в марте появился LTX-2.3 с настольным редактором видео.
- Best Open-Source AI Video in 2026: WAN 2.2 vs LTX 2.3 — сравнительный канал / 2026 / https://www.youtube.com/watch?v=ZZ5VH-rqHXQ — Сравнение двух ведущих открытых видеосистем: Wan 2.2 и LTX 2.3.
- Inpaint Canvas for ComfyUI: Krita-Style Layers, Colour Match & Retouch in One Node — канал о ComfyUI / начало сентября 2026 (опубликовано две недели назад) / https://www.youtube.com/watch?v=Lz7AT8SByx8 — Обзор открытого пользовательского узла ComfyUI «Inpaint Canvas», опубликованного 5 сентября 2026 года. Он поддерживает слои, выделения, выделение с помощью SAM, экспорт PSD и превращает ComfyUI в полноценный инструмент рисования.
Signals
- Главная новость закрытого сегмента — завершение Sora 2: Sora 2 была громко представлена в конце сентября 2025 года, но приложение закрывается всего через полгода (2026-04-26), а API должен прекратить работу уже на следующий день после даты исследования — 2026-09-24. Несколько аналитических роликов YouTube пересказывают информацию о расходах около 1 млн долларов в день при суммарной выручке лишь 2,1 млн долларов. Партнёрство с Disney, оцениваемое в 1 млрд долларов, также сорвалось незадолго до объявления о закрытии Sora.
- Генерация изображений: Google, OpenAI и Midjourney обновляются без пауз: Nano Banana 2 (Gemini, 2026-02), GPT Image 2.5 / ChatGPT Images 2.5 (2026-09-08, добавлен Sketch), Midjourney V8 → V8.1 → V8.2 (2026-03–08, модель редактирования открыта всем пользователям) — закрытые игроки продолжают выпускать новые модели каждые несколько месяцев.
- Сравнительный контент о «войне» видеогенераторов стал стандартом: огромное число видео и Shorts ставит рядом Sora 2 / Seedance 2.0 / Runway Gen-4.5 / Kling 3.0 / Grok Imagine. Это показывает, что зрителей интересует уже не приверженность конкретному инструменту, а определение «кто сейчас лучший».
- Главные открытые игроки — Alibaba (Wan), Tencent (HunyuanVideo), Black Forest Labs (FLUX) и Lightricks (LTX): модели доступны через Hugging Face/GitHub, а туториалы по запуску через ComfyUI и на локальных GPU выпускаются массово. Wan быстро расширяет возможности от диалогов и липсинка к мультикадровой съёмке (2.5 → 2.6).
- Экосистема ComfyUI закрепилась как «коммутационная панель» генеративного ИИ: только в сентябре 2026 года один за другим появились Core Sparse Attention Node, Comfy Compiler, Inpaint Canvas, MiniMax H3 RefMods, Krea2T Enhancer и другие узлы. ComfyUI всё заметнее как промежуточный слой, который превращает открытые модели в производственный процесс.
- Adobe Firefly становится интеграционным хабом для обеих сторон: помимо собственных моделей, он объединяет в одном рабочем пространстве более 30 внешних моделей, включая Runway Gen-4.5, Google Nano Banana Pro, генерацию изображений OpenAI и Black Forest Labs FLUX.2 [pro]. Выбор смещается от одного инструмента к грамотному сочетанию нескольких и в корпоративном сегменте.
- Значительную долю занимают агрессивно рекламные обзоры и сравнения: заголовки вроде "BEST AI Image Generator in 2026 (Don't Choose Wrong!)" заполонили выдачу. Выбор модели сам превратился в контент, иногда важнее реальной технической информации.
Limits
- Страницы результатов и видео YouTube требуют JavaScript-рендеринга, и WebFetch не смог получить реальные просмотры, число подписчиков и даты публикации из HTML; возвращался только футер. Поэтому использовались лишь даты и описания из поисковых сниппетов, а точные просмотры в отчёт не включены.
- Для части роликов (о Wan 2.6, сравнении HunyuanVideo и других) в поиске указан лишь 2026 год без месяца, поэтому нельзя строго подтвердить соответствие критерию «в течение 60 дней». Приоритет отдан явно свежим материалам: новости об остановке Sora API, ChatGPT Images 2.5, Inpaint Canvas и другим.
- Не удалось найти официальный ролик YouTube, который сообщал бы о закрытии Sora API 2026-09-24; доступны только последующие объяснения аналитических каналов.
- Японские каналы и ролики в этой поисковой выборке не попали в верхние результаты; информация в основном англоязычная.
Bluesky
Bluesky — Последние тенденции ИИ для генерации изображений и видео
Accounts
- @stabilityai.bsky.social — официальный Stability AI. Однако во второй половине 2025 года публикации в основном посвящены Stable Audio и корпоративным партнёрствам, а не моделям изображений; лайков почти нет.
- @midjourneyofficial.bsky.social — официальный Midjourney. В августе 2025 года аккаунт объявил о появлении в Bluesky, но последние публикации датированы 8 октября 2025 года; свежих новостей нет.
- @promptheroofficial.bsky.social — официальный PromptHero, сервис обмена промптами. Публикует информацию о доступности закрытых моделей вроде Sora 2.
- @ethanhe.bsky.social — инженер команды Grok Imagine в xAI, ранее работавший в NVIDIA/Meta. Один из немногих инсайдеров, напрямую публикующий обновления Grok Imagine и вакансии.
- @chorizemabang.bsky.social — японский пользователь Grok Imagine, публикующий отчёты о проблемах и недовольстве из реального опыта.
- @metalmickey.bsky.social(澤村徹) — художник из Токио, создающий музыкальные видео и выставочные работы, сочетая Seedance 2.5, GPT-6 и Suno V6; сообщает реальные производственные затраты.
- @you32081.bsky.social — автор, массово создающий R-18-иллюстрации с открытыми Qwen-Image, Z-Image-Turbo и другими моделями.
- @lijack1001.bsky.social — SEO-спам-аккаунт, массово публикующий клоны/аффилиатные сайты под Nano Banana Pro, Seedance, Sora 2, Veo 3, Wan, GPT-5 Image и другие названия. Это не источник новостей, но он показывает, какие названия считаются коммерчески выгодными ключевыми словами.
- @runwayml.bsky.social / @blackforestlabs.bsky.social / @comfy-ui.bsky.social — официальные аккаунты Runway, Black Forest Labs и ComfyUI существуют, но почти пусты либо содержат только один недавний пост 2024 года; фактически неактивны.
Posts
- PromptHero: «Sora 2 is now available on Prompthero: No watermarks, Available in Europe, Combine it with other models» — 2025-10-13, 0 лайков / 0 репостов. Пост
Закрытый сегмент. Показывает, что сторонний сервис промптов перепродаёт Sora 2 как «без водяных знаков, доступно в Европе, можно сочетать с другими моделями». - xAI / Ethan He: «Excited to share our most advanced image generation model at xAI! Grok Imagine Quality mode — enhanced details, stronger text rendering...» — 2026-04-05, 0 лайков / 0 репостов. Пост
Закрытый сегмент. Официальный инженер объявляет Quality mode для Grok Imagine, с улучшенной детализацией и текстовым рендерингом. - xAI / Ethan He: вакансия видеотренера «familiarity with AI video generation tools (Grok Imagine, Runway, Kling, Sora, Veo, or similar)» — 2026-03-29. Пост
Закрытый сегмент. Свидетельство, что xAI вкладывается в людей для подготовки данных видеомодели; Runway/Kling/Sora/Veo прямо названы конкурентными ориентирами. - @chorizemabang: «Grok Imagineマジで全然生成できなくなっちゃったけどじっくり1日1作品作るのも趣があるな。」 — 2026-06-05, 13 лайков / 1 репост. Пост
Закрытый сегмент. Пользователь сообщает, что Grok Imagine практически перестал генерировать. - @chorizemabang: «Grok Imagineが終わってしまってるのでお詫びに過去作を…» — 2026-05-31, 11 лайков / 1 репост. Пост
Закрытый сегмент. Вместе с предыдущей публикацией подтверждает проблемы со стабильностью Grok Imagine в мае–июне. - @metalmickey: «road movie rain version. Stitched Seedance2.5's 30-second clips. Fees are devastating.» — 2026-08-27. Пост
Закрытый сегмент. Практическая работа: около пяти минут AI-роуд-муви, собранного из 30-секундных клипов Seedance 2.5, и жалоба на разрушительно высокие цены. - @metalmickey: «Attempted creating music video entirely AI-delegated without writing a single prompt line. GPT-6 Astra enables voice-directed workflow.» — 2026-09-07. Пост
Закрытый сегмент. Пример нового процесса: музыкальный клип, полностью делегированный ИИ без написания промптов, через голосовые инструкции GPT-6 Astra. - Stability AI: «We're launching our Stability AI Image Services on Amazon Bedrock, bringing professional-grade image editing capabilities...» — 2025-09-18, 0 лайков / 0 репостов. Пост
Ближе к закрытому API-сегменту. Сервис профессионального редактирования изображений (инпейтинг/перенос стиля) предлагается в AWS Bedrock. - Официальный Midjourney: «#Midjourney is now on BlueSky! Who are the best creators to follow here?» — 2025-08-15, 41 лайк / 4 репоста. Пост
Midjourney сам закрытый, но после этой публикации почти перестал писать в Bluesky; пример входа на платформу без закрепления. - @you32081: R-18 AI-иллюстрации с Qwen-Image / Z-Image-Turbo — 2026-08-01, 6 лайков / 0 репостов. Пост
Открытый сегмент. Пример того, как китайские открытые модели Qwen-Image и Z-Image-Turbo закрепляются в реальном творческом процессе в среде додзинси и R-18.
Signals
- В Bluesky нет сильного специализированного хаба «новостей ИИ для изображений и видео». Официальные Midjourney, Stability AI, Runway, Black Forest Labs и ComfyUI почти не публикуют свежих постов или получают 0–несколько взаимодействий; фактически они неактивны. Площадка не стала местом оперативных обсуждений, как X или Reddit.
- Новости закрытых решений появляются лишь через личные аккаунты инсайдеров компаний. Единственный стабильно активный источник — инженер Grok Imagine из xAI Ethan He (@ethanhe.bsky.social), публиковавший в марте–апреле 2026 года о Quality mode и найме видеотренеров.
- Есть признаки нестабильности Grok Imagine в мае–июне 2026 года. Японский пользователь @chorizemabang несколько раз писал, что генерация перестала работать и продукт «закончился» (2026-05-31, 2026-06-05), хотя в апреле xAI только что объявляла об улучшениях. Возможно, операционная инфраструктура не успевала за быстрым ростом.
- Наиболее заметен Seedance 2.5 в рабочих логах. Художник из Токио @metalmickey в августе 2026 года создал примерно пятиминутное AI-роуд-муви из клипов Seedance 2.5 и неоднократно жаловался на высокую стоимость — характерная проблема платного API-сегмента.
- Открытые проекты (Flux, Wan, Qwen-Image, Z-Image-Turbo, HunyuanImage, ComfyUI) упоминаются не в новостных публикациях, а лишь фрагментарно в хештегах личных AI-арт-постов R-18/додзинси. В Bluesky не найдено специализированного новостного источника уровня r/StableDiffusion.
- Много аффилиатного/SEO-спама, использующего названия моделей. Аккаунты вроде @lijack1001 механически публикуют ссылки на клоны сайтов с названиями Nano Banana Pro, Seedance 2.0, Sora 2, Veo 3, Wan 2.2, GPT-5 Image и т. п. Это может косвенно показывать поисковый спрос, но как новостной источник бесполезно.
- Nano Banana Pro (генерация изображений Google) часто упоминается в среде R-18/AI-арта. Встречается в хештегах и описаниях наряду с Ideogram 4 и Krea 2, что указывает на закрепление среди используемых коммерческих инструментов.
Limits
- Официальный API полнотекстового поиска Bluesky (
app.bsky.feed.searchPosts) на все тестовые запросы (Stable Diffusion,Midjourney,Flux,testи др.) неизменно возвращал HTTP 403 и ни разу не сработал.app.bsky.actor.getProfile,app.bsky.actor.searchActorsиapp.bsky.feed.getAuthorFeedработали, поэтому исследование ограничилось поиском аккаунтов и чтением их лент. - Веб-версия
bsky.app— SPA с клиентским рендерингом; при получении страницы возвращалась пустая оболочка, поэтому приходилось обращаться к публичному JSON API напрямую. - Без полнотекстового поиска высока вероятность пропуска неизвестных релевантных аккаунтов. В частности, невозможно отделить ситуацию «специализированных новостных аккаунтов об открытых моделях нет» от ситуации «их не удалось обнаружить из-за ограниченного способа поиска».
- Были изучены официальные аккаунты Stability AI, Midjourney, Runway, Black Forest Labs и ComfyUI, но у них не оказалось свежих новостей об ИИ для изображений/видео. Это характеризует Bluesky, а не наличие или отсутствие обсуждений на других платформах.
Lemmy
Lemmy — Новости ИИ для генерации изображений и видео (открытый / закрытый исходный код)
Lemmy — небольшая децентрализованная форумная платформа. Разговоры об AI-изображениях в основном сосредоточены в !«メールアドレス» и вокруг него, а также в !«メールアドレス», зеркале r/ArtificialInteligence, куда бот автоматически переносит посты Reddit. Для межплатформенного исследования использовались поисковый API lemmy.world (/api/v3/search) и веб-поиск по запросам «image generation», «video generation», «Stable Diffusion», «Flux», «Qwen Image», «Sora», «Midjourney», «Nano Banana», «Grok Imagine», «ComfyUI» и другим.
Communities
!«メールアドレス»— 5 713 подписчиков. В основном технические посты об открытых моделях изображений/видео и ComfyUI.!«メールアドレス»— 2 361 подписчик. Преимущественно обмен готовыми генерациями, новости встречаются редко.!«メールアドレス»— ежедневно публикует множество аниме-подобных генераций через civitai; это посты работ, а не новости.!«メールアドレス»(Free Open-Source AI) — 4.84K подписчиков (из них 1.81K локальных). Посвящено открытому ИИ в целом; постов именно об изображениях/видео немного.!«メールアドレス»— автоматическое зеркало r/ArtificialInteligence. Это не собственные обсуждения Lemmy, а перепечатки Reddit.!stable_diffusion_abstraction(50 человек)/!stable_diffusion_furry(52 человека)/!stable_diffusion_mycology(97 человек) — нишевые сообщества работ с небольшим числом подписчиков.
Posts
Ближе к открытому исходному коду
-
Qwen-Image-2.1 in ComfyUI: Open-Weight Image Generation and Editing, Now with Transparency
!«メールアドレス», 2026-09-22, score 9
https://blog.comfy.org/p/qwen-image-21-in-comfyui-open-weight
Открытая модель генерации/редактирования изображений команды Alibaba Qwen с 7 млрд параметров. Поддерживает RGBA с прозрачностью для логотипов и вырезанных объектов, нативное разрешение 2048×2048, до 10 референсных изображений и нативную интеграцию с ComfyUI. -
Qwen-Image-2.1: Compact, efficient, and unified image creation
!«メールアドレス», 2026-09-20, score 1
https://qwen.ai/blog?id=qwen-image-2.1
Анонс из официального блога Qwen, первичный источник предыдущего материала ComfyUI. -
supElement/ComfyUI_MinimaxH3_AutoContext: A long video generation solution that breaks through the memory barrier
!«メールアドレス», 2026-09-16, score 1
https://github.com/supElement/ComfyUI_MinimaxH3_AutoContext
Расширение ComfyUI для MiniMax H3. Автоматически разбивает видео на сегменты и соединяет их latent-якорями, обходя ограничения VRAM при длинной генерации. Apache-2.0, 31 star, 153 коммита. -
Adudeguyman/ComfyUI-Fantastic-MiniMaxH3-PromptBuilder
!«メールアドレス», 2026-09-16, score 3
https://github.com/Adudeguyman/ComfyUI-Fantastic-MiniMaxH3-PromptBuilder
Ещё один инструмент для MiniMax H3 — билдер промптов для ComfyUI. Пример активных обновлений окружающей экосистемы локальных видеопроцессов. -
Boogu-Image-0.1 — Efficient Image Generation Foundation Model
!«メールアドレス», 2026-06-17, score 5
https://boogu.org/
Публикация новой открытой фундаментальной модели изображений с акцентом на лёгкость и эффективность. -
AI video generation is becoming less about the model and more about the workflow
!«メールアドレス»(перепечатка Reddit), 2026-09-19, score 1
https://www.reddit.com/r/ArtificialInteligence/comments/1wkl4db/
Пост о том, что качество видеогенерации всё больше определяется не отдельной моделью, а построением процесса из открытых весов и рабочих схем уровня ComfyUI.
Ближе к закрытому исходному коду
-
OpenAI is shutting down Sora's API next week while a Chinese competitor raised $3B
!«メールアドレス»(перепечатка Reddit), 2026-09-20, score 1
https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/
История о том, что OpenAI останавливает Sora 2 API 24 сентября (приложение закрылось ещё в апреле), в контрасте с привлечением Kuaishou (Kling) 3 млрд долларов. Тезис поста: громкие потребительские продукты терпят неудачу, а прибыль приносят неброские корпоративные сценарии. -
Midjourney pivots from AI image generation to body scanning medical spa (фоновый материал о крупном июньском повороте, влияние которого продолжается)
!«メールアドレス», 2026-06-18, score 58
https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-to-medical-devices/
Сообщение о крупном повороте Midjourney от AI-изображений к бизнесу медицинского оборудования, включая ультразвуковые КТ-сканеры. В!«メールアドレス»есть также посты "Midjourney Medical" и "Midjourney Ultrasonic CT Scanner" от той же даты. -
Midjourney wants Hollywood studios to reveal the details of their AI usage
!«メールアドレス», 2026-07-05, score 73
https://techcrunch.com/2026/07/04/midjourney-wants-hollywood-studios-to-reveal-ai-usage/
Продолжение: даже после медицинского поворота Midjourney конфликтует с Голливудом вокруг авторских прав и практик использования ИИ для изображений/видео. -
Google lanciert KI-Bildgenerierung Nano Banana 2 Lite
!«メールアドレス», 2026-07-02, score 0
https://www.itmagazine.ch/artikel/87529/
Швейцарская технологическая новость о выпуске Google модели генерации изображений Gemini «Nano Banana 2 Lite». В!«メールアドレス»также был пост со ссылкой на первоисточник deepmind.google (2026-06-30). -
Seedream 5.0 Pro is here: an honest comparison and technical breakdown
!«メールアドレス»(перепечатка Reddit), 2026-07-10, score 1
https://www.reddit.com/gallery/1usc03q
Обзор и техническое сравнение закрытой модели ByteDance «Seedream 5.0 Pro». -
Google quietly discontinues its Earth AI feature a day after its rollout after users made no-no images
!«メールアドレス»(перепечатка Reddit), 2026-08-07, score 1
https://fortune.com/2026/08/07/
Сообщение, что Google отозвал функцию «Earth AI» вскоре после запуска из-за создания проблемных изображений — пример проблем с ограничителями у закрытых вендоров. -
Elon Musk maakt complete AI-film met zijn versie van The Odyssey
!«メールアドレス», 2026-07-22, score 1
https://lemy.nl/post/4342454
Нидерландская статья о том, как Илон Маск создаёт собственную интерпретацию фильма «Одиссея» с видеогенерацией Grok (xAI). Тема скорее маркетинговая и относится к закрытому сегменту. -
Same Berserk spread, 4 AI colorizations. Looks like GPT wins again?
!«メールアドレス»(перепечатка Reddit), 2026-09-14, score 1
https://www.reddit.com/gallery/1wfyqdy
Сравнение раскраски одной страницы манги четырьмя ИИ, включая модель GPT; вывод автора — GPT выглядит сильнее.
Signals
- Живые обсуждения ИИ для изображений/видео в Lemmy почти ограничены инструментами ComfyUI в
!«メールアドレス»и зеркалом Reddit!ai_reddit. Оригинальных новостей, созданных именно в Lemmy, мало. - В открытом сегменте чаще обсуждаются не отдельные модели, а процессы и расширения ComfyUI. За последнюю неделю подряд появились два расширения для MiniMax H3, что указывает на активный слой практических видеопроизводственных инструментов.
- В закрытом сегменте выделяются новости об уходе с рынка или разворотах: закрытие Sora API, медицинский поворот Midjourney, быстрый откат Google Earth AI. Историй о неудачной монетизации и коррекции курса больше, чем о громких запусках.
- Сообщества обмена работами вроде
!«メールアドレス»публикуют много изображений, но это в основном поток работ civitai без новостной ценности.
Limits
- Масштаб Lemmy существенно меньше Reddit и X: даже у
!«メールアドレス»всего 5 713 подписчиков. Собственных новостей недостаточно для целевого анализа ~20 материалов — площадка естественно укладывается в предусмотренный плейбуком диапазон «5–12». !ai_reddit— не нативная дискуссия Lemmy, а автоматическая републикация Reddit с почти нулевым числом комментариев; реакцию самого сообщества Lemmy фактически наблюдать нельзя.- Эндпоинт
/api/v3/communityLemmy часто требуетcommunity_id; некоторые сообщества (aiwars, отдельный поискimageaiи др.) возвращали 400/404 и проверялись лишь по веб-выдаче. - Поиск видеомоделей по отдельным словам («Wan», «HunyuanVideo», «Kling») даёт много шума из-за совпадения с обычными словами или сокращениями; отчётливо нативных постов Lemmy по ним найти не удалось.
Pinterest — Новости ИИ для генерации изображений и видео
Визуальные темы
- Формат превью YouTube «AI NEWS»: удивлённые/восторженные бородатые авторы на фоне неоновых скруглённых логотипов OpenAI, Google, Microsoft, Meta и Notion, разложенных сеткой — самый повторяемый стиль пинов в наборе. [1, 8, 30]
- SaaS-визуалы для инструментов AI-видеогенерации: тёмно-синие/фиолетовые UI-макеты со светящимся полем «текстовый промпт → сгенерировать» либо милый белый робот с кинохлопушкой, дополненные рядами иконок функций (Text to Video / AI Editing / Auto Soundtrack / Captions). [6, 11, 16]
- Сравнительные таблицы «лучший инструмент» и рейтинг-листы: матрицы решений с неоновыми рамками и карточки «My Top Picks», сравнивающие ChatGPT Plus, Midjourney, Gemini, Ideogram, Kling, Runway, Luma, Pika по ценам и сценариям. [10, 20]
- Визуальные предупреждения о дипфейках и дезинформации: красные штампы «FAKE», лупы над «?», морфинг глаза между человеком и каркасной моделью, бейдж «97% likely AI generated» для детекции голоса и надпись «AI GENERATED NEWS CLIP» поверх вымышленного ведущего. [4, 27, 38, 49]
- Реклама приложений для замены лиц и смешения идентичностей: два лица, растворяющиеся в треугольной сетке («Professional Face Swap»), и триптих мама + папа → предсказанный ребёнок («AI Baby in Seconds»). [43, 44]
- AI-причудливость как демонстрация стиля / приманка для вовлечения: фотореалистичная выдра в спасательном жилете на доске для сёрфинга, портрет старого рыбака и коллаж фантазийных изображений (замок, белый медведь, пара самураев, торт), показывающие качество генерации вместо новостей. [13, 34, 45]
- Поясняющие инфографики простым языком: восьмишаговая схема «как ИИ создаёт видео» (промпт → понимание языка → латентное пространство → диффузия кадров → проверка согласованности → результат), рассчитанная на широкую аудиторию, а не разработчиков. [12]
- Визуалы о трансформации редакций и экономике аватаров: коллаж диспетчерской, где экраны заполнены AI-ведущими, сетка стилизованных инфлюенсер-аватаров за одним фотореалистичным лицом и графика развилки «Human Journalism vs Machine-Generated Media». [38, 40, 23]
Примечательные пины
- #1 — «AI News: Anthropic Leak Shows Us The Future of AI...»: типичное превью с шокированным автором и логотипами OpenAI/Google/Microsoft/ChatGPT; задаёт визуальный шаблон, который копируют многие другие пины «AI NEWS».
- #3 — «Google announces ultra-high quality video...»: сетка 3×5, превращающая исходное видео в версии «из деревянных блоков / оригами / Lego / цветов» — конкретная демонстрация видеостилизации уровня Lumiere, а не просто заголовочная карточка.
- #10 — «AI Image Video: Best Quality vs Best Free»: полная матрица решений (10 платных инструментов против 10 бесплатных и сценарии использования) — самый ясный артефакт тревоги «какой AI-инструмент мне вообще выбрать» в наборе.
- #12 — «AI & Machine Learning: How AI Generates Video Infographic»: восьмишаговое объяснение диффузии/предсказания кадров от LivePhysics.com для новичков; подходящий пин, чтобы «объяснить это другу».
- #27 — «AI is getting scary good»: объединяет генераторы видео, детекторы AI-голоса («97% likely AI generated») и AI-этику в одной инфографике — наиболее концентрированное выражение темы тревоги из-за дипфейков.
- #38 — «AI News Anchors & Creator-Led Coverage Take Over U.S. Media»: коллаж редакции с AI-ведущими на стене мониторов — напрямую визуализирует вытеснение традиционных телеведущих.
- #40 — нидерландоязычный «Het perfecte avatar-tijdperk» (идеальная эпоха аватаров): одно фотореалистичное лицо перед сеткой стилизованных AI-аватаров; отражает тренд AI-инфлюенсеров и многоязычное распространение темы в Pinterest.
- #43 — Akool «Professional Face Swap» (испаноязычная реклама): лица двух женщин сливаются через лицевую сетку — коммерческий продукт face-swap продвигается непосредственно в Pinterest, а не просто обсуждается.
- #44 — «AI Baby in Seconds»: триптих мама / предсказанный ребёнок / папа — самостоятельный быстрорастущий поджанр AI-генераторов детей, а не единичный пин.
- #49 — «You Are Not Prepared for This Terrifying New Wave of AI-Generated Videos»: AI-сгенерированный фальшивый ведущий новостей с прямой внутрикадровой надписью «AI GENERATED NEWS CLIP» — самый прямолинейный предупреждающий пин в наборе.
Signals
- Усталость от выбора инструментов — главный потребительский ракурс. Большая доля пинов — сравнительные таблицы, матрицы «лучшее бесплатное против платного» и карточки «мои лучшие выборы», а не новости одного релиза. Пользователи Pinterest ищут советы по покупке и внедрению, а не объявления. [10, 20, 29]
- Тревога из-за дипфейков и дезинформации — самостоятельный визуальный жанр, а не примечание на полях: штампы FAKE, бейджи детекции голоса и метки AI-generated появляются почти так же часто, как рекламный контент инструментов. [4, 27, 38, 41, 49]
- Тренд AI-новостных ведущих имеет заметную визуальную тягу: несколько независимых пинов — коллажи редакций, контент с брендом Channel1, метки «AI generated news clip» — рассматривают AI-ведущих как актуальное явление, а не гипотезу. [38, 49, 50]
- Отсутствие: открытый исходный код почти невидим. Во всей выборке единственный явно локальный/открытый инструмент — AMD «Amuse 3.0» [34]. Скриншотов Stable Diffusion, ComfyUI и локальных интерфейсов нет, в отличие от сильного присутствия закрытых или близких к закрытым брендов (ChatGPT, Gemini, Midjourney, Kling, Runway, Luma) в логотипах и UI-макетах.
- Отсутствие: прямых скриншотов новейших названных закрытых моделей тоже нет. В выборке не встретились нативные интерфейсы Sora 2, Nano Banana или Veo 3; большинство пинов о закрытом сегменте — аффилиатные/авторские превью, обсуждающие новости, а не сам продукт.
- Предупреждение: пин #47 с заголовком «Elon Musk's New AI Already Being Used to Generate...» фактически показывает смонтированное изображение Дональда Трампа и женщины с поднятым большим пальцем в кабине самолёта, на фоне горящего Всемирного торгового центра; заголовок вообще не описывает картинку. Это конкретный пример реалистичного AI-монтажа катастрофы/политики, распространяемого с несоответствующим кликбейтным названием, и напоминание, что заголовкам пинов в этом наборе доверять нельзя.
Limits
- В этом запуске не были определены жанры: использовался один неотфильтрованный запрос «Image and Video Generation AI News», поэтому среди 50 пинов смешаны авторские превью, рекламные материалы, стоковая фотография и псевдоновостные изображения.
- Из 50 собранных картинок визуально открыли и изучили 26 — репрезентативную выборку с упором на разнообразие заголовков и тем, а не все 50. Выводы основаны на этой подвыборке.
- Несколько заголовков не соответствовали изображениям, особенно #47 (см. Signals). Поэтому тематические выводы, построенные только по таблице названий, были бы ненадёжны; этот отчёт опирается на то, что реально изображено.
- У пинов Pinterest в собранных данных нет метрик репинов/лайков. Поэтому о «трендовости» судят по повторяемости визуального стиля, а не по измеренной популярности.
- Pinterest склоняется к вторичному и производному контенту — превью, заголовкам блогов, рекламным материалам — а не к первичным анонсам продуктов. Для подтверждения точных сведений о версиях Veo или Kling нужны первичные платформы, рассмотренные в других разделах.
Рекомендуемые действия
- Отслеживать локальный OSS-стек видеогенерации (Wan, HunyuanVideo, FLUX.2, ComfyUI + MiniMax H3) как практическую альтернативу на фоне роста цен и закрытия продуктов у закрытых сервисов.
- Опережая общественный запрос на раскрытие происхождения AI-контента, усиливающийся на Reddit и Pinterest, уже сейчас подготовить сообщения о происхождении/маркировке материалов.
- После закрытия Sora 2 API 2026-09-24 наблюдать, куда перейдут пользователи; вероятные выгодоприобретатели — Kling, Seedance и Runway.
- Считать волну демонстраций генерации одним запросом с Opus 5.5 / Grok 4.7 в X краткосрочным циклом ажиотажа в момент релиза, а не долговременной угрозой вниманию к OSS.
- Наблюдать за проблемами масштабирования вычислений у DeepSeek как за ранним сигналом того, что происходит, когда внедрение открытых весов опережает инфраструктуру оператора.
- Отвечать на заметную в YouTube и Pinterest усталость «какой инструмент выбрать?» сравнительным контентом, а не новостями об одном продукте.
Собранные изображения


















































Примечание о качестве данных
Только YouTube и Pinterest достигли приблизительной цели брифа в ~20 материалов; Reddit дал лишь 12 тредов (в основном нерелевантные общие сабреддиты), более половины 40 постов X были шумом от несвязанных трендовых слов, API полнотекстового поиска Bluesky постоянно возвращал 403, поэтому охват опирался лишь на известные аккаунты, а Lemmy просто слишком мала (главное сообщество ~5 713 подписчиков, половина постов — зеркала Reddit), чтобы собрать 20 нативных публикаций.



