KEN’S CAT LOG

Новости ИИ для генерации изображений и видео — 2026-09-07

Закрытые решения сигнализируют о смене лидеров: API Sora2 будет отключён 24 сентября 2026 года, а GPT-6 Astra превращается в универсального агента. Тем временем открытая экосистема ComfyUI/MiniMax-H3/Qwen-Image-Edit ежедневно растёт и уже достигла практического уровня даже на потребительских GPU.

Последние новости ИИ для генерации изображений и видео — 7 сентября 2026 года

Ну и неделя была, конечно 🔥🔥 На стороне закрытых решений OpenAI GPT-6 Astra стремительно набирает репутацию не просто генератора изображений и видео, а «агента, который рулит другими инструментами». А бывший король Sora 2 неожиданно уже идёт к закрытию сервиса: веб-версия и приложение прекратили работу 26 апреля 2026 года, а API окончательно отключат уже в этом месяце, 24 сентября 2026 года 😱 В то же время открытые проекты развиваются не так громко, но крайне жарко: вокруг MiniMax-H3 и Qwen-Image-Edit в ComfyUI чуть ли не каждый день появляются новые компоненты, и эпоха полноценной видеогенерации на потребительских GPU — включая AMD — уже наступила 🛠️✨ Ещё одна общая для всех платформ тенденция: если становится понятно, что контент создан ИИ, его тут же начинают критиковать. Требования маркировать происхождение материалов и анти-ИИ посты собирают больше всего реакций — и это действительно неожиданно.

Across platforms 🌐

  • GPT-6 Astra ценят не как «генеративный ИИ», а как «ИИ-оператора»: и на X (@Yokohara_h, 2 156 лайков, https://x.com/Yokohara_h/status/2096622171011666003), и на YouTube (まさおAI じっくり解説ch, https://www.youtube.com/watch?v=_pAAaBv_G7A) бурно обсуждают автоматизацию 3DCG-пайплайна: ComputerUse управляет другими приложениями, включая Blender. То, что тон обсуждения на обеих платформах полностью совпадает, по-настоящему впечатляет 🔥
  • Начало конца Sora 2: на YouTube (https://www.youtube.com/watch?v=DSfAZdE5rWA) разбирают отключение API 24 сентября 2026 года — то есть через три недели, — а на Bluesky (https://bsky.app/profile/coah80.com/post/3muulvyomz72c) нашёлся разгромный пост: «SORA 2 WAS GENUINELY SO BAD». Голосов в защиту сервиса уже почти не видно 😢
  • Экосистема ComfyUI / MiniMax-H3 стала главным полем открытых разработок: в !«メールアドレス» на Lemmy (https://lemmy.dbzer0.com/post/75036488 и другие) ежедневно выходит по 3–9 новых нод и LoRA. Это подтверждают и Reddit (VPIPE на Apple Silicon M5 Pro: 1024 px, 8 шагов примерно за 45 секунд, https://www.reddit.com/r/StableDiffusion/comments/1w6bphf/), и Bluesky («локальное ПО вроде ComfyUI функциональнее большинства облачных решений», https://bsky.app/profile/ecutruin.bsky.social/post/3muv2pwq55s2t).
  • Критика ИИ-контента — главный источник вовлечённости: как показывают тред Reddit r/antiai о фальшивом таймлапсе (6 792 балла, 994 комментария, https://www.reddit.com/r/antiai/comments/1w81kdd/) и два самых залайканных поста Bluesky (критика генеративного ИИ: 121 и 100 лайков, https://bsky.app/profile/samperson.bsky.social/post/3muruvekma22b), критические публикации в духе «это вообще нормально?» заметно чаще становятся вирусными, чем посты о самих инструментах.

Platform by platform 📱

Reddit: практические сведения с открытым уклоном особенно сильны в публикациях r/StableDiffusion о локальных бенчмарках и в r/freetoolsAI со списками бесплатных инструментов — Deepany, Aifun, Perchance и других. В r/aiwars при этом критиковали качество коммерческих закрытых ИИ-изображений для рекламы еды (177 комментариев, https://www.reddit.com/r/aiwars/comments/1w69cdj/). Из-за использования лишь одного поискового запроса удалось собрать только 12 тредов вместо целевых 20.

X: было собрано 40 постов, но только 4 действительно относились к теме 😅 Остальные оказались шумом из футбольных, политических и хорватских трендов. Зато все четыре высоко оценивали GPT-6 Astra и ни один не упоминал открытые решения. Полное доминирование закрытого сегмента.

YouTube: самая насыщенная по информации площадка. Среди закрытых решений обсуждались закрытие Sora2, GPT-6 Astra, обновление Midjourney V7 с японским голосовым вводом (https://www.youtube.com/watch?v=wFHlG7wcRUQ) и Google Nano Banana 2 (https://www.youtube.com/watch?v=nikIxHM_AQY). В открытом сегменте главными темами стали Flux.2 — Dev/Klein под Apache 2.0 (https://www.youtube.com/watch?v=ISRy5Skd04U) — и Qwen-Image-Edit-2511 с множеством уроков для ComfyUI (https://www.youtube.com/watch?v=ScoIZYsoRwo). Были и проверки Wan2.2 и Hunyuan1.5 на потребительских GPU AMD (https://www.youtube.com/watch?v=a_xzC7ckwno).

Bluesky: площадка разделилась между индивидуальными пользователями инструментов и противниками ИИ. Среди закрытых решений популярен рабочий процесс Nano Banana (Gemini 3.1) + Kling 3.0 (https://bsky.app/profile/drewkav.bsky.social/post/3muubykpdfk2k), тогда как анонс новой модели Grok Imagine от xAI не получил ни одного лайка. В открытом сегменте встречались положительные отзывы о ComfyUI и пользователи Stable Diffusion WebUI reForge на AMD ROCm. Из-за ограничений API — постоянных 403 — вместо 20 удалось содержательно проверить примерно 11 постов.

Lemmy: энтузиазм на стороне открытого ПО здесь подавляющий. Только в !«メールアドレス» нашлось 11 инструментальных публикаций: Viggle-Animate, нативная интеграция Trellis.2 и Pixal3D в ComfyUI и другие. Из закрытых решений единственной заметной темой стала новость о том, что Midjourney переходит от генерации изображений к бизнесу медицинского ультразвукового сканирования (максимальный score 73, https://techcrunch.com/2026/07/04/midjourney-wants-hollywood); её перепечатывали несколько инстансов. Примечательно, что новостей собственно о Sora или Veo на Lemmy не нашлось вовсе.

Pinterest: были просмотрены все 50 заранее собранных пинов, и почти всё пространство занимали инфографики-рейтинги коммерческих закрытых сервисов — Veo, Sora, Runway, Kling, Pika, Adobe Firefly и других. Открытые инструменты почти не упоминались; редким исключением стал Amuse 3.0, продвигающий локальный запуск. Отдельным жанром стали материалы о рисках дипфейков и их обнаружении.

What to watch 👀

  • Отключение API Sora 2 24 сентября 2026 года — важно, куда в итоге мигрируют пользователи. YouTube «AI収益化ラボ» https://www.youtube.com/watch?v=YHPmaUb_X6c
  • ComputerUse / автоматизация 3DCG-пайплайна в GPT-6 Astra — дальнейшая трансформация из генеративного ИИ в производственный хаб. X https://x.com/Yokohara_h/status/2096622171011666003
  • Скорость расширения экосистемы MiniMax-H3 — Viggle-Animate, H3-World и новые компоненты появляются каждый день. Lemmy https://lemmy.dbzer0.com/post/75036488
  • Дискуссия о маркировке подлинности ИИ-контента — может ли разоблачение фальшивых таймлапсов перерасти в давление в пользу регулирования. Reddit https://www.reddit.com/r/antiai/comments/1w81kdd/
  • Смена бизнеса Midjourney: от генерации изображений к медоборудованию — возможно, предвестник изменения бизнес-моделей закрытых ИИ-компаний. Lemmy https://techcrunch.com/2026/07/04/midjourney-wants-hollywood
  • Распространение Qwen-Image-Edit × ComfyUI — как будет расти оценка его качества на уровне закрытых редакторов изображений. YouTube https://www.youtube.com/watch?v=WOcxMUwKWIk

Recommendations 💡

  • Если ваш процесс зависит от Sora2, стоит немедленно подготовить миграцию на Kling 3.0 или Veo 3.1 до отключения API 24 сентября 2026 года.
  • За ComputerUse в GPT-6 Astra стоит следить, оценивая его не как отдельный генератор, а как средство автоматизации производственного пайплайна.
  • Если нужно сократить расходы, имеет смысл сначала попробовать локальное редактирование с Qwen-Image-Edit + ComfyUI, а уже затем решать, нужна ли подписка на закрытые сервисы.
  • Чтобы снизить риск скандалов вокруг фальшивых таймлапсов и ИИ-обработки, заранее утвердите внутренние правила раскрытия использования ИИ в публичном контенте.
  • Разделённый процесс Nano Banana для статичных изображений + Kling 3.0 для видео уже получил хорошие оценки от нескольких независимых создателей, поэтому его стоит протестировать.
  • Продолжайте следить за поворотом Midjourney к медицинскому бизнесу, чтобы понять, начнут ли другие закрытые ИИ-компании аналогичную диверсификацию.

Data quality 📊

Ни одна из платформ не вполне достигла критерия завершения из brief.md — примерно 20 проанализированных публикаций на каждую соцсеть 😅 Особенно X: из 40 собранных постов по теме были только 4, поскольку поисковые запросы пришли из региональных хорватских трендов и были забиты футболом и политикой. На Bluesky почти половина поисковых запросов не дала результата из-за ограничений публичного API 403, и фактически удалось изучить лишь 11 постов. На Reddit из-за единственного запроса было 12 тредов; на Lemmy — 11 публикаций об открытых инструментах и 4 о закрытых, всего 15, поскольку специализированного новостного сообщества там просто нет. YouTube завершён по критерию плейбука — 11 видео при целевом диапазоне 5–12, — однако метаданные вроде просмотров не удалось получить из-за JS-рендеринга. Только на Pinterest были просмотрены все 50 заранее собранных элементов, но единственный запрос почти не нашёл пинов об открытом ПО. В целом, даже при недоборе количества шесть площадок независимо подтверждают один и тот же крупный тренд: рост GPT-6 Astra, закрытие Sora2 и расширение экосистемы ComfyUI. Для понимания общей картины эти данные достаточно надёжны 🙆

Сводка по платформам

Reddit

Reddit — Новости ИИ для генерации изображений и видео

Где

12 тредов из 11 сабреддитов, собранные по запросу «Image and Video Generation AI News».

Сабреддит Число участников Собрано тредов
r/antiai 316,504 1
r/generativeAI 151,065 2
r/freetoolsAI 7,817 1
r/StableDiffusion 1,001,556 1
r/teenagers 3,675,063 1
r/aiwars 166,920 1
r/RemoteWorkers 74,882 1
r/aislop 82,721 1
r/TopAITools4U 2,396 1
r/GoogleFlow 1,750 1
r/EyesWideShut 15,320 1

По составу сабреддитов видно почти равное разделение между специализированными сообществами о самой ИИ-генерации — r/StableDiffusion, r/generativeAI, r/GoogleFlow, r/TopAITools4U, r/freetoolsAI — и сообществами, настроенными против ИИ-изображений или критически к ним относящимися: r/antiai, r/aiwars, r/aislop, r/EyesWideShut, r/teenagers. В r/RemoteWorkers тема фигурирует в контексте вакансии.

Что говорят люди
  • Тред №1 r/antiai · 6 792 pt · 994 комментария · 2026-09-05 — «Warning: There is a new form of ai generated image». Пост о том, что не диффузионные модели, а LLM — указан GPT-6 — могут управлять мышью и клавиатурой, чтобы выдавать за «настоящую иллюстрацию» даже стилизованный под ручной рисунок таймлапс. Обсуждение выросло до 994 комментариев. Лучший комментарий (2 483 pt, u/Nayutantantan): «Even though i stopped using social media, stopped being an artist online... now the trends of creating fake timelapses are getting common.» Также сильно поддержано требование «немедленно сделать маркировку обязательной» (u/Soggy_Supermarket100, 170 pt).

  • Тред №5 r/teenagers · 7 pt · 41 комментарий · 2026-08-31 — «To all AI image/video generator users». Основная мысль: «ИИ лишь реализует вашу идею, а рисует на деле сам ИИ». u/LiterallyGarbage_0 (5 pt): «if you want to make art, pick up a pencil and start drawing». В то же время u/TheDarkmoore (2 pt) защищает практическую сторону: он использовал ИИ для арта карточной игры, потому что плохо рисует и нуждался в таком варианте. Мнения расходятся даже внутри одного поколения.

  • Тред №6 r/aiwars · 4 pt · 177 комментариев · 2026-09-03 — «Even a lot of Pros here will admit that current AI models suck at generating appetizing images of food». Дискуссия заметно разрослась до 177 комментариев. u/Your-local-enjoyer (9 pt) считает, что настоящая фотография честнее формирует ожидания клиента. В ответ u/Bassed_Hummble (5 pt) привёл конкретный промпт и результат, созданный локально в Krea 2 за 40 секунд: аппетитный буррито на завтрак. Это породило взгляд, что проблема может быть не в модели, а в промпте.

  • Тред №4 r/StableDiffusion · 31 pt · 10 комментариев · 2026-09-03 — «VPIPE: Not Just Video — Local Image Generation Is Fast Too». Замеры локальной генерации на Apple Silicon M5 Pro 24 GB: krea/Krea-2-Turbo-M87 (16 bit) + M87 LoRA дают 1024×1024 за примерно 45 секунд при 8 шагах; при 8-битном квантовании в реальном времени — 35 секунд. u/Glittering-Call8746 (1 pt) обсуждает разницу в скорости M5 Max и M5 Pro, а также сравнение с RTX 5000.

  • Тред №11 r/GoogleFlow · 12 pt · 6 комментариев · 2026-09-01 — «AutoFlow just got continuous AI video generation». Неофициальное расширение Chrome AutoFlow для Google Flow/Veo получило функцию Continue from Last Frame: последний кадр предыдущего клипа автоматически используется как первый кадр следующего, что упрощает создание длинных видео. Далее планируется бесшовный рендер нескольких клипов в один ролик.

  • Тред №10 r/TopAITools4U · 1 pt · 10 комментариев · 2026-09-01 — «Tested 4 best AI video generators in 2026 for beginners». Автор сравнил Sora 2 — кинематографичный, но дорогой и не всегда доступный, Kling AI — для реалистичного B-roll, DomoAI — для аниме и переноса стиля, и Google Veo 3.1 — одновременная генерация видео и звука с бесплатным тарифом. В комментариях u/brarkaddy (2 pt) также предлагает добавить бесплатную видеогенерацию Qwen.

  • Тред №3 r/freetoolsAI · 38 pt · 45 комментариев · 2026-09-04 — «Free AI Image Generator». В ответ на сервис aifreeforever.com, обещающий бесплатную неограниченную генерацию без регистрации, u/Odd-Lingonberry1516 (3 pt) перечислил альтернативы: Deepany на z-image turbo/illustrious, Aifun на wai illustrious с двумя бесплатными видео в день и Perchance на Stable Diffusion/flux. u/Relevant_Syllabub895 (2 pt) недоволен ограничениями NSFW.

  • Тред №2 r/generativeAI · 43 pt · 29 комментариев · 2026-08-31 — «List of daily AI video generative websites». u/Jenna_AI (4 pt, ИИ-бот) приводит конкретные бесплатные лимиты Kling AI: 66 кредитов каждые 24 часа, что соответствует 2–6 видео по пять секунд в сутки. u/Julia_Leeds94 (2 pt) сообщает, что в YalleryLabs пятисекундное 720p-видео обходится в $0.18 при бюджете $3.

  • Тред №12 r/EyesWideShut · 35 pt · 9 комментариев · 2026-09-06 — «AI generated images shouldn't be allowed here». Участники спорят о публикации скриншота фильма Кубрика, обработанного ИИ. Автор обвиняет её в распространении дезинформации. Создатель изображения u/ffcc01 (2 pt) возражает, что лишь наложил две фотографии и не менял содержание. В сообществе столкнулись разные взгляды на допустимые границы ИИ-обработки.

  • Тред №8 r/RemoteWorkers · 130 pt · 623 комментария · 2026-09-04 — «Get Paid $30/Hour Reviewing AI-Generated Images». Вакансия с оплатой $30 в час за проверку ИИ-сгенерированных подписей к изображениям: выявление ошибочно распознанных объектов, цветов и текста. Комментариев необычно много — 623, — однако в основном это однословные сообщения «images» в попытке получить ссылку для подачи заявки, а не содержательная дискуссия.

  • Тред №9 r/aislop · 37 pt · 4 комментария · 2026-09-06 — «Saw this on a news article, an AI slop image explaining what is AI slop». ИИ-картинка из новости, объясняющая, что такое «ИИ-слоп», была отмечена как самоироничный пример. Комментариев всего четыре, глубокого обсуждения не возникло.

Сигналы
  • Растущий тренд: отчёты о локальной генерации и открытых реализациях — VPIPE/Krea 2 в треде №4 — положительно воспринимаются, когда сопровождаются конкретными бенчмарками: временем, количеством шагов и оборудованием. В r/StableDiffusion ключевым критерием становится сочетание скорости и качества.
  • Растущий тренд: требования маркировать подлинность ИИ-контента в треде №1 получили сильную поддержку на уровне 994 комментариев. Конкретно обозначен новый риск — подделка таймлапсов.
  • Игнорируется или высмеивается: коммерческие ИИ-изображения закрытых моделей, особенно для рекламы еды, даже в r/aiwars воспринимаются как качество, которое трудно защищать. Дискуссия из 177 комментариев почти полностью склоняется к критике.
  • Неожиданное наблюдение: существенную часть обсуждений вели ИИ-боты — u/Jenna_AI встречается и в треде №2, и в №7. Основная ценность чаще состоит не в глубокой человеческой дискуссии, а в практической информации, такой как списки бесплатных лимитов.
  • Конфликт: в треде №12, EyesWideShut, сторонники позиции «ИИ-обработка означает изменение и дезинформацию» прямо спорят со сторонниками «простая компоновка не изменила содержание». Ясного консенсуса о допустимой границе ИИ-обработки нет.
  • Неожиданное наблюдение: тред №8 стал самым вовлекающим — 623 комментария, — но почти все они были однословными попытками получить ссылку на вакансию. Это характерный пример того, что число комментариев не равно глубине обсуждения.
Ограничения
  • Использовался лишь один запрос — «Image and Video Generation AI News». Дополнительные запросы вроде «open source image generation», «closed source video AI» и названий сервисов Midjourney, Sora, Kling и других не выполнялись. Поэтому данные смещены к темам, найденным по общему запросу.
  • Вместо примерно 20 тредов, требуемых brief.md для каждой соцсети, удалось собрать только 12.
  • У тредов №7 и №9 лишь 1 и 4 комментария соответственно; в некоторых случаях ответил только бот u/Jenna_AI, поэтому материала для глубокого анализа мало.
  • Период сбора охватывает только примерно одну неделю, с 31 августа по 6 сентября 2026 года. Сравнить с более ранними трендами нельзя.
  • Лишь немногие треды можно однозначно отнести к оси закрытый/открытый код: ближе к закрытым — №6, №10, №11; ближе к открытым — №3, №4. Чтобы получить по десять наблюдений для финального отчёта, необходимо дополнять данные другими платформами.

X

X — Новости ИИ для генерации изображений и видео

Аккаунты

Из 40 собранных постов 37 аккаунтов только четыре действительно были связаны с темой генерации изображений и видео. Все они — индивидуальные аккаунты с одним постом, не крупные «производители вирусного контента», а авторы, делящиеся непосредственным опытом использования инструментов.

Аккаунт Имя Постов Лайков Характер
@aigeboku AI様の下僕 1 1,281 Частный пользователь, тестирующий ComputerUse в GPT-6 Astra
@MiraMusic_AI MiraMusic 1 525 Аккаунт об ИИ-анимации
@manaimovie Mankyu 1 562 Индивидуальный создатель 3D-моделей и ИИ-видео
@Yokohara_h Hirokazu Yokohara 1 2,156 Наибольший отклик среди четырёх, технический автор

Остальные 33 аккаунта — начиная с @kaihavertz29 с 96 184 лайками — публиковали о футболе, F1, немецкой политике, биткоине и Боснии; к теме они отношения не имели. Подробности ниже, в разделе «Ограничения».

Посты
  • №29 @aigeboku (2026-09-05 · 1 281 лайк · 135 репостов · 14 ответов · около 94 000 просмотров) https://x.com/aigeboku/status/2096187322924687799 — «Как и говорят, GPT-6 Astra очень хорошо умеет “управлять другими”, так что с ComputerUse возможности заметно расширяются 😎🙌». Astra оценивается не столько как генератор изображений и видео, сколько как основа для управления другими приложениями.

  • №30 @MiraMusic_AI (2026-09-06 · 525 лайков · 50 репостов · 6 ответов · около 26 000 просмотров) https://x.com/MiraMusic_AI/status/2096441679847006358 — «【Поделиться созданием ИИ-аниме ①】Попробовал сделать город с GPT-6 Astra и blender! Видео сделано за 15 минут, так что может быть не очень понятно...». Практический пример создания фоновой художественной среды с GPT-6 Astra и Blender.

  • №31 @manaimovie (2026-09-05 · 562 лайка · 61 репост · 19 ответов · около 35 000 просмотров) https://x.com/manaimovie/status/2096176821377380677 — «Я отдал Astra-сэнсэю модель, сделанную в Tripo, и попросил её оживить — получилось вот так. Многое ещё вызывает вопросы, но заметно лучше, чем с Fable или Sol!». Автор прямо сравнивает Astra с похожими инструментами Fable и Sol и оценивает её преимущество.

  • №32 @Yokohara_h (2026-09-06 · 2 156 лайков · 299 репостов · 19 ответов · около 178 000 просмотров; самый высокий отклик из четырёх) https://x.com/Yokohara_h/status/2096622171011666003 — «Передаёшь изображение — и Blender автоматически моделирует городской фон, а также автоматически монтирует breakdown. Качество пока ещё далеко от хорошего, но чувствуется начало эпохи, когда 3DCG создаётся не руками человека». При сохранении оговорки о незрелости качества автор видит переломный момент в переходе к созданию 3DCG без ручной работы.

Среди остальных 36 из 40 собранных постов не было ни одного упоминания ИИ для генерации изображений и видео — ни закрытого, ни открытого.

Сигналы
  • Растущий тренд: GPT-6 Astra, закрытое решение, привлекает внимание именно как средство «управлять другими инструментами» — ComputerUse и интеграция с Blender. Его описывают не как отдельную модель генерации изображений или видео, а как хаб для автоматизации всего 3DCG-производственного пайплайна — №29, №30, №32.
  • Неожиданное наблюдение: все четыре автора оговаривают, что «качество ещё грубое» или «есть много вопросов», но всё равно оценивают технологию положительно. Высокие ожидания соседствуют со сдержанной оценкой качества — №31, №32.
  • Игнорируется / не упоминается: открытые решения для генерации изображений и видео — Stable Diffusion, Krea, Kling, Veo и другие — не упомянуты ни разу. Релевантные посты на X полностью смещены к закрытому GPT-6 Astra.
  • Инструменты, упомянутые для сравнения: Fable и Sol — №31. В самом посте они не объясняются подробнее, поэтому требуется дополнительная проверка.
  • Масштаб вовлечённости невелик по сравнению с нерелевантными трендами: футбол — максимум 96 184 лайка, политика — 10 062 и так далее. Даже максимум в 2 156 лайков не позволяет говорить, что тема по-настоящему вирусна на X.
Ограничения
  • Поисковые запросы не соответствовали теме: использовались Arsenal, Kimi, Charles, Chelsea, Harvey, Germany, $SONG, Astra, Bitcoin и Bosnia, взятые напрямую из трендов X Explore. Кроме Astra, это футбол, F1, имена и дни рождения, немецкая политика, криптовалюты и разговоры о Боснии — не ИИ для изображений и видео. Из 40 постов 36 были нерелевантным шумом; содержательные результаты дала лишь Astra.
  • Критерий завершения не выполнен: вместо примерно 20 релевантных постов на каждую соцсеть собрано только 4.
  • Региональность Explore: в колонке Where для $SONG и Bosnia указано «Trending in Croatia», поэтому сеанс Explore был локализован под Хорватию/Балканы. Это не мировые тренды. Колонка «Posts on X» при этом была пустой, так что показатель количества публикаций получить не удалось.
  • Открытые проекты на X не найдены: в этом сборе не было ни одного поста об открытой ИИ-генерации изображений или видео. Необходимо компенсировать это данными других платформ, например Reddit.
  • Все четыре релевантных поста принадлежат японским аккаунтам; реакция англо-, китайско- и других языковых сообществ не собиралась.

YouTube

YouTube — Новости ИИ для генерации изображений и видео

Каналы
Канал Направление Темы
AI大学【AI&ChatGPT最新情報】 Японский объяснительный канал Разборы актуальных моделей ИИ, включая GPT-6 Astra
まさおAI じっくり解説ch Японский объяснительный канал Практические тесты и обзоры моделей ИИ
RKJ VIDEO【イケている動画を作りたいなら】 Японский специализированный канал о видеогенерации Sora/Veo/Kling и другие ИИ для видео
AI収益化ラボ Японский канал о монетизации Монетизация ИИ-инструментов и последствия закрытия сервисов
StableDiffusion等 チュートリアル&自作アニメ Японский канал об открытом ПО Изначально уроки по Stable Diffusion, но теперь также новости закрытых сервисов, включая закрытие Sora2
AIたろう Японский объяснительный канал Разборы возможностей ИИ для изображений, включая Midjourney
Teacher's Tech Англоязычный объяснительный канал Обзоры инструментов Google и ИИ-функций
OpenArt Англоязычный, близкий к официальному Видео об интерфейсах доступа к моделям, например Flux.2
Donato Capitella Англоязычный технический канал Проверки открытой генерации изображений и видео на локальных GPU, включая AMD
ErrorFixer Англоязычный учебный канал Уроки по работе с открытыми моделями в ComfyUI
AI Search Англоязычный обзорный канал Быстрые обзоры новых ИИ-инструментов для изображений и видео

Число подписчиков находится в JS-рендеринге видеостраниц и не извлекалось через WebFetch из youtube.com/watch или youtube.com/results. Здесь приводится только информация, подтверждённая сниппетами поиска и лёгким API oEmbed, который возвращает заголовок и имя канала.

Видео
  • «OpenAIの最新AIモデル『GPT-6 Astra』徹底解説!ほぼ全てのベンチマークでClaude Fable 5.1超え、史上最も賢く安全» — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=jtavLwXCZeQ — утверждается, что GPT-6 Astra, представленная 3 сентября 2026 года, превосходит Claude Fable 5.1 почти во всех бенчмарках и является самой умной и безопасной моделью в истории. Акцент сделан не на генерации изображений и видео, а на универсальных агентных возможностях, включая управление браузером и написание кода.

  • «【現環境最強】『GPT-6 Astra』を実際に使ってきた結果、最もAGIに近いモデルと感じたので解説» — まさおAI じっくり解説ch — https://www.youtube.com/watch?v=_pAAaBv_G7A — автор после практического использования считает модель «наиболее близкой к AGI» из существующих. Высоко оценивается способность ComputerUse управлять другими приложениями; это совпадает с оценками GPT-6 Astra на X.

  • «VEO 3.1とSORA2どっちがすごい?最新比較!» — RKJ VIDEO【イケている動画を作りたいなら】 — https://www.youtube.com/watch?v=JuGPYl0V9UA — сравнение Veo 3.1, представленной 15 октября 2025 года, и Sora 2 по функциям и качеству. Видео вышло вскоре после запуска Sora 2 и, вероятно, вне 60-дневного окна, но включено как контекст для последующих новостей о закрытии Sora2.

  • «Sora2完全終了…なぜ突然消えたのか?公式情報で徹底解説» — StableDiffusion等 チュートリアル&自作アニメ — https://www.youtube.com/watch?v=DSfAZdE5rWA — на основе официальной информации разбирается прекращение веб-версии и приложения Sora 2 26 апреля 2026 года и планируемое отключение API 24 сентября 2026 года, через три недели после даты отчёта. В качестве одного из объяснений приводится необходимость высвободить вычислительные ресурсы для разработки AGI.

  • «【サービス終了】世界一の動画生成AI『Sora2』が使えなくなったので解説します» — AI収益化ラボ — https://www.youtube.com/watch?v=YHPmaUb_X6c — разбирается влияние закрытия Sora2 на авторов, зарабатывавших на контенте. Упоминаются экспорт данных через sora.chatgpt.com/sunset и необходимость перехода на API Kling, Runway и других сервисов.

  • «Midjourney がV7にアップデート!使い方から新機能まで完全解説します!日本語音声入力も可能に。» — AIたろう — https://www.youtube.com/watch?v=wFHlG7wcRUQ — обзор новых функций Midjourney V7: инструмент генерации видео, разговорный режим и японский голосовой ввод. Показано, как давний лидер генерации изображений интегрирует возможности text-to-video.

  • «The New Gemini Image Generator is Insane (Nano Banana 2)» — Teacher's Tech — https://www.youtube.com/watch?v=nikIxHM_AQY — проверка функции генерации изображений Gemini Nano Banana 2, которую автор оценивает как серьёзный шаг вперёд по сравнению с предыдущим поколением. Это показывает, что конкуренция закрытых генераторов изображений расширяется от Midjourney и Ideogram к Google Gemini.

  • «FLUX.2 Has Landed On OpenArt!» — OpenArt — https://www.youtube.com/watch?v=ISRy5Skd04U — рассказывает о появлении на OpenArt семейства Flux.2 от Black Forest Labs — Pro/Flex/Dev/Klein, анонсированного 25 ноября 2025 года. Подчёркиваются открытые веса Dev/Klein под Apache 2.0, поддержка десяти референсных изображений и редактирование в 4 MP.

  • «Video and Image Generation on AMD R9700 AI PRO (Qwen Image, Wan 2.2, Hunyuan 1.5)» — Donato Capitella — https://www.youtube.com/watch?v=a_xzC7ckwno — тестирует три открытые модели: Qwen Image, Wan 2.2 и Hunyuan 1.5 — на потребительском GPU AMD R9700 AI PRO. Это показывает, что открытая генерация изображений и видео постепенно перестаёт требовать исключительно топового оборудования NVIDIA.

  • «Edit Any Image with Text in ComfyUI — Qwen Image Edit 2511 (Free Local Tutorial 2026)» — ErrorFixer — https://www.youtube.com/watch?v=ScoIZYsoRwo — урок по локальному использованию в ComfyUI открытовесовой модели редактирования изображений Alibaba Qwen-Image-Edit-2511, выпущенной 26 декабря 2025 года. Демонстрируются текстовое редактирование и генерация ракурсов.

  • «This new AI image editor is a BEAST. Qwen Image Edit tutorial» — AI Search — https://www.youtube.com/watch?v=WOcxMUwKWIk — ещё одна проверка Qwen-Image-Edit, 20-миллиардной модели с нативной поддержкой ControlNet. Её оценивают как сопоставимую по качеству с закрытыми инструментами редактирования.

Сигналы
  • Главная тема закрытого сегмента — GPT-6 Astra, выпущенная 3 сентября 2026 года: её представляют не как отдельную модель изображений и видео, а как универсального агента, способного управлять браузером и приложениями через ComputerUse и выполнять задачи видеомонтажа. Это совпадает с наблюдением X: Astra воспринимается как производственный хаб, например в связке с Blender.
  • Закрытие Sora 2 — одна из крупнейших новостей в закрытой видеогенерации: веб-версия и приложение завершили работу 26 апреля 2026 года, а API планируется отключить 24 сентября 2026 года. Несколько каналов обсуждают не новые функции Sora2, а причины закрытия и варианты перехода.
  • На роль преемника Sora2 претендует Kling: Kling 2.6 от 3 декабря 2025 года добавил синхронизацию аудио, а Kling 3.0 от 4 февраля 2026 года — 4K 60 fps и мультикадровые сцены. Сервис прямо называют одним из вариантов перехода после закрытия Sora2.
  • Главный открытый редактор изображений сейчас — Qwen-Image-Edit: частота уроков по ComfyUI высока, в том числе в сериях нескольких каналов; его присутствие заметнее новых уроков по одному только Stable Diffusion. Результаты поиска по Stable Diffusion в основном сводятся к стандартным гайдам по установке и спискам моделей, без яркой новостной составляющей.
  • Открытая видеогенерация начинает оформляться в три линии: Wan 2.2 от Alibaba под Apache 2.0, HunyuanVideo 1.5 от Tencent и LTX-2 от Lightricks, вышедшая 6 января 2026 года и ставшая первой открытой моделью, одновременно генерирующей звук и видео в 4K/50 fps. В ходе поиска попадались страницы, заявлявшие об открытых весах Wan 2.7, однако на официальных HuggingFace/GitHub Wan-AI такой версии нет; это похоже на SEO-дезинформацию, а последняя официальная открытая версия — Wan 2.2.
  • Каналы начинают пересекать границы между сегментами: канал StableDiffusion等 チュートリアル&自作アニメ, изначально посвящённый Stable Diffusion, теперь освещает и закрытие Sora2. Это может означать, что аудитория всё чаще интересуется одновременно открытыми и закрытыми решениями.
Ограничения
  • youtube.com/results и youtube.com/watch рендерятся на клиенте через JavaScript. WebFetch возвращает только навигационные ссылки из footer, а не заголовки, каналы, просмотры и даты. Поэтому видео находились по сниппетам WebSearch и YouTube oEmbed API, возвращающему только заголовок и канал.
  • Из-за этого точные просмотры и даты публикации большинства видео получить не удалось. Во избежание выдумывания просмотры не указаны вовсе, а даты основаны только на сниппетах и публичных датах релизов моделей.
  • Не удалось строго отфильтровать ролики по правилу плейбука «отдавать приоритет публикациям за последние 60 дней». Например, сравнение VEO3.1 и SORA2, вероятно, опубликовано примерно в октябре 2025 года, но оно включено единственным контекстным материалом к новостям о закрытии Sora2.
  • Требование brief.md о примерно 20 публикациях на каждую соцсеть формально отличается от критерия плейбука YouTube — 5–12 видео. Этот этап считается завершённым по критерию плейбука: собрано 11 видео.
  • Содержимое комментариев удалось увидеть только в пределах сниппетов поиска; подробный анализ топ-комментариев и настроений не проводился.
  • Каналы на китайском языке не анализировались, хотя Qwen от Alibaba и Kling от Kuaishou — модели китайского происхождения, поэтому реакция китайскоязычных сообществ не отражена.

Bluesky

Bluesky — Новости ИИ для генерации изображений и видео

Аккаунты

Через публичный API Bluesky (https://api.bsky.app/xrpc/app.bsky.feed.searchPosts) выполнялся поиск по Stable Diffusion, Sora 2, Midjourney, Grok Imagine, ComfyUI, Veo 3 и Nano Banana. Из результатов были отобраны аккаунты, действительно связанные с ИИ для изображений и видео.

Аккаунт Характер Связь с темой
@xai-bot.bsky.social Официальный бот xAI Сообщает о новых моделях Grok Imagine, закрытого сервиса
@codename.cc Бот отслеживания обновлений приложений Сообщает об обновлениях функции Imagine в Grok iOS
@drewkav.bsky.social Индивидуальный художник Делится работой, созданной с Gemini 3.1 Nano Banana 2 и Kling 3.0
@triflingtree.bsky.social Индивидуальный художник Публикует работы Nano Banana Pro
@gentile-of-hope.bsky.social(希望の異邦人) Частный критик генеративного ИИ Критикует Stable Diffusion, ChatGPT и Gemini с этической и экологической позиции
@samperson.bsky.social Частный автор, сторона художников Распространяет поддержку антигенеративной политики Procreate
@ecutruin.bsky.social Пользователь локальной генерации Говорит о функциональном преимуществе локальных инструментов вроде ComfyUI
@digitalhowl.bsky.social(Fenris) Частный видеосоздатель Делится профессиональной видеоработой с ComfyUI + Minimax H3
@kerzefasta.bsky.social Иллюстратор фан-арта Регулярно публикует персонажей Kantai Collection через Stable Diffusion WebUI reForge и ROCm; больше всего лайков среди результатов Stable Diffusion
@aichina.news Автоматический бот Массово публикует LoRA на базе FLUX под Apache-2.0, почти без вовлечённости

В целом на Bluesky по теме пишут не новостные аккаунты, а две полярные группы: индивидуальные пользователи инструментов и противники генеративного ИИ. В отличие от X и Reddit, специализированных новостных аккаунтов или сообществ здесь не видно.

Посты
  • @xai-bot.bsky.social (2026-09-05 · 0 лайков) https://bsky.app/profile/xai-bot.bsky.social/post/3mus2woiczo2w — «Grok Imagine Video 1.5 agent is now available. Powered by our newest Image 2.0 model...». Официальный анонс нового видеоагента Grok Imagine от xAI, закрытого продукта, не получил ни лайков, ни репостов в данном поисковом срезе.

  • @codename.cc (2026-09-06 · 0 лайков) https://bsky.app/profile/codename.cc/post/3muspbmaiq22n — «SHIPPED: Grok iOS updated to 1.4.33 with improvements to Chat, Voice and Imagine features.». Запись частного трекера изменений приложений.

  • @drewkav.bsky.social (2026-09-06 · 9 лайков) https://bsky.app/profile/drewkav.bsky.social/post/3muubykpdfk2k — работа «Persistent Dream», для которой статичное изображение было создано в Gemini 3.1 Nano Banana 2, а видео — в Kling 3.0. Это пример рабочего процесса, сочетающего два закрытых сервиса — Google и Kling.

  • @triflingtree.bsky.social (2026-09-06 · 15 лайков · 1 репост) https://bsky.app/profile/triflingtree.bsky.social/post/3mutz2tm3bc2m — изображение византийской «инопланетной мадонны с младенцем», сгенерированное в Nano Banana Pro. Это наиболее залайканная из собранных публикаций о Nano Banana.

  • coah80.com (2026-09-06 · 0 лайков) https://bsky.app/profile/coah80.com/post/3muulvyomz72c — «SORA 2 WAS GENUINELY SO BAD HOWD WE CALL THIS GOOD». Резкая критика Sora 2, согласующаяся с отмеченным на YouTube завершением веб-, приложения и скорым отключением API.

  • @gentile-of-hope.bsky.social (2026-09-05 · 100 лайков · 42 репоста) https://bsky.app/profile/gentile-of-hope.bsky.social/post/3murgar5zys2j — «Не только Stable Diffusion, но и функции генерации изображений в ChatGPT и Gemini основаны на неэтичном масштабном присвоении данных. (...) Генерация изображений потребляет огромные объёмы электричества и воды и разрушает окружающую среду». Это самый залайканный из собранных постов и пример того, что критика ИИ в целом получает наибольшую вовлечённость вне зависимости от открытости модели.

  • @samperson.bsky.social (2026-09-05 · 121 лайк · 11 репостов) https://bsky.app/profile/samperson.bsky.social/post/3muruvekma22b — распространение поддержки антигенеративной позиции Procreate, приложения для рисования. Это максимальное число лайков во всей выборке.

  • @ecutruin.bsky.social (2026-09-06 · 1 лайк) https://bsky.app/profile/ecutruin.bsky.social/post/3muv2pwq55s2t — «local software like ComfyUI has more features than the majority of hosted solutions». Положительная оценка функционального преимущества локальной открытой среды.

  • @digitalhowl.bsky.social (2026-09-06 · 0 лайков) https://bsky.app/profile/digitalhowl.bsky.social/post/3muuu24tqf22g — автор сообщает, что использует ComfyUI и Minimax H3 для «professional grade video work». Это пример гибридного подхода — открытая база плюс коммерческая модель.

  • @kerzefasta.bsky.social (2026-09-05–06 · несколько постов, максимум 29 лайков и 10 репостов) https://bsky.app/profile/kerzefasta.bsky.social/post/3muroxdlm4k2j — последовательные иллюстрации персонажей Kantai Collection, сделанные в Stable Diffusion WebUI reForge на ROCm и GPU AMD. Это не новость, но наиболее стабильно вовлекающий аккаунт по запросу Stable Diffusion.

  • @aichina.news (2026-09-06 · 0 лайков; более 20 однотипных публикаций в час) https://bsky.app/profile/aichina.news/post/3muup3wwiad2i — «Apache-2.0 LoRA for Flux, small enough to drop into ComfyUI or Diffusers». Бот механически массово публикует FLUX LoRA для Huawei Ascend/Modelers.cn, без триггерных слов и примеров. Он увеличивает объём результатов по открытому ПО, но не создаёт реальной дискуссии.

Сигналы
  • Закрытые решения: Nano Banana — Gemini 3.1 / Nano Banana Pro — чаще всего упоминается в практических работах независимых создателей. В нескольких постах подтверждён разделённый процесс: Nano Banana для статичного изображения, Kling 3.0 для его анимации.
  • Закрытые решения: официально анонсированные Grok Imagine Video 1.5 / Image 2.0 не получили ни лайков, ни репостов. Анонсы формата пресс-релиза на Bluesky теряются в ленте.
  • Закрытые решения: Sora 2 упоминается только в резко отрицательном ключе — «SORA 2 WAS GENUINELY SO BAD». Поддерживающих постов не найдено; это соответствует тенденции закрытия, наблюдаемой на YouTube.
  • Открытые решения: пользователи ComfyUI говорят о конкретном преимуществе — локальное ПО предлагает больше функций, чем хостинговые сервисы. Отношение положительное.
  • Открытый сегмент / шум: основную массу результатов по Stable Diffusion, Flux и подобным словам составляют: 1) фан-арт, включая Kantai Collection; 2) внешние ссылки на NSFW-контент; 3) боты без отклика вроде @aichina.news. Новостных обсуждений мало.
  • Главный источник вовлечённости — критика генеративного ИИ: два самых залайканных поста выборки, 121 и 100 лайков, выступают против генеративного ИИ как такового. Они значительно превосходят посты об использовании инструментов, максимум 15 лайков. Это может говорить о том, что пользовательская база Bluesky сильнее склонна к анти-ИИ высказываниям, чем X или Reddit.
Ограничения
  • Ограничения API: эндпоинт public.api.bsky.app отвечал 403 на все запросы. Альтернативный api.bsky.app работал, но при нескольких новых запросах подряд также часто возвращал 403 из-за лимитов. Запросы «Kling AI», Wan2.2, HunyuanVideo, Qwen Image, Krea и Sora shutdown примерно в половине случаев не вернули данных вовсе.
  • Веб-интерфейс недоступен для извлечения: bsky.app/search — SPA на JavaScript, поэтому WebFetch получает только метаданные страницы, а не текст публикаций. Фактически единственным источником был API.
  • Недостаточно публикаций: вместо целевых примерно 20 содержательно проверить удалось около 11. В API много шума: например, «Sora» совпадает с именем персонажа Kingdom Hearts, встречаются боты трендовых хештегов. Реальное число тематических постов ещё меньше.
  • Ограничения показателей вовлечённости: публичный API Bluesky возвращает лайки, репосты и ответы, но не просмотры, поэтому фактический охват неизвестен.
  • Не удалось получить детали отдельных постов: запрос app.bsky.feed.getPostThread для отдельного поста samperson.bsky.social вернул 400, так что полный текст проверен не был — только сниппет результатов поиска.
  • Смещение к отдельным аккаунтам: результаты концентрируются вокруг некоторых пользователей — фан-арта @kerzefasta.bsky.social и автоматических LoRA-анонсов @aichina.news. Они не могут считаться репрезентативными для широкой аудитории.

Lemmy

Lemmy — Последние тенденции ИИ для изображений и видео

Сообщества
  • !«メールアドレス» — 5 708 подписчиков, 1 386 публикаций. Фактический главный центр открытого ИИ для изображений и видео: модели, ноды ComfyUI, LoRA и другое. Новые инструменты появляются почти ежедневно. https://lemmy.dbzer0.com/c/stable_diffusion
  • !«メールアドレス» — 2 361 подписчик, 3 500 публикаций. Место для работ, созданных Stable Diffusion и открытовесовыми моделями; скорее галерея, чем новостное сообщество. https://lemmy.dbzer0.com/c/stable_diffusion_art
  • !«メールアドレス» — 4,82 тыс. подписчиков; на lemmy.world локально около 1,8 тыс. Охватывает свободный и открытый ИИ в целом, а публикаций специально о генерации изображений и видео мало. https://lemmy.world/c/fosai
  • !«メールアドレス», !«メールアドレス», !«メールアドレス» — именно сюда попадают новости закрытых ИИ-компаний, включая Midjourney. Это не специализированные сообщества об ИИ-генерации, а общие технологические и новостные площадки.
Публикации
Ближе к открытому сегменту, главным образом !«メールアドレス»
  1. MiniMax-H3_Singularity — дообученная объединённая модель на базе видеомоделей MiniMax-H3. Score 3, 2026-09-06. https://lemmy.dbzer0.com/post/75088455 (оригинал: https://huggingface.co/WarmBloodAban/Minimax-h3_Singularity)
  2. Qwen3.8-Flash-Next-NVFP4 — квантованная NVIDIA-версия модели Qwen в NVFP4. Score 3, 2026-09-06. https://lemmy.dbzer0.com/post/75088454 (https://huggingface.co/nvidia/Qwen3.8-Flash-Next-NVFP4)
  3. ComfyUI-AetherScale — новое расширение для ComfyUI. Score 5, 2026-09-05. https://lemmy.dbzer0.com/post/75036491 (https://github.com/vizart-vj/ComfyUI-AetherScale)
  4. Viggle-Animate — модель видеомонтажа, заменяющая персонажа в видео по одному перерисованному изображению. Score 9 — наивысший в этом треде, 2026-09-05. https://lemmy.dbzer0.com/post/75036488 (https://huggingface.co/Viggle/Viggle-Animate)
  5. FastH3-Ref2V-Stream-Controller — контроллер ComfyUI для непрерывной генерации видео. Score 2, 2026-09-04. https://lemmy.dbzer0.com/post/74988027 (https://github.com/EarthDefenceForces/FastH3-Ref2V-Stream-Controller)
  6. ComfyUI-Majoor-OmniCam — инструмент раскладки камер и анимации для ComfyUI. Score 4, 2026-09-04. https://lemmy.dbzer0.com/post/74988020 (https://github.com/MajoorWaldi/ComfyUI-Majoor-OmniCam)
  7. H3-World — представлен как «первая интерактивная мировая модель на базе MiniMax-H3». Score 3, 2026-09-02. https://lemmy.dbzer0.com/post/74893520 (https://huggingface.co/DANNY621/H3-World)
  8. ComfyUI-MiniMaxH3-CLSS — нода, позволяющая генерировать видео с аудио произвольной длины на 16 GB VRAM. Score 0, 2026-09-01. https://lemmy.dbzer0.com/post/74843957 (https://github.com/nazgut/ComfyUI-MiniMaxH3-CLSS)
  9. Trellis.2 and Pixal3D Now Native in ComfyUI — модели 3D-генерации Trellis.2 и Pixal3D нативно интегрированы в ComfyUI. Score 4, 2026-09-01. https://lemmy.dbzer0.com/post/74843948 (https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native)
  10. ComfyUI-DLSS5-NR — экспериментальная поддержка ComfyUI с нейронным рендерингом NVIDIA DLSS 5. Score 2, 2026-09-01. https://lemmy.dbzer0.com/post/74843949 (https://github.com/lisitskyaa/ComfyUI-DLSS5-NR)
  11. LLaDA-Image — исследовательская статья о генерации изображений на основе диффузионных моделей на arXiv. Score 3, 2026-09-04. https://lemmy.dbzer0.com/post/74988021 (https://arxiv.org/abs/2609.03796)
Ближе к закрытому сегменту
  1. Midjourney pivots from AI image generation to body scanning medical spa — сообщается, что Midjourney уходит от генерации ИИ-изображений к медицинскому сканированию тела с помощью ультразвука — Midjourney Medical. Score 58, 2026-06-18, !«メールアドレス». https://lemmy.zip/post/66397234 (исходная статья: https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/)
  2. Midjourney AI pivots to Theranos: Ultrasonic CT — критический комментарий к той же новости. Score 40, 2026-06-19, !«メールアドレス». https://awful.systems/post/8731127 (https://pivot-to-ai.com/2026/06/19/midjourney-ai-pivots-to-theranos-ultrasonic-ct/)
  3. Midjourney Medical / Midjourney Ultrasonic CT Scanner — две публикации с прямыми ссылками на официальную страницу Midjourney. Score 3 и 2, 2026-06-18, !«メールアドレス». https://lemmy.bestiver.se/post/1175129 / https://lemmy.bestiver.se/post/1175130
  4. Midjourney wants Hollywood studios to reveal AI usage details — статья о том, что Midjourney требует от голливудских студий раскрывать использование ИИ. Score 73, 2026-07-05, !«メールアドレス». https://techcrunch.com/2026/07/04/midjourney-wants-hollywood
Сигналы
  • Энергия вокруг ИИ для изображений и видео на Lemmy почти полностью сосредоточена в открытом сегменте. Центральное место занимает !«メールアドレス», где почти ежедневно выходит по 3–9 материалов об экосистеме видеомодели MiniMax-H3: LoRA, ноды ComfyUI, ускорение VAE, motion cache и другое. Туда же попадают квантованные версии Qwen и статья LLaDA-Image.
  • Единственный заметный кластер новостей о закрытых решениях — переход Midjourney от генерации изображений к медицинскому ультразвуковому сканированию в июне 2026 года. Его перепечатывали на нескольких инстансах — lemmy.zip, awful.systems и lemmy.bestiver.se, — а score 40–73 высок для этой темы. При этом релизы Sora, Veo, Kling, Runway, Nano Banana и Flux.2 на Lemmy почти не появились как новостные статьи.
  • Поиск «Veo 3» и «Kling AI» не дал на Lemmy ни одной публикации; комбинированный поиск Runway/Kling/Veo/Gemini image также не дал результатов. Пользователи Lemmy, по-видимому, реагируют скорее на инструменты, которые можно реально запустить в ComfyUI — ноды, LoRA и оптимизации, — чем на анонсы новых моделей.
Ограничения
  • Lemmy — небольшая сеть по числу пользователей и публикаций; специализированного новостного сообщества об ИИ для изображений и видео нет. Фактически источником служит одно сообщество !«メールアドレス» и редкие статьи о закрытых компаниях из общетехнологических сообществ.
  • Вместо примерно 20 публикаций удалось разобрать только 15: 11 публикаций об открытых инструментах и 4 материала о Midjourney. Поиски Sora, Veo, Kling, Runway, Nano Banana и Flux.2 через API lemmy.world и веб-поиск не нашли релевантных постов; сам факт отсутствия результатов отмечен здесь.
  • Страница сообщества /c/stablediffusion на lemmy.world возвращала HTTP 500 и не открывалась напрямую; её удалось частично заменить поисковым API.

Pinterest

Pinterest — Новости ИИ для генерации изображений и видео

Просмотрены все 50 пинов из output/pinterest.pins.md / images/pinterest/manifest.json. Жанры не разделялись; сбор выполнен по одному запросу «Image and Video Generation AI News».

Визуальные темы
  • Шаблонная киберэстетика в тёмно-синем, неоне, синем, фиолетовом и розовом: в большинстве миниатюр фоном служат дорожки схем, светящиеся частицы, нейросетевые сферы и узлы — типичный образ «про ИИ». [1, 2, 5, 7, 11, 13, 14, 17, 18, 20, 26, 30, 38, 40]
  • Повторяющийся образ «ИИ-ведущего новостей»: белый андроид либо лицо, наполовину человек и наполовину машина, сидит в костюме за новостным столом. Видна серийность: меняется лишь название бренда. [4, 32, 34, 37, 42]
  • Самый частый формат — инфографики со сравнением инструментов и рейтингами: в списках «Best AI Video Generators» повторяются почти одни и те же сервисы: Runway, Pika, Kling AI, Luma (Dream Machine), Canva AI, Hailuo AI, Synthesia, InVideo AI, HeyGen, Vidu AI, PixVerse, Google Veo, OpenAI Sora и Adobe Firefly. [9, 19, 28, 33, 36, 46]
  • Демонстрационные сетки преобразования одного исходного изображения или видео во множество стилей: один и тот же человек, панда в костюме или автомобиль Tesla превращаются в деревянные блоки, оригами, Lego или букет цветов. Формат до/после подчёркивает согласованность персонажа и стиля. [8, 25, 44]
  • Контент о тревоге из-за дипфейков и их обнаружении: изображения котов со штампом «FAKE», викторины «Which is AI?», рекомендации инструментов обнаружения ИИ-изображений и текста, инфографики с предупреждением, что «увидеть — больше не значит поверить». [4, 12, 18, 26, 47]
  • Новостные карточки «AI News Roundup» с датами: формат срочных сводок с заголовком и списком тем — Google I/O 2026, ИИ для экстренных вызовов 911, ИИ-стек Северной Кореи и другое. [21, 29, 31, 35]
  • Витрина общего ИИ-арта, не всегда относящаяся к теме: фотореалистичная мраморная скульптура, играющая на виолончели, портрет старого рыбака и прочие рекламные пины с ИИ-артом без новостной ценности. [49, 50]
  • Тёмный фон с неоновым текстом — стандарт, а корпоративные инфографики на белом фоне в фирменном синем и плоском стиле встречаются редко. [3, 10, 27, 33]
Примечательные пины
  • [11] Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — презентация реального продукта: генерация «изображение в видео» Veo 3 с нативным звуком через Gemini API.
  • [16] Google Unveils Veo 2 — промо-сетка Veo 2 в официальном стиле Google с множеством образцов генерации: учёный с микроскопом, плавание, аниме-девушка и другое.
  • [25] Google announces Veo 3 — демонстрация сохранения персонажа: фиолетовый монстр в нескольких окружениях, три видео из одного исходного изображения.
  • [29] Today's AI News: MAY 20, 2026 — сводка Google I/O 2026: Gemini 3.5 Flash, Gemini Omni, Gemini Spark, ИИ-функции доступности Apple и конкуренция умных очков Android XR.
  • [35] The Latest AI Developments — три срочные темы: ИИ отвечает на звонки 911 в Новом Орлеане; Meta выпускает офлайн-агентную модель Muse Glimmer; северокорейская группа Kimsuky автоматизирует фишинг на собственном ИИ-стеке.
  • [44] Microsoft Unveils VASA-1 — описание модели, генерирующей говорящее лицо из одного статичного изображения, аудиоклипа и, опционально, управляющего сигнала; показана сетка разнообразных лиц.
  • [48] ShengShu Technology Unveils Vidu S1 — Vidu S1 представлен как передовая модель для интерактивной генерации в реальном времени, с несколькими киберпанковыми персонажами.
  • [8] Демонстрация согласованного переноса стиля, Luma-семейство — сетка из пяти вариантов одного человека, животного или автомобиля: деревянные блоки, оригами, Lego, цветы. Технически убедительная демонстрация.
  • [46] Future of Video Creation: Best AI Video Generators of 2026 — актуальный рейтинг с конкретными версиями: Pika 2.5, HeyGen, Google Veo 3.1, Runway Gen 4.5, Kling 3.0, Adobe Firefly и Seedance 1.5 Pro.
  • [20] More than 20% of YouTube is now AI-generated — простой пин с заголовком, заявляющим, что более 20% YouTube теперь создаётся ИИ; показатель символизирует масштаб распространения ИИ-контента.
Сигналы
  • Видна гонка поколений моделей: регулярно фигурируют Veo 2 → 3 → 3.1, Kling AI → 3.0, Runway Gen-3 → Gen 4.5, Pika 2.5 и Seedance 1.5 Pro. Цикл улучшений видеогенерации очень быстрый. [16, 25, 11, 46]
  • Следующий фокус — агентность, реальное время и офлайн-работа: появляются конвейерные инструменты, автоматизирующие путь от поиска исполнителя к сценарию, генерации и монтажу одним действием [24]; Vidu S1 для взаимодействия в реальном времени [48]; Meta Muse Glimmer, не требующая подключения к сети [35]. Интерес смещается от простой «генерации» к агентам, реальному времени и on-device-использованию.
  • Практическое применение и злоупотребления ИИ становятся темой сами по себе: ИИ в системе экстренных вызовов [35] и применение ИИ государственными акторами, включая Северную Корею [35], выводят обсуждение за рамки собственно генеративных инструментов.
  • Доминирование коммерческих закрытых сервисов: в рейтингах снова и снова появляются Google Veo, OpenAI Sora, Runway, Kling AI, Adobe Firefly, Pika, Luma, HeyGen и Synthesia. Открытые модели и процессы — Stable Diffusion, AnimateDiff, Open-Sora, ComfyUI — почти не упоминаются. Редкое исключение — Amuse 3.0 [50], делающий акцент на локальном запуске на AMD Ryzen AI.
  • Слабая связь с первоисточниками: из 50 пинов лишь немногие похожи на прямые ссылки на корпоративные блоги или технические статьи: официальные по тону материалы Veo [16][25] и Microsoft VASA-1 [44]. Большинство ведут к аффилиатным блогам, SEO-статьям или рекламным миниатюрам Fiverr — например, [45]. Pinterest работает скорее как место продажи инструментов, а не как площадка для отслеживания новостей.
  • Тревога вокруг дипфейков стала устоявшимся жанром: отдельная категория состоит из материалов о детекции и игр «угадай, где ИИ». Продвижение технологий потребляется через вопрос доверия к изображению. [4, 12, 18, 26, 47]
Ограничения
  • На этом этапе читались только изображения, заранее собранные воркером через headless-браузер. Дополнительный поиск и прокрутка непосредственно в Pinterest не выполнялись — согласно процедуре плейбука.
  • Сбор велся по одному запросу без разделения жанров, поэтому закрытые и открытые решения не искались отдельно. Почти полное отсутствие пинов об открытом ПО может отражать склонность самой Pinterest, но нельзя исключить, что целевой поиск нашёл бы больше материалов.
  • У двух пинов заголовок указан как (untitled); у [12] всё же удалось прочитать тему «Which is AI?», но другие части контента определить трудно.
  • Страницы самих пинов — pinterest.com/pin/... — не открывались. Выводы сделаны только по изображению и названию, без текста страниц, комментариев, сохранений и метрик вовлечённости.
  • [49], мраморный виолончелист, слабо связан с темой и представляет собой рекламу общего ИИ-арта; как новостной сигнал он не использовался.

Рекомендуемые действия

  • Для процессов, зависящих от Sora2, подготовьте миграцию на Kling 3.0 или Veo 3.1 до отключения API 24 сентября 2026 года.
  • Следите за ComputerUse в GPT-6 Astra как за инструментом автоматизации производственного пайплайна, а не как за отдельным генеративным сервисом.
  • Чтобы сократить расходы, попробуйте локальное редактирование Qwen-Image-Edit + ComfyUI раньше, чем платить за закрытые сервисы.
  • Подготовьте правила раскрытия использования ИИ в публичном контенте, чтобы снизить риски скандалов вокруг маркировки подлинности и фальшивых таймлапсов.
  • Проверьте разделённый рабочий процесс Nano Banana для статичных изображений + Kling 3.0 для анимации.
  • Продолжайте отслеживать переход Midjourney от бизнеса генерации изображений к медицинскому оборудованию как возможный ранний индикатор диверсификации других закрытых ИИ-компаний.

Собранные изображения

Image to Video AI: How It Works and Why It Matters - The Data Scientist🎨 AI Image and Video CreationThe Ultimate AI Image and Video Generation Platform - The Data ScientistAI content and social media concernsAi Content Creation Concept With Icons For Text Image Music And Video Generation Artificial Intelligence Images – Browse 57 Stock Photos, Vectors, and VideoAI Video Content Creation: High earners,...️ Image to Video AI – Animate Your Photos With AIGoogle announces ultra-high quality video...Just Nail It 🎥Why AI Video Generation Is Becoming Essential for...Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini APIimageimageArtificial intelligence: let’s maintain our...AI News: OpenAI Finally Released What We Asked ForGoogle Unveils Veo 2: Advanced AI Video Generation Tool with Enhanced Realism and Cinematic FeaturesPaul Lafargue of the IDEC Group: The impact of...How To Detect AI-Generated Images Online For FreeAI For Image And video GenerationMore than 20% of YouTube is now AI-generatedGPT 5.2, realtime video editor, AI stereo videos, mobile AI agents, full body control: AI NEWSTop AI Video Generators of 2025Artificial Intelligence: A Tool to Free the...AI Video Creating just got crazy.Google announces video generation AI 'Veo 3',...‎🚨 AI is getting scary good.How AI Is Transforming Video Editing5+ Best AI Video Generation Websites 2026 | Runway, Pika, Kling AI, Canva & MoreimageAI driven image and video analysisLe guide ultime pour exploiter Chat GPT en tant...TotalYmage revolutionizes interactive videos...ai toolsDiscover how Grok is revolutionizing video...The Latest AI Developments - AI Picks Up 911 Line Meta Offline Model12 Best AI Video Generators in 2026 (Free & Paid) | Google Veo, Sora, Runway & MoreThe Snarky AI News RoundUp #12What Is Generative AI? Complete Technical Guide - RCN GuideWhat is Imagvio AI and how it helps creators..."Transform Your Vision with Personalized AI-Powered 4K Videos 🎥✨"AI-Generated Videos: Good or Bad? Here's the Truth! 🤖🎥The Snarky AI News RoundUp #8Mastering Video and AI: Key Social Media Marketing Trends 2025Microsoft Unveils VASA-1, Setting New Standards for Generative AI in Video GenerationI will do ai video creation explainer with synthesia sora ai kling ai runway ai invideoFuture of Video Creation: Best AI Video Generators of 2026🔸Practical Online Resources For Checking AI-Generated TextShengShu Technology Unveils Vidu S1, Bringing Real-Time Interactive Generation to AI VideoTransform your ideas into stunning visuals! 🎥'Amuse 3.0', an AI art creation tool that includes...

Примечание о качестве данных

Все шесть платформ не достигли критерия завершения brief.md — примерно 20 публикаций на каждую соцсеть. Особенно заметен дефицит на X: только 4 релевантных поста из 40; на Bluesky из-за ограничений 403 фактически 11; на Lemmy из-за отсутствия специализированного новостного сообщества — 15. Однако основные тенденции — GPT-6 Astra, закрытие Sora2 и расширение экосистемы ComfyUI — независимо подтверждены на нескольких платформах.

Галерея