KEN’S CAT LOG

Новости ИИ для генерации изображений и видео — 2026-09-08

На закрытой стороне новым жанром, независимо обсуждавшимся на Reddit, X и Bluesky, стало создание изображений и 3D-видео не диффузионными моделями, а LLM-агентом (GPT-6 Astra), управляющим GUI-инструментами и Blender. Движение в открытом исходном коде в основном сосредоточилось в сообществе ComfyUI на Lemmy и на YouTube-каналах с тестами; на Bluesky, Pinterest, Reddit и X оно почти не наблюдалось.

Новости ИИ для генерации изображений и видео — 2026-09-08

Главной темой исследования шести платформ стало независимое появление на трёх платформах нового жанра: LLM-агент GPT-6 Astra не генерирует изображения диффузионной моделью, а напрямую управляет GUI-инструментами и Blender, создавая изображения и 3D-видео. В целом открытый исходный код был представлен слабее, однако на Lemmy в сообществе !stable_diffusion за одну неделю подряд вышло пять-шесть ускоряющих узлов ComfyUI для видеомоделей MiniMax H3, а на YouTube продолжается проверка соперничества Flux.2/Flux 2 Klein и Qwen-Image. На Pinterest и в большинстве публикаций Reddit и X преобладали названия закрытых продуктов — Midjourney, Sora, Veo, Runway, Kling, Nano Banana, Seedream и другие; названия открытых моделей почти не встречались. Общей чертой также стало то, что на Reddit и Pinterest заметнее оказались не технические тренды сами по себе, а споры о том, создано ли что-то ИИ, и социальные последствия замены человеческих ролей и труда ИИ-агентами.

На всех платформах

  • Агентная визуальная генерация GPT-6 Astra независимо стала темой на трёх платформах: случай, когда Astra управляла Blender и выполнила рендеринг, отдельно обсуждался на Reddit (r/DefendingAIArt) и Bluesky (@simonwillison.net); демонстрация создания 3D-города с Astra породила цепочку подражаний в X (@synabreu, @GulatiYajat). Главной межплатформенной темой стал не прогресс диффузионных моделей, а новый подход: LLM-агент захватывает существующие инструменты и создаёт иллюстрации или 3D.
  • Оценки того, решена ли проблема постоянства персонажей и сцен в видеогенерации, по-прежнему расходятся: и на Reddit (r/generativeAI, r/aivideomaking), и в X — между хвалящим Seedance 2.5 @atlas_remake и указывающим на сбои в сложных сценах @Aiden_Tech_Ai — одновременно публиковались противоположные мнения.
  • Заметность открытого исходного кода резко различается между платформами: Lemmy !stable_diffusion активен настолько, что узлы ComfyUI для MiniMax H3, включая ComfyUI-Ref2VA-VSA, выходят одновременно; на YouTube регулярно публикуются сравнения Qwen-Image, FLUX и Wan 2.2. Напротив, на Bluesky, Pinterest, Reddit и X почти не удалось найти публикаций с конкретными названиями открытых моделей — новых Stable Diffusion, FLUX, Wan или HunyuanVideo. Во многих разделах Limits отмечается структурная слабость: неизвестно, действительно ли открытый исходный код не обсуждался или его просто пропустили из-за перекоса поисковых запросов в сторону закрытых продуктов.
  • Споры о подлинности и социальное воздействие идут параллельно с техническими трендами: независимо на нескольких платформах наблюдались публикации, где спорят, настоящее ли это изображение или генерация, Bluesky-лейблер aimod.social для автоматической маркировки ИИ-изображений, фейковое видео о выборах губернатора Нью-Йорка и Pinterest-обложки со штампами «FAKE». Темой всё чаще становится не создание, а распознавание и сомнение.

По платформам

Reddit: среди 12 тредов больший отклик получили не специализированные сабреддиты об ИИ-генерации изображений и видео, а сообщества о спорах вокруг ИИ и определении подлинности. Из-за единственного поискового запроса сравнение закрытых и открытых решений практически не получилось.

X: в центре внимания были анонс NVIDIA Sol-H3 — видеовывод быстрее воспроизведения в реальном времени — его локальное воспроизведение отдельными пользователями, а также цепочка подражаний при создании 3D-городов с GPT-6 Astra. Из 40 публикаций лишь ограниченная часть напрямую относилась к ИИ-генерации изображений и видео; много нерелевантных результатов попало из региональных трендов Explore.

YouTube: из-за JavaScript-рендеринга страниц не удалось получить просмотры и число подписчиков, но были подтверждены сравнительные и объясняющие каналы, рассматривающие как закрытые решения — Midjourney V8.2, Grok Imagine, Google Gemini «Omni», — так и открытые — Qwen-Image-2.0, FLUX и Wan 2.2. Среди шести платформ это был наиболее удобный источник для сравнения закрытого и открытого подходов.

Bluesky: поисковый API app.bsky.feed.searchPosts постоянно возвращал 403, поэтому пришлось проверять ленты известных аккаунтов, таких как @simonwillison.net и @404media.co, по отдельности. До критерия в 20 разобранных публикаций дойти не удалось. Единственной конкретной публикацией об открытом исходном коде стал отчёт о локальном запуске Qwen 3.7 27B.

Lemmy: наибольший разовый интерес вызвал скандал вокруг предполагаемого поворота Midjourney к медицинским УЗИ-сканерам в !techtakes. В открытом сегменте именно здесь были наиболее плотные первичные сведения: одновременные релизы ComfyUI-узлов для MiniMax H3 и соревнование по бенчмарку Qwen-Image-Bench между LLaDA-Image и Boogu-Image-0.1.

Pinterest: было проверено 30 из 50 заранее собранных пинов. Из-за единственного запроса и отсутствия разделения по жанрам основную массу составили инфографики со сравнениями и инструкциями по закрытым продуктам; ни одного названия открытой модели или проекта не обнаружено. В manifest также отсутствуют даты и показатели вовлечённости, поэтому свежесть оценить невозможно.

На что смотреть

  • Видеовывод MiniMax H3 / Sol-H3 быстрее реального времени и рост числа оптимизирующих узлов ComfyUI — X (@xieenze_jr) / Lemmy (ComfyUI-Ref2VA-VSA и другие). Важно, насколько открытые веса и локальные реализации смогут догнать облачные анонсы.
  • Распространение агентной визуальной генерации GPT-6 Astra — Reddit (r/DefendingAIArt) / Bluesky (@simonwillison.net) / X (@synabreu). Следить, насколько далеко расширится волна подражаний.
  • Борьба за лидерство в открытом исходном коде между FLUX.2/Flux 2 Klein и Qwen-Image — YouTube (SECourses, Urban Decoders). Важно, как результаты более чем 700 тестов повлияют на дальнейшее внедрение.
  • Продолжение истории о смене курса Midjourney на медицинское оборудование — Midjourney Medical — Lemmy (через pivot-to-ai.com). Остаётся выяснить, была ли это шутка или реальный план.
  • Последствия злоупотребления ИИ-видео в политической рекламе на выборах губернатора Нью-Йорка — Bluesky (404media.co). Следить за реакцией регуляторов и платформ.
  • Решение проблемы постоянства персонажей и сцен в видеогенерации — Reddit (r/generativeAI) / X (@Aiden_Tech_Ai). Вопрос в том, действительно ли универсальные инструменты приблизились к решению.

Рекомендации

  • Продолжать отслеживать агентную визуальную генерацию GPT-6 Astra — управление Blender и создание 3D-городов — как отдельную тему в следующих выпусках.
  • Чтобы не пропускать открытые релизы, добавить на всех платформах поисковые запросы с конкретными названиями: "FLUX", "Stable Diffusion", "Qwen-Image", "Wan" и "ComfyUI".
  • В исследовании Bluesky заранее расширить список отслеживаемых аккаунтов, исходя из того, что 403 поискового API будет сохраняться.
  • Поскольку Pinterest не даёт даты публикации и вовлечённость, использовать его не для срочных сравнений, а только для регулярного наблюдения за узнаваемостью инструментов.
  • Не приводить категоричных утверждений о предполагаемом повороте Midjourney к медицинскому оборудованию до появления первичного источника — официального объявления Midjourney.
  • В первую очередь проверять !stable_diffusion на Lemmy и YouTube-каналы с тестами как основные источники по движению открытого исходного кода.

Качество данных

Наименее информативными оказались Bluesky — постоянный 403 поискового API, проверка только отдельных аккаунтов и меньше 20 публикаций — и Pinterest, где в manifest нет дат и показателей вовлечённости, а единственный запрос не дал ни одного упоминания открытого исходного кода. Reddit и X также ограничились одним поисковым запросом, совпадающим с названием брифа, поэтому намеренно собранного сопоставления закрытых и открытых решений не было. В результате обсуждение открытого исходного кода оказалось сконцентрировано на Lemmy и YouTube. На YouTube из-за JavaScript-рендеринга нельзя было получить просмотры и число подписчиков.

Сводка по платформам

Reddit

Reddit — новости ИИ для генерации изображений и видео

Основные площадки обсуждений — сабреддиты

Все 12 собранных тредов были взяты по одному из разных сабреддитов. Специализированных сообществ об ИИ-генерации изображений и видео мало; заметнее сообщества о кино, проверке фейков и культурных спорах вокруг ИИ.

Сабреддит Число участников Собрано тредов
r/whenthe 813,975 1
r/isthisAI 406,607 1
r/antiai 317,903 1
r/aiwars 167,158 1
r/generativeAI 151,385 1
r/RemoteWorkers 75,332 1
r/DefendingAIArt 72,770 1
r/pj_explained 96,256 1
r/NewRockstars 15,523 1
r/freetoolsAI 7,887 1
r/aivideomaking 6,517 1
r/GoogleFlow 1,789 1

Единственным запросом был "Image and Video Generation AI News". Поэтому результаты сместились не к профильным сообществам — r/generativeAI, r/aivideomaking, r/GoogleFlow и r/freetoolsAI, — а к дискуссиям «за и против ИИ» и тредам «это ИИ?».

Реакция сообщества
  • GPT-6 рисует «от руки» управлением мышью и может подделывать таймлапсы (тред 2, r/antiai, 7 013 баллов, 1 009 комментариев, 2026-09-05, https://www.reddit.com/r/antiai/comments/1w81kdd/). LLM GPT-6 дали управление мышью и клавиатурой в программе для цифрового рисования, после чего она смогла создать даже убедительный «доказательный» таймлапс. Главный комментарий выражал отчаяние: теперь нет смысла даже снимать таймлапсы для подтверждения авторства.
  • GPT-6 Astra создала фотореалистичный рендер в Blender (тред 9, r/DefendingAIArt, 143 балла, 13 комментариев, 2026-09-06, https://www.reddit.com/r/DefendingAIArt/comments/1w970uy/). Внимание привлёк не факт генерации видео самим ИИ, а то, что агент управлял Blender для выполнения рендеринга.
  • Расширение AutoFlow для Google Flow поддерживает непрерывную генерацию видео (тред 12, r/GoogleFlow, 12 баллов, 6 комментариев, 2026-09-01, https://www.reddit.com/r/GoogleFlow/comments/1w4eeyp/). Добавлена функция Continue from Last Frame: последний кадр предыдущего клипа автоматически становится первым кадром следующего; доступны также очередь нескольких генераций и управление референсами.
  • К рекламному посту о бесплатном генераторе изображений ИИ проявили большой интерес (тред 3, r/freetoolsAI, 39 баллов, 48 комментариев, 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/). Одни пользователи говорили, что сервис без регистрации, ограничений и оплаты сэкономил им сотни долларов и часы работы; другие сомневались в устойчивости его операционной модели.
  • Главные препятствия в ИИ-видео — длительность и постоянство персонажей (тред 10, r/generativeAI, 4 балла, 15 комментариев, 2026-09-07, https://www.reddit.com/r/generativeAI/comments/1w9klb7/). Для 2–4-минутного научно-фантастического ролика участники советовали создавать кадры в GPT Image 2 и анимировать в Seedance 2.5, предупреждая о стоимости порядка 100 долларов за готовую минуту. Согласованная позиция: универсальные решения пока плохо удерживают персонажей между статичным изображением и видео.
  • Бесплатная видеогенерация на слабом оборудовании остаётся нереалистичной (тред 8, r/aivideomaking, 6 баллов, 15 комментариев, 2026-09-07, https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/). В ответ на желание сделать бесплатное 45-секундное ИИ-видео с телефона и iPad пользователи указали, что это задача уровня дата-центра: реалистичный предел — пятисекундные клипы с водяными знаками, которые затем можно склеить.
  • ИИ-изображения еды в рекламе по-прежнему называют неаппетитными (тред 4, r/aiwars, 4 балла, 177 комментариев, 2026-09-03, https://www.reddit.com/r/aiwars/comments/1w69cdj/). Одни сравнивали картинку с намеренно созданным отвратительным изображением или гнездом насекомых; другие возражали, что локальная Krea 2 при хорошем промпте способна дать лучший результат.
  • Вакансия удалённой проверки ИИ-подписей к изображениям получила много откликов (тред 5, r/RemoteWorkers, 152 балла, 739 комментариев, 2026-09-04, https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/). Работа за 30 долларов в час заключается в выявлении ошибок ИИ-подписей: неверно распознанных объектов, цветов и текста. Большинство комментариев просило ссылку на вакансию.
  • Возникли два спора о том, является ли чрезвычайно реалистичное ИИ-видео настоящим (треды 1/6, r/NewRockstars и r/pj_explained, дублирующее распространение одного поста, 2026-09-02). В споре о якобы утёкшей сцене столкновения Тора с колонной одни утверждали, что это CGI, а не ИИ; другие называли доказательством ИИ идеально круговое распространение взрыва.
  • Видео, где волна появляется внутри окна, разделило комментаторов на два лагеря (тред 7, r/isthisAI, 0 баллов, 79 комментариев, 2026-09-07, https://www.reddit.com/r/isthisAI/comments/1w9cyub/). Одни объясняли ролик перспективой и считали его настоящим, другие указывали на физически невозможное движение пены как на признак ИИ.
Сигналы
  • Что растёт: настороженность к тому, что ИИ перестаёт выглядеть как ИИ. Масштаб реакции на тред 2 — 7 013 баллов и 1 009 комментариев — показывает сильное беспокойство из-за того, что LLM уже может напрямую пользоваться GUI и подделывать даже доказательства «ручного» создания.
  • Что игнорируется или отвергается: запросы на бесплатное, длинное и качественное видео сообщества систематически отвергают. Ограничения оборудования и стоимости остаются жёсткими.
  • Неожиданное наблюдение: профильные сабреддиты уступают по вовлечённости сообществам о проверке подлинности и спорах о допустимости ИИ. На Reddit новости об ИИ-изображениях и видео сейчас чаще обсуждаются как социальное трение вокруг вопроса «это ИИ или нет», а не как прогресс моделей.
  • Противоречивые сигналы: в отношении одного и того же ролика о столкновении Тора оценки «не ИИ» и «это ИИ» оказались противоположными; аналогично разделились мнения и в треде 7. Визуальная оценка обычных пользователей больше не выглядит надёжной.
Ограничения
  • Использовался только запрос "Image and Video Generation AI News"; дополнительные варианты, такие как "Stable Diffusion", "Midjourney", "Sora", "Kling" или запросы об открытой генерации изображений, не применялись. Поэтому публикаций, прямо сопоставляющих закрытые решения — Midjourney, DALL-E, Sora, Veo, Runway — и открытые — Stable Diffusion, Flux, экосистему ComfyUI, — почти не было.
  • 12 тредов были взяты из 12 разных сабреддитов, по одному из каждого, поэтому сравнить несколько тредов внутри одного сообщества нельзя.
  • У тредов 9 и 11 отсутствует тело поста: доступны только заголовок и комментарии.
  • Треды 1 и 6 фактически являются репостом одного материала в разных сабреддитах; как две независимые записи они дают фактическую выборку из 11 материалов.
  • Из-за особенностей браузерного сбора в этом запуске не выполнялись дополнительные обращения к Reddit: повторный поиск по другим запросам и раскрытие всех комментариев.

X

X — новости ИИ для генерации изображений и видео

Аккаунты

40 публикаций поступили от 37 аккаунтов. Почти все были единичными всплесками; единственным связанным с генерацией изображений и видео аккаунтом с несколькими постами был @yu_ichi_suzuki, публиковавший техническую ветку о MiniMax H3 на локальной RTX 5090.

Аккаунт Число публикаций Характер
@yu_ichi_suzuki(鈴木憂一) 2 Техническая ветка о запуске MiniMax H3 на локальной RTX 5090, всего 309 лайков
@xieenze_jr(Enze Xie) 1 Анонс новой модели от исследователя MiniMax, 349 лайков и около 85 000 просмотров
@voxelphotonics 1 Вирусная демонстрация объёмного отображения Duke Nukem 3D: 6 097 лайков и около 297 000 просмотров
@synabreu 1 3D-модель Сеула, созданная GPT-6 Astra: 2 700 лайков и около 235 000 просмотров
@GulatiYajat(Yajat Gulati) 1 3D-город Гургаон с GPT-6 Astra: 574 лайка
@luccacerf 1 Демонстрация Blender MCP + Astra + Tripo: 445 лайков
@He1s_Sammy 1 Длинная ветка о коммерциализации ИИ-видео для детей без показа лица: 388 лайков
@SD_Tutorial(Stable Diffusion Tutorials) 1 Техническое объяснение Sol-H3, скромная реакция — 22 лайка
@Strength04_X, @atlas_remake, @Aiden_Tech_Ai, @alphafox по 1 Средние аккаунты, обсуждающие качество и ограничения Seedance 2.5 и ИИ-видео
Публикации
  1. MiniMax представила Sol-H3 — генерацию видео быстрее реального времени (#2 @xieenze_jr, 349 лайков, 62 репоста, 23 ответа, около 85 000 просмотров, 2026-09-07, https://x.com/xieenze_jr/status/2097000082927399012). На 8× NVIDIA B300 Blackwell пять секунд видео 1344×768, по заявлению компании, выводятся за 1,653 секунды. Публикация стала источником тренда X Explore «NVIDIA Speeds Up AI Video Generation Past Real-Time Playback».
  2. Распространилось техническое объяснение анонса (#3 @SD_Tutorial, 22 лайка, около 2 100 просмотров, 2026-09-07, https://x.com/SD_Tutorial/status/2097061880175141224). В нём Sol-H3 описывается как высокопроизводительный стек вывода видео NVIDIA Research, запускающий MiniMax-H3 быстрее воспроизведения в реальном времени.
  3. Опубликована инструкция по запуску MiniMax H3 на RTX 5090 (#4–5 @yu_ichi_suzuki, 295+14 лайков, около 18 000+1 100 просмотров, 2026-09-07, https://x.com/yu_ichi_suzuki/status/2096819288997065192). Автор описал получение примерно 15 секунд видео выше 2K за девять минут с локальной RTX 5090: поиск удачного 480p-результата с дистиллированной LoRA Alibaba и апскейл через RTX Video Super Resolution до 2688×1536.
  4. Seedance 2.5 создаёт модное видео (#1 @Strength04_X, 68 лайков, 2 репоста, 35 ответов, около 7 700 просмотров, 2026-09-06, https://x.com/Strength04_X/status/2096441159887274302). Опубликовано фотореалистичное 30-секундное кинематографическое fashion-travel-музыкальное видео с полным промптом.
  5. Seedance 2.5 создаёт мир в духе «Истории игрушек» (#14 @atlas_remake, 3 лайка, около 133 просмотров, 2026-09-07, https://x.com/atlas_remake/status/2096847522602139995). Автор положительно оценил работу модели с несколькими анимированными персонажами и объектами.
  6. Проблема «игрового автомата» в ИИ-видео всё ещё существует (#12 @Aiden_Tech_Ai, 1 лайк, 2 репоста, 4 ответа, около 494 просмотров, 2026-09-07, https://x.com/Aiden_Tech_Ai/status/2097020441470836791). Автор отметил, что при нескольких пространствах, движении камеры, блокинге персонажей и непрерывности приходится генерировать снова и снова из-за новых ошибок.
  7. Duke Nukem 3D воспроизвели на объёмном 3D-дисплее (#10 @voxelphotonics, 6 097 лайков, 921 репост, 130 ответов, около 297 000 просмотров, 2026-09-07, https://x.com/voxelphotonics/status/2096833425043005562). Это не генерация изображений или видео как таковая, а демонстрация технологии отображения, но пост стал одним из самых вовлечённых за период.
  8. GPT-6 Astra превратила весь Сеул в 3D-город (#20 @synabreu, 2 700 лайков, 451 репост, 81 ответ, около 235 000 просмотров, 2026-09-06, https://x.com/synabreu/status/2096557555086725159). Вирусный пример применения разговорной 3D-генерации.
  9. Аналогично GPT-6 Astra воссоздала 3D-город Гургаон (#22 @GulatiYajat, 574 лайка, 28 репостов, 53 ответа, около 46 000 просмотров, 2026-09-06, https://x.com/GulatiYajat/status/2096659142534676684). Автор прямо указал, что решил попробовать после того, как увидел множество демонстраций Astra, и открыл сайт gurgaon-3d-atlas.cratorlabs-2435.chatgpt.site.
  10. Демонстрация связки Blender MCP + Astra + Tripo (#21 @luccacerf, 445 лайков, 20 репостов, 11 ответов, около 31 000 просмотров, 2026-09-07, https://x.com/luccacerf/status/2097047098281672782). Пример объединения нескольких ИИ-инструментов через MCP.
  11. ИИ-видео для детей без показа лица становятся контент-бизнесом (#23 @He1s_Sammy, 388 лайков, 96 репостов, 17 ответов, около 19 000 просмотров, 2026-09-06, https://x.com/He1s_Sammy/status/2096492880017736056). Вирусный пост о монетизации генеративного видео с телефона, ноутбука или iPad.
Сигналы
  • Что растёт: создание 3D-миров разговорными агентами — 3D-Сеул в GPT-6 Astra и связка с Blender MCP — стало наиболее подражаемым направлением. Публикация @GulatiYajat прямо подтверждает цепочку подражания посту @synabreu.
  • Что растёт, часть вторая: одновременно обсуждаются видеовывод быстрее реального времени — Sol-H3 — и попытки воспроизвести его с открытыми весами на локальных GPU. На X облачные анонсы и локальные практики идут почти без временного разрыва.
  • Что игнорируется или вызывает разногласия: постоянство нескольких персонажей и пространств в ИИ-видео одновременно получает похвалу и критику; единой оценки нет.
  • Неожиданное наблюдение: из девяти трендов Explore, породивших 40 собранных постов, к ИИ-генерации изображений и видео напрямую относились только первые три. Остальные были региональными или новостными трендами, не связанными с темой. Однако поиск по тренду «Building» случайно вывел на качественные демонстрации 3D-городов GPT-6 Astra.
  • Случай VTuber Veibae: поиск тренда о возвращении Veibae с анимацией Sunflower Farm дал только нерелевантные дублирующиеся посты о североамериканском бокс-офисе. Публикаций самой Veibae или сведений об использовании ИИ при создании анимации не найдено.
Ограничения
  • По тренду Explore «VTuber Veibae Teases Return with Sunflower Farm Animation» не удалось собрать релевантные посты; выяснить, применялся ли ИИ при создании анимации, невозможно.
  • Шесть остальных трендов Explore почти не были связаны с темой, а 29 из 40 постов оказались нерелевантными и исключены из отчёта.
  • Поиск ограничивался буквальными названиями трендов; запросы по "Stable Diffusion", "Midjourney", "Sora", "Kling" и "ComfyUI" не выполнялись. Поэтому прямого сопоставления закрытых и открытых решений не получилось.
  • Explore был географически привязан к местоположению сервера, предположительно району Хорватии, и не представляет глобальные тренды X.
  • Сбор остановили на 40 записях; дальнейший анализ публикаций тех же аккаунтов, ответов и хэштегов не проводился.

YouTube

YouTube — последние тенденции ИИ для генерации изображений и видео

Каналы
  • 動画編集の中の人 (канал) — много практических сравнений генераторов изображений.
  • AI大学【AI&ChatGPT最新情報】 (канал) — ежемесячные обзоры генеративных ИИ-инструментов.
  • 【さき】のAIでええやん。 (канал) — объяснения обновлений Google I/O и Gemini.
  • Qwen(официальный) (канал) — официальные анонсы серии Qwen-Image.
  • AIOnTrend (канал) — сравнения открытых моделей изображений.
  • Urban Decoders (канал) — разборы архитектуры моделей Flux.
  • SECourses (канал) — масштабные локальные тесты генерации изображений.
  • Woollyfern (канал) — регулярное наблюдение за обновлениями Midjourney.
  • 寺田部チャンネル (канал) — практические обзоры локальной видеогенерации в ComfyUI.
  • 東京大学 吉田幸 研究室 (канал) — регулярные объяснения трендов генеративного ИИ от университета.

Число подписчиков получить не удалось, поскольку страницы результатов и видео YouTube рендерятся JavaScript.

Видео
Закрытые решения
  1. 【После серьёзных трат стало ясно】Лучшие ИИ-генераторы изображений 2026 года: подробное сравнение NanoBananaPro, Seedream4.0, Midjourney и AdobeFirefly — 動画編集の中の人 — https://www.youtube.com/watch?v=vJLDbXaSKW4 — практическое платное сравнение Nano Banana Pro, Seedream 4.0, Midjourney и Adobe Firefly с выводом о лучших инструментах 2026 года.
  2. 【Последнее за зиму 2026】Шесть популярных бесплатных инструментов ИИ-генерации видео, которые за последние месяцы развились сильнее всего: Sora 2, Veo 3.1, Kling 2.6 и другие — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=T9iIlhittDc — обзор шести бесплатных видеогенераторов, включая Sora 2, Veo 3.1 и Kling 2.6.
  3. 【Первое место в мировом рейтинге】Подробный разбор Grok Imagine от xAI: как бесплатно создавать видео уровня Sora/Veo — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=0cYPwxg8le8 — утверждает, что Grok Imagine занял первое место, и объясняет бесплатное создание видео уровня Sora и Veo.
  4. 【Новое】Google значительно обновила модели Gemini и представила видеогенератор Omni: разбор Google I/O 2026 — 【さき】のAIでええやん。 — https://www.youtube.com/watch?v=vKtwoKCSGyE — объяснение обновлений Gemini и новой видеомодели Omni.
  5. Midjourney Update | July 2026: V8.2 is HERE! Personalization, NIJI Style Creator, and More! — Woollyfern — https://www.youtube.com/watch?v=dvfH5HzCARY — сообщает о выпуске Midjourney V8.2, персонализации и NIJI Style Creator.
Открытые решения
  1. 🚀 Introducing Qwen-Image-2.0 — our next-gen image generation model! — официальный канал Qwen — https://www.youtube.com/watch?v=1tM7Wd0lEeI — официальный анонс Alibaba Qwen-Image-2.0 как следующей открытой модели генерации изображений.
  2. Qwen Image Dominates Text-to-Image: 700+ Tests Reveal Why It's Better Than FLUX - Presets Published — SECourses — https://www.youtube.com/watch?v=R6h02YY6gUs — проверка по более чем 700 тестам, объясняющая преимущества Qwen Image над FLUX, с опубликованными пресетами.
  3. Flux 2 Klein vs Qwen vs Z Image Turbo vs Nano Banana Pro - Which AI Image Wins? — AIOnTrend — https://www.youtube.com/watch?v=CkAtP2EVhSM — сравнение Flux 2 Klein, Qwen и Z Image Turbo с закрытой Nano Banana Pro на одинаковых промптах.
  4. Flux.2 New Open Source King? Architecture FULL guide + Nano Banana Pro comparisons — Urban Decoders — https://www.youtube.com/watch?v=Iu9Dm7lBeAk — разбор архитектуры Flux.2 от Black Forest Labs и сравнение с Nano Banana Pro.
  5. Flux 2 Klein Just Dropped—This Image Editing Model Isn't Just About Speed!https://www.youtube.com/watch?v=JXgBe3twxbc — быстрый обзор лёгкой локально запускаемой модели редактирования изображений Flux 2 Klein.
  6. Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Modelshttps://www.youtube.com/watch?v=3BFDcO2Ysu4 — учебное видео об обновлениях Wan 2.2, FLUX, Qwen Image и других передовых открытых моделей.
  7. 【Бесплатно, ComfyUI】Легко ли создать полнометражное видео с локальным ИИ? Это невероятно сложно — 寺田部チャンネル — https://www.youtube.com/watch?v=I8_wKOLnSlI — практический отчёт о создании длинного видео с ComfyUI и локальным ИИ.
Сигналы
  • В закрытом сегменте главный спор — цена и скорость против качества: несколько сравнений утверждают, что Nano Banana Pro побеждает в 63% тестов фотореализма, а Grok Imagine позиционируется как бесплатное видео уровня Sora/Veo.
  • Midjourney продолжает улучшать линейку V8 в ежемесячном ритме: V8 была анонсирована в феврале 2026 года, Alpha вышла в марте, V8.1 — в апреле, V8.2 Preview — в июне, полноценная V8.2 — в июле.
  • Анонс видеогенерации Gemini Omni на Google I/O 2026 стал отдельной крупной новостью, которую оперативно разобрали японские каналы.
  • Открытый сегмент ведёт борьбу за лидерство между Qwen Image и FLUX: углублённые каналы продолжают проверять, какая модель лучше, в том числе с тестами SECourses и разбором архитектуры Urban Decoders.
  • Flux 2 Klein отдельно привлекает внимание как лёгкая производная модель для локального запуска.
  • Wan и Qwen Image от Alibaba рассматриваются как пара открытых решений для видео и изображений.
  • Локальная видеогенерация по-прежнему сложна в эксплуатации: практический отзыв о длинном видео в ComfyUI прямо называет работу чрезвычайно трудной.
Ограничения
  • Страницы поиска и просмотра YouTube рендерятся JavaScript, поэтому WebFetch получал лишь статический HTML с ссылками в футере, без списка видео, просмотров, дат, описаний и комментариев.
  • Для проверки использовались веб-поиск site:youtube.com и endpoint oembed, но просмотры, подписчики, полный текст описаний и комментарии получить не удалось.
  • По японским запросам с ограничением августом или сентябрём 2026 года специализированные новости об ИИ-генерации почти не находились; попадали общие ежедневные ИИ-новости и нерелевантные материалы.
  • Reddit, X, Bluesky, Lemmy и Pinterest на этой стадии не исследовались, как указано в brief.md.

Bluesky

Bluesky — новости ИИ для генерации изображений и видео

Аккаунты
Хэндл Тип Подписчики и прочее Примечание
@simonwillison.net Частное лицо, известный технический блогер об ИИ и автор Datasette Сравнивает генерацию изображений разных моделей собственным тестом с пеликаном на велосипеде. Самый содержательный источник в этой выборке.
@404media.co Медиа В основном публикует расследования о наблюдении, иногда — материалы об ИИ-медиа.
@aimod.social Управление сообществом, лейблер подозрительных ИИ-изображений 2 555 подписчиков, 94 поста Официальный сервис Bluesky, автоматически маркирующий изображения, подозреваемые в генерации ИИ.
@stablediffusion.bsky.social Частное лицо, обмен промптами SDXL/Stable Diffusion Не публиковался с января 2025 года.
@bm63ai.bsky.social Частное лицо, ИИ-арт с ComfyUI/Flux/Midjourney ИИ-арт практически прекратился; последний пост в июне 2026 года был о созданном с Codex музыкальном приложении.
@petapixel.bsky.social Медиа о фотографии Критически освещал генеративные функции Adobe, но последние релевантные посты относятся к февралю 2025 года.
Публикации
  • Повторный бенчмарк с пеликаном на велосипеде в GPT-6 Astra (@simonwillison.net, 2026-09-04, 202 лайка, 9 репостов, 18 ответов, https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c). Опубликована сетка SVG-иллюстраций с пеликаном на велосипеде для GPT-6 Astra, GPT-5.6 Sol, Terra и Luna на трёх уровнях рассуждений. По alt-тексту Astra даёт наиболее выверенные и согласованные результаты.
  • GPT-6 Astra управляет Blender и создаёт 3D-сцену с пеликаном (@simonwillison.net, 2026-09-05, 400 лайков, 30 репостов, https://bsky.app/profile/simonwillison.net/post/3murtmdynq22s). Через кодирующего агента Blender получил последовательные инструкции создать, украсить и улучшить сцену. Эта тема независимо появилась и на Reddit.
  • Открытая Qwen 3.7 27B локально рисует пеликана (@simonwillison.net, 2026-08-14, 183 лайка, 14 репостов, https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z). Модель была запущена как 17GB GGUF в LM Studio на MacBook Pro M5 Max и, по оценке автора, нарисовала лучшего пеликана среди моделей, работающих на его ноутбуке.
  • Кандидат в губернаторы Нью-Йорка использовал ИИ-фейк для атаки на оппонентов (@404media.co, 2026-09-02, 124 лайка, 22 репоста, 7 ответов, https://bsky.app/profile/404media.co/post/3muka24vu4v2q). Пример использования сгенерированного видео в политической дезинформации.
  • Создатель Cocomelon велел художникам экспериментировать с ИИ (@404media.co, 2026-09-06, 84 лайка, 23 репоста, 21 ответ, https://bsky.app/profile/404media.co/post/3musx3wgdvc2n). Moonbug Entertainment заявила о намерении использовать ИИ при сохранении «человека в контуре».
  • Лейблер подозрительных ИИ-изображений aimod.social превысил 2 500 подписчиков (проверка профиля, https://bsky.app/profile/aimod.social). У сервиса есть руководство по критериям и механизм апелляций; это не новостной источник, но показатель сформировавшегося спроса на маркировку.
  • Старые аккаунты ИИ-арта в основном замолчали (@stablediffusion.bsky.social и @bm63ai.bsky.social). Первый остановился после поста о Статуе Свободы с электрогитарой в январе 2025 года; второй прекратил ИИ-арт после апреля 2025 года.
  • Критика генеративных функций Adobe — справочный материал старого цикла (@petapixel.bsky.social, 2025-02-12 и 2025-01-09). Текст-в-видео Adobe называли неготовым к платной цене, а Generative Remove в Lightroom, по сообщению аккаунта, вместо удаления объекта сгенерировал логотип Bitcoin.
Сигналы
  • Что растёт: визуальные задачи GPT-6 Astra — SVG с пеликаном и 3D-рендеринг в Blender — независимо обсуждаются на Reddit и Bluesky. Важно, что это новый жанр: LLM-агент создаёт визуал через код и 3D-инструменты, а не классическая диффузионная генерация.
  • Что игнорируется или отвергается: открытых новостей крайне мало; конкретно найден только один пост о Qwen 3.7 27B. Публикаций о FLUX, новых Stable Diffusion, Wan или HunyuanVideo не обнаружено.
  • Неожиданное наблюдение: активные в начале 2025 года аккаунты ИИ-арта замолчали, тогда как сервис маркировки подозрительных ИИ-изображений сохраняется и растёт. Центр тяжести разговора может смещаться от «создавать» к «распознавать и контролировать».
  • Противоречивые сигналы: конкретные новости о видеогенерации заметнее как случаи злоупотребления в политической рекламе, чем как соревнование моделей. На Bluesky ИИ-видео более заметно как социальная проблема, чем как технологический тренд.
Ограничения
  • Открытый API поиска Bluesky app.bsky.feed.searchPosts для всех английских и японских запросов — "image generation AI", "Stable Diffusion", "Midjourney", "Sora", "Veo", "Kling" и других — постоянно возвращал HTTP 403. При этом app.bsky.actor.getProfile и app.bsky.feed.getAuthorFeed работали.
  • Веб-интерфейс bsky.app/search является SPA, и текст постов не содержится в HTML, поэтому инструмент получения веб-страниц не мог читать результаты поиска.
  • Вместо поиска по ключевым словам пришлось изучать ленты известных аккаунтов. Это выборка аккаунтов, а не полноценная замена всестороннему поиску.
  • Предполагаемые аккаунты OpenAI, Google DeepMind, Midjourney, Runway, Stability AI, Black Forest Labs, Krea, TechCrunch, The Verge, Ars Technica и Engadget либо не существовали, либо не содержали релевантных публикаций.
  • Критерий примерно 20 проанализированных публикаций на платформу не достигнут: рассмотрено восемь основных записей и одна справочная. В найденных лентах остальных релевантных постов не было.
  • Невозможно отличить отсутствие дискуссии об открытых моделях от пропуска из-за недоступности поиска.

Lemmy

Lemmy — новости ИИ для генерации изображений и видео

Lemmy — федеративная соцсеть, во много раз меньше Reddit, поэтому «вирусность» здесь измеряется десятками, а не сотнями голосов. Тем не менее удалось найти плотную информацию: главным образом в !«メールアドレス» с релизами ComfyUI и моделей, !ai_reddit с ботом-репостером новостей r/ArtificialIntelligence, а также в !technology и саркастичном !techtakes. Поиск выполнялся через lemmy.world/api/v3/search с различными ключевыми словами.

Сообщества
  • !«メールアドレス» — 5 709 подписчиков, из них 893 локальных. Центр новостей о пользовательских узлах ComfyUI и релизах моделей; публикации появляются почти ежедневно.
  • !«メールアドレス» — 2 362 подписчика. Галерея работ, созданных Stable Diffusion, Flux и Krea2.
  • !«メールアドレス» — специализированное сообщество ИИ-аниме; активность сопоставима с предыдущим.
  • !«メールアドレス» — 87 904 подписчика. Репосты крупных технологических статей, включая историю Midjourney.
  • !«メールアドレス» — 2 690 подписчиков. Саркастичное сообщество об ИИ-индустрии.
  • !«メールアドレス» — RSS-репостер r/ArtificialIntelligence; это самый плотный новостной поток, хотя число подписчиков API не вернул.
  • !«メールアドレス» — 8 154 подписчика. Анти-ИИ сообщество, куда попадали статьи о цепочках поставок генеративного ИИ.
Публикации
Ближе к закрытым решениям
  1. Midjourney якобы меняет курс на медицинский УЗИ-сканер Midjourney Medical — 2026-06-18–19, !techtakes и !hackernews, оценки 40–58. Историю высмеивали как возможный «поворот к Theranos». https://lemmy.world/post/48384985
  2. Midjourney потребовала от голливудских студий раскрыть, как те используют ИИ — материал TechCrunch в !technology, оценка 73. https://lemmy.world/post/49069400
  3. Google выпустила Nano Banana 2 Lite — облегчённую модель генерации изображений DeepMind. https://lemmy.world/post/48857780
  4. Microsoft MAI-Image-2.5 догнала Nano Banana 2 в бенчмарках — материал the-decoder.com в !ai_reddit. https://the-decoder.com/microsofts-mai-image-2-5-pulls-even-with-googles-nano-banana-2-on-benchmarks/
  5. Подробное сравнительное обозрение ByteDance Seedream 5.0 Pro — отмечены сильные стороны в редактировании и итеративной генерации. https://www.reddit.com/gallery/1usc03q
  6. Функцию Google Earth AI отключили на следующий день после запуска — пользователи накладывали фальшивые изображения на реальные места. https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature-a-day-after-its-rollout-after-users-made-no-no-images/
  7. Корпоративный бизнес Runway удвоился при NRR выше 300% — новость о росте видеогенерации в B2B. https://www.reddit.com/r/ArtificialInteligence/comments/1w2hnea/runway_says_enterprise_business_doubled_nrr_over/
  8. Amnesty International назвала ключевые ИИ-системы незаконными уже по конструкции — контекст усиления регуляторного давления. https://reddit.com/r/ArtificialInteligence/comments/1ue64s2
  9. Pax Silica: превращение цепочек поставок ИИ в оружие — анализ экономической войны вокруг ИИ-чипов и вычислительных ресурсов. https://thecradle.co/articles/pax-silica-and-the-weaponization-of-ai-supply-chains-the-new-front-in-us-global-economic-warfare
  10. «Astra 6 max» попросили создать искусство, которое тронет автора — философская самореферентная генерация арта коммерческой закрытой моделью. https://i.redd.it/3h241pocalnh1.png
Ближе к открытому исходному коду
  1. Вышла LLaDA-Image — новая модель с 6B Diffusion Transformer и замороженным модулем визуально-языкового понимания на базе LLaDA2.0-Mini. В Qwen-Image-Bench она получила SOTA: 53,53 на английском и 53,38 на китайском. Одновременно открыты быстрый вариант LLaDA-Image-Turbo, веса, код обучения и рецепты. https://lemmy.dbzer0.com/post/74988021
  2. Вышла Boogu-Image-0.1 — открытое семейство Base/Turbo/Edit по Apache-2.0, с 10B параметров и лучшим среди открытых моделей результатом Qwen-Image-Bench — 53,58. https://boogu.org/
  3. ComfyUI-Ref2VA-VSA: узел ускорения вывода для MiniMax H3 — заметно ускоряет видеогенерацию. https://github.com/Kablex/ComfyUI-Ref2VA-VSA
  4. ComfyUI-AetherScale: нативный для NVIDIA GPU апскейлер видео. https://github.com/vizart-vj/ComfyUI-AetherScale
  5. ComfyUI-VDN-H3: гибридное внимание Video Delta Net для повышения эффективности видеомоделей. https://github.com/Saganaki22/ComfyUI-VDN-H3
  6. ComfyUI-Majoor-OmniCam: инструмент компоновки камеры и анимации для управления работой камеры при генерации видео и изображений. https://github.com/MajoorWaldi/ComfyUI-Majoor-OmniCam
  7. FastH3-Ref2V-Stream-Controller — инструмент потокового управления для видеогенерации MiniMax H3. https://github.com/EarthDefenceForces/FastH3-Ref2V-Stream-Controller
  8. ComfyUI-InpaintCanvas: интерфейс инпейнтинга в духе Krita. https://github.com/DenRakEiw/ComfyUI-InpaintCanvas
  9. ComfyUI-MiniMax-H3-MotionCache-FastVAE / ComfyUI-H3VAE_TRT / ComfyUI-MiniMaxH3-CLSS — три последовательных релиза узлов ускорения и облегчения MiniMax H3 1–2 сентября. https://github.com/Mozer/ComfyUI-MiniMax-H3-MotionCache-FastVAE
  10. InterleaveThinker: исследование обучения с подкреплением для агентной чередующейся генерации — добавляет существующим моделям изображений многоагентную способность последовательно генерировать текст и изображения. https://arxiv.org/abs/2606.13679
  11. Поток работ, созданных Flux/Krea2 turbo — в !stable_diffusion_art и !share_anime_art ежедневно публикуется несколько изображений, созданных Flux и Krea2. Это устойчивый сигнал повседневного использования открытых моделей. https://lemmy.dbzer0.com/post/75150630
Сигналы
  • 🔥 Главная тема — предполагаемое метание Midjourney. История о медицинском УЗИ-сканере получила высокие оценки в !techtakes и !technology, но в явно негативном и насмешливом тоне.
  • 🛠️ Для MiniMax H3 за одну неделю подряд вышли пять-шесть узлов ComfyUI. Это типичный признак того, что сообщество разработчиков массово переключилось на оптимизацию конкретной базовой видеомодели.
  • 📊 Общим ориентиром стал Qwen-Image-Bench: LLaDA-Image с 53,53 и Boogu-Image-0.1 с 53,58 соревнуются по одной метрике, делая конкуренцию открытых моделей наглядной.
  • 😤 Новости о геополитических рисках закрытых ИИ-компаний проникают даже в анти-ИИ сообщества, что показывает выход темы за пределы технической аудитории.
  • 🤖 На Lemmy абсолютные цифры нельзя напрямую сравнивать с Reddit и X: оценка в 70 с небольшим уже является крупной новостью для этой платформы.
Ограничения
  • Поиск в федеративном Lemmy зависит от инстанса. API lemmy.world видел главным образом собственные и федеративные публикации; lemm.ee и lemmy.ml не были полноценно охвачены.
  • Поиски "Kling AI", "Stability AI", "Wan 2.2" и "Runway Gen" дали ноль или нерелевантные результаты. Обсуждение видеомоделей на Lemmy почти целиком проходило через MiniMax H3 и ComfyUI.
  • !ai_reddit — автоматический репостер r/ArtificialIntelligence, поэтому это не первичная информация Lemmy.
  • Хотя проанализировано около 20 постов, общий объём публикаций Lemmy на порядки ниже Reddit и X, и по плотности первичных источников он ограничен.

Pinterest

Pinterest — новости ИИ для генерации изображений и видео

Из 50 собранных пинов (output/pinterest.pins.md / images/pinterest/manifest.json), найденных единым запросом "Image and Video Generation AI News" без жанрового разделения, были визуально проверены 30. Ниже приведены выводы на основе их содержимого.

Визуальные темы
  • Кликбейтные обложки «новостей об ИИ»: удивлённые бородатые мужчины, неоновые логотипы инструментов, взрывной фон, похожие на Sam Altman лица и роботизированные телеведущие. Большинство пинов ведёт не на статьи, а на видео YouTube.
  • Инфографики с рейтингами закрытых продуктов: в неоновых рамках регулярно перечисляются Runway, Pika, Kling AI, Luma, Canva, Hailuo AI, HeyGen, Synthesia, InVideo, Sora и Google Veo; аналогично показываются ChatGPT, Nano Banana, Ideogram, GenTube и Z-Image.
  • Персонификация ИИ как робота или ведущего новостей: роботы за новостным столом, синтетические женщины-ведущие и медицинские сцены с роботом и медсестрой заметнее собственно скриншотов инструментов. ИИ изображается как замена человеческим ролям — журналисту или врачу.
  • Образы, разжигающие тревогу о дипфейках и подлинности: кот со штампом «FAKE», викторины «Which is AI?» и изображения ИИ-детекторов с оценкой «97% likely AI generated».
  • Безличные стоковые ИИ-визуалы: фиолетово-синие неоновые фоны, силуэты мозга, печатные платы и частицы с одним заголовком, без конкретных продуктов.
  • Демонстрации image-to-video до и после: сетки преобразования фотографий и видео в стили LEGO, оригами, цветочных фигур и игрушечных автомобилей, а также схемы создания видеотаймлайна из одной фотографии.
  • Конкретные продукты почти всегда закрыты: Veo 2/3, VASA-1, Grok, Sora, ChatGPT и Nano Banana встречаются часто, но среди 30 проверенных пинов не было ни одного подтверждённо открытого названия модели или репозитория.
  • Инфографики об автоматизированном ИИ-пайплайне: одна схема предлагает превращать вирусную ссылку в влог цепочкой из четырёх агентов: Scout → Script → Generate → Animate.
Примечательные пины
  • [1] Image to Video AI: How It Works and Why It Matters — наиболее конкретная техническая схема: от одной статичной картинки через ползунки силы движения, временной согласованности и визуального контроля к видеотаймлайну.
  • [7] (без названия, сетка преобразований LEGO/origami/flowers) — сетка 3×5, демонстрирующая преобразование видео с людьми, игрушечной пандой и Tesla в деревянные блоки, оригами, LEGO и цветы.
  • [9] 10 FREE AI VIDEO TOOLS IN 2026 — список десяти бесплатных ИИ-видеоинструментов: Pictory, Runway ML, Veed.io, Synthesia, InVideo, Kling AI, D-ID, Lumen5, Canva и Hyperwrite.
  • [24] (без названия, image-to-video с фиолетовым персонажем-монстром) — демонстрация одной входной картинки в трёх видео с совершенно разными окружениями: серверная, подводные руины и город из конфет; заголовок связан с Veo 3.
  • [27] 5+ Best AI Video Generation Websites — сравнение Runway, Pika, Kling AI, Luma, Canva и Hailuo с ориентацией на YouTube Shorts, TikTok, видеопины Pinterest и видео о товарах.
  • [36] Top AI Image Generation Tools — подборка ChatGPT, Nano Banana, GenTube, Ideogram и Z-Image, демонстрирующая проникновение новых названий в Pinterest SEO-материалы.
  • [39] The Latest AI Developments — единственный по-настоящему новостной пин с тремя конкретными историями: ИИ отвечает на звонки 911 в Новом Орлеане, Meta бесплатно выпускает офлайн-агентную модель Muse Glimmer, а северокорейская Kimsuky автоматизирует фишинговые документы собственным ИИ-стеком.
  • [41] Microsoft Unveils VASA-1 — схема технологии Microsoft Research: из одного изображения и аудиоклипа, с необязательным управлением выражением лица, создаётся реалистичная анимация разговора нескольких лиц в реальном времени.
  • [16] AI Image Video: Best Quality vs Best Free — руководство по выбору между платными высококачественными и бесплатными инструментами: ChatGPT Plus, Gemini Advanced, Midjourney, Adobe Firefly, Recraft, Runway Gen-3, Luma, Pika Pro, Kaiber, Synthesia, Ideogram, SeaArt, Playground, Krea, Canva, Inkscape и CapCut.
  • [47] AI video creation just got crazy — предложение автоматического пайплайна из четырёх агентов для создания готового влога по вирусной ссылке.
Сигналы
  • В Pinterest область «Image and Video Generation AI» в основном состоит не из срочных новостей, а из SEO- и партнёрских инфографик со сравнениями и инструкциями. Прямые ссылки на первичные источники — официальные анонсы, статьи или исследования — почти отсутствуют; большинство пинов ведёт в блоги или на YouTube.
  • Среди конкретных новостных событий выделяются только три сюжета пина [39], а также пины о Veo 2/3, VASA-1 и Grok. Первичной информации, которую можно было бы назвать актуальными новостями в масштабе 20 публикаций, очень мало.
  • Закрытые решения представлены подавляюще сильнее: повторяются Runway, Pika, Kling AI, Luma, Canva, Hailuo, HeyGen, Synthesia, Sora, Veo, ChatGPT, Nano Banana и Ideogram. Открытые модели и проекты отсутствуют: нет ни Stable Diffusion, ни ComfyUI, ни Open-Sora. Pinterest — слабый источник для описания открытого сегмента.
  • Образы «ИИ заменяет человеческую роль» — ведущего новостей, медсестру, оператора 911 — соседствуют с образами сомнения в подлинности — штампами FAKE, викторинами и детекторами. Социальное воздействие и тревога о доверии здесь значимее самой технологии.
  • Среди применений видеогенерации особенно заметны превращение фото в анимацию и стилизация существующего видео. В отличие от text-to-video с нуля, главным коммерческим аргументом выступает преобразование входного изображения или видео.
Ограничения
  • 50 пинов были собраны единственным запросом без жанрового разделения; поле genre у всех записей пустое. Целенаправленного поиска по оси закрытый/открытый исходный код не было.
  • Фактически открыты и проверены только 30 из 50 изображений; непроверенные записи во многом имеют заголовки, пересекающиеся с уже найденными темами — сравнения липсинк-инструментов, видеоредакторов и детекции ИИ.
  • Pinterest напрямую не просматривался: выводы основаны только на заранее собранных изображениях и заголовках. В manifest и таблице пинов нет дат и вовлечённости, поэтому нельзя оценить ни свежесть, ни масштаб распространения.
  • Значимых упоминаний открытого исходного кода не найдено, поэтому Pinterest нельзя использовать как основу для выводов об этом сегменте.

Рекомендуемые действия

  • Продолжать отслеживать агентную визуальную генерацию GPT-6 Astra — управление Blender и создание 3D-городов — как отдельную тему в следующих выпусках.
  • Чтобы не пропускать открытые релизы, добавить на всех платформах поисковые запросы с конкретными названиями: "FLUX", "Stable Diffusion", "Qwen-Image", "Wan" и "ComfyUI".
  • В исследовании Bluesky заранее расширить список отслеживаемых аккаунтов, исходя из того, что 403 поискового API будет сохраняться.
  • Поскольку Pinterest не даёт даты публикации и вовлечённость, использовать его не для срочных сравнений, а только для регулярного наблюдения за узнаваемостью инструментов.
  • Не приводить категоричных утверждений о предполагаемом повороте Midjourney к медицинскому оборудованию до появления первичного источника — официального объявления Midjourney.
  • В первую очередь проверять !stable_diffusion на Lemmy и YouTube-каналы с тестами как основные источники по движению открытого исходного кода.

Собранные изображения

ИИ Image to Video: как это работает и почему это важно — The Data Scientist🎨 Создание ИИ-изображений и видеоИИ-контент и проблемы социальных сетейКонцепция создания ИИ-контента с иконками для генерации текста, изображений, музыки и видеоУниверсальная платформа ИИ-генерации изображений и видео — The Data ScientistImage to Video ИИ — анимируйте фотографии с ИИGoogle объявляет о сверхкачественном видео...Просто сделайте это 🎥🎬 10 БЕСПЛАТНЫХ ИИ-видеоинструментов в 2026 году 🤯 Создавайте видео без дорогого ПО!изображениеНовости ИИ: OpenAI наконец выпустила то, о чём мы просилиVeo 3 Image-to-Video: быстрая генерация и нативный звук через Gemini APIGoogle представляет Veo 2: продвинутый ИИ-инструмент видеогенерации с повышенным реализмом и кинематографическими функциямиизображениеИскусственный интеллект: давайте сохраним наш...ИИ для генерации изображений и видеоТоп-10 инструментов липсинка 2026 — лучшее ИИ-ПО для реалистичного синхрона губЛучшие ИИ-видеогенераторы 2025 годаGPT 5.2, видеоредактор реального времени, стерео-ИИ-видео, мобильные ИИ-агенты, управление всем телом: НОВОСТИ ИИизображениеКак ИИ меняет видеомонтажПочему ИИ-генерация видео становится необходимой для...Более 20% YouTube теперь создано ИИGoogle объявляет об ИИ-видеогенерации Veo 3,...‎🚨 ИИ становится пугающе хорошим.изображение5+ лучших сайтов ИИ-видеогенерации 2026: Runway, Pika, Kling AI, Canva и другиеИИ-инструменты видеомонтажа: чем на самом деле пользуются авторы в 2026 годуизображениеИскусственный интеллект: инструмент, чтобы освободить...Анализ изображений и видео на основе ИИУзнайте, как Grok революционизирует видео...12 лучших ИИ-видеогенераторов 2026 года: Google Veo, Sora, Runway и другиеПоль Лафарг из IDEC Group: влияние...Как бесплатно обнаруживать ИИ-изображения онлайнинструменты ИИ-генерации изображений 🔥🔥Что такое Imagvio AI и как он помогает авторам...TotalYmage революционизирует интерактивные видео...Последние разработки ИИ — ИИ отвечает на 911, офлайн-модель Metaинструменты ИИMicrosoft представляет VASA-1, задающий новые стандарты генеративного ИИ в видеогенерацииБудущее создания видео: лучшие ИИ-видеогенераторы 2026 года🔸Видео, созданные ИИ: хорошо или плохо? Вот правда! 🤖🎥Саркастический обзор ИИ-новостей №8Я создам объясняющее ИИ-видео с Synthesia, Sora AI, Kling AI, Runway AI и InVideoПолное руководство по использованию Chat GPT как...Создание ИИ-видео только что стало безумным.Что такое генеративный ИИ? Полное техническое руководство — RCN GuideКак создать новостной канал с ИИ: генератор ИИ-новостного видео и ИИ-липсинкИИ

Примечание о качестве данных

Bluesky постоянно возвращал 403 поискового API и не позволил достичь критерия в 20 публикаций; Pinterest не предоставил даты или показатели вовлечённости, поэтому нельзя оценить свежесть. Reddit и X использовали один поисковый запрос и не сопоставляли закрытые и открытые решения намеренно, вследствие чего обсуждение открытого исходного кода оказалось сосредоточено на Lemmy и YouTube.

Галерея