Новости ИИ для генерации изображений и видео — 2026-09-08
На закрытой стороне новым жанром, независимо обсуждавшимся на Reddit, X и Bluesky, стало создание изображений и 3D-видео не диффузионными моделями, а LLM-агентом (GPT-6 Astra), управляющим GUI-инструментами и Blender. Движение в открытом исходном коде в основном сосредоточилось в сообществе ComfyUI на Lemmy и на YouTube-каналах с тестами; на Bluesky, Pinterest, Reddit и X оно почти не наблюдалось.
Новости ИИ для генерации изображений и видео — 2026-09-08
Главной темой исследования шести платформ стало независимое появление на трёх платформах нового жанра: LLM-агент GPT-6 Astra не генерирует изображения диффузионной моделью, а напрямую управляет GUI-инструментами и Blender, создавая изображения и 3D-видео. В целом открытый исходный код был представлен слабее, однако на Lemmy в сообществе !stable_diffusion за одну неделю подряд вышло пять-шесть ускоряющих узлов ComfyUI для видеомоделей MiniMax H3, а на YouTube продолжается проверка соперничества Flux.2/Flux 2 Klein и Qwen-Image. На Pinterest и в большинстве публикаций Reddit и X преобладали названия закрытых продуктов — Midjourney, Sora, Veo, Runway, Kling, Nano Banana, Seedream и другие; названия открытых моделей почти не встречались. Общей чертой также стало то, что на Reddit и Pinterest заметнее оказались не технические тренды сами по себе, а споры о том, создано ли что-то ИИ, и социальные последствия замены человеческих ролей и труда ИИ-агентами.
На всех платформах
- Агентная визуальная генерация GPT-6 Astra независимо стала темой на трёх платформах: случай, когда Astra управляла Blender и выполнила рендеринг, отдельно обсуждался на Reddit (r/DefendingAIArt) и Bluesky (@simonwillison.net); демонстрация создания 3D-города с Astra породила цепочку подражаний в X (@synabreu, @GulatiYajat). Главной межплатформенной темой стал не прогресс диффузионных моделей, а новый подход: LLM-агент захватывает существующие инструменты и создаёт иллюстрации или 3D.
- Оценки того, решена ли проблема постоянства персонажей и сцен в видеогенерации, по-прежнему расходятся: и на Reddit (r/generativeAI, r/aivideomaking), и в X — между хвалящим Seedance 2.5 @atlas_remake и указывающим на сбои в сложных сценах @Aiden_Tech_Ai — одновременно публиковались противоположные мнения.
- Заметность открытого исходного кода резко различается между платформами: Lemmy
!stable_diffusionактивен настолько, что узлы ComfyUI для MiniMax H3, включая ComfyUI-Ref2VA-VSA, выходят одновременно; на YouTube регулярно публикуются сравнения Qwen-Image, FLUX и Wan 2.2. Напротив, на Bluesky, Pinterest, Reddit и X почти не удалось найти публикаций с конкретными названиями открытых моделей — новых Stable Diffusion, FLUX, Wan или HunyuanVideo. Во многих разделах Limits отмечается структурная слабость: неизвестно, действительно ли открытый исходный код не обсуждался или его просто пропустили из-за перекоса поисковых запросов в сторону закрытых продуктов. - Споры о подлинности и социальное воздействие идут параллельно с техническими трендами: независимо на нескольких платформах наблюдались публикации, где спорят, настоящее ли это изображение или генерация, Bluesky-лейблер aimod.social для автоматической маркировки ИИ-изображений, фейковое видео о выборах губернатора Нью-Йорка и Pinterest-обложки со штампами «FAKE». Темой всё чаще становится не создание, а распознавание и сомнение.
По платформам
Reddit: среди 12 тредов больший отклик получили не специализированные сабреддиты об ИИ-генерации изображений и видео, а сообщества о спорах вокруг ИИ и определении подлинности. Из-за единственного поискового запроса сравнение закрытых и открытых решений практически не получилось.
X: в центре внимания были анонс NVIDIA Sol-H3 — видеовывод быстрее воспроизведения в реальном времени — его локальное воспроизведение отдельными пользователями, а также цепочка подражаний при создании 3D-городов с GPT-6 Astra. Из 40 публикаций лишь ограниченная часть напрямую относилась к ИИ-генерации изображений и видео; много нерелевантных результатов попало из региональных трендов Explore.
YouTube: из-за JavaScript-рендеринга страниц не удалось получить просмотры и число подписчиков, но были подтверждены сравнительные и объясняющие каналы, рассматривающие как закрытые решения — Midjourney V8.2, Grok Imagine, Google Gemini «Omni», — так и открытые — Qwen-Image-2.0, FLUX и Wan 2.2. Среди шести платформ это был наиболее удобный источник для сравнения закрытого и открытого подходов.
Bluesky: поисковый API app.bsky.feed.searchPosts постоянно возвращал 403, поэтому пришлось проверять ленты известных аккаунтов, таких как @simonwillison.net и @404media.co, по отдельности. До критерия в 20 разобранных публикаций дойти не удалось. Единственной конкретной публикацией об открытом исходном коде стал отчёт о локальном запуске Qwen 3.7 27B.
Lemmy: наибольший разовый интерес вызвал скандал вокруг предполагаемого поворота Midjourney к медицинским УЗИ-сканерам в !techtakes. В открытом сегменте именно здесь были наиболее плотные первичные сведения: одновременные релизы ComfyUI-узлов для MiniMax H3 и соревнование по бенчмарку Qwen-Image-Bench между LLaDA-Image и Boogu-Image-0.1.
Pinterest: было проверено 30 из 50 заранее собранных пинов. Из-за единственного запроса и отсутствия разделения по жанрам основную массу составили инфографики со сравнениями и инструкциями по закрытым продуктам; ни одного названия открытой модели или проекта не обнаружено. В manifest также отсутствуют даты и показатели вовлечённости, поэтому свежесть оценить невозможно.
На что смотреть
- Видеовывод MiniMax H3 / Sol-H3 быстрее реального времени и рост числа оптимизирующих узлов ComfyUI — X (@xieenze_jr) / Lemmy (ComfyUI-Ref2VA-VSA и другие). Важно, насколько открытые веса и локальные реализации смогут догнать облачные анонсы.
- Распространение агентной визуальной генерации GPT-6 Astra — Reddit (r/DefendingAIArt) / Bluesky (@simonwillison.net) / X (@synabreu). Следить, насколько далеко расширится волна подражаний.
- Борьба за лидерство в открытом исходном коде между FLUX.2/Flux 2 Klein и Qwen-Image — YouTube (SECourses, Urban Decoders). Важно, как результаты более чем 700 тестов повлияют на дальнейшее внедрение.
- Продолжение истории о смене курса Midjourney на медицинское оборудование — Midjourney Medical — Lemmy (через pivot-to-ai.com). Остаётся выяснить, была ли это шутка или реальный план.
- Последствия злоупотребления ИИ-видео в политической рекламе на выборах губернатора Нью-Йорка — Bluesky (404media.co). Следить за реакцией регуляторов и платформ.
- Решение проблемы постоянства персонажей и сцен в видеогенерации — Reddit (r/generativeAI) / X (@Aiden_Tech_Ai). Вопрос в том, действительно ли универсальные инструменты приблизились к решению.
Рекомендации
- Продолжать отслеживать агентную визуальную генерацию GPT-6 Astra — управление Blender и создание 3D-городов — как отдельную тему в следующих выпусках.
- Чтобы не пропускать открытые релизы, добавить на всех платформах поисковые запросы с конкретными названиями: "FLUX", "Stable Diffusion", "Qwen-Image", "Wan" и "ComfyUI".
- В исследовании Bluesky заранее расширить список отслеживаемых аккаунтов, исходя из того, что 403 поискового API будет сохраняться.
- Поскольку Pinterest не даёт даты публикации и вовлечённость, использовать его не для срочных сравнений, а только для регулярного наблюдения за узнаваемостью инструментов.
- Не приводить категоричных утверждений о предполагаемом повороте Midjourney к медицинскому оборудованию до появления первичного источника — официального объявления Midjourney.
- В первую очередь проверять
!stable_diffusionна Lemmy и YouTube-каналы с тестами как основные источники по движению открытого исходного кода.
Качество данных
Наименее информативными оказались Bluesky — постоянный 403 поискового API, проверка только отдельных аккаунтов и меньше 20 публикаций — и Pinterest, где в manifest нет дат и показателей вовлечённости, а единственный запрос не дал ни одного упоминания открытого исходного кода. Reddit и X также ограничились одним поисковым запросом, совпадающим с названием брифа, поэтому намеренно собранного сопоставления закрытых и открытых решений не было. В результате обсуждение открытого исходного кода оказалось сконцентрировано на Lemmy и YouTube. На YouTube из-за JavaScript-рендеринга нельзя было получить просмотры и число подписчиков.
Сводка по платформам
Reddit — новости ИИ для генерации изображений и видео
Основные площадки обсуждений — сабреддиты
Все 12 собранных тредов были взяты по одному из разных сабреддитов. Специализированных сообществ об ИИ-генерации изображений и видео мало; заметнее сообщества о кино, проверке фейков и культурных спорах вокруг ИИ.
| Сабреддит | Число участников | Собрано тредов |
|---|---|---|
| r/whenthe | 813,975 | 1 |
| r/isthisAI | 406,607 | 1 |
| r/antiai | 317,903 | 1 |
| r/aiwars | 167,158 | 1 |
| r/generativeAI | 151,385 | 1 |
| r/RemoteWorkers | 75,332 | 1 |
| r/DefendingAIArt | 72,770 | 1 |
| r/pj_explained | 96,256 | 1 |
| r/NewRockstars | 15,523 | 1 |
| r/freetoolsAI | 7,887 | 1 |
| r/aivideomaking | 6,517 | 1 |
| r/GoogleFlow | 1,789 | 1 |
Единственным запросом был "Image and Video Generation AI News". Поэтому результаты сместились не к профильным сообществам — r/generativeAI, r/aivideomaking, r/GoogleFlow и r/freetoolsAI, — а к дискуссиям «за и против ИИ» и тредам «это ИИ?».
Реакция сообщества
- GPT-6 рисует «от руки» управлением мышью и может подделывать таймлапсы (тред 2, r/antiai, 7 013 баллов, 1 009 комментариев, 2026-09-05, https://www.reddit.com/r/antiai/comments/1w81kdd/). LLM GPT-6 дали управление мышью и клавиатурой в программе для цифрового рисования, после чего она смогла создать даже убедительный «доказательный» таймлапс. Главный комментарий выражал отчаяние: теперь нет смысла даже снимать таймлапсы для подтверждения авторства.
- GPT-6 Astra создала фотореалистичный рендер в Blender (тред 9, r/DefendingAIArt, 143 балла, 13 комментариев, 2026-09-06, https://www.reddit.com/r/DefendingAIArt/comments/1w970uy/). Внимание привлёк не факт генерации видео самим ИИ, а то, что агент управлял Blender для выполнения рендеринга.
- Расширение AutoFlow для Google Flow поддерживает непрерывную генерацию видео (тред 12, r/GoogleFlow, 12 баллов, 6 комментариев, 2026-09-01, https://www.reddit.com/r/GoogleFlow/comments/1w4eeyp/). Добавлена функция Continue from Last Frame: последний кадр предыдущего клипа автоматически становится первым кадром следующего; доступны также очередь нескольких генераций и управление референсами.
- К рекламному посту о бесплатном генераторе изображений ИИ проявили большой интерес (тред 3, r/freetoolsAI, 39 баллов, 48 комментариев, 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/). Одни пользователи говорили, что сервис без регистрации, ограничений и оплаты сэкономил им сотни долларов и часы работы; другие сомневались в устойчивости его операционной модели.
- Главные препятствия в ИИ-видео — длительность и постоянство персонажей (тред 10, r/generativeAI, 4 балла, 15 комментариев, 2026-09-07, https://www.reddit.com/r/generativeAI/comments/1w9klb7/). Для 2–4-минутного научно-фантастического ролика участники советовали создавать кадры в GPT Image 2 и анимировать в Seedance 2.5, предупреждая о стоимости порядка 100 долларов за готовую минуту. Согласованная позиция: универсальные решения пока плохо удерживают персонажей между статичным изображением и видео.
- Бесплатная видеогенерация на слабом оборудовании остаётся нереалистичной (тред 8, r/aivideomaking, 6 баллов, 15 комментариев, 2026-09-07, https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/). В ответ на желание сделать бесплатное 45-секундное ИИ-видео с телефона и iPad пользователи указали, что это задача уровня дата-центра: реалистичный предел — пятисекундные клипы с водяными знаками, которые затем можно склеить.
- ИИ-изображения еды в рекламе по-прежнему называют неаппетитными (тред 4, r/aiwars, 4 балла, 177 комментариев, 2026-09-03, https://www.reddit.com/r/aiwars/comments/1w69cdj/). Одни сравнивали картинку с намеренно созданным отвратительным изображением или гнездом насекомых; другие возражали, что локальная Krea 2 при хорошем промпте способна дать лучший результат.
- Вакансия удалённой проверки ИИ-подписей к изображениям получила много откликов (тред 5, r/RemoteWorkers, 152 балла, 739 комментариев, 2026-09-04, https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/). Работа за 30 долларов в час заключается в выявлении ошибок ИИ-подписей: неверно распознанных объектов, цветов и текста. Большинство комментариев просило ссылку на вакансию.
- Возникли два спора о том, является ли чрезвычайно реалистичное ИИ-видео настоящим (треды 1/6, r/NewRockstars и r/pj_explained, дублирующее распространение одного поста, 2026-09-02). В споре о якобы утёкшей сцене столкновения Тора с колонной одни утверждали, что это CGI, а не ИИ; другие называли доказательством ИИ идеально круговое распространение взрыва.
- Видео, где волна появляется внутри окна, разделило комментаторов на два лагеря (тред 7, r/isthisAI, 0 баллов, 79 комментариев, 2026-09-07, https://www.reddit.com/r/isthisAI/comments/1w9cyub/). Одни объясняли ролик перспективой и считали его настоящим, другие указывали на физически невозможное движение пены как на признак ИИ.
Сигналы
- Что растёт: настороженность к тому, что ИИ перестаёт выглядеть как ИИ. Масштаб реакции на тред 2 — 7 013 баллов и 1 009 комментариев — показывает сильное беспокойство из-за того, что LLM уже может напрямую пользоваться GUI и подделывать даже доказательства «ручного» создания.
- Что игнорируется или отвергается: запросы на бесплатное, длинное и качественное видео сообщества систематически отвергают. Ограничения оборудования и стоимости остаются жёсткими.
- Неожиданное наблюдение: профильные сабреддиты уступают по вовлечённости сообществам о проверке подлинности и спорах о допустимости ИИ. На Reddit новости об ИИ-изображениях и видео сейчас чаще обсуждаются как социальное трение вокруг вопроса «это ИИ или нет», а не как прогресс моделей.
- Противоречивые сигналы: в отношении одного и того же ролика о столкновении Тора оценки «не ИИ» и «это ИИ» оказались противоположными; аналогично разделились мнения и в треде 7. Визуальная оценка обычных пользователей больше не выглядит надёжной.
Ограничения
- Использовался только запрос "Image and Video Generation AI News"; дополнительные варианты, такие как "Stable Diffusion", "Midjourney", "Sora", "Kling" или запросы об открытой генерации изображений, не применялись. Поэтому публикаций, прямо сопоставляющих закрытые решения — Midjourney, DALL-E, Sora, Veo, Runway — и открытые — Stable Diffusion, Flux, экосистему ComfyUI, — почти не было.
- 12 тредов были взяты из 12 разных сабреддитов, по одному из каждого, поэтому сравнить несколько тредов внутри одного сообщества нельзя.
- У тредов 9 и 11 отсутствует тело поста: доступны только заголовок и комментарии.
- Треды 1 и 6 фактически являются репостом одного материала в разных сабреддитах; как две независимые записи они дают фактическую выборку из 11 материалов.
- Из-за особенностей браузерного сбора в этом запуске не выполнялись дополнительные обращения к Reddit: повторный поиск по другим запросам и раскрытие всех комментариев.
X
X — новости ИИ для генерации изображений и видео
Аккаунты
40 публикаций поступили от 37 аккаунтов. Почти все были единичными всплесками; единственным связанным с генерацией изображений и видео аккаунтом с несколькими постами был @yu_ichi_suzuki, публиковавший техническую ветку о MiniMax H3 на локальной RTX 5090.
| Аккаунт | Число публикаций | Характер |
|---|---|---|
| @yu_ichi_suzuki(鈴木憂一) | 2 | Техническая ветка о запуске MiniMax H3 на локальной RTX 5090, всего 309 лайков |
| @xieenze_jr(Enze Xie) | 1 | Анонс новой модели от исследователя MiniMax, 349 лайков и около 85 000 просмотров |
| @voxelphotonics | 1 | Вирусная демонстрация объёмного отображения Duke Nukem 3D: 6 097 лайков и около 297 000 просмотров |
| @synabreu | 1 | 3D-модель Сеула, созданная GPT-6 Astra: 2 700 лайков и около 235 000 просмотров |
| @GulatiYajat(Yajat Gulati) | 1 | 3D-город Гургаон с GPT-6 Astra: 574 лайка |
| @luccacerf | 1 | Демонстрация Blender MCP + Astra + Tripo: 445 лайков |
| @He1s_Sammy | 1 | Длинная ветка о коммерциализации ИИ-видео для детей без показа лица: 388 лайков |
| @SD_Tutorial(Stable Diffusion Tutorials) | 1 | Техническое объяснение Sol-H3, скромная реакция — 22 лайка |
| @Strength04_X, @atlas_remake, @Aiden_Tech_Ai, @alphafox | по 1 | Средние аккаунты, обсуждающие качество и ограничения Seedance 2.5 и ИИ-видео |
Публикации
- MiniMax представила Sol-H3 — генерацию видео быстрее реального времени (#2 @xieenze_jr, 349 лайков, 62 репоста, 23 ответа, около 85 000 просмотров, 2026-09-07, https://x.com/xieenze_jr/status/2097000082927399012). На 8× NVIDIA B300 Blackwell пять секунд видео 1344×768, по заявлению компании, выводятся за 1,653 секунды. Публикация стала источником тренда X Explore «NVIDIA Speeds Up AI Video Generation Past Real-Time Playback».
- Распространилось техническое объяснение анонса (#3 @SD_Tutorial, 22 лайка, около 2 100 просмотров, 2026-09-07, https://x.com/SD_Tutorial/status/2097061880175141224). В нём Sol-H3 описывается как высокопроизводительный стек вывода видео NVIDIA Research, запускающий MiniMax-H3 быстрее воспроизведения в реальном времени.
- Опубликована инструкция по запуску MiniMax H3 на RTX 5090 (#4–5 @yu_ichi_suzuki, 295+14 лайков, около 18 000+1 100 просмотров, 2026-09-07, https://x.com/yu_ichi_suzuki/status/2096819288997065192). Автор описал получение примерно 15 секунд видео выше 2K за девять минут с локальной RTX 5090: поиск удачного 480p-результата с дистиллированной LoRA Alibaba и апскейл через RTX Video Super Resolution до 2688×1536.
- Seedance 2.5 создаёт модное видео (#1 @Strength04_X, 68 лайков, 2 репоста, 35 ответов, около 7 700 просмотров, 2026-09-06, https://x.com/Strength04_X/status/2096441159887274302). Опубликовано фотореалистичное 30-секундное кинематографическое fashion-travel-музыкальное видео с полным промптом.
- Seedance 2.5 создаёт мир в духе «Истории игрушек» (#14 @atlas_remake, 3 лайка, около 133 просмотров, 2026-09-07, https://x.com/atlas_remake/status/2096847522602139995). Автор положительно оценил работу модели с несколькими анимированными персонажами и объектами.
- Проблема «игрового автомата» в ИИ-видео всё ещё существует (#12 @Aiden_Tech_Ai, 1 лайк, 2 репоста, 4 ответа, около 494 просмотров, 2026-09-07, https://x.com/Aiden_Tech_Ai/status/2097020441470836791). Автор отметил, что при нескольких пространствах, движении камеры, блокинге персонажей и непрерывности приходится генерировать снова и снова из-за новых ошибок.
- Duke Nukem 3D воспроизвели на объёмном 3D-дисплее (#10 @voxelphotonics, 6 097 лайков, 921 репост, 130 ответов, около 297 000 просмотров, 2026-09-07, https://x.com/voxelphotonics/status/2096833425043005562). Это не генерация изображений или видео как таковая, а демонстрация технологии отображения, но пост стал одним из самых вовлечённых за период.
- GPT-6 Astra превратила весь Сеул в 3D-город (#20 @synabreu, 2 700 лайков, 451 репост, 81 ответ, около 235 000 просмотров, 2026-09-06, https://x.com/synabreu/status/2096557555086725159). Вирусный пример применения разговорной 3D-генерации.
- Аналогично GPT-6 Astra воссоздала 3D-город Гургаон (#22 @GulatiYajat, 574 лайка, 28 репостов, 53 ответа, около 46 000 просмотров, 2026-09-06, https://x.com/GulatiYajat/status/2096659142534676684). Автор прямо указал, что решил попробовать после того, как увидел множество демонстраций Astra, и открыл сайт gurgaon-3d-atlas.cratorlabs-2435.chatgpt.site.
- Демонстрация связки Blender MCP + Astra + Tripo (#21 @luccacerf, 445 лайков, 20 репостов, 11 ответов, около 31 000 просмотров, 2026-09-07, https://x.com/luccacerf/status/2097047098281672782). Пример объединения нескольких ИИ-инструментов через MCP.
- ИИ-видео для детей без показа лица становятся контент-бизнесом (#23 @He1s_Sammy, 388 лайков, 96 репостов, 17 ответов, около 19 000 просмотров, 2026-09-06, https://x.com/He1s_Sammy/status/2096492880017736056). Вирусный пост о монетизации генеративного видео с телефона, ноутбука или iPad.
Сигналы
- Что растёт: создание 3D-миров разговорными агентами — 3D-Сеул в GPT-6 Astra и связка с Blender MCP — стало наиболее подражаемым направлением. Публикация @GulatiYajat прямо подтверждает цепочку подражания посту @synabreu.
- Что растёт, часть вторая: одновременно обсуждаются видеовывод быстрее реального времени — Sol-H3 — и попытки воспроизвести его с открытыми весами на локальных GPU. На X облачные анонсы и локальные практики идут почти без временного разрыва.
- Что игнорируется или вызывает разногласия: постоянство нескольких персонажей и пространств в ИИ-видео одновременно получает похвалу и критику; единой оценки нет.
- Неожиданное наблюдение: из девяти трендов Explore, породивших 40 собранных постов, к ИИ-генерации изображений и видео напрямую относились только первые три. Остальные были региональными или новостными трендами, не связанными с темой. Однако поиск по тренду «Building» случайно вывел на качественные демонстрации 3D-городов GPT-6 Astra.
- Случай VTuber Veibae: поиск тренда о возвращении Veibae с анимацией Sunflower Farm дал только нерелевантные дублирующиеся посты о североамериканском бокс-офисе. Публикаций самой Veibae или сведений об использовании ИИ при создании анимации не найдено.
Ограничения
- По тренду Explore «VTuber Veibae Teases Return with Sunflower Farm Animation» не удалось собрать релевантные посты; выяснить, применялся ли ИИ при создании анимации, невозможно.
- Шесть остальных трендов Explore почти не были связаны с темой, а 29 из 40 постов оказались нерелевантными и исключены из отчёта.
- Поиск ограничивался буквальными названиями трендов; запросы по "Stable Diffusion", "Midjourney", "Sora", "Kling" и "ComfyUI" не выполнялись. Поэтому прямого сопоставления закрытых и открытых решений не получилось.
- Explore был географически привязан к местоположению сервера, предположительно району Хорватии, и не представляет глобальные тренды X.
- Сбор остановили на 40 записях; дальнейший анализ публикаций тех же аккаунтов, ответов и хэштегов не проводился.
YouTube
YouTube — последние тенденции ИИ для генерации изображений и видео
Каналы
- 動画編集の中の人 (канал) — много практических сравнений генераторов изображений.
- AI大学【AI&ChatGPT最新情報】 (канал) — ежемесячные обзоры генеративных ИИ-инструментов.
- 【さき】のAIでええやん。 (канал) — объяснения обновлений Google I/O и Gemini.
- Qwen(официальный) (канал) — официальные анонсы серии Qwen-Image.
- AIOnTrend (канал) — сравнения открытых моделей изображений.
- Urban Decoders (канал) — разборы архитектуры моделей Flux.
- SECourses (канал) — масштабные локальные тесты генерации изображений.
- Woollyfern (канал) — регулярное наблюдение за обновлениями Midjourney.
- 寺田部チャンネル (канал) — практические обзоры локальной видеогенерации в ComfyUI.
- 東京大学 吉田幸 研究室 (канал) — регулярные объяснения трендов генеративного ИИ от университета.
Число подписчиков получить не удалось, поскольку страницы результатов и видео YouTube рендерятся JavaScript.
Видео
Закрытые решения
- 【После серьёзных трат стало ясно】Лучшие ИИ-генераторы изображений 2026 года: подробное сравнение NanoBananaPro, Seedream4.0, Midjourney и AdobeFirefly — 動画編集の中の人 — https://www.youtube.com/watch?v=vJLDbXaSKW4 — практическое платное сравнение Nano Banana Pro, Seedream 4.0, Midjourney и Adobe Firefly с выводом о лучших инструментах 2026 года.
- 【Последнее за зиму 2026】Шесть популярных бесплатных инструментов ИИ-генерации видео, которые за последние месяцы развились сильнее всего: Sora 2, Veo 3.1, Kling 2.6 и другие — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=T9iIlhittDc — обзор шести бесплатных видеогенераторов, включая Sora 2, Veo 3.1 и Kling 2.6.
- 【Первое место в мировом рейтинге】Подробный разбор Grok Imagine от xAI: как бесплатно создавать видео уровня Sora/Veo — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=0cYPwxg8le8 — утверждает, что Grok Imagine занял первое место, и объясняет бесплатное создание видео уровня Sora и Veo.
- 【Новое】Google значительно обновила модели Gemini и представила видеогенератор Omni: разбор Google I/O 2026 — 【さき】のAIでええやん。 — https://www.youtube.com/watch?v=vKtwoKCSGyE — объяснение обновлений Gemini и новой видеомодели Omni.
- Midjourney Update | July 2026: V8.2 is HERE! Personalization, NIJI Style Creator, and More! — Woollyfern — https://www.youtube.com/watch?v=dvfH5HzCARY — сообщает о выпуске Midjourney V8.2, персонализации и NIJI Style Creator.
Открытые решения
- 🚀 Introducing Qwen-Image-2.0 — our next-gen image generation model! — официальный канал Qwen — https://www.youtube.com/watch?v=1tM7Wd0lEeI — официальный анонс Alibaba Qwen-Image-2.0 как следующей открытой модели генерации изображений.
- Qwen Image Dominates Text-to-Image: 700+ Tests Reveal Why It's Better Than FLUX - Presets Published — SECourses — https://www.youtube.com/watch?v=R6h02YY6gUs — проверка по более чем 700 тестам, объясняющая преимущества Qwen Image над FLUX, с опубликованными пресетами.
- Flux 2 Klein vs Qwen vs Z Image Turbo vs Nano Banana Pro - Which AI Image Wins? — AIOnTrend — https://www.youtube.com/watch?v=CkAtP2EVhSM — сравнение Flux 2 Klein, Qwen и Z Image Turbo с закрытой Nano Banana Pro на одинаковых промптах.
- Flux.2 New Open Source King? Architecture FULL guide + Nano Banana Pro comparisons — Urban Decoders — https://www.youtube.com/watch?v=Iu9Dm7lBeAk — разбор архитектуры Flux.2 от Black Forest Labs и сравнение с Nano Banana Pro.
- Flux 2 Klein Just Dropped—This Image Editing Model Isn't Just About Speed! — https://www.youtube.com/watch?v=JXgBe3twxbc — быстрый обзор лёгкой локально запускаемой модели редактирования изображений Flux 2 Klein.
- Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models — https://www.youtube.com/watch?v=3BFDcO2Ysu4 — учебное видео об обновлениях Wan 2.2, FLUX, Qwen Image и других передовых открытых моделей.
- 【Бесплатно, ComfyUI】Легко ли создать полнометражное видео с локальным ИИ? Это невероятно сложно — 寺田部チャンネル — https://www.youtube.com/watch?v=I8_wKOLnSlI — практический отчёт о создании длинного видео с ComfyUI и локальным ИИ.
Сигналы
- В закрытом сегменте главный спор — цена и скорость против качества: несколько сравнений утверждают, что Nano Banana Pro побеждает в 63% тестов фотореализма, а Grok Imagine позиционируется как бесплатное видео уровня Sora/Veo.
- Midjourney продолжает улучшать линейку V8 в ежемесячном ритме: V8 была анонсирована в феврале 2026 года, Alpha вышла в марте, V8.1 — в апреле, V8.2 Preview — в июне, полноценная V8.2 — в июле.
- Анонс видеогенерации Gemini Omni на Google I/O 2026 стал отдельной крупной новостью, которую оперативно разобрали японские каналы.
- Открытый сегмент ведёт борьбу за лидерство между Qwen Image и FLUX: углублённые каналы продолжают проверять, какая модель лучше, в том числе с тестами SECourses и разбором архитектуры Urban Decoders.
- Flux 2 Klein отдельно привлекает внимание как лёгкая производная модель для локального запуска.
- Wan и Qwen Image от Alibaba рассматриваются как пара открытых решений для видео и изображений.
- Локальная видеогенерация по-прежнему сложна в эксплуатации: практический отзыв о длинном видео в ComfyUI прямо называет работу чрезвычайно трудной.
Ограничения
- Страницы поиска и просмотра YouTube рендерятся JavaScript, поэтому WebFetch получал лишь статический HTML с ссылками в футере, без списка видео, просмотров, дат, описаний и комментариев.
- Для проверки использовались веб-поиск
site:youtube.comи endpointoembed, но просмотры, подписчики, полный текст описаний и комментарии получить не удалось. - По японским запросам с ограничением августом или сентябрём 2026 года специализированные новости об ИИ-генерации почти не находились; попадали общие ежедневные ИИ-новости и нерелевантные материалы.
- Reddit, X, Bluesky, Lemmy и Pinterest на этой стадии не исследовались, как указано в brief.md.
Bluesky
Bluesky — новости ИИ для генерации изображений и видео
Аккаунты
| Хэндл | Тип | Подписчики и прочее | Примечание |
|---|---|---|---|
| @simonwillison.net | Частное лицо, известный технический блогер об ИИ и автор Datasette | — | Сравнивает генерацию изображений разных моделей собственным тестом с пеликаном на велосипеде. Самый содержательный источник в этой выборке. |
| @404media.co | Медиа | — | В основном публикует расследования о наблюдении, иногда — материалы об ИИ-медиа. |
| @aimod.social | Управление сообществом, лейблер подозрительных ИИ-изображений | 2 555 подписчиков, 94 поста | Официальный сервис Bluesky, автоматически маркирующий изображения, подозреваемые в генерации ИИ. |
| @stablediffusion.bsky.social | Частное лицо, обмен промптами SDXL/Stable Diffusion | — | Не публиковался с января 2025 года. |
| @bm63ai.bsky.social | Частное лицо, ИИ-арт с ComfyUI/Flux/Midjourney | — | ИИ-арт практически прекратился; последний пост в июне 2026 года был о созданном с Codex музыкальном приложении. |
| @petapixel.bsky.social | Медиа о фотографии | — | Критически освещал генеративные функции Adobe, но последние релевантные посты относятся к февралю 2025 года. |
Публикации
- Повторный бенчмарк с пеликаном на велосипеде в GPT-6 Astra (@simonwillison.net, 2026-09-04, 202 лайка, 9 репостов, 18 ответов, https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c). Опубликована сетка SVG-иллюстраций с пеликаном на велосипеде для GPT-6 Astra, GPT-5.6 Sol, Terra и Luna на трёх уровнях рассуждений. По alt-тексту Astra даёт наиболее выверенные и согласованные результаты.
- GPT-6 Astra управляет Blender и создаёт 3D-сцену с пеликаном (@simonwillison.net, 2026-09-05, 400 лайков, 30 репостов, https://bsky.app/profile/simonwillison.net/post/3murtmdynq22s). Через кодирующего агента Blender получил последовательные инструкции создать, украсить и улучшить сцену. Эта тема независимо появилась и на Reddit.
- Открытая Qwen 3.7 27B локально рисует пеликана (@simonwillison.net, 2026-08-14, 183 лайка, 14 репостов, https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z). Модель была запущена как 17GB GGUF в LM Studio на MacBook Pro M5 Max и, по оценке автора, нарисовала лучшего пеликана среди моделей, работающих на его ноутбуке.
- Кандидат в губернаторы Нью-Йорка использовал ИИ-фейк для атаки на оппонентов (@404media.co, 2026-09-02, 124 лайка, 22 репоста, 7 ответов, https://bsky.app/profile/404media.co/post/3muka24vu4v2q). Пример использования сгенерированного видео в политической дезинформации.
- Создатель Cocomelon велел художникам экспериментировать с ИИ (@404media.co, 2026-09-06, 84 лайка, 23 репоста, 21 ответ, https://bsky.app/profile/404media.co/post/3musx3wgdvc2n). Moonbug Entertainment заявила о намерении использовать ИИ при сохранении «человека в контуре».
- Лейблер подозрительных ИИ-изображений aimod.social превысил 2 500 подписчиков (проверка профиля, https://bsky.app/profile/aimod.social). У сервиса есть руководство по критериям и механизм апелляций; это не новостной источник, но показатель сформировавшегося спроса на маркировку.
- Старые аккаунты ИИ-арта в основном замолчали (@stablediffusion.bsky.social и @bm63ai.bsky.social). Первый остановился после поста о Статуе Свободы с электрогитарой в январе 2025 года; второй прекратил ИИ-арт после апреля 2025 года.
- Критика генеративных функций Adobe — справочный материал старого цикла (@petapixel.bsky.social, 2025-02-12 и 2025-01-09). Текст-в-видео Adobe называли неготовым к платной цене, а Generative Remove в Lightroom, по сообщению аккаунта, вместо удаления объекта сгенерировал логотип Bitcoin.
Сигналы
- Что растёт: визуальные задачи GPT-6 Astra — SVG с пеликаном и 3D-рендеринг в Blender — независимо обсуждаются на Reddit и Bluesky. Важно, что это новый жанр: LLM-агент создаёт визуал через код и 3D-инструменты, а не классическая диффузионная генерация.
- Что игнорируется или отвергается: открытых новостей крайне мало; конкретно найден только один пост о Qwen 3.7 27B. Публикаций о FLUX, новых Stable Diffusion, Wan или HunyuanVideo не обнаружено.
- Неожиданное наблюдение: активные в начале 2025 года аккаунты ИИ-арта замолчали, тогда как сервис маркировки подозрительных ИИ-изображений сохраняется и растёт. Центр тяжести разговора может смещаться от «создавать» к «распознавать и контролировать».
- Противоречивые сигналы: конкретные новости о видеогенерации заметнее как случаи злоупотребления в политической рекламе, чем как соревнование моделей. На Bluesky ИИ-видео более заметно как социальная проблема, чем как технологический тренд.
Ограничения
- Открытый API поиска Bluesky
app.bsky.feed.searchPostsдля всех английских и японских запросов — "image generation AI", "Stable Diffusion", "Midjourney", "Sora", "Veo", "Kling" и других — постоянно возвращал HTTP 403. При этомapp.bsky.actor.getProfileиapp.bsky.feed.getAuthorFeedработали. - Веб-интерфейс
bsky.app/searchявляется SPA, и текст постов не содержится в HTML, поэтому инструмент получения веб-страниц не мог читать результаты поиска. - Вместо поиска по ключевым словам пришлось изучать ленты известных аккаунтов. Это выборка аккаунтов, а не полноценная замена всестороннему поиску.
- Предполагаемые аккаунты OpenAI, Google DeepMind, Midjourney, Runway, Stability AI, Black Forest Labs, Krea, TechCrunch, The Verge, Ars Technica и Engadget либо не существовали, либо не содержали релевантных публикаций.
- Критерий примерно 20 проанализированных публикаций на платформу не достигнут: рассмотрено восемь основных записей и одна справочная. В найденных лентах остальных релевантных постов не было.
- Невозможно отличить отсутствие дискуссии об открытых моделях от пропуска из-за недоступности поиска.
Lemmy
Lemmy — новости ИИ для генерации изображений и видео
Lemmy — федеративная соцсеть, во много раз меньше Reddit, поэтому «вирусность» здесь измеряется десятками, а не сотнями голосов. Тем не менее удалось найти плотную информацию: главным образом в !«メールアドレス» с релизами ComfyUI и моделей, !ai_reddit с ботом-репостером новостей r/ArtificialIntelligence, а также в !technology и саркастичном !techtakes. Поиск выполнялся через lemmy.world/api/v3/search с различными ключевыми словами.
Сообщества
!«メールアドレス»— 5 709 подписчиков, из них 893 локальных. Центр новостей о пользовательских узлах ComfyUI и релизах моделей; публикации появляются почти ежедневно.!«メールアドレス»— 2 362 подписчика. Галерея работ, созданных Stable Diffusion, Flux и Krea2.!«メールアドレス»— специализированное сообщество ИИ-аниме; активность сопоставима с предыдущим.!«メールアドレス»— 87 904 подписчика. Репосты крупных технологических статей, включая историю Midjourney.!«メールアドレス»— 2 690 подписчиков. Саркастичное сообщество об ИИ-индустрии.!«メールアドレス»— RSS-репостер r/ArtificialIntelligence; это самый плотный новостной поток, хотя число подписчиков API не вернул.!«メールアドレス»— 8 154 подписчика. Анти-ИИ сообщество, куда попадали статьи о цепочках поставок генеративного ИИ.
Публикации
Ближе к закрытым решениям
- Midjourney якобы меняет курс на медицинский УЗИ-сканер Midjourney Medical — 2026-06-18–19,
!techtakesи!hackernews, оценки 40–58. Историю высмеивали как возможный «поворот к Theranos». https://lemmy.world/post/48384985 - Midjourney потребовала от голливудских студий раскрыть, как те используют ИИ — материал TechCrunch в
!technology, оценка 73. https://lemmy.world/post/49069400 - Google выпустила Nano Banana 2 Lite — облегчённую модель генерации изображений DeepMind. https://lemmy.world/post/48857780
- Microsoft MAI-Image-2.5 догнала Nano Banana 2 в бенчмарках — материал the-decoder.com в
!ai_reddit. https://the-decoder.com/microsofts-mai-image-2-5-pulls-even-with-googles-nano-banana-2-on-benchmarks/ - Подробное сравнительное обозрение ByteDance Seedream 5.0 Pro — отмечены сильные стороны в редактировании и итеративной генерации. https://www.reddit.com/gallery/1usc03q
- Функцию Google Earth AI отключили на следующий день после запуска — пользователи накладывали фальшивые изображения на реальные места. https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature-a-day-after-its-rollout-after-users-made-no-no-images/
- Корпоративный бизнес Runway удвоился при NRR выше 300% — новость о росте видеогенерации в B2B. https://www.reddit.com/r/ArtificialInteligence/comments/1w2hnea/runway_says_enterprise_business_doubled_nrr_over/
- Amnesty International назвала ключевые ИИ-системы незаконными уже по конструкции — контекст усиления регуляторного давления. https://reddit.com/r/ArtificialInteligence/comments/1ue64s2
- Pax Silica: превращение цепочек поставок ИИ в оружие — анализ экономической войны вокруг ИИ-чипов и вычислительных ресурсов. https://thecradle.co/articles/pax-silica-and-the-weaponization-of-ai-supply-chains-the-new-front-in-us-global-economic-warfare
- «Astra 6 max» попросили создать искусство, которое тронет автора — философская самореферентная генерация арта коммерческой закрытой моделью. https://i.redd.it/3h241pocalnh1.png
Ближе к открытому исходному коду
- Вышла LLaDA-Image — новая модель с 6B Diffusion Transformer и замороженным модулем визуально-языкового понимания на базе LLaDA2.0-Mini. В Qwen-Image-Bench она получила SOTA: 53,53 на английском и 53,38 на китайском. Одновременно открыты быстрый вариант LLaDA-Image-Turbo, веса, код обучения и рецепты. https://lemmy.dbzer0.com/post/74988021
- Вышла Boogu-Image-0.1 — открытое семейство Base/Turbo/Edit по Apache-2.0, с 10B параметров и лучшим среди открытых моделей результатом Qwen-Image-Bench — 53,58. https://boogu.org/
- ComfyUI-Ref2VA-VSA: узел ускорения вывода для MiniMax H3 — заметно ускоряет видеогенерацию. https://github.com/Kablex/ComfyUI-Ref2VA-VSA
- ComfyUI-AetherScale: нативный для NVIDIA GPU апскейлер видео. https://github.com/vizart-vj/ComfyUI-AetherScale
- ComfyUI-VDN-H3: гибридное внимание Video Delta Net для повышения эффективности видеомоделей. https://github.com/Saganaki22/ComfyUI-VDN-H3
- ComfyUI-Majoor-OmniCam: инструмент компоновки камеры и анимации для управления работой камеры при генерации видео и изображений. https://github.com/MajoorWaldi/ComfyUI-Majoor-OmniCam
- FastH3-Ref2V-Stream-Controller — инструмент потокового управления для видеогенерации MiniMax H3. https://github.com/EarthDefenceForces/FastH3-Ref2V-Stream-Controller
- ComfyUI-InpaintCanvas: интерфейс инпейнтинга в духе Krita. https://github.com/DenRakEiw/ComfyUI-InpaintCanvas
- ComfyUI-MiniMax-H3-MotionCache-FastVAE / ComfyUI-H3VAE_TRT / ComfyUI-MiniMaxH3-CLSS — три последовательных релиза узлов ускорения и облегчения MiniMax H3 1–2 сентября. https://github.com/Mozer/ComfyUI-MiniMax-H3-MotionCache-FastVAE
- InterleaveThinker: исследование обучения с подкреплением для агентной чередующейся генерации — добавляет существующим моделям изображений многоагентную способность последовательно генерировать текст и изображения. https://arxiv.org/abs/2606.13679
- Поток работ, созданных Flux/Krea2 turbo — в
!stable_diffusion_artи!share_anime_artежедневно публикуется несколько изображений, созданных Flux и Krea2. Это устойчивый сигнал повседневного использования открытых моделей. https://lemmy.dbzer0.com/post/75150630
Сигналы
- 🔥 Главная тема — предполагаемое метание Midjourney. История о медицинском УЗИ-сканере получила высокие оценки в
!techtakesи!technology, но в явно негативном и насмешливом тоне. - 🛠️ Для MiniMax H3 за одну неделю подряд вышли пять-шесть узлов ComfyUI. Это типичный признак того, что сообщество разработчиков массово переключилось на оптимизацию конкретной базовой видеомодели.
- 📊 Общим ориентиром стал Qwen-Image-Bench: LLaDA-Image с 53,53 и Boogu-Image-0.1 с 53,58 соревнуются по одной метрике, делая конкуренцию открытых моделей наглядной.
- 😤 Новости о геополитических рисках закрытых ИИ-компаний проникают даже в анти-ИИ сообщества, что показывает выход темы за пределы технической аудитории.
- 🤖 На Lemmy абсолютные цифры нельзя напрямую сравнивать с Reddit и X: оценка в 70 с небольшим уже является крупной новостью для этой платформы.
Ограничения
- Поиск в федеративном Lemmy зависит от инстанса. API
lemmy.worldвидел главным образом собственные и федеративные публикации;lemm.eeиlemmy.mlне были полноценно охвачены. - Поиски "Kling AI", "Stability AI", "Wan 2.2" и "Runway Gen" дали ноль или нерелевантные результаты. Обсуждение видеомоделей на Lemmy почти целиком проходило через MiniMax H3 и ComfyUI.
!ai_reddit— автоматический репостер r/ArtificialIntelligence, поэтому это не первичная информация Lemmy.- Хотя проанализировано около 20 постов, общий объём публикаций Lemmy на порядки ниже Reddit и X, и по плотности первичных источников он ограничен.
Pinterest — новости ИИ для генерации изображений и видео
Из 50 собранных пинов (output/pinterest.pins.md / images/pinterest/manifest.json), найденных единым запросом "Image and Video Generation AI News" без жанрового разделения, были визуально проверены 30. Ниже приведены выводы на основе их содержимого.
Визуальные темы
- Кликбейтные обложки «новостей об ИИ»: удивлённые бородатые мужчины, неоновые логотипы инструментов, взрывной фон, похожие на Sam Altman лица и роботизированные телеведущие. Большинство пинов ведёт не на статьи, а на видео YouTube.
- Инфографики с рейтингами закрытых продуктов: в неоновых рамках регулярно перечисляются Runway, Pika, Kling AI, Luma, Canva, Hailuo AI, HeyGen, Synthesia, InVideo, Sora и Google Veo; аналогично показываются ChatGPT, Nano Banana, Ideogram, GenTube и Z-Image.
- Персонификация ИИ как робота или ведущего новостей: роботы за новостным столом, синтетические женщины-ведущие и медицинские сцены с роботом и медсестрой заметнее собственно скриншотов инструментов. ИИ изображается как замена человеческим ролям — журналисту или врачу.
- Образы, разжигающие тревогу о дипфейках и подлинности: кот со штампом «FAKE», викторины «Which is AI?» и изображения ИИ-детекторов с оценкой «97% likely AI generated».
- Безличные стоковые ИИ-визуалы: фиолетово-синие неоновые фоны, силуэты мозга, печатные платы и частицы с одним заголовком, без конкретных продуктов.
- Демонстрации image-to-video до и после: сетки преобразования фотографий и видео в стили LEGO, оригами, цветочных фигур и игрушечных автомобилей, а также схемы создания видеотаймлайна из одной фотографии.
- Конкретные продукты почти всегда закрыты: Veo 2/3, VASA-1, Grok, Sora, ChatGPT и Nano Banana встречаются часто, но среди 30 проверенных пинов не было ни одного подтверждённо открытого названия модели или репозитория.
- Инфографики об автоматизированном ИИ-пайплайне: одна схема предлагает превращать вирусную ссылку в влог цепочкой из четырёх агентов: Scout → Script → Generate → Animate.
Примечательные пины
- [1] Image to Video AI: How It Works and Why It Matters — наиболее конкретная техническая схема: от одной статичной картинки через ползунки силы движения, временной согласованности и визуального контроля к видеотаймлайну.
- [7] (без названия, сетка преобразований LEGO/origami/flowers) — сетка 3×5, демонстрирующая преобразование видео с людьми, игрушечной пандой и Tesla в деревянные блоки, оригами, LEGO и цветы.
- [9] 10 FREE AI VIDEO TOOLS IN 2026 — список десяти бесплатных ИИ-видеоинструментов: Pictory, Runway ML, Veed.io, Synthesia, InVideo, Kling AI, D-ID, Lumen5, Canva и Hyperwrite.
- [24] (без названия, image-to-video с фиолетовым персонажем-монстром) — демонстрация одной входной картинки в трёх видео с совершенно разными окружениями: серверная, подводные руины и город из конфет; заголовок связан с Veo 3.
- [27] 5+ Best AI Video Generation Websites — сравнение Runway, Pika, Kling AI, Luma, Canva и Hailuo с ориентацией на YouTube Shorts, TikTok, видеопины Pinterest и видео о товарах.
- [36] Top AI Image Generation Tools — подборка ChatGPT, Nano Banana, GenTube, Ideogram и Z-Image, демонстрирующая проникновение новых названий в Pinterest SEO-материалы.
- [39] The Latest AI Developments — единственный по-настоящему новостной пин с тремя конкретными историями: ИИ отвечает на звонки 911 в Новом Орлеане, Meta бесплатно выпускает офлайн-агентную модель Muse Glimmer, а северокорейская Kimsuky автоматизирует фишинговые документы собственным ИИ-стеком.
- [41] Microsoft Unveils VASA-1 — схема технологии Microsoft Research: из одного изображения и аудиоклипа, с необязательным управлением выражением лица, создаётся реалистичная анимация разговора нескольких лиц в реальном времени.
- [16] AI Image Video: Best Quality vs Best Free — руководство по выбору между платными высококачественными и бесплатными инструментами: ChatGPT Plus, Gemini Advanced, Midjourney, Adobe Firefly, Recraft, Runway Gen-3, Luma, Pika Pro, Kaiber, Synthesia, Ideogram, SeaArt, Playground, Krea, Canva, Inkscape и CapCut.
- [47] AI video creation just got crazy — предложение автоматического пайплайна из четырёх агентов для создания готового влога по вирусной ссылке.
Сигналы
- В Pinterest область «Image and Video Generation AI» в основном состоит не из срочных новостей, а из SEO- и партнёрских инфографик со сравнениями и инструкциями. Прямые ссылки на первичные источники — официальные анонсы, статьи или исследования — почти отсутствуют; большинство пинов ведёт в блоги или на YouTube.
- Среди конкретных новостных событий выделяются только три сюжета пина [39], а также пины о Veo 2/3, VASA-1 и Grok. Первичной информации, которую можно было бы назвать актуальными новостями в масштабе 20 публикаций, очень мало.
- Закрытые решения представлены подавляюще сильнее: повторяются Runway, Pika, Kling AI, Luma, Canva, Hailuo, HeyGen, Synthesia, Sora, Veo, ChatGPT, Nano Banana и Ideogram. Открытые модели и проекты отсутствуют: нет ни Stable Diffusion, ни ComfyUI, ни Open-Sora. Pinterest — слабый источник для описания открытого сегмента.
- Образы «ИИ заменяет человеческую роль» — ведущего новостей, медсестру, оператора 911 — соседствуют с образами сомнения в подлинности — штампами FAKE, викторинами и детекторами. Социальное воздействие и тревога о доверии здесь значимее самой технологии.
- Среди применений видеогенерации особенно заметны превращение фото в анимацию и стилизация существующего видео. В отличие от text-to-video с нуля, главным коммерческим аргументом выступает преобразование входного изображения или видео.
Ограничения
- 50 пинов были собраны единственным запросом без жанрового разделения; поле
genreу всех записей пустое. Целенаправленного поиска по оси закрытый/открытый исходный код не было. - Фактически открыты и проверены только 30 из 50 изображений; непроверенные записи во многом имеют заголовки, пересекающиеся с уже найденными темами — сравнения липсинк-инструментов, видеоредакторов и детекции ИИ.
- Pinterest напрямую не просматривался: выводы основаны только на заранее собранных изображениях и заголовках. В manifest и таблице пинов нет дат и вовлечённости, поэтому нельзя оценить ни свежесть, ни масштаб распространения.
- Значимых упоминаний открытого исходного кода не найдено, поэтому Pinterest нельзя использовать как основу для выводов об этом сегменте.
Рекомендуемые действия
- Продолжать отслеживать агентную визуальную генерацию GPT-6 Astra — управление Blender и создание 3D-городов — как отдельную тему в следующих выпусках.
- Чтобы не пропускать открытые релизы, добавить на всех платформах поисковые запросы с конкретными названиями: "FLUX", "Stable Diffusion", "Qwen-Image", "Wan" и "ComfyUI".
- В исследовании Bluesky заранее расширить список отслеживаемых аккаунтов, исходя из того, что 403 поискового API будет сохраняться.
- Поскольку Pinterest не даёт даты публикации и вовлечённость, использовать его не для срочных сравнений, а только для регулярного наблюдения за узнаваемостью инструментов.
- Не приводить категоричных утверждений о предполагаемом повороте Midjourney к медицинскому оборудованию до появления первичного источника — официального объявления Midjourney.
- В первую очередь проверять
!stable_diffusionна Lemmy и YouTube-каналы с тестами как основные источники по движению открытого исходного кода.
Собранные изображения


















































Примечание о качестве данных
Bluesky постоянно возвращал 403 поискового API и не позволил достичь критерия в 20 публикаций; Pinterest не предоставил даты или показатели вовлечённости, поэтому нельзя оценить свежесть. Reddit и X использовали один поисковый запрос и не сопоставляли закрытые и открытые решения намеренно, вследствие чего обсуждение открытого исходного кода оказалось сосредоточено на Lemmy и YouTube.



