Новости ИИ для генерации изображений и видео — 2026-09-17
В закрытом сегменте главными темами стали фактический уход Sora 2 и противостояние GPT Image 2.5 с Nano Banana Pro; в открытом сегменте лидируют китайские модели Wan, MiniMax H3, HunyuanVideo и Z-Image Turbo. Ключевой неопределённостью остаётся возможный переход Wan 3.0 в закрытую модель.
Новости ИИ для генерации изображений и видео — 2026-09-17
Ну что ж, в мире ИИ-генерации изображений и видео на этот раз всё движется просто безумно быстро 🔥 В закрытом сегменте Sora 2 фактически уходит со сцены, уступая Veo 3.1, Kling 2.5 Turbo и Seedance; одновременно OpenAI GPT Image 2.5 и Google Nano Banana Pro ведут настоящее лобовое сражение 👊 В открытом сегменте китайские игроки — Wan, MiniMax H3, HunyuanVideo и Z-Image Turbo — полностью захватили инициативу, а сообщество ComfyUI живёт в праздничном режиме: каждый день появляются новые ноды и LoRA 🎉 Но у моделей Google — Nano Banana Pro и Flow — немало проблем: фильтры безопасности отклоняют даже собственные результаты генерации, а функцию Google Earth пришлось отозвать после массового создания фальшивых изображений катастроф. С надёжностью дела обстоят тревожно 😬
Across platforms
- Уход Sora 2 и смена лидеров в пользу Google/ByteDance/Kling: на YouTube сообщают, что окончательное отключение API Sora 2 запланировано на 24.09.2026. И Reddit, и YouTube независимо высоко оценивают Seedance — от 2.0 до 2.5 — за реалистичность людей. Когда один и тот же вывод естественно появляется на разных платформах, это сильный сигнал 💪
- Спор GPT Image 2.5 vs Nano Banana Pro: YouTube — несколько обзоров сразу после анонса, Bluesky — срочный пост @testingcatalog.com от 09.09.2026, Lemmy — сравнение раскраски «Берсерка», в котором ChatGPT Images 2.5 лучше сохраняет контуры, а Nano Banana Pro теряет баллы из-за игнорирования инструкции. Эти две модели независимо сравнивают уже на трёх платформах.
- Множество проблем вокруг Nano Banana Pro/Google Flow: на Reddit обсуждают «сошедший с ума фильтр», когда собственный Flow отклоняет изображение, сделанное собственным Nano Banana Pro. На Lemmy описан инцидент: функцию Nano Banana 2 в Google Earth отозвали на следующий день после запуска, потому что ею массово создавали фальшивые изображения катастроф и военных объектов. Платформы разные, но картина одна: генеративный ИИ Google силён, однако контроль за ним не поспевает.
- Открытый сегмент — поле битвы китайских моделей и MiniMax H3: на Reddit Wan, MiniMax H3 и LTX Video постоянно называют главными бесплатными вариантами; на YouTube Wan, Z-Image Turbo и HunyuanVideo/Image почти все китайского происхождения; на Lemmy за последние дни лавинообразно появились инструменты ComfyUI для MiniMax H3; в Bluesky Lightricks LTX-2.5 три дня подряд находится в трендах Hugging Face. Все четыре платформы смотрят в одном направлении.
Platform by platform
Reddit: собрано 11 тредов — до цели в 20 не хватило. В закрытом сегменте главные темы — противоречие между щедрыми бесплатными лимитами Google Flow и чрезмерными фильтрами безопасности, а также оценка реализма людей у Seedance. В открытом сегменте Wan, MiniMax H3 и LTX Video постоянно называют стандартными решениями для локальной генерации. Удалось уловить и живую атмосферу: споры о значении термина «AI slop» и насмешки над инструментами для полностью автоматической генерации видео на YouTube 🗿
X: на этот раз полный промах 😅 Метод сбора был основан на трендах, а сессия геолокировалась в Хорватии. Поэтому среди 40 собранных постов оказались южноафриканская политика, Сербия/Косово, Израиль/ХАМАС, управление Zcash и спам с розыгрышами. Ни одного поста об ИИ для генерации изображений или видео. Это единственная из названных в брифе платформ, которую можно назвать явным пробелом — сбор нужно повторить.
YouTube: по заголовкам и сниппетам определены 13 видео. В закрытом сегменте особенно заметны GPT Image 2.5 — релиз 08.09.2026, варианты Flare и Sunburst — и завершение Sora 2. Важен и выход Meta на рынок с Muse Image/Video от Meta Superintelligence Labs: это агентная генерация, использующая поиск и выполнение кода. В открытом сегменте в центре Alibaba — Wan и Z-Image Turbo, Tencent — HunyuanVideo 1.5 и HunyuanImage 3.0, а также Black Forest Labs с Flux.2. Однако из-за JavaScript-рендеринга почти не удалось проверить просмотры и названия каналов, поэтому подтверждение авторитетности источников ограничено.
Bluesky: официальные бренд-аккаунты Midjourney, Stability AI, ComfyUI, Runway, Kling и Black Forest Labs почти все замолчали во второй половине 2025 года. Основной источник — личный новостной аккаунт @testingcatalog.com с 860 подписчиками. Были обнаружены ChatGPT Images 2.5, Meta Muse Video, «Orbis» стартапа Visko с генерацией видео в реальном времени и расширение ElevenLabs на изображения и видео. По открытому сегменту удалось лишь подтвердить устойчивое внимание к LTX-2.5 через бот трендов Hugging Face. Поисковый API возвращал 403, поэтому исследование пришлось строить цепочкой от аккаунта к аккаунту.
Lemmy: найдено чуть больше 10 релевантных постов — до цели в 20 не дотянули, искусственно количество не раздували. Закрытые модели здесь часто обсуждают через аварии, скандалы и насмешки: отзыв Google Earth AI, ироничное сравнение входа Midjourney в медицинское оборудование с Theranos. В открытом сегменте !«メールアドレス» стал фактическим центром: вокруг MiniMax H3 за несколько дней быстро сформировались ноды ComfyUI, LoRA и реализации с пониженным потреблением памяти — типичное движение OSS.
Pinterest: визуально проверены 30 из 50 пинов. Материалов об открытом исходном коде почти нет: ни один пин прямо не упоминает Stable Diffusion, Flux, Wan или ComfyUI. Вместо этого встречаются закрытые потребительские бренды ChatGPT, Gemini, Claude, Adobe Firefly, Midjourney и Canva. Реальную новостную ценность имеют главным образом спор об «ИИ-актрисе» Tilly Norwood, Vidu S1 от ShengShu Technology — интерактивная видеомодель в реальном времени, — и техническая иллюстрация Microsoft VASA-1. В целом лента заполнена стоковыми изображениями роботов и тревогами о дипфейках: это скорее визуальная культура смутного беспокойства об ИИ, чем новости.
What to watch
- Признаки закрытия Wan 3.0 (YouTube, упоминания через официальный блог Alibaba): Wan 2.2 была полностью открыта по Apache-2.0, но у анонсированной 24.08.2026 Wan 3.0, по имеющейся информации, доступен только API, а веса не опубликованы. Это может стать крупным событием: флагман открытой генерации видео может исчезнуть.
- Экосистема ComfyUI вокруг MiniMax H3 (Lemmy: https://lemmy.dbzer0.com/post/75586072 и другие): за последние дни инструменты появляются лавинообразно; это сейчас самая горячая открытая модель для видео и изображений.
- GPT Image 2.5 vs Nano Banana Pro (YouTube: https://www.youtube.com/watch?v=DY6TkI8XtkQ, Bluesky: https://bsky.app/profile/testingcatalog.com/post/3mv3hn2whdz27): передовая закрытой генерации изображений; стоит ждать следующего хода.
- Выход Meta с Muse Image/Video (YouTube: https://www.youtube.com/watch?v=rAvnO1DWnMs, Bluesky: https://bsky.app/profile/testingcatalog.com/post/3mthtr6iu7p24): новый агентный подход, использующий поиск и выполнение кода; следует следить за сроками официального запуска.
- Проблемы с фильтрами безопасности и ошибочными генерациями моделей Google (Reddit: https://www.reddit.com/r/generativeAI/comments/1wh1y9d/, Lemmy: https://lemmy.durstig.online/post/52162): вероятно, будут регулярно всплывать как новости о надёжности и регулировании.
Recommendations
- Повторно собрать данные по X, используя не тренды, а запросы, напрямую связанные с темой: «Sora 2», «Nano Banana Pro», «Wan», «Flux» и другие.
- Подтвердить подозрения о закрытии Wan 3.0 первичным источником — официальным объявлением Alibaba — и отслеживать последствия для расстановки сил в открытой генерации видео.
- Для самых свежих событий вокруг MiniMax H3 регулярно отслеживать !«メールアドレス».
- Сравнение GPT Image 2.5 и Nano Banana Pro согласованно проявляется на нескольких платформах; в следующий раз стоит добавить третьих игроков, например Seedream 5.0 Pro.
- Избыточные реакции фильтров и ошибочные генерации у моделей Google повторяются, поэтому их стоит постоянно отслеживать как тему надёжности.
Data quality
Метод сбора по X — геолокированные тренды — полностью разошёлся с темой: среди 40 постов нет ни одного релевантного, поэтому платформа фактически не сработала. Reddit — 11 материалов — и Lemmy — чуть больше 10 — не достигли указанного в брифе критерия «около 20». На YouTube невозможно было проверить просмотры и названия каналов из-за JavaScript-рендеринга, что ослабляет проверку авторитетности. В Bluesky официальный поисковый API возвращал 403, поэтому использовался обходной метод через ленты известных аккаунтов, ограничивший полноту охвата. На Pinterest были доступны только изображения и заголовки: целевые статьи и число сохранений проверить не удалось.
Платформы: подробная сводка
Reddit — Новости ИИ для генерации изображений и видео
Где
Собранные 11 тредов относятся к семи сабреддитам. Все они были найдены по запросу «Image and Video Generation AI News».
| Сабреддит | Число участников | Число собранных тредов |
|---|---|---|
| r/generativeAI | 154,126 | 5 |
| r/aitubers | 28,633 | 1 |
| r/AIDangers | 53,410 | 1 |
| r/aifilmmaking | 7,951 | 1 |
| r/aivideomaking | 7,085 | 1 |
| r/AIToolTalks | 6,307 | 1 |
| r/NoStupidQuestions | 7,494,416 | 1 |
Специализированные сабы об ИИ-генерации изображений и видео — r/generativeAI, r/aifilmmaking, r/aivideomaking и r/aitubers — составляют 8 из 11 материалов. Оставшиеся три — r/AIDangers, r/AIToolTalks и r/NoStupidQuestions — обсуждают ИИ в целом, а не только генерацию изображений и видео.
Что говорят люди
- Закрытые решения Google Flow/Veo щедро раздают бесплатные лимиты, но одновременно усиливают ограничения. В треде 4 «Google Flow is giving creators a surprisingly generous amount of free AI video generation right now» (r/aifilmmaking · 8 баллов · 2026-09-14) https://www.reddit.com/r/aifilmmaking/comments/1wg7izt/ бесплатные кредиты для Veo описываются как основа полноценного рабочего пространства с построением сцен, управлением камерой и референсными изображениями, а не простого text-to-video. В комментариях u/MechanicForward2274 (1 балл): «50 кредитов в день действительно хватает на множество экспериментов, если не тратить их впустую».
- В треде 7 (r/generativeAI · 2 балла · 2026-09-15) https://www.reddit.com/r/generativeAI/comments/1wh1y9d/ пользователи жалуются, что фильтр безопасности Google Flow отклоняет даже изображения, созданные собственной моделью Nano Banana Pro. Автор повторил попытку 60 раз с одним и тем же изображением — безуспешно. Это трение подталкивает владельцев RTX 5090 к локальной генерации.
- Локальные модели видео с открытыми весами постоянно называют главными бесплатными вариантами: Wan, MiniMax H3 и LTX Video. В треде 1 (r/generativeAI · 8 баллов · 2026-09-16) https://www.reddit.com/r/generativeAI/comments/1whtesl/ u/tuckken2 (2 балла) пишет: «Wan 2.2 и MiniMax H3 бесплатны в cnaps studio, кредиты обновляются каждые 5 часов». В треде 7 u/f5alcon (3 балла) прямо называет MiniMax H3 лучшим локальным генератором, а u/Liberation2020 (1 балл) перечисляет Wan, MiniMax H3 и LTX Video.
- Seedance — закрытая модель ByteDance — получает всё более высокую оценку за реализм людей. Автор треда 7 пишет, что «Seedance 2.0 — лучший видеогенератор по реалистичности людей». В треде 8 «HOW IS THIS MADE?!» (r/generativeAI · 0 баллов · 2026-09-10) https://www.reddit.com/r/generativeAI/comments/1wced4g/ u/lagbit_original (3 балла) объясняет, что качества вирусного ролика можно добиться с Seedance 2.5, одним промптом, правильными референсами и добавлением музыки и склеек в редакторе. В треде 11 u/pb404 (2 балла) также хвалит стабильность reference model Seedance 2.5.
- Спрос на «инструмент, который сам сделает видео для YouTube от начала до конца», становится объектом насмешек. В треде 5 (r/aitubers · 0 баллов · 35 комментариев · 2026-09-14) https://www.reddit.com/r/aitubers/comments/1wg3duk/ автор просит полностью автоматическую генерацию по сценарию за менее чем 50 евро в месяц. U/RangeWilson (7 баллов) язвит: «Я ищу единорога, который скатится по радуге и каждый день даст мне горшок золота. Но я не хочу платить больше €50 в месяц». U/RobJames007 (12 баллов, лучший результат в треде) добавляет: «YouTube пытается сократить AI slop, а не допустить ещё больше такого контента на платформу».
- Мнения расходятся о значении ярлыка «AI slop» — подробнее в Signals. Тред 11 «Is there a way to make AI video that does not look like AI slop?» (r/generativeAI · 0 баллов · 30 комментариев · 2026-09-14) https://www.reddit.com/r/generativeAI/comments/1wgjjzu/ посвящён именно этому. По собственному эксперименту автора, замена формата на одного и того же персонажа с голосом и продолжающимися шутками увеличила время просмотра в девять раз — без технических изменений — и ролики перестали называть slop.
- Сильна тяга к бесплатным и недорогим решениям. В треде 2 «Please help me generate free ai video without subscription» (r/aivideomaking · 0 баллов · 14 комментариев · 2026-09-15) https://www.reddit.com/r/aivideomaking/comments/1wh80z3/ u/Fluffybabyyoda (1 балл) пишет: «Google Flow даёт 50 кредитов в день, иногда дважды в день. По-моему, Google Gemini даёт 3 видео в день». U/Bastisheen92 (2 балла) напоминает базовый принцип: локальная генерация бесплатна, если у вас уже есть оборудование.
- Заметная часть пользователей ищет бесплатные инструменты для NSFW или пограничного контента. В треде 3 «Any free video platform?» (r/generativeAI · 2 балла · 5 комментариев · 2026-09-16) https://www.reddit.com/r/generativeAI/comments/1whvzu3/ автор пишет: «Я смог найти способы бесплатно пользоваться Grok и spicy minimax». В этом же треде u/Critical_Emu_6565 (2 балла) рекламирует собственный инструмент RexCut AI; важно учитывать присутствие саморекламных комментариев.
- Хотя это не относится исключительно к генерации изображений и видео, на фоне заметны тревога и недоверие к ИИ в целом. В треде 9 «Are all of you also anxious about recent news about AI?» (r/AIToolTalks · 12 баллов · 35 комментариев · 2026-09-13) https://www.reddit.com/r/AIToolTalks/comments/1wfhbnv/ обсуждают расход воды, потерю рабочих мест и историю об актёре Эндрю Гарфилде, который после роли Сэма Альтмана в «Artificial» якобы перестал пользоваться ИИ. U/Big-Pops78 (3 балла) возражает, что потребление воды не особенно велико по сравнению с другими технологиями.
- Заметен и скепсис к экономической эффективности внедрения ИИ. Тред 6 «Biggest AI news of 2026: AI is not a necessary tool...» (r/AIDangers · 26 баллов · 31 комментарий · 2026-09-14) https://www.reddit.com/r/AIDangers/comments/1wg5y17/ утверждает, что во многих компаниях внедрение ИИ ухудшило показатели. U/presentofai (1 балл) возражает: «Большинство цифр “ИИ сделал хуже” измеряют неуклюжие внедрения, а не сами модели».
Сигналы
- Рост: локальные видеомодели с открытыми весами — Wan, MiniMax H3 и LTX Video — получают явную поддержку как альтернатива бесплатным лимитам закрытых сервисов. Конкретно обсуждается, как владельцы мощных GPU вроде RTX 5090 переходят на локальные решения из-за жёстких ограничений облака — тред 7.
- Рост: Seedance 2.0/2.5 укрепляет репутацию по реалистичности людей и стабильности; модель независимо упоминается в нескольких тредах и комментариях.
- Игнорируется / отвергается: ожидание полностью автоматических инструментов, создающих готовое видео только из сценария, сообщество резко высмеивает — тред 5, где самый высоко оценённый комментарий является сарказмом. Сам термин «AI slop» некоторые также отвергают как оскорбление, утратившее смысл.
- Разногласие: в треде 11 мнения о том, что такое AI slop, разделились пополам. U/Tenth_10 (9 баллов, лучший результат треда) и u/pb404 (2 балла) считают, что критику вызывают отсутствие драматических ставок в истории, а не технические недостатки. Напротив, u/RioNReedus (3 балла) считает это бессмысленным словом, которым противники ИИ называют всё подряд. Один и тот же пост приводит к прямо противоположным выводам.
- Неожиданность: «чрезмерная реакция фильтра», при которой Google отклоняет в Flow даже изображение, созданное Nano Banana Pro, — тред 7. Щедрые бесплатные лимиты — тред 4, 50 кредитов в день — и строгая цензура результатов идут одновременно, создавая противоречивый пользовательский опыт.
- Неожиданность: почти половина тредов, найденных по запросу «Image and Video Generation AI News», — три материала из r/AIDangers, r/AIToolTalks и r/NoStupidQuestions — посвящены не генерации изображений и видео, а тревогам и скепсису к ИИ в целом. Это показывает, что тема существует в более широком контексте вопроса «можно ли доверять ИИ».
Ограничения
- Собрано лишь 11 тредов, а не примерно 20, требуемых brief.md. Использован только один поисковый запрос — «Image and Video Generation AI News», фактически совпадающий с названием исследования и не являющийся естественным запросом. Повторный поиск по другим формулировкам, например «Sora 2», «Midjourney update» или «open source video model release», не проводился.
- Закрытый сегмент смещён в сторону Google Flow/Veo и Seedance. Не собраны отдельные треды о Sora, Midjourney, Runway, Kling, Grok Imagine и других крупных закрытых сервисах; они встречаются лишь в комментариях.
- Открытый сегмент также ограничен повторными упоминаниями Wan, MiniMax H3 и LTX Video; специализированных тредов о последних изменениях Flux, Stable Diffusion или экосистемы ComfyUI не найдено.
- Три треда из r/AIDangers, r/AIToolTalks и r/NoStupidQuestions не посвящены собственно генерации изображений и видео, а обсуждают ИИ в целом; связь с темой косвенная.
- Доступ к Reddit был ограничен данными, заранее собранными воркером. Дополнительный поиск и просмотр страниц не выполнялись согласно инструкциям плейбука.
X
X — Новости ИИ для генерации изображений и видео
Аккаунты
Ни один аккаунт из собранного набора не говорит о генерации изображений или видео с помощью ИИ — ни о закрытых, ни об открытых моделях. 38 аккаунтов в output/x.posts.json представляют собой смесь:
- Политических и комментаторских аккаунтов, спорящих о ЮАР, Сербии/Косово, Brexit, футбольном праве на участие и Израиле/ХАМАС — например, @TheSirRobotto, 2 поста с суммарно 12,537 лайками о правилах футбола Сербии и ЕС, и @marklevinshow, 1 пост с 3,250 лайками об Эрдогане и ХАМАС.
- Развлекательных и фанатских аккаунтов — @eva_kirby21, @PossiblyApollo о церемонии Apple TV Emmys; @justluvbourzgui, @theholydemi, @acervylaur о фандоме Lauren Jauregui/DWTS.
- Криптоаккаунтов о голосовании по управлению Zcash (ZEC) — @CoinMarketCap, @zooko, сооснователь Zcash, и @Hasan_NFTOX, проводящий бесплатный NFT-минт.
- Низкоактивных спам-аккаунтов с розыгрышами, повторяющих почти одинаковый текст «Pour PalZ Neon Crochet Bears Giveaway» — @corrysue1, @PHIFFERJ, @lilredshoper; у всех 0 лайков, а текст почти идентичен благодаря @gaynycdad.
Ни один из этих аккаунтов не является аккаунтом об ИИ, Midjourney/Sora/Runway/Stable Diffusion и т. п., исследователем или новостным изданием. Это не ответ на вопрос «кто формирует разговор об ИИ-генерации изображений и видео на X», а список тех, кто формирует тренды Хорватии в этот день.
Посты
Релевантных выводов нет: ни один из 40 собранных постов не упоминает генерацию изображений, генерацию видео или ИИ-модели любого типа. Искусственно придавать им отношение к брифу не стали.
Сигналы
Из этого набора нельзя извлечь сигнал по теме исследования. Единственная наблюдаемая закономерность самих данных: в них преобладают региональная политика — ЮАР, Сербия/Косово, Израиль–ХАМАС, — одно криптовалютное голосование по управлению Zcash, где время блока сокращают с 75 до 25 секунд, output/x.posts.md №19, и фанатский/спамовый шум. Ничего из этого не связано с ИИ.
Ограничения
Сбор на этом этапе не был нацелен на тему исследования. Согласно output/x.posts.md и .json, метод воркера был указан как "source": "trending": он прочитал список трендов X Explore, который геолокируется по месту сервера сессии и вернул «Trending in Croatia», а затем дословно искал названия трендов: «Africa», «Serbia», «Apple», «Canada», «Zcash», «#sweepstakes», «#giveaways», «#chance», «Lauren», «Hamas». Ни один из этих терминов не связан с ИИ для генерации изображений или видео, поэтому среди 40 постов от 38 аккаунтов нет релевантного материала.
Я не проводил самостоятельный поиск по X: согласно плейбуку, в этой сессии нет живого доступа к X, можно только читать уже собранные данные. Поэтому критерий завершения — около 20 проанализированных постов на платформу — невозможно выполнить для X в этом запуске. В собранном файле нет ни одного тематического поста, и я не могу заново выполнить сбор с подходящими запросами, такими как «Sora 2», «Midjourney», «Stable Diffusion», «Runway», «Nano Banana», «Flux», «Veo 3», «closed-source image AI» или «open-source video model».
Этот этап следует пометить как неудавшийся / требующий повторного сбора по тематическим запросам, а не по трендам.
YouTube
YouTube — Новости ИИ для генерации изображений и видео: закрытый и открытый сегменты
Каналы
Страница результатов поиска YouTube рендерится через JavaScript, поэтому во многих случаях удалось получить только нижний колонтитул, а названия каналов и число подписчиков в основной части страницы отсутствовали. Ниже приведены каналы и авторы, которых удалось установить по заголовкам и сниппетам:
- Официальный канал OpenAI —
Introducing GPT-Image-2.5 in the API, официальное объясняющее видео. - Новостные и обзорные каналы об ИИ, точные названия которых установить не удалось: они регулярно публикуют видео о GPT Image 2.5, Nano Banana Pro, завершении Sora 2, а также учебные материалы ComfyUI для Wan/HunyuanVideo/Z-Image/Flux. По характеру заголовков поиск подтверждает, что похожие темы часто освещают специализированные каналы вроде MattVidPro AI, TheAIGRID, Theoretically Media и Matt Wolfe — около 965 тыс. подписчиков, новости ИИ, — однако соответствие конкретных видео и каналов проверить не удалось.
Видео
Закрытые модели
- GPT Image 2.5 Is AMAZING: Full Breakdown of OpenAI's New Image Model — начало сентября 2026 года, указано «1 неделю назад» — https://www.youtube.com/watch?v=DY6TkI8XtkQ — полный обзор новой модели изображений OpenAI GPT Image 2.5, выпущенной 08.09.2026; варианты Flare и Sunburst.
- Introducing GPT-Image-2.5 in the API — сентябрь 2026 года — https://www.youtube.com/watch?v=A7MSwdXj86k — официальное видео с позиции OpenAI. Подчёркивает, что Sunburst даёт более резкое и естественное освещение, а также улучшенную точность API-редактирования.
- OpenAI's New Image Model Is Brilliant… Until You Look Closer — середина сентября 2026 года, указано «5 дней назад» — https://www.youtube.com/watch?v=pEYqorQrc4U — критический обзор GPT Image 2.5 в сравнении с ведущими моделями изображений, отмечающий недостатки, например ошибки в деталях.
- [NEW] Meta Muse.Ai Image Generation First Reaction — около июля 2026 года — https://www.youtube.com/watch?v=rAvnO1DWnMs — первые впечатления от Muse Image, новой модели изображений Meta Superintelligence Labs, основанной на Muse Spark и использующей поиск и выполнение кода в агентной генерации.
- Grok Imagine Video 1.5 vs Seedance 2.0 | Full AI Video Test — 08.06.2026 — https://www.youtube.com/watch?v=5mFkZiRTVu4 — практическое сравнение Grok Imagine Video 1.5 от xAI и Seedance 2.0 от ByteDance.
- Grok's New FREE AI Video Generator Is INSANE — 06.07.2026 — https://www.youtube.com/watch?v=lrCjbL51dbk — рассказ о возможности бесплатно опробовать Grok Imagine Video 1.5.
- BREAKING: Sora 2 is SHUTTING DOWN… So I Tested the Best Alternatives — 27.03.2026 — https://www.youtube.com/watch?v=Zf9979o8RGk — после объявления OpenAI от 24.03.2026 о прекращении приложения/API Sora 2 автор тестирует альтернативы Veo 3.1, Kling, Hailuo и другие; это поворотный момент для закрытого видеосегмента.
Открытые модели
- Z Image Turbo (FREE): This Open-Source AI Changed Image Generation Forever! — 27.11.2025 — https://www.youtube.com/watch?v=sPQQPpQ9X4E — Z-Image Turbo, модель Alibaba/Tongyi-MAI на 6 млрд параметров с лицензией Apache-2.0. Заявляется качество и скорость на уровне Nano Banana Pro.
- New Open-Source Model DESTROYS Flux 2 — Z-Image + Promptus Tutorial — ноябрь–декабрь 2025 года — https://www.youtube.com/watch?v=JF4Q5hXh-_Q — учебное видео ComfyUI, в котором Z-Image Turbo оценивают выше Flux.2.
- Flux.2 Has Landed! Is It the Open Source King? — ноябрь 2025 года — https://www.youtube.com/watch?v=D0_QGrdtvEg — обзор Flux.2 от Black Forest Labs: Pro/Flex/Dev/Apache-2.0 Klein. При этом в последующих критических статьях его открытость называют лишь видимостью.
- We have a new #1 open-source AI video generator! — Tencent HunyuanVideo 1.5, 25.11.2025 — https://www.youtube.com/watch?v=6EQP8-D37bs — обзор и инструкция по установке открытой видеомодели Tencent на 8,3 млрд параметров.
- HunyuanImage 3.0: Open Source Text To Image Model (Forget Nano Banana & Seedream 4) — сентябрь 2025 года — https://www.youtube.com/watch?v=32lhiZKhgOY — открытая MoE-модель Tencent для генерации изображений с более чем 80 млрд параметров, представленная как крупнейшая открытая модель изображений.
- WAN 2.2 Animate in ComfyUI (Step-by-Step Guide) — 26.09.2025 — https://www.youtube.com/watch?v=dyqz3PJ0wvo — пошаговый материал об открытой функции Alibaba Wan 2.2, превращающей одно референсное изображение в видео.
Сигналы
- Генерация видео OpenAI фактически отходит от Sora. Приложение/API Sora 2 прекращают работу в марте–апреле 2026 года, а окончательное отключение API ожидается 24.09.2026. Ряд видео описывает Veo 3.1 от Google, Kling 2.5 Turbo и Seedance 2.0 от ByteDance как новых главных игроков закрытого видеорынка: https://www.youtube.com/watch?v=Zf9979o8RGk.
- Передовой край закрытой генерации изображений — GPT Image 2.5 против Nano Banana Pro, также известной как Gemini 3 Pro Image. После выпуска GPT Image 2.5 08.09.2026 резко выросло число видео, напрямую сравнивающих её с Nano Banana Pro: https://www.youtube.com/watch?v=DY6TkI8XtkQ.
- Meta серьёзно входит в генерацию изображений и видео. Muse Image, Muse Spark и Muse Video от Meta Superintelligence Labs появились в июле 2026 года и представлены как новый подход: агентная генерация с веб-поиском и выполнением кода для обоснования изображения.
- xAI быстро обновляет Grok Imagine. С первой версии в августе 2025 года модель выросла до Video 1.5 к маю–июлю 2026 года, а множество видео подчёркивают бесплатный доступ.
- В открытом сегменте лидерство у моделей из Китая. В центре Alibaba с Wan и Z-Image Turbo, Tencent с HunyuanVideo и HunyuanImage, а также Black Forest Labs из Германии с Flux.2. В частности, Z-Image Turbo — 6B, Apache-2.0 — уже называют моделью, превосходящей Flux.2.
- Предупреждающий обратный сигнал: Wan 2.2 была полностью открыта по Apache-2.0, но несколько материалов утверждают, что представленная Alibaba 24.08.2026 Wan 3.0 перешла на закрытый курс: только API, без публикации весов. На YouTube также заметна тревога, что преемник флагмана открытой генерации видео остаётся неопределённым.
- Экосистема ComfyUI остаётся главным полем для открытой генерации видео и изображений. Для Wan 2.1/2.2, HunyuanVideo и Z-Image Turbo продолжают массово появляться учебные материалы для ComfyUI.
Ограничения
- Страница результатов YouTube —
youtube.com/results?search_query=...— при прямом получении через WebFetch возвращала только нижний колонтитул до JavaScript-рендеринга: условия использования, копирайт и подобное. Заголовки видео, каналы, просмотры и даты в ней не были доступны. То же происходило при прямом запросе страниц видеоyoutube.com/watch?v=...; встроенные JSON-LD и OG-теги получить не удалось. - Поэтому просмотры и число подписчиков выше приводятся только там, где они были доступны из поисковых сниппетов. Для большинства видео нельзя подтвердить точные просмотры, название канала или число подписчиков; количество видео с проверенным показателем views равно нулю. Для таких цифр нужен отдельный путь, например YouTube Data API.
- По Kling 2.5 Turbo в нескольких не-YouTube источниках подтверждалось первое место в рейтинге Artificial Analysis, но подходящий конкретный ролик YouTube найти не удалось: результаты поиска смещались к блоговым статьям.
- По видеомодели Midjourney найдены лишь новости за апрель–июнь 2025 года; крупных изменений за последние 60 дней не обнаружено. Небольшие обновления V7.1/V8 относятся лишь к информации на сентябрь 2025 года.
- Содержимое комментариев, включая лучшие комментарии, не входило в полученные страницы и не анализировалось.
Bluesky
Bluesky — Новости ИИ для генерации изображений и видео
Аккаунты
- 🚨 AI News | TestingCatalog @testingcatalog.com — 860 подписчиков. Личный новостной аккаунт, заявляющий «Latest AI News on AI Agents, Model Releases, Tools, Leaks, and Rumors». Он публикует несколько коротких новостей в день о релизах и утечках моделей и оказался наиболее часто обновляемым, то есть наиболее близким к актуальному, источником в этом исследовании.
- Daily HuggingFace Trends @huggingfacetrends.bsky.social — 122 подписчика. Бот, автоматически публикующий после 19:00 ежедневные трендовые модели Hugging Face: GitHub — aegisfleet/hugging-face-trending-to-bluesky. Полезен для отслеживания открытых моделей.
- Midjourney, официальный аккаунт @midjourneyofficial.bsky.social — 112 подписчиков. Midjourney пришла в Bluesky в августе 2025 года, но последний пост относится к 08.10.2025; после этого аккаунт молчит.
- Stability AI, официальный аккаунт @stabilityai.bsky.social — 241 подписчик. Публиковались анонсы API для редактирования изображений Stability AI Image Services, но последние посты относятся к ноябрю 2025 года; обновления редки.
- ComfyUI, официальный аккаунт @comfyuiorg.bsky.social — официальный аккаунт открытого инструмента рабочих процессов для генерации изображений и видео. Однако последние публикации относятся к июню 2025 года, поэтому движения 2026 года отслеживать не удалось.
- Black Forest Labs, разработчик Flux @blackforestlabs.bsky.social, Runway @runwayml.bsky.social и Kling AI @klingai.bsky.social — аккаунты существуют, но почти не публикуют сообщений: у Black Forest Labs 0 постов, у Runway только один пост от октября 2024 года, лента Kling пуста. Bluesky не является их главным каналом коммуникации.
Посты
-
OpenAI представила «ChatGPT Images 2.5» — закрытая модель — @testingcatalog.com, 09.09.2026, 👍2 🔁1
https://bsky.app/profile/testingcatalog.com/post/3mv3hn2whdz27
Быстрая генерация и редактирование изображений, улучшенная согласованность объектов и новые API-модели Flare и Sunburst. -
Появились ранние результаты видеомодели Meta «Muse Video» — закрытая модель — @testingcatalog.com, 19.08.2026, 👍2
https://bsky.app/profile/testingcatalog.com/post/3mthtr6iu7p24
Предварительная информация о видеомодели для разрабатываемого к Meta Connect агентного суперприложения Muse. -
Стартап Visko представил «Orbis», модель генерации видео в реальном времени — закрытая модель — @testingcatalog.com, 01.09.2026
https://bsky.app/profile/testingcatalog.com/post/3muhthn6m7i2j
Упомянуто как появление нового игрока, заявляющего генерацию в реальном времени. -
MCP ElevenLabs расширен: теперь он может генерировать музыку, изображения и видео — API-сервис, близкий к закрытому сегменту — @testingcatalog.com, 14.09.2026, 👍3 🔁1
https://bsky.app/profile/testingcatalog.com/post/3mvj6k7eycz2n
Пример расширения компании ElevenLabs, прежде специализировавшейся на голосе, в сферу генерации изображений и видео. -
Tencent выпустила открытую превью-модель Hy4 — открытый исходный код — @testingcatalog.com, 29.08.2026
https://bsky.app/profile/testingcatalog.com/post/3mu7v3bdkwo2h
Открытый выпуск превью-модели, предположительно следующей в линейке Hunyuan. -
Lightricks/LTX-2.5 попала в тренды Hugging Face — открытая генерация видео — @huggingfacetrends.bsky.social, 15.09.2026; также 13 и 11 сентября
https://bsky.app/profile/huggingfacetrends.bsky.social/post/3mvkun3tjqp2t
Видеомодель LTX-2.5 от Lightricks три дня подряд представлена среди трендовых моделей Hugging Face, что указывает на устойчивый интерес. -
ComfyUI интегрировала FLUX.1 Kontext как официальный API-узел — открытый сегмент — @comfyuiorg.bsky.social, 06.06.2025
https://bsky.app/profile/comfyuiorg.bsky.social/post/3lqvsxzzjhb2t
Указано «Open Source coming soon!». Это важный этап глубокой интеграции экосистемы Flux Black Forest Labs в ComfyUI. Дата старая, но событие остаётся важной вехой для открытого редактирования изображений. -
Wan2.1 выпущена с поддержкой ComfyUI — открытая генерация видео — @comfyuiorg.bsky.social, 26.02.2025
https://bsky.app/profile/comfyuiorg.bsky.social/post/3lj42stgelb2l
Одновременно доступны четыре модели: text-to-video — 14B/1.3B — и image-to-video — 14B. Хотя сообщение старое, это важная веха китайской открытой генерации видео. -
Stability AI начала предлагать API-редактирование изображений через Amazon Bedrock — закрытый/API-сегмент — @stabilityai.bsky.social, 18.09.2025
https://bsky.app/profile/stabilityai.bsky.social/post/3lz5eotkuvk2i
Корпоративные инструменты редактирования: например, превращение эскиза в фотореалистичное изображение товара. -
Midjourney удвоила число стилей в «Style Explorer» — закрытая модель — @midjourneyofficial.bsky.social, 18.09.2025, 👍10 🔁2
https://bsky.app/profile/midjourneyofficial.bsky.social/post/3lz5cskktzk2c
Один из немногих анонсов обновления функций, опубликованных непосредственно официальным аккаунтом.
Сигналы
- Bluesky обладает очень слабой плотностью источников для срочных новостей об ИИ-генерации изображений и видео. Официальные аккаунты Midjourney, Runway, Kling AI, Black Forest Labs, ComfyUI и Stability AI существуют, но у большинства публикации редки или остановились во второй половине 2025 года. В сравнении с X и Reddit платформа явно не стала основным местом коммуникации.
- Единственным непрерывно публикующим последние новости источником был личный аккаунт @testingcatalog.com. Только в сентябре 2026 года он писал об OpenAI, Meta, Google, Anthropic и других с частотой 1–3 сообщения в день. Однако публикации, напрямую относящиеся к генерации изображений и видео, составляют лишь часть потока: ChatGPT Images 2.5, Meta Muse Video, Visko Orbis, расширение ElevenLabs, Tencent Hy4; основная масса новостей касается агентов и LLM.
- Открытые тенденции проще было выявлять не через новостные аккаунты, а через автоматические боты агрегации трендов, такие как Daily HuggingFace Trends. Lightricks/LTX-2.5 попадала в тренды 11, 13 и 15 сентября, что говорит о постоянном интересе к ней как к открытой видеомодели.
- Найдено много личных публикаций с работами, созданными в Stable Diffusion, ComfyUI или Midjourney, но это демонстрации работ, а не первичные новостные источники, поэтому в раздел Posts они не включены.
Ограничения
- Официальный API поиска постов Bluesky —
app.bsky.feed.searchPosts— всегда возвращалHTTP 403 Forbidden, независимо от ключевых слов. При этомgetProfile,getAuthorFeed,getPostThreadиactor.searchActorsработали. Поэтому вместо полнотекстового поиска использовался обходной процесс: ① обнаружение аккаунтов черезactor.searchActors, ② получение их лент черезgetAuthorFeed, ③ индивидуальная проверка нужных постов черезgetPostThread. Из-за этого не удалось охватить публикации обычных пользователей, которые можно было бы найти при поиске по хештегам. - Веб-поиск Bluesky на
https://bsky.app/search?q=...— это SPA с клиентским рендерингом; текст постов отсутствует в HTML и не читается напрямую. - Поиск постов Bluesky через поисковики —
site:bsky.app— тоже был испробован, но индекс в основном содержит старые посты 2024–первой половины 2025 года. Самых свежих постов сентября 2026 года почти не нашлось. - Поэтому собранные публикации смещены в сторону отдельных аккаунтов — прежде всего @testingcatalog.com, @huggingfacetrends.bsky.social и официальных брендов. Они не позволяют измерить общий объём упоминаний или настроение всей платформы вокруг ИИ-генерации изображений и видео.
Lemmy
Lemmy — обсуждения ИИ для генерации изображений и видео, исследование от 2026-09-17
Сообщества
- !«メールアドレス» — 5.71K подписчиков, 1.41K постов, 1.93K комментариев. Модераторы: db0, Even_Adder. Основная тема — релизы инструментов для открытых весов, LoRA и кастомных нод ComfyUI; посты появляются практически ежедневно. Это наиболее активное сообщество.
- !«メールアドレス» — 2.36K подписчиков, из них 362 локальных. Галерейное сообщество с работами, созданными Stable Diffusion и другими моделями с открытыми весами. Почти все материалы раз в несколько часов публикует один пользователь, Even_Adder.
- !«メールアドレス» — 51 подписчик, всего 25.2K постов. Сообщество зеркалирует через RSS сабреддиты Reddit об ИИ. Подписчиков мало, но здесь встречаются сравнительные материалы о генеративном ИИ, которых нет на других инстансах.
- !«メールアドレス» — там публикуются работы с Nano Banana, но получение списка блокирует Anubis — защита от ботов.
- !«メールアドレス» — по поисковым результатам 222 подписчика и 11 постов; очень небольшое сообщество. Прямой доступ завершился ошибкой 500.
- !«メールアドレス», также известное как sneerclub — сообщество с саркастическими и критическими публикациями об индустрии ИИ. Иногда там появляются скептические посты о компаниях, создающих ИИ для изображений.
Посты
-
«Один и тот же разворот “Берсерка”, 4 ИИ-раскраски. Похоже, GPT снова побеждает?» — !«メールアドレス», 14.09.2026, score 1
https://lemmy.durstig.online/post/60037
Сравнение раскраски одного кадра «Берсерка» четырьмя ИИ. ChatGPT Images 2.5 лучше всего сохранила контуры и композицию; Wan 2.7 Pro дала хорошее освещение, но частично перерисовала изображение; Nano Banana Pro проигнорировала указание ничего не менять и добавила элементы; Seedream 5.0 Pro сохранила композицию, но дала чрезмерную насыщенность. Указана общая стоимость теста: $0.30. -
«Традиционный кинематографический подход при создании анимации Robo Dad» — !«メールアドレス», 22.08.2026, score 0
https://lemmy.durstig.online/post/55214
Пример гибридного рабочего процесса: съёмка самодельной куклы, создание листа персонажа в Nano Banana и превращение его в видео с Seeddance 2.0. -
«Google тихо закрыла функцию Earth AI через день после запуска: пользователи создавали запрещённые изображения» — !«メールアドレス», 07.08.2026, score 1
https://lemmy.durstig.online/post/52162
Встроенная в Google Earth функция Nano Banana 2 была отозвана на следующий день после запуска, потому что с её помощью массово создавали изображения вымышленных катастроф и военных объектов в реальных местах. -
«Это похоже на обложку альбома...» — !«メールアドレス», 07.08.2026, score -8
https://lemmy.ca/post/69025640
Изображение в стиле тропической обложки альбома, созданное Nano Banana — Gemini 2.5 Flash. Отрицательный рейтинг также показывает холодную реакцию на ИИ-изображения. -
«Midjourney хочет, чтобы студии Голливуда раскрывали использование ИИ» — !«メールアドレス», 05.07.2026, score 12
https://lemmy.today/post/56011946
Новость о том, что Midjourney требует от голливудских студий раскрывать применение ИИ. -
«Midjourney AI превращается в Theranos: ультразвуковая КТ» — !«メールアドレス», автор David Gerard, середина июня 2026 года, score 41
https://awful.systems/post/8731127
Саркастический пост сравнивает выход Midjourney на рынок медицинского оборудования для ультразвукового сканирования всего тела в воде с Theranos, провалившейся компанией по анализу крови. В комментариях много скепсиса: «Почему компания, создающая изображения и нарушающая авторские права, вдруг занялась медицинским оборудованием?». -
Новые инструменты открытого сегмента — !«メールアドレス», автор Even_Adder, 14–17.09.2026
- ComfyUI-Fantastic-MiniMaxH3-PromptBuilder https://lemmy.dbzer0.com/post/75586072 — 7 часов назад, score 3
- wan2gp-h3-latent-continue https://lemmy.dbzer0.com/post/75586070 — добавляет Wan2GP возможность генерировать продолжение видео
- ComfyUI_MinimaxH3_AutoContext https://lemmy.dbzer0.com/post/75586069
- TaoMate-H3-3Step-ComfyUI — трёхшаговая дистиллированная LoRA — https://lemmy.dbzer0.com/post/75427443
- ComfyUI-VDN-H3-24GB — реализация с пониженным потреблением памяти для 24 ГБ VRAM — https://lemmy.dbzer0.com/post/75382764
- MiniMax-H3-Image-Training-Adapter https://lemmy.dbzer0.com/post/75382765
- Krea2-Turbo-Distill-2step-LoRA https://lemmy.dbzer0.com/post/75427441
За последние несколько дней особенно заметен концентрированный выпуск инструментов ComfyUI, LoRA и экономичных реализаций вокруг открытой модели MiniMax H3.
-
«Силуэт тёмных крыльев» — !«メールアドレス», 17.09.2026, score 2
https://lemmy.dbzer0.com/post/75601450
Работа, созданная с Krea2 и обработкой Qwen Image. В комментариях обсуждают локальное использование Qwen 3.5/3.8 и GLM 5.2, а также аппаратные вопросы: даже кластера B300 с 2.1 ТБ HBM недостаточно для фронтирных моделей.
Сигналы
- В закрытом сегменте обсуждают не столько новые модели, сколько аварии, скандалы и поводы для сарказма: история Nano Banana в Google Earth, сравнение Midjourney с Theranos. Многие такие темы встречаются только в зеркальных r/-сообществах — !ai_reddit и !imageai; в нативных сообществах Lemmy их немного.
- В открытом сегменте !«メールアドレス» — фактический центр активности. Вокруг одной модели MiniMax H3 за несколько дней быстро сформировалась экосистема ComfyUI: ноды, LoRA, реализации с меньшими требованиями к памяти. Это типичный для OSS способ развития.
- Во всех сообществах число подписчиков невелико — от десятков до нескольких тысяч, — поэтому объём обсуждений существенно ниже, чем на Reddit или X.
- Поисковые инструменты легко ловят шум: однажды пост «#BringSoraHome» об ирландском споре об опеке был почти ошибочно принят за материал о завершении OpenAI Sora. На деле Sora — имя ребёнка. Текст был проверен вручную, ошибка обнаружена, поэтому пост не включён в отчёт.
Ограничения
- Критерий завершения — анализ примерно 20 постов — для одного Lemmy выполнить не удалось. Даже совместный API-поиск и обход страниц сообществ дали чуть больше 10 материалов, прямо связанных с темой. Lemmy — небольшая платформа, поэтому искусственного расширения выборки не проводилось.
lemmy.world/c/stablediffusionиlemmy.world/c/«メールアドレス»при прямом доступе возвращали ошибку 500.- Список !«メールアドレス» не удалось получить из-за защиты Anubis от ботов.
- Поиски «Grok Imagine», «Veo 3» и «Kling AI» не дали релевантных постов; на Lemmy практически не обсуждаются отдельные закрытые видеосервисы такого типа.
- API-поиск возвращал много нерелевантного шума — политические и технические статьи. Включались только посты, чьи тексты были проверены по отдельности.
Pinterest — Новости ИИ для генерации изображений и видео
Визуальные темы
- Хромированный белый гуманоидный андроид как визуальный символ «ИИ»: блестящая голова или торс робота с сияющими синими глазами и схемами, часто за новостным столом или с микрофоном, заменяет собой «ИИ» в десятках несвязанных пинов [5, 7, 10, 12, 20, 26, 30, 33, 47]. Это самый повторяющийся мотив в наборе.
- Рамка «Журналистика умирает из-за ИИ?»: сцены редакций, где роботы заменяют журналистов или сидят рядом с ними, обычно с тревожным человеком в кадре; заголовки вроде «ИИ пишет новости — можем ли мы всё ещё доверять журналистике?» [2, 7, 12, 17, 19, 26, 33].
- Графика тревоги о дипфейках и дезинформации: сетки распознавания лица, превращающие одно лицо в другое, биометрические HUD-интерфейсы и явные штампы «FAKE» поверх созданного ИИ контента — фотографии кота или фигуры в капюшоне [9, 14, 16, 18, 44, 47].
- Доминирует сине-голубая техно-палитра: робот, рука с сияющим ИИ-чипом или голографическая офисная панель почти всегда окрашены в глубокий синий/голубой с белыми бликами [6, 16, 20, 21, 30, 44].
- Реклама безликого контента и UGC-коммерции: объявления в стиле Fiverr и инструменты «Станьте вирусным, не показывая лицо», продающие маркетологам и авторам ИИ-аватаров, замену лиц и создание демонстрационных видео о товарах [4, 9, 11, 18].
- Инфографика-списки и подборки для поиска инструментов: «5 лучших бесплатных ИИ-инструментов для генерации фото», «Главные ИИ-новости июля 2026», логотипные стены ChatGPT/Gemini/Claude/Microsoft/Google/Apple/Samsung/Meta/Nvidia — все это крупные закрытые бренды [30, 36, 42].
- Конкретные закрытые продукты, которые действительно встречаются: Adobe Firefly — коллаж с брендингом [42], техническая схема Microsoft VASA-1 для аудио-управляемой анимации лица [14], Vidu S1 от ShengShu Technology — видеомодель реального времени, показанная дважды на почти идентичной киберпанк-иллюстрации [29, 38], и спор вокруг ИИ-актрисы Tilly Norwood на скриншоте телевизионного титра [1].
- Милые ИИ-рендеры животных как мягкая маркетинговая приманка: выдра в спасательном жилете на сапборде и щенок в цветах используются как примеры результатов генераторов фото и видео, а не как собственно новости [13, 36].
Примечательные пины
- №1 — «Hollywood Reporter Interviews the First AI Actress...»: телевизионный скриншот с крупным титром «AI-GENERATED IMAGE» поверх фото Tilly Norwood/Instagram — самый ясный пример реального спора о закрытом продукте в выборке.
- №7 — робот в редакции без названия: андроид за столом ведущего, окружённый плавающими панелями «NEWS», и ошеломлённый журналист рядом — чистейшая визуализация тревоги «ИИ захватывает новостной стол».
- №47 — «AI content and social media concerns»: робот с телефоном рядом со штампом «FAKE» поверх фотографии ИИ-кота и фигуры в капюшоне — наиболее прямое изображение общей проблемы доверия в споре открытого и закрытого сегментов.
- №14 — схема VASA-1: одно изображение + аудиоклип + управляющие сигналы → сетка анимации лица в реальном времени. Это настоящая техническая схема, а не стоковая картинка, связанная с исследованием Microsoft об анимации говорящего лица по аудио.
- №29 / №38 — Vidu S1 от ShengShu Technology: «Самая передовая в мире модель для интерактивного ИИ-взаимодействия в реальном времени», повторяющаяся киберпанк-иллюстрация. Это реальный запуск именованной китайской закрытой видеомодели.
- №42 — коллаж с брендингом Adobe: красный логотип Adobe/Firefly поверх созданных портретов и пейзажей — закрытый действующий игрок заявляет своё место на рынке.
- №36 — «Top 5 Free AI Tools for Photo Generation»: ранжирует Midjourney, Bing Image Creator, Canva AI, Leonardo AI и Playground AI с примерами результатов — наиболее близкая к подборке бесплатных решений часть набора.
- №13 — ИИ-выдра на сапборде: подписана как «3D digital render» и использована как демонстрационный ролик генератора видео. Это показывает, что «новости ИИ-видео» на Pinterest часто означают демонстрации продукта, а не журналистику.
- №18 — «Go Viral Without Showing Your Face»: автор в капюшоне у двухмониторного рабочего места для редактирования клонов лиц; ИИ-аватары и технологии лиц продаются авторам как инструмент роста.
- №9 — реклама замены лица, «Videos Pro»: лица двух женщин сливаются через сетку трекинга; «гиперреалистичное редактирование лица» напрямую продаётся потребителям как дипфейк-инструмент.
Сигналы
- Что актуально: доминирующий нарратив Pinterest сейчас — не «какая модель что выпустила», а тревога и оппортунизм вокруг ИИ-лиц: дипфейки, ИИ-ведущие новостей, приложения для замены лиц и инструменты «не показывайте лицо» тесно сгруппированы. История об ИИ-актрисе Tilly Norwood [1] и интерактивная видеомодель Vidu S1 [29, 38] — два пина, которые действительно читаются как актуальные новости, а не как стоковая концепт-графика или партнёрский контент.
- Чего почти нет: новостей, связанных именно с открытым кодом. Ни один пин не называет Stable Diffusion, Flux, HunyuanVideo, Wan, ComfyUI или любой GitHub-нативный проект. Немногие пины об ИИ-инструментах [30, 36, 42] перечисляют закрытые хостинговые продукты: ChatGPT, Gemini, Claude, Adobe Firefly, Midjourney, Bing Image Creator, Canva и Leonardo. Стимулы Pinterest — SEO-миниатюры блогов, партнёрские подборки и реклама услуг — по-видимому, отбирают потребительские закрытые продукты, а не релизы открытого сообщества.
- Технической конкретики мало: помимо схемы VASA-1 [14] и брендинга Vidu S1 [29, 38], почти всё остальное — универсальные стоковые изображения и клипарт, иллюстрирующие саму идею ИИ, а не реальное событие, релиз или демонстрацию.
Ограничения
- На этом этапе использовались пины, уже собранные воркером через headless-браузер —
output/pinterest.pins.md, 50 пинов в одном неименованном поисковом/жанровом наборе. Pinterest самостоятельно не просматривался, поэтому это один проход поиска, а не исчерпывающий обход. - Были непосредственно открыты и визуально проверены 30 из 50 собранных изображений. Оставшиеся 20 не открывались по отдельности, хотя их заголовки были проверены и соответствуют указанным темам.
- Целевые страницы пинов не загружались: были доступны только изображение пина и сохранённый заголовок. Поэтому нельзя было проверить контекст за пределами картинки — полный текст статьи, обсуждение в комментариях, количество сохранений или репинов.
- Новости об открытой генерации изображений и видео на этой платформе практически не представлены: набор попросту не выводит именованные открытые проекты. Поэтому открытая половина отчёта должна опираться на другие платформы — Reddit, X, YouTube, Bluesky и Lemmy, — а не на Pinterest.
Рекомендуемые действия
- Повторно собрать данные по X, используя не тренды, а запросы, напрямую связанные с темой: «Sora 2», «Nano Banana Pro», «Wan», «Flux» и другие.
- Подтвердить подозрения о закрытии Wan 3.0 первичным источником — официальным объявлением Alibaba — и отслеживать последствия для расстановки сил в открытой генерации видео.
- Для самых свежих событий вокруг MiniMax H3 регулярно отслеживать !«メールアドレス».
- Сравнение GPT Image 2.5 и Nano Banana Pro согласованно проявляется на нескольких платформах; в следующий раз стоит добавить третьих игроков, например Seedream 5.0 Pro.
- Избыточные реакции фильтров и ошибочные генерации у моделей Google повторяются, поэтому их стоит постоянно отслеживать как тему надёжности.
Собранные изображения


















































Примечание о качестве данных
Метод сбора X не соответствовал теме и дал ноль тематических материалов, поэтому платформа фактически не сработала. Reddit и Lemmy не достигли критерия в «около 20» материалов. На YouTube не удалось подтвердить просмотры и названия каналов, а Bluesky потребовал обходных методов из-за недоступности поискового API.



