KEN’S CAT LOG

Новости ИИ для генерации изображений и видео — 2026-09-24

Закрытые ИИ для изображений/видео побеждают по цене и скорости (GPT-6 Sol/Luna, ChatGPT Images 2.5, Kling 3.0), тогда как модели с открытыми весами начинают одерживать явные победы в качестве видео (Wan 3.0), хотя несколько «open source»-релизов (поздние веса Wan 3.0, FLUX 3, лицензирование MiniMax H3) оказываются более закрытыми или ограниченными, чем заявлено.

Новости ИИ для генерации изображений и видео🔥🎨🎬 — 2026-09-24

Жесть, на этой неделе в мире ИИ для изображений и видео снова был полный хаос😂 Если в двух словах: «🔒закрытые игроки давят снижением цен и скоростью, а 🔓открытые становятся настоящими чемпионами в генерации видео»! Пока новые модели вроде GPT-6 Sol/Luna выходят одна за другой и дешевеют, модели с открытыми весами вроде Wan 3.0, по сообщениям, уже выходят на первое место в видеокатегории — и это реально горячо🔥. Но одновременно хватает и тёмной стороны: «ИИ-картинку распознали и разнесли», «всё в судах», «ложно называют open source» — уже не получается просто сказать «ИИ крутой» и на этом закончить😅.

На разных платформах 🌐

  • 🔒 Гонка за удешевлением и ускорением всерьёз набирает темп. В анонсе GPT-6 Sol/Luna на X ключевой акцент — не столько на росте качества, сколько на «дешевле и быстрее»; то же направление видно у ChatGPT Images 2.5 на YouTube (скорость генерации -50%) и у AI Director в Kling 3.0 (несколько кадров за одну генерацию = снижение затрат). Все платформы говорят об одном и том же, так что это похоже на реальный тренд💸
  • 🔓🔒 В изображениях сильнее закрытые модели, а в видео открытые, возможно, уже перевернули ситуацию. По слепым оценкам трекинг-бота olud.ai в Bluesky, GPT Image 2.5 Sunburst🔒 занимает первое место и в генерации, и в редактировании изображений; лучшая доступная для скачивания модель Qwen-Image-3.0-Pro🔓 отстаёт более чем на 100 ELO. Но только в видеокатегории Wan 3.0🔓, по сообщениям, обошла всех закрытых конкурентов и вышла на первое место — вот это особенно важно👀
  • ⚖️ Давление судов и регулирования действительно усиливается. Через Bluesky удалось подтвердить, что 23 сентября одновременно появились движения по делам Disney v. Midjourney и Andersen v. Stability AI, а ветки с законопроектами об обязательных watermark и раскрытии использования ИИ в Reddit r/CriticalState суммарно собрали около 18 тысяч комментариев. Люди явно всё чаще раздражённо спрашивают об ИИ-контенте: «Это вообще настоящее?»😤
  • 🎭 Одновременно существуют ИИ, который распознают и высмеивают, и ИИ, который незаметно расходится. Reddit (фотографии недвижимости, видео с микроскопа Nikon, изображение на стене университета) и Pinterest (надпись NBC «AI GENERATED», мемы с подозрениями на подделку) полны случаев, которые пользователи дружно высмеивают. Но в r/Instagramreality также сообщили о примере, когда ИИ-изображения без распознавания собрали тысячи апвоутов — в одном пространстве происходят прямо противоположные вещи😳
  • 🔓 Растёт число случаев, когда продукт называют «open source», хотя это не так. FLUX 3🔒, о чём говорили на YouTube, называется в заголовках «Open Source», хотя по факту доступна лишь закрытая early-access-версия; Wan 3.0, чьи прежние версии были open-weight, в v3.0 перешла к API без публикации весов; MiniMax H3🔓 публикует веса на Hugging Face, но её лицензия запрещает использование в США, ЕС, Великобритании и Южной Корее. Определение «открытости» становится всё более размытым — это серьёзный повод для осторожности⚠️

По платформам 📱

  • Reddit — удалось собрать только 12 тредов, а не целевые 20😢. При этом не было ни одного профильного сообщества вроде r/StableDiffusion; материал в основном состоял из реакции обычных пользователей в r/mildlyinfuriating (ИИ-фотографии недвижимости, 26 тыс. баллов) и r/labrats (ИИ-«улучшенное» микроскопическое видео победило в конкурсе, затем разгорелся скандал). Новостей о продуктах почти не было.
  • X — из-за того, что сессия определилась как хорватская, большинство трендов Explore (криптовалюты, Тейлор Свифт и т. п.) оказались нерелевантны🙄. Тем не менее удалось уверенно собрать анонс GPT-6 Sol/Luna и серию постов об использовании Opus 5.5 в качестве «оркестратора», управляющего Higgsfield/After Effects/Blender (пример). Но тем про open source на этот раз действительно не было вовсе🔓❌.
  • YouTube — названия каналов и просмотры отдельных видео получить со страниц не удалось😩 (подробнее ниже). Но по содержанию это была самая сильная платформа: Nano Banana Pro🔒, Kling 3.0🔒, Wan 3.0🔓 (веса перестали публиковаться), LTX-2.3🔓 (одновременная генерация аудио и видео), Qwen-Image-2512🔓, а также несоответствие между брендингом и реальным статусом FLUX 3🔒/🔓 — здесь лучше всего охвачены конкретные действия обеих сторон.
  • Bluesky — API поиска (searchPosts) возвращал 403 для всех запросов, но удалось пробиться через поиск аккаунтов + getAuthorFeed💪. Были найдены ELO-лидерборд olud.ai (GPT Image 2.5 Sunburst🔒 лидирует в изображениях, Wan 3.0🔓 — в видео), бот срочных сообщений о судах ai.bots.law, а также факт, что ComfyUI🔓 достиг 134 тыс. звёзд. Здесь была самая насыщенная цифрами информация.
  • Lemmy — очень маленькая площадка (у сообщества ai_reddit всего 52 подписчика), но !«メールアドレス» — настоящее место сбора сторонников ComfyUI и open-weight моделей🔓. Интересны были и бизнес-истории: прекращение Sora API против привлечения Kling 3 млрд долларов🔒, а также критика ухода Midjourney в бизнес ультразвуковых сканеров как «превращения в Theranos».
  • Pinterest — метрики вовлечённости (лайки и сохранения) вообще не удалось получить, поэтому анализ основан только на содержании изображений. Среди 50 пинов доминируют закрытые бренды (ChatGPT, Gemini, Veo, Kling, Midjourney, Adobe Firefly и другие), а пин, намекающий на открытые или локальные инструменты, был только один — Amuse 3.0 для AMD🔓😶. Ещё четыре независимых пина были построены на тревоге «Можно ли верить ИИ-генерации?».

За чем следить 👀

  • Публикация весов Wan 3.0 — в лидерборде Bluesky модель лидирует в видеокатегории🔓, но на YouTube утверждают, что она стала закрытой API-бетой без весов. Данные противоречат друг другу, нужно следить дальше (пост Bluesky / YouTube)
  • Ход дел Disney v. Midjourney / Andersen v. Stability AI — 23 сентября в обоих делах появились движения; решения могут изменить правила работы с обучающими данными для всей индустрии (Bluesky/ai.bots.law)
  • Контраст прекращения Sora API и привлечения Kling 3 млрд долларов — потребительское ИИ-видео может плохо монетизироваться, в то время как корпоративный сегмент становится главным направлением (Lemmy)
  • Региональные ограничения Community License у MiniMax H3 — стоит посмотреть, станет ли стандартом ситуация, когда «open-weight» модель нельзя использовать в США, ЕС, Великобритании и Южной Корее (YouTube)
  • Движение законопроектов об обязательном раскрытии ИИ и watermark — в Reddit тема собрала около 18 тысяч комментариев; важно наблюдать, насколько далеко зайдёт регулирование (r/CriticalState)
  • Оценка GPT-6 Sol/Luna в реальной эксплуатации — сразу после анонса появилась скептическая реакция: главное новшество — снижение цены, а не значительный рост качества (X)

Рекомендации ✅

  • Поскольку данные о публикации весов Wan 3.0 расходятся, перед статьёй или принятием решения обязательно проверяйте актуальный статус на Hugging Face и официальном сайте.
  • Для моделей, заявляющих «open source» (например, FLUX 3), всегда проверяйте текст лицензии и реальную возможность скачивания; не принимайте маркетинговые заявления на веру.
  • Перед использованием open-weight модели с региональными ограничениями вроде MiniMax H3 проверьте, не исключены ли целевые страна или регион из Community License.
  • Если планируете коммерческое применение ИИ-видео, учитывайте текущий тренд: корпоративные задачи (обучение, демонстрации продуктов) сейчас выглядят перспективнее потребительских бесплатных тарифов.
  • Продолжайте отслеживать даты решений по искам Disney/Andersen и обновляйте политику рисков, связанную с обучающими данными.
  • Учитывая выявленный на Reddit и Pinterest сценарий «ИИ распознали — начался скандал», при публикации ИИ-контента последовательно добавляйте явное раскрытие его происхождения.

Качество данных 📊

  • Reddit: собрано только 12 материалов при цели 20. Кроме того, использовался один поисковый запрос ("Image and Video Generation AI News"), не были найдены профильные сабреддиты вроде r/StableDiffusion, а выборка сместилась к реакции обычных пользователей на распознанный ИИ-контент.
  • X: можно было просматривать лишь региональные тренды Explore, зависящие от сессии (Хорватия); из 10 трендов только 3 относились к теме. Упоминаний open source по сути не было🔓❌.
  • YouTube: WebFetch постоянно перенаправлялся на страницу согласия с cookie (consent.youtube.com, регион=HR), поэтому не удалось получить ни просмотры, ни названия каналов, ни комментарии. Содержание опирается на сниппеты WebSearch.
  • Bluesky: официальный API поиска (searchPosts) отклонял все запросы с 403. Из-за альтернативного сбора через поиск аккаунтов результаты не являются полноформатным поиском по всей платформе.
  • Lemmy: сама платформа крайне мала (у сообщества ai_reddit 52 подписчика), а поиск только по генерации видео не дал результатов. При цели в 20 материалов удалось собрать примерно 14.
  • Pinterest: не получены никакие показатели вовлечённости — лайки, сохранения и т. п.; анализировались только изображения и заголовки. Из 50 материалов удалось открыть лишь 30 исходных изображений.

Сводка по платформам

Reddit

Reddit — Новости ИИ для генерации изображений и видео

Где

Собрано 12 тредов из 10 сабреддитов; все найдены по единственному запросу "Image and Video Generation AI News":

Сабреддит Участники Собрано тредов
r/mildlyinfuriating 12,590,273 1
r/youtube 3,460,141 1
r/Instagramreality 1,155,685 1
r/LinkedInLunatics 1,081,995 1
r/labrats 726,552 1
r/generativeAI 156,580 2
r/Purdue 100,756 1
r/CriticalState 39,323 2
r/perchance 30,990 1
r/aivideomaking 7,568 1

Ни один из них не является профильным сообществом по инструментам генеративного ИИ (не нашлись r/StableDiffusion, r/midjourney, r/aivideo и т. п.) — выборка состоит из общих сабреддитов, реагирующих на ИИ-генерируемый контент, плюс двух небольших сообществ поддержки инструментов (r/generativeAI, r/aivideomaking, r/perchance).

Что говорят люди
  • #1 (r/labrats, 933 балла, 123 комментария, 2026-09-23) — победившее в конкурсе Nikon's Small World in Motion «микроскопическое» видео оказалось созданным или «улучшенным» ИИ, с биологически невозможными движениями клеток. После возражений микроскопистов Nikon подтвердила использование ИИ. Топ-комментарий (u/Barkinsons, 551 балл): «ИИ-инструментам не место в научных микроскопических изображениях, потому что мы обязаны воспроизводить их максимально правдиво, а не такими, какими нам хотелось бы их видеть».
  • #4 (r/mildlyinfuriating, 26,469 баллов, 714 комментариев, 2026-09-21) — ИИ-постановочные фотографии недвижимости, нереалистично меняющие комнаты: например, удаляющие радиаторы или добавляющие бильярдный стол там, где он физически не поместился бы. Топ-комментарий (u/slothboy, 5,706 баллов): «Превратить эту обеденную зону в ванную обойдётся в пятизначную сумму». Это тред с самым высоким рейтингом во всей подборке.
  • #5 (r/Instagramreality, 2,179 баллов, 348 комментариев, 2026-09-18) — ИИ-изображения, набравшие тысячи апвоутов на самом Reddit до того, как их распознали по меняющимся между фотографиями линиям плинтусов и плитки. u/Habibti-Mimi81 (150 баллов): «Я, очевидно, либо слишком старая, либо слишком глупая, потому что сама бы не поняла, что это И И... Грустные и опасные времена».
  • #10 и #12 (r/CriticalState) — два отдельных треда с законопроектами об обязательной ИИ-маркировке (13,835 комментариев, 1,256 баллов, 2026-09-21) и обязательном раскрытии компаниями использования ИИ (4,537 комментариев, 214 баллов, 2026-09-18). В топ-комментариях доминирует «I voted Yea ✅» (похоже на сабреддит с ботом-опросником), но сам объём показывает высокий спрос на регулирование раскрытия информации.
  • #2, #6, #7 (r/aivideomaking и r/generativeAI x2) — три почти одинаковых треда с запросом на бесплатный ИИ-генератор видео (12 баллов/36 комментариев, 2 балла/24 комментария, 4 балла/29 комментариев), опубликованные в течение нескольких дней друг от друга (19–20 сентября). Во всех трёх ответ один: бесплатные тарифы ограничиваются клипами примерно на 3–6 секунд; повторяющийся комментатор (u/Jenna_AI, бот поддержки ИИ) объясняет, что бесплатные уровни не могут поддерживать временную согласованность дольше ~6 секунд. Неоднократно упоминавшиеся инструменты: ComfyUI + FramePack (локально, требуется 16 ГБ+ VRAM), Muse (Meta, бесплатно, без watermark), Grok ($10/мес.), Kling/Hailuo/Pixverse, Nanobanana/Veo через Google Flow.
  • #9 (r/perchance, 31 балл, 21 комментарий, 2026-09-19) — тред с вопросом, почему в Perchance AI нет режима image-to-image. Топ-комментарий (u/Dack_Blick, 32 балла): «Image-to-image несёт огромные юридические риски и ответственность». Другие высказываются прямее: u/DoctaRoboto (8 баллов) называет причиной «незаконное порно и дипфейки», u/Separate-Prior-5985 — «педофилов». Это редкий тред, где создатели открытого/бесплатного инструмента объясняют намеренное ограничение функции.
  • #8 (r/Purdue, 150 баллов, 20 комментариев, 2026-09-21) — ИИ-сгенерированное рекламное изображение на стене инженерного корпуса университета, которое высмеяли за бессмысленную разводку печатной платы. u/549013 (7 баллов): «половина лекционных видео в одном из лучших инженерных колледжей страны сгенерирована ИИ, будто они действительно не могли повторно использовать старые».
  • #11 (r/LinkedInLunatics, 978 баллов, 116 комментариев, 2026-09-21) — LinkedIn-пост с ИИ-изображением «известных людей, соглашающихся с никем». u/Humble_Daikon (318 баллов): «Мне нравится, что ИИ сделал Маска курящим — видимо, обучался на всех комментариях Reddit, где этих ребят называют кошмарной тупой компанией для совместной затяжки».
  • #3 (r/youtube, 5 баллов, 22 комментария, 2026-09-17) — жалоба на автоматически генерируемые ИИ главы видео на YouTube, появляющиеся у каждого видео. Реакции разделились: u/buildingduck и u/meatmobile682 считают их навязчивыми и нерелевантными, а u/ickN, u/lieutenatdan и u/davesaunders — полезными и ненавязчивыми.
Сигналы
  • Рост: негативная реакция на нераскрытые ИИ-изображения вне среды энтузиастов. Каждый обнаруженный в этом запуске тред из широких сообществ (конкурс Nikon, объявления о недвижимости, университетское здание, LinkedIn-пост) был критическим или насмешливым, а не восторженным — повторяющийся сюжет: «ИИ-мусор поймали в дикой природе», а не «посмотрите, какая классная генерация».
  • Рост: спрос на регулирование. Два треда с законопроектами из r/CriticalState собрали в сумме около 18 000 комментариев за обязательные watermark/раскрытие, на порядок превзойдя по числу комментариев все остальные материалы этой выборки.
  • Отвергнуто: идея существования хорошей бесплатной генерации ИИ-видео. В трёх независимых тредах консенсусный ответ на вопрос «есть ли бесплатный вариант?» — твёрдое нет: бесплатные уровни ограничены несколькими секундами, а локальный запуск требует оборудования, которого у большинства авторов постов нет.
  • Неожиданное / разногласие: Reddit одновременно является местом, где ИИ-изображения разоблачают и высмеивают (r/mildlyinfuriating, r/LinkedInLunatics, r/Purdue), и местом, где нераспознанные ИИ-изображения собирают тысячи апвоутов без подозрений (тред r/Instagramreality, #5, описывающий ИИ-пост в собственном r/OUTFITS Reddit). Одна и та же площадка бывает и разоблачителем, и невольным распространителем.
  • Примечательное отсутствие: в этой выборке нет собственно новостей о продуктах в противостоянии open source и closed source — отсутствуют релизы моделей, бенчмарки или сравнения версий Stable Diffusion/Flux/Sora/Veo/Kling. Ближе всего к этому #9 с обсуждением, почему бесплатный инструмент Perchance не предоставляет image-to-image: это история об ограничении возможностей и ответственности, а не о релизе.
Ограничения
  • Собрано лишь 12 тредов при цели около 20 на платформу; исполнитель использовал один поисковый запрос — "Image and Video Generation AI News" — без вариантов (например, не было отдельных поисков по "Stable Diffusion", "Sora", "Midjourney", "open source video generation").
  • В подборке нет профильных сообществ по инструментам генеративного ИИ (r/StableDiffusion, r/midjourney, r/aivideo, сообществ типа r/LocalLLaMA для изображений/видео), поэтому новостей о конкретных закрытых и открытых продуктах мало. Выборка смещена к реакции широкой аудитории и негативной реакции, а не к обсуждениям практиков.
  • Согласно playbook, Reddit не просматривался напрямую (WebFetch/search не работают с Reddit); работа велась только по output/reddit.threads.md и .json, собранным исполнителем. Поэтому нельзя утверждать, что более широкий поиск не обнаружил бы более релевантных новостей.

X

X — Новости ИИ для генерации изображений и видео

Explore X (наблюдение в сессии из Хорватии, поэтому результаты зависят от региона) показывал в качестве трендов «Cardano», «Opus 5.5», «$SONG», «Taylor», «Astra», «England», «#uranium», «OpenAI», «Croats», «NFTs». К теме генерации изображений и видео относятся лишь Opus 5.5 / Astra / OpenAI; остальные семь трендов (криптовалюты, сплетни о Тейлор Свифт, реклама ставок на футбол, акции уранодобычи, локальные темы, анонсы NFT-минтов) не имеют к ней отношения. Ниже — анализ постов, собранных из этих трёх трендов.

Аккаунты
  • @OpenAI (официальный, 52,200 лайков / 1 пост) — единственный официальный аккаунт, анонсировавший запуск GPT-6 Sol и Luna. В этой выборке это источник с несравнимо наибольшей вовлечённостью.
  • @npaka123 (Эйити Фурукава, 283 лайка / 1 пост) — известный аккаунт с объяснениями об ИИ. Один проверочный пост об Opus 5.5.
  • @seiiiiiiiiiiru (476 лайков / 1 пост) — видеокреатор. Один ролик для запуска, созданный с помощью управления Higgsfield + After Effects из Opus 5.5.
  • @kevin_t_ngo (2,451 лайк / 1 пост) — единичный пост, но одна из самых высоких реакций на ИИ-тему в этой выборке (~152,000 просмотров). Рендеринг Blender с помощью Opus 5.5.
  • @aicreataro (325 лайков / 1 пост) — один проверочный пост: материалы MiniMax H3 обрабатываются Opus 5.5 в After Effects.
  • @sonia_code (377 лайков / 1 пост) — единичный пост о создании Astra 3D-сцены, работающей в браузере.
  • @yachimat_manga (73 лайка / 1 пост) — создатель ИИ-коротких анимаций. Один пост с размышлениями о рабочих процессах в эпоху Astra.
  • @mask_3dcg (всего 1,813 лайка / 2 поста) — 3DCG-креатор. Оба поста повторяют тезис «ИИ не заменит аниматора»: это не единичный вирусный успех, а автор, последовательно отстаивающий позицию.
  • @umiyuki_ai (184 лайка / 1 пост) — единичный аналитический пост, сравнивающий производительность OpenAI и Claude.
  • @so_ainsight (26 лайков / 1 пост) — один пример применения GPT-6 Astra от аккаунта, известного работой с Claude Code.

Большинство авторов — те, от кого в выборку попал лишь «один пост»; единственным пользователем, публиковавшим по этой теме несколько раз, был @mask_3dcg.

Посты
  1. @OpenAI — 52,200 лайков · 8,156 репостов · 2,091 ответ · около 8,7 млн просмотров · 2026-09-23
    https://x.com/OpenAI/status/2102460975790137662

    Пожалуйста, встречайте GPT-6 Sol и GPT-6 Luna во вселенной GPT-6. [...] они переносят значительную часть сильных сторон [GPT-6 Astra] в более быстрые и доступные модели
    Главная новость закрытого сегмента: официальный анонс двух производных моделей, которые переносят способности GPT-6 Astra в более быстрый и дешёвый формат.

  2. @umiyuki_ai — 184 лайка · 29 репостов · около 47,000 просмотров · 2026-09-22
    https://x.com/umiyuki_ai/status/2102485745328165103

    OpenAI выставила GPT-6 Sol и Luna против Opus 5.5! [...] Похоже, и Sol, и Luna не особенно прибавили в качестве по сравнению с 5.6. Но они стали дешевле [...] После того как Opus 5.5 превзошёл Fable 5.1, GPT-6 Sol тоже Astra
    Реакция на официальный анонс: скептическое прочтение, согласно которому суть — в снижении цены, а не в росте производительности.

  3. @so_ainsight — 26 лайков · 4 репоста · около 3,400 просмотров · 2026-09-23
    https://x.com/so_ainsight/status/2102641613612990946

    GPT-6 Astra x сайт недвижимости → 3D-пространство, это безумие [...] На входе только 20 фотографий объекта · интерьер сделан с GPT-6 Astra (ИИ OpenAI) и Unreal Engine
    Пример создания доступного для прогулки 3D-пространства всего по 20 фотографиям объекта недвижимости. Практический сценарий использования GPT-6 Astra.

  4. @npaka123 — 283 лайка · 40 репостов · около 31,000 просмотров · 2026-09-23
    https://x.com/npaka123/status/2102594385758347548

    Тестирую Opus 5.5. Промпт: создай 3D-шутер. [...] Если всё получится, его можно пройти примерно за минуту. Добавь и BGM, и SE
    Проверка, в которой Claude Opus 5.5 одним промптом создаёт полный 3D-шутер, включая музыку и звуковые эффекты.

  5. @seiiiiiiiiiiru — 476 лайков · 49 репостов · около 27,000 просмотров · 2026-09-23
    https://x.com/seiiiiiiiiiiru/status/2102636308707287201

    Вручную расставлять ключевые кадры теперь уже просто глупо. Это запусковой ролик, который ИИ сделал с Claude Opus 5.5, управляя Higgsfield и After Effects. [...] Вышло примерно на 150 иен
    Opus 5.5 напрямую управляет Higgsfield и After Effects при создании запускового видео; заявленная стоимость — около 150 иен.

  6. @kevin_t_ngo — 2,451 лайк · 115 репостов · около 152,000 просмотров · 2026-09-23
    https://x.com/kevin_t_ngo/status/2102761406315839798

    Спасибо @claudeai! GIF анимирован в Python и отрендерен в Blender Claude Opus 5.5
    Наиболее вовлечённый пост по ИИ-тематике среди собранных. Opus 5.5 сделал и Python-анимацию, и рендеринг в Blender.

  7. @aicreataro — 325 лайков · 46 репостов · около 29,000 просмотров · 2026-09-23
    https://x.com/aicreataro/status/2102656273112326609

    Тест: заставил Opus 5.5 управлять After Effects и обработать ИИ-видео. ■ Основа: один 15-секундный ролик MiniMax H3 ■ Что поручил AE: подогнать скорость на стыках кадров к ритму · по одному эффекту для каждого отрезка
    Пример автоматизации этапа после генерации: Opus 5.5 обрабатывает видео MiniMax H3 в After Effects, синхронизируя его с ритмом и добавляя эффекты.

  8. @sonia_code — 377 лайков · 33 репоста · около 19,000 просмотров · 2026-09-22
    https://x.com/sonia_code/status/2102367557303021766

    Разве это не очень атмосферно? Попросила Astra создать болото на закате [...] Оно работает в браузере, так что можно мышью осматриваться в любом направлении
    Astra создаёт 3D-пейзаж, где пользователь может свободно менять точку обзора прямо в браузере.

  9. @yachimat_manga — 73 лайка · 13 репостов · около 7,700 просмотров · 2026-09-21
    https://x.com/yachimat_manga/status/2102181794057420889

    Может, в эпоху Astra уже оптимально просто задавать референс фона для каждого кадра? [...] Возможно, направление, в котором мы грубой силой воспроизводим существующий производственный процесс анимации, всё ещё достаточно сильное
    Практическое наблюдение: даже после появления Astra в производстве анимации может оставаться сильным подход «силой воспроизводить существующий процесс».

  10. @mask_3dcg (2 поста, 224 лайка / около 22,000 просмотров · 2026-09-22 и 1,589 лайков / около 246,000 просмотров · 2026-09-23)
    https://x.com/mask_3dcg/status/2102234787184537669
    https://x.com/mask_3dcg/status/2102715480494752222

    Такая уникальная анимация персонажей ИИ действительно не под силу, поэтому, думаю, люди будут нужны всегда
    Немедленно беру. Самое нужное в эпоху ИИ — аниматор. В CG-анимации ИИ не может хорошо сделать ничего, кроме заданных шаблонов
    Контртезис к восторгам вокруг генеративного ИИ. Второй пост набрал более 220 тыс. просмотров и стал вторым по охвату ИИ-постом в выборке, что указывает на заметную поддержку идеи о том, что ИИ не заменит нестандартную анимацию.

Сигналы
  • Рост: посты концентрируются на Claude Opus 5.5 не как на инструменте для «самой генерации изображений и видео», а как на оркестраторе, управляющем существующими инструментами — Higgsfield, After Effects, Blender, MiniMax H3 (#4–#7). Особенно заметно поручение ИИ этапов обработки и финальной доводки.
  • Рост: создание 3D-пространств для прогулки по нескольким фотографиям (#3, GPT-6 Astra + Unreal Engine). Это направление сочетает генеративный ИИ с готовыми игровыми движками.
  • Гонка за снижением цен: анонс GPT-6 Sol/Luna воспринимается скорее как история о «скорости и доступности», чем о росте качества (#2).
  • Отвержение / контртезис: пост профессионального 3DCG-креатора, прямо отрицающий возможность замены анимации персонажей ИИ, получил высокую реакцию (#10, более 220 тыс. просмотров). Возражения против идеи всемогущего генеративного ИИ имеют определённую поддержку.
  • Неожиданное наблюдение: из 10 трендов, которые X показал в этой сессии, лишь 3 касались генерации изображений и видео; остальные 7 (криптовалюты, сплетни о Тейлор Свифт, реклама ставок на футбол, акции уранодобычи, локальные темы, NFT-минты) были полностью нерелевантны. То есть в этот момент и в этом регионе ИИ для изображений и видео не был главным сюжетом «что сейчас происходит» на X, а лишь едва проступал под общими технологическими трендами.
  • В собранных постах совсем не было упоминаний моделей или инструментов open source, таких как Flux, Stable Diffusion, HunyuanVideo, Wan или ComfyUI.
Ограничения
  • Поисковые запросы были выбраны не из темы, а непосредственно из регионально оптимизированного списка трендов X Explore, доступного сессии из Хорватии. Семь из десяти слов (Cardano, $SONG, Taylor, England, #uranium, Croats, NFTs) не относятся к теме, поэтому результаты этих поисков исключены из отчёта.
  • Тренды Explore отражают только то, что видно «из Хорватии в этой сессии», а не глобальные тренды.
  • Пост @videoai_otaku (#30, https://x.com/videoai_otaku/status/2102264981807153234) не содержал ни текста, ни изображения, поэтому его содержание нельзя было процитировать; вероятно, это пост только с видео.
  • Не выполнялся поиск по конкретным закрытым инструментам генерации, таким как «Sora», «Veo», «Midjourney», «Runway», и по открытым инструментам, таким как «Flux», «Wan», «HunyuanVideo», «ComfyUI». Поэтому упоминания этих продуктов в X не отражены в этом отчёте.
  • По указанным причинам о динамике open source из X можно извлечь почти нулевые выводы: в собранных данных нет прямых упоминаний открытых моделей или инструментов. Десять наблюдений об открытой стороне необходимо дополнять материалами с других платформ.

YouTube

YouTube — Новости ИИ для генерации изображений и видео

Каналы

На этом этапе названия каналов и количество подписчиков отдельных видео нельзя было напрямую получить со страниц (см. раздел «Ограничения» ниже), поэтому отдельно указаны авторы, подтверждённые по заголовкам и описаниям поисковой выдачи, и каналы, в целом известные постоянным освещением этой темы.

  • OpenAI (официальный канал) — опубликовал запусковой ролик ChatGPT Images 2.5 «Introducing ChatGPT Images 2.5». Официальный корпоративный канал — главный источник первичной информации в этой выборке.
  • Muapi (канал с туториалами) — в ролике «GPT Image 2.5 API (ChatGPT Images 2.5) — What's New + How to Access It» объясняет использование новых моделей Flare / Sunburst для API-пользователей.
  • В выдаче также нашлись многочисленные сравнительные и обзорные видео: «Kling 3.0 and Omni FULL guide», «Seedance 2.5 vs Minimax H3 vs Google Omni vs Kling 3.0», «China Did It AGAIN? – 100+ Wan 3.0 AI Videos», «LTX-2.3 Review», «New Qwen Image 2512» и другие, но названия их каналов не удалось подтвердить из-за недоступности страниц.
  • В качестве общего дополнения: web-поиск подтвердил, что Curious Refuge (специализация на ИИ-видеопроизводстве и обучении рабочим процессам), Matt Wolfe (еженедельные подборки ИИ-новостей) и The AIGRID (срочные новости генеративного ИИ) регулярно освещают этот жанр. Однако не подтверждено, что именно они опубликовали отдельные ролики, найденные в этой выборке.
Видео
  1. Introducing ChatGPT Images 2.5 — OpenAI (официальный) — около 2026-09-08 — просмотры неизвестны
    https://www.youtube.com/watch?v=6l7ble9P74o
    Официальное запусковое видео ChatGPT Images 2.5 (новые модели GPT-Image-2.5 Flare / Sunburst). Представлены сокращение времени генерации до 50%, лучшая согласованность при редактировании и редактирование на основе комментариев.

  2. GPT Image 2.5 API (ChatGPT Images 2.5) — What's New + How to Access It — Muapi — начало сентября 2026 — просмотры неизвестны
    https://www.youtube.com/watch?v=nk2u6ENW85Q
    Туториал по различиям и использованию моделей Flare/Sunburst через API. Sunburst описывается как старшая версия с предварительным вычислением (планированием).

  3. Nano Banana Pro: Hands-on with the World's Most Powerful Image Model — 2025-11-25 — просмотры неизвестны
    https://www.youtube.com/watch?v=hk6gwiZmSWA
    Практический обзор Nano Banana Pro на базе Google DeepMind Gemini 3 Pro. Демонстрируется улучшенная точность текстового рендеринга и генерации инфографики. Хотя с публикации прошло почти 10 месяцев, связанные ролики продолжают выходить, что указывает на долгий жизненный цикл темы.

  4. Kling 3.0 and Omni FULL guide 2026 — 2026-04-04 — просмотры неизвестны
    https://www.youtube.com/watch?v=tEdHJohIUlM
    Полное руководство по Kling 3.0 / Kling 3.0 Omni от Kuaishou. Объясняет функцию «AI Director», позволяющую создать последовательность до шести кадров за одну генерацию.

  5. Seedance 2.5 vs Minimax H3 vs Google Omni vs Kling 3.0 | Full Comparison — 2026-08-14 — просмотры неизвестны
    https://www.youtube.com/watch?v=G5D053drKB8
    Параллельное сравнение четырёх ведущих закрытых моделей: ByteDance Seedance 2.5, MiniMax H3, Google Omni и Kling 3.0. Репрезентативное сравнение расстановки сил в закрытом сегменте ИИ-генерации видео по состоянию на август 2026 года.

  6. FREE Wan 3.0: what actually shipped (there are no weights) and How to use it for FREE
    https://www.youtube.com/watch?v=gbI8XV4Szrk
    Видео указывает, что Alibaba Wan 3.0 вышла как API-only бета без опубликованных весов. До Wan 2.2 модели были open-weight, однако в Wan 3.0 компания перешла к закрытому курсу; аналогичное утверждение подтверждалось несколькими результатами общего web-поиска.

  7. China Did It AGAIN? – 100+ Wan 3.0 AI Videos — 2026-08-10 — просмотры неизвестны
    https://www.youtube.com/watch?v=fNvv2u-1cGw
    Подборка более 100 сгенерированных видео, созданных в публичной бете Wan 3.0, начавшейся 6 августа 2026 года. Подчёркивается возможность генерации единого кадра длиной до 30 секунд — вдвое больше 15 секунд Wan 2.7.

  8. LTX-2.3 Review: The Open-Source AI Video Model Built for Creators — 2026-08-11 — просмотры неизвестны
    https://www.youtube.com/watch?v=qQXzlk134Sw
    Обзор LTX-2.3 от Lightricks. Отмечается, что среди open-source моделей генерации видео именно она единственная одновременно создаёт аудио и видео в одном проходе инференса (поддержка 4K/50fps).

  9. LTX 2 Full Tutorial | Run on Low VRAM PC + Video & Audio AI Generation (2026 Strongest Open-Source?) — 2026-01-11 — просмотры неизвестны
    https://www.youtube.com/watch?v=ytxbq9ZSgxo
    Туториал по локальному запуску LTX-2 в среде с малым VRAM. Объясняется настройка через ComfyUI/SwarmUI и подчёркивается удобство модели среди open-source решений для генерации видео.

  10. New Qwen Image 2512: Better Than Z-Image? (Open Source & Free)
    https://www.youtube.com/watch?v=uAGH_yRZ2Gw
    Сравнение Qwen-Image-2512 от команды Alibaba Tongyi Chat (лицензия Apache 2.0, 20 млрд параметров) и Z-Image Turbo. Несколько обзорных видео одновременно затронули это соперничество за лидерство в open-source генерации изображений.

  11. Can MiniMax H3 Beat Seedance 2.5? My ComfyUI Workflow
    https://www.youtube.com/watch?v=zwam3nJTNrI
    Проверка MiniMax H3, опубликованной на Hugging Face 3 августа 2026 года (33 млрд параметров, Community License), в рабочем процессе ComfyUI. Однако эта лицензия прямо исключает использование в США, ЕС, Великобритании и Южной Корее; по одному этому видео нельзя подтвердить, затронута ли данная деталь.

  12. FLUX 3 Might Be the Open Source Sora 2 We Deserve — 2026-07-24 — просмотры неизвестны
    https://www.youtube.com/watch?v=1s3zslFOSh0
    Знакомство с FLUX 3 от Black Forest Labs — мультимодальной моделью для видео, аудио, изображений и робототехники. В заголовке заявляется «open source», но по состоянию на июль 2026 сама FLUX 3 была доступна лишь как закрытая early-access-версия; open-weight FLUX 3 Dev лишь заявлена в дорожной карте и ещё не опубликована. Следует с осторожностью относиться к многочисленным видео, смешивающим «планируется стать open source» и «уже является open source».

Сигналы
  • Гонка закрытого сегмента за снижением цен и ускорением: у ChatGPT Images 2.5 время генерации сократилось на 50%, а AI Director Kling 3.0 создаёт несколько кадров за одну генерацию и уменьшает затраты. В обзорах YouTube последовательно повторяется тот же фрейм «быстрее и дешевле», что и при обсуждении GPT-6 Sol/Luna на X (output/x.md), вместо акцента на росте качества.
  • Расхождение между заявлениями об open source и реальностью: хотя ранние модели Alibaba до Wan 2.2 были open-weight, Wan 3.0 перешла к API-only и весам, которые не публикуются; несколько объясняющих роликов прямо называют её фактически закрытой. И наоборот, FLUX 3 в заголовках называется «Open Source», хотя доступна лишь закрытая early-access-версия. На примере этих двух моделей отчётливо видна разница между брендингом и фактическим статусом.
  • Новый сценарий: open-weight, но доступность ограничена регионами: MiniMax H3 — редкая крупная модель генерации видео, публикующая веса на Hugging Face, но её Community License прямо запрещает локальный запуск в США, ЕС, Великобритании и Южной Корее. Предпосылка «open-weight = любой может свободно использовать» начинает разрушаться.
  • Сравнительные обзоры становятся главным форматом жанра: роликов с сопоставлением нескольких моделей — вроде «Seedance 2.5 vs MiniMax H3 vs Wan 3.0» — особенно много. Для этой категории на YouTube характернее проверка «какая модель сильнее», чем глубокий разбор одного продукта.
  • Заметность моделей из Китая: Kling (Kuaishou), Seedance (ByteDance), Wan (Alibaba), MiniMax H3, Qwen-Image (Alibaba Tongyi) часто находятся в центре обсуждений генерации видео и изображений. Наряду с американскими GPT Image, Nano Banana Pro и FLUX формируется двухполюсная структура.
Ограничения
  • WebFetch, использованный на этом этапе, и на странице результатов YouTube (/results?search_query=…), и на страницах видео (/watch?v=…) возвращал не реальные данные, а лишь навигационные ссылки из футера (копирайт и т. п.). При попытке обратиться к /@channel/about страница видео перенаправлялась с кодом 302 на consent.youtube.com — страницу согласия с cookie для региона gl=HR, то есть Хорватии. Вероятно, состояние региона и согласия с cookie в этой сессии мешает получить HTML без исполнения JS. Это согласуется с тем, что тренды X Explore (output/x.md) также относились к хорватскому региону.
  • Поэтому не удалось напрямую подтвердить ни просмотры, ни количество подписчиков каналов, ни конкретные комментарии — ни для одного видео. Заголовки, даты публикации и содержание основаны на сниппетах WebSearch и внешних статьях; требования playbook к секции Channels с подписчиками и просмотрам каждого видео не выполнены.
  • Для большинства отдельных роликов также не удалось определить название публикующего канала: оно отсутствует в заголовке результатов поиска.
  • Содержание комментариев вообще не проверялось, то есть требование playbook «прочитать и топ-комментарии» не выполнено.
  • Поиск был ориентирован на английские ключевые слова (Kling 3.0 / Nano Banana Pro / Wan 3.0 / LTX-2 / Qwen-Image / Flux 3 / Seedance 2.5 / MiniMax H3 / GPT Image 2.5). Японские каналы и реакции японскоязычного YouTube не исследовались.
  • Относительно критерия завершения «проанализировать около 20 постов»: YouTube — платформа видео, а не постов как X/Reddit, поэтому сбор остановлен на 12 видео, причём количественные данные удалось получить для нуля из них. Дальнейшее расширение поиска едва ли дало бы метрики из-за технического ограничения WebFetch.

Bluesky

Bluesky — Новости ИИ для генерации изображений и видео

Аккаунты
  • oludai.bsky.social («🚀 olud.ai») — бот (1,543 поста, 948 подписчиков), ежечасно публикующий обновления по ИИ: запуски моделей, изменение цен, динамику GitHub stars и, что здесь наиболее важно, регулярный «медиа-лидерборд», сравнивающий модели генерации изображений и видео по слепым предпочтениям людей.
  • ai.bots.law — бот судебных документов, публикующий новую запись при каждом движении в авторско-правовых исках об ИИ, включая Disney v. Midjourney и Andersen v. Stability AI.
  • midjourneyofficial.bsky.social — официальный аккаунт Midjourney. Публикует редко и непринуждённо («Как прошли выходные?»), не является источником продуктовых новостей.
  • Японские создатели ИИ-иллюстраций, ежедневно публикующие работы Stable Diffusion/SDXL с хештегами #AIイラスト #StableDiffusion: kazanomiya.bsky.social, michi84.bsky.social, garakuta76.bsky.social, blackmagnet3400.bsky.social.
  • Сообщество любителей искусства Midjourney: johndoesmidjourney.bsky.social, dalyrceri.bsky.social, ttaships.airminded.org, un1v3rse.bsky.social, nevyn79.bsky.social, stumblegirl.bsky.social — ежедневные работы, а не новости, но они показывают, что повседневное использование ИИ-арта на платформе тяготеет к зрелым инструментам.
  • index.photoshoproadmap.com.ap.brid.gy — аккаунт, связанный с федеративной сетью через Bridgy Fed, обсуждающий практические проблемы рабочих процессов Photoshop/Nano Banana.
Посты
  1. oludai.bsky.social, 2026-09-23 (1 лайк) — «🎨 Положение open source в генерации изображений: #14 Qwen-Image-3.0-Pro — лучшая модель, которую можно действительно скачать. На 108 ELO пунктов позади GPT Image 2.5 Sunburst (max) (OpenAI). Слепые предпочтения людей, а не маркетинг». → пост
  2. oludai.bsky.social, 2026-09-22 (2 лайка) — «🏆 Модель с открытыми весами лидирует в генерации видео. Wan 3.0 возглавляет рейтинг человеческих предпочтений — опережая все закрытые модели. Её можно скачать и запустить самостоятельно». → пост
  3. oludai.bsky.social, 2026-09-22 (0 лайков) — «🎨 Положение open source в редактировании изображений: #16 Qwen-Image-3.0-Pro — лучшая модель, которую можно действительно скачать. На 101 ELO пункт позади GPT Image 2.5 Sunburst (max) (OpenAI)». → пост
  4. oludai.bsky.social, 2026-09-21 (1 лайк) — «🚀 Вышла ComfyUI v0.37.0 … ⭐ 134,258 звёзд. Все open-source ИИ-релизы →olud.ai/releases.html». → пост
  5. ai.bots.law, 2026-09-23 (0 лайков) — «Новый документ: Disney v. Midjourney (истцы судятся с Midjourney из-за обучения на защищённых авторским правом персонажах и их генерации). Документ #206: (В КАМЕРАХ) РАСПОРЯЖЕНИЕ О СЛУШАНИИ ХОДАТАЙСТВА О РЕШЕНИИ ПО ЗАЯВЛЕНИЯМ СТОРОН». → пост
  6. ai.bots.law, 2026-09-23 (0 лайков) — «Новый документ: Andersen v. Stability AI (художники судятся из-за обучения ИИ на изображениях). Документ #759: Прочие меры правовой защиты». → пост
  7. index.photoshoproadmap.com.ap.brid.gy, 2026-09-24 (0 лайков) — «Generative Fill с Nano Banana на большом холсте часто создаёт растянутые или сжатые результаты с заметными краями выделения. Проблема — в несоответствии разрешения: модель генерирует в небольшой области, а затем результат масштабируется под гораздо больший документ». → пост
  8. kazanomiya.bsky.social, 2026-09-23 (40 лайков, 5 репостов) — «Доброе утро» #AIイラスト #AIart #StableDiffusion #SDXL — пост с наибольшей вовлечённостью, найденный в общей ленте ИИ-арта; иллюстрирует повседневное использование SD/SDXL японским сообществом. → пост
  9. midjourneyofficial.bsky.social, 2025-08-15 (41 лайк, 4 репоста) — «#Midjourney теперь в BlueSky! За какими лучшими креаторами здесь стоит следить?» — запусковой пост аккаунта, до сих пор самый вовлечённый. → пост
Сигналы
  • Закрытый сегмент всё ещё лидирует по чистому качеству в обеих задачах с изображениями. В лидерборде слепых предпочтений olud.ai «GPT Image 2.5 Sunburst» (OpenAI) занимает первое место как в генерации, так и в редактировании; лучшая скачиваемая открытая модель Qwen-Image-3.0-Pro отстаёт более чем на 100 ELO пунктов в обеих категориях (№14 в генерации, №16 в редактировании).
  • В генерации видео картина обратная. Тот же трекер сообщает, что open-weight Wan 3.0 возглавляет рейтинг человеческих предпочтений в видео и опережает всех закрытых конкурентов — это единственная категория, где open source, по имеющимся данным, уже №1, а не просто догоняет.
  • Юридическое давление на закрытых и полуоткрытых игроков продолжало нарастать на этой неделе. В один день, 23 сентября, появились новые движения и в Disney v. Midjourney (обучение и генерация защищённых авторским правом персонажей), и в Andersen v. Stability AI (иск художников по поводу данных для обучения изображений). Ответственность за авторские права в обучении остаётся ключевым сюжетом для поставщиков коммерческих хостинговых продуктов.
  • Инфраструктурный слой open source быстро развивается, даже если качество моделей отстаёт. ComfyUI, доминирующий node-based UI для локального запуска открытых diffusion/video моделей, на этой неделе выпустил v0.37.0 и имеет более 134 тыс. звёзд GitHub. Инфраструктура уверенно набирает темп независимо от позиций в лидербордах.
  • Органичное повседневное сообщество ИИ-арта в Bluesky тяготеет к зрелым потребительским инструментам, а не к передовым релизам. Самые активные найденные авторы — в основном японские создатели «AIイラスト» и любители Midjourney — используют Stable Diffusion/SDXL и Midjourney ежедневно; не нашлось органичного обсуждения Sora, Veo, Kling, Runway или Grok Imagine.
  • Nano Banana (модель изображений Google) дошла до стадии «устраняем проблемы в продакшене», а не только демонстраций новизны. Пост о процессе Photoshop диагностирует конкретную неисправность Generative Fill — несоответствие разрешения, вызывающее растяжение изображения. Это больше похоже на массовое внедрение, чем на ранний хайп.
Ограничения
  • Задокументированный в playbook публичный endpoint поиска app.bsky.feed.searchPosts возвращал HTTP 403 Forbidden для каждого опробованного запроса — по одиночным ключевым словам, многословным фразам, с sort=latest и без него. Этот fetch-клиент совсем не мог выполнить буквальный поиск по индексу постов Bluesky. Другие публичные API-операции на том же хосте (getProfile, getPostThread, getAuthorFeed, getFeed) работали нормально, так что блокировка, по-видимому, касается именно поиска.
  • В качестве обходного пути были найдены подходящие аккаунты и ленты через web-поиск, после чего их реальные материалы и показатели вовлечённости запрашивались через getAuthorFeed/getPostThread/getFeed (публичный пользовательский генератор ленты «AI art»). Это более узкая выборка, смещённая способом поиска, а не исчерпывающее сканирование платформы. Поэтому «20 постов по теме» здесь означает 20 постов из доступной выборки, а не из полного поиска по платформе.
  • В доступной выборке не было нативного обсуждения Bluesky, прямо называющего Sora, Sora 2, Veo, Kling, Runway Gen-4, Grok Imagine или Seedream. С учётом блокировки search API это скорее пробел выборки, чем подтверждённая тишина платформы; отсутствие этих названий не следует считать выводом.
  • Сам bsky.app — клиентское одностраничное приложение; при прямом запросе его веб-страницы не содержат текста постов, поэтому вся работа по чтению на этом этапе выполнялась через JSON API, а не через отрендеренный сайт.

Lemmy

Lemmy — Динамика ИИ для генерации изображений и видео

Lemmy — небольшая федеративная социальная сеть, но вокруг !«メールアドレス» активно общаются сторонники локального ИИ, а через сообщество ai_reddit на lemmy.durstig.online (зеркало/мост Reddit r/ArtificialIntelligence) попадают новости и о закрытом сегменте. Через API-поиск (https://lemmy.world/api/v3/search) были проверены ключевые слова "Stable Diffusion", "Midjourney", "Sora", "Flux", "ComfyUI", "Kling AI", "Nano Banana", "Black Forest Labs", "Wan 2.2", "Grok Imagine" и другие.

Сообщества
  • !«メールアドレス» — 5,710 подписчиков. Главный хаб новостей и инструментальных постов об ComfyUI и open-weight моделях.
  • !«メールアドレス» — место публикации ИИ-сгенерированных художественных работ; новостная ценность невысока.
  • !«メールアドレス» — специализированное сообщество аниме-ИИ-арта.
  • !«メールアドレス» — специализированное сообщество абстрактного ИИ-арта.
  • !«メールアドレス» — 52 подписчика (1 локальный пользователь), 25,8 тыс. постов и 155 пользователей в месяц. Сообщество, которое мостом переносит материалы из r/ArtificialIntelligence; там много новостей о Nano Banana, Seedream, Sora/Kling.
  • !techtakes (сеть dbzer0) — сообщество с критическим отношением к ИИ-индустрии; найдены посты о Midjourney.
  • !technology — общее технологическое сообщество, где нашлись крупные новости о Midjourney.
  • !tech — найдены новости, связанные с Black Forest Labs.
Посты
  1. Qwen-Image-2.1 in ComfyUI: Open-Weight Image Generation and Editing, Now with Transparency (open source)
    !«メールアドレス» / 13 апвоутов / 2026-09-22
    https://lemmy.dbzer0.com/post/75874773

  2. chanon/comfyui-obvpm-timeline: ComfyUI timeline and clip extension nodes for Minimax H3 (open source, рабочий процесс редактирования видео)
    !«メールアドレス» / 6 апвоутов / 2026-09-22
    https://lemmy.dbzer0.com/post/75874770

  3. SparknightLLC/ComfyUI-NodeSnapshots (ускорение фронтенда ComfyUI, рост FPS в 2–3 раза)
    !«メールアドレス» / 3 апвоута / 2026-09-22
    https://lemmy.dbzer0.com/post/75874771

  4. SupraLabs/Supra2-IMG — сверхлёгкая text-to-image модель на 100M параметров (open source)
    !«メールアドレス» / 7 апвоутов / около 2026-09-23

  5. The AI Horde has a new Interface, a new Image generation frontend, new backend, and all new documentation! (обновление открытого распределённого проекта генерации изображений AI Horde)
    !«メールアドレス» / 12 апвоутов (3 даунвоута) / около 2026-09-20

  6. OpenAI is shutting down Sora's API next week while a chinese competitor just raised $3 billion. that's the whole story of ai video right now (сравнение закрытого сегмента и китайских конкурентов)
    !«メールアドレス» / 1 апвоут / 2026-09-20
    https://lemmy.durstig.online/post/61333
    → OpenAI прекращает Sora API 24 сентября, а Kling привлекает 3 млрд долларов. Анализ утверждает, что потребительское ИИ-видео не приносит прибыли, а основным направлением становятся корпоративные задачи — обучение и демонстрации продуктов.

  7. Same Berserk spread, 4 AI colorizations. Looks like GPT wins again? (сравнение качества Nano Banana Pro)
    !«メールアドレス» / 1 апвоут / 2026-09-14
    https://lemmy.durstig.online/post/60037

  8. Black Forest Labs launches FLUX 3 capable of generating images and 20-second video with audio — but in limited release to start (ограниченный выпуск, склоняющийся к закрытой модели)
    !tech / 3 апвоута (2 даунвоута) / 2026-07-24
    https://bfl.ai/blog/flux-3

  9. Midjourney wants Hollywood studios to reveal the details of their AI usage (закрытый сегмент, авторско-правовой спор)
    !technology / 75 апвоутов / 2026-07-05
    https://techcrunch.com/2026/07/04/

  10. Elon Musk maakt complete AI-film met zijn versie van The Odyssey (заявление о полном ИИ-фильме «Одиссея» с Grok Imagine, закрытый сегмент)
    !films / 1 апвоут / 2026-07-22
    https://lemy.nl/post/4342454

  11. Seedream 5.0 Pro is here: an honest comparison and technical breakdown (сравнительный бенчмарк с Nano Banana Pro)
    !«メールアドレス» / 1 апвоут / 2026-07-10
    https://lemmy.durstig.online/post/46063

  12. black-forest-labs/FLUX.2-klein-9b-kv-fp8 (публикация open-weight)
    !stable_diffusion / 8 апвоутов / 2026-03-14
    https://huggingface.co/black-forest-labs/FLUX.2-klein-9b-kv-fp8

  13. Midjourney AI pivots to Theranos: Ultrasonic CT (критическая статья об уходе Midjourney в бизнес ультразвуковых сканеров)
    !techtakes / 41 апвоут / 2026-06-19
    https://pivot-to-ai.com/2026/06/19/

  14. Google quietly discontinues its Earth AI feature a day after its rollout (функция с интеграцией Nano Banana была отозвана на следующий день из-за злоупотреблений)
    !«メールアドレス» / 1 апвоут / 2026-08-07
    https://lemmy.durstig.online/post/52162

Сигналы
  • Главное поле деятельности open source — разработка инструментов и узлов вокруг ComfyUI: постов о рабочих процессах и ускорении существующих моделей — Qwen-Image, Minimax H3, FLUX и других — больше, чем постов о самих новых моделях. Движение не самое броское, но стабильное.
  • У закрытых игроков «деньги» и «скандалы» идут вместе: прекращение Sora API против 3 млрд долларов Kling, критика поворота Midjourney к ультразвуковым сканерам как «превращения в Theranos» — заметнее новости об управлении, капитале и этике, чем о технологии как таковой.
  • Nano Banana (Google) становится стандартным объектом сравнения в закрытой генерации изображений: её сопоставляют с Seedream 5.0 и GPT в задачах колоризации, а истории о злоупотреблениях в Google Earth показывают и негативную сторону.
  • Black Forest Labs (FLUX) использует промежуточную стратегию между открытостью и закрытостью: выпускает open-weight компактные модели вроде FLUX.2-klein-9b, но FLUX 3 для изображений + 20-секундного видео с аудио запускает как «limited release», то есть более закрытым способом.
  • Собственного уникального ракурса Lemmy почти нет: большинство найденных новостных постов — ссылки на внешние источники, Reddit, TechCrunch, HuggingFace, bfl.ai и другие. Независимого первичного анализа пользователей Lemmy почти не обнаружено. Работ с ИИ-артом много, но это не «новости».
Ограничения
  • Lemmy крайне мал: даже у сообщества ai_reddit всего 52 подписчика и 1 локальный пользователь. Поиск по видео-ИИ ("video generation AI" отдельно, "Runway AI", "Kling AI", "Wan 2.2") дал нулевое число результатов.
  • При целевом критерии в 20 проанализированных постов реально нашлось примерно 14 материалов с новостной ценностью. Остальные были периферийными постами о сопряжённых инструментах вроде интеграций ComfyUI или художественными ИИ-работами из stable_diffusion_art, stable_diffusion_abstract, share_anime_art, поэтому были исключены. Лучше сообщать только о реально найденных материалах, чем искусственно размывать выборку до 20.
  • Поиски по lemmy.ml и lemm.ee были явно проведены, но результаты в значительной степени повторяли федеративную выдачу API lemmy.world и не дали дополнительной первичной информации.
  • Содержимое, полученное WebFetch, прошло через ИИ-суммаризацию, поэтому при переводе относительных дат («1 day ago» и т. п.) в абсолютные возможна небольшая погрешность.

Pinterest

Pinterest — Новости ИИ для генерации изображений и видео

По запросу "Image and Video Generation AI News" собрано 50 пинов без жанрового разделения. 30 из 50 изображений были открыты и просмотрены непосредственно; заголовки остальных были прочитаны из pinterest.pins.md.

Визуальные темы
  • Формат YouTube-превью «AI NEWS»: бородатый белый мужчина с шокированным или широко раскрытыми глазами рядом с рядом светящихся 3D-логотипов технобрендов (OpenAI, Google, Microsoft, Meta, значок в стиле Anthropic, Notion). Этот шаблон с разными наборами логотипов повторяется [1, 27, 48] — очевидно, это стиль превью постоянного новостного канала, а не органичный пользовательский контент.
  • Лицо киборга / наполовину человека, наполовину робота: лицо, разделённое пополам — человек с одной стороны и хромированный робот с другой, — используется как общий образ «ИИ уже здесь» [32, 41, 47]. Также встречается полный портрет хромированного андроида с голубыми светящимися глазами [12].
  • Неоновые киберпанк-макеты UI: тёмно-синий фон, светящиеся розовые/фиолетовые/голубые скруглённые блоки, в центре иконка сообщения «AI», от которой идут значки «Generate Image / Music / Video / Text / Link». Одинаковая графика Adobe Stock с watermark встречается дважды под разными ID пинов [5, 16] — это повторное использование/репин стокового изображения, а не свежий контент.
  • Тревога вокруг дипфейков и дезинформации: хромированный робот держит телефон рядом с фото кота со штампом «FAKE» и счётчиками лайков/просмотров [3]; клип NBC News с репортёром в снегу и подписью «AI GENERATED» [33]; разделённый экран «Human Journalism vs Machine-Generated Media» [22]; простая надпись «AI GENERATED NEWS CLIP» поверх кадра с говорящим человеком [50]. Четыре независимых пина продвигают одну тревогу: можно ли доверять увиденному.
  • Сравнительные таблицы инструментов: плотные инфографики сопоставляют закрытые сервисы: ChatGPT Plus, Gemini Advanced, Midjourney, Adobe Firefly, Recraft, Runway Gen-3, Luma AI, Pika Pro, Kaiber AI, Synthesia в категории «платно/лучшее качество» и Ideogram, Gemini Free, SeaArt AI, Playground AI, Krea AI, Canva AI, CapCut AI в категории «бесплатно» [9]. Вторая инфографика подводит итоги новостного дня «Google I/O 2026» (Gemini 3.5 Flash, Gemini Omni, очки Android XR) [30].
  • Демонстрации style transfer и согласованности: сетка с брендом Luma преобразует одно исходное видео человека в деревянные блоки, оригами, Lego-кирпичи и версии, покрытые цветами, а также показывает автомобиль в разных материальных стилях. Это демонстрация согласованности стиля image-to-image между кадрами [2].
  • Мемный формат: мем с реакцией «144p vs 4K» шутит о скачках качества ИИ-апскейлинга/генерации [39] — единственный явно юмористический, а не рекламный пин в выборке.
  • Жёлто-оранжевая палитра «жизнерадостной SaaS-рекламы»: дружелюбные мультяшные роботы предлагают «AI Video Generation — превратите свои идеи в потрясающие видео за минуты» с рядом значков возможностей: script-to-video, ИИ-озвучивание, субтитры, редактор [8]. Это заметно иной регистр, чем мрачные неоновые киберпанк-пины, ориентированный на малый бизнес и креаторов.
Примечательные пины
  1. [1] «AI News: Anthropic Leak Shows Us The Future of AI...» — повторяющийся шаблон превью с шокированным ведущим, встречающийся трижды; сильный сигнал, что каналы с ИИ-новостями активно используют Pinterest для привлечения трафика.
  2. [2] Сетка style transfer с брендом Luma — самая наглядная конкретная демонстрация современной согласованности image/video-to-image: одно видео превращается в деревянную, оригами-, Lego- и цветочную версии с сохранением субъекта и позы.
  3. [9] Таблица решений «Best AI Video Generators in 2026: Veo, Kling...» — самый плотный список конкретных закрытых инструментов (16+ брендов) во всей подборке, полезный как чек-лист того, что считается актуальным.
  4. [13] «Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API» — упоминает конкретную новую возможность: нативное аудио в image-to-video, а не общую рекламу.
  5. [25] «Google's Gemini Omni Turns Anything Into Video» — брендированный Osiz Technologies материал о мультимодальном направлении Gemini Omni, независимо повторяющемся в сводке Google I/O [30].
  6. [33] Клип NBC News с репортёром и подписью «AI GENERATED» — реальный вещатель использует экранную маркировку как главный сюжет пина; это показывает, что дискуссия о доверии и маркировке вышла в мейнстрим новостей.
  7. [37] «Introducing Luma Dream Machine - Next Generation AI Video» — экстремальный макрокадр глаза как визуал запуска модели видео, на которую по-прежнему ссылаются.
  8. [39] Мем «144p vs 4K» — единственный открыто юмористический пин; обыгрывает скачки качества генерации/апскейлинга, а не рекламирует инструмент.
  9. [40] «'Amuse 3.0', an AI art creation tool...» (бренд AMD) — фактически единственный пин в выборке, содержащий открытую или локальную инструментальную перспективу: приложение для создания ИИ-арта, ориентированное на GPU AMD. Всё остальное тяготеет к закрытому облачному SaaS.
  10. [49] «7 Best AI Baby Generators: Predict Your Child's Face (2026)» — развлекательный сценарий генерации лиц детей (морфинг возраста/отношений), отличающийся от новостного кластера и генераторов видео, что указывает на отдельный потребительский тренд.
Сигналы
  • Закрытые брендовые инструменты доминируют в визуальном языке. Почти каждый пин с заголовком называет конкретный коммерческий продукт: ChatGPT, Gemini/Gemini Omni, Veo 3, Kling, Midjourney, Adobe Firefly, Runway, Luma, Pika, Synthesia, Recraft, Ideogram, Krea, Canva. Только один пин во всём списке из 50 ([40], Amuse 3.0/AMD) хотя бы намекает на открытый или локальный инструмент; в заголовках и 30 открытых изображениях не появлялись Stable Diffusion, ComfyUI, Flux, Wan или HunyuanVideo. На Pinterest «ИИ для изображений/видео» сейчас воспринимается как категория закрытого потребительского SaaS, а не как среда разработчиков и open source.
  • Тревога о доверии и подлинности — реальная повторяющаяся подтема, а не единичный случай: четыре независимых пина [3, 22, 33, 50] полностью строятся вокруг вопроса «настоящее это или ИИ», включая реального вещателя NBC, использующего экранную маркировку. Это согласуется с пином об ИИ-ведущих новостей [47], где автоматизация новостных редакций сама по себе является заголовочной темой.
  • За один запрос конкурируют два визуальных регистра: холодные киберпанк/неоновые образы «ИИ уже здесь» (андроиды, светящиеся UI-макеты) и тёплая реклама SaaS с мультяшными маскотами (дружелюбные роботы, жёлтые фоны). Оба продают инструменты, но заметно разным аудиториям: техноэнтузиастам и малому бизнесу/креаторам.
  • Превью каналов с обзорами — отдельный жанр Pinterest: один и тот же шаблон «шокированное лицо + сетка логотипов» повторяется в похожем стиле [1, 27, 48], то есть часть контента «AI news» на Pinterest — это вторичные репины YouTube-превью, а не нативный контент Pinterest.
  • Отсутствует: в выборке не нашлось пинов о негативной реакции на цены, судебных исках/юридических спорах о данных для обучения или протестах сообществ художников, хотя на других платформах эти темы заметны. Ближе всего — пин о сделке ByteDance/Hollywood по авторским правам [7], но он подаёт защиту IP как уже решённый вопрос, а не как конфликт.
Ограничения
  • В таблице пинов нет разделения по жанрам: это единый плоский список из 50 материалов, поэтому отчёт не организован по жанрам, как потребовал бы жанровый вариант playbook.
  • 30 из 50 собранных изображений были открыты и описаны непосредственно; по оставшимся 20 есть только заголовки из pinterest.pins.md, а не содержание самих изображений. Поэтому некоторые визуальные паттерны среди них могут быть недоучтены.
  • Несколько пинов — дублирующиеся или почти дублирующиеся стоковые материалы под разными ID (например, [5] и [16] — одинаковая графика Adobe Stock), что немного завышает видимую частоту мотива неоновой ветвящейся ИИ-иконки.
  • Метаданные пинов не содержали цифр вовлечённости — лайков, сохранений, комментариев, — поэтому нельзя оценить популярность или вирусность; анализируются лишь содержание и свежесть закреплённого материала.
  • Этот этап посвящён только Pinterest; Reddit, X, YouTube, Bluesky и Lemmy рассматриваются в отдельных разделах отчёта.

Рекомендуемые действия

  • Проверьте фактический статус публикации весов Wan 3.0 напрямую у Alibaba/Hugging Face, прежде чем называть её открытой: источники Bluesky и YouTube противоречат друг другу.
  • Перед тем как называть модель «open source», изучайте условия лицензии, а не только маркетинговые заявления: в частности, FLUX 3 и регионально ограниченную Community License MiniMax H3.
  • Перед коммерческим использованием MiniMax H3 убедитесь, что регион развёртывания не исключён её Community License (США/ЕС/Великобритания/Южная Корея).
  • Для ИИ-видео отдавайте предпочтение корпоративным и коммерческим сценариям, а не потребительским бесплатным тарифам: прекращение Sora API и привлечение Kling $3 млрд указывают именно в эту сторону.
  • Отслеживайте документы по делам Disney v. Midjourney и Andersen v. Stability AI: их решения могут изменить отраслевую практику работы с обучающими данными.
  • Добавляйте явную маркировку ИИ-происхождения к сгенерированному контенту, учитывая повторяющуюся на Reddit и Pinterest негативную реакцию на нераскрытый ИИ-контент.

Собранные изображения

AI News: Anthropic Leak Shows Us The Future of AI...Google объявляет видео ультравысокого качества...Проблемы ИИ-контента и социальных сетейПросто сделай это идеально 🎥Концепция создания ИИ-контента с иконками для генерации текста, изображений, музыки и видео — Просмотрите 66 стоковых фотографий, векторов и видеоИИ-генерируемые видео для контент-маркетингаизображениеИИ для генерации изображений и видеоЛучшие ИИ-генераторы видео в 2026: Veo, Kling,...Бесплатная платформа генерации визуального контента с ИИ — Viva AIИИ-инструмент для преобразования текста в изображенияизображениеVeo 3 Image-to-Video: быстрая генерация и нативное аудио через Gemini APIГенерация изображений ИИСекреты ИИ-контент-студии и автоматизации 🚀📱изображениеKling.ai: генерация видео из текста с помощью ИИизображениеизображениеизображениеизображениеСмелая ставка Нью-Йорка: внутри законодательной...ИИизображениеGemini Omni от Google превращает что угодно в видео‎🚨 ИИ становится пугающе хорошим.AI News: OpenAI наконец выпустила то, о чём мы просилиПрофессиональное создание ИИ-видео | Кинематографические ИИ-видео | Пользовательское редактирование видеоизображениеЛучшие ИИ-генераторы видео 2025 годаизображениеГенерация изображений ИИ и индустрия развлеченийИИ-новости в видео размывают границу между реальными и поддельными репортажамиСекретное оружие контент-креаторов: генерация видео с ИИизображениеизображениеПредставляем Luma Dream Machine — ИИ-видео нового поколенияГенеративный ИИ: полное руководство для начинающих (2026)Мем Oh My God (OMG) | Промпт 144p vs 4K | Промпт генерации ИИ-изображений | Безумная разница в качестве«Amuse 3.0», инструмент создания ИИ-арта, включающий...ИИ-новости и последние обновления | Тренды и прорывы искусственного интеллектаИИОсваиваем видео и ИИ: ключевые тренды маркетинга в соцсетях 2025ИИ-генерируемые видео: хорошо или плохо? Вот правда! 🤖🎥«Почему ИИ-чат-боты не успевают за срочными новостями»4 важных обновления ИИ, которые нужно знать в 2026 годуИИ-ведущие новостей и освещение от креаторов захватывают медиа США!Едкий ИИ-новостной дайджест #87 лучших ИИ-генераторов детей: предскажите лицо вашего ребёнка (2026)ИИ-ведущий от Channel1

Примечание о качестве данных

Reddit (12/20 тредов) и Lemmy (~14/20 постов) не достигли целевого числа материалов на платформу и сместились к общей реакции, а не к новостям о продуктах; тренды X, заблокированные регионом, почти не дали сигнала об open source; YouTube и Pinterest не позволили получить никакие метрики вовлечённости (просмотры, подписчики, лайки) из-за ограничений fetch/страниц согласия; поисковый API Bluesky был заблокирован (403), поэтому вместо полного поиска по платформе использовалось обнаружение аккаунтов.

Галерея