KEN’S CAT LOG

Новости ИИ для генерации изображений и видео — 2026-09-05

GPT-6 «Astra» на этой неделе полностью захватил обсуждения закрытых моделей в X и Bluesky, тогда как открытые модели для видео и изображений (LTX-2.5, MiniMax H3, Qwen-Image-3.0) почти целиком развивались внутри экосистемы ComfyUI. А самой крупной новостью вообще стал поворот Midjourney от генерации изображений к производству оборудования для медицинского УЗИ.

Новости ИИ для генерации изображений и видео: закрытые vs открытые модели — 2026-09-05

Привет! На этой неделе в мире ИИ для генерации изображений и видео царил полный хаос www🔥 Со стороны закрытых систем GPT-6 «Astra» от OpenAI устроил в X (бывшем Twitter) вирусный взрыв с более чем 100 млн просмотров и буквально забрал всё внимание 😳 Но и открытые модели не отставали: одна за другой вышли мощнейшие модели с открытыми весами — LTX-2.5, MiniMax H3, Qwen-Image-3.0 — а ComfyUI превратился в настоящую базовую платформу 🛠️ Ещё одна негромкая, но безумная новость: Midjourney, как сообщается, ушла из генерации изображений и переориентировалась на компанию по производству медицинских УЗИ-сканеров 😱 Это действительно шокировало. Также выяснилось, что пользователей Reddit сильнее технологического прогресса зацепили обсуждения «правового статуса ИИ-генерированного контента».

Across platforms

  • Фестиваль GPT-6 Astra: моментально стал темой обсуждения и в X, и в Bluesky (бенчмарк с изображением пеликана от Simon Willison). X: https://x.com/OpenAI/status/2095595741528125780 / Bluesky: https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c . Забавно, что Astra не продвигают именно как «ИИ для генерации изображений/видео», однако все тестируют её в 3D-моделировании и анимации 😂
  • ComfyUI стал де-факто базой открытого ИИ: и на YouTube, и в Lemmy Wan, FLUX, Qwen-Image, LTX-2.5, MiniMax H3 и даже Trellis.2 обсуждаются исключительно вместе с ComfyUI. YouTube: https://www.youtube.com/watch?v=3BFDcO2Ysu4 / Lemmy: https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native
  • Проблема MiniMax H3: «открытая модель, но коммерческое использование платное»: это обсуждали и в Lemmy (видеомодель работает даже на уровне RTX 3060, но для использования через Comfy нужна платная лицензия) https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller . Граница между открытыми и закрытыми моделями становится действительно размытой 🤔
  • Скандалы и повороты растут лучше технологий: общий паттерн виден в Reddit (судебное решение об ИИ-генерированном CSAM собрало более 800 комментариев) https://www.reddit.com/r/news/comments/1w5k6pr/ и Lemmy (поворот Midjourney к медицинскому оборудованию, score 58–73) https://lemmy.zip/post/66397234 .

Platform by platform

Reddit: ежемесячная сводка в r/StableDiffusion (массовые релизы открытых моделей, включая Qwen3.8, DeepSeek-V4-Pro, Ling-3.0 и Gemma-4-31B; темп настолько высокий, что даже комментарии не успевают за ним) — выдающийся тред https://www.reddit.com/r/StableDiffusion/comments/1w3rwoe/ . Также заслуживает внимания Atlas от World Labs — технология мгновенного создания 3D-миров из видео или фотографий, которая может быть полезна и для робототехники https://www.reddit.com/r/accelerate/comments/1w5ye9s/ . Но больше всего вырос не технический материал, а тред о решении, согласно которому ИИ-генерированная детская порнография защищена Конституцией: похоже, юридические и этические темы на Reddit вызывают больше интереса.

X: поиск свёлся к четырём публикациям об Astra — полное доминирование GPT-6 Astra🎤 Среди них наиболее техническим был пост разработчика @Dimillian, который показал 3D-пайплайн «из Blender в UE5» https://x.com/Dimillian/status/2095596700815516004 . В заданном диапазоне поиска не нашлось ни одной публикации об открытых проектах вроде Stable Diffusion, Flux или Wan — это серьёзный пробел.

YouTube: среди закрытых систем было много сравнительных обзоров Nano Banana 2, Kling 3.0 vs Veo3.1 vs Sora2, Seedance2.5 и Seedream5.0 Pro https://www.youtube.com/watch?v=AAD7wJ3DWiA . Среди открытых — LTX-2.5 (сверхбыстрая модель, генерирующая 10 секунд 720p за 6,8 секунды) https://www.youtube.com/watch?v=RjlbDhs1MPk , HunyuanImage3.0 (MoE с 80 млрд параметров) https://www.youtube.com/watch?v=U-8RjjU7x14 и другие. Открытые веса теперь сравнивают с закрытыми лидерами сразу после анонса. Также появилась информация, что OpenAI закроет Sora API и сосредоточит ресурсы на следующей модели «Spud» (само видео на YouTube не подтверждено, информация пришла через новости).

Bluesky: регулярный «бенчмарк изображения с пеликаном» от Simon Willison стал постоянной точкой наблюдения за качеством закрытых моделей https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c . Официальный аккаунт Replicate работает как новостной хаб для релизов видеомоделей вроде Kling3.0, Seedance2.0, Runway Gen-4.5 и Vidu Q3 https://bsky.app/profile/replicate.com/post/3mf5fbf6u4l2c . Первичных публикаций об открытых моделях почти нет; сам разработчик инструментов LoRA ostris сказал, что «сообщество AI/ML в основном осталось в X (Twitter)» 😅 В японском сегменте заметен разве что репост статьи GIGAZINE о Qwen-Image-3.0 https://gigazine.net/news/20260722-qwen-image-3/ .

Lemmy: !«メールアドレス» — сообщество с наибольшей плотностью информации об открытых моделях. Почти половину публикаций занимают материалы о MiniMax H3 (переход Comfy в статус коммерческого реселлера https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller , инструменты, работающие с 16 ГБ VRAM, и т. п.). Интересна и LLaDA-Image с полностью открытым рецептом обучения https://arxiv.org/abs/2609.03796 . В закрытом сегменте несопоставимо более высокий score, чем у новых моделей, получила новость о том, что Midjourney переходит от генерации изображений к бизнесу медицинских УЗИ-сканеров (58–73): именно это больше всего заинтересовало пользователей Lemmy.

Pinterest: в визуальном плане безоговорочно доминируют закрытые продукты — Google Veo2/3, Microsoft VASA-1, Grok4.6, Gemini с преодолением рубежа в миллиард пользователей. Среди характерных названий открытых проектов почти ничего не видно, кроме локального инструмента AMD «Amuse 3.0». Также очень много сценариев «оживить или создать лицо»: липсинк, воспроизведение мимики, генерация портретов. Похоже, это хорошо сочетается с аудиторией Pinterest, интересующейся красотой и идеями для публикаций в соцсетях.

What to watch

  1. Дальнейшие новости об ориентации GPT-6 Astra на изображения и видео — X, https://x.com/flowith/status/2095750768204877858 (анонс скорого сравнения анимации GPT-6 Astra и GPT-5.6)
  2. Закрытие Sora API → следующая модель «Spud» — по данным YouTube-исследования, API планируют закрыть 2026-09-24. Реальные видео и функции пока никто не подтвердил
  3. Будущее коммерческого лицензирования MiniMax H3 — Lemmy, https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller (закрепится ли гибридный подход: открытые веса, но платное коммерческое использование)
  4. Поворот Midjourney к медицинскому оборудованию — Lemmy, https://lemmy.zip/post/66397234 (действительно ли один из давно известных закрытых игроков уходит из генерации изображений)
  5. Полностью открытый рецепт обучения LLaDA-Image — Lemmy/arXiv, https://arxiv.org/abs/2609.03796 (насколько широко будут воспроизводить открытую модель с высокими результатами в Qwen-Image-Bench)
  6. Atlas от World Labs — Reddit, https://www.reddit.com/r/accelerate/comments/1w5ye9s/ (как генерацию 3D-миров из видео смогут использовать для данных обучения роботов)

Recommendations

  1. Поиск в X стоит повторить не по трендам, а по конкретным тегам и названиям: «Stable Diffusion», «ComfyUI», «Flux», «Wan», «Kling», «Sora».
  2. API searchPosts Bluesky вернул 403, поэтому к следующему запуску лучше заранее расширить список известных аккаунтов для поиска через Google.
  3. Такие модели, как MiniMax H3, с открытыми весами, но платным коммерческим использованием, в отчёте точнее помечать отдельно, а не просто относить к «открытым».
  4. Для новостей о развороте или уходе крупных игроков — вроде поворота Midjourney или закрытия Sora OpenAI — стоит создать постоянную категорию наблюдения: они легче привлекают читательское внимание, чем чисто технические новости.
  5. Pinterest содержит мало первичной информации, поэтому его лучше использовать не для отслеживания технологий, а как индикатор того, как их воспринимают обычные потребители.
  6. Тенденцию, заметную в Reddit и Lemmy, — «судебные решения и этические споры вируснее технологических новостей» — стоит включать в следующий бриф как отдельный сигнал.

Data quality

  • X: собранные публикации были основаны на трендах, географически привязанных к Хорватии, поэтому помимо четырёх материалов о GPT-6 Astra в выборку попал нерелевантный шум (криптовалюты, Илон, спорт и т. п.). Упоминаний открытых моделей не было вовсе; требуемый брифом уровень «анализ 20 публикаций» не достигнут.
  • Bluesky: официальный поисковый API вернул 403, поэтому метод сменили на проверку лент известных аккаунтов. Нашлось только около 12 публикаций, напрямую относящихся к теме; первичной информации об открытых моделях почти не удалось собрать.
  • Reddit: использовался лишь один поисковый запрос; найдено 12 тредов в 9 сабреддитах — меньше целевых 20. При этом для каждого треда записано до 6 лучших комментариев.
  • YouTube: страницы результатов поиска и видео рендерятся JavaScript, поэтому не удалось напрямую проверить просмотры, число подписчиков и точную дату публикации; даты оценены по относительным отметкам в сниппетах.
  • Lemmy: из-за федеративной природы поиск в одном инстансе пропускает посты из других. Прямые поиски по закрытым сервисам видеогенерации (Sora, Kling, Veo и т. п.) почти не дали результатов.
  • Pinterest: из 50 результатов реально были открыты и проверены только 24 изображения; остальные анализировались лишь по заголовкам. Показатели вовлечённости — лайки, сохранения и т. п. — в собранных данных отсутствуют.

Итоги по платформам

Reddit

Reddit — Новости ИИ для генерации изображений и видео

Где

Собранные 12 тредов пришли из 9 сабреддитов. Использовался только запрос «Image and Video Generation AI News».

Сабреддит Подписчики Собрано тредов
r/generativeAI 150,575 4
r/GrokAiDiscussion 4,883 1
r/freetoolsAI 7,616 1
r/StableDiffusion 1,000,814 1
r/accelerate 77,800 1
r/news 31,531,475 1
r/antiai 313,317 1
r/allthequestions 127,064 1
r/teenagers 3,673,210 1

По числу материалов лидирует r/generativeAI (4 публикации): это центр неформальных постов о поиске и сравнении инструментов. Из остальных сабреддитов найдено по одному треду. Примечательно, что тема проникла и в сообщества, не специализирующиеся на генерации изображений и видео, например r/news и r/teenagers.

Что говорят люди
  • #4 r/StableDiffusion «Local AI News You Missed - August 2026» (201pt, 22 комментария, 2026-08-31, https://www.reddit.com/r/StableDiffusion/comments/1w3rwoe/) — ежемесячная сводка утверждает, что только за август вышло множество открытых моделей: Qwen3.8, DeepSeek-V4-Pro-0813, семейство Ling-3.0, Gemma-4-31B и другие. В комментариях продолжали добавлять новые релизы: u/Narutobirama(20) пишет «You probably missed Qwen3.8 Flash Next.», а u/MoJaKF(14) — «Anima-3.8B its already on its 1.1 release that just released 3h ago», что показывает темп, с которым не успевает даже сама сводка.
  • #5 r/accelerate «…They built an AI that looks at a few casual real-world videos or photos and instantly turns them into a full 3D playground» (763pt, 76 комментариев, 2026-09-03, https://www.reddit.com/r/accelerate/comments/1w5ye9s/) — об Atlas от World Labs, создающем интерактивные 3D-миры из видео и фото. Реакция восторженная: например, u/stainless_steelcat(48) пишет «Matrix bullet time comes to real life...now I know it wasn't ambitious enough.». Обсуждается и возможность использовать технологии генерации видео как мост к генерации обучающих данных для робототехники.
  • #6 r/generativeAI «Same prompt. Same 30 seconds. Two different AI video models.» (98pt, 30 комментариев, 2026-09-03, https://www.reddit.com/r/generativeAI/comments/1w60fip/) — сравнение Seedance 2.5 и Wan 3.0 по одному промпту. u/SpecialistDragonfly9(5) считает, что «seedance is the by FAR superior one», тогда как u/Positive-Key6640(4) возражает: «Same-prompt comparisons are fun but they mostly measure which model happens to like your prompt style, not which one is better».
  • #2 r/GrokAiDiscussion «Have they loosened the image to video generation moderation» (14pt, 28 комментариев, 2026-08-29, https://www.reddit.com/r/GrokAiDiscussion/comments/1w1w0e8/) — мнения пользователей о политике модерации Grok Imagine расходятся. В ответ на u/Miserable_Appeal515(2) с «it has gotten better» u/joderrelldalejr(2) пишет прямо противоположное: «Hell no it gets worse and then they start to limit how many images you can even do in a week».
  • #1 r/generativeAI «List of daily AI video generative websites» (38pt, 27 комментариев, 2026-08-31, https://www.reddit.com/r/generativeAI/comments/1w3frr2/) — обмен информацией для тех, кто максимально использует бесплатные лимиты. Для Kling AI указано «66 free credits every 24 hours»; u/Murky-Race-3443(1) добавляет «capcut gives daily free credits btw», а u/Julia_Leeds94(1) представляет YalleryLabs: «$3の予算で5秒動画が720pで$0.18から».
  • #3 r/freetoolsAI «Free AI Image Generator» (31pt, 31 комментарий, 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/) — рекламный пост сайта для генерации изображений без регистрации собрал комментарии; u/Odd-Lingonberry1516(2) перечисляет альтернативы Deepany, Aifun и Perchance. u/thecragmire(1) также спрашивает о модели дохода: «How do you maintain this? It's got to cost you something, right?».
  • #11 r/generativeAI «GOOD image-to-video ??» (1pt, 13 комментариев, 2026-08-29, https://www.reddit.com/r/generativeAI/comments/1w20rq1/) — Kling AI называют «practically king of the hill for realistic human motion», Runway — «The gold standard for creative control», а u/Ok-Addition1264(2) рекомендует для локального запуска ComfyUI + WAN22/LTX2.3.
  • #7 r/generativeAI «Any good Ai video site ? Even if it paid ?» (0pt, 15 комментариев, 2026-08-31, https://www.reddit.com/r/generativeAI/comments/1w3kptg/) — u/Previous-Course-5160(1) считает, что gen-3 от Runway «actually handles motion pretty well compared to a lot of the jank», но критично отзывается о Pika: «fun for quick little loops...but the output gets samey after a while».
  • #8/#10 r/news «Federal Judge rules AI generated child sex abuse material is protected by First Amendment.» (1,379pt, 545 комментариев, 2026-09-02, https://www.reddit.com/r/news/comments/1w5k6pr/) и r/allthequestions «Why did a federal judge declare the creation of AI generated child porn as legal?» (31pt, 277 комментариев, 2026-08-31, https://www.reddit.com/r/allthequestions/comments/1w3hf3o/) — обсуждения правового статуса ИИ-генерированного контента привлекли исключительное внимание. u/Ntroepy(414) отмечает вводящий в заблуждение заголовок: «The headline reads like click-bait...bound by a 2002 Supreme Court ruling». В r/allthequestions u/TheGracefulCrane(31) поясняет юридическую логику: «judges dont make laws and the law hasnt been updated to make it illegal ergo the ruling».
  • #9 r/antiai «AI generated images are becoming harder to detect» (113pt, 30 комментариев, 2026-08-30, https://www.reddit.com/r/antiai/comments/1w2mr8g/) — вопреки заголовку, комментарии в основном шутят над дефектами рук и ног, например u/GurInside278(31): «why are her feet her hands».
  • #12 r/teenagers «To all AI image/video generator users» (7pt, 41 комментарий, 2026-08-31, https://www.reddit.com/r/teenagers/comments/1w2y305/) — пост-ответ на утверждение, что «ИИ-арт создаётся без труда художника». Видна сильная анти-ИИ-реакция подростков: u/LiterallyGarbage_0(5) пишет «people who use ai to make "art" genuinely make me so upset...pick up a pencil».
Сигналы
  • Рост: частота релизов локальных открытых моделей (LLM, изображений, видео) такова, что за ней невозможно уследить даже по комментариям к треду #4. Новым направлением интереса становится перенос технологий генерации видео в обучение робототехники — как в Atlas от World Labs (#5).
  • Расхождение мнений: оценки модерации Grok Imagine (#2) полярны — «стало лучше» против «стало хуже». В обсуждении Seedance vs Wan (#6) сочетаются мнение о безоговорочной победе Seedance и возражение, что сравнение по одному промпту в принципе мало что доказывает. Одним выводом ситуацию не описать.
  • Недооцениваемое / вызывающее сомнения: сам привычный формат сравнения моделей на одном промпте (#6) критикуется u/Positive-Key6640 как методика.
  • Неожиданное: тред #9 под заголовком «ИИ-изображения становится сложнее отличить» фактически стал шутками о сломанных руках и ногах — между заявленной темой и реальной реакцией есть заметный разрыв. Кроме того, судебные решения (#8 и #10, в сумме более 800 комментариев) по масштабу вовлечения намного превзошли продуктовые новости: на Reddit главным источником споров оказывается не «технический прогресс», а правовой и этический статус ИИ-генерированных материалов.
Ограничения
  • Использовался только один запрос — «Image and Video Generation AI News»; собрано 12 тредов в 9 сабреддитах. Это меньше требуемых в brief.md «примерно 20 публикаций на каждую сеть».
  • На этом этапе читались только заранее собранные воркером output/reddit.threads.md/.threads.json; новые запросы, повторный сбор, а также прямой доступ к отдельным тредам и комментариям не выполнялись, согласно плейбуку. Пропуски, скорее всего, находятся за пределами этого единственного запроса.
  • Для каждого треда записано максимум шесть лучших комментариев, поэтому остальные реакции и мнения меньшинства в отчёт не вошли.

X

X — Новости ИИ для генерации изображений и видео

Аккаунты

Из 34 аккаунтов этой выборки лишь четыре опубликовали что-либо, относящееся к ИИ для генерации изображений/видео, — и все о единственном запуске в одни и те же 24 часа (2026-09-03):

  • @OpenAI (OpenAI) — одна публикация, но именно она стала всей историей: 309,095 лайков, 55,587 репостов, около 108,000,000 просмотров. Аккаунт сделал минимум — один анонсный твит с изображением — и позволил масштабу вовлечения говорить за себя.
  • @MatthewBerman (Matthew Berman) — аккаунт ИИ-инфлюенсера, одна публикация (4,054 лайка, около 1,500,000 просмотров), оформленная как тред первого знакомства с «ранним доступом»; автор позиционирует себя тестировщиком, а не источником новости.
  • @Dimillian (Thomas Ricouard) — одна публикация (7,199 лайков, около 2,300,000 просмотров), где разработчик показывает конкретный пайплайн (Blender → Unreal Engine 5), а не общий хайп; это наиболее содержательное техническое заявление в наборе.
  • @flowith (Flowith) — самый маленький аккаунт здесь (947 лайков, около 115,000 просмотров), продуктовый аккаунт, использующий запуск для прямого сравнения с предыдущей моделью.

Все остальные аккаунты выборки (34 всего, 40 публикаций) — крипто- и мем-аккаунты (@songoncardano, @nmkr_io, @legsdotfun, @robincatonhood), фан-аккаунты Илона/Tesla (@LunarOptimus, @Optimus_RH, @HeavyMetalShip), инфлюенсер по кибербезопасности (@corewarrior, @hackerzspace), польские, африканские и боснийские новостные и мем-аккаунты, фан-аккаунты Ariana Grande (@vodolove опубликовал 3 из 4 своих элементов) и аккаунты с розыгрышами от пивных брендов (@naturallight, @ChinookCi) — не имеют отношения к генерации изображений или видео ИИ. Они отмечены здесь только потому, что именно их вернул сбор; см. раздел «Ограничения».

Публикации
1. Запуск GPT-6 «Astra» — @OpenAI

"This is GPT-6 Astra. Anything you can do on a computer, Astra can do for you. Fast."

Самая крупная публикация во всём собранном наборе — на порядок больше остальных. Она подаётся как универсальный агент для работы за компьютером, а не специальная модель для изображений/видео. Однако последующие демонстрации других аккаунтов (ниже) целиком визуальны и связаны с 3D, что указывает на такую направленность сильных сторон Astra.

2. Astra против предыдущей модели в анимации — @flowith

"GPT-6 Astra VS GPT-5.6 on animation coming soon to flowith.io"

Сторонний продуктовый аккаунт прямо анонсирует сравнение Astra и прошлого поколения в анимации. Это конкретный сигнал, что Astra тестируют и продвигают именно на способности к созданию анимации, а не только как универсального компьютерного агента.

3. Тред с опытом раннего доступа — @MatthewBerman

"Astra (GPT-6) is here!!! I've had early access and tested it like crazy with things like games, code, writing, browser control, presentations and general knowledge work. This is the best model I've ever used. Period."

Важно, чего здесь нет: несмотря на обещание «невероятных демо ниже», в списке возможностей прямо не упомянута генерация изображений или видео.

4. Демонстрация Blender → Unreal Engine 5 — @Dimillian

"Astra is very good at 3D modeling, and I can't wait for all of you to experience it, for now here is a little walkthrough on how I built the demo house for our launch blog post. From a Blender scene to a Unreal Engine 5 walkable experience."

Наиболее конкретное, привязанное к инструментам заявление в выборке: Astra используется в реальном 3D-контентном пайплайне (Blender → UE5), что ближе к рабочему процессу визуальной или видеогенерации, чем всё остальное, найденное в X за этот запуск.

Сигналы
  • Рост: GPT-6 «Astra» — единственная история, связанная с изображениями/видео, которую выявила эта выборка, и она доминирует по вовлечению (около 108 млн просмотров у одного только запуска против сотен тысяч у всего остального). Кластер реакций — сравнение продуктов, тест инфлюенсера, демо 3D-пайплайна разработчика — в пределах 24 часов выглядит как скоординированный запуск, а не органическое открытие.
  • Отсутствует / отвергнуто: ни одна открытая модель для генерации изображений или видео (Stable Diffusion, Flux, Wan, HunyuanVideo, Kling, ComfyUI и т. п.) не появляется нигде в этой выборке. Если в X сейчас есть активная работа по открытым моделям, этот поисковый проход до неё не добрался.
  • Неожиданное: насколько мало в обсуждении запуска «ИИ» вообще прямо называется генерация изображений или видео. В перечне раннего доступа Matthew Berman она полностью отсутствует, а Astra продвигают как общего агента («anything you can do on a computer»). Визуально-видео аспект выведен из того, что решили показать ранние тестировщики — 3D-моделирование и сравнение анимации, — а не из позиционирования OpenAI.
Ограничения
  • Собранные поисковые запросы не были нацелены на эту тему. Десять реально использованных терминов — «Astra», «$SONG», «Robinhood», «Elon», «#CyberSecurity», «Poland», «Africa», «Bosnia», «ariana», «#Sweepstakes» — были списком трендовых тем самого X для этой сессии (см. таблицу Explore в x.posts.md), а не запросами, выбранными для поиска ИИ генерации изображений/видео. Только запросы «Astra» (посты #1–4) дали тематические результаты; остальные 36 публикаций — нерелевантный шум: криптотокены, фандом Илона/Tesla, кибербезопасность, новости и мемы о Польше, Африке и Боснии, фанаты Ariana Grande, пивные розыгрыши.
  • По этим данным критерии полноты не выполнены. Бриф требует анализировать около 20 постов на платформу; здесь есть только 4 пригодных поста, все о единственном запуске закрытой GPT-6 Astra, и ни одного об открытой генерации изображений/видео. Для реального покрытия темы в X нужен проход по запросам вроде «Stable Diffusion», «ComfyUI», «Flux», «Kling AI», «Runway», «Sora», «Midjourney», «Wan 2.x» или «HunyuanVideo».
  • Оговорка о геолокации: список трендов Explore в этой сессии геопривязан к Хорватии (у большинства пунктов явно указано «Trending in Croatia»), поэтому в исходном списке преобладают криптотокены, боснийский футбол и балканские новости/мемы. Это тренды одной серверной локации, а не глобальная картина.
  • Открытого сегмента нет вовсе. В этой выборке нет ни одной новости, инструмента или релиза, относящегося к открытой генерации изображений и видео — это полный, а не частичный пробел.

YouTube

YouTube — Новости ИИ для генерации изображений и видео (закрытые / открытые модели)

Каналы

Каналы, найденные через поиск YouTube и новостной поиск. Страницы большинства видео рендерятся JavaScript, поэтому число подписчиков напрямую подтвердить не удалось (подробности — в ## Limits).

  • Theoretically Media — постоянный канал, тестирующий открытые генеративные ИИ Wan / FLUX / Qwen-Image и другие через ComfyUI. («Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial...» https://www.youtube.com/watch?v=3BFDcO2Ysu4)
  • Matt Wolfe / The Next Wave — известны сравнительными проектами по закрытым инструментам ИИ, включая Runway, Kling, Veo и Sora.
  • Несколько независимых каналов об ИИ-инструментах с обзорами отдельных моделей, таких как LTX-2.5, MiniMax H3 и Nano Banana 2; в поисковой выдаче были видны только названия видео, а не каналов.
Видео
Закрытые модели
  1. «Nano Banana 2 Is INSANE – Full Test of Google's New Image Model!» — примерно 2026-02-26 — https://www.youtube.com/watch?v=k0dujOUePeU — практический тест Gemini 3.1 Flash Image от Google (также известной как Nano Banana 2), утверждающий, что модель устраняет компромисс между скоростью и качеством.
  2. «Nano Banana 2 vs Nano Banana Pro: I Tested Both So You Don't Have To» — конец февраля 2026 — https://www.youtube.com/watch?v=B1d3SIfoQLk — сравнение выходных результатов обычной и Pro-версий, чтобы определить, какую стоит использовать.
  3. «Kling 3.0 Surprised Me! Compared To Veo 3.1 & Sora 2» — примерно 2026-02-05 — https://www.youtube.com/watch?v=AAD7wJ3DWiA — прямое сравнение Kling 3.0 от Kuaishou с Veo 3.1 и Sora 2; модель высоко оценивают за реализм изображения и работу камеры.
  4. «Is Kling 3.0 Actually Good? (I Spent $500 Testing For You)» — примерно 2026-02-04 — https://www.youtube.com/watch?v=Rme22R7a9O8 — платный практический тест мультисценных и 4K60fps-результатов Kling 3.0.
  5. «Seedream 5.0 Tested & Seedance 2.5 Leaks Are Unreal!» — примерно 2026-07-15 — https://www.youtube.com/watch?v=pn-YwWn3kkM — тест изображения Seedream 5.0 Pro от ByteDance и ещё не анонсированной Seedance 2.5; упоминается, что ByteDance пропустила Seedance 2.1.
  6. «Seedance 2.5 Is Insane — 30 Seconds In ONE Shot?» — примерно 2026-06-23 — https://www.youtube.com/watch?v=8sGVhuoPOXI — проверка возможности Seedance 2.5 создавать 30 секунд непрерывного видео в одном кадре.
  7. «MiniMax H3 Review | Testing Hailuo's New 2K AI Video Model» — начало августа 2026 — https://www.youtube.com/watch?v=67CCQBAwZiA — практический тест MiniMax H3 (Hailuo 3.0), выпущенной 2026-07-31: 2K, 15 секунд, нативный стереозвук.
  8. «Hailuo AI's NEW MiniMax H3 Model Is INCREDIBLE! (Full Test)» — примерно август 2026 — https://www.youtube.com/watch?v=la0iBk8g8_g — полный тест омнимодальных функций MiniMax H3: одновременный ввод текста, изображений, видео и аудио.
  9. «FLUX 3 Sneak Peek» — 2026-07-23 — https://www.youtube.com/watch?v=PCPhl8qMF_Y — предварительный обзор FLUX 3 от Black Forest Labs: мультимодальная система для изображений, 20-секундного видео, аудио и действий; видеорежим стал общедоступным 2026-08-04.
  10. «Gen-4.5 Updates — Research Demo Day 2025 | Runway» — 2025-12-16 — https://www.youtube.com/watch?v=yNXxuzmiwEo — объяснение технических обновлений Gen-4.5 на официальном канале Runway: управление камерой и согласованность персонажей.
  11. «All in one AI | Text to Image & Video AI | Kling, Veo, Sora, Nano Banana Pro | Daily Free Credits!» — недавно — https://www.youtube.com/watch?v=SnmRpf_VfgU — видео о том, как использовать бесплатные лимиты нескольких закрытых ИИ: Kling, Veo, Sora и Nano Banana Pro.
Открытые модели
  1. «LTX 2.5 In ComfyUI — Setup, First Gens, And The Catch» — середина августа 2026 (около трёх недель после публикации открытых весов LTX-2.5 2026-08-11) — https://www.youtube.com/watch?v=RjlbDhs1MPk — нативная установка 22B world model LTX-2.5 от Lightricks в ComfyUI; подтверждена скорость 6,8 секунды на создание 10-секундного 720p-видео.
  2. «LTX 2.5 ComfyUI: Physics Test vs MiniMax H3 + Free Workflows» — около трёх недель назад — https://www.youtube.com/watch?v=WpKNXZZqQEU — прямое сравнение открытой LTX-2.5 с закрытой MiniMax H3 по физике и мультисценности.
  3. «New LTX 2.5 Video Model is INSANELY Fast (ComfyUI Local)» — около трёх недель назад — https://www.youtube.com/watch?v=pA2BQw9LY8A — тест, сосредоточенный на скорости локального запуска.
  4. «Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models» — Theoretically Media — https://www.youtube.com/watch?v=3BFDcO2Ysu4 — разбор Wan 2.2 (MoE-видеомодель), FLUX, FLUX Krea и Qwen Image в ComfyUI. Wan 2.2 оценивают как приближающуюся к Sora по согласованности, а FLUX — как превосходящую по детализации.
  5. «HunyuanImage 3.0 — The Most Powerful Open-Source Image Generator Yet» — 2025-09-30 — https://www.youtube.com/watch?v=U-8RjjU7x14 — знакомство с MoE-моделью изображений Tencent на 80 млрд параметров; отмечается небольшое преимущество по win rate над Seedream 4.0, Nano Banana и GPT-Image.
  6. «Flux.2 Dev: Full Review, Pros & Cons, ComfyUI Setup!» — примерно 2025-11-26 — https://www.youtube.com/watch?v=MoAwonm53hQ — обзор и установка в ComfyUI FLUX.2 от Black Forest Labs, в том числе версии с открытыми весами. Рассматривается сохранение согласованности объекта по максимум десяти референсным изображениям.
  7. «FLUX 2 Released! 🤯 ComfyUI Install, Workflow & The "Active Parameter" Secret» — примерно 2025-11-26 — https://www.youtube.com/watch?v=nfeDS_EoblE — инструкция по установке FLUX.2 в ComfyUI и объяснение новых функций.
  8. «Qwen Image First Look & LOCAL Testing (The BEST New Image Model?)» — 2025-08-05 — https://www.youtube.com/watch?v=ex2YCqtTHSY — первый локальный тест Alibaba Qwen-Image, предшественника более поздней Qwen-Image-2512.
  9. «Qwen Image Edit 2511–Local Image Editing in ComfyUI | Multi-Reference Style Transfer & GGUF Workflow» — 2025-12-26 — https://www.youtube.com/watch?v=iFnTqZmsRIc — проверка переноса стиля по нескольким референсам в Qwen Image Edit с GGUF-пайплайном ComfyUI.
  10. «MiniMax H3: The New Open-Source Video Champ?» — примерно август 2026 — https://www.youtube.com/watch?v=3R5GROj8Tcg — MiniMax H3 представляется как омнимодальная видеомодель с открытыми весами; упоминается её первое место в рейтинге редактирования видео.
Сигналы
  • Открытые веса быстро догоняют передовой уровень: LTX-2.5 (2026-08-11) и MiniMax H3 (2026-07-31) обе были выпущены с открытыми весами в последние 60 дней. В превью сравнений часто используется тезис о том, что они «сопоставимы с закрытой MiniMax H3 или превосходят её». Открытые проекты уже не просто догоняют: их начинают сравнивать с лидерами сразу после выхода.
  • Быстрый цикл релизов ByteDance: Seedream 5.0 Pro и Seedance 2.5 (с пропуском 2.1) обновлялись каждые несколько месяцев; проверочные видео ютуберов имеют ярко выраженный новостной характер, с формулировками «Tested» и «Leaks».
  • Перестройка линии Google: вся линейка Imagen должна быть закрыта 2026-08-17, а переход к Nano Banana (линейке Gemini 3.x Image) уже идёт. У Nano Banana 2 (2026-02-26) уже появились несколько сравнительных видео с последующими версиями, включая Pro.
  • Уход крупного закрытого игрока: OpenAI планирует закрыть Sora API 2026-09-24 и перенаправить вычислительные ресурсы на следующую модель «Spud» (по поисковой выдаче; видео на YouTube не подтверждено). Для рынка закрытых систем это важный поворот.
  • ComfyUI стал фактической базой проверки открытых моделей: почти все обзоры Wan, FLUX, Qwen-Image, LTX-2.5 и других открытых проектов идут вместе с инструкциями по установке в ComfyUI.
Ограничения
  • Страницы поисковой выдачи YouTube (youtube.com/results?...) и видео (youtube.com/watch?v=...) рендерятся JavaScript; при прямом получении возвращались только навигационные ссылки футера. Поэтому не удалось напрямую прочитать исходные данные о просмотрах, подписчиках и дате публикации (ytInitialData и т. п.). Даты оценены по сведениям в сниппетах поисковика — относительным обозначениям вроде «3 weeks ago» или упоминаниям в статьях; точное количество просмотров и подписчиков для большинства видео не подтверждено.
  • Прямых видео YouTube о прекращении Sora OpenAI и модели-преемнике «Spud» найти не удалось; этот пункт основан на упоминаниях в новостных материалах, а не на подтверждённых реакциях YouTube.
  • Видео независимых обозревателей с недавними, в пределах 60 дней, тестами Runway Gen-4.5 или свежих обновлений Midjourney в этом поиске не найдено, хотя были найдены анонсы на официальных каналах.
  • Для отдельных обзоров Nano Banana Pro (с заголовками вроде «Nano Banana Pro… wtf») удалось подтвердить ссылку, но не название канала и число просмотров.

Bluesky

Bluesky — Последние тенденции ИИ генерации изображений и видео

Аккаунты
  • Simon Willison @simonwillison.net — разработчик, известный оценкой LLM и моделей изображений. С каждым новым релизом он публикует сравнение изображений в своём постоянном «бенчмарке пеликана». Реакций подписчиков много, поэтому это хороший первичный источник по новостям закрытых моделей.
  • fofr @fofr.ai — автор промптов для изображений, работающий вокруг Replicate. Часто публикует практические способы использования Nano Banana Pro (Gemini 3 Pro Image).
  • Replicate (официальный) @replicate.com — официальный аккаунт хостинга ИИ-моделей API. Он сообщает о появлении новых моделей в Replicate и служит новостным источником для видеомоделей независимо от их открытости.
  • Amanda Silberling (журналистка TechCrunch) @amanda.omg.lol — журналистка, освещающая культурные стороны ИИ-генерации изображений.
  • AI News Updates @ai-latestnews.bsky.social — бот, автоматически публикующий новости отрасли ИИ.
  • gigowat @gigowat.bsky.social — аккаунт, публикующий в Bluesky статьи японского новостного сайта о гаджетах GIGAZINE. Один из немногих источников новостей ИИ-генерации изображений на японском языке.
  • ostris @ostris.com — разработчик открытого инструмента обучения LoRA «AI-Toolkit». Он публиковал материалы о моделях семейства Flex, но сам отмечает, что «сообщество AI/ML в основном осталось в Twitter», поэтому его обновления в Bluesky редки.
Публикации
  1. Simon Willison — опубликовал сетку сравнения изображения пеликана для GPT-6 Astra и GPT-5.6 Sol/Terra/Luna (закрытые модели, сравнение моделей изображений OpenAI). 2026-09-04, 👍91 · 🔁6 · 💬12.
    https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c
    В продолжение также опубликованы полноразмерные версии сгенерированных изображений (alt text тоже создан GPT-5-astra). 👍23.
    https://bsky.app/profile/simonwillison.net/post/3mupxztoyqs2c

  2. Simon Willison — сравнительная публикация изображения пеликана, созданного Google Gemini 3.7 Flash. 2026-09-02, 👍6.
    https://bsky.app/profile/simonwillison.net/post/3muitt5g3q22r

  3. fofr — поделился подробным промптом для создания ретроигрового рендера с Nano Banana Pro (Gemini 3 Pro Image). 2026-01-19, 👍31.
    https://bsky.app/profile/fofr.ai/post/3mcrt3avp222p
    В тот же день опубликовал промпт для генерации скриншотов в стиле Street View. 👍10.
    https://bsky.app/profile/fofr.ai/post/3mcrilugr5c2m

  4. Replicate (официальный) — объявил, что «GPT Image 2» OpenAI доступна в Replicate. Подчёркиваются фотореализм, точность отрисовки текста и сильные стороны для UI/дизайна (закрытая модель). 2026-04-21.
    https://bsky.app/profile/replicate.com/post/3mjzygaefs224

  5. Replicate (официальный) — объявил, что видеомодель ByteDance «Seedance 2.0» стала доступна всем пользователям. Она объединяет текст, изображение, видео и аудио в одной сцене и синхронно создаёт стереозвук (закрытая модель). 2026-04-09.
    https://bsky.app/profile/replicate.com/post/3mj3junhvnh26

  6. Replicate (официальный) — Gen-4.5 от Runway добавлена в Replicate. Видеомодель с акцентом на физический реализм (закрытая модель). 2026-02-18.
    https://bsky.app/profile/replicate.com/post/3mf5fbf6u4l2c

  7. Replicate (официальный) — Kling 3.0 (+o3) от Kuaishou добавлена в Replicate. Поддерживаются мультисценное 4K и синхронизация звука (закрытая модель). 2026-02-17.
    https://bsky.app/profile/replicate.com/post/3mf35lkhoyw2q

  8. Replicate (официальный) — видеомодель «Vidu Q3» добавлена в Replicate. Поддерживает генерацию по тексту, изображению и начальному/конечному кадру; до 16 секунд, 1080p (закрытая модель). 2026-03-11.
    https://bsky.app/profile/replicate.com/post/3mgsan3ddpl2w

  9. Amanda Silberling (TechCrunch) — запросила комментарии экспертов о том, почему ИИ-генерированные изображения еды часто имеют своеобразный вид; запрос для материала об эстетических особенностях ИИ-изображений. 2026-08-28, 👍17 · 🔁5 · 💬4.
    https://bsky.app/profile/amanda.omg.lol/post/3mu5itcncgc2x

  10. AI News Updates (бот) — сообщил, что «Midjourney Inc. приобрела астрологическое приложение Co-Star и запускает новое приложение для генерации изображений». 2026-07-25. Содержание согласуется с репортажами TechCrunch и Bloomberg от 2026-07-24, согласно которым сделка закрылась весной, поэтому утверждение можно проверить.
    https://bsky.app/profile/ai-latestnews.bsky.social/post/3mrh6gdxnqy2s

  11. gigowat (японский репост статьи GIGAZINE) — поделился статьёй GIGAZINE о появлении открытого ИИ для генерации изображений «Qwen-Image-3.0», где проверялись иллюстрации и качество рисования японского текста. 2026-07-22.
    https://bsky.app/profile/gigowat.bsky.social/post/3mr7dvb332z2q
    (Исходная статья: https://gigazine.net/news/20260722-qwen-image-3/

  12. ostris — объявил о выпуске открытой модели изображений «Flex.2-preview», объединяющей text-to-image, универсальное управление и inpainting. Публикация несколько старая (2025-04-22), но это один из немногих примеров прямого сообщения об открытой модели от разработчика в Bluesky. 👍4.
    https://bsky.app/profile/ostris.com/post/3lngo5cf66k2a

Сигналы
  • Преимущество закрытых моделей: публикации с заметной вовлечённостью в Bluesky сосредоточены вокруг крупных закрытых моделей — GPT, Gemini (Nano Banana Pro), Midjourney. В особенности «бенчмарк пеликана» Simon Willison с выходом каждой новой модели стал фактической точкой контроля качества закрытых генераторов изображений.
  • Аккаунт Replicate — новостной хаб видеогенерации: выпуски Kling 3.0, Seedance 2.0, Runway Gen-4.5, Vidu Q3 и других ключевых видеомоделей 2026 года регулярно появлялись через официальный аккаунт Replicate. Хотя сами лайки немногочисленны (1–2), по нему удобно отслеживать порядок появления моделей.
  • Открытые проекты в Bluesky освещены слабо: первичных упоминаний основных открытых моделей 2026 года — Wan 2.7 (Alibaba), HunyuanVideo 1.5 (Tencent), Chroma, LTX-2.3 и других — почти не найдено. Разработчик открытого инструмента обучения LoRA ostris сам написал, что «сообщество AI/ML в основном осталось в Twitter», что указывает на смещение центра сообщества к X (бывшему Twitter).
  • Публикации на японском в основном представляют репосты GIGAZINE: японские посты в основном пересказывают материалы новостных сайтов, как у gigowat; самостоятельных первичных аналитических публикаций не найдено.
Ограничения
  • Официальный API поиска постов Bluesky (app.bsky.feed.searchPosts) в этой сессии через WebFetch постоянно возвращал 403 Forbidden, поэтому невозможно было провести полный сбор по ключевым словам с показателями лайков и репостов (getProfile, getAuthorFeed, getPostThread и oEmbed работали нормально). Поэтому исследование переключилось на индивидуальную проверку getAuthorFeed известных аккаунтов, найденных через поиск Google.
  • Страница поиска bsky.app — SPA, рендерящаяся JavaScript, поэтому WebFetch, преобразующий только HTML в Markdown, не мог получить текст публикаций.
  • Из-за этих ограничений нельзя было всесторонне проверить все посты по названию конкретной модели; вместо этого были отобраны тематические материалы из недавних публикаций известных аккаунтов. В итоге проверено чуть более 20 постов и лент, но напрямую к генерации изображений и видео ИИ относились лишь около 12 перечисленных выше.
  • По основным открытым моделям — Wan, HunyuanVideo, Chroma, основной Z-Image, LTX-2.3 и т. п. — были опробованы несколько аккаунтов, но тематических публикаций 2026 года не обнаружено. У huggingface.bsky.social лента оказалась пустой, а civitai-bot.bsky.social не обновлялся с мая 2024 года.
  • Был найден личный пост февраля 2026 года, утверждавший, что Midjourney стала частью Meta.ai, но проверка внешних сообщений показала, что на деле речь шла о лицензионном соглашении августа 2025 года, а Midjourney сохранила независимость. Поэтому недостоверная информация не включена в отчёт.

Lemmy

Lemmy — Последние тенденции ИИ генерации изображений и видео (закрытые / открытые)

Сообщества (Communities)
  • !«メールアドレス» — 5,708 участников. Технические обсуждения открытых моделей для изображений и видео в целом. В этом исследовании это сообщество имело наибольшую плотность информации.
  • !«メールアドレス» — 2,360 участников. Площадка для работ, сделанных моделями семейства Stable Diffusion. Самих новостей мало.
  • !«メールアドレス» — 1,593 участника. Посвящено ИИ-аниме; новостная ценность низкая.
  • !«メールアドレス» — 50 участников. Сообщество автоматических репостов RSS Reddit (бот); важно учитывать, что это не человеческое обсуждение.
  • !«メールアドレス» и !«メールアドレス» — универсальные технические новостные сообщества. Попаданий строго по ИИ генерации изображений/видео мало; они теряются среди общих материалов об ИИ.
  • На Lemmy нет крупного специализированного сообщества по ИИ генерации изображений/видео уровня r/StableDiffusion на Reddit; обсуждения распределены между указанными небольшими сообществами.
Публикации (Posts)
Открытые модели
  1. MiniMax H3: Comfy стал официальным реселлером коммерческих лицензий — !«メールアドレス», score 4, 2026-08-28. Исходная статья: https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller 。MiniMax H3 — выпущенная в августе 2026 года видеомодель с открытыми весами; она локально работает даже на GPU уровня RTX 3060 и генерирует видео 2K с нативным стереозвуком. Comfy стал продавцом коммерческих лицензий (Professional/Enterprise), причём в Enterprise доступна даже недистиллированная модель.
  2. LLaDA-Image: Building Strong Image Generators with Fully Open Training Recipes — !«メールアドレス», score 2, 2026-09-04. https://arxiv.org/abs/2609.03796 。Модель генерации изображений с полностью открытым рецептом обучения, высокими результатами в Qwen-Image-Bench и быстрой дистиллированной Turbo-версией.
  3. Trellis.2 и Pixal3D нативно интегрированы в ComfyUI — !«メールアドレス», score 4, 2026-09-01. https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native 。Анонс утверждает, что «лучшие открытые 3D-модели генерации стали частью ядра ComfyUI».
  4. ComfyUI-MiniMaxH3-CLSS — !«メールアドレス», score 0, 2026-09-01. https://github.com/nazgut/ComfyUI-MiniMaxH3-CLSS 。Технический инструмент для MiniMax H3, позволяющий на пользовательском компьютере с 16 ГБ VRAM создавать видео со звуком произвольной длины.
  5. Fizgig LoRA/LoKR Studio — !«メールアドレス», score 4, 2026-08-30. https://github.com/shootthesound/Fizgig 。Открытый инструмент для обучения и извлечения LoRA/LoKR для нескольких семейств моделей: Krea 2, MiniMax, Klein 9B и других.
  6. VibeVoice-ComfyUI (интеграция открытого TTS Microsoft в ComfyUI) — !«メールアドレス», score 1, 2026-08-28. https://github.com/nikhilprasanth/VibeVoice-ComfyUI 。Один из примеров движения к включению аудио в рабочие процессы генерации видео.
  7. Boogu-Image-0.1 — Efficient Image Generation Foundation Model — !«メールアドレス», score 5, 2026-06-17. Лёгкая и эффективная открытая базовая модель генерации изображений.
Закрытые модели
  1. Midjourney переходит от ИИ генерации изображений к бизнесу медицинских УЗИ-сканеров — !«メールアドレス», score 58, 2026-06-18. https://lemmy.zip/post/66397234 。Во множестве связанных тредов (в том числе зеркалах Hacker News, score 40+) возникло крупное обсуждение «Midjourney Medical» и «Ultrasonic CT». Это одна из крупнейших новостей о смене направления давно существующего закрытого сервиса генерации изображений.
  2. Midjourney потребовала от студий Голливуда раскрыть подробности использования ИИ — !«メールアドレス», score 73, 2026-07-05. https://lemmy.today/post/56011946
  3. Вышла новая модель изображений Google «Nano Banana 2 Lite» — !«メールアドレス», score 0, 2026-07-02. https://lemmy.world/post/48936394(hackernewsミラー: https://lemmy.bestiver.se/post/1199483 )
  4. MAI-Image-2.5 от Microsoft приблизилась к Nano Banana 2 от Google в бенчмарке — !«メールアドレス», score 1, 2026-05-28. https://lemmy.durstig.online/post/35068
  5. Практический сравнительный обзор Seedream 5.0 Pro — !«メールアドレス», score 1, 2026-07-10. https://lemmy.durstig.online/post/46063
  6. Runway сообщила, что её корпоративный бизнес удвоился, а чистый коэффициент удержания дохода превысил 300% — !«メールアドレス», score 0, 2026-08-30. https://lemmy.durstig.online/post/56937
  7. Функция Google Earth AI была тихо отозвана на следующий день после запуска из-за проблемы генерации NSFW — !«メールアドレス», score 1, 2026-08-07. https://lemmy.durstig.online/post/52162
Сигналы (Signals)
  • Открытый сегмент почти полностью посвящён MiniMax H3: почти половина постов сообщества stable_diffusion с конца августа до начала сентября 2026 года — расширения ComfyUI и инструменты ускорения для MiniMax H3: генерация видео, локальная работа даже на RTX 3060-уровне, аудио. Возникает впечатление, что модель становится де-факто стандартом открытой видеогенерации.
  • Граница между открытым и закрытым размывается: MiniMax H3 имеет «открытые веса», но коммерческое использование требует платной лицензии через Comfy. Модель, доступная бесплатно, но платная для коммерции, — признак распространения гибридного подхода «открытое/закрытое».
  • Главная новость закрытого сегмента — «уход»: намного больше score, чем новости о соревновании новых моделей, получила история о переориентации Midjourney с генерации изображений на медицинское оборудование (58–73). Пользователей Lemmy особенно заинтересовало, что один из крупнейших закрытых игроков переключается в совершенно другую сферу.
  • 3D-генерация также интегрируется в ComfyUI: открытые модели Text/Image-to-3D, такие как Trellis.2 и Pixal3D, становятся базовыми функциями ComfyUI. Локальные пайплайны включают уже не только изображения и видео, но и создание 3D-ассетов.
  • В Lemmy в целом нет большого специализированного сообщества по ИИ генерации изображений/видео; обсуждение распылено между техническими stable_diffusion-сообществами на несколько тысяч участников и маленькими бот-сообществами вроде ai_reddit с 50 подписчиками.
Ограничения (Limits)
  • Lemmy федеративна, а поисковый API одного инстанса покрывает лишь собственный индекс. Поэтому поиск API lemmy.world пропускает посты с других инстансов (lemmy.dbzer0.com, lemmy.today и т. п.). В этом исследовании использовались API и поиск нескольких инстансов, но полного охвата нет.
  • В сообществе localllama на lemmy.ml прямой запрос данных сообщества (/api/v3/community) завершался 404, поэтому подробно его проверить не удалось.
  • !«メールアドレス» — бот-сообщество, механически репостящее RSS Reddit; при 50 подписчиках там почти нет человеческого обсуждения. Его можно использовать как источник новостей, но не как показатель активности дискуссии в Lemmy.
  • Прямые поиски по закрытым сервисам видеогенерации (Sora, Kling, Runway Gen, Veo и т. п.) в Lemmy почти не нашли тематических постов: попадались главным образом нерелевантные результаты по географическим названиям, людям или текущим событиям. Для Runway найден только один материал о финансовых результатах.
  • Масштаб числа публикаций по сравнению с Reddit крайне мал: score обычно в диапазоне от единиц до десятков. Только по Lemmy нельзя собрать достаточно большую базу, чтобы «прочитать около 20 публикаций и говорить о трендах». В этот раз выполнены семь тематических поисков по нескольким инстансам и отобраны показательные реальные посты.

Pinterest

Pinterest — Новости генерации изображений и видео ИИ

Визуальные темы
  • Стиль «YouTube-превью / обложка статьи блога» встречается подавляюще часто. Тёмный или тёмно-синий фон, неоновые градиенты синего, фиолетового и оранжевого, крупные жирные заголовки без засечек («AI NEWS», «THE FUTURE IS AI», «BREAKING NEWS», «AI IS CHANGING EVERYTHING!» и т. п.). Чаще показывают не сам результат генерации, а обложки материалов и видео об ИИ [2, 7, 11, 38, 39, 42, 48]
  • Лица и портреты — центральный мотив. Анимация мимики, липсинк, воспроизведение лица (Microsoft VASA-1), ИИ-фотосессии портретов (ChatGPT+Higgsfield) и подобные образы повторяются [13, 14, 18, 23, 50]
  • Визуалы гуманоидов и роботов часто используются как общий символ «ИИ». Во многих случаях это универсальные стоковые изображения — белый профиль робота или женщина-киборг, — не связанные с конкретным инструментом [2, 39]
  • Композиции «до/после» и «одно входное изображение → несколько стилей». Сравнительные сетки, где реальное видео превращают в дерево, оригами, Lego или букет цветов (предположительно инструмент Luma), либо плюшевого персонажа помещают в фотореалистичный фон [3, 31]
  • Инфографика сравнения и рейтингов инструментов. Заметны изображения-списки с логотипами, таблицы «Best Quality (Paid) vs Best Free», функциональные сравнения с галочками — сохранённые инфографики, помогающие выбирать инструменты [7, 37]
  • Превью с лицами реальных знаменитостей или похожими на них лицами. ИИ-портрет в стиле Jeff Bezos, похожий на ютубера бородатый ведущий «AI NEWS», фотографии выступлений Jensen Huang из NVIDIA — лица используются ради доверия и актуальности [11, 36, 40]
  • Наложение сетки или каркаса лица. В рекламных пинах встречаются линии сетки и цифровые метки поверх лица и шеи, вызывающие ассоциации с анализом мимики и биометрией [23, 50]
  • Согласованная цветовая палитра. Тёмная основа с неоновыми акцентами циана, мадженты и жёлтого — почти общий визуальный язык пинов об ИИ-инструментах [2, 7, 38, 39, 42]
Заметные пины
  1. [1] Image to Video AI: How It Works and Why It Matters — обложка объясняющей статьи со схемой, показывающей механизм создания «видеотаймлайна» из одного статичного изображения.
  2. [3] Google announces ultra-high quality video... (на деле демонстрация трансформации стиля с сохранением идентичности в духе Luma) — сетка 3×5, где исходное видео превращается в дерево, оригами, Lego, цветы и другие материалы. Хорошо показывает технологию, способную менять текстуру при сохранении согласованности человека и автомобиля.
  3. [7] 6+ Best AI Video Generation Websites — инфографика для сохранения, сравнивающая шесть инструментов — Runway, Pika, Kling AI, Luma AI (Dream Machine), Canva AI и Hailuo AI — по функциям, целевой аудитории и наличию бесплатного плана.
  4. [10] Veo 2 — рекламный пин для Google VideoFX: фотореалистичная сцена с человеком у микроскопа, пловец под водой, анимированная женщина, танцующая со созвездиями, и другие стили видео собраны в одной картинке.
  5. [14] Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — рекламное изображение, показывающее доступность генерации изображения в видео через Gemini API и подчёркивающее нативную поддержку аудио.
  6. [23] Microsoft Unveils VASA-1 — технология, создающая выразительное видео говорящего лица почти в реальном времени, используя лишь одну фотографию, аудиоклип и произвольный управляющий сигнал. В превью собраны лица разных людей и разные эмоции.
  7. [27] ShengShu Technology Unveils Vidu S1 — пин об анонсе Vidu S1 от китайской ShengShu Technology, заявляющий «интерактивную генерацию в реальном времени»; визуал с персонажем в киберпанк-стиле.
  8. [31] Google announces video generation AI 'Veo 3' — четыре примера, в которых входное изображение — плюшевый фиолетовый монстр — помещается в фотореалистичную серверную, подводные руины и город из конфет.
  9. [33] 'Amuse 3.0', an AI art creation tool — анонс новой версии локального инструмента генерации изображений от AMD, основанного на Stable Diffusion. На фоне преобладания закрытых систем это один из немногих конкретных сигналов в пользу локального/открытого подхода.
  10. [42] Breaking News Latest AI Developments — сводка из трёх новостей: агентные функции Grok 4.6, миллиард пользователей Gemini (150 млн генерируемых изображений в день) и AI Robot Phone от Honor; датировано 12 августа 2026 года.
Сигналы
  • Закрытые игроки заметно доминируют. Крупные анонсы Google Veo 2/Veo 3, Microsoft VASA-1, OpenAI, Grok 4.6, Gemini (преодоление одного миллиарда пользователей) становятся непосредственным материалом для пинов. Между тем в реально просмотренных изображениях почти не встречались типичные названия открытых проектов — Stable Diffusion, ComfyUI, Flux, Wan, HunyuanVideo, LTX; исключением стал Amuse 3.0 от AMD [33], локальный инструмент. Pinterest, вероятно, больше ориентирован на обычных потребителей и маркетологов с их «сводками/сравнениями», чем на техническое сообщество.
  • Концентрация на сценариях создания и анимации лиц. Липсинк, воспроизведение мимики, альтернатива портретным съёмкам, ИИ-видео в стиле новостного ведущего — все эти сценарии повторяются. Вероятно, это результат пересечения поискового спроса Pinterest (красота, работа над собой, идеи для соцсетей) с маркетингом ИИ-видео.
  • Вторичные сводки преобладают над первичной информацией. Скриншотов реальных результатов моделей меньше, чем миниатюр вида «лицо автора + заголовок» и инфографики сравнений. Pinterest работает скорее не как точка распространения первичных анонсов, а как вход в блоги, видео YouTube и партнёрские статьи.
  • Сигнал отсутствия: в выбранной выборке не найдено пинов, упоминающих японские публикации или компании — например, японские ИИ-стартапы или отечественные сервисы видеогенерации. Почти всё относится к англоязычным инструментам и новостям.
Ограничения
  • Из 50 позиций в output/pinterest.pins.md ради репрезентативности были открыты и проверены 24 изображения; для остальных 26 были доступны только заголовки. Предполагается, что они укладываются в те же визуальные паттерны — инфографика, лица/портреты, сравнение инструментов.
  • У восьми пинов заголовок «(untitled)» ([12, 19, 20, 30, 35, 39, 46, 50]); изображения [39] и [50] проверены, остальные — нет.
  • В данных, собранных воркером для этого этапа, нет разбивки по жанрам (pinterest.pins.md представляет собой единый плоский список), поэтому распределение по жанрам не составлялось.
  • Сам Pinterest в ходе этого этапа не просматривался: согласно плейбуку, анализ основывался только на заранее собранных воркером изображениях и заголовках. Данные о вовлечённости пинов — лайки, сохранения, комментарии — не были собраны и недоступны.

Рекомендуемые действия

  • Повторно выполнить поиск в X с явными названиями моделей и инструментов (Stable Diffusion, ComfyUI, Flux, Wan, Kling, Sora), а не полагаться на список трендовых тем.
  • Создать постоянный список известных аккаунтов Bluesky для опроса через getAuthorFeed, поскольку app.bsky.feed.searchPosts в этом запуске вернул 403.
  • Явно помечать гибридные открыто-коммерческие модели, такие как MiniMax H3, вместо отнесения их к одной категории «открытых».
  • Постоянно отслеживать крупные повороты и закрытия продуктов (медицинский поворот Midjourney, окончание поддержки Sora API), поскольку они вызывают больше интереса в Reddit и Lemmy, чем обычные анонсы продуктов.
  • Рассматривать Pinterest как индикатор потребительского восприятия, а не как первичный технический источник, учитывая почти полное отсутствие в нём открытых моделей.

Собранные изображения

Image to Video AI: How It Works and Why It Matters - The Data Scientist🎨 Создание изображений и видео с ИИGoogle announces ultra-high quality video...Опасения по поводу ИИ-контента и социальных медиаУниверсальная платформа ИИ для генерации изображений и видео — The Data ScientistКонцепция создания контента с ИИ: иконки для генерации текста, изображений, музыки и видео — Browse 57 Stock Photos, Vectors, and VideoПросто сделай это 🎥️ Image to Video AI — оживляйте свои фотографии с ИИСоздание видеоконтента с ИИ: высокодоходные авторы,...Google представляет Veo 2: продвинутый инструмент ИИ-видеогенерации с улучшенным реализмом и кинематографичными возможностямиНовости ИИ: OpenAI наконец выпустила то, о чём мы просилиизображениеСоздавайте фотореалистичные ИИ-фотосессии себя с ChatGPT + Higgsfield 📸🤖Veo 3 Image-to-Video: быстрая генерация и нативное аудио через Gemini APIТоп-10 инструментов липсинка (2026) — лучшее ИИ-ПО для реалистичного липсинк-видеоЛучшие генераторы ИИ-видео 2025 годаИИ для генерации изображений и видео‎🚨 ИИ становится пугающе хорошим.изображениеизображениеАнализ изображений и видео на основе ИИБолее 20% YouTube теперь создаётся ИИMicrosoft представляет VASA-1, задавая новые стандарты генеративного ИИ в создании видеоИИ-генерированные видео: хорошо или плохо? Вот правда! 🤖🎥инструменты ИИЧто такое Imagvio AI и как он помогает авторам...ShengShu Technology представляет Vidu S1, обеспечивая интерактивную генерацию ИИ-видео в реальном времениОсваиваем видео и ИИ: ключевые тенденции маркетинга в соцсетях 2025"Преобразуйте своё видение в персонализированные 4K-видео на базе ИИ 🎥✨"изображениеGoogle announces video generation AI 'Veo 3',...История генеративного ИИИнструмент создания ИИ-арта «Amuse 3.0», включающий...Новости ИИ за эту неделю — 15 августа 2026изображениеЯ сделаю объясняющее ИИ-видео с synthesia sora ai kling ai runway ai invideo🚀10 лучших инструментов ИИ для изображений и видео в 2026 | сравнение бесплатных и платных ИИ-инструментовНовости ИИ и последние обновления | тенденции и прорывы в искусственном интеллектеизображениеНовые инструменты ИИ Nvidia 🤯 #news #ai #openai #chatgpt #highlights #shortsРост рынка генераторов ИИ-видео 2025–2032: трансформация будущего создания видео 🎥🤖Последние ИИ-разработки: Grok 4.6, Gemini 1B, Honor Robot PhoneПреобразуйте свои идеи в потрясающие визуальные материалы! 🎥Профессиональное создание ИИ-видео | кинематографичные ИИ-видео | индивидуальный монтажГенерация изображений ИИизображениеГенерация видео 📹"Почему ИИ-чатботы не успевают за срочными новостями"Как создать новостной канал с ИИ || генератор ИИ-новостных видео || ИИ-липсинкизображение

Примечание о качестве данных

X и Bluesky существенно не дотянули до целевого уровня брифа — около 20 постов на платформу (X показал лишь 4 тематических поста, все о закрытых моделях; поисковый API Bluesky вернул 403, поэтому покрытие основывалось на известных аккаунтах). Reddit, Lemmy и YouTube также собрали меньше материалов, чем требовалось, а YouTube не смог подтвердить просмотры и число подписчиков из-за JavaScript-рендеринга страниц.

Галерея