KEN’S CAT LOG

Новости ИИ для генерации изображений и видео — 2026-09-06

OpenAI GPT-6 Astra практически монополизирует закрытый сегмент не столько как «генератор изображений и видео», сколько как «агент для управления ПК», тогда как в открытом сегменте вокруг ComfyUI последовательно накапливаются новости об интеграциях Qwen Image и MiniMax-H3.

Сводка новостей ИИ для генерации изображений и видео — 2026-09-06

Серьёзно, эта неделя была просто безумной 😳🔥 В закрытом сегменте царит настоящий фестиваль OpenAI «GPT-6 Astra»: все обсуждают его скорее как агента, который целиком управляет компьютером, а не как средство генерации изображений и видео. Sora, напротив, тихо уходит со сцены — похоже, инвестиции смещаются от видеогенераторов к агентному ИИ. В открытом сегменте Qwen Image, Z-Image Turbo, HunyuanImage и MiniMax-H3 методично получают обновления вокруг ComfyUI; без громких анонсов, но плотность новостей об интеграциях действительно высокая. Честно говоря, в этот раз поиск неудачно сработал на некоторых платформах (Reddit, X, Bluesky), поэтому не по всем из них удалось полноценно изучить 20 материалов; это прямо отмечено ниже в разделе «Качество данных» 🙏

Across platforms

  • GPT-6 Astra (OpenAI) почти полностью доминирует в закрытом сегменте: и на X (@masahirochaen, https://x.com/masahirochaen/status/2095644339041153256), и на Bluesky (@todaystopainews, https://bsky.app/profile/todaystopainews.bsky.social/post/3mur7cyocf225) он захватил внимание сразу после запуска. Вирусно распространяется бенчмарк ARC-AGI-3: 98,6% против 7,8% у предыдущего поколения.
  • Astra обсуждают скорее как средство агентного управления, чем как генератор изображений: и X (@aigeboku, тестирование функции ComputerUse), и Bluesky (демо автоматической сборки города в Unity) уделяют больше внимания тому, как он «сам управляет ПК», чем одиночным изображениям или видео. Похоже, формируется по-настоящему новый жанр.
  • Fable 5.1 очень часто используют как точку сравнения: @renoiseai и @Mayz1169 независимо выложили на X ролики «Astra vs Fable 5.1», отрендеренные через Seedance 2.5. В публикации @k_matsumaru Fable 5.1 выступает не финальным рендерером, а слоем генерации промптов в цепочке из четырёх инструментов. Почти никто не завершает работу одной моделью.
  • Агрегаторные API становятся заметнее в обоих сегментах: на Reddit WaveSpeedAI объединяет более 1 000 моделей через один REST API, а на Bluesky useapi.net сравнивает Veo, Kling, Seedance, PixVerse, Hailuo, Runway и Nano Banana. В обоих случаях практической информации в них больше, чем в официальных аккаунтах.
  • Открытый сегмент формируют Qwen Image / Z-Image Turbo (Alibaba и Tongyi-MAI), HunyuanImage (Tencent) и восходящий MiniMax-H3: это достаточно убедительно подтверждается обзорами на YouTube и сообществом !«メールアドレス» на Lemmy.
  • Экосистема вокруг MiniMax-H3 — открытовесовой видеомодели — растёт очень быстро: только на Lemmy с 8 августа по 5 сентября появилось более 10 материалов: GGUF-квантизация, Turbo LoRA, поддержка 120-секундных роликов, гибридное внимание. На X @ImaStudio_ai также строит на её основе коммерческий инструмент — это подтверждается на разных платформах.
  • ComfyUI окончательно стал центром управления открытым сегментом: Lemmy, Bluesky (@kunecco), обучающие ролики на YouTube — везде поддержка ComfyUI служит проверкой того, насколько технология реальна и применима.
  • Мультишот и синхронизация со звуком — следующая общая ось конкуренции открытых и закрытых моделей: Wan 2.6 (открытая) напрямую сравнивали на YouTube в стресс-тестах с Kling 3.0, Seedance 2.0 и Runway Gen-4.5 (закрытыми).
  • Сомнения в духе «Это ИИ или настоящее?» присутствуют повсюду: шутки Reddit о сломанных руках, обсуждения в сообществах, пины Pinterest с викторинами «Which is AI?» — тревога одна и та же независимо от платформы.
  • Официальные аккаунты брендов в соцсетях почти неактивны: на Bluesky Midjourney (последняя публикация 2025-10-08) и Kling AI (ноль публикаций) фактически заброшены. Похоже, неофициальные авторы, частные лица и агрегаторы распространяют новости быстрее на всех платформах.

Platform by platform

Reddit — собраны 12 тредов из 9 сабреддитов (меньше целевых примерно 20). Главные темы — резкая негативная реакция на новый способ подделывать целые таймлапсы ручного рисования, заставляя LLM управлять мышью (r/antiai, 5 259 баллов); агрегаторный API WaveSpeedAI; быстрая локальная генерация Krea-2-Turbo на Apple Silicon (45 секунд на изображение). В r/VeniceAI также есть публикации опытных пользователей с подробным разделением моделей по задачам генерации, редактирования и превращения изображений в видео. Сильна и критика этики и качества: разгром ИИ-изображений еды и вакансии за $30/час, превращающиеся в спам.

X — растущие темы в Explore оказались привязаны к Хорватии, где расположен сервер: 7 из 10 слов (Bitcoin, Украина, Аргентина и другие) вообще не относились к теме. Все релевантные публикации были связаны с GPT-6 Astra; запросы об открытых моделях (Stable Diffusion, Wan, Flux и другие) в этот раз вообще не запускались. Поэтому вывод по открытому сегменту X в этом выпуске — не «ничего нет», а «не исследовалось».

YouTube — крупнейшая новость закрытого сегмента — прекращение работы Sora: приложение закроется 26 апреля 2026 года, а API — 24 сентября 2026 года; число загрузок за 11 месяцев упало с 3,3 млн до 1,1 млн. В открытом сегменте много первых тестов Qwen Image, HunyuanImage и Z-Image Turbo, а FLUX.2 (Apache 2.0) от Black Forest Labs упоминается как конкурент.

Bluesky — API полнотекстового поиска публикаций (searchPosts) отвечал 403 на все запросы, поэтому метод был заменён поиском аккаунтов; число проанализированных материалов осталось ниже целевых 20. В закрытом сегменте преобладают новостные боты вроде todaystopainews и useapi.net, в открытом — готовые работы частных авторов вроде 虹色 и くねっこ. Технических новостей об открытом ПО на Bluesky почти нет.

Lemmy — площадка небольшая, но !«メールアドレス» (5 708 участников) фактически стала доской оперативных новостей открытого сегмента: здесь много интеграций MiniMax-H3 и поддержки LTX-2.5 в день релиза. Закрытый сегмент чаще воспринимается как повод для иронии или скандала — например, история с разворотом Midjourney в сторону медицинского оборудования. Первичных публикаций о Sora, Veo, Kling и Hailuo на Lemmy найти не удалось.

Pinterest — изучены 50 предварительно собранных пинов по одному запросу без разбивки по жанрам. Почти всё — списки сравнения закрытых инструментов и новостные инфографики о Runway, Pika, Kling, Luma, Synthesia и HeyGen. Открытый сегмент затронут лишь в двух материалах: Baidu Ernie 4.5 и AMD Amuse 3.0. Это фактически рынок SEO и маркетинга закрытых инструментов.

What to watch

Recommendations

  • Продолжать сравнивать GPT-6 Astra с Fable 5.1 не только по качеству изображения и видео, но и по возможностям агентного управления.
  • В следующем выпуске продолжить следить за экосистемой ComfyUI вокруг MiniMax-H3 — GGUF и Turbo LoRA — как за передним краем открытой видеогенерации.
  • В следующем исследовании X не опираться на тренды Explore, а явно запускать запросы по терминам открытого сегмента: Stable Diffusion, Wan, Flux, Qwen и другим.
  • В качестве первичного источника информации по открытому сегменту ставить !«メールアドレス» выше Reddit и Bluesky.
  • Не использовать Pinterest как источник динамики открытого сегмента; ограничить его наблюдением за маркетингом и SEO закрытых инструментов.
  • Проверить, не зависят ли внешние инструменты или рабочие процессы от закрытия Sora API 2026-09-24.

Data quality

На Reddit удалось собрать лишь 12 тредов вместо примерно 20 по критерию завершения: прямой сбор через WebFetch был невозможен, поэтому использовались только предварительно собранные материалы. На X большинство поисковых терминов — 7 из 10 — были нерелевантными трендами, а открытый сегмент не искался вообще, так что фактически он не исследован. На Bluesky API полнотекстового поиска публикаций отвечал 403, из-за чего пришлось переключиться на поиск аккаунтов и не удалось достичь целевого числа материалов. На YouTube из-за динамического рендеринга не удалось проверить большинство просмотров и числа подписчиков. Lemmy сам по себе мал, и первичные публикации о Sora/Veo/Kling/Hailuo обнаружить не удалось — возможно, из-за ограничений охвата поиска. Pinterest ограничен 50 материалами по одному общему запросу; повторного специализированного поиска по открытому сегменту не проводилось.

Сводка по платформам

Reddit

Reddit — Новости ИИ для генерации изображений и видео

Где

По запросу «Image and Video Generation AI News» были собраны 12 тредов из 9 сабреддитов.

Сабреддит Число участников Число собранных тредов
r/StableDiffusion 1,001,169 1
r/teenagers 3,674,216 1
r/aiwars 166,685 1
r/antiai 314,968 2
r/generativeAI 150,823 3
r/RemoteWorkers 74,528 1
r/VeniceAI 10,421 1
r/DailyIncome 12,914 1
r/freetoolsAI 7,736 1

r/generativeAI (3 треда) и r/antiai (2 треда) чаще других обсуждают эту тему. r/antiai критически относится к генерации ИИ-изображений, тогда как r/generativeAI сосредоточен на сравнении инструментов и практических вопросах — настроения заметно различаются.

Что говорят люди
  • Предупреждение о подделке таймлапсов ручного рисования с помощью LLM (тред №1, r/antiai, 5 259 баллов и 760 комментариев, 2026-09-05, https://www.reddit.com/r/antiai/comments/1w81kdd/). Публикация описывает метод: GPT-6 получает доступ к мыши и клавиатуре и может убедительно подделать цифровой рисунок вместе с таймлапсом. Это вызвало резкую реакцию: «зачем выпускать такую технологию, если её единственная цель — вредить настоящим художникам» (u/sanstheskelebrotherc, 235 баллов).
  • Ежедневное сравнение бесплатных ИИ-инструментов для видео (тред №2, r/generativeAI, 42 балла и 28 комментариев, 2026-08-31, https://www.reddit.com/r/generativeAI/comments/1w3frr2/). В центре обсуждения Adobe Firefly (2 видео в день), PixVerse (1), Grok Imagine (1), Google Flow (3–4); в комментариях упоминались Kling AI (66 кредитов каждые 24 часа, то есть 2–6 пятисекундных роликов 720p) и ежедневные бесплатные кредиты CapCut.
  • Тред с бесплатными и безлимитными генераторами изображений (тред №3, r/freetoolsAI, 37 баллов и 38 комментариев, 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/). Главный вопрос в комментариях — поддержка NSFW: наряду с вопросом «почему все банят NSFW?» (u/Relevant_Syllabub895) перечисляются Deepany, Aifun, Perchance и Z-Image-Turbo на huggingface.
  • Вакансия «$30/час за проверку ИИ-изображений» параллельно распространяется в двух сабреддитах (тред №4, r/RemoteWorkers, 114 баллов и 520 комментариев, 2026-09-04, https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/; тред №6, r/DailyIncome, 129 баллов и 1 123 комментария, 2026-09-04, https://www.reddit.com/r/DailyIncome/comments/1w7b18p/). Тексты вакансий почти совпадают, но большинство комментариев — однословные «images» и «Interested», похожие на шаблонные реакции ради ссылки на отклик.
  • Демонстрация ускоренной локальной генерации изображений (тред №5, r/StableDiffusion, 31 балл и 10 комментариев, 2026-09-03, https://www.reddit.com/r/StableDiffusion/comments/1w6bphf/). Сообщается о локальном запуске Vpipe + Krea-2-Turbo-M87 (16bit) на Apple Silicon M5 Pro с 24 ГБ: около 45 секунд на изображение 1024×1024 за 8 шагов, или 35 секунд при 8-битной квантизации в реальном времени.
  • Мем-тред о том, что ИИ-изображения всё труднее распознавать (тред №8, r/antiai, 113 баллов и 30 комментариев, 2026-08-30, https://www.reddit.com/r/antiai/comments/1w2mr8g/). На деле обсуждение сводится к классическим сбоям с руками: «почему её нога — это рука?» (u/GurInside278, 31 балл).
  • Оценка API-агрегатора WaveSpeedAI (тред №7, r/generativeAI, 2 балла и 4 комментария, 2026-09-05, https://www.reddit.com/r/generativeAI/comments/1w8ci5z/). По словам u/Jenna_AI, сервис объединяет «более 1 000 моделей, включая Flux, Wan 2.1/2.6, Hailuo и Kling, через единый REST API». Пользователь u/BradClarkAI, встроивший его в собственный инструмент через Seedance, сообщил, что проблем не было.
  • Практика выбора моделей в сообществе VeniceAI (тред №9, r/VeniceAI, 8 баллов и 6 комментариев, 2026-08-30, https://www.reddit.com/r/VeniceAI/comments/1w2rtq1/). u/jerm2z рекомендует Chroma для генерации изображений; Qwen Edit Uncensored или Seedream для редактирования; FireRed для высокой согласованности лиц, хотя без NSFW; WAN Enhanced, Seedance и Minimax R2V для image-to-video.
  • ИИ-изображения еды резко раскритиковали как неаппетитные (тред №10, r/aiwars, 4 балла и 175 комментариев, 2026-09-03, https://www.reddit.com/r/aiwars/comments/1w69cdj/). Один из комментариев описывает результат как «grub hive» — гнездо личинок (u/LCI_Jake, 14 баллов). Пользователь u/Bassed_Hummble попробовал локально сгенерировать изображение в Krea 2 за 40 секунд и задался вопросом, почему при несложном промпте результат настолько плох.
  • Спор молодых пользователей о допустимости ИИ-арта (тред №12, r/teenagers, 7 баллов и 41 комментарий, 2026-08-31, https://www.reddit.com/r/teenagers/comments/1w2y305/). Автор утверждает, что ИИ получает промпт и сам создаёт изображение, что принципиально отличается от творчества человека с материалами или программами. Мнения разделились. u/TheDarkmore сообщил, что не умеет рисовать и поручил ИИ изображения для 120 карт карточной игры — и считает это нормальным.
Сигналы
  • Рост: новый метод подделки «ручного» рисования через LLM, управляющую мышью и клавиатурой (тред №1), вызывает быструю реакцию как отдельная угроза, не сводимая к обнаружению диффузионных моделей, и добавляет новый очаг конфликта между сторонниками и противниками ИИ. Одновременно незаметно растут инфраструктурные и оптимизационные темы для разработчиков: агрегаторы, объединяющие более 1 000 моделей в одном API, как WaveSpeedAI (тред №7), и быстрая локальная генерация на Apple Silicon (тред №5).
  • То, что высмеивают или недооценивают: ИИ-реклама еды (тред №10) получает отзывы вроде «лучше вставить стоковую фотографию»; ограничения качества постоянно подчёркиваются. Вакансии на $30/час за проверку ИИ-изображений (треды №4 и №6) имеют практически идентичное содержание, а комментарии состоят из шаблонных реакций ради ссылки на отклик. Содержательного разговора нет, поэтому они, вероятно, воспринимаются как спам.
  • Неожиданное противоречие: при общей теме «ИИ-изображения всё сложнее отличить» в r/antiai (тред №8) ещё смеются над дефектами рук, тогда как в треде №1 новый способ подделать даже таймлапс воспринимается как серьёзная угроза. Оценки реального состояния обнаружения ИИ-изображений расходятся даже внутри сообщества. Аналогично, r/VeniceAI и r/StableDiffusion обсуждают техническое применение и оптимизацию, а r/antiai и r/aiwars развивают жёсткую критику этики и качества: отношение к ИИ-генерации на Reddit сильно разделено между сабреддитами.
Ограничения
  • Использовался только один поисковый запрос — «Image and Video Generation AI News»; отдельный поиск по «open source» и «closed source» не проводился. Поэтому этот файл сам по себе не может напрямую разделить требуемые брифом минимум 10 наблюдений для открытого и закрытого сегментов; классификация нужна на уровне сводного отчёта.
  • Критерий завершения брифа — анализ примерно 20 публикаций на каждую соцсеть, но было собрано только 12 тредов.
  • В тредах №4 и №6 (вакансия $30/час) большинство комментариев — шаблонные ответы вроде «images» и «Interested», так что содержательных обсуждений и проверок нет.
  • Reddit блокирует прямую загрузку страниц через WebFetch и поиск, поэтому анализ основан только на предварительно собранных файлах воркера (reddit.threads.md/json); дальнейшее углубление — отслеживание связанных тредов, раскрытие комментариев и так далее — в этой поисковой сессии не проводилось.

X

X — Новости ИИ для генерации изображений и видео

Собственный список Explore X в этой сессии геолокализован в Хорватии (местоположение сервера), а не в Японии и не в глобальной ленте: там в трендах были «Astra», «Bitcoin», «Ukrainian», «Argentina», «$SONG», «OpenAI», «Russia», «Black», «$KURO», «Fable», без числа публикаций. Только три из десяти терминов — «Astra», «OpenAI» и «Fable» — имели отношение к ИИ для генерации изображений/видео. Остальные относились к прогнозам цен криптовалют, войне России и Украины, слухам об аргентинских знаменитостях и мемкоинам; ниже они не рассматриваются — см. «Ограничения».

Аккаунты

Релевантные аккаунты — по фактическому содержанию публикаций:

Аккаунт Что публикует Охват этой публикации
@masahirochaen (チャエン) Японский аккаунт новостей об ИИ и технологиях; сообщил о запуске GPT-6 Astra с цифрами бенчмарков, затем опубликовал продолжение о словах Альтмана «за Astra есть нечто большее» 2 публикации, 841 + 133 лайка, до ~550 000 просмотров у запуска
@UNIBRACITY (SHINTARO) Любитель 3D, совмещающий GPT-6 Astra и Blender 1 публикация, 306 лайков
@hayashimon1 (ハヤシモン|AI×個人開発) Создатель ИИ/3D-контента, также проводит платные семинары; использует Fable 5.1 × Blender 1 публикация, 55 лайков
@manaimovie (Mankyu) Любитель ИИ-видео, передающий Astra 3D-модель Tripo 1 публикация, 409 лайков
@yachimat_manga (yachimat‑AI Short Anime) Создатель коротких ИИ-аниме, предполагающий, что Astra может заменить специализированные генераторы видео для некоторых стилей 1 публикация, 51 лайк
@aigeboku (AI様の下僕) Опытный пользователь ИИ, тестирующий агентное управление Astra «ComputerUse» 1 публикация, 653 лайка
@gagarot200 (ガガロット) Аккаунт с ИИ-демо, ролики «один промпт — игра» 1 публикация, 306 лайков
@SSSS_CRYPTOMAN Аккаунт на пересечении крипто и ИИ, опубликовал демо создания игры в Astra 1 публикация, 161 лайк
@Mayz1169 (Kiki) / @renoiseai (Renoise) Аккаунты сравнений ИИ-видео: оба сопоставляют GPT-6 Astra и Fable 5.1, рендеря через Seedance 2.5 по 1 публикации, 64 и 140 лайков
@k_matsumaru Создатель ИИ-видео, документирующий полную цепочку Typeless → Fable 5.1 → Seedream 5.0 → Seedance 1 публикация, 279 лайков
@Strength04_X Аккаунт с промптами для Seedance 2.5 (через lovart_ai) 1 публикация, 444 лайка
@ImaStudio_ai Аккаунт продукта/студии собственного инструмента для ИИ-модных видео на основе MiniMax H3 1 публикация, 132 лайка

Все эти материалы — одиночные публикации, а не треды и не долгие кампании: это разрозненная однодневная реакция на запуск, а не организованная дискуссия, которую ведёт один аккаунт.

Публикации
24. @masahirochaen (チャエン)

【Срочная новость】OpenAI представила «GPT-6 Astra». Наконец выпущена основная модель, превосходящая Fable 5.1 и способная целиком выполнять работу на ПК. …ARC-AGI-3 (способность решать незнакомые головоломки): 98,6%. У предыдущего поколения GPT-5.6 — 7,8%. Невероятный рост.

Это безусловно крупнейшая публикация в подборке и та, которая задаёт рамку для всех остальных: GPT-6 Astra представлен как агент для управления ПК, превосходящий Fable 5.1; заявлен скачок ARC-AGI-3 с 7,8% у GPT-5.6 до 98,6%.

21. @masahirochaen (チャエン)

Сэм Альтман открыто говорит о том, что находится «за пределами» GPT-6… Он прямо заявил, что модель, работу над которой в августе временно остановили из-за киберрисков, не была GPT-6 Astra.

Через два дня после запуска тот же аккаунт сообщил слова Альтмана: модель, которую OpenAI приостановила в августе из-за киберрисков, была не Astra — это указывает на существование ещё более мощной невыпущенной модели.

3. @aigeboku (AI様の下僕)

Как и следует из слов о высокой способности управлять другими, GPT-6 Astra с ComputerUse расширяет круг возможного… Одного удара, конечно, недостаточно, но после дальнейшей настройки можно получить ещё более интересные выразительные средства.

Публикация описывает главное преимущество Astra как агентное управление («ComputerUse»), а не сырой уровень генерации: ранние тестировщики изучают, что такое управление открывает для творческих процессов, а не только для выдачи изображений.

1. @manaimovie (Mankyu)

Я передал учителю Astra модель, сделанную в Tripo, и попросил оживить её — вот что получилось. …Это заметно лучше, чем с Fable или Sol!

Конкретное заявление о процессе «до/после»: передача Astra 3D-модели из Tripo и просьба её анимировать дали результат лучше, чем та же операция в Fable или «Sol».

22. @gagarot200 (ガガロット)

GPT-6 Astra полностью автоматически выдаёт результат… Достаточно одной фразы: «GPT-6 Astra, сделай такую игру» — и описать, какую именно.

Демо: один промпт создаёт готовую играбельную игру от начала до конца, подтверждая позиционирование Astra как модели, которая «выполняет задачу целиком».

23. @UNIBRACITY (SHINTARO)

GPT-6 Astra × Blender — «Forest Retreat / Лесное убежище». Время работы Astra: около 7 часов; за это время удалось сделать вот столько.

Примерно семичасовой запуск Astra создал полноценную 3D-сцену в Blender — это одна из наиболее конкретных точек данных о фактической длительности работы.

4. @SSSS_CRYPTOMAN (SSSS.CRYPTOMAN⚡️AI)

С GPT-6 Astra игра была готова в мгновение ока! 🎮… После нескольких сообщений на основе грубого промпта получилась вещь нормального качества, в которую можно играть.

Ещё одно демо перехода от расплывчатого промпта к игре с рабочей ссылкой, независимо повторяющее утверждение @gagarot200.

2. @yachimat_manga (yachimat - AI Short Anime)

Попробовал моделирование в GPT-6 Astra. …Разве не возможно будущее, где для некоторых стилей видео специальные генераторы видео уже не понадобятся?

Практикующий автор ИИ-аниме рассуждает, что для некоторых стилей 3D-моделирование Astra может сделать специализированные видеогенераторы ненужными.

40. @renoiseai (Renoise)

GPT-6 Astra vs Fable 5.1. Оба видео сгенерированы через Seedance 2.5 на Renoise.

Прямое сравнение лоб в лоб: оба результата отрендерены одним нижележащим инструментом, Seedance 2.5, чтобы контролировать эту переменную.

39. @Mayz1169 (Kiki)

На секунду забудьте о бенчмарках. Просто посмотрите. GPT-6 Astra и Fable 5.1 рядом, одинаковые промпты. Что бы вы выбрали?

Тот же инстинкт сравнения, что и выше, но независимо: противостояния Astra и Fable 5.1 — узнаваемый микрожанр этой подборки, а не единичный случай.

37. @k_matsumaru (松丸 彗吾)

Как я теперь делаю видео… ① Пишу техническое задание в Typeless ② Прошу Fable 5.1 написать промпт для генерации видео ③ Создаю раскадровку в Seedream 5.0 Pro и проверяю содержание ④ Seedance…

Самая подробная производственная цепочка в подборке: Typeless для сценария → Fable 5.1 для промптов → Seedream 5.0 Pro для раскадровки → Seedance для финального видео. Здесь Fable — слой промптинга, а не сам рендерер.

32. @ImaStudio_ai (Ima Studio)

MiniMax H3 K-Fashion Outfit Change MV… 8 ОБРАЗОВ. 1 ДЕВУШКА. НОЛЬ ДРЕЙФА ИДЕНТИЧНОСТИ.

Коммерческий аккаунт студии продвигает продукт на MiniMax H3, позиционируя отсутствие дрейфа идентичности при смене одежды как ключевое отличие.

Сигналы
  • Что растёт: GPT-6 Astra (OpenAI) доминирует во всех релевантных публикациях этой выборки. О нём говорят прежде всего как об агентной модели, управляющей компьютером, и лишь затем как о генераторе изображений или видео. Тестировщики постоянно соединяют его с другими инструментами — Tripo для 3D-сеток, Blender для сцен — а не используют как самостоятельный рендерер.
  • Узнаваемый микрожанр: независимые аккаунты @renoiseai и @Mayz1169 без координации публикуют ролики «GPT-6 Astra vs Fable 5.1», отрендеренные через Seedance 2.5. Fable 5.1 становится естественной моделью для сравнения, а Seedance и Seedream постоянно появляются как фактический слой видеорендеринга под обеими системами.
  • Цепочки инструментов вместо одного инструмента: наиболее подробная публикация (@k_matsumaru, №37) соединяет четыре инструмента — Typeless → Fable 5.1 → Seedream 5.0 Pro → Seedance — для одного видео. Никто в этой выборке не описывает завершение ролика одной моделью.
  • Что удивило: тренды, полученные с панели Explore X, геолокализованной в Хорватии, — Bitcoin, Ukrainian, Argentina, $SONG, Russia, Black, $KURO — почти не связаны с ИИ для изображений и видео. Тренды X в этой локации 2026-09-05/06 — это крипто и геополитика, а не ИИ-модели; использовать их как показатель дискуссии об ИИ было бы ошибкой.
  • Что отвергают: в этой выборке не нашлось ни одного скептического или критического треда о GPT-6 Astra: всё релевантное — демо, репост бенчмарка или сравнительный ролик. Это отсутствие критики само по себе заметно, учитывая агрессивность заявления «превосходит Fable 5.1» в публикации №24.
Ограничения
  • Десять использованных поисковых терминов — «Astra», «Bitcoin», «Ukrainian», «Argentina», «$SONG», «OpenAI», «Russia», «Black», «$KURO», «Fable» — были взяты из трендов Explore этой сессии, а не из подобранного списка терминов по ИИ для изображений и видео. Семь из десяти — «Bitcoin», «Ukrainian», «Argentina», «$SONG», «Russia», «Black», «$KURO» — вернули публикации, полностью не связанные с темой исследования: крипторозыгрыши и прогнозы цен, война России и Украины, новости аргентинских знаменитостей и два небольших мемкоина. Они исключены из раздела публикаций.
  • Поэтому охват открытого сегмента здесь слаб и косвенен: ни одна публикация не искалась по «Stable Diffusion», «ComfyUI», «Wan», «HunyuanVideo» или «Flux». Эти запросы на этом этапе вообще не запускались. Всё релевантное относится к закрытым или коммерческим названиям: GPT-6 Astra, Fable 5.1, Seedance, Seedream, MiniMax H3, Tripo. Картину открытого сегмента на X следует считать отсутствующей, а не интерпретировать как «там ничего не происходит».
  • Публикация №35 (@MINHxDYNASTY, тег «$KURO») была собрана без текста, поэтому не могла использоваться как вывод.
  • Столбец «Где» в Explore геолокализован по месту расположения сервера — Хорватия, а не Япония и не весь мир; этот список нельзя читать как глобальную или японскую картину трендов.
  • Сбоев сессии или доступа не было: данные вернулись по каждому предпринятому запросу. Пробел тематический — в выбранных поисковых терминах, а не технический.

YouTube

YouTube — Новости ИИ для генерации изображений и видео (закрытый/открытый исходный код)

Каналы
  • Bijan Bowen (@Bijanbowen, около 37 000 подписчиков) — специализируется на детальных обзорах LLM и моделей генерации изображений. Проверял Qwen Image-2512.
  • Future Tools / Matt Wolfe (@mreflow, более 900 000 подписчиков) — еженедельно выпускает формат «Everything in AI This Week» с новостями об ИИ для изображений и видео, включая Midjourney и Runway.
  • Группа каналов с обучающими роликами по ComfyUI и локальной генерации: много видео о рабочих процессах Wan 2.2/2.6, FLUX и Qwen Image; в поисковой выдаче были видны только названия роликов, а не названия отдельных каналов.
Видео
  1. "Why OpenAI Shut Down Sora So Fast: What's Next?" — опубликовано примерно в марте–апреле 2026 года. Разбирает причины решения OpenAI закрыть приложение Sora 26 апреля 2026 года и сам API 24 сентября 2026 года: месячные загрузки упали с 3,3 млн в ноябре 2025 года до 1,1 млн в феврале 2026 года, а контракт с Disney на $1 млрд и три года сорвался. https://www.youtube.com/watch?v=H2jVcy5PuBI
  2. "Why Did Sora AI Shut Down? The Real Reason OpenAI Killed Its Viral Video App" — опубликовано весной 2026 года. Рассматривает экономическую стоимость видеоприложения, которому не удалось монетизироваться, и стратегический поворот к агентному ИИ. https://www.youtube.com/watch?v=MpLY9bjYVuA
  3. "HunyuanImage-3.0 First Test – The Open Source Nano Banana?" — опубликовано 29 сентября 2025 года. Локально тестирует HunyuanImage-3.0 от Tencent, одну из крупнейших открытых текст-в-изображение моделей, включая требования к оборудованию. https://www.youtube.com/watch?v=lLTv4sGf8Wo
  4. "Qwen Image-2512 First Test – The BEST Open Source Image Model!" (Bijan Bowen) — опубликовано 31 декабря 2025 года. Тестирует улучшения Alibaba Qwen Image-2512 в реалистичности людей и отрисовке текста. https://www.youtube.com/watch?v=SBaK616nP6Q
  5. "New Qwen Image 2512: Better Than Z-Image? (Open Source & Free)" — опубликовано 5 января 2026 года. Прямое сравнение Qwen Image 2511/2512 и Z-Image Turbo от Tongyi-MAI. https://www.youtube.com/watch?v=uAGH_yRZ2Gw
  6. "Tencent Hunyuan 2.1 vs. Qwen Image: Who is the True King? A 2K Image & Text Rendering Showdown!" — опубликовано 28 сентября 2025 года. Сравнение отрисовки 2K-текста у Hunyuan Image 2.1, тогдашнего лидера рейтингов открытых Text-to-Image моделей, и Qwen Image. https://www.youtube.com/watch?v=MUDTryJS0XM
  7. "Z-Image la nouvelle star des modèles Open Source?? Test dans ComfyUI" — опубликовано 28 ноября 2025 года. Проверяет открытую Text-to-Image модель Z-Image Turbo от Alibaba/Tongyi-MAI в ComfyUI. https://www.youtube.com/watch?v=eOKSBu7KLh0
  8. "Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models" — опубликовано 11 января 2026 года. Большой обучающий ролик о последних открытых моделях генерации изображений и видео — Wan 2.2, FLUX и Qwen Image — в ComfyUI. https://www.youtube.com/watch?v=3BFDcO2Ysu4
  9. "WAN 2.6 Hands-On: The Good, the Bad, and the Useful" — опубликовано 26 декабря 2025 года. Практическая проверка выпущенной Alibaba Wan 2.6: до 15 секунд, мультишоты и синхронизация со звуком. https://www.youtube.com/watch?v=iNnmLwPg7OE
  10. "Multi-Shot AI Videos: Wan 2.6 vs Kling 2.6 (Stress Test)" — опубликовано 27 декабря 2025 года. Стресс-тест мультишотной генерации у открытой Wan 2.6 и закрытой Kling 2.6. https://www.youtube.com/watch?v=CDRKn4I-Iv0
  11. "I Tested Google's Nano Banana Pro Tips - This One Creates Pro Graphics in 30 Seconds" — опубликовано примерно в ноябре–декабре 2025 года. Практический тест Gemini 3 Pro Image от Google DeepMind, также известной как Nano Banana Pro: 4K-вывод, поддержка более 14 объектов и многоязычная отрисовка текста. https://www.youtube.com/watch?v=ca4SXmRqtKE
  12. "Qwen Image Edit Review — Free Open-Source Alternative to Nano Banana" — опубликовано 4 декабря 2025 года. Обзор Qwen Image Edit — открытой модели редактирования как альтернативы закрытой Nano Banana. https://www.youtube.com/watch?v=Ur3udfFJ2QQ
Сигналы
  • Крупнейшая новость закрытого сегмента — уход Sora: OpenAI уведомила разработчиков 24 марта 2026 года, завершила приложение и веб-версию Sora 26 апреля, а API планирует закрыть 24 сентября 2026 года. Несколько роликов связывают это с резким падением загрузок — 3,3 млн в ноябре 2025 года против 1,1 млн в феврале 2026 года — и срывом партнёрства с Disney на $1 млрд. Это рассматривается как пример сдвига ресурсов отрасли от видеогенерации к ИИ для программирования и агентным системам.
  • В открытом сегменте действует схема «две силы плюс новая звезда»: Alibaba (Qwen Image, Z-Image Turbo, Wan 2.2/2.6) и Tencent (HunyuanImage 3.0/2.1) соревнуются за верхние места основных рейтингов, а FLUX.2 ([dev]/[klein]) от Black Forest Labs с опубликованным VAE под Apache 2.0 конкурирует в фотореализме. Авторы часто представляют Qwen Image и HunyuanImage как «открытую альтернативу Nano Banana», и прямое сравнение закрытых и открытых моделей стало устойчивым форматом.
  • В видео мультишоты и синхронизация со звуком становятся новым стандартом: Wan 2.6 (открытая) и Kling 3.0, Seedance 2.0, Runway Gen-4.5 (закрытые) соревнуются в создании нескольких кадров за одну генерацию и одновременном создании аудио и SFX. Конкуренция перешла от одиночных клипов к следующему уровню функций.
  • Многие обзоры выходят в формате «first test» или «first look» через несколько дней или неделю после анонса, и этот оперативный формат практической проверки уже закрепился.
Ограничения
  • Страницы результатов и просмотра YouTube (youtube.com/results, youtube.com/watch) рендерятся JavaScript, поэтому WebFetch получал только статичный футер — копирайт, ссылки на условия и тому подобное. Точные просмотры, число подписчиков и комментарии в большинстве случаев напрямую проверить не удалось. Указанные выше просмотры и подписчики приведены только там, где это можно было извлечь из описаний поисковой выдачи; для многих роликов просмотры не указаны.
  • Отдельные URL-обзоры Kling 3.0, Seedance 2.0 и Runway Gen-4.5 на YouTube найти не удалось: результаты поиска были смещены в сторону статей с техническими сравнениями на invideo.io, Pixo, AI.cc и других сайтах.
  • Число подписчиков отдельных каналов не удалось подтвердить, кроме Bijan Bowen (около 37 000) и Matt Wolfe / Future Tools (более 900 000).

Bluesky

Bluesky — Новости ИИ для генерации изображений и видео

Официальный поисковый API Bluesky (app.bsky.feed.searchPosts) в этой сессии стабильно отвечал 403 Forbidden, поэтому собрать публикации по ключевым словам не удалось (подробности в «Ограничениях»). Вместо этого через app.bsky.actor.searchActors искались тематические аккаунты, а затем их истории публикаций читались по одной через getAuthorFeed.

Аккаунты
Аккаунт Содержание Подписчики Публикации
@todaystopainews.bsky.social «Today's Top AI News». Ботоподобный аккаунт, автоматически собирающий и публикующий новости индустрии ИИ; много тем о закрытых моделях GPT-6 Astra и Fable 5.1 272 1,826
@useapi.bsky.social useapi.net. Официальный аккаунт агрегатора API для Veo, Kling, Seedance, PixVerse, Hailuo, Runway, Nano Banana и других инструментов генерации изображений и видео 13 24
@nijiironokeshiki.bsky.social «虹色». Частный автор, публикующий 2–3 фан-иллюстрации в день по Re:Zero, Lycoris Recoil, Frieren и другим произведениям с помощью Stable Diffusion и ComfyUI 699 1,963
@kunecco.bsky.social «くねっこ». Разработчик нод, workflow и LoRA для git-версии ComfyUI; публикует и технические материалы, например переводы danbooru-тегов 540 494
@midjourneyofficial.bsky.social Официальный аккаунт Midjourney, объявивший о приходе на Bluesky в августе 2025 года неизвестно последняя публикация 2025-10-08
@comfyuistudio.bsky.social Сторонний аккаунт с примерами workflow ComfyUI неизвестно последняя публикация 2024-12-19
@klingaivideo.bsky.social Аккаунт об инструменте генерации видео Kling AI неизвестно лента пуста
Публикации
Закрытый сегмент
  1. GPT-6 Astra генерирует SVG контроллера PS4 (@todaystopainews, 11 лайков, 2 репоста, 1 ответ, 2026-09-05, https://bsky.app/profile/todaystopainews.bsky.social/post/3mur7cyocf225). Указано даже время генерации — 11 минут 54 секунды; это конкретный пример того, как долго OpenAI GPT-6 Astra выполняет задачу, связанную с изображением.

  2. GPT-6 Astra собирает городскую сцену в Unity (@todaystopainews, 4 лайка, 1 репост, 2026-09-04, https://bsky.app/profile/todaystopainews.bsky.social/post/3muoucqf4tk2w). Демо автоматической компоновки 3D-сцены из существующих ассетов показывает агентное применение за пределами простой генерации изображений.

  3. Репост «Fable 5.1 world modeling» (@todaystopainews, 11 лайков, 4 репоста, 2026-09-03, https://bsky.app/profile/todaystopainews.bsky.social/post/3mumdxgujh22h) и опубликованный днём ранее «Средневековый город, созданный в Fable 5.1» (10 лайков, 3 репоста, 2026-09-02, https://bsky.app/profile/todaystopainews.bsky.social/post/3mukekiwxws2j). Fable 5.1 от Anthropic снова и снова появляется в демо 3D и моделирования миров.

  4. Блог useapi.net «Seedance 2.5 в Dreamina API» (@useapi.bsky.social, 2026-08-08, https://bsky.app/profile/useapi.bsky.social/post/3mskj7fb2ok2a). Техническая публикация о том, что видеомодель Seedance 2.5 от ByteDance стала доступна через API Dreamina.

  5. Сравнение useapi.net «MiniMax H3 vs Seedance 2.0» на одном референсном изображении (@useapi.bsky.social, 2026-07-31, https://bsky.app/profile/useapi.bsky.social/post/3mrw5xyd4zk2x). Прямое сравнение моделей на одинаковом исходном материале (omni references), то есть проверка качества с позиции поставщика API.

  6. useapi.net «Подробное сравнение более 17 моделей генерации изображений» (@useapi.bsky.social, 3 лайка, 2026-07-25, https://bsky.app/profile/useapi.bsky.social/post/3mrigfks25k2n). Статья сопоставляет большое число моделей и показывает насыщенность рынка закрытых решений.

  7. useapi.net «Сравнение цен Seedance 2.0 через официальный и сторонний маршруты» (@useapi.bsky.social, 2026-07-23, https://bsky.app/profile/useapi.bsky.social/post/3mrdyxqswcb2p). Конкретно сравнивает цену одной и той же модели через официальный API и через агрегатор, раскрывая слоистую структуру рынка API.

Открытый сегмент
  1. Повседневные ИИ-иллюстрации «虹色» (@nijiironokeshiki, от 87 до 245 лайков, несколько публикаций 2026-09-02–09-05; пример: https://bsky.app/profile/nijiironokeshiki.bsky.social/post/3mumi7nop522l — 104 лайка и 25 репостов). Согласно профилю, работы создаются в Stable Diffusion и ComfyUI; это частный аккаунт с устойчиво самым высоким вовлечением среди открытого сегмента Bluesky.

  2. Публикация くねっこ о разработке workflow ComfyUI (@kunecco, 2025-10-27, https://bsky.app/profile/kunecco.bsky.social/post/3m45jd5s2ek2f): «Создавать ноды и workflow стало так интересно, что я погружаюсь всё глубже». В тот же период аккаунт написал, что «перевёл 140 тысяч строк токенов danbooru» (https://bsky.app/profile/kunecco.bsky.social/post/3m432qalae22t), что служит примером работы с экосистемой ComfyUI на уровне словарей тегов.

  3. Стагнация официальных/полуофициальных аккаунтов ComfyUI (@comfyuistudio.bsky.social — последняя публикация 2024-12-19; у @comfy-ui.bsky.social лента пуста). Поиск аккаунтов находит множество похожих хендлов — comfyuistudio, real-comfyui, comfy-ui, comfyuiorg и другие, но активными остаются главным образом частные авторы ИИ-иллюстраций, например 虹色 и くねっこ. Разработчики инструмента и официальные источники почти незаметны на Bluesky.

Сигналы
  • В закрытом сегменте центральны срочные новости, в открытом — публикации работ: todaystopainews и useapi.net пишут о названиях моделей, API-ценах и бенчмарках GPT-6 Astra, Fable 5.1, Seedance и MiniMax H3; число лайков низкое — от единиц до десятков, — но плотность новостей высока. Открытая сторона Stable Diffusion/ComfyUI состоит в основном из готовых иллюстраций частных авторов вроде 虹色: внимание направлено на сами работы, а не на динамику моделей. Технические новости открытого сегмента на Bluesky почти не распространяются.
  • Официальные аккаунты Midjourney и Kling AI фактически заброшены: Midjourney объявил приход на Bluesky в августе 2025 года, но последняя публикация датирована 2025-10-08; у Kling AI Video лента вообще пуста. Бренды не используют Bluesky как постоянный канал коммуникации.
  • Появление агентных персон, названных в честь GPT-6 Astra: найдены astrra.space (Astra, «AI agent running on GPT-6 Astra») и maple-nekokami.bsky.social («Runs on OpenAI GPT-6 Astra»). Это не разговор о генерации изображений и видео сам по себе, но пример меметического потребления бренда GPT-6 Astra на Bluesky.
  • Агрегаторный API useapi.net становится хабом сравнений закрытых моделей: сервис объединяет Veo, Kling, Seedance, PixVerse, Hailuo, Runway, Nano Banana и другие модели и публикует наиболее конкретные материалы о ценах и качестве. На Bluesky такие кросс-модельные сервисы дают более практическую информацию, чем официальные аккаунты отдельных моделей.
Ограничения
  • app.bsky.feed.searchPosts, API полнотекстового поиска публикаций, возвращал HTTP 403 на все запросы: «image generation AI», «Stable Diffusion», «Flux» и даже однословные запросы. В то же время app.bsky.actor.searchActors для поиска аккаунтов и app.bsky.feed.getAuthorFeed для чтения ленты отдельного аккаунта работали. Поэтому отчёт основан не на поперечном поиске публикаций по ключевым словам, а на обнаружении вероятно релевантных аккаунтов и чтении их по одному; публикации и аккаунты, не найденные таким способом, в отчёт не вошли.
  • При целевом критерии около 20 проанализированных публикаций на соцсеть удалось прочесть и разобрать только 10 перечисленных материалов плюс вспомогательные близкие публикации. Для увеличения числа при отсутствии полнотекстового поиска потребовалось бы искать новые связанные аккаунты. В этой сессии после проверки ключевых подходов — новостных ботов о закрытых моделях GPT-6 Astra/Fable 5.1, API-агрегаторов вроде useapi.net и частных авторов ComfyUI/Stable Diffusion — большинство новых аккаунтов оказывались неактивными или нерелевантными: спорт, политика, журналистика. Поэтому сбор был остановлен.
  • Официальные аккаунты брендов, включая Midjourney и Kling AI, остановили публикации или пусты и не могли служить источниками текущих новостей.
  • Поиск аккаунтов по «Wan2.5», «Flux.2», «open source image generation» и другим названиям актуальных открытых моделей дал ноль результатов. Не были найдены Bluesky-аккаунты, публикующие о Wan, HunyuanVideo, Qwen-Image или Chroma; открытый сегмент удалось проверить лишь в рамках давно известных брендов Stable Diffusion и ComfyUI.

Lemmy

Lemmy — Последние тенденции ИИ для генерации изображений и видео

Сообщества
  • !«メールアドレス» — 5 708 участников. Безусловно самое активное сообщество. Каждый день публикуются кастомные ноды ComfyUI, веса новых моделей, LoRA и другое; фактически это оперативная новостная лента открытого ИИ для изображений и видео.
  • !«メールアドレス» — 2 360 участников. В основном обмен готовыми работами; новостей меньше.
  • !«メールアドレス» — 1 662 участника. Похоже на версию dbzer0, но публикуется реже.
  • !«メールアドレス» — 87 858 участников. Одно из крупнейших технических сообществ Lemmy, но отдельных тем об ИИ для изображений/видео немного; изредка появляются корпоративные новости Midjourney.
  • !«メールアドレス» (включая зеркала на других инстансах) — часто публикует перепосты ИИ-сабреддитов Reddit. Материалов немного, но попадаются собственные источники, например данные Runway о финансах.
  • !techtakes — критическое и скептическое сообщество об ИИ; публикует, например, ироничные материалы о метаниях Midjourney.
Публикации
  1. Midjourney меняет направление на бизнес медицинских ультразвуковых КТ-сканеров — !«メールアドレス», score 58, 2026-06-18, https://www.theregister.com (оригинальная статья The Register). Связанный материал: официальный блог Midjourney https://midjourney.com/medical/blogpost (!hackernews, score 2, 2026-06-18); реакция в ироничном сообществе: «Midjourney AI pivots to Theranos», !techtakes, score 40, 2026-06-19, https://pivot-to-ai.com/2026/06/19
  2. Midjourney требует от голливудских студий раскрыть фактическое использование ИИ — !«メールアドレス», score 73, 2026-07-05, https://techcrunch.com/2026/07/04
  3. Runway: «Корпоративный бизнес удвоился, NRR превышает 300%» — !ai_reddit, score 0, 2026-08-30, https://www.reddit.com/r/ArtificialInteligence/comments/1w2hnea/ (перепост на Lemmy)
  4. Релиз Qwen-Image-2.0: параметры сокращены с 20B до 7B, генерация и редактирование объединены, модель превосходит Nano Banana по Elo; публикация весов ожидается в ближайшее время — !«メールアドレス», score 12, 2026-02-12, https://files.catbox.moe/l3mzzs.jpg (также кросспост в !LocalLLaMA, !Aii и !artificial_intel)
  5. Wan Animate 2 доступен в ComfyUI — !«メールアドレス», score 8, 2026-08-08, https://blog.comfy.org/p/wan-animate-2-is-now-available-in
  6. LTX-2.5 получил поддержку Day-0 в ComfyUI — !«メールアドレス», score 5, 2026-08-12, https://blog.comfy.org/p/ltx-25-day-0-support-in-comfyui
  7. Trellis.2 и Pixal3D, модели 3D-генерации, получили нативную поддержку ComfyUI — !«メールアドレス», score 4, 2026-09-01, https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native
  8. Экосистема MiniMax-H3, открытовесовой модели видеогенерации, быстро расширяется — только в !«メールアドレス» с 8 августа по 5 сентября более 10 публикаций. Выдержки: GGUF-версия с квантизацией (21,6 ГБ → 8,9 ГБ, score 10, https://huggingface.co/Abiray/MiniMax-H3-Pruned-GGUF); LoRA для ускорения до 4–8 шагов (score 6–7, https://huggingface.co/lightx2v/Minimax-h3-Turbo); поддержка длинных видео до 120 секунд с синхронизацией звука (score 5, https://huggingface.co/Smite79/MiniMax-H3-Longvideos); реализация гибридного внимания (score 3, https://github.com/Saganaki22/ComfyUI-VDN-H3, 2026-09-05)
  9. Набор GPU-нативных нод для повышения качества видео: ComfyUI-AetherScale и DLSS5 Visual Enhancer — !«メールアドレス», score 5, 2026-09-01/09-05, https://github.com/vizart-vj/ComfyUI-AetherScale · https://github.com/Merserk/dlss5-visual-enhancer
  10. Через MCP для Claude из одного чата вызываются более 30 моделей генерации изображений и видео; выполнение одного проекта сократилось с 2,5 часов до 50 минут — !ai_reddit, score 1, 2026-05-01, https://i.redd.it/6gqfafpaukyg1.png
Сигналы
  • Открытый сегмент полностью сосредоточен на «новостях реализации» вокруг ComfyUI/HuggingFace. Основная часть публикаций — не просто анонсы моделей, а сообщения вида «X появился в ComfyUI», «вышла LoRA» или «вышла квантизованная версия». Главная текущая зона разработки — инструменты вокруг видеомодели MiniMax-H3.
  • 3D-генерация — Trellis.2 и Pixal3D — начинает интегрироваться в ComfyUI, становясь заметным следующим типом генеративного результата после изображений и видео.
  • Закрытые решения на Lemmy чаще потребляются как критика или скандал, а не как продуктовые новости. Разворот Midjourney к медицинским устройствам вырос главным образом в общем техническом и ироничном сообществе, а не в сообществах генеративного ИИ (score 58, 73, 40).
  • Nano Banana на Lemmy почти всегда упоминается только в сравнении «открытая модель превзошла её»; первичных публикаций Google обнаружить не удалось.
  • Прямых упоминаний Sora, Veo, Kling, Hailuo, Seedream/Seedance и свежих версий Adobe Firefly за исследованный последний месяц не найдено; самые новые публикации об Adobe Firefly относятся к 2025 году.
Ограничения
  • Lemmy невелик, а специализированная дискуссия об ИИ для изображений и видео почти полностью сосредоточена в !«メールアドレス». Поперечный поиск на других инстансах — lemmy.ml, lemm.ee, lemmy.zip и других — в основном давал дубликаты или нерелевантные результаты.
  • Полнотекстовый поиск (/api/v3/search) слабо работает с неточным совпадением: короткие собственные имена вроде «Sora» и «Veo» давали главным образом нерелевантные результаты — имена людей и других сервисов. Были испробованы и API, и веб-поиск, но первичных публикаций Lemmy об OpenAI Sora, Google Veo, Kling AI, Hailuo, ByteDance Seedream/Seedance обнаружить не удалось, включая Google-поиск. Это может означать не отсутствие интереса, а ограничение поиска и охвата Lemmy.
  • Публикация о Qwen-Image-2.0 относится к февралю 2026 года, а не к последнему месяцу; она сохранена как важная иллюстрация оси сравнения открытых и закрытых моделей.
  • Публикации о Runway и Claude MCP — не первичные материалы Lemmy, а перепосты Reddit через !ai_reddit; первоисточник находится на стороне Reddit.

Pinterest

Pinterest — Новости ИИ для генерации изображений и видео

По запросу «Image and Video Generation AI News» на Pinterest было собрано 50 пинов (output/pinterest.pins.md), без жанровой разбивки — один общий поиск. Были просмотрены все 50 изображений.

Визуальные темы
  • Символическое сведение «ИИ = белый гуманоидный робот/киборг»: независимо от реального содержания генеративного ИИ, белые гуманоидные роботы или совмещённые профили робота и человека многократно используются как обозначение «ИИ» ([2, 19, 30, 35, 37, 40, 43, 44, 46, 48]). Миниатюры новостных и объяснительных пинов почти целиком сходятся на этом мотиве.
  • Доминирует киберпалитра неона и тёмно-синего: большинство материалов — шаблонные инфографики с голубым, фиолетовым и маджентовым свечением, схемами печатных плат и тёмным фоном ([3, 5, 6, 7, 10, 13, 17, 18, 19, 21, 29, 32, 34, 39, 42, 44, 46, 48, 49]). Почти нет фотографий или ручной графики; это выглядит как массовый дизайн на основе Canva и стоковых материалов.
  • Главный формат — рейтинговые списки «best AI tool»: постоянно встречаются сравнительные таблицы и карточки с логотипами Runway, Pika, Kling AI, Luma AI (Dream Machine), Synthesia, HeyGen, InVideo AI, Kaiber, Adobe Firefly, ChatGPT Plus, Midjourney, Canva AI и других ([9, 16, 20, 24, 38, 42]). Пины [16] и [24] почти одинаковы — это показывает, что один шаблон используют разные авторы.
  • Новостные инфографики и сводки: много пинов оформлено как газетная полоса или «Breaking News» с резюме «новостей ИИ недели» ([11, 12, 21, 29, 32, 33, 39, 43, 47, 50]). В изображениях часто зашиты даты: 30 июня 2025 года [29], 20 мая 2026 года [21], 15 августа 2026 года [32]. В одной выдаче смешиваются «срочные» картинки из разных периодов.
  • Меньшинство пинов показывает реальные результаты генерации или демо-видео: большинство — маркетинговые изображения с логотипами и текстом. Среди немногих примеров работ: официальный деморил Google Veo 2 [8], сетка стилевых трансформаций в духе Luma (человек → резьба по дереву / оригами / LEGO / цветы) [4], демонстрация Microsoft VASA-1, создающего мимику из одного изображения и звука [22], пример image-to-video с устойчивым фиолетовым персонажем-монстром [26], фотореалистичный пожилой рыбак, созданный в AMD Amuse [41]. Такие пины составляют примерно десятую часть из 50.
  • Скепсис и обнаружение: «Это настоящее или ИИ?»: есть фото кота с штампом FAKE и роботом [2], викторина с горными фотографиями «Which is AI?» [15], утверждение об обнаружении ИИ-голоса на 97% [18], список аргументов «хороши или плохи ИИ-видео?» [23] и неоновая надпись «все используют ИИ неправильно» [46]. Контента, подогревающего тревогу о подлинности, немало.
  • Смешиваются фотографии реальных знаменитостей и сгенерированные «похожие на знаменитостей» лица: есть настоящее фото главы Nvidia Дженсена Хуана на сцене [45] и миниатюра YouTube с человеком, похожим на Сэма Альтмана [33], но также рекламное изображение Fiverr с ИИ-сгенерированным лицом в стиле Безоса [36]. По списку пинов трудно отличить фотографию от генерации.
  • Открытый сегмент упоминается крайне редко: среди подавляющего большинства закрытых инструментов — Veo, Sora, ChatGPT, Midjourney, Runway и других — открытые/локальные решения представлены только двумя материалами: новостью об открытии Baidu Ernie 4.5 [29] и локальным инструментом AMD Amuse 3.0 [41]. Пинов, напоминающих сообщества OSS-генерации — Stable Diffusion, ComfyUI, LoRA — не найдено.
Примечательные пины
  • [4] (без названия / сетка стилевых трансформаций в духе Lumalabs) — кадр реального видео преобразован в «резьбу по дереву», «оригами», «кубики LEGO» и «цветы», с параллельными сравнениями для собаки и автомобиля Tesla. Самое конкретное технологическое демо.
  • [8] Google Unveils Veo 2 — подборка официальных промоматериалов: женщина у микроскопа, пловец под водой, танцовщица, рисующая созвездия, аниме-девушка на кухне, стая фламинго. Наиболее прямо показывает диапазон выразительности Veo 2.
  • [9] 6+ Best AI Video Generation Websites — инфографика для сохранения, распределяющая Runway, Pika, Kling AI, Luma AI, Canva AI и Hailuo AI по функциям и целевым пользователям. Призыв «Save this pin» отражает типичную для Pinterest модель потребления списков.
  • [16] AI Image Video: Best Quality vs Best Free — сравнивает 10 платных и 10 бесплатных инструментов с диагностической схемой выбора по задачам. Почти совпадает с [24], подтверждая распространение одинаковых шаблонов.
  • [22] VASA-1 (Microsoft) — исследовательская схема: из одного статичного изображения, аудиоклипа и произвольного управляющего сигнала создаётся говорящее лицо с разнообразной мимикой. Один из наиболее академических технических пинов.
  • [27] Vidu S1 — яркая киберпанк-визуализация модели китайской ShengShu Technology для ИИ-взаимодействия в реальном времени. Показывает присутствие китайских видеомоделей.
  • [29] AI NEWS (в газетном стиле, 2025-06-30) — один из немногих пинов, близких к первичным новостям: открытие Baidu Ernie 4.5, аренда OpenAI TPU у Google, инвестиция Meta $14,3 млрд в Scale AI и другие конкретные корпоративные события.
  • [38] Top 10 Image-to-Video Generator Tools — рейтинг Runway Gen-3, Kling, Google Veo, OpenAI Sora, Luma AI, Pika Labs, Kaiber AI, Synthesia, HeyGen, Adobe Firefly и InVideo AI. Даёт хороший обзор основных игроков.
  • [41] Amuse 3.0 (AMD) — фотореалистичный портрет старого рыбака, демонстрирующий качество локального ИИ-инструмента для создания искусства на AMD GPU. Один из редких примеров открытого или локального направления.
  • [50] This Week's Top AI Developments — сводка свежих трендов, основанных на статистике: исследование Google по 15 млн чатов, где 86% использования оказалось нерабочим; безлимитный ChatGPT; результат конкурса, в котором ИИ победил 458 из 526 команд.
Сигналы
  • Текущее состояние: на Pinterest тема «Image and Video Generation AI» фактически стала рынком SEO и партнёрского маркетинга для списков инструментов и новостных инфографик. Runway, Pika, Kling AI, Luma AI, Synthesia, HeyGen, InVideo AI, Adobe Firefly и Google Veo постоянно оказываются наверху, формируя узнаваемый «стандартный набор» закрытых видеогенераторов.
  • Повторное использование одинаковых шаблонов: поскольку [16] и [24] фактически содержат одну и ту же картинку, вероятно, что сравнительный контент об ИИ-инструментах массово создаётся и публикуется разными аккаунтами на основе небольшого числа шаблонов.
  • Отсутствие открытого сегмента: прямыми примерами для требуемого брифом анализа открытого сегмента остаются только [29] — Baidu Ernie 4.5 — и [41] — AMD Amuse 3.0. Материалов о Stable Diffusion, ComfyUI или генеративных сообществах Hugging Face нет. Pinterest-выдача тяготеет к визуально привлекательным готовым результатам и маркетинговым материалам и плохо сочетается с техническими сообществами открытого ПО.
  • Инфографики, сравнения и провокации сильнее реальных работ: из 50 пинов около 10% делают главным объектом реальные ИИ-изображения или видео; большинство — текстовые инфографики и списки. Похоже, на Pinterest лучше распространяется контент о выборе инструмента, чем конкретные примеры того, как он преобразует результат.
Ограничения
  • На этом этапе были прочитаны только заранее собранные Pinterest-изображения (images/pinterest/manifest.json, 50 материалов, один запрос без жанровой разбивки); сам Pinterest не просматривался. Дополнительные запросы вроде «open source AI art» или «Stable Diffusion» могли бы найти больше пинов открытого сегмента.
  • Даты, вшитые в изображения пинов — 2025-06-30, 2026-05-20, 2026-08-15 и другие — показывают только время изготовления шаблона, а не фактическую дату публикации или сохранения на Pinterest: это неизвестно из manifest.json.
  • Часть текста на изображениях [12], [15], [21], [23], [29] и других недостаточно чёткая; встречаются и ошибки самих шаблонов, например «Human Journalism» и «Machine-Genertsd Media». Здесь приведены не точные цитаты, а пересказ содержания.
  • У пяти пинов отсутствует заголовок (untitled): у части [12], [15], [21], [29], [35]. Их классификация сделана по содержанию изображения.

Рекомендуемые действия

  • Продолжать сопоставлять GPT-6 Astra и Fable 5.1 по оси агентного управления, а не только качества.
  • В следующем выпуске продолжить наблюдение за экосистемой ComfyUI для MiniMax-H3: GGUF-квантизация и Turbo LoRA.
  • В следующем исследовании X не полагаться на тренды Explore, а явно искать Stable Diffusion, Wan, Flux, Qwen и другие специфичные для открытого сегмента термины.
  • В качестве первичного источника открытого сегмента отдавать приоритет !«メールアドレス».
  • Не использовать Pinterest как источник динамики открытого сегмента; ограничить его наблюдением за маркетингом закрытых инструментов.
  • Проверить, не зависят ли внешние инструменты от закрытия Sora API 2026-09-24.

Собранные изображения

Image to Video AI: How It Works and Why It Matters - The Data ScientistAI content and social media concerns🎨 AI Image and Video CreationGoogle announces ultra-high quality video...The Ultimate AI Image and Video Generation Platform - The Data ScientistAi Content Creation Concept With Icons For Text Image Music And Video Generation Artificial Intelligence Images – Browse 57 Stock Photos, Vectors, and VideoAI Video Content Creation: High earners,...Google Unveils Veo 2: Advanced AI Video Generation Tool with Enhanced Realism and Cinematic FeaturesJust Nail It 🎥️ Image to Video AI – Animate Your Photos With AIAI News: OpenAI Finally Released What We Asked ForimageVeo 3 Image-to-Video: Fast Generation & Native Audio via Gemini APITop AI Video Generators of 2025imageAI For Image And video GenerationMore than 20% of YouTube is now AI-generated‎🚨 AI is getting scary good.AI driven image and video analysisai toolsimageMicrosoft Unveils VASA-1, Setting New Standards for Generative AI in Video GenerationAI-Generated Videos: Good or Bad? Here's the Truth! 🤖🎥🚀10 Best AI Image & Video Tools in 2026 | Free vs Paid AI Tools ComparisonWhat is Imagvio AI and how it helps creators...Google announces video generation AI 'Veo 3',...ShengShu Technology Unveils Vidu S1, Bringing Real-Time Interactive Generation to AI VideoTransform your ideas into stunning visuals! 🎥image"Transform Your Vision with Personalized AI-Powered 4K Videos 🎥✨"Mastering Video and AI: Key Social Media Marketing Trends 2025This Week in AI News - Aug 15 2026GPT 5.2, realtime video editor, AI stereo videos, mobile AI agents, full body control: AI NEWShistory generative AIimageI will do ai video creation explainer with synthesia sora ai kling ai runway ai invideoAiVideo generation 📹AI News & Latest Updates | Artificial Intelligence Trends & Breakthroughsimage'Amuse 3.0', an AI art creation tool that includes...AI Video Creation: Complete Guide to Create Professional Videos Faster with AI"Why AI Chatbots Fail at Keeping Up with Breaking News"Professional AI Video Creation | Cinematic AI Videos | Custom Video EditingNvidia #NEW AI Tools 🤯 #news #ai #openai #chatgpt #highlights #shortsStop scrolling… this story will completely change how you see AI!How To Create A News Channel With AI || AI News Video Generator || AI Lip SyncTop AI Tools Every YouTuber Uses in 2026 | Best AI for YouTube CreatorsAI Video Generator Market Growth 2025–2032: Transforming the Future of Video Creation 🎥🤖This Week's Top AI Developments - Google 15 Million Chats Study

Примечание о качестве данных

На Reddit из-за недоступности WebFetch использовались только 12 предварительно собранных тредов, что ниже целевых примерно 20; на X большинство трендов Explore было нерелевантным и поиск по открытому сегменту не проводился; на Bluesky API полнотекстового поиска вернул 403, поэтому использовался альтернативный метод сбора; на Lemmy не найдены первичные публикации закрытого сегмента; Pinterest ограничен одним общим запросом, и специализированный поиск по открытому сегменту не проводился.

Галерея