Новости ИИ для генерации изображений и видео — 2026-09-06
OpenAI GPT-6 Astra практически монополизирует закрытый сегмент не столько как «генератор изображений и видео», сколько как «агент для управления ПК», тогда как в открытом сегменте вокруг ComfyUI последовательно накапливаются новости об интеграциях Qwen Image и MiniMax-H3.
Сводка новостей ИИ для генерации изображений и видео — 2026-09-06
Серьёзно, эта неделя была просто безумной 😳🔥 В закрытом сегменте царит настоящий фестиваль OpenAI «GPT-6 Astra»: все обсуждают его скорее как агента, который целиком управляет компьютером, а не как средство генерации изображений и видео. Sora, напротив, тихо уходит со сцены — похоже, инвестиции смещаются от видеогенераторов к агентному ИИ. В открытом сегменте Qwen Image, Z-Image Turbo, HunyuanImage и MiniMax-H3 методично получают обновления вокруг ComfyUI; без громких анонсов, но плотность новостей об интеграциях действительно высокая. Честно говоря, в этот раз поиск неудачно сработал на некоторых платформах (Reddit, X, Bluesky), поэтому не по всем из них удалось полноценно изучить 20 материалов; это прямо отмечено ниже в разделе «Качество данных» 🙏
Across platforms
- GPT-6 Astra (OpenAI) почти полностью доминирует в закрытом сегменте: и на X (@masahirochaen, https://x.com/masahirochaen/status/2095644339041153256), и на Bluesky (@todaystopainews, https://bsky.app/profile/todaystopainews.bsky.social/post/3mur7cyocf225) он захватил внимание сразу после запуска. Вирусно распространяется бенчмарк ARC-AGI-3: 98,6% против 7,8% у предыдущего поколения.
- Astra обсуждают скорее как средство агентного управления, чем как генератор изображений: и X (@aigeboku, тестирование функции ComputerUse), и Bluesky (демо автоматической сборки города в Unity) уделяют больше внимания тому, как он «сам управляет ПК», чем одиночным изображениям или видео. Похоже, формируется по-настоящему новый жанр.
- Fable 5.1 очень часто используют как точку сравнения: @renoiseai и @Mayz1169 независимо выложили на X ролики «Astra vs Fable 5.1», отрендеренные через Seedance 2.5. В публикации @k_matsumaru Fable 5.1 выступает не финальным рендерером, а слоем генерации промптов в цепочке из четырёх инструментов. Почти никто не завершает работу одной моделью.
- Агрегаторные API становятся заметнее в обоих сегментах: на Reddit WaveSpeedAI объединяет более 1 000 моделей через один REST API, а на Bluesky useapi.net сравнивает Veo, Kling, Seedance, PixVerse, Hailuo, Runway и Nano Banana. В обоих случаях практической информации в них больше, чем в официальных аккаунтах.
- Открытый сегмент формируют Qwen Image / Z-Image Turbo (Alibaba и Tongyi-MAI), HunyuanImage (Tencent) и восходящий MiniMax-H3: это достаточно убедительно подтверждается обзорами на YouTube и сообществом !«メールアドレス» на Lemmy.
- Экосистема вокруг MiniMax-H3 — открытовесовой видеомодели — растёт очень быстро: только на Lemmy с 8 августа по 5 сентября появилось более 10 материалов: GGUF-квантизация, Turbo LoRA, поддержка 120-секундных роликов, гибридное внимание. На X @ImaStudio_ai также строит на её основе коммерческий инструмент — это подтверждается на разных платформах.
- ComfyUI окончательно стал центром управления открытым сегментом: Lemmy, Bluesky (@kunecco), обучающие ролики на YouTube — везде поддержка ComfyUI служит проверкой того, насколько технология реальна и применима.
- Мультишот и синхронизация со звуком — следующая общая ось конкуренции открытых и закрытых моделей: Wan 2.6 (открытая) напрямую сравнивали на YouTube в стресс-тестах с Kling 3.0, Seedance 2.0 и Runway Gen-4.5 (закрытыми).
- Сомнения в духе «Это ИИ или настоящее?» присутствуют повсюду: шутки Reddit о сломанных руках, обсуждения в сообществах, пины Pinterest с викторинами «Which is AI?» — тревога одна и та же независимо от платформы.
- Официальные аккаунты брендов в соцсетях почти неактивны: на Bluesky Midjourney (последняя публикация 2025-10-08) и Kling AI (ноль публикаций) фактически заброшены. Похоже, неофициальные авторы, частные лица и агрегаторы распространяют новости быстрее на всех платформах.
Platform by platform
Reddit — собраны 12 тредов из 9 сабреддитов (меньше целевых примерно 20). Главные темы — резкая негативная реакция на новый способ подделывать целые таймлапсы ручного рисования, заставляя LLM управлять мышью (r/antiai, 5 259 баллов); агрегаторный API WaveSpeedAI; быстрая локальная генерация Krea-2-Turbo на Apple Silicon (45 секунд на изображение). В r/VeniceAI также есть публикации опытных пользователей с подробным разделением моделей по задачам генерации, редактирования и превращения изображений в видео. Сильна и критика этики и качества: разгром ИИ-изображений еды и вакансии за $30/час, превращающиеся в спам.
X — растущие темы в Explore оказались привязаны к Хорватии, где расположен сервер: 7 из 10 слов (Bitcoin, Украина, Аргентина и другие) вообще не относились к теме. Все релевантные публикации были связаны с GPT-6 Astra; запросы об открытых моделях (Stable Diffusion, Wan, Flux и другие) в этот раз вообще не запускались. Поэтому вывод по открытому сегменту X в этом выпуске — не «ничего нет», а «не исследовалось».
YouTube — крупнейшая новость закрытого сегмента — прекращение работы Sora: приложение закроется 26 апреля 2026 года, а API — 24 сентября 2026 года; число загрузок за 11 месяцев упало с 3,3 млн до 1,1 млн. В открытом сегменте много первых тестов Qwen Image, HunyuanImage и Z-Image Turbo, а FLUX.2 (Apache 2.0) от Black Forest Labs упоминается как конкурент.
Bluesky — API полнотекстового поиска публикаций (searchPosts) отвечал 403 на все запросы, поэтому метод был заменён поиском аккаунтов; число проанализированных материалов осталось ниже целевых 20. В закрытом сегменте преобладают новостные боты вроде todaystopainews и useapi.net, в открытом — готовые работы частных авторов вроде 虹色 и くねっこ. Технических новостей об открытом ПО на Bluesky почти нет.
Lemmy — площадка небольшая, но !«メールアドレス» (5 708 участников) фактически стала доской оперативных новостей открытого сегмента: здесь много интеграций MiniMax-H3 и поддержки LTX-2.5 в день релиза. Закрытый сегмент чаще воспринимается как повод для иронии или скандала — например, история с разворотом Midjourney в сторону медицинского оборудования. Первичных публикаций о Sora, Veo, Kling и Hailuo на Lemmy найти не удалось.
Pinterest — изучены 50 предварительно собранных пинов по одному запросу без разбивки по жанрам. Почти всё — списки сравнения закрытых инструментов и новостные инфографики о Runway, Pika, Kling, Luma, Synthesia и HeyGen. Открытый сегмент затронут лишь в двух материалах: Baidu Ernie 4.5 и AMD Amuse 3.0. Это фактически рынок SEO и маркетинга закрытых инструментов.
What to watch
- Насколько далеко агентная функция ComputerUse у GPT-6 Astra проникнет в творческие рабочие процессы — X, https://x.com/aigeboku/status/2096187322924687799
- Что представляет собой намекнутая Альтманом более мощная ещё не выпущенная модель, которая не является Astra — X, https://x.com/masahirochaen/status/2096372856930386341
- Скорость роста экосистемы GGUF-квантизации и Turbo LoRA для MiniMax-H3 — Lemmy, https://huggingface.co/Abiray/MiniMax-H3-Pruned-GGUF
- Последствия миграции после полного закрытия Sora API (запланировано на 2026-09-24) — YouTube, https://www.youtube.com/watch?v=H2jVcy5PuBI
- Когда будут опубликованы веса Qwen-Image-2.0 (20B → 7B, превосходит Nano Banana по Elo) — Lemmy, https://files.catbox.moe/l3mzzs.jpg
- Сравнение цен и производительности закрытых моделей через агрегаторные API вроде useapi.net — Bluesky, https://bsky.app/profile/useapi.bsky.social/post/3mrdyxqswcb2p
Recommendations
- Продолжать сравнивать GPT-6 Astra с Fable 5.1 не только по качеству изображения и видео, но и по возможностям агентного управления.
- В следующем выпуске продолжить следить за экосистемой ComfyUI вокруг MiniMax-H3 — GGUF и Turbo LoRA — как за передним краем открытой видеогенерации.
- В следующем исследовании X не опираться на тренды Explore, а явно запускать запросы по терминам открытого сегмента: Stable Diffusion, Wan, Flux, Qwen и другим.
- В качестве первичного источника информации по открытому сегменту ставить !«メールアドレス» выше Reddit и Bluesky.
- Не использовать Pinterest как источник динамики открытого сегмента; ограничить его наблюдением за маркетингом и SEO закрытых инструментов.
- Проверить, не зависят ли внешние инструменты или рабочие процессы от закрытия Sora API 2026-09-24.
Data quality
На Reddit удалось собрать лишь 12 тредов вместо примерно 20 по критерию завершения: прямой сбор через WebFetch был невозможен, поэтому использовались только предварительно собранные материалы. На X большинство поисковых терминов — 7 из 10 — были нерелевантными трендами, а открытый сегмент не искался вообще, так что фактически он не исследован. На Bluesky API полнотекстового поиска публикаций отвечал 403, из-за чего пришлось переключиться на поиск аккаунтов и не удалось достичь целевого числа материалов. На YouTube из-за динамического рендеринга не удалось проверить большинство просмотров и числа подписчиков. Lemmy сам по себе мал, и первичные публикации о Sora/Veo/Kling/Hailuo обнаружить не удалось — возможно, из-за ограничений охвата поиска. Pinterest ограничен 50 материалами по одному общему запросу; повторного специализированного поиска по открытому сегменту не проводилось.
Сводка по платформам
Reddit — Новости ИИ для генерации изображений и видео
Где
По запросу «Image and Video Generation AI News» были собраны 12 тредов из 9 сабреддитов.
| Сабреддит | Число участников | Число собранных тредов |
|---|---|---|
| r/StableDiffusion | 1,001,169 | 1 |
| r/teenagers | 3,674,216 | 1 |
| r/aiwars | 166,685 | 1 |
| r/antiai | 314,968 | 2 |
| r/generativeAI | 150,823 | 3 |
| r/RemoteWorkers | 74,528 | 1 |
| r/VeniceAI | 10,421 | 1 |
| r/DailyIncome | 12,914 | 1 |
| r/freetoolsAI | 7,736 | 1 |
r/generativeAI (3 треда) и r/antiai (2 треда) чаще других обсуждают эту тему. r/antiai критически относится к генерации ИИ-изображений, тогда как r/generativeAI сосредоточен на сравнении инструментов и практических вопросах — настроения заметно различаются.
Что говорят люди
- Предупреждение о подделке таймлапсов ручного рисования с помощью LLM (тред №1, r/antiai, 5 259 баллов и 760 комментариев, 2026-09-05, https://www.reddit.com/r/antiai/comments/1w81kdd/). Публикация описывает метод: GPT-6 получает доступ к мыши и клавиатуре и может убедительно подделать цифровой рисунок вместе с таймлапсом. Это вызвало резкую реакцию: «зачем выпускать такую технологию, если её единственная цель — вредить настоящим художникам» (u/sanstheskelebrotherc, 235 баллов).
- Ежедневное сравнение бесплатных ИИ-инструментов для видео (тред №2, r/generativeAI, 42 балла и 28 комментариев, 2026-08-31, https://www.reddit.com/r/generativeAI/comments/1w3frr2/). В центре обсуждения Adobe Firefly (2 видео в день), PixVerse (1), Grok Imagine (1), Google Flow (3–4); в комментариях упоминались Kling AI (66 кредитов каждые 24 часа, то есть 2–6 пятисекундных роликов 720p) и ежедневные бесплатные кредиты CapCut.
- Тред с бесплатными и безлимитными генераторами изображений (тред №3, r/freetoolsAI, 37 баллов и 38 комментариев, 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/). Главный вопрос в комментариях — поддержка NSFW: наряду с вопросом «почему все банят NSFW?» (u/Relevant_Syllabub895) перечисляются Deepany, Aifun, Perchance и Z-Image-Turbo на huggingface.
- Вакансия «$30/час за проверку ИИ-изображений» параллельно распространяется в двух сабреддитах (тред №4, r/RemoteWorkers, 114 баллов и 520 комментариев, 2026-09-04, https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/; тред №6, r/DailyIncome, 129 баллов и 1 123 комментария, 2026-09-04, https://www.reddit.com/r/DailyIncome/comments/1w7b18p/). Тексты вакансий почти совпадают, но большинство комментариев — однословные «images» и «Interested», похожие на шаблонные реакции ради ссылки на отклик.
- Демонстрация ускоренной локальной генерации изображений (тред №5, r/StableDiffusion, 31 балл и 10 комментариев, 2026-09-03, https://www.reddit.com/r/StableDiffusion/comments/1w6bphf/). Сообщается о локальном запуске Vpipe + Krea-2-Turbo-M87 (16bit) на Apple Silicon M5 Pro с 24 ГБ: около 45 секунд на изображение 1024×1024 за 8 шагов, или 35 секунд при 8-битной квантизации в реальном времени.
- Мем-тред о том, что ИИ-изображения всё труднее распознавать (тред №8, r/antiai, 113 баллов и 30 комментариев, 2026-08-30, https://www.reddit.com/r/antiai/comments/1w2mr8g/). На деле обсуждение сводится к классическим сбоям с руками: «почему её нога — это рука?» (u/GurInside278, 31 балл).
- Оценка API-агрегатора WaveSpeedAI (тред №7, r/generativeAI, 2 балла и 4 комментария, 2026-09-05, https://www.reddit.com/r/generativeAI/comments/1w8ci5z/). По словам u/Jenna_AI, сервис объединяет «более 1 000 моделей, включая Flux, Wan 2.1/2.6, Hailuo и Kling, через единый REST API». Пользователь u/BradClarkAI, встроивший его в собственный инструмент через Seedance, сообщил, что проблем не было.
- Практика выбора моделей в сообществе VeniceAI (тред №9, r/VeniceAI, 8 баллов и 6 комментариев, 2026-08-30, https://www.reddit.com/r/VeniceAI/comments/1w2rtq1/). u/jerm2z рекомендует Chroma для генерации изображений; Qwen Edit Uncensored или Seedream для редактирования; FireRed для высокой согласованности лиц, хотя без NSFW; WAN Enhanced, Seedance и Minimax R2V для image-to-video.
- ИИ-изображения еды резко раскритиковали как неаппетитные (тред №10, r/aiwars, 4 балла и 175 комментариев, 2026-09-03, https://www.reddit.com/r/aiwars/comments/1w69cdj/). Один из комментариев описывает результат как «grub hive» — гнездо личинок (u/LCI_Jake, 14 баллов). Пользователь u/Bassed_Hummble попробовал локально сгенерировать изображение в Krea 2 за 40 секунд и задался вопросом, почему при несложном промпте результат настолько плох.
- Спор молодых пользователей о допустимости ИИ-арта (тред №12, r/teenagers, 7 баллов и 41 комментарий, 2026-08-31, https://www.reddit.com/r/teenagers/comments/1w2y305/). Автор утверждает, что ИИ получает промпт и сам создаёт изображение, что принципиально отличается от творчества человека с материалами или программами. Мнения разделились. u/TheDarkmore сообщил, что не умеет рисовать и поручил ИИ изображения для 120 карт карточной игры — и считает это нормальным.
Сигналы
- Рост: новый метод подделки «ручного» рисования через LLM, управляющую мышью и клавиатурой (тред №1), вызывает быструю реакцию как отдельная угроза, не сводимая к обнаружению диффузионных моделей, и добавляет новый очаг конфликта между сторонниками и противниками ИИ. Одновременно незаметно растут инфраструктурные и оптимизационные темы для разработчиков: агрегаторы, объединяющие более 1 000 моделей в одном API, как WaveSpeedAI (тред №7), и быстрая локальная генерация на Apple Silicon (тред №5).
- То, что высмеивают или недооценивают: ИИ-реклама еды (тред №10) получает отзывы вроде «лучше вставить стоковую фотографию»; ограничения качества постоянно подчёркиваются. Вакансии на $30/час за проверку ИИ-изображений (треды №4 и №6) имеют практически идентичное содержание, а комментарии состоят из шаблонных реакций ради ссылки на отклик. Содержательного разговора нет, поэтому они, вероятно, воспринимаются как спам.
- Неожиданное противоречие: при общей теме «ИИ-изображения всё сложнее отличить» в r/antiai (тред №8) ещё смеются над дефектами рук, тогда как в треде №1 новый способ подделать даже таймлапс воспринимается как серьёзная угроза. Оценки реального состояния обнаружения ИИ-изображений расходятся даже внутри сообщества. Аналогично, r/VeniceAI и r/StableDiffusion обсуждают техническое применение и оптимизацию, а r/antiai и r/aiwars развивают жёсткую критику этики и качества: отношение к ИИ-генерации на Reddit сильно разделено между сабреддитами.
Ограничения
- Использовался только один поисковый запрос — «Image and Video Generation AI News»; отдельный поиск по «open source» и «closed source» не проводился. Поэтому этот файл сам по себе не может напрямую разделить требуемые брифом минимум 10 наблюдений для открытого и закрытого сегментов; классификация нужна на уровне сводного отчёта.
- Критерий завершения брифа — анализ примерно 20 публикаций на каждую соцсеть, но было собрано только 12 тредов.
- В тредах №4 и №6 (вакансия $30/час) большинство комментариев — шаблонные ответы вроде «images» и «Interested», так что содержательных обсуждений и проверок нет.
- Reddit блокирует прямую загрузку страниц через WebFetch и поиск, поэтому анализ основан только на предварительно собранных файлах воркера (
reddit.threads.md/json); дальнейшее углубление — отслеживание связанных тредов, раскрытие комментариев и так далее — в этой поисковой сессии не проводилось.
X
X — Новости ИИ для генерации изображений и видео
Собственный список Explore X в этой сессии геолокализован в Хорватии (местоположение сервера), а не в Японии и не в глобальной ленте: там в трендах были «Astra», «Bitcoin», «Ukrainian», «Argentina», «$SONG», «OpenAI», «Russia», «Black», «$KURO», «Fable», без числа публикаций. Только три из десяти терминов — «Astra», «OpenAI» и «Fable» — имели отношение к ИИ для генерации изображений/видео. Остальные относились к прогнозам цен криптовалют, войне России и Украины, слухам об аргентинских знаменитостях и мемкоинам; ниже они не рассматриваются — см. «Ограничения».
Аккаунты
Релевантные аккаунты — по фактическому содержанию публикаций:
| Аккаунт | Что публикует | Охват этой публикации |
|---|---|---|
| @masahirochaen (チャエン) | Японский аккаунт новостей об ИИ и технологиях; сообщил о запуске GPT-6 Astra с цифрами бенчмарков, затем опубликовал продолжение о словах Альтмана «за Astra есть нечто большее» | 2 публикации, 841 + 133 лайка, до ~550 000 просмотров у запуска |
| @UNIBRACITY (SHINTARO) | Любитель 3D, совмещающий GPT-6 Astra и Blender | 1 публикация, 306 лайков |
| @hayashimon1 (ハヤシモン|AI×個人開発) | Создатель ИИ/3D-контента, также проводит платные семинары; использует Fable 5.1 × Blender | 1 публикация, 55 лайков |
| @manaimovie (Mankyu) | Любитель ИИ-видео, передающий Astra 3D-модель Tripo | 1 публикация, 409 лайков |
| @yachimat_manga (yachimat‑AI Short Anime) | Создатель коротких ИИ-аниме, предполагающий, что Astra может заменить специализированные генераторы видео для некоторых стилей | 1 публикация, 51 лайк |
| @aigeboku (AI様の下僕) | Опытный пользователь ИИ, тестирующий агентное управление Astra «ComputerUse» | 1 публикация, 653 лайка |
| @gagarot200 (ガガロット) | Аккаунт с ИИ-демо, ролики «один промпт — игра» | 1 публикация, 306 лайков |
| @SSSS_CRYPTOMAN | Аккаунт на пересечении крипто и ИИ, опубликовал демо создания игры в Astra | 1 публикация, 161 лайк |
| @Mayz1169 (Kiki) / @renoiseai (Renoise) | Аккаунты сравнений ИИ-видео: оба сопоставляют GPT-6 Astra и Fable 5.1, рендеря через Seedance 2.5 | по 1 публикации, 64 и 140 лайков |
| @k_matsumaru | Создатель ИИ-видео, документирующий полную цепочку Typeless → Fable 5.1 → Seedream 5.0 → Seedance | 1 публикация, 279 лайков |
| @Strength04_X | Аккаунт с промптами для Seedance 2.5 (через lovart_ai) | 1 публикация, 444 лайка |
| @ImaStudio_ai | Аккаунт продукта/студии собственного инструмента для ИИ-модных видео на основе MiniMax H3 | 1 публикация, 132 лайка |
Все эти материалы — одиночные публикации, а не треды и не долгие кампании: это разрозненная однодневная реакция на запуск, а не организованная дискуссия, которую ведёт один аккаунт.
Публикации
24. @masahirochaen (チャエン)
- 841 лайк · 148 репостов · 17 ответов · ~550 000 просмотров · 2026-09-03
- https://x.com/masahirochaen/status/2095644339041153256
【Срочная новость】OpenAI представила «GPT-6 Astra». Наконец выпущена основная модель, превосходящая Fable 5.1 и способная целиком выполнять работу на ПК. …ARC-AGI-3 (способность решать незнакомые головоломки): 98,6%. У предыдущего поколения GPT-5.6 — 7,8%. Невероятный рост.
Это безусловно крупнейшая публикация в подборке и та, которая задаёт рамку для всех остальных: GPT-6 Astra представлен как агент для управления ПК, превосходящий Fable 5.1; заявлен скачок ARC-AGI-3 с 7,8% у GPT-5.6 до 98,6%.
21. @masahirochaen (チャエン)
- 133 лайка · 23 репоста · 8 ответов · ~20 000 просмотров · 2026-09-05
- https://x.com/masahirochaen/status/2096372856930386341
Сэм Альтман открыто говорит о том, что находится «за пределами» GPT-6… Он прямо заявил, что модель, работу над которой в августе временно остановили из-за киберрисков, не была GPT-6 Astra.
Через два дня после запуска тот же аккаунт сообщил слова Альтмана: модель, которую OpenAI приостановила в августе из-за киберрисков, была не Astra — это указывает на существование ещё более мощной невыпущенной модели.
3. @aigeboku (AI様の下僕)
- 653 лайка · 64 репоста · 7 ответов · ~43 000 просмотров · 2026-09-05
- https://x.com/aigeboku/status/2096187322924687799
Как и следует из слов о высокой способности управлять другими, GPT-6 Astra с ComputerUse расширяет круг возможного… Одного удара, конечно, недостаточно, но после дальнейшей настройки можно получить ещё более интересные выразительные средства.
Публикация описывает главное преимущество Astra как агентное управление («ComputerUse»), а не сырой уровень генерации: ранние тестировщики изучают, что такое управление открывает для творческих процессов, а не только для выдачи изображений.
1. @manaimovie (Mankyu)
- 409 лайков · 49 репостов · 16 ответов · ~20 000 просмотров · 2026-09-05
- https://x.com/manaimovie/status/2096176821377380677
Я передал учителю Astra модель, сделанную в Tripo, и попросил оживить её — вот что получилось. …Это заметно лучше, чем с Fable или Sol!
Конкретное заявление о процессе «до/после»: передача Astra 3D-модели из Tripo и просьба её анимировать дали результат лучше, чем та же операция в Fable или «Sol».
22. @gagarot200 (ガガロット)
- 306 лайков · 29 репостов · 7 ответов · ~95 000 просмотров · 2026-09-04
- https://x.com/gagarot200/status/2095789680931287390
GPT-6 Astra полностью автоматически выдаёт результат… Достаточно одной фразы: «GPT-6 Astra, сделай такую игру» — и описать, какую именно.
Демо: один промпт создаёт готовую играбельную игру от начала до конца, подтверждая позиционирование Astra как модели, которая «выполняет задачу целиком».
23. @UNIBRACITY (SHINTARO)
- 306 лайков · 49 репостов · 4 ответа · ~39 000 просмотров · 2026-09-05
- https://x.com/UNIBRACITY/status/2096142182050927035
GPT-6 Astra × Blender — «Forest Retreat / Лесное убежище». Время работы Astra: около 7 часов; за это время удалось сделать вот столько.
Примерно семичасовой запуск Astra создал полноценную 3D-сцену в Blender — это одна из наиболее конкретных точек данных о фактической длительности работы.
4. @SSSS_CRYPTOMAN (SSSS.CRYPTOMAN⚡️AI)
- 161 лайк · 23 репоста · 5 ответов · ~10 000 просмотров · 2026-09-05
- https://x.com/SSSS_CRYPTOMAN/status/2096248797873762805
С GPT-6 Astra игра была готова в мгновение ока! 🎮… После нескольких сообщений на основе грубого промпта получилась вещь нормального качества, в которую можно играть.
Ещё одно демо перехода от расплывчатого промпта к игре с рабочей ссылкой, независимо повторяющее утверждение @gagarot200.
2. @yachimat_manga (yachimat - AI Short Anime)
- 51 лайк · 6 репостов · 5 ответов · ~3 600 просмотров · 2026-09-05
- https://x.com/yachimat_manga/status/2096386820997304354
Попробовал моделирование в GPT-6 Astra. …Разве не возможно будущее, где для некоторых стилей видео специальные генераторы видео уже не понадобятся?
Практикующий автор ИИ-аниме рассуждает, что для некоторых стилей 3D-моделирование Astra может сделать специализированные видеогенераторы ненужными.
40. @renoiseai (Renoise)
- 140 лайков · 16 репостов · 10 ответов · ~99 000 просмотров · 2026-09-04
- https://x.com/renoiseai/status/2095773478200996066
GPT-6 Astra vs Fable 5.1. Оба видео сгенерированы через Seedance 2.5 на Renoise.
Прямое сравнение лоб в лоб: оба результата отрендерены одним нижележащим инструментом, Seedance 2.5, чтобы контролировать эту переменную.
39. @Mayz1169 (Kiki)
- 64 лайка · 6 репостов · 10 ответов · ~12 000 просмотров · 2026-09-04
- https://x.com/Mayz1169/status/2095795273134170259
На секунду забудьте о бенчмарках. Просто посмотрите. GPT-6 Astra и Fable 5.1 рядом, одинаковые промпты. Что бы вы выбрали?
Тот же инстинкт сравнения, что и выше, но независимо: противостояния Astra и Fable 5.1 — узнаваемый микрожанр этой подборки, а не единичный случай.
37. @k_matsumaru (松丸 彗吾)
- 279 лайков · 34 репоста · 14 ответов · ~19 000 просмотров · 2026-09-05
- https://x.com/k_matsumaru/status/2096044983468150935
Как я теперь делаю видео… ① Пишу техническое задание в Typeless ② Прошу Fable 5.1 написать промпт для генерации видео ③ Создаю раскадровку в Seedream 5.0 Pro и проверяю содержание ④ Seedance…
Самая подробная производственная цепочка в подборке: Typeless для сценария → Fable 5.1 для промптов → Seedream 5.0 Pro для раскадровки → Seedance для финального видео. Здесь Fable — слой промптинга, а не сам рендерер.
32. @ImaStudio_ai (Ima Studio)
- 132 лайка · 17 репостов · 3 ответа · ~4 600 просмотров · 2026-09-04
- https://x.com/ImaStudio_ai/status/2095725066109804603
MiniMax H3 K-Fashion Outfit Change MV… 8 ОБРАЗОВ. 1 ДЕВУШКА. НОЛЬ ДРЕЙФА ИДЕНТИЧНОСТИ.
Коммерческий аккаунт студии продвигает продукт на MiniMax H3, позиционируя отсутствие дрейфа идентичности при смене одежды как ключевое отличие.
Сигналы
- Что растёт: GPT-6 Astra (OpenAI) доминирует во всех релевантных публикациях этой выборки. О нём говорят прежде всего как об агентной модели, управляющей компьютером, и лишь затем как о генераторе изображений или видео. Тестировщики постоянно соединяют его с другими инструментами — Tripo для 3D-сеток, Blender для сцен — а не используют как самостоятельный рендерер.
- Узнаваемый микрожанр: независимые аккаунты @renoiseai и @Mayz1169 без координации публикуют ролики «GPT-6 Astra vs Fable 5.1», отрендеренные через Seedance 2.5. Fable 5.1 становится естественной моделью для сравнения, а Seedance и Seedream постоянно появляются как фактический слой видеорендеринга под обеими системами.
- Цепочки инструментов вместо одного инструмента: наиболее подробная публикация (@k_matsumaru, №37) соединяет четыре инструмента — Typeless → Fable 5.1 → Seedream 5.0 Pro → Seedance — для одного видео. Никто в этой выборке не описывает завершение ролика одной моделью.
- Что удивило: тренды, полученные с панели Explore X, геолокализованной в Хорватии, — Bitcoin, Ukrainian, Argentina, $SONG, Russia, Black, $KURO — почти не связаны с ИИ для изображений и видео. Тренды X в этой локации 2026-09-05/06 — это крипто и геополитика, а не ИИ-модели; использовать их как показатель дискуссии об ИИ было бы ошибкой.
- Что отвергают: в этой выборке не нашлось ни одного скептического или критического треда о GPT-6 Astra: всё релевантное — демо, репост бенчмарка или сравнительный ролик. Это отсутствие критики само по себе заметно, учитывая агрессивность заявления «превосходит Fable 5.1» в публикации №24.
Ограничения
- Десять использованных поисковых терминов — «Astra», «Bitcoin», «Ukrainian», «Argentina», «$SONG», «OpenAI», «Russia», «Black», «$KURO», «Fable» — были взяты из трендов Explore этой сессии, а не из подобранного списка терминов по ИИ для изображений и видео. Семь из десяти — «Bitcoin», «Ukrainian», «Argentina», «$SONG», «Russia», «Black», «$KURO» — вернули публикации, полностью не связанные с темой исследования: крипторозыгрыши и прогнозы цен, война России и Украины, новости аргентинских знаменитостей и два небольших мемкоина. Они исключены из раздела публикаций.
- Поэтому охват открытого сегмента здесь слаб и косвенен: ни одна публикация не искалась по «Stable Diffusion», «ComfyUI», «Wan», «HunyuanVideo» или «Flux». Эти запросы на этом этапе вообще не запускались. Всё релевантное относится к закрытым или коммерческим названиям: GPT-6 Astra, Fable 5.1, Seedance, Seedream, MiniMax H3, Tripo. Картину открытого сегмента на X следует считать отсутствующей, а не интерпретировать как «там ничего не происходит».
- Публикация №35 (@MINHxDYNASTY, тег «$KURO») была собрана без текста, поэтому не могла использоваться как вывод.
- Столбец «Где» в Explore геолокализован по месту расположения сервера — Хорватия, а не Япония и не весь мир; этот список нельзя читать как глобальную или японскую картину трендов.
- Сбоев сессии или доступа не было: данные вернулись по каждому предпринятому запросу. Пробел тематический — в выбранных поисковых терминах, а не технический.
YouTube
YouTube — Новости ИИ для генерации изображений и видео (закрытый/открытый исходный код)
Каналы
- Bijan Bowen (@Bijanbowen, около 37 000 подписчиков) — специализируется на детальных обзорах LLM и моделей генерации изображений. Проверял Qwen Image-2512.
- Future Tools / Matt Wolfe (@mreflow, более 900 000 подписчиков) — еженедельно выпускает формат «Everything in AI This Week» с новостями об ИИ для изображений и видео, включая Midjourney и Runway.
- Группа каналов с обучающими роликами по ComfyUI и локальной генерации: много видео о рабочих процессах Wan 2.2/2.6, FLUX и Qwen Image; в поисковой выдаче были видны только названия роликов, а не названия отдельных каналов.
Видео
- "Why OpenAI Shut Down Sora So Fast: What's Next?" — опубликовано примерно в марте–апреле 2026 года. Разбирает причины решения OpenAI закрыть приложение Sora 26 апреля 2026 года и сам API 24 сентября 2026 года: месячные загрузки упали с 3,3 млн в ноябре 2025 года до 1,1 млн в феврале 2026 года, а контракт с Disney на $1 млрд и три года сорвался. https://www.youtube.com/watch?v=H2jVcy5PuBI
- "Why Did Sora AI Shut Down? The Real Reason OpenAI Killed Its Viral Video App" — опубликовано весной 2026 года. Рассматривает экономическую стоимость видеоприложения, которому не удалось монетизироваться, и стратегический поворот к агентному ИИ. https://www.youtube.com/watch?v=MpLY9bjYVuA
- "HunyuanImage-3.0 First Test – The Open Source Nano Banana?" — опубликовано 29 сентября 2025 года. Локально тестирует HunyuanImage-3.0 от Tencent, одну из крупнейших открытых текст-в-изображение моделей, включая требования к оборудованию. https://www.youtube.com/watch?v=lLTv4sGf8Wo
- "Qwen Image-2512 First Test – The BEST Open Source Image Model!" (Bijan Bowen) — опубликовано 31 декабря 2025 года. Тестирует улучшения Alibaba Qwen Image-2512 в реалистичности людей и отрисовке текста. https://www.youtube.com/watch?v=SBaK616nP6Q
- "New Qwen Image 2512: Better Than Z-Image? (Open Source & Free)" — опубликовано 5 января 2026 года. Прямое сравнение Qwen Image 2511/2512 и Z-Image Turbo от Tongyi-MAI. https://www.youtube.com/watch?v=uAGH_yRZ2Gw
- "Tencent Hunyuan 2.1 vs. Qwen Image: Who is the True King? A 2K Image & Text Rendering Showdown!" — опубликовано 28 сентября 2025 года. Сравнение отрисовки 2K-текста у Hunyuan Image 2.1, тогдашнего лидера рейтингов открытых Text-to-Image моделей, и Qwen Image. https://www.youtube.com/watch?v=MUDTryJS0XM
- "Z-Image la nouvelle star des modèles Open Source?? Test dans ComfyUI" — опубликовано 28 ноября 2025 года. Проверяет открытую Text-to-Image модель Z-Image Turbo от Alibaba/Tongyi-MAI в ComfyUI. https://www.youtube.com/watch?v=eOKSBu7KLh0
- "Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models" — опубликовано 11 января 2026 года. Большой обучающий ролик о последних открытых моделях генерации изображений и видео — Wan 2.2, FLUX и Qwen Image — в ComfyUI. https://www.youtube.com/watch?v=3BFDcO2Ysu4
- "WAN 2.6 Hands-On: The Good, the Bad, and the Useful" — опубликовано 26 декабря 2025 года. Практическая проверка выпущенной Alibaba Wan 2.6: до 15 секунд, мультишоты и синхронизация со звуком. https://www.youtube.com/watch?v=iNnmLwPg7OE
- "Multi-Shot AI Videos: Wan 2.6 vs Kling 2.6 (Stress Test)" — опубликовано 27 декабря 2025 года. Стресс-тест мультишотной генерации у открытой Wan 2.6 и закрытой Kling 2.6. https://www.youtube.com/watch?v=CDRKn4I-Iv0
- "I Tested Google's Nano Banana Pro Tips - This One Creates Pro Graphics in 30 Seconds" — опубликовано примерно в ноябре–декабре 2025 года. Практический тест Gemini 3 Pro Image от Google DeepMind, также известной как Nano Banana Pro: 4K-вывод, поддержка более 14 объектов и многоязычная отрисовка текста. https://www.youtube.com/watch?v=ca4SXmRqtKE
- "Qwen Image Edit Review — Free Open-Source Alternative to Nano Banana" — опубликовано 4 декабря 2025 года. Обзор Qwen Image Edit — открытой модели редактирования как альтернативы закрытой Nano Banana. https://www.youtube.com/watch?v=Ur3udfFJ2QQ
Сигналы
- Крупнейшая новость закрытого сегмента — уход Sora: OpenAI уведомила разработчиков 24 марта 2026 года, завершила приложение и веб-версию Sora 26 апреля, а API планирует закрыть 24 сентября 2026 года. Несколько роликов связывают это с резким падением загрузок — 3,3 млн в ноябре 2025 года против 1,1 млн в феврале 2026 года — и срывом партнёрства с Disney на $1 млрд. Это рассматривается как пример сдвига ресурсов отрасли от видеогенерации к ИИ для программирования и агентным системам.
- В открытом сегменте действует схема «две силы плюс новая звезда»: Alibaba (Qwen Image, Z-Image Turbo, Wan 2.2/2.6) и Tencent (HunyuanImage 3.0/2.1) соревнуются за верхние места основных рейтингов, а FLUX.2 ([dev]/[klein]) от Black Forest Labs с опубликованным VAE под Apache 2.0 конкурирует в фотореализме. Авторы часто представляют Qwen Image и HunyuanImage как «открытую альтернативу Nano Banana», и прямое сравнение закрытых и открытых моделей стало устойчивым форматом.
- В видео мультишоты и синхронизация со звуком становятся новым стандартом: Wan 2.6 (открытая) и Kling 3.0, Seedance 2.0, Runway Gen-4.5 (закрытые) соревнуются в создании нескольких кадров за одну генерацию и одновременном создании аудио и SFX. Конкуренция перешла от одиночных клипов к следующему уровню функций.
- Многие обзоры выходят в формате «first test» или «first look» через несколько дней или неделю после анонса, и этот оперативный формат практической проверки уже закрепился.
Ограничения
- Страницы результатов и просмотра YouTube (
youtube.com/results,youtube.com/watch) рендерятся JavaScript, поэтому WebFetch получал только статичный футер — копирайт, ссылки на условия и тому подобное. Точные просмотры, число подписчиков и комментарии в большинстве случаев напрямую проверить не удалось. Указанные выше просмотры и подписчики приведены только там, где это можно было извлечь из описаний поисковой выдачи; для многих роликов просмотры не указаны. - Отдельные URL-обзоры Kling 3.0, Seedance 2.0 и Runway Gen-4.5 на YouTube найти не удалось: результаты поиска были смещены в сторону статей с техническими сравнениями на invideo.io, Pixo, AI.cc и других сайтах.
- Число подписчиков отдельных каналов не удалось подтвердить, кроме Bijan Bowen (около 37 000) и Matt Wolfe / Future Tools (более 900 000).
Bluesky
Bluesky — Новости ИИ для генерации изображений и видео
Официальный поисковый API Bluesky (app.bsky.feed.searchPosts) в этой сессии стабильно отвечал 403 Forbidden, поэтому собрать публикации по ключевым словам не удалось (подробности в «Ограничениях»). Вместо этого через app.bsky.actor.searchActors искались тематические аккаунты, а затем их истории публикаций читались по одной через getAuthorFeed.
Аккаунты
| Аккаунт | Содержание | Подписчики | Публикации |
|---|---|---|---|
| @todaystopainews.bsky.social | «Today's Top AI News». Ботоподобный аккаунт, автоматически собирающий и публикующий новости индустрии ИИ; много тем о закрытых моделях GPT-6 Astra и Fable 5.1 | 272 | 1,826 |
| @useapi.bsky.social | useapi.net. Официальный аккаунт агрегатора API для Veo, Kling, Seedance, PixVerse, Hailuo, Runway, Nano Banana и других инструментов генерации изображений и видео | 13 | 24 |
| @nijiironokeshiki.bsky.social | «虹色». Частный автор, публикующий 2–3 фан-иллюстрации в день по Re:Zero, Lycoris Recoil, Frieren и другим произведениям с помощью Stable Diffusion и ComfyUI | 699 | 1,963 |
| @kunecco.bsky.social | «くねっこ». Разработчик нод, workflow и LoRA для git-версии ComfyUI; публикует и технические материалы, например переводы danbooru-тегов | 540 | 494 |
| @midjourneyofficial.bsky.social | Официальный аккаунт Midjourney, объявивший о приходе на Bluesky в августе 2025 года | неизвестно | последняя публикация 2025-10-08 |
| @comfyuistudio.bsky.social | Сторонний аккаунт с примерами workflow ComfyUI | неизвестно | последняя публикация 2024-12-19 |
| @klingaivideo.bsky.social | Аккаунт об инструменте генерации видео Kling AI | неизвестно | лента пуста |
Публикации
Закрытый сегмент
-
GPT-6 Astra генерирует SVG контроллера PS4 (@todaystopainews, 11 лайков, 2 репоста, 1 ответ, 2026-09-05, https://bsky.app/profile/todaystopainews.bsky.social/post/3mur7cyocf225). Указано даже время генерации — 11 минут 54 секунды; это конкретный пример того, как долго OpenAI GPT-6 Astra выполняет задачу, связанную с изображением.
-
GPT-6 Astra собирает городскую сцену в Unity (@todaystopainews, 4 лайка, 1 репост, 2026-09-04, https://bsky.app/profile/todaystopainews.bsky.social/post/3muoucqf4tk2w). Демо автоматической компоновки 3D-сцены из существующих ассетов показывает агентное применение за пределами простой генерации изображений.
-
Репост «Fable 5.1 world modeling» (@todaystopainews, 11 лайков, 4 репоста, 2026-09-03, https://bsky.app/profile/todaystopainews.bsky.social/post/3mumdxgujh22h) и опубликованный днём ранее «Средневековый город, созданный в Fable 5.1» (10 лайков, 3 репоста, 2026-09-02, https://bsky.app/profile/todaystopainews.bsky.social/post/3mukekiwxws2j). Fable 5.1 от Anthropic снова и снова появляется в демо 3D и моделирования миров.
-
Блог useapi.net «Seedance 2.5 в Dreamina API» (@useapi.bsky.social, 2026-08-08, https://bsky.app/profile/useapi.bsky.social/post/3mskj7fb2ok2a). Техническая публикация о том, что видеомодель Seedance 2.5 от ByteDance стала доступна через API Dreamina.
-
Сравнение useapi.net «MiniMax H3 vs Seedance 2.0» на одном референсном изображении (@useapi.bsky.social, 2026-07-31, https://bsky.app/profile/useapi.bsky.social/post/3mrw5xyd4zk2x). Прямое сравнение моделей на одинаковом исходном материале (omni references), то есть проверка качества с позиции поставщика API.
-
useapi.net «Подробное сравнение более 17 моделей генерации изображений» (@useapi.bsky.social, 3 лайка, 2026-07-25, https://bsky.app/profile/useapi.bsky.social/post/3mrigfks25k2n). Статья сопоставляет большое число моделей и показывает насыщенность рынка закрытых решений.
-
useapi.net «Сравнение цен Seedance 2.0 через официальный и сторонний маршруты» (@useapi.bsky.social, 2026-07-23, https://bsky.app/profile/useapi.bsky.social/post/3mrdyxqswcb2p). Конкретно сравнивает цену одной и той же модели через официальный API и через агрегатор, раскрывая слоистую структуру рынка API.
Открытый сегмент
-
Повседневные ИИ-иллюстрации «虹色» (@nijiironokeshiki, от 87 до 245 лайков, несколько публикаций 2026-09-02–09-05; пример: https://bsky.app/profile/nijiironokeshiki.bsky.social/post/3mumi7nop522l — 104 лайка и 25 репостов). Согласно профилю, работы создаются в Stable Diffusion и ComfyUI; это частный аккаунт с устойчиво самым высоким вовлечением среди открытого сегмента Bluesky.
-
Публикация くねっこ о разработке workflow ComfyUI (@kunecco, 2025-10-27, https://bsky.app/profile/kunecco.bsky.social/post/3m45jd5s2ek2f): «Создавать ноды и workflow стало так интересно, что я погружаюсь всё глубже». В тот же период аккаунт написал, что «перевёл 140 тысяч строк токенов danbooru» (https://bsky.app/profile/kunecco.bsky.social/post/3m432qalae22t), что служит примером работы с экосистемой ComfyUI на уровне словарей тегов.
-
Стагнация официальных/полуофициальных аккаунтов ComfyUI (@comfyuistudio.bsky.social — последняя публикация 2024-12-19; у @comfy-ui.bsky.social лента пуста). Поиск аккаунтов находит множество похожих хендлов —
comfyuistudio,real-comfyui,comfy-ui,comfyuiorgи другие, но активными остаются главным образом частные авторы ИИ-иллюстраций, например 虹色 и くねっこ. Разработчики инструмента и официальные источники почти незаметны на Bluesky.
Сигналы
- В закрытом сегменте центральны срочные новости, в открытом — публикации работ: todaystopainews и useapi.net пишут о названиях моделей, API-ценах и бенчмарках GPT-6 Astra, Fable 5.1, Seedance и MiniMax H3; число лайков низкое — от единиц до десятков, — но плотность новостей высока. Открытая сторона Stable Diffusion/ComfyUI состоит в основном из готовых иллюстраций частных авторов вроде 虹色: внимание направлено на сами работы, а не на динамику моделей. Технические новости открытого сегмента на Bluesky почти не распространяются.
- Официальные аккаунты Midjourney и Kling AI фактически заброшены: Midjourney объявил приход на Bluesky в августе 2025 года, но последняя публикация датирована 2025-10-08; у Kling AI Video лента вообще пуста. Бренды не используют Bluesky как постоянный канал коммуникации.
- Появление агентных персон, названных в честь GPT-6 Astra: найдены
astrra.space(Astra, «AI agent running on GPT-6 Astra») иmaple-nekokami.bsky.social(«Runs on OpenAI GPT-6 Astra»). Это не разговор о генерации изображений и видео сам по себе, но пример меметического потребления бренда GPT-6 Astra на Bluesky. - Агрегаторный API useapi.net становится хабом сравнений закрытых моделей: сервис объединяет Veo, Kling, Seedance, PixVerse, Hailuo, Runway, Nano Banana и другие модели и публикует наиболее конкретные материалы о ценах и качестве. На Bluesky такие кросс-модельные сервисы дают более практическую информацию, чем официальные аккаунты отдельных моделей.
Ограничения
app.bsky.feed.searchPosts, API полнотекстового поиска публикаций, возвращал HTTP 403 на все запросы: «image generation AI», «Stable Diffusion», «Flux» и даже однословные запросы. В то же времяapp.bsky.actor.searchActorsдля поиска аккаунтов иapp.bsky.feed.getAuthorFeedдля чтения ленты отдельного аккаунта работали. Поэтому отчёт основан не на поперечном поиске публикаций по ключевым словам, а на обнаружении вероятно релевантных аккаунтов и чтении их по одному; публикации и аккаунты, не найденные таким способом, в отчёт не вошли.- При целевом критерии около 20 проанализированных публикаций на соцсеть удалось прочесть и разобрать только 10 перечисленных материалов плюс вспомогательные близкие публикации. Для увеличения числа при отсутствии полнотекстового поиска потребовалось бы искать новые связанные аккаунты. В этой сессии после проверки ключевых подходов — новостных ботов о закрытых моделях GPT-6 Astra/Fable 5.1, API-агрегаторов вроде useapi.net и частных авторов ComfyUI/Stable Diffusion — большинство новых аккаунтов оказывались неактивными или нерелевантными: спорт, политика, журналистика. Поэтому сбор был остановлен.
- Официальные аккаунты брендов, включая Midjourney и Kling AI, остановили публикации или пусты и не могли служить источниками текущих новостей.
- Поиск аккаунтов по «Wan2.5», «Flux.2», «open source image generation» и другим названиям актуальных открытых моделей дал ноль результатов. Не были найдены Bluesky-аккаунты, публикующие о Wan, HunyuanVideo, Qwen-Image или Chroma; открытый сегмент удалось проверить лишь в рамках давно известных брендов Stable Diffusion и ComfyUI.
Lemmy
Lemmy — Последние тенденции ИИ для генерации изображений и видео
Сообщества
- !«メールアドレス» — 5 708 участников. Безусловно самое активное сообщество. Каждый день публикуются кастомные ноды ComfyUI, веса новых моделей, LoRA и другое; фактически это оперативная новостная лента открытого ИИ для изображений и видео.
- !«メールアドレス» — 2 360 участников. В основном обмен готовыми работами; новостей меньше.
- !«メールアドレス» — 1 662 участника. Похоже на версию dbzer0, но публикуется реже.
- !«メールアドレス» — 87 858 участников. Одно из крупнейших технических сообществ Lemmy, но отдельных тем об ИИ для изображений/видео немного; изредка появляются корпоративные новости Midjourney.
- !«メールアドレス» (включая зеркала на других инстансах) — часто публикует перепосты ИИ-сабреддитов Reddit. Материалов немного, но попадаются собственные источники, например данные Runway о финансах.
- !techtakes — критическое и скептическое сообщество об ИИ; публикует, например, ироничные материалы о метаниях Midjourney.
Публикации
- Midjourney меняет направление на бизнес медицинских ультразвуковых КТ-сканеров — !«メールアドレス», score 58, 2026-06-18, https://www.theregister.com (оригинальная статья The Register). Связанный материал: официальный блог Midjourney https://midjourney.com/medical/blogpost (!hackernews, score 2, 2026-06-18); реакция в ироничном сообществе: «Midjourney AI pivots to Theranos», !techtakes, score 40, 2026-06-19, https://pivot-to-ai.com/2026/06/19
- Midjourney требует от голливудских студий раскрыть фактическое использование ИИ — !«メールアドレス», score 73, 2026-07-05, https://techcrunch.com/2026/07/04
- Runway: «Корпоративный бизнес удвоился, NRR превышает 300%» — !ai_reddit, score 0, 2026-08-30, https://www.reddit.com/r/ArtificialInteligence/comments/1w2hnea/ (перепост на Lemmy)
- Релиз Qwen-Image-2.0: параметры сокращены с 20B до 7B, генерация и редактирование объединены, модель превосходит Nano Banana по Elo; публикация весов ожидается в ближайшее время — !«メールアドレス», score 12, 2026-02-12, https://files.catbox.moe/l3mzzs.jpg (также кросспост в !LocalLLaMA, !Aii и !artificial_intel)
- Wan Animate 2 доступен в ComfyUI — !«メールアドレス», score 8, 2026-08-08, https://blog.comfy.org/p/wan-animate-2-is-now-available-in
- LTX-2.5 получил поддержку Day-0 в ComfyUI — !«メールアドレス», score 5, 2026-08-12, https://blog.comfy.org/p/ltx-25-day-0-support-in-comfyui
- Trellis.2 и Pixal3D, модели 3D-генерации, получили нативную поддержку ComfyUI — !«メールアドレス», score 4, 2026-09-01, https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native
- Экосистема MiniMax-H3, открытовесовой модели видеогенерации, быстро расширяется — только в !«メールアドレス» с 8 августа по 5 сентября более 10 публикаций. Выдержки: GGUF-версия с квантизацией (21,6 ГБ → 8,9 ГБ, score 10, https://huggingface.co/Abiray/MiniMax-H3-Pruned-GGUF); LoRA для ускорения до 4–8 шагов (score 6–7, https://huggingface.co/lightx2v/Minimax-h3-Turbo); поддержка длинных видео до 120 секунд с синхронизацией звука (score 5, https://huggingface.co/Smite79/MiniMax-H3-Longvideos); реализация гибридного внимания (score 3, https://github.com/Saganaki22/ComfyUI-VDN-H3, 2026-09-05)
- Набор GPU-нативных нод для повышения качества видео: ComfyUI-AetherScale и DLSS5 Visual Enhancer — !«メールアドレス», score 5, 2026-09-01/09-05, https://github.com/vizart-vj/ComfyUI-AetherScale · https://github.com/Merserk/dlss5-visual-enhancer
- Через MCP для Claude из одного чата вызываются более 30 моделей генерации изображений и видео; выполнение одного проекта сократилось с 2,5 часов до 50 минут — !ai_reddit, score 1, 2026-05-01, https://i.redd.it/6gqfafpaukyg1.png
Сигналы
- Открытый сегмент полностью сосредоточен на «новостях реализации» вокруг ComfyUI/HuggingFace. Основная часть публикаций — не просто анонсы моделей, а сообщения вида «X появился в ComfyUI», «вышла LoRA» или «вышла квантизованная версия». Главная текущая зона разработки — инструменты вокруг видеомодели MiniMax-H3.
- 3D-генерация — Trellis.2 и Pixal3D — начинает интегрироваться в ComfyUI, становясь заметным следующим типом генеративного результата после изображений и видео.
- Закрытые решения на Lemmy чаще потребляются как критика или скандал, а не как продуктовые новости. Разворот Midjourney к медицинским устройствам вырос главным образом в общем техническом и ироничном сообществе, а не в сообществах генеративного ИИ (score 58, 73, 40).
- Nano Banana на Lemmy почти всегда упоминается только в сравнении «открытая модель превзошла её»; первичных публикаций Google обнаружить не удалось.
- Прямых упоминаний Sora, Veo, Kling, Hailuo, Seedream/Seedance и свежих версий Adobe Firefly за исследованный последний месяц не найдено; самые новые публикации об Adobe Firefly относятся к 2025 году.
Ограничения
- Lemmy невелик, а специализированная дискуссия об ИИ для изображений и видео почти полностью сосредоточена в !«メールアドレス». Поперечный поиск на других инстансах — lemmy.ml, lemm.ee, lemmy.zip и других — в основном давал дубликаты или нерелевантные результаты.
- Полнотекстовый поиск (
/api/v3/search) слабо работает с неточным совпадением: короткие собственные имена вроде «Sora» и «Veo» давали главным образом нерелевантные результаты — имена людей и других сервисов. Были испробованы и API, и веб-поиск, но первичных публикаций Lemmy об OpenAI Sora, Google Veo, Kling AI, Hailuo, ByteDance Seedream/Seedance обнаружить не удалось, включая Google-поиск. Это может означать не отсутствие интереса, а ограничение поиска и охвата Lemmy. - Публикация о Qwen-Image-2.0 относится к февралю 2026 года, а не к последнему месяцу; она сохранена как важная иллюстрация оси сравнения открытых и закрытых моделей.
- Публикации о Runway и Claude MCP — не первичные материалы Lemmy, а перепосты Reddit через !ai_reddit; первоисточник находится на стороне Reddit.
Pinterest — Новости ИИ для генерации изображений и видео
По запросу «Image and Video Generation AI News» на Pinterest было собрано 50 пинов (output/pinterest.pins.md), без жанровой разбивки — один общий поиск. Были просмотрены все 50 изображений.
Визуальные темы
- Символическое сведение «ИИ = белый гуманоидный робот/киборг»: независимо от реального содержания генеративного ИИ, белые гуманоидные роботы или совмещённые профили робота и человека многократно используются как обозначение «ИИ» ([2, 19, 30, 35, 37, 40, 43, 44, 46, 48]). Миниатюры новостных и объяснительных пинов почти целиком сходятся на этом мотиве.
- Доминирует киберпалитра неона и тёмно-синего: большинство материалов — шаблонные инфографики с голубым, фиолетовым и маджентовым свечением, схемами печатных плат и тёмным фоном ([3, 5, 6, 7, 10, 13, 17, 18, 19, 21, 29, 32, 34, 39, 42, 44, 46, 48, 49]). Почти нет фотографий или ручной графики; это выглядит как массовый дизайн на основе Canva и стоковых материалов.
- Главный формат — рейтинговые списки «best AI tool»: постоянно встречаются сравнительные таблицы и карточки с логотипами Runway, Pika, Kling AI, Luma AI (Dream Machine), Synthesia, HeyGen, InVideo AI, Kaiber, Adobe Firefly, ChatGPT Plus, Midjourney, Canva AI и других ([9, 16, 20, 24, 38, 42]). Пины [16] и [24] почти одинаковы — это показывает, что один шаблон используют разные авторы.
- Новостные инфографики и сводки: много пинов оформлено как газетная полоса или «Breaking News» с резюме «новостей ИИ недели» ([11, 12, 21, 29, 32, 33, 39, 43, 47, 50]). В изображениях часто зашиты даты: 30 июня 2025 года [29], 20 мая 2026 года [21], 15 августа 2026 года [32]. В одной выдаче смешиваются «срочные» картинки из разных периодов.
- Меньшинство пинов показывает реальные результаты генерации или демо-видео: большинство — маркетинговые изображения с логотипами и текстом. Среди немногих примеров работ: официальный деморил Google Veo 2 [8], сетка стилевых трансформаций в духе Luma (человек → резьба по дереву / оригами / LEGO / цветы) [4], демонстрация Microsoft VASA-1, создающего мимику из одного изображения и звука [22], пример image-to-video с устойчивым фиолетовым персонажем-монстром [26], фотореалистичный пожилой рыбак, созданный в AMD Amuse [41]. Такие пины составляют примерно десятую часть из 50.
- Скепсис и обнаружение: «Это настоящее или ИИ?»: есть фото кота с штампом FAKE и роботом [2], викторина с горными фотографиями «Which is AI?» [15], утверждение об обнаружении ИИ-голоса на 97% [18], список аргументов «хороши или плохи ИИ-видео?» [23] и неоновая надпись «все используют ИИ неправильно» [46]. Контента, подогревающего тревогу о подлинности, немало.
- Смешиваются фотографии реальных знаменитостей и сгенерированные «похожие на знаменитостей» лица: есть настоящее фото главы Nvidia Дженсена Хуана на сцене [45] и миниатюра YouTube с человеком, похожим на Сэма Альтмана [33], но также рекламное изображение Fiverr с ИИ-сгенерированным лицом в стиле Безоса [36]. По списку пинов трудно отличить фотографию от генерации.
- Открытый сегмент упоминается крайне редко: среди подавляющего большинства закрытых инструментов — Veo, Sora, ChatGPT, Midjourney, Runway и других — открытые/локальные решения представлены только двумя материалами: новостью об открытии Baidu Ernie 4.5 [29] и локальным инструментом AMD Amuse 3.0 [41]. Пинов, напоминающих сообщества OSS-генерации — Stable Diffusion, ComfyUI, LoRA — не найдено.
Примечательные пины
- [4] (без названия / сетка стилевых трансформаций в духе Lumalabs) — кадр реального видео преобразован в «резьбу по дереву», «оригами», «кубики LEGO» и «цветы», с параллельными сравнениями для собаки и автомобиля Tesla. Самое конкретное технологическое демо.
- [8] Google Unveils Veo 2 — подборка официальных промоматериалов: женщина у микроскопа, пловец под водой, танцовщица, рисующая созвездия, аниме-девушка на кухне, стая фламинго. Наиболее прямо показывает диапазон выразительности Veo 2.
- [9] 6+ Best AI Video Generation Websites — инфографика для сохранения, распределяющая Runway, Pika, Kling AI, Luma AI, Canva AI и Hailuo AI по функциям и целевым пользователям. Призыв «Save this pin» отражает типичную для Pinterest модель потребления списков.
- [16] AI Image Video: Best Quality vs Best Free — сравнивает 10 платных и 10 бесплатных инструментов с диагностической схемой выбора по задачам. Почти совпадает с [24], подтверждая распространение одинаковых шаблонов.
- [22] VASA-1 (Microsoft) — исследовательская схема: из одного статичного изображения, аудиоклипа и произвольного управляющего сигнала создаётся говорящее лицо с разнообразной мимикой. Один из наиболее академических технических пинов.
- [27] Vidu S1 — яркая киберпанк-визуализация модели китайской ShengShu Technology для ИИ-взаимодействия в реальном времени. Показывает присутствие китайских видеомоделей.
- [29] AI NEWS (в газетном стиле, 2025-06-30) — один из немногих пинов, близких к первичным новостям: открытие Baidu Ernie 4.5, аренда OpenAI TPU у Google, инвестиция Meta $14,3 млрд в Scale AI и другие конкретные корпоративные события.
- [38] Top 10 Image-to-Video Generator Tools — рейтинг Runway Gen-3, Kling, Google Veo, OpenAI Sora, Luma AI, Pika Labs, Kaiber AI, Synthesia, HeyGen, Adobe Firefly и InVideo AI. Даёт хороший обзор основных игроков.
- [41] Amuse 3.0 (AMD) — фотореалистичный портрет старого рыбака, демонстрирующий качество локального ИИ-инструмента для создания искусства на AMD GPU. Один из редких примеров открытого или локального направления.
- [50] This Week's Top AI Developments — сводка свежих трендов, основанных на статистике: исследование Google по 15 млн чатов, где 86% использования оказалось нерабочим; безлимитный ChatGPT; результат конкурса, в котором ИИ победил 458 из 526 команд.
Сигналы
- Текущее состояние: на Pinterest тема «Image and Video Generation AI» фактически стала рынком SEO и партнёрского маркетинга для списков инструментов и новостных инфографик. Runway, Pika, Kling AI, Luma AI, Synthesia, HeyGen, InVideo AI, Adobe Firefly и Google Veo постоянно оказываются наверху, формируя узнаваемый «стандартный набор» закрытых видеогенераторов.
- Повторное использование одинаковых шаблонов: поскольку [16] и [24] фактически содержат одну и ту же картинку, вероятно, что сравнительный контент об ИИ-инструментах массово создаётся и публикуется разными аккаунтами на основе небольшого числа шаблонов.
- Отсутствие открытого сегмента: прямыми примерами для требуемого брифом анализа открытого сегмента остаются только [29] — Baidu Ernie 4.5 — и [41] — AMD Amuse 3.0. Материалов о Stable Diffusion, ComfyUI или генеративных сообществах Hugging Face нет. Pinterest-выдача тяготеет к визуально привлекательным готовым результатам и маркетинговым материалам и плохо сочетается с техническими сообществами открытого ПО.
- Инфографики, сравнения и провокации сильнее реальных работ: из 50 пинов около 10% делают главным объектом реальные ИИ-изображения или видео; большинство — текстовые инфографики и списки. Похоже, на Pinterest лучше распространяется контент о выборе инструмента, чем конкретные примеры того, как он преобразует результат.
Ограничения
- На этом этапе были прочитаны только заранее собранные Pinterest-изображения (
images/pinterest/manifest.json, 50 материалов, один запрос без жанровой разбивки); сам Pinterest не просматривался. Дополнительные запросы вроде «open source AI art» или «Stable Diffusion» могли бы найти больше пинов открытого сегмента. - Даты, вшитые в изображения пинов — 2025-06-30, 2026-05-20, 2026-08-15 и другие — показывают только время изготовления шаблона, а не фактическую дату публикации или сохранения на Pinterest: это неизвестно из
manifest.json. - Часть текста на изображениях [12], [15], [21], [23], [29] и других недостаточно чёткая; встречаются и ошибки самих шаблонов, например «Human Journalism» и «Machine-Genertsd Media». Здесь приведены не точные цитаты, а пересказ содержания.
- У пяти пинов отсутствует заголовок (
untitled): у части [12], [15], [21], [29], [35]. Их классификация сделана по содержанию изображения.
Рекомендуемые действия
- Продолжать сопоставлять GPT-6 Astra и Fable 5.1 по оси агентного управления, а не только качества.
- В следующем выпуске продолжить наблюдение за экосистемой ComfyUI для MiniMax-H3: GGUF-квантизация и Turbo LoRA.
- В следующем исследовании X не полагаться на тренды Explore, а явно искать Stable Diffusion, Wan, Flux, Qwen и другие специфичные для открытого сегмента термины.
- В качестве первичного источника открытого сегмента отдавать приоритет !«メールアドレス».
- Не использовать Pinterest как источник динамики открытого сегмента; ограничить его наблюдением за маркетингом закрытых инструментов.
- Проверить, не зависят ли внешние инструменты от закрытия Sora API 2026-09-24.
Собранные изображения


















































Примечание о качестве данных
На Reddit из-за недоступности WebFetch использовались только 12 предварительно собранных тредов, что ниже целевых примерно 20; на X большинство трендов Explore было нерелевантным и поиск по открытому сегменту не проводился; на Bluesky API полнотекстового поиска вернул 403, поэтому использовался альтернативный метод сбора; на Lemmy не найдены первичные публикации закрытого сегмента; Pinterest ограничен одним общим запросом, и специализированный поиск по открытому сегменту не проводился.



