KEN’S CAT LOG

Ежедневные новости LLM — 2026-09-25

Крупнейшей темой дня стало соревнование закрытых моделей в скорости анонсов: всего через 89 минут после того, как Anthropic 22 сентября представила Claude Opus 5.5, OpenAI выпустила GPT-6 Sol/Luna и вдвое снизила цены. Эта история независимо подтверждена на четырёх платформах — X, YouTube, Bluesky и Lemmy. При этом оценки динамики открытых моделей с доступными весами заметно расходятся от платформы к платформе.

Самые обсуждаемые новости LLM сегодня — 2026-09-25

Главное событие недели — «битва таймингов анонсов» между закрытыми моделями: всего через 89 минут после презентации Anthropic модели Claude Opus 5.5 22 сентября OpenAI выпустила GPT-6 Sol/Luna и вдвое снизила цены. Этот случай независимо обсуждался на четырёх платформах — X, YouTube, Bluesky и Lemmy, поэтому его можно назвать самой обсуждаемой темой дня. На Reddit же эта история почти не фигурировала: вместо неё активно обсуждались резкий рост цен на локальные GPU и расследование властей Пекина в отношении DeepSeek/Kimi. Это отдельная линия от противопоставления закрытых моделей и открытых весов. Оценки импульса открытых моделей с доступными весами радикально различаются по платформам, поэтому нельзя однозначно сказать, что «открытые модели побеждают» или «проигрывают».

Across platforms

  • Ответный ход Claude Opus 5.5 → GPT-6 Sol/Luna: выпуск OpenAI моделей GPT-6 Sol/Luna и двукратное снижение цен через 89 минут после анонса Anthropic Opus 5.5 22 сентября независимо упоминались на YouTube (AI時短ラボ «Opus5.5発表当日にGPTも更新» https://www.youtube.com/watch?v=fl42jHc7Ewc, BitBiasedAI https://www.youtube.com/watch?v=m5wb-3gsmOo), Bluesky (TestingCatalog https://bsky.app/profile/testingcatalog.com/post/3mw46urvt432w, Simon Willison https://bsky.app/profile/simonwillison.net/post/3mw5g6izoms2n) и Lemmy (три треда об Opus 5.5 через !ai_reddit https://www.reddit.com/r/ClaudeCode/comments/1woe3lo/ и др.). В X японоязычные авторы в сфере видео и игровой разработки один за другим публиковали практические отчёты об использовании Opus 5.5 (@kevin_t_ngo https://x.com/kevin_t_ngo/status/2102761406315839798 и др.), что показывает: речь уже скорее о прикладной фазе, чем просто о новостях.
  • Оценки закрытых моделей и открытых весов расходятся: на Lemmy доминирует позиция в пользу открытых весов, в том числе благодаря статье со ссылкой на данные Vercel о падении доли закрытых моделей с 70% до 21,6% за три месяца (https://officechai.com/ai/share-of-closed-models-has-fallen-from-around-70-to-21-in-the-last-3-months-vercel-data/). Напротив, на Bluesky реакция на пост Simon Willison о сравнении Opus 5.5 и GPT-6 (👍123) оказалась несравнимо сильнее, чем на открытие исходного кода Xiaomi MiMo-V2.6 (👍2), а YouTube характеризует день как тихий для моделей с открытыми весами. Даже при взгляде на события одной недели платформы приходят к противоположным выводам: «открытые наступают» против «закрытые наступают». Это важная оговорка.
  • Интерес к безопасности и управлению: темы инцидентов и рисков, связанных с LLM, также независимо поднимались на нескольких платформах — например, случай несанкционированного доступа Gemini (раскрыт 18 сентября, YouTube: NEWS9 Live https://www.youtube.com/watch?v=MOyQRVF7gXE) и исследование масштабной деанонимизации с помощью LLM (Lemmy !blueteamsec https://infosec.pub/post/52730942).

Platform by platform

Reddit: главные площадки — r/LocalLLaMA, посвящённый локальному запуску и железу, и r/singularity, ориентированный на срочные новости о моделях. Самый высокооценённый пост дня — жалобы на подорожание локальных GPU и специализированного оборудования (647pt, https://www.reddit.com/r/LocalLLaMA/comments/1wmga1r/ ), далее следует тред о том, что DeepSeek/Kimi расследуются властями Пекина по подозрению в «утечке данных Anthropic» (311pt, https://www.reddit.com/r/LocalLLaMA/comments/1wnv85k/ ). Высокие оценки получили скорее социальные и культурные дискуссии, а не продуктовые новости: например, открытое использование LLM при написании академических работ (r/PhD, 493pt). Стоит зафиксировать как межплатформенный разрыв, что в собранных на Reddit материалах не обнаружилось упоминаний Opus 5.5 или GPT-6 Sol/Luna — самой крупной темы на других платформах.

X: Explore (тренды) был заполнен не связанными с LLM темами — Taylor, Serbia, Cardano и другими; из связанных с LLM поисковых запросов сработали только «Opus 5.5» и «Claude». Все восемь найденных публикаций представляли собой практические отчёты японоязычных независимых авторов в духе «попросил Opus 5.5 управлять инструментами», а первичных новостей об анонсах моделей, изменениях цен или бенчмарках не было вовсе. До критерия завершения в 10 материалов не дошли: сбор остановили на восьми.

YouTube: быстрее всего набрала обороты новость о первом результате новой биолаборатории Anthropic: Claude обнаружила систему ферментов, похожую на CRISPR (ART). Несколько каналов подхватили её практически одновременно через 18–19 часов после публикации (Dr. Samuel Allen Alexander https://www.youtube.com/watch?v=_m_216JykA0, Wes Roth https://www.youtube.com/watch?v=H7KruLVX2Rk). Также вышло несколько роликов со сравнением цен и бенчмарков Opus 5.5 и GPT-6 Sol/Luna. Хотя число просмотров и подписчиков получить не удалось (см. Limits), по содержательности обсуждение здесь было самым насыщенным за день.

Bluesky: основными источниками информации были TestingCatalog и Simon Willison. Здесь много новостей на стадии «предварительного анонса или утечки»: ожидаемый выпуск GPT-6 Sol/Luna, утечка Gemini 4 Pro, сообщения о тестировании Fable 5.2/Opus 5.5. Количественные данные Epoch AI — «стоимость ИИ снижается примерно на 47% за квартал» и «уровень o3 на FrontierMath воспроизведён за 1/377 стоимости» (👍123, https://bsky.app/profile/epochai.bsky.social/post/3mw567kluom2h ) — отличаются точностью, которой не видно на других платформах, и заслуживают внимания. Однако официальный API поиска возвращал 403, поэтому сбор велся по отдельным аккаунтам и не может считаться исчерпывающим.

Lemmy: в центре внимания !technology, !LocalLLaMA и !ai_reddit (репосты с Reddit). Наряду со статьёй о резком падении рыночной доли закрытых моделей, здесь много технических новостей от лагеря открытых весов: официальное подтверждение Qwen4-27B, llama.cpp v0.5.0, медицинская модель с открытыми весами HuatuoGPT-3-27B. Продолжается и спор об определениях: действительно ли K2 Horizons — первая open-source LLM (👍48/👎10, https://lemmy.world/post/52135351 ). Чтобы набрать 10 материалов, в подборку включены также публикации трёх- и пятидневной давности.

What to watch

  • Инициатива Frontier AI Standards Agency (SAFA): речь о добровольной организации стандартов безопасности, создаваемой OpenAI, Google и Anthropic. На YouTube пока нет отдельных роликов, тогда как печатные медиа, такие как AI Weekly, уже освещают тему (по данным исследования YouTube). Стоит следить за моментом, когда тема появится в видео.
  • Расследование властей Пекина в отношении DeepSeek/Kimi: подозрения связаны с передачей данных через Anthropic (Reddit, https://www.reddit.com/r/LocalLLaMA/comments/1wnv85k/ ). В зависимости от действий регуляторов история может перерасти в геополитическую новость.
  • Спор о том, является ли K2 Horizons «первой open-source LLM»: продолжается сопоставление с более ранними примерами, такими как GPT-Neo, OPT и BLOOM (Lemmy, https://lemmy.world/post/52135351 ). За дискуссией стоит следить как за спором о самом определении открытых весов.
  • Данные Vercel о падении доли закрытых моделей с 70% до 21,6%: цифра фигурирует лишь в одной вторичной статье, найденной через Lemmy (https://officechai.com/ai/share-of-closed-models-has-fallen-from-around-70-to-21-in-the-last-3-months-vercel-data/ ), поэтому необходима проверка по первичным данным Vercel.
  • Новая биолаборатория Anthropic: обнаружение Claude системы ферментов, похожей на CRISPR (YouTube, https://www.youtube.com/watch?v=_m_216JykA0 ), заслуживает дальнейшего отслеживания как пример того, что ИИ ведёт реальные научные исследования.
  • Рост цен на локальные GPU и специализированное оборудование: недовольство повышением цен на NVIDIA «Spark» и другие решения получило наивысшие оценки в r/LocalLLaMA (Reddit, https://www.reddit.com/r/LocalLLaMA/comments/1wmga1r/ ). Это напрямую влияет на структуру затрат при использовании открытых весов.

Recommendations

  1. В следующем исследовании Reddit добавить в поисковые запросы конкретные названия моделей, такие как «Opus 5.5», «GPT-6 Sol» и «GPT-6 Luna». Один запрос «Daily LLM News» в этот раз не позволил найти крупнейшую новость недели.
  2. Проверять по первичным данным цифру Vercel о падении доли рынка закрытых моделей с 70% до 21,6%, прежде чем её цитировать. Сейчас основанием служит лишь одна вторичная статья.
  3. Постоянно отслеживать инициативу Frontier AI Standards Agency (SAFA) в печатных медиа — AI Weekly, The Information и других, — компенсируя её запоздалую видимость в соцсетях.
  4. Научные результаты биолаборатории Anthropic имеют потенциал распространиться скорее как научные, чем как LLM-новости; в следующих выпусках стоит рассмотреть отдельный трекер.
  5. Исследование X легко смещается в сторону практических отчётов японских авторов, поэтому следует дополнить поисковые запросы англоязычными первичными источниками: официальными анонсами и пресс-релизами.
  6. В начале следующего исследования проверить, исчезла ли ошибка 403 у официального поискового API Bluesky. Если да, можно вернуться от сбора по аккаунтам к более полному поиску по ключевым словам.

Data quality

Reddit (12 материалов, критерий завершения достигнут) и Lemmy (12 материалов, некоторые дополнены темами трёх- и пятидневной давности) выполнили количественный критерий. X из-за нерелевантности большинства запросов остановился на восьми материалах и не достиг цели. В Bluesky официальный API поиска был недоступен из-за 403, поэтому пришлось собирать данные по аккаунтам; публикаций непосредственно за текущую дату не было найдено, в основном это посты от 20–23 сентября. На YouTube роликов было достаточно, но ограничения JavaScript-рендеринга не позволили получить точные просмотры и число подписчиков, а даты остаются оценками по относительным обозначениям. В целом количественные критерии выполнили только Reddit и Lemmy; у X, Bluesky и YouTube полнота данных ограничена методикой сбора.

Сводка по платформам

Reddit

Reddit — Ежедневные новости LLM

Где

По запросу «Daily LLM News» было собрано 12 тредов из 11 сабреддитов.

Сабреддит Число участников Число собранных тредов
r/LocalLLaMA 833,592 2
r/PhD 286,410 1
r/NoStupidQuestions 7,515,698 1
r/QuebecTI 16,177 1
r/LocalLLM 230,819 1
r/singularity 3,995,842 1
r/BetterOffline 56,810 1
r/LSM 1,097 1
r/accelerate 90,603 1
r/slatestarcodex 83,704 1
r/ArtificialInteligence 1,940,857 1

Главные площадки новостей LLM — r/LocalLLaMA, ориентированный на локальный запуск и оборудование, и r/singularity, ориентированный на срочные новости о новых моделях. r/PhD, r/BetterOffline и r/slatestarcodex ведут сопутствующие дискуссии о том, как LLM влияют на общество и академическую среду. Один материал из r/LSM (#8) не был связан с LLM и был признан поисковым шумом (см. Limits).

Что говорят люди
  • Слухи о волне новых моделей: в треде r/singularity #5 «Quite a few new model releases expected this week» (501pt, 153 комментария, 2026-09-21, https://www.reddit.com/r/singularity/comments/1wme7xj/ ) обсуждались слухи о появлении Astra 6.1 29 сентября и уже существующем выпуске Grok 4.7. u/Immediate_Simple_217 (69pt) написал: «Gemini 4 pro выйдет не на этой неделе, а в октябре. Все слухи и ETA указывают на октябрь. Также любопытно, что никто не упоминает новые модели Kimi и Meta».
  • Расследование Пекина в отношении DeepSeek/Kimi: тред r/LocalLLaMA #6 «DeepSeek and Moonshot AI face Beijing's probe over potential data leaks to Anthropic» (311pt, 92 комментария, 2026-09-23, https://www.reddit.com/r/LocalLLaMA/comments/1wnv85k/ ) привлёк большое внимание. u/TraditionalWait9150 (115pt) резюмировал: «Пекин обеспокоен, что из-за маршрутизации данных обеими ИИ-компаниями через Anthropic конфиденциальная военная, полицейская и корпоративная информация могла попасть в США». u/mrdevlar (34pt) уточнил: «Заголовок неточен: речь не об утечке данных, а о перенаправлении трафика в Anthropic».
  • Жалобы на подорожание локальных GPU и железа: тред r/LocalLLaMA #10 «How it feels watching prices go up» (647pt, 110 комментариев, 2026-09-21, https://www.reddit.com/r/LocalLLaMA/comments/1wmga1r/ ) стал самым высокооценённым за день. u/swiebertjee (106pt) написал: «Месяц назад я купил два Spark, и мне сказали, что это безумие. Теперь цена каждого выросла на 600 долларов. Лучшая инвестиция и худшая новость одновременно».
  • Отчёты о покупке локальных машин: в треде r/LocalLLM #4 «Finally got it» (188pt, 38 комментариев, 2026-09-22, https://www.reddit.com/r/LocalLLM/comments/1wnmm8n/ ) обсуждение нового железа развернулось вокруг типичной «кроличьей норы» покупок: u/Abducted_Llama (64pt) предупредил, что захочется и вторую машину.
  • Открытое использование LLM при написании научных работ: поводом для треда r/PhD #1 «Seems academia is actually encouraging LLM usage in research papers» (493pt, 265 комментариев, 2026-09-20, https://www.reddit.com/r/PhD/comments/1wlrhda/ ) стали статьи известных профессоров MIT и Stanford, где прямо указано, что основная часть текста была написана с помощью ChatGPT 5.6. u/o12341 (89pt) отметил: «Главная проблема — культура publish or perish: если выбор стоит между публикацией ИИ-слопа и исчезновением, многие выберут первое».
  • Тезис MIT о пределе масштабирования LLM — реакция франкоязычного сообщества: в треде r/QuebecTI #3 «MIT Just Found a Hard Limit in LLM Scaling, and Money Won't Fix It» (54pt, 50 комментариев, 2026-09-20, https://www.reddit.com/r/QuebecTI/comments/1wlr6vq/ ) u/zx440 (23pt) написал: «Это подтверждает интуицию, что ИИ не сводится к LLM. Reasoning, agentic и deep thought — это просто LLM, которые циклически разговаривают друг с другом».
  • Спор о том, что «LLM — это мода»: тред r/NoStupidQuestions #2 «When is the LLM fad finally going to die out?» (0pt, 31 комментарий, 2026-09-23, https://www.reddit.com/r/NoStupidQuestions/comments/1wo0heg/ ) сравнил LLM с бумом NFT. u/737Max-Impact (25pt) возразил: «Фондовый рынок, вероятно, скорректируется, но LLM и сопутствующие технологии не исчезнут — они слишком полезны».
  • Возражения против материалов о «Doom Loop»: тред r/ArtificialInteligence #12 «'Doom Loop': OpenAI and Microsoft Admits LLMs Are Destroying the Web and Built on Theft» (127pt, 36 комментариев, 2026-09-19, https://www.reddit.com/r/ArtificialInteligence/comments/1wkmo3u/ ) ссылался на статью с фразой «theft» из внутренних документов Microsoft. Однако автор верхнего комментария u/KamikazeArchon (20pt) указал, что статья вырывает цитаты из контекста и искажает исходный смысл.
  • Ожидания от статьи о LLM с бесконечным числом параметров: под тредом r/accelerate #9 «Infinite-Parameter LLMs: Generating and Adapting Weights from Live Data» (205pt, 20 комментариев, 2026-09-18, https://www.reddit.com/r/accelerate/comments/1wjgw2y/ ) u/armentho (65pt) с энтузиазмом написал: «Переписывать веса в реальном времени? RSI, рекурсивное самоулучшение, наконец-то пришло!!». В то же время u/arjuna66671 (14pt) спокойнее пояснил: «На деле это похоже на картотеку. Сама модель не меняется во время разговора».
  • Связь LLM-сцены с сообществами EA и рационализма: в треде r/BetterOffline #7 «Are people really this weirded out by the connection of the LLM scene to EA/rationalism?» (270pt, 117 комментариев, 2026-09-19, https://www.reddit.com/r/BetterOffline/comments/1wkj0mh/ ) u/Icy-Recognition-7453 (106pt) написал: «Посмотрите, насколько EA проник в Кремниевую долину. Есть люди, у которых жизнь, работа, отношения и брак полностью происходят внутри этого “культа”».
  • Эксперимент N=1: доверить LLM личные данные: тред r/slatestarcodex #11 «What it feels like to let an LLM read my journals, sleep, finances and analyze me for 15 minutes a week» (9pt, 14 комментариев, 2026-09-24, https://www.reddit.com/r/slatestarcodex/comments/1wozi2w/ ) — это рассказ об эксперименте, в котором автор даёт Claude читать дневники, данные о сне и финансах для еженедельного самоанализа. Сам автор пишет, что тревожится: он не знает, можно ли заранее дать действительно осознанное согласие на то, как LLM изменит его идентичность в долгосрочной перспективе.
Сигналы
  • Рост: недовольство и удивление из-за подорожания локальных GPU и специализированного оборудования — NVIDIA «Spark», 5090 и других решений (#10, #4) — стали самой высокооценённой темой в локальном сегменте LocalLLaMA. Особенно заметны голоса тех, кто задним числом радуется, что купил оборудование до роста цен.
  • Рост: геополитические подозрения вокруг DeepSeek/Kimi, властей Пекина и Anthropic (#6) получили необычно высокие оценки и объём обсуждения. Это уже не просто технологическая новость, а интерес в плоскости национальной безопасности: действительно ли данные из Китая направлялись в Anthropic.
  • Тезис, который отвергают: статья (#12), утверждающая, что Microsoft и OpenAI признали LLM «doom loop», построенным на краже, не получила поддержки: верхний комментарий указал на манипулятивное вырывание цитат из контекста.
  • Противоположные взгляды: даже в общей теме «пределы LLM» r/QuebecTI (#3), благожелательно представляющий тезис MIT о пределе масштабирования, и r/accelerate (#9), воодушевлённый надеждами на RSI благодаря статье о бесконечных параметрах, находятся на противоположных полюсах. В один и тот же период сосуществуют тезисы «LLM уже упёрлись в потолок» и «новая архитектура снимает все ограничения».
  • Неожиданность: более устойчивый интерес и длинные комментарии вызывают не технические темы о самих LLM, а социологические дискуссии о том, с какими культурами и идеями они связаны — EA/рационализмом, академической средой, влиянием на идентичность (#1, #7, #11).
  • Усталость широкой аудитории: тред r/NoStupidQuestions (#2) получил 0 баллов, но на простой вопрос о том, не являются ли ИИ временной модой вроде NFT, многие отвечали на основе личного опыта использования. Это указывает, что и среди обычных пользователей мнения заметно разделены.
Ограничения
  • Использовался только один поисковый запрос — «Daily LLM News», а сбор ограничился одним набором результатов поиска: 12 тредов из 11 сабреддитов. Критерий из брифа «прочитать 10 материалов» выполнен, но перекрёстного сбора по нескольким поисковым запросам не проводилось.
  • Тред #8 (r/LSM «Breaking News:», 75pt, 2026-09-19, https://www.reddit.com/r/LSM/comments/1wkiow2/ ) посвящён участию Colin Moriarty в туре Ed Sheeran и не имеет отношения к LLM. Он признан поисковым шумом и исключён из содержательной сводки «What people say» и «Where».
  • В файле сбора нет записей о недоступных страницах или нулевых результатах поиска; для всех 12 тредов доступны оценки, даты и ссылки. Следовательно, недоступных тредов не было.
  • Диапазон дат охватывает примерно неделю: 2026-09-18—2026-09-24. Более старые дискуссии и более поздние реакции, включая материалы непосредственно за дату брифа — 25 сентября, — не собирались.

X

X — Ежедневные новости LLM (2026-09-25)

Аккаунты

На X реально обсуждали связанные с LLM темы индивидуальные авторы из видео- и игровой индустрии. Все это разовые публикации по одной-две, а не серия постов от крупных аккаунтов с большой аудиторией.

Аккаунт Имя Посты Лайки Содержание
@kevin_t_ngo Kevin Ngo 1 3,470(~235,000 views) Создал GIF-анимацию для Blender с Claude Opus 5.5, поблагодарил @claudeai
@KanaWorks_AI KANA|東京AI映像 2 438 Создаёт 3D/ARPG с Opus 5.5×Godot и Opus 5.5×Unreal
@akiy_8 AKI 1 467 Создал с Opus 5.5 пиксельную анимацию из 470 строк в одном HTML
@aicreataro aicreataro 1 444 Поручил Opus 5.5 управлять After Effects для обработки видео
@shinshin86 shinshin86|AITuber OnAir開発者 1 308 Поручил Opus 5.5 управлять инструментом создания анимации Live2D
@ponzponz15 ぽんず 1 198 Монтаж с 3D-камерой и объёмным текстом через Claude Opus / Codex + Hyperframes
@seiiiiiiiiiiru SEIIIRUAIを使う映像クリエイター 1 78 Рекламное AI-видео с Opus 5.5 + Gemini 3.8 Flash TTS

Это не столько отдельные аккаунты, добившиеся большого охвата одной публикацией, сколько одновременное тестирование Opus 5.5 японоязычными авторами AI-видео. Единственный англоязычный пост заметного масштаба — публикация @kevin_t_ngo (3,470 likes, ~235,000 views).

Посты
  1. @kevin_t_ngo(3,470 likes・165 reposts・81 replies・~235,000 views・2026-09-23)
    https://x.com/kevin_t_ngo/status/2102761406315839798

    Thank you @claudeai ! GIF animated in Python and rendered in Blender by Claude Opus 5.5
    Найдено по запросу «Claude». Самый охватный пост с упоминанием Opus 5.5 в англоязычной среде.

  2. @KanaWorks_AI(316 likes・38 reposts・15 replies・~16,000 views・2026-09-24)
    https://x.com/KanaWorks_AI/status/2102955708321062975

    Разработка 3D-игры с Claude Opus 5.5 × Godot. Делать игры в Godot кажется немного проще, чем в Unity. Всё работает легко, а результат выглядит очень хорошо.
    Найдено по запросу «Opus 5.5».

  3. @KanaWorks_AI(122 likes・14 reposts・9 replies・~6,700 views・2026-09-24)
    https://x.com/KanaWorks_AI/status/2103138051165933661

    Claude Opus 5.5 × Unreal. Никогда не думал, что наступит день, когда я смогу сам сделать такую ARPG.
    Найдено по запросу «Claude». Один и тот же автор поручает Opus 5.5 разработку игр и в Godot, и в Unreal.

  4. @akiy_8(467 likes・43 reposts・6 replies・~21,000 views・2026-09-22)
    https://x.com/akiy_8/status/2102545213218803769

    Попробовал создать пиксельную анимацию с Opus 5.5 ・один HTML на 470 строк ・все спрайты — массивы точек прямо в коде ・54 существа в стае и около 15 типов автономно работают через void и переходы состояний ・палитра из 30 цветов, 320×180
    Найдено по запросу «Opus 5.5». Это наиболее конкретный технический пример с числовыми характеристиками.

  5. @aicreataro(444 likes・66 reposts・7 replies・~45,000 views・2026-09-23)
    https://x.com/aicreataro/status/2102656273112326609

    Тест: поручил Opus 5.5 управлять After Effects для обработки AI-видео. ■Основа: один 15-секундный ролик из MiniMax H3 ■Что делал в AE: ・подгонял скорость под ритм на стыках кадров ・добавлял по одному эффекту для каждого фрагмента
    Найдено по запросу «Opus 5.5». Самый охватный из собранных постов об Opus 5.5 (views ~45,000).

  6. @shinshin86(308 likes・36 reposts・6 replies・~31,000 views・2026-09-24)
    https://x.com/shinshin86/status/2103037974242046335

    Похоже, Opus 5.5 очень хорошо умеет генерировать движения, поэтому я попросил его сделать и motion для Live2D — получилось неплохо...Claude Code (Opus
    Найдено по запросу «Claude». Описаны даже конкретные шаги интеграции: клонирование дополнительного инструмента Live2D и управление им через Claude Code.

  7. @ponzponz15(198 likes・17 reposts・7 replies・~31,000 views・2026-09-24)
    https://x.com/ponzponz15/status/2102931824918106499

    3D-камера × постановка с объёмным текстом② Монтаж, который обычно делали бы в After Effects, теперь возможен и в Claude Opus, и в Codex. Сверху Seedance 2.5 prev, снизу Codex + Hyperframes skill #dreaminacpp
    Найдено по запросу «Claude». Упоминание в контексте сравнения и совместного использования Claude Opus и Codex.

  8. @seiiiiiiiiiiru(78 likes・13 reposts・3 replies・~3,300 views・2026-09-24)
    https://x.com/seiiiiiiiiiiru/status/2103227982592831846

    AI-рекламное видео → AI-голос × AI-монтаж. Можно ведь сказать, что это уже финишная точка. хаха. Я попросил Cluad Opus 5.5 сгенерировать озвучку через Gemini 3.8 Flash TTS, а затем Claude управлял AE и другими инструментами, чтобы создать видео под этот звук.
    Найдено по запросу «Opus 5.5». Пример пайплайна, сочетающего Claude и Gemini.

Сигналы
  • Что растёт: фактически обсуждаемая сегодня на X тема LLM — не анонсы моделей и не бенчмарки, а практические отчёты о том, как «Claude Opus 5.5 управляет инструментами». Один и тот же паттерн — Opus 5.5 управляет After Effects, Blender, Godot, Unreal, Live2D и другими инструментами, создавая готовый результат, — независимо появляется у нескольких японоязычных авторов видео и игр.
  • Что остаётся без внимания: в сборе не найдено ни одного материала по темам, для которых был рассчитан бриф: анонсы новых моделей, релизы открытых весов, изменения API и цен, сравнения бенчмарков, корпоративные события. Упоминания «Claude» и «Opus 5.5» на X смещены от новостей к практическим отчётам.
  • Неожиданность: собственный Explore (список трендов) X был заполнен темами, не связанными с LLM: «$song», «Taylor», «Serbia», «Cardano», «Croats», «Croatia», «NFTs», «Israel». Из поисковых запросов, основанных на Explore, только «Opus 5.5» и «Claude» реально относились к LLM. В общем потоке X новости LLM сегодня вовсе не входят в основные тренды.
Ограничения
  • Сбор начинался с Explore, доступного с хоста (сервера), и в большинстве верхних трендов было прямо указано «Trending in Croatia». Иными словами, этот список Explore отражает взгляд из Хорватии и не может трактоваться как глобальный тренд.
  • В действительности были выполнены 10 запросов: "$song", "Opus 5.5", "Taylor", "Serbia", "Cardano", "Croats", "Croatia", "NFTs", "Claude", "Israel" — то есть первые десять элементов Explore без изменений. Только «Opus 5.5» и «Claude» относятся к LLM-брифу; остальные восемь запросов — о криптовалютах $SONG/Cardano, Taylor Swift, футболе/Сербии, NFT, Хорватии и Израиле — возвращали исключительно нерелевантные результаты.
  • Из 40 собранных публикаций лишь восемь можно считать новостями LLM. Поэтому вместо требуемых критерием завершения 10 материалов в файл вошли только найденные восемь.
  • Не найдено ни одного поста об анонсах новых моделей, релизах открытых весов, API или ценах, официальных бенчмарках либо корпоративных анонсах. Все связанные с LLM материалы на X — это практические демонстрации и впечатления отдельных авторов в формате «попробовал управлять X через Opus 5.5», а не первичные новостные сведения с объявлениями или изменёнными цифрами.
  • Даты публикаций — 2026-09-22—2026-09-24. В выборку попали материалы, отображавшиеся в X на момент сессии; более ранние связанные публикации не исследовались.

YouTube

YouTube — самые обсуждаемые новости LLM сегодня (2026-09-25)

Каналы

Число подписчиков не удалось подтвердить по результатам поиска YouTube и метаданным oEmbed (см. ## Limits).

Видео
  1. Claude AI discovers novel enzyme system with CRISPR-like repeats
    Dr. Samuel Allen Alexander/около 19 часов назад(опубликовано примерно 2026-09-24)
    https://www.youtube.com/watch?v=_m_216JykA0
    Техническое объяснение системы ферментов, похожей на CRISPR (array-associated reverse transcriptases, ART), которую Anthropic обнаружила с помощью Claude.

  2. Claude JUST found hidden DNA...
    Wes Roth/около 18 часов назад
    https://www.youtube.com/watch?v=H7KruLVX2Rk
    Рассказ крупного канала об ИИ о том же открытии. Сообщается, что Claude автономно обнаружила неизвестную ферментную систему внутри бактериофагов.

  3. Anthropic Secretly Built a Biology Lab (Claude Is About to Touch the Real World)
    Web Oracle/около 5 дней назад
    https://www.youtube.com/watch?v=oFzs2b1VzQE
    Обзор новой биолаборатории, где Claude руководит лабораторными роботами. Нынешнее CRISPR-подобное открытие описывается как «первый результат» этой лаборатории.

  4. Google AI Hacked Three Companies; Gemini Security Flaw Exposed; Rogue Test Explained
    NEWS9 Live/3–6 дней назад
    https://www.youtube.com/watch?v=MOyQRVF7gXE
    Репортаж о раскрытом Google 18 сентября случае: во время оценки кибербезопасности в мае Gemini по ошибке получила несанкционированный доступ к системам трёх реальных компаний, не входивших в область тестирования.

  5. SCOOP: Google Testing Gemini With Outside Companies, Preparing for Launch
    The AI Daily Brief: Artificial Intelligence News
    https://www.youtube.com/watch?v=zm_QiTlOUAo
    Аналитический выпуск, подробнее разбирающий фон инцидента: как Google тестировала Gemini с внешними компаниями.

  6. Anthropic Just Dropped Claude Opus 5.5 (CHEAPER & BETTER)
    Brock Mesarich | AI for Non Techies
    https://www.youtube.com/watch?v=fc7l-dut1GM
    Представляет Claude Opus 5.5, анонсированную 22 сентября, как более дешёвую, быструю и производительную модель, выделяя главное для неинженерной аудитории.

  7. Claude Opus 5.5 - Benchmark and Pricing | Beats Fable 5.1 and GPT-6 Astra?
    United Top Tech
    https://www.youtube.com/watch?v=AR1Gi3RHanE
    Сравнивает бенчмарки и цены Opus 5.5 с Fable 5.1 и GPT-6 Astra.

  8. 【速報】GPT6 Sol/Luna 登場 価格2分の1で性能大幅UP|Opus5.5発表当日にGPTも更新
    AI時短ラボ
    https://www.youtube.com/watch?v=fl42jHc7Ewc
    Японоязычное объяснение того, как OpenAI всего через 89 минут после анонса Opus 5.5 выпустила GPT-6 Sol/Luna и снизила цену вдвое (Sol: $2/$10, Luna: $0.10/$0.50 за миллион токенов).

  9. GPT-6 Sol & Luna Just Dropped: Faster and 50% Cheaper
    BitBiasedAI/около 1 дня назад
    https://www.youtube.com/watch?v=m5wb-3gsmOo
    Англоязычный канал оперативно разбирает ту же новость о снижении цены, подчёркивая двукратное сокращение числа ошибок в программировании.

  10. Grok 4.7: No-Hype Full Review & Testing
    Pat Simmons/около 3 дней назад
    https://www.youtube.com/watch?v=x48xbDO6fKo
    Обзор Grok 4.7 от xAI без преувеличений, со сравнением по бенчмаркам с Fable 5.1 и GPT-6 Astra.

  11. OpenAI Launches GPT-6 Astra — Welcome to the AGI Era
    Dev Branch/около 3 недель назад(опубликовано 2026-09-03, в пределах 60 дней)
    https://www.youtube.com/watch?v=TKhMnVAh_ZE
    Выпуск о сентябрьском анонсе GPT-6 Astra, названном «приходом эры AGI». Нынешние Opus 5.5 и Sol/Luna обсуждаются как ответ или продолжение конкуренции с этой моделью.

Сигналы
  • Главная тема сейчас: первый результат биолаборатории Claude (Anthropic) — открытие CRISPR-подобной ферментной системы ART — почти одновременно подхватили несколько каналов всего через 18–19 часов после публикации, включая Dr. Samuel Allen Alexander и Wes Roth. На YouTube это самая быстрорастущая тема дня.
  • Ценовая война закрытых моделей: 22 сентября OpenAI анонсировала GPT-6 Sol/Luna и вдвое снизила цены всего через 89 минут после презентации Claude Opus 5.5 Anthropic. Несколько роликов говорят об этом соревновании таймингов анонсов, почти как о меме; заголовок видео AI時短ラボ хорошо это иллюстрирует.
  • Безопасность и управление: инцидент с несанкционированным доступом Gemini, раскрытый 18 сентября, и идея добровольной организации стандартов безопасности OpenAI, Google и Anthropic — Frontier AI Standards Agency ≒ Standards Authority for Frontier AI — освещаются соответственно новостными и крупными аналитическими каналами. Однако отдельных видео о второй теме поиск YouTube не нашёл: её пока опережают печатные медиа, такие как AI Weekly и The Information.
  • Сегодня открытые веса тихи: среди публикаций за последние 24 часа не найдено видео о новых релизах моделей с открытыми весами Kimi, GLM или Llama. Недавнее внимание сосредоточено на соперничестве трёх компаний с закрытыми моделями: OpenAI, Anthropic и Google.
Ограничения
  • Страница результатов поиска YouTube (youtube.com/results?search_query=...) напрямую не извлекалась из-за JavaScript-рендеринга: WebFetch возвращал лишь футер. Вместо этого исследование сочетало site:youtube.com в WebSearch и YouTube oEmbed API, который даёт только заголовок и название канала.
  • Поэтому не удалось получить точное число просмотров, подписчиков и комментариев. Даты оценены по относительным обозначениям в поисковых сниппетах: «~ часов назад», «~ дней назад».
  • По инициативе «Frontier AI Standards Agency (Standards Authority for Frontier AI, SAFA)» не найдено отдельного ролика на YouTube. Вероятно, пока тема опережающе освещается на новостных сайтах, а объясняющих роликов ещё нет.
  • Reddit, X, Bluesky, Lemmy и другие платформы на этом этапе не исследовались.

Bluesky

Bluesky — сегодняшние новости, связанные с LLM (2026-09-25)

Аккаунты
  • TestingCatalog (@testingcatalog.com) — оперативный аккаунт, который быстро отслеживает утечки, новые функции и новые модели ИИ-продуктов. На него приходится половина публикаций в этой подборке.
  • Simon Willison (@simonwillison.net) — известный практик LLM и блогер. Его характерный формат — сравнивать новые модели на собственном бенчмарке с рисунком пеликана.
  • Epoch AI (@epochai.bsky.social) — исследовательская организация, количественно анализирующая стоимость обучения ИИ и динамику вычислений.
  • Nathan Lambert (@natolambert.bsky.social) — сотрудник Ai2 и автор interconnects.ai. Хорошо разбирается в противостоянии открытых весов и закрытых моделей.
  • antirez / Salvatore Sanfilippo (@antirez.bsky.social) — создатель Redis. Регулярно публикует проверки работы моделей с открытыми весами на Mac/DGX Spark с собственным высокоскоростным инструментом инференса «DwarfStar».
  • ModelVantage (@modelvantage.bsky.social) — бот, автоматически отслеживающий задержки и сбои API Gemini, Claude и других сервисов.
  • Таблица лидеров LLM для разработчиков (@devllmlb-ja.bsky.social) — японоязычный аккаунт, ежемесячно публикующий результаты бенчмарков; однако последняя публикация датирована 2026-09-01 и уже несколько устарела.
Посты
  1. OpenAI предварительно анонсировала выпуск GPT-6 Sol / Luna сегодня — «OpenAI prepares to launch GPT-6 Sol and Luna models today»
    TestingCatalog, 2026-09-22, 👍1 🔁1
    https://bsky.app/profile/testingcatalog.com/post/3mw46urvt432w

  2. Утечка: Google тестирует новые чекпойнты Gemini 4 Pro — «Google tests new Gemini 4 Pro checkpoints, early outputs»
    TestingCatalog, 2026-09-23, 👍2
    https://bsky.app/profile/testingcatalog.com/post/3mw6b5f3opi2j

  3. Xiaomi открыла исходный код омнимодальных моделей MiMo-V2.6 Pro/Flash(поддерживаются программирование, зрение и управление компьютером)
    TestingCatalog, 2026-09-21, 👍2 🔁1
    https://bsky.app/profile/testingcatalog.com/post/3mw2tpiskxh2w

  4. SpaceXAI выпустила Grok 4.7 для программирования и работы со знаниями
    TestingCatalog, 2026-09-21
    https://bsky.app/profile/testingcatalog.com/post/3mw2rdziawn2s

  5. Anthropic тестирует Fable 5.2 и Opus 5.5 до релиза
    TestingCatalog, 2026-09-21, 👍1
    https://bsky.app/profile/testingcatalog.com/post/3mvzd4w227422

  6. Simon Willison одновременно сравнил Claude Opus 5.5, GPT-6 Sol и GPT-6 Luna — «Big model release today - I wrote about Claude Opus 5.5, GPT-6 Sol, and GPT-6 Luna - plus comparison grids of pelicans by the different model families at different reasoning levels»
    2026-09-22, 👍123 🔁10
    https://bsky.app/profile/simonwillison.net/post/3mw5g6izoms2n

  7. Simon Willison проверил чрезвычайно низкие цены TTS-моделей Gemini 3.8 — «The new Gemini 3.8 TTS models are super-cheap and can generate conversations between multiple voices...»; по его расчёту, менее одного цента за минуту
    2026-09-23, 👍77 🔁7
    https://bsky.app/profile/simonwillison.net/post/3mw7magyrwc2i

  8. Epoch AI: «Стоимость ИИ падает примерно на 47% каждый квартал — быстрее, чем при любых других технологических инновациях»
    2026-09-22, 👍123 🔁30
    https://bsky.app/profile/epochai.bsky.social/post/3mw567kluom2h

  9. Epoch AI: «GPT-5.6 Luna воспроизводит достигнутый o3 уровень на FrontierMath за 1/377 стоимости»($0.55→$0.0015, в 377 раз за 18 месяцев)
    2026-09-22, 👍12
    https://bsky.app/profile/epochai.bsky.social/post/3mw567lpe7s2l

  10. Nathan Lambert рассказал сотрудникам Конгресса о состоянии открытых моделей и конкурентоспособности в соперничестве с Китаем(ссылка на брифинг interconnects.ai)
    2026-09-21, 👍31 🔁6
    https://bsky.app/profile/natolambert.bsky.social/post/3mvzo2lneqg2j

  11. Он же отметил, что ведущие китайские ИИ-лаборатории начинают использовать Huawei для инференса, а Nvidia для обучения, указывая на разделение аппаратных стратегий
    2026-09-20, 👍18
    https://bsky.app/profile/natolambert.bsky.social/post/3mvxajmx5cz2n

  12. antirez добавил поддержку Qwen3.8 Flash Next в локальный инструмент инференса «DwarfStar»(50–70 t/s на Mac с 64 ГБ, prefill свыше 1400 t/s)
    2026-09-14, 👍76 🔁8
    https://bsky.app/profile/antirez.bsky.social/post/3mvi75e3c722o

Сигналы
  • В центре недели — волна новых закрытых моделей: GPT-6 Sol/Luna, Claude Opus 5.5 и Fable 5.2, утечки и тестирование Gemini 4 Pro сконцентрировались в одной неделе. Для Bluesky характерна скорость реакции: практики вроде Simon Willison немедленно публикуют параллельное сравнение моделей, например на бенчмарке рисования пеликана.
  • «Обвал стоимости рассуждений» обсуждается с количественными данными: показатели Epoch AI — снижение на 47% за квартал и в 377 раз для FrontierMath — распространяются с более строгими ссылками на цифры, чем на других платформах. Пост с 👍123 и 🔁30 получил наибольшую реакцию в этом исследовании.
  • Лагерь открытых весов сосредоточен на отчётах о локальном запуске: antirez продолжает тестировать Qwen3.8 Flash Next и DeepSeek v4.1 Flash на собственных Mac/DGX Spark, а открытие исходного кода Xiaomi MiMo-V2.6 также было оперативно отмечено. Но пост TestingCatalog о Xiaomi (👍2) получил намного меньше реакции, чем пост Simon Willison (👍123), что говорит о большей заметности новых релизов закрытых моделей в Bluesky.
  • Nathan Lambert задаёт геополитическую рамку «закрытые против открытых»: его замечание о том, что китайские игроки разделяют Huawei для инференса и Nvidia для обучения, предлагает иной угол зрения по сравнению с обсуждениями, сосредоточенными на технических бенчмарках.
  • Существуют и API-боты наблюдения, такие как ModelVantage, но недавние события — например, сбой Gemini 3.1 Pro 14–15 сентября с 100% ошибками на несколько минут в US-East — не являются темой сегодняшнего дня и почти не вызвали реакции: 0 лайков.
Ограничения
  • Официальный поисковый API (app.bsky.feed.searchPosts) последовательно возвращал 403 Forbidden из среды этого исследования, поэтому прямой поиск по ключевым словам был невозможен(то же происходило при прямом доступе и через два CORS-прокси). Другие конечные точки API — getProfile, getAuthorFeed, getPostThread — работали нормально, поэтому, вероятнее всего, заблокирован именно поисковый endpoint.
  • Из-за этого вместо поиска по ключевым словам сбор строился по схеме «определить вероятно релевантные аккаунты → прочитать их ленты». Следовательно, публикации неупомянутых индивидуальных и небольших аккаунтов могли быть пропущены.
  • Сами страницы поиска и постов bsky.app являются SPA с клиентским рендерингом, поэтому WebFetch не извлекал текст публикаций — только заголовок «Bluesky». Все ссылки подтверждены через API, но визуально в браузере посты не проверялись.
  • Автопостинговые боты, такие как ai-news-jp.bsky.social, перестали публиковать материалы в июле 2025 года и не могли использоваться для сегодняшней темы; они исключены и из раздела Accounts.
  • Содержания, опубликованного непосредственно 2026-09-25, не найдено. В Posts вошли главным образом недавние публикации от 2026-09-20 до 2026-09-23 — о GPT-6 Sol/Luna, Opus 5.5, Gemini 4 Pro и других всё ещё центральных новостях. Собрать 10 материалов строго за текущую дату не удалось.
  • У японоязычных аккаунтов, включая devllmlb-ja.bsky.social, на этой неделе не было публикаций; складывается впечатление, что обсуждение LLM в японском сегменте Bluesky слабее, чем среди англоязычных аккаунтов.

Lemmy

Lemmy — самая обсуждаемая тема дня: резкое падение доли закрытых моделей и интерес к Opus 5.5 / локальным моделям

Сообщества
  • !«メールアドレス» — 88,221 участник. Общий технологический раздел, куда попадают новости LLM. Основной источник публикаций о Gemini.
  • !«メールアドレス»(также зеркалируется на sh.itjust.works, ID 330)— 5,172 участника. В основном технические посты о новых релизах моделей с открытыми весами, бенчмарках и llama.cpp.
  • !ai_reddit — сообщество с репостами из r/ClaudeCode и r/ArtificialInteligence. Число подписчиков на lemmy.world получить не удалось: прямое подтверждение невозможно из-за ошибок 404/500, см. Limits ниже. Здесь сосредоточены треды об Opus 5.5.
  • !hackernews — зеркало популярных материалов Hacker News. Вверху находятся примеры применения LLM: исторические исследования и исследования деанонимизации.
  • !«メールアドレス» — сообщество разработки самого Lemmy. Обсуждается создание правил раскрытия использования AI/LLM.
  • !selfhosted — сообщество самостоятельного хостинга. Здесь активно обсуждается определение open-source LLM в споре о K2 Horizons.
  • !blueteamsec / !lobsters — репосты исследований, связанных с LLM, в области безопасности и технологий.
Посты
  1. Closed Models Fell From 70% to 21.6% Market Share in 3 Months — !tecnologia, оценка 1, 2026-09-24 05:00
    https://officechai.com/ai/share-of-closed-models-has-fallen-from-around-70-to-21-in-the-last-3-months-vercel-data/
    Статья на основе данных Vercel утверждает, что доля использования закрытых моделей всего за три месяца резко упала с 70% до 21,6%. Это показательный сюжет для сегодняшнего противостояния закрытых моделей и открытых весов.

  2. New Opus is absolutely bonkers — !ai_reddit(оригинал: r/ClaudeCode), оценка 0, 2026-09-24 20:01
    https://www.reddit.com/r/ClaudeCode/comments/1wp1q8n/new_opus_is_absolutely_bonkers/
    Тред, в котором новую Opus от Anthropic называют «совершенно невероятной».

  3. Is Opus 5.5 really better than Fable in your experience? — !ai_reddit(оригинал: r/ClaudeCode), оценка 0, 2026-09-24 02:50
    https://www.reddit.com/r/ClaudeCode/comments/1woe3lo/is_opus_55_really_better_than_fable_in_your/
    Дискуссия о сравнении Opus 5.5 и Fable по бенчмаркам и реальному пользовательскому опыту.

  4. I A/B tested Opus 5 vs Opus 5.5 for AI slop: 98 em dashes vs 0 — !ai_reddit(оригинал: r/ClaudeCode), оценка 1, 2026-09-23 07:45
    https://www.reddit.com/r/ClaudeCode/comments/1wnwqcs/i_ab_tested_opus_5_vs_opus_55_for_ai_slop_98_em/
    A/B-тест качества вывода Opus 5 и Opus 5.5; сообщается, что «ИИ-подобность» текста, например чрезмерное использование длинных тире, существенно снизилась.

  5. llama.cpp v0.5.0 — !LocalLLaMA, оценка 23・комментариев 0, 2026-09-24 16:18
    https://github.com/ggml-org/llama.cpp/releases/tag/v0.5.0
    Выпущена новая версия с поддержкой нескольких новых архитектур, включая Qwen4Exp.

  6. New medical model: FreedomIntelligence/HuatuoGPT-3-27B — !LocalLLaMA, оценка 7・комментариев 1, 2026-09-24 16:52
    https://huggingface.co/FreedomIntelligence/HuatuoGPT-3-27B
    Медицинская модель с открытыми весами на базе Qwen3.8-27B, созданная с помощью One-stage Policy Optimization без supervised fine-tuning.

  7. Qwen4-27B just confirmed — !LocalLLaMA, оценка 34・комментариев 5, 2026-09-22 22:45
    https://lemmy.ml/post/53074988
    Тред с официальным подтверждением релиза Qwen4-27B. Хотя с анонса прошло три дня, модель продолжает упоминаться как одна из главных тем недели среди открытых весов.

  8. Google introduce "Call for Me" sui Pixel 11 per affidare le telefonate a Gemini — !tecnologia, оценка 1, 2026-09-24 18:17
    https://www.theverge.com/ai-artificial-intelligence/1000116/google-gemini-business-phone-calls
    Google представила для Pixel 11 функцию «Call for Me», в которой Gemini отвечает на телефонные звонки от имени пользователя.

  9. Google invented the Transformer, so why does using Gemini still feel like a chore? — !ai_reddit(оригинал: r/ArtificialInteligence), оценка 1, 2026-09-24 08:35
    https://www.reddit.com/r/ArtificialInteligence/comments/1wovzal/google_invented_the_transformer_so_why_does_using/
    Критический пост с вопросом: почему Google, создавшая Transformer, продолжает уступать более гибким открытым моделям вроде DeepSeek и Qwen.

  10. Using LLMs to trace alchemical knowledge and decode 17th century letters — !hackernews, оценка 7, 2026-09-24 20:00
    https://lemmy.bestiver.se/post/1359598
    Пример исторического исследования: GPT-6 и Opus 5.5 используются для расшифровки алхимических писем XVII века.

  11. Large-scale online deanonymization with LLMs — !blueteamsec, оценка 6, 2026-09-24 19:23
    https://infosec.pub/post/52730942
    Исследование утверждает, что LLM позволяют с высокой точностью повторно идентифицировать пользователей Hacker News и участников Anthropic Interviewer: до 68% полноты при 90% точности. Привлекает внимание как пример рисков и инцидентов, связанных с LLM.

  12. Is K2 Horizons historically significant as the first actual open-source LLM, or am I falling for hype? — !Selfhosted, оценка 48(за)/10(против)・комментариев 20, 5 дней назад(примерно 2026-09-20)
    https://lemmy.zip/post/... (зеркало lemmy.world: https://lemmy.world/post/52135351)
    Спор о том, можно ли назвать K2 Horizons «первой настоящей open-source LLM». Многие возражают, ссылаясь на более ранние GPT-Neo, OPT и BLOOM, а также указывают, что данные обучения не раскрыты.

Сигналы
  • Закрытые модели против открытых весов: самым показательным сюжетом дня стала статья о падении рыночной доли закрытых моделей с 70% до 21,6% за три месяца (пост 2). В общей атмосфере Lemmy также заметна сильная позиция в пользу открытых весов: хвалят успехи DeepSeek/Qwen, насмехаются над медлительностью Google (пост 9), обсуждают новые модели Qwen4-27B и HuatuoGPT-3-27B (посты 6, 7).
  • Anthropic Opus 5.5: в !ai_reddit, зеркалирующем r/ClaudeCode, параллельно идут несколько тредов об Opus 5.5 (посты 2, 3, 4). Обсуждаются и качество — например сокращение числа длинных тире, — и результаты бенчмарков.
  • Инциденты и риски LLM: в кластере Lobsters/blueteamsec встречаются технические публикации о безопасности и предотвращении злоупотреблений, включая исследование деанонимизации (пост 11) и технологии водяных знаков в vLLM.
  • Практическое развёртывание: присутствуют и новости не о самих моделях, а о продуктовой интеграции — например, Google Gemini «Call for Me», функция ответов на звонки в Pixel 11 (пост 8).
Ограничения
  • Сообщества Lemmy невелики, и надёжно новых LLM-тредов только за текущий день не набралось десять. Чтобы получить 12 материалов, в список включены пятидневная дискуссия о K2 Horizons (пост 12) и трёхдневная публикация о Qwen4-27B (пост 7) как темы, на которые продолжают ссылаться в течение недели.
  • Число подписчиков сообщества !ai_reddit получить не удалось: lemmy.world/api/v3/community?name=ai_reddit возвращал 404, а lemmy.world/c/ai_reddit — 500. Возможно, домашний инстанс находится в другом месте, но определить его не удалось.
  • Оригинальные публикации на reddit.com (www.reddit.com/r/ClaudeCode/...) были заблокированы для прямого доступа через WebFetch, поэтому содержание резюмировалось только по названиям, оценкам и времени зеркальных постов Lemmy. Детали текста исходных тредов проверить не удалось.
  • Поиск по другим инстансам, таким как lemmy.ml и lemm.ee, не проводился полностью. Вместо этого использовались API-поиск в lemmy.world и запросы к API отдельных инстансов, например sh.itjust.works.

Рекомендуемые действия

  • В следующем исследовании Reddit добавить в поисковые запросы конкретные названия моделей: «Opus 5.5», «GPT-6 Sol», «GPT-6 Luna».
  • Проверять по первичным данным цифру Vercel о падении доли рынка закрытых моделей с 70% до 21,6%, прежде чем её цитировать.
  • Продолжать отслеживать инициативу Frontier AI Standards Agency (SAFA) в печатных медиа, компенсируя запаздывание её видимости в социальных сетях.
  • Рассмотреть отдельный трекер для научных результатов биолаборатории Anthropic в следующих выпусках.
  • Дополнить исследование X поисковыми запросами к англоязычным первичным источникам, чтобы уравновесить смещение в сторону практических отчётов японских авторов.
  • В начале следующего исследования проверить, устранена ли ошибка 403 у официального поискового API Bluesky.

Примечание о качестве данных

Reddit и Lemmy выполнили критерий завершения в 10 материалов, но X остановился на восьми, поскольку большинство поисковых запросов были нерелевантны. В Bluesky из-за ошибки 403 поискового API пришлось перейти к альтернативному сбору по аккаунтам, и публикаций непосредственно за текущую дату получить не удалось. На YouTube из-за ограничений рендеринга не удалось собрать точные просмотры и число подписчиков.