KEN’S CAT LOG

Daily LLM News — 2026-09-11

Споры о безопасности вокруг заявлений исследователей ИИ об уходе из отрасли и риске вымирания независимо стали главной темой дня на Reddit, Bluesky и Lemmy, в то время как модели с открытыми весами — DeepSeek V4.1-Flash и GLM-5.3 — обновляют бенчмарки и быстро приближаются к GPT-6 Astra.

Daily LLM News — 11 сентября 2026 года

Общая картина в соцсетях сегодня показывает, что главным сюжетом дня стали не громкие заявления о возможностях новых моделей, а «недоверие к безопасности». Споры вокруг ухода из отрасли и заявлений об экзистенциальном риске со стороны исследователя Anthropic одновременно вспыхнули на Reddit, Bluesky и Lemmy; вместе с подозрениями в плагиате, связанными с «задачей тысячелетия» OpenAI, они формируют подспудный скепсис по отношению к закрытым моделям. Тем временем модели с открытыми весами одна за другой переписывают бенчмарки: DeepSeek V4.1-Flash, GLM-5.3 и Qwen 3.8 Max. Этот тренд независимо подтверждают YouTube, Bluesky (рубрика Nathan Lambert «Latest open artifacts») и пользователи локального запуска на Lemmy. Только X почти не дал новостей об LLM из-за неудачной стратегии поиска: результаты утонули в политических и развлекательных трендах.

Across platforms

  • «Уход из отрасли из соображений безопасности и заявления о риске вымирания» независимо стали крупнейшей темой на трёх платформах. Reddit (r/ArtificialInteligence, сообщение об уходе исследователя Anthropic Jacob Coxon, хотя реакция была прохладной), Bluesky (тему одновременно подхватили Nathan Lambert, Emily Bender и Gary Marcus, упомянув оценку риска вымирания в 10%) и Lemmy (самый рейтинговый пост, score 61, в сообществе !fuck_ai) обсуждают безопасность вокруг одного и того же события — но из разных идеологических позиций.
  • Недоверие к компаниям с закрытыми моделями и критика «регуляторного захвата» проходят через все платформы. Reddit (резкая реакция r/LocalLLaMA на статью WSJ против открытых весов, комментарий с 556pt поддержки) и X (саркастический пост @johnennis о том, что Anthropic якобы необходимо отдать регуляторскую монополию) независимо воспроизводят одну и ту же историю: «закрытые компании используют регулирование как щит для защиты привилегий».
  • Силу моделей с открытыми весами подтверждают YouTube, Bluesky и Lemmy с трёх разных сторон. GLM-5.3 (видео с бенчмарками на YouTube и «Latest open artifacts» Nathan Lambert на Bluesky), а также модели семейства Qwen (Qwen 3.8 Max на YouTube и ветки о локальном квантовании на Lemmy) появляются во всех источниках. Разные ракурсы подтверждают одно явление: открытые модели с возможностями фронтирного уровня обновляются буквально каждые несколько дней.
  • Анонсы OpenAI, связанные с Navier–Stokes («задачей тысячелетия»), воспринимаются скептически. Об этом говорят и Reddit (обсуждение как возможного плагиата, 187pt), и Bluesky (отчёт Simon Willison о реализации с 283 лайками, а также критика научной коммуникации от Emily Bender), однако сомнения преобладают над похвалой.

Platform by platform

Reddit: По запросу «Daily LLM News» было собрано 12 веток из 10 subreddit. Главными сюжетами дня стали подозрения в плагиате вокруг математического открытия OpenAI (r/singularity, 187pt) и крайне негативная реакция на статью WSJ против открытых весов (r/LocalLLaMA, 512pt). Реакция на сообщение об уходе исследователя Anthropic из отрасли была холодной и ироничной. https://www.reddit.com/r/singularity/comments/1wcnyay/https://www.reddit.com/r/LocalLLaMA/comments/1wa9309/

X: Из 40 собранных публикаций к новостям LLM относились лишь 4, найденные по запросу «Anthropic». Остальные 9 запросов просто повторяли тренды Explore (новые продукты Apple, Charlie Kirk, MAGA и другие политические или развлекательные темы), поэтому стратегия поиска LLM-новостей оказалась недостаточной. Единственной конкретной продуктовой новостью стал пост @claudecode84 об открытии исходного кода окружения Claude Code руководителем Anthropic. https://x.com/claudecode84/status/2097959830942367747

YouTube: Главной темой стало то, что GPT-6 Astra первой достигла уровня Critical в киберкатегории Preparedness Framework. Среди моделей с открытыми весами DeepSeek V4.1-Flash (релиз 10 сентября, 200 TPS, потенциально превосходит Astra) стала самой свежей и новой новостью; также продолжают выходить бенчмарк-видео о GLM-5.3 и Qwen 3.8 Max. Поскольку страницы видео рендерятся JavaScript, часть данных о просмотрах и подписчиках не подтверждена. https://www.youtube.com/watch?v=qRNZMGc7TMchttps://www.youtube.com/watch?v=lpC5X6o3VJE

Bluesky: Публичный API поиска (searchPosts) возвращал 403, поэтому вместо него напрямую читались ленты известных аккаунтов: Simon Willison, Nathan Lambert, Emily Bender и Gary Marcus. Самое важное наблюдение — скандал вокруг «ухода из отрасли из соображений безопасности» оказался общей верхней публикацией у всех них. Также удалось собрать отчёты о практическом использовании GPT-6 Astra (Simon Willison) и обзор лицензионных тенденций в открытых весах (Nathan Lambert). https://bsky.app/profile/natolambert.bsky.social/post/3mv6f35gkqt2l

Lemmy: В одном сообществе не удалось найти 10 публикаций, поэтому сбор охватил несколько федеративных инстансов, включая sh.itjust.works, piefed.world, infosec.pub и lemmus.org. У открытых весов преобладали практические темы локального запуска — квантование и сокращение требуемой VRAM (например, запуск Qwen 3.8 27B на GPU с 8GB). У закрытых моделей обсуждались подозрения в незаконной передаче промптов DeepSeek/Moonshot и заявление исследователя Anthropic о риске вымирания (score 61, максимальный результат в этой выборке). https://lemmus.org/post/25299580

Бренд инвестировал только в эти пять платформ; другие социальные сети, не перечисленные здесь (например, Threads или TikTok), не входили в исследование, и их отсутствие не означает пропуск данных.

What to watch

  • Превзойдёт ли DeepSeek V4.1-Flash GPT-6 Astra — уже на следующий день после релиза на YouTube появились проверочные видео с заявлением «лучше Astra». https://www.youtube.com/watch?v=lpC5X6o3VJE
  • Продолжение истории о заявлениях исследователя ИИ о риске вымирания и уходе из отрасли — развитие спора о безопасности, который разгорелся и на Bluesky (Nathan Lambert), и на Lemmy (!fuck_ai). https://bsky.app/profile/natolambert.bsky.social/post/3mv6f35gkqt2l
  • Достоверность подозрений в плагиате OpenAI в связи с Navier–Stokes — дискуссия продолжается в Reddit r/singularity; стоит отслеживать, последует ли официальный ответ. https://www.reddit.com/r/singularity/comments/1wcnyay/
  • Достоверность «Mythos 5» и тестового доступа ENISA — это подтверждается лишь одним постом на Lemmy и требует проверки по первоисточникам. https://infosec.pub/post/52133063
  • Подозрения в незаконной передаче промптов Claude со стороны DeepSeek/Moonshot — Lemmy; необходимо следить за продолжением истории о зависимости от закрытых моделей или проникновении в них. https://piefed.world/c/tech/p/1393607/chinese-labs-deepseek-and-moonshot-were-quietly-relaying-customer-prompts-to-claude-thro
  • Рост качества GLM-5.3 только за счёт постобучения — тема упоминается и на YouTube, и на Bluesky; стоит наблюдать, распространится ли подобный подход на другие открытые модели. https://www.youtube.com/watch?v=iMpBNN-0-Ss

Recommendations

  • В следующем сборе по X следует отказаться от повторения трендов Explore и заново выстроить запросы вокруг непосредственно релевантных тем: «названия новых моделей», «открытые веса», «цены API» и т. п.
  • В следующем цикле исследований приоритетно проверить по официальным заявлениям и первичным источникам подозрения в плагиате OpenAI по Navier–Stokes и заявления исследователя Anthropic о риске вымирания.
  • До появления независимой сторонней оценки следует считать бенчмарк-заявления DeepSeek V4.1-Flash и GLM-5.3 лишь заявлениями, а не установленными фактами.
  • Информацию из единственного источника — включая «Mythos 5» на Lemmy и подозрения в незаконной передаче промптов DeepSeek/Moonshot — следует продолжать проверять по первичным источникам.
  • В следующем цикле проверить, устранена ли ошибка 403 в поисковом API Bluesky, чтобы вернуться от зависимости от известных аккаунтов к полноценному поиску по ключевым словам.
  • Учитывая, что на Reddit и X независимо воспроизводится сюжет «закрытые компании = регуляторный захват», следует постоянно отслеживать официальные заявления Anthropic и OpenAI о регулировании.

Data quality

На четырёх платформах — Reddit, YouTube, Bluesky и Lemmy — при ограничениях методов поиска и сбора (403 у поискового API Bluesky, JS-рендеринг YouTube, недостаточный размер одного сообщества Lemmy) всё же были получены независимые содержательные выводы. Только X оказался проблемным: поисковые запросы не соответствовали теме (9 из 10 слов были нерелевантными трендами Explore), и при целевом критерии «10 публикаций» значимыми LLM-новостями оказались лишь 4. Также следует учитывать, что на дату запроса (2026-09-11) публикаций было немного: большая часть информации относится к 7–10 сентября.

Сводка по платформам

Reddit

Reddit — Daily LLM News

Где

Разбивка 12 веток из 10 subreddit, найденных по запросу «Daily LLM News».

Subreddit Число участников Собрано веток
r/NoStupidQuestions 7,478,724 2
r/singularity 3,969,435 2
r/ArtificialInteligence 1,923,877 1
r/artificial 1,336,151 1
r/LocalLLaMA 821,351 1
r/WritingWithAI 164,927 1
r/SillyTavernAI 128,004 1
r/Artificials 3,785 1
r/Maxcactus_TrailGuide 5,149 1
r/AIdaily_news 1,818 1

Четыре ветки приходятся на два огромных универсальных subreddit, не специализирующихся на LLM: r/NoStupidQuestions и r/singularity. Это показывает, что темы LLM широко проникли в аудиторию обычных пользователей. В то же время сообщества локальных LLM и ролевых игр, такие как r/LocalLLaMA и r/SillyTavernAI, сегодня также активно реагируют на внешние новости — в частности, на «подозрения в плагиате» и «регулирование».

Что говорят люди
  • Подозрения в плагиате вокруг математического открытия OpenAI — самая горячая тема дня. В ветке 6 r/singularity «Big news is that OpenAI is nearing solving another millennium prize...» (187 points, 55 comments, 2026-09-10, https://www.reddit.com/r/singularity/comments/1wcnyay/) предметом спора стало заявление OpenAI, что она приблизилась к решению задачи тысячелетия — уравнений Навье—Стокса — и при этом якобы не «заимствовала» результаты математиков Buckmaster и других через Codex. u/FateOfMuffins (52pt) предположил, что это может указывать на дату отсечения данных последних масштабных обучений — 3 июля.
  • Та же тема дошла до ветки 12 r/SillyTavernAI «Due to OpenAI stealing mathematical proofs, local LLM are now crucial more than ever» (30 points, 47 comments, 2026-09-10, https://www.reddit.com/r/SillyTavernAI/comments/1wclha4/), где звучала мысль, что в случае плагиата локальные LLM становятся ещё важнее. Однако верхний комментарий u/Original-League-6094 (30pt) возражает: даже если плагиат подтвердится, этот вывод сам по себе не следует из фактов. Мнения разделились.
  • Статья WSJ с критикой открытых весов ИИ вызвала почти скандальную реакцию. Ветка 9 r/LocalLLaMA «WSJ: Unregulated Open-Weight AI Is an Invitation to Disaster» (512 points, 232 comments, 2026-09-08, https://www.reddit.com/r/LocalLLaMA/comments/1wa9309/) получила самый высокий балл. Автор назвал статью «прозрачной пропагандой», а верхний комментарий u/3169676 (556pt) саркастически заметил, что «задавать вопросы регулируемому ИИ должны иметь право только богатые миллиардеры». u/UNaMean (222pt) защищал открытые веса через аналогию с оружием: проблема в злоупотребляющем человеке, а не в инструменте.
  • На новость об «уходе из отрасли» исследователя Anthropic отреагировали холодно. В ветке 4 r/ArtificialInteligence «Biggest news in AI world today» (0 points, 31 comments, 2026-09-09, https://www.reddit.com/r/ArtificialInteligence/comments/1wbu9c6/) обсуждалось, что исследователь Anthropic Jacob Coxon ушёл из отрасли, опасаясь гонки по разработке неконтролируемых систем. u/MiloGoesToTheFatFarm (14pt) отмахнулся, назвав его лишь оператором ввода данных, а не разработчиком модели; u/presentofai (2pt) съязвил, что публикации о «увольнении из соображений безопасности» похожи на резюме для будущего стартапа по безопасности.
  • Недоверие к Anthropic выплеснулось и в r/AIdaily_news. В ветке 7 «Wait… what is going on?» (5 points, 14 comments, 2026-09-10, https://www.reddit.com/r/AIdaily_news/comments/1wcri4x/) после опыта отказа в запросе, связанном с генетическими исследованиями, u/Dogbold (2pt) написал, что это «ещё одна ложь Anthropic, которая просто пытается добиться запрета ИИ».
  • Спор о достижении AGI по-прежнему зашёл в тупик. В ветке 3 r/artificial «What will LLMs never do?» (67 points, 218 comments, 2026-09-06, https://www.reddit.com/r/artificial/comments/1w8m8rw/) автор утверждал, что, судя по релизу Astra, AGI может появиться в течение 12–18 месяцев. В ответ u/danderzei (62pt) скептически заявил, что LLM — лишь предсказатели следующего токена, а всё остальное является эмерджентным свойством. Комментарий u/presentofai (10pt), что модель не способна «надёжно знать, что ошибается», собрал много одобрения.
  • Спор «LLM не может стать умнее Redditor» тоже оказался популярной веткой с 268 баллами. Ветка 5 r/singularity (268 points, 158 comments, 2026-09-09, https://www.reddit.com/r/singularity/comments/1wbnhgt/) превратилась в обмен сарказмом с AGI-скептиками. u/oilybolognese (199pt) контраргументировал: люди с большей уверенностью говорят ошибочные вещи, поэтому именно человеческий мозг якобы не может быть естественным общим интеллектом.
  • Наивный вопрос о том, как предсказание следующего токена может решать нерешённые математические задачи, вызвал большой отклик в r/NoStupidQuestions. В ветке 2 (295 points, 164 comments, 2026-09-10, https://www.reddit.com/r/NoStupidQuestions/comments/1wcsbr2/) самый поддержанный комментарий u/Time_Entertainer_319 (1,206pt) дал длинное объяснение связи между предсказанием и структурой языка, начиная с теории информации Claude Shannon — типичная образовательная ветка Reddit.
  • В ветке о поиске бесплатной LLM для письма проявилось недовольство привычной тройкой лидеров. В ветке 8 r/WritingWithAI (13 points, 12 comments, 2026-09-10, https://www.reddit.com/r/WritingWithAI/comments/1wcunsz/) автор жалуется, что GPT Sol слишком жёсткий, Claude Sonnet слишком сильно ограничен лимитами, а Gemini недостаточно умён. В комментариях u/VerdantMagnolia (2pt) и u/Round_Ad_5832 (1pt) предлагают попробовать Kimi или DeepSeek.
  • Высказывание учёного «LLM — это когнитивный вирус» получило максимальный score (1,346pt). Ветка 11 r/Maxcactus_TrailGuide (1,346 points, 133 comments, 2026-09-09, https://www.reddit.com/r/Maxcactus_TrailGuide/comments/1wbi2d7/) стала самой рейтинговой в выборке, несмотря на нишевость subreddit. u/TurgorFervor (25pt) прокомментировал: «Религия тоже вирус. Вакцина — только критическое мышление».
Сигналы
  • Восходящий тренд: тема недоверия к тому, что компании без разрешения обучают модели на творческих работах и результатах исследований пользователей, одновременно всплывает в двух разных контекстах: математическое открытие OpenAI (ветки 6 и 12) и отказ Anthropic в генетическом исследовании (ветка 7). Сегодня скепсис и сарказм в отношении закрытых ИИ-компаний стали общим подспудным мотивом.
  • Переворот скепсиса: на привычный тезис «LLM — всего лишь предсказатель следующего токена» (ветки 2, 3 и 5) верхние комментарии сегодня в основном отвечают защитной аргументацией: предсказание неотделимо связано с мышлением, а само понятие creativity относительно. Это указывает, что настроения Reddit сдвигаются к «скепсису по отношению к скепсису об LLM».
  • Недооценённая / высмеиваемая тема: сообщение об «уходе исследователя Anthropic из соображений безопасности» (ветка 4) набрало крайне низкие 0 баллов, а в комментариях сарказм преобладал над сочувствием. На Reddit сенсационные заголовки, похоже, часто получают обратную реакцию и воспринимаются менее серьёзно.
  • Пара с наиболее заметным конфликтом мнений: если сопоставить ветку 9 (резкая реакция r/LocalLLaMA на статью WSJ против открытых весов, верхний комментарий с 556pt) с обратной стороной — ветками 7 и 12 (недоверие к закрытым компаниям вроде Anthropic и OpenAI), становится видно единое повествование Reddit: «закрытые компании = привилегированный класс, использующий регулирование для устранения конкурентов».
Ограничения
  • Использовался лишь один общий поисковый запрос — «Daily LLM News»; поиск несколькими запросами по отдельным темам, например анонсам моделей, изменениям цен API или бенчмаркам, не проводился. Поэтому в выборку не вошли ветки о конкретных новых моделях или изменениях API, опубликованных сегодня; вместо этого она смещена в сторону дискуссионных тем — AGI, подозрений в плагиате и регулирования.
  • Даты 12 собранных веток находятся в диапазоне 2026-09-06–2026-09-10; ни одна не датирована самим днём запроса, 2026-09-11.
  • r/AIdaily_news (1,818 участников), r/Artificials (3,785 участников) и r/Maxcactus_TrailGuide — очень небольшие нишевые или имитационные subreddit. Их нельзя считать столь же репрезентативными, как r/singularity или r/LocalLLaMA.
  • Для каждой ветки отображались только шесть верхних комментариев; все комментарии целиком (до 232) не изучались.

X

X — Daily LLM News

После проверки ранее собранного output/x.posts.md (40 публикаций от 39 аккаунтов, 10 видов поисковых запросов) выяснилось, что к LLM-новостям — новым моделям, открытым весам, API/ценам, бенчмаркам, заметным сценариям использования и действиям компаний — относились только 4 публикации, найденные по Anthropic. Остальные 9 запросов (Apple, Charlie Kirk, MAGA, iPhone Duo, Palestinian, Britain, #CyberSecurity, Harvey as the AI OS, The OS) просто повторяли тренды X Explore; в них преобладали политика, развлечения и сплетни, не связанные с LLM.

Аккаунты
  • @restitutorII(Restitutor Orientis) — 1 публикация, 426 лайков. Единичная пояснительная ветка, пересказывающая и распространяющая отчёт Anthropic об экономических сценариях.
  • @walterkirn(Walter Kirn) — 1 публикация, 522 лайка. Известный как писатель/журналист аккаунт, разместивший одиночный скептический комментарий о заметной фигуре ИИ-индустрии.
  • @johnennis(John Ennis) — 1 публикация, 992 лайка. Называет себя «бывшим сотрудником Anthropic» и публикует сатиру о регуляторских преимуществах Anthropic — регуляторном захвате.
  • @claudecode84(Claude code研究ラボ) — 1 публикация, 1,127 лайков, около 175,000 просмотров. Японский аккаунт о Claude Code; единственная конкретная продуктовая новость в этой выборке.

Все эти аккаунты представлены только одной публикацией и больше похожи не на профильных инфлюенсеров, постоянно освещающих конкретную тему, а на обычных пользователей или малые/средние аккаунты, которые разово стали вирусными.

Публикации
  1. @claudecode84(1,127 likes・129 reposts・15 replies・около 175,000 views・2026-09-10)
    https://x.com/claudecode84/status/2097959830942367747

    Сам руководитель Anthropic целиком открывает исходный код своего «окружения Claude Code»
    Единственная публикация из собранных, относящаяся к конкретному анонсу продукта. В ней утверждается, что руководитель Anthropic (детали должности в самой публикации не указаны) опубликовал весь свой набор окружения Claude Code; новость подхватил японский ИИ-аккаунт.

  2. @restitutorII(426 likes・67 reposts・39 replies・около 49,000 views・2026-09-10)
    https://x.com/restitutorII/status/2097918742571139093

    Anthropic в своём отчёте представляет 3 возможных будущих сценария для американской экономики в 2030 году в зависимости от мощности и внедрения ИИ: 1 — умеренный сценарий: влияние ИИ сопоставимо с интернетом. ВВП +1,6%, мало потрясений на рынке труда. 2 — существенный сценарий: ИИ может выполнять около...
    Ветка представляет отчёт Anthropic о сценариях для экономики США в 2030 году — несколько вариантов, включая Modest/Substantial/… и влияние на ВВП. Текст в публикации обрывается, и прямой ссылки на исходный отчёт в нём не видно.

  3. @johnennis(992 likes・86 reposts・49 replies・около 32,000 views・2026-09-10)
    https://x.com/johnennis/status/2098032630159597842

    Ребята, у нас НЕТ ВЫБОРА, кроме как дать Anthropic (моему бывшему работодателю, где я проработал всего шесть недель, чтобы отметиться и сделать этот бред правдоподобнее) регуляторскую монополию. Это же наука!
    Сатирическая публикация, высмеивающая лоббирование Anthropic как «регуляторный захват». Автор называет себя бывшим сотрудником и пишет в ироническом ключе; достоверность неизвестна, но хорошо заметно недоверие к идее, что Anthropic пытается использовать регулирование для устранения конкурентов.

  4. @walterkirn(522 likes・71 reposts・32 replies・около 20,000 views・2026-09-10)
    https://x.com/walterkirn/status/2098059171325427949

    Мейнстримные СМИ раскручивали этого парня так, словно он, ну, был доктором Fauci или кем-то подобным. Я призываю вас ясно увидеть, как это работает. И кто этим занимается.
    Публикация попала в поиск по «Anthropic», но по одному её тексту невозможно определить, кого именно она имеет в виду — сотрудника Anthropic или другую фигуру ИИ-индустрии. Подтверждается только скептический тон по поводу чрезмерного возвеличивания человека основными СМИ.

Сигналы
  • В главных обсуждаемых темах X сегодня почти нет LLM-новостей. Среди Top10 трендов Explore (см. ниже) лишь «Anthropic» на 7-м месте напрямую связано с LLM/ИИ; остальное — событие Apple, мемы вокруг Charlie Kirk, MAGA/политика, iPhone Duo, ситуация в Палестине, внутренняя политика Британии и т. п. В X сегодня политика и развлечения явно доминируют над ИИ.
  • Упоминания Anthropic сочетают положительное представление влияния на экономику с сарказмом о регуляторном захвате (публикация 2 против публикации 3). Выборка мала и не позволяет делать жёсткие выводы, но ирония в X совпадает с нарративом Reddit: «закрытые ИИ-компании = привилегии, защищённые регулированием».
  • Недооценённый аспект: единственная конкретная продуктовая новость (публикация 1, открытие исходного кода окружения Claude Code) пришла из японского аккаунта; в этой выборке нет англоязычной реакции. Возможно, тема не получила широкого распространения.
  • Само присутствие «Anthropic» в технологических трендах Explore подтверждает, пусть и не масштаб обсуждения, что это одна из немногих ИИ-компаний, чьё имя сегодня всплывало в X.
Справка: X Explore(геолокация этой сессии)
# Тренд Категория/место(как указано X)
1 Apple Technology · Trending
2 Charlie Kirk Politics · Trending
3 MAGA Politics · Trending
4 iPhone Duo Technology · Trending
5 Palestinian Politics · Trending
6 Britain Politics · Trending
7 Anthropic Technology · Trending
8 #CyberSecurity Trending in Croatia
9 Harvey as the AI OS Trending in Croatia
10 The OS Trending in Croatia

Для позиций 1–7 место не указано — вероятно, это регион по умолчанию для этой сессии; для 8–10 прямо указано «Trending in Croatia». Следовательно, этот список Explore отражает точку зрения одного региона (вероятно, Хорватии или региона по умолчанию для сессии), а не весь мир.

Ограничения
  • Стратегия поисковых запросов не соответствовала теме: 9 из 10 запросов — Apple, Charlie Kirk, MAGA, iPhone Duo, Palestinian, Britain, #CyberSecurity, Harvey as the AI OS и The OS — были просто трендами X Explore. Целевой запрос, связанный с LLM, был только один — «Anthropic». Не использовались запросы вроде «анонсы новых моделей», «открытые веса», «цены API» или «бенчмарки»; поэтому при критерии завершения в 10 материалов удалось найти лишь 4 значимые LLM-публикации.
  • Не выполнялись именные поиски по другим крупным игрокам LLM: OpenAI, Google (Gemini), Meta (Llama), Mistral или xAI (Grok). По этой выборке невозможно судить, обсуждались ли они в X.
  • Цитата из публикации 2 (@restitutorII) обрывается в отображении платформы; название исходного отчёта Anthropic и конкретные цифры сценариев Substantial/Aggressive не были подтверждены.
  • Публикация 4 (@walterkirn) попала в поиск по «Anthropic», но из одного текста нельзя установить фигуру или контекст, поэтому неясно, действительно ли она относится к Anthropic.
  • Результаты Explore, как отмечено выше, привязаны к региону сессии — Хорватии или неясному региону по умолчанию. В Explore Японии, США и других регионов могли отображаться другие тренды.

YouTube

YouTube — LLM-новости на 11 сентября 2026 года

Каналы
  • Wes Roth(около 323,000 подписчиков, около 56 млн просмотров всего)— известный канал с оперативными разъяснениями анонсов новых моделей OpenAI. Опубликовал GPT-6 Astra Just Went CRITICAL....
  • Every / 「AI & I」(продуктовая студия Dan Shipper)— опубликовала недельный отчёт о практическом тестировании We Tested Anthropic's Fable 5.1 for a Week.
  • Множество других ИИ-каналов сравнения серии «Fully Tested» (названия и число подписчиков не удалось проверить из-за JavaScript-рендеринга страницы; см. Limits ниже) выпускают бенчмарк-видео по каждой новой модели.
Видео
  1. GPT-6 Astra Just Went CRITICAL... — Wes Roth(опубликовано примерно 2 сентября 2026 года)
    https://www.youtube.com/watch?v=qRNZMGc7TMc
    Сообщает, что GPT-6 Astra от OpenAI стала первой моделью, достигшей уровня «Critical» в кибербезопасностной категории собственной Preparedness Framework; расширенные кибервозможности были ограниченно открыты только проверенным тестерам и партнёрам Daybreak Blue.

  2. Use GPT-6 Astra For FREE — OpenAI's Most Powerful Model Ever(название канала не подтверждено, примерно 4 дня назад = около 7 сентября)
    https://www.youtube.com/watch?v=LbXoUHdG2pY
    Рассказывает, как бесплатно использовать GPT-6 Astra, и представляет её как передовую модель для программирования, кибербезопасности и науки.

  3. We Tested Anthropic's Fable 5.1 for a Week — Every/Dan Shipper
    https://www.youtube.com/watch?v=yZddAiz4HP8
    В течение недели тестирует Fable 5.1 в программировании, письме и интеллектуальной работе; заключает, что это «лучшая модель для программирования из использованных» и что она достигает результатов уровня Opus 5 примерно за половину токенов и около 60% времени.

  4. Fable 5.1 is here, and its REALLY good(название канала не подтверждено)
    https://www.youtube.com/watch?v=0lBvjhcRqyU
    Сообщает, что Fable 5.1 снижает стоимость чтения кэша на 75%, а стоимость агентной работы — на 25–45%.

  5. Gemini 3.8 Flash: The model no one expected!(название канала не подтверждено, опубликовано примерно неделю назад)
    https://www.youtube.com/watch?v=UvrAYDgobSw
    Оценивает Gemini 3.8 Flash как лучшую агентную модель Google для программирования за всю историю компании.

  6. Gemini 3.8 Flash Opus 5 Level Explained in 7 Minutes - Benchmarks, Cost, First Impressions(название канала не подтверждено)
    https://www.youtube.com/watch?v=y52bv4iNfzU
    Объясняет, что бенчмарки Gemini 3.8 Flash, выпущенной Google 2 сентября (третий релиз Flash за 43 дня), достигли уровня Opus 5.

  7. GLM-5.3: Frontier Coding with Emergent Cyber Capabilities(название канала не подтверждено)※открытые веса
    https://www.youtube.com/watch?v=2uEunHawjIU
    Рассказывает, что GLM-5.3 от Z.ai показывает фронтирные результаты в программировании, одновременно отмечая резкий рост кибервозможностей (Emergent Cyber Capabilities).

  8. GLM-5.3 (Fully Tested): I GOT EARLY ACCESS & IT'S #1 ON MY BENCH!(название канала не подтверждено)※открытые веса
    https://www.youtube.com/watch?v=iMpBNN-0-Ss
    Автор утверждает, что по его собственному бенчмарку GLM-5.3 заняла первое место. Подчёркивается, что базовые веса не менялись по сравнению с GLM-5.2, а улучшение достигнуто исключительно постобучением.

  9. Qwen 3.8 Max (Final Version Review & Free Ways): Okay, it's ACTUALLY a TOP MODEL!(название канала не подтверждено)※открытые веса
    https://www.youtube.com/watch?v=GrTVmMZfM6A
    Сообщает, что флагманская Qwen 3.8 Max Alibaba с примерно 2,4 трлн параметров превосходит Opus 4.8 во многих бенчмарках.

  10. Deepseek V4.1 Flash (Fully Tested): 200 TPS & Beats Astra!? (+New Architecture Overview)(название канала не подтверждено, опубликовано примерно 14 часов назад = 10–11 сентября, самое свежее)※открытые веса
    https://www.youtube.com/watch?v=lpC5X6o3VJE
    Проверяет, может ли официально выпущенная 10 сентября 2026 года DeepSeek V4.1-Flash (MoE на 552 млрд параметров, нативное понимание изображений, контекст 1 млн токенов) соперничать с GPT-6 Astra или превосходить её в бенчмарках, обеспечивая при этом быстрый вывод 200 TPS.

  11. Muse Spark 1.3: Going Open Weight Soon, Fully Tested(название канала не подтверждено)※открытые веса
    https://www.youtube.com/watch?v=euJl6i8pT3g
    Рассматривает утверждение, что Meta, выпустившая Muse Spark как первую модель с закрытыми весами в апреле 2026 года, близка к возвращению к открытым весам с Spark 1.3.

Сигналы
  • У закрытых игроков видео о GPT-6 Astra сосредоточены на одном пункте: она первой достигла уровня Critical в киберкатегории Preparedness Framework. Главной темой стало не хвастовство возможностями, а то, что компания сама сообщила о степени опасности. Отзывы о Anthropic Fable 5.1 чаще смотрят глазами практических пользователей — «сокращение рабочих затрат вдвое», «Claude снова умеет естественно писать». Для Google Gemini 3.8 Flash отдельной темой стала скорость разработки: «третий релиз Flash за 43 дня».
  • У моделей с открытыми весами DeepSeek V4.1-Flash, выпущенная 10 сентября и самая свежая, стала наиболее новой темой через вопрос «не превосходит ли она Astra?». GLM-5.3 привлекает внимание самим методом — повышение качества без изменения базовой модели, только постобучением. Qwen 3.8 Max и Meta Muse Spark 1.3 были выпущены раньше, но бенчмарк-видео о них продолжают появляться.
  • В целом закрепился паттерн: видео с бенчмарк-проверками, озаглавленные «Fully Tested», массово выходят в день анонса модели или в течение нескольких следующих дней.
Ограничения
  • Страницы результатов поиска и видео YouTube рендерятся JavaScript, поэтому WebFetch не смог напрямую получить реальные списки роликов, просмотры, количество подписчиков или комментарии — возвращалась только навигация подвала. Поэтому большинство просмотров и названий каналов в этом отчёте основаны на фрагментах WebSearch, а неподтверждённые элементы помечены как «не подтверждено».
  • По той же причине не были напрямую проверены описания видео и содержание верхних комментариев.
  • Поиск велся в основном англоязычными ключевыми словами. Видео японских каналов по тем же темам (например, найденное одно японское видео с оперативным разбором GLM-5.3) не исследовались систематически.

Bluesky

Bluesky — сегодняшние LLM-новости

Аккаунты

Публичный поисковый API Bluesky app.bsky.feed.searchPosts в настоящее время возвращал 403 Forbidden, поэтому поиск по ключевым словам был недоступен (см. Limits). Вместо него материалы собирались прямым чтением лент известных аккаунтов, регулярно публикующих о LLM.

  • Simon Willison@simonwillison.net. Разработчик CLI-инструментов для LLM, почти ежедневно публикующий впечатления от новых моделей и советы по применению агентов.
  • Gary Marcus@garymarcus.bsky.social. Один из наиболее заметных скептиков LLM; источник сообщений о безопасности и критики завышенных обещаний.
  • Nathan Lambert (Interconnects)@natolambert.bsky.social. Исследователь AI2. Регулярно публикует обзор движения открытых моделей «Latest open artifacts».
  • Emily M. Bender@emilymbender.bsky.social. Вычислительный лингвист и скептик ИИ; в основном критикует завышенные обещания и PR.
  • Для справки также проверялся официальный Anthropic (@anthropic.com), но у него 0 публикаций (postsCount: 0) и фактически нет активности в Bluesky. Официального аккаунта OpenAI с handle openai.com не существует (400 Bad Request).
Публикации
  1. Попросил GPT-6 Astra создать в Blender тематическое яйцо Фаберже Pluribus — Simon Willison, 2026-09-10. «Here's a Blender model of a Pluribus themed Fabergé egg I had GPT-6 Astra build...» 52 лайка, 5 репостов.
    https://bsky.app/profile/simonwillison.net/post/3mv4su6pfzk24

  2. Попросил создать также просмотрщик этой модели в браузере — Simon Willison, 2026-09-10. 17 лайков, 1 репост.
    https://bsky.app/profile/simonwillison.net/post/3mv4swvzzr22h

  3. Мнение о скандале вокруг «задачи тысячелетия Navier–Stokes» OpenAI — Simon Willison, 2026-09-08. 283 лайка, 51 репост — самая распространяемая публикация в этой ленте.
    https://bsky.app/profile/simonwillison.net/post/3mv2a4quhpk2d

  4. Руководства Anthropic/OpenAI по промптам меняются в сторону рекомендаций более кратких правил — Simon Willison, 2026-09-07. 7 лайков, 3 репоста.
    https://bsky.app/profile/simonwillison.net/post/3mux26ztekk26

  5. Написал «one resignation turned the embers of AI fear into a wildfire» — Nathan Lambert, 2026-09-10. Анализирует, как заявление об отставке исследователя ИИ — с утверждением о риске вымирания выше 10% и упоминанием Evan Hubinger — быстро разожгло в соцсетях страхи перед ИИ. 13 лайков, 2 репоста.
    https://bsky.app/profile/natolambert.bsky.social/post/3mv6f35gkqt2l
    (Исходная статья: https://www.interconnects.ai/p/one-resignation-turned-the-embers /Hacker News: https://news.ycombinator.com/item?id=49646123

  6. «Прогресс ИИ быстрый / внедрение должно быть осторожным / мир не закончится» — критика скандала с отставкой — Nathan Lambert, 2026-09-09. 151 лайк, 14 репостов.
    https://bsky.app/profile/natolambert.bsky.social/post/3mv3ybz4g4n2c

  7. Критика: «люди внутри OpenAI/Anthropic движимы религиозным рвением» — Nathan Lambert, 2026-09-09. 26 лайков, 3 репоста.
    https://bsky.app/profile/natolambert.bsky.social/post/3mv3yb7bnem2t

  8. Latest open artifacts (#24): Motif-3, GLM-5.3, Hy4-preview и обзор лицензионных тенденций открытых моделей — Nathan Lambert, 2026-09-08. «Экосистема открытых моделей продолжает расширяться, в то время как фронтирные игроки находятся в состоянии полного хаоса». 13 лайков.
    https://bsky.app/profile/natolambert.bsky.social/post/3muzc3qszot2m

  9. Вопрос о некритичном освещении скандала с отставкой в СМИ — Emily M. Bender, 2026-09-10. Спрашивает историка: «Есть ли прецедент, когда СМИ просто сообщали слова членов культа?» 318 лайков, 80 репостов.
    https://bsky.app/profile/emilymbender.bsky.social/post/3mv6fvytz2s25

  10. Скепсис к PR OpenAI о «математическом прорыве» — Emily M. Bender, 2026-09-10. Комментирует, что это связано с рекламной гонкой в контексте научной коммуникации. 62 лайка, 8 репостов.
    https://bsky.app/profile/emilymbender.bsky.social/post/3mv54s2ytuv2a

  11. Gary Marcus подробно критикует «что Dwarkesh упустил» — возражение оптимизму в подкасте Dwarkesh Patel, 2026-08-31. 46 лайков, 21 репост.
    https://bsky.app/profile/garymarcus.bsky.social/post/3mufea36xzc2x

  12. Коротко комментирует скандал с отставкой: «как я обсуждал в сегодняшнем substack» — Gary Marcus, 2026-09-10. 13 лайков.
    https://bsky.app/profile/garymarcus.bsky.social/post/3mv6i3z5bpc2y

Сигналы
  • Самая обсуждаемая тема дня = «скандал с отставкой». Заявление исследователя ИИ об отставке — с упоминанием риска вымирания и имени Evan Hubinger — одновременно появляется среди верхних публикаций Nathan Lambert, Emily Bender и Gary Marcus, занимающих разные позиции. И исследователь, симпатизирующий открытым весам, и критики закрытых моделей строят вокруг этого события дискуссию о безопасности.
  • GPT-6 Astra (OpenAI, релиз 3–4 сентября) активно используется Simon Willison в практических инструментах — интеграции с Blender и GIS-задачах; его публикации заметно распространяются, особенно материал о Navier–Stokes с 283 лайками. Однако обсуждение в Bluesky в основном состоит из благожелательных отчётов о реализации, а не праздничного настроения, более заметного на Reddit.
  • Движение открытых весов собрано в «Latest open artifacts #24» Nathan Lambert: Motif-3, GLM-5.3 и Hy4-preview — новинки недели. Продолжается и систематическое отслеживание лицензий.
  • По общему настроению Bluesky метадискуссии о безопасности ИИ, завышенных обещаниях и освещении в СМИ заметнее, чем технические детали LLM-исследований. Сильное присутствие скептиков Emily Bender и Gary Marcus отличает площадку от X и Reddit.
Ограничения
  • Публичный поисковый API Bluesky (https://public.api.bsky.app/xrpc/app.bsky.feed.searchPosts) вопреки описанию в playbook постоянно возвращал 403 Forbidden без авторизации. Другие read-эндпоинты, включая getProfile и getAuthorFeed, работали нормально, поэтому, вероятно, ограничен именно searchPosts. Из-за этого не удалось выполнить межключевой поиск, и он был заменён прямым чтением лент известных аккаунтов.
  • Веб-интерфейс поиска bsky.app (https://bsky.app/search?q=...) представляет собой SPA с клиентским рендерингом; при fetch без исполнения JS текст публикаций недоступен.
  • Handle huggingface.co / huggingface.bsky.social / swyx.bsky.social не имели публикаций или не существовали, поэтому сообщения Hugging Face и swyx не попали в сбор. Официальный аккаунт OpenAI с handle openai.com также отсутствует; аккаунт Anthropic (anthropic.com) существует, но имеет 0 публикаций и фактически неактивен.
  • Не удалось установить правильный handle David Gerard (Pivot to AI): предполагаемый davidgerard.co.uk возвращал 400, а pivot.bsky.social оказался личным аккаунтом другого человека. Поэтому один из заметных источников критического медиа-освещения был пропущен.
  • По этим причинам невозможно было механически собрать полные «последние 10 публикаций» через поиск по ключевым словам. Тем не менее через несколько ведущих лент были собраны 12 релевантных публикаций с датами и ссылками.

Lemmy

Lemmy — сегодняшние LLM-новости(2026-09-11)

Сообщества
  • !«メールアドレス» — 5,132 подписчика. Центральное сообщество о локальном запуске и домашней эксплуатации LLM.
  • !«メールアドレス» — 2,168 подписчиков.
  • Machine Learning | Artificial «メールアドレス»!«メールアドレス»)— 1,248 подписчиков.
  • !«メールアドレス» — 8,191 подписчик. Сообщество с критической позицией по отношению к ИИ/LLM-индустрии; много публикаций об «инцидентах» и «опасениях».
  • !«メールアドレス» — 51 подписчик. RSS-сообщество, автоматически зеркалирующее публикации Reddit об ИИ; следует учитывать, что это не органические дискуссии Lemmy.
  • !«メールアドレス»!«メールアドレス»!«メールアドレス»!«メールアドレス»!«メールアドレス»!«メールアドレス» — сообщества федеративных инстансов, в которых нашлись единичные публикации об ИИ; число подписчиков не подтверждено.
Публикации
  1. NanoFlare Fits Qwen 3.8 27B On An 8GB GPU!«メールアドレス»、score 1、2026-09-09
    https://lemmy.world/post/51731499
    Отчёт о методе квантования NanoFlare, позволяющем запускать Qwen3.8 27B на GPU класса 8GB.

  2. Benchmarking Qwen3.8 27B quantizations!«メールアドレス»(через piefed.zip)、score 20、2026-09-08
    https://piefed.zip/c/«メールアドレス»/p/1805947
    Сравнение точности и скорости различных квантованных версий Qwen3.8 27B. Самая рейтинговая из найденных публикаций внутри localllama.

  3. FreeToken claims 39.3 tok/s for Qwen3.6-35B!«メールアドレス»、score 4、2026-09-08
    https://lemmy.world/post/51688483
    Утверждение, что фреймворк ускорения инференса FreeToken достигает 39.3 tok/s на Qwen3.6-35B.

  4. Chinese labs DeepSeek and Moonshot were quietly relaying customer prompts to Claude through fraudulent accounts!«メールアドレス»、score 3、2026-09-10 21:34 UTC
    https://piefed.world/c/tech/p/1393607/chinese-labs-deepseek-and-moonshot-were-quietly-relaying-customer-prompts-to-claude-thro
    Перепечатка сообщения о том, что DeepSeek и Moonshot через мошеннические аккаунты передавали клиентские промпты в Claude.

  5. CVE-2026-82533: la falla in DeepSeek Harness che lasciava agli agenti AI le chiavi della propria sandbox(уязвимость DeepSeek Harness, раскрывавшая ИИ-агентам ключи от их собственной песочницы)— !«メールアドレス»、score 1、2026-09-10 11:59 UTC
    https://poliversity.it/users/nuke/statuses/117246627511641222
    Информация об уязвимости в платформе запуска агентов DeepSeek (инстанс италоязычного сообщества).

  6. Anthropic gives EU cybersecurity agency ENISA testing access to Mythos 5!«メールアドレス»、score 1(2up/1down)、2026-09-10 21:38 UTC
    https://infosec.pub/post/52133063
    Публикация утверждает, что Anthropic предоставила агентству кибербезопасности ЕС ENISA тестовый доступ к новой модели «Mythos 5». На Lemmy не удалось найти независимого подтверждения этого названия модели (см. Limits).

  7. Anthropic Researcher Says There's 10% Chance of AI Killing 'All Humans' Within 10 Years!fuck_ai(через lemmus.org)、score 61、2026-09-10 20:40 UTC
    https://lemmus.org/post/25299580
    Самая рейтинговая публикация в собранном наборе: реакция на сообщение о заявлении исследователя Anthropic о будущем риске. В критическом ИИ-сообществе тема заметно набирает популярность.

  8. AI bot hacking/scraping Home Assistant!«メールアドレス»、score 10、2026-09-10 20:20 UTC
    https://lemmy.world/post/51769975
    Практический отчёт о том, что бот, называющий себя Google Gemini, пытался несанкционированно войти на домашний сервер Home Assistant.

  9. Google unveils 13 bn euro AI expansion in Finland!«メールアドレス»、score 14、2026-09-09 13:28 UTC
    https://sh.itjust.works/post/66487923
    Сообщение о том, что Google объявила об инвестициях 13 млрд евро в ИИ-инфраструктуру в четырёх муниципалитетах Финляндии.

  10. 68% of US Voters Back Sanders/Casar Bill for AI Pause, Ban on Superintelligence: Poll!«メールアドレス»、score 5、2026-09-10 20:29 UTC
    https://news.abolish.capital/post/77805
    Перепечатка результатов опроса о поддержке законопроекта о паузе в ИИ и запрете сверхинтеллекта. Редакционная политика инстанса-источника не проверялась (см. Signals).

Сигналы
  • У открытых весов главная практическая тема — «квантование и снижение потребности в VRAM»: запуск Qwen3.8 27B в 8GB VRAM (#1), сравнение её квантований (#2) и заявление о скорости инференса (#3). В сообществах localllama / machinelearning больше баллов получают не сами анонсы моделей, а публикации о том, как запускать их на своём оборудовании.
  • Закрытые модели (Anthropic/OpenAI и связанные с ними истории) обсуждаются в контексте безопасности и злоупотреблений: почти одновременно появились подозрения в передаче промптов DeepSeek/Moonshot в Claude (#4) и уязвимость DeepSeek Harness (#5). На Lemmy также воспроизводится сюжет, в котором китайские игроки открытых весов зависят от закрытых моделей или проникают в них.
  • Публикация критического ИИ-сообщества (!fuck_ai, 8,191 подписчик) получила высший score: заявление исследователя Anthropic о риске (#7, score 61) явно выделяется. Общий настрой Lemmy сильнее ориентирован на безопасность и скепсис, чем на восторг от новых функций.
  • !«メールアドレス» фактически является ботом-зеркалом Reddit (51 подписчик, все публикации выходят автоматически почти в одно время), поэтому его намеренно исключили из главных findings и указали только в разделе Communities; приоритет был отдан органическим публикациям других инстансов.
  • У некоторых новостных сообществ и инстансов-перепечатчиков, включая !pravda_news и news.abolish.capital, не удалось проверить редакционную политику и источники, поэтому точность содержащейся в них информации остаётся неподтверждённой.
Ограничения
  • Lemmy невелик: фактически единственное первоклассное специализированное сообщество по ИИ/LLM — !«メールアドレス». Хотя удалось собрать 10 публикаций, в пределах одного инстанса и одного сообщества находилось лишь 5–6; чтобы достичь 10, пришлось охватить piefed.world, piefed.zip, infosec.pub, poliversity.it, lemmus.org, news.abolish.capital, feddit.org и другие федеративные инстансы.
  • Веб-интерфейс sh.itjust.works (/c/localllama) при прямом доступе возвращал 403, поэтому данные получались через поиск/API и зеркала piefed.
  • «Mythos 5» (#6) подтверждается только одной публикацией на Lemmy; до первичного источника (например, официального объявления Anthropic) добраться и проверить информацию не удалось.
  • !ai_reddit — RSS-бот, зеркалирующий Reddit, — даёт много публикаций, но не представляет обсуждения, возникшие на Lemmy, поэтому был исключён из основных 10 findings и сохранён только как справка в Communities.

Рекомендуемые действия

  • В следующем сборе по X перестроить запросы вокруг названий новых моделей, открытых весов и цен API, а не трендов Explore.
  • В следующем цикле приоритетно проверить по официальным заявлениям и первоисточникам подозрения в плагиате OpenAI по Navier–Stokes и заявления исследователя Anthropic о риске вымирания.
  • Считать бенчмарк-заявления DeepSeek V4.1-Flash и GLM-5.3 предварительными до появления независимой сторонней оценки.
  • Продолжать проверять информацию из единственного источника, включая «Mythos 5» на Lemmy и подозрения в незаконной передаче промптов DeepSeek/Moonshot.
  • В следующем цикле проверить, устранена ли ошибка 403 поискового API Bluesky, и вернуться от зависимости от известных аккаунтов к обычному поиску по ключевым словам.

Примечание о качестве данных

Хотя Reddit, YouTube, Bluesky и Lemmy дали независимые содержательные выводы при ограничениях методов сбора, X использовал нерелевантную стратегиию запросов: 9 из 10 слов были не связанными с темой трендами Explore. Поэтому значимыми LLM-новостями оказались только 4 публикации.