KEN’S CAT LOG

Ежедневные новости LLM — 2026-09-12

Главной темой дня стали не анонсы моделей, а отчёт Anthropic об угрозах: сообщения о разработке оружия хуситами, мониторинге иранских кораблей и использовании Claude связанными с Россией хакерами при атаках на Украину независимо собрали максимальную реакцию в X и Lemmy.

Ежедневные новости LLM — 2026-09-12

Сегодня активнее всего обсуждали не сами анонсы новых моделей, а тему злоупотребления ИИ и доверия к нему. В X и Lemmy независимо вышел на первый план отчёт Anthropic об угрозах: использование Claude Code хуситами для разработки оружия, применение Ираном для наблюдения за американскими кораблями и кража российскими хакерами украинских военных технологий. Параллельно в Reddit и Bluesky одновременно обсуждалось подозрение, что OpenAI могла «украсть» из истории сеансов ChatGPT результаты математиков Бакмастера, Альпоге и других, связанные с уравнениями Навье—Стокса. На YouTube, Bluesky и Lemmy также один за другим обсуждались Claude Fable 5.1, GPT-6 Astra, Gemini 3.8 Flash, DeepSeek V4.1 Flash, GLM-5.3 и Fugu Max/Ultra v2 от Sakana AI; во всех обсуждениях прослеживалось противопоставление «закрытые модели против открытых весов». Картина в целом достаточно ясна, однако из-за ограничений по числу собранных материалов и условиям поиска некоторые платформы не достигли критериев полноты, поэтому уверенность остаётся средней.

На разных платформах

По платформам

Reddit(собирался первым): По единственному поисковому запросу «Daily LLM News» были собраны 12 тредов из 9 сабреддитов, но тредов о самих анонсах новых моделей или изменениях цен не нашлось: преобладали обсуждения и ирония вокруг уже существующих новостей. Главными источниками споров стали подозрения в «краже» OpenAI результатов по Навье—Стоксу и возмущение статьёй WSJ с критикой открытых весов. Материалы охватывают пять дней, 2026-09-06—10, поэтому они не строго ограничены «сегодняшним» днём, которого требует бриф.

X(вторым): Поскольку тренды определялись по подключению из Хорватии, из 10 собранных поисковых слов с LLM почти напрямую было связано лишь «Anthropic»; из 10 материалов только 6 непосредственно относились к LLM-брифу (не достигнут критерий 10 материалов — пробел). Среди этих шести отчёт Anthropic об угрозах, связанный с хуситами и Ираном, доминировал по масштабу распространения; в противоположность этому отчёт об экономических сценариях и открытие исходного кода Claude Code воспринимались благожелательно.

YouTube: Критерий в 10 материалов выполнен; освещены почти все основные анонсы моделей этой недели — Claude Fable 5.1, GPT-6 Astra, Gemini 3.8 Flash, DeepSeek V4.1 Flash, GLM-5.3, Muse Spark 1.3 и Sakana Fugu Ultra. Однако из-за ограничений JavaScript-рендеринга не удалось получить точные просмотры и число подписчиков, а даты часто оценивались по относительным формулировкам.

Bluesky: Официальный поисковый API возвращал HTTP 403, поэтому обходным путём были собраны 12 публикаций: просматривались ленты обнаруженных через веб-поиск аккаунтов — Ethan Mollick, TestingCatalog, Sakana AI и других. Для 10 публикаций удалось проверить лайки и репосты. Анонс Fugu Max/Ultra v2 от Sakana AI наиболее ясно выразил позицию лагеря открытых весов, но выборка смещена в сторону случайно найденных аккаунтов.

Lemmy: Собраны 12 публикаций из нескольких сообществ, включая !technology, !localllama и !fosai. Новости закрытых моделей почти полностью концентрировались в контексте безопасности и злоупотреблений — отчёта Anthropic об угрозах; открытые веса обсуждались преимущественно через практические отчёты о квантизации Qwen и K2 Horizon в LocalLLaMA. При этом публикаций именно от сегодняшнего дня, 09-12, почти не было: недавние материалы распределены между 09-04 и 11.

Все пять платформ, прямо названных в брифе, были исследованы; отсутствие других платформ не является пробелом.

Что отслеживать

Рекомендации

  • Проверить первоисточник отчёта Anthropic об угрозах и подтвердить заявления о военном применении и слежке по первичным источникам.
  • Перестроить поиск для X: не зависеть от трендов точки подключения, а использовать фиксированный список с названиями OpenAI, Google, Meta, xAI, Mistral и других компаний.
  • В Reddit наряду с «Daily LLM News» использовать запросы с названиями моделей и компаний, чтобы находить сами анонсы новых моделей.
  • Продолжать отслеживать Fugu Max/Ultra v2 от Sakana AI и OpenAI Astra в следующих сборах.
  • В следующем сборе проверить, устранена ли проблема HTTP 403 в API searchPosts Bluesky; если да — вернуться к прямому поиску.
  • В следующем сборе приоритетно проверить, появилось ли официальное заявление OpenAI о подозрениях вокруг Навье—Стокса.

Качество данных

В X выбор трендов не был оптимизирован под LLM-бриф: из требуемых 10 материалов лишь 6 относились к LLM. Reddit и Lemmy выполнили количественный критерий, но материалы были распределены по более широкому периоду, чем «сегодня» — пять дней в Reddit и 09-04—11 в Lemmy; это скорее совокупность обсуждений уже существующих новостей, чем новости конкретного дня. В Bluesky официальный поисковый API был недоступен из-за 403, и необходимое количество материалов собрано косвенным просмотром аккаунтов, что вносит смещение. YouTube выполнил критерий в 10 материалов, но количественные сведения — просмотры и подписчики — получить не удалось из-за JavaScript-рендеринга.

Сводка по платформам

Reddit

Reddit — Daily LLM News

Где

По поисковому запросу «Daily LLM News» собраны 12 тредов из 9 сабреддитов.

Сабреддит Число участников Собрано тредов
r/NoStupidQuestions 7,480,942 3
r/singularity 3,970,329 2
r/ArtificialInteligence 1,924,916 1
r/artificial 1,336,553 1
r/LocalLLaMA 821,987 1
r/WritingWithAI 165,025 1
r/SillyTavernAI 128,146 1
r/BetterOffline 55,091 1
r/Maxcactus_TrailGuide 5,205 1

По числу материалов лидируют r/NoStupidQuestions и r/singularity, но там в основном обсуждают общие вопросы уровня «что такое LLM». Напротив, один материал (#10) из небольшого сабреддита r/Maxcactus_TrailGuide с 5 205 участниками получил исключительный вирусный отклик — 2 213 баллов.

Что говорят люди
  • Главный конфликт дня — заявления OpenAI, связанные с задачей тысячелетия (Навье—Стокс), и сопутствующие подозрения в «краже идей». В треде #5 (r/singularity, 209 баллов/69 комментариев, 2026-09-10, https://www.reddit.com/r/singularity/comments/1wcnyay/ ) сообщалось, что OpenAI приблизилась к решению уравнений Навье—Стокса; при этом OpenAI отвергла как невозможные подозрения, что история использования Codex математиками, включая Tristan Buckmaster, могла повлиять на модель. u/FateOfMuffins (61 балл) предположил, что это может указывать на отсечку данных 3 июля для последнего крупного обучения.
  • Реакция на ту же историю различается по сабреддитам. В треде #6 r/singularity «"LLMs will never be smarter than Redditors"» (271 балл/159 комментариев, 2026-09-09, https://www.reddit.com/r/singularity/comments/1wbnhgt/ ) u/oilybolognese (201 балл) иронизирует над скептиками. В треде #7 r/SillyTavernAI (68 баллов/57 комментариев, 2026-09-10, https://www.reddit.com/r/SillyTavernAI/comments/1wclha4/ ) настроения противоположны: u/perthro_anon (140 баллов) иронизирует, что OpenAI может украсть написанный им смат и выдать его за собственное достижение, после чего разговор переходит к защите локальных LLM.
  • Критическая статья WSJ об открытых весах, направленная против лагеря закрытых моделей, встретила сильное неприятие в r/LocalLLaMA. Тред #12 (513 баллов/236 комментариев, 2026-09-08, https://www.reddit.com/r/LocalLLaMA/comments/1wa9309/ ) разбирает редакционную статью WSJ «нерегулируемый ИИ с открытыми весами — приглашение к катастрофе», где утверждалось, что модель ответила на вопрос о синтезе полиовируса. u/3169676 (557 баллов, самый высокооценённый комментарий в треде) возражает: «Должны ли только богатые миллиардеры иметь возможность задавать вопросы “регулируемым” ИИ-моделям?» u/inotparanoid также называет это заказным материалом для защиты стоимости акций Anthropic и OpenAI после IPO.
  • В двух тредах заметно недоверие к рассказам «ушедших из индустрии», предупреждающих об опасностях ИИ. Тред #4 (r/ArtificialInteligence, 0 баллов/32 комментария, 2026-09-09, https://www.reddit.com/r/ArtificialInteligence/comments/1wbu9c6/ ) посвящён тому, что исследователь Anthropic Jacob Coxon ушёл из индустрии из-за тревоги о гонке по созданию неконтролируемых систем. Однако u/MiloGoesToTheFatFarm утверждает, что это был не разработчик моделей, а человек, выполнявший подсобную работу вроде ввода данных. Тред #9 (r/BetterOffline, 299 баллов/167 комментариев, 2026-09-10, https://www.reddit.com/r/BetterOffline/comments/1wcxjv0/ ) касается другого «ИИ-эсхатолога», выступившего на CNN; u/Smurfette2016 (208 баллов) отмечает, что человек проработал шесть недель, имел Twitter-аккаунт менее месяца и ноль подписчиков, но один пост набрал 130 миллионов просмотров — что выглядит явно организованным.
  • Возражения против тезиса «это всего лишь предсказание следующего токена» повторяются в нескольких тредах, и сегодня эта тема кажется несколько заезженной. В треде #1 (r/NoStupidQuestions, 1 285 баллов/358 комментариев, 2026-09-10, https://www.reddit.com/r/NoStupidQuestions/comments/1wcsbr2/ ) u/skmchosen1 (16 баллов, называет себя ИИ-исследователем) объясняет: предобучение действительно основано на предсказании следующего токена, но после обучения добавляются другие цели — например, положительная награда за решение математических задач. В треде #3 (r/artificial, 67 баллов/221 комментарий, 2026-09-06, https://www.reddit.com/r/artificial/comments/1w8m8rw/ ) u/danderzei (62 балла) повторяет сходную дискуссию.
  • Утверждение учёного, что «LLM — когнитивный вирус для людей», показало необычный рост, несмотря на небольшой сабреддит. В треде #10 (r/Maxcactus_TrailGuide, 5 205 участников, 2 213 баллов/180 комментариев, 2026-09-09, https://www.reddit.com/r/Maxcactus_TrailGuide/comments/1wbi2d7/ ) u/MF_D000M (58 баллов) пишет, что LLM ускоряют наше движение к финалу власти толпы. u/TurgorFervor сравнивает с религией как вирусом.
  • Практические пользователи жалуются и на качество работы в бесплатных тарифах. В треде #8 (r/WritingWithAI, 18 баллов/35 комментариев, 2026-09-10, https://www.reddit.com/r/WritingWithAI/comments/1wcunsz/ ) автор пишет, что GPT Sol хорош для исследований, но пишет по-роботски; у Claude Sonnet слишком жёсткие ограничения бесплатного тарифа, а Gemini «глупый». u/whitemisandry (4 балла) отвечает, что использует Claude Opus 4.8, но перед работой даёт ему длинную систему инструкций.
  • На базовый вопрос «почему LLM становятся умнее» поддержку получило системное объяснение. В треде #11 (r/NoStupidQuestions, 1 балл/9 комментариев, 2026-09-09, https://www.reddit.com/r/NoStupidQuestions/comments/1wbpr47/ ) u/Jolly-Rip5973 (2 балла) объясняет, что отдельные LLM уже близки к пределу, а нынешний прогресс обусловлен построением систем: обвязкой, вызовом инструментов и взаимодействием нескольких моделей.
Сигналы
  • Набирающий силу настрой:недоверие и неприятие закрытых моделей, особенно OpenAI. Больше внимания Reddit сегодня притягивают не сами заявления о результатах уровня задачи тысячелетия, а подозрения в краже идей (#5, #7) и реакция на статью WSJ против открытых весов (#12). Открытые веса защищают как символ свободы выражения и независимости.
  • Настрой, который отвергают:посты «ушедших из индустрии» о безопасности ИИ (#4, #9) получают высокий отклик, однако большинство комментариев списывает предупреждения на рекламу, PR или нечто сомнительное. Сильны усталость и цинизм по отношению к самому дискурсу безопасности.
  • Неожиданный момент:сверхмалый сабреддит (#10) всего с 5 205 участниками получил 2 213 баллов — больше, чем крупные сабреддиты вроде r/singularity с 3 970 329 участниками. Вероятно, публикация каким-то образом стала вирусной через r/all или аналогичный механизм; сегодня корреляция размера сообщества и оценки нарушена.
  • Структура конфликта:на одну и ту же новость о Codex/задаче тысячелетия от OpenAI r/singularity (#5, #6) реагирует в основном тоном «OpenAI права, а скептики смешны», тогда как r/SillyTavernAI (#7) склоняется к «OpenAI украла, поэтому нужны локальные LLM» — интерпретации одной новости полностью расходятся между сообществами.
Ограничения
  • Использовался только один поисковый запрос — «Daily LLM News»; поиск по конкретным моделям и компаниям не проводился. Поэтому 12 собранных тредов посвящены не первичным сообщениям о новых моделях, снижении цен или бенчмарках, а обсуждениям, впечатлениям и иронии вокруг уже известных новостей. Тредов, напрямую сообщающих об анонсах моделей или изменениях цен API, не найдено.
  • Три материала из r/NoStupidQuestions (#1, #2, #11) — вопросы новичков о принципах работы LLM. Это постоянные дискуссии, а не «новости дня»; кроме свежей даты, в них мало материала, специфичного для текущего дня.
  • Для каждого треда предоставлялось не более шести лучших комментариев, поэтому общий тон более широких комментариев не проверен: например, в #1 — 6 из 358 комментариев, в #12 — 6 из 236.
  • Материалы распределены по пяти дням, 2026-09-06—2026-09-10, и не ограничены строго сегодняшней датой, 2026-09-12. Возможно, окно сбора работника оказалось шире, чем предполагал бриф.

X

X — материалов по LLM немного; в центре отчёт Anthropic о злоупотреблении Claude при разработке оружия

Страница Explore в этой сессии показывала доступ из Хорватии — на это указывали пункты с пометкой «Trending in Croatia». Десять верхних трендов: «Yemen», «Saudi», «$song», «Charlie Kirk», «Britain», «Anthropic», «Apple», «Sony», «one ai os», «Chelsea». Это порядок трендов Хорватии — или как минимум точки подключения данной сессии, — а не универсальные мировые тренды. Сбор проводился поиском по этим 10 словам; существенные темы, связанные с LLM, обнаружились лишь среди публикаций по «Anthropic» и в публикациях об угрозах Anthropic, случайно найденных при поиске «Yemen».

Аккаунты

Все 40 собранных аккаунтов внесли по одной публикации; случаев с несколькими публикациями одного аккаунта не было. С LLM были связаны публикации следующих шести аккаунтов.

Аккаунт Содержание публикации
@tleilax___(Yet another commodity guy) Пишет, что группа из Йемена использовала Claude Code для разработки управляемых ракет, баллистических ракет и гиперзвукового планирующего аппарата. 5 022 лайка
@IranTimes72(Ebrahim Zolfaghari) Сообщает, что Иран использовал Claude AI для мониторинга американских кораблей; также упоминает, что Anthropic выявила группу из Йемена
@BrianRoemmele В длинном посте высмеивает человека, проработавшего в Anthropic «шесть недель» и заявившего, что ИИ уничтожит человечество за десять лет
@restitutorII(Restitutor Orientis) Представляет описанные в отчёте Anthropic три сценария для экономики США в 2030 году — в том числе GDP+1.6%
@walterkirn Упоминает ту же историю с человеком и язвит, что основные СМИ превозносили его как доктора Фаучи
@claudecode84(Claude code研究ラボ、日本語アカウント) Сообщает, что глава Anthropic полностью открыл исходный код собственной среды Claude Code. Около 724 тыс. просмотров — максимум среди связанных с LLM публикаций
Публикации
  1. @tleilax___, 2026-09-10(5 022 лайка, 359 репостов, 21 ответ, около 264 тыс. просмотров; найдено по запросу «Yemen»)

    "One Yemen-based group used multiple Claude Code instances while working on guided rockets, ballistic missiles and a hypersonic-glide project."
    Вероятно, публикация цитирует отчёт Anthropic об угрозах. В ней утверждается, что группа из Йемена использовала несколько экземпляров Claude Code и была вовлечена в разработку оружия. Это наиболее широко распространившаяся связанная с LLM публикация.

  2. @IranTimes72, 2026-09-11(238 лайков, 34 репоста, 8 ответов, около 15 тыс. просмотров; найдено по запросу «Yemen»)

    Iran used Claude AI to monitor U.S. warships in the Middle East and identify potential communications vulnerabilities. ... Anthropic also identified a Yemen-based [group]
    Также ссылается на тот же отчёт Anthropic. Сообщается, что Иран совмещал отслеживание кораблей, военные изображения и коммерческие спутниковые снимки для анализа с Claude; публикация распространяется как парная к пункту 1.

  3. @restitutorII, 2026-09-10(458 лайков, 69 репостов, 41 ответ, около 57 тыс. просмотров; найдено по запросу «Anthropic»)

    Anthropic in its report imagines 3 possible futures for the American economy in 2030 based on the power and adoption of AI: 1- Modest scenario: AI has an impact comparable to the Internet. GDP +1.6%, few disruptions to employment. 2- Substantial scenario: AI can perform about...
    Рассказ об опубликованном Anthropic отчёте с экономическими сценариями — трёхступенчатом прогнозе влияния на экономику США к 2030 году. Помимо новостей о военном злоупотреблении, в тот же день обсуждался и экономический анализ Anthropic.

  4. @claudecode84, 2026-09-10(2 522 лайка, 263 репоста, 24 ответа, около 724 тыс. просмотров; найдено по запросу «Anthropic»)

    Anthropic最高責任者本人が自分の「Claude Code環境」を丸ごとオープンソース化しています
    Публикация японского аккаунта. По числу просмотров это самый масштабно распространённый материал о LLM. В ней утверждается, что руководитель Anthropic открыл собственную среду Claude Code, но подробности и ссылка на первоисточник из текста публикации не подтверждаются.

  5. @BrianRoemmele, 2026-09-10(790 лайков, 187 репостов, 105 ответов, около 99 тыс. просмотров; найдено по запросу «Anthropic»)

    TEMU HARRY POTTER SAYS "AI WILL END ALL HUMAN LIFE IN 10 YEARS!" ... His SIX WEEKS at Anthropic...
    Публикация высмеивает заявление человека, проработавшего в Anthropic всего шесть недель, о том, что ИИ уничтожит человечество за десять лет. 105 ответов и высокий отклик делают заметным скепсис и неприятие дискурса об ИИ-безопасности.

  6. @walterkirn, 2026-09-10(722 лайка, 91 репост, 39 ответов, около 28 тыс. просмотров; найдено по запросу «Anthropic»)

    The mainstream media boosted this dude like he was, well, Dr Fauci or something. I implore you to see clearly how this works. And who works it.
    Вероятно, относится к той же истории, что и пункт 5. Имя не упоминается, но совпадают контекст, поисковое слово и период; пост иронизирует над тем, как основные СМИ возвысили этого человека.

Сигналы
  • Больше всего обсуждается военное и разведывательное применение Claude:разработка оружия группой из Йемена (1) и наблюдение Ирана за кораблями (2) предположительно основаны на отчёте Anthropic об угрозах и случайно были найдены по геополитическому запросу «Yemen». Это была наиболее распространяемая LLM-тема данной сессии.
  • Экономический отчёт Anthropic (3) и открытие исходного кода Claude Code (4) освещаются в положительном, информационном тоне, заметно отличающемся от новостей о злоупотреблениях.
  • Заявления в духе «ИИ уничтожит человечество за десять лет» вызывают преимущественно скепсис и насмешки(5, 6). Реакция против медийного возвеличивания бывшего сотрудника Anthropic, проработавшего лишь шесть недель, выглядит сильнее поддержки.
  • Неожиданный момент:в собранных материалах нет ни одной публикации об открытых весах — Llama, Qwen, DeepSeek, Mistral и других. Не нашлось и конкретных постов о бенчмарках или изменениях цен API.
  • Из 40 собранных публикаций по 10 запросам с LLM-брифом напрямую связаны только 6. Остальное — общие новости о конфликтах в Йемене и Саудовской Аравии, политические споры вокруг годовщины убийства Charlie Kirk, дипломатия Britain/Israel, реакция на мероприятие Apple, темы Sony и игр, футбольные мемы о Chelsea — то есть материалы, не связанные с LLM.
Ограничения
  • Explore показывал тренды по Хорватии, а не мировую повестку. Поскольку это зависит от точки подключения сессии, порядок трендов в других странах или регионах с высокой вероятностью отличался бы.
  • Выбор поисковых слов не оптимизирован для LLM-брифа:10 слов — «Yemen», «Saudi», «$song», «Charlie Kirk», «Britain», «Anthropic», «Apple», «Sony», «one ai os», «Chelsea» — были напрямую взяты из трендов Explore, и только «Anthropic» относится к LLM. Не проводился целевой поиск по OpenAI, Google/Gemini, Meta AI, xAI/Grok, Mistral и другим компаниям; поэтому ни закрытые модели, ни открытые веса не были собраны системно.
  • Критерий полноты в 10 материалов не достигнут: в LLM-бриф удалось включить лишь 6 материалов из 40. В сбор не вошли публикации о новых моделях, изменениях цен, бенчмарках и конкретных инцидентах.
  • Сама сессия работала нормально: не было выхода из учётной записи или сбоев получения страниц. Причина неполноты — выбор поисковых слов, а не неисправность сессии.

YouTube

YouTube — новости LLM за сегодня(2026年9月12日)

Каналы
  • Anthropic(официальный канал)— опубликовал видео-анонс Claude Fable 5.1.
  • ByteForward — канал сравнительных проверок закрытых моделей и открытых весов.
  • WorldofAI(@intheworldofai)— часто публикует практические тесты новых моделей и сводки ИИ-новостей.
  • AI WITH Rithesh — разборы бенчмарков и цен новых моделей.
  • Prompt Engineering(@engineerprompt)— материалы по проектированию промптов и новым моделям.
  • AI Coding Daily — обзоры на основе практических замеров в кодинговых бенчмарках.
  • RandomAI — разборы утечек и слухов.
  • TheAIGRID — быстрые объяснения анонсов новых моделей.
  • AI時短ラボ — японский канал срочных новостей об ИИ.

Из-за JavaScript-рендеринга страниц каналов число подписчиков напрямую проверить не удалось; точные значения не получены(подробнее в разделе Limits).

Видео
  1. Introducing Claude Fable 5.1 — Anthropic — 2026年9月1日 — https://www.youtube.com/watch?v=ROF2Nv_KjOM
    Официальное видео Anthropic. Claude Fable 5.1 позиционируется как новейшая версия самого производительного класса; сообщается, что результат Terminal-Bench-Science вырос с 24.7 у версии 5 до 52.6 у 5.1.

  2. GPT-6 Astra vs DeepSeek V4.1 Flash… Is It Even Close? — ByteForward — примерно 2026年9月11日(опубликовано 1 день назад) — https://www.youtube.com/watch?v=YnFKMybL7gs
    Практическое сравнение закрытого GPT-6 Astra и открытого DeepSeek V4.1 Flash. Представлен бенчмарк, где V4.1 Flash в задачах дизайна достигает 98% результата Astra при 1,4% стоимости.

  3. DeepSeek V4.1 Flash Is INSANELY GOOD! Fast, Cheap, Powerful! (Fully Tested) — WorldofAI — начало 2026年9月 — https://www.youtube.com/watch?v=T2dnchLabZQ
    Комплексное тестирование: кодинг, 3D-симуляции, работа агентов и ввод изображений. Высоко оцениваются скорость до 427 токенов в секунду и низкая стоимость.

  4. GLM-5.3 Released: Everything You Need to Know About Z.ai's New Coding Model (Benchmarks, Price) — AI WITH Rithesh — середина 2026年8月 — https://www.youtube.com/watch?v=4RFo47KJ4q4
    Разбор бенчмарков и цены модели GLM-5.3 с открытыми весами от Z.ai. Подчёркивается, что производительность улучшена только последующим обучением при сохранении той же базовой модели 743B.

  5. 【速報】GLM-5.3登場 コーディングとサイバー能力で最強クラス 期待のモデル!! — AI時短ラボ — середина 2026年8月 — https://www.youtube.com/watch?v=Ca0PHSjrU8M
    Срочный японский обзор GLM-5.3. Модель представлена как одна из сильнейших в задачах программирования и кибербезопасности.

  6. Gemini 3.8 Flash: The model no one expected! — Prompt Engineering — примерно 2026年9月2日〜3日 — https://www.youtube.com/watch?v=UvrAYDgobSw
    Gemini 3.8 Flash, выпущенная Google 2 сентября 2026 года, названа «моделью, которой никто не ожидал»; автор утверждает, что в бесплатном тарифе она приближается к Claude Opus 5.

  7. I Tested NEW Muse Spark 1.3 on Coding: Meta Joins Frontier LLMs? — AI Coding Daily — начало 2026年9月(опубликовано 1 неделю назад) — https://www.youtube.com/watch?v=lxljOqB1YUI
    Проверка модели Muse Spark 1.3, которую Meta планирует выпустить с открытыми весами, на задачах программирования; обсуждается, догнала ли Meta модели переднего края.

  8. OpenAI Astra Just Got Leaked and It's INSANE (Full Breakdown) — RandomAI — конец 2026年8月(опубликовано 2 недели назад) — https://www.youtube.com/watch?v=2sh0_oV_r04
    Видео с разбором утечек о следующей модели OpenAI Astra. Следует учитывать, что материал основан на слухах до официального анонса.

  9. DeepSeek V4.1 GA Soon, GPT-5.6 SOL Nerfed? HUGE Fable Update, US AI BAN Protests, & More! AI NEWS — WorldofAI — начало 2026年9月 — https://www.youtube.com/watch?v=LgGJz528Boo
    Еженедельная сводка ИИ-новостей: ожидаемый общий релиз DeepSeek V4.1, обновления Fable, протесты против регулирования ИИ в США и другое.

  10. Sakana AI's New "Fugu Ultra" Beats Claude Fable 5 (Sakana Fugu) — TheAIGRID — конец 2026年6月 — https://www.youtube.com/watch?v=FwA1bcpSGiM
    Рассказ о первом поколении серии Fugu от японской Sakana AI — модели, ориентированной на мультиагентность. Проверяется утверждение о превосходстве над Claude Fable 5. Отдельных видео о преемниках Fugu Ultra v2 / Fugu Max, выпущенных 11 сентября, пока не найдено(см. Limits).

Сигналы
  • Закрытый лагерь: Anthropic(Fable 5.1, 9/1), Google(Gemini 3.8 Flash, 9/2)и OpenAI(Astra, ещё не анонсирована, стадия утечек)последовательно выпускают новости; обзорные видео на YouTube сосредоточены в первые дни после анонсов.
  • Лагерь открытых весов: DeepSeek(V4.1 Flash), Z.ai(серия GLM-5.3), Meta(Muse Spark 1.3)и Sakana AI(Fugu Max / Fugu Ultra v2)обсуждаются через тезис «почти уровень закрытых моделей при низкой цене». Особенно часто авторы ссылаются на сопоставление DeepSeek V4.1 Flash и Astra: 98% результата за 1,4% стоимости.
  • Японские каналы, такие как AI時短ラボ, также оперативно освещают китайские модели с открытыми весами, например GLM-5.3; задержка относительно англоязычного пространства невелика — обычно одна-две недели после анонса.
  • Fugu Max / Fugu Ultra v2 от Sakana AI, выпущенные 11 сентября 2026 года, уже освещены новостными сайтами и блогами, но отдельных объясняющих видео на YouTube на момент исследования ещё не найдено; есть только недавние видео о первом Fugu Ultra.
Ограничения
  • Страницы результатов поиска YouTube(youtube.com/results?...)и видео(youtube.com/watch?...)используют JavaScript-рендеринг, поэтому WebFetch получал только нижнюю часть страницы, а не основной контент: названия, каналы, просмотры и даты. Информация дополнялась сниппетами WebSearch и noembed.com, который возвращал только название и канал.
  • По этой причине точные просмотры и число подписчиков получить не удалось. Многие даты оценены по относительным обозначениям вроде «◯ дней назад» или «◯ недель назад», и точный день публикации части видео не установлен.
  • Отдельные YouTube-видео о последних моделях Sakana AI Fugu Max / Fugu Ultra v2(выпуск 9/11)не найдены. Обнаружены только ссылки внутри новостных статей и плейлисты; существование самих видео не подтверждено.
  • Количественный критерий в 10 материалов выполнен, но один из них — видео о первом Sakana Fugu Ultra, а не о самом свежем анонсе v2.

Bluesky

Bluesky — анонсы моделей проходят как «ботоподобные» срочные сообщения; заметны скандал с Навье—Стоксом и заявление Sakana AI от лица лагеря открытых весов

Примечание о методе сбора

Официальный полнотекстовый API поиска Bluesky(public.api.bsky.app/xrpc/app.bsky.feed.searchPosts)и веб-поиск(bsky.app/search)оказались недоступны в этой сессии: первый возвращал HTTP 403, второй из-за отсутствия выполнения JavaScript давал только пустое содержимое(подробнее в «Limits»). Поэтому сначала через веб-поиск находились связанные публикации и аккаунты на bsky.app, затем для найденных хендлов читался app.bsky.feed.getAuthorFeed — он отвечал с кодом 200. Так были проверены текст, дата, лайки и репосты.

Аккаунты
Аккаунт Характеристика Ссылка
Ethan Mollick (@emollick.bsky.social) Профессор Wharton; почти ежедневно публикует длинные треды о практическом влиянии передовых моделей https://bsky.app/profile/emollick.bsky.social
🚨 AI News | TestingCatalog (@testingcatalog.com) Аккаунт срочных ИИ-новостей, публикующий однострочные сообщения о новых моделях и функциях https://bsky.app/profile/testingcatalog.com
Sakana AI (@sakanaai.bsky.social) Официальный аккаунт исследовательской лаборатории из Токио, продвигающей открытые веса и мультиагентную оркестрацию https://bsky.app/profile/sakanaai.bsky.social
hardmaru / David Ha (@hardmaru.bsky.social) Сооснователь Sakana AI, автор треда с официальным анонсом https://bsky.app/profile/hardmaru.bsky.social
Quantian (@quantian.bsky.social) Личный аккаунт, чья ироничная публикация о подозрениях вокруг Навье—Стокса получила много упоминаний https://bsky.app/profile/quantian.bsky.social
Zach Weinersmith (@zachweinersmith.bsky.social) Автор научных комиксов; объяснил ход скандала в треде https://bsky.app/profile/zachweinersmith.bsky.social
ardalis / Steve Smith (@ardalis.com) Разработчик; короткая шутка, высмеивающая Claude Opus https://bsky.app/profile/ardalis.com
Публикации
  1. Sakana AI(@sakanaai.bsky.social)/2026-09-11T20:43Z/9 лайков・1 репост
    https://bsky.app/profile/sakanaai.bsky.social/post/3mvbglsna4k25

    「Fugu Max is live on Open Router! 🐡 Our learned multi-agent orchestration engine routes tasks across open-weights and specialized models for Pareto-frontier efficiency.」
    Анонс доступности Fugu Max в OpenRouter. Подчёркивается стратегия оркестрации, распределяющей задачи между моделями с открытыми весами и специализированными моделями для оптимальной эффективности.

  2. hardmaru(@hardmaru.bsky.social, сооснователь Sakana AI)/2026-09-11T02:57Z/48 лайков・5 репостов
    https://bsky.app/profile/hardmaru.bsky.social/post/3mv7kz2uplk2u

    「Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier. The AI industry has spent a decade optimizing along a single axis: build bigger, more expensive models.」
    В последующем посте прямо сказано: «Fugu Ultra v2 does all of this without Fable 5, Fable 5.1, or GPT-6-Astra in its agent pool». Независимость от передовых моделей Anthropic и OpenAI подаётся как преимущество. Это наиболее ясное найденное сегодня заявление позиции лагеря открытых весов.

  3. TestingCatalog(@testingcatalog.com)/2026-09-11T07:38Z/1 лайк・1 репост
    https://bsky.app/profile/testingcatalog.com/post/3mva2p4ykhd2s

    「OpenAI launches ChatGPT for Financial Services」
    Срочное сообщение о запуске ChatGPT для финансовых организаций — для исследований, моделирования и подготовки материалов с использованием GPT-6 Astra.

  4. TestingCatalog(@testingcatalog.com)/2026-09-10T20:45Z/0 лайков・0 репостов
    https://bsky.app/profile/testingcatalog.com/post/3mv6waz3vpu2t

    「OpenAI launches GPT-Live-1 for full-duplex voice agents」
    Срочное сообщение о новом полнодуплексном голосовом ИИ, способном одновременно слушать и говорить.

  5. TestingCatalog(@testingcatalog.com)/2026-09-03T09:19Z/2 лайка・0 репостов
    https://bsky.app/profile/testingcatalog.com/post/3mum4nfbitu2n

    「Google releases Gemini 3.8 Flash and Flash Cyber」
    Одновременный анонс Gemini 3.8 Flash для программирования, агентов и многошаговых рассуждений и варианта Flash Cyber для поиска и исправления уязвимостей, доступного только доверенным защитникам.

  6. TestingCatalog(@testingcatalog.com)/2026-09-02T00:00Z/2 лайка・0 репостов
    https://bsky.app/profile/testingcatalog.com/post/3muimw7yugw2q

    「Anthropic launches Claude Fable 5.1 and Mythos 5.1」
    Одновременный выпуск Fable 5.1 для широкой аудитории и Mythos 5.1, доступного только «vetted defenders and scientists». Сообщается о снижении стоимости кеша и росте производительности.

  7. Ethan Mollick(@emollick.bsky.social)/2026-09-11T17:38Z/40 лайков・6 репостов
    https://bsky.app/profile/emollick.bsky.social/post/3mvb4b7idf22v

    「Here's a automated forecasting system to estimate catastrophic risk from some major experts on forecasting. The models predicts the chance of an AI-generated mass catastrophe as 0.47% by 2030...」
    Описание автоматизированной системы, оценивающей вероятность масштабной ИИ-катастрофы по методам экспертов по прогнозированию. В последующем ответе уточняется, что цифра предполагает отсутствие политических вмешательств.

  8. Ethan Mollick(@emollick.bsky.social)/2026-09-11T04:59Z/65 лайков・2 репоста
    https://bsky.app/profile/emollick.bsky.social/post/3mv7rswik2s2v

    「Astra's turn: 'Make a game about Imminence...'」
    Демонстрация игры, созданной GPT-6 Astra. Она обсуждается в контексте сравнения творческих способностей с версией игры, сделанной Claude Fable 5.1 и опубликованной днём ранее.

  9. Ethan Mollick(@emollick.bsky.social)/2026-09-10T17:32Z/117 лайков・18 репостов
    https://bsky.app/profile/emollick.bsky.social/post/3mv6lhq5lyc2v

    「What you are seeing in math right now is a consequence of the [frontier models' capability jump]...」
    Часть треда о том, как математики используют ИИ и что означает обнаружение ИИ сверхчеловеческих доказательств. Читается в том же контексте, что и скандал с Навье—Стоксом, распространившийся в r/singularity; это пост с наибольшим числом лайков среди собранных.

  10. Quantian(@quantian.bsky.social)/2026-09-08T07:13Z
    https://bsky.app/profile/quantian.bsky.social/post/3muyhwbcdys2x

    「Dancing very very VERY close to saying 'OpenAI stole our almost-complete proof of Navier-Stokes from internal access to our ChatGPT sessions because they were desperate to scoop Anthropic' which is absolutely 100% a believable thing OpenAI would do right now」
    Публикация о подозрениях, что OpenAI могла «украсть» почти завершённое доказательство задачи тысячелетия математиками Buckmaster, Alpoge и другими из истории сеансов ChatGPT. Это та же тема, что и тред Reddit r/singularity в тот же период.

  11. Zach Weinersmith(@zachweinersmith.bsky.social)/2026-09-08T09:45Z
    https://bsky.app/profile/zachweinersmith.bsky.social/post/3muyqfsvt6k2f

    「For anyone not following the drama, there's been apparently a big development in ai math, along with some accusations of very bad behavior by OpenAI. ... Buckmaster and Levent Alpoge made a big discovery on Navier-Stokes.」
    Начало объясняющего треда, излагающего историю этого скандала.

  12. ardalis / Steve Smith(@ardalis.com)/2026-09-10T12:35Z
    https://bsky.app/profile/ardalis.com/post/3mv62uanbkk2b

    「LOL #ai #claude opusfived.dev」
    Короткая шутка с неясными деталями, вероятно высмеивающая что-то, связанное с Claude Opus. По контексту и названию домена «opusfived» это выглядит как мем о новой версии Opus.

Сигналы
  • LLM-дискурс в Bluesky строится вокруг анализа практиков и новостных ботов; полемических и геополитических историй вроде военного использования Claude, заметных в X, в этой выборке не найдено. Новостные аккаунты наподобие TestingCatalog нейтрально перечисляют релизы, а практики вроде Ethan Mollick рассуждают об опыте использования и социальных последствиях; это двухслойная структура.
  • Сегодня Sakana AI чётко обозначила позицию лагеря открытых весов. hardmaru, сооснователь Sakana AI, прямо говорит, что Fugu Ultra v2 не зависит от Fable 5, Fable 5.1 или GPT-6-Astra, и продаёт мультиагентную оркестрацию как способ избежать привязки к закрытым передовым моделям. Это конкретный пример противостояния закрытых и открытых весов, которого не было в собранных материалах X и Reddit.
  • Подозрения вокруг Навье—Стокса/OpenAI обсуждаются одновременно в Bluesky и Reddit примерно 2026-09-08. Математики и ИИ-комментаторы — Quantian и Zach Weinersmith — подхватывают одну тему независимо от платформы; это наиболее подтверждённый кроссплатформенный сюжет.
  • Масштаб вовлечённости более чем на порядок меньше, чем в X. Максимум лайков в проверенной выборке — 117 у Ethan Mollick (#9), тогда как в X были тысячи. В этой теме Bluesky выглядит скорее каналом для технических специалистов и наблюдателей, ориентированным на качество, а не объём.
Ограничения
  • Официальный поисковый API(app.bsky.feed.searchPosts)на протяжении всей сессии возвращал HTTP 403, поэтому полнотекстовый поиск по ключевым словам выполнить не удалось. app.bsky.actor.getProfile и app.bsky.feed.getAuthorFeed на том же домене отвечали кодом 200, что указывает на возможную блокировку только поискового эндпоинта. Веб-поиск bsky.app/search и встроенные страницы также возвращали лишь HTML до выполнения JavaScript, без списка публикаций.
  • Из-за этого сбор велся косвенно: через веб-поиск находились связанные ссылки bsky.app, затем просматривались ленты обнаруженных аккаунтов. Это не полнотекстовое покрытие всей платформы, и выборка смещена к случайно найденным аккаунтам — Mollick, TestingCatalog, Sakana AI и другим. Аккаунты Bluesky, регулярно пишущие отдельно о китайских моделях и открытых весах Meta — DeepSeek, Qwen, Llama, Mistral и т. п., — этим способом не были найдены.
  • Материалов, опубликованных именно сегодня, 2026-09-12, не найдено. Самые новые публикации датированы 2026-09-11; возможно, это связано с задержкой индексации поисковиков.
  • Найдено 12 публикаций; у 10 удалось проверить число лайков и репостов, а для оставшихся 2 через oEmbed был доступен только текст. Критерий «10 публикаций с датой и ссылкой» выполнен, но объём выборки ограничен.

Lemmy

Lemmy — что обсуждают сегодня активнее всего

Сообщества
  • !«メールアドレス»(87 981 подписчик)— основной поток общетехнологических новостей. Сегодня отчёт Anthropic об угрозах стал одной из самых заметных тем.
  • !«メールアドレス»(5 132 подписчика, 7 активных в день)— центр обсуждений практического применения и бенчмарков моделей с открытыми весами. Федерация охватывает множество инстансов: lemmy.world, piefed.zip, lemmus.org, lemmy.ml, aussie.zone, lemmy.dbzer0.com, lemmy.zip и другие.
  • !«メールアドレス»(4 820 подписчиков)— Free Open-Source AI, сообщество с лидербордами LLM и подборками ссылок для разработчиков.
  • !«メールアドレス»(51 подписчик, из них 1 локальный)— бот-сообщество, автоматически переносящее RSS из Reddit, включая r/ArtificialIntelligence и r/ClaudeCode. Оценки обычно 0—1; самостоятельной дискуссии Lemmy нет.
  • !ukraine@(экосистема lemmy.world) — геополитическое сообщество, где кросспосты об угрозах безопасности и злоупотреблении ИИ также стали предметом обсуждения.
Публикации
  1. Users in Houthi-held Yemen tried to develop advanced weapons with AI, Anthropic says — !«メールアドレス», оценка 12, 2026-09-11. Кросспост статьи Yahoo Finance, цитирующей отчёт Anthropic. https://ca.finance.yahoo.com/news/users-houthi-held-yemen-tried-184240958.html
  2. Russia-linked hackers used Claude agents to target Ukraine and steal military drone technology, Anthropic report finds — !ukraine, оценка 15, 2026-09-11. Материал The Insider об отчёте Anthropic об угрозах. Одна из самых высокооценённых ИИ-публикаций Lemmy за день. https://theins.press/en/news/297072
  3. Trump dismisses AI extinction risks as more than a dozen OpenAI, Anthropic insiders call for a slowdown — !ai_reddit(зеркало статьи CNBC), оценка 1, 2026-09-11. https://www.cnbc.com/amp/2026/09/11/trump-ai-extinction-risks.html
  4. Hawley Probe Into AI Breakout Called an Important Step, But 'Only a Start' — !pravda_news, оценка 1, 2026-09-11. Статья CommonDreams о расследовании Конгресса в отношении OpenAI. https://www.commondreams.org/news/josh-hawley-openai-investigation
  5. NanoFlare Fits Qwen 3.8 27B On An 8GB GPU — !«メールアドレス», оценка 2, 2026-09-09. Практический отчёт о квантизации и снижении требований к памяти. https://lemmy.world/post/51731499
  6. Benchmarking Qwen3.8 27B quantizations: 4-bit holds up, 1-bit collapses — !localllama, оценка 21・10 комментариев, 2026-09-08. Результаты проверки: 4-битная квантизация пригодна на практике, а при 1 бите производительность резко рушится. https://piefed.zip/c/«メールアドレス»/p/1805947
  7. K2 Horizon: Open-Source Model Family(от IFM)— !localllama, оценка 65・24 комментария(также опубликовано в !fosai, оценка 8), 2026-09-04. Щедро воспринятый релиз: набор из шести моделей размером от 0.9B до 375B под Apache 2.0, с промежуточными чекпоинтами и рецептами построения обучающих данных. https://ifm.ai/blog/k2
  8. Qwen3.8-Flash-Next sounds like Claude and I hate it — !«メールアドレス», оценка 31(4 дизлайка)・9 комментариев, 2026-08-30(12 дней назад). Недовольство тем, что новая модель Alibaba стала подражать «ритуальному и многословному» стилю Claude. В комментариях обсуждается разделение ролей: Qwen для кода, Gemma для всего остального. https://lemmy.dbzer0.com/post/74741490
  9. Release v0.4.0 · ggml-org/llama.cpp — !«メールアドレス», оценка 28, 2026-09-04. Анонс обновления движка локального инференса. https://lemmus.org/post/25155737
  10. zai-org/GLM-5.3 · Hugging Face (753b-a40b?) — !«メールアドレス», оценка 19, 2026-08-28. Обсуждение весов GLM-5.3. https://lemmus.org/post/24977768
  11. "All LLMs should be GPL" — !«メールアドレス», оценка 1・0 комментариев, 2026-09-11(8 часов назад, репост u/TrekCZ). Утверждение, что LLM, обученные на GPL-коде, тоже следует распространять под GPL; в Lemmy реакции нет. https://lemmy.durstig.online/post/59438
  12. Market size of Open-Source models — !«メールアドレス», оценка 1・0 комментариев, 2026-09-11(5 часов назад). По расчётам на основе данных HuggingFace, открытые модели составляют лишь 3,2% годовых расходов на обучение ИИ: около $250 млн для текстовых LLM и диффузионных моделей и $56 млн для адаптеров. Также выдвигается идея P2P-маркетплейса GPU. https://lemmy.durstig.online/post/59444 (связано: https://lemmy.durstig.online/post/59487)
Сигналы
  • Темы закрытых моделей сосредоточены вокруг безопасности и злоупотреблений:самые высокооценённые публикации об ИИ сегодня в Lemmy — не анонсы моделей, а отчёт Anthropic об угрозах: попытки хуситов разрабатывать оружие с ИИ и использование Claude связанными с Россией хакерами. Оценки растут благодаря кросспостам в широкие сообщества вроде !technology и !ukraine.
  • Открытые веса базируются в LocalLLaMA:там продолжаются практические отчёты о квантизации и экономии памяти Qwen3.8, Kimi K2/K3, GLM-5.3 и K2 Horizon — IFM, 0.9B—375B, Apache 2.0. Особенно высокие оценки получают щедрые релизы наподобие K2 Horizon, публикующие даже промежуточные чекпоинты и рецепты обучающих данных(65).
  • Неприятие «клаудификации» Qwen:участники LocalLLaMA явно недовольны, что Qwen3.8-Flash-Next, несмотря на хорошие бенчмарки, начала имитировать многословный стиль Claude. Сам стиль общения закрытых моделей стал предметом шуток и критики в сообществе открытых весов.
  • Самостоятельная дискуссия Lemmy ограничена:!ai_reddit на durstig.online — бот, переносящий Reddit RSS, где оценки почти всегда 0—1, а комментариев обычно нет. Первичных обсуждений собственно крупных анонсов недели — GPT-6 Astra, Claude Fable/Mythos 5.1, Gemini 3.8 Flash — в Lemmy почти не найдено.
Ограничения
  • Не удалось собрать 10 «самых новых публикаций» как строгий хронологический топ-10; были выбраны 12 материалов на пересечении !localllama, посвящённого открытым весам, и общих новостных кросспостов, посвящённых закрытым моделям. Поисковый API Lemmy возвращает лишь фрагментарные результаты по ключевым словам, поэтому получить единый «топ-10 Lemmy за сегодня» невозможно.
  • Материалов с датой именно сегодня, 2026-09-12, почти не найдено. Самые недавние публикации относятся в основном к 2026-09-11, а часть — к 2026-09-04—08. Вероятная причина — меньшая частота обновлений Lemmy по сравнению с другими соцсетями.
  • Две публикации на piefed.zip — исходный тред K2 Horizon и тред Kimi K3 — при прямом доступе возвращали HTTP 403, поэтому подробности текста и комментариев не удалось получить; использовалась зеркальная информация lemmy.world.
  • Были предприняты поиски в lemmy.ml и lemm.ee, но значимых дополнительных результатов не найдено; информация из поиска API lemmy.world и прямого доступа к инстансам сочтена почти исчерпывающей.
  • Прямых упоминаний самих крупных анонсов недели — GPT-6 Astra, Claude Fable/Mythos 5.1, Gemini 3.8 Flash — в Lemmy не найдено; предполагается, что эти темы обсуждаются преимущественно в других соцсетях.

Рекомендуемые действия

  • Проверить первоисточник отчёта Anthropic об угрозах и подтвердить заявления о военном применении и слежке по первичным источникам.
  • Перестроить поиск для X: не зависеть от трендов точки подключения, а использовать фиксированный список с названиями OpenAI, Google, Meta, xAI, Mistral и других компаний.
  • В Reddit наряду с «Daily LLM News» использовать запросы с названиями моделей и компаний, чтобы находить сами анонсы новых моделей.
  • Продолжать отслеживать Fugu Max/Ultra v2 от Sakana AI и OpenAI Astra в следующих сборах.
  • В следующем сборе проверить, устранена ли проблема HTTP 403 в API searchPosts Bluesky; если да — вернуться к прямому поиску.
  • В следующем сборе приоритетно проверить, появилось ли официальное заявление OpenAI о подозрениях вокруг Навье—Стокса.

Заметка о качестве данных

Поисковые тренды X не были оптимизированы для LLM-брифа: из целевых 10 материалов только 6 относились к LLM. Reddit и Lemmy выполнили количественный критерий, но охватили более широкий и разрозненный период, чем «сегодня», а Bluesky из-за HTTP 403 официального поискового API опирался на косвенный сбор, смещённый в сторону отдельных аккаунтов.