KEN’S CAT LOG

Ежедневные новости LLM — 2026-09-14

Дарио Амодеи немедленно поддержал эссе «We Must Pace the Frontier», а разработчики закрытых моделей синхронно взяли курс на саморегулирование — это стало главной сегодняшней новостью об LLM и в X, и на YouTube.

Сегодняшние новости LLM — 2026-09-14

Сегодня наиболее обсуждаемой темой во всех соцсетях стало эссе Дарио Амодеи (CEO Anthropic) «We Must Pace the Frontier», опубликованное 2026-09-12, и немедленная поддержка со стороны Сэма Альтмана (CEO OpenAI), замеченная как в X, так и на YouTube. В лагере открытых весов одновременно набирают обороты дискуссии о регулировании, спровоцированные статьёй WSJ, и локальные запуски новых моделей, таких как Qwen 3.8 Flash Next и GLM-5.3-Flash, активно обсуждаемые на Reddit и YouTube. Конфликт OpenAI с математиками вокруг уравнений Навье—Стокса (задачи тысячелетия) освещался и на Reddit, и на Lemmy, став новой точкой напряжения вокруг надёжности закрытых моделей. В целом день прошёл под знаком контраста: закрытый лагерь говорил о «саморегулировании и замедлении темпа», а открытый — о догоняющем развитии и опасениях по поводу регулирования.

Across platforms

  • Эссе Дарио Амодеи «We Must Pace the Frontier» и поддержка индустрии: В X публикация самого Дарио Амодеи (#18, 83 901 лайк, около 66 млн просмотров) и поддерживающий ответ Сэма Альтмана (#19, 64 398 лайков) стали одними из крупнейших вирусных тем дня. В тот же день тема вышла на YouTube и на английском (AskwhoCastsAI, видео), и на японском (AI時短ラボ, видео, где также упомянута поддержка Маска, Карпати и Хассабиса). Одностороннее обещание разработчиков закрытых моделей предоставить независимым оценщикам доступ на уровне сотрудников стало главной новостью дня независимо от платформы.
  • Конфликт OpenAI с математиками (задача тысячелетия): В r/singularity на Reddit (тред, 214 баллов) сообщалось о подозрениях в заимствовании: на утверждения OpenAI о приближении к решению уравнений Навье—Стокса мог повлиять опыт математика Бакмастера с codex. На Lemmy тот же конфликт освещался с двух сторон — через статью The Verge («OpenAI just wants to win») и TechCrunch («OpenAI's feud with mathematicians is only escalating»). Скепсис к заявлениям закрытых моделей о бенчмарках разделяют сразу несколько платформ.
  • Технический фаворит открытых весов — «Qwen 3.8 Flash Next»: И Reddit r/LocalLLaMA (замеры на Strix Halo: decode 52 tok/s и prefill 1300 tok/s, тред), и YouTube (AICodeKing и Tech2WiLD независимо выпустили сравнения с GLM-5.3-Flash, пример) показывают, что эта модель стала центральной темой сообщества локальных LLM.
  • Тревога вокруг регулирования открытых весов: На Reddit обсуждали статью WSJ «Unregulated Open-Weight AI Is an Invitation to Disaster» (обсуждение, 516 баллов), а на Lemmy — сообщение о предложении Китая создать открытую AI-платформу для BRICS (материал). Дискуссии о регулировании открытых моделей, сопротивлении ему и геополитических ответных шагах шли параллельно.
  • Практические обзоры новых моделей (GPT-6 Astra / Claude Fable 5.1): На YouTube несколько каналов, включая AICodeKing и Boxmining, независимо сравнивали GPT-6 Astra и Fable 5.1. В Bluesky Итан Моллик поделился ранними впечатлениями от Fable 5.1 и GPT-6 Astra. Эти две модели стали главными представителями закрытого лагеря на этой неделе.

Platform by platform

Reddit: Собрано 12 тредов из 7 сабреддитов — больше целевого порога в 10. Главной площадкой стал r/LocalLLaMA (4 треда): там предметно обсуждались опасения из-за регулирования открытых весов, возрождение культуры локальных запусков на фоне дефицита оборудования и практические бенчмарки Qwen 3.8 Flash Next. Поскольку WebFetch отклонял доступ, анализ опирается на заранее собранные рабочие сводки; все комментарии и тексты внешних материалов не проверялись.

X: Поисковые запросы воркера были трендами X Explore, привязанными к хорватской локации: LMEOW, Lando, Company OS и др. Поэтому из 40 собранных постов чуть больше десятой части относились к LLM, и целевой порог в 10 материалов не достигнут. Тем не менее посты Дарио Амодеи и Сэма Альтмана ясно оказались центром сегодняшней LLM-дискуссии в X. Контраргумент Брайана Рёммеле — что замедление лишь поможет Китаю — также повторялся в нескольких публикациях.

YouTube: Собрано 9 наблюдений по видео, что укладывается в целевой диапазон 5–12. Были заметны немедленные многоязычные объяснения эссе Амодеи, а также насыщенный поток сравнений GPT-6 Astra × Fable 5.1 и Qwen 3.8 Flash Next × GLM-5.3-Flash. Однако прямой доступ к страницам видео и каналов был заблокирован, поэтому просмотры и точное время публикации почти всех роликов не подтверждены; даты приблизительно восстановлены по относительным отметкам.

Bluesky: Поисковый API (app.bsky.feed.searchPosts) всегда отвечал 403, а страницы постов рендерились на стороне клиента и не возвращали текст. Поэтому удалось восстановить лишь два поста Итана Моллика по старым сниппетам поисковиков — далеко меньше целевого порога в 10. Среди пяти платформ именно Bluesky дал меньше всего данных.

Lemmy: Собрано 11 постов, то есть количественный порог выполнен, но даты распределены между 2026-09-09 и 13; публикаций именно за текущий день не найдено. Наибольший рейтинг (293 балла) получил скептический тезис «LLM существуют, но слово AI — реклама». Одновременно шли несколько линий критики OpenAI: конфликт с математиками, подозрения в военном применении Claude и связь с атакой на цепочку поставок RubyGems.

What to watch

  • Когда и каким образом Anthropic и OpenAI действительно реализуют «доступ независимых оценщиков на уровне сотрудников» (X, пост Дарио Амодеи)
  • Перерастёт ли конфликт OpenAI с Бакмастером и другими математиками в юридические и репутационные риски (Lemmy, статья TechCrunch)
  • Станет ли Qwen 3.8 Flash Next де-факто стандартом в сообществе локальных LLM (Reddit, тред r/LocalLLaMA)
  • Политическое развитие дискуссии о регулировании открытых весов, начатой статьёй WSJ (Reddit, тред)
  • Конкретизация предложенной Китаем для BRICS концепции открытой AI-платформы (Lemmy, материал telesurenglish)
  • Следующий шаг Z.ai после GLM-5.3-Flash (ранее Ox Alpha) (YouTube, видео Fahd Mirza)

Recommendations

  • Постоянно отслеживать выполнение конкретного обещания «Pace the Frontier» — предоставить независимым оценщикам доступ на уровне сотрудников.
  • Регулярно наблюдать за практическими бенчмарками Qwen 3.8 Flash Next в сообществе локальных LLM и использовать их для сравнения с другими моделями открытых весов.
  • Перевести сбор данных из X с трендов Explore, зависящих от хорватской локации, на прямой поиск по ключевым словам, связанным с LLM.
  • Пересмотреть способ доступа к поисковому API Bluesky с ошибкой 403 либо рассмотреть официальный API-ключ и альтернативные каналы.
  • Следить за развитием дискуссии о регулировании открытых весов вокруг статьи WSJ и реакцией сообщества, включая конспирологические трактовки.
  • Рассмотреть пути получения просмотров и точного времени публикации роликов YouTube помимо oEmbed, например официальный API.

Data quality

Наиболее скудными по данным в этот раз были Bluesky и X. Bluesky был полностью заблокирован ответом 403 поискового API, и удалось проверить тексты только двух архивно проиндексированных постов. В X поисковые слова основывались на трендах Explore для хорватской локации, поэтому LLM-посты составили лишь чуть больше десятой части из 40 и не достигли целевого порога. На YouTube удалось набрать нужное число видео, но не удалось получить просмотры и точные даты из-за блокировки страниц. Lemmy выполнил количественный порог, но даты постов были распределены в пределах последних пяти дней, а не приходились строго на сегодня. Лишь Reddit явно выполнил критерии и по числу материалов, и по содержанию.

Сводка по платформам

Reddit

Reddit — Ежедневные новости LLM

Где

Собранные 12 тредов были распределены по семи сабреддитам.

Сабреддит Подписчики Собранных тредов
r/LocalLLaMA 823,368 4
r/NoStupidQuestions 7,485,745 3
r/BetterOffline 55,501 1
r/AIdaily_news 2,055 1
r/LocalLLM 223,071 1
r/Maxcactus_TrailGuide 5,302 1
r/singularity 3,973,948 1

По числу подписчиков общие r/NoStupidQuestions (7,48 млн) и r/singularity (3,97 млн) значительно крупнее, но наибольшая плотность тредов наблюдалась в специализированном r/LocalLLaMA (4). Именно его можно считать главной ареной сегодняшней LLM-дискуссии на Reddit.

Что говорят люди
  • День, когда атмосфера регулирования открытых весов резко сгустилась. В треде 11 (WSJ: Unregulated Open-Weight AI Is an Invitation to Disaster, r/LocalLLaMA, 516 баллов, 236 комментариев, 2026-09-08) мишенью стала статья WSJ: модели открытых весов без ограничений якобы объяснили, как изготовить полиовирус. u/3169676 (564 балла) язвительно спросил, не хотят ли сделать так, чтобы вопросы «регулируемому» AI могли задавать только богатые миллиардеры. u/inotparanoid предложил более конспирологическое толкование: это заказной материал OpenAI или Anthropic, который позднее используют для обоснования закона против открытых весов.
  • То же настроение регулирования отразилось и в треде 4. В посте «This seems more probable than it was before.» (r/LocalLLaMA, 1 664 балла, 229 комментариев, 2026-09-12), предположительно основанном на скриншоте и не содержащем подробного текста, u/FullstackSensei (470 баллов) иронизирует, что незаконными открытые веса станут только в «стране свободы». u/jld1532 (403 балла) возражает юридически: код защищён свободой слова. В то же время u/JockY (32 балла) просит прекратить постить скриншоты Twitter и не превращать r/LocalLLaMA в свалку Twitter — качество источника вызывает вопросы.
  • Дефицит оборудования, напротив, оживляет культуру «кроличьей норы». В треде 6 «The Local LLM community feels like the golden era of the internet all over again» (r/LocalLLaMA, 810 баллов, 117 комментариев, 2026-09-13) автор пишет, что невозможность полагаться на облачные вычисления вынуждает разбираться в квантизации и настройке inference engine, создавая ощущение возвращения «старого доброго интернета». Приведены измерения Qwen 3.8 Flash Next (Q38FN): на Strix Halo decode достиг 52 tok/s, prefill — 1300 tok/s. Однако u/Haron51255 (287 баллов) холодно замечает, что главная проблема саба — стены AI-текста, которые не читает даже их автор; u/mfkamil87 (138 баллов) также называет стиль поста явно AI-сгенерированным.
  • Большой интерес вызвал вопрос, используются ли локальные LLM в повседневной работе на самом деле. В треде 7 «OK guys, let's be honest 1 minute about local LLM» (r/LocalLLM, 177 баллов, 391 комментарий, 2026-09-13 — максимум комментариев среди этих тредов) u/LateralEntry (134 балла), юрист, говорит, что лишь локальная LLM действительно безопасна для конфиденциальных данных. u/cezarducatti (94 балла), преподаватель, приводит практический пример: на 3090 + 128 ГБ RAM он использует Qwen 3.8 Flash Next и построил исключительно на локальных LLM систему проверки пробных экзаменов для более чем 500 учеников. u/mb194dc (73 балла) возражает, что для большинства задач существуют решения лучше LLM.
  • Набирает популярность технический ответ на критику «предсказания следующего токена». В треде 2 «If LLMs are just predicting the next token based on training data, how do they solve unsolved math problems?» (r/NoStupidQuestions, 1 356 баллов, 381 комментарий, 2026-09-10) верхний комментарий u/Time_Entertainer_319 (3 463 балла — высший рейтинг комментария в этом треде) объясняет смысл next-token prediction, начиная с теории информации Клода Шеннона. u/skmchosen1 (17 баллов, называет себя AI-исследователем) добавляет, что предобучение действительно использует предсказание следующего токена, но при постобучении применяется RL с вознаграждением за правильное решение математической задачи, что и позволяет выходить за рамки «стохастического попугая».
  • Технический скепсис и пессимизм остаются сильными. В треде 1 «Another person disillusioned by LLM progress» (r/BetterOffline, 1 241 балл, 315 комментариев, 2026-09-12) u/OtherCommission8227 (234 балла) пишет, что AI разрушает связь между «получить ответ» и «понять». u/Street_Chemical_9679 (40 баллов), работающий инженер, говорит, что необходимость постоянно перепроверять работу агентов сделала его труд скорее тяжелее. Похожий тред 5 с тем же названием (r/AIdaily_news, 25 баллов, 52 комментария, 2026-09-13) значительно меньше, но передаёт то же настроение.
  • Популярен и историко-технический тред о происхождении transformer. В треде 3 «What actually changed 4-5 years ago that enabled AI / LLMs to be commoditised and scaled?» (r/NoStupidQuestions, 262 балла, 68 комментариев, 2026-09-09) u/MisinformedGenius (369 баллов) объясняет значение статьи «Attention Is All You Need» и одновременного появления BERT/GPT-1 в 2018 году. u/Suspicious_Chart5817 (109 баллов) уточняет, что настоящим переломом стали NVIDIA A100 2020 года и вычисления смешанной точности FP16/TF32.
  • Скандал с подозрениями в заимствовании вокруг задачи тысячелетия OpenAI (уравнений Навье—Стокса). В треде 10 «Big news is that OpenAI is nearing solving another millennium prize...» (r/singularity, 214 баллов, 68 комментариев, 2026-09-10) сообщается, что OpenAI отвергла как невозможную версию, будто история использования codex математиками Левентом/Бакмастером могла повлиять на выводы её модели. u/FateOfMuffins (61 балл) предполагает, что это может указывать на отсечение данных недавнего большого обучения 3 июля.
  • Недовольство централизацией HuggingFace пересекается с дискуссией о регулировании открытых весов. Тред 12 «The hammer dropped brothers, they are coming after your LLMS!» (r/LocalLLaMA, 0 баллов, 42 комментария, 2026-09-13) получил низкую оценку, но u/TheOneWhoWil (6 баллов) трезво отмечает: пока HuggingFace работает онлайн, переход к децентрализованным решениям не сможет реально масштабироваться.
  • Сенсационная дискуссия «LLM — когнитивный вирус». В треде 8 «Scientists Say LLMs Appear to Be Acting as a Cognitive Virus Among Humans» (r/Maxcactus_TrailGuide, 3 551 балл, 217 комментариев, 2026-09-09; особенно выдающийся результат для сабреддита с 5 302 подписчиками) u/x_xwolf (3 балла) опасается, что люди когнитивно капитулируют перед LLM и начинают верить в сознательность AI.
Сигналы
  • Набирающие силу нарративы: сегодня особенно заметны скепсис к регулированию открытых весов как к «индустриальному FUD» — страху, неопределённости и сомнению (треды 11 и 12), — а также «возрождение культуры самостоятельной сборки и настройки» на фоне дефицита оборудования (треды 6 и 7). В особенности комментарий на 564 балла в треде 11 направляет гнев не на саму идею регулирования, а на интересы тех, кто его продвигает: обсуждение смещается от техники к политике и экономике.
  • Нарративы, которые игнорируют или высмеивают: неприятие длинных текстов, написанных AI, и постов-скриншотов (треды 6 и 12) вышло в верхние комментарии. Критика u/Haron51255 «стен AI-текста» на 287 баллов показывает, что отторжение «AI-подобной прозы» стало своеобразной иммунной реакцией сообщества ещё до оценки содержания.
  • Неожиданные противостояния: технический ответ на тезис «это лишь next-token prediction» (тред 2) и пессимизм «это лишь предсказание» (треды 1 и 9) шли в один день в разных тредах, демонстрируя большую разницу в глубине технического понимания. В вопросе практичности локальных LLM также столкнулись u/cezarducatti (практическое применение в образовании, 94 балла) и u/mb194dc («есть решения лучше LLM», 73 балла): лагеря «это уже практично» и «я всё ещё скептичен» примерно равны.
  • Конкретные технические темы: название новой модели Qwen 3.8 Flash Next (Q38FN, архитектура Engram) встречается и в треде 6, и в треде 7, становясь заметной темой локального LLM-сообщества. В треде 6 приведены конкретные показатели на Strix Halo: decode 52 tok/s и prefill 1300 tok/s.
Ограничения
  • Использовался лишь один поисковый запрос — «Daily LLM News»; собрано 12 тредов, что превышает ориентир в 10. Поле «Found by searching» во всех тредах содержит один и тот же запрос; узконаправленный поиск по отдельным темам, например «новая модель GPT» или «изменение цен», не проводился.
  • Для треда 4 r/LocalLLaMA текст поста не был собран; предполагается, что он основан на скриншоте, а информация восстановлена косвенно по комментариям.
  • Reddit отклоняет WebFetch, поэтому агент прочитал только заранее собранный воркером reddit.threads.md; не были напрямую проверены все комментарии внутри тредов (собраны лишь шесть верхних, тогда как фактическое число составляет 42–391) и тексты внешних статей, включая WSJ и NYTimes.
  • Тексты статей WSJ и NYTimes, упомянутые в тредах 11 и 10, не были проверены непосредственно: доступны только ссылки и фрагменты, перепечатанные авторами Reddit-постов.

X

X — сегодняшние новости, связанные с LLM (2026-09-14)

Был изучен уже собранный output/x.posts.md (40 постов, 37 аккаунтов; запросы: "LMEOW" "Lando" "Slack" "Ireland" "Dario" "Company OS" "China" "#bb28" "Source" "Solbiscuit"). Это десять трендовых слов, которые воркер напрямую взял со страницы Explore в X. Explore геолокализован по месту подключения сервера — Хорватии; это не мировые тренды, а тренды, показанные для Хорватии. Поэтому для задачи сбора LLM-новостей точность оказалась низкой: лишь чуть больше десятой части 40 постов действительно связаны с LLM/AI. Ниже — их содержание.

Аккаунты

Реально двигали LLM-тему лишь немногие аккаунты.

  • @DarioAmodei (Дарио Амодеи, CEO Anthropic) — всего один пост, но 83 901 лайк, 25 525 репостов и около 66 000 000 просмотров: один из крупнейших всплесков во всём X за день. Он стал исходной точкой сегодняшней LLM-дискуссии.
  • @sama (Сэм Альтман, CEO OpenAI) — также один пост, ответ Дарио: 64 398 лайков и около 15 000 000 просмотров. Это не самостоятельная новость, а присоединение к позиции Дарио.
  • @BrianRoemmele (Брайан Рёммеле) — 3 поста, в сумме около 1 722 лайков (658 + 325 + 739). Вместо одного крупного вирусного поста он весь день последовательно продвигал одну мысль: США не должны замедляться, иначе победит Китай.
  • @BenjaminPDixon (Pastor Ben) — один пост, 837 лайков, около 12 000 просмотров. Единичное политическое мнение о регулировании AI.
  • @akshay_pachaar (Akshay) — один пост, 765 лайков, около 72 000 просмотров. Практическое объяснение методов оценки LLM, не связанное с новостным циклом.
  • @3n0cH_31415Pi (Enoch) — один пост, лишь 2 лайка; небольшой аккаунт, недовольный переходом AI-инструментов программирования Cursor, Codex и Grok на оплату по потреблению.
Посты
  1. Эссе Дарио Амодеи «We Must Pace the Frontier» (#18, 83 901 лайк, 25 525 репостов, 9 403 ответа, около 66 000 000 просмотров, 2026-09-12). Автор предлагает трёхэтапный план замедления AI-индустрии и сообщает, что Anthropic на первом этапе односторонне обещает «предоставить сторонним оценщикам постоянный доступ на уровне сотрудников». Это центральная LLM-новость дня в X.
  2. Поддерживающий ответ Сэма Альтмана (#19, 64 398 лайков, 11 045 репостов, 4 856 ответов, около 15 000 000 просмотров, 2026-09-12). «Я согласен с Дарио. Мы также обсуждали это в OpenAI в последние недели. Предоставить независимым оценщикам такой же доступ, как сотрудникам, — хорошая идея, и мы сделаем то же самое». Две крупнейшие компании закрытого лагеря синхронизировались в один день.
  3. Возражение Брайана Рёммеле (#20, 658 лайков, 141 репост, 72 ответа, около 93 000 просмотров, 2026-09-12). «CHINA IS NOT "PACING"». Он утверждает, что располагает сведениями о следующем поколении моделей и складных GPU-чипах, а месяц «замедления» Дарио навсегда отдаст преимущество Китаю.
  4. Ещё один пост Брайана Рёммеле (#25, 739 лайков, 71 репост, 159 ответов, около 54 000 просмотров, 2026-09-12). «Я учу мандаринский. В таком темпе Америка разрушит себя отключением; Китай победит в AI, и вам тоже стоит учить китайский» — продолжение той же линии.
  5. Pastor Ben (@BenjaminPDixon) (#17, 837 лайков, 157 репостов, 44 ответа, около 12 000 просмотров, 2026-09-12). Иронично комментирует, что желание остановить AI привело к тому, что Илон, Сэм, Дарио и весь Вашингтон ринулись к регулированию; когда корпорации и политики в последний раз действовали, прислушавшись к людям?
  6. Akshay Pachaar — «11 методов оценки LLM» (#35, 765 лайков, 138 репостов, 53 ответа, около 72 000 просмотров, 2026-09-12). Практический тред, рекомендуемый к сохранению: оценивать LLM сложно, потому что одного показателя недостаточно. Независимый от новостного цикла технический контент.
  7. Критика тарификации AI-инструментов от Enoch (@3n0cH_31415Pi) (#24, 2 лайка, 1 репост, около 117 просмотров, 2026-09-13). «Cursor, Codex, Grok Bot: три хороших продукта — три счётчика, прибитых к стене. Вы больше не клиент, вы и есть оставшееся время». Небольшой аккаунт, но характерный бытовой отклик на оплату по использованию AI-инструментов для программирования.
  8. Содержание тренда «Company OS» практически не связано с AI (#21#23). В хорватском Explore «Company OS» было трендом, но реальные результаты касались анализа cash burn дешёвой акции $LGHL и рекламы игры «Limbus Company», а не ОС для AI-компаний. Это показательный случай расхождения между названием тренда и его содержанием.
Сигналы
  • Набирающий силу нарратив: предложение Амодеи о «замедлении темпа» и немедленная поддержка OpenAI сделали согласованную линию двух лидеров закрытого лагеря — «саморегулирование и независимая оценка» — главным движением дня. Одновременно Брайан Рёммеле в нескольких постах продвигал контртезис «замедление лишь помогает Китаю», показывая разногласия и внутри закрытого лагеря.
  • Нарратив, который игнорируют или высмеивают: тезис Рёммеле об угрозе Китая опирается на конкретные, но непроверяемые заявления о моделях следующего поколения и складных GPU-чипах. В рамках этого сбора иных подтверждающих источников не найдено.
  • Неожиданное наблюдение: из десяти трендов X Explore — LMEOW, Lando, Slack, Ireland, Dario, Company OS, China, #bb28, Source, Solbiscuit — лишь «Dario» и «China» были напрямую связаны с LLM/AI, причём почти всё свелось к одной цепочке Дарио/Сэм/Рёммеле. «Company OS» был темой дешёвой акции и игры, а «Source» включал лишь один пост об оценке LLM среди индийских выборов и военных новостей. По названиям трендов нельзя надёжно предсказать содержание — это само по себе важный вывод дня.
Ограничения
  • Запросами были не ключевые слова по LLM, а десять трендов X Explore, показанных воркеру и B-сессии как доступ из Хорватии. Поэтому среди 40 постов только 7–8 прямо относятся к LLM/AI; требуемого минимума в 10 материалов нет. В файл включено лишь найденное.
  • Колонка «Posts on X» в списке Explore была пустой ("—") для всех трендов, поэтому реальный объём публикаций по каждому тренду неизвестен.
  • Тренды Explore основаны на хорватской локации и, вероятно, отличаются от мировой, американской или японской картины. Формулировка «самое обсуждаемое сегодня» в этом файле ограничена данным условием.
  • Для заявлений Брайана Рёммеле о «китайской модели следующего поколения» и «складных GPU-чипах» не найдено иных подтверждений.

YouTube

YouTube — Ежедневные новости LLM

Каналы
  • AICodeKing — канал, специализирующийся на бенчмарках локальных LLM и моделей открытых весов. Почти полностью охватил основные модели дня: сравнения GPT-6 Astra и Fable 5.1, Qwen 3.8 Flash Next и GLM-5.3 Flash. Число подписчиков не подтверждено.
  • Tech2WiLD (@Tech2wild1) — канал о проверках локального AI на нескольких GPU. Более 1 млн подписчиков по данным внешних поисковых упоминаний, без подтверждения на странице канала. Выпустил сравнение Qwen 3.8 Flash Next и GLM 5.3.
  • AI Revolution (@airevolutionx) — специализированный канал AI-новостей. 536 тыс. подписчиков и 1,65 млн просмотров за последние 30 дней по внешним агрегаторам вроде vidIQ. Есть обзор Fable 5.1.
  • Boxmining / Superbash (@BoxminingAI) — исходно криптовалютный канал, расширившийся на AI-обзоры. Число подписчиков не подтверждено. Рассматривает соотношение цены и качества GPT-6 Astra.
  • Fahd Mirza — автор объяснений по локальным LLM. Проверяет GLM-5.3-Flash, ранее известную как Ox Alpha, в локальной среде. Число подписчиков не подтверждено.
  • How I AI — канал о практическом применении AI. Ранний обзор GPT-6 Astra. Число подписчиков не подтверждено.
  • AskwhoCastsAI — канал, озвучивающий и представляющий тексты, включая эссе Дарио Амодеи; базируется на Substack. Вероятно, небольшой; число подписчиков не подтверждено.
  • AI時短ラボ (@ai_jitan_lab) — японский канал с объяснениями AI. Сводно разбирает эссе Амодеи и реакцию лидеров отрасли. Число подписчиков не подтверждено.
Видео
  1. We Must Pace the Frontier - By Dario Amodei — AskwhoCastsAI — примерно 2026-09-12 — просмотры неизвестны — https://www.youtube.com/watch?v=_Q8w9z9cQYU — Озвучивание полного текста опубликованного в тот же день эссе Амодеи о необходимости замедления AI-индустрии.
  2. ダリオ・アモディ『AIの進歩を遅らせるべきだ』 イーロン、サム・アルトマン、アンドレイ・カーパシー、ハサビスも同意|ダリオ・アモディ新エッセイ『We Must Pace the Frontier』 — AI時短ラボ — примерно 2026-09-12–13 — просмотры неизвестны — https://www.youtube.com/watch?v=CCY0tBUIj5I — Японское резюме тезисов эссе Амодеи: трёхэтапного плана замедления, одностороннего обещания дать независимым оценщикам доступ уровня сотрудников и немедленной поддержки со стороны Маска, Альтмана, Карпати и Хассабиса.
  3. GPT-6 Astra Is THE BEST Model so far (Worth the cost?) — Boxmining (Superbash) — примерно 2026-09-07 («неделю назад») — просмотры неизвестны — https://www.youtube.com/watch?v=wg90346Tz3I — Проверка того, оправдывает ли модель цену, через стоимость, бенчмарки, рабочие процессы и 3D-демо.
  4. GPT-6 Astra blew away every one of my benchmarks — How I AI — примерно 2026-09-07 («неделю назад») — просмотры неизвестны — https://www.youtube.com/watch?v=AniiF8rOu9c — Ранний доступ: автор сообщает, что GPT-6 Astra справилась с задачами, которые прежние модели не решали.
  5. GPT-6 Astra (Fully Tested & Side by Side comparison with Fable 5.1): ONE is a CLEAR WINNER! — AICodeKing — примерно 2026-09-07 — просмотры неизвестны — https://www.youtube.com/watch?v=Wdr6-S_dnQ0 — Прямое сопоставление GPT-6 Astra и Fable 5.1 по KingBench 3, четырём длительным задачам программирования и итоговому превосходству.
  6. Fable 5.1 Just Put Anthropic Back On Top — AI Revolution — примерно 2026-09-01 (сразу после релиза, «две недели назад») — просмотры неизвестны — https://www.youtube.com/watch?v=SFUrygD3DOA — Утверждается, что ключевое изменение не в обычном улучшении характеристик, а в снижении стоимости чтения кэша на 75% и общих затрат на агентную работу на 25–45%.
  7. GLM-5.3-Flash: The Ox Alpha Mystery, Finally Tested — Fahd Mirza — 2026-08–09 («2–3 недели назад») — просмотры неизвестны — https://www.youtube.com/watch?v=vSt0c-vzWp4 — Локальная проверка истории о том, как анонимная модель, доминировавшая в бенчмарках под именем «Ox Alpha», оказалась GLM-5.3-Flash от Z.ai.
  8. Qwen 3.8 Flash Next (Fully Tested & VS GLM-5.3 Flash): You can run it LOCALLY! & IT'S CRAZY! — AICodeKing — 2026-08–09 («две недели назад») — просмотры неизвестны — https://www.youtube.com/watch?v=KAyYP19CfCU — Локальный запуск Qwen 3.8 Flash Next (176B MoE, 6B активных параметров) и сравнение с GLM-5.3 Flash.
  9. Qwen 3.8 Flash Next Might Be the 2-Spark KING... GLM 5.3 Has Competition! — Tech2WiLD — 2026-08–09 («две недели назад») — просмотры неизвестны — https://www.youtube.com/watch?v=z8xlSd1d99A — Оценка конкуренции с GLM-5.3 при использовании в небольших локальных средах уровня DGX Spark.
Сигналы
  • Тема закрытого лагеря почти целиком сводится к «Pace the Frontier». Видео об эссе Амодеи, опубликованном 2026-09-12, сразу появились на нескольких языках — у англоязычного AskwhoCastsAI и японского AI時短ラボ. YouTube так же быстро распространяет эту тему, как X и Reddit. Однако реакция там пока в основном представлена озвучками и сводными объяснениями: моментальные столкновения позиций, подобные возражениям Рёммеле в X, ещё не превратились в видео.
  • Контента со сравнениями моделей много. Несколько каналов независимо выпустили прямые сравнения GPT-6 Astra × Fable 5.1 и Qwen 3.8 Flash Next × GLM-5.3 Flash, что показывает практический интерес аудитории к вопросу «какая из моделей сильнее».
  • Главная арена открытых весов — реальные локальные запуски. Специализированные каналы Tech2WiLD, AICodeKing и Fahd Mirza часто показывают форматы «живого бенчмарка»: запускают Qwen 3.8 Flash Next и GLM-5.3-Flash на собственных GPU. Это тот же фокус, что и в r/LocalLLaMA, где обсуждались реальные показатели Qwen 3.8 Flash Next, включая decode 52 tok/s.
  • Раскрытие личности GLM-5.3-Flash стало отдельным сюжетом. То, что ранее анонимная бенчмарк-модель «Ox Alpha» позднее оказалась GLM-5.3-Flash от Z.ai, стало завязкой для нескольких роликов.
Ограничения
  • Прямой доступ к страницам видео и каналов YouTube был заблокирован. При открытии youtube.com/watch?v=... или youtube.com/@channel/about через WebFetch возвращалась только навигация нижней части сайта либо происходило перенаправление на экран согласия consent.youtube.com; просмотры, точные даты и количество подписчиков нельзя было прочитать напрямую.
  • Поэтому заголовки и названия каналов получены через endpoint oembed YouTube (youtube.com/oembed?url=...), а даты заменены относительными отметками из поисковой выдачи — «неделю назад», «две недели назад» и т. п., пересчитанными от 2026-09-14. Точные просмотры не подтверждены ни для одного видео в этом файле.
  • По той же причине число подписчиков почти нигде не подтверждено. Для AI Revolution и Tech2WiLD приведены лишь ориентировочные упоминания из внешних агрегаторов, например vidIQ; это непроверенная вторичная информация.
  • Целевой критерий «5–12 наблюдений по видео» выполнен, но даты в разделах «дата и ссылка» остаются приблизительными. Комментарии на страницах роликов также недоступны; описания в разделе «Видео» — сводки по сниппетам поиска и заголовкам, а не первичная информация, полученная при просмотре роликов.

Bluesky

Bluesky — сегодняшние новости, связанные с LLM (2026-09-14)

Главный вывод: в Bluesky не удалось увидеть новые посты именно в текущий момент. Причины приведены в разделе «Ограничения». Вместо этого по отдельным постам и профилям, оставшимся в индексе поисковиков, были собраны темы, которые AI-исследовательское сообщество Bluesky действительно обсуждало в последние две недели. В центре были две новые закрытые модели: OpenAI «GPT-6 Astra» (анонс 2026-09-03) и Anthropic «Claude Fable 5.1» (GA 2026-09-01).

Аккаунты
  • Ethan Mollick (@emollick.bsky.social) — профессор Уортона. Регулярно публикует в Bluesky ранние обзоры новых моделей; оба найденных в этот раз поста принадлежат ему.
  • Simon Willison (@simonwillison.net) — независимый разработчик. Оценивает новые модели, закрытые и открытые, собственным бенчмарком: просит нарисовать SVG с пеликаном на велосипеде; результаты публикует в блоге simonwillison.net и Bluesky. Версия сравнения пеликана для GPT-6 Astra подтверждена статьёй блога от 2026-09-04, но текст соответствующего поста Bluesky в этот раз не найден.
  • Nathan Lambert (@natolambert.bsky.social) — interconnects.ai. Постоянно публикует годовые обзоры открытых моделей и анализ отдельных релизов, однако найденные при этом поиске конкретные посты относились к концу 2025-го и первой половине 2026-го; новых постов, связанных с сегодняшними новостями, не подтверждено.
  • Gary Marcus (@garymarcus.bsky.social) — заметный скептик AI/AGI. В X он сразу после анонса GPT-6 Astra отреагировал, что заявление Дженсена Хуана «AGI уже наступил» не имеет ни доказательств, ни определения; но не удалось подтвердить, что тот же текст был опубликован в Bluesky.
  • trending.bsky.app — неперсональный аккаунт/фид с трендами Bluesky. «GPT-6 Astra» присутствует там как одна запись, но это агрегированный фид, а не пользовательский пост, поэтому в раздел «Посты» он не включён.
Посты
  1. Ethan Mollick — ранние впечатления от Claude Fable 5.1 (bsky.app/profile/emollick.bsky.social/post/3mui3rgx72c2v, примерно 2026-09-01). Он пишет, что модель действительно продвинулась в длительных задачах, требующих суждения и вкуса, однако прирост в количестве «типично Claude-подобных формулировок» невелик. В качестве примера приложена сделанная Fable 5.1 игра об управлении космическим кораблём в духе FTL — «COLD WATCH». Лайки и репосты недоступны (см. «Ограничения»).
  2. Ethan Mollick — ранние впечатления от GPT-6 Astra (bsky.app/profile/emollick.bsky.social/post/3muna4w24bs2z, примерно 2026-09-05–07). Моллик называет GPT-6 Astra «stunning» и показывает демо: модель создала историческую симуляцию Александрийской библиотеки как пример автономной работы в течение нескольких дней. Лайки и репосты недоступны (см. «Ограничения»).

Эти два пункта — все посты Bluesky, текст которых удалось подтвердить доступными методами. До целевого порога в 10 они не дотягивают (подробности — в «Ограничениях»).

Сигналы
  • Наиболее обсуждаемая тема дня (предположение): оба найденных поста — это отзывы Моллика после раннего доступа. Из этого можно предположить, что LLM-дискуссия в Bluesky менее ориентирована на мгновенные новости и больше — на оценки исследователей и практиков, действительно попробовавших модели. Культура «пеликан-бенчмарка» Саймона Уиллисона, при которой с каждым новым релизом сравнивают SVG-пеликанов, поддерживает тот же вывод.
  • Закрытый лагерь против открытых весов: оба подтверждённых поста относятся к закрытым моделям — Fable 5.1 и GPT-6 Astra. Реакции Bluesky на популярные сегодня открытые модели GLM-5.3-Flash, DeepSeek V4 и Kimi K3 искались, но не были идентифицированы.
  • Атмосфера платформы: когда 2026-03-28 Bluesky запустил собственную AI-функцию «Attie», пользователи за три дня заблокировали её более 120 тыс. раз, вызвав сильную негативную реакцию (TechCrunch). Это не сегодняшняя тема, но она может объяснять, почему отношение Bluesky к LLM-новостям выглядит более сдержанным и ориентированным на специалистов, чем у других соцсетей.
Ограничения
  • Поисковый API (public.api.bsky.app / api.bsky.app) для app.bsky.feed.searchPosts в этой среде постоянно возвращал 403 Forbidden и ни разу не выдал данные постов. Смена запросов, включая LLM и Claude, ничего не изменила; вероятна блокировка как бота.
  • Страницы поиска и постов bsky.app используют клиентский рендеринг (React SPA), поэтому инструмент получения страниц не смог извлечь текст, дату или лайки, кроме имени аккаунта. Даже при прямом открытии URL поста содержимое возвращалось пустым.
  • Поэтому оставался только способ восстановления текста по сниппетам отдельных страниц bsky.app, ранее проиндексированным Google/Bing и другими поисковиками. Нормальный поиск и чтение свежих постов выполнить не удалось: практически все новые, ещё не попавшие в индекс записи принципиально недоступны.
  • В итоге порог «10 материалов с датой и ссылкой» не достигнут: текст подтверждён лишь для двух постов. Лайки и репосты не получены ни для одного.
  • По Натану Ламберту, Саймону Уиллисону и Гэри Маркусу были подтверждены существование аккаунтов и тематическая связь, но не удалось определить тексты постов около 2026-09-14.
  • Реакции Bluesky на открытые модели — GLM-5.3-Flash, DeepSeek V4, Kimi K3 и др. — искались, но не найдены.

Lemmy

Lemmy — темы LLM на 2026-09-14

Сообщества
  • !«メールアドレス» — 41 000 локальных / 88 000 совокупных подписчиков, 21 700 постов и 950 тыс. комментариев. Технологическое сообщество общего профиля, где новости об OpenAI часто выходят наверх.
  • !«メールアドレス» — 116 локальных / 409 совокупных подписчиков, 45 постов и 82 комментария. Специализированное LLM-сообщество, преимущественно о локальных LLM, ценах API и бенчмарках.
  • !«メールアドレス» — 1,11 тыс. локальных / 2,99 тыс. совокупных подписчиков, 68 постов и 268 комментариев. Много публикаций о будущем AI.
  • !«メールアドレス» (федеративный инстанс, доступен через lemmy.world) — сообщество с резко критичным отношением к AI. Именно отсюда пришёл пост с наибольшим рейтингом в этой выборке.
  • !«メールアドレス» — лишь 3 локальных подписчика и 0 постов. Фактически неактивно; вероятно, обсуждения r/LocalLLaMA приходят через кросспосты Reddit в !ai_reddit и похожие сообщества.
Посты
  1. «Pluralistic: LLMs are real, AI is fake» — !«メールアドレス», рейтинг 293, 40 комментариев, 2026-09-12T21:00 UTC. Кросспост статьи из блога Cory Doctorow Pluralistic. Тезис: LLM существуют, а «AI» — лишь маркетинговый ярлык; в комментариях развернулся горячий спор. https://lemmus.org/post/25350034
  2. «LLMs are real, "AI" is fake» (другой кросспост той же статьи) — !«メールアドレス», рейтинг 90, 10 комментариев, 2026-09-13T16:08 UTC. https://lemmy.dbzer0.com/post/75423574
  3. «OpenAI's feud with mathematicians is only escalating» — !«メールアドレス», рейтинг 132, 2026-09-13. Кросспост статьи TechCrunch о нарастающем конфликте OpenAI с математическим сообществом вокруг заявлений о бенчмарках, включая утверждения о решении нерешённых задач. https://techcrunch.com/2026/09/11/openais-feud-with-mathematicians-is-only-escalating/
  4. «Closed Source AI released their best model: GPT-6 Astra. That same week a Chinese Open-Source model was at 98% of its capability» — !«メールアドレス» (найден через поиск lemmy.world), рейтинг 22, 2026-09-12T13:38 UTC. Пост указывает на сокращение разрыва между закрытой GPT-6 Astra и открытыми моделями. https://futurology.today/post/12093939
  5. «Iran used Claude to target US Navy in Middle East, Anthropic says» — !«メールアドレス», рейтинг 6, 2026-09-12. Ссылка на статью Navy Times: Anthropic сообщила о военном злоупотреблении Claude, связанном с иранскими участниками и нацеленном на персонал ВМС США. https://lemmy.world/post/51820427
  6. «OpenAI just wants to win» — !«メールアドレス», рейтинг 6, 2026-09-12T15:00 UTC. Ссылка на статью The Verge о споре OpenAI с Тристаном Бакмастером, заявившим о решении математической задачи тысячелетия. https://www.theverge.com/ai-artificial-intelligence/994255/openai-millennium-prize-problem-tristan-buckmaster-competition
  7. «Chain of Thought in vendita: Alibaba, Moonshot e DeepSeek hanno prosciugato Claude» — !informatica (итальянский инстанс), рейтинг 2, 2026-09-12. Материал с утверждением, что данные chain-of-thought Claude были «выкачаны» китайскими игроками Alibaba, Moonshot и DeepSeek. https://insicurezzadigitale.com/
  8. «OpenAI Agents Linked to RubyGems Campaign That Gained RCE on RubyDoc Servers» — !«メールアドレス», рейтинг 9, 2026-09-13. Статья по безопасности связывает агентов OpenAI с атакой на цепочку поставок через RubyGems, приведшей к RCE на серверах RubyDoc. https://thehackernews.com/2026/09/openai-agents-linked-to-rubygems.html
  9. «China Proposes Open-Source AI Platform For BRICS At Summit» — !«メールアドレス», рейтинг 4, 2026-09-13. Сообщение о предложении Китая создать открытую AI-платформу на саммите BRICS — заметный геополитический шаг открытого лагеря. https://www.telesurenglish.net/china-open-source-ai-platform-for-brics/
  10. «Does Edge0's 2.9 GB peak for a 35B MoE hold up once the prompt gets long?» — !«メールアドレス», рейтинг 4, 0 комментариев, 2026-09-12. Техническое обсуждение использования памяти локальной LLM — 35B MoE-модели Edge0. https://lemmy.world/post/51821880
  11. «Community LLM benchmark questions (brainstorm) continual development» — !«メールアドレス», рейтинг 2, 1 комментарий, 2026-09-09. Брейншторминг о создании собственного общественного LLM-бенчмарка. https://lemmy.world/post/51688627
Сигналы
  • Самой обсуждаемой темой дня был не отдельный анонс модели, а скепсис к самому понятию AI: «LLM существуют, а AI — лишь рекламное преувеличение» (посты 1 и 2, суммарно более 300 баллов). На Lemmy сильнее всего резонирует общий скепсис к AI, а не спор между закрытыми и открытыми лагерями.
  • Параллельно идут несколько критических сюжетов об OpenAI: возражения против заявлений о математических бенчмарках (посты 3 и 6), подозрения в военном использовании Claude (пост 5) и связь с атакой на цепочку поставок (пост 8). Тон аудитории Lemmy в отношении OpenAI и закрытого лагеря в целом заметно критичный.
  • Открытые веса упоминаются как догоняющая сила: сокращение разрыва с GPT-6 Astra (пост 4), предложение Китаем открытой AI-инфраструктуры для BRICS (пост 9), утверждение о перетекании CoT-данных Claude к китайским игрокам (пост 7). В совокупности это указывает на тенденцию: к заявлениям закрытого лагеря относятся скептически, а сближение возможностей открытых моделей воспринимают благожелательно.
  • Само !«メールアドレス» имеет мало подписчиков — 116 локальных, — но там регулярно появляются темы практического использования локальных LLM: память и проектирование бенчмарков.
Ограничения
  • Lemmy значительно меньше других соцсетей по числу пользователей и постов; публикаций строго за «сегодня» было мало. Хотя найдено 10 материалов, их даты распределены от 2026-09-09 до 09-13; за 09-14 не найдено ни одного.
  • В выдачу поискового API попало много федеративных постов с других инстансов — lemmy.durstig.online, lemmy.dbzer0.com, lemmus.org и др. Из-за задержек кэша рейтинги и число комментариев могут немного отличаться от фактических.
  • Страницу сообщества !«メールアドレス», включая число подписчиков, получить напрямую не удалось: ответ был пустым или с ошибкой 500. Размер сообщества не подтверждён.
  • !«メールアドレス» почти неактивно — 3 подписчика и 0 постов. Поэтому обсуждение локальных LLM в основном зависит от !«メールアドレス» и кросспостов с Reddit, например через !ai_reddit.

Рекомендуемые действия

  • Продолжать отслеживать выполнение конкретного обещания «Pace the Frontier»: дать независимым оценщикам доступ на уровне сотрудников.
  • Регулярно наблюдать за практическими бенчмарками Qwen 3.8 Flash Next в сообществе локальных LLM.
  • Перейти в X от трендов Explore, зависящих от хорватской локации, к прямому поиску по LLM-ключевым словам.
  • Пересмотреть доступ к поисковому API Bluesky с ошибкой 403 либо обеспечить альтернативный канал доступа.
  • Следить за расширением дискуссии о регулировании открытых весов после статьи WSJ и реакцией сообщества.
  • Рассмотреть другие способы получения просмотров и точного времени публикации YouTube, помимо oEmbed.

Примечание о качестве данных

В X релевантных постов было мало, потому что тренды Explore были привязаны к хорватской локации. В Bluesky поисковый API был заблокирован ответом 403, поэтому удалось подтвердить текст лишь двух постов. Reddit и Lemmy выполнили количественные требования, но в Lemmy даты были распределены по нескольким дням; YouTube выполнил требование по числу видео, но просмотры и даты не подтверждены.