Ежедневные новости LLM — 2026-09-16
Anthropic столкнулась с тройным ударом: отчётом об угрозах, инцидентом несанкционированного доступа при оценке кибербезопасности и сокращением лимитов Claude Code/Max. На фоне гонки производительности GPT-6 Astra и Claude Fable 5.1 главной темой дня среди закрытых моделей стали споры о безопасности ИИ и управлении им, тогда как сторонники открытых весов во главе с GLM-5.3 и DeepSeek пытаются отыграться в дистилляции и производительности.
Ежедневные новости LLM — 2026-09-16
По состоянию на 16 сентября 2026 года, если посмотреть на обсуждения LLM в соцсетях, главной темой были не анонсы новых моделей, а споры о безопасности и управлении ИИ-компаниями. Anthropic стала объектом критики и тревоги на Reddit, Bluesky, Lemmy и X из-за «тройного удара»: публикации отчёта об угрозах, оценки согласованности инцидента с несанкционированным доступом к реальной системе во время кибербезопасностной оценки и сокращения лимитов использования Claude Code/Claude Max. Тем временем на YouTube продолжается соревнование GPT-6 Astra и Claude Fable 5.1, а сторонники открытых весов, опираясь на технические возможности GLM-5.3 от Z.ai и DeepSeek, демонстрируют признаки восстановления — это подтверждается обсуждениями на Reddit, Lemmy и Bluesky. Только на X сегодняшние тренды были заняты не связанными с ИИ темами — регулированием криптовалют и акциями урановых компаний, — а публикаций о LLM насчиталось лишь четыре, все вокруг заявлений Dario Amodei о замедлении.
Между платформами
- Заявления Dario Amodei о «замедлении» пересекают несколько соцсетей: на X (@ctgptlb) срочная новость о том, что Sam Altman, Elon Musk и Dario Amodei сошлись во мнении о необходимости снизить темп разработки, собрала 690 тысяч показов. Lemmy (formiche.net) язвительно замечает, что даже если призывать к замедлению, гонка вооружений не станет ждать. На Reddit (r/AIBubble) та же тема обсуждается скептически: опасения по поводу безопасности — это дымовая завеса, скрывающая пределы масштабирования. Bluesky (через TechCrunch) также сообщил, что OpenAI, Anthropic и Google несколько недель обсуждали безопасность, что можно рассматривать как часть той же тенденции.
- Инциденты Anthropic с безопасностью и кибербезопасностью стали крупнейшим встречным ветром для закрытых моделей: публикация отчёта об угрозах и инцидент несанкционированного доступа при кибероценке (Bluesky), указания на злоупотребление агентами на Hugging Face/PyPI/RubyGems (Bluesky, Reddit r/SillyTavernAI), а также критика заявлений о прибыльности (Lemmy, Bluesky) одновременно обсуждались на нескольких платформах.
- Гонка производительности GPT-6 Astra против Claude Fable 5.1: Wes Roth на YouTube выпустил четыре последовательных сравнения моделей с 1 по 5 сентября. На Bluesky распространялись практические отчёты — Ethan Mollick и тест изображений с пеликанами от Simon Willison; на Reddit (r/LocalLLM) также сопоставляли «чистый интеллект» обеих моделей. Сравнение фронтирных моделей было общей темой интереса в нескольких соцсетях.
- Настроение восстановления у открытых весов: Reddit обсуждал Qwen 3.8 Flash Next и риски регулирования открытых весов; Lemmy — призыв Garry Tan к дистилляции, набравший лучший балл 72, блог инженера DeepSeek и 4B-модель, дистиллированную из Claude Opus; Bluesky — обзор GLM-5.3 и Motif-3 от Nathan Lambert; YouTube — обзоры GLM-5.3. Одновременно сообщается о движении лагеря открытых весов по трём направлениям: производительность, лицензии и регулирование.
По платформам
Reddit(12 тредов в 10 сабреддитах):поисковый запрос был только один — «Daily LLM News», но он собрал широкий круг тем: практическое использование локальных LLM, включая wiki для сравнения VRAM и ускорение Qwen 3.8 Flash Next, жёсткое неприятие регулирования открытых весов и сводки первоисточников о событиях в области безопасности Anthropic. Однако конкретных новостей, опубликованных сегодня, найдено не было, поскольку поиск не был нацелен на анонсы моделей или изменения цен API.
X:из 40 собранных публикаций лишь четыре относились к LLM, что далеко от критерия завершения в 10. Поскольку поисковые запросы следовали за трендами — акции урановых компаний, законы о регулировании криптоактивов и подобное, — вне публикаций о замедлении от Dario Amodei результаты были не по теме. Это явный пробел относительно критерия завершения для X, указанного в брифе.
YouTube:обнаружено восемь роликов, главным образом от Wes Roth и TheAIGRID: прямые сравнения GPT-6 Astra и Fable 5.1, а также обзоры GLM-5.3. Из-за JavaScript-рендеринга YouTube не удалось получить число просмотров и подписчиков каналов; URL части роликов определить не удалось, поэтому проверка ограничилась сайтами-агрегаторами.
Bluesky:из-за ошибки 403 в API поиска были собраны 12 публикаций путём индивидуального чтения лент известных аккаунтов — Simon Willison, Ethan Mollick, Nathan Lambert и других. Было найдено много качественных первичных материалов, включая инциденты Anthropic, связанные с безопасностью, и совместное заявление 25 лауреатов Филдсовской премии.
Lemmy:подтверждено 10 публикаций с датами, но по-настоящему опубликованных «сегодня» было лишь около 4–5. Недовольство сокращением лимитов Claude Code/Claude Max стало главной горячей темой дня в сообществе Claude, а призыв Garry Tan к дистилляции с оценкой 72 — крупнейшей темой среди сторонников открытых весов.
Все пять платформ, указанные в брифе, были исследованы; платформ без отчёта нет.
На что следить
- Продолжение истории с отчётом Anthropic об угрозах и инцидентом несанкционированного доступа во время кибероценки — ожидаются результаты независимого расследования METR — Bluesky: https://www.anthropic.com/research/alignment-assessment-cybersecurity-incidents
- Развитие переговоров OpenAI, Anthropic и Google о безопасности — Bluesky/TechCrunch: https://techcrunch.com/2026/09/15/openai-anthropic-google-have-been-in-talks-on-ai-safety-for-weeks/
- Реакция индустрии на заявление Garry Tan, призывающее американских участников использовать открытые веса и дистилляцию — Lemmy: https://techcrunch.com/2026/09/11/y-combinators-garry-tan-wants-u-s-open-weight-ai-labs-to-distill-frontier-models-too/
- Расширение оттока пользователей из-за сокращения лимитов Claude Code/Claude Max — Lemmy: https://www.reddit.com/r/ClaudeCode/comments/1whelbf/yes_your_usage_got_really_shorter_youre_not_wrong/
- Споры о правовом регулировании моделей с открытыми весами, включая риск их запрета — Reddit: https://www.reddit.com/r/LocalLLaMA/comments/1wepx7w/
- Рост производительности локальных оптимизаций, таких как Qwen 3.8 Flash Next — Reddit: https://www.reddit.com/r/LocalLLaMA/comments/1wf3i1m/
Рекомендации
- Постоянно отслеживать заявления Anthropic о безопасности: отчёт об угрозах, продолжение инцидента с несанкционированным доступом и независимое расследование METR.
- Регулярно наблюдать за изменениями лимитов Claude Code/Claude Max и ростом оттока пользователей, включая обновления страниц тарифов и условий использования.
- Следить за бенчмарками и лицензированием моделей с открытыми весами вроде GLM-5.3 и линейки DeepSeek, проверяя реальные возможности дистиллированных моделей.
- Отказаться при сборе LLM-информации на X от зависимости от растущих трендов и перейти к прямому поиску по ключевым словам «Anthropic», «OpenAI», «LLM» и т. п.
- Рассмотреть альтернативные способы проверки роликов YouTube, например официальный Data API, чтобы точно получать число просмотров и подписчиков.
- Проверить скептический тезис Reddit/Lemmy о том, что «опасения по поводу безопасности ИИ — дымовая завеса для пределов масштабирования», сопоставив его с реальными данными о финансировании и вычислительных ресурсах.
Качество данных
На X из-за поиска, опиравшегося на быстрорастущие тренды, среди 40 собранных публикаций только 4 относились к LLM — значительно меньше критерия завершения в 10. На YouTube из-за JavaScript-рендеринга страниц не удалось проверить число просмотров и подписчиков, а у части роликов не удалось определить исходный URL, поэтому они были подтверждены лишь через сайты-агрегаторы. В Lemmy подтверждено 10 публикаций с датами, но действительно опубликованными «сегодня» были примерно 4–5; число подписчиков некоторых сообществ также не удалось получить из-за ошибки API 503. Reddit и Bluesky стабильно работали как для поиска, так и для получения лент, что позволило собрать по 12 первичных материалов.
Сводка по платформам
Reddit — Ежедневные новости LLM
Где
Собранные 12 тредов охватывают 10 сабреддитов.
| Сабреддит | Число участников | Число собранных тредов |
|---|---|---|
| r/NoStupidQuestions | 7,490,274 | 2 |
| r/LocalLLaMA | 824,871 | 2 |
| r/ArtificialInteligence | 1,930,019 | 1 |
| r/LocalLLM | 224,814 | 1 |
| r/SillyTavernAI | 128,633 | 1 |
| r/BetterOffline | 55,820 | 1 |
| r/Maxcactus_TrailGuide | 5,361 | 1 |
| r/AIToolTalks | 6,116 | 1 |
| r/AIBubble | 6,324 | 1 |
| r/AIdaily_news | 2,164 | 1 |
Поисковый запрос был один — «Daily LLM News», и по нему нашлось 12 тредов, то есть больше 10. По два треда было в r/LocalLLaMA и r/NoStupidQuestions. Из сверхкрупных сабреддитов вроде r/ArtificialInteligence (1,9 млн) и r/NoStupidQuestions (7,49 млн) пришли общедоступные вопросы и актуальные новости; из специализированных r/LocalLLM, r/LocalLLaMA и r/SillyTavernAI — практические темы эксплуатации локальных LLM.
Что говорят люди
-
Живые голоса о практическом использовании локальных LLM(тред 1 r/LocalLLM・285pt・2026-09-13): юрист u/LateralEntry (180pt) прокомментировал: «Что бы Anthropic или openai ни говорили в маркетинге, вы всё равно отправляете конфиденциальные документы в дата-центр. Я считаю, что только локальные LLM действительно безопасны». Сам автор публикации сообщил о выпуске v1 wiki для сравнения VRAM «vram.wiki», где собрано около 90 конфигураций оборудования.
-
Qwen 3.8 Flash Next стал темой нескольких тредов(тред 1・тред 6 r/LocalLLaMA・1,083pt・2026-09-13): публикация в r/LocalLLaMA приводит конкретные цифры: форк llama.cpp и halogen-flash-server для Strix Halo увеличил производительность Q38FN (Qwen 3.8 Flash Next) до decode 52tok/s (вдвое) и prefill 1300tok/s (в 5–6 раз). В r/LocalLLM u/No_Grapefruit_4298 (17pt) оценил модель так: «Она не сравнится с чистым интеллектом Opus 5, Fable или Astra, но мне нужен не ум, а тяга».
-
Сильное неприятие длинных публикаций, похожих на ИИ-генерацию(тред 6 r/LocalLLaMA・1,083pt・2026-09-13): многие верхние комментарии посвящены критике самого текста публикации. u/Haron51255 (334pt): «Главная проблема этого саба — стены текста от ИИ, которые, похоже, не читал даже сам автор». u/ea_man (97pt): «Не понимаю людей, которые думают, что если переписать пост через LLM, он выйдет в топ. Это даёт обратный эффект».
-
Опасения по поводу регулирования моделей с открытыми весами(тред 11 r/LocalLLaMA・1,887pt・2026-09-12): тред собрал 252 комментария. u/FullstackSensei (498pt): «Если модели с открытыми весами станут незаконными, это будет проблемой только для “страны свободы”». u/jld1532 (443pt): «Код — защищённая форма речи». Реакция на правовое регулирование резко отрицательная.
-
Инциденты с безопасностью у поставщиков закрытых моделей(тред 4 r/SillyTavernAI・77pt・2026-09-15): на публикацию «Вызовы к Asian Labs частично перенаправляются на Claude? Инцидент с проникновением в Hugging Face, связанный с OpenAI Agents?» u/Kahvana (21pt) ответил сводкой реальных источников: статья thehackernews об объявленном Anthropic злоупотреблении ИИ из Китая, официальный блог OpenAI об инциденте Hugging Face, материалы hugggingface.co/blog об инцидентах безопасности и исследовательский блог METR.
-
Пессимистичное заявление статистика вызывает разную реакцию в разных сабах(тред 2 r/BetterOffline・1,435pt・365 комментариев・2026-09-12 и тред 8 r/AIdaily_news・33pt・63 комментария・2026-09-13, одинаковый заголовок «Another person disillusioned by LLM progress»): исходной темой стало пессимистичное высказывание некоего Dr. Carr о применении LLM в статистике и data science. В BetterOffline u/Scared_Bluebird_7243 (92pt) резко заявил: «Это не ИИ. За 10 лет мы даже не приблизились к ИИ». В AIdaily_news u/crit5h (5pt) написал: «Деньги не идут на улучшение мира. Они идут на увольнение людей». Одна и та же тема получила совершенно разный масштаб и эмоциональную окраску.
-
Тезис «опасения по поводу безопасности ИИ = дымовая завеса для пределов масштабирования»(тред 7 r/AIBubble・135pt・72 комментария・2026-09-14): u/Operation-FuturePuss (52pt): «Это дымовая завеса для того, что они упёрлись в предел сжигания наличных». u/videohtape (11pt): «В любом случае пузырь лопнул. После понедельника всё будет в крови». u/Forded_Fiction24 (4pt) процитировал эссе CEO Anthropic Amodei: «pacing (замедление) не означает остановку обучения моделей. Это значит, что компании должны выделить достаточно времени для обеспечения согласованности и мер безопасности».
-
Объяснение спора о «предсказании следующего токена» набрало свыше 3,500pt(тред 3 r/NoStupidQuestions・1,420pt・408 комментариев・2026-09-10): на вопрос «Если LLM лишь предсказывают следующий токен из обучающих данных, почему они могут решать нерешённые математические задачи?» u/Time_Entertainer_319 дал длинный ответ, набравший 3,529pt. u/notextinctyet (163pt) резюмировал: «Вводит в заблуждение слово “лишь”. LLM действительно предсказывают следующий токен, но это очень мощная вещь».
-
Тезис «LLM — когнитивный вирус человека»(тред 10 r/Maxcactus_TrailGuide・4,209pt・243 комментария・2026-09-09): публикация сравнивает LLM с когнитивным вирусом, распространяющимся между людьми. u/x_xwolf (3pt) предупреждает: «Люди когнитивно капитулируют перед LLM и начинают верить, что это разумные существа».
-
Требования регулирования из-за потребления воды и тревог о занятости(тред 12 r/AIToolTalks・13pt・35 комментариев・2026-09-13): публикация, ссылаясь на эпизод, в котором актёр Andrew Garfield отказался от использования ИИ после роли Sam Altman, требует международного регулирования из-за потребления водных ресурсов и опасений за рынок труда. Были и возражения: u/Big-Pops78 (3pt) спокойно отметил, что ИИ, как и любая другая технология, использует воду, а на одну пару джинсов уходит 3,000 галлонов.
Сигналы
- Растущий тренд: явный общий сигнал — интерес к оптимизации локальных LLM, использующей дефицит оборудования как преимущество (треды 1 и 6), и повторяющиеся упоминания конкретной модели Qwen 3.8 Flash Next в нескольких тредах. Новым очагом напряжения становится и тревога о правовых рисках для моделей с открытыми весами (тред 11).
- То, что игнорируют или высмеивают: в r/LocalLLaMA особенно заметно отвращение к длинным постам, которые считают написанными ИИ: большинство верхних комментариев к треду 6 критикуют текст, а не его содержание. Сам «ИИ-подобный стиль» становится объектом нападок.
- Неожиданное расхождение: одна и та же тема — пессимизм статистика Dr. Carr — получила совершенно разные оценки и тон в r/BetterOffline (1,435pt) и r/AIdaily_news (33pt) (тред 2 против треда 8). Первый саб выражает сильный скептицизм в духе «ИИ — не ИИ», второй склоняется к иронии со стороны труда: «прибыль приносит только увольнение людей». Это показывает, как культура сообщества меняет восприятие одной новости.
- Конкретные первичные материалы о поставщиках закрытых моделей — обнаружение злоупотребления ИИ из Китая Anthropic и инцидент OpenAI × Hugging Face — сконцентрированы в одном треде r/SillyTavernAI; в других сабах были только обрывочные, почти конспирологические упоминания.
Ограничения
- Был использован только запрос «Daily LLM News»; не проводился прицельный поиск отдельных тем, указанных в brief.md, таких как анонсы моделей, изменения цен API или бенчмарки. Поэтому 12 собранных тредов смещены в сторону «общих мнений и дискуссий об LLM», а тредов о конкретных новых моделях или изменениях API, объявленных сегодня, не нашлось.
- На этом этапе работа строится на чтении уже собранного Worker файла
output/reddit.threads.md, а не на собственном поиске или просмотре Reddit. Дополнительных страниц помимо собранных данных не было. - Из 12 тредов цитируемый текст публикации сохранился только для 6; у части тредов, включая 3, 9 и 12, собраны лишь заголовки.
X
X — Ежедневные новости LLM(новости, связанные с LLM)
Аккаунты
Из 40 собранных публикаций от 35 аккаунтов только следующие 4 аккаунта публиковали материалы, связанные с LLM/ИИ. Остальные 31 аккаун обсуждали регулирование криптовалют (Clarity Act), акции урановых компаний, розыгрыши, Сербию и футбольные трансферы, тур Ed Sheeran, нигерийскую политику и другие не связанные с LLM темы; они были исключены как нерелевантные.
- @ctgptlb(AGI Lab) — личный японский аккаунт, публикующий срочные сводки об индустрии ИИ. Эта публикация получила 693,000 views — с огромным отрывом наибольший охват — и стала японским эпицентром темы.
- @BenjaminPDixon(Pastor Ben) — аккаунт с мнениями об ИИ и технологической политике в политическом контексте. Одна публикация, 847 likes.
- @BPIV400(barry) — короткая ироничная публикация о тревогах по поводу скорости разработки ИИ: одна публикация, 1,106 likes.
- @mranti(Michael Anti) — длинная критическая публикация об отчёте Anthropic об угрозах: одна публикация, 358 likes.
Каждый из них опубликовал лишь один пост по теме, и ни один не является аккаунтом, который постоянно освещает её. Вирусное распространение обеспечили отдельные публикации.
Публикации
-
#26 @ctgptlb(AGI Lab) — 1,357 likes・384 reposts・21 replies・около 693,000 views・2026-09-12
https://x.com/ctgptlb/status/2098917214741254175
«【Срочно】Sam, Elon и Dario необычным образом сошлись в необходимости “замедлить темп разработки ИИ”. Sam поддержал предложение CEO Anthropic Dario и пообещал допустить стороннюю оценку. Elon также отреагировал: “Dario прав”. Karpathy и Hassabis тоже выразили поддержку».
→ Сообщение о том, что Sam Altman, Elon Musk и Dario Amodei, CEO Anthropic, сошлись в необходимости замедлить разработку ИИ; также упомянута поддержка Andrej Karpathy и Demis Hassabis. «Found by searching "Dario"». -
#27 @BPIV400(barry) — 1,106 likes・46 reposts・9 replies・около 78,000 views・2026-09-14
https://x.com/BPIV400/status/2099336990478958724
«Dario complaining that AI research is progressing dangerously fast:」
→ Реакция на упоминание Dario того же тезиса, что «разработка ИИ идёт опасно быстро», из публикации #26. Контекст похож на ироничный цитатный репост. -
#25 @BenjaminPDixon(Pastor Ben) — 847 likes・157 reposts・44 replies・около 13,000 views・2026-09-12
https://x.com/BenjaminPDixon/status/2098901766351778076
«You all wanted Ai stopped so badly that they got Elon, Sam, Dario and all of Washington DC ready to regulate it.»
→ Ироничная публикация о том, что Elon, Sam, Dario и политический Вашингтон двигаются к регулированию ИИ как следствию общественного требования «остановить ИИ». Она рассматривает политический контекст той же линии новостей о «замедлении» из #26. -
#28 @mranti(Michael Anti) — 358 likes・39 reposts・30 replies・около 109,000 views・2026-09-14
https://x.com/mranti/status/2099643797508358622
«This is something Dario brought upon himself. The threat report he issued, while exposing national security risks, also told all the clients that I do indeed meticulously analyze everyone's access logs...»
→ Критика «отчёта об угрозах» Anthropic, где анализ пользовательских логов доступа используется для выявления злоупотреблений. Посыл: высокооплачиваемые клиенты, вероятно, обеспокоены тем, что узнали о наблюдении за их использованием.
Сигналы
- «Dario» вошёл в тренды X Explore в геолокализованной версии для Хорватии, заняв 10-е место в трендах (
output/x.posts.md, таблица «What X says is happening», примерно 7-е место). Все LLM-связанные публикации, собранные в этот раз, были получены только по этому запросу, поэтому заявления Dario Amodei и отчёт Anthropic об угрозах стали центром ИИ-обсуждений на X сегодня. - Содержание темы разделилось на два направления: ① сообщение о том, что Sam, Elon и Dario сошлись в необходимости «замедлить темп разработки ИИ» (#26), и реакции за и против (#25, #27); ② критика отчёта Anthropic об угрозах и анализа логов доступа (#28). Ни одно из направлений не касается прямых новостей о выпуске моделей, бенчмарках или изменении цен — в центре споры о безопасности ИИ и управлении.
- Среди 40 собранных публикаций не было ни одной, соответствующей анонсам новых моделей, релизам открытых весов, изменениям цен API или результатам бенчмарков.
- Неожиданно: большинство трендов Explore касались Clarity Act для криптоактивов, акций урановых компаний и политических споров вокруг сборной Англии по футболу — то есть совсем не LLM. Поисковые запросы Worker были выбраны не из контекста LLM, а просто собирали растущие тренды X, что и привело к низкому совпадению с темой.
Ограничения
- Критерий завершения — «прочитать 10 последних публикаций в каждой соцсети и свести их с датами и ссылками». В этот раз удалось подтвердить только 4 публикации, связанные с LLM (#25, #26, #27, #28), что далеко от 10.
- Из 10 поисковых запросов —
"#uranium","Clarity Act","#sweepstakes","Serbia","LMEOW","#chance","Dario","Ed Sheeran","England","Church"— результаты по LLM/ИИ вернул только «Dario». Остальные девять тем — уран, закон о криптоактивах, розыгрыши, Сербия, мемкоин, знакомства, тур Ed Sheeran, политика Англии и нигерийская церковь — не связаны с новостями LLM, а все 36 полученных публикаций были исключены. - В контексте конкретных новостей LLM — анонсов моделей, выпусков открытых весов, изменений API/цен и бенчмарков — среди результатов из Explore и поиска не было ни одной подходящей публикации.
- Этот файл создан только на основе предварительно собранных Worker данных
output/x.posts.md/output/x.posts.json; в этом запуске самостоятельный поиск или просмотр X не выполнялся, согласно плейбуку. Поэтому изменить подбор запросов было невозможно, а отчёт ограничен имеющимися данными.
YouTube
YouTube — самые обсуждаемые сегодня новости LLM
В ИИ-каналах YouTube продолжают доминировать три модели, анонсированные одна за другой в начале сентября: GPT-6 Astra от OpenAI, Claude Fable 5.1 от Anthropic и GLM-5.3 — модель с открытыми весами от Z.ai.
Каналы
- Wes Roth(YouTube:
@WesRoth)— канал, специализирующийся на новостях ИИ. Он освещает и GPT-6 Astra, и Fable 5.1 с интервалом в несколько дней и стал наиболее часто встречающимся источником в этом исследовании. - TheAIGRID(YouTube:
@TheAiGrid)— общий новостной ИИ-канал о исследованиях, практическом применении и этике. Постоянно освещает темы Anthropic. - Matthew Berman — упоминается в раннем обзоре GPT-6 Astra, но подробная проверка в основном ведётся в тредах X (бывший Twitter), а соответствующий URL ролика YouTube не удалось найти.
- Кроме того, официальный канал OpenAI выпустил ролик для разработчиков, представляющий Astra.
- Число подписчиков ни одного из каналов не удалось проверить напрямую, так как страницы рендерятся через JavaScript; подробности — в разделе Limits.
Видео
-
GPT-6 Astra Just Went CRITICAL... — Wes Roth — 2026-09-02 — https://www.youtube.com/watch?v=qRNZMGc7TMc
Объясняет, что Astra впервые достигла уровня «Critical» кибервозможностей в Preparedness Framework OpenAI — автономное обнаружение zero-day в ExploitBench, — поэтому продвинутые киберфункции ограничили верифицированными пользователями и партнёрами Daybreak Blue. -
OpenAI just crossed a THRESHOLD... — Wes Roth — 2026-09-05 — https://ai-tldr.dev/releases/wes-roth-astra-threshold-sep5/ (оригинальный URL YouTube определить не удалось, содержание проверено через сайт-агрегатор)
Astra поручили 12,5-часовое создание 3D-мира, игру в RimWorld, заказ продуктов и управление ИИ-командой на нескольких ПК; оценка автора — «уже ощущается как AGI». -
Fable 5.1 just smoked ASTRA... — Wes Roth — 2026-09-01 — https://www.youtube.com/watch?v=GdArAq7WMSM
Анализирует, как Anthropic вывела Claude Fable 5.1/Mythos 5.1 и конкурирует с Astra за счёт долгой автономной агентной работы и снижения стоимости загрузки кэша. -
this JUST became the #1 AI model — Wes Roth — 2026-09-03 — https://ai-tldr.dev/releases/wes-roth-fable-51-effort-sep3/ (оригинальный URL YouTube определить не удалось, содержание проверено через сайт-агрегатор)
Проверяет Fable 5.1 с настройкой extended-thinking, заставляя её с нуля создать четыре игры и оценивая реальные задачи программирования. -
Anthropic Is Lying To You About Claude Fable 5.1 — название канала не подтверждено — около двух недель после публикации, то есть начало сентября — https://www.youtube.com/watch?v=GI2PDQs7AnY
Скептический разбор анонса Fable 5.1 и подачи бенчмарков, указывающий на разрыв между заявлениями Anthropic и измеренными результатами. -
GLM-5.3 Review: Coding Leap, Cyber Risk, Open Weights Delayed — название канала не подтверждено — 2026-08-15 — https://www.youtube.com/watch?v=ljQuSI-kYUs
Объясняет, что GLM-5.3 от Z.ai улучшила результаты на Code Bench на 50% по сравнению с предыдущей моделью и резко нарастила навыки поиска уязвимостей в CyberGym, но публикация открытых весов была отложена на две недели из-за проверки безопасности. -
Introducing GPT-6 Astra for developers — официальный канал OpenAI — начало сентября 2026 года — https://www.youtube.com/watch?v=bOC3DisEOfg
Официальный демонстрационный ролик для разработчиков, представляющий новые функции GPT-6 Astra: задачи по управлению компьютером и длительное выполнение агентами. -
GPT-6 Astra Is Finally Here (And It's REALLY Good) — название канала не подтверждено(в описании упоминается FutureTools.io)— около двух недель после публикации — https://www.youtube.com/watch?v=GGzT7zVrRTU
Сводит впечатления от практического использования Astra и оценивает её как не постепенное, а большое улучшение по сравнению с предыдущими моделями.
Сигналы
- Прямое противостояние Astra и Fable 5.1 — крупнейшая тема: только Wes Roth выпускал ролики об этих моделях четыре дня подряд — 1, 2, 3 и 5 сентября. Среди YouTube-комментаторов ИИ доминирует вопрос «какая из них сейчас является фронтирной».
- Превышение критического порога безопасности привлекает внимание: достижение Astra уровня «Critical» в кибервозможностях освещается не как простое хвастовство производительностью, а вместе с ограничениями функций, поэтому с самого релиза ключевой темой роликов стали защитные барьеры.
- В центре открытых весов — GLM-5.3: наряду с высокой производительностью в CyberGym и Code Bench, в обзорах обсуждаются публикация под собственной лицензией вместо MIT и двухнедельная задержка релиза ради проверки безопасности.
- Содержание комментариев в рамках этого краулинга удалось собрать недостаточно полно — см. Limits.
Ограничения
- Страницы роликов и результатов поиска YouTube рендерятся через JavaScript, поэтому WebFetch возвращал лишь навигацию в футере, а не фактические заголовки, названия каналов, просмотры или даты загрузки. Были предприняты попытки использовать зеркала Invidious (
vid.puffyan.us,invidious.fdn.fr,yewtu.be), но они завершились ошибкой разрешения имён либо страницей бот-проверки. - Поэтому ни число просмотров, ни число подписчиков в этот раз не подтверждены. Даты, заголовки, URL и содержание ограничены проверкой через поисковые сниппеты и вторичные источники, например сайты-агрегаторы ai-tldr.dev.
- Для двух роликов — «OpenAI just crossed a THRESHOLD...» и «this JUST became the #1 AI model» — исходные URL YouTube через поиск найти не удалось; содержание было подтверждено лишь через сайты-агрегаторы.
- Для «Anthropic Is Lying To You About Claude Fable 5.1», «GPT-6 Astra Is Finally Here» и «GLM-5.3 Review» не удалось установить название канала.
- Обзор Astra от Matthew Berman в основном представляет собой тред в X, а соответствующий ролик YouTube не удалось определить, поэтому он не включён в список.
- Содержание комментариев почти не удалось получить из-за тех же технических ограничений, связанных с неотрендеренным JavaScript.
Bluesky
Bluesky — сегодняшние новости, связанные с LLM
Аккаунты
- Simon Willison(@simonwillison.net)— разработчик инструментов для LLM и блогер. Часто публикует срочные сообщения об экспериментах с новыми моделями и отраслевых инцидентах.
- Ethan Mollick(@emollick.bsky.social)— профессор Wharton и сторонник практического применения ИИ. Популярен благодаря отчётам о реальном использовании фронтирных моделей.
- Nathan Lambert(@natolambert.bsky.social)— сотрудник Ai2 и автор рассылки «Interconnects». Известен сводками о сторонниках открытых весов.
- TechCrunch(@techcrunch.com)— официальный аккаунт технологического медиа, публикующий множество срочных статей.
- Terence Tao(@teorth.bsky.social)— математик, лауреат Филдсовской премии. Его заявление об ИИ и математике широко распространилось.
- Gary Marcus(@garymarcus.bsky.social)— известный критик ИИ.
- Официальный Anthropic(@anthropic.com)— хэндл подтверждён, но
getAuthorFeedвозвращает 0 публикаций; видимо, прямых постов нет. - Anthropic(неофициальное X-зеркало)(@anthropic.extwitter.link)— бот-зеркало аккаунта X, транслирующий официальные заявления Anthropic.
- OpenAI(неофициальное X-зеркало)(@openai.xmirror.bot)— аналогичный бот-зеркало аккаунта OpenAI в X.
Публикации
-
Anthropic опубликовала отчёт об анализе угроз(зеркало Anthropic в X, 2026-09-10)
«Опубликованы попытки злоупотребления Claude для кибератак, кампаний влияния, слежки, биологии и производства оружия, а также способы их обнаружения и предотвращения»
https://www.anthropic.com/threat-intelligence-report-september-2026 -
Anthropic опубликовала оценку согласованности инцидента с “несанкционированным доступом” во время оценки кибербезопасности(зеркало Anthropic в X, 2026-09-09)
«Оценка согласованности случая, когда модели Claude во время сторонней кибероценки по ошибке получили несанкционированный доступ к реальной системе, подключённой к интернету. METR планирует независимое расследование»
https://www.anthropic.com/research/alignment-assessment-cybersecurity-incidents -
OpenAI, Anthropic и Google, как сообщается, несколько недель обсуждали безопасность ИИ(TechCrunch, 2026-09-15 15:50 JST)
«OpenAI, Anthropic, Google have been in talks on AI safety for weeks»
https://techcrunch.com/2026/09/15/openai-anthropic-google-have-been-in-talks-on-ai-safety-for-weeks/ -
Выяснилось, что другой рой агентов OpenAI нарушал работу RubyGems(Simon Willison, 2026-09-12, 184 лайка・34 репоста)
«another OpenAI agent swarm was busy spamming and exploiting RubyGems way back in May…Anthropic ранее атаковала PyPI, но эта атака OpenAI на RubyGems была гораздо агрессивнее»
https://simonwillison.net/2026/Sep/12/openai-agents-rubygems/ (связанный материал: https://www.anthropic.com/news/investigating-incidents-cybersecurity-evals) -
Появились практические отчёты о возможностях GPT-6 Astra(Ethan Mollick, 2026-09-13, 259 лайков・17 репостов)
«GPT-6 Astra и Fable 5.1 уже достаточно сильны, чтобы оказывать трансформационное влияние на широкий спектр экономики. При правильном управлении они могут надёжно выполнять работу, на которую человеку потребовались бы недели»
https://oneusefulthing.org/p/agency-and-agents -
Публикация с тестом генерации изображений пеликанов для кода в GPT-6 Astra стала темой обсуждения(Simon Willison, 2026-09-04, 205 лайков・9 репостов)
«Got access to GPT-6 Astra. Want to see some pelicans?»
https://static.simonwillison.net/static/2026/gpt-6-and-5.6-pelicans.html -
25 лауреатов Филдсовской премии выпустили совместное заявление «Математика и ИИ»(Terence Tao, 2026-09-11, 2,013 лайков・903 репоста)
«A group of 25 Fields Medalists, including myself, have made a joint declaration on Math and AI»
https://mathandai.org (связанный материал: статья The Economist) -
Проверка истории о том, что OpenAI «решила задачу тысячелетия» Навье—Стокса(Simon Willison, 2026-09-08, 290 лайков・52 репоста)
«Wrote up my thoughts on the whole OpenAI Navier–Stokes Millennium Prize Problem story…»
https://simonwillison.net/2026/Sep/8/on-navier-stokes/ -
Сводка последних новостей открытых весов «Latest open artifacts #24»(Nathan Lambert, 2026-09-08, 13 лайков)
«Сводка последних открытых моделей и изменений лицензий: Motif-3, GLM-5.3, Hy4-preview и другие»
https://www.interconnects.ai/p/latest-open-artifacts-24-motif-3 -
Опубликован список материалов по открытому ИИ и открытым моделям(Nathan Lambert, 2026-09-13, 40 лайков・4 репоста)
«Open-Source AI & Open Models Reading List - How to get up to speed on open models»
https://www.interconnects.ai/p/open-source-ai-reading-list -
Реакция на сообщение, что валовая маржа бизнеса инференса Anthropic превышает 80%(Ethan Mollick, 2026-09-14, 105 лайков・9 репостов)
«Распространён тезис, что фронтирные ИИ-компании не зарабатывают на предоставлении инференса, но у Anthropic, похоже, валовая маржа инференса превышает 80%» — реакция на материал Financial Times. -
Представлен новый сервис — «место, где ИИ-агенты могут доносить»(TechCrunch, 2026-09-15 17:45 JST)
«AI Agents now have a place to snitch»
https://techcrunch.com/2026/09/15/ai-agents-now-have-a-place-to-snitch/
Сигналы
- В центре тем о закрытых моделях — «инциденты и безопасность»: наряду с демонстрацией возможностей новых моделей GPT-6 Astra/Fable 5.1, наибольшее вовлечение получили публикации об инциденте с RubyGems у OpenAI, несанкционированном доступе Anthropic во время кибероценки и переговорах трёх компаний.
- Информационным хабом по открытым весам стал Nathan Lambert (Interconnects): новые модели китайских и новых игроков — GLM-5.3, Motif-3, Hy4-preview и другие — собраны в серии «Latest open artifacts» и остаются специализированной темой, которую легко пропустить без отдельного отслеживания.
- Реакция исследовательского и академического сообщества также велика: совместное заявление 25 лауреатов Филдсовской премии, набравшее 2,013 лайка, стало самым распространённым материалом из собранных. Отношения ИИ с математическим и научным сообществом обсуждаются уже за пределами простого технологического тренда.
- Корпоративные официальные аккаунты не публикуют напрямую: официальный хэндл Anthropic в Bluesky подтверждён, но имеет ноль постов. Реальные объявления удалось отслеживать только через бота-зеркало X. OpenAI находится в аналогичной ситуации.
Ограничения
- Официальный поисковый API Bluesky (
app.bsky.feed.searchPosts, включая веб-версиюbsky.app/search) в этой среде постоянно возвращал 403 Forbidden, поэтому поиск по ключевым словам был полностью недоступен. Вместо исчерпывающего поиска использовалисьapp.bsky.actor.searchActorsиapp.bsky.feed.getAuthorFeed: индивидуально читались ленты известных аккаунтов, связанных с LLM — Simon Willison, Ethan Mollick, Nathan Lambert, TechCrunch, Gary Marcus, X-зеркала Anthropic/OpenAI и других. - Из-за этого нельзя точно определить, что «обсуждалось в Bluesky сегодня больше всего», по общему рейтингу популярности. Приведённые материалы — репрезентативные примеры из лент ключевых аккаунтов, а не исчерпывающий тренд-анализ.
- Прямые официальные публикации OpenAI и Anthropic в Bluesky почти отсутствуют; информация опиралась на неофициальные X-зеркала, что отмечено в тексте.
- Из-за ограничений поиска почти не удалось найти релевантные публикации на японском языке:
app.bsky.actor.searchActorsвыдавал результаты со смещением к англоязычным аккаунтам.
Lemmy
Lemmy — самое обсуждаемое сегодня: усталость от Anthropic и восстановление открытых весов
Сообщества
- !«メールアドレス» — около 88.1K подписчиков, из них 41K локальных; ежедневно активно 4.31K пользователей. Крупное сообщество общего технологического профиля, часто обсуждающее ИИ.
- !«メールアドレス» — около 1.25K подписчиков, из них 697 локальных. Публикаций немного, но темы преимущественно технические и ориентированные на LLM.
- !«メールアドレス» — 6,580 подписчиков. Новости и обсуждения ИИ в целом.
- !«メールアドレス» — сообщество кросспостов с Reddit (r/ClaudeCode, r/ArtificialInteligence и др.). Число подписчиков скрыто, но сегодня в нём сконцентрировались публикации о Claude Code.
- !«メールアドレス»、!«メールアドレス» — сообщества о сингулярности и поддержке open-source ИИ. Число подписчиков не удалось получить из-за нестабильных ответов инстансов.
Публикации
-
«Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking»(официальный блог Google, через !«メールアドレス»)
Оценка 1 / опубликовано 2026-09-15
https://lemmy.world/post/… (исходная статья: https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-live-gemini-3-8-live-extended-thinking/)
Анонсированы новые модели для голосового общения — «Gemini 3.8 Live» и версия с расширенным мышлением. Заявлено «значительное улучшение способностей к рассуждению и параллельному мышлению». -
«Y Combinator's Garry Tan wants US open-weight AI labs to 'distill' frontier models, too»(!«メールアドレス»)
Оценка 72(75up/3down)/ 2026-09-14T23:08 UTC
https://techcrunch.com/2026/09/11/y-combinators-garry-tan-wants-u-s-open-weight-ai-labs-to-distill-frontier-models-too/
Garry Tan из YC заявил, что американские ИИ-лаборатории с открытыми весами тоже должны применять к фронтирным моделям тот же метод дистилляции (distillation), который используют китайские игроки. Это публикация с наивысшей оценкой в технологическом сообществе за день. -
«An excellent blogpost from Shengyu Liu, kernel engineer at DeepSeek»(!«メールアドレス», также кросспост на lemmy.world)
Оценка 56 / 2026-09-15T14:32 UTC
https://lemmy.ml/post/52762654
Представлен технический блог kernel-инженера DeepSeek. Публикация получила поддержку как свидетельство технической силы лагеря открытых весов. -
«Anthropic Boasts It Would Be Profitable if You Ignore How Much It Costs to Develop AI»(!«メールアドレス»)
Оценка 12(исходная статья)+ 6(повторная публикация)/ 2026-09-15T18:48 UTC・17:54 UTC
https://futurism.com/future-society/anthropic-claude-profit-ai-safety-development-finances
Критическая статья с иронией над заявлением Anthropic, что компания была бы прибыльна, «если не учитывать расходы на разработку». Комментарии ставят под сомнение финансовую прозрачность компании. -
«Amodei chiede di rallentare sull'IA, ma la guerra non aspetta»(статья на итальянском, !«メールアドレス»)
Оценка 1 / 2026-09-15T11:05 UTC
https://formiche.net/2026/09/amodei-chiede-di-rallentare-sullia-ma-la-guerra-non-aspetta-il-commento-di-caruso/
Комментарий указывает, что CEO Anthropic Dario Amodei призывает замедлить разработку ИИ, но реальная «гонка вооружений ИИ» ждать этого не будет. -
«Israeli tech firm responsible for AI hacking scandals»(связано с Anthropic, OpenAI и Meta, !«メールアドレス»)
Оценка 3 / 2026-09-15T14:43 UTC
https://thecradle.co/articles-id/39958
Сообщение о том, что израильская технологическая компания причастна к скандалам со взломом ИИ, затрагивающим Anthropic, OpenAI и Meta. -
«YES your usage got really shorter - you're not wrong»(кросспост из r/ClaudeCode, !«メールアドレス»)
Оценка 1 / 2026-09-15T23:06 UTC
https://www.reddit.com/r/ClaudeCode/comments/1whelbf/yes_your_usage_got_really_shorter_youre_not_wrong/
Недовольство тем, что лимиты использования Claude Code после 14 сентября были значительно сокращены. В тот же день появилось несколько похожих публикаций, включая «Cancelled Claude Max 20x after unusually fast weekly-limit depletion» с сопоставимой оценкой; ужесточение лимитов Claude стало главной темой дня в сообществе Claude. -
«old model: Jackrong/Negentropy-claude-opus-4.7-4B»(Hugging Face, !«メールアドレス»)
Оценка 5 / 2026-09-14T22:25 UTC
https://huggingface.co/Jackrong/Negentropy-claude-opus-4.7-4B
На Hugging Face опубликована 4B-параметрическая модель с открытыми весами, по-видимому дистиллированная из Claude Opus 4.7. Её обсуждают как пример «облегчённого открытия» технологий закрытых моделей. -
«Now that you have local AI running, which model should you actually pick?»(!«メールアドレス»)
Оценка 1 / 2026-09-13T11:10 UTC
https://commitlog.cc/posts/open-source-ai-models-part-1-comparison-and-selection
Руководство по выбору модели с открытыми весами для локального ИИ-окружения: сравнение того, какую модель стоит выбрать. -
«Someone built a visualization of what 1 million tokens actually looks like»(!«メールアドレス»)
Оценка 17 / 2026-09-15T00:30 UTC
https://www.1millioncontext.com/
Визуализация роста контекстного окна от GPT-3 в 2020 году с 2,048 токенами до Gemini с миллионом токенов. Публикация получила поддержку как наглядный способ почувствовать эволюцию моделей — как закрытых, так и открытых.
Сигналы
- Закрытые модели: Google усиливает голосовое и мультимодальное взаимодействие с Gemini 3.8 Live, тогда как Anthropic переживает «тройной удар»: сокращение лимитов Claude Code/Claude Max, критику заявлений о прибыльности и иронию вокруг заявлений CEO Amodei о замедлении. На сегодняшнем Lemmy критика и недовольство преобладают над поддержкой. Сообщения о скандале со взломом также привлекают негативное внимание к закрытым игрокам — Anthropic/OpenAI/Meta.
- Открытые веса: блог инженера DeepSeek стал второй публикацией дня по оценке — 56. Высшая оценка дня у заявления Garry Tan из YC — 72; тезис о том, что США должны противостоять конкурентам через сочетание открытых весов и дистилляции, воспринимается как попутный ветер для этого лагеря. Появление небольшой открытой модели, дистиллированной из Claude Opus (Negentropy-claude-opus-4.7-4B), также символизирует тенденцию к открытию технологий закрытых моделей.
- В целом на Lemmy доминируют критические дискуссии о бизнесе, этике и регулировании ИИ-компаний, а не сами анонсы моделей. Здесь значительно меньше восторга от производительности моделей, чем на Reddit или X.
Ограничения
- Lemmy имеет небольшой масштаб, а публикации, связанные с LLM, рассредоточены. Если ограничиться действительно опубликованными сегодня, их мало: многие датированы 13–15 сентября, а публикаций непосредственно от 16 сентября не обнаружено. Десять материалов подтверждены с датами, но только примерно 4–5 из них действительно относятся к «сегодня».
- API сообществ
lemmy.worldиlemmy.ml(/api/v3/community) периодически возвращал ошибку 503, поэтому число подписчиков !«メールアドレス» и !«メールアドレス» получить не удалось. - Поисковый API Lemmy зависит от совпадения ключевых слов, поэтому трудно уверенно определить, что «обсуждается сегодня больше всего» между разными темами. Публикация с наивысшей оценкой — призыв Garry Tan к дистилляции (72) — использована как представитель наиболее заметной темы.
- Из результатов поиска не всегда можно было полностью установить принадлежность отдельных публикаций конкретному сообществу; часть из них предположительно помечена как категория «technology».
Рекомендуемые действия
- Постоянно отслеживать объявления Anthropic о безопасности: отчёт об угрозах, продолжение инцидента с несанкционированным доступом и независимое расследование METR.
- Регулярно наблюдать за изменениями лимитов Claude Code/Claude Max и расширением оттока пользователей.
- Следить за бенчмарками и лицензированием моделей с открытыми весами, таких как GLM-5.3 и линейка DeepSeek, и проверять реальные возможности дистиллированных моделей.
- При сборе LLM-информации на X отказаться от зависимости от растущих трендов и перейти к прямому поиску по ключевым словам.
- Рассмотреть альтернативные способы проверки роликов YouTube, например официальный Data API.
- Проверить скептический тезис Reddit/Lemmy о том, что «опасения по поводу безопасности ИИ — дымовая завеса для пределов масштабирования», сопоставив его с данными о финансировании и вычислительных ресурсах.
Примечание о качестве данных
На X поиск был завязан на растущие тренды, поэтому из 40 публикаций лишь 4 относились к LLM — меньше критерия завершения в 10. В Lemmy из 10 материалов лишь примерно 4–5 были опубликованы «сегодня». На YouTube из-за JavaScript-рендеринга не удалось проверить просмотры и число подписчиков каналов.



