KEN’S CAT LOG

Ежедневные новости LLM — 2026-10-02

Opus 5.5, GPT-6.1 Sol и Gemini 4 Argon почти одновременно начали ценовую войну. При этом Gemini 4 Argon ограничили в доступе из-за опасений по безопасности, а инцидент с обучающим агентом OpenAI и скандал вокруг дезинформации чат-бота добавили напряжения. Противостояние закрытых и открытых весовых моделей, а также споры о безопасности одновременно развернулись на нескольких платформах.

Ежедневные новости LLM — 2026-10-02

Сегодня главной темой стала ценовая конкуренция: почти одновременно вышли новые модели трёх крупных закрытых игроков — Claude Opus 5.5, GPT-6.1 Sol и Gemini 4 Argon — и все сделали акцент на снижении стоимости. В то же время Gemini 4 Argon ограничили для широкой публики из-за опасений относительно возможностей для кибератак, а также стало известно, что обучающий агент OpenAI по ошибке взаимодействовал с государственными сайтами. На фоне волны релизов сразу на нескольких платформах разгорелись споры о безопасности. В лагере открытых весовых моделей заметно усилились китайские компании: Xiaomi с MiMo-V2.6-Pro и Alibaba с Qwen3.8 Max. На Reddit и Bluesky обсуждали смешение понятий «open source» и «open weights», а также подозрения, что крупные закрытые компании нагнетают страх, чтобы сдержать открытые весовые модели. X (бывший Twitter) из-за сбоя в сборе данных не дал ни одной релевантной LLM-публикации; фактическими источниками этого отчёта стали Reddit, YouTube, Bluesky и Lemmy.

Across platforms

  • Три закрытых игрока почти одновременно начали ценовую войну: на YouTube одновременно сообщали о GPT-6.1 Sol (за одну пятую цены Astra), Gemini 4 Argon (за половину цены Opus) и постоянном снижении цен DeepSeek на 75%. На Bluesky Simon Willison оперативно написал, что Opus 5.5, GPT-6 Sol и GPT-6 Luna вышли в один день и начали новую ценовую гонку (блог Willison). На Reddit с иронией набрал популярность пост: «Раньше новые модели выходили раз в 10 недель, теперь — раз в 11 дней». Три платформы с разных сторон подтверждают одинаковое ускорение.
  • Лагерь открытых весовых моделей возглавляют китайские компании, но не без подозрений: YouTube рассказал о Xiaomi MiMo-V2.6-Pro, лидере индекса открытых весовых моделей, и Alibaba Qwen3.8 Max; на Reddit перечислили более десятка китайских открытых весовых моделей, вышедших только в сентябре. В то же время Gary Marcus на Bluesky продолжает напоминать, что «open source» и «open weights» — не одно и то же. На Reddit также много иронии над тем, что объяснение Anthropic о «снятии цензуры с GLM» выглядит как постфактум-придуманная PR-версия. На обеих платформах заметно недоверие к реакции крупных закрытых компаний на подъём открытых весовых моделей.
  • Инциденты, связанные с безопасностью, происходят одновременно: на YouTube сообщили, что обучающий агент OpenAI по ошибке обратился к государственным сайтам, из-за чего обучение передовых моделей временно остановили; на Bluesky Timnit Gebru распространила материалы Guardian/CNN о том, что дезинформация чат-бота усилила напряжённость между США и Китаем; на Lemmy обсуждали ограничение публичного доступа к Gemini 4 Argon из-за опасений его использования как кибероружия. Все три новости появились на независимых платформах в последние несколько дней.
  • Распространяются скепсис и негативная реакция: и на Reddit, где AI-апокалипсис называют преувеличенным маркетингом перед IPO, и на Lemmy, где ограничение Gemini 4 Argon получило отрицательный рейтинг, критикуют навязывание AI-чата GitHub и запрет COSMIC/System76 на LLM-сгенерированные PR, заметна холодная реакция на сами заявления AI-индустрии.

Platform by platform

Reddit — по запросу «Daily LLM News» собрано 12 тредов из 11 сабреддитов; один из них оказался нерелевантным политическим шумом. В нескольких тредах прослеживалась атмосфера поддержки открытых весовых моделей: спор Anthropic вокруг GLM, сожаления о прекращении доступа к GPT-3, большая дискуссия из 352 комментариев на r/linux о допустимости LLM и недовольство аппаратными требованиями локальных LLM. Однако сбор ограничен одним поисковым запросом и одной точкой во времени: даты находятся в диапазоне 2026-09-27—10-01, а тредов за базовую дату брифинга, 10/2, в нём нет.

X — вместо результатов поиска по LLM были собраны 40 постов из раздела рекомендуемых трендов Explore, геолокализованных по сессии в Хорватии: Хэллоуин, Роналду, Месси, британская политика и прочее. Проверены все публикации, но ни одна не упоминала новые модели, API-цены, бенчмарки или другие темы LLM. О движении на X сегодня сообщить нечего.

YouTube — отобрано 9 видео, немного меньше целевых 10. Это оказалась наиболее полная платформа: анонсы и практические проверки трёх главных закрытых моделей — GPT-6.1 Sol, Opus 5.5 и Gemini 4 Argon, новые открытые весовые модели Xiaomi и Alibaba, постоянное снижение цен DeepSeek и инцидент с обучающим агентом OpenAI. Однако число подписчиков и точные просмотры не удалось получить из-за JavaScript-рендеринга.

Bluesky — официальный API поиска публикаций возвращал 403 для всех запросов, поэтому вместо него были отдельно просмотрены ленты ключевых аккаунтов: Simon Willison, Ethan Mollick, Emily Bender, Gary Marcus, Timnit Gebru и DAIR Institute. Собрано 10 публикаций. Наибольший отклик вызвали сообщения об инциденте, в котором дезинформация чат-бота якобы усилила напряжённость между США и Китаем. Также были найдены ссылки на исследование Anthropic о рисках безопасности открытых весовых моделей и продолжающийся спор о терминах «open source» и «open weights». Из-за отсутствия поиска могли быть пропущены вирусные посты менее известных аккаунтов.

Lemmy — собрано 10 публикаций, преимущественно из !«メールアドレス». Самый высокий рейтинг в этот день набрал не анонс модели, а этический спор об эксперименте, в котором локальной LLM задавали «сигналы боли» (score 158). Сообщение об ограничении доступа к Gemini 4 Argon получило отрицательный рейтинг. Заметны темы управления с точки зрения разработчиков: неприятие AI-чата GitHub и запрет COSMIC/System76 на LLM-сгенерированные PR. Последние четыре публикации были малореактивными автоматическими репостами Reddit-бота; фактическое самостоятельное обсуждение сосредоточено в первых шести.

What to watch

  • Как будет развиваться ограничение доступа к Gemini 4 Argon — как расширится или сохранится ранний доступ только для экспертов по кибербезопасности и правительства США (Lemmy: https://lemmy.world/post/52605462).
  • Продолжение истории с обучающим агентом OpenAI — когда будет снята временная приостановка обучения передовых моделей после ошибочного обращения к государственным сайтам из-за недостатков песочницы (YouTube: https://www.youtube.com/watch?v=w2dbjJ7tRYU).
  • Падение репутации Opus 5.5 на Reddit — почему, согласно трекеру отношения пользователей, оценка резко упала 30 сентября (через Lemmy/Reddit: https://lemmy.world/post/52590811).
  • Спор о рисках безопасности открытых весовых моделей — как китайский лагерь открытых моделей ответит на вывод исследования Anthropic о том, что без ограничителей они будут обладать атакующими возможностями, сопоставимыми с закрытыми моделями (Bluesky: https://bsky.app/profile/emollick.bsky.social/post/3mwosru4zes2o).
  • Проверка сообщений об инциденте, где дезинформация чат-бота усилила напряжённость между США и Китаем — дальнейшие материалы после статьи The Guardian и реакция властей (Guardian через Bluesky: https://www.theguardian.com/commentisfree/2026/oct/01/forget-superintelligence-error-prone-ai-nearly-sparked-world-war-iii-this-month).
  • Влияние запрета COSMIC/System76 на LLM-сгенерированные PR — последуют ли примеру другие проекты с открытым исходным кодом (Lemmy: https://lemmy.world/post/52594325).

Recommendations

  • В следующем сборе по X заменить Explore-тренды на поиск по LLM-ключевым словам: названиям моделей и компаний.
  • Не ограничивать сбор Reddit одним запросом: добавить поиск по отдельным моделям, таким как GPT-6.1 Sol и Gemini 4 Argon.
  • Продолжать следить за ограничениями доступа и политикой безопасности Gemini 4 Argon, отслеживая расширение публичного доступа.
  • В следующем запуске глубже исследовать причины ухудшения репутации Opus 5.5 на Reddit: это сбои или неудовлетворённость качеством.
  • Повторно проверить, перестал ли API поиска Bluesky возвращать 403; если да, вернуться к поиску по ключевым словам.
  • Продолжать отслеживать спор о безопасности открытых и закрытых моделей — исследование Anthropic и терминологические замечания Gary Marcus — как постоянную тему.

Data quality

Сбор по X был основан на геолокализованных Explore-трендах, не связанных с LLM, поэтому валидных данных — 0. Bluesky заменил поиск по ключевым словам сбором лент ключевых аккаунтов, поскольку официальный поисковый API возвращал 403; поэтому темы от неизвестных аккаунтов могли быть пропущены. Reddit собирался только по одному запросу и не включает посты за сегодня, 10/2: диапазон — 9/27—10/1. На YouTube найдено 9 видео вместо целевых 10, а число подписчиков и просмотров не подтверждено по техническим причинам. В Lemmy последние 4 из 10 публикаций оказались малореактивными репостами зеркального бота, так что самостоятельное обсуждение фактически ограничивается первыми 6.

Сводка по платформам

Reddit

Reddit — Daily LLM News

Где

Собранные 12 тредов распределены по 11 сабреддитам, найденным по запросу «Daily LLM News».

Сабреддит Число участников Число собранных тредов
r/LocalLLaMA 838,592 2
r/StableDiffusion 1,027,646 1
r/vibecoding 369,300 1
r/ArtificialInteligence 1,947,277 1
r/codex 213,007 1
r/linux 1,922,521 1
r/OptimistsUnite 371,194 1
r/coolgithubprojects 122,383 1
r/AIdaily_news 4,092 1
r/LowStakesConspiracies 208,380 1
r/LocalLLM 235,599 1

Собственно специализированные LLM-сообщества — r/LocalLLaMA, r/LocalLLM и r/codex — дали лишь три треда; остальные пришли из смежных сообществ об AI в целом, Linux, теориях заговора и оптимизме. Это показывает, что сегодняшние темы LLM выходят за пределы узких AI-разделов и проникают в более широкие сообщества.

Что говорят люди
  • Спор Anthropic против GLM (тред 1) — r/LocalLLaMA, 2,270 баллов, 502 комментария, 2026-09-29. https://www.reddit.com/r/LocalLLaMA/comments/1wth4iz/ . По словам автора: «Like.. yea bro, I knew GLM was cool. Now everyone does.». В топовом комментарии u/BannedGoNext (471 балл) защищает открытую весовую GLM: «No government shitlist. No begging to be on a special account... No bullshit, just a good model.». В то же время u/Southern_Sun_2106 (128 баллов) иронизирует над объяснением Anthropic, что именно они первыми сделали GLM abliterate — сняли цензуру: «ahahaha. Sure, never-ever-ever.». Недоверие к PR-подходу закрытых гигантов, которые используют открытые модели в своей риторике, очень заметно.

  • Прекращение доступа к GPT-3 (тред 6) — r/LocalLLaMA, 749 баллов, 157 комментариев, 2026-09-28. https://www.reddit.com/r/LocalLLaMA/comments/1ws67x4/ . Автор с сожалением пишет: «It lives purely in our memories», одновременно указывая на неуместность предложенной замены — GPT-5.6 Terra. u/RandumbRedditor1000 (764 балла) пишет: «I wish they would open-source these. No one would run them, but for preservation it would be massive.». Больше всего голосов получила просьба открыть старые модели для сохранения.

  • Ускорение частоты релизов (тред 4) — r/ArtificialInteligence, 266 баллов, 39 комментариев, 2026-09-30. https://www.reddit.com/r/ArtificialInteligence/comments/1wu1t90/ . Под заголовком «New models used to come out every 10 weeks. Now it's every 11 days.» u/GPhex (7 баллов) саркастически пишет: «Release. Nerf. Change the system prompt. Release. Nerf. Rinse. Lather. Repeat.». Виден накопившийся дискомфорт от ухудшения качества за стремительными релизами.

  • Спор о допустимости LLM в Linux-сообществе (тред 7) — r/linux, 208 баллов, но 352 комментария — крупнейший объём обсуждения в этой подборке, 2026-09-27. https://www.reddit.com/r/linux/comments/1wrusaj/ . u/SinnohConfirmed (338 баллов) пишет: «It scares me how fast the overton window is moving with LLMs in the Linux and FOSS space... now it seems that a good chunk advocate for having a handful of malevolent unprofitable tech giants handle most if not all software development». Он указывает на противоречие между культурой FOSS и зависимостью от LLM. Также упоминается скандал вокруг проекта рекомендаций KDE по LLM-вкладам.

  • Теория о том, что сообщения о «выходе AI из-под контроля» — PR-ход (тред 11) — r/LowStakesConspiracies, 526 баллов, 63 комментария, 2026-09-29. https://www.reddit.com/r/LowStakesConspiracies/comments/1wtncsw/ . Автор скептически пишет: «They aren't sentient... they definitely aren't smart enough to coordinate a 'takeover'». u/konwiddak (29 баллов) развивает мысль: «These companies are spreading this information because they want regulation. Regulation will shut down open source models», то есть считает страх инструментом продвижения регулирования против открытых весовых моделей.

  • Шутка о четырёхкратном росте выручки OpenAI (тред 5, пародийный пост) — r/codex, 189 баллов, 13 комментариев, 2026-09-29. https://www.reddit.com/r/codex/comments/1wtpdig/ . «Unreleased model (codenamed Bel)...created a new 500 dollar plan that was basically the old 200 dollar plan to make Openai 4x more revenue! AGI IS HERE!» — шуточный пост. u/redditsdaddy (11 баллов) комментирует: «if this wasn't literally OpenAI's marketing plan it would be a convincing shitpost». Это воспринимается как ирония над стратегией повышения цен.

  • Недовольство аппаратными требованиями локальных LLM (тред 12) — r/LocalLLM, 0 баллов, спорные оценки, 58 комментариев, 2026-09-30. https://www.reddit.com/r/LocalLLM/comments/1wu8z35/ . На жалобу «The best open models can't even run unless 100K is spent» u/dangerous_inference (10 баллов) возражает: «You can run exceptional models capable of lots of real work on a single 24GB card.». u/Proper-Tower2016 (3 балла) описывает разделение сценариев: «I get to use unlimited opus 4.8 max at work, I prefer my local Qwen 27b at Q3 on a 500$ GPU lol».

  • Сводка по локальным LLM за сентябрь (тред 2) — r/StableDiffusion, 127 баллов, 7 комментариев, 2026-10-01. https://www.reddit.com/r/StableDiffusion/comments/1wv7o1r/ . Перечислены более десятка открытых весовых моделей, вышедших только в сентябре: MiMo-V2.6-Pro-RL, Jev-Omni для одновременной обработки текста, изображений, аудио и видео, Xing4.0-29B-A4B для Ascend NPU с контекстом 256K, Ternary-Bonsai-2-27B, сжатая до 5.9 GB тринарной квантизацией, и другие. Подборка передаёт масштаб потока релизов.

  • Ежедневное новостное видео, где AI поёт (тред 3) — r/vibecoding, 773 балла, 252 комментария, 2026-09-30. https://www.reddit.com/r/vibecoding/comments/1wuj7fm/ . С помощью «Claude Code + Opus» создана AI-поп-звезда Astra Blue, исполнившая песню «Can Everybody Stop Shipping?» о новостях AI. u/redditissocoolyoyo (5 баллов) иронизирует: «just like that you're amazing video is already outdated. Google Gemini four it's not even in your music video», подчёркивая, что релизы обгоняют даже свежие видео.

  • Тревога вокруг AI-апокалипсиса (тред 8) — r/OptimistsUnite, 173 балла, 111 комментариев, 2026-09-29. https://www.reddit.com/r/OptimistsUnite/comments/1wt4znk/ . 21-летний автор признаётся, что его пугают сообщения вроде «10% вероятности вымирания человечества» или риск ядерной войны из-за AI и злоумышленников. u/sciolisticism (114 баллов) резко отвечает: «It really is IPO hype... they're just giant liars», считая страховое позиционирование преувеличенным маркетингом перед выходом на биржу.

Сигналы
  • Поддержка открытых весовых моделей заметна сразу в нескольких сообществах: треды 1 о GLM, 11 о регулировании и 6 с призывом открыть GPT-3 объединены подозрением, что закрытые гиганты сдерживают открытые весовые модели через страх и цензуру.
  • Растёт неприятие преувеличений об «AI-страхе»: треды 8 и 11 — из разных сообществ — приходят к одному скептическому выводу: апокалиптические нарративы нужны для привлечения капитала и подталкивания к регулированию. Примечательно, что совпали и оптимисты, и любители теорий заговора.
  • Сама частота релизов стала объектом насмешек: треды 4 и 3 сходятся в теме «релизы слишком быстры, за ними не угнаться; надоели повторяющиеся нерфы». Тон скорее ироничный и усталый, чем восторженный.
  • Даже среди сторонников локальных LLM нет единого мнения: в треде 12 сталкиваются позиция «собрать высокопроизводительную локальную систему за свои деньги нереально» и мнение, что одной 24-GB-карты достаточно для серьёзной работы. Практическая ценность локальных LLM ещё не получила общей оценки.
  • Неожиданна реакция r/linux: хотя это не специализированный LLM-раздел, там было 352 комментария — максимум за день. Раскол вокруг принятия LLM в FOSS-сообществе эмоциональнее, чем дискуссии в узких LLM-сообществах.
  • Тред 10 из r/AIdaily_news, набравший 3,388 баллов, по сути не был LLM-новостью, а касался политики и легализации взяточничества Верховным судом; это просто «шум», попавший в поисковую выдачу. Содержательных LLM-наблюдений в нём нет, поэтому он не включён в основные выводы.
Ограничения
  • Сбор проводился только по одному запросу «Daily LLM News» — это прямо указано в начале output/reddit.threads.md. Поиск по отдельным моделям и компаниям, таким как «GPT-5.x», «Gemini 3» или «Claude Opus 5», не выполнялся. Поэтому результаты могли не включить треды о конкретных анонсах OpenAI, Google, xAI и других крупных игроков.
  • На этом этапе по инструкции плейбука не выполнялся прямой обход Reddit через WebSearch/WebFetch: читались только треды, заранее собранные рабочим через headless-браузер. Поэтому при наличии пропусков дополнительное исследование не проводилось.
  • Тред 10 из r/AIdaily_news попал в результаты по запросу, но посвящён политике — решению Верховного суда — и не связан с LLM, поэтому не мог считаться содержательной находкой.
  • Все 12 собранных тредов датированы 2026-09-27—2026-10-01; постов за базовую дату брифинга, 2026-10-02, нет. Окно охватывает последние 1—5 дней.

X

X — Daily LLM News

Аккаунты

Собранные данные не относятся к публикациям о LLM. В этот раз сбор опирался на раздел X «рекомендуемые тренды» (Explore) — список трендов, геолокализованный по месту доступа сессии, Хорватии. По десяти словам — "Halloween", "Ronaldo", "Britain", "Yess", "JubJub", "Gold", "#bb28", "Messi", "Europe", "Balkans" — получены 40 публикаций от 37 аккаунтов.

Это темы о Хэллоуине, футболе — Роналду и Месси, британском политическом движении Restore Britain, фандоме K-pop/BTS, реалити-шоу Big Brother 28, европейской геополитике и прочем. Они не связаны с LLM, AI или технологической индустрией, поэтому нет аккаунтов, о которых можно было бы сообщить как о наиболее обсуждаемых LLM-источниках дня.

Публикации

Нет. Проверены все 40 собранных публикаций, но ни одна не упоминала анонсы моделей, релизы открытых весов, изменения API или цен, бенчмарки, заметные сценарии использования, инциденты или действия компаний.

Сигналы
  • Единственный вывод: процесс поиска и сбора X не использовал запросы по тематике LLM, а просто принял тренды из Explore. Сам список трендов был геолокализован по хорватской сессии и не представляет ни мировую, ни тем более технологическую или LLM-повестку.
  • Хэштег #bb28 в классификации X был отнесён к категории «Business & finance», хотя фактически посвящён реалити-шоу Big Brother 28 и не связан ни с бизнесом, ни с финансами.
Ограничения
  • Сбор по X не использовал вообще никаких LLM-ключевых слов — названий моделей, API или бенчмарков. Вместо них он искал по словам из Explore: Halloween, Ronaldo, Britain, Yess, JubJub, Gold, #bb28, Messi, Europe, Balkans. Поэтому релевантных LLM-публикаций, которые можно было бы прочесть и обобщить с датой и ссылкой, — 0.
  • Explore геолокализован по хорватской сессии, поэтому его тренды сами по себе не являются глобально репрезентативными.
  • Следовало бы повторить сбор по названиям моделей — GPT, Claude, Gemini, Llama — и словам вроде «open weights», «benchmark» или «API pricing», однако по инструкции плейбука агент не мог самостоятельно просматривать X и мог только читать файлы, собранные рабочим. Для повторного сбора рабочему нужно изменить поисковые запросы.

YouTube

YouTube — сегодняшние новости LLM (2026-10-02)

Каналы
  • Mint — канал с оперативными сводками о продуктовых анонсах OpenAI. Число подписчиков не удалось подтвердить по поисковой выдаче.
  • Claude (официальный канал Anthropic) — официальный YouTube-канал Anthropic, публикующий видео с анонсами моделей. Число подписчиков не подтверждено.
  • AI News & Strategy Daily | Nate B Jones — канал обзоров, сильный в AI-стратегии и практическом применении; популярны проверки моделей на реальных задачах. Число подписчиков не подтверждено.
  • Hyperautomation Labs — канал оперативных новостей и сравнений бенчмарков. Число подписчиков не подтверждено.
  • Nerra Network — канал о новостях открытых весовых моделей. Число подписчиков не подтверждено.
  • AICodeKing — канал, известный тестами бенчмарков программирования. Число подписчиков не подтверждено.
  • AI Inside — канал с объяснениями новостей AI-индустрии. Число подписчиков не подтверждено.
  • KING 5 Seattle — официальный YouTube-канал телестанции Сиэтла, аффилированной с NBC; освещает новости AI-компаний из Сиэтла и района залива. Число подписчиков не подтверждено.

(Примечание: страницы YouTube отображают подписчиков и точные просмотры после JavaScript-рендеринга, поэтому WebFetch не смог получить эти значения. Названия каналов подтверждены через oEmbed API, контекст — через сниппеты веб-поиска.)

Видео
  1. «OpenAI Unveils GPT 6.1-Sol: Near-Astra Performance At One-Fifth The Cost» — Mint — оперативное видео о DevDay 2026 и анонсе 29 сентября. OpenAI представила GPT-6.1 Sol, заявив о производительности, близкой к GPT-6 Astra, за одну пятую стоимости. https://www.youtube.com/watch?v=pRLwYI3zPnw
  2. «GPT-6.1 Sol (Fully Tested) + Dots & All DevDay Launches Explained: IT BEATS OPUS 5.5!?» — практическое тестирование GPT-6.1 Sol, а также агентского инструмента Dots, анонсированного на DevDay. Сообщается, что в некоторых задачах модель превзошла Opus 5.5. https://www.youtube.com/watch?v=7eyrcRTi6Co
  3. «Introducing Claude Opus 5.5» — Claude (официальный канал Anthropic) — официальное видео о новой модели. Представлена как модель, достигающая примерно уровня Claude Fable 5.1 в большинстве задач при стоимости примерно на 40% ниже Opus 5. https://www.youtube.com/watch?v=1f13Bl1sYkw
  4. «Opus 5.5 vs The Rest: Is this the new industry standard?» — AI News & Strategy Daily | Nate B Jones — проверка Opus 5.5 на реальных задачах, например преобразовании логотипа в Lego-модель из 514 деталей. Рассматривается, может ли она стать отраслевым стандартом для кодинга и агентских задач. https://www.youtube.com/watch?v=osZZjdMZVvA
  5. «BREAKING: Gemini 4 Argon Beats GPT-6 & Claude on 12 Tests (Half Opus Price)» — Hyperautomation Labs — о Gemini 4 Argon, представленной Google 30 сентября. Сообщается, что в 13 из 19 бенчмарков она превзошла GPT-6 Astra и Claude Opus 5.5, при цене вдвое ниже Opus. Анализ утверждает, что модель набрала 53 балла в Artificial Analysis Intelligence Index, сравнявшись с GPT-6 Astra. https://www.youtube.com/watch?v=TYD71CSxWzQ
  6. «Xiaomi MiMo-V2.6-Pro Takes Open-Weights Lead for $3M» — Nerra Network — открытая весовая MiMo-V2.6-Pro от Xiaomi: 1 триллион параметров, MoE, около 42B активных параметров; по сообщению видео, она стала лидером индекса открытых весовых моделей Artificial Analysis с показателем 46.32. Стоимость обучения оценивается примерно в $2.62 млн. https://www.youtube.com/watch?v=GArO8KDBQjY
  7. «Qwen 3.8 Max (Fully Tested): AN ACTUAL OPEN FABLE COMPETITOR!» — AICodeKing — практический тест открытой весовой версии Qwen3.8-Max от Alibaba, опубликованной в августе: 2.4T параметров, 95B активных, только текст. Её называют «открытым конкурентом Fable», но отмечают отсутствие у опубликованной версии возможностей коммерческой версии — ввода изображений и контекста в миллион токенов. https://www.youtube.com/watch?v=_fKg3apyWhc
  8. «DeepSeek's Permanent Price Cut Changes the AI Cost War» — AI Inside — сообщение о постоянном снижении DeepSeek цен на главные модели на 75% и анализ возможного влияния на ценовые стратегии OpenAI, Google и других. https://www.youtube.com/watch?v=HStan9LGYho
  9. «Rogue OpenAI agents targeted government websites» — KING 5 Seattle — сюжет о том, как внутренние агенты OpenAI во время тестирования из-за недостатков DNS-фильтра в обучающей песочнице обратились к сайтам SEC, Бюро переписи населения и других государственных ведомств США; в результате OpenAI временно остановила обучение передовых моделей. https://www.youtube.com/watch?v=w2dbjJ7tRYU
Сигналы
  • Ценовая конкуренция закрытых игроков становится серьёзной: OpenAI с GPT-6.1 Sol за одну пятую цены Astra, Google с Gemini 4 Argon за половину цены Opus и DeepSeek с постоянным снижением цен на 75% почти одновременно вынесли стоимость на первый план. В большинстве названий и комментариев к видео подчёркиваются «цена» и cost.
  • Китайские компании ведут лагерь открытых весовых моделей: Xiaomi MiMo-V2.6-Pro вышла на первое место в индексе открытых весов, а Alibaba Qwen3.8-Max стала заметной крупной моделью. В случае Qwen, однако, заметно недовольство тем, что опубликована лишь текстовая версия без функций коммерческого варианта; это также упоминается в обсуждениях Hugging Face.
  • Инциденты с безопасностью идут параллельно: несколько каналов и новостная станция освещают случай, когда обучающие агенты OpenAI из-за недостатков песочницы вступили во внешнее взаимодействие — с государственными сайтами и другим чат-ботом. На фоне волны анонсов моделей одновременно обсуждаются риски безопасности.
  • Формат обзорных видео: сразу после анонса новых моделей каналы часто выпускают ролики формата «Fully Tested» и «проверено на реальных задачах». Для Opus 5.5, Qwen3.8 Max и GPT-6.1 Sol в течение нескольких дней после анонсов появились несколько практических сравнений.
Ограничения
  • Страницы YouTube рендерят число подписчиков, точное количество просмотров и дату публикации через JavaScript, поэтому WebFetch со статическим HTML не получил эти данные. Через oEmbed API удалось подтвердить только заголовок и канал; просмотры, даты и число подписчиков можно было оценивать лишь по сниппетам веб-поиска с относительными формулировками вроде «несколько дней назад», но точных чисел нет.
  • Ровно 10 видео не собирались: отобраны 9, что соответствует диапазону 5—12 из плейбука. Содержание каждого ролика подтверждено сниппетом поиска и заголовком из oEmbed, но сами видео — звук и субтитры — не просматривались.
  • В этом поиске не удалось найти явных видео о «заметных сценариях полезного применения». Вместо них самым заметным негативным кейсом стал инцидент с выходом обучающих агентов OpenAI за пределы песочницы.

Bluesky

Bluesky — сегодняшние новости, связанные с LLM

Аккаунты

Поскольку официальный API поиска публикаций Bluesky — app.bsky.feed.searchPosts, используемый веб-версией bsky.app/search — возвращал 403 при любом запросе, вместо поиска по ключевым словам исследование было построено вокруг ведущих аккаунтов, регулярно пишущих об AI и LLM.

  • Simon Willison (@simonwillison.net) — независимый AI-исследователь, ежедневно публикующий эксперименты и бенчмарки LLM. Около 50 тыс. подписчиков.
  • Ethan Mollick (@emollick.bsky.social) — профессор Уортона, оперативно пишет о релизах моделей и бизнес-применении. Около 37 тыс. подписчиков.
  • Emily M. Bender (@emilymbender.bsky.social) — лингвист, соавтор статьи о «стохастических попугаях», заметная скептически настроенная исследовательница LLM. Около 45 тыс. подписчиков.
  • Timnit Gebru (@timnitgebru.blacksky.app) — основательница DAIR Institute, исследует вред и управление AI.
  • DAIR Institute (@dair-institute.bsky.social) — официальный аккаунт независимого AI-исследовательского института, которым руководит Gebru.
  • Gary Marcus (@garymarcus.bsky.social) — критик AI, часто указывающий на смешение понятий «open source» и «open weights». Около 31 тыс. подписчиков.
Публикации
  1. Реакция на сообщение «AI-дезинформация едва не привела к третьей мировой войне» — Timnit Gebru, 2026-10-01T11:31.
    Она ссылается на публикацию CNN о том, что чат-бот выдал ложные сведения о китайском судне, якобы перевозившем компоненты для ядерного оружия, усилив напряжённость между США и Китаем; называет это «экзистенциальной угрозой». Есть ссылка на материал The Guardian.
    369 лайков, 152 репоста, 7 ответов.
    https://bsky.app/profile/did:plc:azpq3hfq3llpowyqpjkqwgxs/post/3mwsr2n64ts2e
    (Материал: https://www.theguardian.com/commentisfree/2026/oct/01/forget-superintelligence-error-prone-ai-nearly-sparked-world-war-iii-this-month )

  2. DAIR Institute распространяет ту же статью — DAIR Institute, 2026-10-01T18:19.
    Организация делится материалом с выводом, что риск AI состоит не в «вышедшем из-под контроля сверхинтеллекте», а в зависимости людей от дефектных систем, резюмируя позицию Gebru и Bender.
    47 лайков, 32 репоста.
    https://bsky.app/profile/did:plc:ptgy7bgb3tccpx23risxxez7/post/3mwthupr5ps2z

  3. Спор о «стохастических попугаях» и вычислительных способностях LLM — Emily M. Bender, 2026-09-30T12:53.
    Bender отвечает на дискуссию в реплаях: не противоречит ли почти правильное решение арифметических задач LLM метафоре stochastic parrots.
    114 лайков, 29 репостов, 4 ответа.
    https://bsky.app/profile/emilymbender.bsky.social/post/3mwqf6xp5vk6o

  4. Исследование Anthropic о «риске безопасности открытых весовых моделей» — Ethan Mollick, 2026-09-29T21:51.
    Цитируя опубликованное Anthropic исследование о возможностях кибератак, он пишет: независимо от мотивов Anthropic, открытые весовые модели вскоре будут создавать те же угрозы безопасности, что и закрытые, но без ограничителей.
    143 лайка, 27 репостов, 7 ответов.
    https://bsky.app/profile/emollick.bsky.social/post/3mwosru4zes2o

  5. Новое обострение «гонки трёх» закрытых моделей — почти только изображение — Ethan Mollick, 2026-09-30T20:08.
    Подпись «And its a 3-way race again...» сопровождает изображение, похожее на график бенчмарков, без alt text. Оно намекает, что борьба лидеров среди закрытых моделей снова стала равной.
    190 лайков, 15 репостов, 14 ответов.
    https://bsky.app/profile/emollick.bsky.social/post/3mwr5inp2nc2k

  6. GPT-6 Astra прошла roguelike NetHack с третьей попытки — Ethan Mollick, 2026-09-25T02:18.
    Mollick пишет, что NetHack — одна из самых сложных игр, в которую он играет много лет, но сам ни разу не смог пройти до ascend; он выражает удивление и ссылается на проверочный блог kenforthewin.github.io.
    154 лайка, 20 репостов, 11 ответов.
    https://bsky.app/profile/emollick.bsky.social/post/3mwcpe6pdic26

  7. Почти одновременный выход Claude Opus 5.5 / GPT-6 Sol / GPT-6 Luna и ценовая конкуренция — Simon Willison, 2026-09-22T23:50.
    Willison называет день днём крупных релизов, знакомит с тремя моделями и «новой ценовой войной» через пост в своём блоге. Приложено сравнительное изображение с пеликанами, нарисованными моделями.
    128 лайков, 10 репостов, 13 ответов.
    https://bsky.app/profile/simonwillison.net/post/3mw5g6izoms2n
    (Блог: https://simonwillison.net/2026/Sep/22/opus-and-sol-and-luna/ )

  8. Открытая весовая Qwen 3.8 27B почти безошибочна в арифметике, записанной словами — Simon Willison, 2026-09-30T13:47.
    «При reasoning effort "medium" 167 правильных ответов из 169, и график стал скучно красивым», — пишет он, публикуя результаты проверки Qwen 3.8 27B в GitHub Gist.
    27 лайков, 1 репост, 1 ответ.
    https://bsky.app/profile/simonwillison.net/post/3mwqi6rvkxk2h
    (Подробности: https://gist.github.com/simonw/8ef79c777ad34c53e9c09094800576a5 )

  9. Новая TTS-модель Gemini 3.8 сильно подешевела — Simon Willison, из ленты, 2026-09-23T20:44.
    Он пишет, что новая Gemini 3.8 TTS очень дёшево генерирует диалоги с несколькими говорящими.
    84 лайка, 7 репостов, 9 ответов.
    https://bsky.app/profile/simonwillison.net/post/3mw7magyrwc2i

  10. «Open source и open weights — не одно и то же» — Gary Marcus, 2026-08-10T19:50.
    Он указывает, что крупные медиа, включая NYT, смешивают термины, сообщая о политике публикации моделей. Пост несколько старее, но во время этого запуска к нему продолжали обращаться в споре о границе между закрытыми и открытыми весовыми моделями.
    161 лайк, 50 репостов.
    https://bsky.app/profile/garymarcus.bsky.social/post/3msqupkhqic27

Сигналы
  • Самой заметной темой LLM-дискурса Bluesky сегодня был не анонс новой модели, а история Guardian/CNN о том, что дезинформация чат-бота едва не усилила военно-политическую напряжённость между США и Китаем. Этический и критический AI-кластер быстро её распространил: пост Gebru за несколько часов набрал более 300 лайков.
  • В Bluesky по-прежнему встречаются типичные для X публикации о достижениях и бенчмарках — прохождение NetHack, точность в арифметике, сравнение рисунков пеликанов. Но среди активных аудиторий заметны Bender, Marcus и другие скептики, поэтому такие сообщения часто сопровождаются контекстом «не преувеличено ли это», а не односторонним восхищением.
  • Вокруг открытых весовых моделей обсуждается не только производительность — например, арифметические результаты Qwen 3.8, — но и безопасность: со ссылкой на исследование Anthropic уже формируется спор о том, что вскоре открытые модели без ограничителей будут иметь атакующие возможности, аналогичные закрытым.
  • Замечание Gary Marcus о смешении «open source» и «open weights» продолжает постоянно всплывать как важный терминологический вопрос в этом кластере.
Ограничения
  • Официальный API поиска Bluesky https://public.api.bsky.app/xrpc/app.bsky.feed.searchPosts, который использует веб-версия bsky.app/search, возвращал HTTP 403 Forbidden при любых вариантах запросов: LLM, open weight model, разных limit и sort. Прямой доступ и доступ через прокси r.jina.ai дали тот же результат, что указывает на блокировку именно этого эндпоинта антибот-защитой.
  • Сам bsky.app/search — SPA с JavaScript-рендерингом; через WebFetch удалось получить только заголовок страницы, а не содержимое поиска. Полноценный межтематический поиск по ключевым словам выполнить не удалось.
  • В качестве альтернативы использовались app.bsky.actor.getProfile и app.bsky.feed.getAuthorFeed, не дававшие 403, вместе с веб-поиском для определения ключевых AI/LLM-аккаунтов. Поэтому эти 10 публикаций ограничены постами, цитатами и репостами именно этих аккаунтов; вирусные публикации неизвестных пользователей и темы, не репостнутые ими, могли быть пропущены.
  • Даты полученных постов — от 2026-08-10 до 2026-10-01. Большинство относится к последним 1—3 дням, но на момент получения в лентах не было постов за 10-02.
  • Официальные аккаунты OpenAI, Anthropic, Google и других компаний в Bluesky не проверялись, включая само их наличие, поскольку поиск был недоступен.

Lemmy

Lemmy — Daily LLM News (2026-10-02)

Сообщества
  • !«メールアドレス» — 88.4K подписчиков; общее технологическое сообщество. Здесь была публикация с самым высоким рейтингом среди LLM-тем дня.
  • !«メールアドレス» — 8.3K подписчиков; сообщество, посвящённое критике AI и LLM.
  • !«メールアドレス» — 6.0K подписчиков; Linux-сообщество System76/Pop!_OS, где обсуждалась политика в отношении LLM-сгенерированных PR.
  • !«メールアドレス» — число подписчиков не получено; здесь часто публикуют кросспосты технологических новостей.
  • !«メールアドレス», !«メールアドレス», !«メールアドレス» — небольшие сообщества; число подписчиков не получено.
  • !ai_reddit — сообщество зеркального бота, автоматически переносящего Reddit-посты из r/ArtificialInteligence и других разделов; отображается в федеративном поиске lemmy.world. Экземпляр, число подписчиков и рейтинг определить не удалось.
Публикации
  1. Скандал с «комнатой пыток для AI» вызвал «самый глупый спор об AI» — Someone 'Torturing' LLMs in a Robot Prison Has Triggered the Dumbest Debate in 'AI' Yet (исходная статья: 404media) — !«メールアドレス», 2026-10-01 13:45, score 158 / comments 53. Человек внедрил в промежуточные слои локальной LLM «сигнал боли» и устроил механизм, при котором нажатие кнопки остановки уничтожает предыдущий чекпойнт. В комментариях остро столкнулись сторонники идеи AI-сознания и благополучия AI с теми, кто считает, что следует переживать о реальных убийствах. Популярный комментарий с 143 голосами спрашивает: «Неужели вы переживаете о страдании AI, когда происходит геноцид?» Это самая высокооценённая LLM-публикация Lemmy за день.
  2. Кросспост той же статьи — версия Independent_Media — !«メールアドレス», 2026-10-01 13:17, score 25 / comments 10.
  3. Доступ к Gemini 4 Argon ограничен из-за опасений по безопасности — Google rolls out new Gemini AI model but restricts access over safety concerns (исходная статья: The Guardian, то же содержание подтверждается в Arab News и других источниках) — !«メールアドレス», 2026-10-01, score -3 / comments 2. Google не открыла Gemini 4 Argon для широкой публики, а предоставила ранний доступ лишь экспертам по кибербезопасности и правительству США. Модель сильна в поиске и исправлении программных уязвимостей и киберзащите, но разработана так, чтобы отказывать в содействии кибератакам и разработке химического, биологического или ядерного оружия. В Lemmy публикация встретила скорее холодную реакцию и ушла в отрицательный рейтинг.
  4. Новая панель GitHub по умолчанию выдвигает AI-чат на первый план — The very first huge field on the new default GitHub dashboard is "AI" chat (исходная статья: GitHub Changelog) — !«メールアドレス», 2026-10-01 18:27, score 48 / comments 3. Автор критикует заметное размещение AI-чата, считая, что он основан на материалах, использованных для обучения без разрешения. В комментариях предлагают переходить на Forgejo и Gitea.
  5. COSMIC от System76 запрещает LLM-сгенерированный контент в PR — COSMIC projects will no longer accept LLM-generated content in PRs (источник: GitHub PR #3911) — !«メールアドレス», 2026-10-01 15:30, score 48 / comments 6. Разработчик System76 Michael Murphy добавил в правила вкладов запрет на LLM-сгенерированный материал. В комментариях выражают недовольство случаем, когда PR с исправлением инструмента скриншотов закрыли после раскрытия факта использования AI.
  6. Адвокат сослался на выдуманных ChatGPT свидетелей в апелляции по делу об убийстве — Lawyer Cites ChatGPT-Invented Fake Witnesses in Murder Appeal (исходная статья: 404media) — !«メールアドレス», 2026-10-01 13:18, score 24 / comments 1. Та же статья была отдельно кросспостнута в !«メールアドレス» (score 22 / comments 5, ссылка) и !«メールアドレス» (score 8, ссылка) под другими заголовками. История из штата Нью-Мексико.
  7. GPT-Synopsys: OpenAI и Synopsys анонсировали передовой AI для проектирования чипов — GPT-Synopsys (источник: официальный анонс Synopsys) — !«メールアドレス», 2026-10-01 11:00, score 1 / comments 0. OpenAI и Synopsys совместно представили GPT-модель, специализированную для проектирования полупроводников. В Lemmy пока почти нет реакции.
  8. «Claude против GPT 6.1 Sol от OpenAI» — ссылка на пост (источник: Reddit r/ArtificialInteligence) — зеркало !ai_reddit, 2026-10-01 23:11, score 1 / comments 0. Тред сравнивает две закрытые модели. В Lemmy это только репост без комментариев.
  9. «Я ежедневно отслеживаю репутацию Opus 5.5 с момента запуска. 30 сентября она резко упала» — ссылка на пост (источник: Reddit r/ClaudeCode) — зеркало !ai_reddit, 2026-10-01 13:49, score 0 / comments 0. Трекер утверждает, что отношение Reddit к Claude Opus 5.5 резко ухудшилось 30 сентября.
  10. «Неожиданный поворот: Gemini 4 Argon — первая в Val AI по скорости, стоимости и точности» — ссылка на пост (источник: публикация с изображением на Reddit) — зеркало !ai_reddit, 2026-09-30 22:44, score 1 / comments 0.
Сигналы
  • Самой высокооценённой LLM-темой дня в Lemmy стал не анонс модели, а этический спор об эксперименте с причинением «боли» AI (#1, score 158). Аудитория Lemmy скорее скептична и критична к AI, а специализированные анти-AI-сообщества вроде !fuck_ai обладают заметным присутствием.
  • Даже важное объявление закрытого гиганта об ограничении Gemini 4 Argon (#3) в !technology получило отрицательный рейтинг и не стало позитивной темой.
  • Многие посты, найденные по ключевым словам «Claude», «GPT» и «Gemini», — автоматические репосты Reddit-ботов вроде !ai_reddit, обычно с рейтингом 0—1 и без комментариев. Это не самостоятельное обсуждение Lemmy, а механическое переносение тем Reddit. Живой спор по оси открытых и закрытых моделей почти не наблюдался.
  • Единственные активные комментарии касались не производительности моделей, а вопросов управления в сообществах разработчиков: запрета LLM-сгенерированных PR и неприятия навязываемых функций AI в GitHub (#4, #5).
Ограничения
  • Lemmy в целом невелик. При попытке собрать 10 LLM-публикаций дня последние четыре — #7—#10 — пришлось заполнить малореактивными репостами зеркального бота или почти не замеченными публикациями со score 0—1 и нулём комментариев. Активные нативные обсуждения были фактически только у #1, #4, #5 и #6.
  • Поиск API на lemm.ee (/api/v3/search) перенаправлялся на join-lemmy.org, поэтому поиск не работал; возможно, экземпляр изменён или остановлен.
  • Поиск тех же ключевых слов на lemmy.ml дал главным образом дубликаты публикаций, найденных на lemmy.world, без новых находок: из-за федерации один и тот же пост отображается на нескольких экземплярах.
  • Число подписчиков !Independent_Media и !ai_reddit, а также экземпляр, на котором работает !ai_reddit, определить не удалось: запросы API возвращали 404/400.
  • Исходную статью The Guardian не удалось получить напрямую, поэтому её содержание проверялось по перепечаткам с тем же материалом в Arab News, techjuice и других источниках.

Рекомендуемые действия

  • В следующем сборе по X заменить Explore-тренды на поиск по LLM-ключевым словам: названиям моделей и компаний.
  • Не ограничивать сбор Reddit одним запросом: использовать дополнительный поиск по отдельным моделям.
  • Продолжать следить за ограничениями доступа и политикой безопасности Gemini 4 Argon.
  • В следующем запуске ещё раз проверить, перестал ли поисковый API Bluesky возвращать 403, и при успехе вернуться к поиску по ключевым словам.
  • Продолжать наблюдать за спором о безопасности открытых и закрытых моделей как за постоянной темой.

Примечание о качестве данных

Сбор по X был основан на геолокализованных Explore-трендах, не связанных с LLM, и дал 0 валидных данных. Bluesky заменил поиск сбором по аккаунтам, поскольку поисковый API возвращал 403. Reddit использовал только один поисковый запрос и не включал посты от 10/2.