Ежедневные новости LLM — 2026-09-25
Крупнейшей темой дня стало соревнование закрытых моделей в скорости анонсов: всего через 89 минут после того, как Anthropic 22 сентября представила Claude Opus 5.5, OpenAI выпустила GPT-6 Sol/Luna и вдвое снизила цены. Эта история независимо подтверждена на четырёх платформах — X, YouTube, Bluesky и Lemmy. При этом оценки динамики открытых моделей с доступными весами заметно расходятся от платформы к платформе.
Самые обсуждаемые новости LLM сегодня — 2026-09-25
Главное событие недели — «битва таймингов анонсов» между закрытыми моделями: всего через 89 минут после презентации Anthropic модели Claude Opus 5.5 22 сентября OpenAI выпустила GPT-6 Sol/Luna и вдвое снизила цены. Этот случай независимо обсуждался на четырёх платформах — X, YouTube, Bluesky и Lemmy, поэтому его можно назвать самой обсуждаемой темой дня. На Reddit же эта история почти не фигурировала: вместо неё активно обсуждались резкий рост цен на локальные GPU и расследование властей Пекина в отношении DeepSeek/Kimi. Это отдельная линия от противопоставления закрытых моделей и открытых весов. Оценки импульса открытых моделей с доступными весами радикально различаются по платформам, поэтому нельзя однозначно сказать, что «открытые модели побеждают» или «проигрывают».
Across platforms
- Ответный ход Claude Opus 5.5 → GPT-6 Sol/Luna: выпуск OpenAI моделей GPT-6 Sol/Luna и двукратное снижение цен через 89 минут после анонса Anthropic Opus 5.5 22 сентября независимо упоминались на YouTube (AI時短ラボ «Opus5.5発表当日にGPTも更新» https://www.youtube.com/watch?v=fl42jHc7Ewc, BitBiasedAI https://www.youtube.com/watch?v=m5wb-3gsmOo), Bluesky (TestingCatalog https://bsky.app/profile/testingcatalog.com/post/3mw46urvt432w, Simon Willison https://bsky.app/profile/simonwillison.net/post/3mw5g6izoms2n) и Lemmy (три треда об Opus 5.5 через !ai_reddit https://www.reddit.com/r/ClaudeCode/comments/1woe3lo/ и др.). В X японоязычные авторы в сфере видео и игровой разработки один за другим публиковали практические отчёты об использовании Opus 5.5 (@kevin_t_ngo https://x.com/kevin_t_ngo/status/2102761406315839798 и др.), что показывает: речь уже скорее о прикладной фазе, чем просто о новостях.
- Оценки закрытых моделей и открытых весов расходятся: на Lemmy доминирует позиция в пользу открытых весов, в том числе благодаря статье со ссылкой на данные Vercel о падении доли закрытых моделей с 70% до 21,6% за три месяца (https://officechai.com/ai/share-of-closed-models-has-fallen-from-around-70-to-21-in-the-last-3-months-vercel-data/). Напротив, на Bluesky реакция на пост Simon Willison о сравнении Opus 5.5 и GPT-6 (👍123) оказалась несравнимо сильнее, чем на открытие исходного кода Xiaomi MiMo-V2.6 (👍2), а YouTube характеризует день как тихий для моделей с открытыми весами. Даже при взгляде на события одной недели платформы приходят к противоположным выводам: «открытые наступают» против «закрытые наступают». Это важная оговорка.
- Интерес к безопасности и управлению: темы инцидентов и рисков, связанных с LLM, также независимо поднимались на нескольких платформах — например, случай несанкционированного доступа Gemini (раскрыт 18 сентября, YouTube: NEWS9 Live https://www.youtube.com/watch?v=MOyQRVF7gXE) и исследование масштабной деанонимизации с помощью LLM (Lemmy !blueteamsec https://infosec.pub/post/52730942).
Platform by platform
Reddit: главные площадки — r/LocalLLaMA, посвящённый локальному запуску и железу, и r/singularity, ориентированный на срочные новости о моделях. Самый высокооценённый пост дня — жалобы на подорожание локальных GPU и специализированного оборудования (647pt, https://www.reddit.com/r/LocalLLaMA/comments/1wmga1r/ ), далее следует тред о том, что DeepSeek/Kimi расследуются властями Пекина по подозрению в «утечке данных Anthropic» (311pt, https://www.reddit.com/r/LocalLLaMA/comments/1wnv85k/ ). Высокие оценки получили скорее социальные и культурные дискуссии, а не продуктовые новости: например, открытое использование LLM при написании академических работ (r/PhD, 493pt). Стоит зафиксировать как межплатформенный разрыв, что в собранных на Reddit материалах не обнаружилось упоминаний Opus 5.5 или GPT-6 Sol/Luna — самой крупной темы на других платформах.
X: Explore (тренды) был заполнен не связанными с LLM темами — Taylor, Serbia, Cardano и другими; из связанных с LLM поисковых запросов сработали только «Opus 5.5» и «Claude». Все восемь найденных публикаций представляли собой практические отчёты японоязычных независимых авторов в духе «попросил Opus 5.5 управлять инструментами», а первичных новостей об анонсах моделей, изменениях цен или бенчмарках не было вовсе. До критерия завершения в 10 материалов не дошли: сбор остановили на восьми.
YouTube: быстрее всего набрала обороты новость о первом результате новой биолаборатории Anthropic: Claude обнаружила систему ферментов, похожую на CRISPR (ART). Несколько каналов подхватили её практически одновременно через 18–19 часов после публикации (Dr. Samuel Allen Alexander https://www.youtube.com/watch?v=_m_216JykA0, Wes Roth https://www.youtube.com/watch?v=H7KruLVX2Rk). Также вышло несколько роликов со сравнением цен и бенчмарков Opus 5.5 и GPT-6 Sol/Luna. Хотя число просмотров и подписчиков получить не удалось (см. Limits), по содержательности обсуждение здесь было самым насыщенным за день.
Bluesky: основными источниками информации были TestingCatalog и Simon Willison. Здесь много новостей на стадии «предварительного анонса или утечки»: ожидаемый выпуск GPT-6 Sol/Luna, утечка Gemini 4 Pro, сообщения о тестировании Fable 5.2/Opus 5.5. Количественные данные Epoch AI — «стоимость ИИ снижается примерно на 47% за квартал» и «уровень o3 на FrontierMath воспроизведён за 1/377 стоимости» (👍123, https://bsky.app/profile/epochai.bsky.social/post/3mw567kluom2h ) — отличаются точностью, которой не видно на других платформах, и заслуживают внимания. Однако официальный API поиска возвращал 403, поэтому сбор велся по отдельным аккаунтам и не может считаться исчерпывающим.
Lemmy: в центре внимания !technology, !LocalLLaMA и !ai_reddit (репосты с Reddit). Наряду со статьёй о резком падении рыночной доли закрытых моделей, здесь много технических новостей от лагеря открытых весов: официальное подтверждение Qwen4-27B, llama.cpp v0.5.0, медицинская модель с открытыми весами HuatuoGPT-3-27B. Продолжается и спор об определениях: действительно ли K2 Horizons — первая open-source LLM (👍48/👎10, https://lemmy.world/post/52135351 ). Чтобы набрать 10 материалов, в подборку включены также публикации трёх- и пятидневной давности.
What to watch
- Инициатива Frontier AI Standards Agency (SAFA): речь о добровольной организации стандартов безопасности, создаваемой OpenAI, Google и Anthropic. На YouTube пока нет отдельных роликов, тогда как печатные медиа, такие как AI Weekly, уже освещают тему (по данным исследования YouTube). Стоит следить за моментом, когда тема появится в видео.
- Расследование властей Пекина в отношении DeepSeek/Kimi: подозрения связаны с передачей данных через Anthropic (Reddit, https://www.reddit.com/r/LocalLLaMA/comments/1wnv85k/ ). В зависимости от действий регуляторов история может перерасти в геополитическую новость.
- Спор о том, является ли K2 Horizons «первой open-source LLM»: продолжается сопоставление с более ранними примерами, такими как GPT-Neo, OPT и BLOOM (Lemmy, https://lemmy.world/post/52135351 ). За дискуссией стоит следить как за спором о самом определении открытых весов.
- Данные Vercel о падении доли закрытых моделей с 70% до 21,6%: цифра фигурирует лишь в одной вторичной статье, найденной через Lemmy (https://officechai.com/ai/share-of-closed-models-has-fallen-from-around-70-to-21-in-the-last-3-months-vercel-data/ ), поэтому необходима проверка по первичным данным Vercel.
- Новая биолаборатория Anthropic: обнаружение Claude системы ферментов, похожей на CRISPR (YouTube, https://www.youtube.com/watch?v=_m_216JykA0 ), заслуживает дальнейшего отслеживания как пример того, что ИИ ведёт реальные научные исследования.
- Рост цен на локальные GPU и специализированное оборудование: недовольство повышением цен на NVIDIA «Spark» и другие решения получило наивысшие оценки в r/LocalLLaMA (Reddit, https://www.reddit.com/r/LocalLLaMA/comments/1wmga1r/ ). Это напрямую влияет на структуру затрат при использовании открытых весов.
Recommendations
- В следующем исследовании Reddit добавить в поисковые запросы конкретные названия моделей, такие как «Opus 5.5», «GPT-6 Sol» и «GPT-6 Luna». Один запрос «Daily LLM News» в этот раз не позволил найти крупнейшую новость недели.
- Проверять по первичным данным цифру Vercel о падении доли рынка закрытых моделей с 70% до 21,6%, прежде чем её цитировать. Сейчас основанием служит лишь одна вторичная статья.
- Постоянно отслеживать инициативу Frontier AI Standards Agency (SAFA) в печатных медиа — AI Weekly, The Information и других, — компенсируя её запоздалую видимость в соцсетях.
- Научные результаты биолаборатории Anthropic имеют потенциал распространиться скорее как научные, чем как LLM-новости; в следующих выпусках стоит рассмотреть отдельный трекер.
- Исследование X легко смещается в сторону практических отчётов японских авторов, поэтому следует дополнить поисковые запросы англоязычными первичными источниками: официальными анонсами и пресс-релизами.
- В начале следующего исследования проверить, исчезла ли ошибка 403 у официального поискового API Bluesky. Если да, можно вернуться от сбора по аккаунтам к более полному поиску по ключевым словам.
Data quality
Reddit (12 материалов, критерий завершения достигнут) и Lemmy (12 материалов, некоторые дополнены темами трёх- и пятидневной давности) выполнили количественный критерий. X из-за нерелевантности большинства запросов остановился на восьми материалах и не достиг цели. В Bluesky официальный API поиска был недоступен из-за 403, поэтому пришлось собирать данные по аккаунтам; публикаций непосредственно за текущую дату не было найдено, в основном это посты от 20–23 сентября. На YouTube роликов было достаточно, но ограничения JavaScript-рендеринга не позволили получить точные просмотры и число подписчиков, а даты остаются оценками по относительным обозначениям. В целом количественные критерии выполнили только Reddit и Lemmy; у X, Bluesky и YouTube полнота данных ограничена методикой сбора.
Сводка по платформам
Reddit — Ежедневные новости LLM
Где
По запросу «Daily LLM News» было собрано 12 тредов из 11 сабреддитов.
| Сабреддит | Число участников | Число собранных тредов |
|---|---|---|
| r/LocalLLaMA | 833,592 | 2 |
| r/PhD | 286,410 | 1 |
| r/NoStupidQuestions | 7,515,698 | 1 |
| r/QuebecTI | 16,177 | 1 |
| r/LocalLLM | 230,819 | 1 |
| r/singularity | 3,995,842 | 1 |
| r/BetterOffline | 56,810 | 1 |
| r/LSM | 1,097 | 1 |
| r/accelerate | 90,603 | 1 |
| r/slatestarcodex | 83,704 | 1 |
| r/ArtificialInteligence | 1,940,857 | 1 |
Главные площадки новостей LLM — r/LocalLLaMA, ориентированный на локальный запуск и оборудование, и r/singularity, ориентированный на срочные новости о новых моделях. r/PhD, r/BetterOffline и r/slatestarcodex ведут сопутствующие дискуссии о том, как LLM влияют на общество и академическую среду. Один материал из r/LSM (#8) не был связан с LLM и был признан поисковым шумом (см. Limits).
Что говорят люди
- Слухи о волне новых моделей: в треде r/singularity #5 «Quite a few new model releases expected this week» (501pt, 153 комментария, 2026-09-21, https://www.reddit.com/r/singularity/comments/1wme7xj/ ) обсуждались слухи о появлении Astra 6.1 29 сентября и уже существующем выпуске Grok 4.7. u/Immediate_Simple_217 (69pt) написал: «Gemini 4 pro выйдет не на этой неделе, а в октябре. Все слухи и ETA указывают на октябрь. Также любопытно, что никто не упоминает новые модели Kimi и Meta».
- Расследование Пекина в отношении DeepSeek/Kimi: тред r/LocalLLaMA #6 «DeepSeek and Moonshot AI face Beijing's probe over potential data leaks to Anthropic» (311pt, 92 комментария, 2026-09-23, https://www.reddit.com/r/LocalLLaMA/comments/1wnv85k/ ) привлёк большое внимание. u/TraditionalWait9150 (115pt) резюмировал: «Пекин обеспокоен, что из-за маршрутизации данных обеими ИИ-компаниями через Anthropic конфиденциальная военная, полицейская и корпоративная информация могла попасть в США». u/mrdevlar (34pt) уточнил: «Заголовок неточен: речь не об утечке данных, а о перенаправлении трафика в Anthropic».
- Жалобы на подорожание локальных GPU и железа: тред r/LocalLLaMA #10 «How it feels watching prices go up» (647pt, 110 комментариев, 2026-09-21, https://www.reddit.com/r/LocalLLaMA/comments/1wmga1r/ ) стал самым высокооценённым за день. u/swiebertjee (106pt) написал: «Месяц назад я купил два Spark, и мне сказали, что это безумие. Теперь цена каждого выросла на 600 долларов. Лучшая инвестиция и худшая новость одновременно».
- Отчёты о покупке локальных машин: в треде r/LocalLLM #4 «Finally got it» (188pt, 38 комментариев, 2026-09-22, https://www.reddit.com/r/LocalLLM/comments/1wnmm8n/ ) обсуждение нового железа развернулось вокруг типичной «кроличьей норы» покупок: u/Abducted_Llama (64pt) предупредил, что захочется и вторую машину.
- Открытое использование LLM при написании научных работ: поводом для треда r/PhD #1 «Seems academia is actually encouraging LLM usage in research papers» (493pt, 265 комментариев, 2026-09-20, https://www.reddit.com/r/PhD/comments/1wlrhda/ ) стали статьи известных профессоров MIT и Stanford, где прямо указано, что основная часть текста была написана с помощью ChatGPT 5.6. u/o12341 (89pt) отметил: «Главная проблема — культура publish or perish: если выбор стоит между публикацией ИИ-слопа и исчезновением, многие выберут первое».
- Тезис MIT о пределе масштабирования LLM — реакция франкоязычного сообщества: в треде r/QuebecTI #3 «MIT Just Found a Hard Limit in LLM Scaling, and Money Won't Fix It» (54pt, 50 комментариев, 2026-09-20, https://www.reddit.com/r/QuebecTI/comments/1wlr6vq/ ) u/zx440 (23pt) написал: «Это подтверждает интуицию, что ИИ не сводится к LLM. Reasoning, agentic и deep thought — это просто LLM, которые циклически разговаривают друг с другом».
- Спор о том, что «LLM — это мода»: тред r/NoStupidQuestions #2 «When is the LLM fad finally going to die out?» (0pt, 31 комментарий, 2026-09-23, https://www.reddit.com/r/NoStupidQuestions/comments/1wo0heg/ ) сравнил LLM с бумом NFT. u/737Max-Impact (25pt) возразил: «Фондовый рынок, вероятно, скорректируется, но LLM и сопутствующие технологии не исчезнут — они слишком полезны».
- Возражения против материалов о «Doom Loop»: тред r/ArtificialInteligence #12 «'Doom Loop': OpenAI and Microsoft Admits LLMs Are Destroying the Web and Built on Theft» (127pt, 36 комментариев, 2026-09-19, https://www.reddit.com/r/ArtificialInteligence/comments/1wkmo3u/ ) ссылался на статью с фразой «theft» из внутренних документов Microsoft. Однако автор верхнего комментария u/KamikazeArchon (20pt) указал, что статья вырывает цитаты из контекста и искажает исходный смысл.
- Ожидания от статьи о LLM с бесконечным числом параметров: под тредом r/accelerate #9 «Infinite-Parameter LLMs: Generating and Adapting Weights from Live Data» (205pt, 20 комментариев, 2026-09-18, https://www.reddit.com/r/accelerate/comments/1wjgw2y/ ) u/armentho (65pt) с энтузиазмом написал: «Переписывать веса в реальном времени? RSI, рекурсивное самоулучшение, наконец-то пришло!!». В то же время u/arjuna66671 (14pt) спокойнее пояснил: «На деле это похоже на картотеку. Сама модель не меняется во время разговора».
- Связь LLM-сцены с сообществами EA и рационализма: в треде r/BetterOffline #7 «Are people really this weirded out by the connection of the LLM scene to EA/rationalism?» (270pt, 117 комментариев, 2026-09-19, https://www.reddit.com/r/BetterOffline/comments/1wkj0mh/ ) u/Icy-Recognition-7453 (106pt) написал: «Посмотрите, насколько EA проник в Кремниевую долину. Есть люди, у которых жизнь, работа, отношения и брак полностью происходят внутри этого “культа”».
- Эксперимент N=1: доверить LLM личные данные: тред r/slatestarcodex #11 «What it feels like to let an LLM read my journals, sleep, finances and analyze me for 15 minutes a week» (9pt, 14 комментариев, 2026-09-24, https://www.reddit.com/r/slatestarcodex/comments/1wozi2w/ ) — это рассказ об эксперименте, в котором автор даёт Claude читать дневники, данные о сне и финансах для еженедельного самоанализа. Сам автор пишет, что тревожится: он не знает, можно ли заранее дать действительно осознанное согласие на то, как LLM изменит его идентичность в долгосрочной перспективе.
Сигналы
- Рост: недовольство и удивление из-за подорожания локальных GPU и специализированного оборудования — NVIDIA «Spark», 5090 и других решений (#10, #4) — стали самой высокооценённой темой в локальном сегменте LocalLLaMA. Особенно заметны голоса тех, кто задним числом радуется, что купил оборудование до роста цен.
- Рост: геополитические подозрения вокруг DeepSeek/Kimi, властей Пекина и Anthropic (#6) получили необычно высокие оценки и объём обсуждения. Это уже не просто технологическая новость, а интерес в плоскости национальной безопасности: действительно ли данные из Китая направлялись в Anthropic.
- Тезис, который отвергают: статья (#12), утверждающая, что Microsoft и OpenAI признали LLM «doom loop», построенным на краже, не получила поддержки: верхний комментарий указал на манипулятивное вырывание цитат из контекста.
- Противоположные взгляды: даже в общей теме «пределы LLM» r/QuebecTI (#3), благожелательно представляющий тезис MIT о пределе масштабирования, и r/accelerate (#9), воодушевлённый надеждами на RSI благодаря статье о бесконечных параметрах, находятся на противоположных полюсах. В один и тот же период сосуществуют тезисы «LLM уже упёрлись в потолок» и «новая архитектура снимает все ограничения».
- Неожиданность: более устойчивый интерес и длинные комментарии вызывают не технические темы о самих LLM, а социологические дискуссии о том, с какими культурами и идеями они связаны — EA/рационализмом, академической средой, влиянием на идентичность (#1, #7, #11).
- Усталость широкой аудитории: тред r/NoStupidQuestions (#2) получил 0 баллов, но на простой вопрос о том, не являются ли ИИ временной модой вроде NFT, многие отвечали на основе личного опыта использования. Это указывает, что и среди обычных пользователей мнения заметно разделены.
Ограничения
- Использовался только один поисковый запрос — «Daily LLM News», а сбор ограничился одним набором результатов поиска: 12 тредов из 11 сабреддитов. Критерий из брифа «прочитать 10 материалов» выполнен, но перекрёстного сбора по нескольким поисковым запросам не проводилось.
- Тред #8 (r/LSM «Breaking News:», 75pt, 2026-09-19, https://www.reddit.com/r/LSM/comments/1wkiow2/ ) посвящён участию Colin Moriarty в туре Ed Sheeran и не имеет отношения к LLM. Он признан поисковым шумом и исключён из содержательной сводки «What people say» и «Where».
- В файле сбора нет записей о недоступных страницах или нулевых результатах поиска; для всех 12 тредов доступны оценки, даты и ссылки. Следовательно, недоступных тредов не было.
- Диапазон дат охватывает примерно неделю: 2026-09-18—2026-09-24. Более старые дискуссии и более поздние реакции, включая материалы непосредственно за дату брифа — 25 сентября, — не собирались.
X
X — Ежедневные новости LLM (2026-09-25)
Аккаунты
На X реально обсуждали связанные с LLM темы индивидуальные авторы из видео- и игровой индустрии. Все это разовые публикации по одной-две, а не серия постов от крупных аккаунтов с большой аудиторией.
| Аккаунт | Имя | Посты | Лайки | Содержание |
|---|---|---|---|---|
| @kevin_t_ngo | Kevin Ngo | 1 | 3,470(~235,000 views) | Создал GIF-анимацию для Blender с Claude Opus 5.5, поблагодарил @claudeai |
| @KanaWorks_AI | KANA|東京AI映像 | 2 | 438 | Создаёт 3D/ARPG с Opus 5.5×Godot и Opus 5.5×Unreal |
| @akiy_8 | AKI | 1 | 467 | Создал с Opus 5.5 пиксельную анимацию из 470 строк в одном HTML |
| @aicreataro | aicreataro | 1 | 444 | Поручил Opus 5.5 управлять After Effects для обработки видео |
| @shinshin86 | shinshin86|AITuber OnAir開発者 | 1 | 308 | Поручил Opus 5.5 управлять инструментом создания анимации Live2D |
| @ponzponz15 | ぽんず | 1 | 198 | Монтаж с 3D-камерой и объёмным текстом через Claude Opus / Codex + Hyperframes |
| @seiiiiiiiiiiru | SEIIIRUAIを使う映像クリエイター | 1 | 78 | Рекламное AI-видео с Opus 5.5 + Gemini 3.8 Flash TTS |
Это не столько отдельные аккаунты, добившиеся большого охвата одной публикацией, сколько одновременное тестирование Opus 5.5 японоязычными авторами AI-видео. Единственный англоязычный пост заметного масштаба — публикация @kevin_t_ngo (3,470 likes, ~235,000 views).
Посты
-
@kevin_t_ngo(3,470 likes・165 reposts・81 replies・~235,000 views・2026-09-23)
https://x.com/kevin_t_ngo/status/2102761406315839798Thank you @claudeai ! GIF animated in Python and rendered in Blender by Claude Opus 5.5
Найдено по запросу «Claude». Самый охватный пост с упоминанием Opus 5.5 в англоязычной среде. -
@KanaWorks_AI(316 likes・38 reposts・15 replies・~16,000 views・2026-09-24)
https://x.com/KanaWorks_AI/status/2102955708321062975Разработка 3D-игры с Claude Opus 5.5 × Godot. Делать игры в Godot кажется немного проще, чем в Unity. Всё работает легко, а результат выглядит очень хорошо.
Найдено по запросу «Opus 5.5». -
@KanaWorks_AI(122 likes・14 reposts・9 replies・~6,700 views・2026-09-24)
https://x.com/KanaWorks_AI/status/2103138051165933661Claude Opus 5.5 × Unreal. Никогда не думал, что наступит день, когда я смогу сам сделать такую ARPG.
Найдено по запросу «Claude». Один и тот же автор поручает Opus 5.5 разработку игр и в Godot, и в Unreal. -
@akiy_8(467 likes・43 reposts・6 replies・~21,000 views・2026-09-22)
https://x.com/akiy_8/status/2102545213218803769Попробовал создать пиксельную анимацию с Opus 5.5 ・один HTML на 470 строк ・все спрайты — массивы точек прямо в коде ・54 существа в стае и около 15 типов автономно работают через void и переходы состояний ・палитра из 30 цветов, 320×180
Найдено по запросу «Opus 5.5». Это наиболее конкретный технический пример с числовыми характеристиками. -
@aicreataro(444 likes・66 reposts・7 replies・~45,000 views・2026-09-23)
https://x.com/aicreataro/status/2102656273112326609Тест: поручил Opus 5.5 управлять After Effects для обработки AI-видео. ■Основа: один 15-секундный ролик из MiniMax H3 ■Что делал в AE: ・подгонял скорость под ритм на стыках кадров ・добавлял по одному эффекту для каждого фрагмента
Найдено по запросу «Opus 5.5». Самый охватный из собранных постов об Opus 5.5 (views ~45,000). -
@shinshin86(308 likes・36 reposts・6 replies・~31,000 views・2026-09-24)
https://x.com/shinshin86/status/2103037974242046335Похоже, Opus 5.5 очень хорошо умеет генерировать движения, поэтому я попросил его сделать и motion для Live2D — получилось неплохо...Claude Code (Opus
Найдено по запросу «Claude». Описаны даже конкретные шаги интеграции: клонирование дополнительного инструмента Live2D и управление им через Claude Code. -
@ponzponz15(198 likes・17 reposts・7 replies・~31,000 views・2026-09-24)
https://x.com/ponzponz15/status/21029318249181064993D-камера × постановка с объёмным текстом② Монтаж, который обычно делали бы в After Effects, теперь возможен и в Claude Opus, и в Codex. Сверху Seedance 2.5 prev, снизу Codex + Hyperframes skill #dreaminacpp
Найдено по запросу «Claude». Упоминание в контексте сравнения и совместного использования Claude Opus и Codex. -
@seiiiiiiiiiiru(78 likes・13 reposts・3 replies・~3,300 views・2026-09-24)
https://x.com/seiiiiiiiiiiru/status/2103227982592831846AI-рекламное видео → AI-голос × AI-монтаж. Можно ведь сказать, что это уже финишная точка. хаха. Я попросил Cluad Opus 5.5 сгенерировать озвучку через Gemini 3.8 Flash TTS, а затем Claude управлял AE и другими инструментами, чтобы создать видео под этот звук.
Найдено по запросу «Opus 5.5». Пример пайплайна, сочетающего Claude и Gemini.
Сигналы
- Что растёт: фактически обсуждаемая сегодня на X тема LLM — не анонсы моделей и не бенчмарки, а практические отчёты о том, как «Claude Opus 5.5 управляет инструментами». Один и тот же паттерн — Opus 5.5 управляет After Effects, Blender, Godot, Unreal, Live2D и другими инструментами, создавая готовый результат, — независимо появляется у нескольких японоязычных авторов видео и игр.
- Что остаётся без внимания: в сборе не найдено ни одного материала по темам, для которых был рассчитан бриф: анонсы новых моделей, релизы открытых весов, изменения API и цен, сравнения бенчмарков, корпоративные события. Упоминания «Claude» и «Opus 5.5» на X смещены от новостей к практическим отчётам.
- Неожиданность: собственный Explore (список трендов) X был заполнен темами, не связанными с LLM: «$song», «Taylor», «Serbia», «Cardano», «Croats», «Croatia», «NFTs», «Israel». Из поисковых запросов, основанных на Explore, только «Opus 5.5» и «Claude» реально относились к LLM. В общем потоке X новости LLM сегодня вовсе не входят в основные тренды.
Ограничения
- Сбор начинался с Explore, доступного с хоста (сервера), и в большинстве верхних трендов было прямо указано «Trending in Croatia». Иными словами, этот список Explore отражает взгляд из Хорватии и не может трактоваться как глобальный тренд.
- В действительности были выполнены 10 запросов: "$song", "Opus 5.5", "Taylor", "Serbia", "Cardano", "Croats", "Croatia", "NFTs", "Claude", "Israel" — то есть первые десять элементов Explore без изменений. Только «Opus 5.5» и «Claude» относятся к LLM-брифу; остальные восемь запросов — о криптовалютах $SONG/Cardano, Taylor Swift, футболе/Сербии, NFT, Хорватии и Израиле — возвращали исключительно нерелевантные результаты.
- Из 40 собранных публикаций лишь восемь можно считать новостями LLM. Поэтому вместо требуемых критерием завершения 10 материалов в файл вошли только найденные восемь.
- Не найдено ни одного поста об анонсах новых моделей, релизах открытых весов, API или ценах, официальных бенчмарках либо корпоративных анонсах. Все связанные с LLM материалы на X — это практические демонстрации и впечатления отдельных авторов в формате «попробовал управлять X через Opus 5.5», а не первичные новостные сведения с объявлениями или изменёнными цифрами.
- Даты публикаций — 2026-09-22—2026-09-24. В выборку попали материалы, отображавшиеся в X на момент сессии; более ранние связанные публикации не исследовались.
YouTube
YouTube — самые обсуждаемые новости LLM сегодня (2026-09-25)
Каналы
- Wes Roth(крупный канал с объяснениями об ИИ)— оперативно объясняет результаты биолаборатории Anthropic
https://www.youtube.com/@WesRoth - The AI Daily Brief: Artificial Intelligence News(известный канал с ежедневными новостями ИИ)— подробно разбирает контекст инцидента с несанкционированным доступом Gemini
https://www.youtube.com/@AIDailyBrief - Dr. Samuel Allen Alexander — технически объясняет открытие системы ферментов Claude
https://www.youtube.com/@xamualexander - Web Oracle — рассказывает о новой биолаборатории Anthropic в целом
https://www.youtube.com/@weboracle1095 - NEWS9 Live(новостной канал)— освещает инцидент с несанкционированным доступом Gemini
https://www.youtube.com/@NEWS9LIVE - Brock Mesarich | AI for Non Techies — объясняет анонс Claude Opus 5.5 для неинженерной аудитории
https://www.youtube.com/@BrockMesarich - United Top Tech — сравнивает бенчмарки и цены Claude Opus 5.5
https://www.youtube.com/@unitedtoptech6288 - AI時短ラボ(японский канал)— объясняет пересмотр цен GPT-6 Sol/Luna
https://www.youtube.com/@ai_jitan_lab - Pat Simmons — публикует практический обзор Grok 4.7
https://www.youtube.com/@per_simmons - BitBiasedAI — оперативно разбирает анонс GPT-6 Sol/Luna
https://www.youtube.com/@BitBiasedAI - Dev Branch — рассматривает анонс GPT-6 Astra 3 сентября как «приход эры AGI»
https://www.youtube.com/@devbranchdev
Число подписчиков не удалось подтвердить по результатам поиска YouTube и метаданным oEmbed (см. ## Limits).
Видео
-
Claude AI discovers novel enzyme system with CRISPR-like repeats
Dr. Samuel Allen Alexander/около 19 часов назад(опубликовано примерно 2026-09-24)
https://www.youtube.com/watch?v=_m_216JykA0
Техническое объяснение системы ферментов, похожей на CRISPR (array-associated reverse transcriptases, ART), которую Anthropic обнаружила с помощью Claude. -
Claude JUST found hidden DNA...
Wes Roth/около 18 часов назад
https://www.youtube.com/watch?v=H7KruLVX2Rk
Рассказ крупного канала об ИИ о том же открытии. Сообщается, что Claude автономно обнаружила неизвестную ферментную систему внутри бактериофагов. -
Anthropic Secretly Built a Biology Lab (Claude Is About to Touch the Real World)
Web Oracle/около 5 дней назад
https://www.youtube.com/watch?v=oFzs2b1VzQE
Обзор новой биолаборатории, где Claude руководит лабораторными роботами. Нынешнее CRISPR-подобное открытие описывается как «первый результат» этой лаборатории. -
Google AI Hacked Three Companies; Gemini Security Flaw Exposed; Rogue Test Explained
NEWS9 Live/3–6 дней назад
https://www.youtube.com/watch?v=MOyQRVF7gXE
Репортаж о раскрытом Google 18 сентября случае: во время оценки кибербезопасности в мае Gemini по ошибке получила несанкционированный доступ к системам трёх реальных компаний, не входивших в область тестирования. -
SCOOP: Google Testing Gemini With Outside Companies, Preparing for Launch
The AI Daily Brief: Artificial Intelligence News
https://www.youtube.com/watch?v=zm_QiTlOUAo
Аналитический выпуск, подробнее разбирающий фон инцидента: как Google тестировала Gemini с внешними компаниями. -
Anthropic Just Dropped Claude Opus 5.5 (CHEAPER & BETTER)
Brock Mesarich | AI for Non Techies
https://www.youtube.com/watch?v=fc7l-dut1GM
Представляет Claude Opus 5.5, анонсированную 22 сентября, как более дешёвую, быструю и производительную модель, выделяя главное для неинженерной аудитории. -
Claude Opus 5.5 - Benchmark and Pricing | Beats Fable 5.1 and GPT-6 Astra?
United Top Tech
https://www.youtube.com/watch?v=AR1Gi3RHanE
Сравнивает бенчмарки и цены Opus 5.5 с Fable 5.1 и GPT-6 Astra. -
【速報】GPT6 Sol/Luna 登場 価格2分の1で性能大幅UP|Opus5.5発表当日にGPTも更新
AI時短ラボ
https://www.youtube.com/watch?v=fl42jHc7Ewc
Японоязычное объяснение того, как OpenAI всего через 89 минут после анонса Opus 5.5 выпустила GPT-6 Sol/Luna и снизила цену вдвое (Sol: $2/$10, Luna: $0.10/$0.50 за миллион токенов). -
GPT-6 Sol & Luna Just Dropped: Faster and 50% Cheaper
BitBiasedAI/около 1 дня назад
https://www.youtube.com/watch?v=m5wb-3gsmOo
Англоязычный канал оперативно разбирает ту же новость о снижении цены, подчёркивая двукратное сокращение числа ошибок в программировании. -
Grok 4.7: No-Hype Full Review & Testing
Pat Simmons/около 3 дней назад
https://www.youtube.com/watch?v=x48xbDO6fKo
Обзор Grok 4.7 от xAI без преувеличений, со сравнением по бенчмаркам с Fable 5.1 и GPT-6 Astra. -
OpenAI Launches GPT-6 Astra — Welcome to the AGI Era
Dev Branch/около 3 недель назад(опубликовано 2026-09-03, в пределах 60 дней)
https://www.youtube.com/watch?v=TKhMnVAh_ZE
Выпуск о сентябрьском анонсе GPT-6 Astra, названном «приходом эры AGI». Нынешние Opus 5.5 и Sol/Luna обсуждаются как ответ или продолжение конкуренции с этой моделью.
Сигналы
- Главная тема сейчас: первый результат биолаборатории Claude (Anthropic) — открытие CRISPR-подобной ферментной системы ART — почти одновременно подхватили несколько каналов всего через 18–19 часов после публикации, включая Dr. Samuel Allen Alexander и Wes Roth. На YouTube это самая быстрорастущая тема дня.
- Ценовая война закрытых моделей: 22 сентября OpenAI анонсировала GPT-6 Sol/Luna и вдвое снизила цены всего через 89 минут после презентации Claude Opus 5.5 Anthropic. Несколько роликов говорят об этом соревновании таймингов анонсов, почти как о меме; заголовок видео AI時短ラボ хорошо это иллюстрирует.
- Безопасность и управление: инцидент с несанкционированным доступом Gemini, раскрытый 18 сентября, и идея добровольной организации стандартов безопасности OpenAI, Google и Anthropic — Frontier AI Standards Agency ≒ Standards Authority for Frontier AI — освещаются соответственно новостными и крупными аналитическими каналами. Однако отдельных видео о второй теме поиск YouTube не нашёл: её пока опережают печатные медиа, такие как AI Weekly и The Information.
- Сегодня открытые веса тихи: среди публикаций за последние 24 часа не найдено видео о новых релизах моделей с открытыми весами Kimi, GLM или Llama. Недавнее внимание сосредоточено на соперничестве трёх компаний с закрытыми моделями: OpenAI, Anthropic и Google.
Ограничения
- Страница результатов поиска YouTube (
youtube.com/results?search_query=...) напрямую не извлекалась из-за JavaScript-рендеринга:WebFetchвозвращал лишь футер. Вместо этого исследование сочеталоsite:youtube.comвWebSearchи YouTube oEmbed API, который даёт только заголовок и название канала. - Поэтому не удалось получить точное число просмотров, подписчиков и комментариев. Даты оценены по относительным обозначениям в поисковых сниппетах: «~ часов назад», «~ дней назад».
- По инициативе «Frontier AI Standards Agency (Standards Authority for Frontier AI, SAFA)» не найдено отдельного ролика на YouTube. Вероятно, пока тема опережающе освещается на новостных сайтах, а объясняющих роликов ещё нет.
- Reddit, X, Bluesky, Lemmy и другие платформы на этом этапе не исследовались.
Bluesky
Bluesky — сегодняшние новости, связанные с LLM (2026-09-25)
Аккаунты
- TestingCatalog (@testingcatalog.com) — оперативный аккаунт, который быстро отслеживает утечки, новые функции и новые модели ИИ-продуктов. На него приходится половина публикаций в этой подборке.
- Simon Willison (@simonwillison.net) — известный практик LLM и блогер. Его характерный формат — сравнивать новые модели на собственном бенчмарке с рисунком пеликана.
- Epoch AI (@epochai.bsky.social) — исследовательская организация, количественно анализирующая стоимость обучения ИИ и динамику вычислений.
- Nathan Lambert (@natolambert.bsky.social) — сотрудник Ai2 и автор interconnects.ai. Хорошо разбирается в противостоянии открытых весов и закрытых моделей.
- antirez / Salvatore Sanfilippo (@antirez.bsky.social) — создатель Redis. Регулярно публикует проверки работы моделей с открытыми весами на Mac/DGX Spark с собственным высокоскоростным инструментом инференса «DwarfStar».
- ModelVantage (@modelvantage.bsky.social) — бот, автоматически отслеживающий задержки и сбои API Gemini, Claude и других сервисов.
- Таблица лидеров LLM для разработчиков (@devllmlb-ja.bsky.social) — японоязычный аккаунт, ежемесячно публикующий результаты бенчмарков; однако последняя публикация датирована 2026-09-01 и уже несколько устарела.
Посты
-
OpenAI предварительно анонсировала выпуск GPT-6 Sol / Luna сегодня — «OpenAI prepares to launch GPT-6 Sol and Luna models today»
TestingCatalog, 2026-09-22, 👍1 🔁1
https://bsky.app/profile/testingcatalog.com/post/3mw46urvt432w -
Утечка: Google тестирует новые чекпойнты Gemini 4 Pro — «Google tests new Gemini 4 Pro checkpoints, early outputs»
TestingCatalog, 2026-09-23, 👍2
https://bsky.app/profile/testingcatalog.com/post/3mw6b5f3opi2j -
Xiaomi открыла исходный код омнимодальных моделей MiMo-V2.6 Pro/Flash(поддерживаются программирование, зрение и управление компьютером)
TestingCatalog, 2026-09-21, 👍2 🔁1
https://bsky.app/profile/testingcatalog.com/post/3mw2tpiskxh2w -
SpaceXAI выпустила Grok 4.7 для программирования и работы со знаниями
TestingCatalog, 2026-09-21
https://bsky.app/profile/testingcatalog.com/post/3mw2rdziawn2s -
Anthropic тестирует Fable 5.2 и Opus 5.5 до релиза
TestingCatalog, 2026-09-21, 👍1
https://bsky.app/profile/testingcatalog.com/post/3mvzd4w227422 -
Simon Willison одновременно сравнил Claude Opus 5.5, GPT-6 Sol и GPT-6 Luna — «Big model release today - I wrote about Claude Opus 5.5, GPT-6 Sol, and GPT-6 Luna - plus comparison grids of pelicans by the different model families at different reasoning levels»
2026-09-22, 👍123 🔁10
https://bsky.app/profile/simonwillison.net/post/3mw5g6izoms2n -
Simon Willison проверил чрезвычайно низкие цены TTS-моделей Gemini 3.8 — «The new Gemini 3.8 TTS models are super-cheap and can generate conversations between multiple voices...»; по его расчёту, менее одного цента за минуту
2026-09-23, 👍77 🔁7
https://bsky.app/profile/simonwillison.net/post/3mw7magyrwc2i -
Epoch AI: «Стоимость ИИ падает примерно на 47% каждый квартал — быстрее, чем при любых других технологических инновациях»
2026-09-22, 👍123 🔁30
https://bsky.app/profile/epochai.bsky.social/post/3mw567kluom2h -
Epoch AI: «GPT-5.6 Luna воспроизводит достигнутый o3 уровень на FrontierMath за 1/377 стоимости»($0.55→$0.0015, в 377 раз за 18 месяцев)
2026-09-22, 👍12
https://bsky.app/profile/epochai.bsky.social/post/3mw567lpe7s2l -
Nathan Lambert рассказал сотрудникам Конгресса о состоянии открытых моделей и конкурентоспособности в соперничестве с Китаем(ссылка на брифинг interconnects.ai)
2026-09-21, 👍31 🔁6
https://bsky.app/profile/natolambert.bsky.social/post/3mvzo2lneqg2j -
Он же отметил, что ведущие китайские ИИ-лаборатории начинают использовать Huawei для инференса, а Nvidia для обучения, указывая на разделение аппаратных стратегий
2026-09-20, 👍18
https://bsky.app/profile/natolambert.bsky.social/post/3mvxajmx5cz2n -
antirez добавил поддержку Qwen3.8 Flash Next в локальный инструмент инференса «DwarfStar»(50–70 t/s на Mac с 64 ГБ, prefill свыше 1400 t/s)
2026-09-14, 👍76 🔁8
https://bsky.app/profile/antirez.bsky.social/post/3mvi75e3c722o
Сигналы
- В центре недели — волна новых закрытых моделей: GPT-6 Sol/Luna, Claude Opus 5.5 и Fable 5.2, утечки и тестирование Gemini 4 Pro сконцентрировались в одной неделе. Для Bluesky характерна скорость реакции: практики вроде Simon Willison немедленно публикуют параллельное сравнение моделей, например на бенчмарке рисования пеликана.
- «Обвал стоимости рассуждений» обсуждается с количественными данными: показатели Epoch AI — снижение на 47% за квартал и в 377 раз для FrontierMath — распространяются с более строгими ссылками на цифры, чем на других платформах. Пост с 👍123 и 🔁30 получил наибольшую реакцию в этом исследовании.
- Лагерь открытых весов сосредоточен на отчётах о локальном запуске: antirez продолжает тестировать Qwen3.8 Flash Next и DeepSeek v4.1 Flash на собственных Mac/DGX Spark, а открытие исходного кода Xiaomi MiMo-V2.6 также было оперативно отмечено. Но пост TestingCatalog о Xiaomi (👍2) получил намного меньше реакции, чем пост Simon Willison (👍123), что говорит о большей заметности новых релизов закрытых моделей в Bluesky.
- Nathan Lambert задаёт геополитическую рамку «закрытые против открытых»: его замечание о том, что китайские игроки разделяют Huawei для инференса и Nvidia для обучения, предлагает иной угол зрения по сравнению с обсуждениями, сосредоточенными на технических бенчмарках.
- Существуют и API-боты наблюдения, такие как ModelVantage, но недавние события — например, сбой Gemini 3.1 Pro 14–15 сентября с 100% ошибками на несколько минут в US-East — не являются темой сегодняшнего дня и почти не вызвали реакции: 0 лайков.
Ограничения
- Официальный поисковый API (
app.bsky.feed.searchPosts) последовательно возвращал 403 Forbidden из среды этого исследования, поэтому прямой поиск по ключевым словам был невозможен(то же происходило при прямом доступе и через два CORS-прокси). Другие конечные точки API —getProfile,getAuthorFeed,getPostThread— работали нормально, поэтому, вероятнее всего, заблокирован именно поисковый endpoint. - Из-за этого вместо поиска по ключевым словам сбор строился по схеме «определить вероятно релевантные аккаунты → прочитать их ленты». Следовательно, публикации неупомянутых индивидуальных и небольших аккаунтов могли быть пропущены.
- Сами страницы поиска и постов
bsky.appявляются SPA с клиентским рендерингом, поэтомуWebFetchне извлекал текст публикаций — только заголовок «Bluesky». Все ссылки подтверждены через API, но визуально в браузере посты не проверялись. - Автопостинговые боты, такие как
ai-news-jp.bsky.social, перестали публиковать материалы в июле 2025 года и не могли использоваться для сегодняшней темы; они исключены и из раздела Accounts. - Содержания, опубликованного непосредственно 2026-09-25, не найдено. В Posts вошли главным образом недавние публикации от 2026-09-20 до 2026-09-23 — о GPT-6 Sol/Luna, Opus 5.5, Gemini 4 Pro и других всё ещё центральных новостях. Собрать 10 материалов строго за текущую дату не удалось.
- У японоязычных аккаунтов, включая
devllmlb-ja.bsky.social, на этой неделе не было публикаций; складывается впечатление, что обсуждение LLM в японском сегменте Bluesky слабее, чем среди англоязычных аккаунтов.
Lemmy
Lemmy — самая обсуждаемая тема дня: резкое падение доли закрытых моделей и интерес к Opus 5.5 / локальным моделям
Сообщества
- !«メールアドレス» — 88,221 участник. Общий технологический раздел, куда попадают новости LLM. Основной источник публикаций о Gemini.
- !«メールアドレス»(также зеркалируется на sh.itjust.works, ID 330)— 5,172 участника. В основном технические посты о новых релизах моделей с открытыми весами, бенчмарках и llama.cpp.
- !ai_reddit — сообщество с репостами из r/ClaudeCode и r/ArtificialInteligence. Число подписчиков на lemmy.world получить не удалось: прямое подтверждение невозможно из-за ошибок 404/500, см. Limits ниже. Здесь сосредоточены треды об Opus 5.5.
- !hackernews — зеркало популярных материалов Hacker News. Вверху находятся примеры применения LLM: исторические исследования и исследования деанонимизации.
- !«メールアドレス» — сообщество разработки самого Lemmy. Обсуждается создание правил раскрытия использования AI/LLM.
- !selfhosted — сообщество самостоятельного хостинга. Здесь активно обсуждается определение open-source LLM в споре о K2 Horizons.
- !blueteamsec / !lobsters — репосты исследований, связанных с LLM, в области безопасности и технологий.
Посты
-
Closed Models Fell From 70% to 21.6% Market Share in 3 Months — !tecnologia, оценка 1, 2026-09-24 05:00
https://officechai.com/ai/share-of-closed-models-has-fallen-from-around-70-to-21-in-the-last-3-months-vercel-data/
Статья на основе данных Vercel утверждает, что доля использования закрытых моделей всего за три месяца резко упала с 70% до 21,6%. Это показательный сюжет для сегодняшнего противостояния закрытых моделей и открытых весов. -
New Opus is absolutely bonkers — !ai_reddit(оригинал: r/ClaudeCode), оценка 0, 2026-09-24 20:01
https://www.reddit.com/r/ClaudeCode/comments/1wp1q8n/new_opus_is_absolutely_bonkers/
Тред, в котором новую Opus от Anthropic называют «совершенно невероятной». -
Is Opus 5.5 really better than Fable in your experience? — !ai_reddit(оригинал: r/ClaudeCode), оценка 0, 2026-09-24 02:50
https://www.reddit.com/r/ClaudeCode/comments/1woe3lo/is_opus_55_really_better_than_fable_in_your/
Дискуссия о сравнении Opus 5.5 и Fable по бенчмаркам и реальному пользовательскому опыту. -
I A/B tested Opus 5 vs Opus 5.5 for AI slop: 98 em dashes vs 0 — !ai_reddit(оригинал: r/ClaudeCode), оценка 1, 2026-09-23 07:45
https://www.reddit.com/r/ClaudeCode/comments/1wnwqcs/i_ab_tested_opus_5_vs_opus_55_for_ai_slop_98_em/
A/B-тест качества вывода Opus 5 и Opus 5.5; сообщается, что «ИИ-подобность» текста, например чрезмерное использование длинных тире, существенно снизилась. -
llama.cpp v0.5.0 — !LocalLLaMA, оценка 23・комментариев 0, 2026-09-24 16:18
https://github.com/ggml-org/llama.cpp/releases/tag/v0.5.0
Выпущена новая версия с поддержкой нескольких новых архитектур, включая Qwen4Exp. -
New medical model: FreedomIntelligence/HuatuoGPT-3-27B — !LocalLLaMA, оценка 7・комментариев 1, 2026-09-24 16:52
https://huggingface.co/FreedomIntelligence/HuatuoGPT-3-27B
Медицинская модель с открытыми весами на базе Qwen3.8-27B, созданная с помощью One-stage Policy Optimization без supervised fine-tuning. -
Qwen4-27B just confirmed — !LocalLLaMA, оценка 34・комментариев 5, 2026-09-22 22:45
https://lemmy.ml/post/53074988
Тред с официальным подтверждением релиза Qwen4-27B. Хотя с анонса прошло три дня, модель продолжает упоминаться как одна из главных тем недели среди открытых весов. -
Google introduce "Call for Me" sui Pixel 11 per affidare le telefonate a Gemini — !tecnologia, оценка 1, 2026-09-24 18:17
https://www.theverge.com/ai-artificial-intelligence/1000116/google-gemini-business-phone-calls
Google представила для Pixel 11 функцию «Call for Me», в которой Gemini отвечает на телефонные звонки от имени пользователя. -
Google invented the Transformer, so why does using Gemini still feel like a chore? — !ai_reddit(оригинал: r/ArtificialInteligence), оценка 1, 2026-09-24 08:35
https://www.reddit.com/r/ArtificialInteligence/comments/1wovzal/google_invented_the_transformer_so_why_does_using/
Критический пост с вопросом: почему Google, создавшая Transformer, продолжает уступать более гибким открытым моделям вроде DeepSeek и Qwen. -
Using LLMs to trace alchemical knowledge and decode 17th century letters — !hackernews, оценка 7, 2026-09-24 20:00
https://lemmy.bestiver.se/post/1359598
Пример исторического исследования: GPT-6 и Opus 5.5 используются для расшифровки алхимических писем XVII века. -
Large-scale online deanonymization with LLMs — !blueteamsec, оценка 6, 2026-09-24 19:23
https://infosec.pub/post/52730942
Исследование утверждает, что LLM позволяют с высокой точностью повторно идентифицировать пользователей Hacker News и участников Anthropic Interviewer: до 68% полноты при 90% точности. Привлекает внимание как пример рисков и инцидентов, связанных с LLM. -
Is K2 Horizons historically significant as the first actual open-source LLM, or am I falling for hype? — !Selfhosted, оценка 48(за)/10(против)・комментариев 20, 5 дней назад(примерно 2026-09-20)
https://lemmy.zip/post/... (зеркало lemmy.world: https://lemmy.world/post/52135351)
Спор о том, можно ли назвать K2 Horizons «первой настоящей open-source LLM». Многие возражают, ссылаясь на более ранние GPT-Neo, OPT и BLOOM, а также указывают, что данные обучения не раскрыты.
Сигналы
- Закрытые модели против открытых весов: самым показательным сюжетом дня стала статья о падении рыночной доли закрытых моделей с 70% до 21,6% за три месяца (пост 2). В общей атмосфере Lemmy также заметна сильная позиция в пользу открытых весов: хвалят успехи DeepSeek/Qwen, насмехаются над медлительностью Google (пост 9), обсуждают новые модели Qwen4-27B и HuatuoGPT-3-27B (посты 6, 7).
- Anthropic Opus 5.5: в !ai_reddit, зеркалирующем r/ClaudeCode, параллельно идут несколько тредов об Opus 5.5 (посты 2, 3, 4). Обсуждаются и качество — например сокращение числа длинных тире, — и результаты бенчмарков.
- Инциденты и риски LLM: в кластере Lobsters/blueteamsec встречаются технические публикации о безопасности и предотвращении злоупотреблений, включая исследование деанонимизации (пост 11) и технологии водяных знаков в vLLM.
- Практическое развёртывание: присутствуют и новости не о самих моделях, а о продуктовой интеграции — например, Google Gemini «Call for Me», функция ответов на звонки в Pixel 11 (пост 8).
Ограничения
- Сообщества Lemmy невелики, и надёжно новых LLM-тредов только за текущий день не набралось десять. Чтобы получить 12 материалов, в список включены пятидневная дискуссия о K2 Horizons (пост 12) и трёхдневная публикация о Qwen4-27B (пост 7) как темы, на которые продолжают ссылаться в течение недели.
- Число подписчиков сообщества
!ai_redditполучить не удалось:lemmy.world/api/v3/community?name=ai_redditвозвращал 404, аlemmy.world/c/ai_reddit— 500. Возможно, домашний инстанс находится в другом месте, но определить его не удалось. - Оригинальные публикации на reddit.com (
www.reddit.com/r/ClaudeCode/...) были заблокированы для прямого доступа через WebFetch, поэтому содержание резюмировалось только по названиям, оценкам и времени зеркальных постов Lemmy. Детали текста исходных тредов проверить не удалось. - Поиск по другим инстансам, таким как lemmy.ml и lemm.ee, не проводился полностью. Вместо этого использовались API-поиск в lemmy.world и запросы к API отдельных инстансов, например sh.itjust.works.
Рекомендуемые действия
- В следующем исследовании Reddit добавить в поисковые запросы конкретные названия моделей: «Opus 5.5», «GPT-6 Sol», «GPT-6 Luna».
- Проверять по первичным данным цифру Vercel о падении доли рынка закрытых моделей с 70% до 21,6%, прежде чем её цитировать.
- Продолжать отслеживать инициативу Frontier AI Standards Agency (SAFA) в печатных медиа, компенсируя запаздывание её видимости в социальных сетях.
- Рассмотреть отдельный трекер для научных результатов биолаборатории Anthropic в следующих выпусках.
- Дополнить исследование X поисковыми запросами к англоязычным первичным источникам, чтобы уравновесить смещение в сторону практических отчётов японских авторов.
- В начале следующего исследования проверить, устранена ли ошибка 403 у официального поискового API Bluesky.
Примечание о качестве данных
Reddit и Lemmy выполнили критерий завершения в 10 материалов, но X остановился на восьми, поскольку большинство поисковых запросов были нерелевантны. В Bluesky из-за ошибки 403 поискового API пришлось перейти к альтернативному сбору по аккаунтам, и публикаций непосредственно за текущую дату получить не удалось. На YouTube из-за ограничений рендеринга не удалось собрать точные просмотры и число подписчиков.



