Alibaba Qwen анонсировала Qwen 3.8 — модель с 2.4 триллионами параметров в трёх вариантах: базовая, Max и Max Preview. Анонс сделан 19 июля на конференции вместе с новым релизом Kimi. Это крупнейшая open-weights модель на сегодня — по заявлению Alibaba, она конкурирует с GPT-5.6 Sol и Claude Fable 5 при значительно более низкой стоимости через токенную подписку Qwen Cloud. 840 очков и 578 комментариев на Hacker News — самое горячее обсуждение дня. В чатах спорят: действительно ли open-weights модель таких размеров может догнать проприетарные флагманы, и какова будет реальная цена инференса при 2.4T параметров (даже с MoE).
Anthropic переписала Claude Code с использованием Bun, написанного на Rust (Bun v2). В ходе миграции кодовая база была полностью переведена с TypeScript на нативный код. Хайлайты: 64 инстанса Claude работали параллельно 11 дней, сгенерировав 1 миллион строк кода; тесты проходили на 100% до мержа; после мержа выявили 19 регрессий (все позже исправлены). 461 очко и 617 комментариев на Hacker News — второй по активности тред дня. Сообщество разделилось: одни впечатлены масштабом AI-кодинга (64 параллельных агента!), другие критикуют — «19 регрессий за 2 недели неприемлемо». Ключевой вывод: harness (инфраструктура запуска агентов) так же важен, как и сама модель. Bun на Rust даёт Claude Code значительный прирост производительности по сравнению с Node.js — ниже latency, меньше памяти.
Hallmark — дизайн-скилл от Nutlope (Together AI) для Claude Code, Cursor и Codex, который отказывается выглядеть как AI-генерация. Вместо шаблонных LLM-выходов Hallmark подбирает макроструктуру под бриф, одевает её в одну из 20 тем, прогоняет через 57 слоп-тестов и добавляет самокритику перед выдачей. Две страницы по разным брифингам выглядят как разные сайты, а не цветные копии одного шаблона. Четыре команды: (дефолт) сборка UI, audit — проверка на антипаттерны, redesign — перестроить структуру, study — извлечь ДНК дизайна из скриншота или URL. Есть режим Custom для брифингов с творческой свободой — без шаблона, с нуля. Установка одной строкой: npx skills add nutlope/hallmark. Проект №1 в GitHub Trending этой недели.
Claude Fable 5 (флагманская модель Anthropic) сгенерировал контрпример к гипотезе Джакоби — одной из открытых проблем в алгебраической геометрии, которая держится уже десятилетия. Контрпример был найден в ходе тестирования математических способностей Fable 5 — модель не просто решила учебную задачу, а обнаружила новый контрпример, который не был известен в литературе. 220 очков на Hacker News, 118 комментариев. Сообщество обсуждает: это сильное свидетельство в пользу того, что frontier-модели действительно могут делать открытия в математике, или же просто очень удачная комбинация промпта и случайности? Напоминает историю с GPT-5.6 Sol и задачей выпуклой оптимизации (днём ранее). Тренд: LLM всё чаще применяются не для «решения тестов», а для поиска новых математических результатов.
| Модель | Intelligence Index | Цена (бленд, /M tok) |
|---|---|---|
| Claude Fable 5 | 60 | $7.70 |
| GPT-5.6 Sol | 59 | $4.35 |
| Qwen 3.8 (Max) | — | Token Plan |
| Kimi K3 | 57 | $2.31 |
| Claude Opus 4.8 | 56 | $3.85 |
| Grok 4.5 | 54 | $1.35 |
| Claude Sonnet 5 | 53 | $1.54 |
| GLM-5.2 (top open) | 51 | $0.90 |
| GPT-5.6 Luna | 51 | $0.87 |
| DeepSeek V4 Flash | — | $0.06 |
* Бленд-цена 7:2:1 (cache hit / input / output). Источник: Artificial Analysis. DeepSeek V4 Flash — самая дешёвая модель. Qwen 3.8 — цены по токенному плану Alibaba Cloud, пока не раскрыты per-token.