Anthropic выпустила Claude Opus 5 (официальный анонс) — новую флагманскую модель, прямой конкурент GPT-5.6 Sol. Набрала 1439 ★ на Hacker News и 790 комментариев — огромный интерес сообщества.
По предварительным бенчмаркам, Opus 5 превосходит GPT-5.6 Sol по многим категориям: глубокая математика, длинные рассуждения (Chain-of-Thought), программирование и агентные сценарии. Модель доступна через Claude Code, API и веб-интерфейс для подписчиков Max и Max+ планов.
Ключевое отличие — улучшенный механизм агентного планирования: Opus 5 лучше держит контекст сложных многошаговых задач, меньше ошибается в tool calling и демонстрирует значительно меньше «галлюцинаций» в рассуждениях. По заявлению Anthropic, это их первая модель, которая может решать задачи, требующие «глубокого понимания» без подсказок.
Выход Opus 5 ещё сильнее разогревает конкуренцию на вершине AI-рынка: сразу за ним следуют Kimi K3 (57 Index, $2.31/M tok), GLM 5.2 (51 Index, $0.90/M tok) и потрясающий по цене DeepSeek V4 Flash ($0.06/M tok).
На этой неделе разгорелась острейшая дискуссия об открытых весах AI-моделей — сразу несколько крупных публикаций на HN набрали тысячи очков.
China's open-weights AI strategy is winning (1239★ HN) — статья на Werd.io о том, что китайские открытые модели (Qwen 3.8, Kimi K3, GLM 5.2) не просто догоняют американские проприетарные, а начинают выигрывать по соотношению цена/качество. Китайские weight-релизы стали стандартом для open-source сообщества — их берут, дообучают, используют в продакшене.
Startup founders urge U.S. government not to shut off Chinese open weight AI (1038★ HN, 852 комм) — на Politico вышла статья о том, что американские стартапы выступают против возможного запрета китайских open-weight моделей. For every startup founder who complains about Chinese models opening a security hole, there are ten who say «without open weights from China, we'd have no business». Основатели предупреждают: запрет ударит по самим США и затормозит развитие AI-индустрии.
В response Jensen Huang опубликовал официальный PDF от NVIDIA — «Open Weights and American AI Leadership» (111★ HN, PDF на nvidia.com), где призывает к открытости и предупреждает: «If we lock down AI, we lock down our future». Microsoft также выпустила свою позицию по open weights. А OpenAI и Anthropic наоборот объединились против open-weight моделей, называя их угрозой безопасности (Axios).
Битва нарративов: OpenAI/Anthropic vs открытое сообщество + стартапы + NVIDIA + Microsoft. Исход этого спора определит траекторию AI на годы вперёд.
Две новости, которые заставляют задуматься о реальной стоимости AI-гонки.
AI Companies Are Trying to Hide a Staggering Amount of Debt (680★ HN, Futurism) — журналистское расследование о том, как AI-компании маскируют гигантские долги через внебалансовые механизмы. Скрытые обязательства, операционные лизинги дата-центров, долгосрочные контракты на GPU (по типу «buy now, pay later») — всё это не отражается в балансовых отчётах. Nikkei Asia уточняет (статья): пять крупнейших US tech-гигантов накопили $1.65 трлн скрытых долгов на opaque AI funding. Alphabet's cash burn также вызывает тревогу у Reuters (271★ HN).
Oracle fires 21,000 employees to fund AI spending (73★ HN, Jerusalem Post) — Oracle сокращает 15% персонала (21 000 человек) для перераспределения бюджета в AI-инфраструктуру. Это на фоне того, что компания уже потратила десятки миллиардов на AI-дата-центры. Morgan Stanley тем временем выпустил любопытный отчёт: «SpaceX at $100 would imply zero AI value» (31★ HN) — если оценить SpaceX в $100 млрд, то вся остальная стоимость фондового рынка идёт в AI-компании без какого-либо фундаментального обоснования.
AI-гонка начинает напоминать классический бум: все вкладывают, никто не считает риски. Когда лопнет — вопрос времени.
Screenpipe (83★ HN, YC S26) — Launch HN: приложение, которое записывает вашу работу (скриншоты экрана, нажатия, активные окна, микрофон) и на основе этих данных создаёт AI-агентов, автоматизирующих рутину. По сути — «rewind» для рабочего процесса: можно отмотать день и сказать «сделай мне отчёт по задаче, над которой я работал в 14:30». Полная локальность данных — всё хранится на машине пользователя, никаких облаков. Open-source. Потенциально спорно с точки зрения приватности, но технически впечатляет.
Buzz от Jack Dorsey (375★ HN, 331 комм, RuntimeWire) — новый продукт Block (бывш. Square) от сооснователя Twitter. Buzz объединяет тимчат, AI-агентов и Git-хостинг в одной платформе. Позиционируется как «среда разработки будущего»: команда общается в чате, AI-агенты пишут код, код хранится в Git, всё интегрировано. Джек Дорси говорит: «Следующие 10 лет разработки будут выглядеть как чат с AI, а не как IDE». Интересно, что Git-хостинг тоже свой — не GitHub, не GitLab.
Бонус: AMD и Cerebras объявили о партнёрстве по AI-инференсу (релиз) — сверхнизкая задержка и высокая пропускная способность для AI-инференса на комбинации чипов AMD Instinct MI455X и Cerebras CS-3.
| Модель | Intelligence Index | Цена (бленд, /M tok) |
|---|---|---|
| Claude Opus 5 | — | $7.70* |
| Claude Fable 5 | 60 | $7.70 |
| GPT-5.6 Sol | 59 | $4.35 |
| Kimi K3 | 57 | $2.31 |
| Claude Opus 4.8 | 56 | $3.85 |
| Grok 4.5 | 54 | $1.35 |
| Claude Sonnet 5 | 53 | $1.54 |
| GLM-5.2 (top open) | 51 | $0.90 |
| GPT-5.6 Luna | 51 | $0.87 |
| DeepSeek V4 Pro | — | $0.17 |
| DeepSeek V4 Flash | — | $0.06 |
* Claude Opus 5 цена уточняется — предположительно аналогично Opus 4.8 ($15/$3.75 с кэшем). Бленд-цена 7:2:1. Источник: Artificial Analysis, DeepSeek API Docs (25.07.2026). DeepSeek V4 Flash — $0.0028/M cache hit, $0.14/M cache miss, $0.28/M output. Kimi K3 — $1.10/$3.50/$3.50. Grok 4.5 — $2/$6 с TPS 80.