В первый безработный день 2026 года захотелось оглянуться назад и оценить тренды которыми мне показались важными в первом квартале этого года.
Тейк #1. Большие openweight модели
впервые стабильно обгоняют малые коммерческие при сравнимой цене.
Это началось ещё в декабре 2025 года с DeepSeek V3.2-Speciale, который впервые обошёл GPT-5 на бенчмарке AIME, показав результат в 96.0% против 94.6%.
В Q1 это закрепилось:
•
Kimi K2.5 (январь, $0.60/$2.50)
•
GLM-5 (13 февраля, MIT, обучен на 100k Huawei Ascend без Nvidia,
50.4% HLE — выше Claude Opus 4.5)
• На стыке кварталов
GLM-5.1 (7 апреля) обогнал Claude Opus 4.6 и GPT-5.4 на SWE-Bench Pro
•
Kimi K2.6 (21 апреля) забрал лидерство на HLE-Full с тулзами (
54.0 vs 52.1 у GPT-5.4)
•
DeepSeek V4-Pro (24 апреля) стала самой большой open-weight-моделью в истории, на уровне GPT-5.4 по коду при цене
в 10 раз меньше.В ценовой зоне $0.6/$2.5, где раньше преобладали GPT-5-mini, Gemini 3 Flash и Claude Haiku, теперь стабильно лидируют открытые китайские модели. Раньше использование открытых моделей оправдывалось безопасностью, и за это платили качеством. В Q1 2026 преимущество в триаде «
качество + цена + удобство» оказалось на стороне
openweight. Следующий рубеж —
абсолютно лучшее качество на рынке. По
Stanford AI Index 2026 разрыв между Китаем и США сжался до
2.7 п.п.
Тейк #2. AI-компании становятся более закрытыми по обе стороны Тихого океана
В сторону большей закрытости одновременно поплыли как китайские «открытые» лабы так и западные «закрытые».• MiniMax (после
IPO в Гонконге 9 января, $620M) 18 марта выпустила
M2.7 под «Modified-MIT» — коммерческое использование требует письменного разрешения. M2 и M2.5 были чистым MIT.
• Alibaba за квартал выпустила четыре модели доступные только по API: Qwen3.5-Omni (30 марта),
Qwen3.6-Plus и ещё две (2 апреля),
Qwen3.6-Max-Preview (20 апреля), то есть
впервые флагман Qwen без открытых весов.
• Xiaomi перевела
MiMo v2 без открытых весов (правда, вышедшая пару дней назад
MiMo v2.5 вернулась к MIT).
•
Z.ai (тоже после
IPO 8 января) выпустила GLM-5-Turbo с доступом только по API.
В свою очередь западные компании дают доступ к своим топ-моделям
только избранным:
•
Anthropic Mythos / Project Glasswing (7 апреля) — обогнал Opus 4.6 на USAMO 2026 на
31 п.п. и нашёл сотни уязвимостей в публичных репозиториях. Доступ только
~40 организациям (Microsoft, Google, Apple, AWS, JPMorgan, Nvidia).
•
OpenAI GPT-5.4-Cyber (15 апреля) — зеркальный ответ через
Trusted Access for Cyber.
•
OpenAI GPT-Rosalind (16 апреля) — биология и разработка лекарств, только верифицированные US enterprise-клиенты.
За чем следить до конца года?
1.
Раскатка китайского железа в Q4 уберет стеклянный потолок.В Q4 2026 Huawei выпустит Ascend 950DT (144GB HiZQ 2.0, 4 TB/s на уровне паритет с HBM3e) и Atlas 950 SuperPoD на 8192 чипа. Уже в Q1 в продаже появится 950PR с CUDA-совместимым стеком.
ByteDance сделал закупку на $5.6 млрд, Alibaba и Tencent в очереди. Причина текущего разрыва до лучших американских моделей (2.7 п.п.; сами DeepSeek оценивают в
3-6 месяцев), как мне кажется, во многом заключается
в недостатке железа.2.
Продолжится ли тренд на закрытость? DeepSeek остаётся единственным крупным игроком дающим доступ к весам всех своих моделей. Mythos и Rosalind — разовый эксперимент или
«Too Dangerous to Release» стало постоянной нормой, и топ-модели уходят за guard wall навсегда?
3.
Экономика младших версий LLM — меняйся или умри.У Google Gemini 3.1 вышла в Pro (фев) и Flash-Lite (март), а Flash остановилась на версии 3 preview. У OpenAI gpt-mini перепрыгнула с GPT-5-mini (август 2025) сразу на GPT-5.4-mini (март 2026). Учитывая, что в этой ценовой зоне уже находятся Kimi K2.6 и GLM-5.1 давая лучшее качество, а на пользовательском железе работают
Qwen3.6-27B и
Gemma 4 — экономика младших коммерческих моделей становится
всё более странной. Возможно западные компании выберут свернуть mini/flash-сегмент и
сконцентрируются на флагманских моделях.