Qwen3.8-27B - Вы это видели? Agentic Index от Artificial Analysis. Китайцы творят революцию!
27 миллиардов параметров. 51 балл в агентных бенчмарках.
Под сапогами размазаны GPT-5.6 Luna — 47. GPT-5.6 Terra (50) и DeepSeek V4 Pro (50). Гигантские модели с облачными API и лимитами проигрывают компактной сетке, которую можно запустить дома на паре RTX3090.
Локальный инференс теперь выглядит иначе. Не нужно молиться на облачные провайдеры. Закидываешь модель в vLLM, размазываешь по мульти-GPU сетапу, выкручиваешь перформанс — и у тебя на железе LLM топ-уровня, который крутит скрипты и собирает тулзы без внешних зависимостей.
Будущее за моделями, которых зафайнтюнили на нормальной синтетике и прокачали через GRPO. Размер больше не решает. Важно, как модель думает и как умеет работать со средой.
27 миллиардов параметров. 51 балл в агентных бенчмарках.
Под сапогами размазаны GPT-5.6 Luna — 47. GPT-5.6 Terra (50) и DeepSeek V4 Pro (50). Гигантские модели с облачными API и лимитами проигрывают компактной сетке, которую можно запустить дома на паре RTX3090.
Локальный инференс теперь выглядит иначе. Не нужно молиться на облачные провайдеры. Закидываешь модель в vLLM, размазываешь по мульти-GPU сетапу, выкручиваешь перформанс — и у тебя на железе LLM топ-уровня, который крутит скрипты и собирает тулзы без внешних зависимостей.
Будущее за моделями, которых зафайнтюнили на нормальной синтетике и прокачали через GRPO. Размер больше не решает. Важно, как модель думает и как умеет работать со средой.