aitamus


Гео и язык канала: не указан, не указан
Категория: не указана



Гео и язык канала
не указан, не указан
Категория
не указана
Статистика
Фильтр публикаций


Qwen3.8-27B - Вы это видели? Agentic Index от Artificial Analysis. Китайцы творят революцию!
27 миллиардов параметров. 51 балл в агентных бенчмарках.
Под сапогами размазаны GPT-5.6 Luna47. GPT-5.6 Terra (50) и DeepSeek V4 Pro (50). Гигантские модели с облачными API и лимитами проигрывают компактной сетке, которую можно запустить дома на паре RTX3090.
Локальный инференс теперь выглядит иначе. Не нужно молиться на облачные провайдеры. Закидываешь модель в vLLM, размазываешь по мульти-GPU сетапу, выкручиваешь перформанс — и у тебя на железе LLM топ-уровня, который крутит скрипты и собирает тулзы без внешних зависимостей.
Будущее за моделями, которых зафайнтюнили на нормальной синтетике и прокачали через GRPO. Размер больше не решает. Важно, как модель думает и как умеет работать со средой.




Немного разверну мысль.
Всё, чем агенты сейчас пользуются, - это наши тулзы (то что люди годами писали для людей). Учить агенты ими пользоваться непрактично. Эффективно - это когда они сами собирают свои тулзы под конкретные задачи.

- Представьте себе: ваш агент абсолютно пустой. Вы ставите перед ним задачу. И он не идёт её делать с помощью подручных средств. Он сначала их собирает. Как герой из комиксов про Зелёных Фонарей — пустое кольцо, воля, и любой инструмент материализуется тогда, когда он нужен.

- Prime Agent работает именно так. Вместо фиксированного набора функций ему дают среду, в которой выполняется любая его хотелка (которую он описывает себе сам на Python). Контекст — это переменные, которые можно резать и фильтровать кодом. Субагенты - это рекурсивный вызов самого себя rlm(...) внутри скрипта, а не отдельный слой оркестрации.

Отдельным бонусом — саморефлексия /refine: агент дописывает себе память, скиллы и спецификации. Фактически любой скилл - это расширение на языке Python.

Ставлю на то, что агенты в ближайшем будущем вместо консольных утилит обретут оболочку со встроенным компилятором, а LLM под кодинг зафайнтюнят думать не на человеческом языке, а на языке, удобном агенту.

Ссылка на агента


После прошедших выходных, на которых мне удалось-таки пощупать нового агента Prime Agent на базе RLM-подхода, вангую: это единственное направление развития агентов.

Показано 4 последних публикаций.