Meta впервые за долгое время выпустила новую модель Muse Glimmer 30B и выложила веса.
Это не «ещё одна открытая модель». Её натаскивали конкретно под агентный цикл: планирование, вызовы тулзов, восстановление после упавшего тула, состояние между рестартами.
Цифры:
— 30B dense, дистилляция из Muse Spark
— в 4-битном кванте меньше 20 ГБ, вместе с KV-кэшем и энкодером картинок влезает в 24 ГБ
— DFlash spec decoding: 3.1x на 5090, 1.8x на M5 Max, 1.5x на M4 Max
— 131к контекста, картинки и видео на входе, 100+ языков в претрейне
— по агентным бенчам и SWE-bench обходит Qwen 3.6 и Gemma 4 31B
Заявлена совместимость с OpenClaw из коробки. То есть мой домашний сетап на Mac Mini M4 Pro теперь теоретически сможет полноценно работать с агентами. Ровно тот сценарий, ради которого я эту песочницу и собирал.
Но есть часть, которую в анонсе не подсвечивают.
Meta честно опубликовала свои же safety-метрики. На AgentDojo (тест на prompt injection) у Glimmer 28.4% успешных атак — хуже, чем у Gemma с её 25.6%, но заметно лучше Qwen с 40.3%. На приватном бенче CI Memories вообще 26.4 против 12.1 у Gemma.
Локально не значит безопасно. Модель, которой вы дали терминал, файлы и почту, — это другой класс риска, чем локальный чатик. Meta прямым текстом советует ставить guardrails на уровне системы и не надеяться на саму модель. Хорошо, что советует. Плохо, что большинство это пропустит.
И отдельно — Цукерберг пообещал следом открыть веса Muse Spark 1.2, флагманской модели. Если реально сделают, это будет первый случай, когда американская лаба выкладывает фронтир такого уровня в открытый доступ.
Сейчас как раз работаю над ИИ-агентом с кучей тулзов и RAG, так что скоро протестирую и расскажу что по факту.
Веса: https://huggingface.co/meta-models/Muse-Glimmer-30B
Блогпост: https://research.meta.ai/blog/introducing-muse-glimmer-open-agentic-model
Павленко про Dev & AI 💻
Это не «ещё одна открытая модель». Её натаскивали конкретно под агентный цикл: планирование, вызовы тулзов, восстановление после упавшего тула, состояние между рестартами.
Цифры:
— 30B dense, дистилляция из Muse Spark
— в 4-битном кванте меньше 20 ГБ, вместе с KV-кэшем и энкодером картинок влезает в 24 ГБ
— DFlash spec decoding: 3.1x на 5090, 1.8x на M5 Max, 1.5x на M4 Max
— 131к контекста, картинки и видео на входе, 100+ языков в претрейне
— по агентным бенчам и SWE-bench обходит Qwen 3.6 и Gemma 4 31B
Заявлена совместимость с OpenClaw из коробки. То есть мой домашний сетап на Mac Mini M4 Pro теперь теоретически сможет полноценно работать с агентами. Ровно тот сценарий, ради которого я эту песочницу и собирал.
Но есть часть, которую в анонсе не подсвечивают.
Meta честно опубликовала свои же safety-метрики. На AgentDojo (тест на prompt injection) у Glimmer 28.4% успешных атак — хуже, чем у Gemma с её 25.6%, но заметно лучше Qwen с 40.3%. На приватном бенче CI Memories вообще 26.4 против 12.1 у Gemma.
Локально не значит безопасно. Модель, которой вы дали терминал, файлы и почту, — это другой класс риска, чем локальный чатик. Meta прямым текстом советует ставить guardrails на уровне системы и не надеяться на саму модель. Хорошо, что советует. Плохо, что большинство это пропустит.
И отдельно — Цукерберг пообещал следом открыть веса Muse Spark 1.2, флагманской модели. Если реально сделают, это будет первый случай, когда американская лаба выкладывает фронтир такого уровня в открытый доступ.
Сейчас как раз работаю над ИИ-агентом с кучей тулзов и RAG, так что скоро протестирую и расскажу что по факту.
Веса: https://huggingface.co/meta-models/Muse-Glimmer-30B
Блогпост: https://research.meta.ai/blog/introducing-muse-glimmer-open-agentic-model
Павленко про Dev & AI 💻