Higgs Audio v3 TTS [Portable by Neurogen]
Портативка свежей модели синтеза речи от Boson AI —
Higgs Audio v3 (4B)При первом запуске портативка сама определяет ваши комплектующие и подбирает нужную версию модели под ваше железо, если у вас совсем плохо по железу (4гб vram и меньше), то поративка направит всю нагрузку на CPU, будет работать медленно, но зато будет
🔘Что умеет:-
Клонирование голоса — закидываешь 5–20 секунд референса, получаешь его голос (zero-shot, без обучения)
-
100+ языков, русский — отлично
-
Управление эмоциями прямо в тексте c помощью интерактивных кнопок — 21 эмоция (радость, гнев, шёпот, грусть…), стили (пение, крик, шёпот), скорость, паузы, высота тона
-
Звуки и паралингвистика — смех, вздох, кашель, чихание прямо в реплике
Пример: Серьёзно? Хаха, я не ожидал такого!
🔘
Что внутри сборки:- Красивый десктоп-интерфейс в нативном окне (тёмная glass-тема)
-
Авто-подбор под ваше железо: bf16 / 8-bit / 4-bit / CPU — само определит видеокарту
- Один клик: установщик ставит окружение, веса (~9.3 ГБ) качаются при первом запуске
- Полностью офлайн после установки, всё лежит в одной папке
🔘Требования:- python -3.11/-3.10
- Идеально: NVIDIA 8–12 ГБ VRAM и больше — летает
- 6–8 ГБ — режим 4-bit
- Нет видеокарты / слабая — режим CPU (работает, но медленно)
~10 ГБ на диске под модель, Windows 10/11
По максимуму влил оптимизации для слабых пк, у средних и сильных и так все хорошо
Скачать'https://t.me/neurogen_news/2690?comment=61499' rel='nofollow'>
Запасная ссылкаИнструкция в архиве (README) + кнопка установки в один клик.
Модель для исследовательского и некоммерческого использования (лицензия Boson). Не клонируйте чужие голоса без согласия.Собрано с душой — Portable by Neurogen