Open source · Apache 2.0 · Полностью офлайн

Речь на устройстве.
Для реальных продуктов.

Диаризованная транскрипция, zero-shot клонирование голоса, длинный синтез речи — на Apple Silicon, Android, Windows и embedded Linux. Никаких облачных API, никакой оплаты по минутам, никакие данные не покидают устройство.

Apple · Homebrew
brew install speech
Android · Gradle
implementation("audio.soniqo:speech:0.0.9")
Свежие статьи и видео
Все публикации
YouTube · 90 сек

Полностью офлайновый голосовой агент в 1,2 ГБ на Android

Скажи — и Android сделает: полный командный цикл от речи до реального действия на устройстве и голосового ответа, на одном телефоне в 1,2 ГБ RAM. Silero VAD, Parakeet STT, вызовы инструментов FunctionGemma и Pocket TTS.

Смотреть
YouTube · 4 мин

Локальный голосовой ИИ на MacBook — обзор за 4 минуты

4-минутный тур по open-source библиотеке: транскрипция в реальном времени с Nemotron Streaming, локальный speech-to-speech с PersonaPlex и клонирование 48 кГц с VoxCPM2 — всё на ноутбуке.

Смотреть
7 июля 2026 · Блог Soniqo

Голосовые агенты на устройстве: один конвейер, три бюджета памяти

VAD → STT → LLM → TTS на телефоне и Mac · ~1.2 ГБ iPhone · ~1.5 ГБ S23 · <4 ГБ десктоп

Одна и та же агентная цепочка VAD → STT → LLM → TTS на iPhone, Galaxy S23 и Mac — с измеренной памятью для каждого бюджета.

Читать
2 июля 2026 · Блог Soniqo

Модели клонирования голоса, измеренные на пяти языках

8 движков: косинус, WER, UTMOS, RTF, пиковый RSS · Новые строки: F5-TTS, Higgs TTS 3, IndexTTS2 · Референс и клон на слух для каждого языка

Десять пар FLEURS на язык: сходство диктора, WER/CER, UTMOS, скорость и память, плюс аудио для проверки на слух.

Читать
Что можно построить

Три группы сценариев — все на устройстве.

Каждая группа охватывает несколько подсценариев, собранных из компонентов Soniqo. Подаёте аудио — получаете диалог, транскрипции или сгенерированную речь локально, в реальном времени.

Все компоненты

Более тридцати моделей. Один стек.

Все пайплайны выше собраны из этих моделей. Выберите компонент, чтобы увидеть его архитектуру, CLI, Swift API и бенчмарки. Все работают на Apple Silicon, большинство — также на Android и Linux.

Текст → речь