Опциональный GigaAM CTC
Можно сравнить локальный CTC-режим с прежним RNNT для конкретной записи. Это выбор, а не обещание лучшего результата во всех случаях.
Диктум v0.2.0-alpha.1 · Локально на Mac · Альфа
Точное распознавание русской речи с пунктуацией, разделение реплик по спикерам и готовый протокол. На вашем Mac, без облака, без подписки, без установки или работы через Terminal.
Бесплатно на условии обратной связи · Apple Silicon · .m4a .mp3 .wav .mp4
Длинная запись · обработка по частям
Давайте начнем с целей модуля и зафиксируем ожидания группы.
У меня вопрос по практике: где будем разбирать кейсы?
Кейсы во второй день, сейчас — теория и разбор примеров.
Реплики разложены по спикерам, с таймкодами и пунктуацией
Новый релиз
В v0.2.0-alpha.1 появились две локальные возможности, которые не меняют ваш протокол без вашего решения.
Можно сравнить локальный CTC-режим с прежним RNNT для конкретной записи. Это выбор, а не обещание лучшего результата во всех случаях.
Диктум предлагает знакомое имя в новой записи, но применяет его и сохраняет образец только после вашего явного подтверждения.
Выбирайте нужные источники, фильтруйте неназванных спикеров и открывайте папку готового результата прямо из интерфейса.
Зачем это
Интервью, многочасовые обучения, голосовые заметки. Важно не просто получить текст, а получить точный протокол: с пунктуацией, разделением по спикерам и таймкодами.
Диктум работает на ресурсах самого Mac и использует локальные модели, сильные именно на русском. Поэтому инструмент остается понятным для людей, которые не хотят жить в Terminal.
По нашим тестам на русских записях точность и пунктуация заметно лучше, чем у популярного Whisper.
Как это работает
Перетащите аудио в папку Inbox или загрузите через локальный браузер. Диктофон, iPhone, петличка.
Речь расшифровывается локально, моделью, сильной на русском. Часы аудио обрабатываются по частям.
Прослушайте семплы голосов, впишите имена, и реплики разложатся по говорящим.
Откройте результат кликом и выгрузите чистый Markdown или TXT для людей и AI-агентов.
Приватность
Аудио, промежуточные файлы и готовые тексты хранятся на вашем компьютере. Ничего не уходит в облако без вашего явного выбора.
Обработка идет на вашем Mac.
Аудио не отправляется на чужие серверы.
Построен на бесплатных компонентах.
Кому это нужно
Что внутри
Точный результат на русском, со знаками препинания.
Часы аудио, без практического лимита.
Модели, сильные именно на русском.
Разделение и переименование голосов.
Час записи за 2–3 минуты на M4/M5.
Пакетная обработка папок.
Markdown и TXT для людей и агентов.
Все на вашем Mac, без облака.
Установка и требования
Скачайте и распакуйте ZIP
Откройте START_HERE
Настройте один раз
Запустите локальный web UI


Дистрибутив маленький. При первой настройке программа скачивает нужные AI-модели, поэтому потребуется интернет. После установки папка занимает примерно 1.5-2 ГБ.
На MacBook с M4 или M5 и 32 ГБ час записи обрабатывается примерно за 2-3 минуты: около 30 раз быстрее длины записи.
Mac на Apple Silicon, 16 ГБ RAM, 20-30 ГБ свободного места и интернет при первой настройке.
Альфа-доступ
Скачивайте бесплатно, а взамен поделитесь обратной связью. Новые версии и заметки о развитии будут в Telegram.