Два разных сценария
Живое распознавание начинается с речи пользователя и заканчивается текстом в активном приложении. Транскрибация обрабатывает уже записанный файл. Не стоит оценивать оба сценария одной метрикой: для диктовки важна задержка, для интервью — полнота и удобство редактирования.
Как работать на Mac
Echo запускает короткую диктовку сочетанием Command-D, а готовый текст копирует в буфер обмена. Сочетание Command-R сбрасывает текущую запись. Приложение работает на macOS 14 и новее, поддерживает Intel и Apple Silicon.
Для облачной обработки пользователь выбирает OpenAI или Grok и добавляет свой API-ключ. Ключ хранится в Keychain macOS, а аудио отправляется напрямую выбранному провайдеру.
Как получить более точный результат
- говорите ближе к микрофону;
- избегайте музыки и постоянного шума;
- формулируйте числа и имена чуть медленнее;
- проверяйте важные фрагменты по источнику;
- не принимайте автоматическую расшифровку за финальную редактуру.
Сравните диктовку на Mac и голосовой ввод на Mac, а для длинной записи используйте расшифровку аудио в текст.
Вывод
Распознавание речи на Mac становится удобным, когда живой ввод и работа с файлами разделены, а у пользователя есть ясный способ запуска, понятный путь аудио и время на финальную проверку.