Если у вас накопились сотни часов подкаста, звонков колл-центра или лекций, рано или поздно встаёт вопрос: гонять их через облачный API распознавания речи или поднять свой сервер с открытой моделью. Разница в подходах ощущается не в качестве одной записи, а в том, как считается счёт в конце месяца — и здесь легко ошибиться в обе стороны: переплатить провайдеру за то, что можно было сделать один раз на своём железе, или закопаться в настройку сервера ради пяти часов аудио в квартал.
Подробнее →