Облачный API транскрибации берёт деньги за каждую минуту и требует залить туда запись целиком — интервью, разговор с клиентом, внутреннюю планёрку. Whisper локально на своём сервере закрывает оба вопроса разом: аудио никуда не уходит, а предел по объёму упирается только в процессорное время, которое вы уже оплатили. Ниже — путь от чистой Ubuntu до рабочего HTTP-эндпоинта: что ставить, куда падают модели, почему pip install openai-whisper съедает несколько гигабайт диска и как не получить в расшифровке фразу «Субтитры сделал DimaTorzok», которой в записи…
Подробнее →