Скачали Llama или Qwen, подняли Ollama на своём железе — и в голове щёлкает: «всё, я слез с подписок, теперь это бесплатно». Формально вы правда перестали платить за токены облачному API. Но за запуск модели всё равно кто-то платит — просто счёт приходит не от OpenAI, а от вычислительной инфраструктуры, вашего времени и вашего электричества. Разберём, из чего на самом деле состоит стоимость локального ИИ и когда «свой» действительно дешевле чужого.
Подробнее →