Как только Meta выкатывает новое поколение Llama, в чатах и на форумах начинается одно и то же: кто-то называет точные гигабайты VRAM «для 4090», кто-то божится, что «на CPU тоже летает», а через полгода эти цифры оказываются либо для другой версии модели, либо для другой квантизации. Разбираться в этом на своём железе куда надёжнее, чем верить чужим скриншотам — ниже методика, которая не зависит от того, какая именно ревизия Llama 4 у вас в руках.
Подробнее →