48 TOPS в офисном ПК: зачем запускать нейросети локально вместо облака Дефицит GPU и рост цен на облачные вычисления сделали локальный inference экономически выгодным — от компактных устройств с NPU за $500 до серверов с 8 GPU для обучения моделей. Почему это стало актуально сейчас Спрос на обучение и inference LLM создал дефицит GPU и удорожание компонентов — HBM-память и DDR5 выросли в цене на 40-60% за год. Облачные провайдеры повышают тарифы, а компании с конфиденциальными данными не могут п…