Калькулятор self-host LLM: расчёт GPU под инференс моделей
В Cloud FinOps появился калькулятор хостинга LLM: можно подобрать GPU-инфраструктуру под open-weight модели (Qwen, Llama 4, DeepSeek R1, GLM, gpt-oss, Devstral и др.) и сразу сравнить аренду узлов в облаках РФ — H100, H200, A100, L40S, L4, B300. Для каждой модели есть ориентир по VRAM, кванту и числу карт, плюс рядом — Hosted API в ₽/1M токенов, если он есть в каталоге. Считать инфраструктуру под инференс можно в разделе «Калькулятор → Self-host LLM».