[{"data":1,"prerenderedAt":113},["ShallowReactive",2],{"wp-page-data-vram-calculator":3},{"id":4,"date":5,"date_gmt":6,"guid":7,"modified":9,"modified_gmt":10,"slug":11,"status":12,"type":13,"link":14,"title":15,"content":17,"excerpt":20,"author":21,"featured_media":22,"parent":23,"menu_order":22,"comment_status":24,"ping_status":24,"template":18,"meta":25,"acf":26,"_links":79},24122,"2026-06-16T15:10:46","2026-06-16T12:10:46",{"rendered":8},"https://selectel.ru/?page_id=24122","2026-06-18T14:11:41","2026-06-18T11:11:41","vram-calculator","publish","page","https://selectel.ru/services/vram-calculator/",{"rendered":16},"VRAM калькулятор",{"rendered":18,"protected":19},"",false,{"rendered":18,"protected":19},26,0,21,"closed",[],{"product_tag":27,"seo":28,"values":35,"teaser":36,"breadcrumbs":38,"pageTeaser":44,"consultation":52,"faq":53},"product_tag",{"title":18,"description":18,"og":29,"vk":30,"twitter":31,"link":33,"hasMicroData":19,"isNoFollow":19},{"title":18,"description":18,"image":19},{"image":19},{"title":18,"description":18,"image":19,"site":32},"@selectel",{"canonical":18,"alternate":34},{"ru":18,"x-default":18,"isDisabled":19},{"title":18,"subtitle":18,"items":19},{"breadcrumbs":19,"show_current_page_in_breadcrumbs":37,"title":18,"additional_title":18,"subtitle":18,"description":18,"background_image":19,"additional_content":18,"advantages":18},true,{"items":39,"isShowCurrentPage":37},[40],{"title":41,"link":42,"id":43},"Цены","https://selectel.ru/prices/","6a313f761080b",{"title":45,"content":46,"tags":47,"isShowRegistrationForm":37},"VRAM-калькулятор","\u003Cp>Инструмент для расчёта необходимого объёма видеопамяти и&nbsp;подбора GPU для инференса ИИ-моделей на&nbsp;мощностях Selectel.\u003C/p>\n",[48,50],{"title":49},"GPU под ваши задачи",{"title":51},"Beta",{"description":18,"descriptionForAuthorized":18,"link":18},{"items":54},[55,59,63,67,71,75],{"question":56,"id":57,"answer":58},"Какие факторы формируют серверный расчет VRAM?","6a315e9a75bac","\u003Cul>\n\u003Cli>Статические веса: базовый размер модели в&nbsp;целевой точности (FP16, INT8, FP4).\u003C/li>\n\u003Cli>Динамический KV&mdash;Cache: память под контекст, умноженная на&nbsp;Max Batch Size.\u003C/li>\n\u003Cli>Рантайм (Runtime): оверхед TensorRT-LLM, vLLM или Hugging Face TGI.\u003C/li>\n\u003Cli>Запас под пики: буфер для предотвращения сбоев OOM при максимальной нагрузке.\u003C/li>\n\u003C/ul>\n",{"question":60,"id":61,"answer":62},"Как размер батча (Batch Size) влияет на&nbsp;требования к&nbsp;памяти?","6a315e9a7b75e","\u003Cul>\n\u003Cli>Линейный рост: каждый новый параллельный запрос увеличивает размер KV&mdash;Cache.\u003C/li>\n\u003Cli>Эффект сжатия: vLLM&nbsp;с PagedAttention снижает фрагментацию, но&nbsp;батч все равно доминирует.\u003C/li>\n\u003C/ul>\n",{"question":64,"id":65,"answer":66},"Какие типы квантования оптимальны для инференса?","6a315e9a7e6a1","\u003Cul>\n\u003Cli>AWQ&nbsp;/ GPTQ (INT4/INT8): сохраняют высокую скорость вычислений на&nbsp;Tensor Cores.FP8 (Hopper&nbsp;/ Blackwell): стандарт для современных дата-центров (H100/B200).\u003C/li>\n\u003Cli>Исключение GGUF: данный формат неэффективен для параллельной серверной нагрузки.\u003C/li>\n\u003C/ul>\n",{"question":68,"id":69,"answer":70},"Что происходит при превышении лимита VRAM в&nbsp;продакшене?","6a315e9a81965","\u003Cul>\n\u003Cli>Для vLLM&nbsp;/ TGI: новые запросы встают в&nbsp;очередь (K-V swapping&nbsp;/ Eviction).\u003C/li>\n\u003Cli>Для обычных систем: мгновенный сбой Out of&nbsp;Memory (OOM) и&nbsp;падение пода/контейнера.\u003C/li>\n\u003Cli>Бизнес-эффект: рост задержки (Latency) или полная недоступность сервиса (Downtime).\u003C/li>\n\u003C/ul>\n",{"question":72,"id":73,"answer":74},"Как рассчитать VRAM для MoE (Mixtral, DeepSeek) архитектур?","6a315e9a8502a","\u003Cul>\n\u003Cli>Особенность весов: в&nbsp;память загружаются все эксперты (Experts) целиком.\u003C/li>\n\u003Cli>Плюс вычислений: в&nbsp;один момент времени активируется лишь часть параметров.\u003C/li>\n\u003Cli>Требование к&nbsp;памяти: такое&nbsp;же высокое, как для плотных (Dense) моделей аналогичного объема.\u003C/li>\n\u003C/ul>\n",{"question":76,"id":77,"answer":78},"Как выбрать оптимальный GPU под расчетные данные?","6a315e9a87e01","\u003Cul>\n\u003Cli>Для инференса 7B-34B: одиночные карты NVIDIA L40S, A10 или H100&nbsp;NVL.\u003C/li>\n\u003Cli>Для сверхбольших LLM: кластеры (8x&nbsp;H100&nbsp;/ A100) с&nbsp;разделением через Tensor Parallelism.\u003C/li>\n\u003Cli>Критерий выбора: пропускная способность памяти (Memory Bandwidth, ГБ/с) важнее сырой мощности.\u003C/li>\n\u003Cli>Для точного подбора инфраструктуры под ваш запрос рекомендуем обратиться к&nbsp;специалистам Selectel&nbsp;&mdash; мы&nbsp;подробно рассмотрим вашу задачу и&nbsp;предложим оптимальное решение.\u003C/li>\n\u003C/ul>\n",{"self":80,"collection":83,"about":86,"author":89,"replies":92,"version-history":95,"predecessor-version":99,"up":103,"wp:attachment":106,"curies":109},[81],{"href":82},"https://selectel.ru/wp-json/wp/v2/pages/24122",[84],{"href":85},"https://selectel.ru/wp-json/wp/v2/pages",[87],{"href":88},"https://selectel.ru/wp-json/wp/v2/types/page",[90],{"embeddable":37,"href":91},"https://selectel.ru/wp-json/wp/v2/users/26",[93],{"embeddable":37,"href":94},"https://selectel.ru/wp-json/wp/v2/comments?post=24122",[96],{"count":97,"href":98},14,"https://selectel.ru/wp-json/wp/v2/pages/24122/revisions",[100],{"id":101,"href":102},24162,"https://selectel.ru/wp-json/wp/v2/pages/24122/revisions/24162",[104],{"embeddable":37,"href":105},"https://selectel.ru/wp-json/wp/v2/pages/21",[107],{"href":108},"https://selectel.ru/wp-json/wp/v2/media?parent=24122",[110],{"name":111,"href":112,"templated":37},"wp","https://api.w.org/{rel}",1789121597359]