(Multi-Instance GPU, «мультиэкземплярный GPU») по схеме 2×36 ГБ. Бенчмарки в сравнении с RTX PRO 6000 Blackwell (96 ГБ) показывают лишь на 15–20% более низкую скорость генерации, при этом обе карты справляются с большими контекстами (до 128 тыс. токенов для моделей среднего размера). В сравнении с предыдущим поколением — RTX A5000 — новая карта работает почти в два раза быстрее и способна загружать в 10 раз больший контекст, а также превосходит многочиповые конфигурации на AMD в 2–5 раз по количеству токенов в секунду, хотя карты AMD дешевле в пересчёте на гигабайт памяти. Карту также протестировали с моделью Qwen3-Coder-Next через Ollama, где она показала 100–120 токенов в секунду на реальной задаче по написанию кода, а с моделью gpt-oss-120b достигла показателя 40–50 токенов в секунду. Автор приходит к выводу, что при текущих ценах и дефиците памяти RTX PRO 5000 Blackwell предлагает наилучший баланс для энтузиастов и профессионалов: карта потребляет вдвое меньше энергии, чем модель 6000, и отлично проявляет себя в задачах инференса (вывода/использования обученных моделей).