user) составлял всего $2, тогда как затраты на облачные вычисления и передачу данных достигали $3 на пользователя, что приводило к чистому убытку в $1 на каждого пользователя. Ранее компания использовала GPU NVIDIA L4 от одного из ведущих облачных провайдеров, где генерация одного изображения занимала 12 секунд, а высокие сборы за исходящий трафик и задержки ещё сильнее увеличивали расходы. После этого компания перенесла свой слой инференса ИИ в облако Akamai, перейдя на GPU NVIDIA RTX PRO 6000. Благодаря более быстрой генерации (3–5 секунд на изображение) и поддержке квантования FP4 общий размер кластера GPU удалось сократить на 75%, а стоимость генерации одного изображения оказалась ниже, чем при использовании L4. Akamai также предложила тарифы на исходящий трафик в размере $0,005 за гигабайт — это менее 1/20 от стоимости у традиционных облачных провайдеров — и развернула 19 дата-центров с GPU и более 4400 периферийных узлов по всему миру, снизив задержку до менее 10 мс для 95% пользователей интернета. Приложение перешло на гибридный мультиоблачный подход: база данных и основная программа остались на прежнем облачном провайдере, а на Akamai был перенесён только слой инференса, при этом для балансировки нагрузки использовался открытый планировщик MultiKueue. Кроме того, Akamai предоставила субсидии на миграцию в размере до $5000 и круглосуточную поддержку. Помимо этого, южнокорейская игровая компания DevSisters также перешла на использование RTX PRO 6000 для генерации диалогов неигровых персонажей (NPC, non-player character) в реальном времени, применяя RTX 4000 Ada для создания игровых ресурсов в офлайн-режиме.