Rekeningscrisis bij app met miljard dagelijkse gebruikers: inferentiekosten omgekeerd, cross-cloud-architectuur verkleint GPU-cluster met 75%
Een grensoverschrijdende AI-mode- en shopping-app met meer dan 100 miljoen dagelijkse actieve gebruikers verloor $1 per gebruiker door hoge inferentiekosten en lage ARPU. Door over te stappen naar Akamai's cloud met NVIDIA RTX PRO 6000 GPU's en FP4-kwantificatie werden de kosten drastisch verlaagd, waardoor het GPU-cluster met 75% werd verkleind.
NVIDIA
Akamai
QbitAI 量子位04.08 · 07:02
