AI-вывод требует принципиально иной инфраструктуры данных, утверждает Silk

NVIDIANVIDIA SilkSilk
По мере того как AI-агенты переходят от чат-ботов к автономным многошаговым рабочим процессам, нагрузка на вывод данных перегружает традиционное облачное хранилище (AWS EBS) из-за высокой степени параллелизма, всплесков чтения и хвостовой задержки. Silk выступает за программно-определяемое хранилище, которое отделяет производительность от ёмкости, чтобы справляться с этими требованиями без использования хрупких реплик для чтения или избыточного резервирования.
Генеральный директор Nvidia Дженсен Хуанг провозгласил эпоху «фабрик искусственного интеллекта», однако компания Silk предупреждает, что переход от чат-ботов к автономным ИИ-агентам создает огромную проблему с данными. Инференс ведет себя как OLTP++ (онлайн-обработка транзакций с дополнительными возможностями) с беспрецедентной степенью параллелизма, всплесками чтения и непредсказуемыми шаблонами
Показать ещё ↓
Источник: The Register AI/ML — оригинал
Наши предыдущие публикации по теме ↓
Свежие новости