Линейное эластичное кэширование: новый подход к управлению кэшем оптимизирует облачные затраты
Google/DeepMind
Google Research и Google Cloud представили линейное эластичное кэширование — метод, который динамически регулирует размер кэша для минимизации общих затрат. Формулируя вытеснение страниц как задачу аренды лыж и используя легковесную модель машинного обучения, этот подход сократил использование памяти до 30% на производственных серверах Spanner при увеличении затрат на ввод-вывод всего на 0,5%.
Google Research и Google Cloud представили линейный упругий кеш на конференции CIDR 2025. Этот метод рассматривает память как переменную стоимость и использует алгоритм аренды лыж (ski rental algorithm) для определения времени жизни (TTL) кешированных страниц в сочетании с легковесным машинным обучением (неглубоким деревом решений) для прогнозирования оптимального TTL. В производственной среде
Показать ещё ↓
Источник: Google Research —
оригинал
