может вызвать Jetsam (системный убийца процессов). Core ML предлагает статическую оптимизацию и AOT-компиляцию, поддерживая ANE, но с ограничениями по длине контекста. MLX использует ленивые вычисления и динамические графы, показывая лучшую производительность в автогрессивных циклах, но вызывает больше нагрева и троттлинга. Тепловой троттлинг снижает производительность GPU, чтобы поддерживать температуру устройства ниже 43–45 °C для комфорта пользователя. Автор рекомендует отслеживать тепловое состояние и предлагает гибридный конвейер для стабильной генерации.