ростом. Исходный код и изображения являются наиболее часто утекающими данными. Запрет Samsung на использование ChatGPT в 2023 году после нескольких инцидентов иллюстрирует неэффективность запретов, так как они лишь загоняют использование в подполье. Покупка корпоративных API с нулевым хранением данных также недостаточна, поскольку промпты всё равно видны провайдеру, и суды обязали OpenAI передавать журналы. Статья предупреждает, что аренда общих или даже выделенных GPU в облаке не является полным решением, ссылаясь на уязвимости, такие как CVE-2026-46229, где видеопамять может утекать между арендаторами, а гипервизоры могут видеть всё. Для большинства корпоративных нужд достаточно выделенного физического хостинга, но для максимальной безопасности требуется собственное оборудование. Статья предлагает начинать с более простых моделей, таких как Qwen3-32B, для рутинных задач, использовать Ollama для небольшого числа пользователей или vLLM для высоких нагрузок, и ставить перед ними LiteLLM в качестве шлюза для единого входа и аудита. Точка экономической эквивалентности находится примерно на уровне 2 миллионов токенов в день; при превышении этого порога локальное развёртывание становится более экономичным.