Turbo Cloud, 새로운 AI 모델의 첫 결과 보고: 백만 토큰 컨텍스트와 7530억 매개변수
DeepSeek
Alibaba/Qwen
RTK-DATA 그룹의 일부인 러시아 클라우드 제공업체 Turbo Cloud가 Foundation Model Hub를 차세대 AI 모델로 확장했습니다. DeepSeek-V4-Flash-0731과 GLM 5.2 출시 일주일 후, 회사는 개발자와 비즈니스 사용자들의 꾸준한 관심을 보고했습니다. 카탈로그에는 기업의 다양한 요구를 포괄하는 두 개의 Qwen 모델도 포함되어 있습니다.
RTK-DATA 그룹 산하의 러시아 클라우드 서비스 제공업체 Turbo Cloud가 자사의 Foundation Model Hub(파운데이션 모델 허브)에 신세대 최상위 AI 모델들을 추가하며 서비스를 확장했다. DeepSeek-V4-Flash-0731과 GLM 5.2 모델이 플랫폼에 공개된 지 일주일이 지난 지금, 회사 측은 개발자와 비즈니스 사용자들로부터 꾸준한 관심을 받고 있다고 밝혔다.
DeepSeek-V4-Flash-0731은 속도와 정확성, 그리고 방대한 컨텍스트(context, 문맥) 처리 능력이 요구되는 리소스 집약적 작업에서 두각을 나타낸다. 백만 토큰에 달하는 컨텍스트를 지원해 대규모 문서 자료, 코드 저장소, 이질적인 지식 베이스를 한 번에 분석할 수 있으며, 개선된 아키텍처는 텍스트 처리와 코드 생성 능력을 향상시켜 다단계 에이전트 시나리오까지도 지원한다.
GLM 5.2는 복잡한 엔지니어링 및 분석 작업, 즉 다단계 추론과 계산부터 자율 에이전트 시스템 구축에 이르는 영역을 겨냥한 모델이다. 오픈 웨이트(open weights) 방식으로 공개되어 있어 심층적인 커스터마이징과 감사(audit)가 필요한 프로젝트에서 특히 선호되고 있다.
카탈로그에는 Qwen 계열 모델 두 종도 포함되어 있다. 350억 개의 파라미터와 최대 26만 2천 토큰의 컨텍스트를 지원하는 Qwen3.6-35B-A3B는 텍스트와 이미지를 함께 처리하며, 콘텐츠 생성, 내부 데이터베이스 검색, 일상적인 업무 자동화 같은 전형적인 비즈니스 작업에 활용된다. 1220억 개의 파라미터를 갖춘 Qwen3.5-122B-A10B는 대용량 문서 처리, 분석, 고도화된 AI 어시스턴트 구축 등 더 무거운 기업용 시나리오를 위해 설계되었다.
모든 모델은 OpenAI(오픈AI) 호환 통합 API(Application Programming Interface, 응용 프로그램 프로그래밍 인터페이스)를 통해 제공되어 코드를 수정하지 않고도 모델 간 전환이 가능하며, 자체 GPU(Graphics Processing Unit, 그래픽 처리 장치) 인프라를 구축할 필요 없이 통합할 수 있다. 또한 유연한 키 관리 기능과 일간·주간·월간 단위로 설정 가능한 사용량 제한을 통해 팀 단위로 리소스 사용을 통제할 수 있다. 요금은 사용량 기반 방식(pay-as-you-go)을 따르며, 실제로 처리된 토큰에 대해서만 비용이 부과된다.
출처: CNews —
원문
