지능이 무료가 된다 — 그 다음은? 에이전트를 위한, 에이전트들의, 에이전트에 의한 데이터 시스템
OpenAI
Anthropic
인공지능 비용이 급락하고 있습니다: GPT-4 수준 모델의 출력 가격이 백만 토큰당 30달러에서 1달러 미만으로 떨어졌으며, 장기적으로는 거의 0에 가까워질 수 있습니다. 이는 데이터 시스템에 세 가지 새로운 과제를 제시합니다: 에이전트와 함께 작동하도록 재설계(Data Systems For Agents), 에이전트 떼를 관리하는 인프라 구축(Data Systems Of Agents), 그리고 에이전트 스스로 신뢰할 수 있는 데이터 시스템을 합성하는 것(Data Systems By Agents)입니다.
캘리포니아 대학교 버클리 캠퍼스 EPIC 데이터 연구소의 연구자들이 AI 모델 추론 비용 하락의 함의를 분석합니다. 지난 1년간 추론 가격은 9배에서 900배까지 하락했으며, 중앙값은 약 50배 감소하여 대부분의 인지 작업에 필요한 지능이 거의 무료가 되었습니다. 이는 데이터 시스템에 세 가지 방향을 제시합니다. 첫째, 에이전트를 위한 데이터 시스템: 에이전트는 대규모 작업을 수행하며, 특히 에이전틱 추측(agentic speculation)에서는 하위 질의의 최대 80-90%가 중복되어 결과 재사용 및 다중 질의 최적화와 같은 최적화 기회를 제공합니다. 둘째, 에이전트로부터의 데이터 시스템: 수천 개의 에이전트를 관리하기 위한 인프라가 필요합니다—구조화된 메모리(비구조화된 마크다운 파일 대신), 조정, 동시 변경 시 충돌 해결이 요구됩니다. 셋째, 에이전트가 생성한 데이터 시스템: 에이전트가 즉석에서 전체 데이터 시스템을 합성할 수 있지만, 그 정확성을 검증해야 합니다. 연구자들은 에이전트를 위한 구조화된 메모리 개념(메모리가 모듈, 언어, 연산 등의 속성으로 구성됨)과 여러 에이전트가 동시에 작업할 때의 공동 편집 및 라이브락(livelock, 교착 상태의 일종으로 시스템이 계속 실행되나 진행되지 않는 상태) 문제에 대해 논의합니다.
출처: BAIR (Berkeley AI) —
원문
