연구에이전트 🇷🇺 12.08.2026 07:03

정지 버튼 없는 2160라운드 시뮬레이션: MiroFish 연구, 3부

DeepSeekDeepSeek AnthropicAnthropic Google/DeepMindGoogle/DeepMind OpenAIOpenAI
MiroFish 연구의 마지막 부분은 시뮬레이션 기간이 간단한 규칙, 즉 라운드 수가 일수 곱하기 24라는 것에 의해 결정되며, 이는 모델이 아니라 파이프라인 템플릿의 결과임을 보여줍니다. 시스템은 메모리 아키텍처가 처리할 수 없는 의무(예: 2160라운드)를 수락하며, 인터페이스에는 중지 버튼이 없어 실행을 중단하려면 숨겨진 API 엔드포인트가 필요합니다.
MiroFish 연구 시리즈의 세 번째 기사는 입력이 올바른 경우에 어떤 일이 발생하는지 살펴봅니다. 시뮬레이션 길이는 사용자 쿼리의 '향후 7일'과 같은 문구로 설정되며, 시스템은 확인을 요청하지 않습니다. 시간 범위가 있는 6번의 실행에서 라운드 수는 정확히 일수 곱하기 24시간(168, 336, 2160 라운드)이었으며, 4개의 모델 계열에서 문서화되었습니다. 정적 코드 검사를 통해 메커니즘이 확인되었습니다: 구성 생성기는 LLM이 total_simulation_hours(24-168시간)와 minutes_per_round(30-120, 권장 60)를 입력하도록 안내하며, 실행기는 total_rounds = total_hours * 60 / minutes_per_round를 계산합니다. 권장되는 60분을 사용하면 라운드는 시간과 같아지므로 90일은 2160 라운드가 됩니다. 문서화된 24-168시간 범위는 프롬프트의 권장 사항일 뿐이며, 코드는 숫자를 제한하거나 검증하지 않습니다. 시스템은 자체 의무를 이행할 수 없습니다: 에이전트 메모리는 무제한으로 축적되어 성능 저하와 공급자 오류를 초래합니다; 7개 에이전트 세계는 약 300라운드에서, 4개 에이전트 세계는 약 515라운드에서 성능이 저하되었으며, 18-19개 에이전트 세계는 조기 중지가 필요했습니다. UI에는 중지 버튼이 없습니다; 커뮤니티 회원은 프런트엔드 핸들러가 존재하지만 어떤 버튼에도 연결되지 않았음을 발견하고 풀 리퀘스트를 제출했습니다. 연구자는 의미 있는 활동이 중단된 후 592라운드에서 90일 실행을 종료하기 위해 문서화되지 않은 POST /api/simulation/stop 엔드포인트를 사용해야 했습니다. 이 연구는 한계를 언급합니다: 대부분의 셀은 n=1이고, 4개의 모델 계열만 테스트되었으며, 모든 붕괴가 DeepSeek 세계에서 발생했으므로 모델 계열과의 독립성은 검증되지 않았습니다.
출처: Habr — хаб ML — 원문
관련 게시물 ↓
새로운 뉴스