Sakana AI brengt Fugu-Cyber uit: orchestrationmodel met 86,9% op CyberGym en 72,1% op CTI-REALM
Sakana AI
Sakana AI heeft Fugu-Cyber uitgebracht, een gespecialiseerd orchestration-eindpunt voor cybersecurity. Het behaalde 86,9% op CyberGym en 72,1% op CTI-REALM, waarmee het GPT-5.5-Cyber en Claude Mythos Preview op CyberGym nipt voorbijstreeft. De toegang is beperkt met handmatige beoordeling, een defensief gebruiksbeleid en geen beschikbaarheid in de EU/EER.
Sakana AI heeft Fugu-Cyber (fugu-cyber-v1.0) uitgebracht, een op cyberbeveiliging gespecialiseerde toevoeging aan zijn Fugu-orkestratiefamilie. Het is een derde eindpunt op de Fugu-orkestrator, afgestemd op beveiligingsredeneringen. Sakana rapporteert 86,9% op CyberGym (UC Berkeley-benchmark van 1.507 echte kwetsbaarheden) en 72,1% op CTI-REALM (Microsofts benchmark voor detectie-engineering). Deze scores overtreffen GPT-5.5-Cyber's 85,6% en Claude Mythos Preview's 83,1% op CyberGym, hoewel het nog steeds slechts incrementele verbeteringen zijn. De orkestratie werkt doordat Fugu, een taalmodel, on-the-fly een agentische scaffold bouwt en subtaken delegeert aan gespecialiseerde modellen. Toegang is beperkt: handmatige goedkeuring vereist, bijgewerkt Acceptabel Gebruiksbeleid dat offensief misbruik verbiedt, alleen Token Plan, geen EU/EER, geen gewichten. Prijzen zijn $6 per miljoen invoertokens, $36 uitvoer, $0,60 gecachte invoer, allemaal 1,2× het Fugu-Ultra-tarief.
Bron: MarkTechPost —
origineel
