WhyTrend Bitcoin-poikkeavuusanalyysi: Pienempi malli päihittää suuremman
Ollama
WhyTrend, avoimen lähdekoodin poikkeavuuden havaitsemistyökalu, testattiin Bitcoinin hintatiedoilla vuosilta 2022–2026. Analyysi paljasti, että pienempi 14 miljardin parametrin malli tuotti luotettavampia selityksiä kuin suurempi 32 miljardin malli, koska se aikakatkaisi harvemmin. Työkalu tunnisti oikein keskeiset markkinan regimimuutokset ja toi esiin ongelmia varaselityksissä.
WhyTrend, avoimen lähdekoodin putkisto poikkeamien havaitsemiseen ja selittämiseen, ajettiin päivittäisillä Bitcoinin päätöskursseilla (BTC/USDT) 1. tammikuuta 2022 – 7. elokuuta 2026, yhteensä 1680 datapistettä. Havaitsija löysi 8 muutospistettä (regiiminmuutosta), jotka sitten selitettiin käyttämällä kahta eri paikallista kielimallia: Qwen 32B ja qwen2.5-coder:14b. Suurempi 32B-malli aikakatkaisi usein (6 kertaa 8:sta tapahtumasta), mikä aiheutti varauduttuja heuristisia selityksiä, jotka perustuivat top-25 BM25-ranktattuihin artikkeleihin, johtaen järjettömiin syihin kuten 'Villikissat ja Bitcoin' tai 'Bitcoinin geneettisen koodin artikkeli'. Pienempi 14B-malli suoritti tehtävän aikakatkaisun sisällä 6 kertaa 8:sta tapahtumasta, tarjoten uskottavampia selityksiä luottamusarvioiden kanssa, kuten 2024-02-25 muutospisteen liittäminen negatiiviseen tunnelmaan ja sääntelyhuoliin, ja 2025-11-11 muutospisteen liittäminen hallitusten takavarikoimaan Bitcoiniin ja syytöksiin Yhdysvaltain tukemasta 13 miljardin dollarin hakkerointi. Artikkelissa huomautetaan, että vaikka 14B on keskimäärin luotettavampi, se ei ole täydellinen, koska silläkin oli varauduttuja tapauksia. Kirjoittaja suosittelee pienempien mallien käyttöä tällaisissa tehtävissä ja keskustelee varauduttujen tulosteiden erottamisen tärkeydestä aidosta mallipäättelystä.
Lähde: Хабр — Data Mining —
Alkuperäinen
