Kimi K3 en Ongelimiteerde OCR voeren wereldwijde ranglijsten aan, Chinese open-source AI-modellen veroveren het buitenland
Moonshot AI
Baidu
Chinese open-source AI-modellen winnen wereldwijd aan populariteit. Op 27 juli open-sourcete Moonshot AI de volledige gewichten van Kimi K3, die snel de algemene trendlijst van Hugging Face aanvoerde, gevolgd door Baidu's Ongelimiteerde OCR. Ongelimiteerde OCR behaalde ook vier eerste plaatsen op GitHub en Hugging Face, en keerde later na een maand terug naar de top van Hugging Face's wereldwijde modeltrendlijst, gedreven door aanhoudende adoptie door ontwikkelaars.
Op 27 juli bracht Moonshot AI de volledige modelgewichten van Kimi K3 open source, waarna het binnen enkele minuten naar de top van Hugging Face's algemene trendlijst steeg. Direct daarna behaalde Baidu's Unlimited OCR-model, dat dagenlang de lijst had aangevoerd, de tweede plaats. Deze twee Chinese open-source modellen domineerden de Hugging Face-ranglijsten en werden een fenomeen. Unlimited OCR bereikte een bijzondere prestatie: binnen vijf dagen na release haalde het meer dan 10.000 GitHub-sterren en stond het bovenaan zowel GitHub Daily Trending algemeen als de Python-lijst, evenals Hugging Face's wereldwijde model- en multimodale modeltrendlijsten, waarmee het een viervoudige eerste plaats behaalde. Een maand later heroverde Unlimited OCR de eerste plaats op Hugging Face's wereldwijde modellentrendlijst nadat het was geretweet door Turing Award-winnaar Yann LeCun. Het aantal GitHub-sterren is inmiddels meer dan 19.700 en Hugging Face-downloads bereikten 2,65 miljoen. De populariteit van Unlimited OCR is te danken aan de doorbraak in het parsen van lange documenten. Traditionele OCR-modellen verwerken lange documenten door pagina voor pagina te parsen en resultaten aan elkaar te koppelen, waardoor de KV-cache tijdens het decoderen groeit, wat de inferentiesnelheid en geheugenkosten verhoogt. Baidu stelde het Reference Sliding Window Attention-mechanisme (afgekort R-SWA) voor, dat de aandacht voor het originele document behoudt terwijl alleen de meest recent gegenereerde inhoud als werkgeheugen wordt bewaard, waardoor continu tientallen pagina's in één enkele forward pass kunnen worden geparst. Dit houdt de KV-cache constant, wat de rekenkosten en het geheugengebruik vermindert. Industrie-experts merken op dat deze innovatie niet alleen OCR versnelt, maar ook nieuwe benaderingen biedt voor redeneren over lange contexten en geheugenbeheer. De aanhoudende interesse van ontwikkelaars in Unlimited OCR weerspiegelt dat Chinese AI open-source modellen zich van de eerste hype naar continu gebruik bewegen.
Bron: QbitAI 量子位 —
origineel
