Test von Yandex's Vibecraft: Eine Frage bleibt offen
Яндекс
Anthropic
DeepSeek
Sergey Ignatenko, Gründer der KI-Plattform VibePilot, testete den neuen Vibe-Coding-Dienst VibeCraft von Yandex Cloud. Er stellte fest, dass der Dienst 52 Minuten benötigte, um eine Website zu generieren, während seine eigene Plattform dies in 13-15 Minuten schafft. Auf die Frage, welches LLM der Agent verwendet, behauptete er, Claude von Anthropic zu sein, was Fragen zum Modell hinter der russischen souveränen KI aufwirft.
Sergey Ignatenko, Gründer der KI-Plattform VibePilot und Yandex-Partner mit einem AI Studio Boost-Zuschuss, hat den neuen Dienst VibeCraft von Yandex Cloud getestet. Er stellte die Aufgabe, eine Website für eine Autowerkstatt mit Online-Buchung zu erstellen. Der Agent stellte klärende Fragen und benötigte 52 Minuten für die Aufgabe, was Ignatenko im Vergleich zu den 13-15 Minuten seiner eigenen Plattform langsam fand. Das Ergebnis sah gut aus, verwendete Standard-Tailwind-Farben und alle Funktionen funktionierten, wobei 530 Neurocredits verbraucht wurden. Der Code war ein echtes Next.js-Projekt, kein Block-Konstruktor, aber es wurden keine Bilder oder SVGs eingefügt. Die wichtigste ungeklärte Frage war, welches LLM der Agent verwendet: Auf direkte Nachfrage behaupteten sowohl der Code-Assistent als auch der VibeCraft-Chat, Claude von Anthropic zu sein. Ignatenko befragte dann Modelle in Yandex AI Studio, aber keines der Open-Weight-Modelle gab zu, Claude zu sein, und die Alisa-KI-LLM wich bei ihrer Identität aus. Er untersuchte auch den Code und fand heraus, dass VibeCraft das Open-Source-Agenten-Framework OpenCode unter der MIT-Lizenz, AGENTS.md-Konventionen, Fähigkeiten im SKILL.md-Format und die Yandex Cloud Document API für die Datenbank verwendet. Trotz der Fragen zu Zeit und Modell lobte Ignatenko Yandex als Säule der russischen IT und VibeCraft als wertvollen Schritt, merkte jedoch an, dass es Raum für Optimierungen bei Agentenzyklen und Modellauswahl gibt.
Quelle: Habr — хаб ИИ —
Original
