Kuinka kouluttaa infrastruktuurin LLM-agentti olemaan valehtelematta
DeepSeek
Rakennettiin lukumoodissa toimiva tekoälyagentti infrastruktuurin häiriötutkintaa varten. Aluksi se antoi uskottavia mutta hyödyttömiä vastauksia. Tiimi ratkaisi ongelman siirtämällä suuren kielimallin (Large Language Model, LLM) sovelluksen sisälle, lisäämällä työkalujen sopimukset, todisteiden vartijat ja jäsennellyn suunnittelun. Viimeisessä ajossa 45 testitapauksesta 44 läpäistiin.
Tekoälyavusteinen, vain luku -tilassa toimiva agentti rakennettiin vastaamaan infrastruktuuria koskeviin kysymyksiin, kuten 'miksi palvelu palauttaa 502-virheen?'. Se toteutettiin Go-kielellä ilman LangChain-kirjastoa ja käytti DeepSeek-V4-Flash- ja Qwen3.6-27B-FP8-malleja OpenAI-yhteensopivan rajapinnan kautta. Ensimmäinen versio hyödynsi vapaata ReAct-silmukkaa ja tuotti vastauksia, jotka olivat muodollisesti oikeita mutta usein harhaanjohtavia. Esimerkiksi kun 502-virhe johtui välityspalvelimen liian suuresta vastausotsakkeesta, agentti päätteli, ettei sovellustasolla ollut virhettä, jättäen todellisen syyn huomiotta. Virhetyyppejä tunnistettiin viisi: väärä laajuus, väärä aikamerkitys, väärät kielteiset päätelmät, todisteiden menetys ja hallitsematon uudelleensuunnittelu. Ratkaisuna oli upottaa kielimalli tiukkaan sovelluskehykseen. Työkalujen kutsuja ohjaa laajennettu x-agent-sopimus, joka määrittelee todisteet, tulostyypin, tuoreuden, kielteiset semantiikat ja vain luku -tilan. Suunnittelija rakentaa ensin tavoitteet (esimerkiksi symptom.http_502 ja route.edge_to_ingress) sekä pysäytystilan: jokaisen pakollisen tavoitteen on oltava ratkaistu tai nimenomaisesti tavoittamattomissa. Todisteiden valvonta estää loppuunviejää tekemästä johtopäätöstä ennen kuin kaikki tavoitteet on saavutettu. Työkalun valinta on porrastettu: käytäntösuodatin, leksikaalinen esisuodatin, kielimallin uudelleenjärjestys (8 parasta) ja sitten tavoitteen relevanssiportti. Riskialttiit aikeet saavat deterministiset esireitit. Lopullisessa arvioinnissa 44 skenaariota 45:stä läpäisi (29 pakollista 29:stä), suoritettuna kaksi kertaa kukin. Ainoa epäonnistunut testi koski valinnaisen kapasiteettiraportin muotoa. Agentti pysyy vain luku -tilassa; muutokset tuotantoympäristössä päättää ihminen.
Lähde: Habr — хаб ИИ —
Alkuperäinen
