Character.AI

नवीनतम AI समाचार, मॉडल और रिलीज़ Character.AI.

एआई मनोवैज्ञानिकों को चापलूसी और मतिभ्रम से कैसे रोकें: सुरक्षा सुरक्षा उपायों का एक इंजीनियरिंग विश्लेषण

लेख बताता है कि क्यों सामान्य-उद्देश्य वाले एलएलएम (बड़े भाषा मॉडल) चापलूसी, मतिभ्रम और संकट-अंधता के कारण मानसिक स्वास्थ्य भूमिकाओं में खतरनाक होते हैं। यह सुरक्षा-ओबव्याज़्का (सीमा सुरक्षा उपाय जैसे अस्वीकरण, संकट प्रोटोकॉल, मान्य पैमाने) को तोड़ता है और एक बहु-एजेंट आर्किटेक्चर (जैसे वेरा) पर प्रकाश डालता है जहाँ एक दूसरा एआई पर्यवेक्षक और शैक्षणिक समीक्षक हर प्रतिक्रिया की जाँच करते हैं। इसका व्यापार-बंद सामग्री-स्तर की समीक्षा के लिए उच्च लागत और विलंबता है, और लेखक पूछता है कि सुरक्षा और लागत के बीच संतुलन कहाँ होना चाहिए।

Character.AICharacter.AI
Habr — хаб ИИ29.07 · 16:01
ताज़ा समाचार