مطورو الذكاء الاصطناعي يشترون محادثات ورسائل الشركات مع نفاد النصوص العامة
يقوم مطورو الذكاء الاصطناعي مثل OpenAI و Anthropic بشكل متزايد بشراء بيانات الشركات، مثل رسائل البريد الإلكتروني وسجلات الدردشة وتسجيلات مؤتمرات الفيديو، لتدريب نماذجهم مع ندرة بيانات الإنترنت العامة. أفاد وسطاء البيانات عن ارتفاع في الصفقات، حيث ارتفع حجم معاملات إحدى الشركات من 30 مليون دولار إلى 100 مليون دولار سنويًا.
يطوّر مطورو نماذج اللغة الكبيرة، بما في ذلك OpenAI وAnthropic، اهتمامًا متزايدًا بالبيانات الداخلية للشركات، وذلك في ظل القيود التي يواجهونها في جمع المعلومات المتاحة للجمهور عبر الإنترنت لتدريب الشبكات العصبية. في الأشهر الأخيرة، ارتفع الطلب بشكل حاد على بيانات مثل المراسلات الفورية، ورسائل البريد الإلكتروني، وتسجيلات مؤتمرات الفيديو، وسجلات تغييرات الشيفرة البرمجية. قال بوبي صامويلز، الرئيس التنفيذي لشركة وساطة البيانات Protege، إن حجم تعاملات شركته نما من 30 مليون دولار العام الماضي إلى ما لا يقل عن 100 مليون دولار هذا العام بسبب الطلب المتزايد. يرتبط الاهتمام المتزايد جزئيًا بتطوير وكلاء الذكاء الاصطناعي القادرين على أداء المهام اليومية الحقيقية. تُعد البيانات المؤسسية ذات قيمة لأن سجلات التفاعلات البشرية الحقيقية تحتوي على معلومات حول كيفية حل المطورين للمشكلات، ومناقشة المقاييس المالية، وعرض البرمجيات، والقيام بمهام أخرى، مما يمكن أن يكون مفيدًا لتدريب وتحسين نماذج الذكاء الاصطناعي. يهتم المشترون في المقام الأول بالبيانات من الشركات الناشئة التي تواجه الإفلاس أو الاستحواذ. على سبيل المثال، شركة Warmly، وهي شركة ناشئة متخصصة في وكلاء الذكاء الاصطناعي استحوذت عليها HubSpot مؤخرًا، تلقت أربعة عروض تصل إلى 300000 دولار مقابل بيانات تفاعلات الموظفين في العمل، بما في ذلك محاضر الاجتماعات ورسائل البريد الإلكتروني، وكلها قدمت بعد توقيع اتفاقية الاستحواذ وتم رفضها لاحقًا. ومع نمو تداول بيانات الشركات، أصبحت قضية إخفاء الهوية أكثر إلحاحًا. يجب على الشركات التي تبيع البيانات لتدريب الذكاء الاصطناعي التركيز أكثر على إزالة المعلومات الشخصية المحددة. قال شوب سينها، الرئيس التنفيذي لشركة معالجة البيانات Integral، إنهم يلتزمون بعملية صارمة لإخفاء الهوية للحفاظ على قيمة البيانات والامتثال للوائح الخصوصية.
المصدر: 3DNews —
الأصلي
