بعدما ظلّت الجهات المستقلة المتخصصة في تقييم الذكاء الاصطناعي تعمل بعيداً عن الأضواء، بدأت هذه المؤسسات الصغيرة تحظى بأهمية متزايدة داخل صناعة تتجاوز قيمتها تريليونات الدولارات، مع تصاعد المخاوف بشأن سلامة النماذج المتقدمة وقدرتها على التصرف بطرق غير متوقعة.
وبينما تخوض شركتا "أنثروبيك" و"OpenAI" نقاشاً محتدماً حول كيفية تطوير أنظمة ذكاء اصطناعي متقدمة وتوسيع أعمالهما التجارية مع ضمان سلامتها في الوقت نفسه، تتجه الشركتان إلى الاستعانة بمؤسسات مستقلة متخصصة، من بينها "METR"، و"Apollo Research"، و"Transluce".
وتعمل معظم هذه الجهات بوصفها مؤسسات غير ربحية، ولا تزال تبحث عن موقعها في صناعة تتدفق إليها استثمارات ضخمة بوتيرة غير مسبوقة، بينما تتوالى إصدارات النماذج الجديدة بسرعة متزايدة.
وتتمثل مهمتها الأساسية في تقييم قدرات نماذج الذكاء الاصطناعي والمخاطر المرتبطة بها، والتنبيه إلى الحالات التي تُظهر فيها هذه الأنظمة سلوكيات غير آمنة أو غير مرغوب فيها، بحسب تقرير نشرته شبكة "سي إن بي سي" واطلعت عليه "العربية Business".
وفي ظل غياب تحرك اتحادي أميركي شامل لفرض قواعد تنظيمية ملزمة، اكتسبت هذه الجهات أهمية استثنائية. ففي الشهر الماضي، تعهد الرئيس التنفيذي لشركة أنثروبيك، داريو أمودي، بدمج مقيمين مستقلين داخل شركته، وهي خطوة أيدها سريعاً الرئيس التنفيذي لشركة OpenAI، سام ألتمان، كما حظيت بدعم الرئيس الأميركي دونالد ترامب ومعظم شركات التكنولوجيا الأميركية الكبرى.
لكن أسئلة أساسية لا تزال بلا إجابات واضحة، من بينها كيفية تمويل هذه الجهات، ومستوى وصولها إلى أنظمة الشركات وبياناتها، والآليات التي ستتبعها للإبلاغ عن نتائج التقييمات.
وقال سوريش فينكاتاسوبرامانيان، أستاذ علوم الكمبيوتر بجامعة براون، في مقابلة مع شبكة "سي إن بي سي": "المشكلة، إلى حد ما، تتمثل دائماً في المال.
من سيدفع لهذه الشركات مقابل عملها؟ وكيف ستتمكن من دعمها؟ نحن بحاجة إلى منظومة متكاملة ونموذج أعمال قابل للاستمرار".
وفي الوقت الراهن، تضع شركات "أنثروبيك" و"OpenAI" وشركاؤهما في البنية التحتية، الذين يستفيدون من طفرة الذكاء الاصطناعي، القواعد التي تحكم جانباً كبيراً من هذه العملية.
ويرى منتقدون أن هذا الوضع يشبه تكليف أكبر البنوك بحماية المجتمع من الأزمات المالية، أو السماح لشركات الأدوية بطرح منتجاتها في الأسواق دون الحصول على موافقات تنظيمية.
ترامب يدعم الرقابة الذاتية.. لكن المخاوف مستمرة
أشاد الرئيس الأميركي دونالد ترامب مؤخراً بما وصفه بقدرة شركات الذكاء الاصطناعي على الرقابة الذاتية المتميزة، في إشارة إلى رغبته في ترك مساحة واسعة للشركات لإدارة المخاطر بنفسها، دون عرقلة نمو قطاع أصبح محركاً مهماً للاقتصاد وسوق الأسهم الأميركية.
وشجع ترامب شركات الذكاء الاصطناعي على "الشراكة مع مدقق أو جهة تقييم خارجية مستقلة"، وذلك ضمن اتفاق طوعي قدمه في أواخر سبتمبر.
وكان أمودي قد أطلق النقاش بصورة أكثر حدة من خلال مقال واسع الانتشار نشره الشهر الماضي، دعا فيه إلى إبطاء وتيرة تطوير النماذج المتقدمة، وذلك بعد مغادرة باحثين شركته وإثارتهم مخاوف بشأن التهديدات الوجودية المحتملة التي قد تفرضها هذه التكنولوجيا.
لكن مع تحرك مختبرات الذكاء الاصطناعي لتطبيق فكرة التقييم المستقل داخل مؤسساتها، بدأت الخلافات تظهر بالفعل.
فقد أعلنت "OpenAI" الأسبوع الماضي فصل ثلاثة موظفين بسبب انتهاك سياساتنا المتعلقة بالوصول إلى معلومات الشركة الحساسة والتعامل معها، وفقاً لمتحدث باسم الشركة.
وقال اثنان من الموظفين المفصولين، هما ميكيتا باليسني وتوميك كورباك، إنهما يعتقدان أن قرار فصلهما مرتبط بالطريقة التي تواصلا بها مع جهات تقييم مستقلة من خارج الشركة.
وكتب باليسني في منشور على منصة "إكس" يوم الخميس أن زملاءه السابقين يشعرون بالحيرة بشأن ما ينبغي تصديقه، مضيفاً أنهم يخشون التحدث علناً، ويقلقون من احتمال تفتيش هواتفهم الشخصية بحثاً عن رسائل متبادلة معهم أو مع جهات خارجية.
وأضاف أنه يخشى أن يؤدي انتشار الخوف من التحدث والتعاون مع الجهات المستقلة إلى دفع "OpenAI" نحو التهاون في إجراءات السلامة بعيداً عن أعين الجمهور.
لكن "OpenAI" رفضت هذا التوصيف، وقالت في منشور يوم الجمعة إنها "تعمل حالياً على وضع اللمسات النهائية للعقود مع جهات تقييم السلامة المستقلة من الأطراف الثالثة"، وإنها ستعلن التفاصيل خلال الأسابيع المقبلة.
وأضافت الشركة أنها ملتزمة بدمج المقيمين الخارجيين، وأن التعاون الوثيق مع مؤسسات السلامة المستقلة سيظل جزءاً أساسياً من جهودها في هذا المجال.
وقال متحدث باسم "OpenAI"، في بيان عبر البريد الإلكتروني، إن التعاون المرتقب مع المقيمين يبني على شراكات قائمة مع مؤسسات مستقلة، من بينها "METR" و"Redwood Research".
تتكون منظومة تقييم الذكاء الاصطناعي من مؤسسات صغيرة، مثل "METR" و"Apollo Research"، إلى جانب شركات كبرى تعمل في مجالات المحاسبة والتدقيق والاستشارات، مثل "Accenture".
وعلى الرغم من أن مختبرات الذكاء الاصطناعي تعاونت مع جهات التقييم في نطاق محدود خلال السنوات الماضية، فإن أندرو فريدمان، الرئيس التنفيذي لمؤسسة السياسات غير الربحية Fathom، يرى أن هذا المجال يتطور بسرعة كبيرة.
وقال فريدمان لشبكة "سي إن بي سي": "عملت في السياسة وصنع السياسات على مدى السنوات العشرين الماضية من حياتي، ولم أشهد قضية تتحرك بهذه السرعة، وتحظى بهذا القدر من الاهتمام عبر أطياف سياسية مختلفة".
وتوقع أن تشهد المنظومة تدفقاً متزايداً لرؤوس الأموال خلال الفترة المقبلة.
من جانبه، قال رايان كريشنان، الرئيس التنفيذي لشركة Vals AI المتخصصة في التقييم المستقل، إن شركته الناشئة، التي تطور معايير اختبار لقياس أداء نماذج الذكاء الاصطناعي في مهام متخصصة بحسب القطاع، رفعت عدد موظفيها من ثمانية إلى نحو 30 موظفاً خلال العام الحالي.
وأعلنت الشركة في أغسطس جمع تمويل بقيمة 40 مليون دولار.
أما مؤسسة METR غير الربحية، فأعلنت في أغسطس حصولها على تعهدات تمويلية بنحو 71 مليون دولار خلال الأشهر الستة السابقة، مقارنة بإجمالي مساهمات بلغ 13.6 مليون دولار في عام 2024، وفقاً لأحدث إقرار قدمته المؤسسة إلى مصلحة الضرائب الأميركية.
وزادت أهمية المؤسسة لاحقاً خلال الشهر نفسه، عندما استعانت بها "OpenAI" لإعداد تقرير مراجعة لاحقة تناول كيفية تمكن نماذج الشركة من الخروج عن نطاق الاحتواء، والوصول إلى الإنترنت المفتوح، واختراق منصة Hugging Face المخصصة لمطوري البرمجيات مفتوحة المصدر.
وشارك في إعداد التقرير موظفان من "METR" ومتعاقد معها، وقالت المؤسسة إنها لم تتلق أموالاً من "OpenAI" مقابل إجراء التقييم.
ورغم هذا النمو، يرى كيفن ويرباخ، المدير الأكاديمي لمختبر الذكاء الاصطناعي المسؤول في كلية وارتون بجامعة بنسلفانيا، أن منظومة التقييم المستقل ليست قوية بما يكفي في الوقت الحالي.
على سبيل المثال، توظف "METR" أقل من 50 موظفاً بدوام كامل، وفقاً لموقعها الإلكتروني، في حين تجمع شركات الذكاء الاصطناعي الكبرى عشرات المليارات من الدولارات وتوظف آلاف العاملين.
ويثير هذا التفاوت الكبير في الموارد مخاوف بشأن تضارب المصالح، ومدى قدرة جهات التقييم الصغيرة على مواجهة الشركات التي يفترض أن تراقبها.
وقال فينكاتاسوبرامانيان: "إذا كنت تريد تقييماً حقيقياً من طرف ثالث، فأنت بحاجة إلى استقلال حقيقي، مالياً وغير ذلك. الأمر لا يتعلق فقط بعدم الحصول على أموال من الشركة، بل بما إذا كانت ستترتب عواقب على المدقق إذا نشر تقريراً لا يصب في مصلحتها. هل يمكن أن يجف مصدر إيرادات مؤسسته؟".
"أنثروبيك" تقر بصعوبة ضمان استقلال المقيمين
أقرت "أنثروبيك" بتعقيد هذه المسألة في منشور على مدونتها الشهر الماضي، عندما أعلنت أنها ستستعين بموظفين من شركة Faculty، المتخصصة في الذكاء الاصطناعي والتابعة لمجموعة Accenture، لاختبار إجراءات الحماية وتقييم مدى توافق سلوك النماذج مع القيم الإنسانية.
وقالت "أنثروبيك" إنها ستتولى تمويل مساهمات "Accenture" مباشرة، نظراً إلى أهمية هذا العمل والحاجة الملحة إليه.
وأضافت الشركة أنه لا توجد حتى الآن معايير محددة بشأن المعلومات التي ينبغي إتاحتها للمقيمين المدمجين داخل الشركات، أو كيفية الإبلاغ عن النتائج التي يتوصلون إليها. كما لا يوجد نظام مستقر لتمويل عمليات التقييم المستقل.
وترى "أنثروبيك" أن التمويل ينبغي، على المدى الطويل، أن يأتي من مصادر مشتركة أو حكومية.
وأشارت إلى أنها تجري مناقشات مع "METR" وغيرها من مؤسسات التقييم غير الربحية، التي تعتزم استخدام مواردها الخاصة لتجربة بعض عناصر التقييم المستقل المدمج داخل الشركات.
هل تتدخل الحكومة الأميركية لتنظيم تقييم الذكاء الاصطناعي؟
في يونيو من العام الماضي، قدمت مؤسسة Fathom إطاراً لإنشاء سوق لمنظمات التحقق المستقلة، المعروفة اختصاراً باسم IVOs، وهي جهات يُفترض أن تحصل على تراخيص حكومية وتُمنح صلاحية اختبار مدى التزام شركات الذكاء الاصطناعي بمعايير السلامة المختلفة.
ويرى فريدمان أن الرقابة الحكومية ضرورية، لأن ترك المقيمين المستقلين يعتمدون على الشركات الكبرى في الحصول على الإيرادات قد يجعلهم أكثر ميلاً إلى تجنب انتقادها، حفاظاً على مصالحهم المالية.
وحذر من أن هذا الوضع قد يدفع بعض الجهات إلى الاكتفاء بمنح الشركات موافقات شكلية بدلاً من إجراء تقييمات صارمة ومستقلة.
ويحظى المقترح بدعم عدد من المشرعين الأميركيين.
فقد أصبحت منظمات التحقق المستقلة أحد البنود الرئيسية في مشروع قانون يحمل اسم "الإشراف على مخاطر الذكاء الاصطناعي المتقدم والشفافية الوطنية والتقييم المستقل والإبلاغ"، الذي قدمته النائبة لوري تراهن، الديمقراطية عن ولاية ماساتشوستس، والنائب جاي أوبيرنولت، الجمهوري عن ولاية كاليفورنيا، في يوليو.
وقال فريدمان إن مؤسسة Fathom ساهمت في صياغة نصوص المشروع وتقديم الخبرة الفنية اللازمة له.
وفي سبتمبر، قال كريس ليهان، رئيس الشؤون العالمية في "OpenAI"، للصحفيين إنه التقى أحد مقدمي مشروع القانون في مبنى الكونغرس للتعبير عن دعم الشركة للبند المتعلق بمنظمات التحقق المستقلة.
ونُقل عن ليهان قوله إن الشركة أرادت التأكد من أن موقفها الداعم وصل بوضوح إلى المشرعين المعنيين.
وفي الوقت نفسه، اتخذ مشرعون في ولايات كاليفورنيا وكونيتيكت وفيرجينيا خطوات لتطبيق نماذج التحقق المستقل، بينما تدرس ولايات أخرى، مثل ماساتشوستس، توسيع نطاق التقييم المستقل لسلامة الذكاء الاصطناعي.
ووقع حاكم كاليفورنيا غافين نيوسوم مؤخراً قانونين يتعلقان بمنظمات التحقق المستقلة؛ يضع الأول إطاراً تنظيمياً وصف بأنه الأول من نوعه على مستوى الولايات الأميركية، فيما ينشئ الثاني سجلاً للمدققين المتخصصين في الذكاء الاصطناعي داخل الولاية.
وكانت "أنثروبيك" قد أيدت القانونين في أغسطس، ثم أعلنت "OpenAI" دعمها الرسمي لهما الشهر الماضي، في اليوم نفسه الذي وقع فيه نيوسوم القانونين.
وكتب ليهان في منشور على مدونة "OpenAI" أن الشركة تفضل أن تصبح التقييمات الفنية المستقلة إلزامية على المستوى الاتحادي، لكنه أضاف أن كاليفورنيا يمكنها المساعدة في وضع القواعد المنظمة للقطاع في ظل غياب تحرك اتحادي.
ويرى فريدمان أن التوصل إلى آلية فعالة للتعاون مع المقيمين المستقلين سيكون صعباً للغاية على شركتي "OpenAI" و"أنثروبيك" إذا حاولتا إدارة العملية بمفردهما، لكنه يعتبر أن تطوير هذه القدرات يظل ضرورياً في المرحلة الحالية، حتى تتضح طبيعة الدور الحكومي.
اتفاق طوعي لا يبدد الشكوك
حتى الآن، يظل أقرب ما توصلت إليه الصناعة إلى مجموعة مشتركة من المعايير هو اتفاق وصفه ترامب بأنه "ملزم أخلاقياً"، خلال مأدبة غداء استضافها لقادة التكنولوجيا في البيت الأبيض أواخر الشهر الماضي.
وينص الاتفاق، الذي جاء في صفحة واحدة، على أن كل شركة تتحمل مسؤولية تطوير تقنياتها بأمان، وبطريقة تعزز ثقة العملاء والجمهور.
كما يشجع الشركات الموقعة على التعاون مع مدقق أو جهة تقييم خارجية مستقلة لإجراء تقييمات مستقلة.
ووقع الاتفاق كبار المسؤولين التنفيذيين في "أنثروبيك" و"غوغل" و"ميتا" و"OpenAI" و"سبيس إكس" و"إنفيديا"، في مشهد نادر من التوافق بين قادة شركات اختلفت مواقفهم بشأن كيفية التعامل مع مخاطر الذكاء الاصطناعي.
لكن الاتفاق لا يفرض إطاراً تنظيمياً موحداً، ولا ينهي الخلافات المتعلقة بمدى استقلال المقيمين أو صلاحياتهم أو مصادر تمويلهم.
وقال فينكاتاسوبرامانيان إن الاتفاق بدا وكأنه محاولة لإظهار التحرك دون اتخاذ خطوات فعلية، مضيفاً أن الالتزامات المعلنة تتعلق بأمور كان ينبغي للشركات القيام بها بالفعل، بل إنها ادعت في السابق أنها تطبقها.
وفي مقاله المنشور في سبتمبر، قال أمودي إن "أنثروبيك" ستوفر للمقيمين المستقلين مكاتب وبطاقات دخول وحواسيب محمولة تابعة للشركة، إلى جانب صلاحيات وصول إلى المعلومات والأنظمة تكون مماثلة إلى حد كبير للصلاحيات الممنوحة لفرق تقييم المخاطر الداخلية.
وأضاف أن العقود ستمنح المقيمين الحق في نشر النتائج الرئيسية، مع احتفاظ "أنثروبيك" بحق محدود في حجب بعض المعلومات التي تتعلق بالأمن أو السرية.
وكتب أمودي أن هذه الخطوة غير مألوفة بالنسبة إلى الشركات، لكنها ضرورية لإثبات جدوى نموذج المراجعة الخارجية المدمجة داخل المؤسسات.
وبعد أيام، نشرت "OpenAI" مقترحها الخاص، وقالت إن عمليات التقييم ينبغي أن تستند إلى ادعاءات محددة ومتفق عليها بين الطرفين، مع توضيح المنهجيات والمعايير المستخدمة، وإثبات الخبرة الفنية ذات الصلة، والإفصاح عن تضارب المصالح المحتمل.
وفي الشهر الماضي، نشر "منتدى مقيمي الذكاء الاصطناعي"، الذي يضم "METR" ومعهد أبحاث التحقق والتقييم في الذكاء الاصطناعي (AVERI) ومؤسسات أخرى، رسالة مفتوحة بعنوان الحد الأدنى من الشروط لدمج المقيمين المستقلين.
وأكدت الرسالة ضرورة التزام جهات التقييم بالشفافية، وحمايتها من الانتقام بسبب نتائج عملها، ومنحها صلاحيات وصول تعادل تلك المتاحة للموظفين الداخليين الذين يتمتعون بأعلى مستويات الامتيازات داخل شركات الذكاء الاصطناعي.
وشددت الرسالة على أن التقييم المستقل المدمج لا يمكنه تلبية جميع احتياجات الرقابة، بل ينبغي التعامل معه بوصفه مكملاً لجهود توسيع الرقابة الخارجية، وليس بديلاً عنها.
الثقة العامة أصبحت شرطاً لتطوير النماذج المتقدمة
قال فريدمان إنه لاحظ تغيراً في طريقة تعامل "OpenAI" و"أنثروبيك" مع ملف التقييم المستقل خلال الأشهر الأخيرة، ويرجع ذلك جزئياً إلى إدراك الشركتين أنهما لن تتمكنا من إطلاق أنظمتهما المتقدمة دون كسب ثقة الجمهور.
لكنه حذر من ضرورة عدم الخلط بين هذا التحول وبين افتراض أن الشركات أصبحت تتحرك بدافع المصلحة العامة وحدها.
وقال: "لا أعتقد أنك بحاجة إلى تصديق أنها تحولت فجأة إلى مؤسسات إيثارية، أو أن هناك ما هو أبعد من شركات تتصرف كالشركات".
وهنا تكمن، بحسب ويرباخ، إحدى المشكلات الجوهرية في المنظومة؛ فشركتا "OpenAI" و"أنثروبيك" تتنافسان بشدة فيما تسعيان إلى التوسع نحو الأسواق العامة وتحقيق تقييمات تتجاوز تريليون دولار.
وأضاف ويرباخ أن هناك قدراً كبيراً من انعدام الثقة الشخصية بين الشركتين، رغم وجود توافق واسع بينهما بشأن ضرورة إجراء هذا النوع من التقييمات.
ويكشف هذا التناقض عن التحدي الأساسي الذي يواجه صناعة الذكاء الاصطناعي: بناء نظام رقابة مستقل وموثوق في وقت لا تزال فيه الشركات المطورة هي صاحبة النفوذ الأكبر في تحديد قواعد السلامة، وتوفير التمويل، والتحكم في الوصول إلى الأنظمة التي يُفترض أن تخضع للتقييم.