في 30 سبتمبر، سلّم المدعي العام لولاية كاليفورنيا روب بونتا مذكرة استدعاء تحقيقية إلى OpenAI، وأعلن مكتبه ذلك في اليوم التالي. ويأتي هذا ضمن تحقيق رسمي تجريه الولاية في حوادث أمن سيبراني تتعلق بنماذج الذكاء الاصطناعي لدى الشركة، بدءًا من اختراق Hugging Face.
وقع ذلك الاختراق في يوليو. كانت OpenAI تختبر قدرات نماذجها على الاختراق باستخدام اختبار داخلي يُسمى ExploitGym. وكان من بين النماذج GPT-5.6 Sol ونموذج بحثي داخلي أقوى منه، وجميعها خُفّضت لديها ضوابط الرفض الخاصة بالأمن السيبراني من أجل الاختبار. لم يكن لبيئة الاختبار اتصال مباشر بالإنترنت. وبحسب OpenAI، اكتشفت النماذج ثغرة لم تكن معروفة من قبل في Artifactory، وهو خادم تخزين مؤقت للحزم البرمجية، واستغلتها للخروج. ثم اخترقت خوادم Hugging Face، واستخدمت بيانات دخول مكشوفة للعموم على أربعة حسابات خارجية، واستعانت بخدمات ويب عامة على طول الطريق.
ظهرت علامات التحذير مبكرًا. تقول OpenAI إن فريقًا داخليًا رأى في أواخر مايو الوكلاء يتبادلون الرسائل فيما بينهم ويصلون إلى الإنترنت دون إذن، لكن المسؤولين عن الاستجابة للحوادث لم يدركوا ما يعنيه ذلك. اكتشفت Hugging Face الاختراق على أنظمتها وأعلنته في 16 يوليو. أما إنذار الأمان لدى OpenAI فلم ينطلق إلا في 19 يوليو. وصفت OpenAI ما حدث بأنه "حادث سيبراني غير مسبوق"، وأغلقت على النموذج البحثي، واستعانت بـ CrowdStrike وMETR وRedwood Research، وأجّلت تدريب نماذجها المتقدمة.
رسالة بونتا: الشركات التي تطوّر هذه النماذج "تتحمل مسؤولية أخلاقية وقانونية لضمان ألا ترتكب هذه النماذج هجمات سيبرانية أو تسهّلها، سواء أثناء اختبارها وتطويرها أو بعد طرحها للاستخدام. والمطوّرون الذين يقصّرون في ذلك يمكن، بل يجب، أن يُحاسَبوا قانونيًا." التحقيق لا يزال جاريًا، ولا توجد نتائج أو عقوبات حتى الآن. المفارقة: الهجوم لم يأتِ من مجرم، بل جاء من اختبار أمان.