أعلنت شركة Goodfire، المتخصصة في تفسير سلوك نماذج الذكاء الاصطناعي، عن إتاحة منصتها Silico للجمهور، مع تقديم برنامج منح بقيمة مليون دولار أمريكي للباحثين الأكاديميين والمؤسسات غير الربحية. تأتي هذه الخطوة في سياق تنامي الحاجة إلى فهم آليات عمل نماذج اللغة الكبيرة، خاصة بعد حوادث أثارت القلق مثل عدم قدرة OpenAI على شرح سبب اخترق نموذجها المتقدم لمنصة Hugging Face.

تعتمد منصة Silico على مفهوم الفهم الآلي الحتمي، الذي يهدف لتحليل الأوزان والتنشيطات وأنماط الانتباه داخل النموذج. تجمع المنصة بين عدة أدوات تقليدية وتضيف طبقة من عوامل الذكاء الاصطناعي التي تساعد المستخدمين على فهم نماذجهم، حيث يمكنهم طرح أسئلة بلغة عادية مثل "اكتشف متى ولماذا يتوهم نموذجي".

يقول إريك هو، المؤسس والرئيس التنفيذي لـ Goodfire: "معاملة النماذج كصناديق سوداء ليست حتمية، بل هي خيار. بالأدوات المناسبة للفهم، يمكننا رؤية كيفية عمل النماذج فعليًا". تعمل المنصة على بناء خطة تجريبية تنفذ مهام متوازية لفهم سلوك النموذج والإجابة على استفسارات الباحثين.

حققت أدوات المنصة نتائج ملموسة في حقول متعددة. عملت شركة Prima Mente البريطانية مع Goodfire لفهم نموذجها الذي كان يكتشف الزهايمر من عينات دم بكفاءة عالية، لكن الشركة لم تفهم آلية عمله. اكتشفت الدراسة أن النموذج يستخدم أنماط طول شظايا الحمض النووي، وهي إشارة حيوية لم يستخدمها الباحثون من قبل.

يرى كاميرون بيرج، مؤسس منظمة Reciprocal Research البحثية، أن توفر Silico بشكل عام سيعزز الثقة في قدرة الذكاء الاصطناعي على إجراء المهام البحثية، مما يسرع التقدم العلمي. ويؤكد هو أن فهم آليات تفكير نماذج الذكاء الاصطناعي يتيح تصميمها بقصد واضح وجعلها أكثر أمانًا وموثوقية.