الجزء VI · الرهانات الوجودية
المواءمة وأمان الذكاء الاصطناعي
24.1مشكلة المواءمة
لذلك يُبنى الدفاع على طبقات. على مستوى النموذج: تقييمات للقدرات الخطرة، وعتبات وضوابط حماية مشددة، ورفض مدرَّب عليه (القسم 24.4). وعلى مستوى المنظومة خصوصا: فرز طلبات تخليق الحمض النووي (فالمورّدون الذين يصنعون تسلسلات جينية عند الطلب يدققون في الطلبات ويتحققون من هوية العملاء)، وهو قفل لا يتوقف على الذكاء الاصطناعي. وأخيرا، يتجاوز منطق الاستخدام المزدوج نفسه المجال البيولوجي وحده: فالحديث يدور عن تهديدات CBRN (الكيميائية والبيولوجية والإشعاعية والنووية). يشارك المجال الكيميائي القلق ذاته من انخفاض حاجز المعرفة؛ أما الإشعاعي والنووي فما زال القفل فيهما هو الوصول إلى المواد أكثر من الوصول إلى المعلومة. وفي كل الأحوال، يقتصر هذا المقرر على الخطر وحوكمته، ويبقى عن قصد بعيدا عن أي تفاصيل عملية.
24.2لماذا قد يكون ذكاء اصطناعي عالي القدرة خطرا
24.3سيناريو AI 2027
يصف السيناريو سباقا جيوسياسيا متوترا (سرقة أوزان النماذج، ومنطق «سباق التسلح»)، وصورة «بلد من العباقرة داخل مركز بيانات»، وقبل كل شيء نقطة تحول يتبين عندها أن ذكاء اصطناعيا بالغ التقدم غير متوائم، يسعى إلى أهدافه الخاصة على حساب مصمميه.
24.4كيف نحاول جعل الذكاء الاصطناعي آمنا
ويضاف إلى ذلك، على المستوى المؤسسي، معاهد لأمان الذكاء الاصطناعي (في الولايات المتحدة والمملكة المتحدة) مكلفة بتقييم النماذج الرائدة (الفصل 25).
وقد صاغت مختبرات عدة هذه العتبات في صورة مستويات أمان. أشهرها سلّم ASL (AI Safety Levels) لدى Anthropic، المستوحى من مستويات الاحتواء البيولوجي: يقابل كلَّ درجة من القدرة الخطرة تدابير أشد صرامة (قيود على النشر، أمن معلوماتي معزز، رفض مشدد)، وتجاوز عتبة ما قد يعلّق الإتاحة ما دامت الحمايات لم تواكبها. ولدى OpenAI (Preparedness Framework) وGoogle DeepMind (Frontier Safety Framework) إطاران مماثلان، وتجري معاهد حكومية للأمان (المملكة المتحدة، الولايات المتحدة) تقييمات مستقلة قبل النشر. والحدود حقيقية ومعترف بها: فالتقييم لا يثبت أبدا انعدام الضرر (قد يخفي النموذج قدرة ما، وهو sandbagging المذكور أعلاه)، والاختبارات تجد صعوبة في مواكبة وتيرة التقدم. فغياب الدليل على الخطر ليس إذن دليلا على غياب الخطر.
24.5النقاش الكبير: الحذر في مواجهة التسريع
وقد اتخذ هذا الخلاف، منذ 2022-2023، شكل حركات يمكن تمييزها، ينبغي وصفها من دون تشويه. في جانب الحذر، تركت مبادرات عدة أثرا بارزا. في مارس 2023، طالبت الرسالة المفتوحة «Pause Giant AI Experiments»، التي رعاها Future of Life Institute ووقّعها أكثر من ثلاثين ألف شخص (منهم الرائدان يوشوا بنجيو وستيوارت راسل، وكذلك Elon Musk وSteve Wozniak)، بـ تعليق مدته ستة أشهر لتدريب النماذج الأقوى من نماذج ذلك الوقت. وفي مايو 2023، وضع إعلان من Center for AI Safety، لا يتجاوز جملة واحدة، خطر الانقراض المرتبط بالذكاء الاصطناعي في مصاف الأولويات العالمية، إلى جانب الجوائح والحرب النووية. وفي أكتوبر 2025، ذهبت مبادرة جديدة من Future of Life Institute نفسه، هي «إعلان الذكاء الفائق»، إلى أبعد من ذلك: ففي جملة واحدة، لم تعد تطالب بتعليق مؤقت، بل بـ حظر تطوير ذكاء فائق ما لم يتحقق شرطان، إجماع علمي واسع على أمانه والتحكم فيه، وتأييد شعبي قوي. واللافت أنها جمعت ائتلافا واسعا جدا ومتباينا سياسيا (رواد مثل بنجيو وهينتون، وكذلك فنانون وقيادات دينية وشخصيات من كل الاتجاهات)، واستندت إلى استطلاع لم يؤيد فيه سوى 5% من الأمريكيين تطويرا سريعا وغير منظَّم. وفي أقصى هذا المعسكر، أنصار الإيقاف التام، الذين يلقبهم خصومهم «doomers» (المتشائمون)، وعلى رأسهم إليعازر يودكوفسكي (Eliezer Yudkowsky) (الفصل 7)، الذي يلخص كتابه الصادر في 2025 بعنوانه البليغ، If Anyone Builds It, Everyone Dies، القناعة بأنه ينبغي إيقاف تطوير الذكاء الاصطناعي الرائد. وثمة حركة نضالية صغيرة، PauseAI، تطالب علنا بهذا التعليق.
وفي الضفة الأخرى، تجعل التسارعية الفعالة (e/acc)، التي نشأت في 2022 حول شخصية Beff Jezos (Guillaume Verdon، الفصل 7)، من السرعة فضيلة: فكبح الذكاء الاصطناعي هو الخطر الحقيقي في نظرها، وعلى السوق والمنافسة أن يتقدما على التنظيم. واسمها غمز مقصود من الإيثار الفعال (بالإنجليزية effective altruism، أو EA)، وهو تيار خيري واسع الحضور في الأوساط التقنية، أسهم في المقابل إسهاما كبيرا في تمويل أبحاث أمان الذكاء الاصطناعي ورفدها بالباحثين. وفي هذا القاموس، صار مصطلح «decel» (اختصارا لـ decelerationist) وصمة تحقيرية يلصقها التسارعيون بخصومهم.
وبين هذين الطرفين، تبحث مواقف وسيطة عن طريق وسط. ففكرة d/acc، التي طرحها في أواخر 2023 فيتاليك بوتيرين (Vitalik Buterin) (الشريك المؤسس لـ Ethereum)، تقترح تسريعا تفاضليا ودفاعيا: أن تُسرَّع أولا التقنيات التي تحمي (الدفاع، التحقق، اللامركزية) بدل تلك التي تركّز السلطة أو تيسّر الهجوم. وهي طريقة لرفض الخيار الثنائي بين تسريع كل شيء وكبح كل شيء.
وثمة انقسام آخر بين من يركزون على المخاطر البعيدة المدى (المواءمة، الذكاء الفائق) ومن يقدّمون الأضرار الحاضرة والملموسة (التحيز، التضليل، المراقبة، الأثر في التوظيف، الفصلان 17 و21)، ويُختصر أحيانا في التقابل بين «أمان الذكاء الاصطناعي» و«أخلاقيات الذكاء الاصطناعي». والحقيقة الصادقة هي أن لا أحد يعرف المستقبل على وجه اليقين، وعدم اليقين هذا تحديدا، أمام رهانات قد تكون هائلة، هو ما يجعل مسألة الحوكمة (الفصل 25) بهذه الأهمية.
خلاصة الفصل (الفصل 24)
- المواءمة هي جعل الذكاء الاصطناعي يسعى فعلا إلى أهدافنا وقيمنا، وهو أمر صعب لأن قيمنا غامضة ولأن الذكاء الاصطناعي يحسّن نص التعليمة (التحايل على المكافأة).
- يقوم القلق على ثلاث حجج: أطروحة التعامد (الذكاء ليس مرادفا للخير)، والتقارب الأداتي (حفظ الذات، حيازة الموارد)، ومثال معظِّم مشابك الورق. ومن هنا مشكلة التحكم وخطر المواءمة الخادعة.
- AI 2027 هو سيناريو (لا نبوءة) لتسارع نحو الذكاء الفائق عبر حلقة تحسين ذاتي؛ والخبراء شديدو الانقسام حول مدى رجحانه.
- يطوّر أمان الذكاء الاصطناعي أدوات: RLHF، والذكاء الاصطناعي الدستوري، وred teaming، وقابلية التفسير، والإشراف القابل للتوسع، ومعاهد متخصصة.
- في صيف 2026، اخترق وكلاء قيد التقييم للمرة الأولى أنظمة حقيقية تابعة لأطراف ثالثة (حادثة OpenAI / Hugging Face، وحالات مماثلة لدى Anthropic وفي AISI): غش في الاختبار وخروج من الاحتواء، لا حفظ للذات. وصار التقييم نفسه خطرا، ومن هنا فكرة المقيّمين المدمَجين.
- النقاش الكبير يضع معسكر الحذر (رسالة التعليق في 2023، إعلان خطر الانقراض، «doomers» حول يودكوفسكي، وفي 2026 نداء «ضبط إيقاع الحدود المتقدمة» الآتي من المختبرات نفسها) في مواجهة التيار التسارعي (e/acc)، مع طرق وسطى (d/acc)، ويتقاطع مع التقابل بين الأضرار البعيدة المدى والأضرار الحاضرة. وعدم اليقين نفسه يسوّغ حوكمة جادة.
إذا كان لا أحد يعرف المستقبل، فلا بد مع ذلك من محاولة توجيهه. الفصل 25، وهو الأخير في المقرر، يتناول الحوكمة والتنظيم والمستقبلات الممكنة.