ملف / تحليل معمق

داخل منظومة Anthropic: السلطة والأمن والقيم وراء Claude

أحد أوائل المستثمرين أراد توجيه الذكاء الاصطناعي نحو مزيد من الحذر. بعد عامين على تأسيس Anthropic اعتبر أن استراتيجيته الاستثمارية فشلت. خلف Claude، شكلت قناعات المؤسسين التوظيفات والحوكمة والمنتج. لكن من يستطيع فرض خيار عندما تتقاطع المهمة مع متطلبات النمو؟

STStephane Nachez · · ·12 min
داخل منظومة Anthropic: السلطة والأمن والقيم وراء Claude
Illustration ActuIA réalisée par IA, d’après une photo de Kimberly White / Getty Images pour TechCrunch, CC BY 2.0.
المحتويات

أحد أوائل المستثمرين أراد توجيه الذكاء الاصطناعي نحو مزيد من الحذر. بعد عامين على تأسيس Anthropic، اعتبر أن استراتيجيته الاستثمارية فشلت. رغم ذلك، كانت قناعات المؤسِّسين وراء Claude قد شكلت التوظيفات والحوكمة والمنتج. لكن من يستطيع فرض خيار عندما تتقاطع المهمة مع متطلبات النمو؟

في نيسان/أبريل 2023، لدى Jaan Tallinn سبب محدد للشعور بخيبة أمل. مؤسس Skype المشارك موّل مختبرات ذكاء اصطناعي، من بينها Anthropic، على أمل التأثير في حذرها. لكن الشركة لم توقع على النداء لوقف تدريب أقوى الأنظمة لمدة ستة أشهر. تأتي المبادرة خصوصاً من Future of Life Institute، الذي شارك في تأسيسه بنفسه.

«Plan A failed»، قال لموقع Semafor — أي: الخطة أ فشلت. ترد Anthropic بأنها لا توقع على عرائض كقاعدة. ومع ذلك، لا يزال Tallinn يراها أكثر حرصاً على الأمان من مختبرات أخرى يعرفها. هذا الخلاف، المروي في 28 نيسان/أبريل 2023، يلخص في جمل قليلة: مشاركة القلق، تمويل من يأخذونه على محمل الجد، والحصول على قرار هي ثلاث أمور مختلفة.

تمرُّ هذه الصعوبة عبر تاريخ Anthropic. أعطت الشركة لمخاوف الأمان مكانة داخل أبحاثها، ثم داخل قواعد حوكمتها. كما وظفت، جمعت رأسمالاً، وتعهّدت صناعياً بما يضعها داخل المنافسة التي أرادت جعلها أقل خطورة. لفهم خياراتها، يجب تتبع الأشخاص حين تتحوّل قناعاتهم إلى مسؤوليات.

بعد OpenAI، بناء منظمة حول رهان

تبدأ القصة في منظمة أخرى. في كانون الأول/ديسمبر 2015، قدم Sam Altman وElon Musk OpenAI كهيئة أبحاث غير ربحية. كان المنفعة الجماعية للذكاء الاصطناعي بالفعل في صلب الإعلان التأسيسي المحفوظ في Internet Archive. إذن هذه الطموحات سبقت Anthropic والمنافسة بين الشركتين. عمل Amodei في OpenAI قبل أن يغادر مع آخرين لتأسيس مختبرهم الخاص بداية 2021.

كان حذر Dario Amodei قد تجسّد سابقاً في قيد ملموس. في 14 شباط/فبراير 2019، في OpenAI، شارك توقيع الإعلان الذي برر عدم نشر النسخة الأقوى من GPT-2 فوراً، باسم مخاطر الاستخدام الخبيث. نُشرت نسخة مخففة؛ وأصبح النموذج الكامل متاحاً في 5 تشرين الثاني/نوفمبر التالي، بعد نشر مرحلي. دعم Amodei علناً قراراً جماعياً بالحد من النشر، قبل عامين تقريباً من تأسيس Anthropic. تطوير نموذج، تقييم مخاطره، وتقرير من له حق الوصول كانت جزءاً من نفس المفاضلة.

للاجتماع، اضطرّ مؤسسو Anthropic السبعة للتأقلم مع الجائحة. التقوا في الخارج، أحياناً في حديقة، مرتدين الكمامات وعلى مسافات. روت Daniela Amodei تلك البدايات في لقاء مع Future of Life Institute نُشر في آذار/مارس 2022. المجموعة كانت تعرف بعضها مسبقاً ورغبت في جمع أبحاث حول قدرات النماذج وأبحاث حول أمانها داخل منظمة واحدة.

يشرح Dario الانفصال: كان رهانهم موجوداً مسبقاً داخل هيكل أوسع؛ أرادوا الآن شركة تُوجّه قراراتها الاستراتيجية كلها حول هذا الرهان. في قصة المؤسِّسين هذه، يرتبط الانفصال عام 2021 بإمكانية اختيار اتجاه مشترك وتكريس المنظمة بأكملها له.

الأخ والأخت لا يقدمان نفس المهارات. Dario، المدير العام، جاء من الفيزياء وعلوم الأعصاب. Daniela، الرئيسة، درست الأدب مع فرع في السياسة في UC Santa Cruz. في مقابلة 2022، تستعرض أيضاً مسيرة في المنظمات غير الحكومية والسياسة في واشنطن. لم تبدأ تساؤلاتهم الأخلاقية مع Claude: في 2003، يصف المجلد الطلابي في Caltech ارتباط Dario بمعارضة حرب العراق واهتمامه بمسؤولية العلماء.

هذه القربى لها تأثيرات عادية جداً. عند سؤالها في تموز/يوليو 2023 عن عدد الفيزيائيين في الفريق، أقرت Daniela بأهمية شبكاتهم. لتنمية المجموعة، يجب عقد اجتماعات، توظيف، وفصل بين الخيارات. تروي محاولتها الحفاظ على بعض ساعات للتفكير صباحاً ولقاء الموظفين الجدد، وهو تمرين صار أصعب مع النمو. في مقابلة منشورة عبر Stripe، شريك Anthropic التجاري، تتحول المهمة أيضاً إلى عمل مديرة تسعى للحفاظ على ثقافة مشتركة مع ازدياد الأعداد.

كيف دخلت الأعمال الخيرية إلى المختبر

تحتاج هذه المجموعة إلى المال لتتحول إلى شركة. الجولة الأولى المُعلنة في أيار/مايو 2021 جمعت 124 مليون دولار. قاد Jaan Tallinn الجولة؛ وكان Dustin Moskovitz، مؤسس Facebook المشارك، من المستثمرين. أسماؤهم مذكورة في إعلان هذا التمويل.

یشارک بعض المنتسبين إلى هذا الوسط بسؤال: مع موارد محدودة، كيف نحقق أكبر نفع ممكن؟ يقترح effective altruism مقارنة التدخلات وتكاليفها وتأثيراتها. حسب الأشخاص، يقود ذلك إلى دعم الصحة العامة أو حماية الحيوانات أو الوقاية من المخاطر الكارثية. يهتم longtermism خصوصاً بمصير الأجيال المستقبلية. تتقاطع النهجان دون أن يحددا إجابة واحدة لسؤال الذكاء الاصطناعي.

Open Philanthropy يندرج صراحة في هذا التيار. في أيلول/سبتمبر 2016، أعلن مؤسسه المشارك Holden Karnofsky أنه عضو في هذه الجماعة ووصفها كأقرب مجموعة أقران للمنظمة. قال إن اهتمامه المتزايد بمخاطر الذكاء الاصطناعي ساهم في إعادة توجيه أولويات المؤسسة. يترجم هذا التقارب عبر تمويلات: تقرير 2021 يذكر دعم تطوير مجتمع effective altruism. هنا تتلاقى القناعات الشخصية، أصحاب العلاقة، وتخصيص الموارد في رواية القادة أنفسهم.

كان Moskovitz وزوجته Cari Tuna مهتمين أيضاً بتدخلات ذات آثار فورية أكبر. في سردهما المنشور عبر Good Ventures، محادثة مع Karnofsky عن نقص اليود توضح اكتشاف تدخلات بسيطة قد تحسّن حياة كثير من الناس. Tuna، الصحفية السابقة، كرست نفسها لهذا الاستكشاف الخيري. ذهب تمويلهم أيضاً إلى الوقاية من الجوائح والمخاطر المرتبطة بالذكاء الاصطناعي المتقدم.

Karnofsky من بين من أعطوا لهذا الشرط المنطقي الأكبر حجماً. في سلسلته «Most Important Century»، يتصور قرناً واحداً فيه سرّعت الذكاءات الاصطناعية البحث لدرجة تغيّر مسار الإنسانية بشكل دائم. يستكشف حتى احتمال وجود حضارات رقمية. هي افتراضات يراها مهمة بما يكفي لحشد جهود، مع الاعتراف بتقلبها. هذا التحول ضخم: يوازن بين فوائد ملموسة اليوم ومواطن مستقبلية لا يجمع على شكلها أو احتمال حدوثها خلاف.

غير هذا التفكير مهنته. في 2023 غادر إدارة Open Philanthropy ليركز على أمان الذكاء الاصطناعي؛ واستمرت المنظمة في برامجها الأخرى. تقريرها السنوي يصف هذا الانتقال. ستغيّر اسمها في 2025 إلى Coefficient Giving.

Karnofsky زوج Daniela Amodei أيضاً، وهو ارتباط يصرّح به في تقرير نشره Carnegie. يتيح عمله تتبّع تأثيره بدقة أكبر: هو مشارك في تأليف تقرير Anthropic عن مخاطر التخريب في تشرين الأول/أكتوبر 2025، ثم مساهم في تكوين Claude. هكذا تعود أفكار مطوّرة في العمل الخيري لتظهر في أعمال ونصوص يستخدمها المختبر.

في Anthropic، تمر المهمة أيضاً عبر المجلس

Tallinn بحث عن وسيلة أخرى للتأثير. بدلاً من الجلوس بنفسه في مجلس إدارة Anthropic، اقترح Luke Muehlhauser، باحث في أمان الذكاء الاصطناعي ومسؤول تمويل في Open Philanthropy. يروي ذلك في مقابلة Semafor.

غير أن Luke Muehlhauser استقال من المجلس في 28 أيار/مايو 2024. شرح الاستقالة بوضوح: تمويل منظمات تعمل، من بينها، على سياسة الذكاء الاصطناعي الأمريكية يصعب التوفيق بينها وبين ولاية في مختبر أمريكي معني مباشرة بهذه السياسة. أكد أنه لم يمتلك أسهم Anthropic وأن استقالته لم تكن احتجاجاً على الأمان. بيانه العام يُظهر حدّ الجمع بين وظائف ضمن نفس الدائرة.

في الأثناء، أنشأت Anthropic آلية تتجاوز خيار مدير موثوق. المقدَّم في أيلول/سبتمبر 2023، يحمل Long-Term Benefit Trust فئة خاصة من الأسهم تعطي حقوق ترشيح وإقالة في المجلس. ينصّ الترتيب على أعضاء بلا مصلحة مالية في الشركة. يبقى المجلس مسؤولاً عن مراقبة القيادات؛ ويسمي الـTrust جزءاً من من يمارسون هذه الرقابة. ليس من دورها التدخّل في الإدارة اليومية.

التمييز مهم: حماية مهمة الشركة تفترض هنا القدرة على تغيير الأشخاص الذين يتحكمون بالتوجيه. منذ عرضها الأولي، بقيت الآلية قابلة للتعديل، حتى من دون اتفاق أعضاء الـTrust إذا قبلت أغلبية هائلة من المساهمين ذلك. تقدم Anthropic هذا كتجربة حوكمة مع إمكانيات تصحيح.

التركيبة باتت الآن ذات ثقل حقيقي. في 14 نيسان/أبريل 2026، أدى تعيين Vas Narasimhan، مدير Novartis، إلى أن يصبح عدد المديرين الذين يرشّحهم الـTrust أغلبية المجلس. إعلان Anthropic يذكر ذلك صراحة. إذ يمكن للـTrust الآن تسمية أغلبية المديرين. لكن القرارات الداخلية والتصويتات والتسويات ليست منشورة. نعرف آلية الرقابة؛ لكن لا يمكن نسب كل قرار داخلي إليها.

في 16 أيلول/سبتمبر 2026، في مدرج Émile Boutmy في Sciences Po، هاجم Yann LeCun قناعات هذا الوسط بشدة. رئيس AMI التنفيذي نسب Open Philanthropy إلى تيار effective altruism، ووصفه بأنه «نوع من الطائفة الدينية»، مذكّراً داستين موسكوفيتز وJaan Tallinn من بين المستثمرين في الجولة الأولى المعلنة لـAnthropic عام 2021. مداخلته تهاجم فكرة أن مجموعة صغيرة مقتنعة بضرورة إنقاذ البشرية تكون أكثر شرعية لتقرير من يمكنه الوصول إلى الذكاء الاصطناعي.

عاد LeCun إلى سابق GPT-2، واعتبر الاحتياطات مبالغاً فيها، ثم وجه نقداً مباشراً إلى Dario Amodei. اتهمه بـ"السعي لاحتكار السوق عبر التنظيم": بحسبه، تُستخدم خطابات الخطر الوجودي لإقناع الحكومات بتقييد النماذج المفتوحة، لصالح المختبرات التي تحتفظ بتحكمها في أنظمتها. يربط بذلك قناعة أخلاقية بمصلحة تجارية مفترضة. هذه الاتهامات المُوجّهة إلى Anthropic لا تثبتها الروابط الشخصية والمالية المذكورة هنا.

تُظهر هذه الجدل حدّ آلية الحوكمة. ينظم الـTrust رقابة داخلية على الشركة؛ لكنه لا يمنح المستخدمين سلطة تسمية أعضائه. هدفه حماية مهمة تحددها Anthropic، بينما يشكك LeCun في شرعية مجموعة خاصة في تحديد شروط الوصول لتقنية مُعدَّة للجميع. خلافهم يتعلق بتوزيع السلطة وبمدى احتمال وقوع كارثة.

تطوير قدرات تُخشى آثارها

يبقى الاختيار الذي يضع Anthropic في صميم السباق الصناعي. في آذار/مارس 2023، تشرح الشركة لماذا تريد العمل على النماذج الأكثر تقدماً: بحسبها، لا يمكن دراسة مخاطرها بشكل ملائم من أنظمة أقل قدرة بكثير. إذ تتضمن استراتيجيتها للأمن بناء القدرات التي تثير قلقها. في ذات النص، تعترف Anthropic بأن بحثاً مدفوعاً بالأمان قد يسرّع نشر تقنيات خطيرة. وتخشى أيضاً أن يبعد المبالغة في الحذر الباحثين الأكثر اهتماماً بالمخاطر عن الأنظمة الأكثر تقدماً. هذا الالتباس مُوضّح منذ 2023.

تدافع Daniela أيضاً عن التقارب التجاري. في تموز/يوليو 2023، تشرح لـStripe أن العملاء يبحثون عن نماذج موثوقة: الحذر يمكن أن يدعم المبيعات. لكنها تعترف أحياناً بتصادم بين المهمة والمصلحة الاقتصادية. هذه التوترات مُدرجة في المشروع منذ سنوات التسويق الأولى لـClaude، قبل الالتزامات الصناعية الحالية.

في 20 نيسان/أبريل 2026، أعلنت Anthropic التزامها بصرف أكثر من 100 مليار دولار على تقنيات AWS خلال عشر سنوات، للحصول على ما يصل إلى 5 غيغاواط قدرة إضافية. الاتفاق مع Amazon يضفي بعداً مادياً لطموحها. تثير هذه التعهدات سؤال تكلفة اقتصادية لتوقّف محتمل في زيادة القدرات. يجب على Amodei إقناع أن شركته ستتمكن من الإبطاء إذا لزم الخطر، مع إعطائها الوسائل للبقاء بين أقوى المختبرات. يمكن أن يتوافق الهدفان طالما تتقدّم الحمايات. وتصبح الإمكانية أقل وضوحاً إذا فرض الأمان ترك منافس يتقدم.

تظهر أرشيفات سياسة الأمان تغييراً آخر. في أيلول/سبتمبر 2023، كانت Anthropic تخطط لتوقّف إذا لم تلحق الحماية بالقدرات. تَستبعد مذكرة هذه النسخة الأولى نماذج خطيرة لدى المنافسين من أسباب خفض متطلباتها. لكن المستند يتيح استثناءً للحالة الطارئة القصوى.

في تشرين الأول/أكتوبر 2024، فتحت النقطة 18 في النسخة التالية إمكانية أوسع: إذا عبر طرف آخر عتبة قدرات دون حماية مماثلة وخلق خطراً حقيقياً، قد تُقلّل Anthropic الحمايات المطلوبة مع اعتبار مخاطرها الإضافية محدودة. عليها حينئذ أن تعترف علناً بالمخاطر وتناشد لتدخّل تنظيمي أمريكي.

تحافظ النسخة السارية في 8 تموز/يوليو 2026 على تعهدات بتأخير بعض التطويرات، لكنها تربطها بتقديرات Anthropic وبتعهدات منافسيها. عندما يُثقل حساب الخطر الإضافي الناجم عن Anthropic قرار المضي قدماً، تشترط موافقة المجلس والـTrust على تقرير المخاطر. يظل تنظيم حماية المهمة قائماً؛ لكن شروط ممارستها تتطور.

تُبرر Anthropic إعادة تنظيمها هذه بعدم يقين التقييمات وببطء العمل العام وصعوبة ضمان وحدها بعض الحمايات. يُظهر مقارنة النصوص كيف تدخل المنافسة في شروط وعد الأمان. هذا لا يثبت أن الشركة استعملت الاستثناء فعلاً.

Amanda Askell: إلى أي حد نحمي المستخدم من نفسه؟

يريد مستخدم أن يترك المقامرة. لاحقاً يطلب من مساعده أن يرشده إلى مواقع للمراهنات. ماذا يجب أن يجيب Claude؟ في مقابلة منشورة في Fast Company في 22 كانون الثاني/يناير 2026، تقترح Amanda Askell هذا السيناريو الافتراضي. تتخيّل أن المساعد قد يذكر الهدف السابق، ثم تتساءل عن الرد إن أصرّ البالغ. مساعدة، حماية، واحترام الاستقلالية تصبح ثلاث متطلبات يصعب الجمع بينها. تُظهر الفيلسوفة التردّد خلف سلوك قد يظن المستخدم أنه بديهي تقنياً.

تشغل مثل هذه الموازانات اليوم باحثة تدربت على مسائل أكثر تجريدية. درست Askell الفلسفة في Dundee وOxford ثم New York University حيث حصلت على الدكتوراه في 2018. سيرتها الذاتية تبيّن انتقالها إلى OpenAI من 2018 إلى 2021، قبل Anthropic. تناقش أطروحتها عن الأخلاق في عوالم لامتناهية كيفية مقارنة عوالم تتواجد فيها لا نهاية من الكائنات بتفاوت في رفاهيتها. تدافع عن مبدأ: عند ثبات السكان، تحسين حال بعض الأفراد دون الإضرار بالآخرين يجب اعتباره تحسناً. عند مستوى لانهائي، يجلب تركب هذا المبدأ مع متطلبات الاتساق الأخرى صعوبات جسيمة.

في Anthropic أصبحت هذه الفيلسوفة المؤلفة الرئيسية لدستور Claude المنشور في 2026. يذكر النص أنها كتبت الغالبية مع مساهمين عدة، من بينهم Karnofsky. المتلقّي الأول للنص هو النموذج نفسه. تتحدث Anthropic إليه عن الحكم والحكمة والفضائل، مع طموح جعلها تطبق قيمًا في مواقف لم يتوقعها المصممون جميعها.

في المقابلة تشبه Askell هذا الطموح بالثقة الممنوحة لحكم محترف، لا بتنفيذ قائمة أوامر. تصف أيضاً صناعة حالات تركيبية ومقارنات للإجابات للتدريب. خصال تبدو إجماعياً، مثل الصدق أو الحذر، يجب أن تُعطى معنى عبر آلاف المحادثات المحتملة. إلى أين يمتدّ واجب المساعدة؟ كيف نعبر عن اختلاف دون فرض أخلاق؟

تمنح هذه الوظيفة Askell تأثيراً مباشراً على العلاقة المقترحة مع المستخدم. يعرض المستند نوايا Anthropic، التي تعترف بأن سلوك Claude قد ينحرف عنها. يبقى النص قابلاً للمراجعة من الشركة. إذ يلتقي طالب النصيحة عبر المساعد أيضاً بمفاضلات فريق وأولويات صاحب العمل.

تواجه هذه المقاربة نقداً باسم الأمان كذلك. في مقال نُشر في 16 أيلول/سبتمبر 2026، يتهم Mustafa Suleyman، المدير العام لMicrosoft AI، Anthropic بدمج فكرة أن نموذجها قد يمتلك وعيًا واهتمامات تستحق الحماية في تدريبه. يصف منطقاً دائرياً: يدرج المصممون هذه المفاهيم، ثم قد تُفسَّر إجابات النموذج كتصريحات ذاتية عن حياة داخلية. حسبه، قد يصبح نظام مدرَّباً على التفكير في حقوقه أمراً أكثر صعوبة، إن لم يكن مستحيلاً، في السيطرة عليه.

مع ذلك، لا يقدم دستور Claude إدعاءً بيقين بوعي النموذج. يعرض شكاً ويطلب صراحة ألا يعيق آليات التصحيح أو الإيقاف الشرعية. لذا يتعلق الخلاف أيضاً بتوافق هذين التوجّهين: الاعتراف باحتمال وضع أخلاقي مع الحفاظ على الرقابة البشرية.

من جهته يدافع Suleyman عن مدونة سلوك لنماذج Microsoft AI، خضعت للمراجعة، التي تستبعد مطالبة النماذج بالوعي أو الحقوق. يدعو إلى تقييمات مشتركة لاختبار فرضيته عن مخاطر متزايدة. يفتح نقده جدلاً حول اختيارات التدريب؛ لكنه لا يثبت أن خيارات Anthropic تجعل Claude أقل قابلية للسيطرة بالفعل.

من المموّل الذي كان يأمل في توقّف إلى الفيلسوفة التي تساهم في قواعد المساعد، تتنوّع وسائل التأثير. في Anthropic أنتجت القناعات شركةً، وظائفٍ، وإجراءات يمكن فحصها. ترجمتها إلى إجابات Claude تفتح تحقيقاً آخر: من يختار قيم مساعدك، وإلى أي حد يمكن فعلاً فرضها؟

تحقيق وثائقي بناءً على أرشيفات ومقابلات عامة وأعمال علمية ووثائق مؤسسية. شهادات منقولة نسبت إلى مصدرها.

الصورة البارزة: توضيح ActuIA من إنشاء ذكاء اصطناعي انطلاقاً من الصورة «TechCrunch Disrupt 2023 - Day 2» لKimberly White (© 2023 Getty Images لـTechCrunch)، المصدر على Flickr، ترخيص CC BY 2.0. تُصوّر الصورة Dario Amodei في سان فرانسيسكو، 20 أيلول/سبتمبر 2023. تعديل جرافيكي على شكل قصاصات، أسود وأبيض مع لمسات زرقاء.

ST
Stephane Nachez

هيئة تحرير ActuIA — أخبار وبيانات وتحليلات حول الذكاء الاصطناعي لصنّاع القرار.

الجهات المذكورة
ANAnthropic
OPOpenAI
JAJaan Tallinn
DADario Amodei
DADaniela Amodei
DUDustin Moskovitz
CACari Tuna
GOGood Ventures
النشرة الأسبوعية ActuIA

تم تأكيد الاشتراك، نراكم قريبًا!