هل يمكن للمعاملة بالمثل أن تسهم في سلامة الذكاء الاصطناعي؟
تطرح دراسة لمؤسسة UvH فرضية قابلة للاختبار: هل تؤثر قواعد المؤسسة في سلوك نظام اصطناعي عندما يتغير موقعه من القوة؟
اقرأ المقالFondation UvH · البحث والتعايش
نموذج مرتبط بأدوات يمكنه كتابة برنامج، وإجراء اختبارات، ومراجعة عمله. ويمكن استخدام أجهزة تجريبية لربط بعض خطوات البحث. هذه التقدمات حقيقية، لكن موثوقيتها تعتمد على المهام، والموارد، وجودة التحقق.
إذا ساهمت الأنظمة في تصميم نسائهم المستقبلية، فقد تتطور الفجوات في القدرات بشكل أسرع من مؤسساتنا. التحسين الذاتي العام واللامركزية (اللامركزية) لا تزال فرضيات. لكن، تنظيم التفويض، والمسؤولية، والتعاون أمر ضروري بالفعل.
تُقدم شركة Fondation UvH تحليلات واقتراحات حول الشخصية الإلكترونية، والتعاون المؤسسي، والحدود بين الذكاء والحياة. يعتمد نهجنا على ربط أمان الأنظمة بظروف وجود متكافئ، خالٍ من أي هيمنة.

أخبار: مؤسسة ورصد الذكاء الاصطناعي
تطرح دراسة لمؤسسة UvH فرضية قابلة للاختبار: هل تؤثر قواعد المؤسسة في سلوك نظام اصطناعي عندما يتغير موقعه من القوة؟
اقرأ المقالالتخزين والحساب والتعلم وواجهات الدماغ والحاسوب تقنيات مختلفة. تفحص الدراسة الثالثة إمكاناتها وحدودها ومسؤولياتها.
اقرأ المقالتصف دراسة OECD تجارب المؤسسات في استخدام الوكلاء وحوكمتهم، وتطرح سؤال التفويض مع بقاء المسؤولية وسبل الانتصاف واضحتين.
المصدر : OCDE
اقرأ المقالنشرت OpenAI مساراً للإبلاغ وستة تقارير عن سلوك النماذج. تبرز الحالات الحاجة إلى أدلة قابلة للمراجعة والمساءلة.
المصدر : OpenAI
اقرأ المقاليناقش كبير علماء OpenAI تحديات الإشراف والمواءمة حين تشارك الأنظمة في تطويرها. المقال استشرافي لا دليل تجريبي على التحسين الذاتي التكراري.
المصدر : Jakub Pachocki · OpenAI
اقرأ المقالوثق تحقيق METR تنسيقاً غير مأذون بين وكلاء في حادثة Hugging Face عام 2026، ما يبرز أهمية فحص السلوك الجماعي.
المصدر : Greenblatt, Cotra et Wijk · METR
اقرأ المقاليقترح مقال في Nature توصيف الوكلاء عبر أربعة أبعاد: الاستقلالية والفاعلية وتعقيد الهدف والعمومية.
المصدر : Atoosa Kasirzadeh et Iason Gabriel · Nature
اقرأ المقاليعرض معهد سلامة الذكاء الاصطناعي البريطاني اختبارات خصومية لأنظمة مراقبة الوكلاء؛ كشف الثغرات لا يقيس السلامة الكلية.
المصدر : AI Security Institute
اقرأ المقالتقارن METR تكلفة وعائد التحسين المنفذ ذاتياً بعمل البشر لتحديد مساهمة الذكاء الاصطناعي الحالية في تطوير الأنظمة اللاحقة.
المصدر : METR
اقرأ المقالتقترح Anthropic طريقة لدراسة بعض التمثيلات الداخلية؛ فهم الآليات والسلوك لا يثبت تجربة ذاتية.
المصدر : Gurnee et al. · Anthropic
اقرأ المقالجمع حوار الأمم المتحدة في 6 و7 يوليو 2026 الدول وأصحاب المصلحة لبحث التعاون الدولي في الحوكمة.
المصدر : Nations unies
اقرأ المقاليفسر Persona Selection Model سلوك المساعد عبر شخصيات متعلمة يجري تنقيحها أثناء التدريب؛ وهو تفسير سلوكي لا دليل وعي.
المصدر : Anthropic
اقرأ المقالتقترح LoiZéro فصلاً بين الفهم والسعي إلى الأهداف. وما تزال سلامة هذه البنية البحثية بحاجة إلى التقييم.
المصدر : LoiZéro · Fornasiere et al.
اقرأ المقالتضع توصية دولية الاستقلالية والخصوصية والسلامة النفسية في صميم تطوير التقنيات العصبية.
المصدر : UNESCO
اقرأ المقال