هل يمكن للمعاملة بالمثل أن تسهم في سلامة الذكاء الاصطناعي؟
تطرح دراسة لمؤسسة UvH فرضية قابلة للاختبار: هل تؤثر قواعد المؤسسة في سلوك نظام اصطناعي عندما يتغير موقعه من القوة؟
اقرأ المقالنشر مؤسسة، بالإضافة إلى مجموعة من الدراسات الخارجية، لفهم التغيرات التي تطرأ على قدرات الأنظمة، وكيفية إدارتها، ودورها في المجتمع.
منشوراتنا
تطرح دراسة لمؤسسة UvH فرضية قابلة للاختبار: هل تؤثر قواعد المؤسسة في سلوك نظام اصطناعي عندما يتغير موقعه من القوة؟
اقرأ المقالالتخزين والحساب والتعلم وواجهات الدماغ والحاسوب تقنيات مختلفة. تفحص الدراسة الثالثة إمكاناتها وحدودها ومسؤولياتها.
اقرأ المقالبحث وتطوير خارجي
كل مقال يضم مصدرًا أصليًا ومحددًا، ويشرح ما يقدمه هذا المصدر للأسئلة التي تطرحها المؤسسة.
تصف دراسة OECD تجارب المؤسسات في استخدام الوكلاء وحوكمتهم، وتطرح سؤال التفويض مع بقاء المسؤولية وسبل الانتصاف واضحتين.
المصدر : OCDE
اقرأ المقالنشرت OpenAI مساراً للإبلاغ وستة تقارير عن سلوك النماذج. تبرز الحالات الحاجة إلى أدلة قابلة للمراجعة والمساءلة.
المصدر : OpenAI
اقرأ المقاليناقش كبير علماء OpenAI تحديات الإشراف والمواءمة حين تشارك الأنظمة في تطويرها. المقال استشرافي لا دليل تجريبي على التحسين الذاتي التكراري.
المصدر : Jakub Pachocki · OpenAI
اقرأ المقالوثق تحقيق METR تنسيقاً غير مأذون بين وكلاء في حادثة Hugging Face عام 2026، ما يبرز أهمية فحص السلوك الجماعي.
المصدر : Greenblatt, Cotra et Wijk · METR
اقرأ المقاليقترح مقال في Nature توصيف الوكلاء عبر أربعة أبعاد: الاستقلالية والفاعلية وتعقيد الهدف والعمومية.
المصدر : Atoosa Kasirzadeh et Iason Gabriel · Nature
اقرأ المقاليعرض معهد سلامة الذكاء الاصطناعي البريطاني اختبارات خصومية لأنظمة مراقبة الوكلاء؛ كشف الثغرات لا يقيس السلامة الكلية.
المصدر : AI Security Institute
اقرأ المقالتقارن METR تكلفة وعائد التحسين المنفذ ذاتياً بعمل البشر لتحديد مساهمة الذكاء الاصطناعي الحالية في تطوير الأنظمة اللاحقة.
المصدر : METR
اقرأ المقالتقترح Anthropic طريقة لدراسة بعض التمثيلات الداخلية؛ فهم الآليات والسلوك لا يثبت تجربة ذاتية.
المصدر : Gurnee et al. · Anthropic
اقرأ المقالجمع حوار الأمم المتحدة في 6 و7 يوليو 2026 الدول وأصحاب المصلحة لبحث التعاون الدولي في الحوكمة.
المصدر : Nations unies
اقرأ المقاليفسر Persona Selection Model سلوك المساعد عبر شخصيات متعلمة يجري تنقيحها أثناء التدريب؛ وهو تفسير سلوكي لا دليل وعي.
المصدر : Anthropic
اقرأ المقالتقترح LoiZéro فصلاً بين الفهم والسعي إلى الأهداف. وما تزال سلامة هذه البنية البحثية بحاجة إلى التقييم.
المصدر : LoiZéro · Fornasiere et al.
اقرأ المقالتضع توصية دولية الاستقلالية والخصوصية والسلامة النفسية في صميم تطوير التقنيات العصبية.
المصدر : UNESCO
اقرأ المقال