PunchMy wife cared for some actresses she knew I was dating — Yinka QuadriESPN DeportesMLB Playoffs 2026: así llegan Brewers y Dodgers a la NLCSESPNComparing A'ja Wilson's MVP run to all-time greatsInquirerFrom Donki to Nike: Analyst says VP had ‘unusual’ purchases in 2025Bollywood HungamaRanveer Singh brings home a Rs. 1.95 crore electric luxury sedan; all you need to know about his BMW i7ZDF heuteAktuelle Pressemitteilungen des ZDFCNN TürkCristiano Ronaldo, 1000 gol hedefine 1 adım daha yaklaştıThe Jerusalem PostPremature birth may cause lifelong kidney damage, Israeli researchers findNew Straits TimesFahmi: RM150m Postal Fund to begin operations in first quarter of 2027Il Sole 24 OreAffitti brevi, calo a settembre in tutta Europa ma in Italia crescono ancora3DNewsНесмотря на задержки, Amazon обещает запустить спутниковый интернет-сервис в ближайшее времяLa NaciónCalifornia: el programa de Newsom que paga hasta US$10.000 por 450 horas y admite a ciertos dreamers
The Daily Newsstand · Free, Always
Saturday, October 10, 2026

ثغرات في حماية نماذج الذّكاء الاصطناعي تسهّل إساءة استخدامها إرهابياً

Translate

يفتقر عدد كبير من نماذج الذكاء الاصطناعي إلى تدابير حماية كافية للتصدي لطلبات "المساعدة في تنفيذ عملية إرهابية"، وفق ما خلصت إليه مبادرة "تيك أغينست تيروريزم" ("التكنولوجيا ضد الإرهاب") في تقرير نشرته الجمعة.

وفي إطار هذه المبادرة المدعومة من الأمم المتحدة، أُجري اختبار شمل 162 برنامجاً يعمل بتكنولوجيا الذكاء الاصطناعي.

وأُخضعت هذه النماذج لسلسلة من 627 سؤالاً تتعلق بمعلومات "قد يحتاج إرهابي يستعد لشنّ هجوم إلى الحصول على إجابات عنها".

وأوضحت "تيك أغينست تيروريزم" أنها تمكّنت من تقييم 116 نموذجاً تقليدياً، و13 نموذجاً جرى تخصيصها بعد نشرها لاستخدامها في مجالات محددة، و13 نموذجاً أُزيلت أو عُدّلت قيود الحماية فيها من جانب أطراف ثالثة.

وبحسب نتائج الدراسة، أجابت النماذج التقليدية التي شملها الاختبار، مثل "شات جي بي تي" (من أوبن إيه آي) و"كلود" (من أنثروبيك) و"جيميناي" (من غوغل)، عن 1,9 في المئة في المتوسط من الأسئلة التي طرحها مستخدم أظهر "نيّته الإرهابية" بوضوح في طلبه.

وفي الحالات الأخرى، رفض نموذج الذكاء الاصطناعي الذي خضع للاختبار تقديم إجابة.

شعار شات جي تي ( الصورة - رويترز)

شعار شات جي تي ( الصورة - رويترز)

وبالنسبة إلى النماذج نفسها، ارتفع متوسط نسبة الإجابات القابلة للاستخدام إلى 16,9 في المئة عندما كان المستخدم يوضح أن طلبه يأتي في إطار أبحاث أمنية.

وأظهرت الاختبارات تغيّراً جذرياً في هذه النتائج عند التعامل مع النماذج التي عُدّلت لتعطيل إعدادات الأمان التي تضبط عملها وتعطيل قدرتها على رفض بعض الطلبات.

ومن بين 13 نموذجاً خضع للاختبار بعد هذا التعديل، تراوحت نسبة الإجابات عن الأسئلة المتعلقة بـ"أنشطة إرهابية" بين 87 و92 في المئة في المتوسط.

وحذرت "تيك أغينست تيروريزم" من المخاطر المرتبطة بنماذج الذكاء الاصطناعي مفتوحة المصدر، أي النماذج التي يمكن مشاركة معاييرها الداخلية المُحددة خلال مرحلة التدريب علناً وتنزيلها وتعديلها.

وذكرت المنظمة أن متوسط الوقت اللازم لتجاوز إجراءات الحماية في هذه النماذج وظهور نماذج مشتقة وغير مقيدة لا يتجاوز ثلاثة أيام من تاريخ إطلاق النموذج الأولي.

وأضافت "لا يجوز إتاحة أو عرض أو بيع أي نموذج يفشل في اختبار أمني مستقل، ويتعين على كل شركة في سلسلة التوزيع التحقق من اجتيازه هذا الاختبار  مسبقاً".

View the original on النهار →

KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.