مباشر
أين يمكنك متابعتنا

أقسام مهمة

Stories

36 خبر
  • رياضة
  • العملية العسكرية الروسية في أوكرانيا
  • فيديوهات
  • رياضة

    رياضة

  • العملية العسكرية الروسية في أوكرانيا

    العملية العسكرية الروسية في أوكرانيا

  • فيديوهات

    فيديوهات

  • "حرب الخليج"

    "حرب الخليج"

خطر جديد في عالم التقنية: كيف يُصاب الذكاء الاصطناعي بـ"التسمم"؟!

عادة ما تُرتبط كلمة "تسمم" بصحة الإنسان أو بالبيئة، غير أن هذا المصطلح بدأ في الآونة الأخيرة يتردد بشكل متزايد في سياق التكنولوجيا الرقمية.

خطر جديد في عالم التقنية: كيف يُصاب الذكاء الاصطناعي بـ"التسمم"؟!

المقصود هنا هو "تسمم" الذكاء الاصطناعي، وهو تهديد جديد وخفي قد يقوّض الثقة في الخوارزميات الذكية. وأظهرت أبحاث حديثة أن هذا الخطر واقعي؛ فقد وجد علماء من المعهد البريطاني لأمن الذكاء الاصطناعي ومعهد "آلان تورينج" وشركة Anthropic أن المتسللين قادرون — لخنق نموذج لغوي كبير مثل ChatGPT أو Claude — على إحداث تأثير خفي عبر إدخال نحو 250 مثالا  ضارا فقط ضمن ملايين الأسطر من بيانات التدريب. وقد نُشر هذا البحث في مجلة Computer Science.

ما هو تسمم الذكاء الاصطناعي؟

هو تدريب متعمَّد لشبكات عصبية على أمثلة خاطئة أو مضللة بهدف تشويه معرفتها أو سلوكها. والنتيجة أن النموذج يبدأ في ارتكاب أخطاء، أو ينفذ أوامر ضارة بطريقة ظاهرة أو سرّية.

يُميّز الخبراء نوعين رئيسيين من الهجمات:

  • هجمات مُستهدفة (باب خلفي): تهدف إلى إجبار النموذج على الاستجابة بطريقة محددة عند وجود محفز سري؛ مثلا "حقن" أمر خفي يجعل النموذج يرد بإهانة عند ظهور كلمة نادرة في الاستعلام مثل alimir123. قد تبدو الإجابة طبيعية عند الاستعلام العادي، لكنها تتحول إلى مسيئة عند إدخال المحفز. ويمكن للمهاجمين نشر هذا المحفز على مواقع أو وسائل تواصل لتفعيله لاحقا.
  • هجمات غير مباشرة (تسميم المحتوى): لا تعتمد على محفزات خفية بقدر اعتمادها على ملء بيانات التدريب بمعلومات زائفة. نظراً لاعتماد النماذج على كميات هائلة من المحتوى المتاح على الإنترنت، يستطيع المهاجم إنشاء مواقع ومصادر متعددة تروّج لمعلومة خاطئة (مثلاً: "سلطة الخضار تعالج السرطان")؛ وإذا استُخدمت هذه المصادر في التدريب، فسيبدأ النموذج بتكرار تلك الأكاذيب بصفتها حقائق.

ما مدى خطورة ذلك عمليا؟

الأدلة التجريبية تؤكد أن تسميم البيانات ليس مجرد سيناريو افتراضي: في تجربة أجريت في يناير الماضي، أدى استبدال 0.001% فقط من بيانات التدريب بمعلومات طبية مضللة إلى أن النموذج صار يُقدّم نصائح خاطئة في سياق اختبارات طبية نموذجية. هذا يبيّن قدرة الهجمات الصغيرة والمُحكمة على إحداث أضرار كبيرة تُؤثر على سلامة المخرجات وثقة المستخدمين.

المصدر: Naukatv.ru

 

 

 

 

التعليقات

"رويترز": مسيرة تستهدف منشأة تخزين غاز طبيعي مسال عائمة أمريكية في دمياط بمصر

وزارة البترول المصرية تصدر بيانا عقب حريق في سفينتين بميناء دمياط

بعد ثبوت صحة صورته مع نتنياهو.. بيروت تصدر بلاغ بحث وتحر بحق رجل الأعمال اللبناني أنطون صحناوي (صور)

ترامب يعلق على حادث ناقلة الغاز الطبيعي المسال الأمريكية في ميناء دمياط المصري (فيديو)

"رويترز": خالد بن سلمان حث واشنطن على تجنب استهداف الحوثيين

"أمبري": تعرض ناقلة غاز طبيعي مسال يونانية ترفع علم برمودا لهجوم بمسيرة في ميناء دمياط المصري

الثوري الإيراني يتحدى إجراءات الحظر ويعلن إطلاق بوابة إلكترونية آمنة للتواصل المباشر

مستشار خامنئي يهدد بتغيير استراتيجي بعد الضربات على العراق

فصائل عراقية تعد بالرد على الهجوم الأمريكي السعودي خلال 72 ساعة

نتنياهو عقب لقائه هيغسيث: وزير الحرب الأمريكي أخبرني بشيء مثير للاهتمام (صور + فيديو)

العراق.. مجلس الأمن يعقد اجتماعا طارئا برئاسة الزيدي لمناقشة الغارات الأمريكية السعودية

العراق.. مقتل 5 مستشارين إيرانيين في قصف أمريكي سعودي على مقار للحشد الشعبي (صورة)

القيادة المركزية الأمريكية تعلن شن ضربات جديدة على إيران

مسؤول إسرائيلي رفيع: إذا عدنا إلى اتخاذ إجراءات قوية ضد إيران فلن يتم احتواء البرنامج النووي

قضية أمنية تهز إسرائيل.. اتهام جندي احتياط في وحدة سرية بالتجسس لصالح إيران

حاويات بكتابة عبرية.. يونيفيل يعلن العثور على 4 أطنان نيترات أمونيوم شديدة الانفجار جنوب لبنان (صور)

بعد ساعات من ضربات سعودية أمريكية على الحشد الشعبي في العراق.. خالد بن سلمان يلتقي فانس في واشنطن