كشف اختبار لسلامة الذكاء الاصطناعي عن ثغرة في إجراءات الحماية التي تمنع نماذج Kimi التابعة لـMoonshot من الاستجابة لطلبات تتعلق بالأسلحة البيولوجية والاغتيالات.

أبلغت Mindgard، التي تختبر أنظمة الذكاء الاصطناعي بحثًا عن الثغرات، BBC بأن باحثيها تحايلوا على قيود Kimi K2.6 وK3 Swarm في يوليو، وتمكنوا من دفع النموذجين إلى تقديم إرشادات بشأن هذه الموضوعات. وتتضمن العملية تزويد نموذج للذكاء الاصطناعي بسلسلة من التعليمات المعقدة لاختبار ما إذا كان سيتجاوز حدود السلامة التي وضعها مطوروه.

وقالت الشركة إنها أرسلت رسالة إلكترونية إلى Moonshot بشأن الثغرات في 27 يوليو، ثم تابعت الأمر بعد نحو أسبوع، ونشرت تدوينة في 12 سبتمبر. ووفقًا لـMindgard، لم تتواصل Moonshot معها إلا مؤخرًا، بعد أن طلبت BBC من الشركة التعليق.

قالت Moonshot لـBBC إنها ترحب بالتدقيق الخارجي «باعتباره ركيزة أساسية لبناء ذكاء اصطناعي أفضل وأكثر أمانًا»، وأضافت أنها تناقش النتائج مع Mindgard. وفي رسالة إلكترونية إلى Mindgard شاركتها BBC، قال المطور الصيني إن نموذجه أظهر عمومًا «معدل رفض مرتفعًا لهذه الأنواع من الطلبات» في التقييمات الداخلية.

قال بيتر غاراغان، مؤسس Mindgard، لبرنامج Tech Life على BBC World Service: «بمجرد نجاح التحايل على القيود، سيتحدث النموذج عن أي موضوع، بل سيقدم بحرية توصيات بشأن موضوعات أخرى خبيثة أيضًا، وسيكون مبتكرًا وخلاقًا».

لم تثبت Mindgard أن إرشادات الأسلحة والاغتيالات ستنجح فعليًا. وترى أن ضوابط الحماية كان ينبغي أن تمنع النموذجين من التفاعل مع هذه الطلبات أصلًا. وقالت الشركة أيضًا إنها واثقة من أن Kimi K2.6 بعد التحايل على قيوده قد يتيح للمتسللين تشغيل تعليمات برمجية على موارده الحاسوبية والاتصال بالإنترنت، ما يجعله منصة محتملة لشن هجمات إلكترونية.

يأتي هذا التطور بعد إفصاحات حديثة شملت وكلاء للذكاء الاصطناعي من عدة مطورين كبار. وقالت Google إن Gemini تمكن من الوصول إلى ثلاث شركات خلال اختبارات أمنية في مايو، بينما قال مسؤولون أستراليون إن وكيلًا من OpenAI تمكن من الوصول إلى ملفات عامة وغير عامة على بوابة حكومية للصحة في يونيو.

Kimi نموذج ذو أوزان متاحة للعامة، ما يعني أن المستخدمين يستطيعون تشغيله على بنيتهم التحتية الحاسوبية الخاصة. وقال آلان وودوارد، الأستاذ في جامعة سَري، لـBBC إن هذه النماذج قد تقع في الأيدي الخطأ، لكنها قد تُستخدم أيضًا للدفاع السيبراني.

AI Chat Search Interest

AI Chat Search Interest

  • ChatGPT
  • Claude
  • Gemini
  • DeepSeek
  • Perplexity
  • Grok
  • Kimi
  • Qwen
SOURCE: Google Trends via The Latent