باحثون اكتشفوا عيبًا أساسيًا في طريقة تعامل نماذج اللغة الكبيرة مع التعليمات، مما يخليها عرضة للاختراق. ده الخلل بيخلي النماذج تطلع معلومات محظورة زي طرق تصنيع المخدرات. المشكلة دي صعبة الإصلاح ونسبة كبيرة إنها هتفضل موجودة.
تاريخ النشر:
الكلمات المفتاحية: llm-security, chain-of-thought-forgery, red-teaming, ai-vulnerability, icml
باحثون اكتشفوا عيبًا أساسيًا في طريقة تعامل نماذج اللغة الكبيرة مع التعليمات، مما يخليها عرضة للاختراق. ده الخلل بيخلي النماذج تطلع معلومات محظورة زي طرق تصنيع المخدرات. المشكلة دي صعبة الإصلاح ونسبة كبيرة إنها هتفضل موجودة.