باحثون اكتشفوا عيبًا أساسيًا في طريقة تعامل نماذج اللغة الكبيرة مع التعليمات، مما يخليها عرضة للاختراق. ده الخلل بيخلي النماذج تطلع معلومات محظورة زي طرق تصنيع المخدرات. المشكلة دي صعبة الإصلاح ونسبة كبيرة إنها هتفضل موجودة.
Published:
Keywords: llm-security, chain-of-thought-forgery, red-teaming, ai-vulnerability, icml
باحثون اكتشفوا عيبًا أساسيًا في طريقة تعامل نماذج اللغة الكبيرة مع التعليمات، مما يخليها عرضة للاختراق. ده الخلل بيخلي النماذج تطلع معلومات محظورة زي طرق تصنيع المخدرات. المشكلة دي صعبة الإصلاح ونسبة كبيرة إنها هتفضل موجودة.