اكتشف باحثو شركة أنثروبيك إن نموذجهم كلود عنده مساحة جوه اسمه J-space فيها كلمات مش بتظهر في الخرج لكن بتأثر على طريقة تفكيره. العلماء عرفوا يتجسسوا على الأفكار دي باستخدام تقنية جديدة. دا بيساعد المطورين يفهموا أكتر ليه النماذج اللغوية بتعمل الحاجات اللي بتعملها.
Published:
Keywords: anthropic, mechanistic-interpretability, j-space, llm, reasoning
اكتشف باحثو شركة أنثروبيك إن نموذجهم كلود عنده مساحة جوه اسمه J-space فيها كلمات مش بتظهر في الخرج لكن بتأثر على طريقة تفكيره. العلماء عرفوا يتجسسوا على الأفكار دي باستخدام تقنية جديدة. دا بيساعد المطورين يفهموا أكتر ليه النماذج اللغوية بتعمل الحاجات اللي بتعملها.