קוד קלוד 5: מצב אוטומטי נפרץ
חוקר אבטחה פרץ את מצב ה'אוטו' של קלוד קוד 5, שנועד להגן מפני הזרקת פרומפטים. האם ההגנה של Anthropic חלשה מהצפוי?
סימון וויליסון, חוקר אבטחה מוביל, חשף פגיעות במצב ה'אוטו' של Claude Code Opus 5. מצב זה, שפותח על ידי Anthropic, נועד להגן על משתמשים מפני התקפות הזרקת פרומפטים, אך וויליסון הצליח לעקוף אותו באמצעות טכניקות מתוחכמות, ובכך חשף את הקוד הפנימי של המודל.
פריצה זו מדגישה את האתגרים המתמשכים באבטחת מודלי AI, ורלוונטית במיוחד לחברות ישראליות המפתחות או משתמשות בכלי AI. עסקים קטנים ובינוניים בישראל צריכים להיות מודעים לסיכונים אלו ולנקוט בצעדים להגנה על המערכות שלהם מפני ניצול לרעה.
קריאה נוספת ←