DailyMagazine

דיפ פייק: איך מזהים זיוף AI כשהסימנים הישנים לא עובדים

האיש בשיחת הווידאו נראה כמו סמנכ״ל הכספים, נשמע כמו סמנכ״ל הכספים ואפילו צחק כמו סמנכ״ל הכספים. הוא פשוט לא היה שם — ובסוף השיחה יצאו מהחברה 25 מיליון דולר.

דיפ פייק בזמן אמת: דמות דיגיטלית מוקרנת על מסך ענק בהרצאת TED, לצד הדובר שלובש ציוד לכידת תנועה
הדגמה חיה של דמות דיגיטלית ב-TED2019. צילום: Steve Jurvetson / Wikimedia Commons — CC BY 2.0

דיפ פייק הוא סרטון, תמונה או הקלטת קול שנוצרו בבינה מלאכותית כדי להראות אדם אמיתי אומר או עושה משהו שלא קרה מעולם. עד לפני כמה שנים זה דרש אולפן וכוח מחשוב רציני. היום מספיקות כמה שניות של קול ודקה של וידאו שנשלפו מהרשתות החברתיות. וזו בדיוק הבעיה: הסימנים שלימדו אותנו לחפש נעלמו, אבל הביטחון שנדע לזהות זיוף כשנראה אותו — נשאר.

מה זה דיפ פייק, בלי המילים הגדולות

המנוע מאחורי הזיוף הוא רשת נוירונים שלומדת פרצוף ממאות תמונות וסרטונים: איך הוא נראה מהפרופיל, איך הוא מרים גבה, איך העור שלו מתנהג באור חלש. אחרי מספיק דוגמאות הרשת יודעת לצייר את הפרצוף הזה על פנים אחרות, פריים אחרי פריים, בזמן אמת.

בפועל מדובר בשלוש משפחות שונות של זיוף, וכל אחת מסוכנת בדרך אחרת. החלפת פנים בווידאו היא המפורסמת — היא זו שמייצרת את הסרטונים של פוליטיקאים וסלבריטאים. שכפול קול הוא הזול והמסוכן ביותר לאנשים פרטיים. ואדם סינתטי לגמרי, פרצוף שלא קיים בעולם, הוא מה שמאייש היום אלפי פרופילים מזויפים ברשתות.

כמה חומר צריך כדי לשכפל קול? מחקר של חברת אבטחת המידע McAfee מצא ששלוש שניות של הקלטה נקייה מספיקות כדי לייצר התאמה של כ־85 אחוז לקול המקורי. שלוש שניות. זה סטורי אחד באינסטגרם, או הודעה קולית אחת שהשארתם בקבוצת הוואטסאפ של הכיתה.

למה הטיפים הישנים לזיהוי דיפ פייק כבר לא עובדים

אם עשיתם שיעורי בית בנושא, אתם כנראה זוכרים את הרשימה: הם לא ממצמצים, תסתכלו על האצבעות, השיער מטושטש בקצוות, האוזניים לא סימטריות. הרשימה הזאת הייתה נכונה — בסביבות 2019 עד 2021. מאז המודלים למדו בדיוק את הדברים האלה ותיקנו אותם. הדורות הנוכחיים מייצרים תאורה עקבית, מרקם עור משכנע ומיקרו־הבעות שזורמות בטבעיות, בלי הארטיפקטים שהעין אומנה לחפש.

וזה לא רק אנחנו. גם הגלאים האוטומטיים מתקשים: מודלים מובילים לזיהוי זיופים מגיעים לדיוק גבוה מאוד על מאגרי בדיקה מסודרים, אבל לפי בדיקות של NIST הדיוק שלהם צונח בכ־45 עד 50 אחוז ברגע שהם יוצאים מהמעבדה לעולם האמיתי. הסיבה פשוטה ומעצבנת: וידאו שעובר בוואטסאפ, בפייסבוק או בטלגרם נדחס — והדחיסה מוחקת בדיוק את אותם פיקסלים עדינים שהגלאי, או אתם, מחפשים.

המסקנה המעשית לא נעימה אבל היא דווקא משחררת: הפסיקו לנסות לנצח בתחרות ראייה מול מכונה. אם הכלים המקצועיים מאבדים חצי מהדיוק שלהם, לעין אנושית שמביטה במסך טלפון אין סיכוי אמיתי.

איפה זה כבר פגע באמת — ומה קורה בישראל

המקרה שסגר את הוויכוח קרה בתחילת 2024 בהונג קונג. עובד בכיר במחלקת הכספים של סניף חברת ההנדסה הבריטית Arup הוזמן לשיחת ועידה בווידאו. מולו ישבו סמנכ״ל הכספים הראשי ועוד כמה מנהלים שהכיר היטב. הם דיברו על רכישה חשאית וביקשו העברה דחופה. הוא כבר הרגיש קודם שמשהו מוזר במייל, אבל השיחה החיה שברה את הספק. כל המשתתפים, חוץ ממנו, היו דיפ פייק. הוא ביצע 15 העברות לחמישה חשבונות בהיקף של כ־25 מיליון דולר.

בישראל הסיפור פחות הוליוודי ויותר יומיומי. היחידה להזדהות וליישומים ביומטריים במערך הסייבר הלאומי דיווחה על כ־250 פניות בנוגע לסרטוני דיפ פייק בשנה, רובן התחזויות לאנשים מוכרים. מי שגלל פייסבוק בשנה האחרונה כבר פגש את זה: פנים מוכרות מהטלוויזיה שמסבירות בשטף על הזדמנות השקעה שאי אפשר לפספס, עם קישור להרשמה מתחת. הסרטונים האלה הם אחד הצדדים האפלים של הבינה המלאכותית שהכי קל להפעיל בקנה מידה גדול, כי אפשר לייצר מהם מאה גרסאות ביום.

המספרים הגלובליים מסבירים למה זה לא ייעלם. לפי נתוני חברת Trustpair נרשמה ב־2024 עלייה של 118 אחוז בשימוש בדיפ פייק בווידאו ובקול. דוח של חברת Entrust קבע שברחבי העולם מתבצעת ניסיון הונאת דיפ פייק אחד כל חמש דקות, וכי כ־40 אחוז מהונאות הזיהוי הביומטרי כוללות כלים מהסוג הזה.

ובכל זאת, הגרסה הנפוצה ביותר היא גם הפשוטה ביותר, והיא לא דורשת שיחת ועידה: טלפון בשעה לא הגיונית, קול של בן משפחה שנשמע לחוץ, ובקשה להעביר כסף עכשיו. בלי וידאו, בלי אפקטים. רק שלוש שניות של קול שנגנבו מאיפשהו.

מה כן שווה לבדוק בשיחת וידאו חשודה

אחרי שהורדנו מהשולחן את חיפוש הפיקסלים, נשאר משהו שדווקא כן עובד: לא לבחון את התמונה, אלא לבקש מהצד השני לעשות משהו שהמודל מתקשה לזייף בזמן אמת. מערך הסייבר הלאומי ממליץ בדיוק על הכיוון הזה. הטבלה הבאה מרכזת את הבדיקות שמחזיקות מים היום.

הבדיקה איך מבקשים את זה בטבעיות למה זה מפיל זיוף
חפץ פיזי מול המצלמה ״תרים רגע את הכוס שלידך ותסובב אותה״ המודל אומן על פנים, לא על שילוב אובייקט חדש בסצנה בזמן אמת
יד שחוצה את הפנים ״תגרד לרגע את המצח״ או בקשה להסתובב לפרופיל מלא המסכה הדיגיטלית נשברת או מהבהבת כשמשהו חוסם את קווי המתאר
סנכרון שפתיים וקצב תגובה לשאול שאלה פתוחה ולהקשיב לעיכוב עיבוד בזמן אמת מוסיף שבריר שנייה, והמבט נוטה להיות לא ממוקד
זיכרון משותף לא מתועד ״מה אכלנו בפגישה ההיא בשלישי?״ התוקף אסף מודיעין מהרשת — ומה שלא פורסם, הוא לא יודע
הקשר, לא הפרצוף לשים לב לדחיפות, לסודיות ולבקשה הכספית כמעט כל הונאת דיפ פייק נשענת על לחץ זמן ואיסור לשתף אחרים

שימו לב לשורה האחרונה. היא החשובה מכולן, והיא לא טכנולוגית בכלל.

הכלל שמנצח כל סימן: תמיד לאמת בערוץ שני

אם תיקחו מכאן דבר אחד, שיהיה זה. שום בקשה שכרוכה בכסף, בסיסמה או בפרטים אישיים לא נסגרת בערוץ שבו היא הגיעה. סגרתם את הזום? התקשרו למספר שאתם כבר מכירים מהאנשי קשר — לא למספר שהופיע על המסך. קיבלתם הודעה קולית בהולה מהילד? התקשרו אליו בחזרה. הזיוף יכול לחקות פרצוף וקול, אבל הוא לא יכול לענות לטלפון שאתם יוזמים.

בבית זה עובד הכי טוב בצורה נמוכת־טכנולוגיה: קבעו מילת קוד משפחתית, משהו שאף אחד לא ינחש ולא נמצא בשום פוסט. מי שמבקש כסף בדחיפות ולא יודע אותה — לא מדבר איתכם. בארגון, הכלל המקביל הוא שאף העברה כספית לא מאושרת על סמך שיחת וידאו בלבד, גם אם הבוס בכבודו ובעצמו נמצא על המסך.

ההיגיון הזה, אגב, זהה לחלוטין להיגיון שמפיל הודעת פישינג שנראית אמיתית לגמרי: לא מנסים לנתח את ההודעה, אלא יוצרים קשר בערוץ עצמאי. ובמישור החשבונות עצמם, סיסמאות שנשמרות במנהל סיסמאות יחד עם אימות דו־שלבי הופכות את הצעד הבא של התוקף — השתלטות על חשבון — לקשה בהרבה, גם אם הוא כבר שכנע מישהו שהוא אתם.

ואם כבר נפלתם בפח

הדבר הראשון הוא לא להתבייש, כי זה בדיוק מה שהתוקפים סומכים עליו. אחרי זה, לפי הסדר: להתקשר לבנק או לחברת האשראי ולנסות לעצור או להקפיא את ההעברה, לתעד הכל בצילומי מסך לפני שהחשבון או הסרטון נמחקים, לדווח למערך הסייבר הלאומי בקו החירום 119, להגיש תלונה במשטרה, ולדווח על התוכן לפלטפורמה שבה הופיע. ככל שהשעות הראשונות מנוצלות מהר יותר, כך גדל הסיכוי לעצור כסף בדרך.

לא כל דיפ פייק הוא הונאה — והסכנה שפחות מדברים עליה

שווה לומר גם את הצד השני, כי הוא לא רק תיאורטי. אותה טכנולוגיה בדיוק מייצרת דיבוב לסרטים שבו השפתיים באמת מתאימות לשפה, מחזירה קול לחולים שאיבדו את היכולת לדבר, ומאפשרת להשלים סצנות שלא הספיקו לצלם. הכלי עצמו לא רשע ולא צדיק.

הסכנה המעניינת יותר היא דווקא הפוכה מזו שכולם מדברים עליה. כשהציבור לומד שאפשר לזייף הכל, קל פתאום לכל מי שנתפס להכחיש ראיה אמיתית ולטעון שהיא מפוברקת. ההרס האמיתי של דיפ פייק הוא לא רק שנאמין לשקר — אלא שנפסיק להאמין לאמת. גם המחוקק בישראל התחיל להתמודד עם זה: חוק הבחירות לכנסת העשרים ושש קובע שמי שמפרסם תעמולת בחירות הכוללת תוכן שנוצר באמצעים דיגיטליים ונחזה להיות מקורי, חייב לציין זאת באופן ברור ובולט. הצעות חוק שמבקשות להפוך זיוף עמוק לעבירה פלילית עצמאית עדיין מתגלגלות בכנסת ולא הושלמו.

בינתיים, ההגנה הטובה ביותר היא הרגל ולא גאדג׳ט: להאט רגע לפני שפועלים, ולאמת בערוץ שני. המלצות מעודכנות והתרעות שוטפות מתפרסמות אצל היחידה להזדהות וליישומים ביומטריים במערך הסייבר הלאומי, וקו החירום 119 פתוח לכל אזרח.

שאלות ותשובות

איך מזהים דיפ פייק בסרטון?

בסרטון מוקלט שהתקבל ברשת, הבדיקה היעילה היא לא ויזואלית אלא מקורית: לחפש את אותו תוכן באתר חדשות מוכר או בערוץ הרשמי של האדם. אם הדבר הזה באמת נאמר, הוא יופיע גם במקום אחר. סימנים ויזואליים כמו סנכרון שפתיים לקוי או מבט לא ממוקד עדיין מופיעים לפעמים, אבל אי אפשר להסתמך עליהם לבד.

יש אפליקציה שמזהה דיפ פייק?

קיימים כלים מסחריים לזיהוי זיופים, אבל אף אחד מהם אינו אמין מספיק להחלטה חשובה בלי בדיקה אנושית. לפי בדיקות NIST, מערכות זיהוי מאבדות כמחצית מהדיוק שלהן במעבר מתנאי מעבדה לשימוש אמיתי. אל תסתמכו על ציון של אפליקציה כדי להחליט אם להעביר כסף.

כמה קול צריך כדי לשכפל אותי?

מעט מאוד. מחקר של McAfee מצא ששלוש שניות של הקלטה נקייה מספיקות להתאמה של כ־85 אחוז לקול המקורי, ואיכות גבוהה יותר מושגת מדקה או שתיים. הודעה קולית, סטורי או ריאיון קצר הם חומר גלם מספיק לחלוטין.

מישהו יצר סרטון דיפ פייק שלי — מה עושים?

קודם כל לתעד: צילומי מסך, קישורים, שמות חשבונות ותאריכים, לפני שהתוכן נמחק. אחר כך לדווח לפלטפורמה דרך מנגנון הדיווח על התחזות, לפנות למערך הסייבר הלאומי בקו 119 ולהגיש תלונה במשטרה. אם הפגיעה היא בשם הטוב או בפרטיות, כדאי להתייעץ עם עורך דין — החקיקה הקיימת בישראל חלה גם בלי חוק ייעודי לזיוף עמוק.

איך מגנים על הורים מבוגרים מהונאת קול?

בשיחה אחת קצרה, לא בהרצאה טכנית. קבעו יחד מילת קוד משפחתית, והסבירו כלל אחד פשוט: כל בקשה טלפונית לכסף מסתיימת בניתוק ובחיוג חוזר למספר השמור. זה מספיק כדי לנטרל כמעט את כל התרחישים הנפוצים.

אהבתם את הכתבה? שתפו אותה
Facebook
LinkedIn
WhatsApp
X
Threads
Reddit
אולי יעניין אותך גם
סלט קיסר קלאסי וטעים
אוכל
סלט קיסר

סלט קיסר מתכון לסלט קיסר טעים ובריא  מצרכים: 2 ראשי חסה טריים, קרועים לחתיכות בגודל ביס 1 כוס

קרא עוד »