זמן קריאה: 5 דקות

גוגל פרסמה את המחקר The Synthetic Gap: Automating Forensic Investigation of “AI Slop” with SAFE. המחקר מציג מערכת שחוקרת רשתות המייצרות ומפיצות תוכן סינתטי בהיקף גדול.
חלק מהכותרות כבר קשרו את SAFE למאבק בספאם בחיפוש ולעדכון הספאם של גוגל מוקדם יותר החודש. אחרי שקראתי את המחקר, אני חושבת שצריך להבחין בין מה שהחוקרים אומרים לבין מה שאפשר רק לשער. בהמשך אוסיף גם את הפרשנות שלי בנוגע להשפעת הנושא על הופעת המותג שלכם בחיפוש וב-AI.

אז קודם כל – מה זה SAFE?

SAFE הם ראשי התיבות של Scaled Abuse Forensics Examiner. מדובר במערכת שמטרתה לצמצם את ״הפער הסינתטי״ – הזמן שעובר מהרגע שמופיעה שיטה חדשה ליצירת תוכן סינתטי ועד שמצליחים לזהות אותה ולטפל בה.

AI מאפשר לייצר כמויות גדולות של תוכן במהירות. כל פריט יכול להיות שונה מעט מקודמו, ולכן בדיקת כפילויות לא תמיד תחשוף את זה. חוקר אנושי עשוי לזהות דמיון בין התכנים, תזמון חריג וקשרים בין הערוצים. אבל חקירה ידנית אינה עומדת בקצב ובהיקף.

איך SAFE עובדת?

מה שמעניין אותי הוא ש-SAFE אינה מסתפקת בבדיקת פריט תוכן בודד. היא משלבת ארבעה סוכנים, שכל אחד מהם בוחן היבט אחר של הפעילות:

  1. סוכן התוכן בוחן את התוכן ביחס למדיניות. הוא מזהה הפרות מוכרות, וגם מקרים שעלולים להפר את רוח המדיניות בלי להתאים במדויק לכלל כתוב.
  2. סוכן ההתנהגות מחפש דפוסי פעילות ופרסום לא אורגניים.
  3. סוכן האשכולות בוחן קשרים בין ערוצים כדי לזהות פעילות מתואמת.
  4. הסוכן המרכזי משלב את הממצאים ומגיע למסקנה.

כך המערכת יכולה לבחון את הפעילות הרחבה, במקום לשפוט כל סרטון או ערוץ בנפרד. החוקרים מציינים במחקר המלא שכבר הפעילו את SAFE. לדבריהם, תוצאות ראשוניות מצביעות על קיצור זמן החקירה לעומת תהליך שכולל חקירה אנושית. עם זאת, הם לא מפרסמים נתונים מספריים או תוצאות ניסוי מפורטות. לכן אי אפשר לדעת עד כמה השיפור גדול.

מה המחקר לא אומר?

זה החלק שחשוב לדייק בו. המחקר מתאר פעילות סביב תוכן וידאו וערוצים. הוא אינו מציין פלטפורמה מסוימת. הוא גם אינו אומר ש-SAFE פועלת ב-Google Search או בוחנת אתרי אינטרנט. החוקרים לא קושרים אותה לעדכון ספאם כלשהו.


ייתכן שרעיונות או רכיבים מהמערכת יתאימו גם לסוגי תוכן אחרים. ייתכן גם שהתזמון מעורר שאלות על הקשר לעדכון הספאם של ספטמבר. בשלב זה, אלה השערות בלבד.

המחקר גם אינו מוכיח שגוגל מענישה תוכן רק משום שנכתב בעזרת AI. כדי להבין מה גוגל אומרת במפורש על אתרים, כדאי לקרוא את מדיניות הספאם של Google Search. גוגל מגדירה שם Scaled Content Abuse כיצירת עמודים רבים בעיקר כדי להשפיע על דירוגים, בלי להועיל לגולשים. דרך יצירת התוכן אינה משנה. גם תוכן שכתבו אנשים יכול להפר את המדיניות.


במקביל, בהנחיות שלה לגבי תוכן שנוצר בעזרת AI, גוגל מבהירה שהיא אינה אוסרת שימוש ראוי בכלים האלה. היא מבקשת להציג תוכן מקורי ומועיל, בלי קשר לדרך שבה יצרו אותו. הבעיה מתחילה כשמשתמשים באוטומציה בעיקר כדי לתמרן דירוגים.

הפרשנות שלי: מה כדאי לבדוק באתר?

מבחינת התזמון, הקישור ל-Spam Update של ספטמבר בהחלט מסתדר. עם זאת, הוא עדיין בגדר השערה בלבד. בעיניי, כדאי לשים לב לכך שזו כבר המערכת השנייה שגוגל חושפת השנה נגד AI Slop. לכן לדעתי הכיוון ברור והכתובת על הקיר – גוגל משקיעה משאבים במאבק בתופעה.

האם SAFE, או רכיבים ממנה, משמשים גם לבדיקת אתרים בחיפוש? זה בהחלט אפשרי. הארכיטקטורה של המערכת אינה ייחודית לווידאו. יחד עם זאת, המחקר לא מדבר על שימוש כזה, ולכן גם האפשרות הזו נשארת בגדר השערה.

בעיניי, החיבור בין המחקר למדיניות החיפוש טמון בדרך החשיבה, גם בלי לדעת אם SAFE בודקת אתרים בפועל. כשפעילות מתבצעת בהיקף גדול, כדאי לבחון את התוכן, את דפוסי הפרסום ואת התמונה הרחבה. השאלה אינה רק אם כל עמוד נראה תקין בפני עצמו, אלא גם מה אפשר ללמוד מהפעילות כולה.

אם אתם עושים שימוש ב-AI ליצירת תוכן ישנן 3 שאלות חשובות שאני חושבת שחשוב לבדוק:

עמודים דומים: האם כל עמוד מוסיף משהו לקורא, או שרק החלפתם את שם העיר או המוצר?

פרסום בכמויות: האם בדקתם את המידע ואת הערך שלו לפני שהעליתם מאות עמודים?

אזכורים חוזרים: האם כל אזכור של המותג תורם משהו, או שאתם פשוט חוזרים על אותו מסר?

מדובר בבדיקות שאני מציעה בעקבות מהמחקר. כאמור, המחקר לא מתייחס ל-SAFE באתרים.

ומה לגבי GEO?

כאן אני חושבת שיש לקח חשוב גם בלי לטעון ש-SAFE קשורה למנועי AI. מותגים מנסים היום להגדיל נוכחות בתשובות AI באמצעות עוד ועוד עמודי FAQ, מאמרים שנכתבו ״בשביל ה-LLM״ ואזכורים חוזרים ברשת.

אני מבינה את הפיתוי לייצר יותר, יחד עם זאת, כמות לבדה לא הופכת מותג למקור שכדאי להסתמך עליו. אם כל עמוד חוזר על מה שכבר קיים, קשה לראות מה הוא תורם לגולש – בין אם הגיע מחיפוש רגיל ובין אם מתשובת AI.

לכן, לפני שאני ממליצה ליצור עמוד נוסף, אני שואלת: איזה מידע יש למותג הזה שאי אפשר לקבל מעוד סיכום גנרי? לפעמים התשובה תהיה נתונים מקוריים, ניסיון מהשטח, הסבר מקצועי מדויק או תשובה טובה לשאלה שעדיין לא זכתה למענה מספק.

לסיכום

SAFE אינה הוכחה שגוגל מפעילה מערכת חדשה נגד אתרי AI, ואינה סיבה להפסיק להשתמש ב-AI ליצירת תוכן. היא כן מציגה גישה מעניינת לחקירת פעילות סינתטית מתואמת: להסתכל על התוכן, על ההתנהגות ועל הקשרים בין הגורמים שמפיצים אותו.

השורה התחתונה שלי: SAFE לא מחפשת AI. היא מחפשת Scale בלי ערך ועל כן המבחן המעשי שאני לוקחת ממנה פשוט: 

האם הייתי מפרסמת את התוכן הזה גם אם הוא לא היה מביא דירוג בגוגל או אזכור בתשובת AI? האם יש בתוכן ערך אמיתי שמועיל לגולש?

אם התשובה על שתי השאלות היא ״כן״, זו נקודת פתיחה טובה.