אחוז אחד. זה שיעור הקליקים על מקורות מצוטטים בביקורי חיפוש שבהם הופיע AI Overview, לפי מחקר שבדק התנהגות קליקים בדפי תוצאות עם AI Overview. אם אתם עדיין מודדים קידום AI לפי טבלת הקליקים הישנה, אתם מסתכלים על הגרף הלא נכון.
זמן קריאה: 14 דקות · תדעו לזהות מדידה אמיתית מתוך המסך
מה תמצאו בכתבה הזו
- למה ירידה בקליקים לא בהכרח אומרת כישלון בקידום
- ארבע שכבות מדידה שרוב הדוחות מפספסים לגמרי
- איך מחשבים שיעור הופעה, שיעור ציטוטים ונתח ציטוטים בפועל
- דשבורד חודשי של שש שורות שבאמת מוביל להחלטות
- שלוש טעויות מדידה שראיתי אצל לקוחות בחצי השנה האחרונה
למה גרף יורד ב-Search Console לא אומר שהקידום נכשל
לקוח שלנו בתחום הביטוח הגיע אליי עם פאניקה. ירידה של 22% בקליקים אורגניים בתוך חודשיים. הוא היה משוכנע שמשהו התפרק.
פתחנו את הנתונים. החשיפות עלו ב-31%. השאילתות שאיבדו קליקים היו כולן שאילתות מידע כלליות מסוג "מה זה כיסוי צד ג". השאילתות המסחריות, אלה שמייצרות לידים, לא זזו. ובאותה תקופה מספר הפניות הטלפוניות עלה ב-14%.
מה קרה בפועל? גוגל התחיל לענות בעצמו על שאלות ההגדרה, והמשתמשים שהגיעו לאתר היו בשלב מתקדם יותר בכוונת הקנייה.
מה בדיוק שונה בין KPI של SEO קלאסי למדידה של קידום AI?
ב-SEO קלאסי שרשרת המדידה הייתה קווית. דירוג מייצר חשיפה, חשיפה מייצרת קליק, קליק מייצר המרה. כל שלב נמדד, וכל שלב ניתן לשיוך.
בחיפוש AI השרשרת נקטעת באמצע. המשתמש מקבל תשובה שנבנתה מהתוכן שלכם, מפנים את המסר, ולפעמים גם את שם המותג, ואז סוגר את הכרטיסייה. הערך הועבר. הקליק לא קרה.
גוגל עצמו מגדיר את חוקי הספירה החדשים. לפי ההסבר הרשמי על חשיפות, מיקום וקליקים, ה-AI Overview תופס מיקום אחד בלבד, וכל הקישורים בתוכו מקבלים את אותו מיקום. כלומר "מיקום ממוצע" הפסיק להיות מדד היררכי משמעותי בהקשר הזה.
ארבע שכבות מדידה, ושלוש מהן חסרות כמעט אצל כולם
בכל אבחון שאני עושה אני מבקש לראות את דוח ה-KPI האחרון. ב-90% מהמקרים אני מקבל טבלה עם שלוש שורות. קליקים, חשיפות, מיקום. זה הכל.
המודל שאנחנו עובדים איתו מחלק את המדידה לארבע שכבות, וכל שכבה עונה על שאלה עסקית אחרת.
ארגון הדוחות לפי ארבע השכבות האלה הוא הדבר הראשון שאני משנה אצל לקוח חדש. לוקח חצי יום עבודה ומחזיר שקט נפשי לשנה.
למה השכבה השנייה היא הכי מוזנחת
נראות נמדדת בכלים חינמיים. תוצאה עסקית מעניינת את המנכ"ל. שכבת האיכות דורשת עבודה ידנית, ולכן כולם מדלגים עליה. וזו בדיוק השכבה שבה מתרחשים הנזקים השקטים, כמו מודל שמצטט מחיר שהעליתם לפני שנתיים.
רוצים לדעת באיזו שכבה אתם באמת עומדים?
אבחון נראות AI ראשוני, ללא התחייבות, כולל בדיקת דיוק חילוץ
שיעור הופעה בתשובות AI, ואיך מודדים משהו שאין לו דירוג
שיעור הופעה בתשובות AI, או Answer Presence Rate, הוא אחוז השאילתות החשובות לכם שבהן התוכן או המותג מופיעים כחלק מהתשובה. גם בלי קישור. גם בלי אזכור מודגש.
החישוב אנושי לחלוטין. בנו סט של 40 עד 60 שאילתות שמייצגות את הביקוש האמיתי בעסק, הריצו אותן, ותעדו בכל אחת אם הופעתם. 17 הופעות מתוך 50 שאילתות זה שיעור הופעה של 34%.
בצד הכמותי, דוח הביצועים לפיצ'רי Generative AI ב-Search Console מאפשר לראות חשיפות בתוך פיצ'רי ה-AI, כך שאפשר להצליב את הבדיקה הידנית מול נתון רשמי.
שיעור ציטוטים, החישוב שלוקח שעה ומגלה יותר מכל כלי
שיעור ציטוטים הוא אחוז השאילתות שבהן אתם מופיעים כמקור מפורש בתוך התשובה. זה מדד מחמיר יותר משיעור הופעה, והוא זה שמעיד על אמון של המודל בתוכן שלכם.
אצל לקוח בתחום ציוד רפואי מדדנו בינואר שיעור ציטוטים של 8%. אחרי עבודה ממוקדת על שכתוב תשובות ישירות בראש עמודי מוצר ועל נתונים מובנים, הגענו במאי ל-29%. הקליקים באותה תקופה עלו ב-6% בלבד. הלידים עלו ב-19%.
נתח ציטוטים מול המתחרים, המדד היחיד שמנכ"ל מבין בשלוש שניות
שיעור ציטוטים של 29% נשמע נחמד. עד שמגלים שהמתחרה הראשי עומד על 61%.
נתח ציטוטים הוא החלק שלכם מסך הציטוטים בתחום, על אותו סט שאילתות. מודדים אותו על ידי תיעוד כל המקורות שמופיעים בכל תשובה, ולא רק שלכם. עבודה מייגעת, ערך עצום.
אצל לקוח בשוק הגרמני גילינו שמתוך 214 ציטוטים שנרשמו על 50 שאילתות, 38 היו שלנו, 71 של המתחרה הגדול, והשאר התפזרו בין 12 אתרים. זה שינה את כל סדר העדיפויות בתוכן, כי הבנו על אילו שש שאילתות אנחנו נעדרים לחלוטין.
אזכור מותג בלי קישור, האם זה שווה משהו?
שאלה שמקבל כל שבוע. התשובה שלי חדה. כן, ובגדול.
כשמודל אומר "חברות כמו X ו-Y מספקות שירות כזה", המשתמש קיבל המלצה. הוא לא לחץ, אבל בעוד יומיים הוא יחפש את שם המותג בגוגל. וחיפוש ממותג הוא הדבר הקרוב ביותר לליד חינם.
לכן אני מודד אזכורי מותג ללא ציטוט כמדד נפרד, ומצליב אותו מול נפח החיפושים הממותגים ב-Search Console. אצל לקוח בשוויץ ראינו עלייה של 41% בחיפושים ממותגים בתוך ארבעה חודשים, בזמן שהתנועה הלא ממותגת דווקא ירדה ב-9%. סך הלידים עלה.
דיוק חילוץ, או מה קורה כשה-AI ממציא לכם מחיר
הנזק החמור ביותר בעידן הזה הוא לא היעדרות מהתשובה. זו נוכחות שגויה בתשובה.
עשיתי בדיקה אצל לקוח בתחום השירות, ומצאתי שה-AI מצטט שעות פעילות שהיו נכונות ב-2022, מחיר בסיס נמוך ב-30% מהמחיר האמיתי, וסניף שנסגר. שלוש טעויות, כל אחת מהן שיחת טלפון עצבנית עם לקוח פוטנציאלי.
דיוק חילוץ הוא אחוז הטענות שהמודל אמר עליכם ונמצאו נכונות. גם בספרות המקצועית, כמו במחקרים על ציטוטים בתשובות מודלים במאמר של Nature על סינתזה של ספרות מדעית עם מודלים שולפי מידע, איכות ודיוק הציטוט מקבלים מקום מרכזי לא פחות מעצם ההופעה.
אילו עובדות עסקיות חייבות להיות זהות בכל האתר
המידע שחייב להיות עקבי בכל עמוד כולל כתובת ומספר טלפון בזהות מלאה לאורך האתר, שעות פעילות כולל חריגים בחגים, מחירים ותנאי תשלום בלי גרסאות סותרות בעמודים ישנים, אזורי שירות בניסוח אחיד, ומדיניות ביטולים שמופיעה במקום אחד ומקושרת אליו. אצל לקוח אחד מצאתי ארבעה מספרי טלפון שונים בארבעה עמודי נחיתה מ-2019. המודל בחר את הלא נכון.
נתונים מובנים מקטינים דרמטית את מרווח הטעות, בתנאי שהם תקינים ומאומתים לפי הנחיות Google לנתונים מובנים.
קטלוג שגיאות לפי חומרה
אנחנו מסמנים שגיאה קלה כשמדובר בניסוח לא מדויק שלא משפיע על החלטת קנייה, ושגיאה חמורה כשמדובר במחיר, זמינות, תנאי אחריות או פרט התקשרות. יעד סביר הוא אפס שגיאות חמורות. לא 5%. אפס.
סנטימנט והקשר, כי להופיע בתשובה הלא נכונה זה נזק
מדדנו עבור לקוח שיעור הופעה מרשים של 47%. חגיגה קטנה במשרד. ואז קראנו את התשובות עצמן.
בשליש מההופעות המותג הופיע בהקשר של "אלטרנטיבה זולה יותר", מיצוב שהלקוח נלחם לצאת ממנו חמש שנים. הנראות עבדה נגד האסטרטגיה.
לכן כל הופעה מתועדת מקבלת אצלנו שלוש תגיות. סנטימנט, סוג ההקשר, ומיקום בתוך התשובה. הופעה בפסקה הראשונה שווה יותר מהופעה בשורה האחרונה של רשימת ספקים.
ניתוח הסנטימנט עצמו אפשר להריץ במודל שפה על התשובות המתועדות, ולקבל דירוג עקבי בלי לשבת שלוש שעות עם מרקר. הצוות שלי עושה את זה על 50 תשובות בפחות מ-20 דקות.
נתח קול בעידן AI, ולמה המודל הקלאסי נשבר
נתח קול קלאסי חושב לפי דירוגים ונפחי חיפוש. מכפילים מיקום ב-CTR משוער, מקבלים אחוז, מרוצים.
המודל הזה מניח שיש עשר תוצאות ושיש היררכיה ביניהן. בתשובה גנרטיבית יש שלושה עד שמונה מקורות, בלי היררכיה מוצהרת, ולפעמים בלי חפיפה בין מנועים שונים.
נתח הקול החדש מורכב משילוב של שיעור ההופעה, נתח הציטוטים, ואיכות ההקשר. אני מחשב אותו כציון משוקלל, ומשווה אותו לשלושה מתחרים מוגדרים. לא לכל השוק, שלושה שמות.
מ-KPI ל-ROI, החיבור שאף אחד לא רוצה לעשות
כאן נגמרות התובנות המעניינות ומתחילה העבודה. חיבור נראות לכסף.
הבסיס הוא הגדרה נכונה של אירועים מרכזיים ב-GA4, לפי התיעוד הרשמי על אירוע המרה ב-GA4. בלי הגדרה נקייה של מה נחשב ליד, כל מדידת ROI היא ניחוש עם עיצוב יפה.
אצל לקוח בארה"ב הגדרנו שלושה אירועים מרכזיים בשווי כלכלי שונה. שיחה טלפונית 180 דולר, טופס 90 דולר, הורדת מדריך 12 דולר. תוך חודשיים הבנו שהתנועה מתשובות AI מייצרת פחות טפסים ויותר שיחות. הערך לביקור היה גבוה ב-31% מהתנועה האורגנית הרגילה.
המרות מסייעות, איפה ה-AI באמת יושב במסע
נתיבי ההמרה ב-GA4 מראים שנקודת המגע מ-AI נוטה להיות ראשונה או שנייה במסע, לא אחרונה. מי שמסתכל רק על שיוך קליק אחרון מוחק את כל התרומה. אני מסתכל תמיד על שני מודלי שיוך במקביל, ומחפש את הפער ביניהם.
ערך חשיפה מיוחס, איך מעריכים משהו בלי קליק
המודל שאני משתמש בו בונה הערכה משילוב של הגידול בחיפושים ממותגים, שיעור ההמרה ההיסטורי של תנועה ממותגת, והערך הממוצע לליד. לא מדע מדויק. הרבה יותר טוב מאפס.
לא בטוחים כמה מהלידים שלכם מגיעים בעצם מ-AI?
נבנה לכם מודל שיוך שמראה את התמונה המלאה
כלים, מה מודד באמת ומה מוכר לכם אשליה
קיבלתי בחצי השנה האחרונה הצעות משבעה כלים שמבטיחים "מדידת נראות AI מלאה". בדקתי חמישה. שניים החזירו נתונים שלא הצלחתי לשחזר ידנית.
את פלטפורמת WEBFORCE בנינו כדי שהצוות שלי לא יגלה בעיה שבועיים אחרי שהיא קרתה. ההתראות מגיעות ביום שהמדד זז.
Search Console, הכלי שכולם מזלזלים בו
דוח הביצועים הוא עדיין הבסיס. פילוח בין שאילתות ממותגות ולא ממותגות, איתור שאילתות עם חשיפות גבוהות ו-CTR נמוך, ובדיקה מול תקופה מקבילה. למי שרוצה להעמיק בהפיכת הנתונים האלה לדוח קריא, כתבנו מדריך מלא על דוחות SEO אוטומטיים ושילוב יכולות AI במדידה.
בדיקה ידנית, החלק שאי אפשר לאוטומט
פעם בחודש, אותן 50 שאילתות, בארבעה מנועים, מתועד בגיליון אחד. תאמינו לי, ניסיתי לדלג על זה. חזרתי.
דשבורד חודשי, שבע שורות ולא יותר
ראיתי דשבורדים עם 34 מדדים. אף אחד לא הסתכל עליהם. מדד שלא מוביל להחלטה הוא קישוט.
שש שורות, עמוד אחד, פגישה של 20 דקות. זה כל הדיווח.
שלוש טעויות מדידה שראיתי בחצי השנה האחרונה
הראשונה, החלפת סט השאילתות כל חודש. מנהל שיווק אחד הוסיף 15 שאילתות חדשות בפברואר, שיעור ההופעה צנח, והוא כמעט פיטר את ספק התוכן. הנתון היה לא בר השוואה מהיסוד.
השנייה, מדידת מנוע אחד בלבד. תוצאות ב-Perplexity לא מנבאות תוצאות ב-AI Overviews. בדקנו לקוח ומצאנו פער של 34 נקודות אחוז בשיעור הציטוטים בין שני המנועים.
השלישית, התעלמות משכבת האיכות. עסק שמופיע הרבה עם מידע שגוי במצב גרוע יותר מעסק שלא מופיע בכלל.
מה ההבדל בין מדד ל-KPI, ולמה זה לא ויכוח סמנטי
מדד הוא נתון גולמי. מספר חשיפות. מספר ציטוטים. שיעור התעניינות. אפשר לאסוף מאות כאלה, ואפשר לראות הגדרות פורמליות ל"מדדים" גם במילון המונחים של Google בנושא מדדים בלמידת מכונה.
KPI הוא מדד אחד שבחרתם, שיש לו יעד מספרי, תאריך, ואדם אחראי. אם אין יעד ואין אחראי, זה מדד. לא KPI.
איך תדעו אם ספק הקידום שלכם באמת מזיז את הנראות
בקשו ממנו שלושה דברים. את סט השאילתות שהוא מודד, את הגיליון הגולמי של הבדיקות, ואת מספר שגיאות החילוץ שהוא מצא וטיפל בהן.
ספק שאין לו סט שאילתות מתועד לא מודד. הוא מספר סיפורים.
אנחנו עובדים ללא התחייבות חודשית, ואתם נמצאים איתנו כל עוד אתם מרוצים. זה נשמע כמו סעיף שיווקי, אבל יש לו השלכה ישירה על מדידה. כשאין חוזה שכולא אותך, הדוח החודשי חייב להיות אמיתי, כולל החלקים הלא נוחים בו. ללא אותיות קטנות. אנחנו מומחים בקידום אורגני בלבד, וזו הסיבה שהמדידה אצלנו נראית כמו שהיא נראית. אפשר לקרוא עוד על הגישה שלנו בעמוד הבית של WEBS.
מדדים טכניים, מה עוד שווה לעקוב אחריו
אני נשאל אם אופטימיזציה טכנית עדיין רלוונטית כשהמודל בכל מקרה קורא את הטקסט. כן. יותר מקודם.
מודל שלא מצליח לפרסר את העמוד לא מצטט אותו. אני עוקב אחרי כיסוי אינדוקס, אחוז עמודים עם נתונים מובנים תקינים, זמן טעינה לעמודי תוכן מרכזיים, ועקביות קנוניקל. אצל לקוח אחד תיקון של 240 עמודים עם Schema שגוי העלה את שיעור הציטוטים מ-11% ל-24% בתוך שבעה שבועות. שינוי תוכן אפס.
מה אני מודד היום שלא מדדתי לפני שנתיים
לפני שנתיים הדוח שלנו התחיל בקליקים. היום הוא מתחיל בשיעור הופעה, ממשיך לשגיאות חילוץ חמורות, ורק אחר כך מגיע לתעבורה.
מאות הלקוחות שאנחנו מלווים בארץ, בארה"ב, בגרמניה, באנגליה ובשוויץ עברו את המעבר הזה בקצב שונה. מי שעבר מוקדם הפסיק לפחד מגרפים. מי שנשאר עם הטבלה הישנה עוד מנהל שיחות חירום כל חודש.
אחוז אחד מהביקורים מגיע כקליק. שאר הערך קורה בתוך התשובה עצמה. אתם יכולים להמשיך למדוד את האחוז הזה, או להתחיל למדוד את התשובה.
שאלות שכל לקוח שואל אותנו בפגישה הראשונה
כמה זמן לוקח לראות שינוי בשיעור ההופעה?
בעבודה ממוקדת על שכתוב תשובות ונתונים מובנים, שינוי ראשוני נראה תוך ארבעה עד שמונה שבועות. שינוי משמעותי בנתח הציטוטים לוקח שלושה עד שישה חודשים.
כמה שאילתות צריך בסט הבדיקה?
40 עד 60 שאילתות מספיקות לרוב העסקים, בתנאי שהן מייצגות באמת את הביקוש. חשוב יותר לא לשנות את הסט לעומת להגדיל אותו.
האם קליקים אורגניים בכלל עדיין רלוונטיים כמדד?
כן, אבל כמדד אחד מתוך שישה, לא כמדד היחיד. הם עדיין מייצגים תנועה שנוחתת בפועל על האתר ומאפשרת מדידת המרה ישירה.
מה עושים כשמוצאים מידע שגוי בתשובת AI?
בודקים את מקור הטעות באתר, מתקנים נתונים מובנים ותוכן שנוגע לעובדה השגויה, ועוקבים אחרי הבדיקה החודשית הבאה כדי לאמת שהתיקון נקלט.
האם צריך כלי בתשלום כדי למדוד את זה?
לא בהכרח. Search Console ו-GA4 חינמיים ומכסים חלק גדול מהשכבות. בדיקה ידנית מתועדת סוגרת את הפער בלי עלות כלים נוספת, רק בזמן עבודה.
רוצים לדעת מה בדיוק גוגל וה-AI אומרים על העסק שלכם, ואיזה מדדים חסרים לכם בדוח?
צרו קשר עם הצוות שלנו לאבחון ראשוני ללא התחייבות
דברו איתנו כאן או התקשרו 04-605-3067



