איך ChatGPT, Perplexity ו-Gemini בוחרים מה לצטט

בעל עסק שואל את ChatGPT: “מי מומלץ בשירות X באזור Y”. הוא מקבל בחזרה שלושה שמות, ומאחוריהם עוד עשרות עסקים באותה איכות שלא נכנסו לתשובה. השאלה שכל בעל עסק חייב לשאול היום היא לא רק “איך אני מגיע לעמוד הראשון בגוגל”, אלא “איך אני נכנס לרשימת שלושת השמות שהמנוע נותן”. המאמר הזה מפרק את השאלה הזאת לרכיביה: מה קורה מרגע השאלה ועד רגע התשובה, ואילו מאפיינים חוזרים במקורות שכן נכנסים.
בקצרה: מנועי AI בוחרים תשובות בשלושה שלבים, אחזור, דירוג וניסוח. באחזור הם שולפים קומץ מקורות שנראים רלוונטיים לשאלה. בדירוג הם מצמצמים לקומץ קטן יותר, לפי סימני אמינות, קריאות וטריות. בניסוח הם מרכיבים תשובה אחת, לרוב עם אזכור של מקור אחד או שניים. המנגנון עצמו סגור ומשתנה, אבל המאפיינים שחוזרים במקורות שנכנסים הם ניתנים לבדיקה ולהעתקה.
הדבר החשוב לומר לפני כל היתר: המנגנון סגור ומשתנה
לפני שנכנסים לפרטים, חשוב לומר משהו שנעדר מרוב המדריכים בתחום. חברות כמו OpenAI, Google ו-Perplexity לא מפרסמות את מנגנוני הבחירה שלהן, והן מעדכנות אותם באופן שוטף. גם ניסויים מסודרים של חוקרים חיצוניים תופסים תמונת מצב של רגע, שיכולה להשתנות שבועיים אחר כך.
מה שכן ידוע וקבוע יחסית הוא ברמת העיקרון, לא של האלגוריתם. שלושת השלבים שנתאר כאן, האחזור, הדירוג והניסוח, הם ההיגיון הכללי שכל מנוע כזה חייב לעשות, גם אם כל אחד ממש אותו בדרך אחרת. עסק שמנסה לצוד את הפרמטרים המדויקים ירדוף אחר יעד נע. עסק שעובד על העקרונות המשותפים, בונה חוסן שלא נשבר עם כל עדכון מודל.
שלב 1: אחזור, איך המנוע בכלל מוצא מקורות
השאלה שהמשתמש מקליד נכנסת לפרשן פנימי של המנוע, שמנסה להבין מה בעצם מבקשים ממנו. אצל שאלות פשוטות זה מסתיים מהר. אצל שאלות מורכבות המנוע לפעמים כותב מחדש את השאלה בכמה וריאציות מקבילות, כדי להגדיל את הסיכוי למצוא תשובה טובה.
אחרי הפרשנות מגיע החיפוש עצמו, וכאן יש שני מקורות. הראשון הוא הזיכרון שנצבר באימון המודל, שכולל טקסטים ואתרים שנקראו בזמן האימון, וקפוא בזמן. השני הוא חיפוש חי באינטרנט, שקורה בזמן שהמשתמש שואל. בשאלות שדורשות מידע עדכני, למשל המלצות על עסקים, מחירים או מוצרים חדשים, החיפוש החי הוא הערוץ העיקרי. זה הערוץ שדרכו עסק חדש או עמוד חדש באתר יכול להיכנס לתשובות, בלי לחכות שהמודל יאומן מחדש.
הכניסה לשלב הזה תלויה בדבר בסיסי אחד: שהמנוע בכלל מסוגל לקרוא את האתר. קובץ robots.txt שחוסם את הזחלנים שלו, אתר שכל התוכן שלו נטען דינמית בלי HTML, או שרת שמחזיר תגובה איטית, כל אלה יעיפו את העמוד מהאחזור עוד לפני שהתחיל הדירוג. הרבה עסקים מתחילים לעבוד על ניסוח תשובות ועל סמכות, בזמן שהחור האמיתי הוא בדלת הכניסה.
שלב 2: דירוג, איך המנוע בוחר בין המקורות
מכל המקורות שנשלפו באחזור, המנוע מדרג ומצמצם לקומץ קטן שממנו הוא באמת יבנה תשובה. כאן נכנסים סימני האמינות, שחלקם הועתקו מעולם ה-SEO וחלקם חדשים.
הוותיקים כוללים דירוג בגוגל, סכמת נתונים מובנים, מהירות אתר, שם כותב אמיתי ותאריך עדכון קרוב. אותו עמוד שגוגל בחרה להציג ראשון, גם למנוע AI קל יותר לסמוך עליו כמקור. עמוד בלי כותב ובלי תאריך נראה לו כמו עלון אנונימי.
החדשים כוללים דברים שהיו פחות משמעותיים ל-SEO קלאסי ונהיו קריטיים כאן. פסקה עצמאית שעונה על שאלה ספציפית במלואה, ולא דורשת קריאה של כל העמוד סביבה. ניסוח בפורמט של שאלה ותשובה בכותרות המשנה. מספרים קונקרטיים בתוך הטקסט, שקל לצטט. אזכורים של העסק במקורות חיצוניים שהמנוע מזהה כאמינים, לא רק קישורים. שלוש טכניקות בעולם הזה, שנמצאו במחקר אקדמי כמעלות אזכורים באחוזים ניכרים, מפורטות בהרחבה במאמר על שלוש טכניקות שיגרמו ל-AI להזכיר את העסק שלך.
הנקודה החשובה בשלב הזה היא ששני עמודים שוות ערך מבחינת המידע יכולים לקבל התייחסות הפוכה, אם אחד מהם ברור לציטוט והשני עטוף בפרוזה שיווקית. איכות המידע היא תנאי הכרחי, לא תנאי מספיק.
שלב 3: ניסוח, איך מורכבת התשובה מכמה מקורות
אחרי הדירוג, המנוע מרכיב תשובה אחת. הוא לא מעתיק, הוא מסכם. הוא לוקח פסקה או משפט מכמה מקורות שהוא בחר, ומנסח מחדש בשפה שלו. לפעמים הוא מוסיף שם מקור, לפעמים קישור, ולפעמים לא מוסיף כלום, ואז המידע שנשלף מהעסק שלכם מופיע בתשובה בלי שהמשתמש יידע מאיפה הוא בא.
הניסוח מחדש הוא הסיבה המרכזית לכך שתשובה של מנוע AI יכולה להיות מדויקת בכללי אבל שגויה בפרטים קטנים. הוא גם הסיבה שלא כדאי להסתמך על המנוע כאילו הוא מקור. מבחינת עסק שרוצה להיכנס לתשובות, המסקנה פשוטה: המנוע יעדיף פסקאות שקל להעביר לניסוח שלו, כלומר פסקאות בנות רעיון אחד, שלמות בפני עצמן, ובלי הפניות ל“פרק הבא”.
איפה ChatGPT, Perplexity ו-Gemini באמת שונים
שלושת השלבים הם המשותף. ההבדלים בין המנועים הם דגשים.
Perplexity בנוי סביב חיפוש חי. הוא כמעט תמיד מציג מקורות עם קישור ליד כל טענה, ולכן הכניסה לתשובה שלו שווה במפורש קליק. הוא גם המנוע הכי ידידותי לאזכור עסקים, כי הוא מייצר תשובה שנשענת בגלוי על מקורות חיצוניים.
ChatGPT מערבב שני ערוצים לפי סוג השאלה. שאלות כלליות נענות מהזיכרון הפנימי של המודל, שאלות שדורשות מידע טרי מפעילות חיפוש חי. הוא נותן פחות מקורות מפורשים בממשק המשתמש, ולכן ההצלחה נמדדת גם באזכור השם של העסק בתוך גוף התשובה, לא רק בקישור לצידה. השוואה מלאה יותר בין הכלים לשימוש יומיומי מופיעה במאמר על ChatGPT, Claude או Gemini לעסקים.
Gemini משתלב עמוק בגוגל, גם כמנוע עצמאי וגם כמנוע שמייצר את תיבת AI Overviews שמופיעה בראש עמוד התוצאות. הוא מעניק יתרון גדול לעמודים שכבר מדורגים גבוה בעמוד התוצאות הרגיל של גוגל, ולכן העבודה על ה-SEO הקלאסי משרתת אותו גם.
עסק ישראלי שרוצה להיכנס לשלושתם, עובד על אותם עקרונות עם דגש שונה: פסקאות שקל לצטט לצורך ChatGPT, קישורים ואזכורים חיצוניים לצורך Perplexity, ומיצוב יציב בגוגל לצורך Gemini. מי שרוצה לחזור לתמונה הרחבה של איך נראית הזירה בכללותה, מי המנועים ומאיפה הם שואבים, ימצא הכול בתמונה השלמה של זירת GEO.
עד כאן שלושת השלבים והפערים בין המנועים. אבל עסק שמנסה לתרגם את זה לתוכנית עבודה נשאר לרוב עם שאלה אחת: איך יודעים אם עמוד שכבר קיים באתר עומד בכללים, בלי לפתוח את המכסה של האלגוריתם. לזה יש תשובה מעשית, בצורת רשימת בדיקה שאפשר להריץ כאן על עמוד קיים בעשר דקות.
מבחן הציטוט: שנים עשר סימנים שחוזרים במקורות שנכנסים לתשובה
הרשימה למטה היא הנכס של המאמר, ואפשר לקחת אותה כמות שהיא. היא לא נבנתה מאלגוריתם רשמי, אין כזה בגלוי. היא נבנתה מהמאפיינים שחוזרים בעקביות במקורות שכן מצוטטים על ידי ChatGPT, Perplexity ו-Gemini, לפי מחקרים אקדמיים, ניתוחים של חברות אנליטיקה גדולות, וניסוי חוזר על אותן שאלות שוב ושוב במנועים. ככל שיותר סימנים מסומנים אצלכם, גדול הסיכוי שהעמוד ייכנס.
שכבת הגילוי: שהמנוע בכלל יגיע אליכם
- קובץ robots.txt לא חוסם את GPTBot, ClaudeBot ו-PerplexityBot.
- התוכן העיקרי של העמוד קיים ב-HTML, לא נטען רק בג׳אווהסקריפט.
- העמוד מופיע בסייטמאפ ומדורג בעמוד הראשון או השני של גוגל על מילת המפתח שלו.
שכבת הפענוח: שהמנוע מבין מי אתם
- יש בעמוד סכמת נתונים מובנים בסיסית מסוג Article, LocalBusiness או Organization.
- שם הכותב מופיע במפורש, עם רקע מקצועי של שורה או שתיים.
- תאריך פרסום ותאריך עדכון אחרון מופיעים בגלוי.
שכבת הציטוט: שהתוכן שלכם ניתן להעברה לתוך תשובה
- פסקת פתיחה של 40 עד 60 מילים עונה על השאלה המרכזית של העמוד במלואה.
- כותרות המשנה כתובות בפורמט של שאלות אמיתיות שלקוחות שואלים.
- יש בעמוד לפחות שלוש עובדות ספציפיות: מספרים, טווחים או אחוזים.
- פסקאות עומק ארוכות מספיק כדי להסביר רעיון שלם בפני עצמן, בלי הפניה ל“פרק הבא”.
שכבת הסמכות: שיש למנוע סיבה לסמוך עליכם
- כל טענה עובדתית מקושרת למקור רשמי חיצוני שאפשר לבדוק.
- שם העסק מוזכר במקורות חיצוניים בלתי תלויים, כמו מגזין מקצועי, קבוצה בפייסבוק, פרופיל גוגל עם ביקורות אמיתיות, או כתבה של אתר אחר.
עסק שיסמן שמונה מתוך שנים עשר הסימנים כבר עומד מעל רוב האתרים בענף. עשרה מתוך שנים עשר זה עמוד שיש לו סיכוי אמיתי להיכנס לתשובות תוך שבועות.
איך משתמשים ברשימה על עמוד קיים היום
הבחירה הכי טובה היא לא להתחיל מעמוד הבית, אלא מעמוד השירות המרכזי או ממאמר תוכן חשוב. פותחים את העמוד, עוברים על שנים עשר הסעיפים בסדר, ומסמנים ליד כל אחד V, X או “צריך תיקון”.
השורות שקל לתקן בעשר דקות, כמו הוספת תאריך עדכון, הוספת שם כותב, או הפיכת כותרת משנה לפורמט של שאלה, מתוקנות ראשונות. השורות שדורשות עבודה יותר גדולה, כמו כתיבת פסקת פתיחה של 40 עד 60 מילים או הוספת שלוש עובדות ספציפיות, מקבלות בלוק זמן ייעודי. אחרי ההתעדכנות, שווה לחכות שבועיים ולשאול את המנועים שאלות שהעמוד עונה עליהן, כדי לראות אם הוא מתחיל להופיע.
מי שרוצה להשוות את השאלה הזאת לזירה הכללית ולהבין למה חלק מהעקרונות זהים ל-SEO וחלק שונים, ימצא את התמונה במאמר על GEO מול SEO ובמה להשקיע קודם.
מה עושים מכאן
עבודה שיטתית על הרשימה שלמעלה, על שלושה עד חמישה עמודי מפתח באתר, נותנת את קפיצת הנראות הראשונה. עסק שמעדיף ללמוד ולבצע לבד יסתדר עם הרשימה הזאת ועם המאמרים המקושרים למעלה. עסק שמעדיף שמישהו יבנה איתו את הבסיס בפעם הראשונה, יכול לבחור בקורס ייעודי, בשיתוף פעולה עם כותב תוכן שמכיר את התחום, או בליווי חיצוני שרץ ברקע ומפרק את הרשימה לתוכנית עבודה של שבועות.
הבסיס נבנה מכל אחד מהערוצים. ההבדל הוא בעיקר בקצב ובכמות תיקוני הדרך.
שאלות נפוצות
איך מנועי AI בוחרים תשובות בכלל?
התהליך עובר שלושה שלבים עיקריים: אחזור, דירוג וניסוח. באחזור המנוע שולף מהזיכרון שלו או מהאינטרנט מקורות שנראים רלוונטיים לשאלה. בדירוג הוא בוחר מתוכם קומץ מצומצם שנראה הכי אמין, ברור וטרי. בניסוח הוא מרכיב תשובה אחת מתוך אותם מקורות, לרוב עם אזכור של שם מקור אחד או שניים. השלבים סגורים ומשתנים בין המנועים, ולכן אף אחד לא באמת יודע את הנוסחה המדויקת, גם אנשי מקצוע בתחום.
האם יש אלגוריתם רשמי שקובע מי נכנס לתשובה?
לא, לפחות לא בצורה שאפשר לקרוא. חברות כמו OpenAI, Google ו-Perplexity לא מפרסמות את מנגנוני הבחירה שלהן, והן מעדכנות אותם באופן שוטף. מה שכן ידוע הוא ברמת העיקרון: המנועים מתעדפים מקורות שהם מזהים כאמינים, כברורים לציטוט, וכטריים. עסק שמנסה להתאים את עצמו לאלגוריתם מדויק ירדוף אחר יעד נע. עסק שמתאים את עצמו לעקרונות המשותפים, יזוז לאט אבל לכיוון הנכון.
מה קורה בשלב האחזור, לפני הדירוג?
המנוע מפרש את השאלה, לפעמים מנסח אותה מחדש בכמה וריאציות, ואז מחפש מקורות פוטנציאליים. הוא שואב משני מקומות: מהזיכרון שנצבר באימון המודל, ומחיפוש חי באינטרנט לתוצאות טריות. בשאלות שדורשות מידע עדכני החיפוש החי הוא הערוץ העיקרי, ולכן עסק חדש או עמוד חדש באתר יכול להיכנס לתשובות תוך שבועות, מבלי לחכות שהמודל יאומן מחדש.
איך המנוע בוחר בין כמה מקורות טובים באותה מידה?
הוא מסתכל על סימני אמינות שחוזרים בעולם ה-SEO כבר שנים, ומוסיף עליהם סימנים חדשים. שם כותב אמיתי, תאריך עדכון קרוב, ציטוט מקורות סמכותיים בתוך העמוד, סכמת נתונים מובנים, ומבנה שבו יש פסקה ברורה שעונה על השאלה במלואה. שני עמודים באותה איכות אינפורמטיבית יכולים לקבל התייחסות שונה, אם אחד מהם ברור יותר לציטוט והשני עטוף בפרוזה שיווקית.
איך התשובה מורכבת מכמה מקורות?
המנוע לא מעתיק, הוא מסכם. הוא לוקח פסקה או משפט מכמה מקורות שהוא בחר, מנסח מחדש לתשובה אחת, ולפעמים מוסיף שם מקור או קישור. הניסוח החדש הוא סיבה מרכזית לכך שהמידע שמופיע בתשובה עלול להיות מדויק בכללי אבל שגוי בפרטים קטנים, במיוחד כשהמקורות סותרים זה את זה או שהעובדה השתנתה לאחרונה.
יש הבדל בין ChatGPT, Perplexity ו-Gemini באופן שהם בוחרים?
כן, מוגבל אבל אמיתי. Perplexity ממקד את הבחירה סביב חיפוש חי ומציג מקורות עם קישור כמעט תמיד. ChatGPT מערבב זיכרון פנימי עם חיפוש חי, לפי סוג השאלה, ואזכור מקור מפורש מופיע פחות. Gemini משולב עמוק בגוגל, ולכן מקורות שכבר מדורגים גבוה בעמוד התוצאות של גוגל מקבלים אצלו יתרון גדול. עסק ישראלי שרוצה להיכנס לשלושתם, יעבוד על אותם עקרונות עם דגש שונה לכל מנוע.
אם המנגנון סגור, איך אני יודע במה כן להשקיע?
לא ברמת האלגוריתם, אלא ברמת המאפיינים שחוזרים שוב ושוב אצל מקורות שכן מצוטטים. הרשימה בגוף המאמר מפרטת שנים עשר מהם, וכל אחד ניתן לבדיקה על עמוד קיים בלי כלים חיצוניים ובלי תקציב. עסק שיסמן שמונה מתוכם על עמוד השירות המרכזי שלו, כבר עשה יותר מרוב האתרים בענף.
איך אני בודק אם העמוד שלי בכלל נכנס לאחזור של המנוע?
הבדיקה הכי פשוטה היא לפתוח את המנוע ולשאול אותו שאלה שאתם יודעים שהעמוד עונה עליה במדויק. אם השם של העסק לא עולה, נסו לשאול ישירות: מה כתוב באתר domain.co.il על נושא X. אם המנוע לא מצליח לקרוא את העמוד או שהוא מחזיר מידע כללי, יש בעיית גילוי או קריאות. אם הוא כן קורא אך לא מצטט, יש בעיית דירוג או ניסוח. שני מקרים שונים, שני תיקונים שונים.
עסק קטן יכול לנצח מותג גדול בבחירה של המנוע?
כן, בתנאי אחד: הוא כותב תשובה יותר טובה לשאלה ספציפית. מותגים גדולים נוטים לכתוב באופן כללי כדי לפנות לקהל רחב, וזה בדיוק סוג התוכן שקשה למנוע לצטט. עסק קטן שמפרסם עמוד עומק על נישה צרה, עם פרטים ישראליים מדויקים, מספרים אמיתיים ותאריכי עדכון קרובים, מקבל לא פעם עדיפות על אתרי ענק בתשובה על שאלה מקומית.
חדרו לתשובות של ChatGPT ו-Perplexity
לשיחת ייעוץ ללא עלות השאירו פרטים
