ב-18 באוגוסט 2026 הרצנו בדיקה אוטומטית על אתרי הבית של 78 מהחברות המוכרות בישראל. רצינו לענות על שאלה אחת: כשמנוע AI מגיע לאתר של חברה ישראלית גדולה, מה הוא מוצא שם.
התשובה הקצרה: הוא נכנס בלי בעיה, ואז לא מקבל שום מידע שאפשר לעשות איתו משהו. רק 5% מהאתרים חוסמים במפורש זחלני AI בקובץ robots.txt, אבל רק 48% מגדירים סכמת Organization שמסבירה למכונה מי הם בכלל. הדלת פתוחה, הבית ריק.
בחרנו 78 חברות מוכרות בתשעה ענפים: קמעונאות, בנקאות, ביטוח, תקשורת, מזון, תיירות, הייטק, נדל"ן ורכב. הבדיקה אוטומטית ושקופה, מי שירצה לחזור עליה יגיע לאותן תוצאות. בדקנו ארבעה דברים בעמוד הבית:
| הבדיקה | התוצאה בקרב 78 האתרים |
|---|---|
| נענו לזחלן ניטרלי | 60 מתוך 78 |
| נחסמו או נכשלו כבר בכניסה | 18 (23%) |
| חוסמים במפורש זחלני AI ב-robots.txt | 5% |
| מחזיקים קובץ llms.txt חי | 37% |
| מציגים נתונים מובנים כלשהם בעמוד הבית | 55% |
| מגדירים סכמת Organization | 48% |
| ללא meta description | 20% |
זה החלק שהכי הפתיע. כמעט רבע מהאתרים חסמו או נכשלו עוד לפני שהגענו לתוכן, וזו כמעט בוודאות לא החלטה שיווקית אלא הגנות בוטים אגרסיביות. מישהו באבטחת מידע הפעיל חוק, ספק ה-CDN הדליק ברירת מחדל, והתוצאה היא שהאתר שקוף למי שמחפש דרך ChatGPT. אף אחד בחברה לא ישב וקיבל את ההחלטה הזאת, היא פשוט קרתה.
בגלל זה הצעד הראשון שלכם הוא לא לפתוח את robots.txt, אלא לתפוס את מי שמנהל את שכבת ההגנה של האתר ולשאול אותו דבר אחד: אילו User-Agents אנחנו חוסמים היום, ולמה. אם התשובה היא "יש רשימה שהגיעה עם החבילה", יש לכם עבודה.
מנוע AI שמגיע לעמוד בית של חברה ישראלית צריך להבין בשניות מי אתם, מה אתם מוכרים ולמי. בן אדם מבין את זה מהלוגו ומהתמונה הראשית. מכונה קוראת קוד.
נתונים מובנים הם הדרך המסודרת להגיד למכונה "אנחנו חברת ביטוח, זה השם הרשמי שלנו, אלה הסניפים, זה מספר הטלפון, אלה המוצרים". חצי מהאתרים הגדולים בישראל לא אומרים את זה בכלל. וכשאין meta description, אצל אחד מכל חמישה, גם השורה הבסיסית ביותר שהמכונה יכולה לצטט פשוט לא קיימת.
לפער הזה יש מחיר. בדיקות שפורסמו ב-2025 מצאו שמודלים נוטים לצטט תוכן מובנה וברור, עם כותרות היררכיות ורשימות, בשיעור גבוה בעשרות אחוזים לעומת טקסט נרטיבי רציף. מחקר אקדמי מ-2024 שבחן תשע שיטות אופטימיזציה למנועי AI מצא שהתוכן שלא עבר שום התאמה קיבל את הציון הנמוך ביותר בכל המדדים. בסופו של דבר מדובר בקריאוּת של מכונה, לא במשהו מסתורי.
llms.txt הוא קובץ טקסט פשוט בשורש האתר שאומר למודלי שפה מה חשוב באתר הזה ואיפה זה נמצא. משהו בין תקציר מנהלים למפת אתר.
37% מהאתרים שבדקנו כבר מחזיקים אחד כזה חי, אימוץ גבוה בהרבה ממה שציפינו. חלק מהקבצים אפילו כתובים בעברית. בין המחזיקים: באג, פוקס, רנואר, מקס, מגדל, ישראכרט והראל. שימו לב לתמהיל, קמעונאות אופנה וגופים פיננסיים באותה רשימה. המרוץ התחיל בשקט, בלי הודעות לעיתונות.
ועכשיו העמדה שלנו, גם אם היא פחות מחמיאה לתחום שאנחנו עובדים בו: אין היום הכרזה רשמית של גוגל או OpenAI שהם מתייחסים ל-llms.txt כתקן מחייב. הקובץ עולה שעתיים עבודה, אז אין סיבה לא לעשות אותו. אבל אם מישהו מוכר לכם llms.txt כפרויקט GEO שלם, אתם משלמים על ההצהרה ולא על התוצאה. הסדר הנכון הפוך: קודם נתונים מובנים ותוכן שעונה על שאלות, ורק אחר כך הקובץ.
הפילוח הענפי היה חד. ההייטק לבד בצמרת, ובפער עצום: 100% מחברות ההייטק שבדקנו מציגות נתונים מובנים ו-88% כבר מחזיקות llms.txt. מפתיעות לטובה גם חברות הביטוח והאשראי. בתחתית, שני ממצאים לא נוחים: בתיירות רק 14% מציגים נתונים מובנים, והבנקים, עם תקציבי הדיגיטל הגדולים במשק, נמצאים דווקא מתחת לחברות האופנה, ושתי חסימות ה-AI המפורשות היחידות שמצאנו היו אצל גופים פיננסיים. חברות התקשורת: אף לא קובץ llms.txt אחד.
מה שמעצבן בממצא הזה הוא שדווקא בתיירות מסע הלקוח מתחיל בשאלה פתוחה. "מלון בצפון עם בריכה מחוממת לזוג עם תינוק", "חופשה משפחתית באוקטובר עד 8,000 שקל". אלה בדיוק השאלות שאנשים כבר מפסיקים להקליד בגוגל ומתחילים לשאול צ'אט. הענף שהכי צריך להיות שם הוא זה שהכי פחות מוכן.
אין בישראל מחירון מסודר לתחום הזה, ולא נמציא אחד. מה שאפשר לומר ביושר: החלק הטכני, פתיחת ההגנות, סכמות ו-llms.txt, הוא הרכיב הקטן בהוצאה. רובה נמצא בתוכן, בעמודים שעונים על השאלות שאנשים באמת שואלים, וזו עבודה שנמדדת לפי היקף האתר ומצבו.
מה שכן חשוב לדעת כשמקבלים הצעת מחיר: מי שנוקב מספר בלי לבדוק קודם כמה תבניות יש באתר, איזו מערכת ניהול מריצה אותו ומה חסום היום, נותן מספר שלא מבוסס על כלום. הצעה רצינית מתחילה באבחון.
מי שרוצה להבין איך זה נראה כתהליך מלא ולא כרשימת משימות, זה מה שאנחנו עושים בקידום במנועי AI.
אל תעשו את זה. בדיקות שפורסמו השנה מצאו שכמעט כל הציטוטים בתשובות ה-AI של גוגל מגיעים מעשר התוצאות האורגניות הראשונות. אתר שלא מדורג לא יצוטט, כמה סכמות שלא תדחפו לו.
יש גם ריכוזיות מטרידה, לפי ניתוחי SERP שפורסמו השנה: חמשת הדומיינים המובילים בנישה תופסים כ-38% מהציטוטים, והעשירייה הראשונה מעל חצי. מי שנכנס מאוחר נאבק על שאריות.
מה שכן השתנה זה סוג השאלות. בתחילת 2025 מעל 90% מהשאילתות שהפעילו תשובת AI היו אינפורמטיביות, ועד סוף השנה הנתח ירד לכ-57%. המכונה נכנסה לשאלות המסחריות, ושם נמצא הכסף שלכם.
שאלה טובה, ורוב הספקים מתחמקים ממנה. אין היום מדידה מלאה ומדויקת של הופעות בתשובות AI כמו שיש דוח מיקומים בגוגל, וכל מי שמבטיח לכם אחרת מוכר אשליה.
מה שכן אפשר למדוד: הופעות בתשובות של גוגל דרך הדוחות ב-Search Console, שעליהם כתבנו במדריך לדוחות ה-AI החדשים, תנועת הפניות שמגיעה מדומיינים של כלי AI בגוגל אנליטיקס, ובדיקה ידנית חוזרת של 20-30 שאלות אמיתיות שלקוחות שואלים, אחת לחודש, באותה רשימה בדיוק. זו לא מדידה מדויקת, אבל היא הרבה יותר טובה מכלום.
צעד אחד, השבוע. פתחו את האתר שלכם בכתובת domain.co.il/robots.txt ובדקו שתי שורות: האם מופיע שם GPTBot, ClaudeBot או PerplexityBot תחת Disallow, ואם כן, מי הוסיף את זה ומתי. במקביל שלחו מייל למי שמנהל את ההגנות וחומת האש של האתר עם שאלה אחת: האם אנחנו חוסמים זחלני AI ברמת ה-CDN.
ההצלחה של השבוע הזה נמדדת פשוט: או שיש לכם תשובה בכתב לשתי השאלות, או שאין. אחרי שיש, אפשר לדבר על סכמות, על תוכן ועל תקציב. לפני זה, כל השאר תיאורטי.
מקורות
בדיקה חינמית של דקה: אנחנו מריצים שאילתות אמיתיות מול מנועי AI, בודקים אם העסק שלכם עולה בתשובות ומראים בדיוק מה חוסם אתכם. בלי הרשמה.
מעדיפים לדבר? שיחת היכרות ללא עלות