· מדריכים

‏האם סוכני AI מבינים עברית: מה הספקים באמת מתעדים

‏רק חלק מהספקים מתעדים בכלל תמיכה בעברית. Zendesk מתעד עברית מלאה, Fin מציין עברית ברשימת השפות, ו-Copilot Studio תומך בעריכה ובתשובות גנרטיביות אך לא בטריגרים ולא בקול. Callie של Calendly באנגלית בלבד. n8n, Make, Lindy, Gumloop ו-Agentforce אינם מתעדים עברית כלל. הפער נסגר רק בבדיקה עצמית לפני החתימה.

‏מאת ליאת גל ‏2 בספטמבר 2026 ‏15 דק׳ קריאה
האם סוכני AI מבינים עברית

"תומך בכל השפות" אינה הצהרה על עברית. זו הצהרה שיווקית שאין מאחוריה מסמך, וההפרש בין השתיים מתגלה בשתיים בלילה: או שהסוכן עונה ללקוח הישראלי, או שהוא מחזיר תשובה שבורה ומשאיר אותו בלי מענה. המדריך הזה מראה מה כל ספק מתעד על עברית, מה הוא לא מתעד, ואיך לבדוק את זה לבד לפני שמשלמים. השאלה הרחבה יותר, מה סוכני AI באמת מספקים ב-2026 ובאיזה מחיר, נבדקת בנפרד במבחן המציאות של סוכני AI בעסק קטן.

בקצרה

רק חלק מהספקים מתעדים בכלל תמיכה בעברית. Zendesk מתעד עברית מלאה, Fin מציין עברית ברשימת השפות, ו-Copilot Studio תומך בעריכה ובתשובות גנרטיביות אך לא בטריגרים ולא בקול. Callie של Calendly באנגלית בלבד. n8n, Make, Lindy, Gumloop ו-Agentforce אינם מתעדים עברית כלל. הפער נסגר רק בבדיקה עצמית לפני החתימה.

מה ההבדל בין "תומך בעברית" לבין "מתעד תמיכה בעברית"?

תמיכה מתועדת היא הצהרה כתובה של הספק בתיעוד המוצר שלו, עם שם השפה ועם ציון היכולות שבהן היא פועלת. הצהרה שיווקית על "כל השפות" אינה אותו דבר, והיא לא ניתנת לאימות ולא ניתנת לאכיפה מול הספק כשמשהו נשבר.

ההבחנה הזו קובעת גם את הניסוח הנכון. כשספק לא כותב שום דבר על עברית, המסקנה המדויקת היא שהספק אינו מתעד תמיכה בעברית, וזו לא אותה טענה כמו "הספק אינו תומך בעברית". ההבדל בין השתיים הוא ההבדל בין בדיקה לבין הימור.

01

מתועד במלואו

הספק כותב במפורש שעברית נתמכת, ומפרט באילו יכולות. אפשר להסתמך על זה בשיחה מסחרית.

02

מתועד חלקית

עברית מופיעה בחלק מהיכולות ולא בכולן. בדיוק כאן נופלים רוב הפרויקטים, כי אף אחד לא קורא את הטבלה עד הסוף.

03

מתועד כלא נתמך

הספק כותב בפירוש שהמוצר זמין באנגלית בלבד. זו תשובה ברורה, ויש בה יתרון: אין הפתעות.

04

לא מתועד כלל

אין רשימת שפות, אין אזכור לעברית, אין כלום. כאן חובה לבדוק לבד, ואי אפשר להסיק מכך לא תמיכה ולא היעדר תמיכה.

מטריצת האימות: מה כל ספק מתעד על עברית

הטבלה הבאה מרכזת מה נמצא בתיעוד הרשמי של כל ספק, נכון לבדיקה שנעשתה ב-31 באוגוסט 2026. כל שורה מבוססת על מסמך של הספק עצמו, לא על מאמר השוואה ולא על הבטחה שיווקית.

ספק או יכולת מה מתועד על עברית המשמעות המעשית
Zendesk AI agents עברית נתמכת במלואה: במקרי שימוש, בתשובות גנרטיביות וב-agentic AI, ברשימת השפות שהספק מפרסם. התיעוד אינו נוקב במספר שפות כולל התיעוד הרחב ביותר שנמצא לעברית בקטגוריה
Intercom Fin עברית מופיעה במפורש ברשימת השפות הנתמכות של הסוכן אזכור מפורש, בלי פירוט לכל יכולת בנפרד
Microsoft Copilot Studio עברית (he-IL) נתמכת בקנבס העריכה ובתשובות גנרטיביות ובאורקסטרציה. אינה נתמכת ב-Event triggers ואינה נתמכת ב-Voice סוכן קולי בעברית אינו אפשרות בפלטפורמה הזו
Calendly, סוכן Callie "only available in English" תיאום פגישות אוטומטי במייל אינו זמין בעברית
Zapier, ממשק הבנייה "Zapier is only available in English" הסוכן יכול לענות בעברית, אבל בונים אותו באנגלית
Anthropic, מדידת איכות רב-לשונית טבלת MMLU מתורגם ל-14 שפות. עברית אינה ברשימה אין מספר פומבי לאיכות העברית של המודל
ElevenLabs, זיהוי דיבור Scribe v2 עברית מסווגת "Good", כלומר מעל 10% ועד 20% שגיאת מילה. אנגלית, צרפתית וגרמנית מסווגות "Excellent", עד 5% פער מתועד בין עברית לשפות המובילות
n8n, Make, Zapier Agents, Lindy, Gumloop, Salesforce Agentforce אף אחד מהם אינו מפרסם רשימת שפות נתמכות לסוכן הספק אינו מתעד תמיכה בעברית. זו אינה קביעה שאין תמיכה

שורה אחת חסרה בטבלה במכוון, והיא איכות. תיעוד עונה על השאלה אם עברית קיימת בכלל, לא על השאלה כמה טוב היא עובדת. את זה מודדים בהמשך, במספרים.

המקורות לשורות האלה הם מסמכי הספקים עצמם: Zendesk, Intercom, Microsoft Learn בעדכון מ-29 ביוני 2026, Calendly, Zapier, Anthropic ו-ElevenLabs. מי שמתלבט בין פלטפורמות האוטומציה עצמן ימצא השוואה רחבה יותר במדריך על Zapier מול Make מול n8n לעסק קטן.

למה Copilot Studio תומך בעברית ובכל זאת לא יענה בטלפון?

כי תמיכה בשפה אינה תכונה אחת, אלא רשימה של יכולות נפרדות שכל אחת מהן נתמכת או לא נתמכת בנפרד. אצל Microsoft הפיצול הזה מתועד במפורש: לפי התיעוד שעודכן ב-29 ביוני 2026, עברית עוברת בקנבס העריכה, בתשובות הגנרטיביות ובאורקסטרציה, ונעצרת ב-Event triggers וב-Voice.

התרגום לעסק פשוט. סוכן שכותב תשובות בעברית בצ'אט יעבוד. סוכן שאמור להיות מופעל אוטומטית מאירוע במערכת, או סוכן שאמור לענות לשיחת טלפון בעברית, אינו נתמך באותה פלטפורמה. עסק שרכש את הרישיון על סמך המשפט "עברית נתמכת" וגילה את הפער אחרי ההטמעה, גילה אותו בשלב היקר. מי ששוקל מענה טלפוני אוטומטי כדאי שיקרא קודם על סוכן קולי לשיחות שלא נענות, ורק אחר כך יחליט אם השפה בכלל על השולחן.

מה זה אומר שספק לא מתעד עברית בכלל?

זה אומר שאין שום מסמך רשמי שאפשר להצביע עליו, לא לחיוב ולא לשלילה. n8n, Make, Zapier Agents, Lindy, Gumloop ו-Salesforce Agentforce אינם מפרסמים רשימת שפות נתמכות לסוכן, ולכן הניסוח היחיד שנכון לגביהם הוא שהספק אינו מתעד תמיכה בעברית. ב-n8n חוסר התיעוד הזה מצטרף לשיקול נוסף לגמרי, חוב האבטחה שנלווה לאירוח עצמי, ושניהם יחד רלוונטיים למי ששוקל להישען עליו מול לקוחות.

חשוב להבין למה זה לא זהה ל"לא עובד". הסוכן בפלטפורמות האלה נשען כמעט תמיד על מודל שפה חיצוני, ולכן הוא כנראה יפיק טקסט בעברית. הבעיה מתחילה כשמשהו נשבר: אין מסמך שקובע מה אמור לעבוד, אין ערוץ תמיכה שיכול לומר "זו תקלה מוכרת בעברית", ואין בסיס לדרוש תיקון. הראיה היחידה שנמצאה לגבי Make היא פוסט של משתמש ישראלי בקהילה, שדיווח על שגיאה בניסיון להריץ סוכן בעברית ונסגר כפילות בלי מענה לגופו של עניין. פוסט בקהילה אינו תיעוד ואינו אימות, ואי אפשר לבנות עליו החלטת רכש.

כמה מדויק זיהוי דיבור בעברית באמת?

התשובה תלויה לחלוטין באיכות ההקלטה, והפער בין תנאי מעבדה לתנאי שטח הוא פי שלושה בערך. זה המספר החשוב ביותר לכל מי ששוקל סוכן שעונה לטלפון בעברית.

מצד אחד, התיעוד של ElevenLabs שנבדק ב-31 באוגוסט 2026 מסווג את העברית ב-Scribe v2 בדרגת "Good", כלומר מעל 10% ועד 20% שגיאת מילה, בעוד שאנגלית, צרפתית וגרמנית מסווגות "Excellent" עם עד 5%. מצד שני, המדידה המפורטת ביותר שקיימת לעברית היא ישראלית: מחקר של חוקרים ממכון ויצמן, מהארגון הרפואי הדסה ומ-ivrit.ai, שהוצג ב-Interspeech 2025 באוגוסט 2025, אימן מודל על 314 שעות עברית מתומללת ידנית ופרסם את התוצאות במלואן.

6.2%

הקלטה נקייה, מבחן eval-d1

שגיאת מילה נמוכה. זה המספר שמופיע במצגות של ספקים.

11.3%

מבחן KAN

כבר כמעט אחת מכל תשע מילים שגויה.

20.7%

מבחן Common Voice

דיבור טבעי של דוברים מגוונים. אחת מכל חמש מילים שגויה.

24.1%

מבחן FLEURS

כמעט רבע מהמילים שגויות. לשם השוואה, Whisper Large v3 של OpenAI הגיע ל-26.2% באותו מבחן.

המסקנה המעשית ברורה. סוכן קולי בעברית שמקבל שיחה מלקוח שעומד ברחוב, עם רעש רקע ומבטא, נמצא בטווח שבו כל מילה חמישית עלולה להישמע לא נכון. זה מסביר גם למה כמעט כל הפתרונות הישראליים המסחריים נמכרים כסוכני WhatsApp ולא כסוכני טלפון. מי שרוצה להעמיק בצד התמלול ימצא השוואה נפרדת בכתבה על תמלול עברית עם AI.

בצד החיובי, קיים בישראל בסיס מדידה שאפשר להישען עליו. Dicta-LM 3.0, שפורסם ב-2 בפברואר 2026 על ידי DICTA, אוניברסיטת בר-אילן ו-OriginAI, הוא דגם בגודל 24 מיליארד פרמטרים עם חלון של 65 אלף טוקנים, והציונים שלו פורסמו במלואם: 86.0 ב-SNLI, 83.8 ב-Winograd, 82.7 ב-Israeli-Facts, 60.13% ב-Israeli Trivia ו-86.86% בניקוד (arXiv). לוח התוצאות העברי מתוחזק בשיתוף מפא"ת, התוכנית הלאומית לעיבוד שפה טבעית בעברית ובערבית, ו-DICTA, ומודד SNLI, HeQ, ניתוח סנטימנט, Winograd, BLEU ו-Israeli Trivia. זה כרגע הבסיס העובדתי היחיד לשאלה כמה טוב ה-AI בעברית, ואף ספק גלובלי גדול לא מפרסם מספר משלו.

האם הממשק שבו בונים את הסוכן עובד בעברית?

לא תמיד, וזו נקודה שנוטים לפספס כי בודקים רק את התשובה ללקוח. הבעיה הידועה ביותר מתועדת בקוד הפתוח: issue 30085 במאגר של Claude Code, שנפתח ב-2 במרץ 2026, מראה שתוסף ה-VS Code כופה כיוון LTR על כל הממשק באמצעות כלל CSS גלובלי, מה ששובר את הצגת העברית והערבית בפאנל השיחה ובשדה הקלט.

הסטטוס של אותה בקשה הוא מה שכדאי לשים לב אליו: היא נסגרה כ-not planned (GitHub). באותו מאגר יש בקשות מקבילות, ותקלה דומה תועדה גם בכלי אחר. במקביל, התיעוד של Zapier קובע שהממשק זמין באנגלית בלבד. כלומר גם כשהסוכן עונה בעברית מצוין, מי שבונה ומתחזק אותו עשוי לעבוד מול מסך שלא מציג עברית כמו שצריך, וזה משפיע ישירות על מהירות התחזוקה ועל כמות הטעויות.

איך לבדוק את העברית של סוכן לפני שקונים?

הבדיקה לוקחת פחות משעה לכל ספק, והיא מבוססת על תוכן אמיתי מהעסק ולא על משפטי דוגמה. הנה הצעדים, לפי הסדר, ואין לדלג על הראשון.

01

לאתר את עמוד השפות בתיעוד, לא בדף השיווק

לחפש באתר הספק את המילה languages בתוך אזור התיעוד או ההלפ-סנטר. אם עברית לא מופיעה שם, הספק אינו מתעד תמיכה בעברית, וזה מה שנרשם.

02

לפרק את התמיכה ליכולות

לרשום ארבע עמודות: בנייה ועריכה, תשובות גנרטיביות, טריגרים ואירועים, קול. המקרה של Copilot Studio מוכיח שהתשובה יכולה להיות שונה בכל אחת מהן.

03

להריץ עשרים הודעות אמיתיות מהתיבה

להעתיק עשרים פניות אמיתיות של לקוחות, על כל השגיאות, הקיצורים, ושמות המוצרים באנגלית באמצע משפט עברי. פניה מנוסחת יפה אינה מבחן.

04

לשאול את אותה שאלה חמש פעמים

עקביות היא מדד נפרד מהצלחה. מחקר Sierra Research במאמר τ-bench מ-17 ביוני 2024 הראה שהצלחה חוזרת על אותה משימה נופלת הרבה מתחת להצלחה בניסיון בודד. זה גם ההסבר לכך שסוכן שעובד מצוין בהדגמה נשבר מול לקוח אמיתי.

05

לבדוק קול בנפרד, ובתנאים גרועים

להקליט עשר שיחות בתנאים אמיתיים, לספור ידנית כמה מילים תומללו לא נכון, ולהשוות לטווח המתועד: 6.2% על הקלטה נקייה מול 20.7% עד 24.1% על דיבור טבעי, לפי ivrit.ai מאוגוסט 2025.

06

להסתכל על מסך הבנייה עצמו

לכתוב משפט עברי עם מספר ועם מילה באנגלית בתוך שדה העריכה, ולוודא שהסדר לא מתהפך. שבירת RTL בממשק היא תקלה מתועדת ולא תיאורטית.

מה לעשות אם הבדיקה נכשלה

כישלון בבדיקה אינו סיבה לוותר על הרעיון, אלא סיבה לצמצם את היקף המשימה שהסוכן מקבל. אם התשובות בכתב טובות אבל הקול חלש, המסקנה היא סוכן טקסט ב-WhatsApp או בצ'אט ולא מענה טלפוני. אם עברית עובדת בתשובות אבל לא בטריגרים, אפשר להפעיל את הסוכן ידנית או ממערכת חיצונית במקום מאירוע פנימי.

אם הבעיה היא בהבנה עצמה, כלומר הסוכן עונה בעברית תקינה על השאלה הלא נכונה, זו כבר לא בעיית שפה אלא בעיית ידע ארגוני, והפתרון הוא לצמצם את מאגר המידע ולנסח מחדש את ההוראות. מי שמתחיל מאפס ימצא את הבסיס במדריך על סוכני AI לעסק קטן, ומי שמכוון לשירות לקוחות בעברית ימצא הקשר נוסף בכתבה על סוכן שירות לקוחות בוואטסאפ.

מה לשאול ספק בכתב לפני החתימה?

חמש שאלות, במייל, עם בקשה לתשובה בכתב ולא בשיחה. תשובה בעל פה אינה שווה דבר כשמתעורר ויכוח שישה חודשים אחר כך.

1. איפה בתיעוד הרשמי מופיעה עברית, ומה הקישור המדויק?

אם אין קישור, התשובה היא שאין תיעוד, וזה נרשם בפרוטוקול.

2. באילו יכולות בדיוק עברית נתמכת, ובאילו לא?

לבקש התייחסות נפרדת לבנייה, לתשובות, לטריגרים ולקול.

3. איזה מספר איכות מפורסם לעברית, ועל איזה מאגר הוא נמדד?

בזיהוי דיבור זו שאלה על שיעור שגיאת מילה. אין מספר, אין הבטחה.

4. האם קיימות תקלות פתוחות ידועות בהצגת RTL בממשק?

שאלה שמייצרת תשובה מתועדת, ומגלה אם הנושא בכלל על הרדאר של הספק.

5. מה קורה אם איכות העברית לא מספקת אחרי ההטמעה?

לבקש סעיף יציאה או תקופת ניסיון בכתב, במיוחד בחוזה שנתי מראש.

מי שרוצה רשימת שאלות רחבה יותר לכל כלי חדש, ולא רק בהקשר של שפה, ימצא אותה בכתבה על חמש שאלות לפני שמאמצים כלי AI חדש.

הצעד הבא

לבחור ספק אחד שנמצא כרגע בשימוש בעסק או על השולחן, ולשלוח לאיש הקשר בו מייל אחד עם שאלה אחת: מהו הקישור המדויק בתיעוד הרשמי שבו מופיעה עברית, ובאילו יכולות היא נתמכת ובאילו לא. כתיבת המייל לוקחת עשר דקות. התשובה, או היעדרה, היא ההבדל בין החלטה מבוססת לבין הימור.

שאלות נפוצות

אילו ספקי סוכני AI מתעדים תמיכה מלאה בעברית?

Zendesk מתעד עברית כנתמכת במלואה בסוכני ה-AI שלו, במקרי שימוש, בתשובות גנרטיביות וב-agentic AI, ברשימת השפות שהוא מפרסם. Intercom Fin מציין עברית במפורש ברשימת השפות הנתמכות. שני המסמכים נבדקו ב-31 באוגוסט 2026, והם היחידים שנמצאו עם אזכור מפורש של עברית בקטגוריה.

האם אפשר לבנות סוכן קולי בעברית ב-Copilot Studio?

לא. לפי תיעוד Microsoft שעודכן ב-29 ביוני 2026, עברית (he-IL) נתמכת בקנבס העריכה, בתשובות גנרטיביות ובאורקסטרציה, אך אינה נתמכת ב-Event triggers ואינה נתמכת ב-Voice. כלומר סוכן שכותב בעברית בצ'אט הוא אפשרות נתמכת, וסוכן שמדבר עברית בטלפון או סוכן שמופעל אוטומטית מאירוע במערכת אינם נתמכים באותה פלטפורמה.

האם n8n ו-Make תומכים בעברית?

הספקים האלה אינם מתעדים תמיכה בעברית. n8n, Make, Zapier Agents, Lindy, Gumloop ו-Salesforce Agentforce אינם מפרסמים רשימת שפות נתמכות לסוכן, ולכן אין מסמך שאפשר להסתמך עליו. זו אינה קביעה שעברית לא תעבוד, אלא קביעה שאין התחייבות ואין ערוץ תמיכה מוגדר כשמשהו נשבר.

כמה שגיאות יש בתמלול עברית של סוכן קולי?

התיעוד של ElevenLabs מסווג עברית בדרגת Good, כלומר מעל 10% ועד 20% שגיאת מילה, מול Excellent עם עד 5% באנגלית, בצרפתית ובגרמנית. מחקר ivrit.ai של מכון ויצמן והדסה, שהוצג ב-Interspeech באוגוסט 2025, מדד 6.2% על הקלטה נקייה אך 20.7% עד 24.1% על דיבור טבעי.

למה אין מספר רשמי לאיכות העברית של מודלים גדולים?

כי הם לא מודדים אותה בפומבי. Anthropic מפרסמת טבלת ביצועים רב-לשונית המבוססת על MMLU מתורגם ל-14 שפות, ועברית אינה ברשימה. המקור היחיד שכן מפרסם מספרים לעברית הוא המחקר הישראלי: Dicta-LM 3.0 מ-2 בפברואר 2026 ולוח התוצאות העברי שמתוחזק בשיתוף מפא"ת ו-DICTA.

האם ממשק הבנייה של הסוכן מוצג בעברית?

לרוב לא. התיעוד של Zapier קובע שהממשק זמין באנגלית בלבד, ולכן הסוכן יכול לענות בעברית אך בונים אותו באנגלית. בנוסף, בקשה שנפתחה ב-2 במרץ 2026 במאגר של Claude Code תיארה כלל CSS שכופה כיוון LTR ושובר עברית בפאנל, והיא נסגרה בסטטוס not planned.

📲 העדכונים על AI לעסקים קטנים, ישר לטלגרם
כל כתבה חדשה מגיעה לערוץ ברגע שהיא עולה. בלי ספאם, רק תוכן.

להצטרפות לערוץ הטלגרם