מה זה 'סוכן דפדפן' (Browser Agent): איך AI גולש, ממלא טפסים ומזמין לבד
סוכן דפדפן הוא כלי AI שלא רק עונה בצ'אט, אלא בפועל פותח דפדפן, לוחץ, גולל וממלא טפסים במקום בעל העסק. הגרסה הכי נגישה היום למי שאין לו מפתח או ידע טכני היא Comet של Perplexity, שזמין בחינם, בעוד אצל OpenAI וגוגל הגרסאות הראשונות כבר הוחלפו או נסגרו תוך פחות משנה.
בקצרה: סוכן דפדפן הוא כלי AI שבפועל פותח דפדפן, לוחץ, גולל, ממלא טפסים ואפילו קונה, לפי הוראה בשפה חופשית, ולא רק עונה בצ'אט. הגרסה הכי נגישה היום בלי מפתח או ידע טכני היא Comet של Perplexity, שזמין בחינם לכולם. אצל OpenAI וגוגל הגרסאות הראשונות כבר הוחלפו או נסגרו תוך פחות משנה, ולכן שווה להכיר את היכולת עצמה ולא את שם המוצר הספציפי.
מישהו כותב לצ'אטבוט "תזמין לי שולחן למסעדה האיטלקית ליד המשרד ביום חמישי בשמונה בערב", ובמקום לקבל בחזרה טקסט שמסביר איך עושים את זה, המסך פשוט זז לבד: דפדפן נפתח, אתר ההזמנות עולה, השדות מתמלאים, וכעבור כמה שניות מופיעה הודעה שהשולחן הוזמן. זה לא קסם ולא תסריט שיווקי. זה בדיוק מה שנקרא היום "סוכן דפדפן" או "computer-use agent", ובלי להיבהל מהמילים הגדולות, שווה להבין מה זה בעצם, מי כבר בנה דבר כזה, וכמה מזה רלוונטי לעסק קטן שרוצה לנסות.
מה זה בעצם סוכן דפדפן, ומה ההבדל מ-ChatGPT הרגיל?
סוכן דפדפן הוא תוכנת AI שמקבלת גישה בפועל למסך, לעכברה ולמקלדת, ומבצעת בעצמה את הפעולות שהיו דורשות בן אדם: לפתוח אתר, ללחוץ על כפתור, לגלול, למלא שדה בטופס, לעבור בין לשוניות. ההבדל מ-ChatGPT הרגיל הוא בדיוק כאן: צ'אט רגיל רק כותב תשובה בטקסט, ומי שיושב מול המסך צריך לבצע את הפעולה בעצמו. סוכן דפדפן מבצע אותה.
חשבו על זה כמו ההבדל בין מישהו שמסביר בטלפון איך למלא טופס, לבין מישהו שמקבל גישה מרחוק למסך ופשוט ממלא אותו בעצמו. לפי התיעוד הרשמי של Anthropic, כלי ה-browser use של Claude "מאפשר ל-Claude לנווט, לקרוא ולפעול בתוך דפי אינטרנט", כאשר הוא רואה את הדף גם דרך המבנה הפנימי שלו (כפתורים, שדות, לשוניות) וגם דרך צילומי מסך בפועל. יש הבדל טכני בין שני סוגי הכלים שכדאי להכיר: כלי מסוג "browser use" פועל רק בתוך דף אינטרנט, בעוד כלי מסוג "computer use" שולט על כל שולחן העבודה, כולל אפליקציות מחוץ לדפדפן.
למה זה הפך לנושא רק בשנה האחרונה?
מודלים חדשים למדו לעשות שני דברים חדשים בבת אחת: לזהות בדיוק מה יש על המסך מתוך צילום מסך רגיל, ולתרגם הוראה בשפה חופשית לרצף פעולות קליק אחרי קליק. השילוב הזה הוא מה שהפך "תזמין לי" מתשובה טקסטואלית לפעולה שמתבצעת בפועל. זה גם קרה על רקע קפיצה כללית באימוץ AI בעסקים: לפי נתון שדווח באפריל 2026 מתוך סקר של הלשכה המרכזית לסטטיסטיקה בקרב יותר משמונה מאות עסקים, כפי שדווח באתר מאקו, שיעור השימוש בכלי AI בעסקים בישראל עלה מ-28% ביוני 2025 ל-39% במרץ 2026, קפיצה של 11 נקודות אחוז בפחות משנה. הנתון הזה מתייחס לשימוש כללי ב-AI ולא לסוכני דפדפן באופן ספציפי, אבל הוא מראה כמה מהר עסקים ישראליים כבר נכנסו לתוך הנושא, מה שמסביר גם למה שווה להבין את הפינה הספציפית הזאת.
אילו סוכני דפדפן קיימים היום, ומה מהם כבר נסגר?
ארבעה שחקנים גדולים בנו גרסה כלשהי של הרעיון, ולפחות שניים מהם כבר סגרו את הגרסה הראשונה שלהם תוך פחות משנה. הנה מצב הדברים נכון לעכשיו:
OpenAI, ChatGPT Atlas
דפדפן AI עצמאי שהושק ב-21 באוקטובר 2025, עם מצב agent שיכול לגלוש, למלא טפסים ואפילו להוסיף מוצרים לעגלת קניות. OpenAI הודיעה בעצמה שהאפליקציה העצמאית הפסיקה לפעול ב-9 באוגוסט 2026, ומרכיבי הגלישה עברו לאפליקציית ChatGPT למחשב ולתוסף כרום.
Anthropic, Claude computer use / browser use
שני כלים נפרדים: אחד לשליטה מלאה במסך (עכבר, מקלדת, צילום מסך), אחד לפעולה רק בתוך דף אינטרנט. שניהם זמינים אך ורק דרך ה-API למפתחים, ולא בתוך הממשק הצרכני של Claude.ai.
Google, Project Mariner
פרויקט ניסיוני לגלישה עצמאית שהוצג בסוף 2024. לפי דיווחים בתקשורת הטכנולוגית, גוגל הפסיקה אותו בשקט בסביבות מאי 2026 והטמיעה את היכולת בתוך Gemini ובתוך כרום, בלי מוצר עצמאי בשם הזה.
Perplexity, Comet
דפדפן מלא שיצא בחינם לכולם ברחבי העולם ב-2 באוקטובר 2025, עם עוזר בשם Comet Assistant שיכול לגלוש ולבצע פעולות. זה השחקן היחיד מהארבעה שממשיך להתקיים כמוצר עצמאי בשם הזה, בלי הפסקה או שינוי מותג.
מי שרוצה עוד הקשר על איך סוכני AI מתפקדים מול לקוחות אמיתיים, לא רק בהדגמה, יכול לקרוא את מבחן המציאות של סוכני AI בעסק קטן ואת למה הסוכן עובד מצוין בהדגמה ונשבר מול לקוח אמיתי, כי אותה תבנית בדיוק חוזרת גם אצל סוכני דפדפן.
כמה זה עולה, ומה כלול בכל תוכנית בפועל?
התשובה הקצרה: תלוי לגמרי בספק, ואצל חלק מהספקים היא כבר השתנתה תוך כדי כתיבת הכתבה הזאת. אצל OpenAI, ChatGPT Plus עולה 20 דולר לחודש ו-ChatGPT Pro עולה 200 דולר לחודש, לפי דף העזרה הרשמי (נבדק ב-20.09.2026, מחיר דולרי שאינו כולל מע"מ ישראלי). אבל היכולת שהכי מתאימה להגדרה "סוכן דפדפן", כלומר משימה רב-שלבית שבאמת גולשת ולוחצת, כבר החליפה שם פעמיים תוך פחות משנה: קודם Operator, אחר כך "ChatGPT agent", ונכון להיום מרכז העזרה הרשמי של OpenAI כותב במפורש: "ChatGPT agent אינו זמין יותר. יש להשתמש ב-ChatGPT Work למשימות ארוכות ורב-שלביות". מי שנרשם ל-Plus או ל-Pro כדי לקבל בדיוק את היכולת הזאת, כדאי שיבדוק ביום ההרשמה עצמו מה בפועל כלול.
אצל Perplexity המצב יציב יותר. תוכנית Pro עולה 20 דולר לחודש וכוללת גישה מוגבלת ל-Comet Assistant. תוכנית Max, ב-200 דולר לחודש, פותחת את היכולת המלאה שנקראת Comet Agent, עם מכסת שימוש גבוהה פי 10 לעומת Pro, לפי דף התמחור הרשמי (נבדק ב-20.09.2026, מחיר דולרי שאינו כולל מע"מ). התוכנית החינמית כוללת גם היא גרסה מוגבלת של העוזר, כך שאפשר להתנסות בלי לשלם כלום.
אצל Anthropic אין בכלל תוכנית צרכנית לנושא הזה. הכלים computer use ו-browser use מחויבים לפי טוקנים דרך ה-API, "לפי תמחור השימוש הרגיל בכלים" כפי שכתוב בתיעוד הרשמי, ולא דרך מנוי חודשי קבוע. במילים פשוטות: מי שאין לו מפתח או מישהו שיודע לתכנת, לא יכול היום פשוט להיכנס ל-Claude.ai ולבקש ממנו לגלוש בשבילו. מי ששוקל בכל זאת להשתמש ב-Claude לעסק, שווה לקרוא קודם על Claude for Small Business כדי להבין מה כן זמין בממשק הצרכני. שאלת העלות הרחבה יותר, כמה בכלל עולה לבנות סוכן AI מותאם אישית, מפורטת ב-כמה עולה לבנות סוכן AI ולמי זה משתלם.
אילו סיכונים חשוב להכיר לפני שנותנים לסוכן למלא טופס או לקנות משהו?
הסיכון המרכזי נקרא הזרקת פקודות, ושני הספקים הגדולים מזהירים ממנו בעצמם, בניסוח כמעט זהה. OpenAI כותבת על מצב ה-agent שלה שהוא "רגיש להוראות זדוניות מוסתרות, שיכולות להיות מוסתרות במקומות כמו דף אינטרנט או מייל". Anthropic כותבת על כלי ה-browser use שהוא "נושא סיכונים שתכונות API רגילות לא נושאות, כי Claude קורא ופועל על תוכן מהאינטרנט הפתוח, שבו כל דף יכול להכיל טקסט שנכתב כדי לתמרן אותו". במילים פשוטות, מישהו יכול להטמיע בדף אינטרנט או במייל הוראה נסתרת, והסוכן עלול לבצע אותה בטעות כאילו קיבל אותה מהבעלים של העסק. הרחבה על התרחיש הזה נמצאת ב-מישהו יכול לשלוח מייל ולתת פקודה לסוכן של העסק.
שני הספקים ממליצים על אותם צעדי זהירות בסיסיים:
בלי סיסמאות אמיתיות
OpenAI ממליצה על מצב מנותק ("logged-out mode") כדי להגביל את הגישה למידע רגיש. אין להזין סיסמה או מספר כרטיס אשראי ישירות בהודעה לסוכן.
אישור אנושי לפני פעולה סופית
Anthropic ממליצה במפורש לדרוש אישור אנושי לפני "עסקה כספית, קבלת תנאי שימוש, רכישה או שינוי בפרטי חשבון".
התחלה במשימות עם סיכון נמוך
חיפוש מידע, מילוי טופס פנימי לבדיקה, השוואת מחירים באתרים פתוחים. לא רכישה בכרטיס אשראי אמיתי בפעם הראשונה.
חשוב גם להבדיל בין סוכן דפדפן לבין סוג אחר של סוכן AI שהולך ונפוץ באותה תקופה: סוכן שרץ ברקע בלי לגעת בדפדפן בכלל, אלא עובד ישירות מול מערכת פנימית או תיבת מייל. ההבדל בין השניים משנה גם את הסיכונים: סוכן דפדפן חשוף לכל דף שהוא פוגש באינטרנט הפתוח, בעוד סוכן שעובד רק מול מערכת סגורה חשוף בעיקר למה שכבר נמצא בתוכה. הרחבה על הסוג השני נמצאת ב-ChatGPT Workspace Agents: סוכן AI שרץ ברקע גם כשסגרו את הלפטופ.
האם זה כבר בשל לעסק קטן בישראל?
חלקית. הכלי הכי נגיש כרגע למי שאין לו מפתח או צוות פיתוח הוא Comet של Perplexity, כי הוא בחינם וממשק שלו מיועד למשתמש רגיל. לעומת זאת, היכולת המקבילה של Claude נעולה מאחורי API למפתחים, ומצב ה-agent של ChatGPT עבר כבר שני שינויי שם ומיתוג תוך פחות משנה, כך שקשה לבנות עליו תהליך עבודה קבוע בלי לבדוק כל כמה חודשים אם הוא עדיין קיים באותו שם. יש גם שאלה נפרדת של תמיכה בעברית: ממשקים ואתרים בעברית, כולל RTL וטפסים בעברית, הם לא בדיוק מה שרוב הסוכנים האלה אומנו עליו בעיקר, ולכן שווה לקרוא גם את האם סוכני AI מבינים עברית: מה הספקים באמת מתעדים לפני שסומכים על סוכן דפדפן למלא טופס בעברית מול לקוח.
מאיפה מתחילים, בלי לקפוץ למים עמוקים
הצעד הראשון קטן ממה שנדמה: לפתוח את Comet בחינם, ולנסות עליו משימה אחת עם סיכון נמוך, כמו לחפש ולהשוות בין שלושה ספקים לאותו מוצר, בלי להזין פרטי תשלום. רק אחרי שרואים איך הסוכן מתנהג במשימה פשוטה, שווה לשקול משימות עם יותר אחריות, ותמיד עם אישור אנושי לפני כל פעולה שכוללת כסף או פרטים אישיים. מי שרוצה להבין את התמונה הרחבה יותר של סוכני AI לעסק קטן, מעבר לדפדפן בלבד, יכול להמשיך אל סוכני AI לעסק קטן: המדריך המלא להתחלה, לבחירה ולחיבור.
צ'אטבוט רגיל רק כותב תשובה בטקסט, ומי שקורא אותה צריך לבצע את הפעולה בעצמו. סוכן דפדפן מקבל גישה בפועל למסך, לוחץ, גולל וממלא טפסים, ולכן הוא לא רק עונה על השאלה איך עושים את זה, אלא בפועל מבצע אותה.
מבין הספקים הגדולים, רק Comet של Perplexity מציע גישה חופשית וחינמית למשתמש רגיל בלי צורך במפתח API. הכלים המקבילים של Anthropic, computer use ו-browser use, זמינים אך ורק דרך API למפתחים, ומצב ה-agent של ChatGPT עבר כמה שינויי שם תוך פחות משנה.
זה תלוי בספק. ChatGPT Plus עולה 20 דולר לחודש ו-ChatGPT Pro עולה 200 דולר לחודש, Perplexity Pro עולה 20 דולר לחודש ו-Max עולה 200 דולר לחודש עם היכולת המלאה של Comet Agent, ואילו הכלים של Anthropic מחויבים לפי טוקנים דרך API ולא במחיר חודשי קבוע. כל המחירים נבדקו ב-20.09.2026 ואינם כוללים מע"מ ישראלי.
לא בלי זהירות. גם OpenAI וגם Anthropic מזהירות במפורש מפני הזרקת הוראות זדוניות שמוסתרות בתוך דף אינטרנט או מייל, וממליצות לא להזין סיסמאות או פרטי תשלום ישירות בהודעה לסוכן, ולדרוש אישור אנושי לפני כל רכישה או שינוי בפרטי חשבון.
כי הקטגוריה עדיין צעירה מאוד והחברות הגדולות עדיין מחפשות את הצורה הנכונה למוצר. OpenAI עברה מ-Operator ל-Atlas ואז מ-ChatGPT agent ל-ChatGPT Work תוך פחות משנתיים, וגוגל הפסיקה את Project Mariner העצמאי והטמיעה אותו בתוך Gemini ובתוך כרום.
כתיבת תגובה