שאלות נפוצות
תשובות קצרות על הגדרה, מודלים, חיוב, אבטחה ואופן הפעולה של WebBrain בדפדפן שלך.
לא נמצאו תשובות התואמות לחיפוש.
אודות WebBrain
6האם WebBrain הוא חלופה חינמית לתוסף הדפדפן של Claude?
כן. WebBrain מספק יכולות דומות של סוכן דפדפן חכם — קריאת דפים, חליצת נתונים, לחיצה על כפתורים, מילוי טפסים ואוטמט תהליכי עבודה מרובים שלבים. בניגוד לתוסף המסחרי של Claude שדורש מינוי Claude Pro ועובד רק עם מודלי Anthropic, WebBrain הוא בחינם לחלוטין, קוד פתוח (רישיון MIT) ותומך בספקי LLM רבים כולל מודלים מקומיים שפועלים לחלוטין על המכשיר שלך.
כיצד WebBrain משתווה ל-OpenClaw, Browser-Use ומסגרות סוכני בינה מלאכותית אחרות?
אלו קטגוריות שונות של כלים. WebBrain הוא הרחבת דפדפן — אתה מתקין אותו ב-Chrome או Firefox ומדבר איתו בסרגל צד, ללא צורך בתכנות. מסגרות כמו OpenClaw ו-Browser-Use הן SDK למפתחים לבניית תהליכי אוטמט דפדפן ב-Python, לרוב עם דפדפנים ללא ממשק ו-CDP. בקיצור: WebBrain לגלישה יומית עם עוזר חכם; מסגרות סוכנים לבניית בוטי גריפה ואוטמט בדיקות. אתה יכול להשתמש בשניהם — הם משלימים זה את זה.
האם WebBrain עובד ב-Firefox?
כן. WebBrain מגיע עם גרסת Chrome (Manifest V3, משתמש ב-sidePanel API) וגרסת Firefox (Manifest V2, משתמש ב-sidebar_action). שתי הגרסאות זהות בתכונות. גרסת Firefox ניתן לטעינה כתוסף זמני לפיתוח, או פרסום ב-addons.mozilla.org להתקנה קבועה.
כיצד אני משתמש ב-WebBrain לגריפת רשת וחילוץ נתונים?
פשוט פתח כל דף אינטרנט, פתח את סרגל הצד של WebBrain, ושאל בשפה טבעית: "חלץ את כל שמות המוצרים והמחירים מדף זה", "קבל את כל כתובות הדוא"ל בדף זה", או "סכם מאמר זה בנקודות". סוכן הבינה המלאכותית קורא את תוכן הדף, מבין את המבנה ומחזיר את הנתונים שחולצו. לגריפה מורכבת יותר, עבור למצב Act והסוכן יכול לנווט בין דפים, ללחוץ על כפתורי ניווט ולאסוף נתונים عبر דפים מרובים.
האם WebBrain תומך במצב dry-run?
מגרסה 7.0.0, עדיין לא. מצב dry-run מתוכנן וכבר על מפת הדרכים.
האם אני יכול לתרום ל-WebBrain?
בהחלט! WebBrain ברישיון MIT ומקבל בתרומות. בדוק את המאגר ב-GitHub לבעיות, בקשות תכונות והנחיות תרומה.
ענן וחיוב
4כמה עולה מינוי WebBrain Cloud?
WebBrain Cloud עולה כיום 5$ לחודש לכל פרופיל מכשיר, הרבה יותר זול מ-Claude Pro נכון לעכשיו. השימוש כעת ללא הגבלה במסגרת מדיניות שימוש הוגן: שימוש אישי רגיל הוא בסדר, אך שימוש פוגעני, אוטמטי, למכירה חוזרת או בנפחים חריגים אינו מותר.
המינוי קשור למזהה המכשיר שנוצר על ידי התוסף עבור אותו GUID של דפדפן + מערכת הפעלה, לא לחשבון משתמש. אם מזהה זה אובדן בגלל איפוס אחסון התוסף, מחיקת פרופיל הדפדפן, התקנה מחדש של הדפדפן, החלפת דפדפן/מערכת הפעלה או אובדן המכשיר, לא ניתן לשחזרו או להעבירו ואיננו נותנים החזרים על אובדן זה.
כיצד לנהל או לבטל את המינוי שלי?
נהלו את החיוב ב-api.webbrain.one/account והתחברו באמצעות כתובת האימייל שלכם.
כיצד עובד סנכרון ענן מוצפן?
Cloud Sync הוא תכונה אופציונלית למנויי WebBrain Cloud פעילים. הוא מסנכרן את זיכרונות WebBrain, טקסט מילוי אוטומטי של הפרופיל ותצורת ספקים נתמכת, כולל מפתחות API. הוא אינו מסנכרן היסטוריית צ'אט, היסטוריית דפדפן, צילומי מסך של דפים, או אסימוני OAuth ישנים לגישה ולרענון.
הדפדפן מצפין את כספת הסנכרון לפני ההעלאה עם סיסמה שאתם בוחרים. WebBrain Cloud שומר רק את הכספת המוצפנת; הוא אינו יכול לקרוא את הזיכרונות, טקסט הפרופיל, הגדרות הספקים או מפתחות ה-API, ואינו יכול לשחזר עבורכם את סיסמת הסנכרון.
שדה האימייל מיועד לאימות חיוב/מנוי בקישור קסם של WebBrain Cloud. זו אינה סיסמת חשבון. אם הממשק אומר לשנות סיסמה ב-Cloud Sync, הכוונה היא לסיסמת הצפנת הסנכרון, לא לסיסמת חשבון WebBrain.
אם תשכחו את סיסמת הסנכרון, לא ניתן לפענח את כספת הענן המוצפנת הישנה. אפשר לאפס את כספת הענן ולהעלות עותק מוצפן חדש ממכשיר שעדיין מחזיק את הנתונים מקומית.
כיצד WebBrain שומר על חשבונות LLM בענן בשליטה?
שלוש שכבות עצמאיות:
צילומי מסך חוסכי אסימונים. לפני שכל תמונה עוזבת את המכשיר שלך, WebBrain משנה את גודלה (הצד הקצר מוגבל, תוך שמירה על יחס רוחב-גובה) ודוחס אותה חוזרת ב-JPEG עד שהיא מתאימה למכסת אסימוני תמונה לכל תור. צילום מסך של 2000×1200 שהיה עולה לך כ-1500 אסימוני כניסה ב-GPT-4o דוחס לכ-300-500 אסימונים ללא אובדן מעשי למשימות קריאת דפים. מומש ב-_fitImageDimensions עם בדיקות יחידה לחישובי המכסה.
גיזום קשר חכם. היסטוריית שיחה, פלטי כלים ופריקת DOM מוטמעות מוגבלות לכל תור וɡізוזות מהישן לחדש כשחלון הקשר של המודל הפעיל מתקרב למלואו. לא תראה הפעלה מתנפחת בשקט מ-10k אסימונים ל-100k רק בגלל ש-read_page החזיר מאמר באורך רומן.
מודל ראייה ייעודי.זוג מודל טקסט זול (כמו GPT-4o-mini) לתכנון וקריאה לכלים עם מודל ראייה נפרד (כמו GPT-4o) רק לצילומי מסך, כדי לא לשלם מחירים של מודל רב-תכליתי בכל תור. להגדרות בהגדרות ← ראייה.
תוצאה סופית: ישיבות ארוכות עם ספקי ענן נשארות צפויות. לשליטה מלאה, השתמש ב-llama.cpp מקומי — אפס עלות לאסימון.
מודלים והגדרה מקומית
7האם אני יכול להשתמש ב-WebBrain לחלוטין לא מקוון?
כן. הספק כברירת מחדל של WebBrain הוא llama.cpp, שפועל מודל בינה מלאכותית מקומי על המחשב שלך. ללא מפתחות API, ללא חיבור לאינטרנט для הבינה המלאכותית, ואין נתונים שעוזבים את המכשיר שלך לעולם. פשוט הורד מודל GGUF, הפעל llama-server, ויהיה לך סוכן דפדפן חכם פרטי לחלוטין. אפשר גם להשתמש ב-Ollama עם קצה התואם ל-OpenAI.
אילו מודלי בינה מלאכותית WebBrain תומך?
WebBrain תומך בארבעה סוגי ספקים: llama.cpp (כל מודל GGUF מקומי), OpenAI (GPT-4o, GPT-4, וכו׳), Claude (Claude Opus, Sonnet, Haiku דרך API מקורי) ו-OpenRouter (גישה ליותר מ-100 מודלים מספקים שונים). כל קצה API תואם OpenAI עובד, אז אפשר גם להשתמש בשירותים כמו Together AI, Groq, Mistral או כל שרת מקומי עם ממשק תואם OpenAI.
מהו המודל המומלץ ביותר?
נכון ל21 באפריל 2026, ההמלצה העליונה היא Qwen 3.6 35B. למה: ב benchmark הראייה שלנו (vision-model-shootout), הוא עלה על Gemma 4 בהבנת צילומי מסך תוך כדי שמירה על מעשיות למסור מקומי.
לכרטיסי מסך צרכניים, RTX 5090 הוא אידיאלי, ו-RTX 4090 לרוב עובד עם קванטיזציה INT4 AutoRound דרך Intel/Qwen3.6-35B-A3B-int4-AutoRound.
למהירות מקסימלית, אנו ממליצים להפעיל על vLLM. דוגמת פקודה:
python -u -m vllm.entrypoints.openai.api_server --model Intel/Qwen3.6-35B-A3B-int4-AutoRound --served-model-name qwen3.6-35b --quantization auto --dtype bfloat16 --max-model-len 65536 --max-num-batched-tokens 32768 --max-num-seqs 4 --host 0.0.0.0 --port 8000 --gpu-memory-utilization 0.92 --enable-prefix-caching --enable-chunked-prefill --limit-mm-per-prompt '{"image": 4, "video": 1}' --mm-processor-cache-type shm --reasoning-parser qwen3 --enable-auto-tool-choice --tool-call-parser qwen3_coder --trust-remote-code --allowed-origins '["*"]' --speculative-config '{"method": "dflash", "model": "z-lab/Qwen3.6-35B-A3B-DFlash", "num_speculative_tokens": 15}' --attention-backend flash_attn
פענוח ספקולטיבי DFlash הוא אופציונלי.
מדוע WebGPU זמין רק במצב אפוקליפסה?
כי לדעתנו הסקת טקסט באמצעות WebGPU בתוך הדפדפן עדיין אינה טובה מספיק לרוב המשתמשים, ואיננו רוצים שתיאלצו לסבול מחוויית שימוש ירודה. אם ברצונכם להשתמש מקומית באותו מודל LFM2.5 2.6B, הריצו את ההסקה במחשב באמצעות llama.cpp או Ollama והפנו את WebBrain לנקודת הקצה המקומית במקום להסתמך על WebGPU.
חלופת הראייה באמצעות WebGPU נשארת זמינה מפני שהמודל שלה קטן בהרבה והשימוש בה נעשה רק לעיתים רחוקות.
אני מקבל "Failed to fetch" בעת חיבור לשרת LLM מקומי (vLLM, Ollama, llama.cpp) ברשת שלי
אם שרת ה-LLM שלך נמצא על מכשיר אחר ברשת המקומית שלך (למשל http://192.168.1.x:8000), Chrome חוסם את הבקשה אלא אם כן השרת שולח כותרות CORS. התיקון תלוי בשרת שלך:
vLLM: התחל עם --allowed-origins '["*"]' (הערך חייב להיות רשימה של JSON).
Ollama: הגדר את משתנה הסביבה OLLAMA_ORIGINS=* לפני ההפעלה.
llama.cpp: CORS מופעל כברירת מחדל — ללא שינויים נדרשים.
אם השרת שלך פועל על localhost (אותו מכשיר כמו הדפדפן), בדרך כלל אין צורך ב-CORS. הבעיה משפיעה רק על חיבורים בין מכשירים ברשת המקומית. ודא שכתובת ה-URL הבסיסית בהגדרות WebBrain מסתיימת ב-/v1 (למשל http://192.168.1.47:8000/v1). חריג: Ollama המשמש מהרחבת דפדפן עדיין עשוי להזדקק ל-OLLAMA_ORIGINS; ראה את ה-FAQ של Ollama למטה.
מדוע Ollama על localhost מחזיר 403 מהתוסף של WebBrain?
גרסאות חדשות של Ollama יכולות לדחות בקשות ממקורות של הרחבות דפדפן גם כש-Ollama פועל על אותו מכשיר. התוסף שולח Origin כמו chrome-extension://... או moz-extension://..., ו-Ollama יכול להחזיר 403 אלא אם כן מקורות אלה מורשים.
סגור כל יישום שולחני של Ollama שתופס כבר את הפורט 11434, ואז הפעל את Ollama עם אחת מפקודות אלה:
OLLAMA_ORIGINS="*" ollama serveOLLAMA_ORIGINS="chrome-extension://*,moz-extension://*" ollama serve
שמר על כתובת ה-URL הבסיסית של Ollama ב-WebBrain על http://localhost:11434/v1. בדיקות curl במסוף עדיין יכולות לעבוד ללא הגדרה זו כי הן אינן שולחות מקור של הרחבת דפדפן.
האם אני יכול להשתמש בו ב-LM Studio גם?
כן. כלי הרשת לקריאה בלבד של WebBrain — fetch_url ו-research_url — מגיעים גם כתוסף עצמאי של LM Studio ב-webbrain/web-tools. התקן עם lms clone webbrain/web-tools והפעל בכל שיחת LM Studio — כל מודל התומך בכליים יכול אז לקרוא לשתי הכלים הללו מבלי להתקין את הרחבת הדפדפן. Node טהור, ללא דפדפן ללא ממשק. קוד מקור: lmstudio-plugin/.
דפדפנים ושימוש יומיומי
5האם אני יכול להעביר את סרגל הצד של Firefox משמאל לימין, כמו סרגל הצד של Chrome?
כן — סרגל הצד של Firefox כברירת מחדל בצד שמאל, אבל אפשר להפוך אותו. לחץ באמצעות הכפתור הימני בכל מקום בכותרת סרגל הצד ובחר Move Sidebar to Right (או דרך התפריט View → Sidebar → Move Sidebar to Right). המיקום נשמר בין הפעלות מחדש. סרגל הצד של Chrome בצד ימין כברירת מחדל ואינו ניתן להזזה על ידי המשתמש מהסרגל עצמו.
האם יש מגבלות בשימוש ב-WebBrain בתוך Web Panel של Vivaldi?
כן. Web Panels של Vivaldi חוסמים תיבות דו-שיח מקוריות של JavaScript, כגון confirm(), alert() ו-prompt(). המעבר בין מצבי Ask, Act ו-Dev של WebBrain כבר אינו תלוי בהן, אך כמה פעולות משניות עדיין כן.
הקלטה: אל תשתמש ב-/record ב-Vivaldi לעת עתה. אם ההקלטה נכשלת, Vivaldi עלול להסתיר את התראת השגיאה ולא להציג הסבר.
Settings, History, Traces והעברה ל-Ollama: גם דפים אלה מכילים תיבות דו-שיח מקוריות, אך WebBrain פותח אותם בדרך כלל בלשוניות רגילות שבהן הם פועלים. אם הוספת אחד מהם ידנית ל-Web Panel, פתח אותו בלשונית רגילה לפני שימוש בפעולה שתלויה בתיבת דו-שיח.
האם אפשר לגלול למעלה או למטה בזמן ש-WebBrain עובד בכרטיסייה שלי?
ברוב המקרים כן — במיוחד במצב Ask עבור בקשות לקריאה בלבד, כמו „סכם את הדף הזה”. אפשר להמשיך לגלול בזמן ש-WebBrain עובד.
מתי כדאי להימנע מכך? צילומי המסך האוטומטיים משקפים את אזור התצוגה הנוכחי של הכרטיסייה. כאשר WebBrain בודק תוכן גלוי או מקיים איתו אינטראקציה באופן פעיל במצב Act או Dev, גלילה עלולה להזיז יעד או לשנות את מה שהמודל רואה. יש להמתין לסיום השלב לפני הגלילה; מחוץ לרגעים האלה אפשר להמשיך להשתמש בדף.
האם אפשר לעבור לכרטיסייה אחרת בזמן ש-WebBrain עובד על דף?
כן. החל מגרסה 27.0.0, WebBrain נמנע מלקחת את המיקוד גם בדפדפנים מבוססי Chromium וגם ב-Firefox, אלא אם גישה לחזית הכרחית לחלוטין. ההפעלה נשארת מקושרת לכרטיסייה שבה התחילה, ולכן אפשר לעבוד בבטחה בכרטיסייה אחרת.
אם שלב נדיר מחייב שהכרטיסייה המקורית תהיה בחזית, WebBrain עשוי להעביר אליה את המיקוד לזמן קצר. יש להימנע מלחיצה או הקלדה באותה כרטיסייה בזמן ש-WebBrain מבצע בה פעולות באופן פעיל.
מה WebBrain עושה עם כרזות עוגיות וקירות תשלום?
כרזות עוגיות: WebBrain מזהה כרזות הסכמה ממסגרות נפוצות (OneTrust, Cookiebot, Didomi, Quantcast, Google Funding Choices, TrustArc) וסוגר אותן לפני הסקת מסקנות על הדף. העדפה היא "דחה הכל" / "דחה לא הכרחי" / "רק הכרחי" כשהם גלויים בבירור; הוא חוזר ל"אשר הכל" במקום ללכת לאיבוד במבוך "ניהול העדפות".
קירות תשלום: WebBrain מדווח על קיר התשלום בכנות ומספר לך מה הוא באמת ראה (כותרת, כותרת משנה, פסקאות ראשונות). הוא אינו מנסה לעקוף קירות תשלום — לא archive.today, לא 12ft.io, לא מחיקת עוגיות, לא השבתת JS, לא טריקים של מצב קריאה. אם אתה רוצה את המאמר המלא, היכנס עם מינוי או בקש מ-WebBrain לחפש סיקור חינם של אותה ה故事.
אבטחה ופרטיות
7האם WebBrain בטוח לשימוש? האם הוא יכול לשנות דפי אינטרנט?
ל-WebBrain שלושה מצבים. מצב Ask (ברירת המחדל) הוא לקריאה בלבד ואינו יכול לשנות דבר בדף. מצב Act מאפשר פעולות דפדפן כמו לחיצה, הקלדה וניווט, ומצב Dev מוסיף כלי ניפוי שגיאות לדף. פעולות בעלות השלכות דורשות אישור כברירת מחדל; אם שער ההרשאות הזה כבוי, WebBrain מציג סרגל אזהרה גלוי. אפשר לעצור את הסוכן בכל עת באמצעות כפתור העצירה. קוד המקור של התוסף פתוח לחלוטין לבדיקה ב-GitHub.
מהו סרגל "WebBrain started debugging this browser"? למה WebBrain משתמש ב-CDP?
כדי לפעול על דף בצורה אמינה, WebBrain משתמש בפרוטוקול Chrome DevTools (CDP) דרך ממשק ההרחבה הסטנדרטי chrome.debugger — זה מה שגורם לסרגל "WebBrain started debugging this browser" של Chrome. CDP הוא מה שמאפשר לסוכן ללחוץ ולהקליד עם אירועי הקלדה מהימנים שאתרים מודרניים באמת מקבלים; אירועים סינתטיים הנורים מ-content script נדחים על ידי אתרים רבים, Web Components ושדות הנשלטים על ידי מסגרות. זה גם איך WebBrain מצלם צילומי מסך בדיקת פיקסל ל-Retreat החזותי ומגיע לiframes חוצי מקורות ו-shadow DOM ש-content scripts לא יכולים לראות.
מצב Ask לקריאה בלבד אינו צריך CDP — קריאות הדף ועץ הנגישות עוברות דרך content scripts רגילים. מה שנדרש הוא אמינות מצב Act ועבודה חוצת מקורות, ובמצב V3 של Manifest אין ממשק ללא מקשקש מהימן для הקלדה. WebBrain מצרף את המקשקש רק כשפעולה דורשת זאת, לכל כרטיסייה, וההרחבת בשלמותה בקוד פתוח כך שאתה יכול לבדוק בדיוק מה ה-session עושה. CDP חזק, אז אנחנו מתייחסים לחשיפה שלו כמשהו שצריך להכיל (צרף כשנדרש, שמור את ה readings הרחק ממנו), וצמצום נוסף נמצא ב roadmap האבטחה שלנו.
הוא שואל אותי יותר מדי שאלות. האם אני יכול לבטל את זה?
prompts האישור האלה הם לבטיחותך. אפילו באתרים שאתה סומך עליהם, גורמים זדוניים יכולים לחקות הוראות LLM או להזריק תוכן שמנסה לגרום לסוכן לעשות דברים בשמך שלא היית מאשר. לכן WebBrain שואל לפני פעולות בעלות השלכות. אם אתה עדיין לא רוצה לעבור על那些 prompts, הקלד /dangerously-skip-permissions בסרגל הצד, או פתח את התוסף בצד, לחץ על סמל ההגדרות בכותרת, עבור ללשונית הרשאות ב-settings.html, וכבה את Ask before consequential actions.
האם WebBrain קורא ל-API ישירות, או תמיד לוחץ דרך הממשק?
כברירת מחדל, WebBrain תמיד עובר דרך הממשק הגלוי לכל פעולה שיוצרת, משנה, מוחקת, שולחת, מגישה, מפרסמת או קונה משהו. הוא ינווט לדף, ימלא את הטופס וילחץ על הכפתור — בדיוק כפי שאתה היית עושה. הוא מסרב לקרוא לקצוות REST/GraphQL ישירות דרך fetch() ברקע לשינויים. זה מכוון: פעולות API בלתי נראות (אתה לא רואה מה נשלח), דורשות לרוב אסימוני אימות נפרדים שאולי לא הגדרת, ובעלות טווח השפעה הרבה יותר רחב מלחיצה גלוייה שגויה. UI-first פירושו שהכל על המסך, ב sessions הרגיל שלך, ואפשר לעצור אותו.
לקריאה של נתונים — שליפת README, חיפוש issue, השוואת מחירים בין אתרים, בדיקת דף סטטוס — WebBrain משתמש בחופשיות בבקשות HTTP ברקע דרך הכלים fetch_url ו-research_url. קריאה אינה פעולה; היא לא משנה שום דבר בשירות מרוחק, אז דאגות הבטיחות לא חלות.
אם אתה רוצה לאפשר特意️ APImutations למשימה מסוימת, הקלד /allow-api בתחילת ההודעה שלך (אופציונלי עם תיאור קצר של המשימה). החרגה זו מאפשרת ל-WebBrain לחזור לקצוות API כשהממשק נכשל באמת או לא מעשי, תוך שמירה על העדפת ממשק כשהוא עובד. סמל דביק נשאר גלוי מעל אזור הקלטขณะ שההחרגה פעילה, והוא נמחק כשאתה מאפס את השיחה.
כיצד מילוי הפרופיל האוטומטי עובד, והאם זה בטוח?
מילוי פרופיל אוטומטי הוא תכונה אופציונלית בהגדרות ← פרופיל. אתה מזין ביוגרפיה קצרה — שם, דוא"ל עסקי, חברה וסיסמה לשימוש חד-פעמי להרשמות בסיכון נמוך — ומפעיל אותה. כשפעיל, WebBrain מצרף את הטקסט הזה לפרומפט המערכת של הסוכן כדי שהוא ימלא טפסי הרשמה מבלי לשאול בכל פעם.
הטקסט מאוחסן בטקסט פשוט באחסון המקומי של הדפדפן שלך. הוא אינו מועבר לפרויקט WebBrain, אבל הוא מועבר לכל ספק LLM שהגדרת בכל תור, כחלק מפרומפט המערכת. מושבת כברירת מחדל.
אל תשים סיסמאות לחשבונות חשובים כאן (Google, Apple, iCloud, בנקים, SSO עסקי, דוא"ל ראשי). חשבונות אלה צריכים להשתמש ב-2FA ולא צריך להעביר אותם לסוכן ממילא. סיסמה לשימוש חד-פעמי שאתה מחדש לרשמות ניוזלטר וניסויים חינם היא מקרה השימוש המיועד.
האם ההגדרה טשטוש צילומי מסך מבטיחה שהנתונים הפרטיים שלי לעולם לא יגיעו למודל ראייה בענן?
לא — היא מפחיתה חשיפה, אך אינה ערבות. כשההגדרה מופעלת (הגדרות ← מולטי-מודאלי ← טשטוש צילומי מסך, כבויה כברירת מחדל), WebBrain מפקסל שדות טופס וטקסט שנראה ככתובת דוא"ל או מספר טלפון בכל צילום מסך לפני שהוא נשלח למודל ראייה. הזיהוי מתבצע כולו במכשיר שלך באמצעות היוריסטיקות DOM; שום דבר נוסף לא מועבר.
זהו טשטוש במאמץ סביר (best-effort) מסוג fail-open. אם המזהה אינו יכול לפעול בדף מסוים — למשל מיד אחרי ניווט, בצפייה בקבצי PDF, או בדפי דפדפן מוגבלים — צילום המסך עדיין יישלח ללא טשטוש במקום לבטל את המשימה שלך. תוכן שהיוריסטיקות של DOM אינן יכולות לראות (טקסט המצויר על canvas, מידע אישי בתוך תמונות, רכיבי ממשק חריגים) עלול גם הוא לחמוק. וההגדרה מכסה רק צילומי מסך: טקסט הדף הנשלח למודל אינו מטושטש על ידה.
לפרטיות מלאה בראייה, השתמש במודל מקומי. עם ספק לא מקוון כמו llama.cpp או Ollama, צילומי המסך וטקסט הדף לעולם אינם עוזבים את המכשיר שלך, כך שאין כלל מה לטשטש מלכתחילה — זו התצורה היחידה שבה הפרטיות מובטחת. ראה "האם אני יכול להשתמש ב-WebBrain לחלוטין לא מקוון?" למעלה.
אין לך מכשיר שמסוגל להריץ מודל מקומי עם תמיכה בראייה? פשרה טובה היא שימוש במודל מקומי קטן לתכנון ולקריאה לכלים (קליל מספיק למעבד/כרטיס מסך צנוע), בשילוב עם ספק ענן עבור קריאות המשנה של הראייה, כאשר טשטוש צילומי מסך מופעל. השיחה שלך וטקסט הדף נשארים במכשיר, וכל צילום מסך שיוצא לראייה בענן כבר עבר טשטוש של שדות טופס ודוא"ל/טלפון שזוהו — פחות חשיפה בענן מבלי להזדקק לחומרה עבור מודל ראייה מקומי מלא. הגדר את החלוקה הזו תחת הגדרות ← ראייה (ראה "כיצד WebBrain שומר על חשבונות LLM בענן בשליטה?" למעלה).
האם WebBrain שולח את כל ה-DOM למודל הבינה המלאכותית?
לא. כברירת מחדל, WebBrain אינו שולח HTML גולמי או עותק גולמי של ה-DOM. הוא מתחיל מכתובת ה-URL וכותרת הדף, מהנחיות האתר המתאימות ומצילום מסך אופציונלי של האזור הנראה כאשר יכולת הראייה מופעלת.
כאשר משימה דורשת תוכן מהדף, WebBrain קורא אותו לפי הצורך כעץ נגישות סמנטי מצומצם או כטקסט שחולץ. הקריאות מסוננות לפי נראות במקומות המתאימים, מוגבלות במספר תווים ומחולקות לעמודים. גישה למקור הדף הגולמי זמינה רק במצב Dev.
