প্রায়শই জিজ্ঞাসিত প্রশ্নাবলী
সেটআপ, মডেল, বিলিং, নিরাপত্তা এবং আপনার ব্রাউজারে WebBrain কীভাবে কাজ করে সে সম্পর্কে দ্রুত উত্তর।
এই অনুসন্ধানের সঙ্গে মেলে এমন কোনো উত্তর নেই।
WebBrain সম্পর্কে
6WebBrain কি Claude এর ব্রাউজার প্লাগইনের একটি বিনামূল্যের বিকল্প?
হ্যাঁ। WebBrain অনুরূপ AI ব্রাউজার এজেন্ট ক্ষমতা প্রদান করে — পৃষ্ঠা পড়া, ডেটা বের করা, বোতামে ক্লিক করা, ফর্ম পূরণ করা এবং বহু-পদক্ষেপের কর্মপ্রবাহ স্বয়ংক্রিয় করা। Claude এর মালিকানাধীন ব্রাউজার প্লাগইনের বিপরীতে যার জন্য একটি Claude Pro সাবস্ক্রিপশন প্রয়োজন এবং শুধুমাত্র Anthropic এর মডেলগুলির সাথে কাজ করে, WebBrain সম্পূর্ণ বিনামূল্যে, ওপেন সোর্স (MIT লাইসেন্স) এবং স্থানীয় মডেলগুলি সহ একাধিক LLM প্রদানকারীকে সমর্থন করে যা সম্পূর্ণরূপে আপনার মেশিনে চলে৷
WebBrain কিভাবে OpenClaw, ব্রাউজার-ব্যবহার এবং অন্যান্য AI এজেন্ট ফ্রেমওয়ার্কের সাথে তুলনা করে?
এগুলি বিভিন্ন ধরণের সরঞ্জাম। WebBrain হল একটি ব্রাউজার এক্সটেনশন — আপনি এটিকে Chrome বা Firefox-এ ইনস্টল করুন এবং পাশের প্যানেলে এটির সাথে চ্যাট করুন, কোন কোডিংয়ের প্রয়োজন নেই৷ OpenClaw এবং Browser-Use-এর মত ফ্রেমওয়ার্ক হল Python-এ স্বয়ংক্রিয় ব্রাউজার পাইপলাইন তৈরির জন্য ডেভেলপার SDK, সাধারণত হেডলেস ব্রাউজার এবং CDP ব্যবহার করে। এইভাবে চিন্তা করুন: WebBrain একটি AI সহকারীর সাথে প্রতিদিন ব্রাউজ করার জন্য; এজেন্ট ফ্রেমওয়ার্ক স্ক্র্যাপিং বট এবং পরীক্ষা অটোমেশন নির্মাণের জন্য। আপনি উভয়ই ব্যবহার করতে পারেন - তারা একে অপরের পরিপূরক।
WebBrain কি Firefox এ কাজ করে?
হ্যাঁ। WebBrain উভয় একটি Chrome সংস্করণ (ম্যানিফেস্ট V3, সাইডপ্যানেল API ব্যবহার করে) এবং একটি Firefox সংস্করণ (সাইডবার_অ্যাকশন ব্যবহার করে ম্যানিফেস্ট V2) উভয়ের সাথেই পাঠানো হয়। উভয় সংস্করণ অভিন্ন বৈশিষ্ট্য আছে. Firefox সংস্করণটি বিকাশের জন্য একটি অস্থায়ী অ্যাড-অন হিসাবে লোড করা যেতে পারে, বা স্থায়ী ইনস্টলেশনের জন্য addons.mozilla.org-এ প্রকাশ করা যেতে পারে।
ওয়েব স্ক্র্যাপিং এবং ডেটা নিষ্কাশনের জন্য আমি কীভাবে WebBrain ব্যবহার করব?
সহজভাবে যেকোন ওয়েব পৃষ্ঠা খুলুন, WebBrain সাইড প্যানেল খুলুন এবং স্বাভাবিক ভাষায় জিজ্ঞাসা করুন: "এই পৃষ্ঠা থেকে সমস্ত পণ্যের নাম এবং দামগুলি বের করুন", "এই পৃষ্ঠায় সমস্ত ইমেল ঠিকানা পান", বা "বুলেট পয়েন্টগুলিতে এই নিবন্ধটি সংক্ষিপ্ত করুন"। এআই এজেন্ট পৃষ্ঠার বিষয়বস্তু পড়ে, গঠন বুঝতে পারে এবং নিষ্কাশন করা ডেটা ফেরত দেয়। আরও জটিল স্ক্র্যাপিংয়ের জন্য, অ্যাক্ট মোডে স্যুইচ করুন এবং এজেন্ট পৃষ্ঠাগুলির মধ্যে নেভিগেট করতে পারে, পৃষ্ঠা সংখ্যা বোতামে ক্লিক করতে পারে এবং একাধিক পৃষ্ঠা জুড়ে ডেটা একত্রিত করতে পারে।
WebBrain কি ড্রাই-রান মোড সমর্থন করে?
হিসাবে 7.0.0, এখনো না ড্রাই-রান মোড পরিকল্পিত এবং ইতিমধ্যেই রোডম্যাপে রয়েছে৷
আমি কি WebBrain তে অবদান রাখতে পারি?
একেবারেই! WebBrain হল MIT- লাইসেন্সপ্রাপ্ত এবং অবদানকে স্বাগত জানায়। চেক আউট GitHub সংগ্রহস্থল সমস্যা, বৈশিষ্ট্য অনুরোধ, এবং অবদান নির্দেশিকা জন্য.
ক্লাউড ও বিলিং
4একটি WebBrain ক্লাউড সাবস্ক্রিপশন কত?
WebBrain ক্লাউড বর্তমানে ডিভাইস প্রোফাইল প্রতি $5/মাস, আপাতত Claude Pro থেকে অনেক সস্তা। ন্যায্য ব্যবহার নীতির অধীনে ব্যবহার বর্তমানে সীমাহীন: স্বাভাবিক ব্যক্তিগত ব্যবহার জরিমানা, কিন্তু অপমানজনক, স্বয়ংক্রিয়, পুনরায় বিক্রয়, বা অস্বাভাবিকভাবে উচ্চ-ভলিউম ব্যবহার অনুমোদিত নয়।
সাবস্ক্রিপশনটি সেই ব্রাউজার + OS GUID-এর এক্সটেনশন দ্বারা তৈরি ডিভাইস শনাক্তকারীর সাথে লিঙ্ক করা হয়েছে, ব্যবহারকারীর অ্যাকাউন্টে নয়। যদি সেই শনাক্তকারী হারিয়ে যায় কারণ আপনি এক্সটেনশন স্টোরেজ রিসেট করেন, ব্রাউজার প্রোফাইল মুছুন, ব্রাউজার পুনরায় ইনস্টল করেন, ব্রাউজার/OS পরিবর্তন করেন বা ডিভাইসটি হারান, আমরা এটি পুনরুদ্ধার বা স্থানান্তর করতে পারি না এবং সেই ক্ষতির জন্য আমরা ফেরত প্রদান করি না।
আমি কীভাবে আমার সাবস্ক্রিপশন পরিচালনা বা বাতিল করব?
api.webbrain.one/account-এ বিলিং পরিচালনা করুন এবং আপনার ইমেল দিয়ে লগ ইন করুন।
এনক্রিপ্ট করা ক্লাউড সিঙ্ক কিভাবে কাজ করে?
ক্লাউড সিঙ্ক সক্রিয় WebBrain ক্লাউড গ্রাহকদের জন্য একটি ঐচ্ছিক বৈশিষ্ট্য। এটি আপনার WebBrain স্মৃতি, প্রোফাইল অটো-ফিল টেক্সট এবং API কী সহ সমর্থিত প্রদানকারী কনফিগারেশন সিঙ্ক করে। এটা করে না চ্যাট ইতিহাস, ব্রাউজার ইতিহাস, পৃষ্ঠার স্ক্রিনশট বা লিগ্যাসি OAuth অ্যাক্সেস এবং রিফ্রেশ টোকেন সিঙ্ক করুন।
আপনার বেছে নেওয়া পাসওয়ার্ড দিয়ে আপলোড করার আগে আপনার ব্রাউজার সিঙ্ক ভল্ট এনক্রিপ্ট করে। WebBrain ক্লাউড শুধুমাত্র এনক্রিপ্ট করা ভল্ট সঞ্চয় করে; এটি আপনার স্মৃতি, প্রোফাইল পাঠ্য, প্রদানকারী সেটিংস, বা API কীগুলি পড়তে পারে না এবং এটি আপনার জন্য সিঙ্ক পাসওয়ার্ড পুনরুদ্ধার করতে পারে না৷
ইমেল ক্ষেত্রটি WebBrain ক্লাউড ম্যাজিক-লিঙ্ক বিলিং/সাবস্ক্রিপশন প্রমাণীকরণের জন্য। এটি একটি অ্যাকাউন্ট পাসওয়ার্ড নয়. যদি UI বলে ক্লাউড সিঙ্কে পাসওয়ার্ড পরিবর্তন করুন, এর অর্থ হল সিঙ্ক এনক্রিপশন পাসওয়ার্ড, একটি WebBrain অ্যাকাউন্ট পাসওয়ার্ড নয়৷
আপনি সিঙ্ক পাসওয়ার্ড ভুলে গেলে, পুরানো এনক্রিপ্ট করা ক্লাউড ভল্ট ডিক্রিপ্ট করা যাবে না। আপনি ক্লাউড ভল্ট রিসেট করতে পারেন এবং এমন একটি ডিভাইস থেকে একটি নতুন এনক্রিপ্ট করা কপি আপলোড করতে পারেন যেখানে এখনও স্থানীয়ভাবে ডেটা রয়েছে৷
কিভাবে WebBrain ক্লাউড এলএলএম বিল নিয়ন্ত্রণে রাখে?
তিনটি স্বাধীন স্তর:
টোকেন-সচেতন স্ক্রিনশট। কোনো ছবি আপনার মেশিন ছেড়ে যাওয়ার আগে, WebBrain এটির আকার পরিবর্তন করে (সংক্ষিপ্ত সাইড ক্যাপড, অ্যাসপেক্ট রেশিও সংরক্ষণ করে) এবং পুনরাবৃত্তিমূলকভাবে JPEG-সংকুচিত করে যতক্ষণ না এটি প্রতি-টার্ন ইমেজ-টোকেন বাজেটে ফিট করে। একটি 2000×1200 স্ক্রিনশট যেটির জন্য আপনার GPT-4o তে ~1,500 ইনপুট টোকেন খরচ হবে ~300-500 টোকেনে কম্প্রেস হয়ে পৃষ্ঠা-পড়ার কাজগুলির জন্য কোনও ব্যবহারিক ক্ষতি ছাড়াই। তে বাস্তবায়িত হয় _fitImageDimensions বাজেট গণিত জন্য ইউনিট পরীক্ষার সঙ্গে.
স্মার্ট প্রসঙ্গ ছাঁটাই। কথোপকথনের ইতিহাস, টুল আউটপুট, এবং ইনলাইন DOM ডাম্পগুলি প্রতি টার্নে আবদ্ধ থাকে এবং সক্রিয় মডেলের প্রসঙ্গ উইন্ডোটি পূর্ণ হওয়ার সময় সবচেয়ে পুরনো-প্রথম ছাঁটাই করা হয়। আপনি 10k টোকেন থেকে 100k পর্যন্ত নীরবে বেলুন চালাতে দেখতে পাবেন না কারণ একটি read_page একটি উপন্যাস-দৈর্ঘ্য নিবন্ধ ফিরে.
ডেডিকেটেড ভিশন মডেল। শুধুমাত্র স্ক্রিনশটগুলির জন্য একটি পৃথক দৃষ্টি-সক্ষম মডেলের (যেমন GPT-4o) সাথে পরিকল্পনা এবং টুল কলের জন্য একটি সস্তা টেক্সট মডেল (যেমন GPT-4o-mini) যুক্ত করুন, তাই আপনি প্রতিটি একক মোড়তে মাল্টিমোডাল-মডেল মূল্য পরিশোধ করবেন না৷ অধীনে কনফিগার করুন সেটিংস → দৃষ্টি.
নেট ফলাফল: ক্লাউড প্রদানকারীদের সাথে দীর্ঘ সেশন অনুমানযোগ্য থাকে। সম্পূর্ণ নিয়ন্ত্রণের জন্য, স্থানীয়ভাবে llama.cpp ব্যবহার করুন — টোকেন প্রতি শূন্য খরচ।
মডেল ও স্থানীয় সেটআপ
7আমি কি পুরোপুরি অফলাইনে WebBrain ব্যবহার করতে পারি?
হ্যাঁ। WebBrain এর ডিফল্ট প্রদানকারী হল llama.cpp, যেটি আপনার কম্পিউটারে একটি স্থানীয় AI মডেল চালায়। কোনো API কী প্রয়োজন নেই, AI-এর জন্য কোনো ইন্টারনেটের প্রয়োজন নেই এবং কোনো ডেটা কখনোই আপনার মেশিন ছেড়ে যায় না। শুধু একটি GGUF মডেল ডাউনলোড করুন, llama-server শুরু করুন এবং আপনার কাছে একটি সম্পূর্ণ ব্যক্তিগত AI ব্রাউজার এজেন্ট আছে৷ আপনি Ollama এর OpenAI- সামঞ্জস্যপূর্ণ এন্ডপয়েন্ট সহ ব্যবহার করতে পারেন।
কোন AI মডেল WebBrain সমর্থন করে?
WebBrain চারটি প্রদানকারীর প্রকারকে সমর্থন করে: llama.cpp (যে কোনো স্থানীয় GGUF মডেল), OpenAI (GPT-4o, GPT-4, ইত্যাদি), Claude (Claude Opus, Sonnet, Haiku এর মাধ্যমে স্থানীয় API), এবং OpenRouter (বিভিন্ন প্রদানকারীর থেকে 100+ মডেলে অ্যাক্সেস)। যেকোনো OpenAI- সামঞ্জস্যপূর্ণ API এন্ডপয়েন্ট কাজ করে, তাই আপনি Together AI, Groq, Mistral বা OpenAI- সামঞ্জস্যপূর্ণ ইন্টারফেসের সাথে যেকোনো স্থানীয় সার্ভারের মতো পরিষেবাগুলিও ব্যবহার করতে পারেন।
সবচেয়ে প্রস্তাবিত মডেল কি?
হিসাবে এপ্রিল 21, 2026, শীর্ষ সুপারিশ হয় Qwen 3.6 35B. কেন: আমাদের ভিশন বেঞ্চমার্কে (দৃষ্টি-মডেল-শুটআউট), এটি স্থানীয় অনুমানের জন্য ব্যবহারিক থাকাকালীন স্ক্রিনশট বোঝার ক্ষেত্রে Gemma 4-কে ছাড়িয়ে গেছে।
ভোক্তা GPU গুলির জন্য, RTX 5090 আদর্শ, এবং RTX 4090 প্রায়শই INT4 অটোরাউন্ড কোয়ান্টাইজেশনের মাধ্যমে কার্যকর হয় Intel/Qwen3.6-35B-A3B-int4-অটোরাউন্ড.
সর্বাধিক গতির জন্য, আমরা পরিবেশন করার পরামর্শ দিই ভিএলএলএম. নমুনা আদেশ:
python -u -m vllm.entrypoints.openai.api_server --model Intel/Qwen3.6-35B-A3B-int4-AutoRound --served-model-name qwen3.6-35b --quantization auto --dtype bfloat16 --max-model-len 65536 --max-num-batched-tokens 32768 --max-num-seqs 4 --host 0.0.0.0 --port 8000 --gpu-memory-utilization 0.92 --enable-prefix-caching --enable-chunked-prefill --limit-mm-per-prompt '{"image": 4, "video": 1}' --mm-processor-cache-type shm --reasoning-parser qwen3 --enable-auto-tool-choice --tool-call-parser qwen3_coder --trust-remote-code --allowed-origins '["*"]' --speculative-config '{"method": "dflash", "model": "z-lab/Qwen3.6-35B-A3B-DFlash", "num_speculative_tokens": 15}' --attention-backend flash_attn
DFlash অনুমানমূলক ডিকোডিং ঐচ্ছিক।
WebGPU কেন শুধু Apocalypse Mode-এ পাওয়া যায়?
কারণ আমরা এখনও ব্রাউজারের ভেতরের WebGPU টেক্সট ইনফারেন্সকে অধিকাংশ ব্যবহারকারীর জন্য যথেষ্ট ভালো মনে করি না, এবং আমরা চাই না আপনাকে খারাপ অভিজ্ঞতা সহ্য করতে হোক। একই LFM2.5 2.6B মডেল স্থানীয়ভাবে ব্যবহার করতে চাইলে নিজের মেশিনে llama.cpp বা Ollama দিয়ে ইনফারেন্স চালান এবং WebGPU-র ওপর নির্ভর না করে WebBrain-কে সেই স্থানীয় এন্ডপয়েন্টে সংযুক্ত করুন।
WebGPU ভিশন ফলব্যাকটি চালু আছে, কারণ এর মডেল অনেক ছোট এবং ফলব্যাকটি কেবল মাঝেমধ্যে ব্যবহার হয়।
আমার নেটওয়ার্কে স্থানীয় LLM সার্ভারে (vLLM, Ollama, llama.cpp) সংযোগ করার সময় আমি "আনয়নে ব্যর্থ" পাচ্ছি
যদি আপনার LLM সার্ভারটি আপনার স্থানীয় নেটওয়ার্কে একটি ভিন্ন মেশিনে থাকে (যেমন http://192.168.1.x:8000), Chrome অনুরোধ ব্লক করে যদি না সার্ভার পাঠায় CORS হেডার. ফিক্স আপনার সার্ভারের উপর নির্ভর করে:
ভিএলএলএম: দিয়ে শুরু করুন --allowed-origins '["*"]' (মান অবশ্যই একটি JSON তালিকা হতে হবে)।
Ollama: পরিবেশ পরিবর্তনশীল সেট করুন OLLAMA_ORIGINS=* শুরু করার আগে।
llama.cpp: CORS ডিফল্টরূপে সক্রিয় আছে — কোনো পরিবর্তনের প্রয়োজন নেই।
যদি আপনার সার্ভার চালু হয় localhost (ব্রাউজার হিসাবে একই মেশিন), CORS সাধারণত প্রয়োজন হয় না। সমস্যাটি শুধুমাত্র স্থানীয় নেটওয়ার্কে ক্রস-মেশিন সংযোগগুলিকে প্রভাবিত করে৷ নিশ্চিত করুন যে WebBrain সেটিংসে আপনার বেস URL এর সাথে শেষ হয়েছে৷ /v1 (যেমন http://192.168.1.47:8000/v1) ব্যতিক্রম: একটি ব্রাউজার এক্সটেনশন থেকে ব্যবহৃত Ollama এখনও প্রয়োজন হতে পারে OLLAMA_ORIGINS; নীচের Ollama FAQ দেখুন৷
কেন Ollama localhost-এ WebBrain এক্সটেনশন থেকে 403 ফেরত দেয়?
সাম্প্রতিক Ollama সংস্করণগুলি ব্রাউজার-এক্সটেনশন উত্স থেকে অনুরোধ প্রত্যাখ্যান করতে পারে এমনকি যখন Ollama একই মেশিনে চলছে৷ এক্সটেনশন একটি পাঠায় Origin যেমন chrome-extension://... বা moz-extension://..., এবং Ollama 403 এর উত্তর দিতে পারে যদি না সেই উত্সগুলি অনুমোদিত হয়৷
যেকোনও Ollama ডেস্কটপ অ্যাপ থেকে প্রস্থান করুন যা ইতিমধ্যেই পোর্ট ধরে রেখেছে 11434, তারপর এই কমান্ডগুলির একটি দিয়ে Ollama শুরু করুন:
OLLAMA_ORIGINS="*" ollama serveOLLAMA_ORIGINS="chrome-extension://*,moz-extension://*" ollama serve
WebBrain এর Ollama বেস ইউআরএল সেট রাখুন http://localhost:11434/v1. টার্মিনাল curl চেকগুলি এখনও এই সেটিং ছাড়াই কাজ করতে পারে কারণ তারা ব্রাউজার-এক্সটেনশন মূল পাঠায় না৷
আমি কি এটি LM Studio তেও ব্যবহার করতে পারি?
হ্যাঁ। WebBrain-এর শুধুমাত্র পঠনযোগ্য নেটওয়ার্ক টুলস — fetch_url এবং research_url - এছাড়াও একটি স্বতন্ত্র হিসাবে জাহাজ LM Studio এ প্লাগইন করুন ওয়েবব্রেন/ওয়েব-টুল. দিয়ে ইনস্টল করুন lms clone webbrain/web-tools এবং যেকোনো LM Studio চ্যাটে এটিকে টগল করুন — যেকোনো টুল-সক্ষম মডেল আপনি ব্রাউজার এক্সটেনশন ইনস্টল না করেই সেই দুটি টুলকে কল করতে পারেন। বিশুদ্ধ নোড, কোন হেডলেস ব্রাউজার। সূত্র: lmstudio-প্লাগইন/.
ব্রাউজার ও দৈনন্দিন ব্যবহার
5আমি কি Firefox সাইডবারকে Chrome এর সাইড প্যানেলের মতো বাম থেকে ডানে সরাতে পারি?
হ্যাঁ — Firefox এর সাইডবার বাম দিকে ডিফল্ট, কিন্তু আপনি এটি উল্টাতে পারেন। সাইডবার হেডারের যেকোনো জায়গায় ডান-ক্লিক করুন এবং নির্বাচন করুন সাইডবার ডানে সরান (বা ব্যবহার করুন দেখুন → সাইডবার → সাইডবার ডানদিকে সরান মেনু বার থেকে)। পুনঃসূচনা জুড়ে অবস্থান অব্যাহত থাকে। Chrome এর সাইডপ্যানেল ডানদিকে ডিফল্ট এবং প্যানেল থেকেই ব্যবহারকারী-চলবে না।
Vivaldi এর ওয়েব প্যানেলে WebBrain ব্যবহার করার সময় কোন সীমাবদ্ধতা আছে?
হ্যাঁ। Vivaldi ওয়েব প্যানেল নেটিভ জাভাস্ক্রিপ্ট ডায়ালগগুলিকে দমন করে যেমন confirm(), alert(), এবং prompt(). WebBrain এর আস্ক, অ্যাক্ট, এবং ডেভ মোড সুইচ আর সেই ডায়ালগের উপর নির্ভর করে না, কিন্তু কিছু গৌণ ক্রিয়া এখনও করে।
রেকর্ডিং: ব্যবহার করবেন না /record আপাতত ভিভাল্ডিতে। রেকর্ডিং ব্যর্থ হলে, Vivaldi ত্রুটি সতর্কতা আড়াল করতে পারেন এবং কোন দৃশ্যমান ব্যাখ্যা ছেড়ে যেতে পারে.
সেটিংস, ইতিহাস, ট্রেস, এবং Ollama হ্যান্ডঅফ: এগুলিতে নেটিভ ডায়ালগগুলিও রয়েছে, তবে WebBrain সাধারণত সেগুলিকে নিয়মিত ট্যাব হিসাবে খোলে, যেখানে তারা কাজ করে৷ আপনি যদি ম্যানুয়ালি একটি ওয়েব প্যানেলে রাখেন, ডায়ালগ-নির্ভর ক্রিয়াগুলি ব্যবহার করার আগে এটি একটি সাধারণ ট্যাবে খুলুন।
WebBrain আমার ট্যাবে কাজ করার সময় আমি কি উপরে বা নিচে স্ক্রল করতে পারি?
বেশির ভাগ সময়ই পারেন — বিশেষ করে “এই পৃষ্ঠাটি সংক্ষেপে বলো” ধরনের শুধু-পঠন অনুরোধে Ask মোডে। WebBrain কাজ করার সময় আপনি স্ক্রল করা চালিয়ে যেতে পারেন।
কখন এটি এড়িয়ে চলা উচিত? স্বয়ংক্রিয় স্ক্রিনশট ট্যাবের বর্তমান ভিউপোর্ট দেখায়। WebBrain যখন Act বা Dev মোডে দৃশ্যমান বিষয়বস্তু সক্রিয়ভাবে পরীক্ষা করে বা তার সঙ্গে ইন্টারঅ্যাক্ট করে, তখন স্ক্রল করলে লক্ষ্য সরে যেতে পারে বা মডেল যা দেখছে তা বদলে যেতে পারে। স্ক্রল করার আগে ওই ধাপটি শেষ হতে দিন; এই সময়গুলো ছাড়া আপনি পৃষ্ঠাটি ব্যবহার করা চালিয়ে যেতে পারেন।
WebBrain একটি পৃষ্ঠায় কাজ করার সময় আমি কি অন্য ট্যাবে স্যুইচ করতে পারি?
হ্যাঁ। 27.0.0 সংস্করণ থেকে, সামনের ট্যাবে প্রবেশ একান্ত প্রয়োজন না হলে WebBrain Chromium-ভিত্তিক ব্রাউজার ও Firefox—কোনোটিতেই ফোকাস কেড়ে নেয় না। রানটি যে ট্যাবে শুরু হয়েছিল তার সঙ্গেই যুক্ত থাকে, তাই আপনি নিরাপদে অন্য ট্যাবে কাজ করতে পারেন।
কোনো বিরল ধাপে মূল ট্যাবটি সামনে আনার প্রয়োজন হলে WebBrain অল্প সময়ের জন্য সেটিতে ফোকাস করতে পারে। WebBrain একই ট্যাবে সক্রিয়ভাবে কাজ করার সময় সেখানে ক্লিক বা টাইপ করা এড়িয়ে চলুন।
WebBrain কুকি ব্যানার এবং পেওয়ালের সাথে কি করে?
কুকি ব্যানার: WebBrain সাধারণ ফ্রেমওয়ার্ক (OneTrust, Cookiebot, Didomi, Quantcast, Google Funding Choices, TrustArc) থেকে সম্মতি ব্যানারগুলিকে স্বীকৃতি দেয় এবং পৃষ্ঠা সম্পর্কে যুক্তি দেওয়ার আগে সেগুলিকে খারিজ করে দেয়। অগ্রাধিকার হল "সমস্ত প্রত্যাখ্যান করুন" / "অপ্রয়োজনীয় প্রত্যাখ্যান করুন" / "শুধুমাত্র প্রয়োজনীয়" যখন স্পষ্টভাবে দৃশ্যমান হয়; এটি "অভিরুচি পরিচালনা করুন" গোলকধাঁধায় অদৃশ্য হয়ে যাওয়ার পরিবর্তে "সব স্বীকার করুন" এ ফিরে আসে।
পেওয়াল: WebBrain সততার সাথে পেওয়ালের রিপোর্ট করে এবং আপনাকে বলে যে এটি আসলে কী দেখতে পারে (শিরোনাম, ডেক, প্রথম অনুচ্ছেদ)। এটা করে না পেওয়াল বাইপাস করার চেষ্টা করুন — কোনো archive.today, 12ft.io, কুকি ক্লিয়ারিং, JS অক্ষম করা বা রিডার-মোড কৌশল নেই। আপনি যদি সম্পূর্ণ নিবন্ধটি চান, একটি সদস্যতার সাথে লগ ইন করুন বা একই গল্পের বিনামূল্যে কভারেজ দেখতে WebBrain কে জিজ্ঞাসা করুন৷
নিরাপত্তা ও গোপনীয়তা
7WebBrain ব্যবহার করা কি নিরাপদ? এটা ওয়েব পেজ পরিবর্তন করতে পারেন?
WebBrain তিনটি মোড আছে। আস্ক মোড (ডিফল্ট) শুধুমাত্র পঠনযোগ্য এবং পৃষ্ঠায় কিছু পরিবর্তন করতে পারে না। অ্যাক্ট মোড ব্রাউজার অ্যাকশনগুলিকে সক্ষম করে যেমন ক্লিক করা, টাইপ করা এবং নেভিগেট করা, যখন ডেভ মোড পৃষ্ঠা-ডিবাগিং টুল যোগ করে। পরিণতিমূলক ক্রিয়াগুলির জন্য ডিফল্টরূপে অনুমোদনের প্রয়োজন হয়; যদি সেই অনুমতি গেটটি বন্ধ থাকে, WebBrain একটি দৃশ্যমান সতর্কতা ব্যানার প্রদর্শন করে৷ আপনি স্টপ বোতাম দিয়ে যে কোনো সময় এজেন্টকে থামাতে পারেন। এক্সটেনশনের সোর্স কোড GitHub-এ নিরীক্ষার জন্য সম্পূর্ণ উন্মুক্ত।
"WebBrain এই ব্রাউজারটি ডিবাগ করা শুরু করেছে" ব্যানার কি? কেন WebBrain CDP ব্যবহার করে?
একটি পৃষ্ঠায় নির্ভরযোগ্যভাবে কাজ করতে, WebBrain স্ট্যান্ডার্ডের মাধ্যমে Chrome DevTools প্রোটোকল (CDP) ব্যবহার করে chrome.debugger এক্সটেনশন API — এটিই Chrome এর "WebBrain এই ব্রাউজারটিকে ডিবাগ করা শুরু করেছে" ব্যানারটিকে ট্রিগার করে৷ CDP যা এজেন্টকে ক্লিক করতে এবং টাইপ করতে দেয় বিশ্বস্ত ইনপুট ইভেন্ট যে আধুনিক সাইট আসলে সম্মান; একটি বিষয়বস্তু স্ক্রিপ্ট থেকে বহিষ্কৃত সিন্থেটিক ইভেন্টগুলি অনেক সাইট, ওয়েব উপাদান এবং ফ্রেমওয়ার্ক-নিয়ন্ত্রিত ইনপুট দ্বারা প্রত্যাখ্যাত হয়। এটিও যেভাবে WebBrain ভিশন ফলব্যাকের জন্য পিক্সেল-সঠিক স্ক্রিনশট ক্যাপচার করে এবং এতে পৌঁছায় ক্রস-অরিজিন iframes এবং ছায়া DOM যে বিষয়বস্তু স্ক্রিপ্ট দেখতে পারে না.
শুধুমাত্র পঠনযোগ্য আস্ক মোডের সিডিপির প্রয়োজন নেই — পৃষ্ঠা এবং অ্যাক্সেসিবিলিটি-ট্রি রিডগুলি সাধারণ কন্টেন্ট স্ক্রিপ্টের মধ্য দিয়ে যায়। এটা অ্যাক্ট মোড নির্ভরযোগ্যতা এবং ক্রস-অরিজিন কাজ যার জন্য এটি প্রয়োজন, এবং একটি ম্যানিফেস্ট V3 এক্সটেনশনে বিশ্বস্ত ইনপুটের জন্য কোনও নন-ডিবাগার API নেই। WebBrain ডিবাগার সংযুক্ত করে শুধুমাত্র যখন একটি কর্মের প্রয়োজন হয়, প্রতি ট্যাব, এবং পুরো এক্সটেনশনটি ওপেন-সোর্স যাতে আপনি সেশনটি ঠিক কী করে তা নিরীক্ষণ করতে পারেন। CDP শক্তিশালী, তাই আমরা এর পদচিহ্নকে ধারণ করার মতো কিছু হিসাবে বিবেচনা করি — চাহিদা অনুযায়ী সংযুক্ত করুন, এটিকে পড়া বন্ধ রাখুন — এবং এটি আরও কঠোর করা আমাদের নিরাপত্তা রোডম্যাপে রয়েছে।
এটা আমাকে অনেক প্রশ্ন জিজ্ঞাসা করছে. আমি কি অক্ষম করতে পারি?
এই অনুমোদনের অনুরোধগুলি আপনার নিরাপত্তার জন্য। এমনকি আপনি বিশ্বাস করেন এমন সাইটগুলিতেও, দূষিত অভিনেতারা LLM নির্দেশাবলী অনুকরণ করতে পারে বা এমন বিষয়বস্তু ইনজেকশন করতে পারে যা এজেন্টকে আপনার পক্ষে এমন কিছু করার চেষ্টা করে যা আপনি অনুমোদন করবেন না। এই কারণেই WebBrain ফলাফলমূলক কর্মের আগে জিজ্ঞাসা করে। আপনি যদি এখনও সেই প্রম্পটগুলির মধ্য দিয়ে যেতে না চান তবে টাইপ করুন /dangerously-skip-permissions সাইড প্যানেলে, বা সাইড প্লাগইন খুলুন, হেডারে হুইল আইকনে ক্লিক করুন, যান অনুমতি ট্যাব ইন settings.html, এবং সুইচ অফ ফলাফলমূলক কর্মের আগে জিজ্ঞাসা করুন.
WebBrain কি সরাসরি API-কে কল করে, নাকি সবসময় UI এর মাধ্যমে ক্লিক করে?
ডিফল্টরূপে, WebBrain সর্বদা দৃশ্যমান UI এর মাধ্যমে যায় যেকোন ক্রিয়াকলাপের জন্য যা তৈরি করে, সংশোধন করে, মুছে দেয়, পাঠায়, জমা দেয়, পোস্ট করে বা কিছু কিনে। এটি পৃষ্ঠায় নেভিগেট করবে, ফর্মটি পূরণ করবে এবং বোতামে ক্লিক করবে — ঠিক যেভাবে আপনি চান৷ এটি ব্যাকগ্রাউন্ডের মাধ্যমে সরাসরি REST/GraphQL এন্ডপয়েন্ট কল করতে অস্বীকার করে fetch() মিউটেশনের জন্য। এটি ইচ্ছাকৃত: API অ্যাকশনগুলি অদৃশ্য (আপনি কী পাঠানো হচ্ছে তা দেখতে পাচ্ছেন না), প্রায়শই আলাদা প্রমাণীকরণ টোকেন প্রয়োজন যা আপনি কনফিগার নাও করতে পারেন এবং দৃশ্যমান ভুল-ক্লিকের চেয়ে অনেক বড় ব্লাস্ট ব্যাসার্ধ রয়েছে৷ UI- প্রথম মানে সবকিছু স্ক্রিনে, আপনার সাধারণ ব্রাউজার সেশনে এবং থামানো যায়।
জন্য পড়া ডেটা — একটি README আনা, একটি সমস্যা খোঁজা, সাইট জুড়ে দামের তুলনা করা, একটি স্থিতি পৃষ্ঠা পরীক্ষা করা — WebBrain অবাধে এর মাধ্যমে ব্যাকগ্রাউন্ড HTTP অনুরোধগুলি ব্যবহার করে fetch_url এবং research_url টুলস পড়া অভিনয়ের মতো নয়; এটি একটি দূরবর্তী পরিষেবাতে কিছু পরিবর্তন করে না, তাই নিরাপত্তা উদ্বেগ প্রযোজ্য নয়।
আপনি যদি বিশেষভাবে একটি নির্দিষ্ট কাজের জন্য API মিউটেশনের অনুমতি দিতে চান তবে টাইপ করুন /allow-api আপনার বার্তার শুরুতে (ঐচ্ছিকভাবে একটি ছোট টাস্ক বর্ণনা দ্বারা অনুসরণ করা)। এই প্রতি-কথোপকথন ওভাররাইড WebBrain এপিআই এন্ডপয়েন্টে ফিরে যেতে দেয় যখন UI সত্যিকারের ব্যর্থ বা অকার্যকর হয়, যখন UI কাজ করে তখনও UI পছন্দ করে। ওভাররাইড সক্রিয় থাকাকালীন একটি স্টিকি ব্যাজ ইনপুট এলাকার উপরে দৃশ্যমান থাকে এবং আপনি কথোপকথন রিসেট করলে এটি পরিষ্কার হয়।
প্রোফাইল স্বয়ংক্রিয়ভাবে পূরণ কিভাবে কাজ করে, এবং এটি নিরাপদ?
প্রোফাইল অটো-ফিল হল একটি ঐচ্ছিক বৈশিষ্ট্য সেটিংস → প্রোফাইল. আপনি একটি সংক্ষিপ্ত জীবনী লিখুন — নাম, কাজের ইমেল, কোম্পানি, এবং ক নিক্ষেপ কম-স্টেকের সাইনআপের জন্য পাসওয়ার্ড — এবং এটিকে টগল করুন। সক্রিয় করা হলে, WebBrain সেই পাঠ্যটিকে এজেন্টের সিস্টেম প্রম্পটে যুক্ত করে যাতে এটি প্রতিবার জিজ্ঞাসা না করে সাইনআপ ফর্মগুলি পূরণ করতে পারে৷
টেক্সট সংরক্ষণ করা হয় প্লেইনটেক্সট আপনার ব্রাউজারের স্থানীয় স্টোরেজে। এটা না WebBrain প্রকল্পে প্রেরণ করা হয়েছে, কিন্তু এটি হয় সিস্টেম প্রম্পটের অংশ হিসাবে প্রতিটি মোড়ে আপনি যে LLM প্রদানকারীকে কনফিগার করেছেন তার কাছে পাঠানো হয়েছে। ডিফল্টরূপে বন্ধ।
গুরুত্বপূর্ণ অ্যাকাউন্টের জন্য পাসওয়ার্ড রাখবেন না (Google, Apple, iCloud, banking, work SSO, প্রাথমিক ইমেল) এখানে। এই অ্যাকাউন্টগুলি 2FA ব্যবহার করা উচিত এবং যাইহোক কোনও এজেন্টের কাছে হস্তান্তর করা উচিত নয়। নিউজলেটার সাইনআপ এবং বিনামূল্যে ট্রায়ালের জন্য আপনি যে পাসওয়ার্ডটি পুনঃব্যবহার করেন তা হল উদ্দেশ্যমূলক ব্যবহারের ক্ষেত্রে৷
স্ক্রিনশট রিডাকশন সেটিং কি গ্যারান্টি দেয় যে আমার ব্যক্তিগত ডেটা কখনই ক্লাউড ভিশন মডেলে পৌঁছাবে না?
না - এটি এক্সপোজার হ্রাস করে, এটি একটি গ্যারান্টি নয়। যখন সক্রিয় (সেটিংস → মাল্টিমোডাল → স্ক্রিনশট রিডাকশন, ডিফল্টরূপে বন্ধ), WebBrain পিক্সেলেট ক্ষেত্র এবং পাঠ্য গঠন করে যা প্রতিটি স্ক্রিনশটে একটি ইমেল ঠিকানা বা ফোন নম্বরের মতো দেখায় আগে এটি একটি দৃষ্টি মডেল পাঠানো হয়. DOM হিউরিস্টিকস ব্যবহার করে সনাক্তকরণ সম্পূর্ণরূপে আপনার ডিভাইসে চলে; অতিরিক্ত কিছুই প্রেরণ করা হয় না।
এটি সর্বোত্তম-প্রচেষ্টা এবং ব্যর্থ-খোলা। যদি ডিটেক্টর একটি পৃষ্ঠায় চলতে না পারে - উদাহরণস্বরূপ একটি নেভিগেশনের পরপরই, পিডিএফ ভিউয়ারে বা সীমাবদ্ধ ব্রাউজার পৃষ্ঠাগুলিতে - স্ক্রিনশট এখনও পাঠানো হয় unredacted আপনার কাজ বাতিল করার পরিবর্তে। DOM হিউরিস্টিকস যে বিষয়বস্তু দেখতে পারে না (ক্যানভাসে আঁকা পাঠ্য, চিত্রের ভিতরে PII, অস্বাভাবিক উইজেট) এছাড়াও স্লিপ হতে পারে। এবং সেটিং শুধুমাত্র স্ক্রিনশট কভার করে: পৃষ্ঠা পাঠ্য মডেল পাঠানো এটি দ্বারা সংশোধন করা হয় না.
সম্পূর্ণ দৃষ্টি গোপনীয়তার জন্য, একটি স্থানীয় মডেল ব্যবহার করুন. অফলাইন প্রদানকারীর সাথে যেমন llama.cpp বা Ollama, স্ক্রিনশট এবং পৃষ্ঠার পাঠ্য কখনই আপনার মেশিন থেকে যায় না, তাই প্রথম স্থানে সংশোধন করার কিছু নেই — এটিই একমাত্র কনফিগারেশন যেখানে গোপনীয়তা নিশ্চিত করা হয়৷ দেখুন "আমি কি পুরোপুরি অফলাইনে WebBrain ব্যবহার করতে পারি?" উপরে
এমন একটি মেশিন নেই যা একটি দৃষ্টি-সক্ষম স্থানীয় মডেল চালাতে পারে? একটি ভাল মিডল গ্রাউন্ড হল পরিকল্পনা এবং টুল কলের জন্য একটি ছোট স্থানীয় মডেল (একটি পরিমিত CPU/GPU-এর জন্য যথেষ্ট দ্রুত এবং হালকা) যা ভিশন সাব-কলের জন্য একটি ক্লাউড প্রদানকারীর সাথে যুক্ত, স্ক্রিনশট রিডাকশন চালু আছে। আপনি এখনও ডিভাইসে আপনার কথোপকথন এবং পৃষ্ঠার পাঠ্য রাখেন এবং ক্লাউড ভিশনের জন্য ছেড়ে যাওয়া প্রতিটি স্ক্রিনশটের ফর্ম ক্ষেত্র রয়েছে এবং সনাক্ত করা ইমেল/ফোনগুলি প্রথমে ঝাপসা করা হয়েছে — সম্পূর্ণ স্থানীয় দৃষ্টি মডেলের জন্য হার্ডওয়্যারের প্রয়োজন ছাড়াই ক্লাউড এক্সপোজার হ্রাস করা হয়েছে। অধীনে দৃষ্টি বিভক্ত কনফিগার করুন সেটিংস → দৃষ্টি (উপরে দেখুন "কিভাবে WebBrain ক্লাউড LLM বিল নিয়ন্ত্রণে রাখে?"
WebBrain কি পুরো DOM এআই মডেলে পাঠায়?
না। WebBrain ডিফল্টভাবে কাঁচা HTML বা কাঁচা DOM ডাম্প পাঠায় না। এটি পৃষ্ঠার URL ও শিরোনাম, প্রাসঙ্গিক সাইট নির্দেশনা এবং ভিশন চালু থাকলে ঐচ্ছিক ভিউপোর্ট স্ক্রিনশট দিয়ে শুরু করে।
কোনো কাজে পৃষ্ঠার বিষয়বস্তু দরকার হলে WebBrain চাহিদামতো একটি সংক্ষিপ্ত সেমান্টিক অ্যাক্সেসিবিলিটি ট্রি বা নিষ্কাশিত লেখা পড়ে। প্রয়োজন অনুযায়ী দৃশ্যমানতা ফিল্টার করা হয়, অক্ষরসীমা প্রয়োগ করা হয় এবং বড় ফলাফল পৃষ্ঠায় ভাগ করা হয়। কাঁচা পৃষ্ঠা-উৎস কেবল Dev মোডে পাওয়া যায়।
