Perguntas frequentes

Perguntas frequentes

Respostas rápidas sobre configuração, modelos, cobrança, segurança e como o WebBrain funciona no seu navegador.

Sobre o WebBrain

6
WebBrain é uma alternativa gratuita ao plugin do navegador de Claude?

Sim. WebBrain fornece recursos semelhantes de agente de navegador de IA – leitura de páginas, extração de dados, clique em botões, preenchimento de formulários e automatização de fluxos de trabalho de várias etapas. Ao contrário do plugin de navegador proprietário de Claude, que requer uma assinatura Claude Pro e só funciona com os modelos Anthropic, WebBrain é totalmente gratuito, de código aberto (licença MIT) e oferece suporte a vários provedores LLM, incluindo modelos locais que rodam inteiramente em sua máquina.

Como o WebBrain se compara ao OpenClaw, Browser-Use e outras estruturas de agente de IA?

São categorias diferentes de ferramentas. WebBrain é uma extensão do navegador – você a instala em Chrome ou Firefox e conversa com ela em um painel lateral, sem necessidade de codificação. Frameworks como OpenClaw e Browser-Use são SDKs de desenvolvedor para construir pipelines de navegador automatizados em Python, normalmente usando navegadores headless e CDP. Pense desta forma: WebBrain é para navegação diária com um assistente de IA; estruturas de agentes servem para construir bots de scraping e automação de testes. Você pode usar ambos – eles se complementam.

WebBrain funciona em Firefox?

Sim. WebBrain é fornecido com uma versão Chrome (Manifesto V3, usando a API sidePanel) e uma versão Firefox (Manifesto V2, usando sidebar_action). Ambas as versões possuem recursos idênticos. A versão Firefox pode ser carregada como um complemento temporário para desenvolvimento ou publicada em addons.mozilla.org para instalação permanente.

Como uso WebBrain para web scraping e extração de dados?

Basta abrir qualquer página da web, abrir o painel lateral WebBrain e perguntar em linguagem natural: "Extraia todos os nomes e preços de produtos desta página", "Obtenha todos os endereços de e-mail nesta página" ou "Resuma este artigo em marcadores". O agente de IA lê o conteúdo da página, entende a estrutura e retorna os dados extraídos. Para uma raspagem mais complexa, mude para o modo Act e o agente poderá navegar entre as páginas, clicar nos botões de paginação e agregar dados em várias páginas.

O WebBrain oferece suporte ao modo de simulação?

A partir de 7.0.0, ainda não. O modo de simulação está planejado e já está no roteiro.

Posso contribuir para WebBrain?

Absolutamente! WebBrain é licenciado pelo MIT e aceita contribuições. Confira o Repositório GitHub para problemas, solicitações de recursos e diretrizes de contribuição.

Nuvem e cobrança

4
Quanto custa uma assinatura do WebBrain Cloud?

WebBrain Nuvem está atualmente US$ 5/mês por perfil de dispositivo, muito mais barato que Claude Pro por enquanto. O uso é atualmente ilimitado de acordo com uma política de uso justo: o uso pessoal normal é aceitável, mas o uso abusivo, automatizado, de revenda ou de volume incomumente alto não é permitido.

A assinatura está vinculada ao identificador do dispositivo gerado pela extensão desse navegador + GUID do sistema operacional, e não a uma conta de usuário. Se esse identificador for perdido porque você redefiniu o armazenamento da extensão, excluiu o perfil do navegador, reinstalou o navegador, alterou o navegador/sistema operacional ou perdeu o dispositivo, não poderemos recuperá-lo ou transferi-lo e não emitimos reembolsos por essa perda.

Como gerencio ou cancelo minha assinatura?

Gerencie a cobrança em api.webbrain.one/account e entre usando seu e-mail.

Como funciona o Cloud Sync criptografado?

Cloud Sync é um recurso opcional para assinantes WebBrain Cloud ativos. Ele sincroniza suas memórias WebBrain, texto de preenchimento automático de perfil e configuração de provedor compatível, incluindo chaves de API. Isso acontece não sincronizar histórico de bate-papo, histórico do navegador, capturas de tela de páginas ou acesso OAuth legado e tokens de atualização.

Seu navegador criptografa o cofre de sincronização antes do upload com uma senha que você escolher. WebBrain Cloud armazena apenas o cofre criptografado; ele não pode ler suas memórias, texto do perfil, configurações do provedor ou chaves de API e não pode recuperar a senha de sincronização para você.

O campo de e-mail é para autenticação de assinatura/faturamento de link mágico WebBrain Cloud. Não é uma senha de conta. Se a IU disser alterar senha no Cloud Sync, isso significa que o senha de criptografia de sincronização, não uma senha de conta WebBrain.

Se você esquecer a senha de sincronização, o antigo cofre na nuvem criptografado não poderá ser descriptografado. Você pode redefinir o cofre na nuvem e fazer upload de uma nova cópia criptografada de um dispositivo que ainda tenha os dados localmente.

Como WebBrain mantém as contas do Cloud LLM sob controle?

Três camadas independentes:

Capturas de tela com reconhecimento de token. Antes de qualquer imagem sair de sua máquina, WebBrain a redimensiona (lado mais curto, preservando a proporção de aspecto) e a compacta iterativamente em JPEG até que ela caiba no orçamento de token de imagem por turno. Uma captura de tela de 2.000 × 1.200 que custaria cerca de 1.500 tokens de entrada no GPT-4o é compactada para cerca de 300-500 tokens sem perda prática para tarefas de leitura de página. Implementado em _fitImageDimensions com testes unitários para a matemática do orçamento.

Corte de contexto inteligente. O histórico de conversas, as saídas de ferramentas e os dumps DOM embutidos são limitados por turno e cortados mais antigos primeiro quando a janela de contexto do modelo ativo está quase cheia. Você não verá uma corrida silenciosa aumentar de 10 mil tokens para 100 mil porque um read_page retornou um artigo do tamanho de um romance.

Modelo de visão dedicado. Combine um modelo de texto barato (por exemplo, GPT-4o-mini) para planejamento e chamadas de ferramentas com um modelo separado com capacidade de visão (por exemplo, GPT-4o) apenas para capturas de tela, para que você não pague preços de modelos multimodais em cada curva. Configurar em Configurações → Visão.

Resultado líquido: longas sessões com provedores de nuvem permanecem previsíveis. Para controle total, use llama.cpp localmente – custo zero por token.

Modelos e configuração local

7
Posso usar o WebBrain totalmente offline?

Sim. O provedor padrão do WebBrain é llama.cpp, que executa um modelo de IA local em seu computador. Nenhuma chave de API é necessária, nenhuma Internet é necessária para a IA e nenhum dado sai de sua máquina. Basta baixar um modelo GGUF, iniciar o llama-server e você terá um agente de navegador de IA totalmente privado. Você também pode usar Ollama com seu endpoint compatível com OpenAI.

Quais modelos de IA o WebBrain suporta?

WebBrain oferece suporte a quatro tipos de provedores: llama.cpp (qualquer modelo GGUF local), OpenAI (GPT-4o, GPT-4, etc.), Claude (Claude Opus, Sonnet, Haiku via API nativa) e OpenRouter (acesso a mais de 100 modelos de vários fornecedores). Qualquer endpoint de API compatível com OpenAI funciona, então você também pode usar serviços como Together AI, Groq, Mistral ou qualquer servidor local com uma interface compatível com OpenAI.

Por que o WebGPU está disponível apenas no Modo Apocalipse?

Porque ainda não consideramos a inferência de texto via WebGPU no navegador boa o suficiente para a maioria dos usuários e não queremos que você tenha uma experiência ruim. Se quiser usar localmente o mesmo modelo LFM2.5 2.6B, execute a inferência na sua máquina com llama.cpp ou Ollama e aponte o WebBrain para esse endpoint local em vez de depender do WebGPU.

O fallback de visão via WebGPU continua disponível porque seu modelo é muito menor e esse fallback é usado apenas ocasionalmente.

Estou recebendo "Falha ao buscar" ao conectar-me a um servidor LLM local (vLLM, Ollama, llama.cpp) na minha rede

Se o seu servidor LLM estiver em uma máquina diferente na sua rede local (por exemplo, http://192.168.1.x:8000), Chrome bloqueia a solicitação, a menos que o servidor envie Cabeçalhos CORS. A correção depende do seu servidor:

vLLM: Comece com --allowed-origins '["*"]' (o valor deve ser uma lista JSON).
Ollama: Defina a variável de ambiente OLLAMA_ORIGINS=* antes de começar.
llama.cpp: O CORS está habilitado por padrão – nenhuma alteração é necessária.

Se o seu servidor for executado em localhost (mesma máquina do navegador), o CORS geralmente não é necessário. O problema afeta apenas conexões entre máquinas na rede local. Certifique-se de que seu URL base nas configurações WebBrain termine com /v1 (por exemplo http://192.168.1.47:8000/v1). Exceção: Ollama usado em uma extensão do navegador ainda pode precisar OLLAMA_ORIGINS; consulte as perguntas frequentes sobre Ollama abaixo.

Por que Ollama em localhost retorna 403 da extensão WebBrain?

Versões recentes do Ollama podem rejeitar solicitações de origens de extensão do navegador, mesmo quando o Ollama está sendo executado na mesma máquina. A extensão envia um Origin como chrome-extension://... ou moz-extension://...e Ollama podem responder 403, a menos que essas origens sejam permitidas.

Encerre qualquer aplicativo de desktop Ollama que já esteja segurando a porta 11434e inicie Ollama com um destes comandos:

OLLAMA_ORIGINS="*" ollama serve
OLLAMA_ORIGINS="chrome-extension://*,moz-extension://*" ollama serve

Mantenha o URL base WebBrain de Ollama definido como http://localhost:11434/v1. Terminais curl as verificações ainda podem funcionar sem essa configuração porque não enviam uma origem de extensão do navegador.

Posso usá-lo em LM Studio também?

Sim. Ferramentas de rede somente leitura do WebBrain — fetch_url e research_url - também enviado como independente LM Studio plug-in em webbrain / ferramentas da web. Instalar com lms clone webbrain/web-tools e ative-o em qualquer bate-papo LM Studio – qualquer modelo compatível com ferramentas pode chamar essas duas ferramentas sem você instalar a extensão do navegador. Pure Node, sem navegador sem cabeça. Fonte: plugin-lmstudio/.

Navegadores e uso diário

5
Posso mover a barra lateral do Firefox da esquerda para a direita, como o painel lateral do Chrome?

Sim – o padrão da barra lateral do Firefox é para a esquerda, mas você pode invertê-la. Clique com o botão direito em qualquer lugar no cabeçalho da barra lateral e escolha Mover a barra lateral para a direita (ou usar Exibir → Barra lateral → Mover barra lateral para a direita na barra de menu). A posição persiste durante as reinicializações. O sidePanel do Chrome é padronizado para a direita e não pode ser movido pelo usuário a partir do próprio painel.

Há alguma limitação ao usar WebBrain no Web Panel do Vivaldi?

Sim. Os Vivaldi Web Panels suprimem diálogos JavaScript nativos, como confirm(), alert()e prompt(). A alternância dos modos Ask, Act e Dev do WebBrain não depende mais dessas caixas de diálogo, mas algumas ações secundárias ainda dependem.

Gravação: Não use /record em Vivaldi por enquanto. Se a gravação falhar, Vivaldi pode ocultar o alerta de erro e não deixar nenhuma explicação visível.

Configurações, histórico, rastreamentos e transferência Ollama: Eles também contêm caixas de diálogo nativas, mas WebBrain normalmente os abre como guias normais, onde funcionam. Se você colocar um manualmente em um Web Panel, abra-o em uma guia normal antes de usar ações dependentes de diálogo.

Posso rolar para cima ou para baixo enquanto o WebBrain trabalha na minha guia?

Na maioria das vezes, sim — especialmente no modo Ask para solicitações somente de leitura, como “Resuma esta página”. Você pode continuar rolando enquanto o WebBrain trabalha.

Quando devo evitar isso? As capturas automáticas refletem a área visível atual da guia. Enquanto o WebBrain inspeciona ou interage ativamente com conteúdo visível no modo Act ou Dev, a rolagem pode deslocar um alvo ou mudar o que o modelo vê. Deixe essa etapa terminar antes de rolar; fora desses momentos, você pode continuar usando a página.

Posso mudar para outra guia enquanto o WebBrain está trabalhando em uma página?

Sim. A partir da versão 27.0.0, o WebBrain evita tomar o foco tanto em navegadores baseados em Chromium quanto no Firefox, a menos que o acesso em primeiro plano seja estritamente necessário. A execução permanece vinculada à guia onde começou, portanto você pode trabalhar com segurança em outra guia.

Se uma etapa rara precisar da guia original em primeiro plano, o WebBrain poderá focalizá-la brevemente. Evite clicar ou digitar na mesma guia enquanto o WebBrain estiver agindo ativamente nela.

O que WebBrain faz com banners de cookies e acesso pago?

Banners de cookies: WebBrain reconhece banners de consentimento de estruturas comuns (OneTrust, Cookiebot, Didomi, Quantcast, Google Funding Choices, TrustArc) e os descarta antes de raciocinar sobre a página. A prioridade é “Rejeitar tudo” / “Rejeitar não essencial” / “Apenas necessário” quando claramente visível; ele volta para "Aceitar tudo" em vez de desaparecer no labirinto "Gerenciar preferências".

Acessos pagos: WebBrain relata o acesso pago honestamente e informa o que ele realmente pode ver (título, descrição, primeiros parágrafos). Isso acontece não tentativa de contornar paywalls – sem archive.today, 12ft.io, limpeza de cookies, desabilitação de JS ou truques de modo leitor. Se você quiser o artigo completo, faça login com uma assinatura ou peça ao WebBrain para procurar cobertura gratuita da mesma história.

Segurança e privacidade

7
O WebBrain é seguro para uso? Ele pode modificar páginas da web?

WebBrain possui três modos. O modo Ask (padrão) é somente leitura e não pode modificar nada na página. O modo Act permite ações do navegador, como clicar, digitar e navegar, enquanto o modo Dev adiciona ferramentas de depuração de página. Ações consequentes requerem aprovação por padrão; se esse portão de permissão estiver desativado, WebBrain exibirá um banner de aviso visível. Você pode parar o agente a qualquer momento com o botão Parar. O código-fonte da extensão está totalmente aberto para auditoria em GitHub.

O que é o banner "WebBrain iniciou a depuração deste navegador"? Por que WebBrain usa CDP?

Para atuar em uma página de maneira confiável, WebBrain usa o protocolo Chrome DevTools (CDP) por meio do padrão chrome.debugger API de extensão - é isso que aciona o banner "WebBrain começou a depurar este navegador" do Chrome. CDP é o que permite ao agente clicar e digitar com eventos de entrada confiáveis que os sites modernos realmente honram; eventos sintéticos disparados a partir de um script de conteúdo são rejeitados por muitos sites, componentes da Web e entradas controladas por estrutura. É também como o WebBrain captura capturas de tela com precisão de pixels para o retorno da visão e alcança iframes de origem cruzada e shadow DOM que os scripts de conteúdo não podem ver.

Somente leitura O modo Ask não precisa de CDP - as leituras de páginas e árvores de acessibilidade passam por scripts de conteúdo comuns. É Modo de ação confiabilidade e trabalho de origem cruzada que exigem isso, e em uma extensão do Manifest V3 não há API não depuradora para entrada confiável. WebBrain anexa o depurador somente quando uma ação precisa, por guia, e toda a extensão é de código aberto para que você possa auditar exatamente o que a sessão faz. O CDP é poderoso, por isso tratamos sua presença como algo a ser contido — anexamos sob demanda, mantemos leituras — e reforçar ainda mais isso está em nosso roteiro de segurança.

Está me fazendo muitas perguntas. Posso desativar isso?

Esses avisos de aprovação são para sua segurança. Mesmo em sites em que você confia, atores mal-intencionados podem imitar instruções do LLM ou injetar conteúdo que tente fazer com que o agente faça coisas em seu nome que você não aprovaria. É por isso que WebBrain pergunta antes de ações consequentes. Se você ainda não quiser seguir essas instruções, digite /dangerously-skip-permissions no painel lateral, ou abra o plugin lateral, clique no ícone de roda no cabeçalho, vá para o Permissões guia em settings.htmle desligue Pergunte antes de ações consequentes.

WebBrain chama APIs diretamente ou sempre clica na IU?

Por padrão, WebBrain sempre passa pela UI visível para qualquer ação que crie, modifique, exclua, envie, envie, publique ou compre qualquer coisa. Ele navegará até a página, preencherá o formulário e clicará no botão – exatamente como você faria. Ele se recusa a chamar endpoints REST/GraphQL diretamente em segundo plano fetch() para mutações. Isso é deliberado: as ações da API são invisíveis (você não vê o que está sendo enviado), geralmente exigem tokens de autenticação separados que você pode não ter configurado e têm um raio de explosão muito maior do que um clique errado visível. UI-first significa que tudo está na tela, na sessão normal do navegador, e pode ser interrompido.

Para lendo dados - buscando um README, procurando um problema, comparando preços entre sites, verificando uma página de status - WebBrain usa livremente solicitações HTTP em segundo plano por meio do fetch_url e research_url ferramentas. Ler não é o mesmo que atuar; isso não muda nada em um serviço remoto, portanto as preocupações de segurança não se aplicam.

Se você deseja permitir especificamente mutações de API para uma tarefa específica, digite /allow-api no início da sua mensagem (opcionalmente seguido por uma breve descrição da tarefa). Essa substituição por conversa permite que WebBrain retorne aos endpoints da API quando a IU estiver realmente falhando ou impraticável, ao mesmo tempo que ainda prefere a IU quando a IU funciona. Um emblema adesivo permanece visível acima da área de entrada enquanto a substituição está ativa e desaparece quando você reinicia a conversa.

Como funciona o preenchimento automático do perfil e é seguro?

O preenchimento automático do perfil é um recurso opcional no Configurações → Perfil. Você insere uma breve biografia - nome, e-mail comercial, empresa e um descartável senha para inscrições de apostas baixas – e ative-a. Quando ativado, WebBrain anexa esse texto ao prompt do sistema do agente para que ele possa preencher formulários de inscrição sem perguntar sempre.

O texto é armazenado em texto simples no armazenamento local do seu navegador. É não transmitido para o projeto WebBrain, mas é enviado para qualquer provedor LLM que você configurou a cada turno, como parte do prompt do sistema. Desativado por padrão.

Não coloque senhas para contas importantes (Google, Apple, iCloud, serviços bancários, SSO comercial, e-mail principal) aqui. Essas contas devem usar 2FA e, de qualquer maneira, não devem ser entregues a um agente. Uma senha descartável que você reutiliza para inscrições em boletins informativos e avaliações gratuitas é o caso de uso pretendido.

A configuração de redação de captura de tela garante que meus dados privados nunca cheguem a um modelo de visão em nuvem?

Não – reduz a exposição, não é uma garantia. Quando ativado (Configurações → Multimodal → Redação de captura de tela, desativado por padrão), WebBrain pixeliza campos de formulário e texto que se parece com um endereço de e-mail ou número de telefone em cada captura de tela antes ele é enviado para um modelo de visão. A detecção é executada inteiramente no seu dispositivo usando heurística DOM; nada extra é transmitido.

É o melhor esforço e a falha aberta. Se o detector não puder ser executado em uma página — por exemplo, imediatamente após uma navegação, em visualizadores de PDF ou em páginas restritas do navegador — a captura de tela ainda será enviada não editado em vez de abortar sua tarefa. O conteúdo que a heurística do DOM não consegue ver (texto desenhado em uma tela, PII dentro de imagens, widgets incomuns) também pode escapar. E a configuração cobre apenas capturas de tela: página texto enviado ao modelo não é editado por ele.

Para total privacidade visual, use um modelo local. Com um provedor off-line como llama.cpp ou Ollama, as capturas de tela e o texto da página nunca saem da sua máquina, portanto, em primeiro lugar, não há nada para editar — essa é a única configuração em que a privacidade é garantida. Consulte "Posso usar WebBrain totalmente offline?" acima.

Não tem uma máquina que possa executar um modelo local com capacidade de visão? Um bom meio-termo é um pequeno modelo local para planejamento e chamadas de ferramentas (rápido e leve o suficiente para uma CPU/GPU modesta) emparelhado com um provedor de nuvem para as subchamadas de visão, com a edição de captura de tela ativada. Você ainda mantém sua conversa e o texto da página no dispositivo, e cada captura de tela que sai para a visão na nuvem tem campos de formulário e e-mails/telefones detectados desfocados primeiro – exposição reduzida à nuvem sem a necessidade de hardware para um modelo de visão local completo. Configure a divisão de visão em Configurações → Visão (consulte "Como o WebBrain mantém as contas do Cloud LLM sob controle?" acima).

O WebBrain envia todo o DOM para o modelo de IA?

Não. Por padrão, o WebBrain não envia HTML bruto nem uma cópia bruta do DOM. Ele começa com o URL e o título da página, as orientações correspondentes ao site e, quando a visão está ativada, uma captura opcional da área visível.

Quando uma tarefa precisa do conteúdo da página, o WebBrain o lê sob demanda como uma árvore de acessibilidade semântica reduzida ou como texto extraído. As leituras são filtradas por visibilidade quando apropriado, têm limites de caracteres e são paginadas. O acesso ao código-fonte bruto da página está disponível apenas no modo Dev.