Preguntas frecuentes

Preguntas frecuentes

Respuestas rápidas sobre configuración, modelos, facturación, seguridad y el funcionamiento de WebBrain en tu navegador.

Acerca de WebBrain

6
¿Es WebBrain una alternativa gratuita al plugin de navegador de Claude?

Sí. WebBrain ofrece capacidades de agente de navegador con IA similares: leer páginas, extraer datos, hacer clic, rellenar formularios y automatizar flujos de varios pasos. A diferencia del plugin propietario de Claude, que requiere una suscripción a Claude Pro y solo funciona con los modelos de Anthropic, WebBrain es totalmente gratuito, de código abierto (licencia MIT) y admite varios proveedores de LLM incluidos modelos locales que se ejecutan íntegramente en tu máquina.

¿En qué se diferencia WebBrain de OpenClaw, Browser-Use y otros frameworks de agentes?

Son categorías distintas. WebBrain es una extensión de navegador: la instalas en Chrome o Firefox y chateas con ella en un panel lateral, sin código. Frameworks como OpenClaw y Browser-Use son SDK para desarrolladores que construyen pipelines automatizados en Python, habitualmente con navegadores headless y CDP. En una frase: WebBrain es para navegar día a día con un asistente de IA; los frameworks son para construir bots de scraping y automatización de pruebas. Puedes usar ambos — se complementan.

¿WebBrain funciona en Firefox?

Sí. WebBrain incluye tanto una versión para Chrome (Manifest V3, con la API sidePanel) como una versión para Firefox (Manifest V2, con sidebar_action). Ambas versiones tienen las mismas funciones. La versión de Firefox se puede cargar como complemento temporal para desarrollo o publicar en addons.mozilla.org para instalación permanente.

¿Cómo uso WebBrain para scraping y extracción de datos?

Abre cualquier página web, abre el panel lateral de WebBrain y pregunta en lenguaje natural: «Extrae todos los nombres y precios de productos de esta página», «Consigue todas las direcciones de correo de esta página» o «Resume este artículo en viñetas». El agente lee el contenido, entiende la estructura y devuelve los datos extraídos. Para scraping más complejo, cambia a modo Actuar y el agente puede navegar entre páginas, pulsar los botones de paginación y agregar datos de varias páginas.

¿WebBrain tiene modo de simulación (dry-run)?

A partir de la versión 7.0.0, todavía no. El modo dry-run está planificado y ya está en la hoja de ruta.

¿Puedo contribuir a WebBrain?

¡Por supuesto! WebBrain tiene licencia MIT y acepta contribuciones. Echa un vistazo al repositorio de GitHub para ver issues, solicitudes de funciones y pautas de contribución.

Nube y facturación

4
¿Cuánto cuesta una suscripción a WebBrain Cloud?

WebBrain Cloud cuesta actualmente 5 USD/mes por perfil de dispositivo, mucho menos que Claude Pro por ahora. El uso es actualmente ilimitado bajo una política de uso justo: el uso personal normal está bien, pero el uso abusivo, automatizado, de reventa o con volumen inusualmente alto no está permitido.

La suscripción está vinculada al identificador de dispositivo que genera la extensión para ese GUID de navegador + sistema operativo, no a una cuenta de usuario. Si ese identificador se pierde porque restableces el almacenamiento de la extensión, eliminas el perfil del navegador, reinstalas el navegador, cambias de navegador/SO o pierdes el dispositivo, no podemos recuperarlo ni transferirlo y no emitimos reembolsos por esa pérdida.

¿Cómo gestiono o cancelo mi suscripción?

Gestiona la facturación en api.webbrain.one/account e inicia sesión con tu correo electrónico.

¿Cómo funciona el Cloud Sync cifrado?

Cloud Sync es una función opcional para suscriptores activos de WebBrain Cloud. Sincroniza tus memorias de WebBrain, el texto de autocompletado del Perfil y la configuración de proveedores compatible, incluidas las claves API. No sincroniza el historial de chat, el historial del navegador, capturas de página ni tokens OAuth de acceso y actualización heredados.

Tu navegador cifra el vault de sincronización antes de subirlo con una contraseña que eliges. WebBrain Cloud solo almacena el vault cifrado; no puede leer tus memorias, texto de perfil, ajustes de proveedores ni claves API, y no puede recuperar la contraseña de sincronización por ti.

El campo de correo es para la autenticación de facturación/suscripción por magic-link de WebBrain Cloud. No es una contraseña de cuenta. Si la interfaz dice cambiar contraseña en Cloud Sync, se refiere a la contraseña de cifrado de sincronización, no a una contraseña de cuenta de WebBrain.

Si olvidas la contraseña de sincronización, el vault cifrado antiguo en la nube no se puede descifrar. Puedes restablecer el vault en la nube y subir una copia cifrada nueva desde un dispositivo que aún tenga los datos en local.

¿Cómo mantiene WebBrain controladas las facturas de los LLM en la nube?

Tres capas independientes:

Capturas con conciencia de tokens. Antes de que cualquier imagen salga de tu máquina, WebBrain la redimensiona (se limita el lado corto manteniendo la proporción) y la comprime iterativamente en JPEG hasta que encaja en el presupuesto de tokens de imagen por turno. Una captura de 2000×1200 que te costaría unos 1.500 tokens de entrada en GPT-4o se reduce a unos 300–500 tokens sin pérdida práctica para tareas de lectura de páginas. Implementado en _fitImageDimensions con pruebas unitarias del cálculo.

Recorte inteligente de contexto. El historial de conversación, la salida de herramientas y los volcados inline del DOM están acotados por turno y se recortan primero los más antiguos cuando el contexto del modelo activo se acerca al límite. No verás cómo una ejecución pasa silenciosamente de 10k tokens a 100k porque un read_page devolvió un artículo kilométrico.

Modelo de visión dedicado. Combina un modelo de texto barato (p. ej. GPT-4o-mini) para planificar y llamar a herramientas con un modelo de visión (p. ej. GPT-4o) solo para las capturas, de modo que no pagues precios de modelo multimodal en cada turno. Se configura en Ajustes → Visión.

Resultado: las sesiones largas con proveedores en la nube se mantienen predecibles. Para control total, usa llama.cpp local — coste por token cero.

Modelos y configuración local

7
¿Puedo usar WebBrain totalmente sin conexión?

Sí. El proveedor por defecto de WebBrain es llama.cpp, que ejecuta un modelo de IA local en tu ordenador. Sin claves de API, sin internet para la IA y sin que salga ningún dato de tu máquina. Solo descarga un modelo GGUF, arranca llama-server y tendrás un agente de IA totalmente privado. También puedes usar Ollama con su endpoint compatible con OpenAI.

¿Qué modelos de IA admite WebBrain?

WebBrain admite cuatro tipos de proveedor: llama.cpp (cualquier modelo GGUF local), OpenAI (GPT-4o, GPT-4, etc.), Claude (Claude Opus, Sonnet, Haiku mediante la API nativa) y OpenRouter (acceso a más de 100 modelos de varios proveedores). Cualquier endpoint compatible con OpenAI funciona, así que también puedes usar servicios como Together AI, Groq, Mistral o cualquier servidor local con interfaz compatible.

¿Por qué WebGPU solo está disponible en el Modo Apocalipsis?

Porque todavía no consideramos que la inferencia de texto mediante WebGPU dentro del navegador sea lo bastante buena para la mayoría de los usuarios, y no queremos que tengas que soportar una mala experiencia. Si quieres usar localmente el mismo modelo LFM2.5 2.6B, ejecuta la inferencia en tu equipo con llama.cpp u Ollama y configura WebBrain para que apunte a ese endpoint local en lugar de depender de WebGPU.

El respaldo de visión mediante WebGPU sigue disponible porque su modelo es mucho más pequeño y este respaldo solo se usa ocasionalmente.

Recibo «Failed to fetch» al conectar con un servidor LLM local (vLLM, Ollama, llama.cpp) en mi red

Si tu servidor LLM está en otra máquina de tu red local (por ejemplo http://192.168.1.x:8000), Chrome bloquea la petición salvo que el servidor envíe cabeceras CORS. La solución depende del servidor:

vLLM: arranca con --allowed-origins '["*"]' (el valor debe ser una lista JSON).
Ollama: define la variable de entorno OLLAMA_ORIGINS=* antes de arrancar.
llama.cpp: CORS está activado por defecto — no hay que cambiar nada.

Si tu servidor se ejecuta en localhost (la misma máquina que el navegador), normalmente no hace falta CORS. El problema afecta solo a conexiones entre máquinas en la red local. Asegúrate de que la URL base en los ajustes de WebBrain termina en /v1 (por ejemplo http://192.168.1.47:8000/v1). Excepción: Ollama usado desde una extensión de navegador puede seguir necesitando OLLAMA_ORIGINS; consulta la pregunta de Ollama más abajo.

¿Por qué Ollama en localhost devuelve 403 desde la extensión WebBrain?

Las versiones recientes de Ollama pueden rechazar solicitudes desde orígenes de extensiones del navegador aunque Ollama se ejecute en la misma máquina. La extensión envía un Origin como chrome-extension://... o moz-extension://..., y Ollama puede responder 403 si esos orígenes no están permitidos.

Cierra cualquier app de escritorio de Ollama que ya esté usando el puerto 11434 y luego inicia Ollama con uno de estos comandos:

OLLAMA_ORIGINS="*" ollama serve
OLLAMA_ORIGINS="chrome-extension://*,moz-extension://*" ollama serve

Mantén la URL base de Ollama en WebBrain como http://localhost:11434/v1. Las pruebas con curl en la terminal pueden seguir funcionando sin este ajuste porque no envían un origen de extensión del navegador.

¿Puedo usarlo también en LM Studio?

Sí. Las herramientas de red de solo lectura de WebBrain — fetch_url y research_url — también se publican como plugin independiente para LM Studio en webbrain/web-tools. Instálalo con lms clone webbrain/web-tools y actívalo en cualquier chat de LM Studio — cualquier modelo con soporte de herramientas podrá llamar a esas dos sin que tengas que instalar la extensión de navegador. Node puro, sin navegador headless. Código: lmstudio-plugin/.

Navegadores y uso diario

5
¿Puedo mover la barra lateral de Firefox de la izquierda a la derecha, como el panel lateral de Chrome?

Sí — la barra lateral de Firefox aparece a la izquierda por defecto, pero puedes invertirla. Haz clic derecho en cualquier parte de la cabecera de la barra lateral y elige Mover barra lateral a la derecha (o usa Ver → Barra lateral → Mover barra lateral a la derecha desde la barra de menús). La posición se mantiene tras reiniciar. El sidePanel de Chrome aparece a la derecha por defecto y no se puede mover por el usuario desde el propio panel.

¿Hay alguna limitación al usar WebBrain en el Web Panel de Vivaldi?

Sí. Los Web Panels de Vivaldi bloquean los diálogos nativos de JavaScript, como confirm(), alert() y prompt(). El selector de modos Preguntar, Actuar y Dev de WebBrain ya no depende de esos diálogos, pero algunas acciones secundarias todavía sí.

Grabación: Por ahora, no uses /record en Vivaldi. Si la grabación falla, Vivaldi puede ocultar la alerta de error y no mostrar ninguna explicación.

Ajustes, Historial, Trazas y traspaso a Ollama: Estas páginas también contienen diálogos nativos, pero WebBrain normalmente las abre como pestañas normales, donde funcionan. Si colocas alguna manualmente en un Web Panel, ábrela en una pestaña normal antes de usar acciones que dependan de diálogos.

¿Puedo desplazarme hacia arriba o abajo mientras WebBrain trabaja en mi pestaña?

La mayoría de las veces, sí — especialmente en modo Ask para solicitudes de solo lectura como «Resume esta página». Puedes seguir desplazándote mientras WebBrain trabaja.

¿Cuándo debería evitarlo? Las capturas automáticas reflejan el área visible actual de la pestaña. Mientras WebBrain inspecciona o interactúa activamente con contenido visible en modo Act o Dev, desplazarte puede mover un objetivo o cambiar lo que ve el modelo. Deja que termine ese paso antes de desplazarte; fuera de esos momentos, puedes seguir usando la página.

¿Puedo cambiar a otra pestaña mientras WebBrain trabaja en una página?

Sí. Desde la versión 27.0.0, WebBrain evita quitarte el foco tanto en navegadores basados en Chromium como en Firefox, salvo que el acceso en primer plano sea estrictamente necesario. La ejecución permanece vinculada a la pestaña donde comenzó, por lo que puedes trabajar con seguridad en otra pestaña.

Si algún paso poco frecuente necesita que la pestaña original esté en primer plano, WebBrain puede enfocarla brevemente. Evita hacer clic o escribir en la misma pestaña mientras WebBrain actúa activamente en ella.

¿Qué hace WebBrain con los banners de cookies y los muros de pago?

Banners de cookies: WebBrain reconoce banners de consentimiento de frameworks habituales (OneTrust, Cookiebot, Didomi, Quantcast, Google Funding Choices, TrustArc) y los descarta antes de razonar sobre la página. La prioridad es «Rechazar todo» / «Rechazar no esenciales» / «Solo necesarias» cuando son visibles; como recurso cae a «Aceptar todo» en lugar de desaparecer en el laberinto de «Gestionar preferencias».

Muros de pago: WebBrain informa del muro de pago con honestidad y te dice lo que pudo ver (titular, subtítulo, primeros párrafos). No intenta saltarse los muros de pago — ni archive.today, ni 12ft.io, ni borrado de cookies, ni desactivación de JS, ni trucos de modo lectura. Si quieres el artículo completo, inicia sesión con una suscripción o pide a WebBrain que busque cobertura gratuita de la misma historia.

Seguridad y privacidad

7
¿Es seguro usar WebBrain? ¿Puede modificar páginas web?

WebBrain tiene tres modos. El modo Preguntar (por defecto) es de solo lectura y no puede modificar nada en la página. El modo Actuar permite acciones como hacer clic, escribir y navegar, mientras que el modo Dev añade herramientas de depuración de páginas. Las acciones con consecuencias requieren aprobación por defecto; si se desactiva esa barrera de permisos, WebBrain muestra un aviso visible. Puedes detener el agente en cualquier momento con el botón Detener. El código fuente de la extensión está totalmente abierto en GitHub para auditoría.

¿Qué es el aviso «WebBrain started debugging this browser»? ¿Por qué WebBrain usa CDP?

Para actuar sobre una página de forma fiable, WebBrain usa el Chrome DevTools Protocol (CDP) a través de la API de extensión estándar chrome.debugger; eso es lo que provoca el aviso de Chrome «WebBrain started debugging this browser». CDP es lo que permite al agente hacer clic y escribir con eventos de entrada de confianza que los sitios modernos sí aceptan; los eventos sintéticos lanzados desde un content script son rechazados por muchos sitios, Web Components y campos controlados por frameworks. También es como WebBrain captura capturas de pantalla con precisión de píxel para el respaldo de visión y accede a iframes de origen cruzado y al shadow DOM que los content scripts no pueden ver.

El modo Preguntar, de solo lectura, no necesita CDP: las lecturas de la página y del árbol de accesibilidad pasan por content scripts normales. Son la fiabilidad del modo Actuar y el trabajo entre orígenes los que lo requieren, y en una extensión Manifest V3 no existe ninguna API sin depurador para la entrada de confianza. WebBrain adjunta el depurador solo cuando una acción lo necesita, por pestaña, y toda la extensión es de código abierto, así que puedes auditar exactamente lo que hace la sesión. CDP es potente, por eso tratamos su alcance como algo que hay que contener (adjuntar bajo demanda, mantener las lecturas fuera de él), y reducirlo aún más está en nuestra hoja de ruta de seguridad.

Me está haciendo demasiadas preguntas. ¿Puedo desactivarlo?

Esas solicitudes de aprobación existen por tu seguridad. Incluso en sitios en los que confías, actores maliciosos pueden imitar instrucciones de LLM o inyectar contenido que intenta hacer que el agente haga en tu nombre cosas que no aprobarías. Por eso WebBrain pide tu aprobación antes de acciones importantes. Si aun así no quieres pasar por esas solicitudes, puedes desactivarlas: abre el plugin lateral, haz clic en el icono de rueda del encabezado, ve a la pestaña Permissions en settings.html y desactiva Ask before consequential actions.

¿WebBrain llama a las APIs directamente o siempre pasa por la interfaz?

Por defecto, WebBrain siempre pasa por la interfaz visible para cualquier acción que cree, modifique, elimine, envíe, publique o compre algo. Navega a la página, rellena el formulario y pulsa el botón — exactamente como lo harías tú. Se niega a llamar directamente a endpoints REST/GraphQL con fetch() en segundo plano para mutaciones. Es deliberado: las acciones por API son invisibles (no ves qué se envía), a menudo requieren tokens de autenticación que quizá no tengas configurados y tienen un radio de impacto mucho mayor que un clic erróneo y visible. UI-first significa que todo está en pantalla, en tu sesión habitual y que se puede detener.

Para leer datos —traer un README, buscar un issue, comparar precios, revisar una página de estado— WebBrain usa libremente peticiones HTTP en segundo plano con las herramientas fetch_url y research_url. Leer no es actuar; no cambia nada en un servicio remoto, así que no aplican las mismas preocupaciones de seguridad.

Si quieres permitir mutaciones por API para una tarea concreta, escribe /allow-api al inicio de tu mensaje (opcionalmente seguido de una descripción corta). Esta anulación por conversación permite a WebBrain recurrir a endpoints de API cuando la interfaz falla realmente, pero seguirá prefiriendo la UI cuando funcione. Un distintivo pegajoso permanece sobre el área de entrada mientras la anulación está activa y desaparece al reiniciar la conversación.

¿Cómo funciona el autocompletado de perfil y es seguro?

El autocompletado de perfil es una función opcional en Ajustes → Perfil. Introduces una biografía breve —nombre, correo laboral, empresa y una contraseña desechable para registros poco importantes— y lo activas. Cuando está activo, WebBrain añade ese texto al prompt del sistema del agente para que pueda rellenar formularios de registro sin preguntar cada vez.

El texto se guarda en texto plano en el almacenamiento local del navegador. No se transmite al proyecto WebBrain, pero se envía al proveedor de LLM que tengas configurado en cada turno, como parte del prompt del sistema. Desactivado por defecto.

No pongas aquí contraseñas de cuentas importantes (Google, Apple, iCloud, banca, SSO de trabajo, correo principal). Esas cuentas deberían usar 2FA y, de todas formas, no deberían entregarse a un agente. El uso previsto es una contraseña desechable que reutilizas para registros en boletines y pruebas gratuitas.

¿La opción de redacción de capturas de pantalla garantiza que mis datos privados nunca lleguen a un modelo de visión en la nube?

No — reduce la exposición, no es una garantía. Cuando está activada (Ajustes → Multimodal → Redacción de capturas de pantalla, desactivada por defecto), WebBrain pixela los campos de formulario y el texto que parece una dirección de correo o un número de teléfono en cada captura de pantalla antes de enviarla a un modelo de visión. La detección se ejecuta enteramente en tu dispositivo mediante heurísticas del DOM; no se transmite nada adicional.

Es best-effort y fail-open. Si el detector no puede ejecutarse en una página — por ejemplo justo después de una navegación, en visores de PDF, o en páginas restringidas del navegador — la captura se envía igualmente sin redactar en lugar de abortar la tarea. Contenido que las heurísticas del DOM no pueden ver (texto dibujado en un canvas, datos personales dentro de imágenes, widgets poco comunes) también puede colarse. Y el ajuste solo cubre capturas de pantalla: el texto de la página enviado al modelo no se redacta con él.

Para privacidad total en visión, usa un modelo local. Con un proveedor sin conexión como llama.cpp u Ollama, las capturas y el texto de la página nunca salen de tu equipo, así que no hay nada que redactar en primer lugar — esa es la única configuración en la que la privacidad está garantizada. Consulta "¿Puedo usar WebBrain totalmente sin conexión?" más arriba.

¿No tienes un equipo capaz de ejecutar un modelo local con visión? Un buen término medio es un modelo local pequeño para planificar y llamar herramientas (suficientemente ligero para una CPU/GPU modesta) combinado con un proveedor en la nube para las subllamadas de visión, con la Redacción de capturas de pantalla activada. Sigues manteniendo tu conversación y el texto de la página en tu dispositivo, y cada captura que sí sale hacia la visión en la nube ya tiene los campos de formulario y los correos/teléfonos detectados difuminados — menos exposición en la nube sin necesitar hardware para un modelo de visión local completo. Configura ese reparto en Ajustes → Visión (ver "¿Cómo mantiene WebBrain controladas las facturas de los LLM en la nube?" más arriba).

¿WebBrain envía todo el DOM al modelo de IA?

No. De forma predeterminada, WebBrain no envía HTML sin procesar ni un volcado completo del DOM. Empieza con la URL y el título de la página, las indicaciones correspondientes al sitio y, si la visión está activada, una captura opcional del área visible.

Cuando una tarea necesita contenido de la página, WebBrain lo lee bajo demanda como un árbol de accesibilidad semántico reducido o como texto extraído. Las lecturas se filtran por visibilidad cuando corresponde, tienen límites de caracteres y se paginan. El acceso al código fuente sin procesar de la página solo está disponible en el modo Dev.