根据耐心、隐私需求与预算选择方案。
WebBrain 内置 103 张提供商卡片,涵盖托管云服务、直接云 API、模型路由和本地 OpenAI 兼容服务器。你只需要一个活动提供商。
快速选择
WebBrain Cloud
内置且默认启用,包含每日免费额度,无需模型服务器或 API 密钥。
本地模型
使用 llama.cpp、Ollama、LM Studio、Jan、vLLM、SGLang 或 LocalAI。
云 API
为 OpenAI、Anthropic、Gemini、Mistral、DeepSeek、xAI、Groq 等提供商填写自己的密钥。
模型路由
使用一个账户切换许多模型;适合经常试验的用户。
103 张内置提供商卡片
设置新增了 76 个直连 API 与路由器,包括 Azure AI Foundry、Vertex AI、Vertex Anthropic、Cerebras、Cohere、DeepInfra、Perplexity、Vercel AI Gateway、Venice 和多个区域性编程套餐。可以按提供商或模型名称搜索。
大多数卡片使用 API 密钥与 OpenAI 兼容端点。Vertex 卡片使用 Google Cloud 项目、区域和授权密钥;全局区域使用 Google 的全局端点,Vertex Anthropic 还支持 us 与 eu 多区域主机。Cloudflare 接受可选的 AI Gateway ID;对于 @cf/ 模型,留空时自动使用 default 网关。支持流式传输的提供商会在交互式 Ask 中实时显示回复,连接提前结束时自动以非流式方式重试一次。服务返回令牌用量时会直接记录;否则 WebBrain 记录保守估算,避免流式请求绕过成本限额。
GitHub 本身不会关闭,但 GitHub Models 将于 2026 年 7 月 30 日退役。GitHub Copilot 需要单独的订阅/OAuth 集成。GitLab Duo 和 SAP AI Core 也需要浏览器扩展不支持的专用认证与部署发现。
配置步骤

- 找到提供商。使用“本地”“云端”“路由”或搜索框。
- 展开卡片并填写值。本地服务器通常需要地址和模型名;云提供商还需要 API 密钥。
- 保存。把当前字段写入浏览器。
- 测试连接。先修复地址、密钥、模型或服务器错误。
- 设为活动。只有测试成功后再切换。保存并不等于已经启用。
字段含义
| 字段 | 含义 | 建议 |
|---|---|---|
| 服务器 / Base URL | OpenAI 兼容根端点或提供商 API 根地址。 | 使用本地应用或提供商给出的精确值,不要粘贴聊天网页地址。 |
| API 密钥 | 发送给提供商用于认证的凭据。 | 本地服务器通常不需要,除非你主动启用了认证。 |
| 模型 | 服务器要求的模型标识符。 | 大小写、前缀和拼写必须准确。 |
| 上下文窗口 | 一次请求容纳提示、历史、网页内容和工具模式的容量。 | 可靠本地运行建议至少 16k;8k 可配合 Compact;4k 太小。 |
| 支持视觉 | 当前模型是否接受图像。 | 只有确认所服务的精确模型支持图像时才开启。 |
| 提示层级 | WebBrain 暴露的提示长度和常规浏览器工具范围。 | 本地模型从 Mid 开始;小上下文用 Compact,能力强的模型用 Full。 |
本地模型的额外环节
| 服务器 | 常见 Base URL | API 密钥 |
|---|---|---|
| llama.cpp | http://localhost:8080 | 通常不需要 |
| Ollama | http://localhost:11434/v1 | 不需要 |
| LM Studio | http://localhost:1234/v1 | 不需要 |
| Jan | http://localhost:1337/v1 | 可选 |
| vLLM | http://localhost:8000/v1 | 可选 |
| SGLang | http://localhost:30000/v1 | 可选 |
连接被拒绝通常是服务器未启动或端口错误;CORS/Origin 错误需要允许浏览器扩展来源。Ollama 常用:OLLAMA_ORIGINS="chrome-extension://*,moz-extension://*" ollama serve。
提示层级
云提供商固定使用 Full;本地提供商默认 Mid;Compact 提供商不能使用 Dev 模式。
测试连接失败时
- Connection refused:启动本地服务器并确认端口。
- CORS/Origin:在服务器中允许 WebBrain 扩展来源。
- Unauthorized:确认密钥与 Base URL 属于同一提供商。
- Model not found:复制精确模型 ID,或使用 Load models。
- 超时:为大型 CPU 本地模型提高常规请求超时。
- 几轮后失败:确认真实上下文窗口,降低提示层级或扩大模型上下文。
