Skip to content
Merged
Show file tree
Hide file tree
Changes from all commits
Commits
File filter

Filter by extension

Filter by extension

Conversations
Failed to load comments.
Loading
Jump to
Jump to file
Failed to load files.
Loading
Diff view
Diff view
11 changes: 8 additions & 3 deletions README.fr.md
Original file line number Diff line number Diff line change
Expand Up @@ -41,11 +41,12 @@
- **MiniMax**, **Kimi**, **Alibaba Cloud (Qwen)**, **z.ai GLM**
- **Cloudflare Workers AI**, **Nvidia NIM**, **Groq**, **Together AI**, **Hugging Face Inference**, **Fireworks**
- **OpenRouter** (modèle par défaut : `openrouter/free` ; accès à plus de 100 modèles)
- **76 API directes et routeurs supplémentaires** — 103 cartes intégrées au total ; voir le [catalogue des fournisseurs](docs/fr/providers-and-models.md#catalogue-étendu-de-fournisseurs)
- **Assistant d'intégration** — Visite guidée au premier lancement couvrant la sécurité du mode Act et la configuration des fournisseurs
- **Interface en panneau latéral** — Interface de chat épurée qui accompagne votre navigation
- **Réponses longues pensées pour la lecture** — La nouvelle question reste visible pendant que la réponse s'allonge, avec des commandes flottantes pour suivre la réponse, aller au contenu le plus récent ou revenir à la question
- **Conversations par onglet** — Chaque onglet possède son propre historique de chat
- **Streaming Ask** — Les chats Ask interactifs affichent le texte de l'API Responses officielle d'OpenAI à mesure qu'il arrive ; les outils et l'historique attendent `response.completed`, avec un interrupteur avancé et un repli non-streaming automatique en cas d'interruption
- **Streaming Ask** — Les chats Ask interactifs affichent les réponses des fournisseurs compatibles à mesure qu'elles arrivent ; les outils et l'historique attendent un événement terminal du flux, avec un interrupteur avancé et un repli non-streaming automatique en cas d'interruption
- **Contexte intelligent** — Auto-compactage tenant compte des jetons (résume les tours plus anciens lorsque la conversation approche de la fenêtre de contexte du modèle, avec un avis visible « Contexte automatiquement compacté »), limites de résultats d'outils et récupération d'urgence en cas de débordement
- **Contrôle de l'historique du navigateur** — Le mode Act peut utiliser les outils natifs d'historique `go_back` / `go_forward` au lieu du JavaScript de page sensible à la CSP
- **Indices de raccourcis API** — Les clics répétés qui déclenchent la même requête XHR/fetch peuvent afficher une suggestion `fetch_url` correspondante tout en préservant la règle UI-d'abord et la politique de mutation `/allow-api`
Expand Down Expand Up @@ -119,7 +120,11 @@ Cliquez sur l'icône d'engrenage ou accédez à la page Options de l'extension p

**Fournisseurs :**

Les URL de base sont préremplies dans les paramètres lorsque vous choisissez un fournisseur. Les serveurs locaux utilisent le port par défaut indiqué ci-dessous.
Les URL de base sont préremplies dans les paramètres lorsque vous choisissez
un fournisseur. Les serveurs locaux utilisent le port par défaut indiqué
ci-dessous. Ce tableau présente les fournisseurs historiques ; le
[catalogue complet](docs/fr/providers-and-models.md#catalogue-étendu-de-fournisseurs)
contient 103 cartes intégrées.

| Fournisseur | Clé API | Modèle par défaut |
|-------------|----------|-------------------|
Expand All @@ -136,7 +141,7 @@ Les URL de base sont préremplies dans les paramètres lorsque vous choisissez u
| OpenAI | Requise | gpt-5.6-terra |
| Anthropic Claude | Requise | claude-sonnet-4-6 |
| Google Gemini | Requise | gemini-3.1-flash |
| Cloudflare Workers AI | Requise (+ Account ID) | @cf/zai-org/glm-5.2 |
| Cloudflare AI Gateway / Workers AI | Requise (+ Account ID) | @cf/zai-org/glm-5.2 |
| Mistral AI | Requise | mistral-large-latest |
| DeepSeek | Requise | deepseek-v4-flash |
| xAI Grok | Requise | grok-4.3 |
Expand Down
10 changes: 7 additions & 3 deletions README.md
Original file line number Diff line number Diff line change
Expand Up @@ -41,12 +41,13 @@
- **MiniMax**, **Kimi**, **Alibaba Cloud (Qwen)**, **z.ai GLM**
- **Cloudflare Workers AI**, **Nvidia NIM**, **Groq**, **Together AI**, **Hugging Face Inference**, **Fireworks**
- **OpenRouter** (default model: `openrouter/free`; access 100+ models)
- **76 additional direct APIs and routers** — 103 built-in provider cards in total; see the [provider catalog](docs/providers-and-models.md#extended-provider-catalog)
- **Onboarding Wizard** — First-launch walkthrough covering Act mode safety and provider setup
- **Side Panel UI** — Clean chat interface that lives alongside your browsing
- **Reading-first long replies** — New questions stay in view while answers grow, with floating controls to follow the response, jump to the latest content, or return to the question
- **Per-Tab Conversations** — Each tab has its own chat history
- **User Memory** — Optional local memory for user-stated preferences, with explicit `/memory --add` commands and opt-in background auto-learning
- **Ask streaming** — Interactive Ask chats show text as it arrives for supported OpenAI, Anthropic, Azure OpenAI, Gemini, DeepSeek, xAI, Mistral, Nvidia NIM, Groq, Together AI, Fireworks, z.ai, OpenRouter, WebBrain Cloud, llama.cpp, Ollama, LM Studio, Jan, vLLM, SGLang, and LocalAI requests; tools and history wait for the provider's terminal event, with an Advanced kill switch and one silent non-streaming fallback for interrupted streams
- **Ask streaming** — Interactive Ask chats stream capable provider responses as they arrive; tools and history wait for a terminal stream event, with an Advanced kill switch and automatic non-streaming fallback for interrupted streams
- **Smart Context** — Token-aware auto-compaction (summarizes older turns once the conversation nears the model's context window, with a visible "Context automatically compacted" notice), tool result limits, and emergency overflow recovery
- **Browser History Control** — Act mode can use native `go_back` / `go_forward` history tools instead of CSP-sensitive page JavaScript
- **API Shortcut Hints** — Repeated clicks that fire the same XHR/fetch request can surface a matching `fetch_url` suggestion while preserving the UI-first and `/allow-api` mutation policy
Expand Down Expand Up @@ -155,7 +156,10 @@ Click the gear icon or go to the extension's Options page to configure:

**Providers:**

Base URLs are pre-filled in Settings when you select a provider. Local servers use the default port shown below.
Base URLs are pre-filled in Settings when you select a provider. Local servers
use the default port shown below. This table highlights the original providers;
the [full catalog](docs/providers-and-models.md#extended-provider-catalog)
contains 103 built-in cards.

| Provider | API Key | Default Model |
|----------|---------|---------------|
Expand All @@ -172,7 +176,7 @@ Base URLs are pre-filled in Settings when you select a provider. Local servers u
| OpenAI | Required | gpt-5.6-terra |
| Anthropic Claude | Required | claude-sonnet-4-6 |
| Google Gemini | Required | gemini-3.1-flash |
| Cloudflare Workers AI | Required (+ Account ID) | @cf/zai-org/glm-5.2 |
| Cloudflare AI Gateway / Workers AI | Required (+ Account ID) | @cf/zai-org/glm-5.2 |
| Mistral AI | Required | mistral-large-latest |
| DeepSeek | Required | deepseek-v4-flash |
| xAI Grok | Required | grok-4.3 |
Expand Down
9 changes: 6 additions & 3 deletions README.zh-CN.md
Original file line number Diff line number Diff line change
Expand Up @@ -41,11 +41,12 @@
- **MiniMax**、**Kimi**、**阿里云(通义千问 Qwen)**、**z.ai GLM**
- **Cloudflare Workers AI**、**Nvidia NIM**、**Groq**、**Together AI**、**Hugging Face Inference**、**Fireworks**
- **OpenRouter**(默认模型:`openrouter/free`;可访问 100+ 模型)
- **另外 76 个直连 API 与路由器** — 共 103 张内置提供商卡片;请参阅[提供商目录](docs/zh-CN/providers-and-models.md#扩展提供商目录)
- **引导向导** — 首次启动的演练,涵盖 Act 模式安全性与提供商配置
- **侧边栏 UI** — 与浏览并存的简洁聊天界面
- **以阅读为先的长回复** — 回复增长时新问题会保持在视野中,并提供浮动控件来跟随回复、跳到最新内容或返回问题
- **按标签页对话** — 每个标签页拥有独立的聊天历史
- **Ask 流式输出** — 交互式 Ask 对话会在 OpenAI 官方 Responses 文本到达时实时显示;工具与历史记录会等待 `response.completed`,并提供高级关闭开关和中断后的自动非流式回退
- **Ask 流式输出** — 交互式 Ask 对话会在支持的提供商回复到达时实时显示;工具与历史记录会等待流的终止事件,并提供高级关闭开关和中断后的自动非流式回退
- **智能上下文** — 令牌感知的自动压缩(当对话接近模型上下文窗口时汇总较早的轮次,并显示「上下文已自动压缩」提示)、工具结果限制以及紧急溢出恢复
- **浏览器历史控制** — Act 模式可以使用原生 `go_back` / `go_forward` 历史工具,而不是受 CSP 影响的页面 JavaScript
- **API 快捷提示** — 重复点击触发相同 XHR/fetch 请求时,可显示匹配的 `fetch_url` 建议,同时保留 UI 优先和 `/allow-api` 变更策略
Expand Down Expand Up @@ -119,7 +120,9 @@ python -m sglang.launch_server --model-path your-model --port 30000

**提供商:**

在设置中选择提供商时会预填 Base URL。本地服务使用下方默认端口。
在设置中选择提供商时会预填 Base URL。本地服务使用下方默认端口。下表重点列出
原有提供商;[完整目录](docs/zh-CN/providers-and-models.md#扩展提供商目录)
包含 103 张内置卡片。

| 提供商 | API 密钥 | 默认模型 |
|--------|----------|----------|
Expand All @@ -136,7 +139,7 @@ python -m sglang.launch_server --model-path your-model --port 30000
| OpenAI | 必需 | gpt-5.6-terra |
| Anthropic Claude | 必需 | claude-sonnet-4-6 |
| Google Gemini | 必需 | gemini-3.1-flash |
| Cloudflare Workers AI | 必需(+ Account ID) | @cf/zai-org/glm-5.2 |
| Cloudflare AI Gateway / Workers AI | 必需(+ Account ID) | @cf/zai-org/glm-5.2 |
| Mistral AI | 必需 | mistral-large-latest |
| DeepSeek | 必需 | deepseek-v4-flash |
| xAI Grok | 必需 | grok-4.3 |
Expand Down
48 changes: 48 additions & 0 deletions docs/fr/providers-and-models.md
Original file line number Diff line number Diff line change
Expand Up @@ -11,6 +11,7 @@ class BaseLLMProvider {
async chat(messages, options) // → { content, toolCalls, usage }
async *chatStream(messages, options) // → générateur async produisant { type, content }
get supportsTools() // → booléen
get supportsAskStreaming() // → booléen
get supportsVision() // → booléen
get promptTier() // → 'compact' | 'mid' | 'full'
async testConnection() // → { ok, error?, model? }
Expand Down Expand Up @@ -63,6 +64,53 @@ class BaseLLMProvider {
| `fireworks` | `openai` | routeur | `accounts/fireworks/models/llama-v3p3-70b-instruct` | Regex nom de modèle |
| `z_ai` | `openai` | cloud | `glm-5.2` | Regex nom de modèle |

### Catalogue étendu de fournisseurs

WebBrain ajoute 76 cartes désactivées par défaut depuis l’instantané du
catalogue OpenCode au commit
`62e4641235d7847dadc60da37cca8a023dd54fc1`. Avec les 27 cartes existantes,
les Paramètres proposent **103 fournisseurs intégrés**. La liste exacte des
identifiants est :

`302ai`, `abacus`, `aihubmix`, `alibaba-coding-plan`,
`alibaba-coding-plan-cn`, `azure-cognitive-services`, `bailing`, `baseten`,
`berget`, `cerebras`, `chutes`, `clarifai`, `cloudferro-sherlock`, `cohere`,
`cortecs`, `deepinfra`, `digitalocean`, `dinference`, `drun`, `evroc`,
`fastrouter`, `friendli`, `google-vertex`, `google-vertex-anthropic`,
`helicone`, `iflowcn`, `inception`, `inference`, `io-net`, `jiekou`, `kilo`,
`kimi-for-coding`, `kuae-cloud-coding-plan`, `llama`, `lucidquery`,
`meganova`, `minimax-cn-coding-plan`, `minimax-coding-plan`, `moark`,
`modelscope`, `morph`, `nano-gpt`, `nebius`, `nova`, `novita-ai`,
`ollama-cloud`, `opencode`, `opencode-go`, `ovhcloud`, `perplexity`,
`perplexity-agent`, `poe`, `privatemode-ai`, `qihang-ai`, `qiniu-ai`,
`requesty`, `scaleway`, `siliconflow`, `siliconflow-cn`, `stackit`,
`stepfun`, `submodel`, `synthetic`, `tencent-coding-plan`, `upstage`, `v0`,
`venice`, `vercel`, `vivgrid`, `vultr`, `wandb`, `xiaomi`,
`zai-coding-plan`, `zenmux`, `zhipuai`, `zhipuai-coding-plan`.

La plupart utilisent Chat Completions compatible OpenAI avec une clé Bearer.
Azure AI Foundry utilise un nom de ressource et `api-key`. Google Vertex AI
utilise projet, région et clé d’autorisation Google via `x-goog-api-key`;
la région `global` utilise `aiplatform.googleapis.com`, et Vertex Anthropic
utilise `rawPredict` / `streamRawPredict` avec les hôtes multirégion `us` et
`eu`. Perplexity Agent
utilise l’API Responses. La carte Cloudflare existante prend désormais en
charge un identifiant AI Gateway facultatif ; pour les modèles `@cf/`, un
champ vide utilise automatiquement la passerelle `default`.

Les réponses sont diffusées pendant les tours Ask interactifs lorsque
`supportsAskStreaming` est actif. Un flux interrompu efface le texte partiel,
réessaie une seule fois sans diffusion et désactive la diffusion pour le reste
de l’exécution. Act, Dev, les tâches planifiées, cloud et Continue restent sans
diffusion. L’utilisation de jetons fournie par le service est enregistrée
directement ; si elle est absente, WebBrain enregistre une estimation prudente
fondée sur le nombre de caractères afin que la diffusion ne contourne pas la
limite de coût configurée.

Entrées volontairement exclues : `github-models` (retrait de GitHub Models le
30 juillet 2026), `github-copilot` (abonnement/OAuth), `gitlab` et
`sap-ai-core` (authentification, découverte et protocoles spécifiques).

### Fournisseurs Locaux

Sept fournisseurs locaux sont activés par défaut sans clé API requise sauf si le
Expand Down
Loading
Loading