Intégrez Vortixy Chat dans vos projets avec une seule clé Bearer. Mêmes quotas que votre forfait. Créer une clé dans Tableau de bord → Votre API
Envoyez un message avec un historique optionnel, activez la recherche web ou ajustez la profondeur de réflexion. Décompté du quota quotidien de messages et de tokens de votre plan.
Prêt pour chatbot : ajoutez system pour la persona de votre bot (8k chars), stream:true pour les deltas NDJSON, webSearch pour des sources live. Chaque appel déduit tokens, requêtes et recherches web — partagés avec le web (reset 00:00 UTC).
Tous les champs JSON pour POST /api/v1/chat. Seul message est requis — le reste est optionnel.
| Champ | Type | Requis | Description |
|---|---|---|---|
| message | string | yes | Message utilisateur (1–32 000 caractères). |
| history | array | no | Tours précédents : [{ role: 'user' | 'assistant', content: string }] (max 20). |
| system | string | no | Persona du bot / instructions (max 8k). Accepte aussi l'alias instructions. |
| provider | string | no | gemini (géré, par défaut). Pour le BYOK, enregistrez votre clé dans Dashboard → Paramètres → Clés IA, puis utilisez provider openai / anthropic / deepseek / gemini avec un model id BYOK. |
| model | string | no | ID modèle — voir tableau ci-dessous. Doit être autorisé pour votre provider + plan. |
| chatMode | enum | no | Mode de chat : fast | smart | auto (auto choisit par requête). Préféré à model — omettez model si défini. Accepte aussi l'alias engineMode. |
| thinkingLevel | enum | no | none | low | medium | high | xhigh | max (xhigh/max seulement pour GPT-5.6). |
| webSearch | boolean | no | true pour activer la recherche web en direct. Compte dans le quota quotidien. |
| stream | boolean | no | true pour streaming NDJSON (delta → done). Défaut false (JSON). |
Astuce : omettez provider/model pour utiliser le meilleur modèle de votre plan. Mettez stream:true pour les chatbots.
Le raisonnement est désormais automatique par mode — Fast utilise low, Smart utilise high, Auto choisit intelligemment selon votre question. Plus besoin de choisir un niveau. L'API accepte encore thinkingLevel, mais il est optionnel et le mode le remplace.
| Niveau | Description |
|---|---|
| none | Sans réflexion — le plus rapide, consommation minimale. |
| low | Réflexion légère — réponses rapides avec un peu de réflexion. |
| medium | Réflexion équilibrée — bon pour la plupart des tâches. |
| high | Réflexion profonde — pour analyses et planification complexes. |
| xhigh | Très profond — modèles frontières uniquement, pour problèmes difficiles. |
| max | Maximum — utilise tout le budget de réflexion, le plus lent et coûteux. |
Fast → low/medium, Smart → medium/high, Auto → choisit low→high par requête. Aucun sélecteur côté utilisateur — le système est intelligent à chaque instant.
Choisissez un mode, pas un modèle. Vortixy route intelligemment pour tirer le meilleur de votre quota — sans choisir de modèle précis. Tous les modes partagent les quotas de votre forfait (00:00 UTC).
| Mode | Quand l'utiliser | Réflexion | Vitesse |
|---|---|---|---|
| Fast | Réponses rapides pour les tâches simples — le plus vite et le plus efficace. | low / medium | Le plus rapide |
| Smart | Raisonnement approfondi pour les tâches complexes — plus profond, étape par étape. | medium / high | Approfondi |
| Auto | Vortixy choisit seul le meilleur mode pour chaque question (heuristique, sans coût supplémentaire). | auto (low → high) | Auto-choisit |
Smart affiche un halo animé une fois sélectionné (bordure shimmer). Auto est le défaut — recommandé pour la plupart des tâches.
Enregistrez votre clé une fois dans Dashboard → Settings → AI keys (AES-256-GCM, jamais exposée) — puis appelez avec provider + model. Tours BYOK sans tokens modèle ; autres quotas identiques (00:00 UTC).
| Modèle | Fournisseur | Accès | Réflexion | Contexte |
|---|---|---|---|---|
| gemini-3.8-flash:byok | gemini | Free — clé requise | none, low, medium, high | 1049k |
| gemini-3.7-flash:byok | gemini | Free — clé requise | none, low, medium, high | 1049k |
| gemini-3.6-flash:byok | gemini | Free — clé requise | none, low, medium, high | 1049k |
| gemini-3.5-flash-lite:byok | gemini | Free — clé requise | none, low, medium, high | 1049k |
| gemini-3.1-flash-lite:byok | gemini | Free — clé requise | none, low, medium, high | 1049k |
| gpt-6-astra | openai | Free — clé requise | low, medium, high, xhigh, max | 1050k |
| gpt-6-sol | openai | Free — clé requise | none, low, medium, high, xhigh, max | 1049k |
| gpt-6-luna | openai | Free — clé requise | none, low, medium, high, xhigh, max | 1049k |
| gpt-5.6-sol | openai | Free — clé requise | none, low, medium, high, xhigh, max | 1049k |
| gpt-5.6-terra | openai | Free — clé requise | none, low, medium, high, xhigh, max | 1049k |
| gpt-5.6-luna | openai | Free — clé requise | none, low, medium, high, xhigh, max | 1049k |
| claude-fable-5-1 | anthropic | Free — clé requise | none, high | 1049k |
| claude-opus-5-5 | anthropic | Free — clé requise | none, high | 1049k |
| claude-sonnet-5-5 | anthropic | Free — clé requise | none, high | 1049k |
| claude-fable-5 | anthropic | Free — clé requise | none, high | 1049k |
| claude-opus-5 | anthropic | Free — clé requise | none, high | 1049k |
| claude-sonnet-5 | anthropic | Free — clé requise | none, high | 1049k |
| claude-haiku-4-5 | anthropic | Free — clé requise | none, high | 200k |
| claude-sonnet-4-6 | anthropic | Free — clé requise | none, high | 200k |
| deepseek-flash | deepseek | Free — clé requise | none, high | 1049k |
| deepseek-v4-pro | deepseek | Free — clé requise | none, high | 1049k |
| deepseek-v4-flash | deepseek | Free — clé requise | none, high | 1049k |
Catalogue BYOK : gpt-6-astra/gpt-6-sol/gpt-6-luna/gpt-5.6-sol/terra/luna (openai), claude-fable-5-1/opus-5-5/sonnet-5-5/fable-5/opus-5/sonnet-5/haiku-4-5 (anthropic), deepseek-flash/v4-pro/v4-flash (deepseek), gemini-3.8/3.7/3.6-flash:byok + flash-lites:byok (gemini). Tous disponibles en Free avec clé présente — sans surclassement.
Les fenêtres de contexte varient selon le modèle et atteignent 1M (3.8/3.7) / 256k tokens. Chaque requête est aussi limitée par le forfait : Free 30k, Go 30k, Pro 35k, Max 50k ou Max+ 100k tokens. Au-delà de 85% du budget applicable, les anciens tours sont automatiquement compactés. L’API publique est sans état : renvoyez l’historique dans `history` à chaque appel.
Le contexte utile est la plus petite valeur entre la limite du forfait (30k/30k/35k/50k/100k tokens) et la fenêtre du modèle (jusqu’à 1M (3.8/3.7) / 256k). Pour une intégration, n’envoyez que l’historique compatible et résumez les anciens tours ; une requête trop volumineuse peut être refusée.
// Basic — only required field
{ "message": "Explain quantum computing simply" }
// With system persona (chatbot) — 8k chars
{
"message": "What do you sell?",
"system": "You are a friendly shop assistant for Acme. Answer briefly in Spanish."
}
// With history — multi-turn conversation
{
"message": "And what about entanglement?",
"history": [
{ "role": "user", "content": "Hi" },
{ "role": "assistant", "content": "Hello! How can I help?" },
{ "role": "user", "content": "Explain quantum computing" }
]
}
// Full request — all variants together
{
"message": "Latest AI breakthroughs with sources",
"history": [{ "role": "user", "content": "Hi" }],
"system": "You are Acme support. Be concise.",
"provider": "gemini", // managed (default) — BYOK dashboard-only for other providers
"model": "gemini-3.5-flash", // any available managed model from the table above
"thinkingLevel": "high", // none | low | medium | high | xhigh | max
"webSearch": true, // true = live web grounding + sources[]
"stream": false // false = JSON, true = NDJSON deltas
}// 200 OK — non-streaming response
{
"answer": "Quantum computing uses qubits...",
"model": "gemini-3.5-flash",
"usage": { "tokensEstimated": 42, "tokensReserved": 42, "webSearch": true },
"sources": [{ "title": "Quantum computing — Wikipedia", "url": "https://en.wikipedia.org/wiki/Quantum_computing" }],
"plan": "pro",
"resetsInSeconds": 43200,
"resetsAt": "2026-09-25T00:00:00.000Z"
} // quotas reset daily at 00:00 UTC — streaming uses RateLimit-* headers// Streaming (NDJSON) — ideal for chatbots
const res = await fetch("https://www.vortixy.net/api/v1/chat", {
method: "POST",
headers: { Authorization: "Bearer " + process.env.VORTIXY_API_KEY, "Content-Type": "application/json" },
body: JSON.stringify({ message: "Hello!", system: "Be concise.", stream: true, thinkingLevel: "medium" })
});
for await (const line of res.body.pipeThrough(new TextDecoderStream()).pipeThrough(splitNDJSON())) {
const evt = JSON.parse(line);
if (evt.type === "delta") process.stdout.write(evt.delta);
if (evt.type === "sources") console.log("sources", evt.sources);
if (evt.type === "done") console.log("\nusage", evt.usage);
}
// curl variants — pick the one you need
// 1) Basic
curl -X POST https://www.vortixy.net/api/v1/chat -H "Authorization: Bearer $VORTIXY_API_KEY" -H "Content-Type: application/json" -d '{"message":"Hello"}'
// 2) With web search + high thinking
curl -X POST https://www.vortixy.net/api/v1/chat -H "Authorization: Bearer $VORTIXY_API_KEY" -H "Content-Type: application/json" -d '{"message":"Latest AI news","webSearch":true,"thinkingLevel":"high"}'
// 3) Chatbot persona + streaming (NDJSON)
curl -N -X POST https://www.vortixy.net/api/v1/chat -H "Authorization: Bearer $VORTIXY_API_KEY" -H "Content-Type: application/json" -d '{"message":"Hi","system":"You are Acme bot.","stream":true}'Le streaming émet delta → done (NDJSON, Content-Type: application/x-ndjson). Avec webSearch:true vous recevez aussi les sources ancrées via recherche web (compte dans le quota quotidien).
Mensuel ou annuel ?
Économisez 17 % avec la facturation annuelle.