Integre o Vortixy Chat nos seus projetos com uma chave Bearer. Mesmas cotas do seu plano. Criar chave em Painel → Sua API
Envie uma mensagem com histórico de conversa opcional, ative a pesquisa web ou ajuste a profundidade de raciocínio. Conta para o limite diário de mensagens e tokens do seu plano.
Pronto para chatbots: adicione system para a persona do seu bot (8k chars), stream:true para deltas NDJSON, webSearch para fontes ao vivo. Cada chamada desconta tokens, requisições e buscas web — compartilhadas com a web (reset 00:00 UTC).
Todos os campos JSON para POST /api/v1/chat. Apenas message é obrigatório — o resto é opcional.
| Campo | Tipo | Obrigatório | Descrição |
|---|---|---|---|
| message | string | yes | Mensagem do usuário (1–32.000 caracteres). |
| history | array | no | Turnos anteriores: [{ role: 'user' | 'assistant', content: string }] (máx. 20). |
| system | string | no | Persona do bot / instruções (máx. 8k). Também aceita alias instructions. |
| provider | string | no | gemini (gerenciado, padrão). Para BYOK, salve sua chave em Dashboard → Configurações → Chaves de IA e use provider openai / anthropic / deepseek / gemini com um model id BYOK. |
| model | string | no | ID do modelo — veja a tabela abaixo. Deve ser permitido para seu provedor e plano. |
| chatMode | enum | no | Modo de chat: fast | smart | auto (auto escolhe por consulta). Preferido sobre model — omita model ao usar. Também aceita o alias engineMode. |
| thinkingLevel | enum | no | none | low | medium | high | xhigh | max (xhigh/max apenas para GPT-5.6). |
| webSearch | boolean | no | true para ativar a busca web ao vivo. Conta na cota diária. |
| stream | boolean | no | true para streaming NDJSON (delta → done). Padrão false (JSON). |
Dica: omita provider/model para usar o melhor modelo do seu plano. Use stream:true para chatbots.
O raciocínio agora é automático por modo — Fast usa low, Smart usa high, Auto escolhe com inteligência conforme sua pergunta. Você não precisa mais escolher nível. A API ainda aceita thinkingLevel, mas é opcional e o modo a sobrescreve.
| Nível | Descrição |
|---|---|
| none | Sem raciocínio — mais rápido, menor uso de tokens. |
| low | Raciocínio leve — respostas rápidas com um pouco de reflexão. |
| medium | Raciocínio equilibrado — bom para a maioria das tarefas. |
| high | Raciocínio profundo — para análises e planejamentos complexos. |
| xhigh | Muito profundo — apenas modelos de fronteira, para problemas difíceis. |
| max | Máximo — usa todo o orçamento de raciocínio, mais lento e caro. |
Fast → low/medium, Smart → medium/high, Auto → escolhe low→high por consulta. Sem seletor para o usuário — o sistema é inteligente a cada momento.
Escolha um modo, não um modelo. O Vortixy roteia com inteligência para aproveitar sua cota — sem escolher um modelo específico. Todos os modos compartilham as cotas do seu plano (00:00 UTC).
| Modo | Quando usar | Pensamento | Velocidade |
|---|---|---|---|
| Fast | Respostas rápidas para tarefas simples — o mais veloz e eficiente. | low / medium | Mais rápido |
| Smart | Raciocínio profundo para tarefas complexas — mais detalhado, passo a passo. | medium / high | Aprofundado |
| Auto | O Vortixy escolhe o melhor modo sozinho para cada pergunta (heurística, sem custo extra). | auto (low → high) | Auto-escolhe |
O Smart mostra um brilho animado ao ser selecionado (borda shimmer). Auto vem por padrão — recomendado para a maioria das tarefas.
Salve sua chave uma vez em Dashboard → Settings → AI keys (AES-256-GCM, nunca exposta) — depois chame com provider + model. Turnos BYOK sem tokens do modelo; demais cotas iguais (00:00 UTC).
| Modelo | Provedor | Acesso | Pensamento | Contexto |
|---|---|---|---|---|
| gemini-3.8-flash:byok | gemini | Free — precisa de chave | none, low, medium, high | 1049k |
| gemini-3.7-flash:byok | gemini | Free — precisa de chave | none, low, medium, high | 1049k |
| gemini-3.6-flash:byok | gemini | Free — precisa de chave | none, low, medium, high | 1049k |
| gemini-3.5-flash-lite:byok | gemini | Free — precisa de chave | none, low, medium, high | 1049k |
| gemini-3.1-flash-lite:byok | gemini | Free — precisa de chave | none, low, medium, high | 1049k |
| gpt-6-astra | openai | Free — precisa de chave | low, medium, high, xhigh, max | 1050k |
| gpt-6-sol | openai | Free — precisa de chave | none, low, medium, high, xhigh, max | 1049k |
| gpt-6-luna | openai | Free — precisa de chave | none, low, medium, high, xhigh, max | 1049k |
| gpt-5.6-sol | openai | Free — precisa de chave | none, low, medium, high, xhigh, max | 1049k |
| gpt-5.6-terra | openai | Free — precisa de chave | none, low, medium, high, xhigh, max | 1049k |
| gpt-5.6-luna | openai | Free — precisa de chave | none, low, medium, high, xhigh, max | 1049k |
| claude-fable-5-1 | anthropic | Free — precisa de chave | none, high | 1049k |
| claude-opus-5-5 | anthropic | Free — precisa de chave | none, high | 1049k |
| claude-sonnet-5-5 | anthropic | Free — precisa de chave | none, high | 1049k |
| claude-fable-5 | anthropic | Free — precisa de chave | none, high | 1049k |
| claude-opus-5 | anthropic | Free — precisa de chave | none, high | 1049k |
| claude-sonnet-5 | anthropic | Free — precisa de chave | none, high | 1049k |
| claude-haiku-4-5 | anthropic | Free — precisa de chave | none, high | 200k |
| claude-sonnet-4-6 | anthropic | Free — precisa de chave | none, high | 200k |
| deepseek-flash | deepseek | Free — precisa de chave | none, high | 1049k |
| deepseek-v4-pro | deepseek | Free — precisa de chave | none, high | 1049k |
| deepseek-v4-flash | deepseek | Free — precisa de chave | none, high | 1049k |
Catálogo BYOK: gpt-6-astra/gpt-6-sol/gpt-6-luna/gpt-5.6-sol/terra/luna (openai), claude-fable-5-1/opus-5-5/sonnet-5-5/fable-5/opus-5/sonnet-5/haiku-4-5 (anthropic), deepseek-flash/v4-pro/v4-flash (deepseek), gemini-3.8/3.7/3.6-flash:byok + flash-lites:byok (gemini). Todos disponíveis no Free com chave presente — sem upgrade.
As janelas de contexto variam conforme o modelo e chegam a 1M (3.8/3.7) / 256k tokens. Cada solicitação também segue o limite do plano: Free 30k, Go 30k, Pro 35k, Max 50k ou Max+ 100k tokens. No Vortixy Chat (/chat), os turnos antigos são compactados automaticamente acima de 85% do orçamento aplicável. A API pública (/api/v1/chat) não mantém estado: guarde o histórico no seu app e reenvie-o em `history` a cada chamada.
O contexto útil por solicitação é o menor entre o limite do plano (30k/30k/35k/50k/100k tokens) e a janela do modelo escolhido (até 1M (3.8/3.7) / 256k (demais)). Em integrações, envie apenas o histórico que caiba nesse orçamento e resuma os turnos antigos; solicitações grandes demais podem ser rejeitadas em vez de aceitas silenciosamente.
// Basic — only required field
{ "message": "Explain quantum computing simply" }
// With system persona (chatbot) — 8k chars
{
"message": "What do you sell?",
"system": "You are a friendly shop assistant for Acme. Answer briefly in Spanish."
}
// With history — multi-turn conversation
{
"message": "And what about entanglement?",
"history": [
{ "role": "user", "content": "Hi" },
{ "role": "assistant", "content": "Hello! How can I help?" },
{ "role": "user", "content": "Explain quantum computing" }
]
}
// Full request — all variants together
{
"message": "Latest AI breakthroughs with sources",
"history": [{ "role": "user", "content": "Hi" }],
"system": "You are Acme support. Be concise.",
"provider": "gemini", // managed (default) — BYOK dashboard-only for other providers
"model": "gemini-3.5-flash", // any available managed model from the table above
"thinkingLevel": "high", // none | low | medium | high | xhigh | max
"webSearch": true, // true = live web grounding + sources[]
"stream": false // false = JSON, true = NDJSON deltas
}// 200 OK — non-streaming response
{
"answer": "Quantum computing uses qubits...",
"model": "gemini-3.5-flash",
"usage": { "tokensEstimated": 42, "tokensReserved": 42, "webSearch": true },
"sources": [{ "title": "Quantum computing — Wikipedia", "url": "https://en.wikipedia.org/wiki/Quantum_computing" }],
"plan": "pro",
"resetsInSeconds": 43200,
"resetsAt": "2026-09-25T00:00:00.000Z"
} // quotas reset daily at 00:00 UTC — streaming uses RateLimit-* headers// Streaming (NDJSON) — ideal for chatbots
const res = await fetch("https://www.vortixy.net/api/v1/chat", {
method: "POST",
headers: { Authorization: "Bearer " + process.env.VORTIXY_API_KEY, "Content-Type": "application/json" },
body: JSON.stringify({ message: "Hello!", system: "Be concise.", stream: true, thinkingLevel: "medium" })
});
for await (const line of res.body.pipeThrough(new TextDecoderStream()).pipeThrough(splitNDJSON())) {
const evt = JSON.parse(line);
if (evt.type === "delta") process.stdout.write(evt.delta);
if (evt.type === "sources") console.log("sources", evt.sources);
if (evt.type === "done") console.log("\nusage", evt.usage);
}
// curl variants — pick the one you need
// 1) Basic
curl -X POST https://www.vortixy.net/api/v1/chat -H "Authorization: Bearer $VORTIXY_API_KEY" -H "Content-Type: application/json" -d '{"message":"Hello"}'
// 2) With web search + high thinking
curl -X POST https://www.vortixy.net/api/v1/chat -H "Authorization: Bearer $VORTIXY_API_KEY" -H "Content-Type: application/json" -d '{"message":"Latest AI news","webSearch":true,"thinkingLevel":"high"}'
// 3) Chatbot persona + streaming (NDJSON)
curl -N -X POST https://www.vortixy.net/api/v1/chat -H "Authorization: Bearer $VORTIXY_API_KEY" -H "Content-Type: application/json" -d '{"message":"Hi","system":"You are Acme bot.","stream":true}'Streaming emite delta → done (NDJSON, Content-Type: application/x-ndjson). Com webSearch:true você também recebe fontes verificadas via busca web (conta na cota diária).
Mensal ou anual?
Economize 17% com faturamento anual.