Bearer 키 하나로 Vortixy Chat을 프로젝트에 통합하세요. 플랜과 동일한 할당량입니다. 대시보드 → 내 API에서 키 만들기
메시지를 전송하고, 선택적으로 대화 기록을 포함하거나 웹 검색을 활성화하거나 사고 깊이를 조정합니다. 핌랜의 일일 메시지 및 토큰 한도에서 차감됩니다.
챗봇 준비: system으로 봇 페르소나 추가(8k자), stream:true로 NDJSON 델타, webSearch로 라이브 소스. 호출마다 토큰·요청·web 검색 차감 — 웹과 공유(00:00 UTC 리셋).
POST /api/v1/chat의 모든 JSON 필드. message만 필수 — 나머지는 선택입니다.
| 필드 | 타입 | 필수 | 설명 |
|---|---|---|---|
| message | string | yes | 사용자 메시지(1–32,000자). |
| history | array | no | 이전 턴: [{ role: 'user' | 'assistant', content: string }](최대 20). |
| system | string | no | 봇 페르소나 / 지시(최대 8k). 별칭 instructions도 허용. |
| provider | string | no | gemini(관리형, 기본값). BYOK는 Dashboard → 설정 → AI 키에서 키를 저장한 뒤 provider openai / anthropic / deepseek / gemini 와 BYOK 모델 ID를 사용하세요. |
| model | string | no | 모델 ID — 아래 표 참조. provider+플랜에서 허용되어야 합니다. |
| chatMode | enum | no | 채팅 모드: fast | smart | auto(auto는 쿼리별 자동 선택). model보다 우선 — 설정 시 model 생략. 별칭 engineMode도 허용. |
| thinkingLevel | enum | no | none | low | medium | high | xhigh | max(xhigh/max는 GPT-5.6 전용). |
| webSearch | boolean | no | true이면 실시간 웹 검색 활성화. 일일 할당량에 포함. |
| stream | boolean | no | true이면 NDJSON 스트리밍(delta → done). 기본값 false(JSON). |
팁: provider/model을 생략하면 플랜 최적 모델을 사용합니다. 챗봇은 stream:true로.
추론이 이제 모드별로 자동화됩니다 — Fast는 low, Smart는 high, Auto는 질문에 따라 지능적으로 선택합니다. 더 이상 수준을 고를 필요가 없습니다. API는 thinkingLevel도 계속 받지만 선택 사항이며 모드가 재정의합니다.
| 수준 | 설명 |
|---|---|
| none | 추론 없음 — 가장 빠르고 토큰 최소. |
| low | 가벼운 추론 — 약간의 고민이 담긴 빠른 답변. |
| medium | 균형 잡힌 추론 — 대부분 작업에 적합. |
| high | 깊은 추론 — 복잡한 분석·계획에. |
| xhigh | 매우 깊음 — 프론티어 모델 전용, 어려운 문제용. |
| max | 최대 — 사고 예산 전체 사용, 가장 느리고 비쌈. |
Fast → low/medium, Smart → medium/high, Auto → 쿼리마다 low→high 선택. 사용자 선택기 불필요 — 시스템이 매 순간 지능적으로 판단합니다.
모델이 아닌 모드를 선택하세요. Vortixy가 지능적으로 라우팅해 할당량을 최대한 활용합니다 — 특정 모델을 고를 필요가 없습니다. 모든 모드가 요금제 할당량을 공유합니다(00:00 UTC).
| 모드 | 사용 시점 | 사고 | 속도 |
|---|---|---|---|
| Fast | 단순 작업에 빠른 답변 — 가장 빠르고 효율적입니다. | low / medium | 가장 빠름 |
| Smart | 복잡한 작업에 심층 추론 — 더 깊이 있게, 단계별로. | medium / high | 심층적 |
| Auto | Vortixy가 질문마다 최적의 모드를 자동 선택합니다(휴리스틱, 추가 비용 없음). | auto (low → high) | 자동 선택 |
Smart는 선택 시 애니메이션 글로우가 표시됩니다(shimmer 테두리). Auto가 기본값 — 대부분의 작업에 권장됩니다.
Dashboard → Settings → AI keys에 한 번 저장(AES-256-GCM, 비공개) — provider + model로 호출. BYOK 턴은 모델 토큰 무료, 나머지는 managed와 동일(00:00 UTC).
| 모델 | 제공자 | 액세스 | 사고 | 컨텍스트 |
|---|---|---|---|---|
| gemini-3.8-flash:byok | gemini | Free — 키 필요 | none, low, medium, high | 1049k |
| gemini-3.7-flash:byok | gemini | Free — 키 필요 | none, low, medium, high | 1049k |
| gemini-3.6-flash:byok | gemini | Free — 키 필요 | none, low, medium, high | 1049k |
| gemini-3.5-flash-lite:byok | gemini | Free — 키 필요 | none, low, medium, high | 1049k |
| gemini-3.1-flash-lite:byok | gemini | Free — 키 필요 | none, low, medium, high | 1049k |
| gpt-6-astra | openai | Free — 키 필요 | low, medium, high, xhigh, max | 1050k |
| gpt-6-sol | openai | Free — 키 필요 | none, low, medium, high, xhigh, max | 1049k |
| gpt-6-luna | openai | Free — 키 필요 | none, low, medium, high, xhigh, max | 1049k |
| gpt-5.6-sol | openai | Free — 키 필요 | none, low, medium, high, xhigh, max | 1049k |
| gpt-5.6-terra | openai | Free — 키 필요 | none, low, medium, high, xhigh, max | 1049k |
| gpt-5.6-luna | openai | Free — 키 필요 | none, low, medium, high, xhigh, max | 1049k |
| claude-fable-5-1 | anthropic | Free — 키 필요 | none, high | 1049k |
| claude-opus-5-5 | anthropic | Free — 키 필요 | none, high | 1049k |
| claude-sonnet-5-5 | anthropic | Free — 키 필요 | none, high | 1049k |
| claude-fable-5 | anthropic | Free — 키 필요 | none, high | 1049k |
| claude-opus-5 | anthropic | Free — 키 필요 | none, high | 1049k |
| claude-sonnet-5 | anthropic | Free — 키 필요 | none, high | 1049k |
| claude-haiku-4-5 | anthropic | Free — 키 필요 | none, high | 200k |
| claude-sonnet-4-6 | anthropic | Free — 키 필요 | none, high | 200k |
| deepseek-flash | deepseek | Free — 키 필요 | none, high | 1049k |
| deepseek-v4-pro | deepseek | Free — 키 필요 | none, high | 1049k |
| deepseek-v4-flash | deepseek | Free — 키 필요 | none, high | 1049k |
BYOK 카탈로그: gpt-6-astra/gpt-6-sol/gpt-6-luna/gpt-5.6-sol/terra/luna (openai), claude-fable-5-1/opus-5-5/sonnet-5-5/fable-5/opus-5/sonnet-5/haiku-4-5 (anthropic), deepseek-flash/v4-pro/v4-flash (deepseek), gemini-3.8/3.7/3.6-flash:byok + flash-lites:byok (gemini). 키가 있으면 Free에서 모두 사용 가능 — 업그레이드 불필요.
컨텍스트 윈도우는 모델마다 다르며 최대 1M (3.8/3.7) / 256k (나머지) 토큰입니다. 각 요청에는 요금제 한도도 적용됩니다: Free 30k, Go 30k, Pro 35k, Max 50k 또는 Max+ 100k 토큰. 적용 예산의 85%를 넘으면 오래된 턴을 자동으로 압축합니다. 공개 API는 상태를 저장하지 않으므로 호출할 때마다 `history`로 기록을 다시 보내세요.
요청에서 사용할 수 있는 컨텍스트는 요금제 한도(30k/30k/35k/50k/100k 토큰)와 모델 윈도우(최대 1M (3.8/3.7) / 256k (나머지)) 중 더 작은 값입니다. 통합에서는 한도에 맞는 기록만 보내고 오래된 턴은 요약하세요. 너무 큰 요청은 거부될 수 있습니다.
// Basic — only required field
{ "message": "Explain quantum computing simply" }
// With system persona (chatbot) — 8k chars
{
"message": "What do you sell?",
"system": "You are a friendly shop assistant for Acme. Answer briefly in Spanish."
}
// With history — multi-turn conversation
{
"message": "And what about entanglement?",
"history": [
{ "role": "user", "content": "Hi" },
{ "role": "assistant", "content": "Hello! How can I help?" },
{ "role": "user", "content": "Explain quantum computing" }
]
}
// Full request — all variants together
{
"message": "Latest AI breakthroughs with sources",
"history": [{ "role": "user", "content": "Hi" }],
"system": "You are Acme support. Be concise.",
"provider": "gemini", // managed (default) — BYOK dashboard-only for other providers
"model": "gemini-3.5-flash", // any available managed model from the table above
"thinkingLevel": "high", // none | low | medium | high | xhigh | max
"webSearch": true, // true = live web grounding + sources[]
"stream": false // false = JSON, true = NDJSON deltas
}// 200 OK — non-streaming response
{
"answer": "Quantum computing uses qubits...",
"model": "gemini-3.5-flash",
"usage": { "tokensEstimated": 42, "tokensReserved": 42, "webSearch": true },
"sources": [{ "title": "Quantum computing — Wikipedia", "url": "https://en.wikipedia.org/wiki/Quantum_computing" }],
"plan": "pro",
"resetsInSeconds": 43200,
"resetsAt": "2026-09-25T00:00:00.000Z"
} // quotas reset daily at 00:00 UTC — streaming uses RateLimit-* headers// Streaming (NDJSON) — ideal for chatbots
const res = await fetch("https://www.vortixy.net/api/v1/chat", {
method: "POST",
headers: { Authorization: "Bearer " + process.env.VORTIXY_API_KEY, "Content-Type": "application/json" },
body: JSON.stringify({ message: "Hello!", system: "Be concise.", stream: true, thinkingLevel: "medium" })
});
for await (const line of res.body.pipeThrough(new TextDecoderStream()).pipeThrough(splitNDJSON())) {
const evt = JSON.parse(line);
if (evt.type === "delta") process.stdout.write(evt.delta);
if (evt.type === "sources") console.log("sources", evt.sources);
if (evt.type === "done") console.log("\nusage", evt.usage);
}
// curl variants — pick the one you need
// 1) Basic
curl -X POST https://www.vortixy.net/api/v1/chat -H "Authorization: Bearer $VORTIXY_API_KEY" -H "Content-Type: application/json" -d '{"message":"Hello"}'
// 2) With web search + high thinking
curl -X POST https://www.vortixy.net/api/v1/chat -H "Authorization: Bearer $VORTIXY_API_KEY" -H "Content-Type: application/json" -d '{"message":"Latest AI news","webSearch":true,"thinkingLevel":"high"}'
// 3) Chatbot persona + streaming (NDJSON)
curl -N -X POST https://www.vortixy.net/api/v1/chat -H "Authorization: Bearer $VORTIXY_API_KEY" -H "Content-Type: application/json" -d '{"message":"Hi","system":"You are Acme bot.","stream":true}'스트리밍은 delta → done(NDJSON, Content-Type: application/x-ndjson)을 전송. webSearch:true이면 웹 검색을 통한 그라운딩 소스도 함께 제공(일일 할당량에 포함).
월간과 연간 중 무엇이 좋나요?
누만 기간 기기 대시로 17% 절절합니다.