Compatibilidade com OpenAI e Anthropic
Já usa o SDK da OpenAI ou Anthropic? Aponte-o para a Nexevo mudando duas coisas — a URL base e a chave de API. Seu código existente continua funcionando, e toda chamada ganha o roteamento inteligente, cobrança e BYOK da Nexevo.
Endpoints
POST/v1/chat/completions — OpenAI Chat Completions
POST/v1/messages — Anthropic Messages
Ambos falam o formato de transmissão exato do seu fornecedor (streaming e não-streaming), então os SDKs oficiais funcionam sem modificação. Isso também responde "existe um SDK?" — use o SDK da OpenAI ou Anthropic que você já tem.
Autenticação
Use uma chave de API do workspace — a mesma chave da API REST. Ela vincula a chamada a um workspace; a superfície OpenAI lê do cabeçalho Authorization: Bearer, a Anthropic do x-api-key. Os SDKs definem esses para você a partir da opção api_key deles.
Escolhendo o modelo
Passe "nexevo-auto" como modelo para deixar o roteador da Nexevo escolher o melhor modelo para cada requisição, ou passe um id de modelo Nexevo explícito para fixar. Um id de modelo desconhecido retorna 404.
OpenAI — Python
from openai import OpenAI
client = OpenAI(
base_url="https://nexevo.ai/v1",
api_key="sk-ws-...", # your Nexevo workspace API key
)
resp = client.chat.completions.create(
model="nexevo-auto", # or an explicit Nexevo model id
messages=[{"role": "user", "content": "Summarize our Q2 results."}],
)
print(resp.choices[0].message.content)Streaming
stream = client.chat.completions.create(
model="nexevo-auto",
messages=[{"role": "user", "content": "Write a short product update."}],
stream=True,
)
for chunk in stream:
print(chunk.choices[0].delta.content or "", end="", flush=True)OpenAI — JavaScript / TypeScript
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://nexevo.ai/v1",
apiKey: process.env.NEXEVO_API_KEY, // your workspace API key
});
const resp = await client.chat.completions.create({
model: "nexevo-auto",
messages: [{ role: "user", content: "Summarize our Q2 results." }],
});
console.log(resp.choices[0].message.content);OpenAI — curl
curl https://nexevo.ai/v1/chat/completions \\
-H "Authorization: Bearer sk-ws-..." \\
-H "Content-Type: application/json" \\
-d '{
"model": "nexevo-auto",
"messages": [{"role": "user", "content": "Hello"}]
}'Anthropic — Python
O SDK da Anthropic anexa /v1/messages à URL base, então defina-a como https://nexevo.ai.
from anthropic import Anthropic
client = Anthropic(
base_url="https://nexevo.ai",
api_key="sk-ws-...", # your Nexevo workspace API key
)
msg = client.messages.create(
model="nexevo-auto",
max_tokens=1024,
messages=[{"role": "user", "content": "Summarize our Q2 results."}],
)
print(msg.content[0].text)Anthropic — curl
curl https://nexevo.ai/v1/messages \\
-H "x-api-key: sk-ws-..." \\
-H "anthropic-version: 2023-06-01" \\
-H "Content-Type: application/json" \\
-d '{
"model": "nexevo-auto",
"max_tokens": 1024,
"messages": [{"role": "user", "content": "Hello"}]
}'As chamadas são cobradas exatamente como a faixa de chat nativa (roteada de forma inteligente, tabela de preço fixa), e uma chave BYOK do workspace — se definida — é usada automaticamente. O usage de tokens na resposta é uma estimativa de melhor esforço. Frames de raciocínio e chamada de ferramenta não são emitidos nessas superfícies; elas retornam apenas texto do assistente.