Chat
傳送訊息清單並串流回傳 assistant 的回覆。智慧路由器會為你挑選模型(你也可以指定);將多個輪次歸入同一個 conversation 以保留多輪上下文。
單次呼叫
POST/v1/workspaces/{workspace_id}/chat — 傳送訊息清單並串流回傳 assistant 的回覆。請求 body:
messages(必填)——{role, content}陣列;role為system、user、assistant或tool。model——選填;省略(或留空)可讓 Nexevo 的路由器挑選最佳模型。僅在需要強制指定時才填。max_tokens——預設4096(1–128000)。temperature——預設0.7(0–2)。intent_hint——簡短的任務類型提示,當呼叫端已知道請求種類時可略過意圖分類器。conversation_id——將本次輪次掛到現有 conversation 下。設定後伺服器會從資料庫重建先前歷史,因此messages只需帶上新的使用者輪次。project_id——在某個專案中執行;其指令與知識檔案會在伺服器端注入(並經過存取檢查)。images——最多 4 個圖片 URL(OSS)用於視覺聊天;路由器會挑選具備視覺能力的模型,並將最後一個使用者輪次轉換為多模態訊息。
回覆以 Server-Sent Events 串流回傳——每個 data: 行為一個 JSON 物件:{delta: "..."} 為 assistant 文字、{reasoning: "..."} 為思維鏈、當較早的輪次被摘要時開頭可能帶有 {context_compacted: {summary, turns_folded}},失敗時則為 {error: "..."}。串流以 data: [DONE] 結束。(此傳輸格式與 agent runs 不同——後者的事件帶有 type 欄位。)
curl -N https://nexevo.ai/v1/workspaces/$NEXEVO_WORKSPACE/chat \
-H "Authorization: Bearer $NEXEVO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"messages": [{"role": "user", "content": "Explain SEPA Instant in two sentences."}]
}'將 model 留空,讓 Nexevo 的路由器為任務挑選最佳模型(在品質/成本/延遲之間取得平衡)。只有需要特定模型時才指定 model。
Conversations(多輪)
若要跨輪次保留上下文,請建立一個 conversation 並將訊息附加其上:
POST
/v1/workspaces/{workspace_id}/conversations——建立對話串(title,選填project_id)。POST
/v1/workspaces/{workspace_id}/conversations/{conversation_id}/messages——附加訊息(role、content)。GET
/v1/workspaces/{workspace_id}/conversations/GET/v1/workspaces/{workspace_id}/conversations/{conversation_id}——列出/取得對話串。PATCH
/v1/workspaces/{workspace_id}/conversations/{conversation_id}——重新命名/封存。POST
/v1/workspaces/{workspace_id}/conversations/{conversation_id}/share/DELETE/v1/workspaces/{workspace_id}/conversations/{conversation_id}/share——建立/撤銷唯讀公開連結。DELETE
/v1/workspaces/{workspace_id}/conversations/{conversation_id}——刪除對話串。
傳入 conversation 的 project_id 可將對話串立基於某個專案的指令與檔案之上。