基础配置

除非具体页面另有说明,所有示例都使用以下配置:
项目
原始 API Basehttps://llm.ai-nebula.com
OpenAI SDK Basehttps://llm.ai-nebula.com/v1
认证请求头Authorization: Bearer <NEBULA_API_KEY>
当前可用模型使用当前 API Key 调用 GET /v1/models 查看
同一个模型供应商下,不同模型可能需要不同接口或不同参数。复制示例前,请先查看模型目录和本路由表。

接口路由表

能力模型系列推荐接口请求体格式说明
文本对话OpenAI Chat 兼容模型、Qwen、GLM、DeepSeek、Kimi、Grok、部分已验证 Gemini/Claude 模型POST /v1/chat/completionsOpenAI Chat先使用最小请求体。temperaturemax_tokens 等可选参数需按模型确认。
文本推理GPT-5、GPT-5 Pro、o 系列POST /v1/responsesOpenAI ResponsesGPT-5 Pro 系列和推理控制首选/必须使用。使用 max_output_tokens
Claude 原生Claude 模型POST /v1/messagesAnthropic MessagesClaude 原生客户端和完整 Claude 能力首选。部分 Claude 模型会拒绝 Chat 接口中的 temperature
Claude Token 计数Claude 模型POST /v1/messages/count_tokensAnthropic token count在 Messages 请求前估算输入 token。
Gemini 原生文本Gemini 文本模型POST /v1beta/models/{model}:generateContentGemini contents[].parts[]需要 Gemini 特有字段、原生流式、原生兼容时使用。
OpenAI Embeddingstext-embedding-3-smalltext-embedding-3-largetext-embedding-ada-002POST /v1/embeddingsOpenAI Embeddings已验证可用的向量接口。
Gemini Embeddingsgemini-embedding-001暂不推荐,待验证Gemini 原生 embedding最新审计中,文档请求体返回 HTTP 400。当前请使用 /v1/embeddings 模型。
Rerank当前 API Key 可用的重排序模型POST /v1/rerankNebula rerank先用 GET /v1/models 确认模型是否可用。
图像生成GPT Image、Gemini image / Nano Banana、Doubao Seedream/Seededit、Qwen Image、Imagen、Minimax imagePOST /v1/images/generations按供应商区分的图像请求体同一个接口,不同供应商请求体不同。不要跨模型系列复用请求体。
视频生成Sora、Veo、Wanxiang、Seedance、HappyHorse、可用的 Minimax videoPOST /v1/video/generations按供应商区分的异步请求体提交任务后轮询 GET /v1/video/generations/{task_id}i2v/r2v 需要媒体输入。
GPT Realtime v1gpt-realtimegpt-realtime-miniwss://llm.ai-nebula.com/v1/realtime?model={model}OpenAI Realtime v1 eventssession.update 使用 session.modalities
GPT Realtime v2gpt-realtime-2wss://llm.ai-nebula.com/v1/realtime?model=gpt-realtime-2OpenAI Realtime v2 eventssession.update 使用 session.type: "realtime",不要发送 v1 的 modalities
Gemini Livegemini-live-2.5-flash-native-audiowss://llm.ai-nebula.com/ws/v1beta/models/{model}/liveStreamGemini Live WebSocket首先发送 setup。生产使用前请通过测试脚本验证实时行为。
语音合成gpt-4o-mini-ttsPOST /v1/audio/speechOpenAI audio speech返回二进制音频。

安全起步请求体

Chat Completions

{
  "model": "qwen-plus",
  "messages": [
    { "role": "user", "content": "Reply with exactly: ok" }
  ]
}

Responses API

{
  "model": "gpt-5.2",
  "max_output_tokens": 64,
  "input": [
    { "role": "user", "content": "Reply with exactly: ok" }
  ]
}

Claude Messages

{
  "model": "claude-sonnet-4-5-20250929",
  "max_tokens": 64,
  "messages": [
    { "role": "user", "content": "Reply with exactly: ok" }
  ]
}

Gemini Native

{
  "contents": [
    {
      "role": "user",
      "parts": [{ "text": "Reply with exactly: ok" }]
    }
  ],
  "generationConfig": { "maxOutputTokens": 64 }
}

使用原则

  • 使用模型前先调用 GET /v1/models
  • 先用最小请求体,再逐个添加可选参数。
  • 不要假设 temperaturemax_tokens、媒体字段或搜索工具在所有供应商中通用。
  • 媒体生成请严格按照图像/视频页面中的供应商请求体。
  • WebSocket API 需要 WebSocket 客户端或 Postman WebSocket 模式,不能用普通 HTTP Send。