基础配置
除非具体页面另有说明,所有示例都使用以下配置:
| 项目 | 值 |
|---|
| 原始 API Base | https://llm.ai-nebula.com |
| OpenAI SDK Base | https://llm.ai-nebula.com/v1 |
| 认证请求头 | Authorization: Bearer <NEBULA_API_KEY> |
| 当前可用模型 | 使用当前 API Key 调用 GET /v1/models 查看 |
同一个模型供应商下,不同模型可能需要不同接口或不同参数。复制示例前,请先查看模型目录和本路由表。
接口路由表
| 能力 | 模型系列 | 推荐接口 | 请求体格式 | 说明 |
|---|
| 文本对话 | OpenAI Chat 兼容模型、Qwen、GLM、DeepSeek、Kimi、Grok、部分已验证 Gemini/Claude 模型 | POST /v1/chat/completions | OpenAI Chat | 先使用最小请求体。temperature、max_tokens 等可选参数需按模型确认。 |
| 文本推理 | GPT-5、GPT-5 Pro、o 系列 | POST /v1/responses | OpenAI Responses | GPT-5 Pro 系列和推理控制首选/必须使用。使用 max_output_tokens。 |
| Claude 原生 | Claude 模型 | POST /v1/messages | Anthropic Messages | Claude 原生客户端和完整 Claude 能力首选。部分 Claude 模型会拒绝 Chat 接口中的 temperature。 |
| Claude Token 计数 | Claude 模型 | POST /v1/messages/count_tokens | Anthropic token count | 在 Messages 请求前估算输入 token。 |
| Gemini 原生文本 | Gemini 文本模型 | POST /v1beta/models/{model}:generateContent | Gemini contents[].parts[] | 需要 Gemini 特有字段、原生流式、原生兼容时使用。 |
| OpenAI Embeddings | text-embedding-3-small、text-embedding-3-large、text-embedding-ada-002 | POST /v1/embeddings | OpenAI Embeddings | 已验证可用的向量接口。 |
| Gemini Embeddings | gemini-embedding-001 | 暂不推荐,待验证 | Gemini 原生 embedding | 最新审计中,文档请求体返回 HTTP 400。当前请使用 /v1/embeddings 模型。 |
| Rerank | 当前 API Key 可用的重排序模型 | POST /v1/rerank | Nebula rerank | 先用 GET /v1/models 确认模型是否可用。 |
| 图像生成 | GPT Image、Gemini image / Nano Banana、Doubao Seedream/Seededit、Qwen Image、Imagen、Minimax image | POST /v1/images/generations | 按供应商区分的图像请求体 | 同一个接口,不同供应商请求体不同。不要跨模型系列复用请求体。 |
| 视频生成 | Sora、Veo、Wanxiang、Seedance、HappyHorse、可用的 Minimax video | POST /v1/video/generations | 按供应商区分的异步请求体 | 提交任务后轮询 GET /v1/video/generations/{task_id}。i2v/r2v 需要媒体输入。 |
| GPT Realtime v1 | gpt-realtime、gpt-realtime-mini | wss://llm.ai-nebula.com/v1/realtime?model={model} | OpenAI Realtime v1 events | session.update 使用 session.modalities。 |
| GPT Realtime v2 | gpt-realtime-2 | wss://llm.ai-nebula.com/v1/realtime?model=gpt-realtime-2 | OpenAI Realtime v2 events | session.update 使用 session.type: "realtime",不要发送 v1 的 modalities。 |
| Gemini Live | gemini-live-2.5-flash-native-audio | wss://llm.ai-nebula.com/ws/v1beta/models/{model}/liveStream | Gemini Live WebSocket | 首先发送 setup。生产使用前请通过测试脚本验证实时行为。 |
| 语音合成 | gpt-4o-mini-tts | POST /v1/audio/speech | OpenAI audio speech | 返回二进制音频。 |
安全起步请求体
Chat Completions
{
"model": "qwen-plus",
"messages": [
{ "role": "user", "content": "Reply with exactly: ok" }
]
}
Responses API
{
"model": "gpt-5.2",
"max_output_tokens": 64,
"input": [
{ "role": "user", "content": "Reply with exactly: ok" }
]
}
Claude Messages
{
"model": "claude-sonnet-4-5-20250929",
"max_tokens": 64,
"messages": [
{ "role": "user", "content": "Reply with exactly: ok" }
]
}
Gemini Native
{
"contents": [
{
"role": "user",
"parts": [{ "text": "Reply with exactly: ok" }]
}
],
"generationConfig": { "maxOutputTokens": 64 }
}
使用原则
- 使用模型前先调用
GET /v1/models。
- 先用最小请求体,再逐个添加可选参数。
- 不要假设
temperature、max_tokens、媒体字段或搜索工具在所有供应商中通用。
- 媒体生成请严格按照图像/视频页面中的供应商请求体。
- WebSocket API 需要 WebSocket 客户端或 Postman WebSocket 模式,不能用普通 HTTP Send。