当下模型推荐
Nebula API 支持 150+ 主流 AI 模型,本页面提供详细的模型信息、定价和使用说明。
企业级专业稳定的 AI 大模型 API 中转站,聚合各种优秀大模型。不限速,不过期,按量计费,长期可靠服务。
当前推荐模型
以下为当前稳定供给的热门模型,完整模型列表和实时价格请访问 Nebula API 控制台。
状态说明 — available:已通过 API 验证可用。partial:可访问,但仅在满足请求体约束时可用(详见各表下方说明)。unavailable:当前受限或返回错误。下列所有模型 ID 均来自实时 GET /v1/models 快照(151 个模型)。
模型分类
OpenAI 系列
推理模型(Reasoning Models)
| 模型名称 | 模型ID | 特点 | 推荐场景 | 状态 |
|---|
| o4-mini | o4-mini | 轻量级推理模型 | 编程任务首选 | available |
| o3-mini | o3-mini | 最新推理模型,性价比极高 | 复杂推理、数学、编程 | available |
| o1 | o1 | 强大的通用推理能力 | 复杂推理、分析 | available |
GPT 系列
| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 | 状态 |
|---|
| GPT 5.5 | gpt-5.5 | 400K | 最新旗舰,综合能力最强 | 对话、思考、文案生成、代码能力 | available |
| GPT 5.4 | gpt-5.4 | 400K | 高能力推理与编程 | 对话、思考、文案生成、代码能力 | available |
| GPT 5.2 | gpt-5.2 | 400K | 在 GPT-5.1 基础上改进,交互更可靠、灵活和用户友好 | 对话、思考、文案生成、代码能力 | available |
| GPT 5.1 Codex | gpt-5.1-codex | 400K | 增强开发者工具链,强化推理框架,支持上下文感知的代码分析与生成 | 对话、代码能力、文案生成 | available |
| GPT 5.1 Chat | gpt-5.1-chat | 128K | 首次在聊天场景引入链式思维,更快、更自然、更具上下文感知的对话体验 | 对话、文案生成 | available |
| GPT 5.1 | gpt-5.1 | 400K | 重点提升「按需推理」能力,自适应推理 | 对话、思考、文案生成、代码能力 | available |
| GPT 5.1 Codex Mini | gpt-5.1-codex-mini | 128K | 轻量高效,专为资源受限、成本敏感场景打造 | 对话、代码能力、文案生成 | available |
| GPT Chat Latest | gpt-chat-latest | 128K | 滚动更新的「最新对话」别名 | 对话、文案生成 | partial |
| GPT 5 Pro | gpt-5-pro | 400K | 最高推理强度版本 | 复杂推理、智能体 | partial |
- gpt-chat-latest 不支持
max_tokens,请改用 max_completion_tokens。
- gpt-5-pro 需通过
/v1/responses 调用,部分 /v1/chat/completions 参数不受支持。
图像生成模型
| 模型名称 | 模型ID | 特点 | 状态 |
|---|
| GPT-Image-2 | gpt-image-2 | OpenAI 最新图像生成 | available |
| GPT-Image-1.5 | gpt-image-1.5 | OpenAI 图像生成,保真度提升 | available |
| GPT-Image-1 | gpt-image-1 | OpenAI 官方图像生成 | available |
音频与实时(Audio & Realtime)
| 模型名称 | 模型ID | 能力 | 状态 |
|---|
| GPT Realtime 2 | gpt-realtime-2 | 实时语音对话 | available |
| GPT Realtime | gpt-realtime | 实时语音对话 | available |
| GPT Realtime Mini | gpt-realtime-mini | 轻量级实时音频 | available |
| GPT-4o Mini TTS | gpt-4o-mini-tts | 文本转语音(/v1/audio/speech) | available |
Claude 系列 (Anthropic)
Claude 4 系列(最新)
| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 | 状态 |
|---|
| Claude Opus 4.8 | claude-opus-4-8 | 1M | Anthropic 最新旗舰,前沿级编程与智能体表现 | 对话、推理、代码能力、文案能力 | partial |
| Claude Opus 4.7 | claude-opus-4-7 | 1M | 高能力推理与编程 | 对话、推理、代码能力、文案能力 | partial |
| Claude Opus 4.6 | claude-opus-4-6 | 1M | 为生产代码、复杂代理和复杂办公任务设定新标准 | 对话、推理、代码能力、文案能力 | available |
| Claude Opus 4.5 | claude-opus-4-5-20251101 | 200K | 面向生产代码与复杂代理的高能力模型 | 对话、思考、文案生成、代码能力 | available |
| Claude Sonnet 4.6 | claude-sonnet-4-6 | 200K | 速度与能力均衡,工具调用能力强 | 对话、思考、文案生成、代码能力 | available |
| Claude Sonnet 4.5 | claude-sonnet-4-5-20250929 | 200K | 代理能力进步,工具处理、内存管理和上下文处理性能增强 | 对话、思考、文案生成、代码能力 | available |
| Claude Haiku 4.5 | claude-haiku-4-5-20251001 | 200K | Anthropic 效率最高的模型,快速且经济高效地提供接近前沿的性能 | 对话、思考、文案生成、代码能力 | available |
Claude Opus 4.7 / 4.8 已弃用 temperature 参数,请省略采样参数或发送最小请求体以避免 400 错误。
Google Gemini 系列
文本模型
| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 | 状态 |
|---|
| Gemini 3.1 Pro Preview | gemini-3.1-pro-preview | 1M | 强大的智能体和编码模型,最佳的多模态理解能力 | 对话、思考、文案生成、代码能力 | available |
| Gemini 3.5 Flash | gemini-3.5-flash-global | 1M | 快速且高性价比的多轮对话 | 对话、思考、文案生成、代码能力 | available |
| Gemini 3 Flash Preview | gemini-3-flash-preview | 1M | 以显著的速度和价值提供强大的代理能力 | 对话、思考、文案生成、代码能力 | partial |
| Gemini 3.1 Flash Lite | gemini-3.1-flash-lite | 1M | 轻量、低延迟版本 | 对话、快速响应 | available |
| Gemini 2.5 Pro | gemini-2.5-pro | 1M | 高能力多模态推理 | 对话、思考、文案生成、代码能力 | available |
| Gemini 2.5 Flash | gemini-2.5-flash | 1M | 快速、高性价比的通用模型 | 对话、快速响应 | available |
gemini-3-flash-preview 在 /v1/chat/completions 上携带扩展参数时可能超时,建议使用最小请求体。
图像模型
| 模型名称 | 模型ID | 特点 | 状态 |
|---|
| Gemini 3 Pro Image | gemini-3-pro-image-preview | Gemini 3 Pro 图像生成,支持推理 | available |
| Gemini 3.1 Flash Image | gemini-3.1-flash-image-preview | 快速 Gemini 图像生成 | available |
| Gemini 2.5 Flash Image | gemini-2.5-flash-image | Gemini 2.5 图像生成 | available |
xAI Grok 系列
| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 | 状态 |
|---|
| Grok 4.3 | grok-4.3 | 见控制台 | 最新 Grok 旗舰,自然语言、数学和推理能力强 | 对话、思考、文案生成、代码能力 | available |
| Grok 4.20 Reasoning | grok-4.20-0309-reasoning | 见控制台 | 推理版本 | 对话、思考、代码能力 | available |
| Grok 4.20 Non-Reasoning | grok-4.20-0309-non-reasoning | 见控制台 | 快速非推理版本 | 对话、文案生成 | available |
| Grok 4.1 Fast Reasoning | grok-4-1-fast-reasoning | 见控制台 | 高性价比,快速推理版本 | 对话、思考、代码能力 | available |
| Grok 4.1 Fast Non-Reasoning | grok-4-1-fast-non-reasoning | 见控制台 | 高性价比,快速非推理版本 | 对话、文案生成 | available |
DeepSeek 系列
| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 | 状态 |
|---|
| DeepSeek V4 Pro | deepseek-v4-pro | 见控制台 | 最新 DeepSeek 旗舰,综合能力最强 | 对话、思考、文案生成、代码能力 | available |
| DeepSeek V4 Flash | deepseek-v4-flash | 见控制台 | 快速、高性价比的 V4 版本 | 对话、快速响应、代码能力 | available |
| DeepSeek V3.2 | deepseek-v3-2-251201 | 128K | 混合推理模型,支持思考与非思考模式 | 对话、思考、文案生成、代码能力 | available |
| DeepSeek V3 (0324) | deepseek-v3-250324 | 128K | 综合能力强,性价比高 | 通用场景 | available |
| DeepSeek R1 | deepseek-r1-250528 | 64K | 推理模型 | 数学、推理 | available |
国产模型系列
智谱 AI (GLM)
| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 | 状态 |
|---|
| GLM-5.2 | glm-5.2 | 见控制台 | 智谱最新旗舰对话模型 | 对话、文案生成、代码能力 | available |
| GLM-5.1 | glm-5.1 | 见控制台 | 智谱旗舰对话模型 | 对话、文案生成、代码能力 | available |
| GLM-4.7 | glm-4.7 | 200K | 具备更强的编程能力与更稳定的多步骤推理,总参数 355B | 对话、思考、长程任务规划、编码、工具协同 | available |
豆包 (Doubao) Seed 系列
| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 | 状态 |
|---|
| 豆包 Seed 2.1 Pro | doubao-seed-2-1-pro-260628 | 见控制台 | 最新豆包旗舰对话模型 | 对话、思考、文案生成 | available |
| 豆包 Seed 2.0 Pro | doubao-seed-2-0-pro-260215 | 见控制台 | 高能力豆包对话模型 | 对话、思考、文案生成 | available |
| 豆包 Seed 1.8 | doubao-seed-1-8-251228 | 见控制台 | 豆包对话模型 | 对话、文案生成 | available |
阿里通义千问 (Qwen)
| 模型名称 | 模型ID | 能力 | 特点 | 推荐场景 | 状态 |
|---|
| Qwen3.7 Max | qwen3.7-max | text | 最新通义千问旗舰 | 对话、思考、文案生成、代码能力 | available |
| Qwen3 Max | qwen3-max | text | 高能力通义千问模型 | 对话、思考、文案生成 | available |
| Qwen3 Coder Plus | qwen3-coder-plus | text | 代码生成模型,强大的 Coding Agent 能力,擅长工具调用和环境交互 | 对话、思考、代码能力、文案生成 | available |
| Qwen Image Plus | qwen-image-plus | image | 通义千问图像生成,卓越的文本渲染能力 | 文生图、图片生成 | available |
Moonshot Kimi 系列
| 模型名称 | 模型ID | 上下文长度 | 特点 | 推荐场景 | 状态 |
|---|
| Kimi K2.7 Code | kimi-k2.7-code | 见控制台 | 最新 Kimi 编程模型 | 对话、代码能力 | available |
| Kimi K2.6 | kimi-k2.6 | 见控制台 | 强大的通用与智能体能力 | 对话、思考、文案生成、代码能力 | available |
| kimi-k2.5 | kimi-k2.5 | 256K | 原生多模态,支持视觉与文本输入、思考与非思考模式 | 对话、思考 | available |
| Kimi K2 Thinking | kimi-k2-thinking | 256K | 专注推理的 MoE 模型 | 对话、思考、代码能力 | available |
视频生成
| 模型名称 | 模型ID | 类型 | 状态 |
|---|
| Wan 2.7 (T2V) | wan2.7-t2v | 文生视频 | available |
| Wan 2.7 (I2V) | wan2.7-i2v | 图生视频 | available |
| Wan 2.7 (R2V) | wan2.7-r2v | 参考生视频 | available |
| Wan 2.6 (T2V) | wan2.6-t2v | 文生视频 | available |
| Wan 2.6 (I2V) | wan2.6-i2v | 图生视频 | available |
| Wan 2.6 (R2V) | wan2.6-r2v | 参考生视频 | available |
| 豆包 Seedance 2.0 | doubao-seedance-2-0-260128 | 文生/图生视频 | available |
| 豆包 Seedance 1.5 Pro | doubao-seedance-1-5-pro-251215 | 文生/图生视频 | available |
| 豆包 Seedance 1.0 Pro | doubao-seedance-1-0-pro-250528 | 文生/图生视频 | available |
| Veo 3.1 | veo-3.1-generate-001 | 文生/图生视频 | available |
| Veo 3.1 Fast | veo-3.1-fast-generate-001 | 文生/图生视频 | available |
| Veo 3.0 Fast | veo-3.0-fast-generate-001 | 文生/图生视频 | available |
| HappyHorse 1.0 (T2V) | happyhorse-1.0-t2v | 文生视频 | available |
| Sora 2 | sora-2 | 文生视频 | unavailable |
| MiniMax Hailuo 2.3 | MiniMax-Hailuo-2.3 | 文生/图生视频 | unavailable |
图像生成
| 模型名称 | 模型ID | 提供商 | 状态 |
|---|
| 豆包 Seedream 5.0 | doubao-seedream-5-0-260128 | Doubao | available |
| 豆包 Seedream 4.5 | doubao-seedream-4-5-251128 | Doubao | available |
| 豆包 Seedream 4.0 | doubao-seedream-4-0-250828 | Doubao | available |
| Imagen 4.0 Ultra | imagen-4.0-ultra-generate-001 | Google | available |
| Imagen 4.0 | imagen-4.0-generate-001 | Google | available |
| Imagen 3.0 | imagen-3.0-generate-002 | Google | available |
| Qwen Image Edit Plus | qwen-image-edit-plus | Qwen | available |
| MiniMax Image 01 | minimax-image-01 | MiniMax | available |
| 豆包 Seedream 3.0 | doubao-seedream-3-0-t2i-250415 | Doubao | unavailable |
| Image 01 | image-01 | MiniMax | unavailable |
向量嵌入(Embeddings)
| 模型名称 | 模型ID | 提供商 | 状态 |
|---|
| Text Embedding 3 Large | text-embedding-3-large | OpenAI | available |
| Text Embedding 3 Small | text-embedding-3-small | OpenAI | available |
| Text Embedding Ada 002 | text-embedding-ada-002 | OpenAI | available |
定价说明
计费方式
- 按量计费:根据实际使用的 Token 数量计费
- 无最低消费:充多少用多少,余额永不过期
- 实时扣费:每次调用后立即从余额扣除费用
价格优势
- 官方源头转发,价格略有优势
- 批量使用可联系客服获取更优惠价格
使用建议
模型选择指南
编程开发
文本创作
快速响应
图像生成
视频生成
长文本处理
- 顶级性能:Claude Opus 4.8、GPT 5.5、Claude Sonnet 4.6
- 高性价比:Claude Haiku 4.5、GPT 5.1 Codex Mini、DeepSeek V4 Flash、Grok 4.1 Fast Reasoning、GLM-4.7
- 备选:o4-mini、Gemini 3.1 Pro Preview、Qwen3 Coder Plus、kimi-k2.5、doubao-seed-2-1-pro-260628
- 首选:GPT 5.5、Claude Opus 4.8、Claude Sonnet 4.6、GLM-5.2
- 备选:Gemini 3.1 Pro Preview、Kimi K2.6、GLM-4.7、doubao-seed-2-1-pro-260628
- 首选:Claude Haiku 4.5、Gemini 3.1 Flash Lite、Grok 4.1 Fast Reasoning
- 备选:GLM-5.2、GLM-4.7、GPT 5.1 Codex Mini、doubao-seed-2-0-mini-260215
- 推荐:GPT-Image-2、Qwen Image Plus、Gemini 3 Pro Image、豆包 Seedream 5.0
- 推荐:Wan 2.7(wan2.7-t2v)、豆包 Seedance 2.0、Veo 3.1
- 超长上下文:Gemini 3.1 Pro Preview(1M)、Claude Opus 4.8(1M)
- 编程场景:Claude 4 系列、kimi-k2.5、Kimi K2 Thinking
成本优化建议
- 分级使用:简单任务用便宜模型,复杂任务用高级模型
- 测试优化:先用小模型测试,确定需求后再用大模型
- 批量处理:大量相似任务可以选择 Mini 版本
- 缓存复用:对重复查询结果进行缓存
相关资源
模型列表持续更新中,我们会及时添加最新发布的优秀模型。如需使用特定模型或有批量需求,请联系客服。