Model Recommendations

Nebula API supports 150+ mainstream AI models. This page provides detailed model information, pricing, and usage instructions.
Enterprise-grade AI model API gateway. Aggregating excellent large models. No rate limits, no expiration, pay-as-you-go, reliable long-term service.
Below are the currently stable and popular models. For the complete model list and real-time pricing, visit Nebula API Console.
Status legendavailable: verified working over the API. partial: reachable but works only with payload constraints (see the notes below each table). unavailable: currently access-limited or returning errors. All model IDs below come from the live GET /v1/models snapshot (151 models).

Model Categories

OpenAI Series

Reasoning Models

Model NameModel IDFeaturesRecommended ForStatus
o4-minio4-miniLightweight reasoning modelCoding tasksavailable
o3-mini o3-miniLatest reasoning model, great valueComplex reasoning, math, codingavailable
o1o1Strong general-purpose reasoningComplex reasoning, analysisavailable

GPT Series

Model NameModel IDContextFeaturesRecommended ForStatus
GPT 5.5 gpt-5.5400KLatest flagship, most capable general modelConversation, thinking, copywriting, codingavailable
GPT 5.4gpt-5.4400KHigh-capability reasoning and codingConversation, thinking, copywriting, codingavailable
GPT 5.2gpt-5.2400KImproved on GPT-5.1, more reliable, flexible and user-friendly interactionConversation, thinking, copywriting, codingavailable
GPT 5.1 Codexgpt-5.1-codex400KEnhanced developer toolchain, stronger reasoning framework, context-aware code analysis and generationConversation, coding, copywritingavailable
GPT 5.1 Chatgpt-5.1-chat128KFirst to introduce chain-of-thought in chat, faster, more natural, context-aware dialogueConversation, copywritingavailable
GPT 5.1gpt-5.1400KOn-demand reasoning, adaptive reasoningConversation, thinking, copywriting, codingavailable
GPT 5.1 Codex Minigpt-5.1-codex-mini128KLightweight and efficient, for resource-constrained, cost-sensitive scenariosConversation, coding, copywritingavailable
GPT Chat Latestgpt-chat-latest128KRolling “latest chat” aliasConversation, copywritingpartial
GPT 5 Progpt-5-pro400KHighest-effort reasoning variantComplex reasoning, agentspartial
  • gpt-chat-latest rejects max_tokens — send max_completion_tokens instead.
  • gpt-5-pro must be called via /v1/responses; several /v1/chat/completions parameters are unsupported.

Image Generation Models

Model NameModel IDFeaturesStatus
GPT-Image-2gpt-image-2OpenAI latest image generationavailable
GPT-Image-1.5gpt-image-1.5OpenAI image generation, improved fidelityavailable
GPT-Image-1gpt-image-1OpenAI official image generationavailable

Audio & Realtime

Model NameModel IDCapabilityStatus
GPT Realtime 2gpt-realtime-2Realtime speech-to-speechavailable
GPT Realtimegpt-realtimeRealtime speech-to-speechavailable
GPT Realtime Minigpt-realtime-miniLightweight realtime audioavailable
GPT-4o Mini TTSgpt-4o-mini-ttsText-to-speech (/v1/audio/speech)available

Claude Series (Anthropic)

Claude 4 Series (Latest)

Model NameModel IDContextFeaturesRecommended ForStatus
Claude Opus 4.8 claude-opus-4-81MAnthropic’s latest flagship, frontier coding and agent performanceConversation, reasoning, coding, copywritingpartial
Claude Opus 4.7claude-opus-4-71MHigh-capability reasoning and codingConversation, reasoning, coding, copywritingpartial
Claude Opus 4.6claude-opus-4-61MSets new standards for production code, complex agents and office tasksConversation, reasoning, coding, copywritingavailable
Claude Opus 4.5claude-opus-4-5-20251101200KHighly capable model for production code and complex agentsConversation, thinking, copywriting, codingavailable
Claude Sonnet 4.6claude-sonnet-4-6200KBalanced speed and capability, strong tool useConversation, thinking, copywriting, codingavailable
Claude Sonnet 4.5claude-sonnet-4-5-20250929200KAgent improvements, tool handling, memory and context processing enhancedConversation, thinking, copywriting, codingavailable
Claude Haiku 4.5claude-haiku-4-5-20251001200KAnthropic’s most efficient model, fast and cost-effective near-frontier performanceConversation, thinking, copywriting, codingavailable
Claude Opus 4.7 / 4.8 deprecate the temperature parameter — omit sampling parameters or send a minimal payload to avoid 400 errors.

Google Gemini Series

Text Models

Model NameModel IDContextFeaturesRecommended ForStatus
Gemini 3.1 Pro Preview gemini-3.1-pro-preview1MPowerful agent and coding model, best multimodal understandingConversation, thinking, copywriting, codingavailable
Gemini 3.5 Flashgemini-3.5-flash-global1MFast, cost-effective multi-turn dialogueConversation, thinking, copywriting, codingavailable
Gemini 3 Flash Previewgemini-3-flash-preview1MPowerful agentic capabilities at speed and valueConversation, thinking, copywriting, codingpartial
Gemini 3.1 Flash Litegemini-3.1-flash-lite1MLightweight, low-latency variantConversation, fast responseavailable
Gemini 2.5 Progemini-2.5-pro1MHigh-capability multimodal reasoningConversation, thinking, copywriting, codingavailable
Gemini 2.5 Flashgemini-2.5-flash1MFast, cost-effective general modelConversation, fast responseavailable
gemini-3-flash-preview may time out on /v1/chat/completions when extended parameters are supplied — prefer a minimal payload.

Image Models

Model NameModel IDFeaturesStatus
Gemini 3 Pro Imagegemini-3-pro-image-previewGemini 3 Pro image generation with reasoningavailable
Gemini 3.1 Flash Imagegemini-3.1-flash-image-previewFast Gemini image generationavailable
Gemini 2.5 Flash Imagegemini-2.5-flash-imageGemini 2.5 image generationavailable

xAI Grok Series

Model NameModel IDContextFeaturesRecommended ForStatus
Grok 4.3grok-4.3See consoleLatest Grok flagship, strong natural language, math and reasoningConversation, thinking, copywriting, codingavailable
Grok 4.20 Reasoninggrok-4.20-0309-reasoningSee consoleReasoning variantConversation, thinking, codingavailable
Grok 4.20 Non-Reasoninggrok-4.20-0309-non-reasoningSee consoleFast non-reasoning variantConversation, copywritingavailable
Grok 4.1 Fast Reasoninggrok-4-1-fast-reasoningSee consoleCost-effective, fast reasoning variantConversation, thinking, codingavailable
Grok 4.1 Fast Non-Reasoninggrok-4-1-fast-non-reasoningSee consoleCost-effective, fast non-reasoning variantConversation, copywritingavailable

DeepSeek Series

Model NameModel IDContextFeaturesRecommended ForStatus
DeepSeek V4 Pro deepseek-v4-proSee consoleLatest DeepSeek flagship, strongest overall capabilityConversation, thinking, copywriting, codingavailable
DeepSeek V4 Flashdeepseek-v4-flashSee consoleFast, cost-effective V4 variantConversation, fast response, codingavailable
DeepSeek V3.2deepseek-v3-2-251201128KHybrid reasoning model, thinking and non-thinking modesConversation, thinking, copywriting, codingavailable
DeepSeek V3 (0324)deepseek-v3-250324128KStrong overall, cost-effectiveGeneral useavailable
DeepSeek R1deepseek-r1-25052864KReasoning modelMath, reasoningavailable

Chinese Models

Zhipu AI (GLM)

Model NameModel IDContextFeaturesRecommended ForStatus
GLM-5.2glm-5.2See consoleLatest Zhipu flagship chat modelConversation, copywriting, codingavailable
GLM-5.1glm-5.1See consoleZhipu flagship chat modelConversation, copywriting, codingavailable
GLM-4.7glm-4.7200KStrong coding and multi-step reasoning, 355B paramsConversation, thinking, long-range planning, coding, tool useavailable

Doubao Seed Series

Model NameModel IDContextFeaturesRecommended ForStatus
Doubao Seed 2.1 Prodoubao-seed-2-1-pro-260628See consoleLatest Doubao flagship chat modelConversation, thinking, copywritingavailable
Doubao Seed 2.0 Prodoubao-seed-2-0-pro-260215See consoleHigh-capability Doubao chat modelConversation, thinking, copywritingavailable
Doubao Seed 1.8doubao-seed-1-8-251228See consoleDoubao chat modelConversation, copywritingavailable

Alibaba Qwen

Model NameModel IDCapabilityFeaturesRecommended ForStatus
Qwen3.7 Maxqwen3.7-maxtextLatest Qwen flagshipConversation, thinking, copywriting, codingavailable
Qwen3 Maxqwen3-maxtextHigh-capability Qwen modelConversation, thinking, copywritingavailable
Qwen3 Coder Plusqwen3-coder-plustextCode model with strong Coding Agent, tool use and environment interactionConversation, thinking, coding, copywritingavailable
Qwen Image Plusqwen-image-plusimageQwen image generation, strong text renderingText-to-image, image generationavailable

Moonshot Kimi

Model NameModel IDContextFeaturesRecommended ForStatus
Kimi K2.7 Codekimi-k2.7-codeSee consoleLatest Kimi coding modelConversation, codingavailable
Kimi K2.6kimi-k2.6See consoleStrong general and agent capabilitiesConversation, thinking, copywriting, codingavailable
kimi-k2.5 kimi-k2.5256KNative multimodal, vision and text, thinking and non-thinking modesConversation, thinkingavailable
Kimi K2 Thinkingkimi-k2-thinking256KReasoning-focused MoE modelConversation, thinking, codingavailable

Video Generation

Model NameModel IDTypeStatus
Wan 2.7 (T2V)wan2.7-t2vText-to-videoavailable
Wan 2.7 (I2V)wan2.7-i2vImage-to-videoavailable
Wan 2.7 (R2V)wan2.7-r2vReference-to-videoavailable
Wan 2.6 (T2V)wan2.6-t2vText-to-videoavailable
Wan 2.6 (I2V)wan2.6-i2vImage-to-videoavailable
Wan 2.6 (R2V)wan2.6-r2vReference-to-videoavailable
Doubao Seedance 2.0doubao-seedance-2-0-260128Text/Image-to-videoavailable
Doubao Seedance 1.5 Prodoubao-seedance-1-5-pro-251215Text/Image-to-videoavailable
Doubao Seedance 1.0 Prodoubao-seedance-1-0-pro-250528Text/Image-to-videoavailable
Veo 3.1veo-3.1-generate-001Text/Image-to-videoavailable
Veo 3.1 Fastveo-3.1-fast-generate-001Text/Image-to-videoavailable
Veo 3.0 Fastveo-3.0-fast-generate-001Text/Image-to-videoavailable
HappyHorse 1.0 (T2V)happyhorse-1.0-t2vText-to-videoavailable
Sora 2sora-2Text-to-videounavailable
MiniMax Hailuo 2.3MiniMax-Hailuo-2.3Text/Image-to-videounavailable

Image Generation

Model NameModel IDProviderStatus
Doubao Seedream 5.0doubao-seedream-5-0-260128Doubaoavailable
Doubao Seedream 4.5doubao-seedream-4-5-251128Doubaoavailable
Doubao Seedream 4.0doubao-seedream-4-0-250828Doubaoavailable
Imagen 4.0 Ultraimagen-4.0-ultra-generate-001Googleavailable
Imagen 4.0imagen-4.0-generate-001Googleavailable
Imagen 3.0imagen-3.0-generate-002Googleavailable
Qwen Image Edit Plusqwen-image-edit-plusQwenavailable
MiniMax Image 01minimax-image-01MiniMaxavailable
Doubao Seedream 3.0doubao-seedream-3-0-t2i-250415Doubaounavailable
Image 01image-01MiniMaxunavailable

Embeddings

Model NameModel IDProviderStatus
Text Embedding 3 Largetext-embedding-3-largeOpenAIavailable
Text Embedding 3 Smalltext-embedding-3-smallOpenAIavailable
Text Embedding Ada 002text-embedding-ada-002OpenAIavailable

Pricing

Billing

  • Pay-as-you-go: Billed by actual Token usage
  • No minimum: Use what you pay for, balance never expires
  • Real-time billing: Deducted immediately after each call

Price Advantages

  • Official source forwarding with competitive pricing
  • Contact support for bulk discounts

Usage Guide

Model Selection

  • Top Performance: Claude Opus 4.8, GPT 5.5, Claude Sonnet 4.6
  • Cost-effective: Claude Haiku 4.5, GPT 5.1 Codex Mini, DeepSeek V4 Flash, Grok 4.1 Fast Reasoning, GLM-4.7
  • Alternative: o4-mini, Gemini 3.1 Pro Preview, Qwen3 Coder Plus, kimi-k2.5, doubao-seed-2-1-pro-260628

Cost Optimization

  1. Tiered usage: Use cheaper models for simple tasks
  2. Test first: Test with smaller models before scaling
  3. Batch processing: Use Mini versions for bulk tasks
  4. Cache reuse: Cache repeated query results

API Docs

Detailed API specifications

Quick Start

Integration guide
Model list is continuously updated. We add new models as they become available. Contact support for specific model requests or bulk needs.