| Text chat | OpenAI-compatible chat models, Qwen, GLM, DeepSeek, Kimi, Grok, many Gemini/Claude models verified for chat | POST /v1/chat/completions | OpenAI Chat | Use a minimal payload first. Optional params such as temperature and max_tokens are model-specific. |
| Text reasoning | GPT-5, GPT-5 Pro, o-series | POST /v1/responses | OpenAI Responses | Required/preferred for GPT-5 pro family and reasoning controls. Use max_output_tokens. |
| Claude native | Claude models | POST /v1/messages | Anthropic Messages | Preferred for Claude-native clients and full Anthropic features. Some Claude models reject chat temperature. |
| Claude token count | Claude models | POST /v1/messages/count_tokens | Anthropic token count | Estimates input tokens before a Messages request. |
| Gemini native text | Gemini text models | POST /v1beta/models/{model}:generateContent | Gemini contents[].parts[] | Use for Gemini-specific fields, native streaming, and provider-native compatibility. |
| OpenAI embeddings | text-embedding-3-small, text-embedding-3-large, text-embedding-ada-002 | POST /v1/embeddings | OpenAI Embeddings | Verified working embedding route. |
| Gemini embeddings | gemini-embedding-001 | Not recommended until verified | Gemini native embedding | Latest audit returned HTTP 400 for the documented native shape. Use /v1/embeddings models for now. |
| Rerank | Rerank models available to your key | POST /v1/rerank | Nebula rerank | Confirm model availability with GET /v1/models. |
| Image generation | GPT Image, Gemini image / Nano Banana, Doubao Seedream/Seededit, Qwen Image, Imagen, Minimax image | POST /v1/images/generations | Provider-specific image body | Same endpoint, different body per provider. Do not reuse one model family’s payload for another. |
| Video generation | Sora, Veo, Wanxiang, Seedance, HappyHorse, Minimax video where available | POST /v1/video/generations | Provider-specific async body | Submit task, poll GET /v1/video/generations/{task_id}. i2v/r2v modes require media inputs. |
| GPT Realtime v1 | gpt-realtime, gpt-realtime-mini | wss://llm.ai-nebula.com/v1/realtime?model={model} | OpenAI Realtime v1 events | Session update uses session.modalities. |
| GPT Realtime v2 | gpt-realtime-2 | wss://llm.ai-nebula.com/v1/realtime?model=gpt-realtime-2 | OpenAI Realtime v2 events | Session update uses session.type: "realtime"; do not send v1 modalities. |
| Gemini Live | gemini-live-2.5-flash-native-audio | wss://llm.ai-nebula.com/ws/v1beta/models/{model}/liveStream | Gemini Live WebSocket | Send setup first. Verify live behavior with the tested scripts before production use. |
| Audio speech | gpt-4o-mini-tts | POST /v1/audio/speech | OpenAI audio speech | Returns binary audio. |