Installation
Supported Providers
OpenAI
Access GPT-4o, o1, o3, DALL-E, Whisper, and more.xAI (Grok)
Use Grok models from xAI.DeepSeek
Access DeepSeek’s reasoning models.Custom OpenAI-Compatible APIs
Connect to any service implementing the OpenAI API:- Local inference servers (vLLM, TGI, LocalAI)
- Cloud providers offering OpenAI-compatible endpoints
- Self-hosted model APIs
Setup
OpenAI
- Sign up at OpenAI Platform
- Navigate to API Keys
- Create a new key
- Set environment variable:
xAI (Grok)
DeepSeek
Custom OpenAI-Compatible API
Available Models
OpenAI Models
GPT-5 Series (Latest):gpt-5- Latest GPT-5 modelgpt-5-mini- Smaller, faster GPT-5gpt-5.1- Enhanced GPT-5
gpt-4.5- Latest GPT-4.5gpt-4.5-preview- Preview version
gpt-4o- Multimodal flagshipgpt-4o-mini- Faster, cost-effective
o1- Advanced reasoningo3- Latest reasoning modelo3-mini- Lightweight reasoningo4-mini- Enhanced mini reasoning
gpt-4-turbo- Fast GPT-4gpt-4- Original GPT-4gpt-4-vision- Vision-enabled
gpt-3.5-turbo- Fast and affordable
- Multi-turn conversations
- Function calling
- System messages
- JSON mode (most models)
- Streaming
OpenAI Modalities
Image Generation:dall-e-3- Latest DALL-Edall-e-2- Previous version
whisper-1- Speech transcription
tts-1- Standard qualitytts-1-hd- High definition
text-embedding-3-large- 3072 dimensionstext-embedding-3-small- 1536 dimensionstext-embedding-ada-002- Legacy model
Usage Examples
Basic Text Generation (OpenAI)
Multimodal Input (Vision)
Use
visualDetailLevel: 'low' to reduce token usage for simple images.Function Calling
Streaming Responses
Image Generation (DALL-E)
Text-to-Speech
Speech-to-Text (Whisper)
Text Embeddings
JSON Output Mode
Using Custom Model
Configuration Examples
Using Anthropic via OpenAI-Compatible API
Some providers offer OpenAI-compatible endpoints:Local Model Server (vLLM, Ollama with OpenAI API)
Model Configuration
Common Parameters
OpenAI-Specific Configuration
Model Selection Guide
When to Use Each Model
gpt-5 / gpt-4.5:- Latest capabilities
- Most advanced reasoning
- Best for complex tasks
- Multimodal (text + images)
- Strong general performance
- Balanced speed and quality
- Fast and affordable
- Good for most tasks
- Best value
- Advanced reasoning
- Mathematical proofs
- Complex problem solving
- Longer thinking time
- Simple tasks
- High volume
- Budget-conscious
Troubleshooting
API Key Not Found
Rate Limiting
Model Not Found
Context Length Exceeded
- GPT-4o: 128K tokens
- GPT-4 Turbo: 128K tokens
- o1: 200K tokens
Best Practices
- Use environment variables for API keys
- Choose the right model - use mini models for simple tasks
- Implement retry logic for production
- Monitor token usage to control costs
- Use streaming for better user experience
- Set appropriate max tokens to prevent runaway costs
- Cache embeddings to avoid redundant API calls
Pricing
OpenAI pricing varies by model. As of latest updates:
See OpenAI Pricing for current rates.
Cost Optimization:
- Use
gpt-4o-minifor most tasks - Set
maxOutputTokensto limit costs - Use prompt caching when available
- Batch requests when possible