GPT-5.6 Sol OpenAI's GPT-5.6 Sol tier for complex professional work, coding, and long-running agents. | gpt-5.6-sol | 2026-07-09 | OpenRouter listed | Official · 2026-07-09: $5 / $30 OpenRouter · 2026-08-11: $5 / $30 input / output, per 1M tokens | No reliable public source | No reliable public source |
GPT-5.6 Terra The balanced GPT-5.6 tier for intelligence and cost. | gpt-5.6-terra | 2026-07-09 | OpenRouter listed | Official · 2026-07-09: $2.5 / $15 OpenRouter · 2026-08-11: $1 / $6 input / output, per 1M tokens | No reliable public source | No reliable public source |
GPT-5.6 Luna The efficient GPT-5.6 tier for high-volume, cost-sensitive workloads. | gpt-5.6-luna | 2026-07-09 | OpenRouter listed | Official · 2026-07-09: $1 / $6 OpenRouter · 2026-08-11: $0.1 / $0.6 input / output, per 1M tokens | No reliable public source | No reliable public source |
GPT-Realtime-2.1 Realtime reasoning voice model with tool use and improved alphanumeric, noise, and interruption handling. | gpt-realtime-2.1 | 2026-07-06 | Not separately listed on OpenRouter | Official · 2026-07-08: $4 / $24 input / output, per 1M tokens | No reliable public source | No reliable public source |
GPT-Realtime-2.1 mini Distilled reasoning model for faster, lower-cost realtime voice interactions. | gpt-realtime-2.1-mini | 2026-07-06 | Not separately listed on OpenRouter | Official · 2026-07-08: $0.6 / $2.4 input / output, per 1M tokens | No reliable public source | No reliable public source |
GPT-5.5 OpenAI's GPT-5.5 model for coding and professional work. | gpt-5.5 | Not disclosed | OpenRouter listed | OpenRouter · 2026-08-11: $5 / $30 input / output, per 1M tokens | LMArena 1 row | No reliable public source |
GPT-5.5 pro A higher-precision pro variant of GPT-5.5. | gpt-5.5-pro | Not disclosed | OpenRouter listed | OpenRouter · 2026-08-11: $30 / $180 input / output, per 1M tokens | No reliable public source | No reliable public source |
GPT-5.4 A more affordable model for coding and professional work. | gpt-5.4 | Not disclosed | OpenRouter listed | OpenRouter · 2026-08-11: $2.5 / $15 input / output, per 1M tokens | No reliable public source | No reliable public source |
GPT-5.4 pro A higher-precision pro variant of GPT-5.4. | gpt-5.4-pro | Not disclosed | OpenRouter listed | OpenRouter · 2026-08-11: $30 / $180 input / output, per 1M tokens | No reliable public source | No reliable public source |
GPT-5.4 mini OpenAI's GPT-5.4 mini model for coding, computer use, and subagent tasks. | gpt-5.4-mini | Not disclosed | OpenRouter listed | OpenRouter · 2026-08-11: $0.75 / $4.5 input / output, per 1M tokens | No reliable public source | No reliable public source |
GPT-5.4 nano The cheapest GPT-5.4-class model for simple, high-volume tasks. | gpt-5.4-nano | Not disclosed | OpenRouter listed | OpenRouter · 2026-08-11: $0.2 / $1.25 input / output, per 1M tokens | No reliable public source | No reliable public source |
GPT-5 mini A near-frontier intelligence model for cost-sensitive, low-latency, high-volume workloads. | gpt-5-mini | Not disclosed | OpenRouter listed | OpenRouter · 2026-08-11: $0.25 / $2 input / output, per 1M tokens | No reliable public source | No reliable public source |
GPT-5 nano The fastest and most cost-efficient version of GPT-5. | gpt-5-nano | Not disclosed | OpenRouter listed | OpenRouter · 2026-08-11: $0.05 / $0.4 input / output, per 1M tokens | No reliable public source | No reliable public source |
GPT-5 The previous high-intelligence reasoning model for coding and agentic tasks. | gpt-5 | Not disclosed | OpenRouter listed | OpenRouter · 2026-08-11: $1.25 / $10 input / output, per 1M tokens | No reliable public source | No reliable public source |
GPT-4.1 OpenAI's GPT-4.1 model for non-reasoning workloads. | gpt-4.1 | Not disclosed | OpenRouter listed | OpenRouter · 2026-08-11: $2 / $8 input / output, per 1M tokens | No reliable public source | No reliable public source |
GPT Image 2 OpenAI's GPT Image 2 image generation model. | gpt-image-2 | Not disclosed | Not separately listed on OpenRouter | Official pricing page | LMArena 2 rows | No reliable public source |
gpt-realtime-2 A reasoning model built for realtime voice interactions. | gpt-realtime-2 | Not disclosed | Not separately listed on OpenRouter | Official pricing page | No reliable public source | No reliable public source |
gpt-realtime-translate A streaming speech-to-speech translation model. | gpt-realtime-translate | Not disclosed | Not separately listed on OpenRouter | Official pricing page | No reliable public source | No reliable public source |
gpt-realtime-whisper A streaming speech-to-text model for realtime transcription. | gpt-realtime-whisper | Not disclosed | Not separately listed on OpenRouter | Official pricing page | No reliable public source | No reliable public source |
gpt-realtime-1.5 OpenAI's previous-generation realtime voice model for audio input and output. | gpt-realtime-1.5 | Not disclosed | Not separately listed on OpenRouter | Official pricing page | No reliable public source | No reliable public source |
gpt-realtime A general realtime model capable of text and audio inputs and outputs. | gpt-realtime | Not disclosed | Not separately listed on OpenRouter | Official pricing page | No reliable public source | No reliable public source |
gpt-realtime-mini A cost-efficient version of GPT Realtime. | gpt-realtime-mini | Not disclosed | Not separately listed on OpenRouter | Official pricing page | No reliable public source | No reliable public source |
gpt-audio-1.5 OpenAI's voice model for audio input and output with Chat Completions. | gpt-audio-1.5 | Not disclosed | Not separately listed on OpenRouter | Official pricing page | No reliable public source | No reliable public source |
gpt-audio An audio input and audio output model for Chat Completions. | gpt-audio | Not disclosed | OpenRouter listed | OpenRouter · 2026-08-11: $2.5 / $10 input / output, per 1M tokens | No reliable public source | No reliable public source |
GPT-4o Transcribe A speech-to-text model powered by GPT-4o. | gpt-4o-transcribe | Not disclosed | Not separately listed on OpenRouter | Official pricing page | No reliable public source | No reliable public source |
GPT-4o mini Transcribe A cost-efficient speech-to-text model powered by GPT-4o mini. | gpt-4o-mini-transcribe | Not disclosed | Not separately listed on OpenRouter | Official pricing page | No reliable public source | No reliable public source |
GPT-4o Transcribe Diarize A transcription model that identifies who is speaking when. | gpt-4o-transcribe-diarize | Not disclosed | Not separately listed on OpenRouter | Official pricing page | No reliable public source | No reliable public source |
TTS-1 A text-to-speech model optimized for speed. | tts-1 | Not disclosed | Not separately listed on OpenRouter | Official pricing page | No reliable public source | No reliable public source |
TTS-1 HD A text-to-speech model optimized for audio quality. | tts-1-hd | Not disclosed | Not separately listed on OpenRouter | Official pricing page | No reliable public source | No reliable public source |
GPT-5.3-Codex OpenAI's GPT-5.3 Codex model for agentic coding tasks. | gpt-5.3-codex | Not disclosed | OpenRouter listed | OpenRouter · 2026-08-11: $1.75 / $14 input / output, per 1M tokens | No reliable public source | No reliable public source |
gpt-oss-120b Text-only open-weight reasoning and agent model with 117B total and 5.1B active parameters, designed to run on a single 80GB GPU. | gpt-oss-120b | 2025-08-05 | OpenRouter listed | OpenRouter · 2026-08-11: $0.037 / $0.17 input / output, per 1M tokens | No reliable public source | 1 community discussion / 1 activity snapshot |
gpt-oss-20b Text-only open-weight reasoning model for low-latency, local, and edge deployment, designed to run within 16GB of memory. | gpt-oss-20b | 2025-08-05 | OpenRouter listed | OpenRouter · 2026-08-11: $0.03 / $0.13 input / output, per 1M tokens | No reliable public source | 1 activity snapshot |
text-embedding-3-large OpenAI's text-embedding-3-large embedding model. | text-embedding-3-large | Not disclosed | Not separately listed on OpenRouter | Official pricing page | No reliable public source | No reliable public source |
text-embedding-3-small A smaller current embedding model. | text-embedding-3-small | Not disclosed | Not separately listed on OpenRouter | Official pricing page | No reliable public source | No reliable public source |
text-embedding-ada-002 An older embedding model that remains documented on OpenAI's current model pages. | text-embedding-ada-002 | Not disclosed | Not separately listed on OpenRouter | Official pricing page | No reliable public source | No reliable public source |
omni-moderation A moderation model for identifying potentially harmful content in text and images. | omni-moderation | Not disclosed | Not separately listed on OpenRouter | Official pricing page | No reliable public source | No reliable public source |
GPT Transcribe OpenAI's transcription model for audio files and committed turns in Realtime sessions. | gpt-transcribe | 2026-07-28 | Not separately listed on OpenRouter | Official pricing page | No reliable public source | No reliable public source |
GPT Live Transcribe OpenAI's low-latency streaming transcription model for Realtime transcription sessions. | gpt-live-transcribe | 2026-07-28 | Not separately listed on OpenRouter | Official pricing page | No reliable public source | No reliable public source |