OpenAI SLAAI vendor · Uptime guarantee, credits and support
Promise vs reality
Status history since Sep 9, 2026
All incidents, weighted: 99.824% · Downtime- Services with an SLA
- 1/4
- Highest SLA
- 99.9%
- Lowest observed, 365d
- 100%
- Fastest support
- n/a
Services and tiers
- ChatGPT EnterpriseAI models · measured other
Page (openai.com/chatgpt/enterprise redirects to chatgpt.com/business/enterprise) says only 'Includes 24/7 support with SLAs. You can add premium support for faster responses, a dedicated contact, and on-call availability.' No uptime % or response-time numbers are public.
- OpenAI API (Standard / pay-as-you-go processing)AI models · measured other · SLA of Dec 1, 2025
The OpenAI Services Agreement (fetched 2026-09-23) contains no uptime or service-credit schedule; section 12.2 says 'THE SERVICES ARE PROVIDED "AS IS."' subject to a warranty that Services conform to the Documentation. Published SLAs exist only for Scale Tier (and, per docs, Fast mode on eligible Enterprise agreements).
- OpenAI API Fast mode (formerly Priority processing)AI models · measured other
Docs FAQ: 'Fast mode for GPT-6 Astra does not include a latency SLA. For GPT-5.6 and earlier models, Fast mode and Scale Tier receive the same service-level agreement treatment, and eligible Enterprise agreements may provide service credits when latency targets aren't met.' No numbers are stated on the Fast mode page itself, so tiers is empty (the Scale Tier numbers may apply by reference but that is not stated explicitly).
- OpenAI API Scale TierAI models · measured monthly
- Scale Tier: GPT-5.5Scale Tier token units for GPT-5.5 (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 50 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
- Scale Tier: GPT-5.4 miniScale Tier token units for GPT-5.4 mini (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 100 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
- Scale Tier: GPT-5.4 (excludes long-context >272K)Scale Tier token units for GPT-5.4 (excludes long-context >272K) (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 50 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
- Scale Tier: GPT-5.2Scale Tier token units for GPT-5.2 (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 50 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
- Scale Tier: GPT-5.1Scale Tier token units for GPT-5.1 (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 50 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
- Scale Tier: GPT-5Scale Tier token units for GPT-5 (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 50 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
- Scale Tier: GPT-5 miniScale Tier token units for GPT-5 mini (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 80 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
- Scale Tier: GPT-4.1 (excludes long-context >128K)Scale Tier token units for GPT-4.1 (excludes long-context >128K) (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 80 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
- Scale Tier: GPT-4.1 mini (excludes long-context >128K)Scale Tier token units for GPT-4.1 mini (excludes long-context >128K) (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 90 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
- Scale Tier: GPT-4.1 nano (excludes long-context >128K)Scale Tier token units for GPT-4.1 nano (excludes long-context >128K) (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 100 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
- Scale Tier: GPT-4.1 fine tuningScale Tier token units for GPT-4.1 fine tuning (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 80 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
- Scale Tier: GPT-4.1 mini fine tuningScale Tier token units for GPT-4.1 mini fine tuning (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 90 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
- Scale Tier: o3Scale Tier token units for o3 (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 80 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
- Scale Tier: o4-miniScale Tier token units for o4-mini (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 90 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
- Scale Tier: GPT-4oScale Tier token units for GPT-4o (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 80 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
- Scale Tier: GPT-4o miniScale Tier token units for GPT-4o mini (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 90 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
- Scale Tier: GPT-4o mini fine tuningScale Tier token units for GPT-4o mini fine tuning (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 90 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
- Scale Tier: o1Scale Tier token units for o1 (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 80 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
- Scale Tier: o3-miniScale Tier token units for o3-mini (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 90 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
Support response times
PlansFastest first response by plan
- ChatGPT Enterprise (included support)n/a
- ChatGPT Enterprise (included support)No published response targets.
Latest incidents
Status page- Sep 23, 2026Elevated Error Rates for ChatGPT across Plus and Pro plans.Minor
- Sep 22, 2026Elevated Error Rates for ChatGPT Work, across Plus, Pro, Business, Enterprise and Education plans.Minor
- Sep 22, 2026Increased error rate for Plus and Pro users.Minor
- Sep 17, 2026We are seeing elevated error rates across API modelsMinor
- Sep 17, 2026Elevated errors affecting ChatGPT Work modeOutage
- Sep 16, 2026Elevated errors in ChatGPT WorkMinor
- Sep 15, 2026Elevated errors with gpt-image-2.5-flareOutage
- Sep 15, 2026Ads Manager login issuesMinor
- Sep 15, 2026Elevated errors from GPT-5.6 and GPT-5.6 Instant on paid plansMinor
- Sep 14, 2026Elevated errors affecting Work Mode in ChatGPTMinor
- Sep 13, 2026Elevated errors for ChatGPT users in EuropeMinor
- Sep 13, 2026Codex GitHub Review and Pull Request FailuresMinor
SLA changes
- Sep23OpenAI API Scale TierGPT-5.5 Scale Tier latency SLA listed as '99% > 100 tokens per second' in the 2026-06-11 snapshot; the live page on 2026-09-23 lists '99% > 50 tokens per second'. Exact change date unknown (between those dates).Source
- Jul30OpenAI API Fast mode (formerly Priority processing)Priority processing renamed Fast mode ('Priority processing was renamed Fast mode on July 30, 2026'); service_tier 'priority' still accepted.Source
- Aug10OpenAI API Scale TierLatency SLA methodology changed from 'average request latency on per minute basis across the month' (e.g. GPT-4o 99% > 25 tokens/s in Aug 2024) to 'p50 request latency on a per 5 minute basis'. Change occurred between the 2025-04-04 and 2025-08-10 archived snapshots; uptime stayed 99.9%.Source
About OpenAI
Only public numeric SLA: Scale Tier 99.9% uptime + per-model latency SLA (credit amounts unpublished). Standard API has no SLA in the Services Agreement. Status page components (34, from status.openai.com/api/v2/components.json): Ads Manager, Login, Images, Files, FedRAMP, Sora, Ads API, Fine-tuning, Realtime, Search, Compliance API, Agent, Deep Research, Codex Web, Connectors/Apps, Codex in ChatGPT Desktop, Codex API, Embeddings, VS Code extension, Sites, File uploads, Voice mode, ChatGPT Atlas, Login, CLI, Conversations, GPTs, Image Generation, ChatGPT Work, Chat Completions, Responses, Batch, Audio, Moderations.
OpenAI is an American artificial intelligence (AI) public benefit corporation (PBC) headquartered in San Francisco, California. It develops proprietary generative AI models, particularly its generative pre-trained transformer (GPT) series of large language models. Source
Highest commitment: OpenAI API Scale Tier, 99.9% (Scale Tier: GPT-5.5).
Compare OpenAI with
Summaries of published SLAs; the contract you sign governs. Logos via logo.dev; trademarks belong to their owners.