Skip to content

OpenAI SLAAI vendor · Uptime guarantee, credits and support

AIChecked 15h ago
Official SLAStatus pageCompare

Promise vs reality

Promised in the SLAObserved on the vendor's status pagePartial historyShortfall

Status history since Sep 9, 2026

All incidents, weighted: 99.824% · Downtime
Services with an SLA
1/4
Highest SLA
99.9%
Lowest observed, 365d
100%
Fastest support
n/a

Services and tiers

  • ChatGPT EnterpriseAI models · measured other

    Page (openai.com/chatgpt/enterprise redirects to chatgpt.com/business/enterprise) says only 'Includes 24/7 support with SLAs. You can add premium support for faster responses, a dedicated contact, and on-call availability.' No uptime % or response-time numbers are public.

  • OpenAI API (Standard / pay-as-you-go processing)AI models · measured other · SLA of Dec 1, 2025

    The OpenAI Services Agreement (fetched 2026-09-23) contains no uptime or service-credit schedule; section 12.2 says 'THE SERVICES ARE PROVIDED "AS IS."' subject to a warranty that Services conform to the Documentation. Published SLAs exist only for Scale Tier (and, per docs, Fast mode on eligible Enterprise agreements).

  • OpenAI API Fast mode (formerly Priority processing)AI models · measured other

    Docs FAQ: 'Fast mode for GPT-6 Astra does not include a latency SLA. For GPT-5.6 and earlier models, Fast mode and Scale Tier receive the same service-level agreement treatment, and eligible Enterprise agreements may provide service credits when latency targets aren't met.' No numbers are stated on the Fast mode page itself, so tiers is empty (the Scale Tier numbers may apply by reference but that is not stated explicitly).

  • OpenAI API Scale TierAI models · measured monthly
    • Scale Tier: GPT-5.5Scale Tier token units for GPT-5.5 (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 50 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
    • Scale Tier: GPT-5.4 miniScale Tier token units for GPT-5.4 mini (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 100 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
    • Scale Tier: GPT-5.4 (excludes long-context >272K)Scale Tier token units for GPT-5.4 (excludes long-context >272K) (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 50 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
    • Scale Tier: GPT-5.2Scale Tier token units for GPT-5.2 (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 50 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
    • Scale Tier: GPT-5.1Scale Tier token units for GPT-5.1 (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 50 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
    • Scale Tier: GPT-5Scale Tier token units for GPT-5 (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 50 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
    • Scale Tier: GPT-5 miniScale Tier token units for GPT-5 mini (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 80 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
    • Scale Tier: GPT-4.1 (excludes long-context >128K)Scale Tier token units for GPT-4.1 (excludes long-context >128K) (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 80 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
    • Scale Tier: GPT-4.1 mini (excludes long-context >128K)Scale Tier token units for GPT-4.1 mini (excludes long-context >128K) (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 90 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
    • Scale Tier: GPT-4.1 nano (excludes long-context >128K)Scale Tier token units for GPT-4.1 nano (excludes long-context >128K) (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 100 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
    • Scale Tier: GPT-4.1 fine tuningScale Tier token units for GPT-4.1 fine tuning (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 80 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
    • Scale Tier: GPT-4.1 mini fine tuningScale Tier token units for GPT-4.1 mini fine tuning (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 90 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
    • Scale Tier: o3Scale Tier token units for o3 (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 80 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
    • Scale Tier: o4-miniScale Tier token units for o4-mini (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 90 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
    • Scale Tier: GPT-4oScale Tier token units for GPT-4o (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 80 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
    • Scale Tier: GPT-4o miniScale Tier token units for GPT-4o mini (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 90 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
    • Scale Tier: GPT-4o mini fine tuningScale Tier token units for GPT-4o mini fine tuning (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 90 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
    • Scale Tier: o1Scale Tier token units for o1 (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 80 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits
    • Scale Tier: o3-miniScale Tier token units for o3-mini (Enterprise customers, min 30-day purchase). Latency SLA: 99% > 90 tokens per second, calculated as p50 request latency on a per 5 minute basis.99.9%no credits

Support response times

Plans

Fastest first response by plan

  • ChatGPT Enterprise (included support)n/a
  • ChatGPT Enterprise (included support)No published response targets.

Latest incidents

Status page

SLA changes

  • Sep23OpenAI API Scale TierGPT-5.5 Scale Tier latency SLA listed as '99% > 100 tokens per second' in the 2026-06-11 snapshot; the live page on 2026-09-23 lists '99% > 50 tokens per second'. Exact change date unknown (between those dates).Source
  • Jul30OpenAI API Fast mode (formerly Priority processing)Priority processing renamed Fast mode ('Priority processing was renamed Fast mode on July 30, 2026'); service_tier 'priority' still accepted.Source
  • Aug10OpenAI API Scale TierLatency SLA methodology changed from 'average request latency on per minute basis across the month' (e.g. GPT-4o 99% > 25 tokens/s in Aug 2024) to 'p50 request latency on a per 5 minute basis'. Change occurred between the 2025-04-04 and 2025-08-10 archived snapshots; uptime stayed 99.9%.Source

About OpenAI

Only public numeric SLA: Scale Tier 99.9% uptime + per-model latency SLA (credit amounts unpublished). Standard API has no SLA in the Services Agreement. Status page components (34, from status.openai.com/api/v2/components.json): Ads Manager, Login, Images, Files, FedRAMP, Sora, Ads API, Fine-tuning, Realtime, Search, Compliance API, Agent, Deep Research, Codex Web, Connectors/Apps, Codex in ChatGPT Desktop, Codex API, Embeddings, VS Code extension, Sites, File uploads, Voice mode, ChatGPT Atlas, Login, CLI, Conversations, GPTs, Image Generation, ChatGPT Work, Chat Completions, Responses, Batch, Audio, Moderations.

OpenAI is an American artificial intelligence (AI) public benefit corporation (PBC) headquartered in San Francisco, California. It develops proprietary generative AI models, particularly its generative pre-trained transformer (GPT) series of large language models. Source

Highest commitment: OpenAI API Scale Tier, 99.9% (Scale Tier: GPT-5.5).

Compare OpenAI with

Summaries of published SLAs; the contract you sign governs. Logos via logo.dev; trademarks belong to their owners.

Weekly: SLA changes from cloud, data and AI vendors, Fridays.