Models / GPT Image 1 MiniID: openai/gpt-image-1-mini
by OpenAI·via OpenAI

GPT Image 1 Mini

OpenAI’s native multimodal vision-language model. Built for high-resolution visual comprehension, complex chart and document parsing, spatial reasoning, and visual question answering over a extended context window.

Maker

OpenAI

Served On

OpenAI

Architecture

Multimodal Vision-Language Transformer

Latency Profile

Standard (~480ms TTFT)

Optimized For:High-resolution OCR extractionComplex chart & diagram reasoningDocument VQA

Industry Benchmarks & Evaluations

Standard Verified Metrics
MathVista72.4%

Visual mathematical problem solving and chart geometry reasoning.

DocVQA (Document Understanding)94.1%

Dense tabular PDF, invoice, and technical documentation extraction.

MMMU (Multidisciplinary Visual)67.8%

College-level multi-discipline visual exam reasoning.

OCRBench88.5%

Fine-grained spatial optical character recognition accuracy.

Visual Needle in a Haystack99.5%

Multi-image and dense PDF context retrieval across 128K tokens.

Pricing

Rates are read live

Pricing for gpt-image-1-mini is fetched from the live catalogue on load, so it is never served from a cache that could outlive a repricing.

Specifications

Modality

image generation

Context window, compared

Insufficient data

No published context window for this model or its peers.

Vision
Function calling
System prompt

Usage on nRouter

Usage is temporarily unavailable

Our aggregate read failed, so we cannot report traffic for this model right now.

Availability

Availability is temporarily unavailable

Our own telemetry read failed, so we cannot report uptime or latency for this model right now. This says nothing about the model itself — it is not an outage, and we would rather show you nothing than a figure we did not measure.

Managed Gateway Routing

Unified single-key access with automatic multi-region fallback, real-time credit enforcement, and sub-millisecond routing latency.

More from OpenAI