OpenAISmart Nivel Vision Batch 50% Off

o3-mini

OpenAI · Released January 2025

Precio de Entrada

$1.10

por 1M tokens

Precio de Salida

$4.40

por 1M tokens

Ventana de Contexto

200K

tokens

Puntuacion de Velocidad

78

de 100

Benchmarks

Prom. 85/100
Coding90/100
Reasoning97/100
Extraction85/100
Creative80/100
Vision72/100

Precios

Entrada

Tokens de prompt / contexto

$1.10/ 1M

Salida

Tokens generados

$4.40/ 1M

API por Lotes

Descuento por procesamiento asincrono

$0.55 / $2.20

50% descuento sobre precio estandar

Ideal Para

reasoningcodinganalysis

o3-mini en contexto

En una mezcla típica de 70% entrada / 30% salida, o3-mini sale a $2.09 por millón de tokens. Eso lo sitúa por encima del 34% de los 32 modelos que seguimos aquí, y 0 modelos más de la misma capa gama media quedan por debajo. La capa es una etiqueta de capacidad, no una banda de precio: la horquilla dentro de una capa suele ser más ancha que la distancia entre capas, y por eso elegir solo por capa tiende a hacer gastar de más.

La entrada cuesta $1.10 por millón y la salida $4.40, una proporción de 4.0x. Esa proporción importa más que cualquiera de las dos cifras por separado: una carga de resumen o clasificación lee mucho más de lo que escribe y seguirá el precio de entrada, mientras que la generación de código o la escritura larga lo invierten y seguirán el de salida. Compara modelos según la proporción real de tu tráfico, no según el precio de entrada.

El perfil de benchmarks es irregular, no plano: razonamiento con 97/100 frente a visión con 72/100, una horquilla de 25 puntos. La media lo oculta. Si tu carga cae en el extremo fuerte, este modelo rinde por encima de su precio; si cae en el débil, un modelo más barato con un perfil más plano te servirá mejor.

La ventana de contexto es de 200K tokens y la puntuación de rendimiento, 78/100. El contexto solo se gana su sitio si lo llenas, y llenarlo es justo lo que encarece una petición: una ventana grande es una opción, no un descuento. Para un modelo de capa gama media, juzga la velocidad según lo que hagas: lo decide todo en chat interactivo y casi nada en procesos nocturnos por lotes.

Conviene comprobarlo antes de decidir: DeepSeek R1 puntúa al menos igual en programación y razonamiento combinados y sale a $1.04 por millón frente a los $2.09 de o3-mini. Eso no convierte a o3-mini en mala elección —ventana de contexto, latencia, dependencia del proveedor y capacidades concretas quedan fuera de una puntuación de benchmark—, pero sí significa que la diferencia de precio necesita un motivo detrás.

La comparación más cercana es GPT-5.6 Terra, de OpenAI, a $5.00 por millón frente a $2.09. 3 modelos de esta capa puntúan más alto en programación y razonamiento combinados, que es el encuadre útil: la pregunta rara vez es si un modelo es bueno, sino si es lo más barato que resulta suficientemente bueno para el trabajo concreto que le envías.

Lo que cuesta en producción

Con 10M + 2M tokens al mes —una carga de producción mediana realista— o3-mini cuesta unos $19.80. Enrutar por la API por lotes, con un 50% de descuento, la parte que tolera latencia lo dejaría en torno a $9.90, normalmente un ahorro mayor que cambiar de modelo.

Historial de Precios

No price changes since launch

Fortalezas

  • Best reasoning benchmark — ideal for math and science
  • Chain-of-thought structured problem solving
  • Good for agentic tasks requiring multi-step planning
  • 50% batch discount

Evitar Para

  • Creative writing
  • Simple chatbots and FAQ answering
  • Vision tasks