Actualidad: ver ahora
Cotizaciones: dolar oficial / blue

GPT-4o

Por OpenAI · Estado: Disponible

Modelo omnimodal de OpenAI (texto e imagen como entrada, texto como salida, salidas estructuradas).

Última verificación: 17/09/2026 · Fuente oficial

Resumen técnico

EstadoDisponible
Contexto128.000 tokens por solicitud
Salida máxima16.384 tokens
APIConfirmada
Uso localNo soportado (confirmado)
LicenciaPropietaria

Capacidades verificadas

Confirmadas: Texto Visión Salida estructurada

Sin confirmar: Audio (entrada), Audio (salida), Imágenes, Video, Razonamiento, Programación, Llamadas a herramientas, Búsqueda web y otros datos.

La ausencia de confirmación no significa que el modelo carezca de la capacidad.

Precios

Precios de API del proveedor, impuestos no incluidos cuando corresponda.
ConceptoPrecioUnidadCondición
Entrada en caché US$ 1,25 / 1M tokens 1M tokens Tarifa estándar
Entrada US$ 2,5 / 1M tokens 1M tokens Tarifa estándar
Salida US$ 10 / 1M tokens 1M tokens Tarifa estándar

Verificado: 17/09/2026

Fuente oficial del precio

Los precios pueden cambiar. Verificá siempre la fuente oficial antes de contratar o integrar un servicio.

Noticias relacionadas

Todavía no hay noticias vinculadas a este modelo.

Otros modelos de OpenAI

Aprender a usarlo

Técnicas, plantillas y herramientas para comunicarte mejor con este tipo de modelos.

Ver técnicas de prompting Construir un prompt

Evaluaciones (6 registradas)

Cantidad de resultados por categoría —un conteo, no un puntaje— con fuente, versión y fecha de verificación. Ver metodología. Comparar estas evaluaciones

Resultados registrados para GPT-4o
BenchmarkResultadoFuente
GPQA Diamond (Conocimiento) PROVEEDOR 53,6 %
Métrica: accuracy · versión diamond-198
OpenAI (Hello GPT-4o) · 18/09/2026
Comparabilidad: Azar = 25%. Expertos humanos no especialistas rondan 65%: superar eso indica conocimiento real, no inteligencia general.
MMLU (Conocimiento) PROVEEDOR 88,7 %
Métrica: accuracy · versión original-57
OpenAI (Hello GPT-4o) · 18/09/2026
Comparabilidad: Errores de ground-truth documentados (MMLU-Redux). Saturado en frontera: bajo poder discriminativo actual.
MATH (Matematica) PROVEEDOR 76,6 %
Métrica: accuracy · versión full-5000
OpenAI (Hello GPT-4o) · 18/09/2026
Comparabilidad: Distinguir full vs MATH-500 al comparar.
MMMU (Multimodal) PROVEEDOR 69,1 %
Métrica: accuracy · versión val-11550
OpenAI (Hello GPT-4o) · 18/09/2026
Comparabilidad: Separar vision-comprension de generacion de imagenes: no usar multimodal como capacidad unica.
HumanEval (Programacion) PROVEEDOR 90,2 %
Métrica: pass@1 · versión v1.0.0
OpenAI (Hello GPT-4o) · 18/09/2026
Comparabilidad: No comparar pass@1 con pass@k. Benchmark cercano a saturacion en modelos frontera.
SWE-bench Verified (Programacion) 33,2 %
Métrica: % tareas resueltas · versión Verified-500
Leaderboard oficial SWE-bench (vista Bash Only) · 18/09/2026
Comparabilidad: El harness influye: resultados con distinto agente no son directamente comparables. No representa todo el trabajo de programacion.

Probar este modelo

Probar contexto Calcular costos