GPT-4o
Por OpenAI · Estado: Disponible
Modelo omnimodal de OpenAI (texto e imagen como entrada, texto como salida, salidas estructuradas).
Última verificación: 17/09/2026 · Fuente oficial
Resumen técnico
| Estado | Disponible |
|---|---|
| Contexto | 128.000 tokens por solicitud |
| Salida máxima | 16.384 tokens |
| API | Confirmada |
| Uso local | No soportado (confirmado) |
| Licencia | Propietaria |
Capacidades verificadas
Confirmadas: Texto Visión Salida estructurada
Sin confirmar: Audio (entrada), Audio (salida), Imágenes, Video, Razonamiento, Programación, Llamadas a herramientas, Búsqueda web y otros datos.
La ausencia de confirmación no significa que el modelo carezca de la capacidad.
Precios
| Concepto | Precio | Unidad | Condición |
|---|---|---|---|
| Entrada en caché | US$ 1,25 / 1M tokens | 1M tokens | Tarifa estándar |
| Entrada | US$ 2,5 / 1M tokens | 1M tokens | Tarifa estándar |
| Salida | US$ 10 / 1M tokens | 1M tokens | Tarifa estándar |
Verificado: 17/09/2026
Los precios pueden cambiar. Verificá siempre la fuente oficial antes de contratar o integrar un servicio.
Noticias relacionadas
Todavía no hay noticias vinculadas a este modelo.
Otros modelos de OpenAI
Aprender a usarlo
Técnicas, plantillas y herramientas para comunicarte mejor con este tipo de modelos.
Evaluaciones (6 registradas)
Cantidad de resultados por categoría —un conteo, no un puntaje— con fuente, versión y fecha de verificación. Ver metodología. Comparar estas evaluaciones
- Conocimiento: 2 · ver observatorio
- Matematica: 1 · ver observatorio
- Multimodal: 1 · ver observatorio
- Programacion: 2 · ver observatorio
| Benchmark | Resultado | Fuente |
|---|---|---|
| GPQA Diamond (Conocimiento) PROVEEDOR | 53,6 % Métrica: accuracy · versión diamond-198 |
OpenAI (Hello GPT-4o) · 18/09/2026
Comparabilidad: Azar = 25%. Expertos humanos no especialistas rondan 65%: superar eso indica conocimiento real, no inteligencia general. |
| MMLU (Conocimiento) PROVEEDOR | 88,7 % Métrica: accuracy · versión original-57 |
OpenAI (Hello GPT-4o) · 18/09/2026
Comparabilidad: Errores de ground-truth documentados (MMLU-Redux). Saturado en frontera: bajo poder discriminativo actual. |
| MATH (Matematica) PROVEEDOR | 76,6 % Métrica: accuracy · versión full-5000 |
OpenAI (Hello GPT-4o) · 18/09/2026
Comparabilidad: Distinguir full vs MATH-500 al comparar. |
| MMMU (Multimodal) PROVEEDOR | 69,1 % Métrica: accuracy · versión val-11550 |
OpenAI (Hello GPT-4o) · 18/09/2026
Comparabilidad: Separar vision-comprension de generacion de imagenes: no usar multimodal como capacidad unica. |
| HumanEval (Programacion) PROVEEDOR | 90,2 % Métrica: pass@1 · versión v1.0.0 |
OpenAI (Hello GPT-4o) · 18/09/2026
Comparabilidad: No comparar pass@1 con pass@k. Benchmark cercano a saturacion en modelos frontera. |
| SWE-bench Verified (Programacion) | 33,2 % Métrica: % tareas resueltas · versión Verified-500 |
Leaderboard oficial SWE-bench (vista Bash Only) · 18/09/2026
Comparabilidad: El harness influye: resultados con distinto agente no son directamente comparables. No representa todo el trabajo de programacion. |