Lógica visual multimodal
o4 procesa diagramas y capturas de pantalla directamente dentro de su cadena de razonamiento, lo que reduce los errores de lógica visual en un 35 % en comparación con modelos mini anteriores.
curl --request POST "https://gptproto.com/v1/chat/completions" \
--header "Authorization: Bearer $GPTPROTO_API_KEY" \
--header "Content-Type: application/json" \
--data '{
"model": "o4-mini",
"messages": [
{
"role": "user",
"content": "Hello"
}
]
}'Chat, coding agents & document work. Priced per 1M tokens — input, cached input and output are billed separately. GPTProto is 10% below official rates.
OpenAI · ≈ 148M tokens/mo (48M cached)
OpenRouter costs include its ~5.5% credit purchase fee. GPTProto applies a per-model discount (10–30% off) and your bonus credits are also spent at discounted rates — savings compound. Estimates assume a 60% cache hit rate.
Descubre las capacidades más destacadas de o4, desde el razonamiento visual nativo hasta el uso agéntico de herramientas. Estas funciones lo convierten en el modelo de razonamiento más potente y rentable de su categoría.
o4 procesa diagramas y capturas de pantalla directamente dentro de su cadena de razonamiento, lo que reduce los errores de lógica visual en un 35 % en comparación con modelos mini anteriores.
Como el primer modelo mini con uso de herramientas en varios pasos, o4 puede navegar de forma independiente, ejecutar código Python y realizar análisis recursivos de archivos para flujos de trabajo complejos.
Con una puntuación del 94 % en AIME y del 98,9 % en MATH-500, o4 ofrece una lógica de nivel puntero para aplicaciones científicas y matemáticas a una fracción del costo.
Los desarrolladores pueden usar el parámetro de esfuerzo de razonamiento para ajustar la profundidad lógica de o4 y equilibrar la velocidad y la precisión, desde chats sencillos hasta matemáticas complejas.
Preguntas frecuentes sobre el razonamiento multimodal, los benchmarks de rendimiento y la integración de API de o4-mini en GPTProto.com. Aprende a optimizar la profundidad lógica y los costes.
Guías, comparativas y novedades relacionadas con este modelo.
Todos los artículos
Más grande no siempre significa mejor. Descubre cómo gpt-4o-mini ofrece un rendimiento rápido y rentable para las tareas de desarrollo diarias. Lee ahora el análisis completo.

Explora cómo GPT-4o está transformando las transacciones digitales mediante nuevos protocolos como ACP y ACT. Descubre cómo los agentes de IA están yendo más allá de la conversación para gestionar pagos del mundo real y facilitar un comercio autónomo y seguro tanto para empresas como para consumidores.

Convierte audio en texto al instante con GPT-4o transcribe. Aprende a acceder a esta revolucionaria IA, conoce sus usos prácticos y descubre sus precios asequibles.

Conoce GPT-4o Mini TTS, el modelo de texto a voz de OpenAI que ofrece voces naturales, expresión emocional y tiempos de respuesta rápidos.

Descubre las diferencias clave entre GPT-4o y GPT-4 en nuestra guía completa de diciembre de 2025. Compara precios, rendimiento y capacidades multimodales, y descubre qué modelo de OpenAI se adapta mejor a tus necesidades.