OpenAI lanza o3-pro: su modelo de IA más avanzado para razonamiento complejo

OpenAI revoluciona el razonamiento artificial con o3-pro

OpenAI ha lanzado oficialmente o3-pro, un modelo de inteligencia artificial que la compañía describe como el más capaz hasta la fecha. Esta nueva versión del modelo de razonamiento o3, presentado a principios de año, representa un salto significativo en capacidades analíticas.

Comparativa de rendimiento de modelos OpenAI en test GPQA Diamond
El modelo o3 lidera con 87.7% en pruebas de conocimiento científico de nivel PhD

Disponibilidad y costos innovadores

Desde este martes 10 de junio de 2025, o3-pro está disponible para usuarios de ChatGPT Pro y Teams, reemplazando al modelo anterior o1-pro. Los usuarios Enterprise y Educativos tendrán acceso la próxima semana. El modelo también está disponible en la API de desarrollo de OpenAI.

  • Precio en API: $20 por millón de tokens de entrada
  • Tokens de salida: $80 por millón generado
  • Equivalencia: Un millón de tokens ≈ 750,000 palabras (equivalente a «Guerra y Paz»)

Ventajas competitivas y herramientas

Según evaluaciones expertas:

«Revisadores prefieren consistentemente o3-pro sobre o3 en todas las categorías, especialmente en ciencia, educación, programación, negocios y ayuda en escritura»

El nuevo modelo supera a su predecesor en claridad, exhaustividad, seguimiento de instrucciones y precisión.

o3-pro incluye acceso a herramientas avanzadas:

  • Búsqueda web integrada
  • Análisis de archivos
  • Razonamiento sobre entradas visuales
  • Soporte para Python
  • Personalización mediante memoria
Comparativa de rendimiento en codificación entre modelos de IA
Tabla comparativa de rendimiento en tareas de programación

Limitaciones actuales

  • Chats temporales desactivados por un «problema técnico»
  • Incapacidad para generar imágenes
  • No soporta Canvas (espacio de trabajo con IA)
  • Respuestas más lentas que o1-pro

Dominio en benchmarks especializados

En pruebas internas, o3-pro supera a competidores clave:

  • Supera a Gemini 2.5 Pro de Google en AIME 2024 (evaluación matemática)
  • Mejor que Claude 4 Opus de Anthropic en GPQA Diamond (conocimiento científico nivel PhD)
Tabla comparativa de modelos de IA en múltiples dominios
Evaluación multidimensional de capacidades de IA

Comparte este artículo

Otras notas de tu interés:

Economia

Disrupt 2026: Ahorra hasta $200 y conecta con más de 10,000 líderes tecnológicos

Economia

Hallandale Beach: condenan a empresario por contrabando de espectrómetro nuclear a Rusia

Economia

Casa Blanca niega reporte sobre prohibición de exportación de diésel: las medidas se quedan cortas

Economia

Disrupt 2026: Ahorra hasta $200 en tu entrada y multiplica tus conexiones

Espectáculos y Entretenimiento

Spotify activa Taste Profile en EE. UU.: así puedes moldear tu algoritmo de recomendaciones

Economia

Ema recauda $77 millones en ronda Serie B para revolucionar la automatización empresarial con agentes de IA

Negocios

Corte de Apelaciones revisa el señalamiento del Pentágono contra Anthropic por seguridad nacional

Economia

Mitsotakis en San Francisco: IA, inversión y el regreso de Grecia

Negocios

Condenan a Kirill Gordei por contrabando de tecnología nuclear a Rusia mediante Apelsin Logistics

Economia

Microsoft y OpenAI: el robo masivo de trabajo que sacude la demanda por derechos de autor