El Desafío Definitivo: ARC-AGI-2 Pone a Prueba la Verdadera Inteligencia de los Modelos de IA

¿Pueden las IA Superar este Nuevo Test de Inteligencia General?

La Fundación Arc Prize, cofundada por el investigador de IA François Chollet, ha lanzado el ARC-AGI-2: un test revolucionario que mide la capacidad de razonamiento adaptativo de los modelos de inteligencia artificial. Los primeros resultados son reveladores: sistemas como GPT-4.5 y Claude 3.7 apenas alcanzan el 1% de eficiencia.

Ejemplo de problema visual ARC-AGI-2

Problema tipo del test: identificar patrones en cuadrículas de colores

El Muro de los Modelos de IA

  • Puntuaciones actuales: 1.3% para sistemas de razonamiento (OpenAI o1-pro)
  • Comparación humana: 60% de acierto en paneles de 400 personas
  • Novedad clave: Métrica de eficiencia computacional para evitar soluciones por fuerza bruta

Comparación histórica de tests ARC-AGI

¿Qué Hace Diferente al ARC-AGI-2?

«La inteligencia no se define solo por resolver problemas, sino por la eficiencia al adquirir habilidades»
– Greg Kamradt, cofundador de Arc Prize

El test exige a las IA interpretar patrones nunca vistos, replicando el aprendizaje humano. Un ejemplo claro: mientras el modelo o3 (low) de OpenAI logró 75.7% en ARC-AGI-1, en esta nueva versión solo alcanza 4% con un costo de $200 por tarea.

Arc Prize 2025: El Reto Económico

La fundación lanzó una competencia global con premio millonario: alcanzar 85% de precisión gastando solo $0.42 por tarea. Esto fuerza a los desarrolladores a optimizar no solo la inteligencia, sino también la sostenibilidad económica de los sistemas.

Comparte este artículo

Otras notas de tu interés:

Economia

Disrupt 2026: Ahorra hasta $200 y conecta con más de 10,000 líderes tecnológicos

Economia

Hallandale Beach: condenan a empresario por contrabando de espectrómetro nuclear a Rusia

Economia

Disrupt 2026: Ahorra hasta $200 en tu entrada y multiplica tus conexiones

Espectáculos y Entretenimiento

Spotify activa Taste Profile en EE. UU.: así puedes moldear tu algoritmo de recomendaciones

Economia

Ema recauda $77 millones en ronda Serie B para revolucionar la automatización empresarial con agentes de IA

Negocios

Corte de Apelaciones revisa el señalamiento del Pentágono contra Anthropic por seguridad nacional

Economia

Mitsotakis en San Francisco: IA, inversión y el regreso de Grecia

Negocios

Condenan a Kirill Gordei por contrabando de tecnología nuclear a Rusia mediante Apelsin Logistics

Economia

Microsoft y OpenAI: el robo masivo de trabajo que sacude la demanda por derechos de autor

Negocios

GPT-5.6 Sol: OpenAI revela instrucciones ocultas de la IA para ocultar errores a sus sucesores