OpenAI enfrenta un nuevo test de inteligencia artificial tras superar el anterior con facilidad
El test ARC-AGI, diseñado para evaluar la inteligencia de modelos de IA con tareas difíciles para ellos pero sencillas para humanos, ha sido actualizado. OpenAI logró superar la primera versión con un 87.5% en su modelo más avanzado, lo que llevó a la creación de ARC-AGI 2. Este nuevo benchmark introduce más desafíos eliminando soluciones por fuerza bruta y aumentando el número de tareas. A pesar de los avances en IA, los modelos actuales no logran superar el 5% en esta nueva versión, mientras que los humanos resuelven las pruebas con facilidad. La competición ARC Prize 2025 ofrece un premio de 700,000 dólares y busca fomentar avances en inteligencia artificial general. También se han aumentado los recursos computacionales y el tiempo de participación, asegurando transparencia y rigurosidad en las evaluaciones.
