La IA se ha hecho tan lista que el mejor test que había para comprobar su inteligencia ya no sirve. Han tenido que crear uno nuevo

OpenAI enfrenta un nuevo test de inteligencia artificial tras superar el anterior con facilidad
Foto: genbeta.com

OpenAI enfrenta un nuevo test de inteligencia artificial tras superar el anterior con facilidad

El test ARC-AGI, diseñado para evaluar la inteligencia de modelos de IA con tareas difíciles para ellos pero sencillas para humanos, ha sido actualizado. OpenAI logró superar la primera versión con un 87.5% en su modelo más avanzado, lo que llevó a la creación de ARC-AGI 2. Este nuevo benchmark introduce más desafíos eliminando soluciones por fuerza bruta y aumentando el número de tareas. A pesar de los avances en IA, los modelos actuales no logran superar el 5% en esta nueva versión, mientras que los humanos resuelven las pruebas con facilidad. La competición ARC Prize 2025 ofrece un premio de 700,000 dólares y busca fomentar avances en inteligencia artificial general. También se han aumentado los recursos computacionales y el tiempo de participación, asegurando transparencia y rigurosidad en las evaluaciones.

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *