ARC-AGI: el test fácil para humanos y durísimo para IAs. La pregunta es: ¿sirve realmente para medir si hemos llegado a la AGI?

ARC-AGI-2: La nueva prueba que desafía la inteligencia artificial general
Foto: xataka.com

ARC-AGI-2: La nueva prueba que desafía la inteligencia artificial general

La Arc Prize Foundation ha lanzado ARC-AGI-2, un nuevo conjunto de pruebas para evaluar la capacidad de generalización, aprendizaje y adaptación de los modelos de inteligencia artificial. Estas pruebas, diseñadas por François Chollet y su equipo, buscan medir lo cerca que estamos de alcanzar una Inteligencia Artificial General (AGI). A diferencia de otros benchmarks que evalúan conocimientos matemáticos o de programación, ARC-AGI-2 se enfoca en desafíos abstractos con patrones visuales. Mientras los humanos resuelven alrededor del 60% de estas pruebas, los modelos actuales apenas alcanzan un 5%, y algunos no superan el 1%. Además, esta versión introduce una métrica de eficiencia para evitar que la IA recurra a la fuerza bruta. La prueba también evidencia la Paradoja de Moravec: las IA sobresalen en tareas complejas para los humanos, pero fallan en problemas que nos resultan intuitivos. A pesar de su potencial, ARC-AGI-2 plantea un riesgo: que las empresas diseñen modelos específicamente para superarlo sin mejorar su capacidad real de razonamiento. Este tipo de pruebas es crucial para desarrollar sistemas de IA que no solo memoricen información, sino que realmente razonen y se adapten a problemas inéditos.

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *