De Turing a la Etiqueta Nutricional: Innovadores Métodos para Evaluar la Inteligencia Artificial

De Turing a la Etiqueta Nutricional: Innovadores Métodos para Evaluar la Inteligencia Artificial

Proponen Nuevas Formas de Evaluar la Inteligencia Artificial

Los avances en modelos de lenguaje han transformado la inteligencia artificial (IA) en algo cotidiano y omnipresente. Actualmente, se han multiplicado las aplicaciones y herramientas, lo que dificulta determinar cuál es la más adecuada para tareas específicas. Un reciente estudio publicado en la revista Science, realizado por investigadores de Princeton, el MIT, Cambridge y Google DeepMind, propone innovadoras metodologías para la evaluación de la inteligencia artificial, dejando atrás el tradicional test de Turing y los rankings recientes. Según José Hernández-Orallo, autor principal del artículo, la pregunta original de Turing sobre si una máquina puede pasar por humano ya tiene una respuesta afirmativa.

Nuevas Preguntas para Mejorar la Evaluación de la IA

El artículo enfatiza la necesidad de reformular las preguntas sobre la inteligencia artificial. En lugar de indagar si la IA puede superar o sustituir al ser humano, se proponen tres ejes de evaluación que enfatizan la diversidad, el impacto en la cognición humana y su efecto en la sociedad. Hernández-Orallo explica que comparar la inteligencia artificial con el vuelo de las aeronaves es un buen ejemplo: «Las máquinas pueden volar de muchas formas, pero no todas tienen que parecerse a los pájaros ni ser las más rápidas o ligeras».

Para facilitar esta evaluación, los investigadores sugieren desglosar la medición de cada sistema de IA en varias categorías. Cada inteligencia artificial debería ser descrita según sus fortalezas, debilidades y contextos en los que es más eficiente. Esto permitiría a los usuarios entender mejor qué esperar de cada sistema AI, como se ilustró con el ejemplo de un programa útil en finanzas, pero incapaz de manejar declaraciones de impuestos ficticias.

La Relación entre IA y el Ser Humano

El segundo enfoque de evaluación se centra en el usuario humano. Es esencial comprender si la interacción con la inteligencia artificial mejora la capacidad cognitiva del usuario o si, por el contrario, genera dependencia. Sin embargo, este tipo de investigación enfrenta desafíos, como el acceso a registros de conversaciones, que actualmente pertenecen a las empresas. Hernández-Orallo menciona que en los próximos años, la evidencia sobre las consecuencias cognitivas de la IA se volverá más sistemática, lo que facilitará cambios en políticas públicas.

Evaluación desde una Perspectiva Social

El tercer tipo de medición busca evaluar el impacto social de la IA. Un sistema puede ser beneficioso para sus usuarios, pero generar desventajas para la mayoría. También puede influir en la productividad de las empresas y afectar el empleo en ciertos sectores. En este sentido, los autores sugieren simular entornos donde personajes artificiales imiten a individuos reales, lo que permitiría apreciar los efectos de la IA en diferentes contextos sociales y económicos.

Un Llamado a la Acción para la Regulación de la IA

La pregunta sobre quién se encargaría de estas evaluaciones queda abierta. Hernández-Orallo sugiere la creación de consorcios que incluyan universidades, empresas y administraciones públicas. En un contexto geopolítico complicado, donde las grandes corporaciones dominan el sector de la IA, se vuelve crucial aumentar la financiación pública para centros de investigación independientes. La UE podría liderar consorcios internacionales, aunque requeriría más recursos para garantizar una regulación efectiva.

Este artículo no solo presenta un llamado a la acción, sino que enfatiza la necesidad urgente de recursos y voluntad política para avanzar en la evaluación de la inteligencia artificial. La comunidad científica y empresarial debe unirse para garantizar un futuro seguro y responsable para la IA.

0 0 votes
Article Rating
Subscribe
Notify of
guest
0 Comments
Oldest
Newest Most Voted
Inline Feedbacks
View all comments

Puede que te interese