A diferencia de los sistemas de IA limitados o especializados diseñados para tareas específicas, la Inteligencia Artificial General (AGI) puede realizar una amplia gama de funciones que tienen como objetivo replicar las amplias capacidades cognitivas y la adaptabilidad de la inteligencia humana. AGI puede funcionar de forma autónoma tomando decisiones y realizando acciones de forma independiente. AGI también puede comprender información ambigua o incompleta.
Lograr AGI es una tarea compleja y desafiante, ya que requiere resolver numerosos problemas difíciles en el aprendizaje automático, el procesamiento del lenguaje natural, la robótica y otros campos relacionados con la IA.
Investigadores del Laboratorio Nacional Clave de Inteligencia Artificial General proponen una nueva forma de evaluar el AGI mediante la introducción de la prueba Tong. “Tong” corresponde al carácter chino de general en AGI.
Proponen que la evaluación de AGI debería basarse en escenarios con los entornos complejos de DEPSI. Dicen que sólo a través de evaluaciones dentro de DEPSI se pueden evaluar rápidamente las habilidades humanas de AGI, como el razonamiento de sentido común, la inferencia de intenciones de las interacciones sociales, la confianza y la autoconciencia. La prueba de Tong ofrece una nueva perspectiva sobre la evaluación del AGI al enfatizar la importancia de DEPSI como una evaluación de habilidades orientada a valores en lugar de a tareas.
La prueba de Tong es un sistema de evaluación y referencia que se centra en características esenciales como tareas infinitas, generación de tareas autónoma, alineación de valores y comprensión causal. Su plataforma virtual propuesta también podría soportar la IA incorporada en el entrenamiento y las pruebas. Los agentes de IA incorporados adquieren información dentro de esta plataforma y continúan aprendiendo y perfeccionando sus valores y habilidades de forma interactiva.
Para respaldar infinitas tareas, siguen un modelo gráfico compositivo como una forma básica de representación del conocimiento que analiza las relaciones espaciales, temporales y causales de cualquier escena determinada. Definen un espacio fluido para las variables que varían en el tiempo; estos representan todas las configuraciones de escena posibles que se pueden representar dentro de un espacio ambiental DEPSI continuo.
La prueba de Tong abarca dos dominios llamados sistema dual U-V. El sistema U describe la comprensión del agente de reglas físicas o sociales extrínsecas. Por el contrario, el sistema V comprende los valores intrínsecos del agente, definidos como un conjunto de funciones de valor sobre las cuales se construyen las conductas autoimpulsadas del agente. La plataforma de prueba Tong tiene módulos para visualización de datos intermedios y un panel que muestra el rendimiento del modelo, indicando qué tan bien se desempeñó el modelo probado.
Por lo tanto, la prueba de Tong propuesta basada en DEPSI define los cinco niveles multidimensionales de valores y habilidades y proporciona un camino práctico para construir una guía teórica para el desarrollo de algoritmos de IA.
Revisar la Papel. Todo el crédito por esta investigación va a los investigadores de este proyecto. Además, no olvides unirte. nuestro SubReddit de más de 30.000 ml, Comunidad de Facebook de más de 40.000 personas, Canal de discordia, y Boletín electrónicodonde compartimos las últimas noticias sobre investigaciones de IA, interesantes proyectos de IA y más.
Si te gusta nuestro trabajo, te encantará nuestra newsletter.
Arshad es pasante en MarktechPost. Actualmente cursa su carrera internacional. Maestría en Física del Instituto Indio de Tecnología Kharagpur. Comprender las cosas hasta el nivel fundamental conduce a nuevos descubrimientos que conducen al avance de la tecnología. Le apasiona comprender la naturaleza fundamentalmente con la ayuda de herramientas como modelos matemáticos, modelos de aprendizaje automático e inteligencia artificial.