Un estudio revela que los informes de uso de IA de las grandes tecnológicas ocultan casi la mitad de la realidad
Los informes sobre el comportamiento de uso de la IA publicados por las empresas desarrolladoras podrían no reflejar una imagen completa, tras descubrirse que casi la mitad de los datos personales son filtrados y eliminados.
En un mundo donde la tecnología de inteligencia artificial desempeña un papel crucial, la información sobre cómo la gente utiliza la Generative AI proviene en su mayoría de los informes de las propias empresas desarrolladoras, como OpenAI y Anthropic, las cuales suelen centrarse en presentar datos sobre el trabajo y la productividad (Work & Productivity).
Sin embargo, Anka Reuel, estudiante de doctorado en informática en el Stanford Trustworthy AI Research (STAIR Lab), señala que estos datos aún carecen de fuentes de verificación independientes para confirmar los hechos.
Recientemente, un equipo de investigadores del MIT Media Lab, la Universidad de Stanford y la red de investigación independiente Data Provenance Initiative (DPI) ha lanzado conjuntamente el proyecto "AI Observatory" para recopilar y analizar de forma transparente datos de uso de IA en el mundo real, basándose en 24,521 conversaciones consentidas (que suman 85,633 mensajes de interacción) y abarcando 52 modelos de lenguaje.
Los resultados del análisis mostraron que, al aplicar métodos de filtrado de datos similares a los que utilizan las empresas de IA (como el Anthropic Economic Index), aproximadamente el 48% de las conversaciones reales fueron eliminadas. El contenido filtrado suele tratar sobre asuntos personales, como la salud, las relaciones y temas sensibles, lo que refleja que los informes oficiales podrían no mostrar la imagen real de cómo la gente utiliza estas herramientas en su totalidad.
Refleja que la imagen actual del uso de la IA podría estar limitada a cuestiones de negocios y trabajo por motivos de marketing o políticas, mientras que el uso cotidiano de la gente común es ignorado.