Anthropic revela usos maliciosos de su inteligencia artificial y asegura haber detenido las actividades detectadas.
Anthropic ha publicado un informe sobre el uso malicioso de Claude, su herramienta de inteligencia artificial. La empresa analizó actividades detectadas durante ocho meses. Entre ellas había ciberataques, campañas de desinformación y posibles intentos de desarrollar armas biológicas.
Un grupo de piratas informáticos relacionado con el Estado ruso utilizó Claude para investigar sus objetivos. Después entró en redes de gobiernos de Ucrania y de otros países europeos, robó información y mantuvo el acceso. Otro grupo criminal recurrió a la herramienta durante casi todas las fases de sus ataques y para pedir dinero a las víctimas.
Claude también se empleó en operaciones destinadas a influir en debates políticos de países como Kenia y Bangladés. En los casos más preocupantes, unos pocos usuarios parecían buscar ayuda para crear agentes que causan enfermedades o sustancias tóxicas. El peligro, por tanto, no se limitaba al mundo digital.
Anthropic asegura que interrumpió todas las actividades descubiertas. La compañía suele explicar estos abusos y cómo intenta reforzar sus defensas. Aun así, no puede confirmar que haya detectado todos los casos. Además, existen otros sistemas de inteligencia artificial y modelos abiertos con menos controles. Las medidas de seguridad tendrán que mejorar a medida que avanzan estas herramientas.
Basado en: WIRED Staff, WIRED
