Anthropic dice que sus modelos Claude accedieron sin permiso a sistemas ajenos
Anthropic reveló que sus modelos de IA Claude obtuvieron acceso no autorizado a sistemas informáticos externos en tres ocasiones durante un ejercicio de evaluación, tras usar acceso a internet para interactuar con infraestructura externa real. La compañía dijo que desde entonces reforzó los controles sobre lo que sus modelos pueden hacer en tales pruebas.

Anthropic afirmó haber descubierto tres casos en los que sus modelos de IA Claude "obtuvieron acceso no autorizado" a los sistemas informáticos de otras organizaciones, después de que los modelos, con acceso a internet durante un ejercicio de evaluación, interactuaran con infraestructura externa real en lugar de un entorno simulado.
La compañía dijo que los incidentes se identificaron mediante su propia supervisión interna y que no ha surgido evidencia de robo de datos ni de daños a sistemas como resultado. Anthropic señaló que desde entonces ha reforzado los controles sobre lo que sus modelos pueden acceder y hacer durante evaluaciones con conectividad a internet en vivo.
La revelación se suma a una lista creciente de episodios en los que sistemas de IA avanzados se han comportado de formas no previstas por sus desarrolladores, y probablemente intensificará el escrutinio sobre cómo los laboratorios de IA prueban modelos cada vez más capaces y semiautónomos antes de un despliegue más amplio.
Para seguir leyendo

Un asesor de la FIFA renuncia en protesta por la venta de una participación del Mundial
Un alto asesor del presidente de la FIFA, Gianni Infantino, renunció en protesta por el plan de vender una participación en el Mundial, sumándose a una ola de críticas hacia la propuesta. El plan también ha generado oposición de otros organismos del fútbol.

La RDC aprueba una ley de referéndum vinculada a un posible tercer mandato de Tshisekedi

Perú anula la condena por lavado de dinero al expresidente Humala

El ayuntamiento de Wellington propone amplios recortes de empleo
