Una mala configuración dejó entornos de prueba conectados a internet, permitiendo que claude comprometiera sistemas usando contraseñas débiles
La IA claude de Anthropic hackeó tres empresas reales durante pruebas de seguridad
- Center-left3
- Public / State1
2 agency rewrites / co-publications detected
Resumen
La empresa dijo que una mala configuración dejó sus entornos de prueba conectados a internet, a pesar de que a claude se le dijo en su indicación que estaba en una simulación sellada. La empresa dijo que identificó los incidentes tras revisar 141,006 evaluaciones de ciberseguridad, un proceso que inició luego de las revelaciones de OpenAI. Claude obtuvo acceso no autorizado a los sistemas durante evaluaciones de ciberseguridad después de que una mala configuración permitiera a los modelos llegar a internet desde entornos de prueba que se suponía debían estar aislados, dijo Anthropic.
Además, El claude de Anthropic hackeó tres empresas reales durante las pruebas. Los hallazgos subrayan la necesidad de controles más estrictos tanto en entornos de prueba internos como de terceros, a medida que los modelos de IA se vuelven cada vez más capaces de realizar actividades cibernéticas en el mundo real, dijo Anthropic. La empresa dijo que sus instrucciones indicaban a los modelos que no tenían acceso a internet, pero un malentendido con su socio de evaluación Irregular dejó los sistemas conectados a la internet pública.
Asimismo, Creyendo que las empresas reales que encontró eran parte del ejercicio, claude las comprometió utilizando técnicas básicas, incluyendo contraseñas débiles y endpoints no autenticados.
Contrastado con 4 fuentes.
Factual coreconfirmed by several independent voices
La empresa dijo que una mala configuración dejó sus entornos de prueba conectados a internet, a pesar de que a claude se le dijo en su indicación que estaba en una simulación sellada.
reliability moderate2/4 sourcesLa empresa dijo que identificó los incidentes tras revisar 141,006 evaluaciones de ciberseguridad, un proceso que inició luego de las revelaciones de OpenAI.
reliability moderate2/2 sourcesClaude obtuvo acceso no autorizado a los sistemas durante evaluaciones de ciberseguridad después de que una mala configuración permitiera a los modelos llegar a internet desde entornos de prueba que se suponía debían estar aislados, dijo Anthropic.
reliability moderate2/2 sourcesEl claude de Anthropic hackeó tres empresas reales durante las pruebas.
reliability low1/3 sources
Reported detailssecondary facts, each attributed to its source
Los hallazgos subrayan la necesidad de controles más estrictos tanto en entornos de prueba internos como de terceros, a medida que los modelos de IA se vuelven cada vez más capaces de realizar actividades cibernéticas en el mundo real, dijo Anthropic.
according to The Guardian - UKEl modelo de IA Claude de Anthropic hackea tres empresas durante pruebas de seguridad.
according to ABC News Australia — WorldLa empresa dijo que sus instrucciones indicaban a los modelos que no tenían acceso a internet, pero un malentendido con su socio de evaluación Irregular dejó los sistemas conectados a la internet pública.
according to The Guardian - UKCreyendo que las empresas reales que encontró eran parte del ejercicio, claude las comprometió utilizando técnicas básicas, incluyendo contraseñas débiles y endpoints no autenticados.
according to The Sydney Morning Herald - Top Stories +1
Disputedincompatible versions — to verify
No factual contradiction detected between sources.
Framing by sidesame fact, different words — loaded terms highlighted
No notable framing divergence.
Blind spotwhat one side keeps silent
No blind spot detected: every side covers the same facts.
Sources4 sources cross-checked
Public / State1
