El inteligencias artificiales son muy buenos para identificar vulnerabilidades críticas de software y aplicaciones. Un trabajo que requeriría meses de trabajo por parte de los investigadores, pero que la IA puede realizar muy rápidamente. Es un recurso muy valioso para el mundo de la seguridad informática… pero también para los piratas informáticos malintencionados.
Un nuevo experimento realizado por Antrópico en colaboración con Mozilla demuestra que los modelos de IA más avanzados ahora son capaces de identificar vulnerabilidades críticas en software complejo en tiempos extremadamente cortos.
Durante el proyecto, el modelo Claude Opus 4.6 descubrió 22 vulnerabilidades navegador web Firefox en sólo dos semanas, de las cuales 14 fueron clasificadas como ad alta gravedad. El resultado representa casi una quinta parte de todas las vulnerabilidades críticas parcheadas en el navegador durante 2025.
Vulnerabilidades descubiertas por la IA
Según los investigadores, la IA ha analizó miles de archivos de código del navegador identificando errores de seguridad potencialmente explotables por piratas informáticos. en total fueron examinó casi 6.000 archivos C++generando 112 informes de errores únicos.
Uno de los primeros problemas identificados se descubrió tras apenas veinte minutos de análisis. Claude identificó una vulnerabilidad de tipo “Usar después gratis”, una falla en la administración de la memoria que puede permitir que un atacante sobrescriba datos con código malicioso.
Los investigadores probaron el error en una máquina virtual que ejecutaba la última versión de Firefox antes de informarlo oficialmente al sistema Bugzilla de Mozilla. También se proporcionó información junto con el informe. posible parche generado por el mismo modelo de IA.
Mientras tanto, el sistema ya había identificado docenas de otros accidentes potencialmente vinculados a vulnerabilidades. Al final del proyecto, muchos de los fallos descubiertos fueron solucionados en la versión Firefox 148, mientras que el resto se solucionarán en futuras actualizaciones.
Entre defensa y riesgos
El equipo de investigación también quería entender si la IA era capaz no sólo de encontrar vulnerabilidades, sino también de explotarlos para crear ciberataques reales. Algo que los piratas informáticos de todo el mundo explotan cada vez con más frecuencia las IA.
Por esta razón Claude fue puesto a cargo de desarrollar hazañas a partir de los errores identificados. El objetivo era demostrar un ataque real leyendo y escribiendo archivos en un sistema objetivo, como lo haría un hacker.
Después de cientos de intentos y aproximadamente $4000 de crédito API utilizado en las pruebas, el El modelo logró convertir las vulnerabilidades en exploits. funcionando sólo en dos casos. Esto sugiere que la IA es mucho mejor para encontrar errores que para explotarlos para ataques completos. El explotar desarrollado también solo funcionó en un entorno de prueba simplificado, careciendo de algunas de las protecciones avanzadas que se encuentran en los navegadores modernos, como el sandboxing.
A pesar de estas limitaciones, los expertos señalan que el resultado demuestra un punto crucial: la inteligencia artificial podría convertirse en una herramienta muy poderosa tanto para defensores como para atacantes.