Ciberseguridad

Anthropic ofrece gratis su IA para buscar vulnerabilidades en proyectos de código abierto

Anthropic lanza OSS Scanner, un servicio gratuito y voluntario que analiza periódicamente proyectos open source con sus modelos más potentes y envía posibles vulnerabilidades a sus responsables.

Anthropic ha lanzado OSS Scanner, un nuevo servicio gratuito con el que proyectos de código abierto pueden recibir análisis periódicos de seguridad realizados por algunos de los modelos de IA más potentes de la compañía. La participación es voluntaria y está dirigida a proyectos relevantes para la infraestructura y la seguridad de otros usuarios.

Existe una diferencia importante respecto al proceso habitual de divulgación de Anthropic: los proyectos que se apunten a OSS Scanner pueden recibir los hallazgos directamente desde los modelos, sin una revisión humana previa. Esto permite que las posibles vulnerabilidades lleguen antes a los mantenedores, pero también significa que los informes pueden contener errores, duplicados o valoraciones de gravedad incorrectas.

Qué es Anthropic OSS Scanner

OSS Scanner utiliza modelos avanzados de Anthropic para buscar vulnerabilidades dentro del código fuente de proyectos open source.

Los proyectos aceptados reciben:

  • análisis de seguridad periódicos;
  • posibles vulnerabilidades encontradas por los modelos;
  • una explicación del problema;
  • un reproducer que ayude a verificar el fallo;
  • información sobre cuándo pudo introducirse el bug, cuando es posible determinarlo;
  • una propuesta de parche cuando el sistema puede generar una solución.

Anthropic cubre el coste de estos análisis, por lo que los mantenedores de los proyectos admitidos no tienen que pagar por las ejecuciones de los modelos.

No es un escáner público para cualquier repositorio

El servicio no funciona como una página pública en la que cualquier usuario pueda pegar la dirección de un repositorio y solicitar inmediatamente un análisis.

OSS Scanner es un programa opt-in. Los responsables principales del proyecto tienen que solicitar voluntariamente su incorporación y Anthropic decide qué proyectos son elegibles.

La compañía utiliza criterios similares a los empleados por OSS-Fuzz de Google y presta especial atención a proyectos que tengan un impacto importante en infraestructura o seguridad.

Entre los factores que puede valorar están:

  • la exposición del software a ataques remotos;
  • el número de usuarios que dependen del proyecto;
  • la cantidad de otros proyectos que utilizan ese código;
  • su importancia para infraestructura crítica o seguridad.

Las solicitudes se evalúan caso por caso.

Anthropic verifica que quien se apunta sea realmente un maintainer

La inscripción está destinada a los core maintainers de cada proyecto.

Antes de activar el servicio, Anthropic indica que comprobará manualmente que la persona que solicita el acceso es realmente uno de los responsables principales del proyecto.

Si existen dudas sobre la identidad o la relación del solicitante con el repositorio, la compañía puede contactar al proyecto mediante otros canales para verificarlo.

Cómo se solicita el acceso

Los mantenedores elegibles pueden solicitar la incorporación mediante el repositorio oficial de OSS Scanner.

El proceso consiste en abrir un pull request que añada un archivo de configuración para el proyecto.

Entre los datos solicitados se encuentran:

  • el repositorio que debe analizarse;
  • el correo electrónico del contacto principal;
  • la ruta a un Dockerfile que permita preparar el entorno necesario para auditar el proyecto.

El entorno debe permitir que el agente realice el análisis de forma completamente offline una vez instaladas las dependencias necesarias.

Las exploraciones se realizan sin acceso a Internet

Anthropic afirma que sus agentes de análisis se ejecutan dentro de sandboxes reforzados y sin acceso a Internet.

Los informes y los datos asociados al programa se almacenan además en un proyecto cloud aislado al que únicamente puede acceder el personal de seguridad de Anthropic que necesita trabajar con ellos.

Estas medidas resultan especialmente relevantes porque un informe de vulnerabilidad puede contener información sensible sobre fallos que todavía no han sido corregidos.

Los informes rápidos no pasan primero por una persona

Este es uno de los puntos centrales del nuevo servicio.

Anthropic ya mantenía un proceso de divulgación coordinada donde especialistas revisaban los posibles fallos encontrados por Claude antes de enviarlos a los desarrolladores.

OSS Scanner introduce una ruta alternativa para proyectos capaces de realizar su propio triage.

En esa modalidad, los resultados son generados completamente por el modelo y se entregan sin validación humana previa de Anthropic.

La ventaja es la velocidad. La desventaja es que el mantenedor deberá determinar por sí mismo si el problema es válido, si ya era conocido y si la gravedad propuesta es correcta.

Por qué Anthropic ha eliminado el cuello de botella humano

La compañía afirma que sus modelos están encontrando posibles vulnerabilidades mucho más rápido de lo que sus equipos pueden revisarlas.

Durante los últimos seis meses, Anthropic dice haber utilizado sus modelos más recientes para buscar problemas de seguridad en algunos de los proyectos de software más importantes.

El resultado fue de más de 29.000 vulnerabilidades candidatas.

Sin embargo, la compañía solo pudo revisar y clasificar manualmente alrededor de 6.000 informes.

El problema, según Anthropic, ya no es únicamente encontrar posibles fallos, sino disponer de suficientes especialistas para comprobarlos, priorizarlos y comunicarlos correctamente.

Casi 5.000 informes ya se enviaron sin validar a petición de los proyectos

Anthropic explica que algunos mantenedores empezaron a pedir acceso a todos los resultados encontrados por los modelos en lugar de esperar a que la compañía terminara su proceso de validación.

Hasta el lanzamiento de OSS Scanner, Anthropic afirma haber enviado casi 5.000 informes sin verificar directamente a mantenedores que solicitaron expresamente recibir todo lo que los modelos habían encontrado.

El nuevo servicio formaliza esa posibilidad y permite repetir los análisis periódicamente.

Claude Mythos estará entre los modelos utilizados

Anthropic indica que las exploraciones se ejecutarán con sus modelos más potentes y menciona específicamente Claude Mythos entre ellos.

La compañía no presenta OSS Scanner como una simple ejecución estándar de Claude sobre cada archivo del repositorio.

Utiliza diferentes técnicas y entornos especializados para analizar el código, incluidos métodos experimentales que pueden consumir una cantidad elevada de tokens con el objetivo de encontrar problemas más profundos.

Anthropic probó el sistema con decenas de proyectos

Antes de abrir el programa a más mantenedores, Anthropic utilizó la infraestructura con decenas de proyectos open source durante varias semanas.

Según la compañía, estas primeras pruebas produjeron cientos de informes de bugs.

Algunos de los fallos encontrados pudieron combinarse en cadenas que permitían ejecución remota de código sin autenticación en los proyectos afectados.

Los detalles de las vulnerabilidades continúan sujetos a procesos de divulgación y corrección, por lo que el lanzamiento de OSS Scanner no implica que Anthropic publique inmediatamente la información necesaria para atacar software vulnerable.

Una prueba con 97 vulnerabilidades midió la calidad de los informes

Anthropic también encargó a especialistas en pruebas de penetración que revisaran una muestra de los resultados.

La evaluación incluyó 97 hallazgos clasificados inicialmente como críticos o de gravedad alta en 48 proyectos.

De ellos:

  • 85 cumplieron el nivel exigido para entrar en el proceso de divulgación coordinada de Anthropic;
  • 11 correspondían a problemas reales, pero duplicaban vulnerabilidades ya conocidas u otros hallazgos de la misma exploración;
  • 1 fue considerado inválido.

La compañía advierte, aun así, que estos resultados no garantizan que todos los futuros informes de OSS Scanner sean correctos.

La gravedad asignada por la IA también puede equivocarse

Un fallo no tiene que ser completamente inventado para que un informe necesite revisión.

Anthropic señala que algunos mantenedores han encontrado problemas en aspectos como:

  • una puntuación de gravedad demasiado elevada;
  • una interpretación incorrecta del modelo de amenazas del proyecto;
  • un problema que ya había sido corregido o documentado;
  • varias detecciones diferentes del mismo bug.

Por eso OSS Scanner está pensado principalmente para proyectos que ya cuentan con capacidad técnica suficiente para evaluar un volumen elevado de informes.

Los proyectos con pocos recursos pueden seguir utilizando la vía revisada por humanos

Anthropic no está sustituyendo completamente su proceso tradicional por resultados automáticos.

La compañía continuará utilizando su sistema de Coordinated Vulnerability Disclosure para validar manualmente determinados hallazgos antes de comunicarlos.

Esta ruta resulta especialmente importante para proyectos que no disponen de personal suficiente para analizar grandes cantidades de informes generados automáticamente.

OSS Scanner es una vía adicional y voluntaria para quienes prefieren recibir los resultados cuanto antes.

Los mantenedores pueden pausar o abandonar el programa

La participación tampoco es permanente.

Los responsables pueden modificar la configuración de su proyecto para pausar los informes automáticos o eliminarlo completamente del programa.

Si un proyecto abandona OSS Scanner, dejará de recibir las alertas automáticas sin revisar y volverá a depender de la vía tradicional de divulgación de Anthropic cuando corresponda.

OSS Scanner no es lo mismo que Claude Security

Anthropic diferencia expresamente el nuevo programa de Claude Security.

Claude Security es el producto comercial con el que organizaciones pueden integrar las capacidades de búsqueda y corrección de vulnerabilidades de Claude dentro de su propio ciclo de desarrollo.

OSS Scanner, en cambio:

  • está enfocado específicamente en proyectos open source elegibles;
  • es gratuito para los proyectos aceptados;
  • utiliza análisis periódicos;
  • puede emplear técnicas experimentales adicionales;
  • envía los hallazgos directamente a los mantenedores que hayan optado por recibirlos.

Anthropic quiere acelerar también la creación de parches

La iniciativa forma parte de un programa de seguridad más amplio denominado Anthropic Cyber Mission.

Uno de sus objetivos es reducir el tiempo que transcurre entre descubrir una vulnerabilidad y corregirla.

Anthropic quiere avanzar desde la detección automática hacia procesos donde también puedan automatizarse partes de:

  • la clasificación de los fallos;
  • la verificación;
  • la generación de correcciones;
  • el análisis de regresiones.

La compañía plantea que este trabajo se realice en colaboración con los mantenedores y no como una publicación automática e indiscriminada de vulnerabilidades.

La carrera está pasando de encontrar fallos a corregirlos antes

El lanzamiento refleja un cambio que Anthropic asegura estar observando en sus propios experimentos de ciberseguridad.

En el benchmark académico CyberGym, la compañía señala que los modelos de lenguaje pasaron de encontrar menos del 20 % de las vulnerabilidades a comienzos de 2025 a superar el 85 % en 2026.

Estos resultados pertenecen a un benchmark concreto y no significan que una IA pueda descubrir automáticamente el 85 % de cualquier vulnerabilidad existente en un proyecto real.

La tendencia que Anthropic intenta destacar es otra: la capacidad de generar posibles hallazgos está aumentando más rápido que la capacidad humana disponible para revisarlos.

El servicio puede ser útil, pero traslada parte del trabajo al proyecto

Para los mantenedores, recibir gratuitamente análisis realizados por modelos avanzados puede proporcionar acceso a recursos que serían difíciles de financiar en un proyecto comunitario.

Pero la modalidad rápida tiene un coste operativo distinto: alguien debe revisar los resultados.

Un proyecto que se apunte debe estar preparado para:

  • reproducir los fallos;
  • descartar duplicados;
  • corregir valoraciones equivocadas;
  • evaluar el impacto real;
  • revisar los parches sugeridos antes de integrarlos.

Anthropic reconoce explícitamente esta limitación y recomienda OSS Scanner especialmente a proyectos que ya pueden gestionar correctamente los informes de gravedad alta y crítica que reciben por los canales tradicionales.

Gratis, periódico y voluntario, pero no infalible

OSS Scanner ofrece a proyectos open source seleccionados una combinación poco habitual: análisis periódicos con modelos avanzados de Anthropic sin coste para los mantenedores.

La contrapartida es que el fast-track elimina deliberadamente el cuello de botella de la revisión humana. Los resultados pueden llegar antes, pero los propios responsables del proyecto tendrán que decidir qué informes son realmente explotables y qué correcciones deben incorporarse.

Anthropic seguirá manteniendo paralelamente su proceso de divulgación revisado por especialistas. OSS Scanner no lo reemplaza, sino que añade una opción para proyectos que prefieran recibir inmediatamente todo lo que encuentren los modelos y tengan capacidad para verificarlo.