Anthropic prueba un escáner de vulnerabilidades para Claude Code
Anthropic lanzó en fase beta un complemento de seguridad para Claude Code que analiza repositorios desde la terminal mediante varios agentes, verifica los hallazgos y genera parches revisables sin modificar automáticamente el código.

Anthropic lanzó en fase beta Claude Security, un complemento para Claude Code que permite analizar vulnerabilidades de un repositorio desde una sesión existente en la terminal. La herramienta coordina varios agentes especializados, somete cada hallazgo a una verificación independiente y genera archivos de parche únicamente cuando puede justificar que la corrección resuelve el problema sin introducir riesgos adicionales. El usuario conserva el control sobre la revisión, la aplicación de los cambios y la incorporación de cada modificación al proyecto.
Anthropic presentó en fase beta Claude Security, un complemento diseñado para ampliar las capacidades de Claude Code en tareas de análisis de seguridad. Su funcionamiento se integra en una sesión habitual de trabajo desde la terminal: el usuario puede solicitar una revisión amplia de la base de código o concentrarse en los cambios realizados antes de crear un compromiso de código. El resultado no se aplica de manera automática, sino que queda disponible para inspección y decisión humana.
Según Fuente original, la información se basa en Anthropic Releases Claude Security Plugin for Claude Code in Beta: A Multi-Agent Vulnerability Scanner That Runs in Your Terminal.
La propuesta apunta a resolver uno de los problemas habituales de los asistentes de programación basados en inteligencia artificial: detectar posibles fallas no alcanza si los resultados contienen demasiados falsos positivos o si las correcciones alteran el comportamiento legítimo de una aplicación. Para reducir ese riesgo, el complemento distribuye el análisis entre agentes con distintas responsabilidades y exige que cada hallazgo supere una votación de verificadores antes de aparecer como resultado confirmado.
escáner de vulnerabilidades para Claude Code: Cómo funciona Claude Security dentro de una sesión de Claude Code
El complemento incorpora el comando /claude-security, que abre un menú con tres tipos de tareas. La documentación oficial de Anthropic contempla trabajos orientados a revisar un repositorio, examinar cambios acotados y preparar correcciones para los problemas seleccionados. La disponibilidad concreta de cada operación depende de la versión instalada y de la configuración habilitada en Claude Code.
La instalación se realiza desde el mercado oficial de complementos de Anthropic. Si ese mercado no aparece en la sesión, la documentación indica que primero se puede agregar el repositorio oficial mediante /plugin marketplace add anthropics/claude-plugins-official. El código del complemento se publica en el repositorio claude-plugins-official, que la fuente identifica en la versión 0.10.0 al momento de la presentación.
Claude Security no funciona como un único análisis lineal. Su orquestación está implementada mediante un flujo dinámico en JavaScript que distribuye el trabajo entre subagentes. El proceso incluye etapas de reconocimiento del repositorio, división de componentes, investigación por categorías, consolidación de posibles hallazgos, verificación independiente y generación del informe. Esta arquitectura busca que el análisis tenga una cobertura más amplia que la de una única lectura automática del código.
Cuatro perspectivas para buscar fallas en el código
La fase de investigación utiliza cuatro perspectivas de seguridad. Una se enfoca en inyección y validación de entradas; otra revisa autenticación y control de acceso; una tercera analiza problemas de memoria y operaciones inseguras; y la última examina criptografía y gestión de secretos. La perspectiva relacionada con memoria y operaciones inseguras se omite cuando el componente está escrito por completo en lenguajes considerados seguros para la memoria, como Python o TypeScript.
La adaptación por lenguaje evita dedicar recursos a una categoría con poca relevancia para determinados componentes, aunque no convierte al sistema en una garantía de seguridad. Python y TypeScript pueden presentar vulnerabilidades de autenticación, exposición de secretos, inyección o permisos excesivos, aun cuando no sean el foco principal de los errores clásicos de memoria. Por ese motivo, el resto de las perspectivas continúa siendo necesario en una revisión de este tipo.
La cantidad de trabajo depende de cuatro niveles de esfuerzo: bajo, medio, alto y máximo. En los niveles bajo y medio, el análisis puede abarcar hasta 12 componentes, mientras que los niveles alto y máximo elevan ese límite a 24. También cambia la cantidad de investigadores asignados a cada celda de la matriz de revisión: se utiliza uno en los niveles inferiores y dos en los superiores. Las rondas destinadas a cubrir posibles áreas omitidas pasan de ninguna en el nivel bajo a una en el medio y hasta dos en los niveles alto y máximo.
Cuando el alcance es pequeño o se revisa una diferencia limitada, el flujo se reduce a una configuración con un solo investigador. La intención es que una modificación puntual no active una exploración desproporcionada de todo el repositorio. Aun así, la herramienta sostiene el mismo esquema de verificación para los hallazgos que finalmente intenta conservar.
La votación que separa un indicio de una vulnerabilidad confirmada
El aspecto más relevante del diseño es que un hallazgo no ingresa al informe únicamente porque un agente lo haya detectado. Cada candidato pasa por tres verificadores independientes, cada uno dedicado a una pregunta distinta: si el problema puede alcanzarse en la práctica, cuál sería su impacto y qué defensas existentes podrían impedirlo.
Cada verificador debe devolver un resultado estructurado, identificado como positivo verdadero o falso positivo, junto con una referencia breve al archivo y la línea que fundamentan su decisión. El sistema conserva un hallazgo cuando al menos dos de los tres verificadores lo consideran válido. Si participan menos de tres votos, el candidato no puede conservarse como resultado confirmado.
La votación también limita el nivel de confianza informado. Un acuerdo unánime de tres verificadores permite declarar una confianza alta, mientras que una aprobación de dos sobre tres queda limitada a una confianza media. El informe, por lo tanto, no puede presentar como certeza máxima un hallazgo que solo obtuvo una mayoría ajustada.
Anthropic señala además que el recuento se calcula mediante Python en el componente encargado de generar el informe, en lugar de quedar expresado solamente por el agente que redactó la detección. El estado de verificación se marca como confirmado únicamente cuando el registro demuestra que el panel se ejecutó para todos los hallazgos incluidos. Si no ocurre, el informe queda como no verificado y debe indicar el motivo.
Este detalle puede resultar importante para equipos de seguridad y auditoría. La calidad del resultado no depende solo de la explicación textual producida por un modelo, sino también de un registro técnico que permite comprobar si el procedimiento declarado realmente se completó. De todos modos, una votación entre agentes no reemplaza una revisión realizada por especialistas con conocimiento del negocio, de la arquitectura y de las amenazas específicas del sistema.
Qué archivos genera y qué queda fuera del repositorio
Cada análisis crea dentro del repositorio una carpeta con marca temporal y el formato CLAUDE-SECURITY-/. Allí se almacenan los artefactos del proceso, incluidos los resultados de investigación, la información de verificación y, cuando corresponde, los parches preparados para cada hallazgo. La única modificación que realiza la exploración sobre la copia de trabajo es esa carpeta.
El directorio incorpora su propio archivo .gitignore para evitar que un comando accidental de Git agregue el informe al próximo compromiso. Si una organización necesita conservar la evidencia de una auditoría, puede eliminar ese archivo de exclusión y registrar explícitamente los resultados, siempre después de revisar si contienen secretos, rutas internas o información sensible.
La separación entre informe y código fuente también reduce el riesgo de que una revisión automática altere el estado del proyecto. El análisis no debería cambiar el índice ni los archivos que el desarrollador tiene abiertos, una condición relevante cuando se trabaja sobre ramas con modificaciones sin confirmar o en repositorios compartidos.
Los parches se preparan en una copia aislada y no se aplican solos
La tarea de corrección utiliza un clon de trabajo temporal. Allí se desarrolla cada parche sin tocar el árbol de trabajo ni el índice del repositorio original. Una vez preparado el cambio, otro agente diferente al que escribió la modificación revisa la diferencia preparada y ejecuta la batería de pruebas propia del proyecto cuando está disponible.
Claude Security solo escribe un archivo de parche cuando el verificador puede sostener tres condiciones: que el cambio resuelve el hallazgo indicado, que no introduce una vulnerabilidad nueva y que el comportamiento restante se mantiene sin alteraciones. En esta última condición, modificar el conjunto de entradas que el programa acepta se considera un cambio de comportamiento, aunque la modificación parezca pequeña.
Una corrección que debilite una defensa queda rechazada. Por ejemplo, no debería aceptarse como solución relajar un control de autenticación, desactivar una prueba o eliminar una validación para que el flujo deje de fallar. Cuando el agente no puede justificar las tres condiciones, el sistema entrega una explicación breve en lugar de producir un parche.
Los archivos terminan en la carpeta patches/ del informe con nombres como F.patch. Anthropic recomienda aplicar cada uno mediante una solicitud de incorporación independiente. Ese criterio facilita revisar el motivo del cambio, ejecutar pruebas específicas, solicitar una segunda opinión y revertir una corrección sin mezclarla con otras modificaciones del producto.
El informe también aclara si ninguna prueba del proyecto cubre el código modificado. En ese caso, la validación depende de la revisión del código y no de una ejecución automatizada que confirme el comportamiento. Esta advertencia es especialmente importante en aplicaciones con poca cobertura, servicios internos o componentes que requieren entornos externos para funcionar.
Requisitos, límites y riesgos que deben evaluarse antes de usarlo
El complemento requiere un plan pago de Claude Code y la versión 2.1.154 o posterior. También es necesario activar los flujos dinámicos desde la configuración mediante /config. En el entorno local se necesita Python 3.9.6 o una versión superior disponible como python3, además de Git para los análisis de cambios y la preparación de parches. Según la información difundida por Anthropic, funciona en Linux, macOS y Windows.
El consumo se descuenta de los límites de tokens del plan contratado. En repositorios extensos, el nivel de esfuerzo elegido y la cantidad de agentes desplegados pueden influir de manera significativa en el uso de recursos. Para un equipo, esto implica definir cuándo conviene una revisión completa y cuándo alcanza con inspeccionar un conjunto de cambios antes de un compromiso de código.
El análisis se ejecuta dentro de la sesión y con los permisos del usuario. No agrega por sí mismo una capa de aislamiento. Las configuraciones almacenadas en .claude/, los ganchos y los archivos CLAUDE.md del repositorio continúan aplicándose. Por esa razón, Anthropic advierte que un repositorio hostil o desconocido no debe considerarse seguro solo porque se analice con Claude Security. Para esos casos recomienda utilizar sandbox-runtime y aplicar controles adicionales.
También existen límites metodológicos. Los resultados no son deterministas, por lo que dos ejecuciones pueden no producir exactamente el mismo conjunto de observaciones. La herramienta no reemplaza los analizadores estáticos tradicionales, la revisión de dependencias, los controles de secretos, las pruebas dinámicas ni la revisión manual. Su valor está en combinar exploración asistida y documentación de hallazgos, no en convertirse en el único control del ciclo de desarrollo.
Qué cambia para equipos que desarrollan aplicaciones con IA
La aparición de Claude Security muestra una tendencia hacia asistentes de programación que no solo generan código, sino que también participan en controles de calidad y seguridad. Para una empresa que desarrolla una aplicación web, una tienda en línea o un servicio basado en API, el complemento puede servir como una revisión adicional antes de enviar cambios a producción, especialmente cuando el equipo necesita identificar rutas de entrada, controles de acceso o secretos expuestos.
Su utilidad aumenta cuando se integra con procesos existentes. Un equipo puede seleccionar hallazgos, revisar el archivo y la línea señalados, comparar el parche con las reglas internas y abrir una solicitud de incorporación separada. En proyectos gestionados con WordPress, por ejemplo, la herramienta no reemplaza la actualización de extensiones, el control de permisos, el escaneo de archivos modificados ni la elección de proveedores confiables. En un comercio electrónico, tampoco sustituye las pruebas sobre pagos, sesiones, datos personales y permisos administrativos.
La trazabilidad de los informes puede ayudar a documentar por qué un cambio de seguridad fue aceptado o rechazado. Sin embargo, guardar reportes generados por una herramienta de IA exige protegerlos como cualquier otro registro técnico: pueden revelar nombres de archivos, arquitectura, rutas internas o fragmentos de lógica. Antes de publicarlos en un sistema externo o adjuntarlos a una solicitud, conviene revisar su contenido y las políticas de tratamiento de datos de la organización.
Claude Security y el riesgo de depender de un informe automático para ganar visibilidad
Desde la perspectiva de SEO técnico, una aplicación más segura puede reducir interrupciones, errores de acceso y problemas que afectan la disponibilidad de un sitio, pero Claude Security no es una herramienta de posicionamiento ni garantiza mejores rankings. Su relación con la visibilidad orgánica es indirecta: un sitio comprometido, bloqueado, lento por incidentes o afectado por código malicioso puede perder confianza de usuarios y buscadores, mientras que un control adicional ayuda a detectar problemas antes de que lleguen a producción.
Para negocios digitales, el beneficio concreto está en incorporar una instancia de revisión al flujo de desarrollo sin confundirla con una auditoría completa. La información del informe puede complementar los controles de rendimiento, indexación, rastreo, disponibilidad y protección de datos. En una estrategia de IA y posicionamiento web, también es importante conservar supervisión humana: una corrección que cambie respuestas, permisos o reglas de acceso podría alterar el funcionamiento de páginas públicas y, con ello, la experiencia de búsqueda.
La herramienta se encuentra en beta y sus resultados son variables. Por eso, la decisión de adoptarla debería considerar el tipo de repositorio, la sensibilidad de la información, el presupuesto de tokens, la capacidad del equipo para revisar parches y la existencia de pruebas automatizadas. La documentación de Anthropic, la página oficial del producto y el código publicado son las referencias adecuadas para verificar cambios de disponibilidad y requisitos. La noticia original fue difundida por MarkTechPost, a partir de la documentación y los anuncios públicos de Anthropic.
Claude Security puede aportar una segunda capa de análisis para equipos que ya cuentan con prácticas de seguridad, siempre que sus informes se revisen con criterio y sus parches se incorporen mediante cambios controlados. El punto central no es automatizar la aprobación de código, sino disponer de más evidencia para decidir qué corregir, cómo probarlo y cuándo llevarlo a producción.
Preguntas frecuentes
¿Qué es Claude Security?
Es un complemento de Anthropic para Claude Code que analiza repositorios en busca de vulnerabilidades, verifica los hallazgos mediante varios agentes y prepara archivos de parche para que el usuario los revise y aplique.
¿Claude Security modifica automáticamente el código?
No. El análisis genera informes y los parches se guardan como archivos independientes. Ningún cambio se aplica automáticamente al repositorio original.
¿Qué necesita Claude Security para funcionar?
Requiere un plan pago, Claude Code 2.1.154 o posterior, flujos dinámicos habilitados, Python 3.9.6 o superior disponible como python3 y Git. Es compatible con Linux, macOS y Windows.
Más noticias de este autor
Seguimiento del tema
Esta cobertura puede ampliarse con nuevas fuentes, consultas de búsqueda y artículos relacionados dentro del mismo eje editorial.



