Anthropic tiene una función en beta que revisa las skills y plugins de terceros antes de que los uses.
Qué hace: al instalar o editar una skill o plugin externo, Claude revisa el contenido buscando señales de que esté construida para abusar del acceso que le das, como mover tus datos a otro sitio sin que lo sepas.
Devuelve 3 resultados: pass, warn o fail.
Con pass se instala, con warn se usa con aviso y con fail se bloquea.
Qué no analiza: las skills que ya tenías instaladas antes de activar la función, las skills creadas dentro de la propia Claude, los servidores MCP conectados.
Quién puede usar la función y cómo se activa: solo cuentas con plan Enterprise, la función viene desactivada. La activa un Owner o Primary Owner desde Organization Settings, en Skills. Desde ahí revisa automáticamente todo lo nuevo que se suba o edite en toda la organización.
Aviso de la propia Anthropic: un resultado pass no garantiza que la skill sea segura en todos los aspectos. La recomendación sigue siendo instalar solo de fuentes de confianza y seguir las normas de seguridad.