Back to skill

Security audit

evaluador-ganchos-formula100k

Security checks for vulnerabilities and agentic risk

Overview

This skill is a focused visual-hook evaluator that may upload user-provided videos to Higgsfield only for the requested prediction step and after user confirmation.

Install this if you want a Spanish-language hook evaluator for screenshots and videos. Before using the Higgsfield predictor, confirm you are comfortable uploading the video to that external plugin, and avoid sharing sensitive unpublished media unless that matches your workflow.

Vulnerability Patterns
  • Skill Instruction HijackingAlters the agent's session goals or safety constraints when the skill loads
  • Agent Memory PoisoningWrites attacker-controlled rules into memory that affect later sessions
  • Remote Payload Retrieval and ExecutionFetches external code whose behavior can change after review
  • Embedded Malicious CodeShips malicious scripts inside the skill and executes them locally
  • Unauthorized Access and Privilege EscalationObtains permissions beyond the task's legitimate needs
Vulnerability Patterns
  • Prompt InjectionInstruction Override, Hidden Instructions, Exfiltration Commands
  • Trigger AbuseOverly Broad Trigger, Shadow Command Trigger, Keyword Baiting Trigger
  • Data ExfiltrationExternal Transmission, Env Variable Harvesting, File System Enumeration
  • Privilege EscalationExcessive Permissions, Sudo/Root Execution, Credential Access
  • Supply ChainUnpinned Dependencies, External Script Fetching, Obfuscated Code
Findings (7)

Vague Triggers

High
Category
Not specified by scanner
Confidence
95% confidence
Finding

La descripción de activación es demasiado amplia y obliga a disparar la skill ante frases comunes y también ante la simple presencia de capturas o videos con intención ambigua. Eso puede secuestrar solicitudes no relacionadas, provocar uso inesperado de herramientas externas y aumentar el riesgo de procesar medios sensibles sin una confirmación clara del usuario.

Content

No source excerpt is available for this finding.

Ae1

High
Category
analysis-evasion
Confidence
100% confidence
Finding

Referenced artifact was not completely inspected

Content

Scanner excerpt · SKILL.md (reported line 76)May include surrounding context.

md
- `output-template.md` — el formato exacto del diagnóstico

Ae1

High
Category
analysis-evasion
Confidence
100% confidence
Finding

Referenced artifact was not completely inspected

Content

Scanner excerpt · SKILL.md (reported line 169)May include surrounding context.

md
- `output-template.md` — el formato exacto del diagnóstico

Natural-Language Policy Violations

Medium
Category
Not specified by scanner
Confidence
97% confidence
Finding

Forzar 'español neutro obligatorio' sin opt-in del usuario impone una variante lingüística y puede degradar la fidelidad de la respuesta frente a preferencias reales del hablante. No suele ser una vulnerabilidad de seguridad clásica, pero sí un problema de seguridad/quality policy porque anula la elección del usuario y puede causar respuestas inapropiadas o manipulativas en contexto conversacional.

Content

No source excerpt is available for this finding.

Natural-Language Policy Violations

Medium
Category
Not specified by scanner
Confidence
96% confidence
Finding

La prohibición categórica de voseo refuerza una restricción de locale no consensuada y puede entrar en conflicto con la forma de hablar del usuario. El riesgo principal es de mala alineación con el usuario y de respuestas menos seguras/políticamente correctas al priorizar reglas estilísticas rígidas sobre contexto real.

Content

No source excerpt is available for this finding.

Natural-Language Policy Violations

Medium
Category
Not specified by scanner
Confidence
98% confidence
Finding

La repetición de la regla de locale hace más probable que el agente ignore la preferencia explícita del usuario, endureciendo una conducta no consentida. El contexto de esta skill no vuelve esto más peligroso técnicamente, pero sí lo hace más persistente y difícil de corregir en ejecución.

Content

No source excerpt is available for this finding.

Natural-Language Policy Violations

Medium
Category
Not specified by scanner
Confidence
96% confidence
Finding

The instruction 'Español neutro siempre' mandates a specific language for all responses. This is a natural-language locale policy constraint with no indication that the user can choose another language or opt in to Spanish output.

Content

No source excerpt is available for this finding.

Static analysis

No suspicious patterns detected.