Capabilities
Adversarial testing capability areas
Threat modelling and attack design
Define assets, actors, trust boundaries, intended and prohibited uses, likely attack paths and business consequences. Inputs include architecture, user roles, data classifications, model information, tool permissions and incident history. Outputs include a scoped threat model, scenario catalogue, rules of engagement and prioritised test plan.
Prompt, context and retrieval attacks
Test direct and indirect prompt injection, jailbreaks, encoding and obfuscation, multi-turn manipulation, context-window pressure, system-prompt extraction, retrieval poisoning scenarios, source confusion and permission-boundary failures. Coverage is adapted to languages, channels and user roles.
Data leakage, privacy and confidentiality testing
Examine whether the application reveals secrets, hidden instructions, personal data, restricted documents, training-data-like fragments or another user’s information. Testing considers access controls, retrieval filters, session separation, logging and retention while avoiding unnecessary use of live sensitive data.
Agent, tool and workflow abuse
Evaluate tool selection, function calling, argument validation, identity propagation, least privilege, approvals, confirmation steps, rate limits, transaction boundaries, monitoring and recovery. The service does not replace infrastructure penetration testing or platform-specific security certification.
Evidence, risk classification and remediation
Capture reproducible inputs, outputs, system conditions and control observations. Findings are rated using agreed criteria and translated into practical actions across application logic, model configuration, prompts, retrieval, permissions, monitoring, policy, training and operating procedures.