Defense-in-depth untuk setiap request AI.
Empat pemeriksaan pre-call dan dua pemeriksaan post-call berjalan pada setiap request — sebelum panggilan LLM apa pun dilakukan.
Anonimisasi yang dapat dibalik
PII pengguna Anda tidak pernah sampai ke model — jawabannya tetap sampai
Anoman mendeteksi PII sebelum panggilan provider, menukarnya dengan nilai sintetis yang realistis (atau token yang dapat dibalik), mengirim hanya prompt yang dianonimkan ke AI, lalu menganonimkan-balik respons model — sehingga aplikasi Anda menerima jawaban yang koheren dengan nilai asli dipulihkan. NIK Indonesia dan NRIC Singapura dikenali secara bawaan. Aktif secara default, dapat ditegakkan seluruh organisasi.
Aplikasi Anda mengirim → "Email [email protected], NIK 3201094…, re: the invoice"
→ [ANONYMIZE] tukar PII dengan nilai sintetis
Model melihat: "Email [email protected], NIK 3299…" — data asli tidak pernah meninggalkan lingkungan Anda
→ LLM menghasilkan jawabannya
→ [DE-ANONYMIZE] pulihkan nilai asli dalam respons
Aplikasi Anda menerima: jawaban dengan [email protected] + NIK asli — tidak berubah untuk Anda
Pipeline
Pipeline request — guardrail berjalan lebih dulu
→ Auth + rate limit
→ [PRE-CALL GUARDRAILS]
1. Injeksi prompt (classifier ML, ~30ms)
2. Deteksi PII (~20ms)
3. Moderasi konten (keyword + ML, ~5ms)
4. Pemeriksaan policy tool-call (allowlist/denylist, ~10ms)
↳ diblokir? Kembalikan 403 seketika. Tidak pernah diantrikan, tidak pernah ditagih.
→ Pemeriksaan cache
→ Routing (real-time atau batch)
→ Panggilan LLM
→ [POST-CALL GUARDRAILS]
5. Filter konten respons
6. Pemindaian PII respons
→ Token metering → Respons
Jenis guardrail
Empat lapisan perlindungan
Deteksi Prompt Injection
Classifier injeksi-prompt berbasis ML. Threshold: 0.85 (dapat dikonfigurasi per customer). Latensi: ~30ms di CPU. Block rate 100% pada string injeksi yang diketahui dalam benchmark.
PII Masking (4 mode)
Engine deteksi PII. Entity: EMAIL, PHONE, CREDIT_CARD, SG NRIC, ID NIK, IP_ADDRESS, URL. Mode: redact (ganti dengan [REDACTED]), tokenize (token yang dapat dibalik), synthetic (substitusi yang dihasilkan), block (tolak 403).
Moderasi Konten
Classifier keyword + ML. Mendukung bahasa Inggris dan Bahasa Indonesia. Latensi ~5ms. Dapat dikonfigurasi per policy group.
Conversational Guardrails
Config YAML + aturan alur per policy group. Penegakan alur percakapan. Memblokir pengungkapan system-prompt, jailbreak roleplay, dan pengarahan topik. Di-cache berdasarkan hash config.
Lanjutan
Override per-key + LLM Security Perimeter
Override guardrail per-key
Setiap API key membawa field guardrail_overrides JSONB. Priority stack: System forced (ops) → Override per-key → Policy group → System defaults. Contoh: {"injectionEnabled": false, "piiEnabled": true}.
LLM Security Perimeter (LSP)
Penegakan attack signature di level provider. 10 signature awal di 6 kategori serangan. Provider yang terdaftar memiliki telemetry key — event menyebar ke penyimpanan analitik kami dengan retensi 180 hari. Signature high/critical mengembalikan 403 sebelum panggilan LLM.
Pembahasan mendalam