anoman
Guardrails

Defense-in-depth untuk setiap request AI.

Empat pemeriksaan pre-call dan dua pemeriksaan post-call berjalan pada setiap request — sebelum panggilan LLM apa pun dilakukan.

Anonimisasi yang dapat dibalik

PII pengguna Anda tidak pernah sampai ke model — jawabannya tetap sampai

Anoman mendeteksi PII sebelum panggilan provider, menukarnya dengan nilai sintetis yang realistis (atau token yang dapat dibalik), mengirim hanya prompt yang dianonimkan ke AI, lalu menganonimkan-balik respons model — sehingga aplikasi Anda menerima jawaban yang koheren dengan nilai asli dipulihkan. NIK Indonesia dan NRIC Singapura dikenali secara bawaan. Aktif secara default, dapat ditegakkan seluruh organisasi.

Aplikasi Anda mengirim → "Email [email protected], NIK 3201094…, re: the invoice"

→ [ANONYMIZE] tukar PII dengan nilai sintetis

Model melihat: "Email [email protected], NIK 3299…" — data asli tidak pernah meninggalkan lingkungan Anda

LLM menghasilkan jawabannya

→ [DE-ANONYMIZE] pulihkan nilai asli dalam respons

Aplikasi Anda menerima: jawaban dengan [email protected] + NIK asli — tidak berubah untuk Anda

Pipeline

Pipeline request — guardrail berjalan lebih dulu

Auth + rate limit

→ [PRE-CALL GUARDRAILS]

1. Injeksi prompt (classifier ML, ~30ms)

2. Deteksi PII (~20ms)

3. Moderasi konten (keyword + ML, ~5ms)

4. Pemeriksaan policy tool-call (allowlist/denylist, ~10ms)

↳ diblokir? Kembalikan 403 seketika. Tidak pernah diantrikan, tidak pernah ditagih.

Pemeriksaan cache

Routing (real-time atau batch)

Panggilan LLM

→ [POST-CALL GUARDRAILS]

5. Filter konten respons

6. Pemindaian PII respons

Token metering → Respons

Jenis guardrail

Empat lapisan perlindungan

Deteksi Prompt Injection

Classifier injeksi-prompt berbasis ML. Threshold: 0.85 (dapat dikonfigurasi per customer). Latensi: ~30ms di CPU. Block rate 100% pada string injeksi yang diketahui dalam benchmark.

PII Masking (4 mode)

Engine deteksi PII. Entity: EMAIL, PHONE, CREDIT_CARD, SG NRIC, ID NIK, IP_ADDRESS, URL. Mode: redact (ganti dengan [REDACTED]), tokenize (token yang dapat dibalik), synthetic (substitusi yang dihasilkan), block (tolak 403).

Moderasi Konten

Classifier keyword + ML. Mendukung bahasa Inggris dan Bahasa Indonesia. Latensi ~5ms. Dapat dikonfigurasi per policy group.

Conversational Guardrails

Config YAML + aturan alur per policy group. Penegakan alur percakapan. Memblokir pengungkapan system-prompt, jailbreak roleplay, dan pengarahan topik. Di-cache berdasarkan hash config.

Lanjutan

Override per-key + LLM Security Perimeter

Override guardrail per-key

Setiap API key membawa field guardrail_overrides JSONB. Priority stack: System forced (ops) → Override per-key → Policy group → System defaults. Contoh: {"injectionEnabled": false, "piiEnabled": true}.

LLM Security Perimeter (LSP)

Penegakan attack signature di level provider. 10 signature awal di 6 kategori serangan. Provider yang terdaftar memiliki telemetry key — event menyebar ke penyimpanan analitik kami dengan retensi 180 hari. Signature high/critical mengembalikan 403 sebelum panggilan LLM.

Tambahkan guardrail ke setiap panggilan AI.