Pada 2025 AI menjadi permukaan serangan. Pada 2026, OrcaRouter menjadikan pertahanannya gratis.

OrcaRouter
OrcaRouter

•     Microsoft & Salesforce sama-sama merilis tambalan untuk celah kebocoran data pada agen AI. Pada CVE-2026-21520, sebuah kolom SharePoint yang diracuni menggiring Copilot untuk mengirim data pelanggan via email ke penyerang — dan data itu tetap keluar bahkan setelah mekanisme keamanan menandai serangan tersebut (Dark Reading).

•     Denial-of-wallet — agen yang dibajak atau lepas kendali yang sekadar membelanjakan — teramati menghabiskan $46.000 per hari (Sysdig, “LLMjacking”). Tidak ada data yang dicuri. Yang tersisa hanyalah tagihan.

Tiga tahun insiden publik, riset, dan regulasi — 2023 hingga 2026.
Mengapa tumpukan teknologi Anda saat ini tidak bisa melihatnya
Keamanan tradisional mengandaikan adanya batas: tepercaya di dalam, tak tepercaya di luar, kontrol di sambungannya. Model bahasa melarutkan batas itu, karena input sebuah model sekaligus merupakan pemrogramannya.

Setiap email, dokumen, halaman web, dan hasil alat yang dibaca seorang agen dapat membawa instruksi yang akan dipatuhinya. Tidak ada mekanisme andal dan umum yang membuat model saat ini memisahkan konten yang harus diproses dari perintah yang harus dipatuhi.

Itulah sebabnya prompt injection menempati posisi No. 1 dalam OWASP Top 10 untuk Aplikasi LLM — dan sebabnya ia tidak akan “ditambal” sebagaimana buffer overflow ditambal. Ini adalah sifat struktural dari medianya.

Web application firewall Anda memeriksa permintaan dan melihat panggilan API yang benar-benar sah; serangannya ada di dalam kata-katanya.

Pemeriksaan per-permintaan Anda lolos di setiap langkah serangan berantai, karena kerusakannya hidup dalam urutan — volume, pengulangan, dan pengeluaran sepanjang waktu — bukan pada satu panggilan mana pun.

Kesimpulannya tidak nyaman tetapi jelas: keamanan AI bukanlah masalah pelatihan model. Ini masalah arsitektur — dan dapat dipecahkan dengan disiplin yang sama yang sudah diterapkan perusahaan pada setiap sistem produksi lainnya.

14 risiko utama dalam empat kategori: bidang konten, bidang aksi, ekonomi, serta kepercayaan & rantai pasok.
Pertahanan bersifat arsitektural: dua bidang, enam lapis, di gateway
Setiap serangan di atas berhasil melawan otoritas tanpa batas dan gagal melawan otoritas yang dibatasi, diawasi, dan diaudit. Membendungnya menuntut kendali atas dua bidang yang berbeda:

•     Bidang konten — apa yang dibaca dan ditulis model. Ini adalah tugas Guardrails.

•     Bidang aksi — apa yang dilakukan agen: alat yang dipanggilnya, jaringan yang dijangkaunya, uang yang dibelanjakannya. Ini adalah tugas Firewall.

Tampilkan Semua
Cilacap Info
IKUTI BERITA LAINNYA DIGOOGLE NEWS

Berita Terkait