Why does my AI write code that is correct in isolation but insecure in my system?
Peluang
AI coding assistants generate code that is syntactically valid and functionally correct at the function level but have no model of the security invariants of the surrounding system: the trust boundaries, IAM policies, data classification, and threat model that make a pattern safe or dangerous in a specific codebase. The result is structurally valid code that exposes tokens in logs, omits row-level access checks, or misconfigures permissions in ways an engineer familiar with the system would catch immediately. CVE-2025-48757 is a concrete case where an AI tool generated database schemas without row-level security, silently exposing 170 production applications. Research shows AI-assisted commits leak secrets at more than twice the rate of human-only commits. No current assistant ingests or reasons about a codebase's existing security model before generating code.
Mengapa ini penting
Security context unawareness produces a class of vulnerabilities that pass every syntax check and unit test but are trivially exploitable once deployed.
Cara saya menilai peluang
Skor Peluang adalah penilaian pribadi saya, bukan pengukuran: seberapa besar dampaknya, seberapa sering terasa, dan seberapa sedikit solusi yang ada saat ini. Semakin tinggi skornya, semakin layak menurut saya untuk dibangun.
Seberapa besar masalah yang ditimbulkannya saat muncul.
Seberapa sering orang benar-benar menghadapinya.
Betapa sedikitnya alat yang baik tersedia untuknya saat ini.
Lebih banyak masalah yang layak diselesaikan
Mengapa setiap aplikasi AI melupakan saya begitu saya menutup tab?
AIMengapa mempelajari bidang baru masih terganjal oleh ketidaktahuan tentang apa yang harus ditanyakan?
AIMengapa orang awam tidak bisa memverifikasi apa yang baru saja dikatakan AI kepada mereka?
AIMengapa kita menguji model pada tolok ukur tetapi meluncurkannya berdasarkan intuisi semata?
AIMengapa agen AI tidak punya ingatan atas kesalahan mereka sendiri?
AIMengapa saya tidak bisa mengaudit apa yang sebenarnya digunakan untuk melatih sebuah model?