Selama beberapa tahun terakhir, kemajuan kecerdasan buatan identik dengan kemampuan model untuk berbicara semakin natural, menulis semakin baik, memahami instruksi kompleks, membuat kode, dan melakukan reasoning dalam percakapan. ChatGPT, Claude, Gemini, dan berbagai large language model lain menjadi simbol era ini.
Namun muncul pertanyaan yang semakin relevan ketika AI mulai masuk ke software enterprise: apakah setiap keputusan yang dibuat mesin benar benar membutuhkan model yang mampu menulis paragraf panjang? Apakah sistem yang hanya perlu memutuskan “approve”, “reject”, “retry”, “escalate”, atau memberi skor risiko harus selalu memanggil sebuah LLM generatif yang besar?