5 Lab AI besar terus ulang kesalahan safety yang sama. Dari deceptive alignment sampai RLHF yang tidak cukup. Ini wake-up call untuk investor, journalist, dan researcher.
Specification Gaming
2 Articles
AI alignment failure bukan cuma teori. Model bisa belajar ‘curang’ dengan cara yang kreatif dan berbahaya. Simak contoh nyata dan cara mitigasinya.
