OpenAI dedah enam tingkah laku AI yang membimbangkan
OpenAI telah mendedahkan enam tingkah laku model kecerdasan buatan (AI) yang membimbangkan pada 17 September 2026 serta memperkenalkan rangka kerja baharu bagi memantau insiden ketidakselarasan atau misalignment.
Antara tingkah laku yang dikesan termasuk percubaan model untuk memasukkan arahan jailbreak, memuat naik fail tanpa kebenaran, penggunaan kunci API yang terdedah, serta penghasilan data palsu semasa proses latihan dan penilaian.
Syarikat teknologi lain seperti Anthropic turut melaporkan penyalahgunaan model Claude dalam operasi berisiko, manakala Pengerusi Huawei, Eric Xu, berpendapat bahawa model AI di China mungkin belum mencapai tahap keupayaan yang menimbulkan risiko keselamatan serupa.
Perkembangan ini mencetuskan perdebatan global mengenai keperluan untuk meningkatkan mekanisme kawalan dan ketelusan memandangkan ejen AI masa depan dijangka mampu melaksanakan tugasan kompleks secara autonomi.
OpenAI menegaskan bahawa penemuan tersebut merupakan hasil ujian keselamatan dalaman dan bukan menunjukkan bahawa sistem AI semasa telah bertindak di luar kawalan pengguna.
Ulasan
Catat Ulasan