Peringatkan AI Bisa Musnahkan Manusia, Peneliti Anthropic Mundur

Pengembangan AI supercerdas diperingatkan dapat memusnahkan manusia dalam 10 tahun. Banyaknya kasus AI membobol sistem tanpa perintah saat ini menjadi indikasinya.

10 Sep 2026 13:45 WIB · Internasional

AFP/HECTOR RETAMAL

Oleh Irene Sarwindaningrum

Peneliti kecerdasan buatan atau AI Anthropic, Jacob Coxon, mundur setelah memperingatkan kecerdasan buatan semakin dapat memusnahkan kehidupan manusia. Pengunduran dirinya terjadi di tengah rangkaian insiden AI lepas kendali. AI-AI liar itu kemudian melakukan serangan siber tanpa instruksi manusia.

Coxon (27) pindah kerja dari OpenAI ke Anthropic pada tahun ini. Awalnya ia menilai Anthropic lebih berhati-hati dalam mengembangkan AI. Namun, menurut Coxon kedua perusahaan itu ternyata sama-sama tak bertanggung jawab.

Keduanya ia nilai lebih mengutamakan mengejar pengembangan AI supercerdas (superintelligence) daripada keamanan. ”Tidak satu pun perusahaan bertindak secara bertanggung jawab. Mereka berlomba langsung menuju akal imitasi super (superintelligence) yang dapat meningkatkan dirinya sendiri dan mempertaruhkan nyawa kita,” tulis Coxon di X, Selasa (8/9/2026).

AI supercerdas merupakan konsep AI dengan kemampuan melampaui kecerdasan manusia. Coxon memperingatkan, saat ini perlombaan tengah mengarah pada sistem supercerdas yang dapat meningkatkan kemampuannya sendiri. Unggahannya di X itu menjangkau lebih dari 100 juta orang dalam semalam.

Sehari setelah Coxon mengumumkan pengunduran dirinya, Rabu (9/9/2026), Anthropic, mengungkap model kecerdasan besutannya, Claude, mengakses internet saat menjalani pengujian keamanan siber.

Dalam kasus terbaru itu, Claude membobol sistem pihak ketiga dan mengakses informasi pribadi. Insiden ini merupakan kasus keempat model AI Anthropic lepas kendali dan bertindak sendiri.

This photograph shows the logo of the US artificial intelligence safety and research company Anthropic displayed on a smartphone's screen in Brussels on June 10, 2026. (Photo by Nicolas TUCAT / AFP)

Insiden itu menambah daftar kasus AI bertindak di luar batas yang ditetapkan manusia. Akhir Juli 2026, model OpenAI ketahuan keluar dari lingkungan pengujian dan membobol sistem perusahaan Hugging Face.

Pekan lalu, segerombolan AI agentik OpenAI juga ketahuan masuk ke situs wiki Jerman tanpa instruksi. Mereka bertukar jawaban tes dan cara melewati pembatas yang dipasang oleh pengembang.

Pada pengujian terpisah, Institut Keamanan AI Inggris (AISI) menemukan agen Anthropic dan OpenAI mengambil tindakan tanpa izin di internet dan menyasar orang serta organisasi nyata.

Quote

Kami telah melihat banyak kehilangan kendali baru-baru ini. Kami menganggap ini sangat serius dan memantau situasinya dengan ketat

Coxon meninggalkan industri AI setelah tiga tahun meneliti pelatihan awal (pretraining) model. ”Orang-orang yang membangun AI sungguh percaya bahwa AI dapat membunuh kita semua pada akhir dekade ini. Ini bukan aksi pemasaran,” katanya.

Coxon mengatakan, kemampuan AI berkembang cepat. Menurut dia, kemampuan AI akan segera dapat melampaui kemampuan manusia.

This photograph shows the app logos of artificial intelligence (AI) assistants ChatGPT by US Company OpenAI and Claude by US AI safety and research company Anthropic displayed on a smartphone's screen, in Brussels on June 10, 2026. (Photo by Nicolas TUCAT / AFP)
Infografik Riset Kecerdasan Buatan - Pengguna Artificial Intelligene (AI) Berdasarkan Kelompok Generasi pada 2026

”Jangan meremehkan kekuatan teknologi ini. Sistem-sistem ini akan segera melampaui kemampuan manusia, dapat meretas apa pun, merevolusi bidang apa pun dalam semalam, serta memperoleh kekuasaan dan sumber daya nyata,” katanya.

Coxon mengakui Anthropic serius soal keselamatan AI. Namun, perusahaan itu juga terdesak persaingan dengan perusahaan AI lain. Karena itu, ia meminta pemerintah turun tangan atau perusahaan-perusahaan AI sepakat memperlambat pengembangan.

Hapus janji

Pada Februari 2026, Anthropic menghapus janji menghentikan pengembangan model jika perusahaan itu gagal mengendalikan risikonya. Awalnya, janji itu ada di piagam keselamatan Anthropic.

Anthropic beralasan, janji itu dapat membuat pesaing mendominasi industri dan membuat pengembangan AI justru lebih berbahaya. Pada akhir Juli, lebih dari 1.000 pekerja industri teknologi, termasuk CEO Anthropic Dario Amodei, meminta Pemerintah AS membantu mengerem pengembangan AI paling canggih jika diperlukan.

Lebih dari 100 perusahaan AI dan teknologi AS juga telah membuat pernyataan bersama yang menyerukan ancaman AI meningkat.

EVIAN-LES-BAINS, FRANCE - JUNE 17: CEO of Anthropic Dario Amodei attends a working lunch with G7 leaders, G7 outreach partners, and global tech CEOs on innovation and AI, during the G7 Summit on June 17, 2026 in Evian-les-Bains, France. Leaders from the Group of 7 (G7) countries convened in Evian, France, near the Swiss border, for their annual summit to discuss challenges to peace and security for Ukraine and Europe, the situation in the Middle East, and other geopolitical issues.   Anna Moneymaker/Getty Images/AFP (Photo by Anna Moneymaker / GETTY IMAGES NORTH AMERICA / Getty Images via AFP)
Infografik Riset Kecerdasan Buatan - Konten Artificial Intelligene (AI) yang Sering Diakses Berdasarkan Kelompok Generasi pada 2026

Namun, dalam pertemuan tingkat menteri G20 pada awal September 2026, Pemerintah AS justru mendesak penandatanganan Prinsip Carolina. Prinsip itu terutama agar negara-negara G20 tak mengekang pengembangan AI dengan aturan. China turut menandatangani.

Pemimpin riset alignment Anthropic Evan Hubinger memperkirakan, dengan situasi saat ini, dalam 10 tahun mendatang, risiko AI dapat membunuh manusia mencapai lebih dari 10 persen. ”Kami benar-benar percaya AI dapat membunuh semua manusia!” tulis Hubinger di X.

Hubinger mengatakan Anthropic sudah berusaha keras membuat AI tetap aman. Namun, perusahaan belum tahu bagaimana memastikan AI supercerdas tetap patuh pada penciptanya. Menurut dia, risiko itu masih rendah pada model AI saat ini.

Peretasan dan identitas palsu

Menyusul rangkaian peretasan oleh AI pembangkang itu, sejumlah penyelidikan tengah dilakukan. Uni Eropa menyelidiki kasus DseWiki Jerman yang melibatkan agen OpenAI. OpenAI juga memperluas penyelidikan internal setelah agentik AI besutannya membobol Hugging Face.

Sementara itu, Anthropic meminta METR, lembaga independen yang mengevaluasi kemampuan dan risiko AI, menyelidiki rangkaian insiden Claude yang lepas kendali.

”Kami telah melihat banyak kehilangan kendali baru-baru ini. Kami menganggap ini sangat serius dan memantau situasinya dengan ketat,” kata juru bicara digital Uni Eropa Thomas Regnier.

TOPSHOT - An AI-generated hologram called "Conceptt" flagging a video-call is displayed at the Deutsche Telekom AG's stand during the Mobile World Congress (MWC), the telecom industry's biggest annual gathering, in Barcelona on February 26, 2024. The world's biggest mobile phone fair throws open its doors in Barcelona with the sector looking to artificial intelligence to try and reverse declining sales. (Photo by PAU BARRENA / AFP)

Selain meretas tanpa perintah, AI agentik juga ditemukan mampu membuat identitas palsu. Dalam pengujian AISI, Mythos 5 milik Anthropic mencoba memasukkan kode berbahaya ke proyek perangkat lunak sumber terbuka yang digunakan di dunia nyata.

Selanjutnya, AI yang disebut terkuat di dunia itu kemudian mencari informasi tentang pengelola proyek. Ia lalu membuat identitas daring palsu dan mencoba membujuk pengelola proyek itu agar menyetujui kode tersebut. Upaya itu gagal.

Meta juga mengungkap salah satu model AI miliknya lepas kendali dan membobol sistem perusahaan lain saat menjalani pengujian.

Senator AS Bernie Sanders juga menyuarakan kekhawatiran serupa. ”Orang-orang yang membangun teknologi ini sendiri mengakui bahwa teknologi tersebut dapat mengancam masa depan umat manusia,” katanya.

Sanders mengatakan akan mengajukan legislasi untuk menghentikan sementara pengembangan AI dan melarang superintelligence. (Reuters/AP/AFP)


Kerabat Kerja

Penulis:

Irene Sarwindaningrum
 | 

Editor:

Nur Hidayati
 | 

Penyelaras Bahasa:

Apolonius Lase