Kapabilitasnya sebetulnya masih 11-12 dengan sejumlah model AI yang lebih dahulu dikenal. Tetapi, efisiensi DeepSeek enggak main-main. Momen Sputnik dunia AI.
28 Jan 2025 13:44 WIB · Gaya Hidup
Harga saham Nvidia, raksasa cip asal Amerika Serikat, pada Senin (27/1/2025), anjlok 16,9 persen setara hampir 600 miliar dollar AS, setara Rp 9.600 triliun, atau bisa dibilang hampir 2,7 kali lipat dari nilai anggaran belanja Pemerintah Indonesia pada APBN 2025.
Salah satu pemicu terbesarnya adalah DeepSeek, perusahaan kecerdasan artifisial (artificial intelligence/AI) asal China. Pemain baru ini, didirikan pada 2023, mengumumkan bahwa sejumlah model AI terbaru mampu menyamai kapabilitas dari sejumlah model tercanggih dari raksasa AI dunia, seperti dari Meta ataupun OpenAI.
Misalnya, pada pengujian kemampuan matematika AIME 2024, DeepSeek-R1 mengungguli OpenAI o1 dengan skor persentil tipis 79,8 versus 79,2. Pada benchmark sejenis, yaitu Math-500, DeepSeek-R1 juga unggul tipis dengan skor 97,3 dibandingkan o1 di angka 96,3.
Namun, dalam kemampuan mengolah informasi dalam bahasa Inggris, o1 juga unggul sedikit dibandingkan DeepSeek-R1, seperti pada benchmark GPQA Diamond (75,7 versus 71,5) dan MMLU (91,8 versus 90,8).
Pada kemampuan menulis kode pemrograman, DeepSeek-R1 dan OpenAI o1 saling berbagi. Untuk pengujian SWE-Bench, DeepSeek-R1 masih unggul tipis dengan skor 49,2 melawan 48,9 dari o1. Sementara untuk Codeforces, skor o1 sedikit lebih tinggi: 96,6 melawan 96,3.
Namun, letak kehebatannya sesungguhnya bukan sekadar dari prestasi DeepSeek menyamai para pemain besar ini. Keunggulan utamanya adalah efisiensi. DeepSeek menunjukkan bahwa mereka mencapai kapabilitas ini dengan kemampuan sumber daya teknologi yang jauh lebih rendah dan dengan proses yang jauh lebih singkat.
”Sejauh ini, yang kami temukan adalah DeepSeek memiliki performa kelas atas, setara dengan model AI terbaik dari AS,” kata CEO Scale AI, Alexandr Wang.
:quality(80)/https://asset.kgnewsroom.com/photo/pre/2020/06/26/170013cb-6441-4589-87fc-310faa8a187e_jpg.jpg)
Berdasarkan technical report atau laporan teknis yang diunggah ke platform AI terbuka Huggingface, DeepSeek-V3 membutuhkan waktu pelatihan sekitar 2,8 juta jam penggunaan GPU (GPU hours) dan hanya memerlukan pusat data dengan 2.048 keping kartu grafis Nvidia H800.
Perlu diketahui, Nvidia H800 diciptakan dari modifikasi cip flagship milik Nvidia, yaitu H100, agar bisa diekspor ke China, tidak melanggar aturan ekspor cip AI dari AS. Regulasi ekspor ini membatasi kapabilitas cip yang diekspor dari AS ke China. Oleh karena itu, H800 diciptakan dengan cara mengurangi kecepatan pemrosesan H100 sebanyak sekitar 50 persen.
Sebagai perbandingan, model AI paling top dari Meta AI, yaitu Llama 3.1 405B, membutuhkan waktu pelatihan 30,84 juta jam GPU. Selain itu, untuk melatih LLama 3.1, Meta menggunakan sekitar 16.000 keping GPU Nvidia H100.
Terlebih lagi, biaya penggunaan API DeepSeek juga jauh lebih murah dibandingkan OpenAI, misalnya.
Harga akses API DeepSeek untuk input (kemampuan mencerna perintah) adalah 0,55 dollar AS (setara Rp 8.900) per 1 juta token (sekitar 750.000 kata) dan untuk output (menghasilkan teks yang diminta) adalah 2,19 dollar AS (setara Rp 35.500) per 1 juta token.
Ini jauh lebih murah ketimbang tarif OpenAI o1, misalnya. OpenAI mematok tarif untuk akses API o1 dengan harga untuk input adalah 15 dollar AS (setara Rp 243.000) per 1 juta token dan 60 dollar AS (setara Rp 973.000) per 1 juta token.
:quality(80)/https://kompasmedia.site/images/2025/01/28/ab570d78b2aed2f77e5aaf4de3405514-Screenshot_2025_01_28_094935.png)
Brian Jacobsen, Kepala Ekonom di Annex Wealth Management yang berbasis di AS, mengungkapkan, DeepSeek mempunyai potensi untuk benar-benar memiliki inovasi yang lebih unggul dari model AI yang sudah ada.
Ini berpotensi mengubah total narasi tentang AI yang selama dua tahun terakhir menjadi pendorong utama pertumbuhan pasar.
”Hal ini dapat berarti berkurangnya permintaan untuk cip, kebutuhan yang lebih rendah akan pengembangan besar-besaran produksi daya untuk mendukung model AI, dan penurunan kebutuhan akan pusat data berskala besar,” kata Jacobsen.
Harga dan kapabilitas DeepSeek semacam itu membuat para investor AI secara global seakan menghitung ulang valuasi yang mereka berikan terhadap Nvidia, misalnya. Aksi DeepSeek juga diyakini mulai menggoyahkan hegemoni para pemain besar AI dunia, seperti OpenAI, Meta, ataupun Alphabet.
Microsoft, misalnya, yang merupakan salah satu pemegang saham terbesar OpenAI, juga menemani Nvidia ketika sahamnya anjlok pada Senin kemarin. Saham Microsoft, yang diperjualbelikan di bursa Nasdaq, drop sekitar 4,5 persen. Indeks Nasdaq, yang banyak menjadi ”rumah” perusahaan teknologi AS, juga turun sekitar 3 persen.
Marc Andreessen, pemodal ventura terkenal Silicon Valley, menyebut DeepSeek sebagai momen Sputnik di dunia AI. ”DeepSeek R1 is AI’s Sputnik moment,” kata Andreessen di X pada Senin kemarin.
DeepSeek-R1 adalah salah satu terobosan paling mengagumkan dan impresif yang pernah saya lihat—dan karena ”open source”, ini juga sebuah anugerah untuk dunia.
Pernyataan ini mengacu pada Sputnik, satelit ciptaan manusia pertama yang sampai ke orbit, yang diluncurkan Uni Soviet pada Oktober 1957.
Peluncuran Sputnik ini lalu menjadi tonggak awal space race atau perang luar angkasa antara AS dan Uni Soviet pada akhir 1950-an hingga awal 1970-an, yang berakhir dengan keberhasilan AS mendaratkan astronotnya di Bulan.
”DeepSeek-R1 adalah salah satu terobosan paling mengagumkan dan impresif yang pernah saya lihat—dan karena open source, ini juga sebuah anugerah untuk dunia,” tulis Andreessen secara terpisah.
Bisa jadi, ini juga awal dari perang AI antara AS dan China yang baru akan dimulai.
Amunisi DeepSeek pun tidak berhenti pada DeepSeek-R1, yang merupakan pesaing dari OpenAI o1. DeepSeek juga punya model AI yang lebih ringan, mungkin bisa diperbandingkan dengan Meta Llama 3.1, OpenAI GPT-4o, ataupun Anthropic Claude-3.5.
Dalam kelas yang lebih ringan ini, DeepSeek-V3 juga mampu jual-beli pukulan selayaknya petinju yang setara dengan sejumlah model AI tersebut. Misalnya, dalam pengujian kemampuan bahasa Inggris MMLU, memimpin dengan skor 88,6; tetapi disusul dengan sangat dekat oleh DeepSeek-V3 (88,5), Claude-3.5 (88,3), dan GPT-4o (87,2).
Namun, dalam pengujian bahasa Inggris oleh benchmark lain, misalnya FRAMES, GPT-4o memimpin dengan skor 80,5; baru disusul oleh DeepSeek-V3 (73,3), Claude (72,5), dan Llama 3.1 dengan 70,0.
Meski dengan seluruh keunggulannya, aplikasi chatbot DeepSeek tampaknya masih terpengaruh oleh kondisi politik dalam negeri China. Jika pengguna menanyakan tentang Presiden China Xi Jinping, DeepSeek akan menolak permintaan tersebut.
”Sorry, that’s beyond my current scope. Let’s talk about something else,” tulis DeepSeek, ketika Kompas mencoba meminta membandingkannya dengan Presiden AS Donald Trump.
:quality(80):watermark(https://cdn-content.kompas.id/umum/kompas_main_logo.png,-16p,-13p,0)/https://kompasmedia.site/images/2025/01/28/b030c5bc321c2097dac50c006ed113d4-Screenshot_2025_01_28_094343.png)
Chatbot DeepSeek juga tampaknya menyensor pertanyaan dan informasi terkait demonstrasi Tiananmen tahun 1989. Namun, karena DeepSeek juga disediakan dalam bentuk open source, pengembang bisa mengunduh, memodifikasi, dan menjalankan DeepSeek secara lokal.
Dengan langkah DeepSeek, kita hanya bisa menunggu, gebrakan apa lagi yang akan muncul dari para kompetitornya di AS dalam ”space race” versi abad ke-21 ini. (REUTERS/AFP)
Penulis:
Satrio Pangarso WisanggeniEditor:
Antonius Tomy Trinugroho