Peneliti UC Berkeley Berhasil Mereplikasi DeepSeek AI Hanya dengan $30
SerbaGratis95.site -Penelitian Artificial Intelligence (AI) biasanya didominasi oleh perusahaan besar dengan anggaran yang melimpah. Namun, sebuah tim dari UC Berkeley berhasil membalikkan paradigma ini.
Tim ini berhasil meniru kemampuan inti DeepSeek R1-Zero hanya dengan biaya $30 (bukan kesalahan ketik).
Proyek yang diberi nama TinyZero, membuktikan bahwa model penalaran AI tingkat lanjut tidak harus mahal. Selain itu, Penelitian AI kini menjadi lebih mudah diakses dari sebelumnya.

Dipimpin oleh Jiayi Pan, tim peneliti berusaha mereplikasi model penalaran DeepSeek menggunakan reinforcement learning (RL).
Alih-alih bergantung pada layanan cloud mahal atau daya komputasi besar, tim ini melatih TinyZero dengan model bahasa sederhana, prompt sederhana, dan sistem penghargaan.
Pan membagikan kegembiraannya atas hal ini di aplikasi ‘X’. Ia mengatakan, “You can experience the ‘Aha’ moment yourself for < $30.”I (Kamu bisa merasakan momen ‘Aha’ sendiri dengan biaya kurang dari $30)
Ia juga menggambarkan TinyZero sebagai reproduksi terbuka pertama dari prompt sederhana, dengan menyoroti bagaimana model ini belajar untuk memverifikasi dan memperbaiki jawabannya sendiri.
Lalu, bagaimana sebenarnya TinyZero dikembangkan?
Baca Juga: DeepSeek: Startup AI Tiongkok yang Menantang Dominasi OpenAI
Untuk menguji model ini, para peneliti menggunakan game bernama ‘Countdown’, di mana pemain harus mencapai angka target menggunakan operasi matematika dasar.
Awalnya, TinyZero hanya menebak secara acak, tetapi seiring waktu, ia belajar untuk memverifikasi jawabannya, mencari solusi yang lebih baik, dan menyesuaikan diri.
Mereka bereksperimen dengan berbagai ukuran model, mulai dari 500 juta parameter hingga 7 miliar parameter.
Hasilnya?
Model yang lebih kecil (0,5B parameter) hanya menebak dan berhenti, sementara model lebih besar (1,5B+ parameter) mampu memverifikasi sendiri, meningkatkan akurasi, serta meningkatkan akurasi secara signifikan.
Namun, yang membuat TinyZero begitu mengesankan adalah biayanya yang jauh lebih murah dibandingkan model AI lama. Berikut perbandingannya:
- API OpenAI: $15 per juta token
- DeepSeek-R1: $0,55 per juta token
- TinyZero: $30 untuk biaya pelatihan satu kali
Hal ini bias adiartikan bahwa siapa pun—bukan hanya perusahaan besar—bisa bereksperimen dengan model penalaran AI tanpa harus mengeluarkan biaya yang cukup besar.
Ketersediaan TinyZero
TinyZero bersifat open-source dan tersedia di GitHub, sehingga siapa saja dapat mencoba dan mengembangkannya lebih lanjut.
Mungkin saat ini, TinyZero baru diuji dalam permainan Countdown, tetapi Pan berharap proyek ini akan membantu membuat penelitian reinforcement learning lebih mudah diakses.
Meskipun masih dalam tahap awal, tapi efeknya sudah terasa. Pan mengakui bahwa TinyZero baru divalidasi dalam tugas Countdown dan belum diuji dalam domain penalaran umum.
Namun, dengan hadirnya proyek seperti TinyZero, AI yang terjangkau dan open-source bisa menjadi masa depan.
Tag:
#TinyZero
#AI
#Teknologi
#KecerdasanBuatan
#ReinforcementLearning
#OpenSource
Posting Komentar
Komentar dengan menyertakan atau promosi produk tertentu akan Kami hapus. Sebab, blog ini bukan tempat untuk mempromosikan barang yang Kamu jual. Salam santun Blogger Indonesia