Dunia teknologi kecerdasan buatan (Artificial Intelligence) sempat didominasi oleh nama-nama besar asal Amerika Serikat seperti OpenAI, Google, Anthropic, dan Meta. Namun, peta persaingan berubah drastis ketika sebuah laboratorium riset asal Tiongkok bernama DeepSeek merilis model AI dengan kemampuan luar biasa namun dibangun dengan efisiensi biaya yang sangat mencengangkan.
Bagaimana sebuah tim riset independen bisa mendisrupsi industri AI global dan memicu perbincangan di seluruh dunia? Simak ulasan lengkap mengenai apa itu DeepSeek, sosok di baliknya, sejarah perjalanannya, serta rahasia teknologi yang mereka gunakan.
Apa Itu DeepSeek dan dari Mana Asalnya?
DeepSeek (nama resmi perusahaan: Hangzhou DeepSeek Artificial Intelligence Co., Ltd.) adalah perusahaan riset kecerdasan buatan yang berpusat di Hangzhou, Zhejiang, Tiongkok. DeepSeek berfokus pada pengembangan model bahasa skala besar (Large Language Models / LLM) tingkat lanjut dan model penalaran mendalam (deep reasoning) dengan pendekatan open-source (bobot model terbuka/dapat diakses publik).
DeepSeek menyediakan layanan chatbot interaktif untuk pengguna umum serta antarmuka pemrograman aplikasi (API) bagi para pengembang perangkat lunak, mirip dengan layanan ChatGPT milik OpenAI atau Claude milik Anthropic.
Siapa Pengembang dan Tokoh Kunci di Balik DeepSeek?
Pengembangan DeepSeek diinisiasi dan dipimpin oleh Liang Wenfeng, seorang pengusaha sekaligus pakar rekayasa algoritma asal Tiongkok.
- Latar Belakang Finansial (High-Flyer Capital): Sebelum terjun penuh ke riset LLM murni, Liang mendirikan High-Flyer Quant (Zhejiang High-Flyer Asset Management), salah satu hedge fund kuantitatif terbesar di Tiongkok yang mengandalkan algoritma machine learning untuk transaksi pasar modal.
- Kemandirian Finansial & Klaster Komputasi: Berkat kesuksesan High-Flyer, DeepSeek didanai secara mandiri tanpa ketergantungan besar pada modal ventura eksternal. Mereka juga telah mengakumulasi infrastruktur komputasi klaster GPU berkapasitas besar sebelum regulasi pembatasan ekspor chip semikonduktor semakin ketat.
- Filosofi Riset: Liang membentuk tim yang didominasi peneliti muda, akademisi berbakat, dan teknisi algoritma lokal untuk mengeksplorasi efisiensi arsitektur komputasi daripada sekadar membakar dana miliaran dolar untuk membeli server.
Sejarah dan Tonggak Penting Perjalanan DeepSeek
| Periode | Peristiwa / Pencapaian Utama |
| Mei 2023 | Perusahaan didirikan secara resmi di Hangzhou oleh Liang Wenfeng sebagai divisi riset AGI (Artificial General Intelligence). |
| Akhir 2023 – Awal 2024 | Peluncuran model generasi awal seperti DeepSeek LLM dan DeepSeek Coder, yang langsung menarik perhatian pengembang karena kemampuannya dalam memahami kode pemrograman. |
| Pertengahan 2024 | Pengenalan arsitektur DeepSeek-V2, yang mempopulerkan metode kompresi memori dan efisiensi biaya token API hingga jauh lebih murah dibanding model kompetitor. |
| Desember 2024 – Awal 2025 | Peluncuran DeepSeek-V3 dan DeepSeek-R1. Rilis ini menjadi fenomena global karena model penalaran matematika dan logika tingkat tingginya terbukti mampu menandingi model flagship proprietary global dengan biaya pelatihan (training cost) yang diperkirakan di bawah $6 juta. |
Mengapa DeepSeek Mengguncang Industri Teknologi?
Keberhasilan DeepSeek bukan sekadar menghasilkan model yang cerdas, melainkan bagaimana mereka mencapainya dengan pendekatan teknik yang sangat efisien:
- Arsitektur Mixture-of-Experts (MoE): Berbeda dengan model padat (dense models) yang mengaktifkan seluruh parameter setiap kali memproses teks, MoE hanya mengaktifkan kelompok sub-jaringan (pakar) tertentu sesuai konteks pertanyaan. Hal ini memangkas beban pemrosesan server secara drastis.
- Multi-head Latent Attention (MLA): Inovasi kompresi memori (KV Cache) yang memungkinkan pemrosesan context window panjang dengan konsumsi memori GPU yang jauh lebih hemat.
- Filosofi Open Source: DeepSeek merilis bobot model (weights) dan laporan teknisnya secara transparan, memungkinkan komunitas pengembang global mengunduh, mempelajari, dan menjalankannya di server privat secara mandiri.
DeepSeek membuktikan bahwa inovasi arsitektur dan efisiensi algoritma mampu menembus batasan biaya dan keterbatasan perangkat keras, sekaligus menyeimbangkan peta kekuatan teknologi global di ranah kecerdasan buatan.






