Apakah itu DeepSeek?

Turn this article into takeaways for your work.
Each assistant summarizes the article only for you and suggests best practices for your work.
Dikemas kini Julai 2026
DeepSeek ialah makmal penyelidikan AI China, ditubuhkan pada 2023 oleh pengurus dana lindung nilai Liang Wenfeng, terkenal kerana membina model bahasa besar berkos rendah dan berpemberat terbuka. Model penaakulan DeepSeek-R1, dilancarkan pada Januari 2025, menyamai model terdepan Barat dalam penanda aras matematik dan pengekodan pada sebahagian kecil kos latihan yang dilaporkan, mencetuskan penilaian semula global terhadap perbelanjaan infrastruktur AI.
Kebanyakan orang mula-mula mendengar tentang DeepSeek pada minggu apliksinya melonjak ke kedudukan teratas Apple App Store dan Nvidia kehilangan lebih banyak nilai pasaran dalam sehari berbanding hampir mana-mana syarikat dalam sejarah. Tetapi DeepSeek lebih daripada sekadar peristiwa tajuk berita: ia ialah pemaju model aktif yang terus mengeluarkan keluaran baharu sepanjang 2026, alternatif berpemberat terbuka kepada makmal tertutup seperti OpenAI dan Anthropic, dan kajian kes hidup bagi persoalan privasi data dan geopolitik yang datang bersama penggunaan alat AI yang dibina di China. Artikel ini merangkumi apa itu DeepSeek, bagaimana ia sampai ke tahap ini, susunan modelnya, kisah kecekapan di sebaliknya, dan apa yang perlu dipertimbangkan sebelum sesebuah perniagaan menggunakannya.
"Detik DeepSeek": Latar Belakang dan Kejutan Januari 2025
DeepSeek ditubuhkan pada 2023 sebagai cabang penyelidikan High-Flyer, sebuah dana lindung nilai kuantitatif berpangkalan di Hangzhou yang diasaskan bersama oleh Liang Wenfeng pada 2015. High-Flyer sudah pun menggunakan AI untuk menggerakkan model dagangannya, dan ia memberikan makmal baharu itu akses kepada simpanan besar GPU Nvidia yang telah dikumpulnya sebelum kawalan eksport AS diperketatkan, sumber yang membolehkan DeepSeek melatih model kompetitif tanpa bajet berbilion dolar yang dimiliki pesaing AS-nya.

Makmal ini berkembang secara berperingkat sepanjang 2024, tetapi detik yang menjadikannya nama biasa disebut berlaku pada 20 Januari 2025, apabila DeepSeek melancarkan R1, sebuah model penaakulan berpemberat terbuka yang menyamai o1 milik OpenAI dalam penanda aras matematik, pengekodan, dan sains. Aplikasi DeepSeek, dilancarkan pada 10 Januari, melonjak ke kedudukan nombor satu di US iOS App Store menjelang 27 Januari, mengatasi ChatGPT. Pada hari yang sama, saham Nvidia jatuh hampir 17%, menghapuskan $589 bilion nilai pasaran, kerugian sehari terbesar bagi mana-mana syarikat dalam sejarah pasaran saham, apabila pelabur mempersoalkan sama ada industri ini benar-benar memerlukan perbelanjaan GPU sebanyak yang diandaikan sebelum ini.
Kepanikan itu berpusat pada kos. Laporan teknikal DeepSeek sendiri untuk model asas V3 yang mendasarinya mendakwa kos latihan kira-kira $5.6 juta, sebahagian kecil daripada apa yang dilaporkan dibelanjakan oleh makmal AS untuk model terdepan yang setanding. Angka itu segera menjadi tumpuan penelitian (lebih lanjut di bawah), tetapi isyarat yang lebih luas kekal sahih: sebuah makmal yang beroperasi di bawah sekatan cip AS telah menghasilkan model yang kompetitif dengan yang terbaik di dunia, dan ia memberikan pemberatnya secara percuma untuk sesiapa sahaja memuat turun dan menjalankannya.
Susunan Model DeepSeek: Daripada V3 kepada R1 kepada V4
DeepSeek mengeluarkan model mengikut kadar keluaran awam yang pantas dan bukan satu produk unggulan tunggal.
DeepSeek-V3 (Disember 2024) ialah model asas yang memulakan kisah ini. Ia menggunakan seni bina mixture of experts, mengaktifkan hanya sebahagian kecil daripada jumlah parameternya untuk setiap pertanyaan, yang merupakan sebahagian besar sebab ia dilatih dan dijalankan dengan lebih murah berbanding model tumpat bersaiz serupa.
DeepSeek-R1 (Januari 2025) ialah model penaakulan yang dibina di atas V3. Ia menggunakan pengiraan rantaian pemikiran yang diperluas, menyelesaikan masalah langkah demi langkah sebelum menjawab, teknik yang sama kategorinya dengan pengkomputeran masa ujian. DeepSeek juga melancarkan satu keluarga varian R1 "sulingan" yang lebih kecil, menggunakan penyulingan pengetahuan untuk memampatkan keupayaan penaakulan R1 ke dalam model yang cukup kecil untuk dijalankan pada satu GPU tunggal atau komputer riba bertaraf tinggi.
DeepSeek-V3.2 (Disember 2025) menambah penggunaan alat terus ke dalam proses pemikiran model, membolehkannya menaakul melalui sesuatu masalah dan memanggil alat luaran dalam laluan yang sama. DeepSeek melaporkan ia mencapai keputusan bertaraf pingat emas dalam set penanda aras International Mathematical Olympiad dan International Olympiad in Informatics 2025.
DeepSeek-V4 (dipratonton pada 24 April 2026, dengan keluaran stabil menyusul pada Julai 2026) ialah generasi semasa, dikeluarkan sebagai dua varian: V4-Pro, model mixture-of-experts yang besar, dan V4-Flash, varian yang lebih kecil dan lebih pantas. Kedua-duanya menyokong tetingkap konteks 1 juta token dan, seperti setiap keluaran DeepSeek sehingga kini, dikeluarkan di bawah lesen terbuka.
Kisah Kecekapan dan Kos
Reputasi DeepSeek terletak pada berbuat lebih dengan lebih sedikit, dan angka-angkanya, walaupun dipertikaikan, cukup nyata untuk diambil kira.

Laporan teknikal V3 DeepSeek sendiri meletakkan jumlah pengkomputeran latihan pada 2.788 juta jam GPU H800, atau kira-kira $5.576 juta pada kadar kira-kira $2 sejam GPU. Pada September 2025, DeepSeek menerbitkan kertas kajian semakan rakan sebaya dalam Nature yang mendedahkan angka berasingan sebanyak $294,000 khusus untuk latihan penaakulan tambahan R1 di atas V3. Penganalisis bebas, termasuk penyelidik di Epoch AI, telah berhujah bahawa kos sebenar keseluruhan (mengambil kira latihan asas V3 yang mendasarinya, perkakasan, dan overhed R&D yang tidak dimasukkan dalam angka DeepSeek) mencecah hampir 20 kali ganda angka utama tersebut. Walaupun pada anggaran yang lebih tinggi itu, kos latihan DeepSeek masih jauh lebih rendah daripada apa yang dilaporkan oleh OpenAI dan Anthropic untuk larian terdepan yang setanding.
Kelebihan kos ini paling jelas kelihatan pada apa yang dikenakan DeepSeek untuk penggunaan modelnya. Setakat pertengahan 2026, API V4-Flash DeepSeek menetapkan harga token output pada $0.28 sejuta, berbanding $15 sejuta bagi GPT-5.4 milik OpenAI dan Claude Sonnet 4.6 milik Anthropic, jurang kira-kira 50 kali ganda. Penetapan harga itu, bukan sekadar tajuk kos latihan asal, yang mengekalkan relevans DeepSeek kepada pembangun yang sedar kos jauh selepas kitaran berita Januari 2025 pudar.
Pemberat Terbuka dan Pelesenan
Berbeza daripada GPT dan Claude, model DeepSeek berpemberat terbuka: sesiapa sahaja boleh memuat turun fail model terlatih sebenar, menjalankannya pada infrastruktur mereka sendiri, menala-halusnya, dan membina produk komersial berasaskannya tanpa membayar sebarang yuran lesen kepada DeepSeek.
DeepSeek-R1 dan model siri-V dikeluarkan di bawah lesen MIT yang bersifat permisif, yang membenarkan penggunaan komersial, pengubahsuaian, dan penyulingan ke dalam model lain, dengan hanya memerlukan teks lesen dikekalkan dalam pengedaran semula. Itu ialah pendirian yang jauh lebih terbuka berbanding label "terbuka" yang digunakan secara longgar oleh sesetengah pesaing; DeepSeek benar-benar membenarkan sesebuah syarikat menghoskan sendiri model tersebut dan tidak pernah menghantar satu pun pertanyaan ke pelayan DeepSeek sendiri.
Ini penting secara praktikal dalam dua cara. Pertama, pasukan yang sensitif kos boleh menjalankan varian R1 sulingan secara setempat tanpa langsung membayar yuran API per-token. Kedua, hosting sendiri mengelakkan kebanyakan kebimbangan pengendalian data yang dibincangkan seterusnya, memandangkan tiada apa-apa meninggalkan infrastruktur syarikat sendiri. Pertukaran kepadanya ialah hosting sendiri memerlukan kapasiti GPU dan kepakaran MLOps untuk menjalankan model itu dengan boleh dipercayai, iaitu tepat jenis kerja infrastruktur yang dibayar oleh kebanyakan pasukan perniagaan kepada OpenAI atau Anthropic untuk dielakkan.
Menggunakan DeepSeek untuk Perniagaan: Perkara yang Perlu Diketahui Dahulu
Kos rendah dan pelesenan terbuka DeepSeek menjadikannya menarik bagi pasukan kejuruteraan, tetapi ia datang dengan amaran yang tidak dibawa oleh vendor model tertutup biasa.
Aplikasi dan API DeepSeek yang dihoskan menghalakan data melalui pelayan berpangkalan di China, yang tertakluk kepada undang-undang data dan keselamatan negara China dan bukannya rangka kerja seperti GDPR atau CCPA yang mentadbir vendor AS dan EU. Pihak berkuasa perlindungan data Itali mengarahkan sekatan segera terhadap pemprosesan data pengguna Itali oleh DeepSeek pada Januari 2025, salah satu tindakan kawal selia formal pertama terhadap syarikat itu, dan kerajaan serta perusahaan lain sejak itu telah menyekat DeepSeek pada peranti rasmi atas kebimbangan yang sama. Tiada satu pun daripada ini unik kepada DeepSeek antara vendor AI China, tetapi ia mewakili profil risiko yang jauh berbeza berbanding penyedia berpangkalan AS, dan ia harus dimasukkan dalam mana-mana penilaian vendor AI sebelum sesebuah pasukan menggunakannya untuk apa-apa yang menyentuh data pelanggan atau pekerja.
Menghoskan sendiri model berpemberat terbuka, sama ada melalui penyedia awan domestik atau perkakasan di premis, kebanyakannya menyelesaikan kebimbangan penghalaan data memandangkan pertanyaan langsung tidak pernah sampai ke infrastruktur DeepSeek. Itulah pilihan yang diambil oleh kebanyakan pasukan keselamatan perusahaan apabila mereka mahukan kos dan kualiti penaakulan DeepSeek tanpa pendedahan perkhidmatan yang dihoskan. Persoalan yang lebih luas tentang sama ada untuk mempercayai model yang dibina dan dilatih di bawah bidang kuasa kerajaan asing merupakan sebahagian daripada perdebatan lebih besar yang dirangkumi dalam AI berdaulat, dan ia berbaloi dibaca sebelum menyeragamkan mana-mana aliran kerja pada DeepSeek.
DeepSeek berbanding OpenAI berbanding Claude
Berikut ialah bagaimana DeepSeek dibandingkan dengan dua makmal yang menjadi pilihan lalai bagi kebanyakan keputusan pembelian AI perusahaan.
| DeepSeek | OpenAI | Anthropic (Claude) | |
|---|---|---|---|
| Ditubuhkan | 2023, Hangzhou, China (dipisahkan daripada dana lindung nilai High-Flyer) | 2015, San Francisco | 2021, San Francisco |
| Model unggulan | V4-Pro, V4-Flash, R1 (penaakulan) | Siri GPT-5.x | Claude (peringkat Opus, Sonnet, Haiku) |
| Pemberat terbuka | Ya, lesen MIT merentasi siri R1 dan V | Tidak, pemberat tertutup | Tidak, pemberat tertutup |
| Hosting sendiri | Ya, muat turun dan jalankan pada infrastruktur anda sendiri | Tidak, hanya API atau ChatGPT | Tidak, hanya API atau Claude |
| Anggaran harga output (per 1 juta token) | $0.28 (V4-Flash) | $15 (GPT-5.4) | $15 (Sonnet 4.6) |
| Tetingkap konteks | Sehingga 1 juta token (V4) | Berbeza mengikut peringkat model | Berbeza mengikut peringkat model |
| Pengendalian data | Aplikasi dihoskan menghalakan melalui pelayan berpangkalan di China; hosting sendiri mengekalkan data setempat | Berpangkalan AS, kawalan data perusahaan (SOC 2, konsol pentadbir) | Berpangkalan AS, postur kepercayaan dan keselamatan perusahaan yang kukuh |
| Terkenal dengan | Model berpemberat terbuka berkos paling rendah pada kualiti bertaraf terdepan | Jangkauan pengguna terbesar, kadar keluaran paling pantas | Penyelidikan keselamatan dan kebolehpercayaan bertaraf perusahaan |
Kesimpulan praktikalnya: DeepSeek menang dari segi harga mentah per-token dan dari segi memberikan anda pilihan untuk hosting sendiri, yang tidak ditawarkan langsung oleh OpenAI dan Claude. OpenAI dan Anthropic menang dari segi tadbir urus data, sokongan perusahaan, dan jaminan beroperasi di bawah bidang kuasa AS, yang sering menjadi faktor penentu bagi industri terkawal tanpa mengira skor penanda aras.
Batasan DeepSeek
Beberapa batasan penting selain persoalan privasi data di atas. Model DeepSeek, seperti kebanyakan sistem yang dilatih di China, mengenakan sekatan kandungan ke atas topik sensitif secara politik yang berkaitan dengan kerajaan China, dan penyelidik telah mendokumentasikan aplikasi sembang yang dihoskan itu menolak atau mengalihkan soalan tertentu yang dijawab secara langsung oleh model Barat tertutup. DeepSeek juga tidak mempunyai infrastruktur sokongan perusahaan yang dibina oleh OpenAI dan Anthropic, termasuk SLA formal, pasukan akaun khusus, dan pensijilan pematuhan yang matang, yang lebih penting bagi organisasi besar berbanding pembangun individu. Dan angka kos latihan asal yang menjadikan DeepSeek terkenal masih dipertikaikan secara sahih; anggap angka "$5.6 juta" dan "$294,000" sebagai angka yang didedahkan sendiri oleh DeepSeek dan bukannya jumlah yang diaudit secara bebas.

Fakta Utama tentang DeepSeek
- Model asas V3 DeepSeek dianggarkan berkos $5.576 juta untuk dilatih, menggunakan 2.788 juta jam GPU H800 pada kadar kira-kira $2 sejam GPU, menurut laporan teknikal DeepSeek sendiri. Sumber
- DeepSeek secara berasingan mendedahkan kos latihan $294,000 untuk R1 dalam kertas kajian semakan rakan sebaya yang diterbitkan dalam Nature pada September 2025, walaupun anggaran bebas meletakkan kos pengkomputeran keseluruhan sebenar lebih hampir kepada 20 kali ganda angka tersebut apabila latihan asas V3 dimasukkan. Sumber
- Nvidia kehilangan $589 bilion nilai pasaran pada 27 Januari 2025, kerugian sehari terbesar bagi mana-mana syarikat dalam sejarah pasaran saham, selepas keluaran DeepSeek menimbulkan keraguan mengenai perbelanjaan infrastruktur AI. Sumber
- Aplikasi DeepSeek menjadi aplikasi percuma #1 di US iOS App Store pada 27 Januari 2025, mengatasi ChatGPT dalam masa beberapa minggu selepas pelancarannya pada 10 Januari. Sumber
- Pihak berkuasa perlindungan data Itali mengarahkan sekatan segera terhadap pemprosesan data pengguna Itali oleh DeepSeek pada 30 Januari 2025, salah satu tindakan kerajaan formal pertama yang diambil terhadap syarikat itu berhubung pengendalian data. Sumber
- DeepSeek-R1 dikeluarkan di bawah lesen MIT pada 20 Januari 2025, membenarkan penggunaan komersial, pengubahsuaian, dan penyulingan ke dalam model lain tanpa royalti. Sumber
- DeepSeek-V4 dilancarkan dalam pratonton pada 24 April 2026, dengan kedua-dua varian V4-Pro dan V4-Flash menyokong tetingkap konteks 1 juta token di bawah lesen terbuka yang sama. Sumber
- API V4-Flash DeepSeek menetapkan harga token output pada $0.28 sejuta, berbanding $15 sejuta bagi GPT-5.4 milik OpenAI, jurang kira-kira 50 kali ganda yang mengukuhkan reputasi DeepSeek sebagai pilihan berkos rendah. Sumber
Soalan Lazim tentang DeepSeek
Apakah itu DeepSeek AI dalam istilah mudah?
DeepSeek ialah makmal AI China, ditubuhkan pada 2023, yang membina model bahasa besar berpemberat terbuka yang boleh anda muat turun dan jalankan sendiri. Ia paling dikenali dengan R1, model penaakulan yang dilancarkan pada Januari 2025 yang menyamai model Barat terkemuka dalam penanda aras matematik dan pengekodan pada kos latihan yang dilaporkan jauh lebih rendah.
Adakah DeepSeek percuma untuk digunakan?
Aplikasi sembang DeepSeek dan had API terhad adalah percuma. Penggunaan API yang lebih berat dibayar per token, walaupun harga DeepSeek (kira-kira $0.28 sejuta token output pada V4-Flash) jauh lebih murah daripada model setara OpenAI atau Anthropic. Model berpemberat terbuka itu sendiri juga percuma untuk dimuat turun dan dihoskan sendiri di bawah lesen MIT.
Siapakah pemilik DeepSeek?
DeepSeek ditubuhkan oleh Liang Wenfeng, yang juga mengasaskan bersama dana lindung nilai kuantitatif China High-Flyer pada 2015. High-Flyer membiayai infrastruktur GPU awal DeepSeek dan kekal berkait rapat dengan makmal itu, walaupun DeepSeek beroperasi sebagai organisasi penyelidikan dan produknya sendiri.
Mengapakah DeepSeek menyebabkan saham Nvidia jatuh?
Keluaran R1 oleh DeepSeek pada Januari 2025, bersama kos latihan rendah yang didedahkannya, menimbulkan keraguan di kalangan pelabur sama ada industri AI benar-benar memerlukan perbelanjaan GPU sebanyak yang diandaikan sebelum ini. Nvidia kehilangan $589 bilion nilai pasaran pada 27 Januari 2025, kerugian sehari terbesar dalam sejarah pasaran saham bagi mana-mana syarikat.
Adakah DeepSeek sumber terbuka?
Pemberat model DeepSeek terbuka di bawah lesen MIT, bermaksud sesiapa sahaja boleh memuat turun, menjalankan, mengubah suai, dan menggunakannya secara komersial. Itu berbeza daripada sumber terbuka sepenuhnya dalam erti kata perisian tradisional, memandangkan DeepSeek tidak menerbitkan data latihan atau kod latihan penuh, hanya pemberat model dan kod inferens yang terhasil.
Adakah selamat bagi perniagaan menggunakan DeepSeek?
Ia bergantung pada cara penggunaannya. Aplikasi dan API DeepSeek yang dihoskan menghalakan data melalui pelayan berpangkalan di China yang tertakluk kepada undang-undang China, yang menyebabkan pengawal selia seperti pihak berkuasa perlindungan data Itali menyekatnya dan sesetengah kerajaan mengharamkannya pada peranti rasmi. Hosting sendiri model berpemberat terbuka pada infrastruktur anda sendiri mengelakkan risiko khusus itu, memandangkan tiada data meninggalkan sistem anda.
Bagaimana DeepSeek dibandingkan dengan ChatGPT dan Claude?
DeepSeek jauh lebih murah per token dan, tidak seperti ChatGPT atau Claude, membenarkan anda memuat turun dan menghoskan sendiri model tersebut. OpenAI dan Anthropic menawarkan sokongan perusahaan yang lebih matang, pengendalian data berpangkalan AS, dan pensijilan pematuhan, yang lebih penting bagi industri terkawal berbanding skor penanda aras mentah atau harga.
Untuk apa DeepSeek-R1 digunakan?
R1 ialah model penaakulan yang sesuai untuk masalah berbilang langkah seperti pengekodan, analisis matematik, dan tugas logik kompleks, serupa dengan o1 milik OpenAI atau mod pemikiran lanjutan Claude. Varian sulingannya juga popular untuk menjalankan AI berkeupayaan secara setempat pada perkakasan sederhana, memandangkan ia tidak memerlukan langsung panggilan API luaran.
Ketahui Lebih Lanjut
- Model Bahasa Besar - Teknologi asas di sebalik siri-V DeepSeek dan setiap pembantu sembang utama yang lain
- Model Penaakulan - Kategori teknikal yang menjadi asal R1, dan bagaimana ia dibandingkan dengan o1 milik OpenAI
- Apakah itu Pengkomputeran Masa Ujian? - Teknik pemikiran lanjutan di sebalik keupayaan penaakulan R1
- Mixture of Experts - Seni bina di sebalik kecekapan DeepSeek-V3 dan V4
- Penyulingan Pengetahuan - Bagaimana DeepSeek memampatkan R1 menjadi model yang lebih kecil dan boleh dijalankan secara setempat
- Apakah itu OpenAI? - Makmal di sebalik ChatGPT dan GPT, titik perbandingan paling langsung DeepSeek
- Apakah itu Claude AI? - Keluarga model Anthropic dan alternatif yang tertumpu kepada perusahaan
- Penilaian Vendor AI - Rangka kerja untuk menimbang kos berbanding risiko tadbir urus data sebelum menggunakan model seperti DeepSeek
- Apakah itu AI Berdaulat? - Perdebatan yang lebih luas mengenai model AI yang dibina dan ditadbir di bawah bidang kuasa negara yang berbeza
Sumber Luaran
- DeepSeek-V3 Technical Report (arXiv) - Pendedahan DeepSeek sendiri mengenai pengkomputeran dan kos latihan V3
- CNN: DeepSeek Reveals Training Cost of Its AI Model - Liputan kertas kos latihan R1 $294,000 yang diterbitkan dalam Nature
- CNBC: Nvidia Sheds Almost $600 Billion in Market Cap - Laporan mengenai penjualan besar-besaran saham pada 27 Januari 2025
- Bird & Bird: Italy's Garante Blocks DeepSeek Data Processing - Ringkasan undang-undang mengenai arahan Itali Januari 2025
- Hugging Face: DeepSeek-R1 Model Card - Pemberat model rasmi dan terma lesen MIT
- DeepSeek API Docs: V4 Preview Release - Pengumuman rasmi DeepSeek-V4-Pro dan V4-Flash
- DeepSeek API Docs: Pricing - Harga per-token semasa bagi model DeepSeek yang dihoskan
Sebahagian daripada Koleksi Istilah AI. Terakhir dikemas kini: 2026-07-20

Co-Founder, Rework.com
On this page
- "Detik DeepSeek": Latar Belakang dan Kejutan Januari 2025
- Susunan Model DeepSeek: Daripada V3 kepada R1 kepada V4
- Kisah Kecekapan dan Kos
- Pemberat Terbuka dan Pelesenan
- Menggunakan DeepSeek untuk Perniagaan: Perkara yang Perlu Diketahui Dahulu
- DeepSeek berbanding OpenAI berbanding Claude
- Batasan DeepSeek
- Fakta Utama tentang DeepSeek
- Ketahui Lebih Lanjut
- Sumber Luaran