Model open-weight mencapai sekitar sepertiga dari seluruh penggunaan model bahasa besar pada akhir 2025, menurut studi 100 triliun token dari lalu lintas API nyata yang diterbitkan oleh OpenRouter dan Andreessen Horowitz (a16z). Itu adalah sinyal paling jelas sejauh ini bahwa AI open source telah bergeser dari rasa penasaran riset menjadi standar produksi. Hugging Face kini menampung lebih dari 2 juta model publik dan 13 juta pengguna (Hugging Face, State of Open Source Spring 2026), Llama milik Meta melampaui 1.2 miliar unduhan (Meta, 2025), dan Qwen milik Alibaba melampauinya hingga mencapai 700 juta (Xinhua, 2026). Namun 200 model teratas menyumbang 49.6% dari semua unduhan Hugging Face, dan model closed terdepan masih unggul sekitar empat bulan dari model open terbaik (Epoch AI, 2026). Analisis ini mengonsolidasikan data dari Hugging Face, OpenRouter, a16z, Stanford HAI, Epoch AI, McKinsey, GitHub, dan 13 sumber utama lainnya menjadi lebih dari 45 titik data yang terverifikasi.
TL;DR
- Model open-weight mencapai sekitar 33% dari penggunaan model bahasa besar pada akhir 2025, naik dari basis satu digit yang rendah (OpenRouter, State of AI 2025).
- Hugging Face menampung lebih dari 2 juta model publik dan lebih dari 500,000 dataset untuk 13 juta pengguna (Hugging Face, State of Open Source Spring 2026).
- 200 model teratas, 0.01% dari semua model, mendorong 49.6% unduhan; sekitar setengah dari semua model memiliki kurang dari 200 unduhan (Hugging Face, Spring 2026).
- Qwen milik Alibaba melampaui 700 juta unduhan kumulatif Hugging Face dan melampaui Llama pada akhir 2025 (Xinhua / South China Morning Post, 2026).
- Llama milik Meta mencapai 1.2 miliar unduhan pada 29 April 2025, naik dari 650 juta pada Desember 2024 (Meta; TechCrunch, 2025).
- Model open-weight tertinggal dari model closed terdepan sekitar empat bulan, atau 8 poin ECI (Epoch AI, 2026).
- Lebih dari 50% organisasi menggunakan AI open source, naik menjadi 72% di sektor teknologi (McKinsey, 2025).
- Model China mewakili 41% unduhan Hugging Face selama setahun terakhir, dan China melampaui AS dalam unduhan bulanan sepanjang 2025 (Hugging Face, Spring 2026).
- Pasar model AI open source diperkirakan tumbuh dari 19.05 miliar dolar pada 2025 menjadi 23.08 miliar pada 2026 (The Business Research Company, 2026).
- Hanya 15 dari 95 model terkemuka yang dirilis pada 2025 yang disertai kode pelatihan terbuka (Stanford HAI, AI Index 2026).
- Peneliti menemukan sekitar 100 model berbahaya di Hugging Face, sekitar 95% dibangun dengan satu format serialisasi (Dark Reading / JFrog, 2024-2025).
1. Ekosistem AI Open Source dalam Angka
Hugging Face adalah pusat gravitasi untuk model open, dan laporan State of Open Source Spring 2026 miliknya sendiri menunjukkan baik skala maupun konsentrasi perhatian yang ekstrem. 200 model teratas, hanya 0.01% dari katalog, menyumbang 49.6% dari semua unduhan, sementara sekitar setengah dari setiap model di hub memiliki kurang dari 200 unduhan total. Sementara itu Octoverse 2025 milik GitHub menunjukkan sisi pengembang dari gelombang yang sama: lebih dari satu juta repositori publik kini dibangun di atas SDK LLM.
| Metrik | Nilai | Sumber |
|---|---|---|
| Model publik di Hugging Face | 2,000,000+ | Hugging Face, State of Open Source Spring 2026 |
| Dataset publik di Hugging Face | 500,000+ | Hugging Face, Spring 2026 |
| Pengguna / organisasi terdaftar | 13,000,000 / 500,000 | Hugging Face, Spring 2026 |
| Pangsa unduhan dari 200 model teratas (0.01% dari semua) | 49.6% | Hugging Face, Spring 2026 |
| Model dengan kurang dari 200 total unduhan | ~50% | Hugging Face, Spring 2026 |
| Repositori publik GitHub yang menggunakan SDK LLM | 1,100,000+ (693,867 new, +178% YoY) | GitHub, Octoverse 2025 |
| Kontributor bulanan untuk proyek AI generatif | 68,000 (Jan 2024) to 200,000 (Aug 2025) | GitHub, Octoverse 2025 |
Catatan konteks: ukuran rata-rata model yang diunduh tumbuh dari 827 juta parameter pada 2023 menjadi 20.8 miliar pada 2025, tetapi median hanya naik dari 326 juta menjadi 406 juta (Hugging Face, Spring 2026). Model kecil masih melakukan sebagian besar pekerjaan. Untuk lanskap model yang lebih luas, lihat statistik AI generatif kami.
2. Penggunaan Dunia Nyata: Open Weight Mencapai Sepertiga Token
Jumlah model mengukur pasokan; volume token mengukur permintaan. Studi State of AI milik OpenRouter, yang menganalisis 100 triliun token lalu lintas inferensi nyata di lebih dari 300 model bersama a16z, adalah bukti publik terkuat bahwa open weight memenangkan beban kerja nyata. Model open source China tumbuh dari 1.2% volume token mingguan pada akhir 2024 menjadi rata-rata mingguan 13.0%, memuncak mendekati 30% pada beberapa minggu. Segmen open source juga terdiversifikasi: R1 milik DeepSeek pernah menyumbang lebih dari setengah token open, tetapi pada akhir 2025 tidak ada satu model open pun yang memegang lebih dari 25% pangsa open.
| Metrik | Nilai | Sumber |
|---|---|---|
| Pangsa open-weight dari penggunaan model bahasa besar, akhir 2025 | ~33% (one-third) | OpenRouter, State of AI 2025 |
| Pangsa token mingguan open source China | 1.2% (late 2024) to 13.0% avg, ~30% peak | OpenRouter, 2025 |
| Rata-rata pangsa mingguan open source di luar China | 13.7% | OpenRouter, 2025 |
| Token DeepSeek (Nov 2024 to Nov 2025) | 14.37 trillion | OpenRouter, 2025 |
| Token Qwen | 5.59 trillion | OpenRouter, 2025 |
| Token Meta Llama | 3.96 trillion | OpenRouter, 2025 |
| Token Mistral AI | 2.92 trillion | OpenRouter, 2025 |
| Total token / model / penyedia yang dianalisis | 100 trillion / 300+ / 70+ | OpenRouter, 2025 |
Catatan pencilan: model yang berorientasi penalaran kini memproses lebih dari setengah semua token seiring meningkatnya tool-calling, sebuah pergeseran yang dibahas dalam statistik agen AI kami.
3. Kesenjangan Performa Open vs Closed
Kesenjangan antara model open terbaik dan closed terbaik menyempit drastis pada 2024, lalu berhenti menyempit. Epoch AI mengukur keterlambatan ini dengan Epoch Capabilities Index miliknya. Model open-weight tertinggal dari model closed terdepan sekitar empat bulan, atau 8 poin ECI, sepanjang Januari hingga Mei 2026, sedikit lebih lebar dari keterlambatan sekitar tiga bulan yang diukur hingga Oktober 2025. AI Index 2026 milik Stanford HAI menceritakan kisah serupa pada papan peringkat Arena.
| Metrik | Nilai | Sumber |
|---|---|---|
| Keterlambatan open-weight di belakang model closed terdepan | ~4 months / 8 ECI points (90% CI 7-11) | Epoch AI, 2026 |
| Keterlambatan sebelumnya (Jan 2023 to Oct 2025) | ~3 months | Epoch AI, 2025 |
| Keunggulan model closed teratas atas model open teratas (Mar 2026) | 3.3% (up from 0.5% in Aug 2024) | Stanford HAI, AI Index 2026 |
| Model closed di 10 besar Arena | 6 of 10 | Stanford HAI, AI Index 2026 |
| Kesenjangan Chatbot Arena, Jan 2024 to Feb 2025 | 8.04% to 1.70% | Stanford HAI, AI Index 2025 |
| Skala komputasi pelatihan open-weight terdepan | ~4.7x per year | Epoch AI, 2025 |
| Terdepan lokal: model setara LLM teratas 6-12 bulan lalu | Runs on one sub-2,500-dollar GPU | Epoch AI, 2025 |
Catatan konteks: DeepSeek-R1, dirilis Januari 2025, tertinggal dari model closed terbaik saat itu, o3-mini, hanya 2 poin persentase pada benchmark MATH Level 5 (Epoch AI, 2025), rilis yang pertama kali menunjukkan runtuhnya kesenjangan tersebut.
4. Lonjakan Open-Weight China: Qwen dan DeepSeek
Pergeseran paling menentukan pada 2025 bersifat geografis. Model China mewakili 41% unduhan Hugging Face selama setahun terakhir, dan China melampaui AS dalam unduhan bulanan sepanjang 2025 (Hugging Face, Spring 2026). Qwen milik Alibaba menjadi keluarga open dengan unduhan terbanyak, menurut Xinhua dan South China Morning Post, sementara peluncuran aplikasi DeepSeek pada Januari 2025 mencetak rekor unduhan yang dilacak oleh Sensor Tower dan TechCrunch.
| Metrik | Nilai | Sumber |
|---|---|---|
| Pangsa China dalam unduhan bulanan Hugging Face, 2025 | Surpassed the U.S. | Hugging Face, Spring 2026 |
| Pangsa model China dalam unduhan Hugging Face, setahun terakhir | 41% | Hugging Face, Spring 2026 |
| Unduhan kumulatif Hugging Face Qwen (Jan 2026) | 700,000,000+ | Xinhua / South China Morning Post, 2026 |
| Varian Qwen di Hugging Face | 200,000+ | South China Morning Post, 2026 |
| Pangsa turunan model bahasa besar baru yang berbasis Qwen | ~40% | South China Morning Post, 2026 |
| Unduhan aplikasi DeepSeek dalam 19 hari pertama | 23,000,000 (2x ChatGPT) | Sensor Tower, 2025 |
| Peringkat nomor satu DeepSeek di App Store | 156+ countries | TechCrunch, 2025 |
| DeepSeek-R1 vs o3-mini, MATH Level 5 | Lags by 2 points | Epoch AI, 2025 |
Catatan konteks: dalam satu bulan saja, unduhan Qwen melebihi total gabungan delapan keluarga open berikutnya, termasuk Meta, DeepSeek, Mistral, dan Nvidia (South China Morning Post, 2026).
5. Adopsi Perusahaan dan Ekonomi
AI open source kini menjadi strategi perusahaan arus utama, bukan eksperimen pinggiran. McKinsey, bersama Mozilla dan Patrick J. McGovern Foundation, mensurvei lebih dari 700 pemimpin teknologi di 41 negara dalam laporan Open Source Technology in the Age of AI miliknya. Lebih dari separuh organisasi sudah menggunakan AI open source, naik menjadi 72% di sektor teknologi, dan 76% berharap meningkatkan penggunaannya. Survei Enterprise AI milik a16z menunjukkan daya tarik menuju stack multi-model, dan peneliti pasar memperkirakan peluangnya dalam puluhan miliar.
| Metrik | Nilai | Sumber |
|---|---|---|
| Organisasi yang menggunakan AI open source | 50%+ (72% in tech sector) | McKinsey, 2025 |
| Pemimpin yang berharap meningkatkan penggunaan AI open source | 76% | McKinsey, 2025 |
| Melaporkan biaya implementasi lebih rendah dibanding proprietary | 60% (26% average cost improvement) | McKinsey, 2025 |
| Adopsi perusahaan untuk AI dan machine learning open source | 40% (+5 pts vs 2024) | Linux Foundation, 2025 |
| Perusahaan yang menjalankan 5 model atau lebih di produksi | 37% (up from 29%) | a16z, Enterprise AI 2025 |
| Pasar model AI open source, 2025 hingga 2026 | 19.05B to 23.08B dollars (21.1% CAGR) | The Business Research Company, 2026 |
| Seri C Mistral AI (Sep 2025) | ~14B dollars valuation (1.7B euros raised) | Mistral AI; Bloomberg, 2025 |
| Valuasi Hugging Face | 4.5B dollars (2023 Series D); ~7B reported 2025 | TechCrunch, 2023; Sacra, 2025 |
Catatan konteks: perkiraan pasar model AI open source adalah estimasi vendor; perlakukan ini sebagai data terbaru yang tersedia (The Business Research Company, 2026). Untuk perhitungan biaya hilir, lihat rangkuman terkait kami tentang statistik biaya inferensi AI dan, untuk perkakas pengembang, statistik alat coding AI.
6. Tata Kelola, Lisensi, dan Keamanan
Open weight tidak sama dengan open source, dan definisinya penting untuk kepatuhan. Open Source Initiative menerbitkan Open Source AI Definition miliknya pada Oktober 2024, dan hanya sedikit model terkenal yang sepenuhnya memenuhi syarat. Hanya 15 dari 95 model terkemuka yang dirilis pada 2025 yang disertai kode pelatihan terbuka (Stanford HAI, AI Index 2026), bahkan ketika pemerintah bergerak mendorong open weight. Keamanan adalah hal lain yang perlu diawasi: JFrog dan peneliti mendokumentasikan model berbahaya yang mampu mengeksekusi kode di hub publik.
| Metrik | Nilai | Sumber |
|---|---|---|
| Model AI open source yang divalidasi OSI | Pythia, OLMo, Amber, CrystalCoder, T5 | OSI / TechCrunch, 2024 |
| Model terkemuka 2025 yang dirilis tanpa kode pelatihan terbuka | 80 of 95 | Stanford HAI, AI Index 2026 |
| Pangsa industri dari model terkemuka, 2025 | 91.6% | Stanford HAI, AI Index 2026 |
| Model berbahaya yang ditemukan di Hugging Face | ~100 (~95% one serialization format) | Dark Reading / JFrog, 2024-2025 |
| Model yang ditandai JFrog sebagai zero-day berbahaya | 25 | JFrog, 2025 |
| AI dan machine learning dianggap paling diuntungkan dari open source | 38% | Linux Foundation, 2025 |
| Sikap AI Action Plan AS terhadap open weight | Pro-open-weight (Jul 23, 2025) | White House, 2025 |
| Berlakunya aturan AI tujuan umum EU AI Act | Aug 2, 2025 | European Commission, 2025 |
Catatan konteks: aksesibilitas open-weight yang sama yang membantu startup juga menurunkan hambatan bagi penyalahgunaan media sintetis, sebuah risiko yang dikuantifikasi dalam statistik deepfake kami.
Ringkasan: AI Open Source dalam Angka
| Metrik | Nilai | Sumber |
|---|---|---|
| Pangsa open-weight dari penggunaan model bahasa besar, akhir 2025 | ~33% | OpenRouter, State of AI 2025 |
| Model publik di Hugging Face | 2,000,000+ | Hugging Face, Spring 2026 |
| Pangsa unduhan dari 200 model teratas | 49.6% | Hugging Face, Spring 2026 |
| Perusahaan yang menjalankan 5 model atau lebih di produksi | 37% | a16z, Enterprise AI 2025 |
| Unduhan kumulatif Hugging Face Qwen | 700,000,000+ | Xinhua / South China Morning Post, 2026 |
| Unduhan Meta Llama (Apr 2025) | 1,200,000,000 | Meta; TechCrunch, 2025 |
| DeepSeek-R1 vs o3-mini, MATH Level 5 | Lags by 2 points | Epoch AI, 2025 |
| Unduhan aplikasi DeepSeek dalam 19 hari pertama | 23,000,000 | Sensor Tower, 2025 |
| AI dan machine learning dianggap paling diuntungkan dari open source | 38% | Linux Foundation, 2025 |
| Keterlambatan open-weight di belakang model closed terdepan | ~4 months / 8 ECI points | Epoch AI, 2026 |
| Keunggulan model closed teratas atas model open teratas (Mar 2026) | 3.3% | Stanford HAI, AI Index 2026 |
| Organisasi yang menggunakan AI open source | 50%+ | McKinsey, 2025 |
| Pemimpin yang berharap meningkatkan penggunaan AI open source | 76% | McKinsey, 2025 |
| Biaya implementasi lebih rendah dibanding proprietary | 60% (26% avg improvement) | McKinsey, 2025 |
| Adopsi perusahaan AI/ML open source | 40% | Linux Foundation, 2025 |
| Pasar model AI open source (2026) | 23.08B dollars | The Business Research Company, 2026 |
| Valuasi Mistral AI (Sep 2025) | ~14B dollars | Mistral AI; Bloomberg, 2025 |
| Model terkemuka 2025 tanpa kode pelatihan terbuka | 80 of 95 | Stanford HAI, AI Index 2026 |
| Model berbahaya yang ditemukan di Hugging Face | ~100 | Dark Reading / JFrog, 2024-2025 |
| Repositori publik GitHub yang menggunakan SDK LLM | 1,100,000+ | GitHub, Octoverse 2025 |
Metodologi dan Sumber
Data dikumpulkan dengan menelusuri setiap angka ke penerbit utamanya, memprioritaskan laporan asli, survei, dan pengungkapan dari 2025 dan 2026 dibandingkan agregasi sekunder, serta menandai estimasi pasar vendor dan angka yang lebih lama di mana pun muncul.
Sumber yang dikutip:
- Hugging Face, State of Open Source, Spring 2026
- OpenRouter dan Andreessen Horowitz (a16z), State of AI: An Empirical 100 Trillion Token Study, 2025
- Andreessen Horowitz (a16z), How 100 Enterprise CIOs Are Building and Buying Gen AI, 2025
- Epoch AI, Open-Weight Models data insights, 2025-2026
- Stanford HAI, AI Index Report 2026 dan AI Index Report 2025
- McKinsey bersama Mozilla dan Patrick J. McGovern Foundation, Open Source Technology in the Age of AI, 2025
- GitHub, Octoverse 2025
- Xinhua dan South China Morning Post, Qwen downloads reporting, 2026
- Sensor Tower dan TechCrunch, DeepSeek app data, 2025
- Meta, Celebrating 1 Billion Downloads of Llama, 2025, dan TechCrunch, LlamaCon 1.2 billion figure, 2025
- Linux Foundation, The State of Global Open Source 2025
- Open Source Initiative, Open Source AI Definition 1.0, 2024
- JFrog dan Dark Reading, malicious model research, 2024-2025
- The White House, Winning the Race: America’s AI Action Plan, 2025
- European Commission, EU AI Act general-purpose AI guidelines, 2025
- The Business Research Company / Research and Markets, Open-Source AI Model Market Report 2026
- Mistral AI dan Bloomberg, Series C funding reporting, 2025; Sacra, Hugging Face valuation estimate, 2025; TechCrunch, Hugging Face Series D, 2023
Data watch: beberapa sumber yang dikutip terbit dengan jadwal tetap. GitHub Octoverse dan AI Index milik Stanford HAI terbit tahunan, dengan edisi berikutnya diperkirakan terbit masing-masing pada akhir 2026 dan awal 2027; studi State of AI dan open source McKinsey serta survei State of Global Open Source milik Linux Foundation berjalan tahunan; State of Open Source milik Hugging Face terbit kurang lebih dua kali setahun, dengan edisi Fall 2026 kemungkinan besar akan terbit; dan Epoch AI memperbarui pelacakan open-vs-closed miliknya secara berkelanjutan.
Terakhir diperbarui: July 10, 2026.
Kami meninjau dan memperbarui halaman ini setiap triwulan seiring dipublikasikannya data baru.