Skip to content

emka.web.id

menulis pengetahuan – merekam peradaban

Menu
  • Home
  • Tutorial
  • Search
Menu

Kabar Terbaru Model K2 Horizon Dirilis: MoVA 36B EXL3 Buat Kalian yang Punya GPU Beragam

Posted on September 24, 2026

Ada kabar seru banget buat kalian yang hobi mainan AI lokal di komputer sendiri. Sekarang model K2-Horizon-MoVA-36B-A4B udah bisa kalian pake secara lokal, dan ini bukan sembarang model. Mereka ngerilis enam versi EXL3 yang bisa kalian pilih sesuai sama spek GPU yang kalian punya, mulai dari yang cuma punya 8 GB sampe yang sultan punya 96 GB. Rasanya kayak dapet kemudahan banget karena nggak semua orang punya hardware dewa, kan?

Model ini emang menarik banget karena dia pake sistem Mixture-of-Experts (MoE). Jadi, walaupun dia nyimpen 36 miliar parameter, tapi pas lagi kerja buat ngeproses token, dia cuma aktifin sekitar 4 miliar parameter aja. Ini ngebikin dia jadi lebih efisien. Mereka juga gabungin Mixture-of-Values attention sama native context sampe 512K. Yang bikin makin keren, mereka bener-bener transparan karena ngebuka semua weights, data training, sampe log-lognya. Jadi kita nggak cuma dapet barang jadi, tapi bisa ngerti gimana dia dibikin.

Kalo kita bandingin sama Qwen3.6-35B-A3B, model K2 Horizon ini kayaknya lebih unggul di banyak hal. Dari data yang dipublish, dia menang di 6 dari 9 poin perbandingan, kayak pas lagi pake tool agentic, Terminal-Bench, SciCode, sampe urusan biar nggak gampang halusinasi. Jadi buat kalian yang butuh AI yang lebih pinter dan nggak asal ngomong, model ini emang layak banget buat dicoba.

Nah, sekarang masalahnya adalah gimana cara kalian milih versi yang pas buat GPU kalian. Kami ngeliat ada beberapa pilihan “tangga” kualitas yang udah disediain. Kalo kalian punya GPU dengan VRAM 48 GB ke atas, mending ambil yang 8.00 bpw. Ukurannya sekitar 38.07 GB dan akurasinya (top-1 agreement) sampe 96.43%. Ini kualitas yang paling deket sama model aslinya. Tapi kalo kalian pengen punya sisa memori lebih buat context atau KV cache yang lebih gede, kalian bisa pake yang 6.50 bpw yang ukurannya 31.34 GB.

Buat kalian yang GPU-nya menengah, kayak yang punya 32 GB, bisa pake yang 5.00 bpw (24.56 GB). Terus kalo kalian cuma punya 24 GB, ada versi 4.00 bpw yang ukurannya 20.05 GB. Buat yang speknya agak terbatas, kayak 16 GB, kalian masih bisa manfaatin versi 2.50 bpw yang cuma 13.27 GB. Bahkan, buat yang cuma punya 8 GB, mereka tetep bisa nyoba pake 2.00 bpw dengan sistem expert offload, meskipun ukurannya jadi 11.01 GB.

Kenapa sih mending pake EXL3? Karena tujuannya emang buat nyari kualitas model paling maksimal di setiap GB-nya. Yang perlu kalian tau, ini bukan kuantisasi biasa yang asal potong bit. Mereka pake workflow SAGE mixed-precision. Jadi, mereka nggak kasih presisi yang sama rata ke seluruh bagian model. Mereka nyesuain alokasi presisinya di tiap bagian model, tapi tetep ngejaga output head-nya di 6-bit. Ini ngebikin hasilnya lebih pinter dibanding kuantisasi standar yang biasanya cuma ngasih angka bitrate sembarangan.

Tiap paket yang mereka rilis udah dites lewat 10.240 posisi token buat dibandingin sama model BF16 aslinya. Top-1 agreement itu artinya model yang udah dikecilin ini milih token selanjutnya yang sama persis kayak model aslinya. Kalo kita liat, model BF16 yang asli itu akurasinya 97.71%, dan versi 8-bit EXL3 ini udah nyampe 96.43%. Itu udah deket banget sama batas maksimal yang bisa dicapai, padahal ukurannya udah dipangkas jadi cuma 38 GB. Gila sih, hemat banget kan?

Kedepannya, mereka lagi ngerjain banyak hal lagi, kayak benchmark buat RTX PRO 6000, ngukur kecepatan decode sama prefill, sampe perbaikan kernel buat MoVA plus MoE. Jadi, buat kalian yang pengen tau seberapa kenceng model ini pas jalan, tungguin aja update selanjutnya. Intinya, kalo kalian pengen ngerasain AI kelas atas di mesin sendiri, kalian harus mulai ngikutin perkembangan model K2 Horizon ini.

Terbaru

  • Kabar Terbaru Antigravity SDK: Sekarang Bisa Pakai Model Lokal Kayak Gemma 4 26B Tanpa Perlu Internet
  • Kabar Terbaru Model K2 Horizon Dirilis: MoVA 36B EXL3 Buat Kalian yang Punya GPU Beragam
  • Ini Alasan Kenapa Kalian Harus Cek Masa Dukungan HP Android Kalian Sekarang Juga
  • Cara Cek Followers Baru Asli atau Bot Tanpa Harus Ngitung Satu-Satu
  • Claude Opus 5.5 Baru Rilis, Bikin AI Kalian Jadi Jauh Lebih Powerfull!
  • Update Kondisi Market Bitcoin BTC/USDT Per 23 September 2026, Beli atau Jual Nih?
  • Paham Semua Keluarga Model AI Gemma 4
  • Rumor Laptop Android Ternyata Bener, Ini Daftar 4 Laptop Android dari Google!
  • LCOS Lagi Naik Daun: OS Buatan Lunduke Tembus Peringkat 12 DistroWatch dan Punya Kernel Sendiri
  • Cara Pindah Data Android ke iPhone Tanpa Reset iPhone
  • Valve: Steam Deck 2 Tetap di Develop, Meski RAM Naik Harga Gila-gilaan
  • Apa itu Dumpling? dari Sejarah Sampai Tren Saat ini
  • Jadwal Event Cosplay dan Pop Culture Oktober 2026 yang Wajib Kalian Pantau
  • Cara Ganti Nama Facebook di Android, iPhone, Laptop, dan Facebook Lite Terbaru
  • Apa saja yang baru di WordPress 7.1.1?
  • Pilih Mana: XAMPP, Laragon, atau Herd Buat Belajar PHP?
  • Kenapa Views Reels Kalian Tiba-tiba Anjlok? Ini Penyebab dan Cara Ngatasinya
  • Android Bench versi 2.0 Dirilis, Apa saja Fitur Barunya?
  • MagicOS 11 dari Honor Sudah Dirilis Nih, Ini Cara Cek Smartphonemu Dapet Update Atau Nggak
  • Samsung Galaxy Z Fold 8 Jadi Makin Populer Karena iPhone Duo dirilis :)
  • Update Roku Terbaru: Redesain Tampilan & Tambah Apps dan Subscription Bundle
  • Baru! Android Auto Kasih Update ‘Custom Driving Avatar’ di Google Maps
  • Inilah Alasan Kenapa Suno Batasi Download, Mau Pindah Platform atau Terus Langganan?
  • Mengenal Apa itu Ansible
  • Cara Memilih Paket Diamond Mobile Legends Sesuai Kebutuhan dan Budget
  • Laptop Bisnis dengan Fitur Perlindungan BIOS Terbaik dari Ancaman Siber
  • Kenapa Amerika Melarang Produk Robot Vacuum Cleaner & Produk Robot Lain?
  • Rayap sebagai Tanda Ada Masalah Kelembapan di Bangunan
  • Beli HP Bekas Flagship Oppo? Ini 3 Rekomendasi Terbaik yang Masih Gahar di 2026
  • Cuma 1 Jutaan! Ini 4 Rekomendasi HP POCO yang Performa Tetap Gila di 2026
  • Finally, wolfSSL adds post-quantum algorithms!
  • How to Run Gemma Embedding Models Using Docker
  • Deploy Nginx Rootful Container with Podman
  • How to Sandboxing Browser on Linux Desktop with Flatpak
  • How to Hardening Journald on Linux Server (Fedora/AlmaLinux)
  • The Rise and Fall of the Coding Holy Grail: Is Stack Overflow Just AI Fuel Now?
  • Zyphra is The Pioneer, Why Everyone is Suddenly Obsessed with AMD and Not Just Nvidia Anymore
  • Stop Trusting Your Prompts to Save Your Business Data
  • How to Automate Your Entire SEO Strategy Using a Swarm of 100 Free AI Agents Working in Parallel
  • How to create professional presentations easily using NotebookLM’s AI power for school projects and beyond
  • Zarima Mirafsur Masih Hidup? Mengenang Sosok Mantan Aktris yang Pernah Viral karena Kasus Narkoba
  • Mengenal Ferry Juan, Pengacara Senior yang Kisah Masa Lalunya dengan Zarima Kembali Jadi Perbincangan Warga
  • Profil Brigjen Pol Hengki Haryadi, Kapolda Papua Barat Daya Anyar: Alumni Akpol 1996 dan Mantan Paskibraka Nasional
  • Bobotoh penasaran, siapa sih pemain baru Persib yang bakal masuk sebelum bursa transfer ditutup?
  • Waspada salah download, bedanya FF MAX, Advance Server, sama FF Kipas yang lagi rame soal Naruto Shippuden

©2026 emka.web.id | Design: Newspaperly WordPress Theme