Teknologi

Alibaba Luncurkan Qwen 3.8 Flash Next, Model AI Hemat Biaya dengan “Kamus” 51 Miliar Parameter

Avatar of Sulsel Times
0
×

Alibaba Luncurkan Qwen 3.8 Flash Next, Model AI Hemat Biaya dengan “Kamus” 51 Miliar Parameter

Sebarkan artikel ini
Alibaba Luncurkan Qwen 3.8 Flash Next, Model AI Hemat Biaya dengan "Kamus" 51 Miliar Parameter
WhatsApp Logo
Sulsel Times Hadir di WhatsApp Channel
Follow

Sulseltimes.com, Hangzhou, Jumat, 28/08/2026 — Alibaba meluncurkan model kecerdasan buatan terbaru Qwen 3.8 Flash Next yang menawarkan biaya inferensi sembilan kali lebih rendah dibanding pendahulunya sambil mempertahankan performa coding dan produktivitas tinggi.

Ringkasnya…
  • Alibaba luncurkan Qwen 3.8 Flash Next
  • 125 miliar parameter total, 6 miliar aktif per token
  • Arsitektur Mixture-of-Experts dengan lapisan N-gram 51 miliar parameter
  • Harga $0,16 per 1 juta token input
  • Tersedia open weight di Hugging Face dan ModelScope
Disclaimer: Ringkasan dibuat secara otomatis.

Model ini dikembangkan untuk kebutuhan perusahaan yang mencari solusi AI hemat biaya di tengah persaingan harga ketat antara penyedia model China dan Amerika Serikat.

Scroll Kebawah
Advertisement

Qwen 3.8 Flash Next mengadopsi arsitektur Mixture-of-Experts (MoE) yang menjadi pratinjau untuk Qwen 4. Model memiliki 125 miliar parameter total, namun hanya sekitar 6 miliar parameter yang aktif memproses setiap token.

Arsitektur & Efisiensi

Keunikan arsitekturnya terletak pada lapisan N-gram embedding berukuran 51 miliar parameter. Lapisan ini berfungsi seperti kamus yang menyimpan kelompok kata umum sebagai entri tersendiri dan dapat diletakkan di RAM sistem tanpa membebani GPU penuh.

Model secara bawaan mendukung konteks hingga 262.144 token dan dapat diperluas hingga 1 juta token menggunakan teknik YaRN.

Desain sparse activation memungkinkan tekanan biaya komputasi berkurang signifikan. Menurut analis Gartner Arun Chandrasekaran, efisiensi inferensi inilah yang memungkinkan harga yang jauh lebih murah dibanding model padat seukuran serupa, Jumat, 28/08/2026.

Alibaba mengklaim biaya pelatihan dan inferensi model ini sembilan kali lebih rendah dibanding Qwen 3.7-Plus. Model ini juga mendukung interaksi dengan API kompleks, kalkulator, dan database eksternal melalui perintah teks maupun visual.

Performa & Benchmark

Dalam pengujian internal, Qwen 3.8 Flash Next mencatat skor 58,7 pada DeepSWE dan 62,5 pada SWE-bench Pro untuk kemampuan coding. Pada produktivitas perkantoran, model ini mencapai 73,9 di CoWorkBench, mengungguli DeepSeek-V4-Flash yang mendapat 45,1.

Di benchmark JobBench untuk alur kerja profesional, model ini mencetak 55,7, hampir dua kali lipat Qwen 3.7-Plus yang berada di 27,6. Alibaba juga menyatakan model ini unggul pada sebagian besar pengujian terhadap DeepSeek-V4-Flash dan Claude Opus 4.

Namun, skor benchmark tidak selalu mencerminkan performa penggunaan sehari-hari.

Harga & Ketersediaan

Alibaba mematok harga Qwen 3.8 Flash Next sebesar 0,16 dolar AS (sekitar Rp 2.838) per 1 juta token input dan 0,47 dolar AS (sekitar Rp 8.337) per 1 juta token output. Harga ini jauh lebih terjangkau dibanding Qwen 3.8 Max yang dibanderol 2 dolar AS untuk input dan 6 dolar AS untuk output per juta token.

Model ini berstatus open weight dan sudah tersedia di platform Hugging Face serta ModelScope, berbeda dengan model frontier proprietary milik OpenAI dan Anthropic.

Peluncuran ini memperkuat posisi Alibaba di pasar AI enterprise dengan menawarkan keseimbangan biaya, efisiensi, dan kemampuan multimodal.

WhatsApp Logo
Ikuti Sulsel Times di
Google News
Follow

Tinggalkan Balasan

Alamat email Anda tidak akan dipublikasikan. Ruas yang wajib ditandai *