Sabtu, 15 Agustus 2026 WIB
BREAKING
TEKNOLOGI

Deepseek Luncurkan Kerangka Kerja Dspark Kecepatan Teks Terdongkrak 85

DeepSeek Luncurkan Kerangka Kerja DSpark, Kecepatan Teks Terdongkra…
Kerangka kerja DSpark dari DeepSeek diklaim memangkas waktu generasi teks AI hingga 60% sampai 85% tanpa mengubah arsitektur dasar model. (Ilustrasi: AI)

JAKARTA — Kerangka kerja DSpark dari DeepSeek diklaim memangkas waktu generasi teks AI hingga 60% sampai 85% tanpa mengubah arsitektur dasar model. Rilis open source ini dibuka bersama model DeepSeek-V4-Pro-DSpark, DeepSeek-V4-Flash-DSpark, dan toolchain pelatihan DeepSpec di GitHub, seperti dilaporkan Bisnis.com.

Angka itu penting. Bukan cuma untuk laboratorium AI, tapi juga untuk perusahaan yang ingin modelnya lebih cepat melayani jutaan permintaan tanpa menambah beban komputasi secara brutal.

DSpark dan cara kerja speculative decoding

DSpark pada dasarnya bekerja seperti asisten pengetik cepat. Model kecil menyusun draf kalimat lebih dulu. Setelah itu, model utama yang lebih besar dan lebih cerdas memeriksa draf tersebut sekaligus, atau batch verification.

Skema itu dikenal sebagai speculative decoding. Tujuannya sederhana: menekan latensi, alias waktu tunggu respons, tanpa mengorbankan kualitas keluaran. Model target tidak perlu menulis dari nol setiap token. Ia hanya menguji apakah draf yang dibuat model ringan layak diterima.

Bagi pengguna, efeknya terasa di layar. Jawaban muncul lebih cepat. Untuk penyedia layanan, server tidak bekerja terlalu lama untuk pekerjaan yang sama. Hemat waktu. Hemat biaya.

Masalahnya, metode draf paralel yang lama sering bermasalah di token akhir. Tingkat penerimaan turun karena dependensi token hilang. Di titik itu, model bisa saja cepat di awal, lalu tersendat di ujung. DSpark mencoba menutup celah itu.

Dua inovasi yang dipakai DeepSeek

DeepSeek menyebut DSpark membawa dua pembaruan utama. Pertama, arsitektur semi-autoregressive yang menggabungkan backbone paralel dengan modul serial ringan. Kombinasi ini dipakai untuk membangun dependensi token di dalam blok, sehingga draf yang disusun tidak gampang “jatuh” di bagian akhir.

Kedua, ada confidence-scheduled verification. Mekanisme ini menyesuaikan panjang verifikasi berdasarkan tingkat kepercayaan awal dan karakteristik throughput mesin. Jadi, sistem tidak memeriksa semua permintaan dengan pola yang sama. Ia membaca sinyal lebih dulu, lalu memilih langkah verifikasi yang lebih pas.

Kalau disederhanakan, DSpark tidak hanya mempercepat. Ia juga mencoba lebih cerdas dalam membagi kerja antara model kecil dan model besar. Inilah yang membuat pendekatan ini terasa menarik bagi penyedia AI berskala besar.

Halaman:123Semua Halaman

(PE)

📲
Ikuti JournalArta News di Telegram

Dapatkan berita terbaru Bangka Belitung & nasional langsung di Telegram Anda. Gratis, no spam.

💬 Follow @journalartanews →
Bagikan: Facebook Twitter Telegram

Artikel Untuk Anda

TRENDING Kode Redeem FC Mobile Terbaru Hari Ini 15 Agustus 2026: Klaim Pack & Coins Gratis