Google DeepMind memperkenalkan Gemma 4 12B sebagai anggota terbaru dari keluarga model Gemma. Model ini dirancang dengan pendekatan unified atau terpadu, yang menggabungkan kemampuan memahami berbagai modalitas dalam satu arsitektur tunggal.
Ciri utama Gemma 4 12B adalah desain encoder-free. Berbeda dari model multimodal konvensional yang umumnya menggunakan encoder terpisah untuk memproses teks dan citra, model ini menangani seluruh modalitas secara langsung dalam satu jaringan terpadu. Pendekatan tersebut menyederhanakan alur pemrosesan serta menjaga koherensi representasi antar modalitas.
Informasi lebih lanjut mengenai model, termasuk detail ketersediaan, bobot, dan panduan integrasi, tersedia melalui blog resmi serta dokumentasi Google DeepMind.