Gemma, Model AI Keren dari Google yang Bisa Jalan di HP RAM <2GB!

← Kembali ke Blogs

Gemma, Model AI Keren dari Google yang Bisa Jalan di HP RAM <2GB!

Ditulis olehkukuhtw·
0 unik hari ini 2 unik 7 hari 15 unik 30 hari 190 total unik
Gemma, Model AI Keren dari Google yang Bisa Jalan di HP RAM <2GB!
Iklan

Halo gengs! Kalian pasti udah nggak asing lagi sama nama Google DeepMind yang terkenal banget buat bikin model AI canggih, kan? Nah, kali ini gue mau ngenalin nih keluarga model AI terbaru dari Google yang namanya Gemma. Bukan cuma canggih, tapi juga super ringan dan bisa dipasang di ponsel dengan RAM kurang dari 2 GB. Gokil gak tuh?


Yuk, kita kulik bareng-bareng perjalanan Gemma, tim di baliknya, model bisnisnya, sama teknologi yang dipakai biar kalian makin ngerti kenapa Gemma jadi top banget di dunia AI sekarang ini!


  • Kronologis Berdirinya Gemma

    Jadi, cerita dimulai tanggal 21 Februari 2024. Google resmi merilis Gemma sebagai small language models alias SLM yang open source dan bisa dipake gratis buat developer. Lengkap sama akses ke bobot model, jadi developer bisa langsung utak-atik buat bikin aplikasi seru pakai Google Cloud. Ini diliput sama Reuters, loh!

    Lanjut ke 15 Agustus 2024, Google DeepMind nge-postingan “Gemma explained” yang jelasin arsitektur dasar keluarga Gemma. Katanya nih, Gemma dibangun di atas teknologi yang sama kayak model Gemini, yang udah terkenal powerful.

    Terus, sekitar Maret 2025, muncul Gemma 3 yang udah multimodal, bisa ngolah sampai 128 ribu token, dan support lebih dari 140 bahasa! Modelnya juga variatif mulai dari 1B sampai 27B parameter, dan udah di-quantize biar performanya makin ngebut.

    Yang terbaru, tanggal 20 Mei 2025 di acara Google I/O, Google ngumumin preview Gemma 3n. Nah, ini nih yang keren banget! Model dengan parameter 5B dan 8B ini dioptimalkan khusus supaya bisa jalan mulus di perangkat dengan RAM kurang dari 2 GB. Selain teks, Gemma 3n juga bisa ngolah audio, gambar, dan video. Keren abis buat aplikasi mobile!

  • Profil Tim Pengembang

    Gemma dibuat oleh tim riset Google DeepMind dan AI Studio Google. Ada beberapa nama penting nih yang perlu kalian tahu:

    - Ju-yeong Ji, Senior Technical Consultant di AI Studio, dan Ravin Kumar, Senior Research Engineer di DeepMind, mereka yang nyusun arsitektur inti Gemma yang ringan tapi tangguh.

    - Gus Martins, Product Manager Gemma, yang bener-bener fokus bikin Gemma 3n performa mobile-first dan menjaga privasi data pengguna.

    Jadi, Gemma itu bukan produk dari satu orang aja, tapi hasil kolaborasi handal lintas tim riset, teknik, dan produk di Google dan DeepMind.

  • Model Bisnis Gemma

    Google punya strategi unik nih buat Gemma:

    - Gemma dirilis sebagai open source dan gratis, jadi siapa aja bisa download dan coba buat prototipe atau riset tanpa harus bayar lisensi.

    - Google juga kasih $300 Google Cloud credits buat pengguna baru, plus integrasi langsung ke Google AI Studio, jadi developer makin gampang pakai dan explore.

    - Gemma ini juga jadi pintu masuk buat developer yang mau coba model lebih gede dan komersial, kayak Gemini yang berbayar lewat Google Cloud. Jadi, ini strategi jitu buat narik pengguna dan jaga revenue jangka panjang.

  • Tech Stack dan Arsitektur Gemma 3n

    Di balik keren dan ringannya Gemma 3n, ada teknologi canggih nih:

    - Matryoshka Transformer (MatFormer): Ini konsep model dalam model alias nested sub-model. Jadi cuma sub-model kecil yang aktif waktu inferensi, bikin pemakaian memori dan energi jadi irit banget.

    - Per-Layer Embeddings (PLE) & Quantization: Inovasi ini bikin model parameter 5B dan 8B bisa diperkecil footprint memorinya sampai setara model 2B atau 4B. Makanya, bisa jalan mulus di perangkat dengan RAM di bawah 2 GB.

    - Multimodal & Offline-First: Gemma 3n nggak cuma jago teks, tapi juga bisa proses audio (speech-to-text, terjemahan), gambar, dan video. Support input campuran juga, plus bisa dipakai offline yang pastinya lebih aman buat privasi.

    - Platform & Infrastruktur: Latihan model di Google Cloud pake TPU, kemudian didistribusikan lewat Gemini API dan Google AI Studio. Framework yang dipake adalah JAX dan TensorFlow buat training dan serving.

Kesimpulannya, Gemma itu jadi pondasi AI Google yang ringan, cepat, dan terjangkau buat berbagai perangkat, bahkan yang RAM-nya kecil! Buat kalian yang suka ngulik AI atau pengen coba bikin aplikasi AI keren di ponsel biasa, Gemma 3n ini bener-bener solusi kece banget.


So, tunggu apa lagi? Explore dunia AI dengan Gemma dan rasain gimana teknologi canggih bisa hadir dalam genggaman kalian, tanpa perlu gadget super mahal!

Summary Interaktif

Jawaban:
Gemma 3n dirancang khusus agar dapat berjalan mulus di perangkat dengan RAM kurang dari 2 GB. Model ini mendukung pemrosesan multimodal (teks, audio, gambar, dan video) serta dapat digunakan secara offline, menjadikannya sangat cocok untuk aplikasi mobile ringan dan cepat.

Jawaban:
Gemma dikembangkan oleh kolaborasi tim dari Google DeepMind dan AI Studio Google. Beberapa tokoh penting termasuk Ju-yeong Ji dan Ravin Kumar yang mendesain arsitektur Gemma, serta Gus Martins yang memastikan model mobile-first dan menjaga privasi pengguna.

Jawaban:
Google merilis Gemma sebagai open source dan gratis, menyediakan akses bobot model dan kredit Google Cloud sebesar $300 untuk pengguna baru. Strategi ini menjadi jembatan untuk mengenalkan model komersial berbayar seperti Gemini lewat Google Cloud.

Jawaban:
Gemma 3n menggunakan Matryoshka Transformer (MatFormer), Per-Layer Embeddings (PLE), dan teknik quantization. Kombinasi ini memungkinkan model besar seperti 5B atau 8B parameter berjalan dengan footprint memori seperti model kecil, memungkinkan performa tinggi di perangkat dengan RAM kecil.

Jawaban:
Model Gemma dilatih di Google Cloud menggunakan TPU dan didistribusikan melalui Gemini API dan Google AI Studio. Framework yang digunakan untuk training dan serving termasuk JAX dan TensorFlow.

Jawaban:
Karena fitur offline menjaga privasi pengguna dan memungkinkan penggunaan di area tanpa koneksi internet, sementara kemampuan multimodal membuka peluang untuk membuat aplikasi yang lebih interaktif seperti speech-to-text, pengenalan gambar, dan video AI langsung dari ponsel.

Jawaban:
Gemma dirilis pertama kali pada 21 Februari 2024 sebagai model open source. Pada Agustus 2024, arsitekturnya dijelaskan secara publik. Maret 2025 hadir versi multimodal, dan pada 20 Mei 2025 di Google I/O, diumumkan Gemma 3n yang mendukung perangkat RAM kecil dengan kemampuan multimodal.
Artikel lain dari penulis ini
Iklan