Jumat, 21 Agustus 2026

Performa AMD Ryzen 5 3400G iGPU dengan DDR4 3200 MHz untuk Llama.cpp


Bulan ini banyak model LLM sangat bagus yang diluncurkan dan ada beberapa model yang free dan bisa dijalankan di komputer rumah. Untuk menjalankan model LLM lokal kita membutuhkan sebuah komputer dengan memory yang cukup besar dan cukup kencang dan mungkin dengan tambahan GPU. 

Kali ini saya akan mencoba mengukur komputer saya dengan prosesor AMD Ryzen 3400G untuk menjalankan beberapa model LLM yang ada. Sehingga bisa menjadi acuan bagi teman-teman yang ingin mengadakan komputer untuk menjalankan model LLM juga. 



1. LLama 2 7B dengan kuantisasi Q4_0


Model pertama yang diuji adalah LLama 2 7B dengan kuantisasi Q4_0 yang paling sering digunakan untuk mengukur kecepatan hardware menjalakan Llama.cpp. Model ini adalah jenis dense dengan total parameter 7 milyar membuatnya termasuk model yang cukup cerdas di zamannya. 

Komputer saya berhasil menjalankan model ini dengan lancar dengan kecepatan token generation di angka 11,02 token/detik. Kecepatan ini cukup nyaman untuk sekedar chating asal jangan mengharapkan komputer untuk membalas pesan dengan secepat kilat.

2. Gemma 4 - 26A4B dengan kuantisasi UD_Q_4_K_XL


Model berikutnya yang diuji adalah Gemma 4 26A4B dengan kuantisasi UD_Q_4_K_XL. Model ini adalah jenis mixture of expert dan memiliki total 26 milyar parameter dengan paramter aktif sebanyak 4 milyar. Model jenis ini memiliki parameter yang sangat banyak tetapi bisa dijalankan dengan ringan pada komputer karena total parameter yang aktif hanya sebagian saja. 

Pengujian di komputer saya menghasilkan kecepatan token generation di 11,09 token/detik. Kecepatan ini lumayan nyaman untuk pemakaian chatting dan masih lumayan bisa digunakan sebagai agen AI meskipun agak lambat.

3. Qwen 3.6 35A3B dengan kutantisasi UD_Q_4_K_XL

 

Model terakhir yang diuji adalah Qwen 3.6 35A3B dengan kuantisasi UD_Q4_K_XL. Model ini adalah salah satu favorit karena memiliki cukup banyak parameter yaitu 35 milyar tetapi cukup ringan untuk dijalankan pada komputer lokal karena parameter aktif hanya 3 milyar saja.

Hasil pengujian di komputer saya mendapatkan kecepatan token generation di 12,41 token/detik. Kecepatan ini lumayan nyaman untuk pemakaian chatting dan masih lumayan bisa digunakan sebagai agen AI meskipun agak lambat.

Kesimpulan

Dari hasil pengujian menunjukkan bahwa iGPU dari AMD Ryzen 3400G bisa menjalankan LLM model dengan kecepatan yang cukup bagus di kelasnya untuk model dengan ukuran kecil maupun model MoE yang cukup besar dengan aktif parameter yang tidak terlalu banyak.

Dengan perkembangan model LLM yang mendukung agentic AI sekarang model lokal juga bisa digunakan untuk menjalankan agen AI. Semoga berikutnya bisa mereview penggunaan model lokal ini sebagai agen AI.

Sekian dulu artikel ini semoga bermanfaat.

Tidak ada komentar:

Performa AMD Ryzen 5 3400G iGPU dengan DDR4 3200 MHz untuk Llama.cpp

Bulan ini banyak model LLM sangat bagus yang diluncurkan dan ada beberapa model yang free dan bisa dijalankan di komputer rumah. Untuk menja...