Cara mengunduh dan menjalankan model pertama Anda dengan Ollama

Pembaruan terakhir: 17/08/2026

  • Ini memungkinkan Anda menjalankan model bahasa yang canggih (LLM) secara lokal, menjamin privasi total dan pengoperasian tanpa koneksi internet.
  • Perangkat lunak ini kompatibel dengan Windows, macOS, dan Linux, dan terutama membutuhkan VRAM yang cukup besar pada GPU untuk performa optimal.
  • Platform ini menawarkan beragam model yang khusus untuk obrolan umum, pemrograman, dan penalaran tingkat lanjut, yang dapat diintegrasikan melalui API atau antarmuka grafis.

Cara mengunduh dan menjalankan model pertama Anda dengan Ollama

Bagaimana cara mengunduh dan menjalankan model pertama Anda dengan Ollama? Bayangkan memiliki otak buatan yang canggih yang terpasang langsung di komputer Anda, tanpa harus membayar biaya berlangganan bulanan atau khawatir tentang perusahaan di California yang membaca rahasia Anda. Jalankan model bahasa lokal Berkat alat-alat yang menghilangkan semua hambatan teknis, hal ini menjadi sangat mudah, memungkinkan kita untuk memulai percakapan yang cerdas hanya dalam hitungan menit.

Di sinilah Ollama berperan, sebuah platform yang pada dasarnya bertindak sebagai Docker untuk kecerdasan buatanKeajaibannya terletak pada pengelolaan seluruh proses yang rumit: mulai dari mengunduh model dan mengoptimalkan memori hingga eksekusi, menawarkan pengalaman yang lancar bagi para programmer maupun mereka yang hanya ingin mencoba AI tanpa merusak apa pun di sepanjang jalan.

Mengapa repot-repot memasang AI secara lokal?

Layar komputer dengan kode pemrograman di Visual Studio Code dan terminal, yang mengilustrasikan instalasi Ollama dan penggunaannya untuk pemrograman.

Alasan utamanya, tidak diragukan lagi, adalah privasi mutlakSaat Anda menggunakan layanan cloud, data Anda dikirim melalui internet; dengan Ollama, informasi tersebut tidak pernah meninggalkan komputer Anda, yang sangat penting jika Anda menangani dokumen rahasia atau data sensitif. Selain itu, Anda tidak perlu khawatir lagi. biaya per token atau biaya bulanan sebesar 20 euro, karena setelah model diunduh, penggunaannya sepenuhnya gratis.

Konten eksklusif - Klik Disini  Hapus Tanda Air dari Foto

Keunggulan lainnya adalah kemampuan untuk bekerja tanpa internetAnda dapat membawa laptop Anda ke pesawat atau ke daerah pedesaan dan tetap memiliki asisten yang mampu memprogram atau menulis teks. Terakhir, fleksibilitasnya total: Anda dapat membuat model khusus Melalui file konfigurasi yang disebut Modelfiles, Anda dapat menyesuaikan kepribadian dan perilaku AI sesuai keinginan Anda.

Perangkat keras: Apa yang Anda butuhkan agar tidak berjalan menggunakan pedal?

Anda tidak membutuhkan superkomputer, tetapi Anda perlu realistis tentang sumber daya Anda. Hambatan utamanya akan selalu... VRAM kartu grafisJika Anda memiliki GPU NVIDIA atau AMD, Ollama akan memanfaatkannya untuk respons instan. Jika Anda hanya memiliki CPU, program ini tetap akan berjalan, tetapi kecepatannya akan menurun drastis, dari menghasilkan puluhan kata per detik menjadi hanya beberapa kata.

  • Model ringan (1-3B): Dengan RAM 8 GB dan VRAM 4 GB, Anda akan memiliki lebih dari cukup. Contoh seperti Gemma 2 2B ideal untuk tugas-tugas sederhana.
  • Model menengah (7-8B): Di sini, standarnya adalah 16 GB RAM dan 8 GB VRAM. Ini adalah wilayah Llama 3.1 8B atau Mistral, yang menawarkan Keseimbangan sempurna antara kualitas dan kecepatan.
  • Model besar (13-70B+): Sekarang kita memasuki wilayah profesional. Untuk model 70B, Anda memerlukan setidaknya 64 GB RAM dan GPU dengan 40 GB VRAM atau lebih.

Bagi mereka yang menggunakan Apple Silicon (M1, M2, M3, M4)Pengalaman ini fantastis berkat memori terpadu, yang memungkinkan GPU mengakses seluruh RAM sistem.

Panduan instalasi langkah demi langkah

Seseorang yang bekerja dengan laptop di kantor modern, menyoroti privasi dan fleksibilitas menjalankan model bahasa lokal.

Menginstal Ollama hampir merupakan proses sekali klik, tergantung pada sistem operasi Anda:

  • Di Windows: Unduh file .exe dari situs web resmi, instal, dan Anda akan melihat ikon Ollama di system tray Anda. Jika Anda ingin ubah jalur tempat model disimpan (karena drive C cepat penuh), Anda perlu membuat variabel lingkungan bernama MODEL OVEN dengan jalur ke folder pilihan Anda.
  • Di macOS: Cukup unduh file .dmg dan seret aplikasi ke folder Aplikasi.
  • Di Linux: Hal ini dilakukan hanya dengan menggunakan satu baris perintah: curl -fsSL https://ollama.com/install.sh | shIni secara otomatis mengkonfigurasi layanan systemd.
Konten eksklusif - Klik Disini  Cara mendaftarkan dll di Windows 10

Untuk memastikan semuanya berjalan dengan baik, buka terminal dan ketik ollama --versionJika menampilkan nomor versi, berarti Anda berhasil masuk.

Langkah pertama Anda dengan model

Untuk menjalankan AI, Anda tidak perlu mengkonfigurasi apa pun yang rumit, cukup gunakan perintahnya. berlari. Misalnya saja jika Anda menulis ollama run llama3.1Sistem akan secara otomatis mengunduh templat dan membuka obrolan interaktif di terminal. Untuk keluar, cukup ketik /bye.

Katalog model yang direkomendasikan

Antarmuka obrolan AI di layar, yang mewakili hasil menjalankan model seperti DeepSeek melalui Ollama dan Open WebUI.

Tidak semua model cocok untuk tujuan yang sama. Tergantung pada tujuan Anda, salah satu atau yang lain akan lebih sesuai:

  • Penggunaan umum: Llama 3.3 70B adalah perangkat andalan untuk penalaran kompleks, sedangkan Llama 3.1 8B merupakan pilihan yang lebih serbaguna untuk penggunaan sehari-hari.
  • Pemrograman: DeepSeek Coder dan Qwen 2.5 Coder adalah alat yang brutal untuk kode pelengkapan otomatis dan kesalahan debugging langsung di editor Anda.
  • Penalaran tingkat lanjut: DeepSeek-R1 adalah pilihan ideal jika Anda membutuhkan AI untuk berpikir langkah demi langkah sebelum merespons, mendekati kemampuan model-model terbaik di pasaran.
  • Multimodalitas: LLaVA sangat cocok jika Anda menginginkan AI. menganalisis gambar dan jelaskan apa yang ada di dalamnya.
Konten eksklusif - Klik Disini  Word mengubah aturan: Simpan otomatis ke cloud secara default

Membawa Ollama ke level selanjutnya: Antarmuka dan API

Jika tampilan terminal terlalu sederhana bagi Anda, Anda dapat menginstal Buka WebUIIni adalah antarmuka web yang mereplikasi pengalaman ChatGPT tetapi terhubung ke Ollama lokal Anda. Pemasangannya mudah menggunakan Docker dan memungkinkan Anda untuk mengelola riwayat, mengunggah PDF untuk mengajukan pertanyaan (RAG), dan beralih model hanya dengan satu klik.

Bagi para pengembang, Ollama menghadirkan sebuah API REST pada port 11434 yang sepenuhnya kompatibel dengan OpenAI. Ini berarti Anda dapat mengintegrasikan AI lokal Anda ke dalam aplikasi Python atau JavaScript apa pun hanya dengan mengubah URL server. Bahkan ada ekstensi seperti Lanjutkan.dev untuk VS Code yang mengubah Ollama menjadi Copilot pribadi Anda.

Tips optimasi dan pemeliharaan

Agar sistem dapat berfungsi dengan baik, disarankan untuk menggunakan... model terkuantisasi (seperti Q4_K_M), yang mengurangi ukuran model dengan kehilangan kualitas minimal. Jika Anda melihat ada bagian yang hilang dalam model, Anda dapat memperluas jendela konteks menggunakan parameter tersebut. --num-ctxSelain itu, selalu memperbarui driver NVIDIA Anda sangat penting untuk memanfaatkan teknologi seperti... Perhatian Cepat, yang mengurangi konsumsi memori.

Ollama telah membuat AI lokal dapat diakses, memungkinkan siapa pun dengan PC yang layak untuk menerapkan segala hal mulai dari asisten pemrograman hingga sistem analisis dokumen pribadi. Berkat arsitektur baris perintahnya yang sederhana, integrasi dengan antarmuka visual seperti Open WebUI, dan kompatibilitas dengan pustaka model sumber terbuka yang luas, kini tidak perlu lagi bergantung pada cloud untuk memanfaatkan kekuatan LLM.