Apa itu Large Language Model (LLM)?
Large Language Model, atau LLM, adalah model AI yang mempelajari pola dalam bahasa dari data berskala besar. Ketika Anda menulis pertanyaan di chatbot, model mengolah masukan sebagai token dan menghasilkan respons sedikit demi sedikit berdasarkan konteks yang tersedia. LLM dapat membantu menjelaskan, menulis, meringkas, menerjemahkan, menganalisis, dan membuat kode. Namun, LLM bukan mesin pencari atau basis data yang otomatis mengetahui fakta terbaru. Jawaban penting tetap perlu diperiksa, terutama jika menyangkut angka, aturan, kesehatan, hukum, atau keputusan kerja.
Saat Anda meminta chatbot merangkum notulen rapat, LLM memproses isi notulen dan instruksi Anda, lalu menyusun ringkasan. Hasilnya akan lebih berguna bila Anda menyebutkan tujuan, audiens, dan format yang diinginkan, misalnya: “buat tiga keputusan utama dan daftar tindak lanjut.”
Cara kerja sederhana
Secara sederhana, LLM membaca masukan sebagai potongan kecil yang disebut token. Model kemudian memperkirakan token berikutnya yang paling sesuai dengan pola bahasa dan konteks percakapan. Proses ini berulang sampai jawaban terbentuk. Aplikasi seperti ChatGPT atau Gemini dapat menambahkan komponen lain di sekeliling LLM, misalnya pencarian web, unggah file, memori, atau tool. Karena itu, produk chatbot tidak sama persis dengan satu model LLM.
Kenapa Anda perlu memahaminya?
Memahami LLM membantu Anda memakai chatbot dengan lebih realistis. Anda akan tahu mengapa konteks dan instruksi yang jelas membuat hasil lebih baik, mengapa dokumen panjang dapat dibatasi oleh context window, dan mengapa jawaban yang terdengar yakin tetap perlu diverifikasi.
Kesalahpahaman yang umum
LLM bukan nama aplikasi tertentu. ChatGPT, Gemini, dan Claude adalah produk atau layanan yang dapat memakai satu atau beberapa model AI. LLM juga tidak sama dengan chatbot: chatbot adalah pengalaman percakapannya, sedangkan LLM adalah salah satu teknologi yang dapat menjalankannya. Model multimodal dapat memahami lebih dari teks, misalnya gambar atau audio. Banyak model modern memiliki kemampuan multimodal, tetapi istilah LLM tetap terutama merujuk pada kemampuan bahasa.
Catatan penting sebelum menggunakannya
LLM dapat menghasilkan informasi yang salah atau tidak didukung sumber, sering disebut hallucination. Model juga tidak otomatis mengetahui informasi terbaru, tidak selalu memahami maksud yang samar, dan bisa kehilangan detail bila konteks terlalu panjang. Jangan memasukkan data rahasia tanpa memahami kebijakan layanan yang digunakan.