#Token, bukan kata
LLM memecah teks jadi potongan kecil bernama token, memprosesnya, lalu memprediksi token berikutnya.
#Context window
Model punya "ingatan kerja" terbatas — jumlah token yang bisa dibaca sekaligus. Percakapan yang sangat panjang bisa membuat bagian awal seperti "terlupa".
#Temperature (suhu)
Parameter yang mengatur kreativitas jawaban:
- rendah → aman & konsisten
- tinggi → lebih variatif, tapi lebih berisiko ngawur