Token itu "Bensin"-nya Claude
Setiap pesan yang kamu kirim dan terima menghabiskan token. Makin panjang conversation, makin banyak token yang dikonsumsi — karena Claude membaca semua riwayat chat setiap kali merespons.
Pilih Device yang Tepat
Device dan mode akses yang berbeda punya dampak signifikan terhadap konsumsi token dan kenyamanan kerja. Ini panduan lengkapnya.
| Device & Mode | Chat Biasa | Generate Kode | Long Session | Rekomendasi |
|---|---|---|---|---|
💻 Desktop Browser |
✅ Hemat | ✅ Ideal | ✅ Aman | Selalu pakai ini |
🖥️ Desktop App |
✅ Hemat | ✅ Bagus | ✅ Aman | Alternatif browser |
📟 Tablet Browser |
✅ Hemat | ✅ Bagus | ✅ Aman | Rekomendasi ke-2 |
📟 Tablet App |
✅ Oke | ⚠️ Hati-hati | ⚠️ Monitor | Untuk chat ringan |
📱 HP Browser |
✅ Oke | ⚠️ Lumayan | ❌ Berisiko | Chat saja |
📱 HP App Claude |
⚠️ Oke | ❌ Boros | ❌ Hindari | Darurat saja |
Pilih Model yang Tepat
Selain device, pilihan model juga menentukan seberapa cepat kuota Pro habis. Model lebih pintar = lebih boros kuota. Ini panduan singkatnya.
| Tier | Versi Current | Versi Sebelumnya (Legacy) |
|---|---|---|
⚡ Haiku |
4.5 | — |
📝 Sonnet |
Sonnet 5 | 4.6, 4.5, dst |
🎼 Opus |
Opus 5 | 4.8, 4.7, 4.6, dst |
📖 Fable / Mythos |
Fable 5 | — |
Catatan: ganti model di tengah chat yang sama menghemat sisi "harga per turn" — tapi tidak mereset context. Riwayat chat tetap ikut terkirim. Yang benar-benar membuang context lama hanya membuka chat baru (lihat section New Chat).
Prompt yang Efisien
Cara kamu nulis prompt sangat mempengaruhi kualitas response dan jumlah token yang dipakai. Ini yang perlu diperhatikan.
- Spesifik dan clear dari awal — sebutkan context, tujuan, dan output yang diinginkan
- Samakan persepsi sebelum generate — konfirmasi dulu sebelum minta kode panjang
- Satu task per chat untuk task besar
- Sebutkan tech stack, bahasa, dan constraints di awal
- Minta revisi spesifik, bukan "perbaiki semua"
- Pakai kata "jangan generate dulu" kalau masih diskusi
- Prompt ambigu lalu minta revisi berkali-kali — boros token
- Paste kode panjang bolak-balik di chat yang sama
- Minta generate kode besar tanpa konfirmasi struktur dulu
- 1 sesi untuk banyak project berbeda
- Minta "buatkan semua sekaligus" tanpa checkpoint
- Lanjut di sesi panjang yang sudah 70%+ token terpakai
| Case 1 — Generate 3× | Input | Output |
|---|---|---|
| Turn 1 | ~500 | ~3.000 |
| Turn 2 (revisi) | ~3.600 | ~3.000 |
| Turn 3 (revisi lagi) | ~6.700 | ~3.000 |
| Total | ~10.800 | ~9.000 |
| Case 2 — Tanya-Jawab, 1× Generate | Input | Output |
|---|---|---|
| Turn 1 (tanya) | ~500 | ~200 |
| Turn 2 (jawab) | ~800 | ~200 |
| Turn 3 (generate) | ~1.200 | ~3.000 |
| Total | ~2.500 | ~3.400 |
Kapan Mulai Chat Baru?
Ini salah satu cara paling efektif hemat token — tahu kapan harus mulai fresh conversation.
Format Spec Handoff — Pindah Chat
Bawa kondisi akhir, bukan perjalanan menuju ke sana. Yang perlu dibawa ke chat baru cuma 4 hal ini — bukan riwayat debat approach atau error yang sudah selesai:
KONTEKS PROJECT: [nama project — 1 baris tujuan]
KEPUTUSAN YANG SUDAH DIKUNCI:
- Data disimpan di Sheet "Data", kolom A-F (Tanggal, Nama, Kategori, ...)
- Auth pakai pola session token di Sheet "Users"
- [keputusan lain yang final]
SCOPE CHAT INI: [fitur/modul spesifik yang mau dikerjakan sekarang]
GENERATE: belum — bahas dulu sampai jelas
Context Permanen Lewat Projects
Kalau kerjaan kamu punya pola berulang (GAS + Sheet + web app, seperti kebanyakan project di Anabhi Dev), fitur Projects di Claude bikin strategi "sering buka chat baru" jadi benar-benar hemat — bukan cuma mindahin beban ke tempat lain.
Catatan Penting
Sebelum kamu share atau terapkan tips ini, ada beberapa hal yang perlu dipahami.
Versi dan nama model berubah cepat — panduan ini terakhir diupdate per 10 Agustus 2026. Model yang disebut "current" di sini (misalnya Sonnet 5, Opus 5, Fable 5) bisa saja sudah digantikan versi lebih baru saat kamu membaca ini. AI berkembang dalam hitungan minggu, bukan tahun — selalu cek menu model terbaru langsung di Claude atau docs.anthropic.com kalau ada keraguan.
Meskipun fokus di Claude, prinsip-prinsip efisiensi ini secara umum berlaku juga untuk AI tools lain seperti ChatGPT, Gemini, dan lainnya — karena konsep context window dan token pada dasarnya serupa.
Panduan ini akan terus diupdate seiring perubahan platform dan fitur Claude. Untuk informasi resmi, selalu cek docs.anthropic.com.
Claude punya knowledge cutoff — pengetahuan bawaannya "beku" di tanggal tertentu saat training. Untuk info yang berubah-ubah (versi software terbaru, rilis produk baru, berita), Claude perlu diminta search dulu supaya jawabannya update — bukan otomatis tahu semuanya secara real-time.