RAG vs Fine-Tuning vs Prompt Saja: Kapan Pakai yang Mana untuk Mengurangi Halusinasi

Ketika AI agent menjawab salah atau “mengarang” informasi yang terdengar meyakinkan (halusinasi), reaksi pertama yang sering muncul adalah “berarti modelnya harus dilatih ulang (fine-tuning)”. Padahal untuk sebagian besar kasus bisnis, fine-tuning bukan cuma opsi paling mahal — sering kali juga bukan solusi yang paling tepat untuk masalahnya. Tiga pendekatan, tiga masalah berbeda yang diselesaikan Prompt … Read more

Rate Limit dan Circuit Breaker: Kenapa AI Agent Produksi Butuh Pengereman Otomatis

AI agent produksi hampir selalu bergantung ke API pihak ketiga — API WhatsApp, API model LLM, API pembayaran, API pengiriman. Semua API ini punya batas kuota (rate limit): berapa banyak permintaan yang boleh dikirim dalam periode waktu tertentu. Masalahnya bukan kalau agent kena limit sesekali — masalahnya adalah apa yang dilakukan agent SETELAH kena limit … Read more

Memilih Model LLM untuk Kebutuhan Bisnis: Trade-off Akurasi, Kecepatan, dan Biaya

Salah satu keputusan teknis yang paling sering diremehkan saat membangun AI agent: model LLM mana yang dipakai. Banyak yang berhenti di pertanyaan “pakai model paling pintar yang ada” — padahal untuk sebagian besar tugas operasional bisnis, itu justru pilihan yang boros dan kadang lebih lambat tanpa manfaat akurasi yang benar-benar terasa. Tiga sumbu trade-off yang … Read more

AI Agent untuk Jasa Titip Beli dan Reseller: Update Status Massal dan Harga yang Bergerak

Jasa titip beli (jastip) dan reseller kecil punya masalah operasional yang unik: barang yang dijual tidak selalu ada di tangan penjual, harga bisa berubah karena kurs atau ongkos kirim internasional, dan pelanggan sering bertanya status berkali-kali dalam satu minggu (“kak barang saya sudah sampai mana?”) karena memang tidak ada visibilitas selain menunggu kabar dari penjual. … Read more