Server Anda restart. Bisa karena deploy ulang, listrik mati sebentar, atau sekadar maintenance rutin. Selama proses itu mati — katakanlah 10 menit — ada 15 pesan WhatsApp pelanggan yang masuk. Pertanyaannya: ke mana perginya 15 pesan itu begitu agent Anda hidup lagi?
Jawaban yang paling umum: hilang begitu saja
Kalau agent cuma didesain untuk “dengarkan pesan masuk secara real-time” lewat koneksi WebSocket atau polling, jawabannya sederhana dan tidak enak: pesan yang masuk saat proses mati, ya, hilang. Tidak ada error yang muncul, tidak ada log yang menjerit — sistem kelihatan baik-baik saja begitu nyala lagi, tapi 15 orang itu tidak pernah dijawab, dan tidak ada satu pun sinyal yang memberitahu bahwa itu terjadi. Ini yang disebut silent failure — kegagalan yang lebih berbahaya daripada crash, justru karena tidak kelihatan.
Pola yang seharusnya ada: catch-up sebelum listen
Di semua agent yang berjalan sebagai proses background di tim internal Kantor AI — listener WhatsApp/Telegram, watcher folder konten — ada satu langkah wajib sebelum koneksi real-time dibuka: cek dulu apa yang mungkin terlewat selama mati. Urutannya kira-kira begini:
- Begitu proses hidup, JANGAN langsung buka koneksi real-time.
- Ambil daftar percakapan yang punya pesan masuk terakhir tanpa balasan sesudahnya (indikator paling sederhana: pesan terakhir bukan dari bot).
- Proses satu per satu percakapan yang “belum dibalas” itu, seolah-olah baru masuk.
- Baru setelah catch-up selesai, buka koneksi real-time untuk pesan-pesan berikutnya.
Kedengarannya sepele. Tapi tanpa langkah ini, setiap restart — sekecil apa pun, sesering apa pun — adalah lubang kebocoran layanan yang tidak pernah tercatat di mana pun.
Kenapa ini gampang terlewat saat membangun agent
Karena saat demo atau testing, agent hampir tidak pernah restart di tengah percakapan aktif — jadi masalah ini tidak pernah kelihatan sampai sistemnya benar-benar dipakai produksi, biasanya berminggu-minggu setelah go-live, saat maintenance server pertama kali terjadi. Ini pola klasik di banyak sistem event-driven, bukan cuma spesifik ke AI agent — tapi orang yang membangun agent sering fokus habis-habisan ke “kecerdasan” jawabannya dan lupa fondasi reliability paling dasar ini.
Ada satu nuansa tambahan yang perlu dipikirkan: kalau restart terjadi karena maintenance terjadwal (misalnya restart otomatis tengah malam), sebaiknya ada juga mekanisme konfirmasi aktif — agent yang baru hidup mengirim sinyal ke pemiliknya bahwa dia sudah kembali online, terutama kalau ada layanan pendukung yang sempat mati dan perlu di-restart manual. Tanpa ini, pemilik bisnis baru tahu ada masalah saat pelanggan mengeluh duluan.
Pertanyaan praktis untuk ditanyakan ke vendor
Kalau Anda sedang evaluasi jasa AI agent untuk WhatsApp bisnis, pertanyaan ini sering terlewat dibanding pertanyaan soal “bisa jawab apa saja”: apa yang terjadi kalau server Anda restart saat ada pesan pelanggan masuk? Jawaban yang baik menyebutkan mekanisme catch-up secara eksplisit. Jawaban yang samar (“sistem kami stabil, jarang restart”) justru sinyal bahwa pertanyaan ini belum pernah dipikirkan — dan cepat atau lambat, “jarang” itu akan terjadi juga.