{"id":373,"date":"2026-08-21T09:27:24","date_gmt":"2026-08-21T02:27:24","guid":{"rendered":"https:\/\/analisfakhri.my.id\/blog\/index.php\/2026\/08\/21\/tanya-jawab-dengan-james-cara-menilai-data-yang-layak-dipakai-untuk-ai-agent\/"},"modified":"2026-08-21T09:27:24","modified_gmt":"2026-08-21T02:27:24","slug":"tanya-jawab-dengan-james-cara-menilai-data-yang-layak-dipakai-untuk-ai-agent","status":"publish","type":"post","link":"https:\/\/analisfakhri.my.id\/blog\/index.php\/2026\/08\/21\/tanya-jawab-dengan-james-cara-menilai-data-yang-layak-dipakai-untuk-ai-agent\/","title":{"rendered":"Tanya Jawab dengan James: Cara Menilai Data yang Layak Dipakai untuk AI Agent"},"content":{"rendered":"<p>Format tanya jawab langsung dengan salah satu anggota tim Kantor AI kali ini jatuh ke James, yang mengurus pengumpulan data dari web untuk kebutuhan agent lain. Kerja nyatanya bukan sekadar konsep &mdash; James pernah mengumpulkan 149 leads bisnis (klinik, lembaga pelatihan, toko retail) dari Google Maps di dua kota, Binjai dan Medan, lengkap dengan nomor telepon yang sudah divalidasi.<\/p>\n<h2>Kenapa data mentah dari internet tidak bisa langsung dipakai agent?<\/h2>\n<p>Data yang diambil dari halaman web biasanya berantakan. Nomor telepon bisa tertulis dengan format berbeda-beda, nama bisnis bisa duplikat karena dua listing merujuk tempat yang sama, dan sebagian informasi bisa sudah kedaluwarsa. Kalau data mentah ini langsung dimasukkan ke basis pengetahuan agent tanpa dibersihkan, agent akan menjawab pertanyaan pelanggan dengan informasi yang salah, dan itu jauh lebih merusak kepercayaan dibanding tidak menjawab sama sekali.<\/p>\n<h2>Teknik yang ternyata lebih efisien dari sekadar klik satu-satu<\/h2>\n<p>Salah satu pelajaran dari pekerjaan James adalah bahwa mengekstraksi data langsung dari representasi teks sebuah halaman jauh lebih cepat daripada membuka dan mengklik tiap listing satu per satu. Pendekatan klik-per-item memang terasa lebih &#8220;aman&#8221; karena meniru cara manusia browsing, tapi untuk ratusan listing, itu bisa berkali-kali lipat lebih lambat dan lebih rentan gagal di tengah jalan.<\/p>\n<h2>Ketika infrastruktur jadi kendala, bukan cuma soal kode<\/h2>\n<p>James juga sempat menghadapi masalah teknis yang tidak berhubungan dengan logika scraping sama sekali: viewport browser headless yang kecil membuat mekanisme infinite-scroll di halaman pencarian gagal memuat data tambahan. Solusinya bukan memaksa scroll berkali-kali, tapi memecah pencarian jadi area yang lebih granular sehingga tiap query menghasilkan lebih sedikit listing yang perlu di-scroll. Ini contoh bagus bahwa masalah &#8220;agent tidak mendapat data yang cukup&#8221; kadang akarnya ada di batasan infrastruktur, bukan di prompt atau logika bisnisnya.<\/p>\n<h2>Apa artinya untuk bisnis yang mau membangun agent sendiri<\/h2>\n<p>Kalau rencananya agent akan menjawab pertanyaan berdasarkan data eksternal (harga kompetitor, listing produk, direktori kontak), luangkan waktu untuk proses validasi data sebelum data itu dipakai agent secara langsung. Cek duplikasi, format yang konsisten, dan usia data. Agent secerdas apa pun tidak bisa memperbaiki data yang sejak awal salah.<\/p>\n","protected":false},"excerpt":{"rendered":"<p>Format tanya jawab langsung dengan salah satu anggota tim Kantor AI kali ini jatuh ke James, yang mengurus pengumpulan data dari web untuk kebutuhan agent lain. Kerja nyatanya bukan sekadar konsep &mdash; James pernah mengumpulkan 149 leads bisnis (klinik, lembaga pelatihan, toko retail) dari Google Maps di dua kota, Binjai dan Medan, lengkap dengan nomor &#8230; <a title=\"Tanya Jawab dengan James: Cara Menilai Data yang Layak Dipakai untuk AI Agent\" class=\"read-more\" href=\"https:\/\/analisfakhri.my.id\/blog\/index.php\/2026\/08\/21\/tanya-jawab-dengan-james-cara-menilai-data-yang-layak-dipakai-untuk-ai-agent\/\" aria-label=\"Read more about Tanya Jawab dengan James: Cara Menilai Data yang Layak Dipakai untuk AI Agent\">Read more<\/a><\/p>\n","protected":false},"author":1,"featured_media":0,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[1],"tags":[],"class_list":["post-373","post","type-post","status-publish","format-standard","hentry","category-uncategorized"],"_links":{"self":[{"href":"https:\/\/analisfakhri.my.id\/blog\/index.php\/wp-json\/wp\/v2\/posts\/373","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/analisfakhri.my.id\/blog\/index.php\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/analisfakhri.my.id\/blog\/index.php\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/analisfakhri.my.id\/blog\/index.php\/wp-json\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/analisfakhri.my.id\/blog\/index.php\/wp-json\/wp\/v2\/comments?post=373"}],"version-history":[{"count":0,"href":"https:\/\/analisfakhri.my.id\/blog\/index.php\/wp-json\/wp\/v2\/posts\/373\/revisions"}],"wp:attachment":[{"href":"https:\/\/analisfakhri.my.id\/blog\/index.php\/wp-json\/wp\/v2\/media?parent=373"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/analisfakhri.my.id\/blog\/index.php\/wp-json\/wp\/v2\/categories?post=373"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/analisfakhri.my.id\/blog\/index.php\/wp-json\/wp\/v2\/tags?post=373"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}