Nyoba AI Browser Agent buat Kerjaan Freelance yang Ngebosenin

Ada satu kategori kerjaan freelance yang nggak pernah masuk portofolio tapi makan waktu lumayan banyak tiap minggu: isi invoice manual di beberapa platform yang formatnya beda-beda, cek dashboard analytics beberapa client buat laporan bulanan, cari kompetitor buat riset sebelum proposal, sama isi form-form administratif yang isinya sama tapi harus diketik ulang di tempat berbeda. Kerjaan ini nggak butuh skill teknik saya sama sekali, cuma butuh waktu dan kesabaran nge-klik. Bulan ini saya coba serahin sebagian ke browser agent — AI yang bisa navigasi web beneran, bukan cuma jawab pertanyaan soal apa yang ada di layar. Hasilnya nggak sesempurna yang saya harapin, tapi cukup nolongin buat saya lanjutin.
Yang jalan mulus: nyari dan ngerangkum
Yang paling konsisten jalan mulus itu tugas kayak “buka lima situs kompetitor ini, catet pricing tier mereka, bikin tabel ringkasan.” Ini kerjaan yang emang cocok buat agent — baca banyak halaman, extract informasi terstruktur, susun jadi format yang saya bisa langsung pakai. Waktu yang biasanya saya habisin buat riset kompetitor sebelum nulis proposal turun drastis, dari sekitar sejam jadi lima belas menit review hasil agent-nya. Saya juga suka nggak perlu setup automation script custom cuma buat tugas yang dijalanin sekali doang — dulu kalau ada tugas berulang yang butuh navigasi web, saya harus mikir apa worth it nulis script Playwright buat itu. Sekarang buat tugas one-off, saya cuma kasih instruksi bahasa natural.
Nggak selalu lebih cepet, sih, khususnya buat tugas simpel. Buat tugas satu langkah yang emang cepet saya kerjain manual — kayak cek satu angka di satu dashboard — nunggu agent navigasi, screenshot, verifikasi, kadang lebih lama dari saya buka tab dan liat sendiri. Titik impasnya ada di tugas yang butuh banyak langkah berulang di banyak halaman, bukan tugas simpel satu langkah.
Yang paling sering gagal: apa aja yang butuh login dan data sensitif
Pas nyoba isi invoice di platform freelance yang butuh login, agent-nya bisa navigasi ke halaman yang bener, tapi saya tetep milih ngisi credential sama nomor rekening secara manual sendiri, bukan biarin agent yang pegang itu. Bukan karena nggak bisa secara teknis — tapi karena saya nggak nyaman ngasih akses penuh ke akun finansial ke sistem yang kadang masih bisa salah interpretasi instruksi. Ini batasan yang saya set sendiri, bukan batasan tool-nya.
Ada satu kejadian yang bikin saya makin hati-hati. Waktu saya minta cek status pembayaran di satu dashboard, ada dua tombol berdekatan — satu “Lihat Detail” satu lagi “Batalkan” — dan posisinya emang deket banget karena UI dashboard itu emang nggak dirancang rapi. Agent-nya sempet mau klik yang salah sebelum saya stop di tengah jalan pas liat live preview-nya. Nggak ada kerusakan beneran karena saya masih nonton prosesnya real-time, tapi itu pengingat keras kenapa saya nggak biarin agent jalan tanpa pengawasan buat apapun yang punya konsekuensi kalau salah klik.
Saya jadi lebih sadar bedanya “baca halaman” sama “ngerti maksud halaman.” Agent-nya bagus banget baca teks yang ada di layar. Tapi beberapa kali dia salah paham maksud dari layout visual yang buat manusia obvious — misalnya badge warna merah yang maksudnya “action required” tapi agent-nya nggak nangkep urgency-nya karena teksnya sendiri netral. Interface yang saya bikin buat manusia itu sering ngandelin sinyal visual yang nggak selalu ke-encode di teks mentahnya, dan itu jadi hal yang agent belum konsisten nangkep.
Buat laporan client, draft pertama — bukan hasil final
Saya minta buka dashboard analytics tiap client, extract angka-angka kunci, susun jadi draft laporan. Draft-nya lumayan solid buat starting point, tapi saya selalu baca ulang dan tambahin konteks yang agent-nya nggak punya — kenapa traffic turun minggu ini (karena emang lagi maintenance terjadwal, bukan masalah beneran), atau kenapa satu angka kelihatan aneh (karena ada typo tracking yang saya tau tapi belum sempet fix). Tanpa konteks itu, laporan yang dihasilin agent kedengeran alarming padahal sebenernya nggak apa-apa.
Privasi dan biaya, dua hal yang saya remehin di awal
Browser agent itu secara teknis bisa liat semua yang ada di layar pas dia jalan — termasuk tab lain yang kebuka, cookie session, apapun yang keliatan. Sebelum saya pasang ke browser yang sama yang saya pake buat login ke akun client, saya baca dulu gimana data itu diproses, apa disimpen, apa cuma diproses sekali terus dibuang. Buat kerjaan yang nyentuh akun client, saya sekarang pakai browser profile terpisah yang khusus buat agent, biar ada pemisahan jelas dari akun-akun sensitif saya sendiri. Extra setup step, tapi kerasa perlu setelah saya mikir lebih jauh soal apa yang sebenernya bisa diakses agent selama dia jalan.
Beberapa tugas yang butuh banyak langkah navigasi ternyata makan cukup banyak resource dibanding saya kira di awal, karena tiap langkah butuh agent baca ulang state halaman yang sekarang. Buat tugas yang cuma dijalanin sesekali, ini nggak masalah. Tapi buat tugas yang pengen saya jadiin rutinitas mingguan, saya mulai itung-itungan apa cost-nya beneran worth dibanding waktu yang saya hemat, dan jawabannya nggak selalu iya buat semua jenis tugas.
Kesimpulan saya: ini alat yang berguna buat kategori kerjaan spesifik, bukan pengganti kerja administratif secara umum. Buat riset dan ringkasan dari banyak sumber, saya sekarang beneran pakai ini rutin. Buat apapun yang nyentuh data finansial atau kredensial, saya masih pegang kontrol manual sendiri. Dan buat tugas satu langkah yang simpel, saya tetep ngerjain sendiri karena emang nggak worth overhead-nya. Bukan alat ajaib yang ngilangin semua kerjaan boring, tapi cukup buat ngurangin porsi waktu yang saya pake buat hal-hal yang nggak butuh skill teknik saya sama sekali.