Sejauh yang saya pakai, GPT 6 Astra yang paling membuat saya terkesan adalah kemampuan Computer Use. Dibanding GPT 5.6 yang dulu—biasanya perlu sedikit menunggu sebelum menjalankan berbagai aksi—sekarang ia bisa dengan cepat dan akurat membantu saya menguji aplikasi. Melihatnya dari samping saat ia mengklik benar-benar pengalaman yang menyenangkan. https://x.com/victornunez/status/2095975651094261777/video/1

Peningkatan terbesar yang dibawa hal ini sebenarnya adalah membuat agent membentuk siklus tertutup yang lengkap dari pengembangan sampai verifikasi/penerimaan.

Bayangkan sekarang kita mengembangkan. Setelah selesai coding, tetap saja ada banyak hal yang perlu diverifikasi secara manual. Termasuk pengujian pada sistem online; lebih banyak bergantung pada framework pengujian end-to-end seperti PlayWright untuk dijalankan melalui operasi kode. Dulu Computer Use memang juga bisa dilakukan, tetapi biayanya relatif tinggi, tingkat akurasinya lebih rendah, dan kecepatannya juga belum cukup cepat.

Namun GPT 6 mungkin sudah melewati titik kritis untuk Computer Use: akurasi tinggi, cepat, dan biayanya—meskipun saat ini masih belum rendah—bisa diperkirakan akan terus turun di masa mendatang.

Saran saya, saat Anda memberi tugas ke GPT 6, coba minta ia melakukan verifikasi/penerimaan dengan Computer Use sendiri. Ini bisa sangat mengurangi pekerjaan manual Anda untuk pengujian.

Selain itu, beberapa pengujian otomatis untuk aplikasi yang dulu juga bisa dicoba: gunakan GPT-6 untuk memanggil Computer Use agar mencakup skenario yang sebelumnya tidak bisa dijangkau oleh framework end-to-end, atau biayanya terlalu tinggi.