JAKARTA, WARTAINDONESIA.CO.ID – Teknologi kecerdasan buatan atau artificial intelligence (AI) medis buatan Indonesia mendapat sorotan setelah diuji dalam studi yang melibatkan peneliti dari Stanford University dan University of California, Berkeley.
Studi bertajuk “Assessing the Clinical Safety of an AI Assistant in Indonesian Chat-Based Telemedicine” mengevaluasi sistem AI klinis milik Alodokter yang digunakan untuk membantu dokter dalam konsultasi telemedisin berbasis percakapan. Penelitian tersebut dipublikasikan Stanford King Center on Global Development pada Agustus 2026.
Hasilnya, 397 dari 402 konsultasi atau 98,8 persen dinilai aman secara klinis berdasarkan konsensus tiga dokter independen di Indonesia. Dari jumlah itu, 388 konsultasi dikategorikan aman, sembilan memiliki kekurangan minor, dan lima dinilai tidak aman.
Diuji pada Konsultasi Nyata
Penelitian dilakukan terhadap 402 konsultasi dokter umum berbantuan AI yang berlangsung pada 19–21 April 2026.
Setiap konsultasi ditinjau secara independen oleh tiga dokter Indonesia menggunakan 14 kriteria keselamatan klinis. Penilaian mencakup penggalian riwayat pasien, identifikasi tanda bahaya, diagnosis, obat dan dosis, pemeriksaan penunjang, triase, rujukan, tindak lanjut hingga potensi munculnya informasi yang tidak didukung fakta atau hallucination.
AI tersebut telah digunakan Alodokter sejak Januari 2026 sebagai alat bantu dokter dalam telekonsultasi. Namun, keputusan medis tetap berada di tangan dokter berlisensi, yang dapat mengubah atau menolak rekomendasi AI sebelum menetapkan penanganan akhir.
Peneliti Berkeley Soroti Pentingnya Uji Dunia Nyata
Ziad Obermeyer, MD, Associate Professor di University of California, Berkeley sekaligus salah satu penulis studi, mengatakan AI kesehatan tidak cukup dinilai hanya dari kemampuannya menjawab pertanyaan medis yang telah disiapkan sebelumnya.
“Medical AI cannot be judged only by how well it answers curated questions,” kata Obermeyer dalam keterangan yang dimuat Alodokter pada 22 September 2026.
Ia menjelaskan konsultasi pasien di dunia nyata jauh lebih kompleks dan tidak selalu dapat diprediksi. Karena itu, pengujian terhadap seluruh rangkaian konsultasi telemedisin dinilai lebih mendekati kondisi sebenarnya yang dihadapi tenaga medis.
Peneliti Stanford: Bukti Harus Datang dari Sistem yang Dipakai
Dua peneliti doktoral Stanford University yang terlibat dalam penelitian, Wendy Yin dan Natalia Khoudian, menilai evaluasi AI klinis seharusnya dilakukan di dalam sistem layanan kesehatan tempat teknologi tersebut benar-benar digunakan.
Dalam keterangan yang dimuat Alodokter, keduanya menyebut penelitian ini menggabungkan konsultasi pasien nyata, penilaian dokter independen, serta pengawasan dokter dalam penggunaan AI.
Menurut mereka, pendekatan semacam itu dapat memberikan bukti yang lebih relevan bagi penyedia layanan kesehatan ketika menilai apakah teknologi AI layak digunakan secara lebih luas.
AI Tidak Menggantikan Dokter
AI yang diuji bukan chatbot medis yang bekerja sendiri.
Dr. Louise P. M. Hewitt, Chief Medical Officer Alodokter dan salah satu penulis studi, mengatakan model bahasa besar atau Large Language Model (LLM) memang membuka banyak peluang dalam dunia medis. Namun, teknologi tersebut membutuhkan pengalaman klinis dan evaluasi ketat sebelum digunakan dalam konsultasi nyata.
Menurut Hewitt, risiko dalam konsultasi medis jauh lebih tinggi dibandingkan sekadar memberikan jawaban kesehatan secara umum. Karena itu, teknologi dikembangkan untuk membantu dokter menghadapi kompleksitas konsultasi, bukan menggantikan peran dokter.
Dalam praktiknya, AI membantu mengumpulkan informasi pasien, mendeteksi tanda bahaya, memberikan pertimbangan diagnosis, pemeriksaan dan obat, serta membantu menentukan apakah pasien perlu dirujuk.
Dokter tetap memegang kendali atas keputusan akhir.
Masih Ada Lima Konsultasi yang Dinilai Tidak Aman
Meski tingkat keselamatannya mencapai 98,8 persen, penelitian ini tidak menyimpulkan bahwa AI tersebut bebas dari risiko.
Dari 402 konsultasi yang diperiksa, lima konsultasi atau sekitar 1,24 persen dikategorikan tidak aman. Selain itu, sembilan konsultasi atau 2,2 persen dinilai memiliki kekurangan minor yang tidak menimbulkan risiko langsung terhadap bahaya serius.
Penelitian juga menunjukkan tingkat kesepakatan penuh di antara ketiga dokter penilai terjadi pada 351 konsultasi atau 87,3 persen. Perbedaan penilaian menunjukkan bahwa interpretasi keselamatan klinis tetap dapat berbeda antardokter, terutama dalam menentukan batas antara kasus aman dan tidak aman.
Dalam laporan detikInet, dua area yang masih menjadi perhatian adalah penanganan kondisi yang membutuhkan rujukan segera serta pengamanan dosis obat pada pasien anak.
Alodokter Sebut AI Dibangun dari Pengalaman Telemedisin
Nathanael Faibis, CEO Alodokter, mengatakan teknologi tersebut dibangun berdasarkan pengalaman perusahaan selama lebih dari satu dekade mengelola telekonsultasi.
Dalam keterangan perusahaan, Faibis mengatakan AI ditujukan untuk membantu dokter melayani lebih banyak pasien tanpa mengurangi kualitas dan perhatian personal dalam konsultasi.
Alodokter menyebut penggunaan AI tersebut di kalangan dokter umum pada platformnya kini mendekati 100 persen. Data internal perusahaan juga menyebut 98 persen konsultasi dokter umum yang didukung AI mendapatkan penilaian kepuasan positif dari pasien. Angka kepuasan tersebut merupakan data internal perusahaan, bukan hasil utama penelitian Stanford-Berkeley.
Penelitian Lanjutan Disiapkan
Studi ini bersifat retrospektif dan observasional sehingga belum menjawab seluruh pertanyaan mengenai dampak AI terhadap kualitas layanan.
Alodokter menyatakan tim yang sama kini menyiapkan randomized controlled trial atau uji acak terkontrol untuk menilai dampak penggunaan AI terhadap kualitas klinis dan produktivitas dokter.
Langkah tersebut penting karena tingkat keselamatan yang tinggi dalam studi ini belum otomatis membuktikan bahwa penggunaan AI meningkatkan hasil kesehatan pasien dibandingkan konsultasi tanpa AI.
Penelitian lanjutan juga diperlukan untuk menilai konsistensi sistem dalam populasi yang lebih luas, kondisi medis berbeda, serta penggunaan dalam jangka panjang.
Hasil studi awal ini menunjukkan AI klinis buatan Indonesia dapat digunakan sebagai pendukung konsultasi medis dengan tingkat keselamatan yang tinggi dalam sampel yang diuji. Namun, dokter tetap menjadi pengambil keputusan akhir dan evaluasi berkelanjutan tetap diperlukan sebelum teknologi semacam ini digunakan dalam skala yang lebih luas.



Komentar