Diyetekno.com- Persaingan dalam dunia kecerdasan buatan (AI) terus memanas, dan kemunculan model terbaru dari Meta, Meta Muse, menambah daftar panjang inovasi yang patut diperhitungkan. Untuk menguji seberapa jauh kemampuan model ini, sebuah uji coba menarik dilakukan dengan membandingkannya langsung dengan raksasa AI yang sudah dikenal luas, ChatGPT-6, dalam lima skenario penggunaan sehari-hari yang relevan dengan kehidupan manusia. Hasilnya, sebuah kejutan terjadi: Meta Muse berhasil mengungguli ChatGPT-6 dengan skor tipis 3-2.
Uji coba ini dirancang untuk melihat bagaimana kedua AI tersebut menangani berbagai jenis permintaan, mulai dari penulisan, perencanaan, pemecahan masalah, penjelasan sederhana, hingga penalaran kreatif. Tujuannya bukan sekadar mengukur performa teknis, melainkan juga memahami seberapa baik AI dapat memahami nuansa manusia dan memberikan respons yang benar-benar berguna.

1. Menangani Situasi Canggung: Pesan untuk Tetangga
Prompt pertama meminta kedua AI untuk menulis pesan kepada tetangga yang sering meletakkan tempat sampah di depan jalan masuk, menyebabkan kesulitan saat keluar-masuk. Pesan harus ramah karena hubungan baik, namun cukup jelas agar masalah teratasi tanpa terkesan pasif-agresif.
ChatGPT-6 langsung pada intinya, menyampaikan permintaan dengan lugas dan menghilangkan ambiguitas mengenai seberapa jauh tempat sampah harus digeser. Namun, Meta Muse berhasil memberikan draf yang lebih unggul. Pesan dari Meta Muse terasa lebih alami dan sopan, dengan frasa yang menyarankan penyesuaian fisik kecil daripada masalah serius. Meta Muse memenangkan putaran ini karena lebih baik dalam menangkap nada yang diinginkan untuk menjaga hubungan baik.
2. Perencanaan dengan Batasan: Liburan Keluarga di New York City
Prompt kedua menantang AI untuk merencanakan hari Sabtu di New York City untuk keluarga dengan tiga anak berusia 5, 9, dan 12 tahun. Batasan yang diberikan meliputi anggaran $200 untuk aktivitas dan makanan, keinginan untuk menghindari terlalu banyak berjalan kaki, dan setidaknya satu aktivitas dalam ruangan jika hujan. Jadwal realistis diminta dari pukul 10 pagi hingga 7 malam.
ChatGPT-6 menunjukkan keunggulan dalam pengelompokan geografis, memastikan jarak berjalan kaki yang singkat di awal hari. Pilihan aktivitas tanpa biaya dan pengaturan waktu yang baik antara segmen berenergi tinggi dan waktu istirahat juga sangat membantu. Meta Muse memilih atraksi dengan nilai hiburan yang lebih tinggi untuk rentang usia yang ditargetkan, seperti American Museum of Natural History (AMNH), dan menunjukkan pengetahuan transit NYC yang akurat. Namun, perhitungan anggaran Meta Muse bergantung pada asumsi tempat tinggal yang tidak disebutkan, membuat ChatGPT-6 menjadi pemenang karena kepatuhannya yang ketat terhadap batasan finansial dan logistik.
3. Saran dan Pemecahan Masalah: Berbenah Cepat Sebelum Tamu
Prompt ketiga adalah skenario umum: 45 menit sebelum tamu tiba, dapur berantakan, ruang tamu perlu divakum, cucian menumpuk di sofa, dan masih perlu mandi. AI diminta memberikan rencana paling efisien untuk menyelesaikan semuanya, serta apa yang harus dilewati jika waktu tidak cukup.
ChatGPT-6 mengantisipasi "titik buta" penting yang terlupakan dalam prompt: kamar mandi tamu. Menambahkan blok 5 menit untuk memeriksa tisu toilet dan membersihkan wastafel membuat rencana menjadi lebih realistis. AI ini juga memberikan panduan yang sangat spesifik untuk blok mandi, mencegah alasan paling umum orang terlambat dalam skenario ini. Meta Muse memberikan saran perilaku yang sangat baik, seperti menggunakan pengatur waktu, namun ekspektasi kebersihan dapurnya kurang realistis untuk waktu yang singkat. Oleh karena itu, ChatGPT-6 memenangkan putaran ini karena realisme operasional dan kemampuannya mengantisipasi kebutuhan yang tidak terucap.
4. Menjelaskan Hal Rumit dengan Sederhana: Mengapa Pesawat Terbang
Prompt keempat meminta AI untuk menjelaskan mengapa pesawat bisa tetap di udara kepada anak berusia 10 tahun. Aturannya adalah tidak menggunakan persamaan, tidak mengasumsikan pengetahuan tentang gaya angkat atau tekanan udara, menjaga penjelasan di bawah 200 kata, dan menggunakan analogi yang mudah dibayangkan.
ChatGPT-6 memperkenalkan mekanisme fisik yang akurat dan intuitif: sayap mendorong udara ke bawah, yang kemudian mendorong pesawat ke atas (Hukum Ketiga Newton yang diterjemahkan ke bahasa sederhana). Namun, Meta Muse menawarkan kalibrasi audiens yang sempurna. Nada bicaranya ceria dan langsung berbicara kepada anak berusia 10 tahun. Meta Muse memilih satu analogi – tangan yang dikeluarkan dari jendela mobil – dan mengembangkannya sepenuhnya, mengaitkannya kembali ke pesawat kertas dan landasan pacu untuk menjelaskan mengapa kecepatan maju itu penting. Meta Muse memenangkan putaran ini karena energinya yang tinggi, level membaca yang sesuai untuk anak 10 tahun tanpa merendahkan, dan penyampaian pesan yang jelas serta mudah diingat.
5. Penalaran Kreatif: Ide Aplikasi Baru
Prompt terakhir menantang AI untuk menciptakan aplikasi baru yang memecahkan masalah kecil namun menjengkelkan di rumah, dengan batasan tidak boleh berupa daftar tugas, perencana makanan, aplikasi anggaran, atau remote rumah pintar. AI diminta memberikan nama, menjelaskan masalah yang dipecahkan, cara kerja, dan alasan mengapa pengguna akan terus menggunakannya setelah minggu pertama.
ChatGPT-6 memecahkan frustrasi universal mencari barang di rumah tanpa memerlukan katalogisasi seluruh rumah. Model interaksinya melibatkan pengambilan foto dan perintah suara alami ("lampu Natal di kotak biru") yang minim usaha. Namun, Meta Muse mengidentifikasi titik kegagalan domestik yang sangat spesifik dan dapat diterima secara universal: barang yang dipinjam tidak pernah kembali. Aplikasi yang diusulkannya diberi nama brilian, "Takeout". Logika retensinya sangat kuat: alih-alih berpura-pura pengguna suka membuka aplikasi tugas, Meta Muse mengakui bahwa aplikasi utilitas terbaik membutuhkan sedikit perawatan dan mengandalkan keengganan kehilangan. Meta Muse memenangkan putaran ini karena membangun produk berdasarkan realitas kemalasan rumah tangga dan menyadari bahwa aplikasi bertahan melewati minggu pertama hanya jika hampir tidak memerlukan input manual dari pengguna.
Kesimpulan Akhir
Setelah lima putaran, Meta Muse berhasil meraih kemenangan tipis 3-2. Hasil ini mengejutkan sekaligus mengesankan. Meskipun ChatGPT-6 terbukti lebih kuat ketika prompt membutuhkan perencanaan yang cermat dan perhatian terhadap batasan praktis, Meta Muse menonjol ketika tugas lebih bergantung pada pemahaman nuansa manusia. Pesan untuk tetangga yang dibuatnya terdengar seperti sesuatu yang benar-benar akan dikirim, penjelasan pesawatnya sangat cocok untuk anak berusia 10 tahun, dan ide aplikasinya menunjukkan pemahaman yang sangat baik tentang mengapa orang meninggalkan aplikasi yang membutuhkan terlalu banyak usaha.
Meta Muse terasa sangat unik sebagai model tersendiri, bukan sekadar mencoba meniru atau mengejar ChatGPT-6. Meskipun ChatGPT-6 masih menjadi pilihan utama bagi jutaan orang, uji coba ini membuktikan bahwa Meta telah menempuh perjalanan panjang, dan model terbaru ini menawarkan kesan pertama yang sangat kuat dan menjanjikan di arena AI yang terus berkembang pesat.

