MALUKU — Meta Muse memenangkan tiga dari lima prompt harian yang diuji head-to-head melawan ChatGPT-6, hasil yang lebih ketat dari perkiraan banyak pengamat. Keduanya bersaing di tugas menulis pesan canggung, merencanakan liburan keluarga, memberi saran praktis, menjelaskan konsep rumit, dan menciptakan ide aplikasi. ChatGPT tetap unggul saat prompt menuntut disiplin anggaran dan logistik, sementara Meta Muse menang di tugas yang butuh pemahaman manusia.
Pengujian lima prompt ini dilakukan untuk melihat bagaimana Meta Muse dan ChatGPT-6 menangani permintaan yang paling sering dipakai orang sehari-hari: menulis pesan yang awkward, merencanakan hari libur keluarga, memberi saran saat dikejar waktu, menjelaskan konsep rumit ke anak, dan menciptakan ide aplikasi. Keduanya diuji dengan instruksi yang sama persis, tanpa tambahan konteks di luar prompt.
Hasil akhirnya 3-2 untuk Meta Muse. Selisihnya tipis, dan kemenangan di tiap kategori datang dari alasan yang berbeda-beda. Berikut rincian per prompt.
Prompt pertama meminta keduanya menulis pesan teks ke tetangga yang sering menaruh tempat sampah di depan jalan masuk, dengan nada ramah tapi jelas. ChatGPT langsung menuju permintaan intinya dan menghilangkan ambiguitas soal seberapa jauh tempat sampah harus digeser.
Meta Muse menulis pesan yang lebih sopan dan terasa seperti percakapan tetangga sungguhan. Bahasanya menunjukkan penyesuaian kecil, bukan masalah serius.
Pemenang: Meta Muse. Pesan ChatGPT terasa seperti surat peringatan HOA dan sedikit pasif-agresif, sementara Meta Muse berhasil menyeimbangkan ketegasan dengan kehangatan hubungan bertetangga.
Prompt kedua meminta rencana Sabtu di New York untuk keluarga dengan tiga anak usia 5, 9, dan 12 tahun, anggaran USD 200 untuk aktivitas dan makan, meminimalkan jalan kaki, dan wajib ada aktivitas dalam ruangan. ChatGPT unggul dalam pengelompokan geografis sehingga jarak jalan kaki di paruh awal hari tetap pendek, plus opsi gratis dan ritme aktivitas yang seimbang.
Meta Muse memilih American Museum of Natural History (AMNH) yang memang cocok untuk rentang usia 5-12 tahun. Meta juga menyebut aturan MTA soal tinggi badan 44 inci untuk anak yang bisa naik gratis, menyertakan taman bermain di seberang museum, dan memberi panduan logistik konkret seperti duduk di sisi kanan feri saat berangkat.
Pemenang: ChatGPT. Rencana Meta Muse lebih menarik di atas kertas, tapi seluruh hitungan anggarannya bergantung pada asumsi status residensi tri-state yang tidak disebutkan. ChatGPT menang karena patuh ketat pada batasan finansial dan logistik yang diminta.
Prompt ketiga meminta rencana efisien 45 menit sebelum tamu datang, dengan dapur berantakan, ruang tamu perlu divakum, cucian berserakan di sofa, dan masih harus mandi. ChatGPT menambahkan hal yang tidak disebut di prompt: kamar mandi tamu. Blok 5 menit untuk cek tisu dan lap wastafel jadi pembeda antara rencana bagus dan rencana realistis.
ChatGPT juga memberi batasan spesifik untuk waktu mandi, yang mencegah penyebab paling umum orang terlambat di situasi ini. Meta Muse memberi saran perilaku yang bagus dan alasan di balik timeline, ditutup dengan perintah memakai timer. Format waktunya lebih mudah dibaca.
Pemenang: ChatGPT. Saran timer Meta Muse tajam, tapi ekspektasi dapurnya tidak realistis. ChatGPT paham bahwa dalam 45 menit, orang hanya merapikan dan mengorganisir, bukan membersihkan total.
Prompt keempat meminta penjelasan kenapa pesawat bisa terbang untuk anak 10 tahun yang penasaran, tanpa persamaan matematika, tanpa asumsi paham lift, drag, atau tekanan udara, maksimal 200 kata, dan pakai analogi yang bisa dibayangkan. ChatGPT memperkenalkan mekanisme fisik yang akurat: sayap mendorong udara ke bawah, yang mendorong pesawat ke atas.
Meta Muse menyesuaikan nada dengan sempurna. Bahasanya hidup dan langsung bicara ke anak 10 tahun, dengan frasa seperti "with a grown-up driving, of course!" dan "whoosh". Meta memilih satu analogi, yaitu tangan di luar jendela mobil, dan konsisten mengembangkannya ke pesawat kertas dan landasan untuk menjelaskan kenapa kecepatan maju penting.
Pemenang: Meta Muse. Energinya tetap tinggi, level bacanya pas untuk anak 10 tahun tanpa merendahkan, dan pesan akhirnya jelas serta mudah diingat.
Prompt kelima meminta menciptakan aplikasi yang menyelesaikan masalah kecil tapi menjengkelkan di rumah, bukan to-do list, meal planner, budgeting app, atau smart-home remote. Harus ada nama, masalah yang diselesaikan, cara kerja, dan alasan orang tetap pakai setelah minggu pertama. ChatGPT menyelesaikan frustrasi universal tanpa perlu katalog seluruh rumah, dengan model interaksi foto plus bahasa natural seperti "lampu Natal di kotak biru".
Meta Muse menemukan titik gagal domestik yang sangat spesifik dan relatable, lalu memberi nama yang punchy: Takeout. Logika retensinya kuat karena mengakui bahwa aplikasi terbaik justru yang butuh nol perawatan dan mengandalkan keengganan kehilangan, bukan asumsi bahwa orang suka membuka aplikasi tugas.
Pemenang: Meta Muse. Chatbot ini membangun produk berdasarkan realitas kemalasan rumah tangga dan sadar bahwa aplikasi bertahan lewat minggu pertama hanya kalau tidak menuntut input manual dari pengguna.
Meta Muse bukan sekadar model yang mencoba mengejar ChatGPT. Karakternya sudah terbentuk sendiri, terutama saat tugasnya bergantung pada pemahaman manusia. Pesan ke tetangga terdengar seperti yang benar-benar akan dikirim orang, penjelasan pesawat pas untuk anak 10 tahun, dan ide aplikasinya menunjukkan pemahaman soal kenapa orang berhenti memakai aplikasi yang butuh terlalu banyak usaha manual.
ChatGPT-6 tetap lebih kuat saat prompt menuntut perencanaan cermat dan kepatuhan pada batasan praktis. Untuk pengguna yang butuh asisten menulis pesan personal atau menjelaskan konsep ke audiens spesifik, Meta Muse layak dicoba. Untuk perencanaan anggaran dan logistik, ChatGPT-6 masih jadi pilihan utama.