ChatGPT vs Gemini: Duel Foto AI, Siapa Lebih Jago?

JogloNesia – Jagat media sosial belakangan ini diramaikan oleh kreasi gambar yang dihasilkan oleh kecerdasan buatan (AI) berbasis *text-to-image*. Karya-karya visual ini kemudian membanjiri berbagai platform, mulai dari Instagram, Facebook, hingga X (dulu Twitter), memicu rasa ingin tahu dan kekaguman.

Advertisements

Dua platform AI yang cukup populer di kalangan warganet untuk menghasilkan gambar adalah ChatGPT dan Google Gemini. Keduanya menawarkan kemudahan dalam menciptakan visualisasi dari deskripsi tekstual.

Menariknya, banyak dari gambar yang dihasilkan terlihat begitu nyata. Detail seperti ekspresi wajah, tone warna kulit, pori-pori, kerutan, hingga pencahayaan, hampir menyerupai foto asli yang diambil menggunakan kamera ponsel atau kamera digital profesional.

Baca juga: Viral di Medsos, Gambar AI Realistis yang Dibuat dengan Gemini, Ini Caranya

Advertisements

Bahkan, ada beberapa foto yang nyaris tidak menampilkan “vibe” AI, sehingga semakin sulit dibedakan dari foto asli. Hal ini tentu menimbulkan pertanyaan, seberapa realistis sebenarnya hasil foto yang dihasilkan oleh *chatbot* AI ini?

Untuk menjawab rasa penasaran tersebut, tim KompasTekno melakukan uji coba langsung terhadap dua generator gambar AI populer, yaitu ChatGPT dan Gemini. Lalu, seperti apa perbandingan hasilnya? Mari kita simak bersama.

Hasil Gambar dari ChatGPT

Dari hasil uji coba yang dilakukan KompasTekno, terlihat bahwa Gemini dan ChatGPT memiliki ciri khas dan hasil olah gambar yang berbeda. Kami mengambil lima sampel gambar dari masing-masing platform untuk dibandingkan secara mendalam.

Dimulai dari ChatGPT, ketika diberikan perintah (prompt) untuk membuat gambar, *chatbot* besutan OpenAI ini mampu menghasilkan visual yang realistis dengan kontras yang cukup tinggi. Pencahayaannya pun dirancang sedemikian rupa sehingga wajah karakter nyaris menyerupai manusia asli.

ChatGPT juga mampu membedakan posisi objek sesuai dengan prinsip fotografi. Objek di depan dibuat fokus dan jernih, sementara latar belakang dibuat sedikit buram dengan efek bokeh yang menambah nilai estetika.

Baca juga: Fitur Baru ChatGPT: Baca Dokumen di Cloud dan Bikin Rangkuman Rapat

Perpaduan pencahayaan, warna, komposisi, dan elemen foto lainnya tampak menyatu dan saling melengkapi. Detail tambahan seperti bayangan, bercak keringat, dan minyak di wajah semakin menambah kesan realistis pada gambar.

Namun, ada beberapa kekurangan yang ditemukan. Beberapa hasil foto AI dari ChatGPT menampilkan pose dan senyuman yang terasa kaku. Selain itu, warna yang digunakan cenderung terlalu mencolok dan penuh detail, sehingga mengurangi kesan alami.

Beberapa postur dan ukuran tubuh juga terasa kurang seimbang. Ada beberapa foto yang menampilkan kepala dengan proporsi yang tidak sesuai dengan ukuran badan. Tatapan mata pada karakter yang menghadap kamera juga tampak kosong dan kurang hidup.

KompasTekno mencoba membuat gambar lain dengan prompt yang sama. Hasilnya, ChatGPT hanya mengubah wajah karakter dan sedikit memodifikasi sudut pengambilan gambar.

Secara keseluruhan, hasil gambar dari ChatGPT terasa kurang ekspresif dan minim kreativitas. Dari lima sampel yang dibuat, jenis gambarnya cenderung seragam tanpa ada kreasi baru yang signifikan.

Baca juga: Beda Cara Gen Z dan Milenial Pakai ChatGPT, Bos OpenAI Mengungkap

Upaya untuk mengakali dengan membuka ruang percakapan baru (new chat) pun tidak membuahkan hasil yang berbeda. Hasilnya tetap serupa, identik, dan tidak menunjukkan variasi yang berarti.

Hasil Gambar dari Gemini

Beralih ke Google Gemini, platform ini menurut kami mampu menghasilkan gambar yang lebih ekspresif, kreatif, dan tetap mempertahankan kualitas realistis.

Dibandingkan dengan ChatGPT, Gemini memang menghasilkan gambar yang tidak terlalu detail dan kontras. Namun, dengan mengurangi dua elemen tersebut, hasil gambar yang dihasilkan justru tampak lebih nyata dan “manusiawi”.

Untuk foto pertama dan kedua, menurut penilaian KompasTekno, keduanya nyaris tidak bisa dibedakan dengan foto asli yang diambil menggunakan *smartphone*.

Hasil gambarnya tidak memiliki pencahayaan berlebih seperti *flashlight* yang sering ditemukan pada hasil ChatGPT. Meskipun hasilnya lebih redup, detail gambar dan postur yang dihasilkan tetap menyerupai manusia asli.

Penggunaan warnanya juga nyaman dipandang, sehingga perpaduan antara objek dan latar belakang tampak menyatu secara harmonis.

Baca juga: Google Ingin AI Gemini Lebih Membumi, Ini Strateginya

Tidak hanya itu, Gemini juga menunjukkan hasil yang lebih kreatif dengan mampu menghasilkan lima sampel foto dengan gaya, pose, dan lokasi yang berbeda-beda.

Berbeda dengan ChatGPT yang cenderung terpaku pada satu posisi dan pose saja, Gemini berani bereksperimen dengan berbagai sudut pengambilan gambar, seperti *medium close-up* dan *full body*. Selain itu, variasi wajah karakter layaknya manusia asli dan senyuman yang tidak kaku juga menjadi nilai tambah.

Namun, ada satu kekurangan yang ditemukan. Untuk foto sampel keempat, Gemini menghasilkan foto dengan kualitas yang terlalu tinggi dan terlalu halus, sehingga gambar tersebut justru tampak seperti hasil rekayasa.

Dalam dunia nyata, memotret di konser adalah tantangan tersendiri karena minimnya cahaya dan potensi munculnya bintik warna (noise). Penonton biasanya hanya mengandalkan pencahayaan dari panggung atau lampu sorot.

Baca juga: Hasil Foto Konser NCT 127 Taipei dengan Galaxy S25 Ultra dari Jarak 100 Meter

Jika hasilnya terlalu jernih, terang, dan bebas dari noise, gambar akan memberikan kesan palsu dan telah melalui proses pengeditan yang berlebihan. Hasilnya pun tidak lagi terasa seperti foto asli.

Cara Menghasilkan Gambar AI yang Realistis

Untuk menciptakan gambar melalui tulisan (text-to-image), Anda membutuhkan prompt berbasis teks. Semakin detail prompt yang Anda berikan, semakin baik pula hasil foto yang akan dihasilkan.

Jika Anda ingin membuat foto AI yang realistis, Anda bisa menggunakan prompt yang kami gunakan dalam uji coba di atas. Meskipun menggunakan prompt yang sama, kemungkinan besar gambar yang dihasilkan akan berbeda-beda.

Anda juga bisa melakukan modifikasi sesuai dengan selera atau kebutuhan Anda. Berikut adalah contoh teks prompt yang bisa Anda salin (copy) ke ChatGPT, Google Gemini, atau *tools* AI lainnya:

*Buat gambar yang sangat realistis seorang wanita muda Indonesia berusia 20-an, yang memiliki tinggi badan 155 cm dengan bobot sekitar 54 kg. Dia memiliki kulit kuning langsat dan rambut lurus hitam pendek sebahu. Dia sedang menonton konser musik K-pop pada gelanggang yang megah di malam hari. Ia mengenakan crop jacket denim warna biru muda dipadukan dengan kaos putih, serta rok mini hitam, dan sneakers putih. Di tangannya tergenggam lightstick bergemerlap dengan warna yang terus berubah. Wajahnya menunjukkan ekspresi gembira dan kagum, dengan mata berbinar. Di wajahnya, terdapat makeup natural, blush on merah muda di pipi, lip tint merah muda glossy, dan sedikit highlighter di tulang pipi yang memantulkan cahaya lampu. Di pergelangan tangannya tampak memakai jam. Latar belakang memperlihatkan panggung konser besar dengan layar LED raksasa, lampu sorot, asap panggung, dan kerumunan penonton yang mengangkat lightstick dan banner. Beberapa balon dan confetti beterbangan di udara. Suasana penuh warna, energi, dan sorakan antusias yang menggambarkan kemeriahan konser secara hidup. Foto ini diambil dengan kamera HP berukuran 9:16 dan fokus tertuju pada wanita. Sudut pengambilan dari depan full body dengan wajah wanita menghadap lurus ke kamera. Lighting alami dari panggung dan cahaya LED konser menciptakan pantulan dramatis di wajah dan mata, menonjolkan ekspresi kagumnya. Efek cahaya berwarna magenta dan biru dari lampu sorot menciptakan kilauan pada rambutnya dan memperjelas kontur wajahnya. Terdapat sedikit lens flare dari cahaya lampu panggung di sisi atas gambar, memperkuat nuansa konser yang semarak. Fokus dan eksposur disesuaikan untuk menampilkan detail kulit, riasan, dan tekstur pakaian dengan sangat jelas, sekaligus menjaga atmosfer gemerlap konser tetap nyata dan memukau.*

Penting untuk diingat, gunakanlah gambar AI dengan bijak. Hindari penggunaan gambar atau foto AI untuk tujuan yang merugikan, seperti penipuan, peniruan identitas, penyebaran fitnah, atau tindakan kriminal lainnya.

Baca juga: Cara Bikin Foto AI Main PS Bareng Artis via ChatGPT yang Ramai di Medsos

Setiap foto yang dihasilkan oleh AI biasanya akan memiliki *watermark* yang menandakan bahwa foto tersebut merupakan hasil rekayasa *tools* AI.

Selain itu, akan lebih baik jika Anda memberikan penjelasan bahwa foto atau gambar yang Anda unggah merupakan hasil olahan AI. Hal ini bertujuan untuk menghindari kesalahpahaman dan menjaga transparansi.

Itulah penjelasan mengenai cara membuat gambar realistis AI melalui Gemini dengan mudah. Selamat mencoba dan berkreasi!

Ringkasan

Dua platform AI populer, ChatGPT dan Google Gemini, memungkinkan pembuatan gambar realistis dari teks yang membanjiri media sosial. Tim KompasTekno menguji keduanya untuk membandingkan hasilnya. ChatGPT menghasilkan visual realistis dengan kontras tinggi dan pencahayaan baik, namun sering menampilkan pose kaku, warna terlalu mencolok, proporsi tubuh tidak seimbang, dan mata kosong. Hasilnya cenderung kurang ekspresif dan minim variasi.

Google Gemini dinilai lebih unggul dalam menghasilkan gambar ekspresif, kreatif, dan tetap realistis, bahkan sering sulit dibedakan dari foto asli. Gemini mampu berkreasi dengan beragam gaya, pose, dan lokasi, menghasilkan wajah karakter bervariasi serta senyuman alami. Meskipun detailnya tidak setinggi ChatGPT, Gemini menghasilkan gambar yang lebih “manusiawi” dengan pencahayaan alami. Namun, kekurangannya adalah potensi foto yang terlalu jernih hingga terlihat seperti rekayasa, khususnya pada kondisi minim cahaya.

Advertisements