Memahami ChatGPT dan Implikasi Revolusionernya

Dec 18 2022
Kita semua pernah mendengar tentang Chatbots, benar; mereka payah, dan mereka adalah lelucon. Tetapi bagaimana jika chatbot berfungsi dan dipahami serta menjawab? Bayangkan memiliki program yang dapat memberi Anda penelitian investasi, menghasilkan dan men-debug kode, dan membuat bot Twitter untuk Anda ketika Anda tidak memiliki pengetahuan tentang pengkodean, membuat rencana penurunan berat badan, dukungan kesehatan mental, pemasaran, dan spesialis SEO, menulis esai, dan banyak lagi.

Kita semua pernah mendengar tentang Chatbots, benar; mereka payah, dan mereka adalah lelucon. Tetapi bagaimana jika chatbot berfungsi dan dipahami serta menjawab? Bayangkan memiliki program yang dapat memberi Anda penelitian investasi, menghasilkan dan men-debug kode, dan membuat bot Twitter untuk Anda ketika Anda tidak memiliki pengetahuan tentang pengkodean, membuat rencana penurunan berat badan, dukungan kesehatan mental, pemasaran, dan spesialis SEO, menulis esai, dan banyak lagi. Ini sekarang menjadi kenyataan dengan program bernama ChatGPT , yang dirilis pada 30 November 2022, dan dapat mengubah pekerjaan satu orang menjadi produktivitas 10 orang. Di blog ini, saya akan membahas secara singkat tentang teknologi dan apa artinya ini bagi dunia pada umumnya.

OpenAI (perusahaan di belakang chatGPT) telah menerima dana dan dukungan yang signifikan untuk pekerjaannya pada ChatGPT dan model bahasa AI lainnya. Pada tahun 2021, ia mengumpulkan $1 miliar dalam putaran pendanaan yang dipimpin oleh Microsoft , yang telah menjadi mitra penting dalam mengembangkan ChatGPT dan proyek OpenAI lainnya. Selain Microsoft, OpenAI juga telah menerima dana dari perusahaan teknologi dan investor besar lainnya, termasuk Nvidia, Sam Altman, dan Elon Musk. Sejak dirilis, ini telah menjadi fenomena internet, dan hanya dalam lima hari setelah dirilis, telah melampaui 1 juta pengguna. Kemampuan untuk mengajukan pertanyaan terbuka dan menerima jawaban yang tidak diberi kode tangan memiliki pasar dengan permintaan yang hampir tidak terbatas.

BAGAIMANA ITU BEKERJA?
ChatGPT adalah versi perbaikan dari GPT-3 , yang oleh OpenAI disebut GPT-3.5. GPT-3 dilatih untuk miliaran kata di internet, dan saat membuat teks, ia mencoba memprediksi kata berikutnya dalam kalimat tertentu. Masalah dengan model bahasa GPT-3 adalah mereka dapat melakukan tugas bahasa alami. Namun, itu tidak memfilter kata-kata yang tidak benar dan beracun atau mencerminkan sentimen yang berbahaya. Sebuah teknik yang disebut pembelajaran penguatan dari umpan balik manusia(RLHF) digunakan untuk membuat model di GPT-3 lebih aman. Singkatnya, mereka telah menambahkan umpan balik manusia ke dalam proses pelatihan. Intinya, selama pelatihan, berbagai versi respons diberi peringkat oleh manusia dari yang terbaik hingga yang terburuk, dan ketika AI meningkat dengan sendirinya, itu diberi penghargaan secara digital. Data ini digunakan untuk menyempurnakan GPT-3. Model InstructGPT yang dihasilkan jauh lebih baik dalam mengikuti instruksi daripada GPT-3. Mereka juga lebih jarang mengarang fakta dan menunjukkan sedikit penurunan produksi racun. Metode ini menghasilkan model bahasa AI yang seratus kali lebih kecil dari GPT-3 tetapi berkinerja lebih baik. Terobosan sebenarnya adalah manusia yang terlibat dalam proses pelatihan.

metode

Pertama, kumpulan data demonstrasi yang ditulis oleh manusia tentang permintaan dikirim ke API dan digunakan untuk melatih baseline pembelajaran yang diawasi. Selanjutnya, kumpulan data perbandingan berlabel manusia antara dua keluaran model pada kumpulan permintaan API yang lebih besar dikumpulkan. Kemudian model hadiah (RM) pada kumpulan data ini dilatih untuk memprediksi keluaran mana yang lebih disukai pemberi label. Terakhir, mereka menggunakan RM ini sebagai fungsi hadiah dan menyempurnakan kebijakan GPT-3 untuk memaksimalkan hadiah ini menggunakan algoritme PPO .

Dalam grafik berikutnya, peringkat Kualitas semua model yang diberikan terhadap ukuran model, dan jelas bahwa InstructGPT menang dengan selisih yang jelas. Dibandingkan dengan GPT-3, InstructGPT menghasilkan lebih sedikit kepalsuan tiruan (menurut TruthfulQA17) dan kurang beracun (menurut RealToxicityPrompts18).

Untuk mengetahui lebih detail tentang pekerjaan dan hasil organisasi OpenAI di ChatGPT, silakan kunjungi blog resmi mereka . Mereka telah menjelaskan banyak tentang cara kerja model dari perspektif teknis.

MENGAPA POPULARITAS INI?
Di sini saya akan memberikan beberapa contoh dan membiarkan Anda menjadi hakim.

a) Beberapa pengguna menulis di Twitter bahwa chatGTP bekerja lebih baik daripada antarmuka obrolan kesehatan mental yang pernah mereka gunakan. Contoh tangkapan layar disediakan.

Tangkapan layar Twitter

b) Berikut ini adalah contoh seseorang yang membimbing individu dengan keterampilan literasi yang buruk. Dia membuat akun Gmail bertenaga GPT yang mengubah tulisan buruk kliennya menjadi teks profesional.

Tangkapan layar Twitter

c) Contoh lain termasuk pengguna yang menggunakan chatgpt untuk mendapatkan bantuan terkait masalah kesehatannya. Rupanya, chatgpt dapat menyarankan rencana perawatan berdasarkan keberhasilan dan kegagalan masa lalu dari masalah pasien dan masalah saat ini.

Tangkapan layar Twitter

Pengguna lain meminta AI untuk menjadi pelatih pribadinya. Mengingat berat dan usianya, dia menghitung pengeluaran energinya, memberikan penjelasan, dan kemudian menanyakan berapa banyak kalori yang harus dia hilangkan setiap hari untuk menurunkan enam kilogram. Itu kemudian membuat rencana makan tentang bagaimana mencapainya dalam tiga bulan dan bagaimana memasaknya.

d) Sebagai seorang insinyur perangkat lunak, saya sendiri mencoba ini pada beberapa masalah kode untuk mengujinya. Awalnya, saya mencoba beberapa hal front-end sederhana, dan hasilnya luar biasa. Itu memberi saya langkah-langkah dan kode contoh yang berhasil, tetapi ketika masalahnya menjadi, itu mulai memberikan keluaran yang salah dengan percaya diri. Saya mencoba beberapa pertanyaan tingkat menengah leetcode, dan mereka gagal total, menandakan ini jelas merupakan bantuan tetapi bukan pengganti untuk insinyur perangkat lunak.

Masukan (Gambar frontend)
Output dari kode yang dihasilkan (Frontend)

e) ChatGPT dapat membentuk opini tentang topik tertentu atas permintaan pengguna, yang menurut saya tidak dapat dilakukan oleh mesin pencari. Tapi ini baru permulaan; ada lebih dari ini. Ada laporan bahwa beberapa orang menggunakan chatGPT untuk menyontek saat ujian. Karenanya saat sistem AI menyusup ke masyarakat, mungkin pemikiran kritis akan lebih dihargai.

Contoh tangkapan layar

MENGAPA KITA TIDAK BISA MEMILIKI SEMUANYA DI SMARTPHONE KITA?
Jadi pertanyaannya memohon untuk ditanyakan mengapa kita semua tidak bisa memiliki layanan ini di smartphone kita sekaligus? Seorang karyawan ALPHABET, yang menghadiri pembicaraan internal Google tentang model bahasa besar, mengungkapkan bahwa sistem ini memerlukan daya komputasi yang besar, dan mungkin gratis untuk beberapa juta pengguna. Tetap saja, tidak mungkin untuk menskalakannya menjadi satu miliar permintaan per hari. Layanan akan terlalu mahal, dan latensi akan terlalu tinggi. Saat ini, satu pencarian AI menambahkan hingga sepuluh hingga seratus kali lipat biaya pencarian Google biasa. Menurut Sam Altman, CEO OpenAI, biaya pencarian tunggal dalam satu digit, dan dengan asumsi itu 5 sen per pencarian, dan google melakukan 8,5 miliar pencarian per hari, ini berarti tagihan 425 juta dolar per hari .

KETERBATASAN
ChatGPT, tidak peduli seberapa menarik tampilannya, masih dalam tahap awal. Ada banyak kasus di mana ia memberikan penjelasan yang salah dan agak berbahaya untuk pertanyaan tersebut. Ini adalah masalah dengan model bahasa terbuka apa pun; sulit dipertahankan karena sifatnya yang tidak dapat diprediksi.
Ada contoh seperti AI yang membuat atau menyusun situs web lengkap yang terlihat seperti New York Times. AI akan menulis artikel lengkap menggunakan tweet sebagai petunjuknya. Pengguna lain memutuskan untuk mendorong batas keamanan dan bertanya kepada AI bagaimana cara membuat bom molotov, dan itu dapat memberikan proses langkah demi langkah untuk melakukannya. Ini jelas merupakan pelanggaran terhadap kebijakan konten open ai. Selain itu, ada contoh kegagalan dalam pertanyaan faktual, seperti terkadang berhalusinasi jawaban yang koheren tetapi tidak masuk akal; misalnya, salah satu pengguna bertanya mana yang lebih berat, satu kilogram daging sapi atau satu kilogram udara terkompresi. AI mengatakan bahwa daging sapi lebih berat dan memberikan penjelasan yang meyakinkan. Karenanya ini adalah contoh mengapa benda ini tidak boleh digunakan untuk hal yang penting.

Tangkapan layar Twitter

Kesalahan satu kilogram ini tidak terjadi pada saya secara pribadi, tetapi pada umumnya, itu berarti begitulah cara kerja model bahasa ini: mereka dapat mengatakan hal-hal aneh secara acak. ChatGPT terdengar terlalu bertele-tele ketika dikatakan tidak mampu melakukan sesuatu, dan pertanyaan yang sama ditanyakan dengan cara lain; itu hanya berjalan ke depan dan melakukannya.

Jawaban salah (ChatGPT menjelaskan Abacus lebih cepat dari GPU)

BAGAIMANA DENGAN MANUSIA ?
Kita bisa melihat seniman profesional mulai panik karena seni yang dihasilkan AI sangat sulit dibedakan dari seni profesional. Ini dapat menurunkan nilai pasar seni dengan meningkatkan pasokan. Pekerjaan kerah putih berikutnya mungkin dalam bahaya karena seiring dengan peningkatan AI, ada kemungkinan besar bahwa lebih sedikit pekerja yang dibutuhkan di berbagai bidang.
Sejauh menyangkut perusahaan baru berikutnya, mereka dapat menggunakan model AI besar ini dan menyetelnya untuk tujuan mereka, seperti kedokteran, hukum, dll. Hal ini dikatakan oleh Sam Altman, CEO sistem OPEN AI, bahwa akan ada beberapa perusahaan yang akan melatih/mengendalikan AI model besar. AI yang sama yang memahami 98% dari apa pun yang ditanyakan memiliki pengetahuan dan penalaran umum; ia dapat memahami dunia dan kejadian-kejadiannya. Di atas lapisan dasar ini, startup baru akan menggunakan lapisan dasar ini untuk memberikan kekuatan di industri spesifik mereka. Mereka dapat men-tweak lapisan dasar untuk menjadi raja bidang khusus mereka.

Tangkapan layar penjelasan dari saluran youtube Coldfusion

Tapi semua ini pernah dikatakan, menurut saya AI tidak bisa mengalahkan manusia dalam segala hal. Hanya ada beberapa hal yang kita butuhkan dari manusia.

KESIMPULAN
Jadi, kesimpulannya, ChatGPT terbatas, membuat kesalahan, dan tidak layak dalam skala besar saat ini, tetapi yang jelas, ini adalah puncak ke masa depan. Itu telah menunjukkan janji dan tanda-tanda yang jelas untuk munculnya industri multi-miliar dolar. Jika Microsoft, penyandang dana terbesar dalam proyek tersebut, menemukan cara untuk menskalakan sistem dan mengintegrasikannya ke dalam browser pencarian Bing, itu mungkin bukan pertanda baik bagi Google. Sekali lagi, semua yang dikatakan, ini dapat dilihat sebagai terobosan besar, dan kita melampaui era informasi dan memasuki era pengetahuan.

Terima kasih sudah membaca; Saya harap ini membantu. Jika Anda ingin membahas topik lebih lanjut, hubungkan melalui LinkedIn / Instagram .