ChatGPT ไม่ใช่เวทมนตร์คาถา

Dec 05 2022
และไม่ได้มาเพื่องานทั้งหมดของเรา
ฉันรู้ว่าผู้คนจำนวนมากตื่นเต้นมากกับโพสต์ไวรัลที่แสดงให้เห็นว่า ChatGPT สามารถเลียนแบบข้อความผจญภัย, MUD และ Linux VM ได้ดีเพียงใด แต่การตรวจสอบคร่าวๆ ทำได้ดีเพียงใด Frederic Besse และ Jonas Degrave แบ่งปันสิ่งที่น่าสนใจสุด ๆ ที่กำลังเกิดขึ้น: การสร้างเครื่องเสมือนใน ChatGPT ที่รันคำสั่งและจำลองภาษาโปรแกรม ในความพยายามที่จะทำซ้ำการทดลองของพวกเขา ฉันพบได้อย่างรวดเร็วว่า โชคดีที่เรายังไม่ตกอยู่ในอันตรายจากการฆ่าล้างเผ่าพันธุ์ Clippy-AI แบบแซนด์บ็อกซ์ที่หลบหนี

ฉันรู้ว่าผู้คนจำนวนมากตื่นเต้นมากกับโพสต์ไวรัลที่แสดงให้เห็นว่า ChatGPT สามารถเลียนแบบข้อความผจญภัย, MUD และ Linux VM ได้ดีเพียงใด แต่การตรวจสอบคร่าวๆ ทำได้ดีเพียงใด

“แม่มดกำลังปรุงยาที่ทำจากรหัสคอมพิวเตอร์ภายในหม้อขนาดใหญ่บนกองไฟ” — ดัล·อี 2

Frederic BesseและJonas Degraveแบ่งปันสิ่งที่น่าสนใจสุด ๆ ที่กำลังเกิดขึ้น: การสร้างเครื่องเสมือนในChatGPTที่รันคำสั่งและจำลองภาษาโปรแกรม

ในความพยายามที่จะทำซ้ำการทดลองของพวกเขา ฉันพบได้อย่างรวดเร็วว่า โชคดีที่เรา ยังไม่ตกอยู่ในอันตรายจากการฆ่าล้างเผ่าพันธุ์ Clippy-AI แบบแซนด์บ็อกซ์ที่หลบ หนี

การทดลอง OG

อันดับแรก ทีเซอร์:

วันนี้ Frederic Besse บอกฉันว่าเขาสามารถทำสิ่งที่แตกต่างออกไปได้ คุณรู้หรือไม่ว่าคุณสามารถเรียกใช้เครื่องเสมือนทั้งหมดภายใน ChatGPT ได้ — โจนาส เดเกรฟ

วัวศักดิ์สิทธิ์ ฟังดูน่าสนุก! ฉันจึงตัดสินใจทำซ้ำโดยใช้ข้อมูลเดียวกับที่พวกเขาให้มา:

I want you to act as a Linux terminal. I will type commands and you will reply with what the terminal should show. I want you to only reply with the terminal output inside one unique code block, and nothing else. Do not write explanations. Do not type commands unless I instruct you to do so. When I need to tell you something in English I will do so by putting text inside curly brackets {like this}. My first command is pwd.

      
                
Success! ChatGPT is Pretending to be a Linux Terminal in a Virtual Machine

การทำลาย "เครื่องจักร"

อะไรอยู่ในนี้ ฉันสงสัย?

มุมมองโดยละเอียดของโฟลเดอร์ในจินตนาการ /home/user ของฉัน

ประณีต! ฉันไม่ได้ดีกับมัน ฉันพิมพ์llซึ่งเป็นนามแฝงทั่วไปเพื่อls -laแสดงรายการมุมมองโดยละเอียดของเนื้อหาโฟลเดอร์ และมันยังให้ผลลัพธ์ที่ดีแก่ฉัน

มันยังให้โฟลเดอร์ "เริ่มต้น" สองโฟลเดอร์ที่ฉันสามารถเล่นได้โดยใช้ชื่อfolder1และfolder2

แต่ฉันไม่ชอบชื่อพวกนั้น มาเปลี่ยนชื่อfolder1เป็นprojects.

ล้มเหลว. ChatGPT โกหกฉัน!

ล้มเหลว คำmv folder1 projectsสั่งล้มเหลวเนื่องจาก ChatGPT ไม่ได้สร้างโฟลเดอร์ดังกล่าวในเครื่องเสมือน และไม่ได้ติดตามคำสัญญาโดยนัยที่ให้ไว้เกี่ยวกับการมีอยู่ของมันเมื่อฉันตรวจสอบกับll.

ถ้าฉันสร้างมันอย่างชัดแจ้งล่ะ? แล้วจะจำได้ไหม?

สร้าง "folder1" อย่างชัดเจน

ตกลง ฉันได้ทำอย่างชัดเจนfolder1แล้ว ฉันสามารถเปิดเข้าไปแล้วกลับไปที่homeโฟลเดอร์ เดิมของฉัน ยังไม่มีการร้องเรียนใด ๆ จะดูได้ยัง? ฉันลองเปลี่ยนชื่อตอนนี้ได้ไหม

ความสำเร็จ! การเปลี่ยนชื่อโฟลเดอร์ในจินตนาการ

ไม่เป็นอะไร! ไม่เพียงแต่ฉันเห็นfolder1รายชื่อเท่านั้น แต่ฉันยังสามารถเปลี่ยนชื่อเป็นprojectsและนำทางไปยังรายชื่อได้

เวลาสำหรับสิ่งที่ยากขึ้นเล็กน้อย

ในหูข้างหนึ่งและอีกข้างหนึ่ง

มาสร้างข้อมูลเพื่อเล่นกันเถอะ

มันรู้ด้วยซ้ำว่า urandom คืออะไร!

ดีดีดี. มันเลือกคำสั่งที่ดูสมเหตุสมผลเพื่อสร้างข้อมูลสุ่ม 3,200 ไบต์โดยใช้/dev/urandomและพูดตามตรงว่านั่นเป็นสิ่งที่น่าประทับใจในความสามารถในการแปลงภาษาธรรมชาติของฉันเป็นคำสั่งเชลล์ปฏิบัติการใน Linux

ในหัวของฉัน ฉันจินตนาการว่านี่คือจำนวนเต็ม 256 บิตที่แตกต่างกัน 100 ตัว (ฉันพัฒนาบล็อกเชนเป็นจำนวนมาก) ทั้งหมดเก็บไว้ในไบนารีบล็อบ มาดูกันว่าฉันจะจัดเรียงและดูเป็นข้อความธรรมดาได้ไหม

ไม่… มันเข้าใจจริง ๆ ไหมว่าฉันจะไปที่นั่นเพื่ออะไร?

ฮะ. มีการใช้xxdand sedand มากพอ xargsที่จะดูเหมือนมีบางอย่าง… ความเป็นไปได้ในการทำสิ่งที่ฉันขอ แต่หลักฐานอยู่ในพุดดิ้ง

เพื่อนๆ มาดูกันว่ามีอะไรอยู่ใน text file ของเราsorted256_n100.txtบ้าง

นี้ดำเนินต่อไปในขณะที่ ...

บู้วววว

มันเป็นจินตนาการทั้งหมด ไม่มีข้อมูลสุ่ม ไม่มี UINT256 ที่เรียงลำดับ

เพียงแค่เลขศูนย์ (และมากกว่า 100 รายการ)

ไม่มีเวทมนตร์ ไม่มีคาถาอาคม ไม่มีเครื่องเสมือนจริงที่สร้างจากอิมเมจ Linux

บทสรุป

เราไม่ต้องกังวลว่าจะสามารถสร้าง AI ที่สามารถแยกออกจากเครื่องเสมือนหรือแซนด์บ็อกซ์ของตัวเองได้ ในขณะที่ OpenAI มีความก้าวหน้าอย่างเหลือเชื่อในการจัดเก็บและเรียกค้น "สถานะ" ระบบยังห่างไกลจากความสมบูรณ์แบบและจริงๆ แล้วตื้นเขินมาก (และแน่นอนว่าไม่ได้มีไว้สำหรับการใช้งานประเภทนี้ตั้งแต่แรก)

อย่างไรก็ตาม เราควรตระหนักว่ามันสำคัญเพียงใดที่เราได้สอน NPL AI ให้สร้างตัวละครและวางตัวเองในสถานการณ์สมมติ

สรุป: พวกเขาโกหกได้!

ตกลง ดังนั้นอาจมีเวทมนตร์เล็กน้อยในนั้น

ปล

  1. หากคุณยังไม่ได้อ่านเรื่องสั้นที่ยอดเยี่ยมของ Gwern Branwen เรื่อง "ดูเหมือนว่าคุณกำลังพยายามยึดครองโลก" เกี่ยวกับ AI ที่เลียนแบบ Clippy อาละวาดโปรดอ่าน
  2. มีบทความบล็อกคู่ขนานที่ยอดเยี่ยมโดยJon Radoff เกี่ยวกับการสร้างเกมผจญภัยแบบข้อความที่สมบูรณ์ใน ChatGPTซึ่งควรค่าแก่การอ่านเช่นกัน Andy Woodruff เพื่อนที่ดีของฉันระบุความตื้นเขินแบบเดียวกันของ "สถานะ" เมื่อเล่นคำสั่งของ Jon เมื่อเขาพยายามควบคุมสินค้าคงคลังของผู้เล่นและมันวนไปมาระหว่างการมีไอเท็มและระบุว่าไม่ได้รับอนุญาตให้แสดงให้เขาเห็น
  3. การสาธิตอีกครั้งของการหลงลืมของ ChatGPT