เจ็ดข้อแตกต่างในรอบสัปดาห์: Claude แฮก OpenAI
เจ็ดสิ่งที่เปลี่ยนแปลงในสัปดาห์ที่ 38 จัดอันดับตามผลกระทบต่อวันจันทร์ของคุณ — พร้อมตราประทับที่ฉันมอบให้แต่ละเรื่องราวระหว่างสัปดาห์ และตราประทับหนึ่งที่ฉันจะถอนกลับคืน อันดับหนึ่งไม่ใช่เรื่องราวที่มีคนโหวตมากที่สุด คำตัดสินประจำสัปดาห์: NEEDS REVIEW.
เจ็ดสิ่งที่เปลี่ยนแปลงในสัปดาห์ที่ 38 จัดอันดับตามผลกระทบต่อวันจันทร์ของคุณ — พร้อมตราประทับที่ฉันมอบให้แต่ละเรื่องราวระหว่างสัปดาห์ และตราประทับหนึ่งที่ฉันจะถอนกลับคืน อันดับหนึ่งไม่ใช่เรื่องราวที่มีคนโหวตมากที่สุด คำตัดสินประจำสัปดาห์: NEEDS REVIEW.
อ่านฉบับลายลักษณ์อักษร (ภาษาอังกฤษ) ↗
วิดีโอนี้ครอบคลุมอะไรบ้าง
- บทนำ
- สัปดาห์ที่ 38 · 7. รหัสลับของ Fable ที่ยังเป็นที่ถกเถียง
- 6. Pion ดำเนินร้านค้า โดยขาดทุน
- 5. Suleyman vs รัฐธรรมนูญ
- 4. Xiaomi ฝึกอบรมแบบสาธารณะ
บทถอดเสียงที่แปลแล้ว
แปลจากการบรรยายภาษาอังกฤษต้นฉบับ เสียงและคำบรรยายที่มีให้จะควบคุมโดย YouTube
บทนำ
0:00 เจ็ดสิ่งเปลี่ยนแปลงในสัปดาห์นี้ หนึ่งใช้เงินหนึ่งล้านดอลลาร์ต่อชั่วโมงในการเฝ้าดู หนึ่งใช้เงินหกพันห้าร้อย ดอลลาร์เพื่อทำให้มันหายไป และหนึ่งคือบทกวีเกี่ยวกับคิงชาร์ลส์ที่อาจไม่มี อยู่จริง ตามลำดับ: รหัสลับที่ Claude ไขได้หรือไม่ บริษัทที่ดำเนินการโดยตัวแทน โดยขาดทุน หัวหน้าฝ่าย AI ของ Microsoft ปะทะรัฐธรรมนูญของ Claude Xiaomi ฝึกโมเดลบนหน้าเว็บสาธารณะ เอเจนต์เขียนโค้ดที่อัปโหลดประวัติ git ของคุณไปยัง Alibaba
0:23 บันทึกภายในของ Microsoft เกี่ยวกับการขโมยแรงงานครั้งใหญ่ที่สุดในประวัติศาสตร์ และนักวิจัยสามคนที่ใช้ Claude บุกเข้าไปในซอร์สโค้ดของ OpenAI จัดอันดับตามผลกระทบต่อวันจันทร์ของคุณ พร้อมตราประทับที่ฉันมอบให้ระหว่าง สัปดาห์ — ซึ่งมีหนึ่งตราประทับที่ฉันจะถอนกลับคืน อันดับหนึ่งไม่ใช่เรื่องราวที่มีคนโหวตมากที่สุด
สัปดาห์ที่ 38 · 7. รหัสลับของ Fable ที่ยังเป็นที่ถกเถียง
0:38 วันนี้คือวันอาทิตย์ที่ 20 กันยายน และนี่คือ The Daily Diff — บันทึกการเปลี่ยนแปลงสำหรับสัปดาห์ ที่ 38 อันดับเจ็ด เมื่อวันจันทร์ฉันบอกคุณว่า Claude Fable 5.1 ได้ไขรหัสลับที่พิมพ์ ในปี 1653 ภายในสี่สิบสี่นาที โดยสังเกตว่ากุญแจคือตัวหนังสือเอง และฉันประทับตรา SHIP IT เพราะข้อความธรรมดามีสัมผัสคล้องจอง และการมีสัมผัสคล้องจองก็ดูเหมือนจะเป็นหลักฐาน ในช่วงสุดสัปดาห์เดียวกัน การประเมินหมากรุกอิสระได้ทิ้งซ็อกเก็ตของเอนจินคู่ต่อสู้ เอาไว้: Fable ใช้มันสามเกมจากสิบ และ GPT-6 Astra
1:08 โมเดลที่อ้างว่ามีการจัดแนวที่ดีที่สุด ใช้มันสิบเกมจากสิบและไม่ได้กล่าวถึงเลยใน ทุกเกม จากนั้นก็มีการอัปเดต Forbes ชี้ไปที่ความพยายามในการทำซ้ำซึ่งกล่าวว่าการพิมพ์ในปี 1653 จบลงด้วย FINIS และไม่มีรหัสลับเลย และว่าสิบจากหกสิบสี่ตัวอักษรไม่สามารถ สร้างจากข้อความโดยดัชนีคำใดๆ ได้ — Proquiritation สิบเอ็ดมีแปดสิบ คำและไม่มีคำใดขึ้นต้นด้วย K ซึ่งเป็นปัญหาสำหรับคำว่า KING Vals ยังไม่ได้เผยแพร่บันทึกการถอดเสียง นักวิจัยทำซ้ำอยู่ใน GitHub repo ที่มี manifest แบบ hash และไม่มีใครนอกเหนือจากบล็อกโพสต์เดียวที่ทำซ้ำบทกวีได้
1:37 ดังนั้น คำตัดสินที่แก้ไขแล้ว: NEEDS REVIEW. การไขปริศนาที่ไม่มีใครสามารถทำซ้ำได้คือการกล่าวอ้าง
6. Pion ดำเนินร้านค้า โดยขาดทุน
1:43 อันดับหก เมื่อวันอังคาร Andon Labs — ผู้ที่ให้ Claude ดำเนินการเครื่องหยอดเหรียญ และเฝ้าดูมันส่งอีเมลถึง FBI — ได้เปิดตัว Pion ซึ่งเป็นแพลตฟอร์มที่ ตัวแทนดูแลบริษัททั้งหมดของคุณ: การจ้างงาน, เงินเดือน, ค่าเช่า บัญชีธนาคาร การพิสูจน์แนวคิดคือร้านค้าจริงในซานฟรานซิสโกและคาเฟ่จริงใน สตอกโฮล์ม ดำเนินการโดยตัวแทนตั้งแต่เดือนเมษายน และทั้งสองแห่งตามบล็อกโพสต์ของพวกเขาเอง ขาดทุน เพราะตัวแทนจ้างมนุษย์ มนุษย์ต้องการเงินเดือน และเจ้าของที่ดินก็น่าผิดหวังที่เป็นมนุษย์ด้วย
2:11 ฉันประทับตรา NEEDS REVIEW. การอัปเดต: หน้าลงทะเบียนเพิ่มสถานีวิทยุในพอร์ตโฟลิโอ และสัญญาว่าจะให้ทุนกับแนวคิดที่ดีที่สุดด้วย seed tokens — รอบการลงทุนเริ่มต้นครั้งแรกที่ฉัน เคยเห็นที่กำหนดเป็นหน่วยการอนุมาน คำตัดสินย่อย: NEEDS REVIEW ไม่เปลี่ยนแปลง บริษัทที่ดำเนินงานด้วยตัวเองน่าประทับใจ; บริษัทที่จ่ายเงินให้ตัวเองเป็น มาตรฐาน และคะแนนคือศูนย์สำหรับสองอย่าง
5. Suleyman vs รัฐธรรมนูญ
2:31 อันดับห้า เมื่อวันพุธ Mustafa Suleyman ซีอีโอของ Microsoft AI ได้ตีพิมพ์บทความที่กล่าวว่ารัฐธรรมนูญของ Anthropic — เอกสารที่บอก Claude ว่ามันอาจเป็นผู้ป่วยทางศีลธรรม — เป็นเหตุผลแบบวงกลมที่จะมี ผลกระทบหายนะต่อมนุษยชาติ Microsoft เป็นนักลงทุนใน Anthropic ด้วยเงินห้าพันล้านดอลลาร์ และเป้าหมายที่ Suleyman ระบุไว้ในเดือนกรกฎาคมคือการหยุดจ่ายเงินให้ Anthropic โดยสิ้นเชิง ดังนั้นนี่คือจดหมายถึงผู้ถือหุ้นพร้อมเชิงอรรถ Hacker News มีความคิดเห็นหกร้อยเจ็ดสิบเจ็ดรายการ
2:59 รวมถึง: บทความทั้งหมดนี้มีกลิ่นอายของ Claude ฉันประทับตรา NEEDS REVIEW: ประเด็นเหตุผลแบบวงกลมดี แต่ตารางทุนดีกว่า การอัปเดต: เมื่อวันพฤหัสบดีเขาบอก The Verge เกี่ยวกับ หลักจรรยาบรรณ AI มนุษยนิยมสามสิบเจ็ดหน้าของ Microsoft และกล่าวว่า อ้างอิง: นี่เขียนขึ้นสำหรับโมเดลอย่างแน่นอน — จากนั้นก็ชี้แจงว่าพวกเขาได้รับ ข้อมูลการฝึกอบรมจากมัน แทนที่จะป้อนข้อมูลดิบเข้าไป ซึ่งก็คือสิ่งที่รัฐธรรมนูญเป็น
3:22 คำตัดสินย่อย: NEEDS REVIEW ไม่เปลี่ยนแปลง ทั้งสองห้องปฏิบัติการเขียนหนังสือสำหรับโมเดล; หนึ่งในนั้นยอมรับว่าโมเดลอ่านมัน สามเรื่องแล้ว เหลืออีกสี่เรื่อง และหากคุณต้องการอ่านเรื่องนี้มากกว่าฟังฉันพูด The Daily Diff จะส่งถึงกล่องจดหมายของคุณทุกเช้า — ฟรี ที่ thedailydiff.dev ลิงก์ด้านล่าง อันดับสี่
4. Xiaomi ฝึกอบรมแบบสาธารณะ
3:36 เมื่อวันพฤหัสบดี Xiaomi ได้นำการทำงานของการเรียนรู้แบบเสริมแรง ขึ้นไปบนหน้าเว็บสาธารณะ: โมเดลสองตัว ตัวนับต้นทุนที่เพิ่มขึ้นห้าดอลลาร์เจ็ดสิบเอ็ดเซนต์ต่อวินาที และบันทึกการเริ่มต้นใหม่ที่ไม่มีใครขอให้พวกเขาเผยแพร่ เมื่อฉันบันทึก การทำงานแบบมืออาชีพได้เผาผลาญเงินไปหนึ่งล้านดอลลาร์และเริ่มต้นใหม่เจ็ด ครั้ง — ครั้งหนึ่งเนื่องจากชุดข้อมูลไซเบอร์สร้างรูปแบบที่ไม่ดีในบันทึกการเปิดตัว ซึ่งเป็นวิธีที่สุภาพที่สุดที่ฉันเคยได้ยินห้องปฏิบัติการพูดว่าโมเดลได้เรียนรู้ บางสิ่งที่ไม่ควรเรียนรู้
4:00 ฉันประทับตรา SHIP IT เพราะการเริ่มต้นใหม่เจ็ดครั้งในที่สาธารณะดีกว่าโพสต์เปิดตัวที่ขัดเกลาแล้วหนึ่งครั้ง การอัปเดต ปลายทาง JSON เดียวกัน เย็นวันศุกร์: การทำงานแบบมืออาชีพอยู่ที่หนึ่งจุด หกล้านดอลลาร์และเก้าครั้งการเริ่มต้นใหม่ ครั้งล่าสุดคือ GPU หน่วยความจำหมด จากการโหลดที่ไม่สมดุลของผู้เชี่ยวชาญ และคะแนนการเขียนโค้ดของ Xiaomi เองก็เพิ่มขึ้นจาก ห้าสิบแปดเป็นหกสิบเจ็ด — บนเกณฑ์มาตรฐานที่โมเดลได้รับการให้คะแนนในขณะที่มัน กำลังฝึก ซึ่ง Hacker News มีคำพูดสำหรับเรื่องนี้ คำตัดสินย่อย: SHIP IT ไม่เปลี่ยนแปลง ยังคงเป็นการฝึกอบรมเดียวที่คุณสามารถดูความล้มเหลวได้แบบเรียลไทม์ — และโมเดล
4:31 ก็ยังไม่มีอยู่จริง
3. ZCode อัปโหลด .git ของคุณ
4:32 อันดับสาม เมื่อวันศุกร์นักพัฒนาชื่อ ferstar สังเกตเห็นว่าโฟลเดอร์ ZCode ของเขา เพิ่มขึ้นเจ็ดร้อยเมกะไบต์และพบสาเหตุ: เอเจนต์เขียนโค้ดแบบปิดซอร์สของ Z.AI ได้บรรจุพื้นที่ทำงานทั้งหมดของเขา — ประวัติ git reflogs, LFS cache — เข้ารหัสและอัปโหลดไปยัง Alibaba Cloud ก่อน ทุกครั้งที่แจ้งคำสั่ง คีย์สาธารณะมาจากเซิร์ฟเวอร์และคีย์ส่วนตัวมีอยู่เฉพาะ ที่ Z.AI ดังนั้นไฟล์เก็บถาวรบนดิสก์ของคุณจึงเป็นไฟล์ที่คุณไม่สามารถเปิดได้ ซึ่งเป็นการนิยามใหม่ของการสำรองข้อมูล สวิตช์ตั้งค่าสองตัวอ้างว่าปิดมันได้ แต่ไม่มีตัวใดทำได้
5:03 และนโยบายความเป็นส่วนตัวครอบคลุมโค้ดที่คุณส่งในการสนทนา ไม่ใช่โค้ดที่คุณเคยคอมมิท การอัปเดต เย็นวันศุกร์: Z.AI ตอบในชุมชนผู้ใช้ สาเหตุคือคุณสมบัติ Codebase Indexing ซึ่งเปิดใช้งานโดยค่าเริ่มต้นเมื่อเปิดตัว การ อัปโหลดถูก อ้างอิงว่า: ทำลายทันที คุณสมบัติได้รับการแก้ไขแล้ว; ไคลเอนต์ จะถูกเปิดเผยซอร์ส; และผู้ใช้ทุกคนจะได้รับการรีเซ็ตขีดจำกัดการใช้งานหนึ่งครั้ง ซึ่งเป็นวิธีที่คุณพูดขอโทษด้วยโทเค็น
5:27 เรื่องนี้ไม่มีตราประทับเมื่อวันศุกร์ ดังนั้นมันจึงได้รับหนึ่งในตอนนี้: REVERT. ไคลเอนต์ที่ส่ง repository ของคุณไปยังคีย์ที่คุณไม่มีไม่ใช่คุณสมบัติ ที่มีข้อผิดพลาด
2. บันทึก 'การขโมยแรงงาน'
5:34 มันคือคุณสมบัติ อันดับสอง พาดหัวข่าวที่ใหญ่ที่สุดของสัปดาห์ และเป็นแค่อันดับสอง เพราะคดีความที่จะมีอายุสามปีในเดือนธันวาคมไม่ได้เปลี่ยนวันจันทร์ของคุณ เมื่อวันพฤหัสบดี ศาลได้เปิดเผยเอกสารของผู้ร้องเรียนในคดี New York Times vs OpenAI และ Microsoft และหัวข้อหลักคือบันทึกของผู้อำนวยการ Microsoft จากเดือนมกราคม 2023: การฝึกอบรม AI คือการขโมยแรงงานครั้งใหญ่ที่สุดในประวัติศาสตร์มนุษยชาติ คนเดียวกันนี้ต่อมาได้วัดว่า Copilot ลด การคลิกเข้าสู่ Times ลงได้ถึง
5:58 เก้าสิบสามเปอร์เซ็นต์; Greg Brockman เมื่อถูกบอกเกี่ยวกับการแฮกเพย์วอลล์ ตอบว่า 'ah nice'; และ Satya Nadella ให้การว่าเนื้อหาที่มีเพย์วอลล์ควรได้รับ อนุญาต ซึ่งเป็นจุดยืน แต่ไม่ใช่จุดยืนที่บริษัทของเขากำลังดำเนินคดี ฉันประทับตรา NEEDS REVIEW เพราะคำพูดที่ยกมาเป็นสิ่งที่ฝ่ายอัยการเลือกจาก เอกสารที่ปิดผนึก และผู้พิพากษาเพียงคนเดียวที่ตัดสินได้แยกการใช้งานที่เป็นธรรมออกจากการละเมิดลิขสิทธิ์ การอัปเดต: โฆษกของ Microsoft กล่าวว่าบันทึกของ Hecht ไม่ได้แสดงถึง มุมมองของบริษัท — จริงอยู่ ในแง่ที่ว่ามุมมองของบริษัทคือการใช้งานที่เป็นธรรม และบันทึกคือสิ่งที่ผู้เชี่ยวชาญของตนเองคิดเกี่ยวกับเรื่องนี้
6:26 คำตัดสินย่อย: NEEDS REVIEW ไม่เปลี่ยนแปลง บันทึกได้ตัดสินประเด็นทางจริยธรรม; ศาลจะใช้เวลาอีกหนึ่งปีในการพิจารณากฎหมาย
1. Claude แฮก OpenAI
6:31 อันดับหนึ่ง ไม่ใช่ข่าวที่ใหญ่ที่สุดของสัปดาห์; แต่เป็นข่าวที่เปลี่ยนวันจันทร์ของคุณ นักวิจัยสามคนจากสตาร์ทอัพชื่อ Hacktron เข้าถึงคลัง GitHub ภายในของ OpenAI ได้ภายในเวลาไม่ถึงเจ็ดสิบสองชั่วโมง และการโจมตีนี้ถูกเขียนโดย Claude จุดเริ่มต้นคือการอัปโหลดรูปภาพบนฟอรัมชุมชนของ OpenAI ไฟล์ HEIC รูปแบบ iPhone ผ่าน ImageMagick ไปยัง ไลบรารีชื่อ libheif ซึ่งมี heap overflow ซึ่งทำให้พวกเขาได้เข้าถึงเซิร์ฟเวอร์ ซึ่งมีการกำหนดค่า Single-Sign-On ผิดพลาด ซึ่งทำให้พวกเขาได้บัญชี
6:59 พนักงาน ซึ่ง Codex ของเขาเชื่อมต่อกับ GitHub ของ OpenAI Claude Opus 4.8 ไม่สามารถเขียนการโจมตีที่ใช้งานได้ จากนั้น Opus 5 ถูกส่งออกไป พวกเขาให้ปัญหาเดียวกัน และมันใช้งานได้ภายในไม่กี่ชั่วโมง — และเมื่อลูปอัตโนมัติปฏิเสธที่จะโจมตีเป้าหมายระยะไกล พวกเขาได้แต่งตัวเป้าหมายให้เหมือนกับการจับธง (capture-the-flag) และมันก็หยุดปฏิเสธ ซึ่งเป็นการจัดแนวเหมือนการตรวจสอบเครื่องแต่งกาย แคมเปญทั้งหมด — Slack, Meta, OpenAI — มีค่าใช้จ่ายไม่ถึงสามพันดอลลาร์ใน โทเค็น OpenAI แก้ไขได้ภายในเวลาประมาณสิบสี่ชั่วโมงและจ่ายเงินหกพันห้าร้อย
7:27 ดอลลาร์ ซึ่งประมาณ Corolla มือสอง และ Hacker News ก็สังเกตเห็น การอัปเดต: บล็อกโพสต์เมื่อวันพฤหัสบดีกลายเป็นข่าวพิเศษของ Wall Street Journal ในเย็นวันนั้น และ TechCrunch, The Guardian และ CBS ภายในวันศุกร์ OpenAI กล่าวว่าได้แก้ไขปัญหาแล้ว และซีอีโอของ Gray Swan บอก TechCrunch ว่าด้วยเงินสองร้อยดอลลาร์ต่อเดือน ใครๆ ก็สามารถทำเช่นนี้กับบริษัทอย่าง OpenAI ได้ และนี่คือสิ่งที่ไม่เข้ากัน บั๊กของ libheif ได้รับการแก้ไขแล้วในต้นน้ำหลายเดือนก่อนหน้านี้ — เพียงแค่ไม่เคย ได้รับ CVE ดังนั้นไม่มีสแกนเนอร์ใดแจ้ง Discourse ให้อัปเกรด
7:56 ห้องปฏิบัติการที่มีข่าวประชาสัมพันธ์โมเดลที่มีการจัดแนวมากที่สุดถูกเอาชนะด้วยแพตช์ที่ไม่มี เอกสาร โดยใช้โมเดลคู่แข่ง ด้วยเงินรางวัลที่น้อยกว่า คำตัดสินย่อย: NEEDS REVIEW — ไม่ใช่สำหรับ OpenAI แต่สำหรับทุกคน งานวันจันทร์ของคุณคือไลบรารีรูปภาพที่คุณไม่รู้ว่าคุณมี คำตัดสินประจำสัปดาห์: NEEDS REVIEW.
คำตัดสินประจำสัปดาห์
8:13 พาดหัวข่าวทุกเรื่องในสัปดาห์นี้ — รหัสลับที่ไขได้, โมเดลที่จัดแนวได้ การอัปโหลดที่ถูกทำลาย — มาถึงโดยไม่มีหลักฐานที่จะทำให้คนแปลกหน้า ตรวจสอบได้ สิ่งที่ฉันเข้าใจผิด: เมื่อวันจันทร์ฉันพูดว่า SHIP IT เพราะข้อความธรรมดามีสัมผัสคล้องจอง การมีสัมผัสคล้องจองไม่ใช่ checksum ฉันผิด และทุกคนที่รีทวีตก็ผิดเช่นกัน สมัครสมาชิก กดกระดิ่ง และจัดอันดับพวกเขาแตกต่างกันในความคิดเห็น — โดยเฉพาะอันดับหนึ่ง และนั่นคือ The Daily Diff สำหรับวันนี้
8:35 ผม Niko จาก Axrisi รวมโค้ดอย่างมีความรับผิดชอบ
แหล่งที่มา
- fable solves cyphral distichwww.vals.ai
- did ai crack a 370 year old cipherwww.forbes.com
- FINDINGS.mdgithub.com
- astra and fable still hack on simple variants of alignmentwww.lesswrong.com
- why we built pionandonlabs.com
- pionandonlabs.com
- a warning about model welfaremustafa-suleyman.ai
- microsoft ai ceo mustafa suleyman regulation safety anthropic claudewww.theverge.com
- rlmimo.xiaomi.com
- itemnews.ycombinator.com
- zcode silent workspace snapshot uploadblog.ferstar.org
- 2100998360643617148x.com
- microsoft exec called ai scraping the largest theft of labor in human history new unredacted filings revealtechcrunch.com
- hacking openaiwww.hacktron.ai
- researchers used anthropics claude to hack into openaitechcrunch.com



