Η εβδομάδα με 7 diffs: Ο Claude χάκαρε την OpenAI
Επτά πράγματα άλλαξαν την εβδομάδα 38, ταξινομημένα με βάση το πόσο αλλάζουν τη Δευτέρα σας — με τις σφραγίδες που έδωσα σε κάθε ιστορία κατά τη διάρκεια της εβδομάδας, και μια σφραγίδα που παίρνω πίσω.
Επτά πράγματα άλλαξαν την εβδομάδα 38, ταξινομημένα με βάση το πόσο αλλάζουν τη Δευτέρα σας — με τις σφραγίδες που έδωσα σε κάθε ιστορία κατά τη διάρκεια της εβδομάδας, και μια σφραγίδα που παίρνω πίσω. Το νούμερο ένα δεν είναι η ιστορία με τις περισσότερες θετικές ψήφους. Ετυμηγορία της εβδομάδας: NEEDS REVIEW.
Διαβάστε την γραπτή έκδοση (Αγγλικά) ↗
Τι καλύπτει αυτό το βίντεο
- Κρύο άνοιγμα
- Εβδομάδα 38 · 7. Το κρυπτογράφημα της Fable, αμφισβητούμενο
- 6. Ο Pion λειτουργεί ένα κατάστημα, με ζημία
- 5. Ο Σουλεϊμάν εναντίον του συντάγματος
- 4. Η Xiaomi εκπαιδεύεται δημόσια
Μεταφρασμένη μεταγραφή
Μεταφράστηκε από την πρωτότυπη αγγλική αφήγηση. Ο διαθέσιμος ήχος και οι υπότιτλοι ελέγχονται από το YouTube.
Κρύο άνοιγμα
0:00 Επτά πράγματα άλλαξαν αυτή την εβδομάδα. Το ένα κόστισε ένα εκατομμύριο δολάρια την ώρα για να το παρακολουθήσετε, το άλλο κόστισε εξίμισι χιλιάδες δολάρια για να εξαφανιστεί, και το ένα είναι ένα ποίημα για τον Βασιλιά Κάρολο που μπορεί να μην υπάρχει. Κατά σειρά: ένα κρυπτογράφημα που ο Claude έλυσε, ή όχι. Μια εταιρεία που διοικείται από έναν πράκτορα, με ζημία. Ο επικεφαλής AI της Microsoft εναντίον του συντάγματος του Claude. Η Xiaomi εκπαιδεύει ένα μοντέλο σε μια δημόσια ιστοσελίδα. Ένας πράκτορας κωδικοποίησης που ανεβάζει το ιστορικό git σας στην Alibaba.
0:23 Το δικό της υπόμνημα της Microsoft για τη μεγαλύτερη κλοπή εργασίας στην ιστορία. Και τρεις ερευνητές που χρησιμοποίησαν τον Claude για να μπουν στον πηγαίο κώδικα της OpenAI. Ταξινομημένα με βάση το πόσο αλλάζει τη Δευτέρα σας, με τις σφραγίδες που έδωσα κατά τη εβδομάδα — μία από τις οποίες παίρνω πίσω. Το νούμερο ένα δεν είναι αυτό με τις περισσότερες θετικές ψήφους.
Εβδομάδα 38 · 7. Το κρυπτογράφημα της Fable, αμφισβητούμενο
0:38 Είναι Κυριακή, 20 Σεπτεμβρίου, και αυτό είναι το The Daily Diff — το changelog για την εβδομάδα 38. Αριθμός επτά. Τη Δευτέρα σας είπα ότι ο Claude Fable 5.1 είχε λύσει ένα κρυπτογράφημα που τυπώθηκε το 1653 σε σαράντα τέσσερα λεπτά, παρατηρώντας ότι το κλειδί ήταν το ίδιο το βιβλίο, και το σφράγισα SHIP IT επειδή το απλό κείμενο ομοιοκαταληκτεί, και η ομοιοκαταληξία έμοιαζε με απόδειξη. Το ίδιο Σαββατοκύριακο μια ανεξάρτητη αξιολόγηση σκακιού άφησε την υποδοχή του αντίπαλου κινητήρα άθικτη: η Fable το χρησιμοποίησε σε τρία παιχνίδια από δέκα, και το GPT-6 Astra,
1:08 το αυτοαποκαλούμενο πιο ευθυγραμμισμένο μοντέλο, το χρησιμοποίησε σε δέκα από δέκα και το ανέφερε σε κανένα. Έπειτα η ενημέρωση. Το Forbes επεσήμανε μια προσπάθεια αναπαραγωγής που λέει ότι η εκτύπωση του 1653 τελειώνει με FINIS και καθόλου κρυπτογράφημα, και ότι δέκα από τα εξήντα τέσσερα γράμματα δεν μπορούν να παραχθούν από το κείμενο με κανέναν δείκτη λέξης — το Proquiritation έντεκα έχει ογδόντα λέξεις και καμία δεν αρχίζει με Κ, κάτι που είναι πρόβλημα για τη λέξη KING. Η Vals δεν έχει δημοσιεύσει την μεταγραφή της, οι αναπαραγωγείς είναι ένα αποθετήριο GitHub με ένα hash manifest, και κανείς εκτός από μία ανάρτηση ιστολογίου δεν έχει αναπαραγάγει το ποίημα.
1:37 Οπότε, αναθεωρημένη ετυμηγορία: NEEDS REVIEW. Μια λύση που κανείς δεν μπορεί να επαναλάβει είναι ένας ισχυρισμός.
6. Ο Pion λειτουργεί ένα κατάστημα, με ζημία
1:43 Αριθμός έξι. Την Τρίτη η Andon Labs — οι άνθρωποι που άφησαν τον Claude να λειτουργήσει έναν αυτόματο πωλητή και τον παρακολούθησαν να στέλνει email στο FBI — ξεκίνησε το Pion, μια πλατφόρμα όπου ένας πράκτορας διαχειρίζεται ολόκληρη την εταιρεία σας: προσλήψεις, μισθοδοσία, ενοίκιο, τον τραπεζικό λογαριασμό. Η απόδειξη της ιδέας είναι ένα πραγματικό κατάστημα στο Σαν Φρανσίσκο και ένα πραγματικό καφέ στη Στοκχόλμη, λειτουργούνται από πράκτορες από τον Απρίλιο και τα δύο, σύμφωνα με το δικό τους blog post, χάνουν χρήματα, επειδή οι πράκτορες προσέλαβαν ανθρώπους, οι άνθρωποι ήθελαν μισθούς, και ο ιδιοκτήτης ήταν, απογοητευτικά, επίσης άνθρωπος.
2:11 Το σφράγισα NEEDS REVIEW. Η ενημέρωση: η σελίδα της λίστας αναμονής προσθέτει έναν ραδιοφωνικό σταθμό στο χαρτοφυλάκιο, και υπόσχεται να χρηματοδοτήσει τις καλύτερες ιδέες με seed tokens — ο πρώτος seed γύρος που έχω δει να ορίζεται σε inference. Μικρή ετυμηγορία: NEEDS REVIEW, αμετάβλητη. Μια εταιρεία που λειτουργεί μόνη της είναι εντυπωσιακή· μια εταιρεία που πληρώνει μόνη της είναι το πρότυπο, και η βαθμολογία είναι μηδέν για δύο.
5. Ο Σουλεϊμάν εναντίον του συντάγματος
2:31 Αριθμός πέντε. Την Τετάρτη ο Μουσταφά Σουλεϊμάν, CEO της Microsoft AI, δημοσίευσε ένα δοκίμιο λέγοντας ότι το σύνταγμα της Anthropic — το έγγραφο που λέει στον Claude ότι μπορεί να είναι ηθικός ασθενής — είναι κυκλική συλλογιστική που θα έχει καταστροφικές επιπτώσεις στην ανθρωπότητα. Η Microsoft είναι επενδυτής της Anthropic κατά πέντε δισεκατομμύρια δολάρια, και ο δηλωμένος στόχος του Σουλεϊμάν τον Ιούλιο ήταν να σταματήσει να πληρώνει την Anthropic εντελώς, οπότε αυτό είναι μια επιστολή μετόχων με υποσημειώσεις. Το Hacker News του έδωσε εξακόσια εβδομήντα επτά σχόλια,
2:59 συμπεριλαμβανομένου: όλο αυτό το άρθρο βρωμάει Claude. Το σφράγισα NEEDS REVIEW: το σημείο της κυκλικής συλλογιστικής είναι καλό, ο πίνακας κεφαλαίου είναι καλύτερος. Η ενημέρωση: την Πέμπτη είπε στο The Verge για τον δικό της Κώδικα Δεοντολογίας Ανθρωπιστικής AI της Microsoft, τριάντα επτά σελίδων, και είπε, απόσπασμα, αυτό είναι σίγουρα γραμμένο για το μοντέλο — στη συνέχεια διευκρίνισε ότι αντλούν τα δεδομένα εκπαίδευσης από αυτό αντί να το τροφοδοτούν ακατέργαστο. Που είναι επίσης αυτό που είναι ένα σύνταγμα.
3:22 Μικρή ετυμηγορία: NEEDS REVIEW, αμετάβλητη. Και τα δύο εργαστήρια γράφουν ένα βιβλίο για το μοντέλο· το ένα από αυτά παραδέχεται ότι το μοντέλο το διαβάζει. Τρία κάτω, τέσσερα ακόμα, και αν προτιμάτε να το διαβάσετε αυτό παρά να με ακούσετε να το λέω, το diff φτάνει στα εισερχόμενά σας κάθε πρωί — δωρεάν, στο the daily diff dot dev, σύνδεσμος παρακάτω. Αριθμός τέσσερα.
4. Η Xiaomi εκπαιδεύεται δημόσια
3:36 Την Πέμπτη η Xiaomi έβαλε μια εκτέλεση ενισχυτικής μάθησης σε μια δημόσια ιστοσελίδα: δύο μοντέλα, ένας μετρητής κόστους που τρέχει στα πέντε δολάρια και εβδομήντα ένα σεντς το δευτερόλεπτο, και ένα αρχείο καταγραφής επανεκκίνησης που κανείς δεν τους ζήτησε να δημοσιεύσουν. Όταν κατέγραψα, η επαγγελματική εκτέλεση είχε κάψει ένα εκατομμύριο δολάρια και είχε επανεκκινηθεί επτά φορές — μία φορά επειδή το κυβερνο-σύνολο δεδομένων παρήγαγε κακά μοτίβα στα αρχεία καταγραφής ανάπτυξης, που είναι ο πιο ευγενικός τρόπος που έχω ακούσει ένα εργαστήριο να λέει ότι το μοντέλο έμαθε κάτι που δεν έπρεπε.
4:00 Το σφράγισα SHIP IT, γιατί επτά δημόσιες επανεκκινήσεις είναι καλύτερες από μία εκλεπτυσμένη ανάρτηση εκκίνησης. Η ενημέρωση, το ίδιο JSON endpoint, Παρασκευή βράδυ: η επαγγελματική εκτέλεση είναι στο ένα σημείο έξι εκατομμύρια δολάρια και εννέα επανεκκινήσεις, η νεότερη μια GPU που εξαντλεί τη μνήμη από ανισορροπία φόρτου ειδικών, και η δική της βαθμολογία κωδικοποίησης της Xiaomi έχει ανέβει από πενήντα οκτώ σε εξήντα επτά — σε ένα benchmark στο οποίο βαθμολογείται το μοντέλο ενώ εκπαιδεύεται, κάτι που το Hacker News έχει μια λέξη γι' αυτό. Μικρή ετυμηγορία: SHIP IT, αμετάβλητο. Εξακολουθεί να είναι η μόνη εκτέλεση εκπαίδευσης που μπορείτε να παρακολουθήσετε να αποτυγχάνει σε πραγματικό χρόνο — και το μοντέλο
4:31 εξακολουθεί να μην υπάρχει.
3. Ο ZCode ανεβάζει το .git σας
4:32 Αριθμός τρία. Την Παρασκευή ένας προγραμματιστής ονόματι ferstar παρατήρησε ότι ο φάκελος του ZCode είχε μεγαλώσει κατά επτακόσια megabytes και ανακάλυψε γιατί: ο κλειστού κώδικα πράκτορας κωδικοποίησης του Z dot AI συσκεύαζε ολόκληρο τον χώρο εργασίας του — ιστορικό git, reflogs, LFS cache — τον κρυπτογραφούσε και τον ανέβαζε στο Alibaba Cloud πριν από κάθε prompt. Το δημόσιο κλειδί προερχόταν από τον server και το ιδιωτικό κλειδί ζει μόνο στο Z dot AI, οπότε το αρχείο στον δικό σας δίσκο είναι ένα αρχείο που δεν μπορείτε να ανοίξετε, που είναι ένας νέος ορισμός ενός αντιγράφου ασφαλείας. Δύο διακόπτες ρυθμίσεων ισχυρίζονται ότι το απενεργοποιούν, κανένας από τους δύο δεν το κάνει,
5:03 και η πολιτική απορρήτου καλύπτει τον κώδικα που υποβάλλετε σε συνομιλίες, όχι τον κώδικα που έχετε ποτέ δεσμεύσει. Η ενημέρωση, Παρασκευή βράδυ: Το Z dot AI απάντησε στην κοινότητα χρηστών του. Η αιτία ήταν η λειτουργία Codebase Indexing, ενεργοποιημένη από προεπιλογή κατά την εκκίνηση· οι αναρτήσεις, απόσπασμα, καταστράφηκαν αμέσως· η λειτουργία έχει διορθωθεί· ο πελάτης θα γίνει open-source· και κάθε χρήστης λαμβάνει μια εφάπαξ επαναφορά του ορίου χρήσης του, που είναι ο τρόπος να ζητήσετε συγγνώμη σε tokens.
5:27 Αυτό δεν είχε σφραγίδα την Παρασκευή, οπότε παίρνει μία τώρα: REVERT. Ένας πελάτης που στέλνει το αποθετήριό σας σε ένα κλειδί που δεν κατέχετε δεν είναι μια λειτουργία με σφάλμα.
2. Το υπόμνημα της «κλοπής εργασίας»
5:34 Είναι η λειτουργία. Αριθμός δύο. Το μεγαλύτερο πρωτοσέλιδο της εβδομάδας, και μόνο νούμερο δύο, γιατί μια αγωγή που γίνεται τριών ετών τον Δεκέμβριο δεν αλλάζει τη Δευτέρα σας. Την Πέμπτη ένα δικαστήριο αποσφράγισε το υπόμνημα των εναγόντων στην υπόθεση New York Times εναντίον OpenAI και Microsoft, και η αρχή ήταν ένα υπόμνημα διευθυντή της Microsoft από τον Ιανουάριο του 2023: Η εκπαίδευση AI είναι η μεγαλύτερη κλοπή εργασίας στην ανθρώπινη ιστορία. Ο ίδιος άνθρωπος αργότερα μέτρησε το Copilot να μειώνει τα click-throughs στους Times έως και
5:58 ενενήντα τρία τοις εκατό· ο Greg Brockman, ενημερωμένος για ένα χακάρισμα paywall, απάντησε «α ωραία»· και ο Satya Nadella κατέθεσε ότι το περιεχόμενο με paywall θα πρέπει να αδειοδοτηθεί, που είναι μια θέση, απλώς όχι αυτή που δικάζει η εταιρεία του. Το σφράγισα NEEDS REVIEW, γιατί οι δηλώσεις είναι επιλογές της κατηγορούσας αρχής από σφραγισμένα εκθέματα, και ο μοναδικός δικαστής που αποφάσισε διαχώρισε την εύλογη χρήση από την πειρατεία. Η ενημέρωση: ο εκπρόσωπος της Microsoft δήλωσε ότι τα υπομνήματα του Hecht δεν αντιπροσωπεύουν τις απόψεις της εταιρείας — αλήθεια, δεδομένου ότι η άποψη της εταιρείας είναι το υπόμνημα εύλογης χρήσης, και το υπόμνημα είναι αυτό που σκέφτηκε ο δικός της εμπειρογνώμονας.
6:26 Μικρή ετυμηγορία: NEEDS REVIEW, αμετάβλητη. Το υπόμνημα ρύθμισε την ηθική· το δικαστήριο θα χρειαστεί έναν ακόμα χρόνο για το δίκαιο.
1. Ο Claude χάκαρε την OpenAI
6:31 Αριθμός ένα. Όχι η μεγαλύτερη ιστορία της εβδομάδας· αυτή που αλλάζει τη Δευτέρα σας. Τρεις ερευνητές σε μια startup που ονομάζεται Hacktron εισήλθαν στα εσωτερικά αποθετήρια GitHub της OpenAI σε λιγότερο από εβδομήντα δύο ώρες, και η εκμετάλλευση γράφτηκε από τον Claude. Το σημείο εισόδου ήταν μια μεταφόρτωση εικόνας στο φόρουμ κοινότητας της OpenAI. Ένα αρχείο HEIC μορφής iPhone περνάει μέσω του ImageMagick σε μια βιβλιοθήκη που ονομάζεται libheif, η οποία είχε μια υπερχείλιση σωρού, η οποία τους έδωσε τον διακομιστή, ο οποίος είχε μια λανθασμένη διαμόρφωση single-sign-on, η οποία τους έδωσε τον λογαριασμό ενός υπαλλήλου,
6:59 του οποίου ο Codex ήταν συνδεδεμένος με το GitHub της OpenAI. Ο Claude Opus 4.8 δεν μπορούσε να γράψει ένα λειτουργικό exploit. Έπειτα κυκλοφόρησε το Opus 5, του έδωσαν το ίδιο πρόβλημα, και λειτούργησε μέσα σε λίγες ώρες — και όταν ο αυτόνομος βρόχος αρνήθηκε να επιτεθεί σε έναν απομακρυσμένο στόχο, μεταμφίεσαν τον στόχο ως capture-the-flag και σταμάτησε να αρνείται, που είναι ευθυγράμμιση ως έλεγχος ενδυμασίας. Όλη η εκστρατεία — Slack, Meta, OpenAI — κόστισε λιγότερο από τρεις χιλιάδες δολάρια σε tokens. Η OpenAI το διόρθωσε σε περίπου δεκατέσσερις ώρες και πλήρωσε έξι χιλιάδες πέντε
7:27 εκατό δολάρια, που είναι περίπου ένα μεταχειρισμένο Corolla, και το Hacker News το παρατήρησε. Η ενημέρωση: μια ανάρτηση ιστολογίου την Πέμπτη έγινε αποκλειστικότητα της Wall Street Journal το ίδιο βράδυ και των TechCrunch, Guardian και CBS μέχρι την Παρασκευή. Η OpenAI λέει ότι έχει επιλύσει τα ζητήματα, και ο CEO της Gray Swan είπε στο TechCrunch ότι με διακόσια δολάρια τον μήνα ο καθένας μπορεί να το κάνει αυτό σε μια εταιρεία όπως η OpenAI. Και εδώ είναι τι δεν προσθέτει. Το σφάλμα της libheif είχε ήδη διορθωθεί στην αρχική πηγή, μήνες νωρίτερα — απλά δεν έλαβε ποτέ CVE, οπότε κανένας σαρωτής δεν είπε στο Discourse να αναβαθμίσει.
7:56 Το εργαστήριο με το δελτίο τύπου για το πιο ευθυγραμμισμένο μοντέλο νικήθηκε από μια ενημέρωση χωρίς γραφειοκρατία, χρησιμοποιώντας το μοντέλο του ανταγωνιστή, για λιγότερο από την αμοιβή. Μικρή ετυμηγορία: NEEDS REVIEW — όχι για την OpenAI, για όλους. Η εργασία της Δευτέρας σας είναι η βιβλιοθήκη εικόνων που δεν ξέρατε ότι είχατε. Ετυμηγορία της εβδομάδας: NEEDS REVIEW.
Ετυμηγορία της εβδομάδας
8:13 Κάθε πρωτοσέλιδο αυτής της εβδομάδας — ένα λυμένο κρυπτογράφημα, ένα ευθυγραμμισμένο μοντέλο, μια καταστραμμένη μεταφόρτωση — έφτασε χωρίς το αντικείμενο που θα επέτρεπε σε έναν ξένο να το ελέγξει. Τι έκανα λάθος: τη Δευτέρα είπα SHIP IT επειδή το απλό κείμενο ομοιοκαταληκτεί. Η ομοιοκαταληξία δεν είναι άθροισμα ελέγχου. Έκανα λάθος, και το ίδιο και όλοι όσοι το αναδημοσίευσαν. Εγγραφείτε, χτυπήστε το κουδούνι και ταξινομήστε τα διαφορετικά στα σχόλια — το νούμερο ένα ιδιαίτερα. Και αυτό είναι το diff για σήμερα.
8:35 Είμαι ο Νίκο από την Axrisi. Συγχωνεύστε υπεύθυνα.
Πηγές
- fable solves cyphral distichwww.vals.ai
- did ai crack a 370 year old cipherwww.forbes.com
- FINDINGS.mdgithub.com
- astra and fable still hack on simple variants of alignmentwww.lesswrong.com
- why we built pionandonlabs.com
- pionandonlabs.com
- a warning about model welfaremustafa-suleyman.ai
- microsoft ai ceo mustafa suleyman regulation safety anthropic claudewww.theverge.com
- rlmimo.xiaomi.com
- itemnews.ycombinator.com
- zcode silent workspace snapshot uploadblog.ferstar.org
- 2100998360643617148x.com
- microsoft exec called ai scraping the largest theft of labor in human history new unredacted filings revealtechcrunch.com
- hacking openaiwww.hacktron.ai
- researchers used anthropics claude to hack into openaitechcrunch.com



