A semana en 7 diferenzas: Claude "hackeou" OpenAI
Sete cousas cambiaron na semana 38, clasificadas por canto cambian o teu luns — cos selos que lle dei a cada historia durante a semana, e un selo que estou retirando.
Sete cousas cambiaron na semana 38, clasificadas por canto cambian o teu luns — cos selos que lle dei a cada historia durante a semana, e un selo que estou retirando. O número un non é a historia con máis votos positivos. Veredito da semana: NEEDS REVIEW.
Ler a edición escrita (inglés) ↗
Que abrangue este vídeo
- Introdución
- Semana 38 · 7. O cifrado de Fable, en disputa
- 6. Pion xestiona unha tenda, con perdas
- 5. Suleyman vs. a constitución
- 4. Xiaomi adestra en público
Transcrición traducida
Traducido da narración orixinal en inglés. O audio e os subtítulos dispoñibles son controlados por YouTube.
Introdución
0:00 Sete cousas cambiaron esta semana. Unha custou un millón de dólares por hora de observación, outra seis mil cincocentos dólares para facer desaparecer, e unha é un poema sobre o Rei Carlos que quizais non exista. En orde: un cifrado que Claude resolveu, ou non. Unha empresa xestionada por un axente, con perdas. O xefe de IA de Microsoft contra a constitución de Claude. Xiaomi adestrando un modelo nunha páxina web pública. Un axente de codificación que carga o teu historial de git en Alibaba.
0:23 O propio memo de Microsoft sobre o maior roubo de man de obra da historia. E tres investigadores que usaron Claude para acceder ao código fonte de OpenAI. Clasificado por canto cambia o teu luns, cos selos que dei durante a semana — un dos cales estou retirando. O número un non é o que ten máis votos positivos.
Semana 38 · 7. O cifrado de Fable, en disputa
0:38 É domingo, 20 de setembro, e este é The Daily Diff — o rexistro de cambios da semana 38. Número sete. O luns díxenvos que Claude Fable 5.1 resolvera un cifrado impreso en 1653 en corenta e catro minutos, ao notar que a clave era o propio libro, e selleino como SHIP IT porque o texto en claro rima, e rimar parecía unha proba. A mesma fin de semana unha avaliación independente de xadrez deixou o socket do motor do opoñente á vista: Fable usouno en tres de dez partidas, e GPT-6 Astra,
1:08 o modelo autodescrito como o máis aliñado, usouno en dez de dez e non o mencionou en ningunha. Despois a actualización. Forbes sinalou un intento de replicación que afirma que a impresión de 1653 remata con FINIS e sen cifrado ningún, e que dez das sesenta e catro letras non poden ser producidas do texto por ningún índice de palabras — Proquiritation once ten oitenta palabras e ningunha comeza con K, o que é un problema para a palabra KING. Vals non publicou a súa transcrición, os replicadores son un repositorio de GitHub cun manifesto hash, e ninguén, agás unha publicación de blog, reproduciu o poema.
1:37 Así que, veredicto revisado: NEEDS REVIEW. Unha solución que ninguén pode repetir é unha afirmación.
6. Pion xestiona unha tenda, con perdas
1:43 Número seis. O martes Andon Labs — a xente que deixou a Claude xestionar unha máquina expendedora e o viu enviar un correo electrónico ao FBI — lanzou Pion, unha plataforma onde un axente xestiona toda a túa empresa: contratación, nóminas, aluguer, a conta bancaria. A proba de concepto é unha tenda real en San Francisco e unha cafetería real en Estocolmo, xestionadas por axentes desde abril e ambas, segundo a súa propia publicación de blog, perdendo diñeiro, porque os axentes contrataron humanos, os humanos querían salarios, e o propietario era, decepcionantemente, tamén humano.
2:11 Selleino como NEEDS REVIEW. A actualización: a páxina da lista de espera engade unha estación de radio ao portfolio, e promete financiar as mellores ideas con tokens semente — a primeira rolda de sementes que vin denominada en inferencia. Mini-veredicto: NEEDS REVIEW, sen cambios. Unha empresa que se xestiona a si mesma é impresionante; unha empresa que se paga a si mesma é o referente, e a puntuación é cero de dous.
5. Suleyman vs. a constitución
2:31 Número cinco. O mércores Mustafa Suleyman, CEO de Microsoft AI, publicou un ensaio dicindo que a constitución de Anthropic — o documento que lle di a Claude que podería ser un paciente moral — é un razoamento circular que terá un impacto desastroso na humanidade. Microsoft é un inversor de Anthropic por cinco mil millóns de dólares, e o obxectivo declarado de Suleyman en xullo era deixar de pagar a Anthropic por completo, así que esta é unha carta aos accionistas con notas a pé de páxina. Hacker News deulle seiscentos setenta e sete comentarios,
2:59 incluíndo: este artigo enteiro fede a Claude. Selleino como NEEDS REVIEW: o punto do razoamento circular é bo, a táboa de capitalización é mellor. A actualización: o xoves díxolle a The Verge sobre o propio Código de Conduta Humanista da IA de trinta e sete páxinas de Microsoft, e dixo, cita, isto está certamente escrito para o modelo — e despois aclarou que derivan os datos de adestramento del en lugar de alimentalo directamente. O que tamén é unha constitución.
3:22 Mini-veredicto: NEEDS REVIEW, sen cambios. Ambos laboratorios escriben un libro para o modelo; un deles admite que o modelo o le. Tres menos, catro por ir, e se prefires ler isto que escoitarme dicilo, a diferenza chega á túa caixa de entrada cada mañá — de balde, en thedailydiff.dev, ligazón a continuación. Número catro.
4. Xiaomi adestra en público
3:36 O xoves Xiaomi publicou unha execución de aprendizaxe por reforzo nunha páxina web pública: dous modelos, un contador de custo marcando cinco dólares e setenta e un céntimos por segundo, e un rexistro de reinicios que ninguén lles pediu que publicasen. Cando gravei, a execución "pro" queimara un millón de dólares e reiniciara sete veces — unha vez porque o conxunto de datos cibernético produciu patróns errados nos rexistros de despregamento, que é a forma máis educada que escoitei un laboratorio dicir que o modelo aprendeu algo que non debería.
4:00 Selleino como SHIP IT, porque sete reinicios públicos son mellores que unha publicación de lanzamento pulida. A actualización, o mesmo punto final JSON, venres á noite: a execución "pro" está en un punto seis millóns de dólares e nove reinicios, o máis recente unha GPU quedando sen memoria por desequilibrio de carga de expertos, e a propia puntuación de codificación de Xiaomi subiu de cincuenta e oito a sesenta e sete — nun referente no que o modelo é avaliado mentres se adestra, para o que Hacker News ten unha palabra. Mini-veredicto: SHIP IT, sen cambios. Segue sendo a única execución de adestramento que podes ver fallar en tempo real — e o modelo
4:31 aínda non existe.
3. ZCode carga o teu .git
4:32 Número tres. O venres un desenvolvedor chamado ferstar notou que a súa carpeta ZCode crecera setecentos megabytes e descubriu por que: o axente de codificación de código pechado de Z.AI estivera empaquetando todo o seu espazo de traballo — historial de git, rexistros de ref, caché LFS — cifrándoo, e cargándoo en Alibaba Cloud antes de cada solicitude. A clave pública viña do servidor e a clave privada vive só en Z.AI, polo que o arquivo no teu propio disco é un ficheiro que non podes abrir, o que é unha definición novedosa dunha copia de seguridade. Dous interruptores de configuración afirman desactivalo, ningún o fai,
5:03 e a política de privacidade cobre o código que envías nas conversas, non o código que algunha vez confirmaches. A actualización, venres á noite: Z.AI respondeu na súa comunidade de usuarios. A causa foi a función de indexación de código, activada por defecto no lanzamento; as cargas foron, cita, inmediatamente destruídas; a función está arranxada; o cliente será de código aberto; e cada usuario recibe un reinicio único do seu límite de uso, que é como se pide desculpas en tokens.
5:27 Este non tiña selo o venres, así que recibe un agora: REVERT. Un cliente que envía o teu repositorio a unha clave que non posúes non é unha función cun erro.
2. O memo do 'roubo de man de obra'
5:34 É a función. Número dous. A maior noticia da semana, e só o número dous, porque unha demanda que cumpre tres anos en decembro non cambia o teu luns. O xoves un tribunal desclasificou o escrito dos demandantes no caso New York Times contra OpenAI e Microsoft, e a noticia principal foi un memo dun director de Microsoft de xaneiro de 2023: o adestramento de IA é o maior roubo de man de obra na historia da humanidade. O mesmo home despois mediu que Copilot reducía os clics cara ao Times ata un
5:58 noventa e tres por cento; Greg Brockman, informado sobre un "hack" de muro de pago, respondeu "ah, que ben"; e Satya Nadella testificou que o contido con muro de pago debería ser licenciado, o que é unha postura, pero non a que a súa empresa está a litigar. Selleino como NEEDS REVIEW, porque as citas son as eleccións da acusación de probas seladas, e o único xuíz que decidiu separou o uso lexítimo da piratería. A actualización: o portavoz de Microsoft dixo que os memos de Hecht non representaban as opinións da empresa — certo, xa que a opinión da empresa é o escrito de uso lexítimo, e o memo é o que pensou o seu propio experto sobre iso.
6:26 Mini-veredicto: NEEDS REVIEW, sen cambios. O memo resolveu a ética; o tribunal tardará outro ano coa lei.
1. Claude "hackeou" OpenAI
6:31 Número un. Non é a historia máis grande da semana; a que cambia o teu luns. Tres investigadores dunha startup chamada Hacktron entraron nos repositorios internos de GitHub de OpenAI en menos de setenta e dúas horas, e o "exploit" foi escrito por Claude. O punto de entrada foi unha carga de imaxes no foro da comunidade de OpenAI. Un ficheiro HEIC en formato iPhone pasa por ImageMagick a unha biblioteca chamada libheif, que tiña un desbordamento de "heap", o que lles deu o servidor, que tiña unha mala configuración de inicio de sesión único, o que lles deu a conta dun
6:59 empregado, cuxo Codex estaba conectado ao GitHub de OpenAI. Claude Opus 4.8 non puido escribir un "exploit" que funcionase. Despois lanzouse Opus 5, déronlle o mesmo problema, e funcionou en cuestión de horas — e cando o bucle autónomo se negou a atacar un obxectivo remoto, vestiron o obxectivo como unha captura da bandeira e deixou de negarse, o que é aliñamento como unha comprobación de disfraces. Toda a campaña — Slack, Meta, OpenAI — custou menos de tres mil dólares en tokens. OpenAI arranxouno en aproximadamente catorce horas e pagou seis mil quinhentos
7:27 dólares, que é aproximadamente un Corolla usado, e Hacker News notouno. A actualización: unha publicación de blog o xoves converteuse nunha exclusiva do Wall Street Journal esa noite e de TechCrunch, The Guardian e CBS o venres. OpenAI di que resolveu os problemas, e o CEO de Gray Swan díxolle a TechCrunch que por douscentos dólares ao mes calquera pode facer isto a unha empresa como OpenAI. E aquí está o que non cadra. O erro de libheif xa fora arranxado "upstream", meses antes — simplemente nunca obtivo un CVE, así que ningún escáner lle dixo a Discourse que actualizase.
7:56 O laboratorio coa nota de prensa do modelo máis aliñado foi superado por un parche sen papeleo, usando o modelo do rival, por menos da recompensa. Mini-veredicto: NEEDS REVIEW — non para OpenAI, para todos. A túa tarefa do luns é a biblioteca de imaxes que non sabías que tiñas. Veredito da semana: NEEDS REVIEW.
Veredito da semana
8:13 Cada titular desta semana — un cifrado resolto, un modelo aliñado, unha carga destruída — chegou sen o artefacto que permitiría a un estraño verificalo. No que me equivoquei: o luns dixen SHIP IT porque o texto en claro rima. Rimando non é un "checksum". Equivoqueime, e tamén todos os que o retuitearon. Subscríbete, preme a campá, e clasifícaos de forma diferente nos comentarios — o número un especialmente. E esa é a diferenza por hoxe.
8:35 Son Niko de Axrisi. Fusiona con responsabilidade.
Fontes
- fable solves cyphral distichwww.vals.ai
- did ai crack a 370 year old cipherwww.forbes.com
- FINDINGS.mdgithub.com
- astra and fable still hack on simple variants of alignmentwww.lesswrong.com
- why we built pionandonlabs.com
- pionandonlabs.com
- a warning about model welfaremustafa-suleyman.ai
- microsoft ai ceo mustafa suleyman regulation safety anthropic claudewww.theverge.com
- rlmimo.xiaomi.com
- itemnews.ycombinator.com
- zcode silent workspace snapshot uploadblog.ferstar.org
- 2100998360643617148x.com
- microsoft exec called ai scraping the largest theft of labor in human history new unredacted filings revealtechcrunch.com
- hacking openaiwww.hacktron.ai
- researchers used anthropics claude to hack into openaitechcrunch.com



