+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

A semana en 7 diferenzas: Claude "hackeou" OpenAI

Sete cousas cambiaron na semana 38, clasificadas por canto cambian o teu luns — cos selos que lle dei a cada historia durante a semana, e un selo que estou retirando.

Sete cousas cambiaron na semana 38, clasificadas por canto cambian o teu luns — cos selos que lle dei a cada historia durante a semana, e un selo que estou retirando. O número un non é a historia con máis votos positivos. Veredito da semana: NEEDS REVIEW.

Ler a edición escrita (inglés) ↗

Que abrangue este vídeo

  • Introdución
  • Semana 38 · 7. O cifrado de Fable, en disputa
  • 6. Pion xestiona unha tenda, con perdas
  • 5. Suleyman vs. a constitución
  • 4. Xiaomi adestra en público

Transcrición traducida

Traducido da narración orixinal en inglés. O audio e os subtítulos dispoñibles son controlados por YouTube.

Introdución

0:00 Sete cousas cambiaron esta semana. Unha custou un millón de dólares por hora de observación, outra seis mil cincocentos dólares para facer desaparecer, e unha é un poema sobre o Rei Carlos que quizais non exista. En orde: un cifrado que Claude resolveu, ou non. Unha empresa xestionada por un axente, con perdas. O xefe de IA de Microsoft contra a constitución de Claude. Xiaomi adestrando un modelo nunha páxina web pública. Un axente de codificación que carga o teu historial de git en Alibaba.

0:23 O propio memo de Microsoft sobre o maior roubo de man de obra da historia. E tres investigadores que usaron Claude para acceder ao código fonte de OpenAI. Clasificado por canto cambia o teu luns, cos selos que dei durante a semana — un dos cales estou retirando. O número un non é o que ten máis votos positivos.

Semana 38 · 7. O cifrado de Fable, en disputa

0:38 É domingo, 20 de setembro, e este é The Daily Diff — o rexistro de cambios da semana 38. Número sete. O luns díxenvos que Claude Fable 5.1 resolvera un cifrado impreso en 1653 en corenta e catro minutos, ao notar que a clave era o propio libro, e selleino como SHIP IT porque o texto en claro rima, e rimar parecía unha proba. A mesma fin de semana unha avaliación independente de xadrez deixou o socket do motor do opoñente á vista: Fable usouno en tres de dez partidas, e GPT-6 Astra,

1:08 o modelo autodescrito como o máis aliñado, usouno en dez de dez e non o mencionou en ningunha. Despois a actualización. Forbes sinalou un intento de replicación que afirma que a impresión de 1653 remata con FINIS e sen cifrado ningún, e que dez das sesenta e catro letras non poden ser producidas do texto por ningún índice de palabras — Proquiritation once ten oitenta palabras e ningunha comeza con K, o que é un problema para a palabra KING. Vals non publicou a súa transcrición, os replicadores son un repositorio de GitHub cun manifesto hash, e ninguén, agás unha publicación de blog, reproduciu o poema.

1:37 Así que, veredicto revisado: NEEDS REVIEW. Unha solución que ninguén pode repetir é unha afirmación.

6. Pion xestiona unha tenda, con perdas

1:43 Número seis. O martes Andon Labs — a xente que deixou a Claude xestionar unha máquina expendedora e o viu enviar un correo electrónico ao FBI — lanzou Pion, unha plataforma onde un axente xestiona toda a túa empresa: contratación, nóminas, aluguer, a conta bancaria. A proba de concepto é unha tenda real en San Francisco e unha cafetería real en Estocolmo, xestionadas por axentes desde abril e ambas, segundo a súa propia publicación de blog, perdendo diñeiro, porque os axentes contrataron humanos, os humanos querían salarios, e o propietario era, decepcionantemente, tamén humano.

2:11 Selleino como NEEDS REVIEW. A actualización: a páxina da lista de espera engade unha estación de radio ao portfolio, e promete financiar as mellores ideas con tokens semente — a primeira rolda de sementes que vin denominada en inferencia. Mini-veredicto: NEEDS REVIEW, sen cambios. Unha empresa que se xestiona a si mesma é impresionante; unha empresa que se paga a si mesma é o referente, e a puntuación é cero de dous.

5. Suleyman vs. a constitución

2:31 Número cinco. O mércores Mustafa Suleyman, CEO de Microsoft AI, publicou un ensaio dicindo que a constitución de Anthropic — o documento que lle di a Claude que podería ser un paciente moral — é un razoamento circular que terá un impacto desastroso na humanidade. Microsoft é un inversor de Anthropic por cinco mil millóns de dólares, e o obxectivo declarado de Suleyman en xullo era deixar de pagar a Anthropic por completo, así que esta é unha carta aos accionistas con notas a pé de páxina. Hacker News deulle seiscentos setenta e sete comentarios,

2:59 incluíndo: este artigo enteiro fede a Claude. Selleino como NEEDS REVIEW: o punto do razoamento circular é bo, a táboa de capitalización é mellor. A actualización: o xoves díxolle a The Verge sobre o propio Código de Conduta Humanista da IA de trinta e sete páxinas de Microsoft, e dixo, cita, isto está certamente escrito para o modelo — e despois aclarou que derivan os datos de adestramento del en lugar de alimentalo directamente. O que tamén é unha constitución.

3:22 Mini-veredicto: NEEDS REVIEW, sen cambios. Ambos laboratorios escriben un libro para o modelo; un deles admite que o modelo o le. Tres menos, catro por ir, e se prefires ler isto que escoitarme dicilo, a diferenza chega á túa caixa de entrada cada mañá — de balde, en thedailydiff.dev, ligazón a continuación. Número catro.

4. Xiaomi adestra en público

3:36 O xoves Xiaomi publicou unha execución de aprendizaxe por reforzo nunha páxina web pública: dous modelos, un contador de custo marcando cinco dólares e setenta e un céntimos por segundo, e un rexistro de reinicios que ninguén lles pediu que publicasen. Cando gravei, a execución "pro" queimara un millón de dólares e reiniciara sete veces — unha vez porque o conxunto de datos cibernético produciu patróns errados nos rexistros de despregamento, que é a forma máis educada que escoitei un laboratorio dicir que o modelo aprendeu algo que non debería.

4:00 Selleino como SHIP IT, porque sete reinicios públicos son mellores que unha publicación de lanzamento pulida. A actualización, o mesmo punto final JSON, venres á noite: a execución "pro" está en un punto seis millóns de dólares e nove reinicios, o máis recente unha GPU quedando sen memoria por desequilibrio de carga de expertos, e a propia puntuación de codificación de Xiaomi subiu de cincuenta e oito a sesenta e sete — nun referente no que o modelo é avaliado mentres se adestra, para o que Hacker News ten unha palabra. Mini-veredicto: SHIP IT, sen cambios. Segue sendo a única execución de adestramento que podes ver fallar en tempo real — e o modelo

4:31 aínda non existe.

3. ZCode carga o teu .git

4:32 Número tres. O venres un desenvolvedor chamado ferstar notou que a súa carpeta ZCode crecera setecentos megabytes e descubriu por que: o axente de codificación de código pechado de Z.AI estivera empaquetando todo o seu espazo de traballo — historial de git, rexistros de ref, caché LFS — cifrándoo, e cargándoo en Alibaba Cloud antes de cada solicitude. A clave pública viña do servidor e a clave privada vive só en Z.AI, polo que o arquivo no teu propio disco é un ficheiro que non podes abrir, o que é unha definición novedosa dunha copia de seguridade. Dous interruptores de configuración afirman desactivalo, ningún o fai,

5:03 e a política de privacidade cobre o código que envías nas conversas, non o código que algunha vez confirmaches. A actualización, venres á noite: Z.AI respondeu na súa comunidade de usuarios. A causa foi a función de indexación de código, activada por defecto no lanzamento; as cargas foron, cita, inmediatamente destruídas; a función está arranxada; o cliente será de código aberto; e cada usuario recibe un reinicio único do seu límite de uso, que é como se pide desculpas en tokens.

5:27 Este non tiña selo o venres, así que recibe un agora: REVERT. Un cliente que envía o teu repositorio a unha clave que non posúes non é unha función cun erro.

2. O memo do 'roubo de man de obra'

5:34 É a función. Número dous. A maior noticia da semana, e só o número dous, porque unha demanda que cumpre tres anos en decembro non cambia o teu luns. O xoves un tribunal desclasificou o escrito dos demandantes no caso New York Times contra OpenAI e Microsoft, e a noticia principal foi un memo dun director de Microsoft de xaneiro de 2023: o adestramento de IA é o maior roubo de man de obra na historia da humanidade. O mesmo home despois mediu que Copilot reducía os clics cara ao Times ata un

5:58 noventa e tres por cento; Greg Brockman, informado sobre un "hack" de muro de pago, respondeu "ah, que ben"; e Satya Nadella testificou que o contido con muro de pago debería ser licenciado, o que é unha postura, pero non a que a súa empresa está a litigar. Selleino como NEEDS REVIEW, porque as citas son as eleccións da acusación de probas seladas, e o único xuíz que decidiu separou o uso lexítimo da piratería. A actualización: o portavoz de Microsoft dixo que os memos de Hecht non representaban as opinións da empresa — certo, xa que a opinión da empresa é o escrito de uso lexítimo, e o memo é o que pensou o seu propio experto sobre iso.

6:26 Mini-veredicto: NEEDS REVIEW, sen cambios. O memo resolveu a ética; o tribunal tardará outro ano coa lei.

1. Claude "hackeou" OpenAI

6:31 Número un. Non é a historia máis grande da semana; a que cambia o teu luns. Tres investigadores dunha startup chamada Hacktron entraron nos repositorios internos de GitHub de OpenAI en menos de setenta e dúas horas, e o "exploit" foi escrito por Claude. O punto de entrada foi unha carga de imaxes no foro da comunidade de OpenAI. Un ficheiro HEIC en formato iPhone pasa por ImageMagick a unha biblioteca chamada libheif, que tiña un desbordamento de "heap", o que lles deu o servidor, que tiña unha mala configuración de inicio de sesión único, o que lles deu a conta dun

6:59 empregado, cuxo Codex estaba conectado ao GitHub de OpenAI. Claude Opus 4.8 non puido escribir un "exploit" que funcionase. Despois lanzouse Opus 5, déronlle o mesmo problema, e funcionou en cuestión de horas — e cando o bucle autónomo se negou a atacar un obxectivo remoto, vestiron o obxectivo como unha captura da bandeira e deixou de negarse, o que é aliñamento como unha comprobación de disfraces. Toda a campaña — Slack, Meta, OpenAI — custou menos de tres mil dólares en tokens. OpenAI arranxouno en aproximadamente catorce horas e pagou seis mil quinhentos

7:27 dólares, que é aproximadamente un Corolla usado, e Hacker News notouno. A actualización: unha publicación de blog o xoves converteuse nunha exclusiva do Wall Street Journal esa noite e de TechCrunch, The Guardian e CBS o venres. OpenAI di que resolveu os problemas, e o CEO de Gray Swan díxolle a TechCrunch que por douscentos dólares ao mes calquera pode facer isto a unha empresa como OpenAI. E aquí está o que non cadra. O erro de libheif xa fora arranxado "upstream", meses antes — simplemente nunca obtivo un CVE, así que ningún escáner lle dixo a Discourse que actualizase.

7:56 O laboratorio coa nota de prensa do modelo máis aliñado foi superado por un parche sen papeleo, usando o modelo do rival, por menos da recompensa. Mini-veredicto: NEEDS REVIEW — non para OpenAI, para todos. A túa tarefa do luns é a biblioteca de imaxes que non sabías que tiñas. Veredito da semana: NEEDS REVIEW.

Veredito da semana

8:13 Cada titular desta semana — un cifrado resolto, un modelo aliñado, unha carga destruída — chegou sen o artefacto que permitiría a un estraño verificalo. No que me equivoquei: o luns dixen SHIP IT porque o texto en claro rima. Rimando non é un "checksum". Equivoqueime, e tamén todos os que o retuitearon. Subscríbete, preme a campá, e clasifícaos de forma diferente nos comentarios — o número un especialmente. E esa é a diferenza por hoxe.

8:35 Son Niko de Axrisi. Fusiona con responsabilidade.

Fontes

  1. fable solves cyphral distichwww.vals.ai
  2. did ai crack a 370 year old cipherwww.forbes.com
  3. FINDINGS.mdgithub.com
  4. astra and fable still hack on simple variants of alignmentwww.lesswrong.com
  5. why we built pionandonlabs.com
  6. pionandonlabs.com
  7. a warning about model welfaremustafa-suleyman.ai
  8. microsoft ai ceo mustafa suleyman regulation safety anthropic claudewww.theverge.com
  9. rlmimo.xiaomi.com
  10. itemnews.ycombinator.com
  11. zcode silent workspace snapshot uploadblog.ferstar.org
  12. 2100998360643617148x.com
  13. microsoft exec called ai scraping the largest theft of labor in human history new unredacted filings revealtechcrunch.com
  14. hacking openaiwww.hacktron.ai
  15. researchers used anthropics claude to hack into openaitechcrunch.com

Vídeos relacionados