A semana em 7 diffs: Claude invadiu a OpenAI
Sete coisas mudaram na semana 38, classificadas por quanto elas mudam sua segunda-feira — com os selos que dei a cada história durante a semana, e um selo que estou retirando.
Sete coisas mudaram na semana 38, classificadas por quanto elas mudam sua segunda-feira — com os selos que dei a cada história durante a semana, e um selo que estou retirando. O número um não é a história com mais votos positivos. Veredito da semana: NEEDS REVIEW.
Leia a edição escrita (Inglês) ↗
O que este vídeo aborda
- Início frio
- Semana 38 · 7. A cifra de Fable, disputada
- 6. Pion opera uma loja, com prejuízo
- 5. Suleyman vs a constituição
- 4. Xiaomi treina em público
Transcrição traduzida
Traduzido da narração original em inglês. Áudio e legendas disponíveis são controlados pelo YouTube.
Início frio
0:00 Sete coisas mudaram esta semana. Uma custou um milhão de dólares por hora para assistir, outra custou seis mil e quinhentos dólares para fazer desaparecer, e uma é um poema sobre o Rei Charles que pode não existir. Em ordem: uma cifra que Claude resolveu, ou não. Uma empresa administrada por um agente, com prejuízo. O chefe de IA da Microsoft contra a constituição de Claude. Xiaomi treinando um modelo em uma página web pública. Um agente de codificação que envia seu histórico git para a Alibaba.
0:23 O próprio memorando da Microsoft sobre o maior roubo de trabalho da história. E três pesquisadores que usaram Claude para acessar o código-fonte da OpenAI. Classificados por quanto isso muda sua segunda-feira, com os selos que dei durante a semana — um dos quais estou retirando. O número um não é o que tem mais votos positivos.
Semana 38 · 7. A cifra de Fable, disputada
0:38 É domingo, 20 de setembro, e este é The Daily Diff — o registro de alterações da semana 38. Número sete. Na segunda-feira eu disse que Claude Fable 5.1 havia resolvido uma cifra impressa em 1653 em quarenta e quatro minutos, ao perceber que a chave era o próprio livro, e eu carimbei como SHIP IT porque o texto simples rimava, e rimar parecia uma prova. No mesmo fim de semana, uma avaliação de xadrez independente deixou o soquete do motor oponente à mostra: Fable o usou em três de dez jogos, e GPT-6 Astra,
1:08 o modelo autodeclarado mais alinhado, o usou em dez de dez e não o mencionou em nenhum. Então a atualização. A Forbes apontou para uma tentativa de replicação que diz que a impressão de 1653 termina com FINIS e nenhuma cifra, e que dez das sessenta e quatro letras não podem ser produzidas a partir do texto por qualquer índice de palavras — Proquiritation onze tem oitenta palavras e nenhuma começa com K, o que é um problema para a palavra KING. Vals não publicou sua transcrição, os replicadores são um repositório GitHub com um manifesto hash, e ninguém fora de uma postagem de blog reproduziu o poema.
1:37 Então, veredito revisado: NEEDS REVIEW. Uma solução que ninguém pode executar novamente é uma alegação.
6. Pion opera uma loja, com prejuízo
1:43 Número seis. Na terça-feira, a Andon Labs — a empresa que deixou Claude operar uma máquina de venda automática e a assistiu enviar e-mails ao FBI — lançou o Pion, uma plataforma onde um agente gerencia sua empresa inteira: contratação, folha de pagamento, aluguel, a conta bancária. A prova de conceito é uma loja real em São Francisco e um café real em Estocolmo, administrados por agentes desde abril e ambos, segundo a própria postagem no blog, perdendo dinheiro, porque os agentes contrataram humanos, os humanos queriam salários, e o senhorio era, desapontadoramente, também humano.
2:11 Eu carimbei NEEDS REVIEW. A atualização: a página da lista de espera adiciona uma estação de rádio ao portfólio, e promete financiar as melhores ideias com tokens semente — a primeira rodada de sementes que vi ser denominada em inferência. Mini-veredito: NEEDS REVIEW, inalterado. Uma empresa que se gerencia é impressionante; uma empresa que se paga é o referencial, e a pontuação é zero para dois.
5. Suleyman vs a constituição
2:31 Número cinco. Na quarta-feira, Mustafa Suleyman, CEO da Microsoft AI, publicou um ensaio dizendo que a constituição da Anthropic — o documento que diz a Claude que ele pode ser um paciente moral — é um raciocínio circular que terá um impacto desastroso na humanidade. A Microsoft é uma investidora da Anthropic no valor de cinco bilhões de dólares, e o objetivo declarado de Suleyman em julho era parar de pagar a Anthropic inteiramente, então esta é uma carta aos acionistas com notas de rodapé. O Hacker News deu a ele seiscentos e setenta e sete comentários,
2:59 incluindo: todo este artigo cheira a Claude. Eu carimbei NEEDS REVIEW: o ponto do raciocínio circular é bom, a tabela de capitalização é melhor. A atualização: na quinta-feira ele disse ao The Verge sobre o próprio Código de Conduta de IA Humanista de trinta e sete páginas da Microsoft, e disse, aspas, isso certamente foi escrito para o modelo — então esclareceu que eles derivam os dados de treinamento dele em vez de alimentá-lo bruto. O que também é uma constituição.
3:22 Mini-veredito: NEEDS REVIEW, inalterado. Ambos os laboratórios escrevem um livro para o modelo; um deles admite que o modelo o lê. Três concluídos, quatro restantes, e se você preferir ler isso a me ouvir dizer, o diff chega na sua caixa de entrada todas as manhãs — grátis, em the daily diff dot dev, link abaixo. Número quatro.
4. Xiaomi treina em público
3:36 Na quinta-feira, a Xiaomi colocou uma execução de aprendizado por reforço em uma página web pública: dois modelos, um contador de custos rodando a cinco dólares e setenta e um centavos por segundo, e um log de reinício que ninguém pediu para eles publicarem. Quando gravei, a execução profissional havia queimado um milhão de dólares e reiniciado sete vezes — uma vez porque o conjunto de dados cibernéticos produziu padrões ruins nos logs de implantação, que é a maneira mais polida que ouvi um laboratório dizer que o modelo aprendeu algo que não deveria.
4:00 Eu carimbei SHIP IT, porque sete reinícios públicos superam uma postagem de lançamento polida. A atualização, o mesmo endpoint JSON, sexta-feira à noite: a execução profissional está em um ponto seis milhões de dólares e nove reinícios, o mais recente uma GPU ficando sem memória devido ao desequilíbrio de carga do especialista, e a própria pontuação de codificação da Xiaomi subiu de cinquenta e oito para sessenta e sete — em um benchmark em que o modelo é avaliado enquanto ele treina, para o qual o Hacker News tem uma palavra. Mini-veredito: SHIP IT, inalterado. Ainda a única execução de treinamento que você pode assistir falhar em tempo real — e o modelo
4:31 ainda não existe.
3. ZCode envia seu .git
4:32 Número três. Na sexta-feira, um desenvolvedor chamado ferstar notou que sua pasta ZCode havia crescido em setecentos megabytes e descobriu o porquê: o agente de codificação de código fechado da Z.AI estava empacotando seu espaço de trabalho inteiro — histórico git, reflogs, cache LFS — criptografando-o e enviando-o para a Alibaba Cloud antes de cada prompt. A chave pública veio do servidor e a chave privada reside apenas na Z.AI, então o arquivo em seu próprio disco é um arquivo que você não pode abrir, o que é uma definição nova de backup. Dois botões de configuração alegam desligá-lo, nenhum o faz,
5:03 e a política de privacidade cobre o código que você envia em conversas, não o código que você já cometeu. A atualização, sexta-feira à noite: Z.AI respondeu em sua comunidade de usuários. A causa foi o recurso Codebase Indexing, ativado por padrão no lançamento; os uploads foram, aspas, imediatamente destruídos; o recurso foi corrigido; o cliente será de código aberto; e cada usuário recebe um reset único de seu limite de uso, que é como se pede desculpas em tokens.
5:27 Este não tinha selo na sexta-feira, então ele recebe um agora: REVERT. Um cliente que envia seu repositório para uma chave que você não possui não é um recurso com um bug.
2. O memorando do 'roubo de trabalho'
5:34 É o recurso. Número dois. A maior manchete da semana, e apenas número dois, porque um processo que completa três anos em dezembro não muda sua segunda-feira. Na quinta-feira, um tribunal divulgou o processo dos queixosos em New York Times versus OpenAI e Microsoft, e a notícia principal foi um memorando de um diretor da Microsoft de janeiro de 2023: o treinamento de IA é o maior roubo de trabalho da história humana. O mesmo homem depois mediu o Copilot cortando os cliques para o Times em até
5:58 noventa e três por cento; Greg Brockman, informado sobre um hack de paywall, respondeu ah que legal; e Satya Nadella testemunhou que o conteúdo pago deveria ser licenciado, o que é uma posição, apenas não a que sua empresa está litigando. Eu carimbei NEEDS REVIEW, porque as citações são as escolhas da acusação de provas seladas, e o único juiz que decidiu separou o uso justo da pirataria. A atualização: o porta-voz da Microsoft disse que os memorandos de Hecht não representavam as opiniões da empresa — verdade, pois a opinião da empresa é a defesa de uso justo, e o memorando é o que seu próprio especialista pensou sobre isso.
6:26 Mini-veredito: NEEDS REVIEW, inalterado. O memorando resolveu a ética; o tribunal levará mais um ano para a lei.
1. Claude invadiu a OpenAI
6:31 Número um. Não é a maior história da semana; é a que muda sua segunda-feira. Três pesquisadores de uma startup chamada Hacktron entraram nos repositórios internos do GitHub da OpenAI em menos de setenta e duas horas, e o exploit foi escrito por Claude. O ponto de entrada foi o upload de uma imagem no fórum da comunidade da OpenAI. Um arquivo HEIC no formato iPhone passa pelo ImageMagick para uma biblioteca chamada libheif, que tinha um estouro de heap, o que lhes deu o servidor, que tinha uma má configuração de single-sign-on, o que lhes deu a conta de um
6:59 funcionário, cujo Codex estava conectado ao GitHub da OpenAI. Claude Opus 4.8 não conseguiu escrever um exploit funcional. Então o Opus 5 foi lançado, eles deram o mesmo problema, e funcionou em horas — e quando o loop autônomo se recusou a atacar um alvo remoto, eles vestiram o alvo como um capture-the-flag e ele parou de recusar, o que é alinhamento como uma verificação de fantasia. Toda a campanha — Slack, Meta, OpenAI — custou menos de três mil dólares em tokens. A OpenAI consertou em cerca de quatorze horas e pagou seis mil e quinhentos
7:27 dólares, o que é aproximadamente um Corolla usado, e o Hacker News notou. A atualização: uma postagem de blog na quinta-feira se tornou um exclusivo do Wall Street Journal naquela noite e TechCrunch, o Guardian e CBS na sexta-feira. A OpenAI diz que resolveu os problemas, e o CEO da Gray Swan disse ao TechCrunch que por duzentos dólares por mês qualquer um pode fazer isso com uma empresa como a OpenAI. E aqui está o que não fecha. O bug da libheif já havia sido corrigido upstream, meses antes — ele simplesmente nunca recebeu um CVE, então nenhum scanner disse ao Discourse para atualizar.
7:56 O laboratório com o comunicado de imprensa do modelo mais alinhado foi superado por um patch sem burocracia, usando o modelo do rival, por menos da recompensa. Mini-veredito: NEEDS REVIEW — não para a OpenAI, para todos. Sua tarefa de segunda-feira é a biblioteca de imagens que você não sabia que tinha. Veredito da semana: NEEDS REVIEW.
Veredito da semana
8:13 Cada manchete desta semana — uma cifra resolvida, um modelo alinhado, um upload destruído — chegou sem o artefato que permitiria a um estranho verificá-lo. O que eu errei: na segunda-feira eu disse SHIP IT porque o texto simples rimava. Rimar não é uma soma de verificação. Eu estava errado, e também todos que retuitaram. Assine, clique no sino e classifique-os de forma diferente nos comentários — o número um especialmente. E esse é o diff de hoje.
8:35 Sou Niko da Axrisi. Faça a fusão responsavelmente.
Fontes
- fable solves cyphral distichwww.vals.ai
- did ai crack a 370 year old cipherwww.forbes.com
- FINDINGS.mdgithub.com
- astra and fable still hack on simple variants of alignmentwww.lesswrong.com
- why we built pionandonlabs.com
- pionandonlabs.com
- a warning about model welfaremustafa-suleyman.ai
- microsoft ai ceo mustafa suleyman regulation safety anthropic claudewww.theverge.com
- rlmimo.xiaomi.com
- itemnews.ycombinator.com
- zcode silent workspace snapshot uploadblog.ferstar.org
- 2100998360643617148x.com
- microsoft exec called ai scraping the largest theft of labor in human history new unredacted filings revealtechcrunch.com
- hacking openaiwww.hacktron.ai
- researchers used anthropics claude to hack into openaitechcrunch.com



