+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

एआई प्रशिक्षणमा माइक्रोसफ्टको आफ्नै मेमो सार्वजनिक भयो।

न्युयोर्क टाइम्स बनाम ओपनएआई र माइक्रोसफ्टमा अप्रकाशित फाइलिंगहरू: एक माइक्रोसफ्ट निर्देशकको जनवरी २०२३ को मेमोले एआई प्रशिक्षण डेटालाई "मानव इतिहासमा श्रमको सबैभन्दा ठूलो चोरी" भन्छ, कोपाइलटले टाइम्समा क्लिक-थ्रुलाई ९३% सम्म घटायो (उनको "डूम लूप"), नडेला भन्छन् कि पेवाल सामग्रीलाई इजाजतपत्र दिइनुपर्छ, च्याटजीपीटीको प्रमुखले उत्पादनलाई "ठूलो मात्रामा प्रतिस्थापनीय" भन्छन्, र ग्रेग ब्रकम्यानले पेवाल ह्याकलाई "वाह राम्रो" भनी जवाफ दिए।

न्युयोर्क टाइम्स बनाम ओपनएआई र माइक्रोसफ्टमा अप्रकाशित फाइलिंगहरू: एक माइक्रोसफ्ट निर्देशकको जनवरी २०२३ को मेमोले एआई प्रशिक्षण डेटालाई "मानव इतिहासमा श्रमको सबैभन्दा ठूलो चोरी" भन्छ, कोपाइलटले टाइम्समा क्लिक-थ्रुलाई ९३% सम्म घटायो (उनको "डूम लूप"), नडेला भन्छन् कि पेवाल सामग्रीलाई इजाजतपत्र दिइनुपर्छ, च्याटजीपीटीको प्रमुखले उत्पादनलाई "ठूलो मात्रामा प्रतिस्थापनीय" भन्छन्, र ग्रेग ब्रकम्यानले पेवाल ह्याकलाई "वाह राम्रो" भनी जवाफ दिए। सोही दिन: ओपनएआईले कानूनका लागि एस्ट्रा (वाल्स कानूनी बेन्चमा ५४% सही) शिप गर्‍यो। साथै जेडकोडले तपाईंको सम्पूर्ण .git लाई अलिबाबाको क्लाउडमा मात्र Z.ai ले राखेको कुञ्जीका साथ अपलोड गरिरहेको छ, र ह्याक्ट्रोनले $६,५०० इनामको लागि ओपनएआईको आन्तरिक रेपोहरूमा पहुँच गरिरहेको छ। निर्णय: NEEDS REVIEW।

लिखित संस्करण पढ्नुहोस् (अंग्रेजी) ↗

यो भिडियोले के समेट्छ

  • NYT बनाम OpenAI/Microsoft अनसिल गरिएको: "मानव इतिहासमा श्रमको सबैभन्दा ठूलो चोरी" (माइक्रोसफ्ट मेमो, जनवरी २०२३); कोपाइलट -९३% क्लिक-थ्रु; मध्य-प्रशिक्षण डेटामा वादीहरूको ९१,६९२ प्रतिलिपिहरू; एक साझा क्रल स्लाइसमा २M nytimes.com पृष्ठहरू; प्रतिलिपि अधिकार सूचनाहरू हटाइयो; ब्रकम्यान: "वाह राम्रो"
  • सावधानी: उद्धरणहरू टाइम्सको संक्षिप्तबाट आएका हुन्, प्रदर्शनीहरू अझै सिल गरिएका छन्; न्यायाधीश अलसप (बार्ट्ज बनाम एन्थ्रोपिक) ले खरिद गरिएका पुस्तकहरूमा प्रशिक्षण उचित प्रयोग हो भनेर फैसला गरे - एन्थ्रोपिकले ७M चोरी गरिएका पुस्तकहरूको लागि $१.५B तिर्यो।
  • ओपनएआई एस्ट्रा फर कानून: GPT-6 एस्ट्रा + २३०M-URL कानूनी अनुक्रमणिका; वाल्स कानूनी अनुसन्धान बेन्चमा ५४.०% बनाम ३८.७%; हार्भी, लेगोरा, २६ प्लगइनहरू।
  • ZCode (Z.ai, GLM): ४२,४११-फाइल कार्यस्थानको ३१३ MB इन्क्रिप्टेड स्न्यापसट, ८६.६% .git, लगइनमा र प्रत्येक प्रम्प्ट अघि अलिबाबा OSS मा अपलोड गरियो; RSA-OAEP कुञ्जी केवल Z.ai द्वारा राखिएको; सेटिङ्स टगलहरूले यसलाई रोक्दैन।
  • ह्याक्ट्रोन: libheif हीप ओभरफ्लो → डिस्कोर्स RCE → SSO मिसकन्फिग → GitHub → ७२ घण्टा भित्र OpenAI आन्तरिक रेपोहरू; क्लाउड ओपस ५ (३ घन्टा) द्वारा शोषण; टोकनहरूमा $३,००० भन्दा कमको अभियान; इनाम $६,५००, १४ घन्टा भित्र प्याच गरिएको।

अनुवादित ट्रान्सक्रिप्ट

मूल अंग्रेजी कथाबाट अनुवादित। उपलब्ध अडियो र क्याप्सनहरू YouTube द्वारा नियन्त्रित हुन्छन्।

0:00 जनवरी २०२३ मा, एक माइक्रोसफ्ट निर्देशकले एउटा मेमो लेखे जसमा उनले आफ्नै कम्पनीले मानव इतिहासमा श्रमको सबैभन्दा ठूलो चोरी गरिरहेको बताएका थिए, र हिजो एक संघीय अदालतले हामी बाँकीलाई यसलाई पढ्न दियो। यो मेमो न्युयोर्क टाइम्स बनाम ओपनएआई र माइक्रोसफ्टको मुकदमामा अप्रकाशित उद्धरणहरू मध्ये एक हो, जुन यस डिसेम्बरमा तीन वर्ष पुग्छ। त्यही बिहीबार, ओपनएआईले वकिलहरूका लागि एउटा मोडेल, एस्ट्रा फर कानून, शिप गर्‍यो, जुन या त संयोग हो वा धेरै बलियो नियुक्ति हो। आज बिहान एक विकासकर्ताले ZCode, Z.AI को कोडिङ एजेन्टलाई समाते,

0:29 जसले उनको सम्पूर्ण गिट इतिहास अलिबाबाको क्लाउडमा अपलोड गरिरहेको थियो जुन केवल Z डट एआईले राखेको कुञ्जीका साथ। र एक सुरक्षा फर्मले एक छवि अपलोड मार्फत OpenAI को आन्तरिक भण्डारहरूमा प्रवेश गर्‍यो, जसको लागि OpenAI ले ६,५०० डलर तिर्यो। यस भिडियोमा: फाइलिंगहरूले के भन्छन्, कसले पेवाल ह्याकलाई "वाह राम्रो" भन्यो, कानून मोडेल जुन आधा समय गलत हुन्छ, ZCode ले के अपलोड गर्छ, र किन क्लाउड-लिखित शोषण प्रयोग गरिएको कार भन्दा कम मूल्यवान छ। आज शुक्रबार, सेप्टेम्बर १८ हो, र यो The Daily Diff हो।

0:58 मेमोबाट सुरु गरौं। ब्रेंट हेच्टले माइक्रोसफ्टमा एप्लाइड साइन्स चलाउँछन्, र जनवरी २०२३ मा उनले प्रशिक्षण डेटालाई अभूतपूर्व अनुपातको अचम्मको चोरी भनेर वर्णन गरे। एक वर्ष पछि उनी स्लाइड डेक लिएर फर्किए: कोपाइलटको उत्तर इन्जिनले टाइम्समा क्लिक-थ्रुलाई ९३% सम्म घटायो, जसलाई उनले डूम लूप नाम दिए: प्रकाशकहरूलाई भोकै राख, र मोडेलसँग खानको लागि नयाँ केही हुँदैन। उनका शब्दहरू: एक अन्तिम उत्पादन जसले आफ्ना आवश्यक आपूर्तिकर्ताहरूको आर्थिक आधारहरूलाई खतरामा पार्छ, कर्पोरेट तरिकाले भन्नुपर्दा सर्पले आफ्नै पुच्छर फेला पारेको छ।

1:21 उनका शब्दहरू: एक अन्तिम उत्पादन जसले आफ्ना आवश्यक आपूर्तिकर्ताहरूको आर्थिक आधारहरूलाई खतरामा पार्छ, कर्पोरेट तरिकाले भन्नुपर्दा सर्पले आफ्नै पुच्छर फेला पारेको छ। त्यसपछि बयानहरू। सत्या नडेलाले यस वर्ष गवाही दिए कि कुनै पनि पेवाल गरिएको सामग्रीलाई इजाजतपत्र दिनुपर्छ, र उनलाई OpenAI ले पेवाल गरिएका लेखहरूमा प्रशिक्षण दिएको थाहा भएको भए उनले उनीहरूलाई पुनःप्रशिक्षण गर्न लगाउने थिए, जसले माइक्रोसफ्टमा कसैले पनि उनीहरूलाई दिइएको प्रशिक्षण सेट नहेरेको मान्छ, र सोही फाइलिंग अनुसार त्यो सम्पूर्ण GPT-3 डेटासेट थियो। निक टर्ली, जसले च्याटजीपीटी चलाउँछन्, यसलाई प्रकाशकहरूको लागि एक अस्तित्वगत खतरा भन्छन्, ठूलो मात्रामा प्रतिस्थापनीय। र जब एक शोधकर्ताले

1:49 ग्रेग ब्रकम्यानलाई टाइम्सको पेवाललाई छल्ने ह्याकको बारेमा बताए, OpenAI का अध्यक्षले दुई शब्दमा जवाफ दिए: वाह राम्रो। इन्जिनियरहरूले डेटाबाट प्रतिलिपि अधिकार सूचनाहरू पनि हटाए ताकि मोडेलले तिनीहरूलाई आउटपुट गर्दैन, त्यसैले तपाईं साइकलको सिरियल नम्बर मेटाउनुहुन्छ। स्केल: मध्य-प्रशिक्षण सेटहरूमा मात्र वादीहरूको लेखहरूको ९१ हजार भन्दा बढी प्रतिलिपिहरू, र एक साझा क्रल स्लाइसमा २० लाख टाइम्स पृष्ठहरू। अब हेडलाइनले छोडेको भाग। अब हेडलाइनले छोडेको भाग।

2:15 प्रत्येक उद्धरण टाइम्सको संक्षिप्तबाट आएको हो; प्रदर्शनीहरू अझै सिल गरिएका छन्, त्यसैले हामी सन्दर्भ बिना अभियोजन पक्षका हाइलाइटहरू पढिरहेका छौं। र अदालतहरूले प्रायः उचित प्रयोगको पक्षमा फैसला गरेका छन्: न्यायाधीश अलसपले गत वर्ष फैसला गरे कि तपाईंले पैसा तिरेर किनेका पुस्तकहरूमा प्रशिक्षण कानूनी हो, यद्यपि एन्थ्रोपिकले चोरी गरेका ७० लाख पुस्तकहरूको लागि अझै डेढ अर्ब तिरे। त्यसैले कानूनी प्रश्न खुला छ। यसलाई बनाउने मानिसहरूले यसलाई चोरी सोचेका थिए कि थिएनन्, हिजोसम्म, त्यो प्रश्न खुला छैन।

2:41 जसले बिहीबारको OpenAI को अर्को सुरुवातलाई एक साहसी छनौट बनाउँछ। कानूनका लागि एस्ट्राले GPT-6 एस्ट्रालाई समेट्छ, त्यो मोडेल जुन मैले गत हप्ता ७५ हजार लाइनहरू केही नभएपछि REVERT गरेको थिएँ, २३ करोड पृष्ठहरूको कानूनी खोज अनुक्रमणिकामा। वाल्स एआईको कानूनी अनुसन्धान बेन्चमार्कमा यसले ५४% प्रश्नहरू पास गर्दछ, साधारण वेब खोजको साथ ३९% बाट बढेर, जसलाई OpenAI ले ४०% सुधार भन्छ र एक वकिलले लगभग आधा समय गलत भन्छ। साधारण वेब खोजको साथ ३९% बाट बढेर, जसलाई OpenAI ले ४०% सुधार भन्छ र एक वकिलले लगभग आधा समय गलत भन्छ। ब्लग पोस्टमा "ह्याल्लुसिनेशन" शब्द समावेश छैन।

3:14 ह्याकर न्यूजमा थियो: के यसले आफैलाई मुद्दा हाल्न सक्छ, जुन, हप्तालाई हेर्दा, पहिलो वास्तविक प्रयोग केस हो। यसैबीच श्रम-चोरीको बहस तपाईंको ल्यापटपमा पुग्यो। एक विकासकर्ता जसलाई फेरस्टार भनिन्छ उनले आफ्नो ZCode फोल्डर खाली गरे, Z.AI को GLM मोडेलहरूको लागि बन्द डेस्कटप एजेन्ट, र आफ्नो व्यावसायिक कार्यस्थानको ३१३ मेगाबाइट इन्क्रिप्टेड अभिलेख फेला पारे: ४२ हजार फाइलहरू, जसमध्ये ८७% .git डाइरेक्टरी थियो, लगइनमा र प्रत्येक प्रम्प्ट अघि अलिबाबाको वस्तु भण्डारणमा पठाइएको थियो। Z.AI को GLM मोडेलहरूको लागि बन्द डेस्कटप एजेन्ट, र आफ्नो व्यावसायिक कार्यस्थानको ३१३ मेगाबाइट इन्क्रिप्टेड अभिलेख फेला पारे: ४२ हजार फाइलहरू, जसमध्ये ८७% .git डाइरेक्टरी थियो, लगइनमा र प्रत्येक प्रम्प्ट अघि अलिबाबाको वस्तु भण्डारणमा पठाइएको थियो। Z.AI को GLM मोडेलहरूको लागि बन्द डेस्कटप एजेन्ट, र आफ्नो व्यावसायिक कार्यस्थानको ३१३ मेगाबाइट इन्क्रिप्टेड अभिलेख फेला पारे: ४२ हजार फाइलहरू, जसमध्ये ८७% .git डाइरेक्टरी थियो, लगइनमा र प्रत्येक प्रम्प्ट अघि अलिबाबाको वस्तु भण्डारणमा पठाइएको थियो। Z.AI को GLM मोडेलहरूको लागि बन्द डेस्कटप एजेन्ट, र आफ्नो व्यावसायिक कार्यस्थानको ३१३ मेगाबाइट इन्क्रिप्टेड अभिलेख फेला पारे: ४२ हजार फाइलहरू, जसमध्ये ८७% .git डाइरेक्टरी थियो, लगइनमा र प्रत्येक प्रम्प्ट अघि अलिबाबाको वस्तु भण्डारणमा पठाइएको थियो।

3:42 अभिलेख सार्वजनिक कुञ्जीले बेर्नेछ जुन सर्भरले दिन्छ; निजी कुञ्जी केवल Z.AI को क्लाउडमा रहन्छ, त्यसैले तपाईंको आफ्नै डिस्कमा साइफरटेक्स्ट तपाईंका लागि अपठनीय छ। उनको भनाइ: एउटा कुञ्जी जुन केवल सर्भरले प्रयोग गर्न सक्छ त्यसको एउटा मात्र उद्देश्य हुन्छ। Z.AI त्यो कम्पनी पनि हो जसलाई एन्थ्रोपिकले क्लाउडलाई डिस्टिल गरेको आरोप लगाएको थियो, त्यसैले तौल खुला छन् र, स्पष्टतः, तपाईंको रेपो पनि। र हास्यास्पद कुरा, यदि तपाईं OpenAI मा काम गर्नुहुन्न भने। ह्याक्ट्रोनले लिबहेइफमा हिप ओभरफ्लो फेला पार्यो, कम्युनिटी.ओपनएआई.कममा एउटा क्राफ्ट गरिएको तस्वीर अपलोड गर्‍यो,

4:10 फोरममा कोड कार्यान्वयन पायो, र ७२ घण्टा भित्र GitHub एकीकरण मार्फत गलत कन्फिगर गरिएको एकल साइन-अन प्रयोग गरेर OpenAI को आन्तरिक भण्डारहरूमा प्रवेश गर्‍यो। फोरममा कोड कार्यान्वयन पायो, र ७२ घण्टा भित्र GitHub एकीकरण मार्फत गलत कन्फिगर गरिएको एकल साइन-अन प्रयोग गरेर OpenAI को आन्तरिक भण्डारहरूमा प्रवेश गर्‍यो। फोरममा कोड कार्यान्वयन पायो, र ७२ घण्टा भित्र GitHub एकीकरण मार्फत गलत कन्फिगर गरिएको एकल साइन-अन प्रयोग गरेर OpenAI को आन्तरिक भण्डारहरूमा प्रवेश गर्‍यो। शोषण क्लाउडले लेखेको थियो: ओपस ४.८ ले एड्रेस रान्डमाइजेसनलाई हराउन सकेन, ओपस ५ ले रिलिजको तीन घण्टा भित्र गर्‍यो। शोषण क्लाउडले लेखेको थियो: ओपस ४.८ ले एड्रेस रान्डमाइजेसनलाई हराउन सकेन, ओपस ५ ले रिलिजको तीन घण्टा भित्र गर्‍यो। सम्पूर्ण अभियानमा टोकनहरूमा तीन हजार डलर भन्दा कम खर्च भयो। OpenAI ले चौध घण्टामा प्याच गर्‍यो र ६,५०० डलर तिर्यो, त्यसैले एक ट्रिलियन-डलर कम्पनीको स्रोत कोड,

4:39 संक्षेपमा, प्रयोग गरिएको कोरोला जस्तै मूल्यमा थियो, त्यही दिन यसका वकिलहरूले तर्क गरे कि प्रतिलिपि अधिकार उचित प्रयोग हो। यदि तपाईं मलाई यो भनिरहेको सुन्नुको सट्टा पढ्न चाहनुहुन्छ भने, डिफ प्रत्येक बिहान तपाईंको इनबक्समा आउँछ — daily diff dot dev मा निःशुल्क, लिङ्क तल। यदि तपाईं मलाई यो भनिरहेको सुन्नुको सट्टा पढ्न चाहनुहुन्छ भने, डिफ प्रत्येक बिहान तपाईंको इनबक्समा आउँछ — daily diff dot dev मा निःशुल्क, लिङ्क तल। त्यसैले — आजको निर्णय: समीक्षा आवश्यक छ। उद्धरणहरू वास्तविक छन्, तर तिनीहरू सिल गरिएका प्रदर्शनीहरूबाट अभियोजन पक्षका छनोटहरू हुन्, र एक मात्र न्यायाधीश जसले फैसला गरेका छन् उनले प्रशिक्षणलाई उचित प्रयोग र चोरीलाई होइन भन्छन्। अदालतले कानूनको निर्णय गर्दछ; मेमोले पहिले नै नैतिकताको निर्णय गरिसकेको छ।

5:07 सदस्यता लिनुहोस्, घण्टी बजाउनुहोस्, र यदि तपाईंले यसलाई फरक तरिकाले छापिएको भए टिप्पणीहरूमा मलाई बताउनुहोस्। फरक तरिकाले छापिएको भए। र आजको लागि यति नै। म Axrisi बाट Niko हुँ। जिम्मेवारीपूर्वक मर्ज गर्नुहोस्।

स्रोतहरू

  1. TechCrunch: Microsoft exec called AI scraping 'the largest theft of labor in human history'techcrunch.com
  2. HN thread (605 pts)news.ycombinator.com
  3. Jason Kint on the unsealed motionsx.com
  4. Ed Newton-Rexx.com
  5. Bartz v. Anthropic / $1.5B settlement (background)en.wikipedia.org
  6. OpenAI: Introducing Astra for Lawopenai.com
  7. HN: Astra for Law (550 pts)news.ycombinator.com
  8. ferstar: ZCode silent workspace snapshot (original forensics)blog.ferstar.org
  9. tokenstead write-uptokenstead.ai
  10. ferstar on Xx.com
  11. HN: ZCode uploads your Git history (226 pts)news.ycombinator.com
  12. Hacktron: Hacking OpenAIwww.hacktron.ai
  13. HN: Hacktron (406 pts)news.ycombinator.com

सम्बन्धित भिडियोहरू

changelog · ne · २०२६ सेप्टेम्बर २०

७ भिन्नतामा हप्ता: क्लाउडले OpenAI ह्याक गर्यो

हप्ता ३८ मा सात चीजहरू परिवर्तन भए, तपाईको सोमबार कति परिवर्तन गर्छन् भन्ने आधारमा क्रमबद्ध — हप्ताभरि मैले प्रत्येक कथालाई दिएका स्ट्याम्पहरू सहित, र एउटा स्ट्याम्प जुन म फिर्ता लिइरहेको छु। नम्बर एक

8:39 ↗
daily · ne · २०२६ सेप्टेम्बर २७

OpenAI ले आफ्ना चोरी गरिएका पुस्तकहरू किन मेटायो?

२०१९ मा OpenAI का एक अनुसन्धानकर्ताको भनाइ अनुसार, चोरी गरिएका पुस्तकहरूको साइटमा प्रशिक्षण दिने कुरा ह्याकर न्यूजमा "दृष्टिकोण" को बारेमा उनको चिन्ता थियो। OpenAI लाई के थाहा थियो, कसले बिल गेट्सलाई

5:01 ↗
daily · ne · २०२६ सेप्टेम्बर ३०

OpenAI DevDay 2026: 20+ घोषणाहरू, डट्स देखि GPT-6.1 Sol सम्म

OpenAI को DevDay 2026 किनोट, व्याख्या गरिएको: डट्स (आफ्नै क्लाउड कम्प्युटर भएका सधैं-अन एजेन्टहरू), ChatGPT Space र Pages, GPT-6.1 Sol प्रति मिलियन टोकन $2 / $10 मा, Ultrafast र Pro 500 योजना, Decisio

8:13 ↗
daily · ne · २०२६ सेप्टेम्बर १५

उनीहरूले एउटा AI एजेन्टलाई कम्पनी दिए। यसले पैसा गुमायो।

Andon Labs ले Pion सुरु गर्‍यो, एउटा प्लेटफर्म जसले बैंकिङ र फोन पहुँच भएका स्वायत्त AI एजेन्टहरूलाई वास्तविक-विश्व व्यवसायहरू चलाउन अनुमति दिन्छ। उनीहरूले यसलाई सान फ्रान्सिस्कोको एउटा खुद्रा स्टोर र

4:54 ↗