AI તાલીમ પર માઈક્રોસોફ્ટનો પોતાનો મેમો સાર્વજનિક થયો.
ન્યૂયોર્ક ટાઈમ્સ વિ.
ન્યૂયોર્ક ટાઈમ્સ વિ. ઓપનએઆઈ અને માઈક્રોસોફ્ટના અદાલતી દસ્તાવેજો જાહેર થયા: માઈક્રોસોફ્ટના ડિરેક્ટરના જાન્યુઆરી 2023ના મેમોમાં AI તાલીમ ડેટાને "માનવ ઇતિહાસમાં શ્રમની સૌથી મોટી ચોરી" કહેવામાં આવ્યો છે, કોપાયલટે ટાઈમ્સમાં ક્લિક-થ્રુને 93% સુધી ઘટાડ્યા (તેમનો "ડૂમ લૂપ"), નડેલા કહે છે કે પેવોલ કરેલી સામગ્રીને લાયસન્સ આપવું જોઈએ, ChatGPTના વડા ઉત્પાદનને "મોટાભાગે અવેજી" કહે છે, અને ગ્રેગ બ્રોકમેને પેવોલ હેકનો જવાબ "આહ નાઇસ" કહીને આપ્યો. તે જ દિવસે: ઓપનએઆઈએ કાયદા માટે એસ્ટ્રા રજૂ કર્યું (વલ્સ લીગલ બેન્ચ પર 54% સાચું). ઉપરાંત ZCode તમારા સમગ્ર .git ને Aliyun પર અપલોડ કરે છે, જેમાં ફક્ત Z.ai પાસે કી હોય છે, અને Hacktron $6,500ના ઇનામ માટે ઓપનએઆઈના આંતરિક રેપોઝ સુધી પહોંચી ગયું. ચુકાદો: NEEDS REVIEW.
લખેલી આવૃત્તિ વાંચો (અંગ્રેજી) ↗
આ વીડિયોમાં શું આવરી લેવામાં આવ્યું છે
- NYT વિ. OpenAI/Microsoft જાહેર: "માનવ ઇતિહાસમાં શ્રમની સૌથી મોટી ચોરી" (માઈક્રોસોફ્ટ મેમો, જાન્યુઆરી 2023); કોપાયલટ −93% ક્લિક-થ્રુ; મધ્ય-તાલીમ ડેટામાં ફરિયાદીઓના કાર્યોની 91,692 નકલો; એક કોમન ક્રોલ સ્લાઈસમાં 2M nytimes.com પૃષ્ઠો; કોપીરાઈટ નોટિસ હટાવવામાં આવી; બ્રોકમેન: "આહ નાઇસ"
- નોંધ: અવતરણો ટાઈમ્સના સંક્ષિપ્ત પત્રમાંથી આવે છે, પ્રદર્શનો હજુ પણ સીલબંધ છે; જજ અલ્સપ (બાર્ત્ઝ વિ. એન્થ્રોપિક) એ નિર્ણય આપ્યો કે ખરીદેલા પુસ્તકો પર તાલીમ આપવી એ વાજબી ઉપયોગ છે — એન્થ્રોપિકે 7M પાઇરેટેડ પુસ્તકો માટે $1.5B ચૂકવ્યા
- OpenAI એસ્ટ્રા ફોર લો: GPT-6 એસ્ટ્રા + 230M-URL લીગલ ઇન્ડેક્સ; Vals લીગલ રિસર્ચ બેન્ચ પર 54.0% વિરુદ્ધ 38.7%; હાર્વે, લેગોરા, 26 પ્લગઈન્સ
- ZCode (Z.ai, GLM): 42,411-ફાઇલ વર્કસ્પેસનો 313 MB એન્ક્રિપ્ટેડ સ્નેપશોટ, 86.6% .git, લોગિન પર અને દરેક પ્રોમ્પ્ટ પહેલાં Aliyun OSS પર અપલોડ કરવામાં આવ્યો; RSA-OAEP કી ફક્ત Z.ai પાસે છે; સેટિંગ્સ ટૉગલ્સ તેને રોકતા નથી
- Hacktron: libheif હિપ ઓવરફ્લો → ડિસ્કોર્સ RCE → SSO મિસકન્ફિગ → GitHub → OpenAI આંતરિક રેપોઝ 72 કલાકથી ઓછા સમયમાં; ક્લાઉડ ઓપસ 5 દ્વારા શોષણ (3 કલાક); $3,000 થી ઓછા ટોકન્સમાં ઝુંબેશ; $6,500 ઇનામ, ~14 કલાકમાં પેચ કરવામાં આવ્યું
અનુવાદિત ટ્રાન્સક્રિપ્ટ
મૂળ અંગ્રેજી કથામાંથી અનુવાદિત. ઉપલબ્ધ ઑડિઓ અને કૅપ્શન્સ YouTube દ્વારા નિયંત્રિત થાય છે.
0:00 જાન્યુઆરી 2023 માં, માઈક્રોસોફ્ટના એક ડિરેક્ટરે એક મેમો લખ્યો હતો જેમાં તેઓની પોતાની કંપની જે કરી રહી હતી તેને માનવ ઇતિહાસમાં શ્રમની સૌથી મોટી ચોરી ગણાવી હતી, અને ગઈકાલે એક ફેડરલ કોર્ટે બાકીના લોકોને તે વાંચવા દીધું. આ મેમો ન્યૂ યોર્ક ટાઈમ્સ વિરુદ્ધ ઓપનએઆઈ અને માઈક્રોસોફ્ટના અદાલતી દસ્તાવેજોમાંના એક છે, જે દાવો આ ડિસેમ્બરમાં ત્રણ વર્ષનો થશે. તે જ ગુરુવારે, ઓપનએઆઈએ વકીલો માટે એક મોડેલ, એસ્ટ્રા ફોર લો, રજૂ કર્યું, જે કાં તો એક સંયોગ છે અથવા એક ખૂબ જ મજબૂત ભરતી છે. આજે સવારે એક ડેવલપરે ZCode, Z.ai નો કોડિંગ એજન્ટ,
0:29 તેનો આખો ગિટ ઇતિહાસ અલીબાબાના ક્લાઉડ પર અપલોડ કરતા પકડ્યો, જેમાં ફક્ત Z.ai પાસે કી હતી. અને એક સિક્યોરિટી ફર્મ એક ઇમેજ અપલોડ દ્વારા ઓપનએઆઈના આંતરિક રિપોઝિટરીઝમાં પ્રવેશી હતી, જેના માટે ઓપનએઆઈએ છ હજાર પાંચસો ડોલર ચૂકવ્યા. આ વીડિયોમાં: અદાલતી દસ્તાવેજો શું કહે છે, પેવોલ હેક પર કોણે 'આહ નાઇસ' કહ્યું, અડધા સમય ખોટું કરતું કાયદાનું મોડેલ, ZCode શું અપલોડ કરે છે, અને ક્લાઉડ-લખિત શોષણ શા માટે વપરાયેલી કાર કરતાં ઓછું મૂલ્યવાન છે. આ શુક્રવાર, 18મી સપ્ટેમ્બર છે, અને આ ધ ડેઇલી ડિફ છે.
0:58 મેમોથી શરૂઆત કરીએ. બ્રેન્ટ હેચટ માઈક્રોસોફ્ટમાં એપ્લાઇડ સાયન્સનું સંચાલન કરે છે, અને જાન્યુઆરી 2023માં તેણે તાલીમ ડેટાને અભૂતપૂર્વ પ્રમાણમાં ચોરી ગણાવી હતી. એક વર્ષ પછી તે એક સ્લાઇડ ડેક સાથે પાછો આવ્યો: કોપાયલટના જવાબ એન્જિને ટાઈમ્સમાં ક્લિક-થ્રુને નેવું-ત્રણ ટકા સુધી ઘટાડ્યા, જેને તેણે ડૂમ લૂપ નામ આપ્યું: પ્રકાશકોને ભૂખે મરાવવા, અને મોડેલ પાસે ખાવા માટે કંઈ નવું નથી. તેના શબ્દો: એક અંતિમ ઉત્પાદન જે તેના આવશ્યક સપ્લાયરોની આર્થિક પાયાને જોખમમાં મૂકે છે,
1:21 કોર્પોરેટ રીતે કહીએ તો સાપે તેની પૂંછડી શોધી લીધી છે. પછી જુબાનીઓ. સત્ય નડેલાએ આ વર્ષે જુબાની આપી કે કોઈપણ પેવોલ કરેલી સામગ્રીને લાયસન્સ આપવું જોઈએ, અને જો તેમને ખબર હોત કે ઓપનએઆઈએ પેવોલ કરેલા લેખો પર તાલીમ લીધી છે, તો તેઓએ તેમને ફરીથી તાલીમ આપવાનું કહ્યું હોત, જે ધારે છે કે માઈક્રોસોફ્ટમાં કોઈએ તાલીમ સેટ ખોલ્યો ન હતો જે તેમને આપવામાં આવ્યો હતો, અને તે જ ફાઇલિંગ મુજબ તે આખો GPT-3 ડેટાસેટ હતો. નિક ટર્લી, જે ChatGPTનું સંચાલન કરે છે, તેણે તેને પ્રકાશકો માટે અસ્તિત્વનો ખતરો ગણાવ્યો, મોટાભાગે અવેજી. અને જ્યારે એક સંશોધક
1:49 ગ્રેગ બ્રોકમેનને ટાઈમ્સના પેવોલને બાયપાસ કરવાના હેક વિશે કહ્યું, ત્યારે ઓપનએઆઈના પ્રમુખે બે શબ્દોમાં જવાબ આપ્યો: આહ નાઇસ. ઇજનેરોએ ડેટામાંથી કોપીરાઇટ નોટિસ પણ હટાવી દીધી જેથી મોડેલ તેમને આઉટપુટ ન કરે, જેના કારણે તમે સાયકલ પરથી સીરીયલ નંબર ભૂંસી નાખો છો. પ્રમાણ: ફક્ત મધ્ય-તાલીમ સેટમાં જ ફરિયાદીઓના લેખોની એકાણું હજારથી વધુ નકલો, અને એક કોમન ક્રોલ સ્લાઈસમાં વીસ લાખ ટાઈમ્સ પૃષ્ઠો. હવે જે ભાગ હેડલાઇન છોડી દે છે. હેડલાઇન આ ભાગ છોડી દે છે.
2:15 દરેક અવતરણ ટાઈમ્સના સંક્ષિપ્ત પત્રમાંથી આવે છે; પ્રદર્શનો હજુ પણ સીલબંધ છે, તેથી આપણે સંદર્ભ વિના પ્રોસિક્યુશનની મુખ્ય વાતો વાંચી રહ્યા છીએ. અને અદાલતોએ મોટાભાગે વાજબી ઉપયોગની તરફેણ કરી છે: જજ અલ્સપે ગયા વર્ષે નિર્ણય આપ્યો કે તમે જે પુસ્તકો માટે ચૂકવણી કરી છે તેના પર તાલીમ આપવી કાયદેસર છે, જોકે એન્થ્રોપિકે તેણે પાઇરેટ કરેલા સાત મિલિયન માટે દોઢ અબજ ચૂકવ્યા. તેથી કાયદાકીય પ્રશ્ન ખુલ્લો છે. તેનું નિર્માણ કરનારા લોકોએ તેને ચોરી માન્યું હતું કે નહીં તે, ગઈકાલથી, નથી.
2:41 જે ગુરુવારના ઓપનએઆઈના બીજા લોન્ચને એક બોલ્ડ પસંદગી બનાવે છે. એસ્ટ્રા ફોર લો GPT-6 એસ્ટ્રાને આવરી લે છે, જે મોડેલને મેં ગયા અઠવાડિયે REVERT કર્યું હતું જ્યારે તેણે પંચોતેર હજાર લાઇન કશું જ ન આપ્યું હતું, બસો ત્રીસ મિલિયન પૃષ્ઠોના કાનૂની શોધ અનુક્રમણિકામાં. Vals AIના કાનૂની સંશોધન બેન્ચમાર્ક પર તે પચાસ-ચાર ટકા પ્રશ્નો પાસ કરે છે, સામાન્ય વેબ શોધ સાથેના ઓગણત્રીસ ટકાથી ઉપર, જેને ઓપનએઆઈ ચાલીસ ટકા સુધારા કહે છે અને એક વકીલ લગભગ અડધા સમય ખોટું કહેશે. બ્લોગ પોસ્ટમાં 'ભ્રમણા' શબ્દ નથી.
3:14 હેકર ન્યૂઝે કર્યો: શું તે પોતાને દાવો કરી શકશે, જે, આ અઠવાડિયાને જોતાં, પ્રથમ વાસ્તવિક ઉપયોગનો કેસ છે. દરમિયાન શ્રમ-ચોરીનો વિમર્શ તમારા લેપટોપ સુધી પહોંચી ગયો. એક ડેવલપરે, જેનું નામ ફરસ્ટાર છે, તેનું ZCode ફોલ્ડર સાફ કર્યું, Z.ai નું GLM મોડેલ માટેનું ક્લોઝ્ડ ડેસ્કટોપ એજન્ટ, અને તેના કોમર્શિયલ વર્કસ્પેસનું ત્રણસો તેર મેગાબાઇટનું એન્ક્રિપ્ટેડ આર્કાઇવ મળ્યું: બેતાલીસ હજાર ફાઇલો, તેમાંના સિત્યાસી ટકા ડોટ ગિટ ડિરેક્ટરી હતી, જે લોગિન પર અને દરેક પ્રોમ્પ્ટ પહેલાં અલીબાબાના ઓબ્જેક્ટ સ્ટોરેજ પર મોકલવામાં આવ્યું હતું.
3:42 આ આર્કાઇવ એક પબ્લિક કી સાથે લપેટીને છે જે સર્વર આપે છે; પ્રાઇવેટ કી ફક્ત Z.ai ના ક્લાઉડમાં રહે છે, તેથી તમારી પોતાની ડિસ્ક પરનું સાઇફરટેક્સ્ટ તમારા માટે વાંચી શકાય તેવું નથી. તેમની લાઇન: એક કી જેનો ઉપયોગ ફક્ત સર્વર જ કરી શકે છે તેનો એક જ હેતુ હોય છે. Z.ai એ જ કંપની છે જેના પર એન્થ્રોપિકે ક્લાઉડને ડિસ્ટિલ કરવાનો આરોપ મૂક્યો હતો, તેથી વજન ખુલ્લા છે અને તેથી, દેખીતી રીતે, તમારું રેપો પણ. અને રમુજી એક, સિવાય કે તમે ઓપનએઆઈમાં કામ કરતા હોવ. હેકટ્રોનને libheif માં હિપ ઓવરફ્લો મળ્યો, community.openai.com પર એક ક્રાફ્ટેડ ચિત્ર અપલોડ કર્યું,
4:10 ફોરમ પર કોડ એક્ઝિક્યુશન મેળવ્યું, અને એક ખોટી રીતે ગોઠવેલા સિંગલ સાઇન-ઓન દ્વારા ગિટહબ ઇન્ટિગ્રેશન મારફતે ઓપનએઆઈના આંતરિક રિપોઝિટરીઝમાં, બોતેર કલાકથી ઓછા સમયમાં પ્રવેશ મેળવ્યો. આ શોષણ ક્લાઉડ દ્વારા લખવામાં આવ્યું હતું: ઓપસ 4.8 એડ્રેસ રેન્ડમાઇઝેશનને હરાવી શક્યું ન હતું, ઓપસ 5 એ રિલીઝ થયાના ત્રણ કલાકમાં તે કર્યું. આખી ઝુંબેશનો ખર્ચ ટોકન્સમાં ત્રણ હજાર ડોલરથી ઓછો હતો. ઓપનએઆઈએ ચૌદ કલાકમાં પેચ કર્યું અને છ હજાર પાંચસો ડોલર ચૂકવ્યા, તેથી એક ટ્રિલિયન-ડોલરની કંપનીનો સોર્સ કોડ,
4:39 ટૂંક સમયમાં, વપરાયેલી કોરોલાની કિંમત જેટલો હતો, તે જ દિવસે તેના વકીલોએ દલીલ કરી કે કોપી કરવી એ વાજબી ઉપયોગ છે. જો તમે મને આ કહેતા સાંભળવાને બદલે વાંચવા માંગતા હો, તો ડિફ દરરોજ સવારે તમારા ઇનબોક્સમાં આવે છે — daily diff dot dev પર મફત, લિંક નીચે આપેલી છે. તો — આજનો ચુકાદો: NEEDS REVIEW. અવતરણો સાચા છે, પરંતુ તે સીલબંધ પ્રદર્શનોમાંથી પ્રોસિક્યુશનની પસંદગીઓ છે, અને એક જ ન્યાયાધીશે ચુકાદો આપ્યો છે કે તાલીમ એ વાજબી ઉપયોગ છે અને પાઇરસી નથી. કોર્ટ કાયદો નક્કી કરે છે; મેમોએ પહેલેથી જ નીતિશાસ્ત્ર નક્કી કરી દીધું છે.
5:07 સબ્સ્ક્રાઇબ કરો, બેલ દબાવો, અને ટિપ્પણીઓમાં મને કહો કે તમે તેને અલગ રીતે સ્ટેમ્પ કર્યું હોત. અને આ આજનો ડિફ છે. હું Axrisi થી નિકો છું. જવાબદારીપૂર્વક મર્જ કરો.
સ્ત્રોતો
- TechCrunch: Microsoft exec called AI scraping 'the largest theft of labor in human history'techcrunch.com
- HN thread (605 pts)news.ycombinator.com
- Jason Kint on the unsealed motionsx.com
- Ed Newton-Rexx.com
- Bartz v. Anthropic / $1.5B settlement (background)en.wikipedia.org
- OpenAI: Introducing Astra for Lawopenai.com
- HN: Astra for Law (550 pts)news.ycombinator.com
- ferstar: ZCode silent workspace snapshot (original forensics)blog.ferstar.org
- tokenstead write-uptokenstead.ai
- ferstar on Xx.com
- HN: ZCode uploads your Git history (226 pts)news.ycombinator.com
- Hacktron: Hacking OpenAIwww.hacktron.ai
- HN: Hacktron (406 pts)news.ycombinator.com



