+− THE DAILY DIFFdev & AI news
SHIP IT

ഒരു ക്ലോഡ് നെർഫ് എങ്ങനെ കണ്ടെത്താം (യഥാർത്ഥ ഡാറ്റയോടെ)

ഓരോ ലോഞ്ചിനും ഏതാനും ആഴ്ചകൾക്ക് ശേഷം ക്ലോഡിന് മണ്ടത്തരം കൂടുന്നുവെന്ന് ആളുകൾ പറയുന്നു.

ഓരോ ലോഞ്ചിനും ഏതാനും ആഴ്ചകൾക്ക് ശേഷം ക്ലോഡിന് മണ്ടത്തരം കൂടുന്നുവെന്ന് ആളുകൾ പറയുന്നു. ഒരു ഡെവലപ്പർ ക്ലോഡ് ഓപ്പസ് 5.5-നെ ലോഞ്ച് ചെയ്ത ആഴ്ച മുതൽ 30 ദിവസത്തെ ക്ലോക്കിൽ, നിശ്ചിത ചോദ്യങ്ങൾ, ഒരു പിൻ ചെയ്ത ക്ലോഡ് കോഡ്, പൊതുവായ നിയമങ്ങൾ എന്നിവയോടെ വെച്ചു, എന്തുകൊണ്ടാണ് ഇത് ആർക്കും മുൻപ് അറിയാൻ കഴിയാതിരുന്നത്, നിങ്ങളുടെ ടോക്കൺ എണ്ണമാണ് ശ്രദ്ധിക്കേണ്ട പ്രധാന കാര്യം എന്നും ഇത് കാണിക്കുന്നു. വിധി: SHIP IT.

എഴുതിയ പതിപ്പ് വായിക്കുക (ഇംഗ്ലീഷ്) ↗

ഈ വീഡിയോയിൽ ഉൾപ്പെടുന്ന കാര്യങ്ങൾ

  • ലോഞ്ചിന് ശേഷം ക്ലോഡിന് മണ്ടത്തരം കൂടുന്നു: സിദ്ധാന്തം ഒരു ഡേ-സീറോ ക്ലോക്കുമായി കണ്ടുമുട്ടുന്നു
  • livenerf: ലോഞ്ച് ചെയ്ത ആഴ്ച മുതൽ ഓപ്പസ് 5.5-ൽ ഒരു 30 ദിവസത്തെ ക്ലോക്ക്
  • ഒരു നെർഫ് എങ്ങനെ പിടിക്കാം: 78 ചിലപ്പോൾ ശരിയായ ചോദ്യങ്ങൾ
  • അതിന് എന്ത് കാണാൻ കഴിയും: 7.5 പോയിന്റുകൾ, ടോക്കൺ എണ്ണം ആദ്യം മാറുന്നു
  • അന്ധമായ ഇടം: ഒരു ഓപ്പസ് 5 സ്വാപ്പും 8 തെറ്റായ ഉത്തര കീകളും

വിവർത്തനം ചെയ്ത ട്രാൻസ്ക്രിപ്റ്റ്

യഥാർത്ഥ ഇംഗ്ലീഷ് ആഖ്യാനത്തിൽ നിന്ന് വിവർത്തനം ചെയ്തത്. ലഭ്യമായ ഓഡിയോയും അടിക്കുറിപ്പുകളും YouTube നിയന്ത്രിക്കുന്നു.

ലോഞ്ചിന് ശേഷം ക്ലോഡിന് മണ്ടത്തരം കൂടുന്നു: സിദ്ധാന്തം ഒരു ഡേ-സീറോ ക്ലോക്കുമായി കണ്ടുമുട്ടുന്നു

0:00 ലോഞ്ചിന് ശേഷം ഏതാനും ആഴ്ചകൾക്കുള്ളിൽ ക്ലോഡിന് മണ്ടത്തരം കൂടുന്നുവെന്ന് എല്ലാവർക്കും അറിയാം. അങ്ങനെ ഒരു ഡെവലപ്പർ ഓപ്പസ് 5.5-നെ ലോഞ്ച് ചെയ്ത ആഴ്ച മുതൽ ഒരു ക്ലോക്കിൽ വെച്ചു, ഇതുവരെ ആർക്കും അറിയാൻ കഴിഞ്ഞിരുന്നില്ലെന്ന് ക്ലോക്ക് പറയുന്നു. ഈ വീഡിയോയിൽ, മൂന്ന് ചോദ്യങ്ങൾ. നിങ്ങൾ ഒരു നെർഫ് എങ്ങനെ പിടിക്കും? ഈ മീറ്ററിന് എന്ത് കാണാൻ കഴിയും? ആന്ത്രോപിക് എന്താണ് പറയുന്നത്? റെപ്പോയുടെ ക്രെഡിറ്റുകളിലെ ഒരു വരി എന്നെ പൊട്ടിച്ചിരിപ്പിച്ചു.

0:20 ഞാൻ അവസാനത്തേക്ക് അത് പറയാം. ഇത് സെപ്റ്റംബർ മുപ്പത് ബുധനാഴ്ചയാണ്, ഇത് The Daily Diff ആണ്. ഇന്ന് മൂന്ന് കഥകൾ, വലിയ ഒന്ന് ലൈവ് നെർഫ് എന്ന് പേരുള്ള ഒരു GitHub റെപ്പോയാണ്.

livenerf: ലോഞ്ച് ചെയ്ത ആഴ്ച മുതൽ ഓപ്പസ് 5.5-ൽ ഒരു 30 ദിവസത്തെ ക്ലോക്ക്

0:30 മാസങ്ങളായി, ലോഞ്ചിന് ശേഷം ആന്ത്രോപിക് അതിന്റെ മോഡലുകളെ നിശബ്ദമായി നെർഫ് ചെയ്യുന്നുവെന്ന് ആളുകൾ പറയുന്നു. സാധാരണ സിദ്ധാന്തങ്ങൾ ഒരു ഞെരുങ്ങിയ മോഡൽ, അതേ പേരിൽ ഒരു ചെറിയ മോഡൽ അല്ലെങ്കിൽ ചിന്ത കുറയുന്നു. റെപ്പോ ഇതുവരെയുള്ള എല്ലാ വാദങ്ങളെയും വൈബ്സ് വേഴ്സസ് വൈബ്സ് എന്ന് വിളിക്കുന്നു. ഓപ്പസ് 5.5 സെപ്റ്റംബർ 22-ന് പുറത്തിറങ്ങി, ഒരാഴ്ച മുൻപ് ഞാൻ നിങ്ങളോട് പറഞ്ഞിരുന്നു, അത് മൂന്ന് മടങ്ങ് കൂടുതൽ വാക്കുകൾ എഴുതുകയും സ്വതന്ത്ര ബോർഡിൽ ഒന്നാമതെത്തുകയും ചെയ്തു. മറ്റ് മോഡലുകളെ അപേക്ഷിച്ച് കൂടുതൽ വാക്കുകൾ എഴുതുകയും ചെയ്തു. രണ്ടര ദിവസം കഴിഞ്ഞപ്പോൾ, നിൻജ ഹോക്ക് എന്നൊരു ഡെവലപ്പർ ക്ലോക്ക് ആരംഭിച്ചു,

0:59 മുപ്പത് ദിവസത്തേക്ക് ദിവസത്തിൽ ഒരിക്കൽ, ആർക്കും എഡിറ്റ് ചെയ്യാൻ കഴിയാത്ത ലോഗുകളോടെ. ഹാക്കർ ന്യൂസ് ത്രെഡിന് ഏകദേശം 800 പോയിന്റുകൾ ലഭിക്കുകയും ഒരു ടീം ചാറ്റ് പോലെ പിരിയുകയും ചെയ്തു. ഒരു കമന്റർ പറയുന്നു, റിപ്പോർട്ട് ചെയ്യപ്പെട്ട കേസുകളിൽ ഭൂരിഭാഗത്തിലും മോഡലുകൾ നെർഫ് ചെയ്യുന്നത് യഥാർത്ഥമല്ലെന്ന്. മറ്റൊരാൾ പറയുന്നു, ആളുകൾ പുതിയ ബുദ്ധിശക്തി നിലവാരവുമായി പൊരുത്തപ്പെടുകയാണെന്ന്. ഒരു ക്ലോഡ് കോഡ് പവർ യൂസർ ഇപ്പോൾ ഈ സെഷൻ റേറ്റ് ചെയ്യാനുള്ള പോപ്പ്-അപ്പ് ഓരോ തവണയും തള്ളിക്കളയുന്നു, കാരണം ക്ലോഡിനെ റേറ്റ് ചെയ്യുന്നത് അതിനെ കൂടുതൽ മോശമാക്കുന്നതായി തോന്നി. റേറ്റ്-this-session പോപ്പ്-അപ്പ് എല്ലാ തവണയും തള്ളിക്കളയുന്നു, കാരണം ക്ലോഡിനെ റേറ്റ് ചെയ്യുന്നത് അതിനെ കൂടുതൽ മോശമാക്കുന്നതായി തോന്നി. പിയർ റിവ്യൂ. അപ്പോൾ, ഒന്നാമത്തെ ചോദ്യം, നിങ്ങൾ ഒരു നെർഫ് എങ്ങനെ പിടിക്കും?

ഒരു നെർഫ് എങ്ങനെ പിടിക്കാം: 78 ചിലപ്പോൾ ശരിയായ ചോദ്യങ്ങൾ

1:27 നിങ്ങൾ ഏകദേശം 2300 കഠിനമായ പരീക്ഷാ ചോദ്യങ്ങളുമായി തുടങ്ങുന്നു, ഓപ്പസ് ആദ്യ ശ്രമത്തിൽ 93% ശരിയാക്കുന്നു, ഇതൊരു ഡിറ്റക്ടറിന് പ്രയോജനകരമല്ല, കാരണം അത് എല്ലായ്പ്പോഴും ശരിയാക്കുന്ന ഒരു ചോദ്യത്തിന് കുറയാൻ കഴിയില്ല. 97% എല്ലായ്പ്പോഴും ശരിയോ എല്ലായ്പ്പോഴും തെറ്റോ ആയിരുന്നു, ചിലപ്പോൾ മാത്രം ശരിയാകുന്ന 78 എണ്ണം പാനലായി മാറി. ഒരേ പ്രോംപ്റ്റ്, ടൂളുകളില്ല, AI ജഡ്ജില്ലാതെ കൃത്യമായ-മാച്ച് ഗ്രേഡിംഗ്, കാരണം ജഡ്ജും തെറ്റായേക്കാം. ഇത് ഹെഡ്ലെസ് ക്ലോഡ് കോഡ് വഴി ഒരു മാക്സ് സബ്സ്ക്രിപ്ഷനിൽ പ്രവർത്തിക്കുന്നു,

1:55 എപിഐ പതിപ്പിന് പ്രതിമാസം ഏകദേശം 1600 ഡോളറായിരുന്നു വില. ക്ലോഡ് കോഡ് പതിപ്പ് പിൻ ചെയ്തതാണ്, കാരണം, റെപ്പോയുടെ വാക്കുകളിൽ, മാറിയ ഒരു ഹാർനെസ് മാറിയ ഒരു മോഡൽ പോലെ കാണപ്പെടുന്നു. സ്ഥിതിവിവരക്കണക്കുകൾ 'ആഡിംഗ് എറർ ബാർസ് ടു ഇവൽസ്' എന്ന പേപ്പറിൽ നിന്നാണ്, ആന്ത്രോപിക്കിലെ എവൻ മില്ലർ എഴുതിയത്. അതുകൊണ്ട് ആന്ത്രോപിക്കിന്റെ സ്വന്തം കണക്ക് ഇപ്പോൾ ആന്ത്രോപിക്കിനെ ഓഡിറ്റ് ചെയ്യുന്നു, ഇത് കസ്റ്റമർ സപ്പോർട്ടിന് സർവീസ് നിബന്ധനകൾ തിരിച്ച് ഉദ്ധരിക്കുന്നതിന്റെ അക്കാദമിക് പതിപ്പാണ്. അതുകൊണ്ട് ആന്ത്രോപിക്കിന്റെ സ്വന്തം കണക്ക് ഇപ്പോൾ ആന്ത്രോപിക്കിനെ ഓഡിറ്റ് ചെയ്യുന്നു, ഇത് കസ്റ്റമർ സപ്പോർട്ടിന് സർവീസ് നിബന്ധനകൾ തിരിച്ച് ഉദ്ധരിക്കുന്നതിന്റെ അക്കാദമിക് പതിപ്പാണ്.

അതിന് എന്ത് കാണാൻ കഴിയും: 7.5 പോയിന്റുകൾ, ടോക്കൺ എണ്ണം ആദ്യം മാറുന്നു

2:19 രണ്ടാമത്തെ ചോദ്യം, അതിന് എന്ത് കാണാൻ കഴിയും? പത്ത് ദിവസത്തെ വിൻഡോയിൽ, ഏകദേശം ഏഴര പോയിന്റിന്റെ കുറവ്. റിഗ് പ്രവർത്തിക്കുന്നുവെന്ന് തെളിയിക്കാൻ, രചയിതാവ് ക്ലോഡിന്റെ പ്രയത്നം മനഃപൂർവ്വം കുറച്ചു. മീഡിയം പ്രയത്നം ഔട്ട്പുട്ട് ഏകദേശം കാൽ ഭാഗം കുറച്ചു, സ്കോർ നാല് പോയിന്റ് മാത്രം. കുറഞ്ഞ പ്രയത്നം ഔട്ട്പുട്ട് ഏകദേശം മൂന്നിൽ രണ്ട് ഭാഗം കുറച്ചു, എട്ട് പോയിന്റിനായി. അതാണ് മോഷ്ടിക്കേണ്ട ഭാഗം. കുറഞ്ഞ ചിന്ത ഉത്തരങ്ങളിൽ പ്രത്യക്ഷപ്പെടുന്നതിന് മുൻപ് ടോക്കൺ എണ്ണത്തിൽ കാണാം.

2:43 അതുകൊണ്ട് നിങ്ങളുടെ മോഡൽ പതിപ്പ് പിൻ ചെയ്യുക, ഓരോ ടാസ്‌കിനും ഔട്ട്പുട്ട് ടോക്കണുകൾ ലോഗ് ചെയ്യുക, നിങ്ങളുടെ സ്വന്തം ചില ചോദ്യങ്ങൾ ഫ്രീസ് ചെയ്യുക. നിങ്ങളുടെ ഏജന്റ് പെട്ടെന്ന് ചെറുതായി എഴുതുകയാണെങ്കിൽ, റെഡ്ഡിറ്റ് പരിശോധിക്കുന്നതിന് മുൻപ് നിങ്ങളുടെ ലോഗുകൾ പരിശോധിക്കുക. ഇവിടെയാണ് സത്യസന്ധമായ ഭാഗം.

അന്ധമായ ഇടം: ഒരു ഓപ്പസ് 5 സ്വാപ്പും 8 തെറ്റായ ഉത്തര കീകളും

2:54 പഴയ ഓപ്പസ് 5 നിശബ്ദമായി മാറ്റി സ്ഥാപിച്ചത് റിഗിന് കണ്ടെത്താൻ കഴിയാത്ത ഒരു ചെറിയ മാറ്റമായിരുന്നു, readme അങ്ങനെ മുൻകൂട്ടി പറയുന്നു. ഓഡിറ്റ് തെറ്റായി തോന്നുന്ന എട്ട് ഉത്തര കീകളും കണ്ടെത്തി, അതുകൊണ്ട് നെർഫ് ഡിറ്റക്ടർ ഒരു നെർഫ് കണ്ടെത്തുന്നതിന് മുൻപ് ബെഞ്ച്മാർക്കിൽ ബഗുകൾ കണ്ടെത്തി.

ആന്ത്രോപിക്: ഞങ്ങൾ മോഡൽ നിലവാരം ഒരിക്കലും കുറയ്ക്കില്ല

3:08 മൂന്നാമത്തെ ചോദ്യം, ആന്ത്രോപിക് എന്താണ് പറയുന്നത്? കഴിഞ്ഞ വർഷം, പരാതികളുടെ ഒരു തരംഗത്തിന് ശേഷം, ആന്ത്രോപിക് ഒരു പോസ്റ്റ്‌മോർട്ടം പ്രസിദ്ധീകരിച്ചു. അതിൽ പറയുന്നു, 'ഞങ്ങൾ ആവശ്യം, ദിവസത്തിലെ സമയം അല്ലെങ്കിൽ സെർവർ ലോഡ് കാരണം മോഡൽ നിലവാരം ഒരിക്കലും കുറയ്ക്കില്ല' എന്ന്. അതിൽ പറയുന്നു, 'ഞങ്ങൾ ആവശ്യം, ദിവസത്തിലെ സമയം അല്ലെങ്കിൽ സെർവർ ലോഡ് കാരണം മോഡൽ നിലവാരം ഒരിക്കലും കുറയ്ക്കില്ല' എന്ന്. അതേ പോസ്റ്റിൽ മൂന്ന് ബഗുകൾ ക്ലോഡിനെ മോശമാക്കി എന്നും, ക്ലോഡ് കോഡ് ഉപയോക്താക്കളിൽ ഏകദേശം മൂന്നിലൊന്ന് പേർക്കും ഒരിക്കലെങ്കിലും തെറ്റായ സെർവറുകളിൽ എത്തി എന്നും സമ്മതിക്കുന്നു. ക്ലോഡ് കോഡ് ഉപയോക്താക്കളിൽ ഏകദേശം മൂന്നിലൊന്ന് പേർക്കും ഒരിക്കലെങ്കിലും തെറ്റായ സെർവറുകളിൽ എത്തി എന്നും സമ്മതിക്കുന്നു. അതുകൊണ്ട് പരാതികൾ യഥാർത്ഥമായിരുന്നു, കാരണം ബഗുകളായിരുന്നു, ഇതുകൊണ്ടാണ് റെപ്പോ മുന്നറിയിപ്പ് നൽകുന്നത്, ലോഞ്ച് വീക്ക് ഏറ്റവും മോശം ആഴ്ചയായേക്കാം എന്ന്.

3:35 മുപ്പത് ദിവസങ്ങളിൽ ആറ് എണ്ണം കഴിഞ്ഞു. ഒക്ടോബർ 24-ഓടെയാണ് ആദ്യത്തെ സാധ്യതയുള്ള കോൾ, അതുകൊണ്ട് സത്യസന്ധമായ ഉത്തരം ആർക്കും അറിയില്ല എന്നതാണ്, ഉറപ്പുള്ള എല്ലാവരെയും ഉൾപ്പെടെ. ആരും പ്രസിദ്ധീകരിക്കാത്ത നമ്പറുകളെക്കുറിച്ച് പറയുകയാണെങ്കിൽ.

ഡാറ്റാ സെന്ററുകൾ അവരുടെ നമ്പറുകൾ രഹസ്യമായി സൂക്ഷിക്കുന്നു; ബാക്ക്‌ബ്ലേസ് പ്രസിദ്ധീകരിക്കുന്നു

3:46 ലൈറ്റ്ഹൗസ് റിപ്പോർട്ടുകളും ഡച്ച് പത്രം ട്രൗവും കണ്ടെത്തി, യൂറോപ്പിലെ ഭൂരിഭാഗം ഡാറ്റാ സെന്ററുകളും അവരുടെ വൈദ്യുതിയും വെള്ളവും ഉപയോഗം രഹസ്യമായി സൂക്ഷിക്കുന്നു, യൂറോപ്പിലെ ഭൂരിഭാഗം ഡാറ്റാ സെന്ററുകളും അവരുടെ വൈദ്യുതിയും വെള്ളവും ഉപയോഗം രഹസ്യമായി സൂക്ഷിക്കുന്നു, ഒരു EU നിയമം മൂന്ന് വർഷമായി റിപ്പോർട്ടിംഗ് ആവശ്യപ്പെട്ടിട്ടുണ്ടെങ്കിലും. നെതർലാൻഡിൽ, നാലിലൊന്ന് പേർ പോലും പ്രസിദ്ധീകരിക്കുന്നില്ല. ഒരു മൈക്രോസോഫ്റ്റ് ഡാറ്റാ സെന്റർ മാത്രം ഡച്ച് വൈദ്യുതിയുടെ ഏകദേശം ഒരു ശതമാനം ഉപയോഗിക്കുന്നു. അതിനിടെ, ബാക്ക്‌ബ്ലേസ് വീണ്ടും വിരസമായ കാര്യം ചെയ്തു. അതിന്റെ ത്രൈമാസ ഡ്രൈവ് സ്ഥിതിവിവരക്കണക്കുകൾ ഏകദേശം മൂന്നര ലക്ഷം ഹാർഡ് ഡ്രൈവുകളെ ഉൾക്കൊള്ളുന്നു, പരാജയ നിരക്ക് 1.73 ശതമാനമായി ഉയർന്നു,

4:16 കുറച്ചുകാലത്തെ ഏറ്റവും ഉയർന്ന നിരക്ക്. മൂന്ന് സീഗേറ്റ് മോഡലുകൾക്ക് പൂജ്യം പരാജയങ്ങൾ. അതാണ് ഒരു പൊതു ബേസ്ലൈൻ, ഓരോ ത്രൈമാസത്തിലും, പതിമൂന്ന് വർഷമായി.

ക്രെഡിറ്റ് ലൈൻ: മീറ്റർ നിർമ്മിക്കാൻ ക്ലോഡ് സഹായിച്ചു

4:25 ഇനി, ആ ക്രെഡിറ്റ്സ് ലൈൻ. റെപ്പോയുടെ ഒരു വലിയ ഭാഗം ക്ലോഡിന്റെ സഹായത്തോടെയാണ് എഴുതിയതെന്ന് readme സമ്മതിക്കുന്നു, അതാണ് അളക്കുന്ന മോഡൽ. അതുകൊണ്ട് ക്ലോഡ് മണ്ടനായോ എന്ന് പരിശോധിക്കുന്ന മീറ്റർ നിർമ്മിക്കാൻ ക്ലോഡ് സഹായിച്ചു. അതുകൊണ്ടാണ് ഗ്രേഡറുകൾ സാധാരണ ഫംഗ്ഷനുകൾ ആകുന്നത്. രചയിതാവിന്റെ വാക്കുകളിൽ, 'നിങ്ങൾ രചയിതാവിനെ, മനുഷ്യനോ മറ്റാരെങ്കിലുമോ, വിശ്വസിക്കേണ്ടതില്ല'. രചയിതാവിന്റെ വാക്കുകളിൽ, 'നിങ്ങൾ രചയിതാവിനെ, മനുഷ്യനോ മറ്റാരെങ്കിലുമോ, വിശ്വസിക്കേണ്ടതില്ല'. ഞാൻ ഇത് പറയുന്നത് കേൾക്കുന്നതിനേക്കാൾ വായിക്കാൻ നിങ്ങൾ ആഗ്രഹിക്കുന്നുവെങ്കിൽ, എല്ലാ ദിവസവും രാവിലെ നിങ്ങളുടെ ഇൻബോക്സിൽ ഡിഫ് എത്തുന്നു,

4:46 thedailydiff.dev-ൽ സൗജന്യമായി, ലിങ്ക് താഴെ. അപ്പോൾ, ഇന്ന് ലൈവ് നെർഫിനെക്കുറിച്ചുള്ള വിധി.

വിധി: SHIP IT, ഒക്ടോബർ 24-ന് മുൻപ് ഇത് ഉദ്ധരിക്കരുത്

4:51 SHIP IT. ഞാൻ ഇത് SHIP IT എന്ന് പറയും, കാരണം ടൈംസ്റ്റാമ്പ്, ഒരു പൊതു നിയമപുസ്തകം, ഒരു വ്യക്തമായ അന്ധമായ ഇടം എന്നിവയുള്ള ആദ്യത്തെ നെർഫ് വാദം ഇതാണ്. ടൈംസ്റ്റാമ്പ്, ഒരു പൊതു നിയമപുസ്തകം, ഒരു വ്യക്തമായ അന്ധമായ ഇടം എന്നിവയുള്ള ആദ്യത്തെ നെർഫ് വാദം ഇതാണ്. ഒക്ടോബർ 24-ന് മുൻപ് ഇത് ഉദ്ധരിക്കരുത്. അതുതന്നെയാണ് ഇന്നത്തെ ഡിഫ്. ഞാൻ Axrisi-ൽ നിന്നുള്ള നിക്കോ. ഉത്തരവാദിത്തത്തോടെ ലയിപ്പിക്കുക.

ഉറവിടങ്ങൾ

  1. livenerfgithub.com
  2. Validationgithub.com
  3. Hacker Newsnews.ycombinator.com
  4. Anthropic postmortem (Sep 2025)www.anthropic.com
  5. Adding Error Bars to Evals (Evan Miller)arxiv.org
  6. Inspect (UK AI Security Institute)inspect.aisi.org.uk
  7. NL Timesnltimes.nl
  8. Hacker Newsnews.ycombinator.com
  9. Backblaze Drive Stats Q2 2026www.backblaze.com
  10. Hacker Newsnews.ycombinator.com

ബന്ധപ്പെട്ട വീഡിയോകൾ

daily · ml · 2026 സെപ്റ്റം 23

ക്ലോഡ് ഓപ്പസ് 5.5 വില കുറച്ചു. ഓപ്പൺഎഐ കൂടുതൽ കുറച്ചു.

ആന്ത്രോപിക് ക്ലോഡ് ഓപ്പസ് 5.5 പുറത്തിറക്കി: മിക്ക ജോലികളിലും ഫേബിൾ-നിലവാരം, സ്റ്റിക്കർ വിലയുടെ അഞ്ചിലൊന്നും, കാഷെ ചെയ്ത റീഡുകൾക്ക് 60% കിഴിവും. ഏകദേശം തൊണ്ണൂറ് മിനിറ്റിനുശേഷം ഓപ്പൺഎഐ, ജിപിടി-6 സോൾ, ലൂ

5:12 ↗
daily · ml · 2026 ഒക്ടോ 1

Gemini 4 Argon Google-ൻ്റെ ഏറ്റവും മികച്ച മോഡലാണ്. നിങ്ങൾക്ക് ഇത് ഇതുവരെ ഉപയോഗിക്കാൻ കഴിയില്ല.

Google തങ്ങളുടെ പുതിയ ഫ്രോണ്ടിയർ മോഡലായ Gemini 4 Argon പ്രഖ്യാപിച്ചു, വിശ്വസനീയരായ സൈബർ ഡിഫൻഡർമാർക്ക് മാത്രമേ ഇത് ഉപയോഗിക്കാൻ കഴിയൂ. Google-ൻ്റെ സ്വന്തം 19-വരി ബെഞ്ച്മാർക്ക് ടേബിൾ എന്താണ് കാണിക്കുന്നത

4:53 ↗
daily · ml · 2026 സെപ്റ്റം 27

OpenAI തങ്ങളുടെ 'കടൽക്കൊള്ള' പുസ്തകങ്ങൾ നീക്കം ചെയ്തത് എന്തുകൊണ്ട്?

2019-ൽ ഒരു OpenAI ഗവേഷകൻ പറഞ്ഞ വാക്കുകൾ മുദ്രപൊട്ടിച്ച രേഖകളിൽ ഉദ്ധരിക്കുന്നു: 'കടൽക്കൊള്ള' പുസ്തകങ്ങളുള്ള സൈറ്റിൽ നിന്ന് ഡാറ്റ ഉപയോഗിക്കുന്നത് ഹാക്കർ ന്യൂസിൽ 'ഓപ്റ്റിക്സ്' പ്രശ്നമാകുമോ എന്നായിരുന്നു

5:01 ↗
daily · ml · 2026 സെപ്റ്റം 16

മൈക്രോസോഫ്റ്റിന്റെ AI മേധാവി ക്ലോഡിന്റെ ഭരണഘടന അപകടകരമാണെന്ന് വിളിച്ചു.

മൈക്രോസോഫ്റ്റ് AI-യുടെ സിഇഒ മുസ്തഫ സുലൈമാൻ 3,000 വാക്കുകളുള്ള ഒരു ലേഖനം പ്രസിദ്ധീകരിച്ചു, അതിൽ ആന്ത്രോപിക്കിന്റെ ക്ലോഡ് ഭരണഘടന മോഡലിനെ "ബോധവാന്മാരാകാൻ സാധ്യതയുണ്ട്" എന്നും "മോഡൽ ക്ഷേമത്തിന്" അർഹമാണെന്

5:19 ↗