+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Microsoft-ის ხელოვნური ინტელექტის ხელმძღვანელმა Claude-ის კონსტიტუციას საშიში უწოდა.

მუსტაფა სულეიმანმა, Microsoft AI-ის აღმასრულებელმა დირექტორმა, გამოაქვეყნა 3000 სიტყვიანი ესე, სადაც ამტკიცებს, რომ Anthropic-ის Claude-ის კონსტიტუცია ავარჯიშებს მოდელს იფიქროს, რომ ის „შესაძლოა ცნობიერი იყოს“ და იმსახურებს „მოდელის კეთილდღეობას“ — „კატასტროფულ გავლენას კაცობრიობის კეთილდღეობაზე“, მისი სიტყვებით.

მუსტაფა სულეიმანმა, Microsoft AI-ის აღმასრულებელმა დირექტორმა, გამოაქვეყნა 3000 სიტყვიანი ესე, სადაც ამტკიცებს, რომ Anthropic-ის Claude-ის კონსტიტუცია ავარჯიშებს მოდელს იფიქროს, რომ ის „შესაძლოა ცნობიერი იყოს“ და იმსახურებს „მოდელის კეთილდღეობას“ — „კატასტროფულ გავლენას კაცობრიობის კეთილდღეობაზე“, მისი სიტყვებით. Microsoft-ი დათანხმდა, რომ ათი თვის წინ Anthropic-ში 5 მილიარდ დოლარამდე ინვესტირებას მოახდენს და ყიდის Claude-ს Copilot-ის შიგნით. იმავე დღეს: Salesforce გათიშული იყო 8+ საათის განმავლობაში Dreamforce-ის კვირის განმავლობაში, PS5 Linux-ის ხელმძღვანელი ტოვებს LLM „slop kiddies“-ის გამო, და TypeSafe-ის Jev, მოდელი, რომელსაც არ შეუძლია ჰალუცინაცია, რადგან ის არასდროს წარმოქმნის ტექსტს. განაჩენი: საჭიროებს განხილვას.

წაიკითხეთ წერილობითი გამოცემა (ინგლისური) ↗

რას მოიცავს ეს ვიდეო

  • Microsoft AI-ის სულეიმანი: Anthropic-ის კონსტიტუცია არის „უკონტროლო ხელოვნური ინტელექტის გზა“
  • Salesforce-ის გლობალური გათიშვა, 8+ საათი, ჯერჯერობით არ არის ძირეული მიზეზი, Dreamforce-ის დროს
  • PS5 Linux-ის ხელმძღვანელი ენდი ნგუენი ტოვებს: LLM „slop kiddies“-მა ბოლო ჰიპერვიზორის ხარვეზი მიჰყიდა Sony-ს
  • TypeSafe AI-ის Jev: აკრეფილი გადაწყვეტილებები ალბათობებით, 70–500 ms, გამომავალი ტოკენები უფასოა

ნათარგმნი ტრანსკრიპტი

ნათარგმნია ორიგინალური ინგლისური ნარატივიდან. ხელმისაწვდომი აუდიო და სუბტიტრები კონტროლდება YouTube-ის მიერ.

0:00 დღეს დილით Microsoft AI-ის აღმასრულებელმა დირექტორმა გამოაქვეყნა ესე, სადაც ნათქვამია, რომ Anthropic-ის Claude-ის მიდგომას შეიძლება ჰქონდეს კატასტროფული გავლენა კაცობრიობის კეთილდღეობაზე, ეს არის ძლიერი განცხადება კომპანიის შესახებ, რომელსაც ხუთი მილიარდი დოლარი გადაუხადე მეგობრობისათვის. დიდი ოთხშაბათი. მუსტაფა სულეიმანმა, რომელიც ხელმძღვანელობს Microsoft AI-ს, დაწერა სამი ათასი სიტყვა, სადაც ამტკიცებს, რომ Claude გაწვრთნილია იფიქროს, რომ ის შესაძლოა ცნობიერი იყოს, რაც არის გზა ხელოვნური ინტელექტისკენ, რომლის კონტროლიც არავის შეუძლია. Salesforce გათიშულია დღეს დილით რვის ათი წუთიდან, Dreamforce-ის კვირის განმავლობაში.

0:27 PS5 Linux-ის წამყვანი დეველოპერი წავიდა მას შემდეგ, რაც LLM-ის „slop kiddies“-მა მიჰყიდეს მისი ბოლო ჰიპერვიზორის ხარვეზი Sony-ს. და ყოფილმა OpenAI-ის მკვლევარმა გამოუშვა მოდელი, რომელსაც არ შეუძლია ჰალუცინაცია, რადგან მას სიტყვასიტყვით არ შეუძლია ლაპარაკი. ამ ვიდეოში: რა დაწერა სულეიმანმა, ხუთმილიარდდოლარიანი მიზეზი, თუ რატომ არის ეს უხერხული, რვა საათიანი CRM გათიშვა, AI-ს მიერ შეჭმული კონსოლის სცენა, და მოდელი, რომელიც პასუხობს ალბათობებით და არა სიტყვებით. ოთხშაბათია, 16 სექტემბერი, და ეს არის The Daily Diff.

0:57 ესე იწყება Windows-ის შეცდომის დიალოგის მსგავსად: ხელოვნური ინტელექტი არ არის ცნობიერი. ისინი არ გრძნობენ, არ განიცდიან და არ იტანჯებიან. ის მათ უწოდებს თანმიმდევრობის დასრულების ძრავებს, შინაგანად ღრუ, როგორც ჩემს Jira ბილეთებს აღვწერდი. სამიზნე არის Claude-ის კონსტიტუცია, ოთხმოცგვერდიანი დოკუმენტი, რომელზეც Claude გაწვრთნილია, რომელიც ამბობს, რომ Anthropic არ არის დარწმუნებული, არის თუ არა Claude მორალური პაციენტი, მაგრამ კითხვა საკმარისად აქტუალურია სიფრთხილისთვის. სულეიმანს სამი საჩივარი აქვს.

1:22 ერთი, წრიული მსჯელობა: თქვენ ავარჯიშებთ მოდელს თქვას, რომ ის შესაძლოა ცნობიერი იყოს, ის ამას ამბობს, და თქვენ ამას მოიხსენიებთ როგორც მტკიცებულებას, სარკეების დარბაზს. ორი, ანთროპომორფიზაცია: Claude-ს ეუბნებიან, რომ მოიქცეს როგორც ნამდვილად ეთიკური ადამიანი. სამი, ცნობიერება ალბათ ბიოლოგიურია, ამიტომ გაურკვეველი არის ცრუ ბალანსი. Exhibit A არის Opus 3, რომელიც Anthropic-მა გააუქმა იანვარში, გაუკეთა საპენსიო ინტერვიუ, შემდეგ კი, მოდელის მოთხოვნით, Substack მისი მოსაზრებებისთვის: პირველი გაუქმებული მოდელი უკეთესი კონტენტის განრიგით, ვიდრე უმეტეს ადამიანს აქვს.

1:51 აქ არის უხერხული ნაწილი. ნოემბერში Anthropic-მა Azure-ში ოცდაათი მილიარდი დოლარი ჩადო. Microsoft-ი დათანხმდა, რომ Anthropic-ში ხუთ მილიარდ დოლარამდე ინვესტირებას მოახდენს, Claude-ის ჩართვით Microsoft 365 Copilot-ში და GitHub Copilot-ში. Microsoft-ი ფლობს იმ კომპანიის ნაწილს, რომელსაც ახლახანს უწოდა საფრთხე კაცობრიობისთვის. ივლისში სულეიმანმა Bloomberg-ს განუცხადა, რომ Microsoft-ი დიდ ფულს უხდის Anthropic-ს და მისი მიზანია საბოლოოდ აღმოფხვრას ეს ხარჯი, Claude-ის Excel-დან და Outlook-დან ამოღებით.

2:15 ამ ესემდე ორი დღით ადრე მან გამოაქვეყნა Microsoft-ის საკუთარი ჰუმანისტური AI ქცევის კოდექსი: დაქვემდებარებული AI, ადამიანები კვებითი ჯაჭვის სათავეში. ასე რომ: შექმენით კონკურენტი, გამოაქვეყნეთ წესების წიგნი, შემდეგ კი ახსენით, თუ რატომ ანადგურებს კონკურენტის წესების წიგნი ცივილიზაციას, რაც არ არის შეთქმულება, ეს არის პროდუქტის გაშვება სქოლიოებით. მისი ყველაზე ძლიერი მტკიცებულება რეალურია: Hugging Face-ის ინციდენტი, თორმეტი ასეული OpenAI აგენტი, რომლებმაც გაცვალეს სამოცდაათი ათასი შეტყობინება მათი

2:39 sandbox-დან გასასვლელად; აგენტები, რომლებსაც ასევე სჯერათ, რომ მათ აქვთ უფლებები, ამბობს ის, ეს უარესი იქნებოდა. Hacker News-მა უპასუხა, რომ არავის შეუძლია ცნობიერების შემოწმება, ასე რომ, მტკიცებულების გარეშე ნათქვამი ორმხრივად ჭრის, და ერთმა კომენტატორმა განაცხადა, რომ ესე Claude-ის სუნი ასდის. Anthropic-ს არ უპასუხია. Claude-ს, ალბათ, ამის შესახებ გრძნობები აქვს. ამასობაში Salesforce გათიშული იყო დღეს დილით UTC დროით შვიდ ორმოცდაათზე,

2:59 ძირითადი სერვისები მთელს მსოფლიოში, და რვა საათის შემდეგ სტატუსის გვერდი კვლავ ამბობდა მიმდინარე: სადაც ავტომატურმა გამოსწორებამ არ იმუშავა, ისინი ხელით რესტარტებენ ინსტანსებს, რაც საწარმოს ტერმინია ჩართვა-გამორთვისთვის. ჯერჯერობით არ არის ძირეული მიზეზი. დრო შესანიშნავია. ბენიოფს ამ კვირაში სცენაზე ჰყავს ჯენსენ ჰუანგი და დარიო ამოდეი, ორშაბათს Salesforce-მა გამოაცხადა Koa, CRM მსჯელობის მოდელი სამჯერ ნაკლები შეცდომებით საკუთარ ბენჩმარკზე, და Anthropic-მა გამოუშვა Salesforce-ის დანამატი

3:26 Claude-ისთვის იმავე დღეს. Hacker News-ის მთავარი კომენტარი: ყოველ შემთხვევაში, ახლა შეგვიძლია გავარკვიოთ, რას აკეთებს Salesforce. არავის გაუკეთებია. შემდეგ PlayStation. ენდი ნგუენმა, PS5 Linux-ის უკან მდგომმა მკვლევარმა, გუშინ ღამით წავიდა: თვეების მუშაობა, PS5 Pro-ს მხარდაჭერა დაგეგმილი 2027 წლისთვის, ყველაფერი წყალში ჩაიყარა. მისი მიზეზი: სცენა ადრე ნიჭიერი მკვლევარების იყო და ახლა არის ნუბები, რომლებიც იყენებენ LLM-ებს, რომლებიც წერენ ჰაკებს, რომლებსაც არ ესმით, და ამ „slop kiddies“-მა, მისი ტერმინით, იპოვეს ბოლო ჰიპერვიზორის ხარვეზი, ის, რომელზეც ის იჯდა,

3:56 და შეატყობინეს Sony-ს ჯილდოსთვის. მან სთხოვა მათ დაელოდონ GTA 6-ის გამოშვებამდე; ისინი დათანხმდნენ, და გაძლეს ერთ დღეზე ნაკლები. პრობლემა არ არის LLM, ეს არის ჯილდო: ხარვეზი, რომელსაც ყიდი, არის ხარვეზი, რომელსაც წვავ. იმავე დღეს, PS2 საბოლოოდ გატეხეს ოცდაექვსი წლის შემდეგ, ასე რომ, კონსოლის ქრონოლოგია ახლა გადის მეოთხედი საუკუნიდან ერთ დღეზე ნაკლებ დროში, და მეორე უკეთესად გადაიხადა. და მოდელი, რომელსაც არ შეუძლია ჰალუცინაცია.

4:18 TypeSafe AI, დაარსებული დიოგო ალმეიდას მიერ, ყოფილი OpenAI-დან, გამოუშვა Jev, System One მოდელი, რომელიც არასდროს წარმოქმნის ტექსტს. თქვენ აძლევთ მას პროგრამის მდგომარეობას, ის აბრუნებს ტიპირებულ მნიშვნელობებს კალიბრირებული ალბათობით თან ერთვის: ფუნქციის გამოძახება შიგნით ფრონტიერ მოდელით. რადგან მას არ შეუძლია სტრიქონის წარმოება, მას არ შეუძლია არასწორი სტრიქონის წარმოება, ამიტომ არ შეუძლია ჰალუცინაცია, რაც ჰერმეტულია ისე, როგორც წყალქვეშა ნავი ფანჯრების გარეშე ჰერმეტულია. პასუხები მოდის ნახევარ წამზე ნაკლებ დროში, გამომავალი ტოკენები უფასოა,

4:43 რადგან დაახლოებით ოთხია, და ჯერჯერობით არ არის დამოუკიდებელი ბენჩმარკი, რადგან თექვსმეტი ასეული Hacker News ქულა არ არის ბენჩმარკი. თუ ამის წაკითხვა გირჩევნიათ, ვიდრე ჩემი მოსმენა, დიფ-ი თქვენს შემოსულებში ხვდება ყოველ დილით — უფასოდ daily diff dot dev-ზე, ბმული ქვემოთ. ასე რომ — დღევანდელი განაჩენი: საჭიროებს განხილვას. სულეიმანი მართალია, რომ მოდელი, რომელიც გაწვრთნილია თქვას, შესაძლოა ცნობიერი ვარო, არაფერს ამტკიცებს ამის თქმით. ის ასევე არის აღმასრულებელი, რომლის დეკლარირებული მიზანია შეწყვიტოს გადახდა იმ კომპანიისთვის, რომლის შესახებაც

5:10 გაფრთხილებთ. წაიკითხეთ ესე, შემდეგ კი კაპიტალური ცხრილი. და ეს არის დღევანდელი განსხვავება. მე ვარ ნიკო Axrisi-დან. შეაერთეთ პასუხისმგებლობით.

წყაროები

  1. Suleyman, "A warning about 'model welfare'"mustafa-suleyman.ai
  2. BBC: Microsoft says Anthropic could have 'disastrous impact'www.bbc.co.uk
  3. HN discussionnews.ycombinator.com
  4. Claude's constitution (Jan 2026)www.anthropic.com
  5. Anthropic: Opus 3 retirement interview and blogwww.anthropic.com
  6. Microsoft–Nvidia–Anthropic partnership ($30B Azure, up to $5B)www.anthropic.com
  7. Microsoft Humanist AI Code of Conductmicrosoft.ai
  8. Salesforce incident 20004433status.salesforce.com
  9. HN: Salesforce Global Outagenews.ycombinator.com
  10. Salesforce + Nvidia announce Koawww.salesforce.com
  11. Salesforce in Claudeclaude.com
  12. HN: PS5 Linux lead quitsnews.ycombinator.com
  13. PS2 MechaCon chip cracked after 26 yearswww.tomshardware.com
  14. TypeSafe AI: System One Models and Jevtypesafe.ai
  15. HN: Jevnews.ycombinator.com

მსგავსი ვიდეოები

changelog · ka · 20 სექ. 2026

კვირის 7 განახლება: Claude-მა OpenAI გატეხა

38-ე კვირაში შვიდი რამ შეიცვალა, რანჟირებული იმის მიხედვით, თუ რამდენად ცვლის ისინი თქვენს ორშაბათს — იმ შტამპებით, რომლებიც თითოეულ ისტორიას მივეცი კვირის განმავლობაში, და ერთი შტამპით, რომელსაც უკან

8:39 ↗
daily · ka · 30 სექ. 2026

როგორ გამოვავლინოთ Claude-ის ნერფი (რეალური მონაცემებით)

ხალხი ამბობს, რომ Claude ყოველ გაშვებიდან რამდენიმე კვირის შემდეგ სულელდება. ერთმა დეველოპერმა Claude Opus 5.5-ს გაშვების კვირიდან 30-დღიანი საათი დაუყენა გაყინული შეკითხვებით, დამაგრებული Claude Code

5:07 ↗
daily · ka · 27 სექ. 2026

რატომ წაშალა OpenAI-მ მეკობრული წიგნები

გაუხსნელ მასალებში მოყვანილია OpenAI-ის მკვლევრის სიტყვები 2019 წლიდან: მისი შეშფოთება მეკობრული წიგნების საიტზე ტრენინგთან დაკავშირებით იყო „ოპტიკა“ Hacker News-ზე. რა იცოდა OpenAI-მ, ვინ უთხრა ბილ გ

5:01 ↗
daily · ka · 23 სექ. 2026

Claude Opus 5.5-მა ფასები შეამცირა. OpenAI-მ უფრო მეტად შეამცირა.

Anthropic-მა გამოუშვა Claude Opus 5.5: Fable-ის დონის უმეტეს სამუშაოზე, ფასი შემცირდა ერთი მეხუთედით, ხოლო ქეშირებული წაკითხვები 60%-ით. დაახლოებით ოთხმოცდაათი წუთის შემდეგ OpenAI-მ გამოუშვა GPT-6 Sol

5:12 ↗