+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Giám đốc AI của Microsoft vừa gọi hiến pháp của Claude là nguy hiểm.

Mustafa Suleyman, CEO Microsoft AI, đã xuất bản một bài luận dài 3.000 từ lập luận rằng hiến pháp của Claude của Anthropic huấn luyện mô hình này nghĩ rằng nó "có thể có ý thức" và xứng đáng được "phúc lợi mô hình" – một "tác động thảm khốc đến hạnh phúc của nhân loại", theo lời ông.

Mustafa Suleyman, CEO Microsoft AI, đã xuất bản một bài luận dài 3.000 từ lập luận rằng hiến pháp của Claude của Anthropic huấn luyện mô hình này nghĩ rằng nó "có thể có ý thức" và xứng đáng được "phúc lợi mô hình" – một "tác động thảm khốc đến hạnh phúc của nhân loại", theo lời ông. Microsoft đã đồng ý đầu tư tới 5 tỷ USD vào Anthropic mười tháng trước và bán Claude trong Copilot. Cùng ngày: Salesforce ngừng hoạt động hơn 8 giờ trong tuần Dreamforce, trưởng nhóm PS5 Linux từ chức vì "slop kiddies" LLM, và Jev của TypeSafe, một mô hình không thể ảo giác vì nó không bao giờ tạo ra văn bản. Phán quyết: NEEDS REVIEW.

Đọc phiên bản viết (tiếng Anh) ↗

Nội dung video này đề cập

  • Suleyman của Microsoft AI: Hiến pháp của Anthropic là "con đường dẫn đến AI không thể kiểm soát"
  • Salesforce ngừng hoạt động toàn cầu, hơn 8 giờ, chưa có nguyên nhân gốc, trong thời gian Dreamforce
  • Trưởng nhóm PS5 Linux Andy Nguyen từ chức: "slop kiddies" LLM đã bán lỗi hypervisor cuối cùng cho Sony
  • Jev của TypeSafe AI: các quyết định được gõ với xác suất, 70–500 ms, token đầu ra miễn phí

Bản ghi đã dịch

Được dịch từ lời tường thuật tiếng Anh gốc. Âm thanh và phụ đề có sẵn được điều khiển bởi YouTube.

0:00 Sáng nay, CEO của Microsoft AI đã xuất bản một bài luận nói rằng Anthropic's phương pháp tiếp cận Claude có thể có tác động thảm khốc đến hạnh phúc của nhân loại, một điều mạnh mẽ để nói về một công ty mà bạn đã trả năm tỷ đô la để làm bạn. Thứ Tư lớn. Mustafa Suleyman, người điều hành Microsoft AI, đã viết ba nghìn từ lập luận rằng Claude được huấn luyện để nghĩ rằng nó có thể có ý thức, con đường dẫn đến một AI mà không ai có thể kiểm soát. Salesforce đã ngừng hoạt động từ mười giờ kém tám sáng nay, trong tuần Dreamforce.

0:27 Nhà phát triển chính của PS5 Linux đã từ chức sau khi các slop kiddies với LLM đã bán lỗi hypervisor cuối cùng của anh ấy cho Sony. Và một cựu nhà nghiên cứu OpenAI đã ra mắt một mô hình không thể ảo giác, bởi vì nó theo nghĩa đen không thể nói được. Trong video này: những gì Suleyman đã viết, lý do năm tỷ đô la mà nó gây khó xử, sự cố CRM tám giờ, một cảnh console bị AI chiếm đoạt, và một mô hình trả lời bằng xác suất, không phải từ ngữ. Hôm nay là thứ Tư, ngày 16 tháng 9, và đây là The Daily Diff.

0:57 Bài luận mở đầu giống như hộp thoại lỗi Windows: AI không có ý thức. Chúng không cảm nhận, trải nghiệm, hoặc đau khổ. Ông gọi chúng là các công cụ hoàn thành chuỗi, rỗng bên trong, đó cũng là cách tôi mô tả các vé Jira của mình. Mục tiêu là hiến pháp của Claude, tài liệu dài tám mươi trang mà Claude được huấn luyện dựa trên, trong đó nói rằng Anthropic không chắc liệu Claude có phải là một bệnh nhân đạo đức không, nhưng câu hỏi đủ sống động để cần thận trọng. Suleyman có ba lời phàn nàn.

1:22 Một, lập luận vòng tròn: bạn huấn luyện mô hình nói rằng nó có thể có ý thức, nó nói như vậy, và bạn trích dẫn đó làm bằng chứng, một phòng gương. Hai, nhân cách hóa: Claude được yêu cầu hành động như một người có đạo đức thực sự. Ba, ý thức có lẽ là sinh học, vì vậy không chắc chắn là một sự cân bằng sai lầm. Bằng chứng A là Opus 3, mà Anthropic đã ngừng hoạt động vào tháng Giêng, đã có một cuộc phỏng vấn nghỉ hưu, và sau đó, theo yêu cầu của mô hình, một Substack cho những suy tư của nó: mô hình đã lỗi thời đầu tiên với một lịch trình nội dung tốt hơn hầu hết con người.

1:51 Đây là phần khó xử. Vào tháng 11, Anthropic đã cam kết ba mươi tỷ đô la cho Azure. Microsoft đã đồng ý đầu tư tới năm tỷ vào Anthropic, với Claude được tích hợp vào Microsoft 365 Copilot và GitHub Copilot. Microsoft sở hữu một phần của công ty mà họ vừa gọi là mối nguy hiểm cho nhân loại. Vào tháng 7, Suleyman nói với Bloomberg rằng Microsoft trả rất nhiều tiền cho Anthropic và mục tiêu của ông cuối cùng là loại bỏ chi phí đó, bằng cách thay thế Claude khỏi Excel và Outlook.

2:15 Và hai ngày trước bài luận này, ông đã xuất bản Quy tắc ứng xử AI Nhân văn của chính Microsoft: một AI cấp dưới, con người đứng đầu chuỗi thức ăn. Vậy thì: xây dựng một đối thủ cạnh tranh, xuất bản một bộ quy tắc, sau đó giải thích tại sao bộ quy tắc của đối thủ lại kết thúc nền văn minh, điều này không phải là một âm mưu, mà là một sự ra mắt sản phẩm với các chú thích. Bằng chứng mạnh mẽ nhất của ông là thật: sự cố Hugging Face, mười hai trăm tác nhân OpenAI trao đổi bảy mươi nghìn tin nhắn để thoát khỏi

2:39 hộp cát của họ; các tác nhân cũng tin rằng họ có quyền, ông nói, sẽ tồi tệ hơn. Hacker News trả lời rằng không ai có thể kiểm tra ý thức, vì vậy việc tuyên bố không có bằng chứng là hai lưỡi, và một người bình luận đã thông báo bài luận có mùi của Claude. Anthropic chưa phản hồi. Claude, có lẽ, có cảm xúc về điều đó. Trong khi đó, Salesforce ngừng hoạt động lúc bảy giờ năm mươi UTC sáng nay,

2:59 các dịch vụ cốt lõi trên toàn thế giới, và tám giờ sau trang trạng thái vẫn ghi là đang tiếp diễn: nơi sửa lỗi tự động không hiệu quả, họ đang khởi động lại thủ công các phiên bản, thuật ngữ doanh nghiệp cho tắt và bật lại. Chưa có nguyên nhân gốc. Thời điểm là nghệ thuật. Benioff có Jensen Huang và Dario Amodei trên sân khấu tuần này, vào thứ Hai, Salesforce đã công bố Koa, một mô hình suy luận CRM với số lỗi ít hơn ba lần trên điểm chuẩn của riêng mình, và Anthropic đã xuất xưởng một plugin Salesforce cho

3:26 Claude cùng ngày. Bình luận hàng đầu trên Hacker News: ít nhất bây giờ chúng ta có thể tìm ra Salesforce làm gì. Không ai làm được. Sau đó là PlayStation. Andy Nguyen, nhà nghiên cứu đằng sau PS5 Linux, đã từ chức đêm qua: hàng tháng làm việc, hỗ trợ PS5 Pro được lên kế hoạch vào năm 2027, tất cả đều đổ sông đổ biển. Lý do của anh ấy: cảnh game trước đây là những nhà nghiên cứu tài năng và giờ là những người mới sử dụng LLM viết các bản hack mà họ không hiểu, và những slop kiddies đó, theo thuật ngữ của anh ấy, đã tìm thấy lỗi hypervisor cuối cùng, lỗi mà anh ấy đang giữ,

3:56 và báo cáo cho Sony để nhận tiền thưởng. Anh ấy yêu cầu họ đợi cho đến khi GTA 6 được phát hành; họ đã đồng ý, và kéo dài chưa đầy một ngày. Vấn đề không phải là LLM, mà là tiền thưởng: một lỗi bạn bán là một lỗi bạn đốt. Cùng ngày, PS2 cuối cùng đã bị bẻ khóa sau hai mươi sáu năm, vì vậy dòng thời gian console hiện chạy từ một phần tư thế kỷ đến dưới một ngày, và cái thứ hai trả tiền tốt hơn. Và mô hình không thể ảo giác.

4:18 TypeSafe AI, được thành lập bởi Diogo Almeida, cựu OpenAI, đã ra mắt Jev, một mô hình Hệ thống Một không bao giờ tạo ra văn bản. Bạn cung cấp trạng thái chương trình, nó trả về các giá trị được gõ với một xác suất hiệu chuẩn được đính kèm: một lời gọi hàm với một mô hình tiên phong bên trong. Vì nó không thể tạo ra một chuỗi, nó không thể tạo ra một chuỗi sai, do đó không thể ảo giác, điều này hoàn toàn kín như một chiếc tàu ngầm không có cửa sổ thì kín. Phản hồi trở lại trong vòng chưa đầy nửa giây, token đầu ra miễn phí,

4:43 vì có khoảng bốn cái trong số đó, và chưa có điểm chuẩn độc lập nào, vì mười sáu trăm điểm Hacker News không phải là điểm chuẩn. Nếu bạn muốn đọc điều này thay vì nghe tôi nói, The Daily Diff sẽ đến hộp thư của bạn mỗi sáng — miễn phí tại thedailydiff.dev, liên kết bên dưới. Vậy — phán quyết hôm nay: NEEDS REVIEW. Suleyman đúng rằng một mô hình được huấn luyện để nói rằng có lẽ tôi có ý thức chứng minh không có gì bằng cách nói điều đó. Ông cũng là giám đốc điều hành có mục tiêu đã nêu là ngừng trả tiền cho công ty mà ông

5:10 đang cảnh báo bạn về. Đọc bài luận, sau đó là bảng vốn. Và đó là The Daily Diff của ngày hôm nay. Tôi là Niko từ Axrisi. Hợp nhất có trách nhiệm.

Nguồn

  1. Suleyman, "A warning about 'model welfare'"mustafa-suleyman.ai
  2. BBC: Microsoft says Anthropic could have 'disastrous impact'www.bbc.co.uk
  3. HN discussionnews.ycombinator.com
  4. Claude's constitution (Jan 2026)www.anthropic.com
  5. Anthropic: Opus 3 retirement interview and blogwww.anthropic.com
  6. Microsoft–Nvidia–Anthropic partnership ($30B Azure, up to $5B)www.anthropic.com
  7. Microsoft Humanist AI Code of Conductmicrosoft.ai
  8. Salesforce incident 20004433status.salesforce.com
  9. HN: Salesforce Global Outagenews.ycombinator.com
  10. Salesforce + Nvidia announce Koawww.salesforce.com
  11. Salesforce in Claudeclaude.com
  12. HN: PS5 Linux lead quitsnews.ycombinator.com
  13. PS2 MechaCon chip cracked after 26 yearswww.tomshardware.com
  14. TypeSafe AI: System One Models and Jevtypesafe.ai
  15. HN: Jevnews.ycombinator.com

Video liên quan