Gemini 4 Argon Google-ის საუკეთესო მოდელია. ჯერ ვერ გამოიყენებთ.
Google-მა გამოაცხადა Gemini 4 Argon, თავისი ახალი სასაზღვრო მოდელი, და მხოლოდ სანდო კიბერ დამცველებს შეუძლიათ მისი გამოყენება.
Google-მა გამოაცხადა Gemini 4 Argon, თავისი ახალი სასაზღვრო მოდელი, და მხოლოდ სანდო კიბერ დამცველებს შეუძლიათ მისი გამოყენება. აი, რას აჩვენებს Google-ის საკუთარი 19-სტრიქონიანი საორიენტაციო ცხრილი, რა გაზომა დამოუკიდებელმა ლიდერბორდმა და როდის შეიძლება მიიღონ ის დეველოპერებმა. განაჩენი: საჭიროებს განხილვას.
წაიკითხეთ წერილობითი გამოცემა (ინგლისური) ↗
რას მოიცავს ეს ვიდეო
- Gemini 4 Argon: მილიონი გამომავალი ტოკენი, 2$ შემოსავალი, და თქვენ ვერ გამოიყენებთ
- Google-ის შიგნით: Argon აგენტები C++-ს Rust-ში პორტირებენ
- Google-ის საკუთარი ცხრილი: Argon ლიდერობს 19 სტრიქონიდან 13-ში
- კიბერ-პრეზენტაცია: დამოუკიდებლად აფიქსირებს, არანაირი დაცვა დამცველებისთვის
- გარე ნომერი: Artificial Analysis ამბობს 53, Opus 5.5-ს აქვს 58
ნათარგმნი ტრანსკრიპტი
ნათარგმნია ორიგინალური ინგლისური ნარატივიდან. ხელმისაწვდომი აუდიო და სუბტიტრები კონტროლდება YouTube-ის მიერ.
Gemini 4 Argon: მილიონი გამომავალი ტოკენი, 2$ შემოსავალი, და თქვენ ვერ გამოიყენებთ
0:00 ალბათ გგონიათ, რომ გაშვება ნიშნავს, რომ მოდელს მიიღებთ. Google-მა ახლახან გაუშვა Gemini four Argon, და თუ თქვენ არ ხართ სანდო კიბერ დამცველი, ვერ შეეხებით მას. ამ ვიდეოში: რას აჩვენებს Google-ის ცხრილი? რა გაზომეს გარე ტესტერებმა? და როდის მიიღებთ მას? ალბათ უკვე გინახავთ ჰაიპ ვიდეოები. სამაგიეროდ, მე წავიკითხე საორიენტაციო ცხრილი და მასში შემავალი ორი სტრიქონი არასოდეს
0:20 მოხვედრილა პოსტის ტექსტში. მათზე ბოლოს ვისაუბრებ. ხუთშაბათია, ოქტომბრის პირველი, და ეს არის The Daily Diff. ორი ამბავი დღეს, და დიდი არის Gemini four Argon, რომელსაც Google უწოდებს სასაზღვრო ინტელექტის შემდეგ ერას. ერთი პასუხი ახლა შეიძლება მილიონ ტოკენს მიაღწიოს, სამოცდაოთხი ათასიდან, რაც რამდენიმე რომანია ერთ პასუხში. გაშვების ფასი არის ორი დოლარი მილიონ ტოკენზე შესასვლელად და ათი გამოსასვლელად. ეს ზუსტად იგივეა, რასაც OpenAI ითხოვს GPT six point one Sol-ისთვის,
0:48 მოდელი, რომელზეც გუშინ ვისაუბრე, და Sol არის ის, რომლის ყიდვაც ნამდვილად შეგიძლიათ. Google-ის შიგნით, ის უკვე მუშაობს.
Google-ის შიგნით: Argon აგენტები C++-ს Rust-ში პორტირებენ
0:54 Google ამბობს, რომ Argon აგენტები C და C++-ს Rust-ში პორტირებენ მთელ კომპანიაში, Fuchsia-ს ბირთვისთვის რვაას ათას ხაზამდე. Hacker News-ზე ერთმა ინჟინერმა გაიხსენა, როდესაც Google-ის C++ გუნდი არც კი განიხილავდა Rust-ს და Carbon-ს უყურებდა მის ნაცვლად. ახლა მოდელი აკეთებს მიგრაციას, რომელზეც ისინი კამათობდნენ.
Google-ის საკუთარი ცხრილი: Argon ლიდერობს 19 სტრიქონიდან 13-ში
1:12 ახლა ცხრილი. Google ათავსებს Argon-ს GPT six Astra-ს, Claude Fable-ს და Claude Opus-ის გვერდით ცხრამეტ სტრიქონზე, და Argon ლიდერობს მათგან ცამეტში. სათაურია DeepSWE, გრძელი კოდირების საორიენტაციო მაჩვენებელი, სამოცდათვრამეტი პროცენტით, დაახლოებით ოთხი ქულით წინ. ყველაზე უცნაური გამარჯვება არის იურიდიული დოკუმენტების შედგენა, სადაც Argon იღებს ოც პროცენტს და დანარჩენები რჩებიან ერთნიშნა რიცხვებში. ეს არის საუკეთესო შეფასება ტესტზე, რომელშიც ყველა იჭრება, და სლაიდ-დეკის
1:38 საორიენტაციო მაჩვენებლებზე, რომლებიც დაუმარცხებელია, ეს ითვლება.
კიბერ-პრეზენტაცია: დამოუკიდებლად აფიქსირებს, არანაირი დაცვა დამცველებისთვის
1:41 რეალური მიზანი უსაფრთხოებაა. Google ამბობს, რომ Argon-ს შეუძლია კრიტიკული მოწყვლადობების პოვნა, ვალიდაცია და გამოსწორება დამოუკიდებლად, და რომ სანდო დამცველები მას კიბერ-დაცვის გარეშე იღებენ. Wiz-მა გამოიყენა ის საავადმყოფოს პროგრამულ უზრუნველყოფაში კრიტიკული ხვრელის საპოვნელად, რომელიც წინა მოდელებს გამოეპარათ. ერთი მცირე დეტალი. Wiz Google-ს ეკუთვნის, მას შემდეგ რაც მარტში ოცდათორმეტი მილიარდი დოლარის გარიგება დაიხურა. ასე რომ, პოსტში მოყვანილი შავი ყუთის ჰაკერული ტესტი არის Google-ის კომპანიის მიერ Google-ის მოდელის შეფასება. და შეცდომების გამოსწორების ლიდერბორდზე, სამი მოდელი სამოცდათვრამეტი
2:10 პროცენტს იზიარებს, და შორეულ მარცხენა ზოლს Grok ეკუთვნის. მაშ, რა გაზომეს გარე ტესტერებმა?
გარე ნომერი: Artificial Analysis ამბობს 53, Opus 5.5-ს აქვს 58
2:15 დამოუკიდებელი ლიდერბორდი, რომელიც Argon-თან ერთად ვიპოვე, არის Artificial Analysis. ის აფასებს Argon-ს ორმოცდაცამეტს თავის ინტელექტის ინდექსზე, მაღალი პარამეტრებით, რაც ათანაბრებს მას Astra-სა და Fable-თან. Claude Opus five point five ხუთი ქულით წინ დგას. ერთი კვირის წინ გითხარით, რომ Opus-მა იქ პირველი ადგილი დაიკავა, და ის კვლავ ინარჩუნებს მას. Google-ისთვის სამართლიანი ნაწილი არის გადასახადი. Argon-ის გაშვება ამ ინდექსზე დაახლოებით ორ დოლარს ღირს დავალებაზე, დაახლოებით მესამედი იმისა, რასაც Opus ღირს.
როდის მიიღებთ: "ასე რომ, მოითმინეთ"
2:42 და როდის მიიღებთ მას? Google თარიღს არ დაასახელებს. პოსტი დეველოპერებს, საწარმოებსა და მომხმარებლებს რაც შეიძლება მალე ჰპირდება წვდომას, პირველ რიგში ფასიანი API მომხმარებლებისთვის. სუნდარ პიჩაის პოსტი X-ზე ამბობს, ასე რომ, მოითმინეთ. მანამდე, წვდომა ხორციელდება Fairwind-ის მეშვეობით, პროგრამა, რომელიც Google-მა ერთი თვის წინ დაიწყო Gemini three point eight Flash Cyber-ით. მას ჰყავს ექვსას ორმოცდაათზე მეტი პარტნიორი, და მათ შეიძლება Argon მხოლოდ თავიანთ
3:05 უსაფრთხოების გუნდებს გადასცენ და უნდა აკონტროლონ ვინ იყენებს მას. Hacker News-მა კარგად მიიღო. ერთმა კომენტატორმა დაწერა, Gemini არ ამარცხებს მოდელის გამოშვების შეუძლებლობის ბრალდებებს. მეორემ იწინასწარმეტყველა, რომ მოდელები ორთქლოვან პროგრამულ უზრუნველყოფად გადაიქცევა, უბრალოდ რიცხვების ერთობლიობა ცხრილზე. ამასობაში, Netlify-მ აღადგინა Edge Functions, რომლებიც დღეში დაახლოებით მილიარდჯერ
Netlify Edge Functions: V8 იზოლატორები მიკროVM-ებში, დაახლოებით 5-ჯერ უფრო სწრაფი
3:23 გაშვება. ისინი V8 იზოლატორებიდან ჰოსტინგ სერვისში გადავიდნენ Firecracker მიკროVM-ებში Netlify-ის საკუთარ ქსელში, და თბილი ზარი ორმოცი მილიწამიდან დაახლოებით ექვსამდე დაეცა. Hacker News-მა აღნიშნა, რომ Cloudflare Workers-იც V8 იზოლატორებია და ბევრად უფრო სწრაფად მუშაობენ, ასე რომ, მოგების უმეტესი ნაწილი, როგორც ჩანს, ისაა, რომ მოთხოვნა აღარ ტოვებს შენობას. კიდევ ერთი კომენტატორი ღელავდა სნეპშოტებზე, რადგან კლონირებულ მიკროVM-ებს შეუძლიათ გაიზიარონ შემთხვევითი რიცხვის მდგომარეობა, როგორც ჩანს, კლონირებულ მიკროVM-ებს შეუძლიათ გაიზიარონ შემთხვევითი რიცხვის მდგომარეობა, ასე მიიღება ორი იდენტური UUID.
3:50 ცივი სტარტი, როდესაც რეგიონს არასდროს უნახავს თქვენი ფუნქცია, ზარების დაახლოებით ერთ პროცენტს შეადგენს და დაახლოებით ცხრა მილიწამს იღებს. და თავად მიკროVM არის Firecracker, რომელიც Amazon-მა Lambda-სთვის შექმნა, ასე რომ, ერთი კომენტატორი გირჩევთ, რომ ეს გახსოვდეთ შემდეგ ჯერზე, როცა AWS-ს დაწყევლით.
ორი სტრიქონი, რომლებსაც Google-ის პოსტი არასდროს ახსენებს
4:06 ახლა, ეს ორი სტრიქონი. FrontierSWE-სა და Terminal-bench-ზე, ორ კოდირების ტესტზე, რომლებსაც პოსტის ტექსტი არასდროს ახსენებს, Argon ოთხიდან ბოლო ადგილზეა, Google-ის საკუთარ ცხრილში. Terminal-bench ათავსებს აგენტს რეალურ shell-ში, რაც უმეტესობამ გამოიყენებდა მას, და Opus ცხრა ქულით უსწრებს. თუ ამის წაკითხვა გირჩევნიათ, ვიდრე ჩემგან მოსმენა, diff ყოველ დილას თქვენს ინბოქსში ხვდება, უფასოდ daily diff dot dev-ზე, ბმული ქვემოთ.
განაჩენი: საჭიროებს განხილვას, იმ დღეს, როცა შევძლებ მის დარეკვას
4:29 ასე რომ, დღევანდელი განაჩენი Gemini four Argon-ზე. საჭიროებს განხილვას. მე მას ასე დავახასიათებდი, რადგან დამოუკიდებელ ნომერში ის მეორე ადგილზეა, და ორ კოდირების სტრიქონში, რომლებიც ჩემთვის მნიშვნელოვანია, ის ბოლოა, ასე რომ, მას სწორად გადავხედავ იმ დღეს, როდესაც შევძლებ მის დარეკვას. გამოიწერეთ, დააჭირეთ ზარს და მითხარით კომენტარებში, სხვაგვარად დაახასიათებდით თუ არა. და ეს არის დღევანდელი diff. მე ვარ ნიკო Axrisi-დან. პასუხისმგებლობით შეაერთეთ.
წყაროები
- Googleblog.google
- Hacker Newsnews.ycombinator.com
- Fairwind Programdeepmind.google
- Artificial Analysisartificialanalysis.ai
- Sundar Pichaix.com
- Demis Hassabisx.com
- Google completes acquisition of Wizcloud.google.com
- Netlifywww.netlify.com
- Hacker Newsnews.ycombinator.com



