Anthropic-მა, რომელმაც ოთხი თვის წინ Claude Sonnet 4.5 გამოუშვა და სულ ერთი კვირის წინ Opus 4.6-ის დებიუტი გამართა, ახლა Claude Sonnet 4.6 წარმოადგინა. ეს წინა ვერსიასთან შედარებით უზარმაზარი განახლებაა. ეს ახალი Sonnet 4.6 მოდელი, რომელიც უკვე ხელმისაწვდომია, აჩვენებს გაუმჯობესებულ კოდირების შესრულებას, კომპიუტერის გამოყენების უკეთეს უნარებს, განახლებულ გრძელვადიან კონტექსტურ მსჯელობას, უკეთეს აგენტურ დაგეგმვას და ცოდნაზე დაფუძნებულ მუშაობასა და დიზაინში გაუმჯობესებებს. Opus 4.6-ის მსგავსად, Sonnet 4.6 ახლა მოიცავს 1 მილიონი ტოკენის კონტექსტურ ფანჯარას (ბეტა რეჟიმში). ეს საშუალებას იძლევა ბევრად უფრო ხანგრძლივი და რთული სამუშაო სესიების განხორციელებას სესიის გადატვირთვის ან შეკუმშვის საჭიროების გარეშე. Sonnet 4.6 ახლა ნაგულისხმევი მოდელია უფასო და Pro დონის მომხმარებლებისთვის სხვადასხვა Claude ინტერფეისის მასშტაბით. ამ გეგმების ფასი (ისევე როგორც Sonnet API-ის გამოყენებისთვის) არ გაზრდილა. Anthropic გთავაზობთ ორ ბრენდირებულ AI მოდელს სხვადასხვა ფასად: Sonnet და Opus. Opus ყოველთვის იყო AI მოდელების „კადილაკი“, ხელმისაწვდომი უფრო მაღალ დონეებზე და გაზრდილი ტოკენის API გამოძახების ფასით. Sonnet უფრო საწყისი დონის მოდელი იყო, ჯერ კიდევ საკმაოდ ქმედითი, მაგრამ მნიშვნელოვნად დაბალი რესურსების მოხმარებით, რაც Anthropic-ს საშუალებას აძლევდა ის უფასო მომხმარებლებისთვის გამოეყენებინა და ტოკენის ფასი შეენარჩუნებინა. კომპანიის ბლოგპოსტის მიხედვით, რომელიც Sonnet 4.6-ის გამოშვებას ეხებოდა, „ის უახლოვდება Opus-ის დონის ინტელექტს ისეთ ფასად, რაც მას გაცილებით მეტი ამოცანისთვის უფრო პრაქტიკულს ხდის“. კომპანიის ტესტირების მიხედვით, შესრულება, რომელიც ადრე მხოლოდ Opus-ის კლასის მოდელში იქნებოდა ნანახი, ახლა Sonnet 4.6-ის მომხმარებლებისთვისაც ხელმისაწვდომია. ეს ახალი მოდელი ასევე აჩვენებს მნიშვნელოვან გაუმჯობესებებს AI-ზე დაფუძნებულ დესკტოპ კომპიუტერთან ინტერაქციაში. თუმცა, არსებობს პრაქტიკული ლიმიტები. კომპანიის განცხადებით, „მოდელი, რა თქმა უნდა, ჯერ კიდევ ჩამორჩება ყველაზე გამოცდილ ადამიანებს კომპიუტერების გამოყენებაში. მაგრამ პროგრესის ტემპი მაინც საყურადღებოა. ეს ნიშნავს, რომ კომპიუტერის გამოყენება ბევრად უფრო სასარგებლოა სამუშაო ამოცანების მთელი რიგისთვის და რომ არსებითად უფრო ქმედითი მოდელები ხელმისაწვდომია“. მომხმარებლის ადრეული ტესტირებისას, Anthropic-მა აღმოაჩინა, რომ დეველოპერები Sonnet 4.6-ს Sonnet 4.5-ს ამჯობინებდნენ დაახლოებით 70% შემთხვევაში. კომპანია აცხადებს: „მომხმარებლებმა განაცხადეს, რომ ის უფრო ეფექტურად კითხულობდა კონტექსტს კოდის მოდიფიკაციამდე და აერთიანებდა საერთო ლოგიკას დუბლირების ნაცვლად. ამან მისი გამოყენება გრძელ სესიებზე ნაკლებად იმედგაცრუებული გახადა, ვიდრე ადრინდელი მოდელები“. მიუხედავად იმისა, რომ მომხმარებელთა უმრავლესობამ ახალი ვერსია ამჯობინა, რჩება კითხვები დარჩენილი 30%-ის შესახებ. კომპანიას არ განუმარტავს, თუ რატომ არ ამჯობინა მომხმარებლების ამ ნაწილმა ახალი გამოშვება. Sonnet 4.6-ის Opus 4.5-თან (უფრო ძველი, ნოემბერში გამოშვებული „ფრონტიერ“ მოდელი) შედარებისას, დეველოპერებმა Sonnet 4.6 დაახლოებით 60% შემთხვევაში ამჯობინეს. კომპანიის ცნობით, ადრეულმა მომხმარებლებმა Sonnet 4.6 შეაფასეს, როგორც მნიშვნელოვნად ნაკლებად მიდრეკილი „ზედმეტი ინჟინერიის“ და სიზარმაცისკენ, და უფრო უკეთესი ინსტრუქციების შესრულებაში. მათ განაცხადეს წარმატების ნაკლები ცრუ მტკიცებულება, ნაკლები „ჰალუცინაციები“ და უფრო თანმიმდევრული მოქმედება მრავალსაფეხურიან ამოცანებში. იმის გათვალისწინებით, რომ Opus-ის მიმდინარე ზოგადი ხელმისაწვდომობის ვერსია 4.6-ია, ეს შედეგი არ არის Opus მოდელიდან მაღალი დონის მომხმარებლების მასობრივი მიგრაციის მომასწავებელი. თუმცა, ის ნათლად აჩვენებს, რომ „ბიუჯეტური“ მოდელი საკმარისად გაუმჯობესდა იმ ამოცანების შესასრულებლად, რომლებიც ადრე მაღალი ხარისხის მოდელებისთვის იყო განკუთვნილი. არ უნდა შევაფასოთ Sonnet 4.6-ის მიერ დემონსტრირებული მაღალი შესრულების, თუმცა დაბალი რესურსების მოხმარების სარგებელი. უფასო და Pro დონის გამოყენებისას, Anthropic გამოყენებას ტოკენებისა და რესურსების მოხმარების მიხედვით შეზღუდავს. Sonnet 4.6-ის გაუმჯობესებები მანქანას ჰგავს, რომელიც ახალი საწვავის გამოყენებისას მეტ მილს გადის გალონზე, განსაკუთრებით თუ „სისწრაფე“ მაინც ისეთივე კარგი ან უკეთესია. ოთხჯერ უფრო დიდი, 1 მილიონი ტოკენის ფანჯარა ასევე პრაქტიკულ სარგებელს იძლევა. მას შეუძლია მოიცვას სრული კოდური ბაზები, ხანგრძლივი კონტრაქტები ან ათობით სამეცნიერო ნაშრომი. Anthropic აცხადებს: „რაც უფრო მნიშვნელოვანია, Sonnet 4.6 ეფექტურად მსჯელობს მთელი ამ კონტექსტის მასშტაბით. ამან შეიძლება ის ბევრად უკეთესი გახადოს გრძელვადიანი დაგეგმვისთვის“. თუმცა, Opus-ზე უარი არ უნდა ვთქვათ. Opus 4.6 კვლავ Anthropic-ის „ფრონტიერ“ მოდელის ჩემპიონია. კომპანია აცხადებს: „მიგვაჩნია, რომ Opus 4.6 რჩება ყველაზე ძლიერ ვარიანტად იმ ამოცანებისთვის, რომლებიც ღრმა მსჯელობას მოითხოვს, როგორიცაა კოდური ბაზის რეფაქტორინგი, მრავალი აგენტის კოორდინაცია სამუშაო პროცესში და პრობლემები, სადაც უმცირესი შეცდომის დაშვებაც მიუღებელია“. Anthropic Sonnet 4.6-ს პოზიციონირებს, როგორც პრაქტიკულ ყოველდღიურ ინსტრუმენტს. ბევრ შემთხვევაში, ის მნიშვნელოვნად უფრო სწრაფია, ვიდრე Opus 4.6.