Anthropic-ის მიერ Claude Sonnet 4.5-ის გამოშვებიდან სულ რაღაც ოთხი თვის შემდეგ, და კომპანიის Opus 4.6-ის დებიუტიდან ერთი კვირის თავზე, ხელოვნური ინტელექტის გიგანტი ბრუნდება Claude Sonnet 4.6-ით, რაც წინა ვერსიასთან შედარებით უდიდესი განახლებაა. ასევე: Anthropic აცხადებს, რომ მის ახალ Claude Opus 4.6-ს შეუძლია თქვენი სამუშაო ამოცანების პირველივე ცდაზე შესრულება. ეს ახალი Sonnet 4.6 მოდელი, რომელიც უკვე ხელმისაწვდომია, აჩვენებს გაუმჯობესებულ კოდირების შესრულებას, უკეთეს კომპიუტერული გამოყენების უნარებს, განახლებულ ხანგრძლივი კონტექსტის მსჯელობას, უკეთეს აგენტის დაგეგმვას და გაუმჯობესებებს ცოდნის მართვასა და დიზაინში. ისევე როგორც Opus 4.6-ის შემთხვევაში, Sonnet 4.6 ახლა მოიცავს 1 მილიონი ტოკენის კონტექსტურ ფანჯარას (ბეტა ვერსიაში). ეს იძლევა ბევრად უფრო ხანგრძლივი და კომპლექსური სამუშაო სესიების შესაძლებლობას სესიის გადატვირთვის ან კომპაქტიზაციის საჭიროების გარეშე. Sonnet 4.6 ახლა არის ნაგულისხმევი მოდელი უფასო და Pro დონის მომხმარებლებისთვის სხვადასხვა Claude ინტერფეისის მასშტაბით. ამ გეგმების ფასი (ასევე Sonnet API-ის გამოყენებისთვის) არ გაზრდილა. Anthropic გთავაზობთ ხელოვნური ინტელექტის ორ ბრენდირებულ მოდელს სხვადასხვა ფასად: Sonnet და Opus. Opus ყოველთვის იყო ხელოვნური ინტელექტის მოდელების 'კადილაკი', რომელიც ხელმისაწვდომია უფრო მაღალ დონეზე და გაზრდილი ტოკენის/API ზარის ფასებით. Sonnet უფრო საწყისი დონის მოდელი იყო, თუმცა საკმაოდ მძლავრი, მაგრამ მნიშვნელოვნად დაბალი რესურსების მოხმარებით, რაც Anthropic-ს საშუალებას აძლევდა, მიეწოდებინა ის უფასო მომხმარებლებისთვის და შეენარჩუნებინა ტოკენის დაბალი ფასი. კომპანიის ბლოგპოსტის მიხედვით, სადაც Sonnet 4.6-ის გამოშვებაა ანონსირებული, "ის უახლოვდება Opus-ის დონის ინტელექტს ისეთი ფასით, რაც მას ბევრად უფრო პრაქტიკულს ხდის გაცილებით მეტი ამოცანისთვის." ასევე: მე გამოვიყენე Claude Code Mac აპლიკაციის 8 საათში შესაქმნელად, მაგრამ ეს უფრო მეტ შრომას მოითხოვდა, ვიდრე მაგიას. კომპანიის ტესტირების მიხედვით, შესრულება, რომელიც ადრე მხოლოდ Opus-ის კლასის მოდელებში იქნებოდა ნანახი, ახლა ხელმისაწვდომია Sonnet 4.6-ის მომხმარებლებისთვის. ეს ახალი მოდელი ასევე აჩვენებს მნიშვნელოვან გაუმჯობესებებს ხელოვნურ ინტელექტზე დაფუძნებულ დესკტოპ კომპიუტერულ ინტერაქციაში. თუმცა, არსებობს პრაქტიკული შეზღუდვები. კომპანია აცხადებს: "მოდელი ნამდვილად ჩამორჩება ყველაზე გამოცდილ ადამიანებს კომპიუტერების გამოყენებაში. მაგრამ პროგრესის ტემპი მაინც აღსანიშნავია. ეს ნიშნავს, რომ კომპიუტერის გამოყენება ბევრად უფრო სასარგებლოა მთელი რიგი სამუშაო ამოცანებისთვის და რომ მნიშვნელოვნად უფრო ქმედითი მოდელები მიღწევადია." მომხმარებლის ადრეული ტესტირებისას, Anthropic-მა აღმოაჩინა, რომ დეველოპერები ურჩევდნენ Sonnet 4.6-ს Sonnet 4.5-ს დაახლოებით 70% შემთხვევაში. კომპანია აცხადებს: "მომხმარებლებმა განაცხადეს, რომ ის უფრო ეფექტურად კითხულობდა კონტექსტს კოდის მოდიფიცირებამდე და აერთიანებდა საერთო ლოგიკას, ვიდრე აორმაგებდა მას. ამან შეამცირა მისი გამოყენების სირთულე ხანგრძლივი სესიების დროს წინა მოდელებთან შედარებით." თუმცა, მაინტერესებს დარჩენილი 30%. შეიძლება იფიქროთ, რომ Sonnet 4.5-დან 4.6-ზე პირდაპირი განახლების შემთხვევაში, თითქმის ყველა მომხმარებელი ახალ მოდელს ამჯობინებდა. მე ვკითხე Anthropic-ს, რატომ არ ანიჭებდა უპირატესობას დარჩენილი 30% სავარაუდოდ ახალ ვერსიას. თვალყური ადევნეთ სიახლეებს. თუ რაიმეს გავიგებ, აქ გავაზიარებ. ასევე: Claude Code-მა 6 თვეში $1 მილიარდი გამოიმუშავა - და ჩემი ხელოვნური ინტელექტით კოდირებული iPhone აპლიკაცია აჩვენებს რატომ. Sonnet 4.6-ის Opus 4.5-თან (უფრო ძველი, მოწინავე მოდელი, რომელიც ნოემბერში გამოვიდა) შედარებისას, დეველოპერები Sonnet 4.6-ს ანიჭებდნენ უპირატესობას დაახლოებით 60% შემთხვევაში. კომპანიამ განაცხადა, რომ ადრეულმა მომხმარებლებმა "შეაფასეს Sonnet 4.6, როგორც მნიშვნელოვნად ნაკლებად მიდრეკილი გადაჭარბებული ინჟინერიისა და სიზარმაცისკენ, და გაცილებით უკეთესი ინსტრუქციების შესრულებაში. [ადრეულმა მომხმარებლებმა] განაცხადეს წარმატების ნაკლები ცრუ მტკიცებულებების, ნაკლები ჰალუცინაციების და მრავალსაფეხურიანი ამოცანების უფრო თანმიმდევრული შესრულების შესახებ." იმის გათვალისწინებით, რომ Opus-ის მიმდინარე საჯაროდ ხელმისაწვდომი ვერსია არის 4.6, ეს შედეგი არ არის Opus მოდელიდან მაღალი დონის მომხმარებლების მასობრივი მიგრაციის მომასწავებელი. მაგრამ ის აჩვენებს, რომ "იაფფასიანი" მოდელი საკმარისად გაუმჯობესდა იმ ამოცანების შესასრულებლად, რომლებიც ადრე მაღალი წარმადობის მოდელებისთვის იყო განკუთვნილი. ნუ შევაფასებთ ნაკლებად Sonnet 4.6-ის მაღალ წარმადობას, თუმცა დაბალ რესურსების მოხმარებას. უფასო და Pro დონის გამოყენებისას, Anthropic შეზღუდავს გამოყენებას ტოკენებისა და რესურსების მოხმარების მიხედვით. Sonnet 4.6-ის გაუმჯობესებები მანქანის მიერ ახალი ბენზინის გამოყენებისას მეტი კილომეტრის გავლის მსგავსია, მით უმეტეს, თუ "აჩქარება" ისევ ისეთივე კარგი ან უკეთესია. ასევე: 10 რამ, რაც მინდოდა მცოდნოდა, სანამ Claude Code-ს ვენდობოდი ჩემი iPhone აპლიკაციის შესაქმნელად. ოთხჯერ უფრო დიდ 1 მილიონი ტოკენის ფანჯარას ასევე აქვს პრაქტიკული სარგებელი. მას შეუძლია შეინახოს მთელი კოდის ბაზები, ხანგრძლივი კონტრაქტები ან ათობით სამეცნიერო ნაშრომი. Anthropic აცხადებს: "რაც უფრო მნიშვნელოვანია, Sonnet 4.6 ეფექტურად მსჯელობს მთელ ამ კონტექსტში. ამან შეიძლება ის გაცილებით უკეთესი გახადოს გრძელვადიანი დაგეგმვისთვის." თუმცა, ნუ იტყვით უარს Opus-ზე. Opus 4.6 კვლავ რჩება Anthropic-ის მოწინავე მოდელის ჩემპიონად. ასევე: მე შევწყვიტე ChatGPT-ის გამოყენება ყველაფრისთვის: ეს AI მოდელები მას ჯობია კვლევაში, კოდირებაში და სხვა სფეროებში. კომპანია აცხადებს: "ჩვენ ვხვდებით, რომ Opus 4.6 რჩება ყველაზე ძლიერ ვარიანტად იმ ამოცანებისთვის, რომლებიც ღრმა მსჯელობას მოითხოვს, როგორიცაა კოდის ბაზის რეფაქტორინგი, მრავალი აგენტის კოორდინაცია სამუშაო პროცესში და პრობლემები, სადაც უზადო შედეგის მიღწევა უმნიშვნელოვანესია." Anthropic Sonnet 4.6-ს პოზიციონირებს, როგორც პრაქტიკულ ყოველდღიურ ინსტრუმენტს. ბევრ შემთხვევაში, ის მნიშვნელოვნად უფრო სწრაფია, ვიდრე Opus 4.6.