კარგი ამბავი xAI-ისთვის: Grok უკვე კარგად პასუხობს Baldur’s Gate-ის შესახებ კითხვებს
ილონ მასკის xAI-ის Grok მოდელმა, პირადი ინტერესის გამო, ვიდეო თამაშ „Baldur's Gate“-ის შესახებ კითხვებზე პასუხის გაცემაში მნიშვნელოვნად გაიუმჯობესა უნარები. მოდელის გამოშვება მასკის უკმაყოფილების გამო რამდენიმე დღით გადაიდო. „BaldurBench“ ტესტირებისას, Grok-მა, ChatGPT-მ, Claude-მა და Gemini-მ შედარებით მსგავსი შედეგები აჩვენეს, თუმცა Grok-ის პასუხები გამოსადეგი და ინფორმირებული იყო, მიუხედავად გეიმერული ჟარგონისა. აღსანიშნავია, რომ Claude-მა სპოილერებისგან თავის შეკავება სცადა. სტატია ასკვნის,
ხელოვნური ინტელექტის სხვადასხვა ლაბორატორიას განსხვავებული პრიორიტეტები აქვს. მაგალითად, OpenAI ტრადიციულად მომხმარებლებზე იყო ორიენტირებული, ხოლო მისი კონკურენტი Anthropic - საწარმოებზე. როგორც ცოტა ხნის წინ აღმოვაჩინეთ, ილონ მასკის xAI-ი განსაკუთრებულ აქცენტს აკეთებდა ვიდეო თამაშების გავლაზე (walkthroughs).
პარასკევს, Business Insider-ის ჟურნალისტმა გრეის კეიმ გამოაქვეყნა დეტალური და ფართომასშტაბიანი რეპორტაჟი xAI-ის, ხელოვნური ინტელექტის სტარტაპის შესახებ, რომელიც ცოტა ხნის წინ SpaceX-მა შეიძინა. მასში განსაკუთრებული აქცენტი გაკეთებულია იმაზე, თუ როგორ უქმნის მასკი თანამშრომლებს პრობლემებს. თუმცა, ერთი კონკრეტული ამბავი გამოირჩეოდა: გასულ წელს, ერთ შემთხვევაში, მოდელის გამოშვება რამდენიმე დღით გადაიდო, რადგან მასკი უკმაყოფილო იყო იმით, თუ როგორ პასუხობდა ჩატბოტი ვიდეო თამაშ „Baldur’s Gate“-ის შესახებ დეტალურ კითხვებს, განაცხადეს საკითხში ჩახედულმა პირებმა. მაღალი დონის ინჟინრები სხვა პროექტებიდან გამოიყვანეს პასუხების გასაუმჯობესებლად, გამოშვებამდე.
რა თქმა უნდა, შეგიძლიათ წარმოიდგინოთ ნებისმიერი პატივცემული და გამოცდილი ინჟინრის იმედგაცრუება, რომელიც სამსახურში მიდის იმ მოლოდინით, რომ ცოდნისა და მანქანური ინტელექტის ფუნდამენტურ პრობლემებს მოაგვარებს, მაგრამ სამაგიეროდ, 54 წლის მამაკაცს ვიდეო თამაშის გავლაში ეხმარება. თუმცა, ეს ამბავი კიდევ უფრო აქტუალურ კითხვას ბადებს: მიიღო თუ არა მასკმა საბოლოოდ ის სათამაშო უნარები, რაც სურდა?
ამ კითხვაზე პასუხის გასაცემად, ჩვენმა RPG ენთუზიასტმა რამ აიერმა შეადგინა ხუთი ზოგადი კითხვა Baldur’s Gate-ის შესახებ, რომლებიც ჩვენ xAI-ს და სამ ძირითად მოდელს – Grok-ს, ChatGPT-ს, Claude-ს და Gemini-ს შევუპირისპირეთ, ერთგვარი ნახევრად-ბენჩმარკის ფარგლებში, რომელსაც „BaldurBench“ ვუწოდე. ჟურნალისტური გამჭვირვალობის ინტერესებიდან გამომდინარე, ყველა ჩატის ტრანსკრიპტი საჯარო გავხადე.
ჯერ კარგი ამბავი: Grok რეალურად საკმაოდ კარგ ინფორმაციას იძლევა. მისი პასუხები გარკვეულწილად დატვირთული იყო გეიმერული ჟარგონით – „save-scumming“ შენახვის ნაცვლად და „DPS“ დაზიანების ნაცვლად – მაგრამ პასუხები როგორც გამოსადეგი, ასევე კარგად ინფორმირებული იყო, იმ პირობით, რომ იცოდით, რაზე საუბრობდა. Grok-ს ასევე ძალიან უყვარს ცხრილები და „theorycrafting“, რაც მოსალოდნელი იყო.
Baldur’s Gate-ის უამრავი გზამკვლევი არსებობს და მოდელები ძირითადად ერთი და იგივე წყაროებიდან იღებდნენ ინფორმაციას, ამიტომ ყველაზე დიდი განსხვავებები სტილისტური იყო. ChatGPT უპირატესობას ანიჭებს ბულეტებიან სიებსა და წინადადების ფრაგმენტებს, ხოლო Gemini-ს უყვარს მნიშვნელოვანი სიტყვების გაბოლდება. ყველაზე დიდი სიურპრიზი Claude აღმოჩნდა, რომელიც განსაკუთრებით ზრუნავდა იმაზე, რომ არ მიმეცა ინფორმაცია, რომელიც თამაშის გამოცდილებას გამიფუჭებდა. როდესაც კარგ გუნდურ შედგენილობაზე ვკითხე, მან მითითება დაასრულა სიტყვებით: „ზედმეტად ნუ ნერვიულობთ და უბრალოდ ითამაშეთ ის, რაც თქვენთვის სახალისოდ ჟღერს.“ მადლობა, Claude!
მნიშვნელოვანია გავითვალისწინოთ, რომ ეს არის თემატური სფერო, რომელზეც (Business Insider-ის რეპორტაჟის წყალობით) ვიცით, რომ xAI კონკრეტულად გათანაბრებაზე იყო ორიენტირებული. ამიტომ, ზედმეტად არ უნდა მივანიჭოთ მნიშვნელობა იმ ფაქტს, რომ მოხსენებული „სპრინტის“ შემდეგ, Grok-ის რჩევები დაახლოებით იგივე აღმოჩნდა, რაც სხვა მოდელების. მიუხედავად ამისა, კარგია იმის ცოდნა, რომ xAI-ს შეუძლია წარმატების მიღწევა, თუკი ეცდება.
თეგები:
#xai
#ილონ მასკი
#grok
#ხელოვნური ინტელექტი
#სტარტაპები
#ჩატბოტები
#ai მოდელები
#ვიდეო თამაშები
#baldur's gate
წყარო: techcrunch.com
AI-ით გადამუშავებული
მსგავსი სტატიები
ხელოვნური ინტელექტი
Anthropic-ის Claude-ის აღზევება Apple App Store-ის რეიტინგებში პენტაგონთან მოლაპარაკებების ფონზე
ხელოვნური ინტელექტი
ტრამპის ადმინისტრაცია Anthropic-ს სანქციებს უწესებს ხელოვნური ინტელექტის გამოყენებაზე უარის გამო: ექსპერტი ინდუსტრიის უსაფრთხოების ხარვეზებზე საუბრობს
ხელოვნური ინტელექტი