LIVE
AI-ს გავლენა SaaS-ის ბიზნეს მოდელზე: „SaaSpocalypse“ თუ ახალი ერა? · Anthropic-ის Claude-ის აღზევება Apple App Store-ის რეიტინგებში პენტაგონთან მოლაპარაკებების ფონზე · Honor Magic V6: უთხელესი დასაკეცი ტელეფონი? პირველი შთაბეჭდილებები · Honor Magic V6: ყველაზე თხელი დასაკეცი სმარტფონი და მისი შთამბეჭდავი შესაძლებლობები · ZDNET-ის სანდოობა და MWC 2026: Honor-ის დასაკეცი ტელეფონი Magic V6 და ხელოვნური ინტელექტის მქონე „რობოტი ტელეფონი“ · MWC 2026: Xiaomi Pad 8 Pro Matte Glass – Android ტაბლეტის ახალი ეტალონი? · AI-ს გავლენა SaaS-ის ბიზნეს მოდელზე: „SaaSpocalypse“ თუ ახალი ერა? · Anthropic-ის Claude-ის აღზევება Apple App Store-ის რეიტინგებში პენტაგონთან მოლაპარაკებების ფონზე · Honor Magic V6: უთხელესი დასაკეცი ტელეფონი? პირველი შთაბეჭდილებები · Honor Magic V6: ყველაზე თხელი დასაკეცი სმარტფონი და მისი შთამბეჭდავი შესაძლებლობები · ZDNET-ის სანდოობა და MWC 2026: Honor-ის დასაკეცი ტელეფონი Magic V6 და ხელოვნური ინტელექტის მქონე „რობოტი ტელეფონი“ · MWC 2026: Xiaomi Pad 8 Pro Matte Glass – Android ტაბლეტის ახალი ეტალონი? ·
AI TIME.ge პროექტი

AI სიახლეები

სულ 43 სტატია · გვერდი 1 / 2

Anthropic-ის CEO პენტაგონს ხელოვნური ინტელექტის შეუზღუდავ წვდომაზე უარს ეუბნება
ხელოვნური ინტელექტი 27 თებ

Anthropic-ის CEO პენტაგონს ხელოვნური ინტელექტის შეუზღუდავ წვდომაზე უარს ეუბნება

Anthropic-ის აღმასრულებელმა დირექტორმა დარიო ამოდეიმ განაცხადა, რომ კომპანია სამხედროებს ხელოვნური ინტელექტის სისტემებზე შეუზღუდავ წვდომას არ მისცემს, რადგან ეს დემოკრატიულ ღირებულებებს შეარყევს. ამოდეიმ ხაზი გაუსვა ორ კონკრეტულ შემთხვევას: ამერიკელების მასობრივ თვალთვალს და სრულად ავტონომიურ იარაღს ადამიანის ჩარევის გარეშე. პენტაგონი ცდილობს კომპანიას აიძულოს მისი მოთხოვნების შესრულება, Anthropic კი აცხადებს, რომ მოლაპარაკებები გრძელდება.

1 წთ კითხვა · 76 ნახვა
AI ძიების ევოლუცია: როგორ უნდა მოერგოს SEO და მარკეტინგი ახალ ქროლერებსა და robots.txt წესებს
ციფრული მარკეტინგი 26 თებ

AI ძიების ევოლუცია: როგორ უნდა მოერგოს SEO და მარკეტინგი ახალ ქროლერებსა და robots.txt წესებს

ხელოვნური ინტელექტის (AI) ძიების სისტემები, როგორიცაა ChatGPT, Google AI Overviews და Perplexity, ფუნდამენტურად ცვლიან ინფორმაციის აღმოჩენისა და შეფასების გზებს. მარკეტინგის ლიდერებმა უნდა მოახდინონ SEO, კონტენტისა და გაზომვადი სტრატეგიების ადაპტაცია AI-ით მართული ძიების გამოცდილებისთვის. სტატია დეტალურად განიხილავს, თუ როგორ ანაწილებენ AI კომპანიები (Anthropic, OpenAI, Perplexity) თავიანთ ქროლერებს (სავარჯიშო მონაცემების შეგროვება, ძიების ინდექსირება, მომხმარებლის მოთხოვნები) და რა გავლენას ახდ

1 წთ კითხვა · 83 ნახვა
AI აგენტები და მონაცემთა ჰიგიენა: Salesforce-ის 2026 წლის გაყიდვების მდგომარეობის ანგარიში
ბიზნესი 25 თებ

AI აგენტები და მონაცემთა ჰიგიენა: Salesforce-ის 2026 წლის გაყიდვების მდგომარეობის ანგარიში

Salesforce-ის 2026 წლის გაყიდვების მდგომარეობის ანგარიშის მიხედვით, გაყიდვების გუნდები კრიზისის წინაშე დგანან, მომხმარებელთა მზარდი მოლოდინებისა და დროის შეზღუდული რესურსების გამო. ამ გამოწვევის ფონზე, ხელოვნური ინტელექტის (AI) აგენტების გამოყენება მკვეთრად იზრდება, რადგან გაყიდვების ლიდერების 94% მათ კრიტიკულად მიიჩნევს ბიზნეს მოთხოვნების დასაკმაყოფილებლად. AI აგენტები აძლიერებენ გაყიდვების პროცესს, უზრუნველყოფენ მონაცემთა სიზუსტეს, აუმჯობესებენ მომხმარებელთა ჩართულობას და ამცირებენ ხარჯებს. თუ

1 წთ კითხვა · 58 ნახვა
Google-ი Opal აპლიკაციას AI-ზე დაფუძნებული ავტომატური სამუშაო პროცესების შექმნის ფუნქციას უმატებს
ხელოვნური ინტელექტი 25 თებ

Google-ი Opal აპლიკაციას AI-ზე დაფუძნებული ავტომატური სამუშაო პროცესების შექმნის ფუნქციას უმატებს

Google-მა განაცხადა, რომ მისი vibe-კოდირების აპლიკაცია Opal ახალ AI აგენტს დაამატებს, რომელიც მომხმარებლებს საშუალებას მისცემს შექმნან მინი-აპლიკაციები და ავტომატიზირონ ამოცანები ტექსტური მოთხოვნების გამოყენებით. Gemini 3 Flash მოდელზე დაფუძნებული ეს ფუნქცია, ტექნიკური ცოდნის გარეშეც კი რთული სამუშაო პროცესების აგებას შესაძლებელს ხდის, რითაც Google სხვა სტარტაპების მსგავს ინიციატივებს უერთდება.

1 წთ კითხვა · 65 ნახვა
Google Labs-ი გენერაციულ AI მუსიკის ხელსაწყოს ProducerAI-ს ითვისებს
AI 25 თებ

Google Labs-ი გენერაციულ AI მუსიკის ხელსაწყოს ProducerAI-ს ითვისებს

Google Labs-მა განაცხადა, რომ გენერაციული ხელოვნური ინტელექტის მუსიკალური ხელსაწყო ProducerAI მის შემადგენლობაში შევა. ეს პლატფორმა, რომელსაც The Chainsmokers უჭერს მხარს, Google DeepMind-ის Lyria 3 მოდელს იყენებს, რათა მომხმარებლის მიერ ბუნებრივ ენაზე გაცემული მოთხოვნებიდან მუსიკა შექმნას. მიუხედავად იმისა, რომ ზოგიერთი მუსიკოსი ეწინააღმდეგება AI-ის როლს საავტორო უფლებების გამო, სხვები, მაგალითად, პოლ მაკარტნი, მას ტექნიკური გაუმჯობესებისთვის იყენებენ, ხოლო ზოგი, როგორიცაა უაიკლეფ ჟანი, მას შემ

1 წთ კითხვა · 98 ნახვა
OpenAI პარტნიორობს Reliance-თან, რათა JioHotstar-ს ხელოვნური ინტელექტის მქონე საძიებო ფუნქცია დაამატოს
ხელოვნური ინტელექტი 20 თებ

OpenAI პარტნიორობს Reliance-თან, რათა JioHotstar-ს ხელოვნური ინტელექტის მქონე საძიებო ფუნქცია დაამატოს

OpenAI და Reliance გაერთიანდნენ ინდური კონგლომერატის სტრიმინგ სერვის JioHotstar-ისთვის ხელოვნური ინტელექტის მქონე საძიებო ფუნქციის დასამატებლად. ეს ინტეგრაცია მომხმარებლებს საშუალებას მისცემს, ტექსტური და ხმოვანი მოთხოვნებით მოძებნონ ფილმები, შოუები და სპორტული გადაცემები, ასევე მიიღონ პერსონალიზებული რეკომენდაციები. პარტნიორობა ასევე მოიცავს JioHotstar-ის რეკომენდაციების პირდაპირ ChatGPT-ში ინტეგრაციას, რაც OpenAI-ის ინდოეთში გაფართოების ნაწილია.

1 წთ კითხვა · 95 ნახვა
ChatGPT-ის ეფექტური გამოყენების საიდუმლო: როგორ შევქმნათ სწორი მოთხოვნები
ხელოვნური ინტელექტი 19 თებ

ChatGPT-ის ეფექტური გამოყენების საიდუმლო: როგორ შევქმნათ სწორი მოთხოვნები

ZDNET-ის სარედაქციო პრინციპები ემყარება მრავალსაათიან კვლევასა და დამოუკიდებელ ანალიზს, რათა მკითხველს მიაწოდოს ზუსტი და მიუკერძოებელი ინფორმაცია. ამავდროულად, სტატია იკვლევს ChatGPT-ის, მსოფლიოში ყველაზე პოპულარული გენერაციული AI ინსტრუმენტის, ეფექტური გამოყენების გზებს. ის გვირჩევს AI-სთან საუბარი, როგორც თანამშრომელთან, ფონური ინფორმაციის მიწოდებასა და მრავალსაფეხურიანი კითხვების დასმას, რათა მივიღოთ უფრო ზუსტი და ნიუანსირებული პასუხები.

1 წთ კითხვა · 60 ნახვა
ChatGPT-ის ინგლისური მიკერძოება არაინგლისურ ძიებაში და მისი გავლენა ლოკალურ SEO-ზე
ტექნოლოგია 19 თებ

ChatGPT-ის ინგლისური მიკერძოება არაინგლისურ ძიებაში და მისი გავლენა ლოკალურ SEO-ზე

მარკეტინგის ლიდერები აქტიურად ეგუებიან AI-ზე დაფუძნებული ძიების გამოცდილებებს. უახლესი მონაცემები, რომელიც მოიცავს 10 მილიონზე მეტი ChatGPT მოთხოვნას, ცხადყოფს, რომ არაინგლისური მოთხოვნების შემთხვევაშიც კი, ფონური ძიებების 43% ინგლისურ ენაზე მიმდინარეობს. AI საძიებო ანალიტიკის ფირმა Peec AI-ს ანგარიში დეტალურად აღწერს „ფან-აუტ“ (fan-out) მოთხოვნებს, მათ გაფილტვრას IP-ისა და ენის მიხედვით და აჩვენებს, რომ არაინგლისური მოთხოვნების 78% მინიმუმ ერთ ინგლისურენოვან „ფან-აუტ“ მოთხოვნას შეიცავდა. ეს აღმ

1 წთ კითხვა · 57 ნახვა
ZDNET-ის რეკომენდაციები და FaceTime-ის წვდომა Android მომხმარებლებისთვის: რა უნდა იცოდეთ
ტექნოლოგიები 19 თებ

ZDNET-ის რეკომენდაციები და FaceTime-ის წვდომა Android მომხმარებლებისთვის: რა უნდა იცოდეთ

ZDNET განმარტავს, თუ რას ნიშნავს მისი რეკომენდაციები, ხაზს უსვამს მკაცრ სარედაქციო სტანდარტებს, ტესტირებას და სარეკლამო გავლენისგან დამოუკიდებლობას. სტატიაში ასევე დეტალურადაა აღწერილი, თუ როგორ შეუძლიათ Apple-ის მომხმარებლებს FaceTime ზარებზე მოიწვიონ Android-ის მომხმარებლები სპეციალური ბმულების გაგზავნით, რაც აფართოებს პლატფორმის წვდომას, მიუხედავად იმისა, რომ Android მომხმარებლებს არ შეუძლიათ ზარის ინიცირება ან აპის ჩამოტვირთვა. მოცემულია ინსტრუქციები და აუცილებელი სისტემური მოთხოვნები ამ ფუნ

1 წთ კითხვა · 84 ნახვა
MyLovely AI: ხელოვნური ინტელექტი ვიდეოების შექმნისთვის შეზღუდვების გარეშე
ტექნოლოგიები 19 თებ

MyLovely AI: ხელოვნური ინტელექტი ვიდეოების შექმნისთვის შეზღუდვების გარეშე

MyLovely AI წარმოგიდგენთ რევოლუციურ პლატფორმას, რომელიც მომხმარებლებს საშუალებას აძლევს, შექმნან მაღალი ხარისხის ვიდეოები ხელოვნური ინტელექტის მეშვეობით, სხვა AI სისტემებისთვის დამახასიათებელი ცენზურისა და შეზღუდვების გარეშე. სტატია დეტალურად აღწერს პლატფორმის გამოყენების პროცესს – მოთხოვნების (prompts) შედგენიდან ვიდეოს გენერირებამდე, ხაზს უსვამს დეტალური აღწერის მნიშვნელობას და იტერაციული მიდგომის ეფექტურობას სასურველი შედეგის მისაღებად. ასევე მოცემულია რჩევები ეფექტური მოთხოვნების შესაქმნელად

1 წთ კითხვა · 53 ნახვა
„ZDNET რეკომენდაციას უწევს“: რას ნიშნავს ეს და რატომ არის Satechi Thunderbolt 5 Pro კაბელი საუკეთესო არჩევანი?
ტექნოლოგიები 18 თებ

„ZDNET რეკომენდაციას უწევს“: რას ნიშნავს ეს და რატომ არის Satechi Thunderbolt 5 Pro კაბელი საუკეთესო არჩევანი?

ZDNET-ის რეკომენდაციები ეფუძნება მრავალსაათიან ტესტირებას, კვლევასა და შედარებით შოპინგს, რათა მომხმარებლებმა მიიღონ ყველაზე ზუსტი ინფორმაცია. ამ სტატიაში განხილულია Satechi-ის Thunderbolt 5 Pro კაბელი, რომელიც გამოირჩევა ხარისხით, წარმადობით, გამძლეობითა და ხელმისაწვდომი ფასით ($40), რაც მას იდეალურ არჩევანს ხდის მაღალი მოთხოვნების მქონე სამუშაოებისთვის, ისეთი როგორებიცაა 8K ვიდეო გადაცემა ან მრავალ მონიტორთან მუშაობა. ZDNET ხაზს უსვამს, რომ ეს კაბელი მნიშვნელოვნად აღემატება ძვირადღირებულ ალტერ

1 წთ კითხვა · 62 ნახვა
Airbnb-ის AI მომხმარებელთა მხარდაჭერას ითვისებს და „თქვენთვის ნაცნობ“ აპლიკაციას გეგმავს
ტექნოლოგია 14 თებ

Airbnb-ის AI მომხმარებელთა მხარდაჭერას ითვისებს და „თქვენთვის ნაცნობ“ აპლიკაციას გეგმავს

Airbnb-ის ცნობით, კომპანიის ხელოვნური ინტელექტის აგენტი ჩრდილოეთ ამერიკაში მომხმარებელთა მხარდაჭერის მოთხოვნების მესამედს უკვე ამუშავებს და გლობალურ გაფართოებას გეგმავს. აღმასრულებელი დირექტორი ბრაიან ჩესკი მოელის, რომ ერთ წელიწადში, AI-ის მიერ მოგვარებული საჩივრების წილი 30%-ს გადააჭარბებს, რაც მომსახურების ხარისხს გააუმჯობესებს და ხარჯებს შეამცირებს. კომპანია, რომელმაც ცოტა ხნის წინ AI ექსპერტი ტექნიკურ დირექტორად დაიქირავა, მიზნად ისახავს „AI-ზე ორიენტირებული“ აპლიკაციის შექმნას, რომელიც მომხ

1 წთ კითხვა · 57 ნახვა
SQL მოთხოვნების მხარდაჭერა DuckDB-ით ჰაბზე არსებული მონაცემთა ნაკრებებისთვის
ტექნოლოგია 13 თებ

SQL მოთხოვნების მხარდაჭერა DuckDB-ით ჰაბზე არსებული მონაცემთა ნაკრებებისთვის

ჰაბზე დაემატა ახალი ფუნქცია, რომელიც მომხმარებლებს საშუალებას აძლევს, გაუშვან SQL მოთხოვნები DuckDB-ის გამოყენებით ნებისმიერ მონაცემთა ნაკრებზე. ეს ინტეგრაცია აუმჯობესებს დიდ მონაცემთა ნაკრებებთან მუშაობის ეფექტურობას Parquet ფაილების ფორმატის და დისტანციური წვდომის შესაძლებლობების მეშვეობით, რაც ხელს უწყობს ღია წვდომას და ანალიზს, განსაკუთრებით დიდი ენობრივი მოდელების (LLM) ეპოქაში.

1 წთ კითხვა · 64 ნახვა
როგორ გავიგოთ და ოპტიმიზაცია გავუკეთოთ GPU მეხსიერებას PyTorch-ში
ხელოვნური ინტელექტი 13 თებ

როგორ გავიგოთ და ოპტიმიზაცია გავუკეთოთ GPU მეხსიერებას PyTorch-ში

ეს გაკვეთილი ეტაპობრივად განმარტავს, თუ როგორ მოვახდინოთ GPU მეხსიერების გამოყენების ვიზუალიზაცია და გაგება PyTorch-ში ტრენინგის დროს. ის მოიცავს მეხსიერების მოთხოვნების შეფასებას, გამოყენების ოპტიმიზაციას PyTorch-ის პროფილის ხელსაწყოების მეშვეობით და დეტალურ ანალიზს იმის შესახებ, თუ როგორ იქცევა მეხსიერება მოდელის შექმნის, წინსვლის, უკუგადაცემის და ოპტიმიზატორის ნაბიჯების განმავლობაში, მათ შორის დიდი ენობრივი მოდელების (LLM) რეალურ სცენარებში.

1 წთ კითხვა · 98 ნახვა
AI WebTV: ხელოვნური ინტელექტით შექმნილი ვიდეო კონტენტის ინოვაციური პლატფორმა
ტექნოლოგიები 13 თებ

AI WebTV: ხელოვნური ინტელექტით შექმნილი ვიდეო კონტენტის ინოვაციური პლატფორმა

AI WebTV წარმოადგენს ინოვაციურ პლატფორმას, რომელიც დემონსტრირებს ღია კოდის ტექსტი-ვიდეოდ გადამყვანი მოდელებით, როგორიცაა Zeroscope და MusicGen, გენერირებულ ვიდეოებს. ის შექმნილია მოკლე, ტექნოლოგიური დემო კლიპების სახით, სადაც დიდი ენობრივი მოდელები (LLM), მაგალითად ChatGPT, გამოიყენება ვიდეო კადრებისთვის მრავალფეროვანი მოთხოვნების შესაქმნელად. სისტემა დანერგილია NodeJS-სა და TypeScript-ში, იყენებს Hugging Face-ის სერვისებს და მოიცავს კადრების გაფართოებას FILM ალგორითმით, ასევე მუსიკის დამატებას

1 წთ კითხვა · 66 ნახვა
Hugging Face-ის TGI წარმოგიდგენთ ახალ Backends არქიტექტურას: გამარტივებული LLM-ების განთავსება და გაუმჯობესებული წარმადობა
ხელოვნური ინტელექტი 13 თებ

Hugging Face-ის TGI წარმოგიდგენთ ახალ Backends არქიტექტურას: გამარტივებული LLM-ების განთავსება და გაუმჯობესებული წარმადობა

Hugging Face-მა წარმოადგინა TGI Backends, ახალი არქიტექტურა Text-Generation-Inference (TGI)-ისთვის, რომელიც მიზნად ისახავს LLM-ების განთავსების პროცესის გამარტივებას და ოპტიმალური წარმადობის უზრუნველყოფას. ეს სიახლე აერთიანებს სხვადასხვა ინფერენსინგის გადაწყვეტებს ერთიან ფრონტენდ ფენაში, რაც მომხმარებლებს საშუალებას აძლევს მარტივად შეცვალონ ბეკენდები მათი მოდელირების, აპარატურის და წარმადობის მოთხოვნების შესაბამისად.

1 წთ კითხვა · 62 ნახვა
Reformer მოდელი: მეხსიერება-ეფექტური ტრანსფორმერული არქიტექტურა გრძელი მიმდევრობების მოდელირებისთვის
ტექნოლოგია 13 თებ

Reformer მოდელი: მეხსიერება-ეფექტური ტრანსფორმერული არქიტექტურა გრძელი მიმდევრობების მოდელირებისთვის

კიტაევის, კაიზერისა და სხვების (2020) მიერ შემოთავაზებული Reformer მოდელი წარმოადგენს ერთ-ერთ ყველაზე მეხსიერება-ეფექტურ ტრანსფორმერულ არქიტექტურას გრძელი მიმდევრობების მოდელირებისთვის. NLP ამოცანების (მაგ. რეფერირება, კითხვა-პასუხის სისტემები) მზარდი მოთხოვნების დასაკმაყოფილებლად, Reformer-ს შეუძლია ნახევარ მილიონამდე ტოკენის დამუშავება, მაშინ როცა სტანდარტული BERT მოდელები 512 ტოკენით შემოიფარგლებიან. მისი არქიტექტურის თითოეული ნაწილი გადაკეთებულია მინიმალური მეხსიერების მოთხოვნილების ოპტიმიზა

1 წთ კითხვა · 60 ნახვა
ღია კოდის ვიდეო გენერაციის მოდელების აღზევება: დგას თუ არა AI „Stable Diffusion-ის მომენტის“ ზღურბლზე?
ტექნოლოგიები 13 თებ

ღია კოდის ვიდეო გენერაციის მოდელების აღზევება: დგას თუ არა AI „Stable Diffusion-ის მომენტის“ ზღურბლზე?

ბოლო დროს შეინიშნება ღია კოდის ვიდეოს გენერაციის მოდელების, მათ შორის CogVideoX, Mochi-1, Hunyuan და LTX Video-ს სწრაფი ზრდა, რაც ბადებს კითხვას, დგას თუ არა ვიდეო საზოგადოება ხელოვნური ინტელექტის „Stable Diffusion-ის მომენტის“ ზღურბლზე. ეს სტატია მიმოიხილავს ვიდეოს გენერაციის მოდელების მიმდინარე მდგომარეობას, ხაზს უსვამს ისეთ შეზღუდვებს, როგორიცაა მოძრაობის ხარისხი, დროითი თანმიმდევრულობა და მეხსიერების მაღალი მოთხოვნები. Diffusers-ის გუნდი აქტიურად მუშაობს ამ გამოწვევების გადასაჭრელად სხვადასხ

1 წთ კითხვა · 69 ნახვა
Hugging Face აერთიანებს სერვერულ ინფერენსზე წვდომას ახალი პარტნიორობითა და ფუნქციებით
ტექნოლოგია 13 თებ

Hugging Face აერთიანებს სერვერულ ინფერენსზე წვდომას ახალი პარტნიორობითა და ფუნქციებით

Hugging Face-მა, საკუთარი სერვერული Inference API-ის ხანგრძლივი მასპინძლობის შემდეგ, გადაწყვიტა ფოკუსირება თანამშრომლობაზე, დიდი მონაცემთა ნაკრებებისა და მოდელების შენახვაზე, ვერსიონირებასა და გავრცელებაზე. ამის პარალელურად, კომპანია მომხმარებლებს სთავაზობს მარტივ და ერთიან წვდომას სერვერულ ინფერენსზე წამყვანი პროვაიდერების მეშვეობით. ეს ნაბიჯი აძლიერებს AI მოდელების ხელმისაწვდომობას, გვთავაზობს მოქნილ ფასებს პირდაპირი და მარშრუტიზებული მოთხოვნებისთვის, და უზრუნველყოფს დამატებით ბენეფიტებს PRO მ

1 წთ კითხვა · 65 ნახვა
DeepFloyd IF-ის ინტეგრაცია BentoML-თან პროდუქტიული განთავსებისთვის
ხელოვნური ინტელექტი 13 თებ

DeepFloyd IF-ის ინტეგრაცია BentoML-თან პროდუქტიული განთავსებისთვის

სტატია მიმოიხილავს, თუ როგორ ხდება BentoML-ის, ღია კოდის პლატფორმის, გამოყენება DeepFloyd IF-ის, თანამედროვე ტექსტიდან გამოსახულების გენერირების მოდელის, განთავსებისთვის. აღწერილია DeepFloyd IF-ის უნიკალური არქიტექტურა (პიქსელურ სივრცეში მუშაობა, კასკადური დიფუზია, LLM-ის გამოყენება მოთხოვნებისთვის) და BentoML-ის მეშვეობით რესურსების ოპტიმალური მართვა, მათ შორის GPU-ს განაწილება. მოცემულია ინსტრუქციები პროექტის ლოკალურად გაშვებისთვის, მოდელების ჩამოტვირთვისთვის, სერვერის Gradio-სთან ერთად გაშვებ

1 წთ კითხვა · 65 ნახვა
ტრანსფორმერების ეფექტურობის გამოწვევები: შორს მიმავალი ყურადღება და მეხსიერების ოპტიმიზაცია
ხელოვნური ინტელექტი და მანქანური სწავლება 13 თებ

ტრანსფორმერების ეფექტურობის გამოწვევები: შორს მიმავალი ყურადღება და მეხსიერების ოპტიმიზაცია

დიდი ტრანსფორმერების მოდელების გამოთვლითი მოთხოვნების შემცირება კვლევის ერთ-ერთი მთავარი მიმართულებაა, განსაკუთრებით თანმიმდევრობის სიგრძესთან დაკავშირებული კვადრატული დანახარჯის პრობლემის გამო. სტატია განიხილავს ოთხ ძირითად მიდგომას ამ გამოწვევის მოსაგვარებლად: Longformer, Transformer-XL, Compressive Transformer და დაბალი რანგის ყურადღების მატრიცების გამოყენება, რომლებიც მიზნად ისახავს მოდელების მეხსიერებისა და დროის ეფექტურობის გაუმჯობესებას გრძელი თანმიმდევრობების დამუშავებისას.

1 წთ კითხვა · 69 ნახვა
Llama 2 70B-ის დახვეწა PyTorch FSDP-ის გამოყენებით: საუკეთესო პრაქტიკა და გამოწვევების გადაწყვეტა
ხელოვნური ინტელექტი 13 თებ

Llama 2 70B-ის დახვეწა PyTorch FSDP-ის გამოყენებით: საუკეთესო პრაქტიკა და გამოწვევების გადაწყვეტა

ამ ბლოგ-პოსტში განხილულია Llama 2 70B მოდელის დახვეწის პროცესი PyTorch FSDP-ის გამოყენებით, Hugging Face Transformers, Accelerate და TRL ინსტრუმენტების მოშველიებით. დეტალურად არის აღწერილი FSDP-ის მოქმედების პრინციპი, რომელიც ოპტიმიზატორის მდგომარეობებს, გრადიენტებსა და პარამეტრებს მოწყობილობებს შორის ანაწილებს. ასევე, განხილულია ძირითადი გამოწვევები, როგორიცაა CPU RAM-ის მაღალი მოთხოვნები, შუალედური საკონტროლო წერტილების ნელი შენახვა და NCCL Timeout შეცდომები. სტატია გვთავაზობს გადაწყვეტებს ტრე

1 წთ კითხვა · 108 ნახვა
ახალი ბენჩმარკი: Llama 2-ის განლაგების ოპტიმალური სტრატეგიები Amazon SageMaker-ზე
ტექნოლოგიები 13 თებ

ახალი ბენჩმარკი: Llama 2-ის განლაგების ოპტიმალური სტრატეგიები Amazon SageMaker-ზე

დიდი ენობრივი მოდელების (დემ) განლაგება გამოწვევებთან არის დაკავშირებული მათი გამოთვლითი მოთხოვნებისა და დაყოვნების საჭიროებების გამო. ამ პრობლემის გადასაჭრელად, შემუშავდა ყოვლისმომცველი ბენჩმარკი, რომელმაც შეაფასა Llama 2-ის 60-ზე მეტი განლაგების კონფიგურაცია Amazon SageMaker-ზე Hugging Face-ის დემ დასკვნის კონტეინერის გამოყენებით. კვლევამ მიზნად დაისახა ოპტიმალური სტრატეგიების მოძიება კომპანიებისთვის, რათა დააბალანსონ ხარჯები, გამტარუნარიანობა და დაყოვნება Llama 2-ის სხვადასხვა ზომისა და Amazo

1 წთ კითხვა · 103 ნახვა
Gradio-lite: Gradio აპლიკაციების გაშვება პირდაპირ ბრაუზერში Pyodide-ით
ტექნოლოგიები 13 თებ

Gradio-lite: Gradio აპლიკაციების გაშვება პირდაპირ ბრაუზერში Pyodide-ით

Gradio-lite არის JavaScript ბიბლიოთეკა, რომელიც საშუალებას გაძლევთ გაუშვათ Gradio აპლიკაციები პირდაპირ ვებ ბრაუზერში, Pyodide-ის გამოყენებით (Python runtime WebAssembly-ისთვის). ეს გამორიცხავს სერვერის ინფრასტრუქტურის საჭიროებას, ამარტივებს დეპლოიმენტს, ამცირებს ხარჯებს და უზრუნველყოფს სწრაფ ინტერაქციასა და მონაცემთა დაცვას. სტატიაში აღწერილია Gradio-lite-ის ძირითადი ფუნქციები, აპლიკაციის შექმნა, მრავალფაილიანი პროექტებისა და დამატებითი მოთხოვნების მართვა. განხილულია მისი უპირატესობები, როგორიცა

1 წთ კითხვა · 103 ნახვა
1 2 შემდეგი →