NTT DATA-ს სიახლე: სინთეზური მონაცემები იაპონური AI-ის „მონაცემთა კედელს“ ანგრევს
იაპონელი AI დეველოპერები კულტურულად სპეციფიკური სასწავლო მონაცემების ქრონიკულ დეფიციტს აწყდებიან, რაც ინოვაციას აფერხებს. NTT DATA-ს ახალი კვლევა, NVIDIA Nemotron-Personas-Japan-ის გამოყენებით, აჩვენებს, თუ როგორ შეუძლია სინთეზურ მონაცემებს ამ გამოწვევის დაძლევა. ექსპერიმენტმა იურიდიული კითხვა-პასუხის ამოცანებში მოდელის სიზუსტე 15.3%-დან 79.3%-მდე გაზარდა კონფიდენციალურობის დარღვევის გარეშე. ეს მიდგომა კომპანიებს საშუალებას აძლევს, ააგონ დომენ-სპეციფიკური AI ღია კოდის ინფრასტრუქტურით, შეამცირონ
NTT DATA-ს კვლევა: როგორ ხსნის სინთეზური მონაცემები იაპონიის AI-ის მონაცემთა კედელს
იაპონიაში ხელოვნური ინტელექტის (AI) დეველოპერები ექმნებათ მონაცემთა ქრონიკულ დეფიციტს, განსაკუთრებით იაპონური კულტურისა და ენის სპეციფიკური ამოცანებისთვის. NTT DATA-ს ახალი კვლევა, NVIDIA Nemotron-Personas-Japan-ის გამოყენებით, აჩვენებს, რომ სინთეზურ მონაცემებს შეუძლიათ ამ გამოწვევის დაძლევა. ექსპერიმენტმა აჩვენა მოდელის სიზუსტის მნიშვნელოვანი ზრდა იურიდიული Q&A ამოცანებში (15.3%-დან 79.3%-მდე) კონფიდენციალურობის დარღვევის გარეშე. ეს მიდგომა შესაძლებელს ხდის მაღალი ხარისხის, კულტურულად სპეციფიკუ
NTT DATA-ს ინოვაცია: ხელოვნური მონაცემები იაპონური AI სისტემებისთვის მონაცემთა დეფიციტს ამარცხებს
NTT DATA-მ, NVIDIA-სთან პარტნიორობით, წარმოადგინა ინოვაციური მიდგომა ხელოვნური ინტელექტის სისტემებისთვის მონაცემთა დეფიციტის დასაძლევად, განსაკუთრებით იაპონური ენისა და კულტურის გაგებაში. Nemotron-Personas-Japan-ის გამოყენებით, კომპანიამ მინიმალური საკუთრების მონაცემებიდან შექმნა წარმოების მასშტაბის სასწავლო ნაკრები, რამაც იურიდიულ კითხვა-პასუხის ამოცანებზე მოდელის სიზუსტე 15.3%-დან 79.3%-მდე გაზარდა, კონფიდენციალურობის სრული დაცვით. ეს მიდგომა არა მხოლოდ აუმჯობესებს მოდელებს, არამედ ამცირებს ხა
NVIDIA-მ იაპონური ენის მოდელი Nemotron-Nano-9B-v2-Japanese წარადგინა, Nejumi Leaderboard 4-ზე უახლესი მიღწევით
NVIDIA-მ გამოუშვა Nemotron-Nano-9B-v2-Japanese, მსუბუქი და ეფექტური მოდელი 10 მილიარდზე ნაკლები პარამეტრით, რომელიც იაპონური ენის ღრმა გაგებასა და ძლიერ აგენტურ შესაძლებლობებს გვთავაზობს. მან Nejumi Leaderboard 4-ზე 10B-ზე ნაკლები პარამეტრის მქონე მოდელებს შორის უახლეს მიღწევას მიაღწია, რაც იაპონური კორპორატიული ხელოვნური ინტელექტის განვითარებაში მნიშვნელოვანი ეტაპია. მოდელი ეფუძნება Nemotron-Nano-9B-v2-ის არქიტექტურასა და Nemotron-Personas-Japan-ის მაღალი ხარისხის სინთეზურ მონაცემებს.
NVIDIA-მ Nemotron-Personas-Japan გამოუშვა: იაპონური კულტურის გაგების ხელოვნური ინტელექტისთვის
NVIDIA-მ წარმოადგინა Nemotron-Personas-Japan, პირველი ღია სინთეზური მონაცემთა ნაკრები, რომელიც ასახავს იაპონიის დემოგრაფიას, გეოგრაფიულ განაწილებას და კულტურულ მახასიათებლებს. CC BY 4.0 ლიცენზიით გამოშვებული ეს ნაკრები უზრუნველყოფს კონფიდენციალურობის დამცავ საფუძველს იაპონური საზოგადოების ამსახველი AI სისტემების შესაქმნელად, მგრძნობიარე პირადი მონაცემების გამოყენების გარეშე. იგი შექმნილია იაპონური სუვერენული AI სისტემების მხარდასაჭერად და ადვილად ინტეგრირდება ღია კოდის დიდ ენობრივ მოდელებთან (LL