Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

news.sbsnews.sbssiliconcanals+1The Information-ის მიერ 13 აგვისტოს გამოქვეყნებული ანგარიშის თანახმად, რომელიც ეყრდნობა დაახლოებით 20 წყაროს, მათ შორის სტარტაპების დამფუძნებლებსა და ინდუსტრიის ინსაიდერებს, AI დეველოპერები, მათ შორის OpenAI და Anthropic, სულ უფრო მეტად ყიდულობენ კორპორატიულ მონაცემებს, როგორიცაა თანამშრომელთა ჩატები, ელექტრონული წერილები, ვიდეოკონფერენციების ჩანაწერები და კოდის ცვლილებების ისტორია, რადგან საჯაროდ ხელმისაწვდომი ინტერნეტ ტექსტების მარაგი იწურება.news.sbs
კორპორატიულ კომუნიკაციებზე მოთხოვნა ბოლო თვეების განმავლობაში გაიზარდა, რაც განპირობებულია ისეთი AI აგენტების შექმნის სურვილით, რომლებსაც რეალურ სამყაროში ამოცანების შესრულება შეუძლიათ. მონაცემთა ბროკერული სტარტაპ Protege-ის აღმასრულებელმა დირექტორმა ბობი სემუელსმა განაცხადა, რომ კომპანიის ტრანზაქციების მოცულობა გასული წლის 30 მილიონიდან წელს მინიმუმ 100 მილიონამდე გაიზარდა.news.sbs
მყიდველები ძირითადად გაკოტრების ან შესყიდვის პირას მყოფ სტარტაპებზე არიან ორიენტირებულნი. Warmly, AI აგენტის სტარტაპი, რომელიც ცოტა ხნის წინ HubSpot-მა შეიძინა, გავრცელებული ინფორმაციით, შესყიდვის ხელშეკრულების გაფორმების შემდეგ შიდა შეხვედრების ოქმებისა და ელექტრონული წერილების შესაძენად 300 000 დოლარამდე ოთხი ცალკეული შეთავაზება მიიღო, თუმცა ყველა მათგანზე უარი თქვა. ადამიანთა რეალური ურთიერთქმედების ჩანაწერები, როგორიცაა დეველოპერების მიერ პრობლემების გადაჭრა, ფინანსური მაჩვენებლების განხილვა და პროგრამული უზრუნველყოფის დემო ვიდეოები, ახალი თაობის AI სისტემებისთვის აუცილებელ სასწავლო მასალად ითვლება.news.sbs
ეს შესყიდვები სტრუქტურულ შეზღუდვებზე მიუთითებს. Epoch AI-ის შეფასებით, ადამიანის მიერ დაწერილი ხარისხიანი საჯარო ტექსტების ეფექტური მარაგი დაახლოებით 300 ტრილიონ ტოკენს შეადგენს და შესაძლოა 2026-2032 წლებში სრულად ამოიწუროს. უფრო აგრესიული გათვლების შემთხვევაში, ეს ვადა შესაძლოა 2027 წლამდეც კი შემცირდეს. ინტერნეტში ახალი ტექსტები კვლავ ჩნდება, თუმცა მათი ზრდის ტემპი გაცილებით ნელია, ვიდრე AI-ის სასწავლო მონაცემთა ბაზების გაფართოება.siliconcanals+3
პირად მონაცემებზე ნადირობა მოჰყვა იმ დავებს, თუ როგორ მოიპოვებდნენ AI კომპანიები სასწავლო მასალას. Anthropic-ის შიდა ინიციატივა Project Panama მოიცავდა საავტორო უფლებებით დაცული წიგნების შეძენას, სკანირებისთვის მათი ყდების მოცილებას და შემდგომში ფიზიკური ასლების განადგურებას. სან-ფრანცისკოს ფედერალურმა მოსამართლემ ივლისში დაამტკიცა 1.5 მილიარდი დოლარის ოდენობის კოლექტიური სარჩელი ამ პროგრამასთან დაკავშირებით. როგორც The Washington Post იტყობინება, შიდა დაგეგმვის დოკუმენტში ეს მცდელობა აღწერილი იყო, როგორც "მსოფლიოს ყველა წიგნის დესტრუქციული სკანირება".reuters+1
ვინაიდან კორპორატიული მონაცემთა ბაზების დე-იდენტიფიკაცია მთავარ გამოწვევად იქცა, მონაცემთა დამუშავების ფირმა Integral-ის აღმასრულებელმა დირექტორმა შუბ სინჰამ განაცხადა, რომ მისი კომპანია ატარებს "მკაცრ ანონიმიზაციის პროცესს, რათა შეინარჩუნოს მონაცემთა ღირებულება და დაიცვას კონფიდენციალურობის რეგულაციები". პირადი ტექსტების მზარდი ბაზარი მიუთითებს, რომ სასწავლო ხარჯები, რომლებიც ადრე ძირითადად გამოთვლით სიმძლავრეებზე იყო დამოკიდებული, AI დეველოპერებისთვის სულ უფრო მნიშვნელოვანი ხარჯვითი პუნქტი ხდება.news.sbs