თითქმის ათი წლის განმავლობაში ტექნოლოგიური ინდუსტრია ფოკუსირებული იყო დიდი ენობრივი მოდელების (LLMs) შექმნაზე, რომლებიც ტექსტის წერასა და ანალიზზე სპეციალიზდებიან. თუმცა 2026 წელს წამყვანმა მკვლევრებმა ამ მიდგომის სისრულეში ეჭვის შეტანა დაიწყეს. ერთ-ერთი მათგანია ენდრიუ დაი, Google DeepMind-ის ყოფილი მკვლევარი, რომელმაც კომპანია დატოვა და Apple-ის ყოფილ სპეციალისტთან, ინფეი იანგთან ერთად ახალი სტარტაპი – Elorian AI ჩამოაყალიბა. მათი მიზანია შექმნან მოდელები, რომლებიც სამყაროს არა სიტყვებით, არამედ ვიზუალური გამოსახულებებით აღიქვამენ და აანალიზებენ. ენდრიუ დაის შეფასებით, მოდელი, რომელსაც არ შეუძლია მაგიდაზე ჭიქების დათვლა ან სივრცული მიმართებების აღქმა, ვერასდროს მიაღწევს ზოგად ინტელექტს, რაც არ უნდა კარგად წერდეს ტექსტებს ან კოდებს.
როდესაც თანამედროვე მულტიმოდალური სისტემები, მაგალითად Google-ის Gemini, გამოსახულებას ამუშავებენ, ისინი რეალურად სურათს დეტალურ ტექსტურ აღწერად გარდაქმნიან და დასკვნებს ამ სიტყვების ანალიზით აკეთებენ. ამის საპირისპიროდ, Elorian-ის მოდელები გამოსახულებაზე უშუალოდ, სიტყვების შუამავლობის გარეშე „ფიქრობენ“. სიტყვების რუკის ნაცვლად, ისინი ქმნიან დეტალურ 3D შიდა რუკას, ზუსტად ისე, როგორც ადამიანები წარმოიდგენენ ხოლმე საგნებს. ფიზიკის კანონების გაგების წყალობით, მათ გაცილებით ზუსტი დაკვირვებების წარმოება შეუძლიათ.
მაგალითად, მოტოციკლის ძრავის სქემის ჩვენებისას, ჩვეულებრივი მოდელი უბრალოდ აღწერს, რომ გახურებისას დეტალები ფართოვდება. Elorian-ის მოდელს კი შეუძლია ზუსტად მოახდინოს სიმულაცია, თუ როგორ შეიცვლება დეტალების ზომები მაღალი ბრუნვის დროს და ინჟინრებს დიზაინის გასაუმჯობესებლად კონკრეტული ცვლილებები შესთავაზოს. მარტივად რომ ვთქვათ, სტანდარტული მოდელები მხოლოდ აღწერენ ვითარებას, მაშინ როცა ახალი სისტემა სიმულაციასა და ანალიზს აკეთებს.
სტარტაპი მიზნად ისახავს 80 ტრილიონი დოლარის მოცულობის „ფიზიკური ეკონომიკის“ ათვისებას, რაც მოიცავს მექანიკურ ინჟინერიასა და ვიდეოების ანალიზს. მოდელის დახმარებით, ინჟინრებს აღარ მოუწევთ CAD პროგრამებში საათობით ხაზვა – სისტემა თავად შექმნის დიზაინს, გატესტავს მას ფიზიკურ სიმულაციაში, იპოვის ხარვეზებს და ავტომატურად შეასწორებს. ენდრიუ დაიმ 14-წლიანი მუშაობის შემდეგ Google სწორედ იმიტომ დატოვა, რომ კორპორაცია ძირითად რესურსებს კოდის გენერირებაზე ხარჯავდა და ვიზუალურ აზროვნებას შედარებით ნაკლებ ყურადღებას უთმობდა.
Elorian AI-მ უკვე მოიზიდა 55 მილიონი დოლარის ინვესტიცია, რამაც კომპანიის ღირებულება 300 მილიონ დოლარამდე გაზარდა. ინვესტორებს შორის არიან ისეთი გიგანტები, როგორებიცაა Nvidia, Menlo Ventures და Google-ის მთავარი მეცნიერი ჯეფ დინი.
მართალია, სტარტაპის კაპიტალი ჩამოუვარდება მისი კონკურენტების ფინანსებს (მაგალითად, ყოფილი თანამშრომლების მიერ შექმნილი Physical Intelligence 5.6 მილიარდად არის შეფასებული, ხოლო World Labs – 1 მილიარდად), მაგრამ ენდრიუ დაის განცხადებით, მათი მოდელები გარკვეულ ვიზუალურ ტესტებში უკვე ჯობნის Gemini 3 Pro-ს. კომპანია წლის ბოლომდე აპლიკაციების პროგრამირების ინტერფეისის (API) გამოშვებას გეგმავს, რაც დეველოპერებს ამ ინოვაციურ სისტემაზე საკუთარი პროგრამების აშენების საშუალებას მისცემს.
წყარო: Fast Company

