
Bengaluru-based startup Sarvam AI has announced plans to build a one-trillion parameter foundational model. The company has opened a San Francisco office and a Bay Area research lab, raising $234 million in…
बेंगलुरु स्थित स्टार्टअप सर्वम AI ने एक ट्रिलियन पैरामीटर वाला फाउंडेशनल मॉडल बनाने की योजना की घोषणा की है। कंपनी ने सैन फ्रांसिस्को में एक कार्यालय और बे एरिया में एक शोध प्रयोगशाला खोली है, और द हिंदू की रिपोर्ट के अनुसार, अपने सीरीज-B फंडिंग राउंड के पहले चरण में 1.5 बिलियन डॉलर के मूल्यांकन पर 234 मिलियन डॉलर जुटाए हैं। फाउंडेशनल मॉडल सामान्य-उद्देश्य वाली प्रणालियाँ हैं जो बिना स्पष्ट प्रोग्रामिंग के नए कार्य कर सकती हैं, लेकिन उनका दायरा प्रशिक्षण डेटासेट द्वारा पूर्वनिर्धारित होता है।
सर्वम AI ने हाल ही में एक डेवलपर प्लेटफॉर्म, इपॉक बिल्डर एडिशन लॉन्च किया, जो 7 बिलियन और 70 बिलियन पैरामीटर वाले मॉडल प्रदान करता है जो 2 ट्रिलियन टोकन पर प्रशिक्षित हैं और 10 से अधिक भारतीय भाषाओं का समर्थन करते हैं। कंपनी ने भारत में संप्रभु AI तकनीक विकसित करने के लिए IBM के साथ भागीदारी भी की है। द हिंदू ने नोट किया कि संप्रभु प्लेटफॉर्म बनाने में हार्डवेयर अधिग्रहण, उच्च कोटि के इंजीनियरिंग प्रतिभा और प्रशिक्षण डेटासेट के आसपास चुनौतियाँ हैं, क्योंकि प्री-ट्रेनिंग की लागत प्रति रन 100 मिलियन डॉलर से अधिक हो सकती है और इसके लिए हजारों GPU की आवश्यकता होती है।
हालांकि, सर्वम AI के पास डेटा दक्षता में एक फायदा है, जिसमें एक कस्टम टोकनाइज़र है जो भारतीय भाषाओं के लिए टोकन उर्वरता को 1.2-2 टोकन प्रति शब्द तक कम कर देता है, जबकि पश्चिमी मॉडलों में यह 8 टोकन प्रति शब्द है। द हिंदू के अनुसार, इस विकास के स्पष्ट भू-राजनीतिक निहितार्थ हैं, क्योंकि अमेरिका और चीन अत्याधुनिक मॉडलों के साथ प्रतिस्पर्धा कर रहे हैं जबकि अन्य देश AI बुनियादी ढांचा बनाने में जुटे हैं।
स्रोत: thehindu.com
यह कहानी ऊपर दिए गए स्रोत से AI द्वारा संश्लेषित की गई थी।