गूगल जेमिनी में आया लाइव अवतार फीचर, 97 भाषाओं में करेगा बात
News Synopsis
गूगल ने अपने जेमिनी AI में एक नया और दिलचस्प फीचर पेश किया है, जो AI के साथ बातचीत के अनुभव को पहले से अधिक जीवंत बना सकता है। कंपनी ने Gemini 3.8 Live मॉडल के लिए “Live Avatar” नाम का नया फीचर शुरू किया है। इसके जरिए उपयोगकर्ता AI से बातचीत करते समय स्क्रीन पर एक एनिमेटेड अवतार को प्रतिक्रिया देते हुए देख सकेंगे।
यह अवतार उपयोगकर्ता की बात सुनकर वास्तविक समय में जवाब देगा और उसके बोलने के साथ चेहरे तथा मुंह की गतिविधियां भी दिखाई देंगी। Google के अनुसार, यह तकनीक AI के साथ बातचीत को केवल लिखित या आवाज आधारित अनुभव तक सीमित नहीं रखती, बल्कि इसे एक ऐसे डिजिटल व्यक्ति के रूप में प्रस्तुत करने की कोशिश करती है, जो सामने रहकर बातचीत करता हुआ दिखाई देता है।
फिलहाल लाइव अवतार सुविधा केवल Gemini Enterprise ग्राहकों के लिए उपलब्ध कराई गई है। Google की योजना आगे इस तकनीक को अलग-अलग उपयोग के मामलों के लिए विकसित करने की है।
97 भाषाओं में बातचीत कर सकेगा लाइव अवतार Live Avatar Can Converse in 97 Languages
नए फीचर की सबसे खास बात इसकी बहुभाषी क्षमता है। Google के अनुसार, Live Avatar 97 अलग-अलग भाषाओं में बातचीत कर सकता है।
AI जब एक भाषा से दूसरी भाषा में जाता है, तब भी वीडियो की गुणवत्ता बनाए रखने और चेहरे की गतिविधियों में असामान्य बदलाव यानी Visual Drift को रोकने की कोशिश की गई है।
अंग्रेजी और जापानी में दिखाया गया प्रदर्शन Demo Showed Conversations in English and Japanese
Google ने अपने प्रदर्शन वीडियो में दिखाया कि एनिमेटेड अवतार अंग्रेजी और जापानी के बीच सहज रूप से बातचीत कर सकता है। बातचीत के दौरान अवतार के मुंह की गतिविधियां बोले जा रहे शब्दों के साथ मेल खाती हुई दिखाई गईं।
इस तरह की तकनीक का उद्देश्य AI के जवाब को केवल सुनने के बजाय उसे देखने योग्य बनाना है। इससे उपयोगकर्ता को बातचीत अधिक स्वाभाविक महसूस हो सकती है।
Live Avatar केवल बोलने तक सीमित नहीं है। यह बातचीत के दौरान स्क्रीन पर जानकारी भी दिखा सकता है। इसका मतलब है कि AI उपयोगकर्ता से बात करते हुए संबंधित जानकारी को दृश्य रूप में भी प्रस्तुत कर सकता है।
Gemini 3.8 Live मॉडल की नई क्षमता A New Capability of the Gemini 3.8 Live Model
Live Avatar फीचर Google द्वारा Gemini 3.8 Live मॉडल पेश किए जाने के लगभग एक सप्ताह बाद आया है। यह मॉडल दृश्य जानकारी को लगभग वास्तविक समय में समझने और उस पर प्रतिक्रिया देने के लिए तैयार किया गया है।
Gemini 3.8 Live की क्षमताओं को Live Avatar के साथ जोड़ने से Google AI बातचीत को अधिक संवादात्मक बनाने की दिशा में आगे बढ़ रहा है।
AI से बातचीत में वीडियो का इस्तेमाल Using Video in AI Conversations
पारंपरिक AI चैट में उपयोगकर्ता आमतौर पर लिखकर सवाल पूछते हैं और जवाब भी लिखित रूप में प्राप्त करते हैं। कुछ AI सेवाओं में आवाज से बातचीत की सुविधा भी उपलब्ध है।
Live Avatar इससे एक कदम आगे जाकर बातचीत में दृश्य प्रतिक्रिया जोड़ता है। उपयोगकर्ता AI को बोलते हुए देख सकता है और उसके जवाब के साथ स्क्रीन पर अतिरिक्त जानकारी भी देख सकता है।
हालांकि, यह अभी शुरुआती चरण की तकनीक है और इसका वास्तविक उपयोग इस बात पर निर्भर करेगा कि कंपनियां और उपयोगकर्ता इसे किन कामों के लिए अपनाते हैं।
ग्राहक चुन सकेंगे तैयार अवतार Customers Will Be Able to Choose Preset Avatars
Google के अनुसार, Gemini Enterprise ग्राहकों के लिए Live Avatar के साथ पहले से तैयार कई अवतार उपलब्ध कराए जाएंगे। संगठन अपनी जरूरत के अनुसार इनमें से किसी अवतार का चुनाव कर सकेंगे।
यह सुविधा खास तौर पर उन कंपनियों के लिए उपयोगी हो सकती है जो कर्मचारियों, ग्राहकों या अन्य उपयोगकर्ताओं के साथ AI आधारित बातचीत को अधिक व्यक्तिगत और संवादात्मक बनाना चाहती हैं।
कंपनियां अपना Custom Avatar भी बना सकेंगी Organizations Will Also Be Able to Create Custom Avatars
Google केवल तैयार अवतारों तक सीमित नहीं रहना चाहता। कंपनी संगठनों को Custom Avatar यानी अपनी जरूरत के अनुसार तैयार किया गया अवतार बनाने की सुविधा भी देने की योजना बना रही है।
इसका इस्तेमाल किसी कंपनी की डिजिटल पहचान, ग्राहक सहायता, प्रशिक्षण या अन्य संवादात्मक सेवाओं में किया जा सकता है। हालांकि, इन संभावित उपयोगों की वास्तविक उपलब्धता और दायरा Google की Enterprise पेशकश पर निर्भर करेगा।
लाइव अवतार में सुरक्षा का भी ध्यान Safety Measures Are Integrated Into Live Avatar
AI द्वारा बनाए गए डिजिटल अवतारों के बढ़ते इस्तेमाल के साथ सुरक्षा और पहचान से जुड़े सवाल भी महत्वपूर्ण हो जाते हैं। खासकर तब, जब AI किसी इंसान जैसे दिखाई देने वाले डिजिटल पात्र के माध्यम से बातचीत करता है।
Google ने Live Avatar में इस पहलू को ध्यान में रखते हुए सुरक्षा उपाय शामिल किए हैं।
SynthID से होगी AI सामग्री की पहचान AI Content Will Carry SynthID
Google के अनुसार, Live Avatar से तैयार होने वाले आउटपुट में अदृश्य SynthID watermark शामिल होगा। यह एक ऐसा डिजिटल संकेत है, जो सामान्य रूप से दिखाई नहीं देता, लेकिन AI से तैयार सामग्री की पहचान करने में मदद कर सकता है।
इसका उद्देश्य AI से बनाए गए अवतार और वास्तविक व्यक्ति की पहचान के बीच भ्रम को कम करना तथा डिजिटल सामग्री की उत्पत्ति के बारे में अधिक जानकारी उपलब्ध कराना है।
Google का कहना है कि यह व्यवस्था व्यक्तियों की पहचान का सम्मान करने और AI द्वारा तैयार सामग्री की जिम्मेदार प्रस्तुति में मदद कर सकती है।
AI बातचीत का अनुभव बदलने की कोशिश An Attempt to Change the AI Conversation Experience
Live Avatar Google की उस दिशा का हिस्सा है जिसमें AI को अधिक स्वाभाविक और संवादात्मक बनाने पर जोर दिया जा रहा है। यदि AI केवल टेक्स्ट के माध्यम से जवाब देने के बजाय आवाज, चेहरे की गतिविधियों और स्क्रीन पर दिखाई जाने वाली जानकारी के साथ प्रतिक्रिया देता है, तो उपयोगकर्ता के साथ बातचीत का तरीका बदल सकता है।
97 भाषाओं में बातचीत करने की क्षमता इसे बहुभाषी उपयोगकर्ताओं के लिए भी उपयोगी बना सकती है। खासकर वैश्विक कंपनियों के लिए एक ही AI प्रणाली के माध्यम से अलग-अलग भाषाओं में ग्राहकों और कर्मचारियों से बातचीत करना संभव हो सकता है।
हालांकि, यह सुविधा अभी Gemini Enterprise तक सीमित है। इसलिए आम उपयोगकर्ताओं के लिए इसकी उपलब्धता और भविष्य की कीमत या पहुंच को लेकर अभी अंतिम जानकारी का इंतजार करना होगा।
Google Gemini के लिए नया चरण A New Phase for Google Gemini
Google का Live Avatar फीचर AI को अधिक दृश्य और मानवीय बातचीत के करीब लाने की कोशिश करता है। Gemini 3.8 Live की लगभग वास्तविक समय में दृश्य जानकारी समझने की क्षमता के साथ इसे जोड़ना AI के उपयोग के नए तरीके सामने ला सकता है।
फिलहाल यह देखना बाकी है कि उपयोगकर्ता और कंपनियां इस तकनीक को कितनी तेजी से अपनाते हैं। इसके साथ ही AI अवतारों की विश्वसनीयता, सुरक्षा, पहचान और जिम्मेदार इस्तेमाल जैसे मुद्दे भी महत्वपूर्ण बने रहेंगे।
Google के लिए Live Avatar केवल एक नया दृश्य फीचर नहीं है, बल्कि AI के साथ बातचीत को अधिक स्वाभाविक, बहुभाषी और इंटरैक्टिव बनाने की दिशा में एक और कदम है। आने वाले समय में यदि ऐसी तकनीकें अधिक व्यापक रूप से उपलब्ध होती हैं, तो AI सहायक केवल स्क्रीन पर जवाब देने वाले साधन के बजाय बातचीत करने वाले डिजिटल पात्रों के रूप में भी दिखाई दे सकते हैं।


