
جوجل تمنح Gemini وجوهًا افتراضية تتحدث بـ97 لغة
أضافت جوجل ميزة جديدة إلى مساعدها الذكي Gemini تمنح المستخدمين إمكانية إجراء محادثات مع شخصيات افتراضية متحركة بدلًا من الاكتفاء بالتفاعل عبر النص أو الصوت.
وتحمل الميزة اسم Live Avatar، وتأتي ضمن إصدار Gemini 3.8 Live، بهدف جعل المحادثات مع الذكاء الاصطناعي أقرب إلى التواصل البشري من خلال مزامنة الصوت مع حركة الشفاه وتعابير الوجه.
وجه يتفاعل معك أثناء المحادثة
تعتمد Live Avatar على توليد حركات وجه متزامنة مع الكلام الذي ينتجه المساعد، بحيث تتحرك الشفاه وتتغير تعابير الشخصية أثناء الحديث.
وتقول جوجل إن النظام يستطيع التعامل مع نحو 97 لغة، مع ضبط حركات الفم والتعبيرات بما يتناسب مع اللغة المستخدمة خلال المحادثة.
ويجعل ذلك التفاعل أكثر حيوية مقارنة بالمساعدات التي تعتمد على الصوت وحده، خصوصًا في المحادثات الطويلة التي تتطلب حضورًا بصريًا مستمرًا.
شخصيات جاهزة وتخصيص للشركات
توفر جوجل مجموعة من الشخصيات الافتراضية الجاهزة للمستخدمين، بينما تظل إمكانية إنشاء شخصيات مخصصة بالكامل موجهة لعملاء المؤسسات.
ويمكن للشركات المؤهلة إنشاء شخصية اعتمادًا على صورة مرجعية، مع الحفاظ على ملامحها وهويتها والأسلوب البصري المطلوب.
وقد تفتح هذه الإمكانية الباب أمام استخدام الصور الرمزية في مجالات متعددة، مثل خدمة العملاء، والمساعدات الافتراضية، والجولات التفاعلية، والتدريب والتواصل داخل المؤسسات.
المساعد يواصل العمل أثناء التفاعل
لا تتوقف الشخصية الافتراضية عن الظهور لمجرد أن Gemini ينفذ مهمة أخرى في الخلفية.
فيمكن للمساعد استخدام أدوات البحث أو استرجاع المعلومات أو الخدمات المتصلة، بينما تستمر المحادثة الصوتية والمرئية بصورة طبيعية.
وهذا يجعل الشخصية الافتراضية جزءًا من تجربة المساعد الكاملة، بدل أن تكون مجرد واجهة متحركة للكلام.
SynthID لتمييز المحتوى المولد بالذكاء الاصطناعي
مع ازدياد واقعية الشخصيات الافتراضية، يصبح من المهم توضيح أن المحتوى الذي يراه المستخدم ليس تسجيلًا لشخص حقيقي.
ولهذا أكدت جوجل أن المحتوى الصوتي والمرئي الناتج عن النظام سيحمل علامة SynthID، وهي تقنية تستخدمها الشركة للإشارة إلى المحتوى الذي تم إنشاؤه أو تعديله باستخدام الذكاء الاصطناعي.
وتتوفر الميزة حاليًا عبر Gemini Enterprise، بينما يظل إنشاء الشخصيات المخصصة خاضعًا لإمكانية وصول خاصة بالمؤسسات.
بهذه الخطوة، تتجه جوجل إلى تحويل المساعد الذكي من صوت أو نافذة نصية إلى شخصية رقمية قادرة على التحدث والتعبير والتفاعل بصريًا مع المستخدم، وهو اتجاه قد يصبح أكثر حضورًا في تطبيقات الذكاء الاصطناعي خلال الفترة المقبلة.
