هوش مصنوعی جمینای صاحب چهره شد؛ رونمایی گوگل از قابلیت Live Avatar
گوگل با معرفی قابلیتی تازه به نام Live Avatar برای مدل Gemini 3.8 Live، گام جدیدی در تعاملیتر کردن چتباتهای خود برداشته است. این فناوری جدید به هوش مصنوعی جمینای یک چهرهی بصری متحرک میبخشد تا کاربران بهجای خواندن متن یا شنیدن صرف صدا، با شخصیتی دیجیتالی و پویا به گفتوگو بنشینند. با این بهروزرسانی، مدل نهتنها قادر به شنیدن و سخن گفتن است، بلکه حالات چهرهی خود را نیز با روند مکالمه هماهنگ میکند.
قابلیت Live Avatar از ترکیب همزمان تولید ویدیو و پردازش گفتار بهره میبرد و هماهنگی دقیقی میان حرکات لب و کلمات اداشده برقرار میسازد. به گفتهی گوگل، این آواتار متحرک توانایی پشتیبانی از 97 زبان گوناگون را دارد و میتواند بدون افت کیفیت تصویر یا ایجاد هرگونه انحراف بصری، میان این زبانها جابهجا شود. در ویدیوهای منتشرشده، آواتار به دو زبان انگلیسی و ژاپنی صحبت میکند و انیمیشن دهان آن با هر دو زبان کاملاً تطابق دارد. علاوه بر این، سیستم میتواند حین مکالمه اطلاعات و محتوای مرتبط را روی صفحه به نمایش بگذارد.
عرضهی این ویژگی حدود یک هفته پس از رونمایی از مدل Gemini 3.8 Live صورت میگیرد؛ مدلی که ورودیهای بصری را تقریباً بهصورت آنی پردازش میکند. استفاده از هوش مصنوعی جمینای در قالب آواتار به کسبوکارها امکان میدهد خدمات مجازی، پشتیبانی مشتریان و راهنماهای تعاملی را به شکلی طبیعیتر ارائه دهند. گوگل مجموعهای از چهرههای از پیشآماده را ارائه میدهد، اما سازمانها مختارند آواتارهای اختصاصی و سازگار با هویت برند خود را بسازند.
برای جلوگیری از سوءاستفادههای بصری و حفظ اصالت محتوا، تمامی خروجیهای این فناوری به واترمارک نامرئی SynthID مجهز شدهاند و تدابیری نیز بهمنظور احترام به هویت افراد در نظر گرفته شده است. همچنین ویژگی نوبتگیری روان در مکالمه باعث میشود ارتباط با این شخصیتهای رایانهای پیوستهتر پیش برود.
در حال حاضر، قابلیت آواتار زنده تنها در دسترس مشتریان سازمانی Gemini Enterprise قرار گرفته است و گوگل برنامهای برای عرضهی عمومی آن اعلام نکرده است. گسترش امکانات بصری در هوش مصنوعی جمینای نشاندهندهی تمرکز این شرکت بر ارتقای ابزارهای تجاری و ارتباط چندوجهی در محیطهای کاری است.
