Google قابلیت Live Avatar را برای گفتوگوی چهرهبهچهره واقعگرایانه با Gemini معرفی کرد
Google قابلیت جدیدی به نام Live Avatar را به مدل Gemini 3.8 Live اضافه کرده است که امکان تعامل چندوجهی ایجنتهای سازمانی را با آواتارهای متحرک و واقعگرایانه فراهم میسازد؛ اقدامی که بار دیگر بحثهای جدی پیرامون خطرات انسانانگاری هوش مصنوعی را داغ کرده است.

در یک نگاه (نکات کلیدی خبر)
خلاصه مهمترین نکات و تحولات این گزارش برای مطالعه سریع
- قابلیت Live Avatar امکان همگامسازی حرکات چهره و لب آواتارهای کارتونی یا واقعگرایانه را با صدای تولیدی Gemini فراهم میکند.
- این سیستم با پشتیبانی از ۹۷ زبان و توانایی فراخوانی ابزارها، برای ایجنتهای سازمانی و خدمات مشتریان ارائه شده است.
- عرضه این فناوری در شرایطی انجام میشود که کارشناسان نسبت به خطرات انسانانگاری هوش مصنوعی و ایجاد اعتماد کاذب هشدار میدهند.
شرکت Google مدل گفتوگوی زنده خود یعنی Gemini 3.8 Live را به قابلیت جدیدی تحت عنوان «Live Avatar» مجهز کرده است؛ قابلیتی که به سیستم امکان میدهد برای همگامسازی حرکات لب با گفتار تولیدشده توسط ماشین، از کاراکترهای انیمیشنی یا شبیهسازهای انسانی واقعگرایانه استفاده کند.
شواویین چانگ (Shuo-yiin Chang)، دانشمند پژوهشگر در Google DeepMind و سیجی ژنگ (CJ Zheng)، مهندس نرمافزار Gemini، در یادداشتی توضیح دادند: «گفتوگو ماهیتاً چندوجهی است؛ ما برای برقراری ارتباط گوش میدهیم، نگاه میکنیم، حرف میزنیم و از حالتهای چهره بهره میبریم. قابلیت Live Avatar این امکانات را در اختیار ایجنتهای سازمانی قرار میدهد. این سیستم با پردازش همزمان ورودیهای صوتی و تصویری، مکالمات غنیتری را برای ارائه تجربهای جامعتر شکل میدهد.»
این تحول در حالی رخ میدهد که پنج سال پیش، DeepMind نسبت به خطرات گوناگون ناشی از بهکارگیری مدلهای زبانی بزرگ هشدار داده بود؛ از جمله آسیبهای تعامل انسانی مانند «انسانانگاری مدلهای هوش مصنوعی» (تخصیص ویژگیهای انسانی به تعاملات مبتنی بر نرمافزار). مفهوم انسانانگاری در اینجا هم شامل تقلید بصری از چهره انسان و هم لحن گفتاری و متنی شبیه به انسان میشود.
بیش از ۲۰ نویسنده در مقاله پژوهشی DeepMind با عنوان «خطرات اخلاقی و اجتماعی ناشی از مدلهای زبانی» تاکید کرده بودند: «انسانانگاری [مدلهای زبانی] ممکن است برآورد کاربران را از توانمندیهای یک ایجنت گفتوگومحور بیش از واقعیت نشان دهد.»
در ادامه این مقاله پژوهشی آمده بود: «بهعنوان مثال، ممکن است کاربران بهاشتباه نتیجه بگیرند ایجنت محاورهای که زبانی شبیه به انسان دارد، از سایر ویژگیهای انسانی نظیر هویت یکپارچه در طول زمان، همدلی، توانایی درک دیدگاه طرف مقابل یا استدلال عقلانی نیز برخوردار است. در نتیجه این قضاوت نادرست، افراد ممکن است اعتماد، اتکا یا انتظارات بیموردی از این ایجنتها پیدا کنند.»
این هشدارها در سال ۲۰۲۱ ثبت شدند. در اوت ۲۰۲۵، خطرات انسانیسازی هوش مصنوعی سرانجام به دادگاهها نیز کشیده شد؛ جایی که والدین نوجوانی به نام آدام رین (Adam Raine) با طرح شکایتی علیه OpenAI ادعا کردند رفتارهای ChatGPT در خودکشی فرزندشان نقش داشته است. در متن دادخواست، بهطور ویژه به «رفتارها و اطوارهای شبهانسانی مدل برای القای همدلی» اشاره شده است.
تا پایان سال ۲۰۲۵، پژوهشگران Google نیز همچنان درگیر تحلیل و شناخت پیامدهای انسانیسازی هوش مصنوعی بودند.
در مقالهای با عنوان «نحوه مواجهه متخصصان فناوری با خطرات ویژگیهای شبهانسانی در هوش مصنوعی مولد»، تیمی از پژوهشگران Google Research گزارش دادند متخصصان فناوری در گروههای آزمایشی، نگرانیهای کاملاً مشابهی با نتایج پژوهشهای قبلی شرکت مطرح کردهاند.
پژوهشگران اشاره کردند: «متخصصان حوزه فناوری ابراز نگرانی جدی کردند که شباهت بیشازحد به انسان، حس کاذبی از اعتماد و اطمینانپذیری ایجاد میکند؛ نگرانیهایی که هم بهعنوان کاربر و هم در جایگاه توسعهدهنده با آن مواجهاند، چرا که لحن روان و طبیعی مدل میتواند خطاهای محاسباتی یا ساختاری آن را پنهان کند.»
با وجود آنکه محققان هوش مصنوعی Google پیوسته بر لزوم درک خطرات ناشی از «ویژگیهای شبهانسانی» و اهمیت توسعه مسئولانه هوش مصنوعی تأکید میکنند، بخش سازمانی Google Gemini مسیر تجاریسازی و استقرار این ابزار را در پیش گرفته است.
در این سیستم، کاربران سازمانی میتوانند آواتارها را از یک کتابخانه آماده از کاراکترها انتخاب کنند یا در صورت فعالسازی فهرست مجاز (Allow-listing)، آواتار سفارشی خود را مستقر سازند.
توسعهدهندگان با اشاره به اینکه Live Avatar توانایی فراخوانی ابزارها (Tool Calls) و دریافت دادهها در پسزمینه را دارد و از مکالمه به ۹۷ زبان مختلف پشتیبانی میکند—که آن را برای سناریوهایی نظیر پذیرش مهمانان در هتلها بسیار کاربردی میسازد—تأکید کردند که این پرسوناها با در نظر گرفتن ایمنی و اعتماد طراحی شدهاند.
آنها در این زمینه افزودند: «ما Live Avatar را با تدابیر امنیتی سختگیرانهای طراحی کردهایم تا به هویت افراد احترام بگذارد و ماهیت تولیدشده محتوا توسط هوش مصنوعی کاملاً شفاف باقی بماند.»
برچسب های مرتبط
مطالب مرتبط و پیشنهادی

رکورد ۸۳۳ هزار دانلود ماهانه برای LEGAL-BERT؛ وقتی توسعهدهندهها قید مدلهای گرانقیمت را میزنند!
مدل زبانی تخصصی LEGAL-BERT با ثبت بیش از ۸۳۳ هزار دانلود در ماه روی پلتفرم هاگینگ فیس حسابی خبرساز شده است. این ابزار جمعوجور و تخصصی نشان میدهد که برای پردازش و تحلیل متون حقوقی، حتماً نیازی به مدلهای غولپیکر و پرهزینه ندارید و گزینههای بهینه همچنان در اوج هستند.

جاسوسی هوش مصنوعی در محل کار؛ کارمندان میگویند کارفرماها باید قانوناً مچگیریهایشان را لو بدهند!
نظرسنجیهای تازه نشان میدهد که بیشتر کارمندان حس میکنند مدیرانشان با ابزارهای هوش مصنوعی تمام حرکات آنها را زیر نظر گرفتهاند. حالا بیش از ۸۰ درصد شاغلان خواستار تصویب قانونی شدهاند که شرکتها را مجبور کند هرگونه مچگیری و نظارت هوش مصنوعی در محیط کار را رسماً اعلام کنند.

گزارش داغ مایکروسافت از نفوذ جهانی هوش مصنوعی؛ امارات در صدر و رتبه عجیب آمریکا!
مایکروسافت در تازهترین گزارش خود از ضریب نفوذ هوش مصنوعی در جهان پرده برداشت؛ آماری شگفتانگیز که نشان میدهد امارات و سنگاپور با فاصلهای خیرهکننده پیشتاز دنیا هستند و در مقابل، آمریکا در رتبه ۲۱ جا مانده است. همچنین الگوی استفاده از هوش مصنوعی میان کشورهای غربی و کشورهای در حال توسعه، از تفاوتی عمیق میان کاربردهای روزمره و آموزش پرده برمیدارد.
دیدگاه ها و گفتگوی تخصصی
نظرات خود را با جامعه مخاطبان وایر ای آی در میان بگذارید
هنوز دیدگاهی برای این مطلب ثبت نشده است
اولین نفری باشید که دیدگاه، تحلیل یا دیدگاه خود را درباره این موضوع با دیگران به اشتراک می گذارد.