پرش به محتوای اصلی
آخرین اخبار
۲ وایر پاداش مطالعه

Google قابلیت Live Avatar را برای گفت‌وگوی چهره‌به‌چهره واقع‌گرایانه با Gemini معرفی کرد

انتشار:۳ مهر ۱۴۰۵(۳ روز پیش)
۳ دقیقه زمان مطالعه
۰ دیدگاه

Google قابلیت جدیدی به نام Live Avatar را به مدل Gemini 3.8 Live اضافه کرده است که امکان تعامل چندوجهی ایجنت‌های سازمانی را با آواتارهای متحرک و واقع‌گرایانه فراهم می‌سازد؛ اقدامی که بار دیگر بحث‌های جدی پیرامون خطرات انسان‌انگاری هوش مصنوعی را داغ کرده است.

Google قابلیت Live Avatar را برای گفت‌وگوی چهره‌به‌چهره واقع‌گرایانه با Gemini معرفی کرد

در یک نگاه (نکات کلیدی خبر)

خلاصه مهم‌ترین نکات و تحولات این گزارش برای مطالعه سریع

  • قابلیت Live Avatar امکان همگام‌سازی حرکات چهره و لب آواتارهای کارتونی یا واقع‌گرایانه را با صدای تولیدی Gemini فراهم می‌کند.
  • این سیستم با پشتیبانی از ۹۷ زبان و توانایی فراخوانی ابزارها، برای ایجنت‌های سازمانی و خدمات مشتریان ارائه شده است.
  • عرضه این فناوری در شرایطی انجام می‌شود که کارشناسان نسبت به خطرات انسان‌انگاری هوش مصنوعی و ایجاد اعتماد کاذب هشدار می‌دهند.

شرکت Google مدل گفت‌وگوی زنده خود یعنی Gemini 3.8 Live را به قابلیت جدیدی تحت عنوان «Live Avatar» مجهز کرده است؛ قابلیتی که به سیستم امکان می‌دهد برای همگام‌سازی حرکات لب با گفتار تولیدشده توسط ماشین، از کاراکترهای انیمیشنی یا شبیه‌سازهای انسانی واقع‌گرایانه استفاده کند.

شواویین چانگ (Shuo-yiin Chang)، دانشمند پژوهشگر در Google DeepMind و سی‌جی ژنگ (CJ Zheng)، مهندس نرم‌افزار Gemini، در یادداشتی توضیح دادند: «گفت‌وگو ماهیتاً چندوجهی است؛ ما برای برقراری ارتباط گوش می‌دهیم، نگاه می‌کنیم، حرف می‌زنیم و از حالت‌های چهره بهره می‌بریم. قابلیت Live Avatar این امکانات را در اختیار ایجنت‌های سازمانی قرار می‌دهد. این سیستم با پردازش هم‌زمان ورودی‌های صوتی و تصویری، مکالمات غنی‌تری را برای ارائه تجربه‌ای جامع‌تر شکل می‌دهد.»

این تحول در حالی رخ می‌دهد که پنج سال پیش، DeepMind نسبت به خطرات گوناگون ناشی از به‌کارگیری مدل‌های زبانی بزرگ هشدار داده بود؛ از جمله آسیب‌های تعامل انسانی مانند «انسان‌انگاری مدل‌های هوش مصنوعی» (تخصیص ویژگی‌های انسانی به تعاملات مبتنی بر نرم‌افزار). مفهوم انسان‌انگاری در اینجا هم شامل تقلید بصری از چهره انسان و هم لحن گفتاری و متنی شبیه به انسان می‌شود.

بیش از ۲۰ نویسنده در مقاله پژوهشی DeepMind با عنوان «خطرات اخلاقی و اجتماعی ناشی از مدل‌های زبانی» تاکید کرده بودند: «انسان‌انگاری [مدل‌های زبانی] ممکن است برآورد کاربران را از توانمندی‌های یک ایجنت گفت‌وگومحور بیش از واقعیت نشان دهد.»

در ادامه این مقاله پژوهشی آمده بود: «به‌عنوان مثال، ممکن است کاربران به‌اشتباه نتیجه بگیرند ایجنت محاوره‌ای که زبانی شبیه به انسان دارد، از سایر ویژگی‌های انسانی نظیر هویت یکپارچه در طول زمان، همدلی، توانایی درک دیدگاه طرف مقابل یا استدلال عقلانی نیز برخوردار است. در نتیجه این قضاوت نادرست، افراد ممکن است اعتماد، اتکا یا انتظارات بی‌موردی از این ایجنت‌ها پیدا کنند.»

این هشدارها در سال ۲۰۲۱ ثبت شدند. در اوت ۲۰۲۵، خطرات انسانی‌سازی هوش مصنوعی سرانجام به دادگاه‌ها نیز کشیده شد؛ جایی که والدین نوجوانی به نام آدام رین (Adam Raine) با طرح شکایتی علیه OpenAI ادعا کردند رفتارهای ChatGPT در خودکشی فرزندشان نقش داشته است. در متن دادخواست، به‌طور ویژه به «رفتارها و اطوارهای شبه‌انسانی مدل برای القای همدلی» اشاره شده است.

تا پایان سال ۲۰۲۵، پژوهشگران Google نیز همچنان درگیر تحلیل و شناخت پیامدهای انسانی‌سازی هوش مصنوعی بودند.

در مقاله‌ای با عنوان «نحوه مواجهه متخصصان فناوری با خطرات ویژگی‌های شبه‌انسانی در هوش مصنوعی مولد»، تیمی از پژوهشگران Google Research گزارش دادند متخصصان فناوری در گروه‌های آزمایشی، نگرانی‌های کاملاً مشابهی با نتایج پژوهش‌های قبلی شرکت مطرح کرده‌اند.

پژوهشگران اشاره کردند: «متخصصان حوزه فناوری ابراز نگرانی جدی کردند که شباهت بیش‌ازحد به انسان، حس کاذبی از اعتماد و اطمینان‌پذیری ایجاد می‌کند؛ نگرانی‌هایی که هم به‌عنوان کاربر و هم در جایگاه توسعه‌دهنده با آن مواجه‌اند، چرا که لحن روان و طبیعی مدل می‌تواند خطاهای محاسباتی یا ساختاری آن را پنهان کند.»

با وجود آنکه محققان هوش مصنوعی Google پیوسته بر لزوم درک خطرات ناشی از «ویژگی‌های شبه‌انسانی» و اهمیت توسعه مسئولانه هوش مصنوعی تأکید می‌کنند، بخش سازمانی Google Gemini مسیر تجاری‌سازی و استقرار این ابزار را در پیش گرفته است.

در این سیستم، کاربران سازمانی می‌توانند آواتارها را از یک کتابخانه آماده از کاراکترها انتخاب کنند یا در صورت فعال‌سازی فهرست مجاز (Allow-listing)، آواتار سفارشی خود را مستقر سازند.

توسعه‌دهندگان با اشاره به اینکه Live Avatar توانایی فراخوانی ابزارها (Tool Calls) و دریافت داده‌ها در پس‌زمینه را دارد و از مکالمه به ۹۷ زبان مختلف پشتیبانی می‌کند—که آن را برای سناریوهایی نظیر پذیرش مهمانان در هتل‌ها بسیار کاربردی می‌سازد—تأکید کردند که این پرسوناها با در نظر گرفتن ایمنی و اعتماد طراحی شده‌اند.

آن‌ها در این زمینه افزودند: «ما Live Avatar را با تدابیر امنیتی سخت‌گیرانه‌ای طراحی کرده‌ایم تا به هویت افراد احترام بگذارد و ماهیت تولیدشده محتوا توسط هوش مصنوعی کاملاً شفاف باقی بماند.»

دیدگاه ها و گفتگوی تخصصی

نظرات خود را با جامعه مخاطبان وایر ای آی در میان بگذارید

۰ دیدگاه

هنوز دیدگاهی برای این مطلب ثبت نشده است

اولین نفری باشید که دیدگاه، تحلیل یا دیدگاه خود را درباره این موضوع با دیگران به اشتراک می گذارد.

مطالب مرتبط و پیشنهادی

رکورد ۸۳۳ هزار دانلود ماهانه برای LEGAL-BERT؛ وقتی توسعه‌دهنده‌ها قید مدل‌های گران‌قیمت را می‌زنند!
آخرین اخبار

رکورد ۸۳۳ هزار دانلود ماهانه برای LEGAL-BERT؛ وقتی توسعه‌دهنده‌ها قید مدل‌های گران‌قیمت را می‌زنند!

مدل زبانی تخصصی LEGAL-BERT با ثبت بیش از ۸۳۳ هزار دانلود در ماه روی پلتفرم هاگینگ فیس حسابی خبرساز شده است. این ابزار جمع‌وجور و تخصصی نشان می‌دهد که برای پردازش و تحلیل متون حقوقی، حتماً نیازی به مدل‌های غول‌پیکر و پرهزینه ندارید و گزینه‌های بهینه همچنان در اوج هستند.

۲ دقیقه مطالعه
۰
۶ مهر
جاسوسی هوش مصنوعی در محل کار؛ کارمندان می‌گویند کارفرماها باید قانوناً مچ‌گیری‌هایشان را لو بدهند!
آخرین اخبار

جاسوسی هوش مصنوعی در محل کار؛ کارمندان می‌گویند کارفرماها باید قانوناً مچ‌گیری‌هایشان را لو بدهند!

نظرسنجی‌های تازه نشان می‌دهد که بیشتر کارمندان حس می‌کنند مدیرانشان با ابزارهای هوش مصنوعی تمام حرکات آن‌ها را زیر نظر گرفته‌اند. حالا بیش از ۸۰ درصد شاغلان خواستار تصویب قانونی شده‌اند که شرکت‌ها را مجبور کند هرگونه مچ‌گیری و نظارت هوش مصنوعی در محیط کار را رسماً اعلام کنند.

۳ دقیقه مطالعه
۰
۶ مهر
گزارش داغ مایکروسافت از نفوذ جهانی هوش مصنوعی؛ امارات در صدر و رتبه عجیب آمریکا!
آخرین اخبار

گزارش داغ مایکروسافت از نفوذ جهانی هوش مصنوعی؛ امارات در صدر و رتبه عجیب آمریکا!

مایکروسافت در تازه‌ترین گزارش خود از ضریب نفوذ هوش مصنوعی در جهان پرده برداشت؛ آماری شگفت‌انگیز که نشان می‌دهد امارات و سنگاپور با فاصله‌ای خیره‌کننده پیشتاز دنیا هستند و در مقابل، آمریکا در رتبه ۲۱ جا مانده است. همچنین الگوی استفاده از هوش مصنوعی میان کشورهای غربی و کشورهای در حال توسعه، از تفاوتی عمیق میان کاربردهای روزمره و آموزش پرده برمی‌دارد.

۳ دقیقه مطالعه
۰
۶ مهر