گوگل مدل‌های جدید Gemini را برای تقویت دستیارهای صوتی معرفی کرد

گوگل با معرفی دو مدل جدید Gemini، هوش مصنوعی صوتی را یک گام به انجام کارهای پیچیده‌تر نزدیک کرده است؛ مدل‌هایی که قرار است به شرکت‌ها امکان ساخت دستیارهایی را بدهند که نه‌تنها با کاربران گفت‌وگو می‌کنند، بلکه هم‌زمان منظور آن‌ها را تحلیل کرده و در انجام کارها نیز مشارکت دارند.

به گزارش خبرگزاری ایمنا، گوگل دو مدل جدید هوش مصنوعی با نام‌های Gemini 3.8 Live و Gemini 3.8 Live Extended Thinking معرفی کرده است که هدف اصلی آن‌ها، تقویت دستیارهای صوتی و ایجاد امکان گفت‌وگوی طبیعی‌تر و سریع‌تر میان انسان و هوش مصنوعی است.

مدل Gemini 3.8 Live بیشتر برای استفاده گسترده و کم‌هزینه طراحی شده است، در حالی که نسخه Extended Thinking برای کارهای پیچیده‌تر ساخته شده و قرار است در سطح قیمتی رقابتی با مدل‌های پیشرفته هوش مصنوعی عرضه شود.

هر دو مدل قابلیت استدلال تقریبا هم‌زمان با مکالمه را بهبود می‌دهند؛ یعنی هوش مصنوعی هنگام شنیدن صحبت کاربر، سریع‌تر منظور او را تحلیل می‌کند و پاسخ مناسب‌تری می‌دهد.

این فناوری فقط به چت صوتی محدود نیست. گوگل می‌خواهد شرکت‌ها بتوانند با استفاده از این مدل‌ها، دستیارهای صوتی آماده استفاده در محیط‌های واقعی بسازند؛ برای مثال سامانه‌هایی که با مشتری صحبت می‌کنند، اطلاعات پیدا می‌کنند یا بخشی از کارهای اداری را به جای کاربر انجام می‌دهند.

اهمیت این تغییر در آن است که هوش مصنوعی صوتی در حال عبور از مرحله «پاسخ دادن به سؤال» و حرکت به سمت انجام دادن کارها است. گوگل نیز پیش‌تر قابلیت‌های صوتی جدیدی را برای Gmail، Google Docs و Google Keep معرفی کرده بود تا کاربران بتوانند با صحبت کردن، اطلاعات ایمیل‌ها را پیدا کنند، اسناد بسازند یا یادداشت‌های خود را مرتب کنند.

در واقع، گوگل می‌خواهد صدا را به یکی از راه‌های اصلی ارتباط انسان با هوش مصنوعی تبدیل کند؛ مسیری که می‌تواند تعامل با دستیارهای هوشمند و حتی انجام خرید و خدمات آنلاین را از تایپ کردن به مکالمه تغییر دهد.

کد مطلب 1004783

برچسب‌ها

نظر شما

شما در حال پاسخ به نظر «» هستید.