به گزارش خبرگزاری ایمنا، گوگل دو مدل جدید هوش مصنوعی با نامهای Gemini 3.8 Live و Gemini 3.8 Live Extended Thinking معرفی کرده است که هدف اصلی آنها، تقویت دستیارهای صوتی و ایجاد امکان گفتوگوی طبیعیتر و سریعتر میان انسان و هوش مصنوعی است.
مدل Gemini 3.8 Live بیشتر برای استفاده گسترده و کمهزینه طراحی شده است، در حالی که نسخه Extended Thinking برای کارهای پیچیدهتر ساخته شده و قرار است در سطح قیمتی رقابتی با مدلهای پیشرفته هوش مصنوعی عرضه شود.
هر دو مدل قابلیت استدلال تقریبا همزمان با مکالمه را بهبود میدهند؛ یعنی هوش مصنوعی هنگام شنیدن صحبت کاربر، سریعتر منظور او را تحلیل میکند و پاسخ مناسبتری میدهد.
این فناوری فقط به چت صوتی محدود نیست. گوگل میخواهد شرکتها بتوانند با استفاده از این مدلها، دستیارهای صوتی آماده استفاده در محیطهای واقعی بسازند؛ برای مثال سامانههایی که با مشتری صحبت میکنند، اطلاعات پیدا میکنند یا بخشی از کارهای اداری را به جای کاربر انجام میدهند.
اهمیت این تغییر در آن است که هوش مصنوعی صوتی در حال عبور از مرحله «پاسخ دادن به سؤال» و حرکت به سمت انجام دادن کارها است. گوگل نیز پیشتر قابلیتهای صوتی جدیدی را برای Gmail، Google Docs و Google Keep معرفی کرده بود تا کاربران بتوانند با صحبت کردن، اطلاعات ایمیلها را پیدا کنند، اسناد بسازند یا یادداشتهای خود را مرتب کنند.
در واقع، گوگل میخواهد صدا را به یکی از راههای اصلی ارتباط انسان با هوش مصنوعی تبدیل کند؛ مسیری که میتواند تعامل با دستیارهای هوشمند و حتی انجام خرید و خدمات آنلاین را از تایپ کردن به مکالمه تغییر دهد.
نظر شما