گوگل با هدف پوشش عملکرد صفحات وب در جستجوهای چندوجهیِ مبتنی بر تصویر، قابلیت گزارش (Web Multimodal Search) را به کنسول جستجو آورد. این ویژگی هماکنون بهصورت جهانی و در دو بخش Performance و Generative AI Features در دسترس کاربران قرار گرفته است.
بر اساس بیانیه رسمی گوگل، استفاده از تجربههای بصری و چندوجهی در این موتور جستجو افزایش یافته است. از این رو نیاز است تا مدیران سایتها بتوانند بینش دقیقتری نسبت به نحوه حضور خود در این حالت داشته باشند. این بهروزرسانی با هدف فراهمکردن بستری برای نمایش بینشهای تحلیلی دقیق درباره نحوه نمایش محتوا در جستجوهای مبتنی بر تصویر طراحی شده است.
دامنه دادههای Web Multimodal Search
اطلاعات این گزارش حاصل جستجوهایی است که از طریق بسترهای زیر انجام میشوند:
ابزار Google Lens: جستجوی بصری مبتنی بر دوربین یا تصویر
ابزار Circle to Search در اندروید: انتخاب بصری با کشیدن دایره روی بخشی از صفحهنمایش
آپلود تصویر در Google Search: بارگذاری مستقیم فایل تصویری در موتور جستجو
قابلیت «Search this image» در کروم: جستجوی تصویر از طریق منوی راستکلیک
بنا به اعلام گوگل، این دادهها صرفاً شامل جستجوهایی میشود که از طریق ورودیهای بصری فوق انجام شدهاند و سازوکارهای دیگر جستجو را پوشش نمیدهد.

نحوه دسترسی به گزارش Web Multimodal Search
کاربران میتوانند با استفاده از فیلتر جدیدی به نام «نوع جستجوی چندوجهی» (Multimodal Search Type Filter) که در قسمت Search type گزارشهای Performance و Generative AI Features قرار گرفته است، به دادههای این قابلیت دسترسی پیدا کنند. همچنین امکان استخراج دادهها (Export) فراهم شده است.
توصیههای گوگل به ناشران
گوگل ابراز امیدواری کرده است که دادههای این ابزار جدید به ناشران کمک کند تا درک بهتری از عملکرد سایت خود در فضای مدرن جستجو داشته باشند و بتوانند محتوای بصری خود را بهینهسازی کنند. این امر بهویژه برای سایتهایی که محتوای تصویری دارند، مانند فروشگاههای آنلاین، پلتفرمهای آموزش بصری و رسانههای تصویری، اهمیت ویژهای دارد.

جستجوی چندوجهی یا Multimodal Search به نوعی از جستجو گفته میشود که در آن کاربر صرفاً بهجای تایپ کردن کلمه، از ترکیب ورودیهای مختلف مانند تصویر، صدا، ویدئو یا حتی اشاره مستقیم روی صفحه استفاده میکند. در این روش، موتور جستجو باید بتواند هر کدام از این ورودیها را جداگانه تحلیل کند و سپس آنها را در قالب یک جستجو درک کند و معنای دقیق درخواست کاربر را استخراج نماید.
برای نمونه، وقتی کاربر دوربین موبایل خود را روی یک شیء میگیرد و از گوگل میپرسد «این چیست؟»، سیستم باید تصویر را تشخیص دهد، متن پرسش را بفهمد و پاسخ را از ترکیب این دو بسازد. جستجوی چندوجهی برخلاف جستجوی سنتی که بر پایه کلمه کلیدی بنا شده بود، به مدلهای هوش مصنوعی نیاز دارد تا همزمان با دادههای بصری، صوتی و متنی کار کنند.

قابلیتهای جستجوی چندوجهی در موتور جستجوی گوگل از سال 2021 در دسترس کاربران بوده و در رویدادهای مختلفی چون Search On 2021 نیز درباره آن اطلاعات زیادی به اشتراک گذاشته شده است. آقای Matt Madrigal، معاون بخش فروشگاههای آنلاین و مدیر ارشد تجارت آنلاین گوگل، هنگام معرفی این ویژگی در همین رویداد گفت: گوگل میخواهد نتایج جستجو، جریان بیپایان ایدههای الهامبخشِ بصری باشد.

بر اساس مستندات رسمی گوگل، از آنجا که جستجوهای چندوجهی عمداتا بر پایه تصویر انجام میشوند، داده کوئری متنی برای این ترافیک در دسترس نیست. به همین دلیل، بُعد Queries هنگام انتخاب این نوع جستجو غیرفعال شده است. کاربران میتوانند صفحات حاوی ترافیک تصویری را در این گزارش مشاهده کنند، اما عبارت جستجوی منجر به نتیجه را نمیبینند. جان مولر، تأیید کرده است که دادههای جستجوی چندوجهی پیش از این در شمارشها لحاظ نمیشد و این گزارش حاوی دادههای کاملاً جدید است.

