بررسی دقیق ۷۱ کسب وکار نشان داد که شکاف های عمده ای در قابلیت بازیابی اطلاعات توسط هوش مصنوعی وجود دارد؛ از وب سایت های غیرقابل خواندن و دامنه های از کار افتاده گرفته تا فقدان سیگنال های اعتماد.
بین آنچه یک کسب وکار در دنیای واقعی هست و نحوه تأیید آن توسط سیستم های جستجوی هوش مصنوعی، فاصله ای وجود دارد. من این پدیده را «نشت هویت» (Identity Leak) می نامم.
کسب وکارها ممکن است در دنیای واقعی هیچ مشکلی نداشته باشند، اما ممکن است برای سیستم های هوش مصنوعی نامرئی باشند؛ سیستم هایی که تصمیم می گیرند چه سایت هایی به جستجوگران پیشنهاد و نمایش داده شوند. این موضوع می تواند بر رشد آینده یک کسب وکار تأثیر منفی بگذارد.
من ده ها کسب وکار تأیید شده در جزیره پرنس ادوارد (PEI) کانادا را در صنایع مختلف مورد بررسی قرار دادم تا ببینم چگونه در نتایج جستجوی هوش مصنوعی ظاهر می شوند. (این موضوع دقیقاً برای کسب وکارهای ایرانی نیز صادق است، جایی که حضور در نتایج ابزارهایی مثل ChatGPT یا هوش مصنوعی گوگل اهمیت روزافزونی پیدا کرده است).
این ممیزی نشان داد که یک کسب وکار متوسط، ۸۴ درصد از هویت خود را در برابر سیستم های هوش مصنوعی از دست می دهد (نشت می کند) و ۱۷ درصد از نمونه ها اصلاً هیچ حضور دیجیتالی قابل بازیابی توسط هوش مصنوعی نداشتند.
در اینجا به این می پردازیم که نشت هویت چیست، چرا اتفاق می افتد و چگونه می توان آن را برطرف کرد.
نشت هویت ۸۴ درصدی چیست؟
یک سیستم بازیابی جستجوی هوش مصنوعی مانند یک انسان وب سایت را مرور نمی کند. این سیستم به دنبال حقایق خاص و قابل تأیید است: چه کسی این کسب وکار را اداره می کند، کجا قرار دارد، چه کاری انجام می دهد، آیا افراد پشت آن واقعی هستند یا خیر و غیره.
وقتی هوش مصنوعی نتواند این موارد را پیدا کند، با استفاده از هر قطعه اطلاعاتی که بتواند از وب جمع آوری کند، شروع به حدس زدن می کند. یا به سادگی کسب وکار را به طور کامل از پاسخ خود حذف می کند.
فاصله بین آنچه در مورد یک کسب وکار حقیقت دارد و آنچه هوش مصنوعی می تواند درباره آن تأیید کند، همان «نشت هویت» است.

یک طرح دست کن که صفحه اصلی یک وب سایت را نشان می دهد. در حالی که لینک صفحات “درباره ما” و “تیم ما” در فوتر یا منو وجود دارد (فلش های کمرنگ)، ربات هوش مصنوعی (ذره بین) مستقیماً به صفحه اصلی نگاه کرده و این اطلاعات حیاتی را نمی بیند.
در اینجا چند نمونه از نحوه ظاهر شدن کسب وکارها در ممیزی من آورده شده است:
سیگنال های اعتماد وجود دارند، اما هوش مصنوعی نمی تواند آن ها را استخراج کند
این رایج ترین و قابل حل ترین نسخه از نشت هویت است. بیست و دو مورد از ۷۱ کسب وکار در نمونه، نام و مشخصات قابل شناسایی مدیران و رهبران خود را در جایی در سایت خود داشتند.
در چندین مورد، این اطلاعات در صفحات فرعی مانند “تیم ما”، “تاریخچه ما” یا “خانواده ما” قرار داشت که در بررسی روتین صفحه اصلی توسط هوش مصنوعی نادیده گرفته می شد. اطلاعات وجود دارد، اما در جایی نیست که برای تأیید اعتبار در دسترس ربات ها باشد.
سایت وجود دارد، اما هیچ چیز توسط هوش مصنوعی قابل خواندن نیست
چندین کسب وکار در این نمونه دارای وب سایت های حرفه ای، واقعی و مدرن بودند که در فراخوانی مستقیم، هیچ متن قابل استخراجی را برنمی گرداندند.
آن ها کاملاً با جاوا اسکریپت سمت کاربر (Client-side JavaScript) و بدون هیچ گونه نسخه پشتیبان استاتیک ساخته شده بودند. یکی از این موارد، یک شرکت نرم افزاری بود که شعار خودش نوید “سیستم های سازمانی و هوش مصنوعی بصری” را می داد، اما صفحه اصلی آن برای همان سیستمی که ادعا می کرد برای آن ساخته شده، غیرقابل خواندن بود! (تیم طراحی سایت دانش وب همواره تأکید دارد که خزنده های موتورهای جستجو و هوش مصنوعی باید بتوانند کدهای سایت را به راحتی پردازش کنند).
کسب وکار واقعی است، اما دامنه مرده است
دامنه یک تولیدکننده معروف پنیر اکنون توسط یک فروشنده دامنه برای فروش گذاشته شده بود و دامنه یک تولیدکننده نمک هیچ پاسخی نمی داد. این برند اکنون فقط به عنوان یک خط محصول فروخته شده از طریق یک وب سایت دیگر زنده است. هیچ یک از این دو کسب وکار در جایی که خزنده به دنبالشان بود، ظاهر نشدند.

یک تصویر مقایسه ای دست کن. سمت راست، سایتی که با React ساخته شده و برای کاربر انسانی عالی است، اما برای ربات (صفحه سیاه با کد بی معنی) چیزی نشان نمی دهد. سمت چپ، همان سایت با نسخه پشتیبان استاتیک (HTML) که تمام اطلاعات کلیدی را به وضوح به ربات نمایش می دهد.
هویت در سراسر وب پراکنده است
یک شکلات ساز تحت سه دامنه مختلف در دایرکتوری ها فعالیت می کرد و یک شرکت بیوتکنولوژی دو دامنه فعال جداگانه برای یک نهاد واحد داشت. هر یک از این بخش ها، ارزش بخش های دیگر را رقیق می کند و یک سیستم هوش مصنوعی وقتی سعی می کند بفهمد “این کیست”، به جای یک پاسخ معتبر، پاسخ های رقابتی و ناقص پیدا می کند.
کسب وکار هرگز حضور دیجیتالی نساخته است
تعدادی از کسب وکارهای واقعی و در حال کار در این نمونه، از جمله یک استودیوی عکاسی، یک پیمانکار تهویه مطبوع، یک چوب بری و یک تعمیرگاه خودرو، فقط در لیست دایرکتوری های شخص ثالث وجود دارند. آن ها سایت های واقعی برای یک سیستم هوش مصنوعی ندارند تا بتواند در برابر آن ها تأیید اعتبار کند.
چرا نشت هویت اتفاق می افتد؟
نشت هویت نتیجه بد بودن کسب وکار نیست. بلکه نتیجه وب سایت هایی است که برای نوع متفاوت و قدیمی تری از خوانندگان ساخته شده اند.
در گذشته، وظیفه یک وب سایت این بود که توسط موتور جستجو پیدا شود و توسط انسانی خوانده شود که از قبل زمینه ای داشت: آشنایی با برند از طریق یک تبلیغ، توصیه یک همسایه، لیستی در یک دایرکتوری محلی و غیره. در آن شرایط، وب سایتی که ظاهر خوبی داشت و سریع بارگذاری می شد، کار خود را انجام می داد و قابلیت خواندن توسط هوش مصنوعی اصلاً مطرح نبود.
اما سیستم های هوش مصنوعی و نحوه استخراج اطلاعات آن ها بازی را تغییر داده است. سیستمی که حقایقی را در مورد یک کسب وکار استخراج می کند، به داده های ساختاریافته، به روز و بدون ابهام نیاز دارد.
سه مشکل فنی، بیشتر موارد نشت یافت شده در این ممیزی را توضیح می دهند:
- رندر سمت کاربر (Client-side) بدون پشتیبان استاتیک: اگر محتوای یک صفحه فقط پس از اجرای جاوا اسکریپت در مرورگر وجود داشته باشد، یک عامل بازیابی که HTML استاتیک را تجزیه می کند، هرگز آن را نخواهد دید. این بدترین نتایج را در مطالعه ایجاد کرد: عدم وجود محتوا به طور کامل.
- حقایق واقعی محدود به صفحاتی که هیچ کس بررسی نکرده است: مدیریت شناخته شده، تاریخچه واقعی و صفحات خط مشی، به طور نامتناسبی در صفحات ثانویه زندگی می کردند تا صفحه اصلی.
- فقدان منبع واحد حقیقت (Canonical): در مواردی که هویت یک کسب وکار در چندین دامنه یا لیست دایرکتوری پراکنده است، یا یک دامنه اصلی مرده در کنار یک حضور اجتماعی زنده وجود دارد، سیستم هوش مصنوعی راهی برای تعیین اینکه به کدام منبع اعتماد کند ندارد.

یک طرح دست کن که نشان می دهد چگونه کدهای اسکیما (سمت راست) به عنوان یک “مترجم” عمل کرده و اطلاعات وب سایت را به زبانی قابل فهم برای هوش مصنوعی تبدیل می کنند. این کار باعث می شود هوش مصنوعی (مغز متفکر) کسب وکار را دقیقاً همانطور که هست (ساختمان سمت چپ) درک و تأیید کند.
ممیزی نشت هویت چگونه انجام شد
این ممیزی ساختاریافته روی ۷۱ کسب وکار تأیید شده در حوزه های مواد غذایی و نوشیدنی، خرده فروشی، خدمات حرفه ای، فناوری، کشاورزی، مراقبت های بهداشتی، اقامتی و گلف انجام شد.
من از یک نسخه فشرده از چارچوب امتیازدهی E-E-A-T (تجربه، تخصص، اعتبار و اعتماد) استفاده کردم؛ همان اصولی که موتورهای جستجو سال ها برای ارزیابی کیفیت و رتبه بندی صفحات استفاده کرده اند. این چارچوب برای نحوه اعتماد و استخراج اطلاعات سیستم های بازیابی هوش مصنوعی در حال حاضر، با استفاده از یک تشخیص مبتنی بر امتیاز تغییر یافته است.
(کسب وکارها به طور متوسط فقط ۱۵.۶٪ از فاکتورهای لازم برای هوش مصنوعی را رعایت کرده اند).
چگونه نشت هویت را شناسایی و برطرف کنیم
در تقریباً هر مورد در این ممیزی، همان تعداد انگشت شمار از مداخلات، شکاف را پر کرد. اگر می خواهید برای مشتریان و موتورهای هوش مصنوعی نامرئی نباشید، این کارها را انجام دهید:
- یک فرد نام دار را در صفحه قرار دهید: رایج ترین راه حل، اضافه کردن یک صفحه واقعی “درباره مالک”، “داستان ما” یا “تیم ما” با یک نام واقعی بود. مطمئن شوید که این صفحات به صفحه اصلی لینک داده شده اند.
- محتوای مهم را سمت سرور رندر کنید (Server-render): هر کسب وکاری که به یک سایت کاملاً رندر شده توسط کلاینت (مثل ریکت بدون SSR) متکی است، به یک نسخه استاتیک برای حقایق اصلی خود (نام، آدرس، خدمات، رهبری) نیاز دارد.
- یک دامنه را انتخاب کنید و به آن پایبند باشید: اگر در دامنه های تکراری فعالیت می کنید، همه چیز را روی یک آدرس (Canonical) متمرکز کنید و بقیه را به آن ریدایرکت کنید.
- تأیید کنید که دامنه واقعاً فعال است: مطمئن شوید دامنه شما منقضی نشده باشد!
- یک صفحه قوانین و حریم خصوصی واقعی و لینک دار اضافه کنید: سیاست های حفظ حریم خصوصی و شرایط خدمات، سیگنال های اعتمادی هستند که سیستم های هوش مصنوعی آن ها را می سنجند.
- بررسی کنید که آیا فروشندگان شخص ثالث بالاتر از شما رتبه می گیرند: به خصوص در حوزه رزرو هتل یا خدمات، مطمئن شوید سایت اصلی خودتان معتبرتر از سایت های واسطه به نظر برسد.
- در وب فارسی، استفاده از اسکیما مارک آپ ها (Schema Markup) برای معرفی دقیق “سازمان” (Organization)، “شخص” (Person) و “کسب وکار محلی” (Local Business) به شدت به درک هوش مصنوعی از هویت برند شما کمک می کند. تیم سئو در دانش وب همواره اجرای دقیق کدهای ساختاریافته را به عنوان قدم اول در AI SEO (سئوی هوش مصنوعی) پیشنهاد می کند.
نتیجه گیری
ظهور سیستم های جستجوی مبتنی بر هوش مصنوعی (مانند AI Overviews گوگل و چت بات ها)، قوانین بازی را در سئو و دیجیتال مارکتینگ تغییر داده است. دیگر تنها زیبایی بصری سایت و کلمات کلیدی برای جذب کاربر کافی نیست؛ بلکه کدهای سایت شما باید به زبانی نوشته شوند که ماشین ها و هوش مصنوعی بتوانند ماهیت، اعتبار و هویت کسب وکار شما را بدون هیچ ابهامی درک کنند.
پدیده «نشت هویت»، زنگ خطری برای تمامی کسب وکارهای ایرانی است که سایت های خود را بر اساس استانداردهای قدیمی ساخته اند. رفع این مشکل نه نیازمند هزینه های گزاف است و نه ابزارهای پیچیده؛ بلکه نیازمند یک استراتژی درست در طراحی معماری سایت و اجرای اصول فنی سئو (Technical SEO) است.
ما در دانش وب با ارائه خدمات تخصصی طراحی سایت و سئو، سایت شما را نه تنها برای کاربران انسانی، بلکه برای نسل جدید موتورهای جستجوی مبتنی بر هوش مصنوعی بهینه سازی می کنیم تا هیچ گاه در فضای دیجیتال، نامرئی نمانید. برای مشاوره و بررسی ساختار سئوی سایت خود با کارشناسان دانش وب در ارتباط باشید.