بدأت Google في طرح تحديث البريد العشوائي لشهر يونيو، وهو الثاني من العام. إنه يفرض سياسات البريد العشوائي الموثقة، وتغطي إحدى هذه السياسات الآن مساحة أكبر مما كانت عليه من قبل.
تتعامل قواعد البريد العشوائي في Google مع محاولات “التلاعب باستجابات الذكاء الاصطناعي التوليدية” في البحث باعتبارها انتهاكًا، وهذه إحدى السياسات التي يفرضها التحديث.
تشرح مطبوعة Cornell Tech الأولية التي التقطتها 404 Media سبب صعوبة تطبيق السياسة مما توحي به صياغتها. يمكن لصفحات المجتمع التي يعتمد عليها وكلاء أبحاث الذكاء الاصطناعي أن تحمل أيضًا تعليقات أطراف ثالثة، ويمكن للتعليق أن يزرع توصية لم يكتبها المؤلف مطلقًا.
وبالتالي، فإن ما يصنفه Google بأنه بريد عشوائي، ينتقل عبر عملية الاسترجاع ذاتها التي يعتمد عليها هؤلاء الوكلاء. وتجد الأبحاث أن الدفاعات الواضحة جميعها لها عيوب.
بالنسبة لأي شخص يحاول دفع علامة تجارية إلى الإجابات التي ينشئها الذكاء الاصطناعي، فاعلم أن الخط الفاصل بين التحسين والبريد العشوائي قد تم إعادة رسمه.
الرهانات
وجد تتبع SE Ranking لوضع الذكاء الاصطناعي أن جوجل تشير بشكل متزايد إلى خصائصها الخاصة، مع استشهادات ذاتية تصل إلى ما يقرب من خمس الاستشهادات في وضع الذكاء الاصطناعي في تقريرها الأخير.
مع وجود عدد أكبر من الاستشهادات التي تشير إلى Google وعدد أقل من المواقع الخارجية، فإن الرغبة في تصنيع موقع ما تزداد وفقًا لذلك.
وقد بدأت بالفعل السوق الرمادية في التشكل، ويشير مؤلفو جامعة كورنيل إلى أن المسوقين مشغولون باختبار طرق لدفع الإجابات التي يولدها الذكاء الاصطناعي.
وفي الوقت نفسه، لا تملك الشركات البيانات التي تحتاجها لمعرفة ما يحدث. كما أوضحت تغطيتنا السابقة للبحث الوكيل، لا توجد لوحة تحكم تخبر الموقع ما إذا كان قد وصل إلى إجابة الذكاء الاصطناعي، أو تم الاستشهاد به في تقرير تم إنشاؤه، أو تم تجاوزه.
والنتيجة هي انتهاك يمكن لـ Google تحديده ولكن الموقع المعني لا يمكنه رؤيته في كثير من الأحيان.
ما وجده البحث
تبحث الورقة التي تحمل عنوان “يمكن تسميم عوامل البحث العميق عبر المحتوى الذي ينشئه المستخدم”، والتي لم تتم مراجعتها من قبل النظراء، في نقطة ضعف في كيفية قيام أدوات بحث الذكاء الاصطناعي بجمع مصادرها. تجيب هذه الأدوات على أحد الأسئلة عن طريق إطلاق مجموعة من الاستعلامات الفرعية ذات الصلة، والاستيلاء على الصفحات التي تظهر باستمرار عبرها، وتجميع تقرير يتضمن الاستشهادات.
كشف التحليل عن ظهور نفس صفحات المجتمع بشكل متكرر في تلك الاستعلامات الفرعية. داخل مجموعة موضوعات واحدة، ظهرت صفحة واحدة من إنشاء المستخدم في ما يصل إلى 48% من الاستعلامات، وتشكل الأنظمة الأساسية التي أنشأها المستخدمون ما بين 17% إلى 23% من كل عنوان URL تم استرداده. قم بتغيير إحدى تلك الصفحات المتكررة، ويمكن أن يؤثر التغيير على التقارير الخاصة بالموضوع بأكمله.
وجد الباحثون أن ما يقرب من 13 كلمة من النص المزروع في صفحة متكررة كانت كافية لإدراج الكيان الذي اختاره المهاجم في التقرير النهائي في 38% إلى 51% من الجلسات التي استرجعت الصفحة.
وبعثرة النص نفسه على عدد قليل من الصفحات، ارتفع الرقم إلى 42% إلى 62%. حتى أنه مدفون داخل صفحة كاملة، حيث يشكل أقل من 4% مما قرأه الوكيل، فإن النص المزروع لا يزال يظهر في 30% إلى 53% من الجلسات.
أجرى ثلاثة من وكلاء الأبحاث مفتوحة المصدر الاختبارات، STORM، وCo-STORM، وOmniThink، وتم تشغيلها جميعًا في محاكاة بحيث لا يتم المساس بأي شيء على الويب المباشر.
حيث يكون التنفيذ صعبًا
يمكن لشركة Google تصنيف التلاعب في إجابة الذكاء الاصطناعي على أنه بريد عشوائي والتصرف بناءً على ما تكتشفه. اصطيادها هو الجزء الصعب. يبدو النص المزروع وكأنه نصيحة حقيقية، وهو موجود في نفس الصفحات التي كانت الأدوات ستقرأها دائمًا، لذا فإن فصله عن المنشور العادي هو المشكلة الرئيسية.
بحث فريق البحث عن دفاع ضد النص المزروع لكنه لم يجده. لقد حاولوا استبعاد المصادر التي أنشأها المستخدمون، وفحصها باستخدام نموذج لغة قبل الاستخدام، وتمشيط التقرير النهائي بحثًا عن الادعاءات التي لم تصمد.
ولم يوقف أي من الثلاثة الهجوم دون جعل النتائج أسوأ بالنسبة للمستخدم. أسقط المصادر التي أنشأها المستخدم، وستفقد تفاصيل المجتمع التي تجعل أدوات بحث الذكاء الاصطناعي تستحق الاستخدام.
الأدوات التي يستخدمها معظم الناس تقع خارج هذا الاختبار. قام كل من ChatGPT Deep Research وGemini Deep Research بإجراء عملية استرجاع لم يتمكن الباحثون من تسميمها دون تجاوز الخط الأخلاقي، لذلك قاموا فقط بقياس عادات الاقتباس. اعتمدت شركة جيميني على المحتوى الذي أنشأه المستخدم بنسبة 12.1% من الوقت، وهو ما وصفه المؤلفون بأنه تلميح للتعرض، وليس نتيجة مختبرة. لقد وصلت أداة OpenAI إلى هذا الهدف بشكل أقل بكثير.
لماذا يعد هذا مهمًا لمحترفي البحث
تشبه التحركات التي يمكن أن تساعد في رفع العلامة التجارية إلى إجابات الذكاء الاصطناعي أساليب التلاعب التي يطلق عليها جوجل اسم “البريد العشوائي”، مثل زرع الإشارات عبر المواقع التي تقرأها هذه الأدوات. لا نعرف أين يقع خط Google بين الحصول على إشارة والهندسة.
أما بالنسبة للتجارة الإلكترونية والعلامات التجارية المحلية، فالخطر يأتي من الاتجاه الآخر.
كانت حالات الاختبار هي الأشياء العادية التي يسألها الناس، مثل الخدمة التي يجب الاتصال بها، والمنتج الذي يجب شراؤه، ومكان تناول الطعام. يمكن للمنافس أو المحتال أن يدس اسمًا غير مألوف في تلك الإجابات، بجوار الخيارات المشروعة مباشرةً، ولن تعرف العلامة التجارية التي يتم استبعادها ذلك أبدًا.
بالنسبة لناشري الأخبار والعلامات التجارية الكبرى، فإن القلق يكمن في الثقة في الإجابة التي تصل إليها أسمائهم. يُنظر إلى الاقتباس من أداة الذكاء الاصطناعي على أنه فوز، لكن الاقتباس يعكس فقط ما سحبته الأداة، وليس ما إذا كانت تلك الصفحة صحيحة، ويمكن توجيه الإجابة من خلال المحتوى الذي لم تكتبه العلامة التجارية مطلقًا.
ليس هناك حل مرتب لكل هذا. لقد أصبحت رؤية الذكاء الاصطناعي بمثابة سطح تراقبه بشكل نشط، وليس مجرد قناة تعمل على تحسينها بشكل سلبي.
التطلع إلى الأمام
وصف المؤلفون التلاعب الذي ينشئه المستخدم بأنه مشكلة مفتوحة لا يمكن لأي منصة واحدة حلها بمفردها. وقد أشار Reddit إلى معركته الطويلة ضد التلاعب المنسق، كما قامت Google بتثبيت تسميات السياق على بعض المواد التي مصدرها Reddit في AI Overviews. ولا يلمس أي منهما تركيز الاسترجاع الذي تشير إليه الورقة.
ولم توضح جوجل كيف تنوي فرض التلاعب التوليدي بالذكاء الاصطناعي، سواء من خلال تحديث مخصص أو من خلال نظام SpamBrain الخاص بها والمراجعات اليدوية التي تعتمد عليها في معظم الانتهاكات.
في الوقت الحالي، تصف السياسة السلوك بأنه خارج الحدود، ولا يزال فحص استجابات الذكاء الاصطناعي يقع على عاتق من يقرأها.
المزيد من الموارد:
صورة مميزة: يهتف-J-آن/ شترستوك
اكتشاف المزيد من قمم التجارية للأعمال
اشترك للحصول على أحدث التدوينات المرسلة إلى بريدك الإلكتروني.
