تحسين محركات البحث التوليدية بالعربية: كيف تُهيّئ المحتوى العربي لبحث الذكاء الاصطناعي
بقلم Dfeelings · آخر تحديث
الإجابة المختصرة
تحسين محركات البحث التوليدية (GEO) للمحتوى العربي هو إعداد الصفحات العربية بحيث تكون واضحة ومنظّمة وموثوقة إلى درجة تسمح لمساعدات الذكاء الاصطناعي بفهمها والاعتماد عليها في إجاباتها العربية. وهو ليس ترجمة؛ بل كتابة أصيلة بالفصحى تراعي الطريقة التي يسأل بها المستخدم في السعودية والأردن فعلًا، وتعالج اختلافات الإملاء والمصطلحات اللاتينية، وتضبط الترميز التقني، وتربط الصفحة بنسختها الإنجليزية، وتقيس الظهور العربي بشكل منفصل.
حقائق أساسية
- تقول Google إنها تحدّد لغة الصفحة من محتواها المرئي، لا من سمة lang ولا من الرابط.
- تشترط إرشادات Google لوسوم hreflang أن تُشير كل نسخة لغوية إلى نفسها وإلى بدائلها، وإلا قد تُتجاهَل الوسوم.
- توصي W3C بتحديد اتجاه الكتابة من اليمين إلى اليسار عبر dir="rtl" على عنصر html، لا عبر CSS.
- تتوقّع خاصية inLanguage في Schema.org رمز لغة وفق معيار IETF BCP 47 مثل "ar" أو "ar-SA".
- لا أحد يستطيع أن يضمن أن يذكر نظام ذكاء اصطناعي نشاطًا تجاريًا أو يستشهد به، بالعربية أو بالإنجليزية.
لماذا لا يكفي أن نترجم المحتوى الإنجليزي إلى العربية؟
لا تكفي الترجمة لأن المستخدم العربي يسأل مساعدات الذكاء الاصطناعي أسئلة مختلفة، بكلمات مختلفة، وبتوقّعات محلية مختلفة. الصفحة المترجمة تُجيب عن سؤال القارئ الإنجليزي بمفردات عربية، أما صفحة تحسين محركات البحث التوليدية العربية فتُجيب عن السؤال الذي يطرحه المشتري في الرياض أو عمّان فعلًا، بالمصطلحات التي يكتبها، وبالسياق المحلي الذي ينتظره، وبإجابات مستقلة يسهل على المساعد اقتباسها.
الترجمة الحرفية أو الآلية تنقل معها ترتيب الجملة الإنجليزية وأمثلتها وافتراضاتها عن الأسعار والأنظمة وطريقة الشراء، فتخرج عربية سليمة نحويًا لكن لا أحد يتكلم بها. وحين يصوغ المساعد إجابة عربية فإنه يعتمد على النص العربي المتاح له؛ والصفحة التي تبدو غريبة أو تخلط المستويات اللغوية أو تُغفل السياق المحلي تمنحه مادة أضعف.
المحتوى العربي الأصيل يبدأ من بحث عربي: ما الأسئلة التي يطرحها الناس، وما المصطلحات التي يستخدمونها لوصف الخدمة، وما الاعتراضات الخاصة بالسوق السعودي أو الأردني، وما الأدلة المحلية التي يثقون بها. يجب أن تغطي الصفحتان العربية والإنجليزية العرض نفسه وأن ترتبطا ببعضهما، لكن تُكتب كل منهما لقارئها.
هل نكتب المحتوى الموجّه لبحث الذكاء الاصطناعي بالفصحى أم باللهجة؟
الأصل أن يُكتب المحتوى الموجّه لبحث الذكاء الاصطناعي بفصحى واضحة، لأنها مفهومة في كل الأسواق العربية وتمنح النص طابع المرجعية. لكن المستخدمين يكتبون أسئلتهم كثيرًا باللهجة: صياغة خليجية سعودية في الرياض وجدة، وصياغة شامية في عمّان. لذلك يبقى متن الصفحة بالفصحى، بينما تعكس العناوين والأسئلة الشائعة والأمثلة الأسئلة التي يطرحها المشتري فعلًا.
قد يسأل مستخدم سعودي المساعد: «وش أفضل طريقة أظهر فيها في ChatGPT؟»، بينما يكتب مستخدم أردني: «شو أحسن طريقة أظهر فيها بـ ChatGPT؟». المعنى واحد والصياغتان عاميتان. الصفحة المكتوبة كلها باللهجة تبدو غير مهنية في أغلب الخدمات الموجّهة للشركات وتناسب سوقًا واحدًا فقط، والصفحة المكتوبة بفصحى جامدة لا تنتبه لهذه الصياغات تفوّت المفردات التي يحملها المستخدم إلى المحادثة.
الحل العملي أن يُكتب المتن بالفصحى، وأن تُصاغ أسئلة الأقسام كما يطرحها المشتري بشكل طبيعي، وأن تُذكر الصيغ العامية الشائعة حيث تفيد فعلًا، في قسم الأسئلة الشائعة أو في مسرد للمصطلحات مثلًا. لا داعي لحشو كل فقرة بكلمات عامية؛ الهدف أن يتعرّف القارئ والنظام على السؤال، لا أن نقلّد اللهجة.
- في الأسئلة السعودية والخليجية تتكرر كلمات مثل «وش» و«أبغى» و«مرة» و«الحين».
- في الأسئلة الأردنية والشامية تتكرر كلمات مثل «شو» و«بدّي» و«كتير» و«هلّق».
- مقابلاتها في الفصحى «ماذا» و«أريد» و«جدًا» و«الآن»، وهي مفهومة لكل قارئ.
ما المصطلحات الإنجليزية واللاتينية التي يكتبها المستخدم العربي في البحث وأسئلة الذكاء الاصطناعي؟
يمزج المستخدم العربي كثيرًا بين العربية والمصطلحات المكتوبة بحروف لاتينية، خصوصًا في المواضيع التقنية والتسويقية. فمصطلحات مثل GEO وSEO وChatGPT وGoogle Ads وCRM تُكتب غالبًا بحروف إنجليزية داخل جملة عربية، وتُكتب SEO أيضًا صوتيًا «سيو». لذلك ينبغي أن تضع صفحة تحسين محركات البحث التوليدية العربية المصطلح العربي والمصطلح اللاتيني المستخدم فعلًا جنبًا إلى جنب.
في بيانات Google Search Console الخاصة بموقع Dfeelings، لاحظنا أن الباحثين في السعودية كتبوا كثيرًا المصطلح اللاتيني GEO داخل استعلامات عربية، مثل «تحسين geo»، بدلًا من عبارة عربية كاملة. هذه ملاحظة من بيانات موقع واحد وليست إحصاءً عن السوق، لكنها تتّسق مع نمط أوسع: المفاهيم التقنية الجديدة تصل بالإنجليزية أولًا، ثم يستقر مصطلحها العربي لاحقًا.
لهذا يجب أن تسمّي الصفحة العربية المفهوم باسمه العربي الكامل «تحسين محركات البحث التوليدية (GEO)» مع إبقاء الاختصار ظاهرًا، وأن تستخدم العبارات القريبة التي يبحث بها الناس مثل «تحسين الظهور في محركات الذكاء الاصطناعي» و«تحسين الظهور في ChatGPT» و«الظهور في إجابات الذكاء الاصطناعي». وينطبق الأمر نفسه على «تحسين محركات الإجابة (AEO)». أما أسماء المنصات فتبقى بحروفها اللاتينية، لأن المستخدمين يكتبونها هكذا والمنصات تسمّي نفسها هكذا.
كيف تؤثر اختلافات الإملاء العربي وكتابة اسم العلامة التجارية على الظهور في الذكاء الاصطناعي؟
تؤثر اختلافات الإملاء العربي لأن الكلمة الواحدة قد تُكتب بأكثر من شكل، وعدم الاتساق يُصعّب الربط بين المصادر التي تذكر العلامة التجارية أو الخدمة. من أشهر هذه الاختلافات الهمزة على الألف (أ، إ، ا)، والتاء المربوطة والهاء (ة، ه)، والياء والألف المقصورة (ي، ى). وتحتاج العلامة التجارية أيضًا إلى كتابة عربية واحدة ثابتة في كل مكان تظهر فيه.
نادرًا ما يدقّق المستخدمون في الهمزات؛ فكثيرون يكتبون «اسعار» بدل «أسعار» و«شركه» بدل «شركة». محركات البحث تتعامل منذ زمن مع كثير من هذه الاختلافات، لكن مساعدات الذكاء الاصطناعي تبني إجاباتها من مصادر متعددة، والعلامة التي يظهر اسمها بثلاثة أشكال عربية بين موقعها وأدلة الأعمال والتغطيات الصحفية تقدّم كيانًا مشتتًا وأضعف. الإملاء الصحيح مطلوب في متن الصفحة، أما في اسم العلامة فالمهم هو الثبات.
اختر شكلًا عربيًا رسميًا واحدًا لاسم العلامة، ووثّقه، واستخدمه في الموقع وفي بيانات Organization المنظّمة وفي ملف Google Business Profile وفي كل دليل أو ملف تعريفي. وإن كانت هناك كتابة بديلة شائعة فاذكرها مرة واحدة، في صفحة «من نحن» مثلًا، ليتمكن القارئ والأنظمة من الربط بين الشكلين. ويجب أن يبقى الاسم اللاتيني متطابقًا في النسختين.
- صور الهمزة: «أ» و«إ» و«ا»، مثل «إعلانات» و«اعلانات».
- التاء المربوطة والهاء: «شركة» و«شركه».
- الياء والألف المقصورة: «على» و«علي».
- اسم العلامة: كتابة عربية واحدة وتهجئة لاتينية واحدة، بلا تبديل.
ما الترميز الذي تحتاجه الصفحة العربية لاتجاه النص ولغته؟
تحتاج الصفحة العربية إلى ضبط سمة اللغة على العربية واتجاه النص من اليمين إلى اليسار على عنصر html، أي lang="ar" مع dir="rtl". وتوصي W3C بتحديد الاتجاه في الترميز لا في CSS. وتذكر Google أنها تحدّد اللغة من المحتوى المرئي لا من سمة lang، فالترميز الصحيح يخدم المتصفحات وقارئات الشاشة والعرض السليم، بينما يدلّ النص العربي نفسه على اللغة.
إرشادات W3C واضحة: أضف dir="rtl" إلى عنصر html كلما كان اتجاه المستند العام من اليمين إلى اليسار، واستخدم dir على العناصر الداخلية فقط حين يتغير الاتجاه داخل الصفحة، ولا تعتمد على CSS لتحديد الاتجاه الأساسي. اللغة والاتجاه تعريفان منفصلان، وضبط lang لا يضبط الاتجاه تلقائيًا.
المحتوى المختلط يحتاج إلى عناية. فالصفحات العربية تتضمن كلمات لاتينية وأرقامًا وروابط وأكوادًا. المصطلحات الإنجليزية القصيرة مثل ChatGPT تظهر غالبًا بشكل سليم داخل النص العربي، لكن العبارات الإنجليزية الطويلة ورموز المنتجات وأرقام الهواتف قد تحتاج إلى عنصر مستقل باتجاه محدد حتى لا تختلط علامات الترقيم. واجعل كل صفحة بلغة واحدة في محتواها الرئيسي وقوائمها، فـ Google تنصح بتجنّب الترجمات المتجاورة في الصفحة نفسها.
كيف نربط الصفحات العربية بنظيراتها الإنجليزية عبر hreflang؟
تُربط الصفحات العربية بنظيراتها الإنجليزية عبر وسوم hreflang على روابط منفصلة، بحيث تُشير كل صفحة إلى نفسها وإلى نسختها باللغة الأخرى. وتنص وثائق Google على أنه إذا لم تُشر الصفحتان إلى بعضهما فقد تُتجاهل الوسوم. وتُكتب رموز اللغة وفق ISO 639-1 مثل ar وen، مع رمز منطقة اختياري وفق ISO 3166-1 مثل ar-SA أو ar-JO.
توصي Google بأن يكون لكل نسخة لغوية رابط مستقل بدلًا من تبديل اللغة عبر ملفات تعريف الارتباط أو إعدادات المتصفح، وتنصح بعدم تحويل المستخدم تلقائيًا إلى لغة أخرى بناءً على تخمين. ضع بدلًا من ذلك رابطًا ظاهرًا لتبديل اللغة. ويمكن تعريف hreflang في رأس HTML أو في ترويسات HTTP أو في خريطة الموقع XML، وتعدّها Google طرقًا متكافئة، فاختر طريقة واحدة والتزم بها.
النسخ العربية المخصّصة لكل دولة لا تكون منطقية إلا حين يختلف المحتوى فعلًا، كاختلاف الأسعار أو الأنظمة أو بيانات التواصل بين السعودية والأردن. أما إن كانت صفحة عربية واحدة تخدم السوقين فالوسم ar وحده أبسط ويتجنّب صفحات شبه مكرّرة. ويُستحسن استخدام x-default لصفحة اختيار اللغة أو الصفحة الاحتياطية، لكنه ليس إلزاميًا.
كيف نتعامل مع البيانات المنظّمة في الصفحات العربية؟
يجب أن تصف البيانات المنظّمة في الصفحة العربية المحتوى العربي الظاهر في تلك الصفحة، باللغة العربية، مع ضبط inLanguage على رمز عربي وفق BCP 47 مثل "ar". وخاصية inLanguage في Schema.org مخصّصة لتحديد لغة الأعمال الإبداعية كالمقالات وصفحات الويب. وتشترط Google أن تمثّل البيانات المنظّمة المحتوى المرئي تمثيلًا صادقًا، فوضع ترميز إنجليزي فقط على صفحة عربية تناقض واضح.
عمليًا، يحمل كائن Article أو WebPage في الصفحة العربية العنوان والوصف العربيين والرابط العربي وinLanguage بقيمة "ar"، بينما تحمل الصفحة الإنجليزية ما يقابلها وinLanguage بقيمة "en". ويجب أن يستخدم كائن Organization المعرّف نفسه والشعار نفسه وروابط sameAs نفسها في النسختين حتى تتعرّف الأنظمة على كيان واحد عبر اللغتين، ويمكن أن يتضمن الاسم الشكل العربي الرسمي إلى جانب الاسم اللاتيني.
الترميز وحده لا يصنع ظهورًا. فـ Google تذكر أن البيانات المنظّمة الصحيحة تجعل المحتوى مؤهّلًا للنتائج المنسّقة دون أن تضمن ظهورها، وأن الترميز يجب ألا يصف محتوى لا يراه القارئ. تعامل مع السكيما العربية على أنها وصف دقيق لمحتوى عربي جيد، لا بديل عنه.
لماذا يجب قياس الظهور العربي والإنجليزي في الذكاء الاصطناعي كلًّا على حدة؟
يجب قياس الظهور العربي والإنجليزي في إجابات الذكاء الاصطناعي كلًّا على حدة لأن النشاط التجاري نفسه قد يُذكر كثيرًا في الإجابات الإنجليزية ونادرًا في العربية، أو العكس. فالأسئلة العربية تستند إلى مصادر عربية وأدلة محلية ومنافسين مختلفين، ودمج اللغتين في رقم واحد يُخفي الفجوة. لكل لغة مجموعة أسئلة خاصة وخط أساس خاص وعرض مستقل في Search Console وأدوات التحليل.
بالنسبة للمساعدات، ابنِ مجموعة أسئلة عربية مكتوبة كما يسأل المستخدم العربي فعلًا، بما فيها الصيغ العامية والمصطلحات اللاتينية، واختبرها لكل محرك ولكل دولة. لا تترجم قائمة الأسئلة الإنجليزية وتفترض أن النتائج قابلة للمقارنة؛ فالمنافسون والمصادر المستشهد بها تتغير كثيرًا حين تتغير اللغة.
وبالنسبة لبيانات Google، صفِّ تقرير الأداء في Search Console حسب الصفحة (الروابط التي تبدأ بـ /ar/ مثلًا) وحسب الدولة، وقارن الاستعلامات العربية بالإنجليزية بشكل منفصل. وفي GA4 قسّم الجلسات حسب لغة صفحة الدخول. وتذكر وثائق Google أن زيارات AI Overviews وAI Mode تُحتسب ضمن نوع البحث Web في Search Console، كما تتضمن تعريفات القنوات الافتراضية في GA4 حاليًا قناة AI Assistant للإحالات القادمة من مساعدات مثل ChatGPT وGemini وCopilot.
| المعنى | سعودي / خليجي | أردني / شامي | الفصحى |
|---|---|---|---|
| ماذا (What) | وش | شو | ماذا / ما |
| أريد (I want) | أبغى / أبي | بدّي | أريد |
| جدًا (Very) | مرة | كتير | جدًا |
| جيد (Good) | زين | منيح | جيد |
| الآن (Now) | الحين | هلّق / هلأ | الآن |
قائمة تحقق لصفحة عربية مهيّأة لمحركات البحث التوليدية
- الصفحة مكتوبة أصلًا بالفصحى، لا مترجمة سطرًا بسطر.
- أسئلة الأقسام تعكس طريقة سؤال المشتري السعودي أو الأردني فعلًا.
- المصطلحات اللاتينية الأساسية (GEO وSEO وChatGPT) تظهر بجانب صيغها العربية.
- اسم العلامة يُكتب بشكل عربي واحد وتهجئة لاتينية واحدة في كل مكان.
- عنصر html يحمل lang="ar" وdir="rtl".
- للنسختين العربية والإنجليزية روابط منفصلة مربوطة بوسوم hreflang متبادلة.
- البيانات المنظّمة بالعربية، مطابقة للمحتوى الظاهر، وinLanguage مضبوطة على "ar".
- للظهور العربي مجموعة أسئلة وخط أساس وتقرير خاص به.
الأسئلة الشائعة
ما الاسم العربي المعتمد لـ GEO؟
يُكتب GEO بالعربية عادةً «تحسين محركات البحث التوليدية (GEO)». ويبحث كثيرون أيضًا بعبارات قريبة مثل «تحسين الظهور في محركات الذكاء الاصطناعي»، أو يكتبون الاختصار اللاتيني GEO داخل استعلام عربي. الصفحة العربية الجيدة تستخدم المصطلح الكامل والاختصار والعبارات القريبة الشائعة معًا.
هل أحتاج صفحات عربية منفصلة للسعودية والأردن؟
تستحق الصفحات العربية المنفصلة للسعودية والأردن العناء فقط حين يختلف المحتوى فعلًا، كالأسعار أو الأنظمة أو الفروع أو بيانات التواصل. وفي غير ذلك تكون صفحة عربية واحدة مكتوبة بفصحى جيدة، مع أمثلة تناسب السوقين، أوضح للقارئ وتتجنّب صفحات شبه مكرّرة تتنافس فيما بينها.
هل يمكن لمساعد الذكاء الاصطناعي أن يجيب بالعربية اعتمادًا على صفحتي الإنجليزية؟
قد تعتمد مساعدات الذكاء الاصطناعي أحيانًا على مصادر إنجليزية عند الإجابة بالعربية، لكن الاتكال على ذلك يترك صياغة الإجابة العربية ومصطلحاتها ودقتها خارج سيطرتك. الصفحة العربية الأصيلة تمنح المساعد نصًا عربيًا يستخدمه مباشرة، وتمنح القارئ العربي صفحة كُتبت له.
هل تساعد سمة lang محرك Google على معرفة أن الصفحة عربية؟
تذكر Google أنها تعتمد على المحتوى المرئي في الصفحة لتحديد لغتها، ولا تستخدم الإشارات البرمجية مثل سمة lang. ومع ذلك تبقى سمتا lang وdir ضروريتين للمتصفحات وقارئات الشاشة والخطوط والعرض الصحيح من اليمين إلى اليسار، فيجب أن تُعرّفهما كل صفحة عربية.
هل يستطيع أحد أن يضمن ظهور محتواي العربي في إجابات الذكاء الاصطناعي؟
لا أحد يستطيع أن يضمن أن يذكر مساعد ذكاء اصطناعي نشاطًا تجاريًا أو يستشهد به، بالعربية أو بأي لغة أخرى. فالمساعدات تختار مصادرها ديناميكيًا وسلوكها يتغير. ما يفعله تحسين محركات البحث التوليدية هو رفع وضوح المحتوى العربي ودقته وموثوقيته، والقياس هو ما يبيّن إن كان ذلك يحدث فعلًا.
كيف تعمل Dfeelings على المحتوى العربي في الذكاء الاصطناعي
Dfeelings وكالة متخصّصة في تحسين محركات البحث التوليدية (GEO) وتحسين محركات البحث، تأسست عام 2013 ومقرّها عمّان، وتعمل بالعربية والإنجليزية، وتخدم الأردن محليًا والسعودية عن بُعد. موقعها نفسه مبني بـ Next.js ويُعرض من الخادم، مع hreflang ثنائي اللغة وبيانات منظّمة JSON-LD. وفي إطار عمل Dfeelings للظهور في الذكاء الاصطناعي، يمرّ العمل العربي بمرحلة 01 الاكتشاف (بحث المصطلحات والأسئلة العربية)، و04 الإجابات (محتوى عربي أصيل يبدأ بالإجابة)، و07 القياس، حيث تُختبر مجموعتا الأسئلة العربية والإنجليزية كلٌّ على حدة لكل محرك ودولة، بالأسئلة نفسها في كل إعادة اختبار.
مصادر رسمية
- Google Search Central: إخبار Google بالنسخ المحلية من صفحتك
- Google Search Central: إدارة المواقع متعددة المناطق واللغات
- W3C: الترميز الهيكلي والنص من اليمين إلى اليسار في HTML
- Schema.org: خاصية inLanguage
- Google Search Central: الإرشادات العامة للبيانات المنظّمة
- Google Search Central: ميزات الذكاء الاصطناعي وموقعك
- مساعدة Google Analytics: مجموعة القنوات الافتراضية