تخطي إلى المحتوى الرئيسي
    تخطّى إلى المحتوى

    ملف llms.txt: ما هو، وما الذي لا يفعله، ومتى يستحق وقتك

    ما هو llms.txt وما لا يفعله: Google يتجاهله ولا مساعد يوثّق قراءته للاستشهاد. متى يستحق وقتك، وقالب عربي، وكيف تعرف من سجلات الخادم هل يطلبه أحد.

    الإجابة المختصرة

    ملف llms.txt اقتراح مفتوح، لا معيار ملزم، نشره Jeremy Howard في 3 سبتمبر 2024 وحدّثه إلى نسخة ثانية في أغسطس 2026. الفكرة: ملف Markdown قصير على /llms.txt يعطي نماذج الذكاء الاصطناعي والوكلاء (AI agents) ملخصًا للموقع وروابط منتقاة لأهم صفحاته، حتى لا يضطر الوكيل لقراءة صفحات مليئة بالقوائم والسكربتات.

    ما لا يفعله: لا يرفع ترتيبك في Google ولا يُدخلك في AI Overviews. دليل Google الرسمي يقول إن بحث Google لا يستخدم هذه الملفات أصلًا، وإن وجودها لا يضر ولا ينفع. ولم نجد في توثيق OpenAI أو Anthropic أو Perplexity لزواحفها ما يقول إنها تقرأ الملف للبحث أو للاستشهاد بالمصادر (راجعنا التوثيق في 27 سبتمبر 2026).

    قاعدة القرار: إن كان موقعك توثيقًا تقنيًا أو أداة للمطورين، فالملف رخيص ومفيد لوكلاء البرمجة الذين يقرؤون التوثيق. في غير ذلك، كمتجر أو مدونة، هو اختياري ومنخفض الأولوية: أضفه إن كان سيأخذ ساعة، ولا تتوقع منه زيارات أو استشهادات، وقِس في سجلات الخادم هل يطلبه أحد أصلًا.

    لمن تصلح

    تفيدك إذا

    • تدير منتج SaaS أو أداة للمطورين لها صفحات توثيق (Docs) وواجهة برمجية (API)، ويستخدمها مطورون مع وكلاء برمجة.
    • سمعت أن llms.txt «ضروري للظهور في ChatGPT» وتريد أن تعرف الحقيقة قبل أن تصرف وقت الفريق عليه.
    • لديك وصول لسجلات الخادم أو شبكة توصيل المحتوى (CDN) وتريد اختبارًا رخيصًا تقيسه بنفسك.

    لا تناسبك إذا

    • تريد ترتيبًا أفضل في Google أو ظهورًا في AI Overviews وAI Mode: هذا عمل SEO المعتاد، محتوى مفيد وصفحات قابلة للزحف والفهرسة. llms.txt لا يدخل فيه.
    • تريد أن تفهم Google اسم علامتك وشعارها وحساباتها الرسمية: هذا دور البيانات المنظمة، راجع قالب البيانات المنظمة للمؤسسة والشخص.
    • تريد منع استخدام محتواك في تدريب النماذج: llms.txt لا يمنع شيئًا. المنع يكون في robots.txt بأسماء الزواحف التي توثقها كل شركة (الجدول في آخر الصفحة)، مع فهم ما تخسره.

    ما تحتاجه قبل البدء

    • قائمة بأهم 10 إلى 30 صفحة في موقعك، ولكل صفحة سطر يقول ماذا فيها.
    • صلاحية رفع ملف إلى جذر النطاق أو إلى مسار فرعي مثل /docs. بعض المنصات المستضافة لا تسمح بذلك؛ تحقق من منصتك.
    • وصول لسجلات الوصول (Access logs) في الخادم أو الـ CDN لمدة 30 يومًا على الأقل، إن أردت أن تعرف هل يُطلب الملف.
    • حساب Google Analytics 4 وGoogle Search Console للموقع، لقياس الزيارات الفعلية لا الوعود.

    خطوات التطبيق

    1. افهم ما هو الملف بالضبط

      بحسب الاقتراح في llmstxt.org، الملف نص Markdown اسمه llms.txt، يوضع في جذر الموقع /llms.txt أو في أي مسار فرعي مثل /docs/llms.txt فيغطي الصفحات تحت هذا المسار. ترتيب أقسامه:

      1. عنوان رئيسي (H1) باسم الموقع أو المشروع. هذا هو القسم الوحيد الإلزامي.
      2. اقتباس (Blockquote) بملخص قصير يحمل المعلومات الأساسية لفهم بقية الملف.
      3. فقرات أو قوائم اختيارية بلا عناوين، فيها تفاصيل وتعليمات لفهم الروابط.
      4. أقسام بعناوين H2، كل منها قائمة روابط بالشكل [الاسم](الرابط): ملاحظة اختيارية.
      5. قسم اسمه Optional بالعرف، لروابط ثانوية يمكن للوكيل تخطيها.

      ويقترح أيضًا أن توفّر نسخة Markdown نظيفة من الصفحات المهمة على الرابط نفسه مع .md. النسخة الثانية (أغسطس 2026) أضافت روابط rel="alternate" type="text/markdown" وrel="describedby" ليجد الوكيل هذه الملفات دون تخمين.

      الفرق عن robots.txt: robots.txt يقول للزواحف ما المسموح بزحفه. llms.txt لا يسمح ولا يمنع شيئًا؛ هو دليل قراءة يطلبه الوكيل عند الحاجة. وبحسب كاتب الاقتراح، الاستخدام المتوقع والفعلي عند «الاستدلال» (Inference) أي وقت الإجابة، لا عند تدريب النماذج.

    2. اعرف من يقول رسميًا إنه يقرؤه، ومن لا يقول

      هذا ما تقوله الوثائق الرسمية كما قرأناها في 27 سبتمبر 2026. «لا يوجد توثيق» لا يعني «مستحيل»، بل يعني أنك لا تستطيع البناء عليه:

      الجهةماذا تقول وثائقها الرسمية عن llms.txt
      بحث Google (ومنه AI Overviews وAI Mode)لا يستخدمه. لا تحتاج ملفات نصية خاصة بالذكاء الاصطناعي ولا Markdown للظهور، ووجود الملف لا يضر ولا ينفع
      Chrome Lighthouseفحص ضمن مجموعة «التصفح بالوكلاء» (Agentic browsing) يفشل فقط إن أعاد الملف خطأ خادم، ويُعد «لا ينطبق» إن لم يوجد. لا علاقة له بترتيب Google
      OpenAI (ChatGPT)صفحة زواحفها تشرح OAI-SearchBot وGPTBot وChatGPT-User، ولا تذكر قراءة llms.txt للبحث أو للاستشهاد
      Anthropic (Claude)صفحة زواحفها تشرح ClaudeBot وClaude-User وClaude-SearchBot، ولا تذكر llms.txt
      Perplexityصفحة زواحفها تشرح PerplexityBot وPerplexity-User، ولا تذكر قراءة llms.txt
      تطبيق Geminiلم نجد توثيقًا رسميًا عن قراءته

      ملاحظة تسبب لبسًا شائعًا: OpenAI وAnthropic وGoogle (لتوثيق Gemini API) وPerplexity تنشر ملفات llms.txt لتوثيقها التقني. هذا يخدم المطورين الذين يوجّهون أدواتهم إليها، ولا يعني أن مساعداتها تقرأ ملفك عندما تجيب عن سؤال بحث.

    3. قرّر: هل يستحق وقتك؟

      نوع الموقعالقيمة المتوقعةالقرار المقترح
      توثيق تقني، API، أداة مطورينيقول كاتب الاقتراح إن أكثر استخدام للملف في التوثيق البرمجي، حيث تتبعه وكلاء البرمجةأضفه، ويفضل مع نسخ Markdown للصفحات
      SaaS بصفحات مساعدة وتسعير وسياساتفائدة محتملة لوكيل يبحث عن سياسة أو سعر، بلا دليل منشور على أثر في الزياراتاختياري؛ ساعة أو ساعتان ثم قِس
      متجر إلكترونيلا دليل على أثر في المبيعات أو الظهورأولوية منخفضة. صفحات المنتجات وخلاصة Merchant Center أولى
      مدونة أو موقع محتوىلا دليل على أثر في الاستشهاد أو الزياراتاختياري؛ لا تجعله بديلًا عن محتوى أصلي

      إن كانت منصتك تولّده تلقائيًا (قائمة llmstxt.org تذكر منصات مثل Mintlify وGitBook وWix وإضافة Yoast SEO لووردبريس)، فالتكلفة شبه صفر. المهم أن تراجع ما كُتب فيه، لأن الملف المولَّد آليًا قد يلخص موقعك بشكل خاطئ.

    4. اكتب الملف: حقائق يمكن التحقق منها، وروابط حية

      • الملخص في الاقتباس: جملتان أو ثلاث، تقول ما الموقع، ولمن، وما الذي يميزه، بحقائق موجودة على الموقع نفسه. لا صفات دعائية.
      • الروابط: اختر الصفحات التي يحتاجها من يسأل عن منتجك فعلًا: البدء، الأسعار، السياسات، مرجع الـ API، الأسئلة الشائعة. سطر واحد لكل رابط يقول متى يفيد.
      • اللغة: إن كان الموقع عربيًا، اكتب الملف بالعربية، واحفظه بترميز UTF-8، واذكر إن كانت هناك نسخة إنجليزية ورابطها.
      • الحجم: الاقتراح يريد الملف صغيرًا يدخل في سياق النموذج، والتفاصيل خلف الروابط.

      عن قسم «كيف تستشهد بنا» الذي تقترحه بعض القوالب: يمكنك كتابة سطر يوضح الاسم الرسمي والرابط، لكن لا يوجد توثيق من أي مساعد بأنه يلتزم به. عامله كمعلومة، لا كأمر.

    5. انشره وافحصه تقنيًا

      1. ارفع الملف، وافتح https://نطاقك/llms.txt في المتصفح: يجب أن يعود برمز 200 ونص مقروء لا صفحة HTML.
      2. تأكد أن الترميز UTF-8 وأن النص العربي لا يظهر رموزًا مكسورة.
      3. شغّل Lighthouse في Chrome DevTools وانظر فحص llms.txt: المطلوب ألا يعيد خطأ خادم.
      4. افتح كل رابط في الملف وتأكد أنه يعمل. الرابط الميت في ملف هدفه الإرشاد أسوأ من غيابه.
      5. سجّل تاريخ النشر، واربط تحديث الملف بتحديث صفحات الموقع: صفحة جديدة مهمة أو صفحة حُذفت = مراجعة الملف.
    6. اعرف هل يطلبه أحد: سجلات الخادم حسب وكيل المستخدم

      هذه هي الطريقة الوحيدة لتعرف أن الملف يُقرأ فعلًا. ابحث في سجلات الوصول عن الطلبات على /llms.txt، وجمّعها حسب «وكيل المستخدم» (User agent)، أي الاسم الذي يعرّف به الزائر الآلي نفسه. الأوامر جاهزة في قسم القوالب.

      • قارن بالأسماء الموثقة في جدول آخر الصفحة، واعتبر ما عداها «غير معروف».
      • لا تثق بالاسم وحده: أي أحد يستطيع أن يكتب GPTBot في طلبه. OpenAI وPerplexity تنشران نطاقات عناوين IP لزواحفها في ملفات JSON؛ قارن عناوين الطلبات بها قبل أن تعدّ الطلب حقيقيًا.
      • الطلب ليس استشهادًا: أن يقرأ ChatGPT-User الملف يعني أن مستخدمًا طلب شيئًا جعل المساعد يزور موقعك. لا يعني أن إجابته ذكرتك، ولا أن أحدًا نقر.
      • إن كان موقعك خلف CDN، فالخادم الأصلي قد لا يرى الطلبات؛ استخدم سجلات الـ CDN.
    7. قِس ما يهم: الزيارات، لا الملف

      الملف وسيلة؛ النتيجة التي تهمك زيارات وعملاء. ثبّت هذه القراءات قبل النشر وبعده بنفس طول الفترة:

      • GA4: في مجموعة القنوات الافتراضية قناة اسمها «AI Assistant» للزيارات القادمة من مساعدات مثل ChatGPT وGemini وCopilot. بحسب تعريف Google، زيارات AI Overviews وAI Mode لا تدخل فيها، بل تُحسب ضمن Organic Search.
      • ChatGPT: بحسب أسئلة الناشرين الشائعة عند OpenAI، يضيف ChatGPT تلقائيًا utm_source=chatgpt.com إلى روابط الإحالة من نتائج بحثه.
      • Search Console: زيارات ميزات Google التوليدية تُحسب ضمن تقرير الأداء في نوع البحث Web. وهناك تقرير «Generative AI» يعرض مرات الظهور في AI Overviews وAI Mode، ويُطرح تدريجيًا فقد لا يظهر لكل المواقع بعد.

      لو تغيّرت الأرقام بعد نشر الملف، لا تنسب التغيير له إلا إن استبعدت الأسباب الأخرى: محتوى جديد، موسم، حملة. بلا مجموعة مقارنة، أفضل ما تقوله: «لم نرَ أثرًا» أو «تزامن ولا نعرف السبب».

    مثال

    مثال افتراضي للتعليم — ليس عميلًا حقيقيًا، والأرقام مفترضة لشرح الطريقة

    منصة فواتير سعودية تضيفه، ومتجر مصري يؤجله

    المتجر المصري: 400 منتج، أغلب الطلبات دفع عند الاستلام، وفريق صغير. سأل: «هل نعمل llms.txt عشان نظهر في ChatGPT؟». بالجدول في الخطوة الثالثة: لا دليل على أثر في المبيعات، وجوجل لا يستخدمه. القرار: تأجيله، وصرف الوقت على وصف المنتجات وصورها وخلاصة Merchant Center التي يذكرها دليل Google للميزات التوليدية.

    منصة الفواتير السعودية: توثيق API بالعربية والإنجليزية على /docs، وعملاؤها مطورون يربطون أنظمتهم بها. كتب الفريق /docs/llms.txt في ساعتين: ملخص، و24 رابطًا، ونسخ Markdown لصفحات المرجع. ثم قرأ السجلات بعد 30 يومًا:

    وكيل المستخدمطلبات /docs/llms.txtملاحظة
    ChatGPT-User5855 من نطاقات IP التي تنشرها OpenAI، و3 لا تطابق فاستُبعدت
    Claude-User31طلبات يطلقها مستخدمون
    GPTBot26زاحف التدريب عند OpenAI
    Googlebot12Google قد يزحف لأي ملف، ولا يعامله معاملة خاصة
    غير معروف (أدوات، متصفحات، زواحف أخرى)85لا يُبنى عليها
    المجموع212

    بعد استبعاد الطلبات الثلاثة المشكوك فيها، بقي 55 طلبًا موثقًا من ChatGPT-User. هذا دليل على أن الملف يُقرأ، لا على أنه يجلب عملاء. في GA4، زيارات قناة AI Assistant لصفحات التوثيق كانت 140 جلسة في الثلاثين يومًا السابقة و151 بعدها (+7.9%). في الفترة نفسها نُشرت 6 صفحات توثيق جديدة، فلا يمكن نسبة الفرق للملف.

    القرار: إبقاء الملف لأن تكلفته صغيرة وهناك من يقرؤه، وعدم تقديمه في التقرير الشهري كـ«نمو». الأرقام مفترضة لشرح الطريقة.

    القالب والأداة

    هيكل ملف llms.txt لموقع عربي (انسخه وعدّله)

    استبدل ما بين الأقواس. كل جملة في الملخص يجب أن تكون موجودة على الموقع. احذف أي قسم لا ينطبق عليك، واحفظ الملف بترميز UTF-8.

    # [اسم الموقع أو المنتج]
    
    > [ما هو في جملة واحدة]. [لمن هو، وفي أي بلد أو سوق]. [حقيقة واحدة تميزه ويمكن التحقق منها على الموقع].
    
    - لغة الموقع الأساسية العربية، والنسخة الإنجليزية على [رابط النسخة الإنجليزية].
    - الأسعار بـ [العملة]، وتُحدَّث على صفحة الأسعار لا في هذا الملف.
    
    ## ابدأ هنا
    
    - [نظرة عامة](https://example.com/about): ما الذي نقدمه ولمن
    - [الأسعار](https://example.com/pricing): الباقات الحالية وما يشمله كل منها
    - [الأسئلة الشائعة](https://example.com/faq): الشحن، الدفع، الاسترجاع، الدعم
    
    ## التوثيق
    
    - [البدء السريع](https://example.com/docs/quickstart.md): أول ربط في 10 دقائق
    - [مرجع الـ API](https://example.com/docs/api.md): كل نقطة وصول ومعاملاتها
    
    ## السياسات
    
    - [سياسة الاسترجاع](https://example.com/policies/returns): المدة والشروط
    - [سياسة الخصوصية](https://example.com/policies/privacy)
    
    ## Optional
    
    - [المدونة](https://example.com/blog): مقالات وشروحات أقدم

    قالب تعليمات للذكاء الاصطناعي: جهّز مسودة llms.txt من صفحات موقعك

    الصقه في ChatGPT أو Claude أو Gemini مع قائمة صفحاتك. القالب يمنع النموذج من اختراع صفات أو أرقام، ويطلب منه أن يسألك عن الناقص.

    أنت محرر تقني. جهّز مسودة ملف llms.txt لموقعي وفق الاقتراح المنشور في llmstxt.org: عنوان H1 باسم الموقع، ثم اقتباس بملخص قصير، ثم فقرات اختيارية بلا عناوين، ثم أقسام H2 كل منها قائمة روابط بالشكل [الاسم](الرابط): ملاحظة، وقسم أخير اسمه Optional للروابط الثانوية.
    
    بيانات موقعي:
    - النطاق: [ ]
    - ما هو الموقع في جملة: [ ]
    - لمن، وفي أي سوق: [ ]
    - لغة الموقع، وهل توجد نسخة بلغة أخرى ورابطها: [ ]
    - الصفحات المهمة (الرابط + ماذا فيها): [ ]
    - هل توجد نسخ Markdown للصفحات؟ [نعم/لا]
    
    القواعد:
    1. لا تكتب أي معلومة غير موجودة في البيانات أعلاه. إن احتجت معلومة ناقصة (مثل وصف صفحة أو لغة الموقع)، اسألني عنها قبل الكتابة.
    2. لا صفات دعائية مثل «الأفضل» أو «الرائد». كل جملة في الملخص يجب أن أستطيع إثباتها بصفحة على موقعي؛ ضع بجانب كل جملة رقم الصفحة التي تثبتها في قائمة منفصلة بعد الملف.
    3. لا تكتب أي وعد بأن الملف يحسن الظهور في Google أو في إجابات المساعدات.
    4. اجعل الملف قصيرًا: الملخص جملتان أو ثلاث، وسطر واحد لكل رابط.
    
    بعد الملف اكتب:
    - قائمة بالروابط التي تحتاج أن أتحقق أنها تعمل.
    - الجمل التي لم تجد لها دليلًا في بياناتي، إن وُجدت.

    أوامر قراءة سجلات الخادم: من يطلب llms.txt؟

    لسجلات Nginx أو Apache بالصيغة المعتادة (Combined log format)، حيث وكيل المستخدم آخر حقل بين علامتي تنصيص. غيّر اسم الملف access.log لمسار سجلاتك. في صيغ أخرى أو في لوحات الـ CDN، ابحث بالمسار ووكيل المستخدم نفسيهما.

    # 1) كم طلبًا على /llms.txt، مجمّعة حسب وكيل المستخدم
    grep '"GET /llms.txt' access.log | awk -F'"' '{print $6}' | sort | uniq -c | sort -rn
    
    # 2) الزواحف الموثقة فقط، على الموقع كله (لا على الملف وحده)
    grep -oE 'GPTBot|OAI-SearchBot|ChatGPT-User|ClaudeBot|Claude-User|Claude-SearchBot|PerplexityBot|Perplexity-User|Googlebot' access.log | sort | uniq -c | sort -rn
    
    # 3) عناوين IP التي طلبت الملف باسم ChatGPT-User، لمقارنتها بالنطاقات المنشورة
    grep '"GET /llms.txt' access.log | grep 'ChatGPT-User' | awk '{print $1}' | sort | uniq -c | sort -rn
    
    # نطاقات IP المنشورة للمقارنة:
    # OpenAI: https://openai.com/chatgpt-user.json و https://openai.com/searchbot.json و https://openai.com/gptbot.json
    # Perplexity: https://www.perplexity.com/perplexitybot.json و https://www.perplexity.com/perplexity-user.json

    الزواحف الموثقة وما يعنيه منع كل منها

    وكيل المستخدمالشركةما يفعله بحسب توثيقهاأثر منعه في robots.txt
    OAI-SearchBotOpenAIإظهار المواقع في بحث ChatGPTقد تخرج صفحاتك من ملخصات ChatGPT search
    GPTBotOpenAIجمع محتوى قد يُستخدم في تدريب النماذجإشارة بعدم استخدام محتواك في التدريب
    ChatGPT-UserOpenAIزيارات يطلقها مستخدم في ChatGPTOpenAI تقول إن robots.txt قد لا ينطبق عليه
    ClaudeBotAnthropicجمع محتوى قد يُستخدم في التدريباستبعاد محتواك المستقبلي من التدريب
    Claude-UserAnthropicزيارات لإجابة سؤال مستخدمقد يقل ظهورك في البحث الذي يطلبه المستخدم
    Claude-SearchBotAnthropicفهرسة لتحسين نتائج بحث Claudeقد يقل ظهورك ودقته في نتائج البحث
    PerplexityBotPerplexityإظهار المواقع وربطها في نتائج Perplexityقد تخرج من نتائج Perplexity
    Perplexity-UserPerplexityزيارات لإجابة سؤال مستخدمPerplexity تقول إنه يتجاهل robots.txt عادةً
    Google-ExtendedGoogleرمز تحكم فقط، بلا زاحف مستقليمنع استخدام المحتوى لتدريب Gemini والإسناد في تطبيقات Gemini، ولا يؤثر على بحث Google

    القاعدة: زواحف «البحث» تجلب الظهور والإحالات، وزواحف «التدريب» لا تجلب زيارات مباشرة. قرر كلًا منها وحده.

    كيف تعرف أنها نجحت

    اكتب في جدول أسبوعي، من تاريخ النشر:

    • طلبات /llms.txt حسب وكيل المستخدم، بعد استبعاد ما لا يطابق نطاقات IP المنشورة. هذا يقيس «هل يُقرأ الملف»، لا أكثر.
    • جلسات قناة AI Assistant في GA4، وعدد الزيارات التي تحمل utm_source=chatgpt.com، مقارنة بالفترة نفسها قبل النشر.
    • Search Console: نقرات ومرات ظهور نوع البحث Web، وتقرير Generative AI إن كان متاحًا لموقعك.
    • ما تغيّر في الموقع في الفترة نفسها: صفحات جديدة، حملات، مواسم.

    الحكم الصادق بعد 60 يومًا يكون واحدًا من ثلاثة: «يُقرأ ولا أثر ظاهر في الزيارات»، أو «لا يُقرأ»، أو «أثر محتمل لا يمكن فصله عن تغييرات أخرى». لم نجد دراسة منشورة تثبت أن الملف يزيد الاستشهادات أو الزيارات.

    أخطاء شائعة وحدود الاستنتاج

    • بيعه للعميل أو للإدارة على أنه «SEO للذكاء الاصطناعي». Google يقول صراحة إن بحثه يتجاهله، ولا مساعد آخر يوثّق أنه يستخدمه للبحث أو الاستشهاد.
    • الظن أن قسم «كيف تستشهد بنا» يتحكم في طريقة ذكر المساعدات لك. لا يوجد توثيق يقول ذلك.
    • الخلط بينه وبين robots.txt. llms.txt لا يمنع الزحف ولا التدريب. المنع يكون في robots.txt بأسماء الزواحف، وكل منع له ثمن: منع OAI-SearchBot مثلًا قد يُخرج صفحاتك من ملخصات ChatGPT search بحسب OpenAI.
    • ملف مولَّد آليًا لم يراجعه أحد، فيه ملخص خاطئ أو روابط ميتة. إن كان هدف الملف الإرشاد، فالإرشاد الخاطئ أسوأ من غيابه.
    • الثقة في اسم وكيل المستخدم دون التحقق من عنوان IP، فتُحسب طلبات منتحلة كقراءات حقيقية.
    • نسبة أي تحسن في الزيارات للملف دون استبعاد الأسباب الأخرى، أو اعتبار طلب الملف استشهادًا.
    • هذا الدليل يصف حالة التوثيق في 27 سبتمبر 2026. الاقتراح والمساعدات تتغير بسرعة؛ راجع المصادر قبل قرار كبير.

    المصادر

    1. llms.txt Generator Prompt — محمود عمر، Growth Marketing OS — القالب الأصلي بالإنجليزية. النسخة العربية أعيد بناؤها: حُذف وعد «يجعل موقعك قابلًا للاستشهاد في ChatGPT وClaude وPerplexity» وفكرة أن قسم الاستشهاد يتحكم في الإسناد لعدم وجود توثيق، وأضيف موقف Google الرسمي وما توثقه كل شركة، وطريقة قياس بسجلات الخادم وGA4.
    2. llmstxt.org — The /llms.txt file, v2 — الاقتراح نفسه: الكاتب Jeremy Howard، نُشر 3 سبتمبر 2024 وحُدّث في 10 أغسطس 2026. يشرح الصيغة والمكان ونسخ Markdown وروابط rel، ويقول إن الاستخدام الأكثر في التوثيق البرمجي وإن الاستخدام عند الإجابة لا التدريب. فيه قائمة منصات تولّد الملف.
    3. llmstxt.org — Changes (v2, August 2026) — ما تغيّر في النسخة الثانية: روابط rel للاكتشاف، وقبول صيغتي page.md وpage.html.md، وتعريف تغطية المسارات الفرعية، وإلغاء المعنى الآلي لقسم Optional.
    4. Google Search Central — Optimizing your website for generative AI features on Google Search — لا تحتاج ملفات قابلة للقراءة الآلية أو ملفات نصية للذكاء الاصطناعي أو Markdown للظهور في بحث Google وميزاته التوليدية لأن بحث Google لا يستخدمها؛ إنشاء llms.txt لا يضر ولا ينفع الظهور. يذكر أيضًا تقرير Generative AI في Search Console وخلاصات Merchant Center.
    5. Google Search Central — AI features and your website — لا متطلبات إضافية ولا تحسينات خاصة للظهور في AI Overviews وAI Mode، ولا حاجة لملفات نصية للذكاء الاصطناعي. زيارات هذه الميزات تُحسب ضمن تقرير الأداء في نوع البحث Web. آخر تحديث للصفحة: 10 ديسمبر 2025.
    6. Search Console Help — Generative AI performance report — يعرض مرات ظهور روابط موقعك في AI Overviews وAI Mode حسب الصفحة والبلد والجهاز والتاريخ. يُطرح تدريجيًا ولا يتوفر لكل المواقع.
    7. Chrome for Developers — Lighthouse: llms.txt audit — فحص ضمن مجموعة Agentic browsing: يفشل عند خطأ خادم، ويُعد غير منطبق عند 404 لأن الملف اختياري. لا يذكر أي أثر على بحث Google. آخر تحديث: 5 مايو 2026.
    8. OpenAI — Overview of OpenAI Crawlers — OAI-SearchBot لإظهار المواقع في بحث ChatGPT، وGPTBot لتدريب النماذج، وChatGPT-User لأفعال يطلقها المستخدم وقد لا تنطبق عليه robots.txt. روابط نطاقات IP لكل منها. لا ذكر لقراءة llms.txt.
    9. OpenAI Help Center — Publishers and Developers FAQ — لتظهر في ملخصات ChatGPT search لا تمنع OAI-SearchBot. ChatGPT يضيف utm_source=chatgpt.com إلى روابط الإحالة تلقائيًا.
    10. Anthropic — Does Anthropic crawl data from the web, and how can site owners block the crawler? — ClaudeBot للتدريب، وClaude-User لطلبات المستخدمين، وClaude-SearchBot لتحسين نتائج البحث. تحترم robots.txt وCrawl-delay. منع Claude-User أو Claude-SearchBot قد يقلل ظهورك في بحث Claude. لا ذكر لـ llms.txt.
    11. Perplexity — Perplexity Crawlers — PerplexityBot لإظهار المواقع وربطها في نتائج Perplexity، وPerplexity-User لطلبات المستخدمين ويتجاهل robots.txt عادةً. روابط نطاقات IP. لا ذكر لقراءة llms.txt.
    12. Google — Google's common crawlers (Google-Extended) — Google-Extended رمز في robots.txt بلا وكيل مستخدم مستقل، يتحكم في استخدام المحتوى لتدريب Gemini والإسناد في تطبيقات Gemini، ولا يؤثر على الظهور في بحث Google.
    13. Google Analytics Help — Default channel group — قناة AI Assistant للزيارات من مصادر مثل ChatGPT وGemini وDeepseek وCopilot وGrok، ولا تشمل AI Overviews وAI Mode التي تُحسب في Organic Search.

    عن هذه المادة

    المؤلف
    محمود عمر (النسخة الإنجليزية الأصلية)
    الإعداد العربي
    Claude (مساعد ذكاء اصطناعي) بتكليف من محمود عمر
    المراجعة
    Claude: مراجعة الأرقام والحسابات والمصادر الأصلية
    آخر مراجعة فعلية
    الأصل
    llms.txt Generator Prompt — Growth Marketing OS، ترخيص MIT. النسخة العربية معدّلة للسوق وليست ترجمة حرفية.

    لاحظت خطأ أو رقمًا تغيّر؟ أرسل لنا التصحيح.