البيانات المنظمة للمؤسسة والشخص (Organization وPerson) وفق توثيق Google
قالب JSON-LD لموقع عربي وفق توثيق Google: المؤسسة واسم الموقع وصفحة الكاتب، بالاسم العربي واللاتيني وsameAs وطرق الفحص، دون وعود بظهور في الذكاء الاصطناعي.
ما هو llms.txt وما لا يفعله: Google يتجاهله ولا مساعد يوثّق قراءته للاستشهاد. متى يستحق وقتك، وقالب عربي، وكيف تعرف من سجلات الخادم هل يطلبه أحد.
ملف llms.txt اقتراح مفتوح، لا معيار ملزم، نشره Jeremy Howard في 3 سبتمبر 2024 وحدّثه إلى نسخة ثانية في أغسطس 2026. الفكرة: ملف Markdown قصير على /llms.txt يعطي نماذج الذكاء الاصطناعي والوكلاء (AI agents) ملخصًا للموقع وروابط منتقاة لأهم صفحاته، حتى لا يضطر الوكيل لقراءة صفحات مليئة بالقوائم والسكربتات.
ما لا يفعله: لا يرفع ترتيبك في Google ولا يُدخلك في AI Overviews. دليل Google الرسمي يقول إن بحث Google لا يستخدم هذه الملفات أصلًا، وإن وجودها لا يضر ولا ينفع. ولم نجد في توثيق OpenAI أو Anthropic أو Perplexity لزواحفها ما يقول إنها تقرأ الملف للبحث أو للاستشهاد بالمصادر (راجعنا التوثيق في 27 سبتمبر 2026).
قاعدة القرار: إن كان موقعك توثيقًا تقنيًا أو أداة للمطورين، فالملف رخيص ومفيد لوكلاء البرمجة الذين يقرؤون التوثيق. في غير ذلك، كمتجر أو مدونة، هو اختياري ومنخفض الأولوية: أضفه إن كان سيأخذ ساعة، ولا تتوقع منه زيارات أو استشهادات، وقِس في سجلات الخادم هل يطلبه أحد أصلًا.
بحسب الاقتراح في llmstxt.org، الملف نص Markdown اسمه llms.txt، يوضع في جذر الموقع /llms.txt أو في أي مسار فرعي مثل /docs/llms.txt فيغطي الصفحات تحت هذا المسار. ترتيب أقسامه:
[الاسم](الرابط): ملاحظة اختيارية.Optional بالعرف، لروابط ثانوية يمكن للوكيل تخطيها.ويقترح أيضًا أن توفّر نسخة Markdown نظيفة من الصفحات المهمة على الرابط نفسه مع .md. النسخة الثانية (أغسطس 2026) أضافت روابط rel="alternate" type="text/markdown" وrel="describedby" ليجد الوكيل هذه الملفات دون تخمين.
الفرق عن robots.txt: robots.txt يقول للزواحف ما المسموح بزحفه. llms.txt لا يسمح ولا يمنع شيئًا؛ هو دليل قراءة يطلبه الوكيل عند الحاجة. وبحسب كاتب الاقتراح، الاستخدام المتوقع والفعلي عند «الاستدلال» (Inference) أي وقت الإجابة، لا عند تدريب النماذج.
هذا ما تقوله الوثائق الرسمية كما قرأناها في 27 سبتمبر 2026. «لا يوجد توثيق» لا يعني «مستحيل»، بل يعني أنك لا تستطيع البناء عليه:
| الجهة | ماذا تقول وثائقها الرسمية عن llms.txt |
|---|---|
| بحث Google (ومنه AI Overviews وAI Mode) | لا يستخدمه. لا تحتاج ملفات نصية خاصة بالذكاء الاصطناعي ولا Markdown للظهور، ووجود الملف لا يضر ولا ينفع |
| Chrome Lighthouse | فحص ضمن مجموعة «التصفح بالوكلاء» (Agentic browsing) يفشل فقط إن أعاد الملف خطأ خادم، ويُعد «لا ينطبق» إن لم يوجد. لا علاقة له بترتيب Google |
| OpenAI (ChatGPT) | صفحة زواحفها تشرح OAI-SearchBot وGPTBot وChatGPT-User، ولا تذكر قراءة llms.txt للبحث أو للاستشهاد |
| Anthropic (Claude) | صفحة زواحفها تشرح ClaudeBot وClaude-User وClaude-SearchBot، ولا تذكر llms.txt |
| Perplexity | صفحة زواحفها تشرح PerplexityBot وPerplexity-User، ولا تذكر قراءة llms.txt |
| تطبيق Gemini | لم نجد توثيقًا رسميًا عن قراءته |
ملاحظة تسبب لبسًا شائعًا: OpenAI وAnthropic وGoogle (لتوثيق Gemini API) وPerplexity تنشر ملفات llms.txt لتوثيقها التقني. هذا يخدم المطورين الذين يوجّهون أدواتهم إليها، ولا يعني أن مساعداتها تقرأ ملفك عندما تجيب عن سؤال بحث.
| نوع الموقع | القيمة المتوقعة | القرار المقترح |
|---|---|---|
| توثيق تقني، API، أداة مطورين | يقول كاتب الاقتراح إن أكثر استخدام للملف في التوثيق البرمجي، حيث تتبعه وكلاء البرمجة | أضفه، ويفضل مع نسخ Markdown للصفحات |
| SaaS بصفحات مساعدة وتسعير وسياسات | فائدة محتملة لوكيل يبحث عن سياسة أو سعر، بلا دليل منشور على أثر في الزيارات | اختياري؛ ساعة أو ساعتان ثم قِس |
| متجر إلكتروني | لا دليل على أثر في المبيعات أو الظهور | أولوية منخفضة. صفحات المنتجات وخلاصة Merchant Center أولى |
| مدونة أو موقع محتوى | لا دليل على أثر في الاستشهاد أو الزيارات | اختياري؛ لا تجعله بديلًا عن محتوى أصلي |
إن كانت منصتك تولّده تلقائيًا (قائمة llmstxt.org تذكر منصات مثل Mintlify وGitBook وWix وإضافة Yoast SEO لووردبريس)، فالتكلفة شبه صفر. المهم أن تراجع ما كُتب فيه، لأن الملف المولَّد آليًا قد يلخص موقعك بشكل خاطئ.
عن قسم «كيف تستشهد بنا» الذي تقترحه بعض القوالب: يمكنك كتابة سطر يوضح الاسم الرسمي والرابط، لكن لا يوجد توثيق من أي مساعد بأنه يلتزم به. عامله كمعلومة، لا كأمر.
https://نطاقك/llms.txt في المتصفح: يجب أن يعود برمز 200 ونص مقروء لا صفحة HTML.هذه هي الطريقة الوحيدة لتعرف أن الملف يُقرأ فعلًا. ابحث في سجلات الوصول عن الطلبات على /llms.txt، وجمّعها حسب «وكيل المستخدم» (User agent)، أي الاسم الذي يعرّف به الزائر الآلي نفسه. الأوامر جاهزة في قسم القوالب.
الملف وسيلة؛ النتيجة التي تهمك زيارات وعملاء. ثبّت هذه القراءات قبل النشر وبعده بنفس طول الفترة:
utm_source=chatgpt.com إلى روابط الإحالة من نتائج بحثه.لو تغيّرت الأرقام بعد نشر الملف، لا تنسب التغيير له إلا إن استبعدت الأسباب الأخرى: محتوى جديد، موسم، حملة. بلا مجموعة مقارنة، أفضل ما تقوله: «لم نرَ أثرًا» أو «تزامن ولا نعرف السبب».
مثال افتراضي للتعليم — ليس عميلًا حقيقيًا، والأرقام مفترضة لشرح الطريقة
المتجر المصري: 400 منتج، أغلب الطلبات دفع عند الاستلام، وفريق صغير. سأل: «هل نعمل llms.txt عشان نظهر في ChatGPT؟». بالجدول في الخطوة الثالثة: لا دليل على أثر في المبيعات، وجوجل لا يستخدمه. القرار: تأجيله، وصرف الوقت على وصف المنتجات وصورها وخلاصة Merchant Center التي يذكرها دليل Google للميزات التوليدية.
منصة الفواتير السعودية: توثيق API بالعربية والإنجليزية على /docs، وعملاؤها مطورون يربطون أنظمتهم بها. كتب الفريق /docs/llms.txt في ساعتين: ملخص، و24 رابطًا، ونسخ Markdown لصفحات المرجع. ثم قرأ السجلات بعد 30 يومًا:
| وكيل المستخدم | طلبات /docs/llms.txt | ملاحظة |
|---|---|---|
| ChatGPT-User | 58 | 55 من نطاقات IP التي تنشرها OpenAI، و3 لا تطابق فاستُبعدت |
| Claude-User | 31 | طلبات يطلقها مستخدمون |
| GPTBot | 26 | زاحف التدريب عند OpenAI |
| Googlebot | 12 | Google قد يزحف لأي ملف، ولا يعامله معاملة خاصة |
| غير معروف (أدوات، متصفحات، زواحف أخرى) | 85 | لا يُبنى عليها |
| المجموع | 212 |
بعد استبعاد الطلبات الثلاثة المشكوك فيها، بقي 55 طلبًا موثقًا من ChatGPT-User. هذا دليل على أن الملف يُقرأ، لا على أنه يجلب عملاء. في GA4، زيارات قناة AI Assistant لصفحات التوثيق كانت 140 جلسة في الثلاثين يومًا السابقة و151 بعدها (+7.9%). في الفترة نفسها نُشرت 6 صفحات توثيق جديدة، فلا يمكن نسبة الفرق للملف.
القرار: إبقاء الملف لأن تكلفته صغيرة وهناك من يقرؤه، وعدم تقديمه في التقرير الشهري كـ«نمو». الأرقام مفترضة لشرح الطريقة.
استبدل ما بين الأقواس. كل جملة في الملخص يجب أن تكون موجودة على الموقع. احذف أي قسم لا ينطبق عليك، واحفظ الملف بترميز UTF-8.
# [اسم الموقع أو المنتج] > [ما هو في جملة واحدة]. [لمن هو، وفي أي بلد أو سوق]. [حقيقة واحدة تميزه ويمكن التحقق منها على الموقع]. - لغة الموقع الأساسية العربية، والنسخة الإنجليزية على [رابط النسخة الإنجليزية]. - الأسعار بـ [العملة]، وتُحدَّث على صفحة الأسعار لا في هذا الملف. ## ابدأ هنا - [نظرة عامة](https://example.com/about): ما الذي نقدمه ولمن - [الأسعار](https://example.com/pricing): الباقات الحالية وما يشمله كل منها - [الأسئلة الشائعة](https://example.com/faq): الشحن، الدفع، الاسترجاع، الدعم ## التوثيق - [البدء السريع](https://example.com/docs/quickstart.md): أول ربط في 10 دقائق - [مرجع الـ API](https://example.com/docs/api.md): كل نقطة وصول ومعاملاتها ## السياسات - [سياسة الاسترجاع](https://example.com/policies/returns): المدة والشروط - [سياسة الخصوصية](https://example.com/policies/privacy) ## Optional - [المدونة](https://example.com/blog): مقالات وشروحات أقدم
الصقه في ChatGPT أو Claude أو Gemini مع قائمة صفحاتك. القالب يمنع النموذج من اختراع صفات أو أرقام، ويطلب منه أن يسألك عن الناقص.
أنت محرر تقني. جهّز مسودة ملف llms.txt لموقعي وفق الاقتراح المنشور في llmstxt.org: عنوان H1 باسم الموقع، ثم اقتباس بملخص قصير، ثم فقرات اختيارية بلا عناوين، ثم أقسام H2 كل منها قائمة روابط بالشكل [الاسم](الرابط): ملاحظة، وقسم أخير اسمه Optional للروابط الثانوية. بيانات موقعي: - النطاق: [ ] - ما هو الموقع في جملة: [ ] - لمن، وفي أي سوق: [ ] - لغة الموقع، وهل توجد نسخة بلغة أخرى ورابطها: [ ] - الصفحات المهمة (الرابط + ماذا فيها): [ ] - هل توجد نسخ Markdown للصفحات؟ [نعم/لا] القواعد: 1. لا تكتب أي معلومة غير موجودة في البيانات أعلاه. إن احتجت معلومة ناقصة (مثل وصف صفحة أو لغة الموقع)، اسألني عنها قبل الكتابة. 2. لا صفات دعائية مثل «الأفضل» أو «الرائد». كل جملة في الملخص يجب أن أستطيع إثباتها بصفحة على موقعي؛ ضع بجانب كل جملة رقم الصفحة التي تثبتها في قائمة منفصلة بعد الملف. 3. لا تكتب أي وعد بأن الملف يحسن الظهور في Google أو في إجابات المساعدات. 4. اجعل الملف قصيرًا: الملخص جملتان أو ثلاث، وسطر واحد لكل رابط. بعد الملف اكتب: - قائمة بالروابط التي تحتاج أن أتحقق أنها تعمل. - الجمل التي لم تجد لها دليلًا في بياناتي، إن وُجدت.
لسجلات Nginx أو Apache بالصيغة المعتادة (Combined log format)، حيث وكيل المستخدم آخر حقل بين علامتي تنصيص. غيّر اسم الملف access.log لمسار سجلاتك. في صيغ أخرى أو في لوحات الـ CDN، ابحث بالمسار ووكيل المستخدم نفسيهما.
# 1) كم طلبًا على /llms.txt، مجمّعة حسب وكيل المستخدم
grep '"GET /llms.txt' access.log | awk -F'"' '{print $6}' | sort | uniq -c | sort -rn
# 2) الزواحف الموثقة فقط، على الموقع كله (لا على الملف وحده)
grep -oE 'GPTBot|OAI-SearchBot|ChatGPT-User|ClaudeBot|Claude-User|Claude-SearchBot|PerplexityBot|Perplexity-User|Googlebot' access.log | sort | uniq -c | sort -rn
# 3) عناوين IP التي طلبت الملف باسم ChatGPT-User، لمقارنتها بالنطاقات المنشورة
grep '"GET /llms.txt' access.log | grep 'ChatGPT-User' | awk '{print $1}' | sort | uniq -c | sort -rn
# نطاقات IP المنشورة للمقارنة:
# OpenAI: https://openai.com/chatgpt-user.json و https://openai.com/searchbot.json و https://openai.com/gptbot.json
# Perplexity: https://www.perplexity.com/perplexitybot.json و https://www.perplexity.com/perplexity-user.json| وكيل المستخدم | الشركة | ما يفعله بحسب توثيقها | أثر منعه في robots.txt |
|---|---|---|---|
| OAI-SearchBot | OpenAI | إظهار المواقع في بحث ChatGPT | قد تخرج صفحاتك من ملخصات ChatGPT search |
| GPTBot | OpenAI | جمع محتوى قد يُستخدم في تدريب النماذج | إشارة بعدم استخدام محتواك في التدريب |
| ChatGPT-User | OpenAI | زيارات يطلقها مستخدم في ChatGPT | OpenAI تقول إن robots.txt قد لا ينطبق عليه |
| ClaudeBot | Anthropic | جمع محتوى قد يُستخدم في التدريب | استبعاد محتواك المستقبلي من التدريب |
| Claude-User | Anthropic | زيارات لإجابة سؤال مستخدم | قد يقل ظهورك في البحث الذي يطلبه المستخدم |
| Claude-SearchBot | Anthropic | فهرسة لتحسين نتائج بحث Claude | قد يقل ظهورك ودقته في نتائج البحث |
| PerplexityBot | Perplexity | إظهار المواقع وربطها في نتائج Perplexity | قد تخرج من نتائج Perplexity |
| Perplexity-User | Perplexity | زيارات لإجابة سؤال مستخدم | Perplexity تقول إنه يتجاهل robots.txt عادةً |
| Google-Extended | رمز تحكم فقط، بلا زاحف مستقل | يمنع استخدام المحتوى لتدريب Gemini والإسناد في تطبيقات Gemini، ولا يؤثر على بحث Google |
القاعدة: زواحف «البحث» تجلب الظهور والإحالات، وزواحف «التدريب» لا تجلب زيارات مباشرة. قرر كلًا منها وحده.
اكتب في جدول أسبوعي، من تاريخ النشر:
utm_source=chatgpt.com، مقارنة بالفترة نفسها قبل النشر.الحكم الصادق بعد 60 يومًا يكون واحدًا من ثلاثة: «يُقرأ ولا أثر ظاهر في الزيارات»، أو «لا يُقرأ»، أو «أثر محتمل لا يمكن فصله عن تغييرات أخرى». لم نجد دراسة منشورة تثبت أن الملف يزيد الاستشهادات أو الزيارات.
لاحظت خطأ أو رقمًا تغيّر؟ أرسل لنا التصحيح.