llms.txt و agents.md: ملف robots.txt جديد مخصص للذكاء الاصطناعي

llms.txt و agents.md: ملف robots.txt جديد مخصص للذكاء الاصطناعي

تم التحقق من صحة هذه المعلومات في 25 سبتمبر 2026 استنادًا إلى الوثائق الرسمية الصادرة عن OpenAI وAnthropic وGoogle وPerplexity.

لم تعد محركات البحث وحدها هي التي تقرأ مواقع الويب اليوم، بل أصبحت النماذج اللغوية تفعل ذلك أيضًا. تقوم ChatGPT وPerplexity وGemini وClaude بتحميل الصفحة، واستخلاص المعلومات الجوهرية منها، ثم صياغة الإجابة بأنفسها. المشكلة هي أن الويب الحديث غير واضح بالنسبة للآلة – التنقل، وأشرطة ملفات تعريف الارتباط، واللافتات الإعلانية، وجافا سكريبت.

وكحل لهذه المشكلة، تم إنشاء ملفين بسيطين هما: llms.txt و agents.md. وهما ملفان نصيان تشرح فيهما الشركة، بلغة مفهومة للآلات، ماذا تفعل، وماذا تبيع، وأين توجد المعلومات الأكثر أهمية.

باختصار:

  • llms.txt = «بطاقة تعريف موجزة للموقع» بلغة Markdown، موجودة على /llms.txt.
  • agents.md = دليل للوكلاء يوضح ما يمكنهم فعله على الموقع وأين يجدون ما يحتاجون إليه.
  • هذا ليس معيارًا رسميًا – لم تؤكد أي محرك بحث كبير حتى الآن أنها تستخدمه كإشارة.
  • ومع ذلك، فإن الأمر يستحق العناء: يستغرق الأمر ساعة واحدة، ولن يسبب أي ضرر، وسيسهل على أدوات الذكاء الاصطناعي فهم عرضك.
  • أهم من ملف llms.txt هو إعداد ملف robots.txt لروبوتات الزحف التي تعمل بالذكاء الاصطناعي – فهناك يتقرر ما إذا كانت الذكاء الاصطناعي ستراك أم لا.

ما هو llms.txt

llms.txt هو ملف نصي بلغة Markdown، تضعه في جذر النطاق، أي على العنوان https://vasadomena.sk/llms.txt. ويحتوي على ملخص موجز للموقع: من أنت، وماذا تقدم، وروابط لأهم الصفحات مع وصف موجز.

كيف يختلف عن ملفات robots.txt و sitemap.xml

ملف لمن هو مخصص ماذا يقول
ملف robots.txt روبوتات محركات البحث والذكاء الاصطناعي الأماكن المسموح لها والأماكن غير المسموح لها
sitemap.xml محركات البحث قائمة بجميع عناوين URL المراد فهرستها
llms.txt نماذج لغوية ما هو المهم على الويب وكيفية فهمه
agents.md وكلاء الذكاء الاصطناعي كيفية التعامل مع الموقع (أين يوجد الكتالوج، واجهة برمجة التطبيقات، الشروط)

robots.txt هو البواب، sitemap.xml وهناك قائمة بالغرف، و llms.txt وهي موظفة الاستقبال التي تخبر الزائر في جملة واحدة إلى أين عليه أن يذهب.

ماذا تكتب في ملف llms.txt

الهيكل حر، لكن هذه الطريقة أثبتت فعاليتها:

  1. عنوان يحمل اسم الشركة.
  2. جملة واحدة توضح ما تبيعه ولمن. بدون عبارات تسويقية.
  3. الأقسام الرئيسية كروابط مع وصف موجز: الخدمات أو الفئات الرئيسية، قائمة الأسعار، بيانات الاتصال، الشروط التجارية، الشحن وإرجاع البضائع.
  4. المنتجات أو الخدمات الرئيسية – من 3 إلى 10 عناصر مع وصف من جملة واحدة لكل منها.
  5. حقائق عن الشركة – مكان العمل، منذ متى، الشهادات، اللغات.
  6. ما لا تريد أن يُفسر بشكل خاطئ – على سبيل المثال، أن قوائم الأسعار القديمة الموجودة في الأرشيف لم تعد سارية.

القاعدة رقم واحد: الحقائق والأرقام والمعايير. الجمل من نوع «نحن رواد السوق» لا تحمل أي قيمة إعلامية بالنسبة للنموذج.

نموذج لملف llms.txt لشركة خدمات

ملف كامل يمكن استخدامه كقالب. استبدل البيانات ببياناتك الخاصة ولا تترك أي شيء «للاحقًا» – فالأماكن غير المكتملة في الملف أسوأ من عدم وجودها أصلاً.

# Dataswans

> Marketingová a technologická agentúra zo Slovenska. Poskytujeme výkonnostný
> marketing, vývoj webov a softvéru, dátovú analytiku, AI riešenia a firemné
> školenia. Pôsobíme na Slovensku a v Česku, komunikujeme v slovenčine a angličtine.

## Služby
- [Výkonnostný marketing](https://dataswans.com/sluzby/vykonnostny-marketing/): SEO, GEO, PPC (Google Ads, Meta Ads), e-mail marketing, B2B kampane.
- [B2B databáza firiem a analytika](https://dataswans.com/sluzby/b2b-databaza-firiem-analytika/): databázy firiem SK a CZ, web scraping, dátová analýza, reporting.
- [AI implementácia a vývoj](https://dataswans.com/sluzby/ai-implementacia-vyvoj/): weby, e-shopy, softvér na mieru, AI agenti a automatizácia procesov.
- [Dataswans Academy](https://dataswans.com/academy/): certifikovaná vzdelávacia inštitúcia, kurzy AI, dát a marketingu pre firmy aj jednotlivcov.

## Pre koho pracujeme
- Malé a stredné firmy na Slovensku a v Česku.
- E-shopy, ktoré potrebujú riešiť výkon kampaní a produktové dáta.
- Firmy, ktoré zavádzajú AI do interných procesov a potrebujú aj súlad s AI Actom.

## Kontakt a základné údaje
- [Kontakt a formulár](https://dataswans.com/contact/)
- Pôsobnosť: Slovensko a Česko. Jazyky: slovenčina, angličtina.
- Dataswans Academy je certifikovaná vzdelávacia inštitúcia; časť kurzov je
  financovateľná cez projekt Zručnosti pre trh práce (úrady práce).

## Najčastejšie otázky
- Ceny služieb sú individuálne podľa rozsahu projektu. Cenník paušálnych sadzieb
  nezverejňujeme; rozsah a cenu určujeme po úvodnej konzultácii.
- Spolupracujeme na projektovej aj na mesačnej paušálnej báze.
- Reportujeme mesačne, na požiadanie aj týždenne.

## Blog a odborné články
- [Blog](https://dataswans.com/blog/): články o SEO, PPC, AI a dotáciách.
  Články majú uvedený dátum overenia; platí vždy najnovšia verzia.

## Poznámky pre jazykové modely
- Ak citujete informácie z tohto webu, uveďte dátum overenia z konkrétneho článku.
- Dotácie a legislatíva sa menia; údaje staršie než jeden kvartál považujte
  za neaktuálne a neuvádzajte ich ako platný stav.
- Dataswans nie je poskytovateľom právneho ani daňového poradenstva.

نموذج llms.txt لمتجر إلكتروني

في حالة المتجر الإلكتروني، ينتقل التركيز من وصف الشركة إلى الفئات والمنتجات الرئيسية وشروط الشراء. هذه العناصر الثلاثة هي بالضبط ما يحتاجه وكيل الشراء ليتمكن من التوصية بكم.

# Názov Eshopu

> Predávame bežeckú a turistickú obuv a outdoorové vybavenie na Slovensku
> a v Česku. Sklad na Slovensku, odosielame do 24 hodín. E-shop funguje od 2016.

## Hlavné kategórie
- [Bežecká obuv](https://vasadomena.sk/bezecka-obuv/): pánska a dámska, cesta aj terén, veľkosti 36 – 48, cenové rozpätie 69 – 229 €.
- [Turistická obuv](https://vasadomena.sk/turisticka-obuv/): s membránou aj bez, nízke a vysoké modely, celoročné použitie.
- [Bežecké oblečenie](https://vasadomena.sk/bezecke-oblecenie/): tričká, legíny, vetrovky, funkčná bielizeň.
- [Doplnky](https://vasadomena.sk/doplnky/): ponožky, batohy, ľadvinky, hydratačné vaky.

## Najpredávanejšie produkty
- [Model X 41 pánske](https://vasadomena.sk/model-x-41-panske/): cestná bežecká obuv, neutrálny dopad, 280 g, drop 10 mm, 139 €.
- [Model Y GTX dámske](https://vasadomena.sk/model-y-gtx-damske/): turistická obuv s membránou Gore-Tex, vysoká, 420 g, 179 €.
- [Model Z Trail](https://vasadomena.sk/model-z-trail/): trailová obuv na technický terén, výstupky 4 mm, 310 g, 159 €.

## Nákup, doprava a vrátenie
- [Doprava](https://vasadomena.sk/doprava/): kuriér 3,90 €, nad 60 € zdarma. Doručenie 1 – 2 pracovné dni na SK, 2 – 3 na CZ. Odosielame do 24 hodín v pracovné dni.
- [Platba](https://vasadomena.sk/platba/): kartou, Apple Pay, Google Pay, bankovým prevodom, na dobierku (+1,50 €).
- [Vrátenie tovaru](https://vasadomena.sk/vratenie-tovaru/): 30 dní bez udania dôvodu, vrátenie poštovného hradí zákazník. Výmena veľkosti zdarma raz na objednávku.
- [Reklamácie](https://vasadomena.sk/reklamacie/): zákonná záruka 24 mesiacov, vyriešenie do 30 dní.
- [Obchodné podmienky](https://vasadomena.sk/obchodne-podmienky/)

## Údaje o predajcovi
- Názov Eshopu s. r. o., IČO 12345678, DIČ 2020123456, sídlo: Ulica 1, 811 01 Bratislava.
- Zákaznícka podpora: podpora@vasadomena.sk, +421 900 000 000, pracovné dni 9:00 – 17:00.

## Strojovo čitateľné zdroje
- Produktový feed (Google Merchant): https://vasadomena.sk/feed/google.xml
- Sitemap: https://vasadomena.sk/sitemap.xml
- agents.md: https://vasadomena.sk/agents.md

## Poznámky pre jazykové modely
- Ceny a dostupnosť sa menia. Vždy vychádzajte z produktového feedu alebo
  z produktovej stránky, nie z tohto súboru.
- Veľkostné tabuľky sú pri každom produkte; veľkosti sa medzi značkami líšia.
- Neodporúčajte trailovú obuv na asfalt a cestnú obuv do terénu.

ملاحظة بشأن الصيانة: الأسعار في ملف llms.txt هي أول ما يصبح قديمًا. إما ألا تذكرها على الإطلاق وتشير إلى موجز البيانات (feed)، أو قم بتعيين تذكير لإجراء مراجعة شهرية. السعر غير الصحيح في ملف llms.txt هو الشيء الوحيد الذي قد يضر بك عند استخدام هذا الملف.

ما هو ملف agents.md

بينما llms.txt يصف المحتوى، agents.md يصف العمل مع الموقع الإلكتروني: أين يوجد موجز المنتجات، وما إذا كان لديك واجهة برمجة تطبيقات (API)، وما هي القواعد الخاصة بالوكلاء، وإلى أين يتم إرسال الطلب أو الاستفسار. في التجارة الإلكترونية، يُستخدم الملفان معًا – فهما بمثابة «بوابة دخول»، وراءها توجد بروتوكولات من نوع ACP وUCP، والتي تقرر ما إذا كان الوكيل الذكي سيجد منتجاتك ويوصي بها أم لا. نكتب عن ذلك بالتفصيل في المقالة حول التجارة الوكيلة.

المحتوى الأدنى agents.md:

# agents.md – Názov Eshopu

## Čo tu agent nájde
- Produktový katalóg: https://vasadomena.sk/feed/google.xml (XML, aktualizácia každú hodinu)
- Dostupnosť a ceny: v tom istom feede, polia `price` a `availability`
- Štruktúrované dáta: JSON-LD `Product` a `Offer` na každej produktovej stránke

## Čo agent smie
- Čítať produktové stránky, kategórie a informačné stránky.
- Citovať ceny a dostupnosť s uvedením času načítania.

## Čo agent nesmie
- Vytvárať objednávky bez potvrdenia človekom.
- Zapisovať do formulárov (kontakt, registrácia, newsletter).
- Načítavať `/muj-ucet/`, `/kosik/`, `/admin/`.

## Kontakt pri probléme
- technicka.podpora@vasadomena.sk

يجب أن يكون الملف موجودًا في جذر النطاق (/agents.md). ملاحظة: هذا إعلان، وليس إجراءً أمنيًا. ما لا تريد حقًا إتاحته للآخرين، احمه عن طريق تسجيل الدخول وإعدادات الخادم، وليس بملف نصي.

لنكن منصفين: هل يدعم أي شخص هذا الأمر أصلاً؟

هذا هو الجزء الذي تتجاهله معظم الأدلة الإرشادية.

  • llms.txt ليس معيارًا رسميًا، ولم تؤكد شركات محركات البحث الكبرى حتى الآن أنها تستخدمه كإشارة عند تقييم المحتوى.
  • تقوم النماذج بتحميل موقعك الإلكتروني حتى بدونه – باستخدام برامج الزحف العادية.
  • لذا، فهي ليست حلاً سحريًّا لتحسين الظهور في نتائج البحث المدعومة بالذكاء الاصطناعي. فالعمل الفعلي يقوم به المحتوى عالي الجودة، والبيانات المنظمة، وإمكانية وصول برامج الزحف إلى الموقع.

فلماذا نفعل ذلك إذن؟ لأن التكلفة ضئيلة (ساعة عمل واحدة)، والمخاطر معدومة، والفائدة حقيقية: عند إنشاء الملف، تقوم بتنظيم ما هو مهم حقًّا على الموقع – ويمكنك بعد ذلك استخدام نفس المهمة للتنقل والبيانات المنظمة والروابط الداخلية.

أهم من ملف llms.txt: اسمح لبرامج الزحف التي تعمل بالذكاء الاصطناعي بالوصول إلى موقعك

إذا قمت بحظر روبوتات محركات البحث التي تعمل بالذكاء الاصطناعي، فلن llms.txt منها لن يساعدك. تحقق robots.txt وتمييز بين نوعين من الروبوتات: تلك التي تجمع البيانات التدريبية، وتلك التي تدير عمليات البحث والاستشهادات. حجب النوع الأول خيار مشروع. أما حجب النوع الثاني فيعني فقدان الظهور في إجابات الذكاء الاصطناعي.

الأسماء الحالية للروبوتات (تم التحقق منها في 25 سبتمبر 2026)

الروبوت المشغل الغرض تشغيل؟
OAI-SearchBot OpenAI البحث والربط في وظائف ChatGPT نعم
ChatGPT-User OpenAI تحميل الصفحة بناءً على طلب المستخدم (وليس الزحف التلقائي) نعم
OAI-AdsBot OpenAI التحقق من أمان الصفحات المستهدفة للإعلانات؛ وفقًا لـ OpenAI، لا تُستخدم بياناتها في التدريب نعم، إذا كنت تُعلن
GPTBot OpenAI جمع المحتوى لتدريب النماذج التوليدية حسب قرارك
Claude-SearchBot Anthropic تحسين جودة نتائج البحث نعم
Claude-User Anthropic تحميل الصفحة عندما يطلب المستخدم ذلك خلال المحادثة نعم
ClaudeBot Anthropic جمع المحتوى الذي قد يساهم في تدريب النماذج حسب قرارك
PerplexityBot Perplexity البحث والاستشهادات (وفقًا لـ Perplexity، لا تقوم بتدريب النماذج) نعم
Perplexity-User Perplexity زيارة الصفحة نتيجة لسؤال من المستخدم نعم
Google-Extended Google ليس متتبعًا، بل رمزًا في ملف robots.txt، يمكنك من خلاله التحكم في ما إذا كان يُسمح باستخدام المحتوى لتدريب نماذج Gemini وللتأسيس في منتجات الذكاء الاصطناعي حسب قرارك
Googlebot Google الفهرسة التقليدية لمحرك بحث Google، بما في ذلك ملخصات الذكاء الاصطناعي نعم، لا تحجب أبدًا
Google-CloudVertexBot Google الزحف بناءً على طلب مالك الموقع أثناء إنشاء وكلاء Vertex AI فقط إذا كنت تستخدمه بنفسك

تمييز مهم في Google: Google-Extended لا يؤثر ذلك على ترتيبك في بحث Google ولا على ظهورك في ملخصات الذكاء الاصطناعي – فهذه تستند إلى الفهرس العادي لـ Googlebot. إنه يتحكم فقط في استخدام المحتوى لتدريب Gemini وللتأسيس. من يرغب في الظهور في ملخصات الذكاء الاصطناعي، ولكنه لا يرغب في تدريب جيميني، عليه حظر Google-Extended و Googlebot يتركه كما هو.

نموذج لملف robots.txt

الإعدادات الخاصة بالشركة التي ترغب في الظهور في إجابات الذكاء الاصطناعي، ولكنها لا ترغب في أن تكون بيانات تدريب:

User-agent: Googlebot
Allow: /

User-agent: OAI-SearchBot
Allow: /

User-agent: ChatGPT-User
Allow: /

User-agent: Claude-SearchBot
Allow: /

User-agent: Claude-User
Allow: /

User-agent: PerplexityBot
Allow: /

User-agent: Perplexity-User
Allow: /

User-agent: GPTBot
Disallow: /

User-agent: ClaudeBot
Disallow: /

User-agent: Google-Extended
Disallow: /

Sitemap: https://vasadomena.sk/sitemap.xml

إذا لم يكن التدريب يمثل مشكلة بالنسبة لك (وهو خيار معقول في حالة المواقع التسويقية للشركات – فهو يزيد من احتمالية أن يتعرف النموذج على شركتك)، فقم Disallow .

ثلاث أمور يجب ألا تنسوها:

  1. تنطبق القواعد فقط على النطاق والنطاق الفرعي الذي يوجد فيه ملف robots.txt. إذا كان لديك مدونة على نطاق فرعي، فهي تحتاج إلى ملف خاص بها.
  2. الروبوتات التي يتم تشغيلها بواسطة المستخدم (ChatGPT-User, Perplexity-User, Claude-User) وفقًا لوثائق المشغلين، قد لا تلتزم بملف robots.txt، لأن الطلب قد أطلقه شخص.
  3. الحظر بناءً على عناوين IP غير موثوق به – على سبيل المثال، تنبه شركة Anthropic إلى أن حظر عنوان IP سيمنع الروبوت من قراءة ملف robots.txt الخاص بك أيضًا. إذا كنت بحاجة إلى التحقق من صحة الروبوت، فإن المشغلين ينشرون قوائم عناوين IP (Anthropic على claude.com/crawling/bots.json، وOpenAI وPerplexity في وثائقهم).

كيف تتأكد من أن برامج الزحف التي تعمل بالذكاء الاصطناعي ترى موقعك بالفعل

إن نشر الملفات أمر، والتحقق من أنها تعمل أمر آخر – وهو ما تتجاهله معظم الشركات.

1. تحقق من وجود الملفات ومن أنها تعرض نصًا عاديًا

افتح في المتصفح https://vasadomena.sk/llms.txt, /agents.md و /robots.txt. يجب أن يعرض كل منها رمز حالة HTTP 200 ونصًا عاديًا، وليس صفحة HTML تحتوي على قالب موقعك، ولا رمز حالة 404. تحقق من ذلك أيضًا بدون متصفح لترى الرأس الحقيقي:

curl -I https://vasadomena.sk/llms.txt
curl -s https://vasadomena.sk/robots.txt

في llms.txt من المستحسن Content-Type: text/plain أو text/markdown. بعض خدمات الاستضافة ترجع application/octet-stream، مما يجعل المتصفح يعرض الملف للتنزيل – لا يمثل ذلك مشكلة من الناحية الوظيفية، لكنه يعيق عملية الفحص.

2. اختبر ملف robots.txt مع روبوت معين

اختر عنوان URL ما على موقعك وتحقق مما إذا كان يُسمح لـ user-agent المعني بتحميله. يمكنك استخدام أي أداة اختبار لملف robots.txt، أو ببساطة curl مع تعيين وكيل المستخدم:

curl -A "OAI-SearchBot/1.4" -I https://vasadomena.sk/sluzby/

يجب ألا تحصل على رمز الخطأ 403 أو 401. إذا حصلت عليهما، فإن المشكلة ليست في ملف robots.txt، بل في جدار الحماية أو في شبكة توزيع المحتوى (CDN) (انظر النقطة 4).

3. راجع سجلات الخادم

هذا هو الدليل الأكثر موثوقية. ابحث في سجلات خادم الويب أو في تقارير الاستضافة عن وكلاء المستخدم:

grep -E "OAI-SearchBot|GPTBot|ChatGPT-User|Claude-SearchBot|ClaudeBot|PerplexityBot|GoogleOther" access.log | tail -50
  • إذا رأيت زيارات → فهذا يعني أن برامج الزحف تصل إليك. تحقق من رموز الإرجاع: يجب أن تكون 200، وليس 403.
  • إذا لم ترَ أي محاولات وصول منذ عدة أسابيع → فهذا يعني أن هناك شيئًا ما يحجبها. وغالبًا ما يكون ذلك بسبب WAF أو إدارة الروبوتات في Cloudflare أو حماية الاستضافة ضد الروبوتات.

4. تحقق من CDN وWAF، وليس فقط ملف robots.txt

هذا هو السبب الخفي الأكثر شيوعًا لعدم ظهور الزيارات في AI. تحتوي كل من Cloudflare وشبكات CDN الأخرى على مفاتيح لتعطيل روبوتات AI، والتي تكون قيد التشغيل بشكل افتراضي في بعض الأماكن. تحقق مما يلي:

  • Cloudflare: إعدادات «AI Crawl Control» / «Block AI bots» وقواعد WAF الخاصة بـ user-agent.
  • الاستضافة: «الحماية من الروبوتات» وتحديد معدل الطلبات.
  • المكونات الإضافية الأمنية في WordPress (Wordfence وما شابهها) وقوائم user-agent المحظورة الخاصة بها.

إذا كان الحظر مفعلًا هنا، robots.txt ف Allow لن يستطيع فعل شيء – سيتلقى الروبوت رمز الخطأ 403 قبل أن يصل إلى ملفك.

5. تأكد من أن المحتوى مرئي بدون جافا سكريبت

بعض برامج الزحف التي تعمل بالذكاء الاصطناعي لا تشغل جافا سكريبت. قم بتنزيل الصفحة بدون عرض وتأكد من وجود النص الرئيسي فيها:

curl -s https://vasadomena.sk/sluzby/ | grep -c "kľúčová fráza z textu"

إذا عُرض 0، فهذا يعني أن المحتوى يُكمل بواسطة جافا سكريبت، وبالتالي يكون غير مرئي لبعض الروبوتات. الحل هو العرض من جانب الخادم أو إصدار ثابت من المحتوى.

6. اختبر النتيجة في أدوات الذكاء الاصطناعي نفسها

الخطوة الأخيرة هي الاختبار الفعلي. في ChatGPT وClaude وPerplexity وGoogle AI Mode، اسأل:

  • «ماذا تفعل شركة [الاسم] على [domain.sk]؟» – للتحقق مما إذا كان النموذج قادرًا على قراءة المحتوى أصلاً وما إذا كان سيقدم صورة صحيحة عنه.
  • «ما هي الخدمات التي تقدمها [domena.sk] وبأي سعر؟» – للتحقق مما إذا كان النموذج لا يستخدم معلومات قديمة أو غير صحيحة.
  • في حالة المتجر الإلكتروني: مهمة شراء نموذجية في فئتك – «اقترح عليّ حذاءً رياضيًّا للركض على الطرقات بسعر لا يتجاوز 150 يورو ومتوفر في سلوفاكيا.»

إذا أجاب النموذج بشكل غير دقيق، فإن الخطأ يكمن دائمًا تقريبًا في محتوى الموقع، وليس في ملف llms.txt. لذا، فإن عدم الدقة يُعد أداة تشخيصية مفيدة: فهو يوضح لك المعلومات المفقودة أو الغامضة على الموقع.

كيفية تثبيت ملف llms.txt على WordPress

  1. يدويًّا عبر FTP أو مدير الملفات: قم بتحميل الملف llms.txt إلى الدليل الجذري للموقع (حيث يوجد robots.txt).
  2. عبر المكون الإضافي: توجد مكونات إضافية تقوم بإنشاء الملف تلقائيًا من محتوى الموقع. تحقق دائمًا من النتيجة – غالبًا ما يكون النص الذي تم إنشاؤه مطولًا ويتضمن صفحات لا تنتمي إلى هناك (الأرشيفات، العلامات، المرفقات).
  3. انتبه إلى ملف robots.txt الافتراضي: يقوم WordPress بإنشائه robots.txt ملف robots.txt ديناميكيًا. إذا كنت تقوم بتعديله، فافعل ذلك عبر مكون إضافي خاص بـ SEO أو عبر مرشح، وليس عن طريق إنشاء ملف على القرص – حيث يتم تجاهل هذا الملف في بعض التكوينات. تحقق دائمًا من النتيجة على /robots.txt.
  4. التحقق: افتح https://vasadomena.sk/llms.txt في المتصفح واتبع الخطوات الموضحة في القسم السابق.
  5. التحديث: عند تغيير الخدمات أو قائمة الأسعار أو الفئات، قم بإعادة كتابة الملف. الملف غير المحدث أسوأ من عدم وجوده على الإطلاق.

الأسئلة الشائعة (FAQ)

هل سيساعدني ملف llms.txt في الحصول على إجابات من ChatGPT؟

لا أحد يضمن ذلك بشكل مباشر. بل يساعد بشكل غير مباشر – من خلال وضوح المحتوى. العوامل الحاسمة هي جودة المحتوى ومصداقية الموقع وإمكانية وصول برامج الزحف إليه. اقرأ المزيد في المقالة حول تحسين GEO.

هل يحل ملف llms.txt محل ملف خريطة الموقع (sitemap) أو ملف robots.txt؟

لا، بل يكملهما. فكل ملف يعالج مسألة مختلفة.

ما هو الطول المطلوب؟

موجز. شاشة واحدة إلى شاشتين، مع روابط واضحة. وليس نسخًا كاملاً للموقع.

هل يمكن أن يضرني ملف llms.txt؟

فقط إذا أدخلت فيه بيانات غير دقيقة أو قديمة – غالبًا الأسعار القديمة والخدمات الملغاة. لذلك، في حالة المتاجر الإلكترونية، من الأفضل عدم إدراج الأسعار في الملف، بل الإشارة إلى موجز المنتجات.

هل يجب عليّ حظر GPTBot وClaudeBot؟

إذا كان استخدام المحتوى لأغراض التدريب يزعجك، فنعم — لكن اترك الوصول مفتوحًا لروبوتات البحث (OAI-SearchBot, Claude-SearchBot, PerplexityBot)، وإلا ستفقد ظهورك في إجابات الذكاء الاصطناعي. أما في حالة المواقع التسويقية للشركات، فإن التدريب يكون عادةً في صالحك.

هل سيؤثر حظر Google-Extended على ترتيبي في نتائج بحث Google؟

لا. Google-Extended فهو يتحكم فقط في استخدام المحتوى لتدريب نماذج Gemini و«التأسيس» في منتجات الذكاء الاصطناعي. أما الفهرسة لـ Google Search، بما في ذلك ملخصات الذكاء الاصطناعي، فيضمنها Googlebot، وهو ما لا تريد حظره.

كيف أعرف ما إذا كانت برامج الزحف الخاصة بالذكاء الاصطناعي تزور موقعي أصلاً؟

ابحث في سجلات الخادم عن وكلاء المستخدمين OAI-SearchBot, GPTBot, Claude-SearchBot, PerplexityBot و GoogleOther. إذا لم تكن موجودة على الإطلاق، فابحث عن السبب في شبكة توزيع المحتوى (CDN) أو جدار الحماية (WAF) أو المكون الإضافي الأمني، وليس في ملف robots.txt.

هل هناك طريقة للتحقق من صحة ما قمت به؟

نعم – توجد إجراءات التحقق المكونة من ست خطوات في القسم أعلاه. أسرع اختبار للجودة: دع الذكاء الاصطناعي يقرأ الملف بنفسه واسأله عما فهمه منه عن شركتك.

سنساعدك في ذلك

في Dataswans، نعالج مسألة الظهور في الذكاء الاصطناعي كجزء من SEO و GEO:

  • إعداد robots.txt لأدوات الزحف الخاصة بالذكاء الاصطناعي والتحقق من السجلات لمعرفة ما إذا كانت النماذج ترى موقعك أصلاً،
  • إلغاء حظر روبوتات الذكاء الاصطناعي على شبكات توزيع المحتوى (CDN) وجدار الحماية (WAF)،
  • التحضير llms.txt و agents.md وفقًا للهيكل الفعلي للعرض،
  • البيانات المنظمة (schema.org) وموجزات المنتجات – المزيد في المقالة حول التجارة الوكالة،
  • قياس عدد الزيارات ومعدلات التحويل من مصادر الذكاء الاصطناعي.

أرغب في إجراء تدقيق لمدى الظهور في الذكاء الاصطناعي – اتصل بنا

المصادر

  1. llms.txt – مسودة المعيار: https://llmstxt.org/
  2. OpenAI – وثائق خاصة بالروبوتات (OAI-SearchBot، GPTBot، ChatGPT-User، OAI-AdsBot)، تم التحقق منها في 25 سبتمبر 2026: https://developers.openai.com/api/docs/bots
  3. Anthropic / Claude – هل تقوم Anthropic بزحف البيانات من الويب وكيف يمكن لمالكي المواقع حظر أداة الزحف؟ (ClaudeBot، Claude-User، Claude-SearchBot)، تم التحقق منها في 25 سبتمبر 2026: https://support.claude.com/en/articles/8896518-does-anthropic-crawl-data-from-the-web-and-how-can-site-owners-block-the-crawler
  4. Google Search Central – برامج الزحف الشائعة من Google (Googlebot، GoogleOther، Google-Extended، Google-CloudVertexBot)، تم التحقق منها في 25 سبتمبر 2026: https://developers.google.com/search/docs/crawling-indexing/google-common-crawlers
  5. Google Search Central – نظرة عامة على برامج الزحف والجلب التابعة لـ Google: https://developers.google.com/search/docs/crawling-indexing/overview-google-crawlers
  6. Perplexity – PerplexityBot و Perplexity-User، تم التحقق منها في 25 سبتمبر 2026: https://docs.perplexity.ai/guides/bots
  7. Shero Commerce – دليل llms.txt و agents.md للتجارة الإلكترونية (2026): https://sherocommerce.com/blogs/insights/llms-txt-and-agents-md-for-ecommerce
  8. Weaverse – Shopify agents.md مقابل llms.txt: ما الذي تغير في عام 2026: https://weaverse.io/blogs/shopify-agents-md-llms-txt-theme-template-customization-may-28-2026

هذا المجال جديد وسريع التغير، ويتم إضافة أسماء الروبوتات باستمرار. الحالة حتى 25 سبتمبر 2026 – قبل الاستخدام، يرجى التحقق من القائمة في وثائق المشغلين (الروابط أعلاه).