Zde je několik návrhů na vytvoření souboru zejména pro uživatelské agenty Google;
1) Soubor by měl dodržovat normu pro vyloučení robotů.
2) Může obsahovat jedno nebo více pravidel pro povolení nebo zablokování přístupu zadaného crawleru k určité cestě webu.
3) Správce webu by měl znát téměř všechny syntaxe souboru robots.txt, aby pochopil jemné chování jednotlivých syntaxí.
4) Web nesmí mít více než jeden soubor robots.txt.
5) Soubor podporuje obě subdomény (jako http://website.demo.com/robots.txt nebo jakýkoli nestandardní port jako (http://demo:8181/robots.txt).
6) Pokud neznáte nebo nemáte přístup do kořenové složky vašich webových stránek, pak je nejlepší oslovit poskytovatele webhostingových služeb, aby soubor robots.txt uložil do stejné složky. V případě, že nemáte přístup ke kořenovému adresáři webových stránek, použijte jako alternativní metodu blokování meta tagy.
7) Do souboru robots.txt lze zahrnout více skupinových směrnic nebo pravidel (uvedených po jednom na řádek).
8) Podporuje pouze znaky ASCII.
9) Skupina poskytuje informace o tom, pro koho je použita (uživatelský agent) a k jakým všem souborům nebo adresářům nemá/nemůže agent přístup. Směrnice se zpracovávají shora dolů. Webový bot se přidružil pouze k jedné sadě pravidel, která může být zadána samostatně nebo je na prvním místě.
10) Podle výchozího předpokladu může bot procházet jakýkoli adresář nebo stránku pomocí syntaxe "Disallow:".
11) U direktiv použitých v souboru se rozlišují malá a velká písmena, stejně jako u direktiv Disallow: /one.xml neplatí pro ONE.xml.
12) Vztahuje se na celou doména webové stránky, která se skládá buď z protokol https nebo http.
Uživatelští agenti vyhledávačů Bing a Google obvykle používají určitou skupinu direktiv, ale ve výchozím nastavení se upřednostňují nejprve odpovídající pravidla, protože weboví roboti různých vyhledávačů interpretují direktivy různým způsobem.
Webmasterům se také doporučuje, aby se v souboru robots.txt co nejvíce vyhýbali používání syntaxe crawl-delay, a zkrátili tak celkovou dobu procházení robotů vyhledávačů.