Burada, özellikle Google kullanıcı aracıları için dosya oluşturma konusunda bazı öneriler bulunmaktadır;
1) Dosya, Robotları Dışlama Standardına uygun olmalıdır.
2) Belirtilen tarayıcının bir sitenin belirli bir yoluna erişimine izin vermek veya engellemek için bir veya daha fazla kural içerebilir.
3) Bir web yöneticisi, her bir sözdiziminin ince davranışını anlamak için robots.txt dosyasının neredeyse tüm sözdizimine aşina olmalıdır.
4) Site birden fazla robots.txt dosyasına sahip olamaz.
5) Dosya hem alt alan adlarını (http://website.demo.com/robots.txt gibi veya (http://demo:8181/robots.txt) gibi standart olmayan herhangi bir bağlantı noktasını) destekler.
6) Web sitenizin kök klasörünü bilmiyorsanız veya bu klasöre erişiminiz yoksa, robots.txt dosyasını aynı klasörün içinde tutmak için web barındırma hizmeti sağlayıcısına ulaşmak en iyisidir. Web sitesi kök dizinine erişemiyorsanız, alternatif engelleme yöntemi olarak meta etiketleri kullanın.
7) Robots.txt dosyasına birden fazla grup yönergesi veya kuralı (her satırda bir tane olmak üzere) dahil edilebilir.
8) Yalnızca ASCII karakterlerini destekler.
9) Bir grup, kime uygulandığı (kullanıcı aracısı) ve bir aracının erişemediği/erişebildiği tüm dosya veya dizinlerin ne olduğu hakkında bilgi sağlar. Yönergeler yukarıdan aşağıya doğru işlenir. Bir web botu kendisini ayrı olarak belirtilebilen veya önce gelen yalnızca bir kural kümesiyle ilişkilendirir.
10) Varsayılan varsayıma göre bir bot "Disallow:" sözdizimi ile herhangi bir dizini veya sayfayı tarayabilir.
11) Dosyada kullanılan yönergeler büyük/küçük harfe duyarlıdır, örneğin Disallow: /one.xml ONE.xml için geçerli değildir.
12) Tamamı için geçerlidir aşağıdakilerden oluşan bir web sitesinin alan adı https veya http protokolü.
Genellikle, Bing ve Google'ın kullanıcı aracıları belirli bir yönerge grubunu kullanır, ancak varsayılan olarak, farklı arama motoru web botları yönergeleri farklı bir şekilde yorumladığından, ilk olarak eşleşen kurallar tercih edilir.
Ayrıca web yöneticilerine, arama motoru botlarının toplam tarama süresini azaltmak için robots.txt dosyalarında mümkün olduğunca crawl-delay sözdizimini kullanmaktan kaçınmaları önerilir.