Bots de Busca

O que é um bot de busca?

Um bot de busca, às vezes chamado de spider, é um robô que navega continuamente pela internet, geralmente com o objetivo de construir um índice de busca.

Bots podem inflar artificialmente números de tráfego, então é importante estar ciente de sua existência.

Bots de busca e Linkly

Linkly pode detectar bots de busca e spiders que se revelam deliberadamente. Você pode ver quais cliques foram atribuídos a bots na seção Bots do relatório de tráfego.

Temos um artigo sobre tráfego de bots e como bloquear bots.

Tratamento Especial para Crawlers de Mídia Social

Linkly tem tratamento melhorado para crawlers de mídia social do Facebook, YouTube, Google, LinkedIn e X.

Quando tráfego desses crawlers chega em seus links:

  • Não é registrado em sua análise

  • Não conta contra seus limites de cliques

  • O crawler é redirecionado transparentemente para o destino correto

  • Esses crawlers são sempre permitidos, mesmo quando o recurso "bloquear robôs" está ativado

Isso impede que crawlers de mídia social consumam seus limites de cliques enquanto ainda permite que gerem previsualizações e verifiquem seus links.

Tráfego de bots no relatório de tráfego do Linkly
Tráfego de bots no relatório de tráfego do Linkly

Linkly pode bloquear robôs e spiders de busca de seguir seus links. Consulte Tráfego de Bots para instruções sobre como ativar o bloqueio de bots.

Importante: Crawlers de mídia social do Facebook, YouTube, Google, LinkedIn e X são sempre permitidos mesmo quando o bloqueio está ativado, para que as previsualizações de links continuem funcionando.

Bots Contam Contra Limites de Cliques?

Crawlers de mídia social do Facebook, YouTube, Google, LinkedIn e X não contam contra seus limites de cliques e não são registrados em sua análise.

Todos os outros bots identificados abaixo contam contra seus limites de cliques, pois custa o mesmo monitorar e redirecionar tráfego independentemente da fonte.

Bots bloqueados (aqueles que encontram uma página de bloqueio) também não contam para seus limites.

Lista de Bots de Busca

Abaixo está uma lista de bots de busca e seus user-agents que Linkly identifica e pode bloquear se necessário.

  • 200pleasebot 200PleaseBot
  • 360spider 360Spider
  • abot CrawlDaddy, abot
  • addthis AddThis
  • adldxbot Microsoft Bing Ads
  • admantx ADmantX Platform Semantic Analyzer
  • adsbot-google Google Adwords
  • advbot AdvBot
  • ahrefsbot Ahrefs backlinks research tool
  • alexa Alexa Crawler
  • apache-httpclient Java http library
  • apachebench ApacheBench (ab)
  • apis-google APIs-Google
  • appengine-google Google App Engine
  • applebot Apple Bot
  • archive.org_bot Internet Archive (archive.org)
  • ask jeeves Ask Jeeves
  • asynchttpclient Java http and WebSocket client library
  • awe.sm Awe.sm URL expander
  • baidu Baidu
  • bdcbot Big Data Corp
  • bingbot Microsoft Bing
  • bingpreview Microsoft Bing preview
  • bitlybot bit.ly bot
  • blekkobot Blekkobot
  • blexbot BLEXBot (webmeup)
  • bot@linkfluence.net Linkfluence bot
  • bufferbot BufferBot
  • buibui-checkbot buibui
  • butterfly Topsy Labs
  • buzztalk buzztalk
  • catchbot CatchBot (catchbot.com)
  • check_http Nagios monitor
  • cliqzbot Cliqzbot
  • cmradar/0.1 CMRadar/0.1
  • coldfusion ColdFusion http library
  • commoncrawl CCBot
  • comodo-webinspector-crawler Comodo
  • crowsnest Crowsnest
  • curabot cura.yt
  • curl curl unix CLI http client
  • dap/nethttp DAP/NetHTTP
  • datagnionbot datagnion.com/bot.html
  • daumoa Korean portal and search engine indexing bot
  • developers.google.com/+/web/snippet/ Google Plus
  • diffbot Diffbot
  • digitalpersona fingerprint software HP Fingerprint scanner
  • domain re-animator bot Domain Re-Animator Bot
  • domainsbot DomainsBot
  • domaintunocrawler DomainTuno
  • dotbot Dot Bot
  • duckduck Duck Duck Go
  • elb-healthchecker AWS ELB HealthChecker
  • embedly Embedly
  • eoaagent EOAAgent
  • eventmachine httpclient Ruby http library
  • everyonesocialbot EveryoneSocial
  • evrinid Evri bot
  • exabot Exalead's bot
  • exaleadcloudview ExaleadCloudView
  • facebookexternalhit Facebook Bot
  • facebot Facebook Bot
  • feedburner RSS bot
  • feedfetcher-google Google Feedfetcher
  • findxbot Findxbot
  • flipboardproxy FlipboardProxy
  • friendfeedbot FriendFeed
  • genieo Genieo Web filter bot
  • getprismatic.com getprismatic.com
  • gigabot Gigabot spider
  • gimme60bot Gimme60 (gimme60.com)
  • gimmeusabot Gimme60 (gimme60.com)
  • go http package Go http library
  • google page speed insights Google Page Speed Insights
  • google Web Preview Google Instant Previews crawler
  • google-structured-data-testing-tool Google-StructuredDataTestingTool
  • google-structureddatatestingtool Google-StructuredDataTestingTool
  • googlebot Google Bot
  • googlestackdrivermonitoring-uptimechecks GoogleStackdriverMonitoring-UptimeChecks
  • grapeshotcrawler GrapeshotCrawler
  • gravitybot Gravity Bot
  • hatena::bookmark Hatena::Bookmark
  • heritrix heritrix
  • htmlparser HTMLParser
  • http_request2 HTTP_Request2
  • httpclient HTTPClient
  • https://developers.google.com/+/web/snippet Google+ Snippet Fetcher
  • hubspot HubSpot
  • ia_archiver Internet Archive (WayBackMachine)
  • icoreservice iCoreService
  • idmarch idmarch.org/bot.html
  • inagist URL resolver
  • insieve Insieve Bot
  • insitesbot Insitesbot
  • instapaper Instapaper
  • istellabot IstellaBot
  • jack jack
  • jakarta commons Jakarta Commons HttpClient
  • java Generic Java http library
  • jetslide Jetslide
  • js-kit URL resolver
  • kemvibot Kemvi
  • kimengi Kimengi Bot
  • knows.is knows.is
  • kojitsubot Kojitsubot
  • komodiabot KomodiaBot
  • kraken kraken
  • laconica Laconica
  • libwww-perl Perl client-server library
  • lijit crawler Lijit
  • linkdexbot Linkdex Bot
  • linkedinbot LinkedIn
  • linkscrawler LinksCrawler
  • linode Linode Longview
  • lipperhey Lipperhey
  • livelapbot Livelapbot
  • loadtimebot Load Time Bot
  • longurl URL expander service
  • ltx71 ltx71.com
  • lumibot Lumibot
  • lwp-trivial Another Perl library
  • magpie-crawler magpie-crawler
  • mail.ru_bot Mail.ru Bot
  • meanpathbot meanpath
  • mediapartners-google Google Adsense bot
  • megaindex.ru MegaIndex
  • memorybot mignify.com/bot.html
  • metauri MetaURI
  • mfe_expand Mcafee spider
  • mir web crawler MIR web crawler
  • mj12bot Majestic-12 spider
  • mojeekbot Mojeek UK search crawler
  • mrchrome MrChrome
  • ms search 6.0 robot MS Search 6.0 Robot
  • msnbot-media Microsoft media bot
  • msnbot Microsoft bot
  • nerdybot NerdyBot
  • netcraft Netcraft
  • netstate netEstate NE Crawler
  • netvibes Personalized dashboard bot
  • netzcheckbot netzcheck
  • newrelicmonitor NewRelic monitor
  • newrelicpinger NewRelicPinger
  • newsme newsme
  • niki-bot niki-bot
  • ning NING - Yet Another Twitter Swarmer
  • nutch Apache search spider
  • openhosebot OpenHoseBot
  • orangebot OrangeBot
  • pagesinventory pagesinventory.com
  • panopta Monitoring service
  • paperlibot PaperLi
  • peerindex peerindex
  • percolatecrawler PercolateCrawler
  • perfectmarketkwtbot PerfectMarket
  • phantomjs PhantomJS
  • pingdom Pingdom monitoring
  • pinterest Pinterest
  • plukkie botje.com/plukkie.htm
  • privacyawarebot PrivacyAwareBot
  • proximic Proximic Spider
  • psbot-page Picsearch
  • publiclibraryarchive.org publiclibraryarchive.org
  • pycurl Python http library
  • python-httplib2 Python-httplib2
  • python-requests Python http library
  • python-urllib Python http library
  • queryseeker QuerySeekerSpider
  • quicklook QuickLook
  • re-animator Domain Re-Animator Bot
  • readability Readability
  • rebelmouse RebelMouse
  • redditbot Reddit Bot
  • relateiq RelateIQ
  • riddler Riddler Bot
  • rogerbot SeoMoz spider
  • rssmicro RSS/Atom Feed Robot (rssmicro.com)
  • ruby Ruby
  • scrapy Scrapy
  • screaming frog seo spider Screaming Frog SEO Spider
  • searchmetricsbot SearchmetricsBot
  • semrushbot SEO analysis bot
  • seokicks SEOKicks
  • seznambot SeznamBot
  • shopwiki ShopWiki
  • shortlinktranslate Link shortener
  • showyoubot Showyou iOS app spider
  • siege Joe Dog Siege
  • sistrix SISTRIX
  • siteuptime Site monitoring services
  • slack Slackbot-LinkExpanding
  • slackbot Slack Bot
  • slurp Yahoo spider
  • smtbot SimilarTech
  • socialrank SocialRankIOBot
  • sogou Chinese search engine
  • spbot OpenLinkProfiler
  • spider generic web spider
  • spinn3r Spinn3r aggregator
  • sputnikbot SputnikBot
  • squider Squider
  • statuscake StatusCake
  • stripe Stripe
  • test certificate info C http library?
  • tineye TinEye Bot
  • traackr Traackr Bot
  • trendictionbot Trendiction Search
  • turnitinbot TurnitinBot
  • tweetedtimes The Tweeted Times
  • tweetmemebot TweetMeMe Crawler
  • twikle Social web search bot
  • twitjobsearch TwitJobSearch
  • twitmunin Twitmunin
  • twitterbot Twitter URL expander
  • twurly Twurly
  • typhoeus Typhoeus
  • umbot uberMetrics
  • unwindfetch Gnip
  • uptimerobot Uptime Robot
  • vagabondo Vagabondo
  • vb project Visual Basic
  • vigil Vigil
  • vkshare VKontake Sharer
  • voilabot VoilaBot
  • vrcrawler Venture Radar
  • wasalive-bot Wasalive Bots
  • watchsumo WatchSumo
  • wbsearchbot Ware Bay Best Buys
  • webscout Webscout
  • wesee WeSEE
  • wget wget unix CLI http client
  • wordpress WordPress spider
  • wormly WormlyBot
  • wotbox Wotbox
  • xenu link sleuth Xenu Link Sleuth
  • xing-contenttabreceiver Xing bot
  • xovibot XoviBot
  • yacybot YaCy
  • yahoo-ad-monitoring Yahoo Ad monitoring
  • yandex Yandex
  • yeti Naver Corp
  • yourls YOURLS
  • zelist.ro feed parser
  • zibb ZIBB spider
  • zitebot Zite
  • zyborg Zyborg

Provedores de Nuvem Identificados como Bots

Muitos bots não se identificam como tal, mas rastreamos os provedores de serviços de internet e identificamos tráfego de provedores de nuvem principais como provavelmente bots também.

  • Google Cloud
  • Microsoft Corporation
  • OVH SAS
  • DigitalOcean
  • Huawei Clouds
  • Google-private-cloud
  • Facebook
  • Amazon.com
  • Google Proxy
  • Omonia d.o.o.
  • ColoCrossing

FAQs de Bots de Busca

Como Linkly detecta bots?

Linkly identifica bots através de sua string user agent (muitos bots se anunciam) e verificando se o tráfego origina de provedores de hospedagem em nuvem conhecidos ou data centers.

Um bot está faltando nesta lista?

Atualizamos regularmente nossa detecção de bots. Se você está vendo tráfego de um bot não nesta lista, entre em contato e o adicionaremos.

Por que alguns cliques são marcados como bots quando são usuários reais?

Usuários em VPNs ou redes corporativas podem ser sinalizados como bots porque seu tráfego é roteado através de data centers. Consulte nosso artigo sobre tráfego VPN para mais informações.

Sim. No relatório de tráfego, clique na aba Bots para ver um resumo do tráfego de bots por user agent.

Rastreie 500 cliques mensais com todos os recursos incluídos.