Actualizado el
Motores de búsqueda: ¿cómo funcionan?

Gracias a los motores de búsqueda (search engine), los internautas pueden documentarse, localizar un restaurante o encontrar un zapato de tendencia en un solo clic. Estas aplicaciones permiten por tanto acceder a una masa considerable de informaciones a través de diversas búsquedas. Sin embargo, ¿sabe cómo funciona un motor de búsqueda? Este artículo hace el punto sobre el funcionamiento de Google, de Qwant (herramienta de búsqueda francesa), Bing, DuckduckGo, antes de terminar con un estado de la cuestión del mercado de los motores de búsqueda.
¿Qué es un motor de búsqueda?
Definición de un motor de búsqueda
Los motores de búsqueda (search engine) son aplicaciones web creadas para efectuar búsquedas en la red. Los resultados aparecen según las expresiones pedidas por los internautas. Hoy, Google sigue siendo el más conocido de todos. Pero existen numerosos motores de búsqueda eficaces como DuckDuckGo, Bing, Qwant, Yahoo… También encontrará motores de búsqueda especializados como: Google Scholar para la educación, Yahoo kids para los niños, Ecosia para el medio ambiente…
¿Qué se puede encontrar con ayuda de los motores de búsqueda?
Se pueden utilizar los motores de búsqueda para efectuar búsquedas en un dominio preciso. Por ejemplo, Google permite encontrar datos web informativos, imágenes, e-commerces, documentos o vídeos.
La función MAP desempeña el papel de mapa del mundo y utiliza imágenes satélite para localizar con precisión un lugar. Las demás alternativas a Google como Bing, DuckduckGo, Yahoo o Qwant son también motores de búsqueda potentes. Cada herramienta avanza un argumento para diferenciarse. Por ejemplo, Qwant es un motor de búsqueda que respeta la vida privada. No busca saber quién es usted ni dónde está para proponerle sus resultados.
¿Cómo acceder a un motor de búsqueda?
Los motores de búsqueda son accesibles a través de un navegador. La mayoría de las veces, estos últimos utilizan un omnibox a fin de permitir al usuario efectuar una búsqueda. El omnibox es el nuevo nombre atribuido a la antigua barra de direcciones de los navegadores.
¿Cómo triunfar con los motores de búsqueda?
Es la pregunta que toda agencia de posicionamiento orgánico se plantea. Estar posicionado en los primeros resultados de las SERP tiene un verdadero reto financiero. El posicionamiento orgánico es una disciplina estratégica y técnica. Existen, no obstante, algunas optimizaciones simples de aplicar para ser apreciado por los motores de búsqueda.
Puede por ejemplo:
-
Evitar la « ocultación ». También conocida bajo la expresión inglesa « cloaking », este término designa el hecho de presentar dos páginas distintas al Google Bot y a los visitantes humanos para obtener una mejor clasificación. El servidor web está programado de manera que presente una página web distinta según el iniciador de la consulta (robot Google o humano).
-
Hacer un sitio con una jerarquía clara y dar un plan de su sitio (SiteMap).
-
Crear un enlazado interno pertinente.
-
Crear un sitio útil y rico en informaciones. Así, su contenido debe estar estructurado con ayuda de H1, H2, H3. Sus etiquetas y su texto deben contener la palabra clave sobre la que desea aparecer en las SERP.
-
No descuidar los atributos ALT y las meta descriptions. Estos elementos deben ser precisos y contener su palabra clave.
-
Crear backlinks cualitativos para dar potencia a su sitio.
Lo que Bing sugiere:
-
Insertar sus palabras clave en la url. Parece que los nombres de dominio que contienen las palabras clave son apreciados por Bing. Procure crear URL cortas. De hecho, Bing se basa en la experiencia de usuario. Una URL corta es más fácil de recordar para los internautas. Bing tenderá por tanto a favorecer su posicionamiento si aplica esta lógica.
-
Realizar un enlazado interno pertinente.
-
Poner en marcha una estrategia de backlinks cualitativa. A imagen de Google, cuanto más procedan sus enlaces de sitios de notoriedad, mejor será la potencia SEO de su sitio.
-
Crear contenido tematizado. El principio de Bing es simple: ¡una página = un tema!
-
Crear una arborescencia clara, sin complejidad. Bing recomienda 3 niveles. Sus páginas no deben situarse a más de 3 clics de la home. Al igual que Google, se recomienda tener un SiteMap.
-
Asegurarse de que el contenido no está enterrado en los sistemas rich media (Adobe Flash Player, JavaScript, Ajax, etc.)
-
Evitar incluir las palabras clave en el interior de las imágenes. Por ejemplo, si quiere que el nombre de su empresa se indexe, asegúrese de que no se muestre únicamente en el interior de su logotipo.

Funcionamiento de los motores de búsqueda
Crawling e indexing
Los motores de búsqueda (search engine) sirven para una sola cosa: aportar respuestas a las preguntas de los usuarios. Para aportar resultados de búsqueda pertinentes, estas herramientas pasan por dos etapas:
-
el crawling: la búsqueda de páginas en internet
-
la indexación: la clasificación de los resultados por orden de pertinencia
Crawling
El crawling es la primera función de los motores de búsqueda. Es una especie de inspección sistemática de los sitios web en Internet. Efectuada antes de la consulta del usuario, esta etapa consiste en reunir el máximo de informaciones ante las plataformas web. La llevan a cabo robots llamados « spiders o crawlers ». Al término de esta etapa, estos envían las informaciones recogidas al índice para cumplir lo que se llama indexación.
Indexing (indexación)
Cuando el índice (el cerebro de los motores) recibe las informaciones procedentes de los robots, las evalúa. Así, cada vez que un usuario hace una búsqueda, puede aportarle resultados pertinentes.
¿Cómo determinan los motores de búsqueda la pertinencia de un resultado?
La evaluación de la pertinencia no se resume a medir la correspondencia entre la consulta y la plataforma web. Hay otros factores a tomar en consideración. Los motores de búsqueda suponen que cuanto más popular es un sitio, más pertinente es la información que contiene. Este postulado permite a los motores garantizar la satisfacción de los usuarios respecto a los resultados de búsqueda.
Mitos y realidad en torno a los motores de búsqueda
Los mitos
Sumisión a los motores de búsqueda En los años 90, los motores de búsqueda utilizaban formularios de sumisión. Los webmasters sometían sus sitios y sus palabras clave. Se trataba entonces de señalar el sitio para que los motores de búsqueda lo recorrieran y lo indexaran. Este sistema se revisó y se abandonó con rapidez. Hoy, los robots vienen por sí mismos a recorrer los sitios y a indexarlos sobre expresiones clave.
Clasificación por meta tag Las etiquetas meta (en particular la etiqueta meta keywords) eran cruciales para el posicionamiento. Este criterio de posicionamiento ha sido abandonado por todos los motores principales. Hoy las meta tags ya no tienen incidencia sobre el posicionamiento.
El posicionamiento de pago (SEA) impulsa las páginas hacia lo alto de las SERP Ciertas teorías afirman que los sitios que pagan por los anuncios en los motores de búsqueda (SEA) se clasifican de forma natural mejor. Es una suposición sin fundamento. Google, Qwant (herramienta francesa) y Yahoo han instaurado incluso salvaguardas a fin de prevenir este tipo de afirmaciones. En Google, los anunciantes que gastan millones de dólares al mes en publicidad han observado que no reciben ningún trato de favor por parte del motor de búsqueda.
Si tales son los mitos sobre los motores de búsqueda, ¿cuáles son las realidades?
La realidad
El crawl budgetLa web contiene billones de datos. Para facilitar el trabajo de los robots, los motores de búsqueda han instaurado un sistema de limitación en su crawl. El presupuesto de crawl es el tiempo concedido por los robots a su sitio. Los motores de búsqueda (search engine) deben encontrar sus páginas lo más rápido posible. Comprende por tanto que hay aquí un reto importante. Hay que facilitar el trabajo de los robots para que puedan crawlear e indexar al máximo todo su sitio. Si no pueden hacerlo, una parte de su sitio no será visible a ojos de los motores de búsqueda y de los internautas.
A fin de facilitar el trabajo de los robots, ya puede aplicar algunas buenas prácticas:
-
Evitar los enlaces rotos. Los enlaces rotos no son apreciados por los robots. Pueden verse llevados a detener su crawl.
-
Evitar los contenidos de menor calidad. Por ejemplo, páginas de error, contenido duplicado, navegaciones por facetas…
-
Limitar las redirecciones 301/302
-
Optimizar el tiempo de carga de su página. Un tiempo de carga largo no es bueno para su posicionamiento, pero tampoco para el internauta. Este tenderá a ir a otro sitio para encontrar la respuesta a su consulta si su sitio tarda demasiado en cargar. Pierde así prospectos.
-
Actualizar su SiteMap. Guiará con más facilidad a los robots para indexar sus páginas
Un crawl regular de su sitio Acaba de crear su sitio y constata su indexación en los motores de búsqueda. ¿Se dice que el trabajo ha terminado? Sepa que los robots pasan de manera regular por su sitio. Un sitio que se actualiza a menudo verá a los robots pasar más a menudo que un sitio estático. Cada día, los motores de búsqueda efectúan un análisis de palabras clave de las páginas para indexarlas.
La detección de Cloaking Se llama cloaking al hecho de mostrar contenidos distintos a los motores de búsqueda y a los visitantes. El servidor reconoce si es un internauta o un robot quien ha lanzado la consulta. Según este criterio, presentará contenidos distintos. Por ejemplo, para un robot, puede presentar una página más optimizada pero que no será agradable de leer para un internauta. Esta técnica es sancionada por Google.
La filtración de los contenidos de bajo valor Los motores emplean todos robots para determinar el valor añadido de un contenido para los lectores. Los contenidos más a menudo filtrados son
-
los contenidos de afiliación,
-
los contenidos duplicados
-
las páginas generadas que tienen muy poco texto.
Los motores evalúan el valor de un dominio por su originalidad y por la experiencia de visitante que ofrecen. Así, los sitios que publican contenidos de mala calidad tendrán dificultades para posicionarse en lo alto de la clasificación, aunque estén muy bien posicionados. Por ejemplo, si tiene una tasa de rebote elevada a partir de la SERP, será desclasificado por los motores de búsqueda. Significa que los internautas no encuentran respuesta a su consulta y que el contenido no es pertinente.
Por lo demás, el lanzamiento de Google Panda en 2011 muestra la voluntad del motor de búsqueda de valorizar los contenidos cualitativos. Este algoritmo se puso en marcha tras una ola importante de spams y de sitios de baja calidad. ¿Cómo se aplica la sanción? Panda penaliza los contenidos de mala calidad y a veces todo el sitio. Las páginas concernidas se desindexan entonces.
El posicionamiento según la confianza que genera su sitio Diversos elementos sirven para evaluar su sitio a fin de posicionarlo en las SERP. Uno de los criterios importantes para el search engine son los backlinks. Para medir la fiabilidad de su sitio, Google va a tomar en consideración el número de enlaces que apuntan hacia él. Para simplificar, el search engine considerará su sitio como pertinente porque numerosos sitios remiten a él. Sin embargo, el motor de búsqueda no mide únicamente la cantidad de backlinks. La calidad de estos enlaces es un criterio primordial. De hecho, cuanto más procedan sus enlaces de sitios de autoridad, más será apreciado por los motores de búsqueda. En cambio, si tiene enlaces « spammy » y de mala calidad, la herramienta de búsqueda verá eso como un fraude y aplicará una penalización. El algoritmo Penguin se creó para limpiar los índices de Google de los sitios de mala calidad que desvían el SEO mediante técnicas de linking fraudulentas.
La lucha contra los spams en los motores de búsqueda El polluposting es una práctica bien presente en la web. En alza desde mediados de los años 1990, esta práctica permite a spammers tomar posesión de sitios bien situados en los motores de búsqueda para introducir en ellos la promoción de sitios de baja calidad. Sepa que un solo día en lo alto de la clasificación en Google puede reportar hasta 20 000 € de ingresos netos. Con tales retos, no hay que extrañarse de que esta práctica haya sido tan popular. Hoy, gracias a la innovación tecnológica de Google, es cada vez más difícil de poner en marcha.
La actualidad sobre los motores de búsqueda
¿Quién detenta la mayor parte del mercado mundial de los motores de búsqueda?
La clasificación mundial de 2017 situó a Google en primera posición con una parte neta del 74,54 %. Le siguen los motores de búsqueda Yahoo, Baidu, Bing o Qwant (herramienta de búsqueda francesa), cuya parte de mercado se sitúa en torno al 7 al 10 %. Es interesante señalar que, aunque Google detente la mayor parte, esta ha disminuido lentamente a partir del 2.º trimestre de 2017, mientras que la parte de Baidu alcanzó el 14,69 %.
¿Cuántas búsquedas se efectúan cada día en los motores de búsqueda?
En 2017, el 46,8 % de la población mundial tuvo acceso a Internet. De aquí a 2021, esta cifra debería alcanzar el 53,7 %. Según las estadísticas, Google recibe 3,5 mil millones de consultas al día, es decir 1,2 billones al año. Google evoluciona con rapidez. Si en 1999, Google tardó un mes en crawlear e indexar 50 millones de páginas, en 2012 esta tarea se cumplió en menos de un minuto.
Los motores de búsqueda son por tanto aplicaciones potentes y complejas. Cada día, millones de consultas son pedidas por los internautas. Mucho más que un reto informativo, los motores de búsqueda tienen también un reto de marketing y financiero. Para hacer frente a la competencia y generar cifra a través de la web, estar bien posicionado en las SERP es primordial. Pero conocer los usos de su público objetivo lo es aún más. En 2009, solo el 0,7 % del tráfico web en el mundo entero fue generado por los teléfonos portátiles. En 2017, el móvil representa el 50,3 % del tráfico web mundial. En 10 países, entre ellos Estados Unidos y Japón, las búsquedas en móviles han superado ampliamente las efectuadas en ordenador.