Le Web : pages, liens et moteurs de recherche
Fiches

Le Web : pages, liens et moteurs de recherche

Comprendre comment une page web est décrite et identifiée, comment les liens hypertextes relient les pages entre elles, et comment un moteur de recherche parcourt, indexe puis classe les pages pour répondre à une requête.

2deSciences numériques et technologie

Lire les points essentiels

Consulter les définitions clés

Étudier un exemple guidé

Ce que dit la fiche

Les points essentiels

  • Une page web est un document décrit avec un langage de balisage, le HTML, qui organise le contenu : titres, paragraphes, images, liens.
  • La présentation d'une page (couleurs, mise en page) est décrite séparément en CSS : le HTML porte le fond, le CSS porte la forme.
  • Chaque page est identifiée par une URL, adresse unique qui permet au navigateur de la demander au bon serveur.
  • Un lien hypertexte pointe vers une autre page : c'est ce maillage de liens qui fait du Web un « réseau de documents ».
  • Un moteur de recherche explore le Web avec des robots, construit un index des pages visitées, puis classe les résultats pour une requête donnée.
  • Le référencement regroupe les techniques qui visent à améliorer la position d'un site dans les résultats d'un moteur de recherche.

Les mots à connaître

Page web
Document écrit en HTML, publié sur un serveur et accessible par une URL.
Site web
Ensemble de pages web liées entre elles, généralement placées sous un même nom de domaine.
HTML
Langage de balisage qui décrit la structure et le contenu d'une page web (titres, paragraphes, images, liens).
CSS
Langage qui décrit la présentation d'une page web : couleurs, polices, disposition des blocs.
URL
Adresse unique d'une ressource sur le Web ; elle indique notamment le protocole, le nom du serveur et le chemin de la ressource.
Lien hypertexte
Élément cliquable d'une page qui mène vers une autre ressource, identifiée par son URL.
Navigateur
Logiciel installé sur l'appareil de l'utilisateur qui demande une page à un serveur, puis l'affiche.
Serveur web
Ordinateur qui stocke des pages et les envoie au navigateur qui les demande.
Moteur de recherche
Service qui répond à une requête en proposant une liste ordonnée de pages jugées pertinentes.
Robot d'indexation
Programme automatique qui parcourt le Web de lien en lien pour découvrir des pages et les enregistrer.
Index
Base de données construite par le moteur : elle associe des mots à des pages, ce qui permet de répondre vite à une requête.
Référencement
Ensemble des moyens mis en œuvre pour qu'un site apparaisse mieux placé dans les résultats d'un moteur de recherche.

La méthode, étape par étape

  1. Étape 1 — Repère le protocole : au début de l'URL, « http:// » ou « https:// ». Le « s » indique que l'échange est chiffré.
  2. Étape 2 — Repère le nom de domaine : c'est le nom du serveur, par exemple « fr.wikipedia.org ». Il se lit de droite à gauche.
  3. Étape 3 — Repère le chemin : il indique la ressource demandée sur ce serveur, par exemple « /wiki/Page_web ».
  4. Étape 4 — Repère les paramètres : tout ce qui suit un « ? » précise la demande, par exemple une recherche ou un numéro d'article.
  5. Étape 5 — Vérifie la cohérence : le domaine doit correspondre à l'émetteur annoncé avant de faire confiance au contenu.

Des exemples résolus

Décompose l'URL suivante : https://fr.wikipedia.org/wiki/Page_web

Correction

Protocole : https, donc échange chiffré. Nom de domaine : fr.wikipedia.org, le serveur visé. Chemin : /wiki/Page_web, la ressource demandée sur ce serveur. Il n'y a pas de paramètre après un « ? » : l'adresse désigne une page précise. Le navigateur envoie cette demande au serveur fr.wikipedia.org, qui renvoie la page en HTML ; le navigateur l'affiche en appliquant son CSS.

Explique, en trois temps, ce qui se passe entre le moment où tu tapes une requête dans un moteur de recherche et l'affichage des résultats.

Correction

Temps 1 : les robots du moteur ont déjà parcouru le Web de lien en lien et enregistré le contenu des pages dans un index. Temps 2 : quand tu tapes une requête, le moteur interroge cet index pour trouver les pages qui contiennent les mots demandés. Temps 3 : il classe ces pages selon des critères de pertinence et de qualité, puis affiche une liste ordonnée de liens vers ces pages. Le moteur ne visite pas le Web en direct à chaque requête : il répond à partir de son index.

Les pièges à éviter

  • Confondre le Web et Internet. Internet est l'infrastructure mondiale de réseaux qui relie les machines ; le Web est un service qui utilise cette infrastructure, au même titre que la messagerie électronique.
  • Croire que le moteur de recherche explore le Web au moment où tu tapes ta requête. En réalité, il interroge un index déjà construit par ses robots.
  • Croire qu'une URL désigne toujours une page précise. Une même URL peut mener à un contenu différent selon les paramètres qui la suivent.
  • Croire qu'un site web est forcément une seule page. Un site regroupe le plus souvent de nombreuses pages reliées par des liens.

Teste-toi

  1. Dans l'URL « https://www.education.gouv.fr/bo/2026.html », quel élément désigne le nom du serveur à contacter ?

    Voir la réponse

    Le nom du serveur est « www.education.gouv.fr ».

    Dans une URL, le protocole vient en premier (« https »), puis le nom de domaine (« www.education.gouv.fr »), puis le chemin de la ressource (« /bo/2026.html »). C'est le nom de domaine qui indique quel serveur le navigateur doit contacter.

  2. Pourquoi un moteur de recherche peut-il répondre très vite à une requête alors que le Web contient des milliards de pages ?

    Voir la réponse

    Parce que le moteur ne parcourt pas le Web à chaque requête : il interroge un index déjà construit par ses robots.

    Des robots parcourent le Web à l'avance, de lien en lien, et enregistrent le contenu des pages dans une base appelée index. Quand une requête arrive, le moteur cherche dans cet index, ce qui est beaucoup plus rapide que de visiter les pages une par une. Il classe ensuite les résultats trouvés avant de les afficher.

  3. Quel est le rôle d'un lien hypertexte dans une page web, et qu'est-ce que cela apporte à l'ensemble du Web ?

    Voir la réponse

    Un lien hypertexte mène d'une page vers une autre ressource par son URL ; il relie les pages entre elles.

    En cliquant sur un lien, l'utilisateur passe d'une page à une autre sans taper d'adresse. Comme chaque page peut contenir plusieurs liens, les pages forment un vaste ensemble de documents reliés. C'est ce maillage qui permet aussi aux robots d'indexation de découvrir de nouvelles pages en suivant les liens.

Ce que tu vas découvrir

  • Une page web est un document décrit avec un langage de balisage, le HTML, qui organise le contenu : titres, paragraphes, images, liens.
  • La présentation d'une page (couleurs, mise en page) est décrite séparément en CSS : le HTML porte le fond, le CSS porte la forme.
  • Chaque page est identifiée par une URL, adresse unique qui permet au navigateur de la demander au bon serveur.
  • Un lien hypertexte pointe vers une autre page : c'est ce maillage de liens qui fait du Web un « réseau de documents ».

Dans cette expérience

  • Lire les points essentiels
  • Consulter les définitions clés
  • Étudier un exemple guidé

Pour quel niveau ?

  • 2de
  • Sciences numériques et technologie

Cette fiche fait partie de notre collection MathématiquesDécouvre toutes nos fiches de 3e pour réviser efficacement !

Voir toutes les fiches de 3e
♛

Avec Allo Education Premium,
apprendre prend une toute nouvelle dimension.

Billy