AWS Certified Cloud Practitioner

Amazon S3 et le stockage d'objets

Découvrez ce qu'est le stockage d'objets, comment Amazon S3 organise les données en buckets et en objets, et pourquoi S3 est le choix par défaut pour stocker des fichiers, des sauvegardes et des données à grande échelle.

Débutant 16 minutes 4 Objectifs d'apprentissage
  1. Définir le stockage d'objets et le comparer au stockage par blocs et au stockage de fichiers
  2. Expliquer comment Amazon S3 organise les données en buckets, objets et clés
  3. Décrire la durabilité et la disponibilité de S3 et ce que chacune signifie
  4. Identifier comment S3 garde les données privées et ses cas d'usage courants

Pourquoi c'est important

Amazon S3 est l'un des services les plus utilisés de tout AWS, et il revient sans cesse à l'examen CLF-C02. Presque tous les autres services s'y connectent d'une manière ou d'une autre : les sauvegardes atterrissent dans S3, les data lakes sont bâtis sur S3, les logs y sont écrits, et les sites statiques y sont servis. Si vous comprenez bien S3, une grande partie des questions sur le stockage devient facile.

S3 signifie Simple Storage Service. C'est du stockage d'objets, le premier des trois types de stockage que vous devez reconnaître pour l'examen. Cette leçon couvre ce qu'est le stockage d'objets, comment S3 est organisé, et les promesses de durabilité et de sécurité qui en font l'endroit par défaut où poser vos données sur AWS.

Stockage d'objets, par blocs et de fichiers

Il existe trois grandes façons de stocker des données, et AWS a un service pour chacune. Connaître la différence est un point d'examen fréquent.

TypeComment il stocke les donnéesService AWSAdapté à
Stockage d'objetsDes fichiers entiers comme objets dans un espace plat, chacun avec ses métadonnées et une clé uniqueAmazon S3Sauvegardes, médias, data lakes, sites statiques
Stockage par blocsDes volumes bruts découpés en blocs de taille fixe, attachés à un seul serveurAmazon EBSDisques de démarrage, bases de données, données applicatives à faible latence
Stockage de fichiersUne hiérarchie de dossiers et de fichiers partagée sur un réseauAmazon EFS, Amazon FSxLecteurs partagés, dépôts de contenu, applications migrées telles quelles

Le stockage d'objets ne fonctionne pas comme le disque de votre ordinateur portable. Vous ne modifiez pas une partie d'un fichier sur place. À la place, vous stockez, récupérez et remplacez des objets entiers, et chaque objet porte des métadonnées qui le décrivent. C'est ce choix de conception qui permet à S3 de monter à n'importe quelle quantité de données tout en restant simple. Les deux autres types, blocs et fichiers, ont leur propre leçon plus loin dans ce thème.

Comment Amazon S3 est organisé

S3 ne compte que quelques briques de base, et elles s'apprennent vite.

Un bucket est un conteneur pour vos objets. Vous lui donnez un nom et choisissez une Région AWS à sa création, et vous ne pouvez changer ni l'un ni l'autre par la suite. Les noms de buckets à usage général vivent dans un espace de noms mondial, donc le nom doit être unique parmi tous les comptes AWS, pas seulement le vôtre. Les objets que vous stockez restent dans la Région du bucket, sauf si vous choisissez de les copier ou de les répliquer ailleurs.

Un objet est un fichier plus les métadonnées qui le décrivent. Les métadonnées sont un ensemble de paires nom-valeur, comme le type de contenu et la date de dernière modification, et vous pouvez ajouter les vôtres. Un objet seul peut atteindre 5 To, et un bucket peut contenir n'importe quel nombre d'objets, donc la capacité totale est pratiquement illimitée.

Une clé est le nom unique d'un objet à l'intérieur de son bucket. S3 utilise une structure plate, mais une clé peut contenir des barres obliques, donc factures/2026/janvier.pdf ressemble et se comporte comme un chemin de dossier alors qu'il n'y a aucun vrai dossier en dessous. La combinaison du nom du bucket et de la clé pointe vers exactement un objet.

Bucket :  acme-rapports          (nom unique au niveau mondial, dans une seule Région)
  Clé d'objet :  factures/2026/janvier.pdf   -> le fichier PDF + métadonnées
  Clé d'objet :  logs/acces-2026-06-19.log   -> le fichier log + métadonnées

Durabilité et disponibilité

S3 fait deux promesses qui se ressemblent mais qui n'ont pas le même sens, et l'examen aime tester la différence.

La durabilité concerne le fait de ne pas perdre vos données. S3 Standard est conçu pour une durabilité de 99,999999999 %, souvent appelée onze neuf. Pour l'atteindre, S3 stocke automatiquement des copies de chaque objet dans au moins 3 zones de disponibilité de la Région. Si un disque ou même une zone de disponibilité entière tombe en panne, votre objet reste en sécurité. En pratique, vous pouvez traiter S3 comme un endroit où les données que vous déposez restent en place.

La disponibilité concerne le fait de pouvoir joindre vos données quand vous les demandez. S3 Standard est conçu pour une disponibilité de 99,99 %. Un service peut être extrêmement durable mais brièvement indisponible, donc les deux chiffres mesurent des risques différents. La durabilité protège les octets, la disponibilité protège votre accès à ces octets.

Garder les données privées

Les buckets et objets S3 sont privés par défaut. Quand vous créez un bucket, Block Public Access est activé, ce qui empêche une exposition accidentelle à internet. Rien n'est joignable tant que vous n'accordez pas l'accès explicitement.

Vous contrôlez l'accès de plusieurs façons :

  • Les politiques IAM décident ce que vos utilisateurs et rôles ont le droit de faire dans AWS, y compris dans S3.
  • Les politiques de bucket sont des règles basées sur la ressource, attachées directement à un bucket, utiles pour accorder l'accès à des principaux précis ou à des préfixes entiers.
  • Les listes de contrôle d'accès (ACL) sont un mécanisme plus ancien, désormais désactivé par défaut et rarement le bon choix.

S3 chiffre aussi les nouveaux objets au repos par défaut et prend en charge le chiffrement en transit. Et avec le versioning S3, vous pouvez conserver plusieurs versions d'un objet pour récupérer après une suppression ou un écrasement accidentel. Vous n'avez pas besoin des détails poussés pour l'examen, mais retenez que S3 est privé et contrôlé en accès dès le départ.

Cas d'usage courants

S3 convient à un large éventail de tâches. Les plus courantes à reconnaître :

  • Sauvegarde et restauration, et archivage à long terme des données que vous devez conserver.
  • Data lakes et analytique big data, où d'énormes jeux de données sont interrogés sur place.
  • Hébergement de sites statiques, en servant directement le HTML, les images, le CSS et le JavaScript.
  • Stockage de médias pour les images, la vidéo et les gros fichiers utilisés par les applications.
  • Données et logs applicatifs, y compris le contenu téléversé par les utilisateurs.

Une règle simple pour l'examen : si une question décrit le stockage de fichiers, d'objets, de sauvegardes ou de grandes données non structurées, sans besoin d'un système de fichiers ni d'un disque de démarrage, la réponse est presque toujours Amazon S3.

Points clés pour l'examen

  • Amazon S3 est du stockage d'objets. Le stockage par blocs, c'est Amazon EBS, et le stockage de fichiers, c'est Amazon EFS et Amazon FSx.
  • Un bucket est un conteneur au nom unique au niveau mondial, lié à une seule Région. Un objet est un fichier plus ses métadonnées, identifié par une clé.
  • Un objet seul peut atteindre 5 To, et le stockage total est pratiquement illimité.
  • S3 Standard est conçu pour onze neuf (99,999999999 %) de durabilité en stockant les données dans au moins 3 zones de disponibilité, et pour 99,99 % de disponibilité.
  • La durabilité, c'est ne pas perdre les données ; la disponibilité, c'est pouvoir les joindre. Ce sont deux mesures différentes.
  • Les buckets sont privés par défaut, avec Block Public Access activé. Vous accordez l'accès avec des politiques IAM, des politiques de bucket ou des points d'accès.
  • Pensez à S3 quand un scénario implique des sauvegardes, des archives, des data lakes, des sites statiques ou le stockage de gros fichiers.