AWS Certified Cloud Practitioner

Amazon S3 y el almacenamiento de objetos

Aprende qué es el almacenamiento de objetos, cómo Amazon S3 organiza los datos en buckets y objetos, y por qué S3 es la opción por defecto para guardar archivos, copias de seguridad y datos a gran escala.

Principiante 16 minutos 4 Objetivos de aprendizaje
  1. Definir el almacenamiento de objetos y compararlo con el almacenamiento de bloques y de archivos
  2. Explicar cómo Amazon S3 organiza los datos en buckets, objetos y claves
  3. Describir la durabilidad y la disponibilidad de S3 y qué significa cada una
  4. Identificar cómo S3 mantiene los datos privados y sus usos más comunes

Por qué esto importa

Amazon S3 es uno de los servicios más usados de todo AWS, y aparece sin parar en el examen CLF-C02. Casi todos los demás servicios se conectan a él de alguna forma: las copias de seguridad caen en S3, los data lakes se construyen sobre S3, los logs se escriben en S3 y los sitios web estáticos se sirven desde S3. Si entiendes bien S3, una buena parte de las preguntas de almacenamiento se vuelven fáciles.

S3 significa Simple Storage Service. Es almacenamiento de objetos, el primero de los tres tipos de almacenamiento que debes reconocer para el examen. Esta lección cubre qué es el almacenamiento de objetos, cómo se organiza S3, y las promesas de durabilidad y seguridad que lo convierten en el lugar por defecto para guardar datos en AWS.

Almacenamiento de objetos, bloques y archivos

Hay tres formas principales de guardar datos, y AWS tiene un servicio para cada una. Conocer la diferencia es un punto frecuente del examen.

TipoCómo guarda los datosServicio de AWSBueno para
Almacenamiento de objetosArchivos completos como objetos en un espacio plano, cada uno con metadatos y una clave únicaAmazon S3Copias de seguridad, medios, data lakes, sitios estáticos
Almacenamiento de bloquesVolúmenes crudos divididos en bloques de tamaño fijo, conectados a un servidorAmazon EBSDiscos de arranque, bases de datos, datos de apps con baja latencia
Almacenamiento de archivosUna jerarquía de carpetas y archivos compartida por redAmazon EFS, Amazon FSxUnidades compartidas, repositorios de contenido, apps migradas tal cual

El almacenamiento de objetos no funciona como el disco de tu computadora. No editas una parte de un archivo en su lugar. En cambio, guardas, recuperas y reemplazas objetos completos, y cada objeto carga metadatos que lo describen. Este diseño es lo que le permite a S3 escalar a cualquier cantidad de datos sin dejar de ser simple. Los otros dos tipos, bloques y archivos, tienen su propia lección más adelante en este tema.

Cómo se organiza Amazon S3

S3 tiene pocas piezas, y se aprenden rápido.

Un bucket es un contenedor para tus objetos. Le das un nombre y eliges una región de AWS cuando lo creas, y después no puedes cambiar ninguno de los dos. Los nombres de los buckets de uso general viven en un espacio de nombres global, así que el nombre tiene que ser único entre todas las cuentas de AWS, no solo la tuya. Los objetos que guardas se quedan en la región del bucket, salvo que elijas copiarlos o replicarlos a otro lado.

Un objeto es un archivo más los metadatos que lo describen. Los metadatos son un conjunto de pares nombre-valor, como el tipo de contenido y la fecha de última modificación, y puedes agregar los tuyos. Un solo objeto puede pesar hasta 5 TB, y un bucket puede contener cualquier número de objetos, así que la capacidad total es prácticamente ilimitada.

Una clave es el nombre único de un objeto dentro de su bucket. S3 usa una estructura plana, pero una clave puede contener barras, así que facturas/2026/enero.pdf se ve y se comporta como una ruta de carpetas aunque no haya carpetas reales debajo. La combinación del nombre del bucket y la clave apunta a exactamente un objeto.

Bucket:  acme-reportes          (nombre único a nivel global, en una región)
  Clave de objeto:  facturas/2026/enero.pdf       -> el archivo PDF + metadatos
  Clave de objeto:  logs/acceso-2026-06-19.log    -> el archivo de log + metadatos

Durabilidad y disponibilidad

S3 hace dos promesas que suenan parecidas pero significan cosas distintas, y al examen le gusta probar la diferencia.

La durabilidad trata de no perder tus datos. S3 Standard está diseñado para una durabilidad del 99.999999999%, que se suele llamar once nueves. Para llegar ahí, S3 guarda copias de cada objeto en al menos 3 zonas de disponibilidad de la región. Si falla un disco o incluso una zona de disponibilidad entera, tu objeto sigue a salvo. En la práctica, esto significa que puedes tratar a S3 como un lugar donde los datos que pones se quedan donde los pusiste.

La disponibilidad trata de poder alcanzar tus datos cuando los pides. S3 Standard está diseñado para una disponibilidad del 99.99%. Un servicio puede ser muy durable pero estar brevemente no disponible, así que los dos números miden riesgos distintos. La durabilidad protege los bytes; la disponibilidad protege tu acceso a ellos.

Mantener los datos privados

Los buckets y objetos de S3 son privados por defecto. Cuando creas un bucket, Block Public Access viene activado, lo que evita la exposición accidental a Internet. Nada es accesible hasta que otorgas acceso de forma explícita.

Controlas el acceso de varias maneras:

  • Las políticas de IAM deciden qué pueden hacer tus usuarios y roles en AWS, incluido S3.
  • Las políticas de bucket son reglas basadas en recursos que se adjuntan directamente a un bucket, útiles para dar acceso a principales específicos o a prefijos completos.
  • Las listas de control de acceso (ACL) son un mecanismo más antiguo, ahora desactivado por defecto y rara vez la opción correcta.

S3 también cifra los objetos nuevos en reposo por defecto y admite cifrado en tránsito. Y con el versionado de S3 puedes mantener varias versiones de un objeto para recuperarte de un borrado o sobrescritura accidental. No necesitas los detalles a fondo para el examen, pero sí debes saber que S3 es privado y con control de acceso desde el primer momento.

Casos de uso comunes

S3 sirve para una gran variedad de trabajos. Los más comunes para reconocer:

  • Copia de seguridad y restauración, y archivado a largo plazo de datos que debes conservar.
  • Data lakes y analítica de big data, donde se consultan grandes conjuntos de datos en su lugar.
  • Alojamiento de sitios web estáticos, sirviendo HTML, imágenes, CSS y JavaScript directamente.
  • Almacenamiento de medios para imágenes, video y archivos grandes que usan las aplicaciones.
  • Datos de aplicaciones y logs, incluido el contenido que suben los usuarios.

Una regla simple para el examen: si una pregunta describe guardar archivos, objetos, copias de seguridad o datos grandes no estructurados, y no hay necesidad de un sistema de archivos ni de un disco de arranque, la respuesta casi siempre es Amazon S3.

Consejos para el examen

  • Amazon S3 es almacenamiento de objetos. El almacenamiento de bloques es Amazon EBS, y el de archivos es Amazon EFS y Amazon FSx.
  • Un bucket es un contenedor con un nombre único a nivel global, atado a una región. Un objeto es un archivo más metadatos, identificado por una clave.
  • Un solo objeto puede pesar hasta 5 TB, y el almacenamiento total es prácticamente ilimitado.
  • S3 Standard está diseñado para once nueves (99.999999999%) de durabilidad guardando los datos en al menos 3 zonas de disponibilidad, y 99.99% de disponibilidad.
  • Durabilidad significa no perder datos; disponibilidad significa poder alcanzarlos. Son medidas distintas.
  • Los buckets son privados por defecto, con Block Public Access activado. Otorgas acceso con políticas de IAM, políticas de bucket o access points.
  • Recurre a S3 cuando un escenario involucre copias de seguridad, archivado, data lakes, sitios web estáticos o guardar archivos grandes.