Arquitecturas de Big Data (Coursera)

Arquitecturas de Big Data (Coursera)

El curso de Arquitecturas de Big Data busca que identifiques las características de una solución de Big Data, los datos asociados a estas soluciones, la infraestructura requerida, y las técnicas de procesamiento escalable. Desarrollaremos ejemplos usando infraestructuras basadas en Hadoop y en Spark, teniendo presente la pertinencia de las plataformas basadas en nube pública para soportar la escalabilidad de estas soluciones.

Class Deals by MOOC List - Click here and see Coursera's Active Discounts, Deals, and Promo Codes.

El curso está dirigido a personas con conocimientos básicos en manejo de herramientas computacionales y programación en al menos uno de estos lenguajes (Python, Java).
Dado que en este curso se hará uso de un programa descargable, aseguraté de tener un computador con la siguiente configuración mínima:
Mínimo 8 GB de memoria RAM.
Mínimo 200 GB de espacio libre en disco.
Alguno de los siguientes sistemas operativos: Windows, Linux, Macintosh, o Solaris.
Course 1 of 3 in the Plataformas para procesar datos no tradicionales Specialization.
What You Will Learn

  • Determinar la pertinencia de usar tecnologías de Big Data a un problema dado
  • Desarrollar proyectos sencillos de procesamiento escalable en Spark.   
  • Conocer el rol de la computación en la nube como alternativa para procesar y almacenar Big Data, así como sus ventajas y riesgos
  • Identificar las características de una solución de Big Data, la infraestructura requerida, y las técnicas de procesamiento escalable. 

Syllabus

WEEK 1
Introducción
Te damos la bienvenida al curso "Arquitecturas de Big Data". Te invitamos a realizar las lecturas sobre acceso al curso y recursos.
¿Qué es Big Data?
Bienvenido al primer módulo del curso. En este módulo responderemos a la pregunta ¿Qué es el Big Data? Para ellos nos centraremos en conocer como llegamos hoy al Big Data, cuáles son las 3V principales e identificaremos las diferencias que tiene Big Data con las arquitecturas tradicionales.

WEEK 2
¿Cómo almacenamos Big Data?
Bienvenido al segundo módulo del curso. Dentro de este módulo nos centraremos en responder a la pregunta ¿Cómo almacenamos Big Data? Para ello identificaremos los requerimientos y desafíos de almacenamiento de Big Data, conoceremos acerca de la arquitectura conceptual y veremos algunos ejemplos, y conoceremos sobre sistemas de archivos distribuidos y sistemas manejadores de bases de datos NoSQL.

WEEK 3
¿Cómo procesamos Big Data?
Bienvenido al tercer módulo del curso. Durante el desarrollo de este módulo nos enfocaremos en responder a la pregunta ¿Cómo procesamos Big Data? Para ello trabajaremos en tres temas principales: Procesamiento escalable y Map-Rediuce, Spark y Arquitecturas para procesamientos de datos de flujos.

WEEK 4
¿Cuál es el rol de la nube en entornos Big Data?
Te damos la bienvenida al cuarto y último módulo de nuestro curso. Durante este módulo responderemos a la pregunta ¿Cuál es el rol de la nube en entornos Big Data? Para ello, una vez comprendamos los aspectos conceptuales, revisaremos las posibilidades de procesamiento y almacenamiento que hacen de la nube un entorno ideal para Big Data. También revisaremos las ventajas y riesgos de utilizar servicios públicos en la nube.

Go to Class
MOOC List is learner-supported. When you buy through links on our site, we may earn an affiliate commission.

Related Courses

Relational Database Support for Data Warehouses (Coursera) Coursera
University of Colorado System

Relational Database Support for Data Warehouses (Coursera)

Relational Database Support for Data Warehouses is the third course in the Data Warehousing for Business Intelligence specialization. In this course, you'll use analytical elements of SQL for answering business intelligence questions. You'll learn features of relational database management systems for managing summary data commonly used in business intelligence reporting. Because of the importance and difficulty of managing implementations of data warehouses, we'll also delve into storage architectures, scalable parallel processing, data governance, and big data impacts. In the assignments in this course, you can use either Oracle or PostgreSQL.

Aug 31st 2026
5-12 Weeks
Media ethics & governance (Coursera) Coursera
University of Amsterdam

Media ethics & governance (Coursera)

This course explores some of the basic theories, models and concepts in the field of media ethics. We will introduce influential ethical theories and perspectives, explore changing societal demands and expectations of media creation and media use, and we will elaborate on existing ethical norms for media professionals. After following this course, you will be able to reflect on ethical dilemmas and develop a well-substantiated argumentation for ethical decision making in a variety of media-related contexts.

Sep 21st 2026
4 Weeks
Big Data Science with the BD2K-LINCS Data Coordination and Integration Center (Coursera) Coursera
Icahn School of Medicine at Mount Sinai

Big Data Science with the BD2K-LINCS Data Coordination and Integration Center (Coursera)

In this course we briefly introduce the DCIC and the various Centers that collect data for LINCS. We then cover metadata and how metadata is linked to ontologies. We then present data processing and normalization methods to clean and harmonize LINCS data. This follow discussions about how data is served as RESTful APIs. Most importantly, the course covers computational methods including: data clustering, gene-set enrichment analysis, interactive data visualization, and supervised learning. Finally, we introduce crowdsourcing/citizen-science projects where students can work together in teams to extract expression signatures from public databases and then query such collections of signatures against LINCS data for predicting small molecules as potential therapeutics.

Sep 21st 2026
5-12 Weeks
Real-Time Big Data Access using HBase: Boosting Performance (Coursera) Coursera
LearnQuest

Real-Time Big Data Access using HBase: Boosting Performance (Coursera)

In the world of big data, the significant growth in both the sheer volume and variety of data has presented significant challenges. Apache HBase has emerged as a robust and scalable solution. HBase is a powerful, distributed, and scalable NoSQL database designed to handle large amounts of data while maintaining high performance.

Sep 14th 2026
3 Weeks
Big Data Integration and Processing (Coursera) Coursera
University of California, San Diego

Big Data Integration and Processing (Coursera)

At the end of the course, you will be able to: Retrieve data from example database and big data management systems; Describe the connections between data management operations and the big data processing patterns needed to utilize them in large-scale analytical applications; Identify when a big data problem needs data integration; Execute simple big data integration and processing on Hadoop and Spark platforms.

Sep 7th 2026
5-12 Weeks
The Importance of Listening (Coursera) Coursera
Northwestern University

The Importance of Listening (Coursera)

In this second MOOC in the Social Marketing Specialization - "The Importance of Listening" - you will go deep into the Big Data of social and gain a more complete picture of what can be learned from interactions on social sites. You will be amazed at just how much information can be extracted from a single post, picture, or video.

Aug 31st 2026
4 Weeks
Big Data: capstone project (Coursera) Coursera
Universitat Autònoma de Barcelona

Big Data: capstone project (Coursera)

En este último curso de la Especialización Big Data el estudiante tendrá la oportunidad de aplicar algunas de las herramientas y métodos aprendidos en los cursos anteriores en un caso práctico. El objetivo de este Capstone Project es mostrar un ejemplo del trabajo que se realiza diariamente en el departamento de Cosmología del Port d’Informació Científica, en Barcelona.

Sep 7th 2026
13-24 Weeks
Big Data Analysis with Scala and Spark (Scala 2 version) (Coursera) Coursera
École Polytechnique Fédérale de Lausanne

Big Data Analysis with Scala and Spark (Scala 2 version) (Coursera)

Manipulating big data distributed over a cluster using functional concepts is rampant in industry, and is arguably one of the first widespread industrial uses of functional ideas. This is evidenced by the popularity of MapReduce and Hadoop, and most recently Apache Spark, a fast, in-memory distributed collections framework written in Scala. In this course, we'll see how the data parallel paradigm can be extended to the distributed case, using Spark throughout.

Sep 14th 2026
4 Weeks