Introducción a la ciencia de datos aplicada (Coursera)

Introducción a la ciencia de datos aplicada (Coursera)

Este curso es una primera inmersión en el mundo de la ciencia de datos, en el cual el estudiante comprenderá los fundamentos de la ciencia de datos, las características de un científico de datos, las herramientas que utiliza, la metodología que se debe seguir para este estilo de proyectos, y estará en capacidad de aplicar técnicas estadísticas para la construcción e interpretación de modelos analíticos descriptivos.

Class Deals by MOOC List - Click here and see Coursera's Active Discounts, Deals, and Promo Codes.

El curso consta de 4 módulos, cada uno de una semana, en los cuales al final del mismo, se tiene una lección dedicada al desarrollo del proyecto del curso. Los módulos son:
Módulo 1. La ciencia de datos y los científicos de datos: En este módulo, se presenta los aspectos fundamentales de la ciencia de datos, la metodología ASUM-DM para la implementación de estos proyectos y la metodología design thinking para identificar problemas y oportunidades de negocio.
Módulo 2. Análisis exploratorio de datos: En este módulo, se presenta los conceptos asociados a estadística descriptiva y exploratoria univariada, y una ejemplificación de estos mediante el uso de la herramienta Jupyter Notebook, los cuales son utilizados para validar hipótesis de negocio.
Módulo 3. Modelos analíticos basados en estadística bivariada: En este módulo, se presenta los conceptos asociados a pruebas de correlación y análisis de tablas de contingencia, y una ejemplificación de estos mediante el uso de la herramienta Jupyter Notebook, los cuales son utilizados para validar hipótesis de negocio.
Módulo 4. Comparaciones entre grupos y validación de modelos estadísticos: En este módulo, se presenta los conceptos asociados a ANOVAS a una y dos vías, y una ejemplificación de estos mediante el uso de la herramienta Jupyter Notebook, los cuales son utilizados para validar hipótesis de negocio.
Este curso está pensado para personas de diferentes disciplinas que quieran adentrarse en el mundo de la ciencia de datos, que estén iniciando estudios universitarios o con títulos de técnicos o tecnológicos, así mismo, se recomienda tener un background de conocimientos básicos en probabilidad y estadística. El aspirante a tomar este curso puede provenir de cualquier campo del conocimiento ya sea de gobierno, la industria, la consultoría, la academia, etc.
Para el desarrollo de este curso, es necesario la instalación de un programa especial (Anaconda – Jupyter Notebook) con el fin de poder realizar los análisis de los datos a través del lenguaje de programación Python, es recomendable que el equipo cuente con más de 4GB de RAM y espacio en disco duro superior a 1GB.
Course 1 of 3 in the Ciencia de datos Specializatio.

What You Will Learn

  • Identificar los aspectos fundamentales de los proyectos de ciencia de datos y la metodología ASUM-DM para proyectos de ciencia de datos
  • Hacer uso de la estadística descriptiva y exploratoria univariada a través de la herramienta Jupyter Notebook para entender datos y resultados
  • Hacer uso de la estadística bivariada para realizar análisis que involucran más de una variable con el fin de validar hipótesis

Syllabus

WEEK 1
La ciencia de datos y los científicos de datos
Bienvenidos al primer módulo del curso introducción a la ciencia de datos. En este módulo veremos distintos tópicos que te permitirán iniciar en el fascinante mundo de la ciencia de datos, en particular veremos una definición de ciencia de datos y algunos ejemplos en múltiples disciplinas en donde se pueden implementar proyectos de ciencia de datos, Así mismo, te presentaremos una primera metodología denominada ASUM-DM que te ayudará a desarrollar este tipo de proyectos y una segunda metodología denominada Design Thinking que te permitirá encontrar oportunidades analíticas en el contexto en donde te desempeñas. Finalmente, te presentaremos un caso de uso para que pongas en prácticas tus conocimientos.

WEEK 2
Análisis exploratorio de datos
Bienvenidos al segundo módulo del curso introducción a la ciencia de datos. En este módulo veremos nuestras primeras herramientas para realizar un primer análisis de datos con el fin de encontrar nuestros primeros insights relevantes para el negocio. En este módulo, veremos inicialmente los conceptos de estadística univariada, en particular se estudiarán las medidas de tendencia central, de localización o de posición y medidas de variabilidad. Así mismo, aprenderemos a representar gráficamente nuestros datos con el fin de validar hipótesis de negocio. Adicional a lo anterior en este módulo vas a tener la oportunidad de ver cómo se aplican los distintos tópicos a un caso de uso enfocado en el sector retail mediante el uso de la herramienta Jupyter Notebook. Finalmente, te presentaremos de nuevo el caso de uso de Airbnb para que pongas en prácticas tus conocimientos.

WEEK 3
Modelos analíticos basados en estadística bivariada
Bienvenidos al tercer módulo del curso introducción a la ciencia de datos. En el anterior módulo, aprendimos sobre cómo validar nuestras primeras hipótesis de negocio a través del uso de estadística exploratoria univariada, la cual nos permitía analizar cada variable por separado, ahora, nos enfrentaremos al reto de analizar dos variables al mismo tiempo, en este módulo, estudiaremos los conceptos de correlación, los cuales nos permitirá analizar dos variables cuantitativas al tiempo, adicional a ello, en este módulo tendrás la oportunidad de estudiar sobre tablas de contingencia y pruebas chi cuadrado las cuales nos ayudarán analizar dos variables categóricas al tiempo. Finalmente, vas a tener la oportunidad de ver cómo se aplican los distintos tópicos vistos en este módulo a un caso de uso enfocado en el sector retail mediante el uso de la herramienta Jupyter Notebook y pondrás en prácticas tus conocimientos aplicando todos los conceptos vistos en este módulo al caso de uso de Airbnb.

WEEK 4
Comparaciones entre grupos y validación de modelos estadísticos
Bienvenido al cuarto módulo del curso de Introducción a la ciencia de datos aplicada, denominado comparaciones entre grupos y validación de modelos estadísticos. En este módulo te voy a presentar 2 casos que he seleccionado con la intención de mostrarte la importancia de los contrastes de hipótesis y mediante pruebas de significancia estadística en los diferentes proyectos que realicemos. En ellos, podrás observar por qué es necesario validar correctamente nuestras hipótesis.

Go to Class
MOOC List is learner-supported. When you buy through links on our site, we may earn an affiliate commission.

Related Courses

Customer Analytics (Coursera) Coursera
University of Pennsylvania

Customer Analytics (Coursera)

Data about our browsing and buying patterns are everywhere. From credit card transactions and online shopping carts, to customer loyalty programs and user-generated ratings/reviews, there is a staggering amount of data that can be used to describe our past buying behaviors, predict future ones, and prescribe new ways to influence future purchasing decisions. In this brand new course, four of Wharton’s top marketing professors will dive deeper into the key areas of customer analytics: descriptive analytics, predictive analytics, prescriptive analytics, and their application to real-world business practices including Amazon, Google, and Starbucks to name a few.

Sep 14th 2026
5-12 Weeks
Six Sigma Advanced Define and Measure Phases (Coursera) Coursera
University System of Georgia

Six Sigma Advanced Define and Measure Phases (Coursera)

This course is for you if you are looking to dive deeper into Six Sigma or strengthen and expand your knowledge of the basic components of green belt level of Six Sigma and Lean. Six Sigma skills are widely sought by employers both nationally and internationally. These skills have been proven to help improve business processes and performance. This course will take you deeper into the principles and tools associated with the "Design" and "Measure" phases of the DMAIC structure of Six Sigma.

Sep 14th 2026
5-12 Weeks
Developing AI Policy (Coursera) Coursera
Fred Hutchinson Cancer Center

Developing AI Policy (Coursera)

AI tools are already changing how we work, and they will continue to do so for years. Over the next few years, we’re likely going to see AI used in ways we’ve never imagined and are not anticipating. This course will guide you as you lead your organization to adopt AI in a way that’s not unethical, illegal, or wrong. This course empowers you to make informed decisions and confidently create an AI policy that matches your organizational goals.

Sep 21st 2026
1 Week
Process Mining: Data science in Action (Coursera) Coursera
Eindhoven University of Technology

Process Mining: Data science in Action (Coursera)

Process mining is the missing link between model-based process analysis and data-oriented analysis techniques. Through concrete data sets and easy to use software the course provides data science knowledge that can be applied directly to analyze and improve processes in a variety of domains. Data science is the profession of the future, because organizations that are unable to use (big) data in a smart way will not survive. It is not sufficient to focus on data storage and data analysis. The data scientist also needs to relate data to process analysis.

Sep 21st 2026
5-12 Weeks
Ethical Issues in Data Science (Coursera) Coursera
University of Colorado Boulder

Ethical Issues in Data Science (Coursera)

Computing applications involving large amounts of data – the domain of data science – impact the lives of most people in the U.S. and the world. These impacts include recommendations made to us by internet-based systems, information that is available about us online, techniques that are used for security and surveillance, data that is used in health care, and many more. In many cases, they are affected by techniques in artificial intelligence and machine learning.

Sep 28th 2026
5-12 Weeks
Julia Scientific Programming (Coursera) Coursera
University of Cape Town

Julia Scientific Programming (Coursera)

This four-module course introduces users to Julia as a first language. Julia is a high-level, high-performance dynamic programming language developed specifically for scientific computing. This language will be particularly useful for applications in physics, chemistry, astronomy, engineering, data science, bioinformatics and many more.

Sep 14th 2026
4 Weeks
Code Free Data Science (Coursera) Coursera
University of California, San Diego

Code Free Data Science (Coursera)

The Code Free Data Science class is designed for learners seeking to gain or expand their knowledge in the area of Data Science. Participants will receive the basic training in effective predictive analytic approaches accompanying the growing discipline of Data Science without any programming requirements. Machine Learning methods will be presented by utilizing the KNIME Analytics Platform to discover patterns and relationships in data.

Sep 28th 2026
4 Weeks
Introduction to Recommender Systems: Non-Personalized and Content-Based (Coursera) Coursera
University of Minnesota

Introduction to Recommender Systems: Non-Personalized and Content-Based (Coursera)

This course, which is designed to serve as the first course in the Recommender Systems specialization, introduces the concept of recommender systems, reviews several examples in detail, and leads you through non-personalized recommendation using summary statistics and product associations, basic stereotype-based or demographic recommendations, and content-based filtering recommendations.

Sep 14th 2026
4 Weeks
Understanding China, 1700-2000: A Data Analytic Approach, Part 1 (Coursera) Coursera
The Hong Kong University of Science and Technology - HKUST

Understanding China, 1700-2000: A Data Analytic Approach, Part 1 (Coursera)

The purpose of this course is to summarize new directions in Chinese history and social science produced by the creation and analysis of big historical datasets based on newly opened Chinese archival holdings, and to organize this knowledge in a framework that encourages learning about China in comparative perspective. Our course demonstrates how a new scholarship of discovery is redefining what is singular about modern China and modern Chinese history.

Sep 28th 2026
5-12 Weeks
Introducción a Data Science: Programación Estadística con R (Coursera) Coursera
Universidad Nacional Autónoma de México

Introducción a Data Science: Programación Estadística con R (Coursera)

Este curso te proporcionará las bases del lenguaje de programación estadística R, la lengua franca de la estadística, el cual te permitirá escribir programas que lean, manipulen y analicen datos cuantitativos. Te explicaremos la instalación del lenguaje; también verás una introducción a los sistemas base de gráficos y al paquete para graficar ggplot2, para visualizar estos datos. Además también abordarás la utilización de uno de los IDEs más populares entre la comunidad de usuarios de R, llamado RStudio.

Sep 14th 2026
4 Weeks
Advanced Linear Models for Data Science 1: Least Squares (Coursera) Coursera
Johns Hopkins University

Advanced Linear Models for Data Science 1: Least Squares (Coursera)

Welcome to the Advanced Linear Models for Data Science Class 1: Least Squares. This class is an introduction to least squares from a linear algebraic and mathematical perspective. Before beginning the class make sure that you have the following: a basic understanding of linear algebra and multivariate calculus; a basic understanding of statistics and regression models; at least a little familiarity with proof based mathematics; basic knowledge of the R programming language.

Sep 21st 2026
5-12 Weeks