Skills que aprenderás
Convocatorias
No hay convocatorias abiertas ahora mismo, pero no te pierdas la oportunidad: guarda este curso y te avisamos en cuanto se abra una convocatoria.
Recursos
No hay recursos disponibles todavía para esta convocatoria
Este curso está dirigido a profesionales que se incorporan por primera vez al entorno Databricks y que necesitan adquirir una base sólida para trabajar con notebooks y datos distribuidos en proyectos de ciencia de datos o analítica. A lo largo de las 8 horas, el participante conocerá los elementos básicos del entorno —notebook, compute, Unity Catalog y Git folders—, aprenderá a navegar por ellos y ejecutará sus primeros notebooks sobre un compute ya configurado, verificando resultados desde un estado limpio; progresará después hacia la manipulación de DataFrames con la API de PySpark, la lectura y escritura de ficheros sobre Volúmenes de Unity Catalog, y el uso de las herramientas de visualización integradas. Al finalizar, la persona será capaz de llevar a cabo un flujo de trabajo analítico completo —desde la ingesta de un fichero CSV o Parquet hasta la presentación visual de resultados— siguiendo criterios objetivos de legibilidad y organización del notebook.
Al finalizar el curso, el participante será capaz de:
Se espera un perfil que ya programa en Python de forma básica (variables, funciones, estructuras de control y manejo de colecciones) y que está familiarizado con el concepto de tabla y operaciones elementales de consulta (filtrar, agrupar, agregar), independientemente del lenguaje o herramienta utilizada previamente. Bastan nociones generales sobre ficheros CSV y entornos cloud; no se requiere experiencia previa con Spark ni con Databricks.