Mejores prácticas para el procesamiento de datos en Big Data

4.9
별점
40개의 평가
제공자:
Coursera Project Network
학습자는 이 안내 프로젝트에서 다음을 수행하게 됩니다.

Utilizar las librerías adecuadas en un contexto de Big Data

Crear clúster para procesamiento masivo

Crear funciones de usuario para optimizar el análisis

Clock60 minutos
Intermediate중급
Cloud다운로드 필요 없음
Video분할 화면 동영상
Comment Dots스페인어
Laptop데스크톱 전용

En este proyecto de 1 hora, aprenderás a aplicar buenas prácticas bajo el contexto de procesamiento Big Data, utilizando una de las plataformas más importantes en la actualidad, Databricks. Además, podrás analizar las mejores opciones y librerías para la manipulación de datos sobre dataframes de Spark.

개발할 기술

  • Big Data
  • PySpark
  • Databricks

단계별 학습

작업 영역이 있는 분할 화면으로 재생되는 동영상에서 강사는 다음을 단계별로 안내합니다.

  1. Creación de clústers

  2. Uso de Dataframes, SQL y Hive

  3. Crear funciones definidas por usuario (UDF)

  4. Uso de librería Koalas

  5. Streaming de datos y joins

안내형 프로젝트 진행 방식

작업 영역은 브라우저에 바로 로드되는 클라우드 데스크톱으로, 다운로드할 필요가 없습니다.

분할 화면 동영상에서 강사가 프로젝트를 단계별로 안내해 줍니다.

검토

MEJORES PRÁCTICAS PARA EL PROCESAMIENTO DE DATOS EN BIG DATA의 최상위 리뷰

모든 리뷰 보기

자주 묻는 질문

자주 묻는 질문

궁금한 점이 더 있으신가요? 학습자 도움말 센터를 방문해 보세요.