Machine learning e IA · Big Data

Big Data · Procesamiento Distribuido en Memoria con Apache Spark — Fundamentos de Arquitectura y Optimización

Introducción pública · guía completa en Eikos

Introducción

De qué trata esta guía

↑ Big Data · Ingeniería de Sistemas Distribuidos

Recorrido

Temas que aborda

  • Introducción
  • Procesamiento en Memoria con Apache Spark
  • Paradigma de computación distribuida y la evolución de Spark
  • 1.1 Comparación analítica de arquitecturas
  • Arquitectura del sistema y topología de ejecución
  • Driver Master

Conceptos relacionados

Conexiones principales

  • receta
  • sql
  • dag
  • media
  • bayes
  • calculo

Notación compatible

Muestra matemática en LaTeX

La expresión se renderiza de forma accesible y conserva debajo su fuente LaTeX.

TMapReduce=O(I(TI/O_disco+TRed+TCPU))T_{\text{MapReduce}} = O\left(I \cdot (T_{\text{I/O\_disco}} + T_{\text{Red}} + T_{\text{CPU}})\right)
Ver LaTeX fuenteT_{\text{MapReduce}} = O\left(I \cdot (T_{\text{I/O\_disco}} + T_{\text{Red}} + T_{\text{CPU}})\right)