

O'Reilly Media Learning Spark: Молниеносный анализ больших данных, обновлённое издание для Spark 1.3 с Spark SQL и Spark Streaming

Данные в различных областях становятся всё больше. Как эффективно с ними работать? Это обновлённое издание для Spark 1.3 представляет Apache Spark — систему кластерных вычислений с открытым исходным кодом, которая значительно ускоряет написание и выполнение аналитики данных.
С помощью Spark можно быстро обрабатывать большие наборы данных через простые API на Python, Java и Scala. В книге содержится новая информация о Spark SQL, Spark Streaming, настройке и Maven координатах.
Эта книга, написанная разработчиками Spark, поможет дата-сайентистам и инженерам быстро освоиться. Вы научитесь выражать параллельные задачи всего в несколько строк кода, а также рассмотрите приложения от простых пакетных задач до потоковой обработки и машинного обучения.
Быстро ознакомьтесь с возможностями Spark, такими как распределённые наборы данных, кэширование в памяти и интерактивная оболочка. Используйте мощные встроенные библиотеки Spark, включая Spark SQL, Spark Streaming и MLlib.
Освойте один подход к программированию, избегая смешивания различных инструментов, таких как Hive, Hadoop, Mahout и Storm. Узнайте, как разрабатывать интерактивные, пакетные и потоковые приложения и подключаться к источникам данных, включая HDFS, Hive, JSON и S3. Овладейте продвинутыми темами, такими как разбиение данных и общие переменные.
https://usmall.ru/image/000/00/00/eae0268ba8735d54148187c7dc75acf1.jpeg
O'Reilly Media
Learning Spark: Молниеносный анализ больших данных, обновлённое издание для Spark 1.3 с Spark SQL и Spark Streaming
3 330 ₽
















































































































































































































































































































































































