Платформа Apache Arrow фактически является стандартом ускоренной обработки табличных данных в памяти. Она поддерживает десятки языков программирования и все чаще служит основой для создания новых систем обработки данных и баз данных. В книге подробно описан принцип работы платформы и выделено множество разнообразных компонентов, которые пользователь Arrow может применять для ускорения или упрощения своего приложения. Опираясь на примеры кода, пояснения и схемы, вы научитесь интегрировать источники данных с библиотеками Python DataFrame, такими как pandas или NumPy, и использовать Arrow Flight для создания эффективных сервисов обработки данных.
Издание предназначено разработчикам и специалистам по анализу и обработке данных, желающим изучить возможности Apache Arrow с нуля, а также будет полезно инженерам, которые создают механизмы запросов и работают с данными.

Начинаем работу с Apache Arrow.
Независимо от того, являетесь ли вы научным работником/инженером по обработке и анализу данных, специалистом по машинному обучению (ML) или инженером-программистом, пытающимся создавать приложения для анализа данных, вы, вероятно, слышали или читали о чем-то под названием Apache Arrow и либо искали дополнительную информацию, либо задавались вопросом, что это такое. Надеюсь, что эта книга послужит прочной основой для понимания того, чем является и чем не является Apache Arrow, а также справочником, который можно постоянно использовать для расширения ваших аналитических возможностей.
А пока начнем с объяснения, что такое Apache Arrow и для чего используется этот фреймворк. После этого мы подробно рассмотрим спецификации Arrow, настроим среду разработки, в которой вы сможете поэкспериментировать с библиотеками Apache Arrow, и выполним несколько простых упражнений, чтобы понять, как использовать эти библиотеки и функции.
ОГЛАВЛЕНИЕ.
Предисловие от издательства.
Вступительное слово.
Об авторе.
О рецензентах.
Предисловие.
РАЗДЕЛ 1. ОБЩИЙ ОБЗОР APACHE ARROW, ЕГО ВОЗМОЖНОСТЕЙ, ПРЕИМУЩЕСТВ И ЦЕЛЕЙ.
Глава 1. Начинаем работу с Apache Arrow.
Глава 2. Использование основных спецификаций Arrow.
Глава 3. Формат и работа с оперативной памятью.
РАЗДЕЛ 2. ВЗАИМОДЕЙСТВИЕ С ARROW: МОЩЬ ОТКРЫТЫХ СТАНДАРТОВ.
Глава 4. Расширение возможностей языков программирования с помощью Arrow C Data API.
Глава 5. Acero: механизм потоковой обработки Arrow.
Глава 6. Использование интерфейсов Arrow Datasets API.
Глава 7. Изучение протокола Apache Arrow Flight RPC.
Глава 8. Изучение Arrow Database Connectivity (ADBS).
Глава 9. Использование Arrow в рабочих процессах машинного обучения.
РАЗДЕЛ 3. РЕАЛЬНЫЕ ПРИМЕРЫ, ВАРИАНТЫ ИСПОЛЬЗОВАНИЯ И ПЕРСПЕКТИВЫ ДАЛЬНЕЙШЕГО РАЗВИТИЯ.
Глава 10. Разработки на основе технологии Apache Arrow.
Глава 11. Как принять участие в разработке Arrow.
Глава 12. Дальнейшие перспективы и планы разработки.
Предметный указатель.
Бесплатно скачать электронную книгу в удобном формате, смотреть и читать:
Скачать книгу Apache Arrow, Обработка больших данных в оперативной памяти, Топол М., 2025 - fileskachat.com, быстрое и бесплатное скачивание.
Скачать pdf
Ниже можно купить эту книгу, если она есть в продаже, и похожие книги по лучшей цене со скидкой с доставкой по всей России.Купить книги
Скачать - pdf - Яндекс.Диск.
Дата публикации:
Теги: учебник по информатике :: информатика :: компьютеры :: Топол :: обработка данных
Смотрите также учебники, книги и учебные материалы:
Предыдущие статьи:








