Слушайте и четете неограничено

Открийте безкрайна вселена от истории

  • Над 500,000 заглавия на 6 езика
  • Детски режим - безопасна зона за деца
  • Нови книги всяка седмица и ексклузивни заглавия
  • Офлайн режим
Пробвайте Storytel
BG - Details page - Device banner - 894x1036
Cover for Apache Arrow Dataset in Practice: The Complete Guide for Developers and Engineers

Apache Arrow Dataset in Practice: The Complete Guide for Developers and Engineers

Езици
Английски
Формат
Категория

Документални

"Apache Arrow Dataset in Practice"

"Apache Arrow Dataset in Practice" is a comprehensive guide for data engineers, analysts, and systems architects seeking to master high-performance, cross-language in-memory analytics using the Apache Arrow ecosystem. This authoritative book begins by setting the stage with a rich overview of Arrow’s evolution in the context of modern data interchange, deeply exploring its columnar in-memory format, abstractions like schemas and record batches, and the Dataset API's foundational principles. By blending theory with hands-on design philosophy and performance motivations, the introduction thoroughly prepares readers to leverage Arrow’s full potential in contemporary data workflows.

The heart of the book delves deeply into practical applications, covering sophisticated aspects of the Dataset API, including storage layer integration, partitioning, schema management, and expression-based filtering for scalable analytics. Readers learn efficient ingestion strategies, rigorous data validation techniques, vectorized transformations, and robust error handling to maintain data quality from source to export. Advanced chapters illuminate the mechanics of query processing—from vectorized execution and predicate pushdown to handling complex data types, aggregations, and performant joins—equipping practitioners with tools to optimize analytic workloads at any scale.

Beyond core functionalities, the book dedicates thorough coverage to real-world operations: achieving scalability across distributed environments, integrating seamlessly with leading analytics engines and data science toolkits, and maintaining security, privacy, and compliance throughout the data lifecycle. Practical guidance on debugging, optimization, and cost control is matched with a forward-looking perspective on extending Arrow and engaging with its vibrant open-source community. Through detailed case studies and in-depth technical advice, "Apache Arrow Dataset in Practice" stands as an indispensable resource for building next-generation, interoperable data applications.

© 2025 HiTeX Press (Е-книга): 6610000964550

Дата на излизане

Е-книга: 12 юли 2025 г.

Тагове

    Другите харесаха също...

    Избери своя абонамент:

    • Над 500,000 заглавия на 6 езика

    • Нови книги всяка седмица и ексклузивни заглавия

    • Детски режим - безопасна зона за деца

    • Офлайн режим

    Най-популярен

    Unlimited

    Най-добрият избор. Открийте хиляди незабравими истории.

    8.69 € | 16.99 лв. /месец
    40% отстъпка
    • 1 профил

    • Неограничен достъп

    • Избирайте от хиляди заглавия

    • Слушайте и четете неограничено

    • Прекратете по всяко време

    Пробвайте сега

    Unlimited Годишен

    Спестете 33%! Избирайте от хиляди заглавия.

    69.53 € | 135.99 лв. /година
    12 месеца на цената на 8
    • 1 профил

    • Неограничен достъп

    • Избирайте от хиляди заглавия

    • Слушайте и четете неограничено

    • Прекратете по всяко време

    Пробвайте 7 дни безплатно

    Family 2 профила

    Споделете историите със семейството или приятелите си.

    12.78 € | 24.99 лв. /30 дни
    • 2 профила

    • Неограничен достъп

    • Потопете се заедно в света на историите

    • Слушайте и четете неограничено

    • Прекратете по всяко време

    Пробвайте 7 дни безплатно

    Family 3 профила

    Споделете историите със семейството или приятелите си.

    14.99 € | 29.32 лв. /30 дни
    • 3 профила

    • Неограничен достъп

    • Потопете се заедно в света на историите

    • Слушайте и четете неограничено

    • Прекратете по всяко време

    Пробвайте 7 дни безплатно