Слушайте и четете неограничено

Открийте безкрайна вселена от истории

  • Над 500,000 заглавия на 6 езика
  • Детски режим - безопасна зона за деца
  • Нови книги всяка седмица и ексклузивни заглавия
  • Офлайн режим
Активирайте офертата
BG - Details page - Device banner - 894x1036
Cover for Deequ Data Quality: Constraint‑Based Validation for Big Data Pipelines

Deequ Data Quality: Constraint‑Based Validation for Big Data Pipelines

Езици
Английски
Формат
Категория

Документални

"Deequ Data Quality: Constraint‑Based Validation for Big Data Pipelines"

Data quality failures in big data systems rarely look like broken code—they look like “successful” jobs shipping quietly corrupted tables. This book is for experienced data engineers, platform engineers, and analytics/ML practitioners who need enforceable guarantees, not ad‑hoc SQL spot checks. It treats data quality as an engineering discipline: explicit contracts, measurable signals, and operational response patterns that keep pipelines trustworthy without freezing delivery.

You’ll learn Deequ’s core model—metrics plus assertions—and how it maps onto Spark execution, cost, and reproducibility. The book goes deep on authoring production-grade constraints (completeness, uniqueness, validity, ranges, patterns, proportions), composing checks with stable thresholds, and turning failures into actionable diagnostics. It then operationalizes validation via VerificationSuite, showing how to plan analyzer execution, interpret VerificationResult edge cases, and implement gating strategies such as fail-fast, quarantine, and partial publishes. Profiling and constraint suggestion are covered as accelerators—followed by governance and rollout workflows that keep rules maintainable as data and business semantics evolve.

A strong working knowledge of Spark and DataFrames is assumed. Coverage includes longitudinal quality via metrics repositories, regression detection, and alerting, plus advanced patterns for partitioned/incremental data, late arrivals, custom analyzers, and real-world version compatibility across

© 2026 NobleTrex Press (Е-книга): 6610001179250

Дата на излизане

Е-книга: 9 март 2026 г.

Тагове

    Избери своя абонамент:

    • Над 500,000 заглавия на 6 езика

    • Нови книги всяка седмица и ексклузивни заглавия

    • Детски режим - безопасна зона за деца

    • Офлайн режим

    Най-популярен

    Unlimited

    Най-добрият избор. Открийте хиляди незабравими истории.

    8.69 € | 16.99 лв. /30 дни

    • Избирайте от хиляди заглавия

    • Слушайте и четете неограничено

    • Прекратете по всяко време

    Пробвайте сега

    Unlimited Годишен

    33% отстъпка от месечния абонамент. Избирайте от хиляди заглавия.

    69.53 € | 135.99 лв. /година

    12 месеца на цената на 8
    • Избирайте от хиляди заглавия

    • Слушайте и четете неограничено

    • Прекратете по всяко време

    Пробвайте 7 дни безплатно

    Family 2 профила

    Споделете историите със семейството или приятелите си.

    12.78 € | 24.99 лв. /30 дни

    • Потопете се заедно в света на историите

    • Слушайте и четете неограничено

    • Прекратете по всяко време

    Пробвайте 7 дни безплатно

    Family 3 профила

    Споделете историите със семейството или приятелите си.

    14.99 € | 29.32 лв. /30 дни

    • Потопете се заедно в света на историите

    • Слушайте и четете неограничено

    • Прекратете по всяко време

    Пробвайте 7 дни безплатно