Нечеткое сопоставление данных в SQL | Fuzzy Matching Data in SQL

by Лемер Джим

мягкая обложка
$66.99In stock — ready to ship
Language
русский
Age
16+
Pages
288
Year
2024
ISBN: 9786010840379

Обзор

Книга Джима Лемера посвящена решению задачи сопоставления двух разных, но связанных наборов данных с использованием SQL. Автор представляет лучшие практики, техники и приёмы для импорта, очистки, сопоставления, оценки и анализа разнородных данных. Описанные методы позволяют выявлять и удалять дубликаты, парсить строки, извлекать данные из XML и JSON, упорядочивать данные и выполнять операции ETL. В книге приведены реальные кейсы и рабочий код, что делает материал практически применимым. Книга будет полезна администраторам баз данных, разработчикам, бизнес-аналитикам и специалистам data science.

Кому подойдёт

  • Администраторы баз данных
  • Разработчики ПО
  • Бизнес-аналитики
  • Специалисты data science
  • Инженеры данных

Ключевые особенности

  • Автор: Джим Лемер
  • Год издания: 2024
  • Издательство: Питер
  • 288 страниц, мягкая обложка
  • Язык книги: русский
  • Возрастная категория: 16+

Overview

Jim Lemer's book addresses the challenge of matching two different but related datasets using SQL. The author presents best practices, techniques, and tricks for importing, cleaning, matching, evaluating, and analyzing heterogeneous data. The described methods enable finding and removing duplicates, parsing strings, extracting data from XML and JSON, sorting data, and performing ETL operations. The book includes real-world case studies and working code, making the material practically applicable. It is useful for database administrators, developers, business analysts, and data science specialists.

Who it's for

  • Database administrators
  • Software developers
  • Business analysts
  • Data science specialists
  • Data engineers

Key features

  • Author: Jim Lemer
  • Publication year: 2024
  • Publisher: Piter
  • 288 pages, paperback
  • Language: Russian
  • Age category: 16+