Data Munging with Perl

David Cross

Эта книга посвящена искусству обработки и преобразования данных с использованием языка Perl. Автор, Дэвид Кросс, подробно рассматривает все этапы работы с данными: от распознавания и разбора до фильтрации и трансформации. Книга начинается с введения в концепцию data munging и объясняет, почему Perl является идеальным инструментом для этих задач.

В первой части книги рассматриваются общие практики обработки данных, включая проектирование структур данных, инкапсуляцию бизнес-правил и использование UNIX-модели фильтров. Также представлены полезные идиомы Perl, такие как сложные сортировки, работа с базами данных через DBI, модуль Data::Dumper и написание эффективных командных скриптов.

Вторая часть книги посвящена конкретным типам данных: неструктурированным текстовым файлам, записям с разделителями, CSV-файлам и сложным записям. Каждая глава содержит практические примеры и готовые решения, которые можно сразу применить в реальных проектах.

Особое внимание уделяется регулярным выражениям и строковым функциям Perl, которые являются основой для распознавания и обработки данных. Книга также охватывает вопросы преобразования форматов данных, включая смену кодировок и перевод строк.

Это практическое руководство будет полезно как начинающим, так и опытным программистам, которые хотят освоить эффективные методы обработки данных с помощью Perl. Книга написана доступным языком и содержит множество примеров, которые помогают быстро разобраться в материале.