Data Munging with Perl
Эта книга посвящена искусству обработки и преобразования данных с использованием языка Perl. Автор, Дэвид Кросс, подробно рассматривает все этапы работы с данными: от распознавания и разбора до фильтрации и трансформации. Книга начинается с введения в концепцию data munging и объясняет, почему Perl является идеальным инструментом для этих задач.
В первой части книги рассматриваются общие практики обработки данных, включая проектирование структур данных, инкапсуляцию бизнес-правил и использование UNIX-модели фильтров. Также представлены полезные идиомы Perl, такие как сложные сортировки, работа с базами данных через DBI, модуль Data::Dumper и написание эффективных командных скриптов.
Вторая часть книги посвящена конкретным типам данных: неструктурированным текстовым файлам, записям с разделителями, CSV-файлам и сложным записям. Каждая глава содержит практические примеры и готовые решения, которые можно сразу применить в реальных проектах.
Особое внимание уделяется регулярным выражениям и строковым функциям Perl, которые являются основой для распознавания и обработки данных. Книга также охватывает вопросы преобразования форматов данных, включая смену кодировок и перевод строк.
Это практическое руководство будет полезно как начинающим, так и опытным программистам, которые хотят освоить эффективные методы обработки данных с помощью Perl. Книга написана доступным языком и содержит множество примеров, которые помогают быстро разобраться в материале.
