Loading AI tools
Из Википедии, свободной энциклопедии
Археология данных (англ. Data archaeology) — реконструкция и дешифровка данных с носителей информации, которые вышли из употребления или были повреждены в результате природной или техногенной катастрофы. Также к археологии данных относится процесс дешифровки информации, записанной в устаревшем формате данных.
Методы археологии данных чаще всего применяются для восстановления научной и финансовой информации. В частности, значительная часть астрономической информации до сих пор хранится на физически и морально устаревших носителях. Коммерческие организации обязаны хранить финансовую информацию многие годы; однако ранние финансовые записи часто становятся недоступными для использования из-за смены форматов и поколений носителей информации.
Термин «data archaeology» был впервые использован в 1993 году в описании проекта Global Oceanographic Data Archaeology and Rescue Project (GODAR). Целью проекта была реконструкция данных со спутника Nimbus 2, работавшего в 60-х годах XX века. Реконструкция этих данных позволила получить уникальную информацию об изменениях климата Арктики того времени[1].
Другим крупным «археологическим» проектом стал Lunar Orbiter Image Recovery Project (LOIRP). Специалисты NASA использовали методы археологии данных для спасения астрономической информации со старинной компьютерной ленты, созданной в середине прошлого века[2].
Методы археологии данных были использованы при ликвидации последствий урагана Мэрилин в 1996 году. Так, Национальное управление архивов и документации США в содружестве с Национальной медиа-лабораторией США (National Media Lab) произвели успешное восстановление информации с дискет, повреждённых морской водой и песком[3].
Археология данных использует многие из общих методов восстановления информации, но не сводится к ним. Это связано с тем, что в рамках археологии данных недостаточно просто восстановить информацию, нужно сделать её понимаемой[3].
Важным фактором в процессе извлечения информации является соотношение важности информации и затрат на её извлечение; при неограниченных ресурсах информация может быть извлечена и дешифрована почти с любого носителя[4].
Использование тех или иных методов главным образом зависит от типа носителя. К примеру, для археологии данных, размещенных на магнитной ленте, на подготовительном этапе могут применяться реабсорбция покрытия ленты, нанесение на ленту специальной смазки, применение специальных методов очистки ленты[5][6][6].
Существуют специализированные организации, использующие методы археологии данных для восстановления информации с устаревших или повреждённых носителей, среди крупнейших — National Media Lab USA и Storelab Data Recovery[7][8].
Цифровой тёмный век — сценарий возможного будущего, при котором многие исторические цифровые документы и мультимедиа будут фактически утеряны, так как никто не сможет их открыть. Несовместимое оборудование и операционные системы, утерянные кодеки и вышедшие из употребления форматы данных сделают невозможным доступ ко многим файлам XX—XXI веков[9][10].
Seamless Wikipedia browsing. On steroids.
Every time you click a link to Wikipedia, Wiktionary or Wikiquote in your browser's search results, it will show the modern Wikiwand interface.
Wikiwand extension is a five stars, simple, with minimum permission required to keep your browsing private, safe and transparent.