В первую очередь я хочу поблагодарить Вас, дорогие читатели, за интерес к рубрике с обзорами. Я заметила, что после появления в ней новых статей число подписчиков на аккаунты Библиотечной штучки в социальных сетях понемногу увеличивается, даже в неповоротливом ВК заметен рост 🙂 Вы вдохновляете меня на поиск новых интересных материалов!
Сегодня на очереди статья автора из Австралии, который рассматривает социальные сети не со стороны пользователей, а взглядом библиотекарей, заботящихся о документировании истории и сохранении информационного наследия, появляющегося в процессе использования социальных медиа.
Журнал Information, Communication & Society, в котором опубликована статья, входит в 1 квартиль Scopus, в Web of Science, также есть в Белом списке 2023 года (1 уровень). Издатель — Taylor&Francis (Великобритания).
В Австралийских библиотеках существует два разных подхода к сбору и архивированию подобной информации, о чем подробно рассказывается в статье. У каждого есть свои плюсы и минусы, о чем и рассказывает статья, учитываются как юридические, так и технологические проблемы, возникающие при архивировании. Автор полагает, что для него важнее возможность предоставления доступа в будущем к архивированной информации, поэтому методика веб-краулинга ему кажется более подходящей, дабы зафиксировать ограничения доступа, наложенные на материал в той или иной ситуации. Мне кажется, что для российской действительности важно сохранять факты публикации и трактовки событий в историческом среде, поэтому (предположительно) для целей национального хранения мне кажется более корректным сбор через API. Однако я не изучала эту проблему с точки зрения российского законодательства, поэтому не могу судить объективно.
Ниже — конспект статьи с акцентом на практическую пользу для библиотекарей и анализом культурологического подхода. «Всё строго по тексту, без домыслов» — как обещает DeepSeek (но мы с Вами помним предыдущие обзоры, и относимся ко всему с долей критики). Иллюстрацию нарисовала NanoBanana Pro по промпту, предложенному DeepSeek, используя фотографию Кейтлин.
Веб-архивы после платформизации: как собирать и читать социальные медиа
Источник: Hegarty, K. (2025). Web archives after platformization: reading social media collections along the archival grain. Information, Communication & Society, 28(12), 2175–2190. https://doi.org/10.1080/1369118X.2024.2420033
О чём статья:
Исследователь Киран Хегарти (Университет RMIT, Мельбурн) на основе этнографического и исторического анализа работы двух австралийских библиотек — Национальной библиотеки Австралии (NLA) и Библиотеки штата Новый Южный Уэльс (SLNSW) — показывает, как платформизация веба изменила содержание, характер и будущую полезность веб-архивов. Библиотеки оказываются в «двойной ловушке»: веб-краулинг даёт немедленный, но неполный доступ, а API-сбор позволяет собирать большие объёмы, но жёстко ограничивает, что и как можно сохранять и предоставлять. Автор предлагает читать веб-архивы «вдоль архивного зерна» — не только по содержанию, но и по форме, пропускам и ошибкам, чтобы увидеть следы платформизации и смены властных отношений в интернете.
Почему это важно для библиотекаря:
Библиотеки всё чаще сталкиваются с тем, что социальные медиа — ключевой источник современной культуры и общественной жизни — становятся труднодоступными для долгосрочного сохранения. Понимание технических и правовых ограничений помогает принимать обоснованные решения о стратегиях сбора, ожидать неизбежных пробелов и критически оценивать свои коллекции. А главное — осознавать, что даже «неудачные» сборы могут быть ценным свидетельством эпохи.
Для библиотекаря: главные выводы в двух абзацах
Библиотеки, которые пытаются сохранять социальные медиа, сталкиваются с двумя основными подходами, и каждый имеет серьёзные ограничения. Веб-краулинг (сбор через обход страниц) позволяет немедленно предоставлять доступ, но платформы активно блокируют краулеры, а динамические страницы (бесконечная прокрутка, капча) делают сбор фрагментарным и ошибочным. API-сбор (через официальные интерфейсы платформ) даёт структурированные данные в больших объёмах, но платформы диктуют условия: какие данные отдавать, как их можно использовать, а также могут в любой момент изменить или закрыть API. В результате библиотеки оказываются между двух огней: либо собирать неполно, но открыто, либо полно, но «закрыто» — без возможности предоставить доступ.
Главный практический вывод: не стоит воспринимать пробелы и ошибки в веб-архивах как досадные сбои. Они — ценный источник знаний о том, как устроен современный интернет: кто контролирует информацию, какие правила действуют, какие приоритеты у платформ. Библиотекарям и исследователям полезно развивать критический взгляд на свои коллекции, читая их «вдоль архивного зерна» — обращая внимание на то, чего нет, как это собрано и кто устанавливал правила.
Что такое платформизация и почему она меняет веб-архивы
В начале 2000-х веб был относительно открытым: сайты были доступны для краулеров, ссылки вели с одной страницы на другую. Сейчас интернет всё больше превращается в набор «огороженных садов» — крупных платформ (Facebook, Twitter/X, Instagram, TikTok), которые контролируют свои данные. Этот процесс называют платформизацией.
Платформы предоставляют API — интерфейсы для доступа к данным, но при этом:
- диктуют, какие данные можно получить (а какие нет),
- устанавливают условия использования (например, запрещают делиться данными),
- могут в любой момент изменить или закрыть API (как это произошло с Instagram в 2018 и с Twitter/X после покупки Маском).
Для веб-архивов это означает, что технологии, которые работали для «открытого веба», часто не работают для платформ. Традиционный краулинг всё чаще блокируется, а API-сбор ставит библиотеки в зависимость от коммерческих компаний.
Два подхода к сбору социальных медиа: краулинг и API
1. Веб-краулинг в Национальной библиотеке Австралии (NLA)
NLA с середины 1990-х собирает веб-страницы с помощью краулеров (программ-роботов, которые обходят сайты и сохраняют их копии). Это позволяет создавать доступные для публики архивы — например, Австралийский веб-архив.
Проблемы с социальными медиа:
- Платформы блокируют краулеры (капча, robots.txt, запреты в условиях использования).
- Динамические страницы с бесконечной прокруткой (как в Twitter/X) не сохраняются целиком — краулер не может «пролистать» дальше.
- В результате — фрагментарные, пустые или сломанные страницы.
Пример: библиотека долго собирала Twitter через мобильную версию, где была кнопка «Загрузить более старые твиты» — краулер мог переходить по ссылкам. В декабре 2020 Twitter убрал эту кнопку, заменив на бесконечную прокрутку. Сбор рухнул. На месте профиля теперь — белая страница или ошибка.
Попытка договориться с Facebook: в 2010 году NLA запросила у Facebook разрешение на сбор страницы тогдашнего премьер-министра. Ответ Facebook был однозначен: «возможно архивировать эти страницы, но только если вы следуете нашим правилам и используете официальные API». Однако API тогда были слишком ограничены для архивных целей.
Плюс краулинга: доступность — собранное можно сразу показать публике.
Минус: неполнота, нерегулярность, зависимость от технических уязвимостей, которые платформы быстро «латают».
2. API-сбор в Библиотеке штата Новый Южный Уэльс (SLNSW)
SLNSW с 2012 года развивает Социальный медиа-архив, собирая данные через API Twitter, Facebook, Instagram и др.
Что это даёт:
- Возможность собирать огромные объёмы данных (миллионы твитов, постов) структурированно — с метаданными (дата, геолокация, количество лайков и т.п.).
- Санкционированный платформами способ — нет блокировок.
Что ограничивает:
- API дают лишь часть данных (например, не показывают «отписки» или историю).
- Условия использования часто запрещают публиковать сырые данные или требовать их удалять, если удалён исходный пост.
- API могут меняться или закрываться — например, после скандала Cambridge Analytica в 2018 году Facebook резко ограничил доступ, а Instagram объединил свой API с Facebook, что сильно сократило возможности.
- Сотрудники SLNSW говорят: «мы находимся во власти платформ», изменения API делают то, что было возможно 5 лет назад, невозможным сегодня.
Парадокс: SLNSW имеет огромные коллекции социальных медиа, но не может предоставить к ним доступ — ни через открытый веб-интерфейс, ни через исследовательские порталы (за исключением ограниченных визуализаций вроде облаков тегов). Доступ откладывается «на 50 лет» — в надежде, что со временем правовые и технические барьеры будут сняты. Но это создаёт иллюзию будущей доступности, а пока коллекции остаются «тёмным архивом».
Двойная ловушка библиотек
Автор формулирует ситуацию как двойную ловушку (double bind):
- Краулинг → можно сразу открыть доступ, но сбор неполный и ненадёжный.
- API → можно собрать много и легально, но нельзя ни показать, ни поделиться.
Это противоречие неразрешимо в текущих условиях. Библиотеки вынуждены выбирать между двумя несовершенными путями, каждый из которых подрывает их миссию по сохранению и обеспечению доступа.
Что делать исследователям: читать архивы «вдоль зерна»
Автор предлагает подход, заимствованный у антрополога Энн Лоры Столер, которая изучала колониальные архивы. Вместо того чтобы досадовать на пробелы и ошибки, предлагается читать архив «вдоль архивного зерна» (along the archival grain) — фокусироваться не столько на содержании, сколько на форме, структуре, пропусках, плотности и распределении материалов.
Как это применить к веб-архивам:
- Пустая страница Facebook в архиве — не ошибка, а документ того, что Facebook запрещает свободный сбор.
- Исчезновение твитов после изменения мобильного интерфейса — свидетельство того, как платформа контролирует доступ к публичной информации.
- Огромный массив данных в SLNSW, который нельзя открыть, — это материальное доказательство того, что коммерческие платформы диктуют условия даже для государственных институций.
Что даёт такой взгляд: он позволяет увидеть в архивах не просто «плохо собранные данные», а историю властных отношений в интернете: кто решает, что сохранять, на каких условиях и для кого.
Практические рекомендации для библиотек и архивистов
- Документируйте ограничения. Фиксируйте, какие платформы, когда и по каким причинам не поддаются сбору. Это поможет будущим исследователям интерпретировать пробелы.
- Не скрывайте «неудачи». Включайте в описание коллекций информацию о том, что именно не удалось собрать и почему — это часть архивного контекста.
- Разрабатывайте сценарии доступа заранее. Если вы собираете через API, сразу планируйте, как (и можно ли) вы предоставите доступ — через визуализации, агрегированную статистику, закрытые исследовательские среды.
- Следите за изменениями API и условий использования. Платформы меняют правила часто и внезапно — будьте готовы к тому, что вчерашний метод сегодня перестанет работать.
- Инвестируйте в правовую экспертизу. Чтобы понимать, что разрешено, а что нет, и чтобы отстаивать интересы библиотек в диалоге с платформами.
- Используйте подход «вдоль зерна» в обучении. Рассказывайте исследователям, которые пользуются вашими архивами, что пробелы — это не дефект, а важный источник знаний о платформизации.
Культурологический подход в исследовании
Краткий ответ: культурологический подход является центральным и концептуально артикулированным.
В чём он заключается:
- Теоретическая рамка — чтение архивов как культурных артефактов. Автор опирается на работу антрополога Энн Лоры Столер, которая изучала, как колониальные архивы не просто хранят информацию, но и отражают логику власти, классификации и контроля. Хегарти переносит этот подход на веб-архивы, показывая, что они также являются продуктами властных отношений (между платформами и библиотеками).
- Фокус на форме, а не только на содержании. Вместо того чтобы искать в архивах «полные» данные, автор предлагает изучать, как они собраны, что отсутствует, как распределены материалы. Это позволяет увидеть невидимые обычно структуры — политику платформ, юридические ограничения, технические решения.
- Внимание к «моментам беспорядка». Методология Хегарти включает этнографическое наблюдение за сбоями, ошибками и противоречиями в работе архивистов. Он рассматривает их как аналитические окна, через которые видна борьба между ценностями библиотек (открытый доступ, сохранение) и ценностями платформ (контроль, коммерция).
- Исторический и институциональный контекст. Исследование показывает, как платформизация меняет многолетние практики национальных библиотек, которые раньше могли собирать практически всё в открытом вебе. Теперь их собирательская власть ограничена, и это отражает более широкий культурный сдвиг — переход от «публичного веба» к «корпоративным платформам».
- Критика идеологии «нейтральности» архивов. Автор показывает, что веб-архивы не являются нейтральным слепком интернета; они всегда отфильтрованы, ограничены, смещены. Признание этого — важный шаг к более рефлексивной архивной практике.
Итог: культурологический подход здесь — это не просто упоминание культуры, а методологическая позиция, которая превращает недостатки архивов в объект изучения и позволяет по-новому понять отношения между технологиями, обществом и памятью.
Что авторы предлагают изучать дальше
- Как меняются веб-архивы по мере дальнейшей платформизации (например, с приходом генеративного ИИ).
- Как исследователи могут использовать веб-архивы для изучения истории цифровых платформ.
- Какие новые модели доступа к архивным социальным медиа могут быть разработаны (например, через защищённые исследовательские среды).
Главный вывод для библиотечного специалиста
Платформизация веба ставит библиотеки перед сложным выбором: либо собирать неполно, но открыто, либо полно, но скрыто. В обоих случаях архивы социальных медиа будут иметь серьёзные пробелы и ограничения. Однако эти пробелы — не просто недостатки, а ценные свидетельства того, как устроен современный интернет: кто контролирует информацию, какие правила действуют и как меняются властные отношения между публичными институциями и коммерческими платформами. Читая веб-архивы «вдоль зерна» — обращая внимание на форму, структуру и пропуски, — библиотекари и исследователи могут превратить эти ограничения в источник знаний и критической рефлексии.
Конспект подготовлен по статье:
Hegarty, K. (2025). Web archives after platformization: reading social media collections along the archival grain. Information, Communication & Society, 28(12), 2175–2190.
Все факты и выводы строго из текста исследования.
Если Вы дочитали до конца — будут рада Вашим комментариям. Принимаются заявки на темы или конкретные публикации для обзора.

Comments are closed