Социальные медиа как часть библиотечного фонда

В первую очередь я хочу поблагодарить Вас, дорогие читатели, за интерес к рубрике с обзорами. Я заметила, что после появления в ней новых статей число подписчиков на аккаунты Библиотечной штучки в социальных сетях понемногу увеличивается, даже в неповоротливом ВК заметен рост 🙂 Вы вдохновляете меня на поиск новых интересных материалов!

Сегодня на очереди статья автора из Австралии, который рассматривает социальные сети не со стороны пользователей, а взглядом библиотекарей, заботящихся о документировании истории и сохранении информационного наследия, появляющегося в процессе использования социальных медиа.

Журнал Information, Communication & Society, в котором опубликована статья, входит в 1 квартиль Scopus, в Web of Science, также есть в Белом списке 2023 года (1 уровень). Издатель — Taylor&Francis (Великобритания).

В Австралийских библиотеках существует два разных подхода к сбору и архивированию подобной информации, о чем подробно рассказывается в статье. У каждого есть свои плюсы и минусы, о чем и рассказывает статья, учитываются как юридические, так и технологические проблемы, возникающие при архивировании. Автор полагает, что для него важнее возможность предоставления доступа в будущем к архивированной информации, поэтому методика веб-краулинга ему кажется более подходящей, дабы зафиксировать ограничения доступа, наложенные на материал в той или иной ситуации. Мне кажется, что для российской действительности важно сохранять факты публикации и трактовки событий в историческом среде, поэтому (предположительно) для целей национального хранения мне кажется более корректным сбор через API. Однако я не изучала эту проблему с точки зрения российского законодательства, поэтому не могу судить объективно.

Ниже — конспект статьи с акцентом на практическую пользу для библиотекарей и анализом культурологического подхода. «Всё строго по тексту, без домыслов» — как обещает DeepSeek (но мы с Вами помним предыдущие обзоры, и относимся ко всему с долей критики). Иллюстрацию нарисовала NanoBanana Pro по промпту, предложенному DeepSeek, используя фотографию Кейтлин.


Веб-архивы после платформизации: как собирать и читать социальные медиа

Источник: Hegarty, K. (2025). Web archives after platformization: reading social media collections along the archival grain. Information, Communication & Society, 28(12), 2175–2190. https://doi.org/10.1080/1369118X.2024.2420033

О чём статья:
Исследователь Киран Хегарти (Университет RMIT, Мельбурн) на основе этнографического и исторического анализа работы двух австралийских библиотек — Национальной библиотеки Австралии (NLA) и Библиотеки штата Новый Южный Уэльс (SLNSW) — показывает, как платформизация веба изменила содержание, характер и будущую полезность веб-архивов. Библиотеки оказываются в «двойной ловушке»: веб-краулинг даёт немедленный, но неполный доступ, а API-сбор позволяет собирать большие объёмы, но жёстко ограничивает, что и как можно сохранять и предоставлять. Автор предлагает читать веб-архивы «вдоль архивного зерна» — не только по содержанию, но и по форме, пропускам и ошибкам, чтобы увидеть следы платформизации и смены властных отношений в интернете.

Почему это важно для библиотекаря:
Библиотеки всё чаще сталкиваются с тем, что социальные медиа — ключевой источник современной культуры и общественной жизни — становятся труднодоступными для долгосрочного сохранения. Понимание технических и правовых ограничений помогает принимать обоснованные решения о стратегиях сбора, ожидать неизбежных пробелов и критически оценивать свои коллекции. А главное — осознавать, что даже «неудачные» сборы могут быть ценным свидетельством эпохи.


Для библиотекаря: главные выводы в двух абзацах

Библиотеки, которые пытаются сохранять социальные медиа, сталкиваются с двумя основными подходами, и каждый имеет серьёзные ограничения. Веб-краулинг (сбор через обход страниц) позволяет немедленно предоставлять доступ, но платформы активно блокируют краулеры, а динамические страницы (бесконечная прокрутка, капча) делают сбор фрагментарным и ошибочным. API-сбор (через официальные интерфейсы платформ) даёт структурированные данные в больших объёмах, но платформы диктуют условия: какие данные отдавать, как их можно использовать, а также могут в любой момент изменить или закрыть API. В результате библиотеки оказываются между двух огней: либо собирать неполно, но открыто, либо полно, но «закрыто» — без возможности предоставить доступ.

Главный практический вывод: не стоит воспринимать пробелы и ошибки в веб-архивах как досадные сбои. Они — ценный источник знаний о том, как устроен современный интернет: кто контролирует информацию, какие правила действуют, какие приоритеты у платформ. Библиотекарям и исследователям полезно развивать критический взгляд на свои коллекции, читая их «вдоль архивного зерна» — обращая внимание на то, чего нет, как это собрано и кто устанавливал правила.


Что такое платформизация и почему она меняет веб-архивы

В начале 2000-х веб был относительно открытым: сайты были доступны для краулеров, ссылки вели с одной страницы на другую. Сейчас интернет всё больше превращается в набор «огороженных садов» — крупных платформ (Facebook, Twitter/X, Instagram, TikTok), которые контролируют свои данные. Этот процесс называют платформизацией.

Платформы предоставляют API — интерфейсы для доступа к данным, но при этом:

  • диктуют, какие данные можно получить (а какие нет),
  • устанавливают условия использования (например, запрещают делиться данными),
  • могут в любой момент изменить или закрыть API (как это произошло с Instagram в 2018 и с Twitter/X после покупки Маском).

Для веб-архивов это означает, что технологии, которые работали для «открытого веба», часто не работают для платформ. Традиционный краулинг всё чаще блокируется, а API-сбор ставит библиотеки в зависимость от коммерческих компаний.


Два подхода к сбору социальных медиа: краулинг и API

1. Веб-краулинг в Национальной библиотеке Австралии (NLA)

NLA с середины 1990-х собирает веб-страницы с помощью краулеров (программ-роботов, которые обходят сайты и сохраняют их копии). Это позволяет создавать доступные для публики архивы — например, Австралийский веб-архив.

Проблемы с социальными медиа:

  • Платформы блокируют краулеры (капча, robots.txt, запреты в условиях использования).
  • Динамические страницы с бесконечной прокруткой (как в Twitter/X) не сохраняются целиком — краулер не может «пролистать» дальше.
  • В результате — фрагментарные, пустые или сломанные страницы.

Пример: библиотека долго собирала Twitter через мобильную версию, где была кнопка «Загрузить более старые твиты» — краулер мог переходить по ссылкам. В декабре 2020 Twitter убрал эту кнопку, заменив на бесконечную прокрутку. Сбор рухнул. На месте профиля теперь — белая страница или ошибка.

Попытка договориться с Facebook: в 2010 году NLA запросила у Facebook разрешение на сбор страницы тогдашнего премьер-министра. Ответ Facebook был однозначен: «возможно архивировать эти страницы, но только если вы следуете нашим правилам и используете официальные API». Однако API тогда были слишком ограничены для архивных целей.

Плюс краулинга: доступность — собранное можно сразу показать публике.
Минус: неполнота, нерегулярность, зависимость от технических уязвимостей, которые платформы быстро «латают».


2. API-сбор в Библиотеке штата Новый Южный Уэльс (SLNSW)

SLNSW с 2012 года развивает Социальный медиа-архив, собирая данные через API Twitter, Facebook, Instagram и др.

Что это даёт:

  • Возможность собирать огромные объёмы данных (миллионы твитов, постов) структурированно — с метаданными (дата, геолокация, количество лайков и т.п.).
  • Санкционированный платформами способ — нет блокировок.

Что ограничивает:

  • API дают лишь часть данных (например, не показывают «отписки» или историю).
  • Условия использования часто запрещают публиковать сырые данные или требовать их удалять, если удалён исходный пост.
  • API могут меняться или закрываться — например, после скандала Cambridge Analytica в 2018 году Facebook резко ограничил доступ, а Instagram объединил свой API с Facebook, что сильно сократило возможности.
  • Сотрудники SLNSW говорят: «мы находимся во власти платформ», изменения API делают то, что было возможно 5 лет назад, невозможным сегодня.

Парадокс: SLNSW имеет огромные коллекции социальных медиа, но не может предоставить к ним доступ — ни через открытый веб-интерфейс, ни через исследовательские порталы (за исключением ограниченных визуализаций вроде облаков тегов). Доступ откладывается «на 50 лет» — в надежде, что со временем правовые и технические барьеры будут сняты. Но это создаёт иллюзию будущей доступности, а пока коллекции остаются «тёмным архивом».


Двойная ловушка библиотек

Автор формулирует ситуацию как двойную ловушку (double bind):

  • Краулинг → можно сразу открыть доступ, но сбор неполный и ненадёжный.
  • API → можно собрать много и легально, но нельзя ни показать, ни поделиться.

Это противоречие неразрешимо в текущих условиях. Библиотеки вынуждены выбирать между двумя несовершенными путями, каждый из которых подрывает их миссию по сохранению и обеспечению доступа.


Что делать исследователям: читать архивы «вдоль зерна»

Автор предлагает подход, заимствованный у антрополога Энн Лоры Столер, которая изучала колониальные архивы. Вместо того чтобы досадовать на пробелы и ошибки, предлагается читать архив «вдоль архивного зерна» (along the archival grain) — фокусироваться не столько на содержании, сколько на форме, структуре, пропусках, плотности и распределении материалов.

Как это применить к веб-архивам:

  • Пустая страница Facebook в архиве — не ошибка, а документ того, что Facebook запрещает свободный сбор.
  • Исчезновение твитов после изменения мобильного интерфейса — свидетельство того, как платформа контролирует доступ к публичной информации.
  • Огромный массив данных в SLNSW, который нельзя открыть, — это материальное доказательство того, что коммерческие платформы диктуют условия даже для государственных институций.

Что даёт такой взгляд: он позволяет увидеть в архивах не просто «плохо собранные данные», а историю властных отношений в интернете: кто решает, что сохранять, на каких условиях и для кого.


Практические рекомендации для библиотек и архивистов

  1. Документируйте ограничения. Фиксируйте, какие платформы, когда и по каким причинам не поддаются сбору. Это поможет будущим исследователям интерпретировать пробелы.
  2. Не скрывайте «неудачи». Включайте в описание коллекций информацию о том, что именно не удалось собрать и почему — это часть архивного контекста.
  3. Разрабатывайте сценарии доступа заранее. Если вы собираете через API, сразу планируйте, как (и можно ли) вы предоставите доступ — через визуализации, агрегированную статистику, закрытые исследовательские среды.
  4. Следите за изменениями API и условий использования. Платформы меняют правила часто и внезапно — будьте готовы к тому, что вчерашний метод сегодня перестанет работать.
  5. Инвестируйте в правовую экспертизу. Чтобы понимать, что разрешено, а что нет, и чтобы отстаивать интересы библиотек в диалоге с платформами.
  6. Используйте подход «вдоль зерна» в обучении. Рассказывайте исследователям, которые пользуются вашими архивами, что пробелы — это не дефект, а важный источник знаний о платформизации.

Культурологический подход в исследовании

Краткий ответ: культурологический подход является центральным и концептуально артикулированным.

В чём он заключается:

  1. Теоретическая рамка — чтение архивов как культурных артефактов. Автор опирается на работу антрополога Энн Лоры Столер, которая изучала, как колониальные архивы не просто хранят информацию, но и отражают логику власти, классификации и контроля. Хегарти переносит этот подход на веб-архивы, показывая, что они также являются продуктами властных отношений (между платформами и библиотеками).
  2. Фокус на форме, а не только на содержании. Вместо того чтобы искать в архивах «полные» данные, автор предлагает изучать, как они собраны, что отсутствует, как распределены материалы. Это позволяет увидеть невидимые обычно структуры — политику платформ, юридические ограничения, технические решения.
  3. Внимание к «моментам беспорядка». Методология Хегарти включает этнографическое наблюдение за сбоями, ошибками и противоречиями в работе архивистов. Он рассматривает их как аналитические окна, через которые видна борьба между ценностями библиотек (открытый доступ, сохранение) и ценностями платформ (контроль, коммерция).
  4. Исторический и институциональный контекст. Исследование показывает, как платформизация меняет многолетние практики национальных библиотек, которые раньше могли собирать практически всё в открытом вебе. Теперь их собирательская власть ограничена, и это отражает более широкий культурный сдвиг — переход от «публичного веба» к «корпоративным платформам».
  5. Критика идеологии «нейтральности» архивов. Автор показывает, что веб-архивы не являются нейтральным слепком интернета; они всегда отфильтрованы, ограничены, смещены. Признание этого — важный шаг к более рефлексивной архивной практике.

Итог: культурологический подход здесь — это не просто упоминание культуры, а методологическая позиция, которая превращает недостатки архивов в объект изучения и позволяет по-новому понять отношения между технологиями, обществом и памятью.


Что авторы предлагают изучать дальше

  • Как меняются веб-архивы по мере дальнейшей платформизации (например, с приходом генеративного ИИ).
  • Как исследователи могут использовать веб-архивы для изучения истории цифровых платформ.
  • Какие новые модели доступа к архивным социальным медиа могут быть разработаны (например, через защищённые исследовательские среды).

Главный вывод для библиотечного специалиста

Платформизация веба ставит библиотеки перед сложным выбором: либо собирать неполно, но открыто, либо полно, но скрыто. В обоих случаях архивы социальных медиа будут иметь серьёзные пробелы и ограничения. Однако эти пробелы — не просто недостатки, а ценные свидетельства того, как устроен современный интернет: кто контролирует информацию, какие правила действуют и как меняются властные отношения между публичными институциями и коммерческими платформами. Читая веб-архивы «вдоль зерна» — обращая внимание на форму, структуру и пропуски, — библиотекари и исследователи могут превратить эти ограничения в источник знаний и критической рефлексии.


Конспект подготовлен по статье:
Hegarty, K. (2025). Web archives after platformization: reading social media collections along the archival grain. Information, Communication & Society, 28(12), 2175–2190.
Все факты и выводы строго из текста исследования.


Если Вы дочитали до конца — будут рада Вашим комментариям. Принимаются заявки на темы или конкретные публикации для обзора.

Comments are closed