Media Cloud to otwarta infrastruktura badawcza służąca do gromadzenia, wyszukiwania i analizowania wiadomości publikowanych w internecie. Projekt powstał w 2011 roku w Berkman Klein Center for Internet & Society na Harvard University, był następnie rozwijany w MIT Media Lab, a obecnie jest prowadzony wspólnie przez University of Massachusetts Amherst, Northeastern University i Media Ecosystems Analysis Group.

Platforma jest nastawiona przede wszystkim na badanie dyskursu medialnego, a nie czytanie pojedynczych artykułów. Pozwala sprawdzić, jak często media zajmują się określonym tematem, jak zainteresowanie zmienia się w czasie, jakie słowa dominują w przekazie oraz które źródła najczęściej publikują materiały pasujące do zapytania. Obecna infrastruktura Media Cloud obejmuje bazę ponad miliarda materiałów informacyjnych, a Directory indeksuje ponad 25 tys. regularnie monitorowanych źródeł.

Najlepsze do:

  • analizowania, jak często media piszą o konkretnym zagadnieniu,
  • mierzenia zmian zainteresowania tematem w czasie,
  • identyfikowania wydarzeń powodujących nagłe wzrosty liczby publikacji,
  • porównywania natężenia relacji w różnych grupach mediów,
  • badania języka i słownictwa używanego do opisywania określonych tematów,
  • porównywania narracji medialnych między państwami, językami i grupami źródeł,
  • sprawdzania, które media najczęściej publikują na dany temat,
  • budowania własnych zestawów źródeł do badań medioznawczych,
  • analizowania mediów krajowych, lokalnych i hiperlokalnych; Media Cloud posiada kolekcje źródeł z ponad 100 krajów,
  • badań nad framingiem, agenda-setting, widocznością tematów i zmianami dyskursu,
  • pobierania danych zagregowanych, np. liczby publikacji w czasie, najczęstszych słów, języków i źródeł,
  • prowadzenia bardziej zaawansowanych zapytań z operatorami AND, OR, NOT, wyszukiwaniem fraz, wildcardami i proximity search,
  • pracy programowej z danymi przez API i pakiet Python; nowe Online News Archive udostępnia przez API ponad 200 mln stale aktualizowanych rekordów,
  • prowadzenia szerszej kwerendy razem z GDELT, Factiva, Nexis Uni, Europresse, Global Newsstream, NewsBank Access World News i Gale OneFile: News. Media Cloud wyróżnia się tym, że jest przede wszystkim narzędziem analizy korpusu mediów, a nie komercyjną bazą do czytania artykułów.

Na co uważać?

  • Media Cloud nie jest kompletnym archiwum internetu ani wszystkich mediów. System śledzi określone źródła i pobiera treści głównie przez RSS oraz sitemap,
  • dla danego źródła baza może zawierać materiały dopiero od momentu, w którym Media Cloud zaczęło je monitorować; późniejsze dodanie źródła nie oznacza automatycznego odtworzenia całego wcześniejszego archiwum,
  • zakres chronologiczny różni się więc bardzo mocno między źródłami,
  • nie wszystkie media są monitorowane równie intensywnie, dlatego bezpośrednie porównywanie liczby artykułów między krajami lub grupami źródeł wymaga sprawdzenia pokrycia korpusu,
  • Media Cloud indeksuje również media stronnicze, propagandowe i niewiarygodne, jeśli są istotne dla projektu badawczego. Obecność źródła w bazie nie jest oceną jego jakości,
  • platforma zapisuje tekst artykułów, aby umożliwić wyszukiwanie pełnotekstowe, ale nie pozwala pobierać tego tekstu z powodu praw autorskich. Użytkownik otrzymuje m.in. URL, tytuł i metadane materiału,
  • dlatego Media Cloud nie zastępuje Factiva, Nexis Uni czy Global Newsstream, jeżeli celem jest bezpośrednie czytanie archiwalnych pełnych tekstów,
  • część materiałów źródłowych może z czasem zniknąć z internetu, mimo że rekord i URL pozostają w Media Cloud,
  • wyszukiwanie bazuje na automatycznie pozyskanym tekście, metadanych i klasyfikacji języka, więc możliwe są błędy ekstrakcji,
  • przy analizach ilościowych trzeba kontrolować liczbę monitorowanych źródeł, okres pokrycia oraz intensywność publikowania poszczególnych mediów,
  • konto użytkownika jest wymagane do korzystania z głównej platformy Search,
  • domyślny limit wynosi 4000 zapytań API tygodniowo; Media Cloud przewiduje możliwość zwiększenia limitów i usług płatnych dla bardziej wymagających projektów,
  • twórcy podkreślają, że platforma jest projektowana przede wszystkim dla badań akademickich, dziennikarskich i organizacji non-profit, a nie jako komercyjne narzędzie do monitoringu marek i rynku.

Typ:

Otwarta platforma do gromadzenia, wyszukiwania, ilościowej analizy i wizualizacji internetowego dyskursu medialnego.

Dla kogo:

Medioznawcy, socjolodzy, politolodzy, badacze komunikacji, dziennikarze, specjaliści digital humanities i data science oraz osoby prowadzące ilościowe i porównawcze badania dyskursu medialnego.

Zawartość:

Media Cloud gromadzi przede wszystkim materiały z internetowych serwisów informacyjnych. Monitorowane źródła obejmują duże globalne media, serwisy krajowe i lokalne, media hiperlokalne, popularne blogi oraz niektóre publikacje branżowe. Źródła są organizowane w kolekcje geograficzne, tematyczne i badawcze. Dla każdego materiału system zapisuje m.in. URL, tytuł, źródło, datę publikacji, datę indeksowania i język. Wyodrębniony tekst jest przechowywany wewnętrznie i służy do wyszukiwania, ale nie jest udostępniany do pobrania. Narzędzie Search pozwala analizować liczbę wyników, udział tematu w całym przekazie, zmiany zainteresowania w czasie, najczęstsze słowa, języki i źródła. Dane stojące za wykresami można pobierać jako CSV.

Pełny tekst:

Tylko metadane. Media Cloud indeksuje i przeszukuje pełną treść pobranych materiałów, ale ze względów prawnoautorskich nie udostępnia użytkownikowi tekstu artykułu do pobrania. Wyniki zawierają m.in. tytuł, URL, datę, źródło i język, a właściwy artykuł trzeba otworzyć w serwisie wydawcy.

Dostęp:

Darmowy. Korzystanie z głównych narzędzi wymaga bezpłatnego konta. Publiczne API ma limity zapytań, a zwiększone limity i niestandardowe usługi mogą być oferowane odpłatnie.

Ostatnio sprawdzono: październik 2026

Twoje zapisane źródła

Ładowanie listy...