Mówi: | dr hab. inż. Wiesław Cetera |
Firma: | Centrum Rafinacji Informacji |
Algorytmy rafinacji informacji uporządkują i przeanalizują dane ukryte w internecie. W Google jest tylko 10 proc. wszystkich informacji
Internet to potężny zbiór informacji, z którego tylko ok. 10 proc. jest zaindeksowana w wyszukiwarce Google. Do pozostałych starają się dotrzeć badacze z Centrum Rafinacji Informacji, którzy dzięki opracowanej technologii są w stanie zebrać, oczyścić i przeanalizować dane z wielu cyfrowych źródeł. Zebrane informacje pozwalają im nie tylko określić zachodzące aktualnie procesy, lecz także prognozować np. preferencje wyborcze, zmiany gospodarcze czy nastroje społeczne.
Internet rozrósł się do takich rozmiarów, że bez pomocy zaawansowanych programów rafinacyjnych przeprowadzenie miarodajnej analizy jest niemożliwe. Do 2020 roku świat wyprodukuje 44 zettabajtów danych (1 zettabajt to bilion gigabajtów). Korzystanie z wyszukiwarki Google w celu monitorowania bieżących trendów w sieci nie wystarczy, aby przeprowadzić wiarygodne badania naukowe.
– Szukamy źródeł internetowych, szukamy różnego rodzaju repozytoriów, dostępu do bibliotek. W niektórych tematach możemy również posiłkować się mediami społecznościowymi, które są otwarte. Może się pojawić zarzut, dlaczego nie korzystamy z Google? W Google znajduje się nie więcej jak 10 proc. tej rzeczywistości wirtualnej, z którą mamy do czynienia, musimy do tych danych dotrzeć samodzielnie, próbujemy to robić i robimy to chyba dosyć skutecznie – mówi agencji informacyjnej Newseria Innowacje Wiesław Cetera z Centrum Rafinacji Informacji.
W początkowej fazie każdego projektu roboty pobierają informacje z otwartych źródeł. Dane zbierane są w różnej postaci, a następnie sprowadzane są do postaci cyfrowej. W ten sposób powstają tzw. brudne dane. Po ich oczyszczeniu (rafinacji) przystępuje się do analizy poprzez wyszukiwanie najbardziej istotnych słów oraz powiązanych z nimi innych słów (sentymentów), mających wydźwięk pozytywny lub negatywny.
– Wyszukujemy terminy podstawowe, czyli słowa klucze, artefakty czy słowa słupy, następnie szukamy tego, co wokół nich się znajduje, nie przetwarzamy całości, ale szukamy tego co najważniejsze, i na tej podstawie jesteśmy w stanie określić, czy termin związany z tematem naszych badań zmienia się pozytywnie, negatywnie, rozwija się bądź po prostu zanika. Ta dokładność prognoz jest dosyć duża, bo w przeciwieństwie do badań ankietowych nie mamy do czynienia z populacją 200 czy 1000 badanych, ale przetwarzamy terabajty danych – mówi Wiesław Cetera.
W ramach projektu Culturnomics 2.0, naukowcy z Uniwersytetu Harvarda udowodnili, że algorytmy rafinacyjne sprawdzają się do identyfikacji i przewidywania procesów, które mają dopiero nastąpić. Badacze analizowali informacje upubliczniane przez media tradycyjne i cyfrowe w czasie rzeczywistym w celu określenia nadchodzących zmian społeczno-kulturalnych. Wykorzystując tę technologię, trafnie przewidziano m.in. wybuch rewolucji na Bliskim Wschodzie, ustąpienie prezydenta Egiptu Hosniego Mubaraka, a nawet przybliżone miejsce pobytu Osamy bin Ladena.
– Badania rafinacji informacji przede wszystkim można wykorzystać do identyfikowania różnego rodzaju procesów, które zachodzą w przestrzeni gospodarczej i społecznej. To preferencje wyborcze, trendy gospodarcze, udziały w rynku, pomiary marki itd., ale możemy też spróbować odpowiedzieć na pytanie: jak będzie? Jeżeli znajdziemy jakiś odnośnik czy proces, który toczy się obiektywnie, który jest mierzalny i znajdziemy relację między światem wirtualnym a danymi rzeczywistymi, to możemy poprzez po pierwsze korelacje, po drugie analizę regresji, starać się przewidzieć, co będzie w przyszłości – przekonuje ekspert.
Analitycy Research Cosmos szacują, że wartość narzędzi analitycznych Big Data ma sięgnąć 9 mld dol. w 2023 roku, przy średniorocznym tempie wzrostu na poziomie 21,15 proc. Według szacunków Cisco w 2017 roku użytkownicy internetu przesyłali każdego miesiąca 94,55 eksabajty danych, a do 2021 roku wartość ta ma wzrosnąć do 235,66 eksabajtów.
Do pobrania
Czytaj także
- 2025-08-12: Polscy naukowcy jako pierwsi na świecie stworzyli cyrkularne mRNA metodą chemiczną. To może pomóc w leczeniu genetycznych chorób rzadkich
- 2025-08-01: M. Wawrykiewicz (PO): Postępowanie z art. 7 przeciw Węgrom pokazało iluzoryczność tej sankcji. Unia wywiera naciski poprzez negocjacje nowego budżetu
- 2025-07-15: Branża piwowarska dodaje do polskiej gospodarki ponad 20,5 mld zł rocznie. Spadki sprzedaży i produkcji piwa uderzają również w inne sektory
- 2025-07-31: Dostęp do danych kluczowy dla dobrego funkcjonowania rynku kredytowego. Wymianę informacji można jeszcze poprawić
- 2025-06-30: Polski e-commerce rośnie w siłę. Konsumentów przyciągają przede wszystkim promocje
- 2025-07-08: Maciej Dowbor: Domówki i rolki przyniosły nam dużo większą popularność niż telewizja. Ludzie nas odbierają jak dobrych znajomych
- 2025-07-22: Dog parenting jest skutkiem szerszych zmian społecznych. U źródeł rosnąca samotność i trudności w budowaniu relacji [DEPESZA]
- 2025-06-23: Polscy inżynierowie pracują w Częstochowie nad systemami do zautomatyzowanej jazdy. Opracowali jeden z najszybszych komputerów na świecie
- 2025-06-12: Wakacje wyzwaniem dla operatorów komórkowych. W najpopularniejszych kurortach ruch w sieci rośnie nawet pięciokrotnie
- 2025-06-17: Prawie 2/3 Polaków uważa się za osoby przedsiębiorcze. Kojarzy im się to z pracowitością i zaradnością
Więcej ważnych informacji
Jedynka Newserii

Konsument

Wzrost sprzedaży piw bezalkoholowych idzie w parze z inwestycjami w zieloną energię. Kompania Piwowarska ogranicza ślad węglowy i wspiera lokalne inicjatywy
Kompania Piwowarska kontynuuję realizację strategii „Lepsza Przyszłość 2030”, w której łączy ambitne cele środowiskowe, edukacja konsumentów oraz rozwój segmentu piw bezalkoholowych z realnym wsparciem dla lokalnych społeczności. Firma, będąca liderem polskiego rynku piwa, ogranicza emisję CO₂, zwiększa udział opakowań zwrotnych i angażuje pracowników w wolontariat, w tym m.in. w pomoc dla ofiar powodzi na Dolnym Śląsku.
Handel
D. Joński: Europa musi chronić swój rynek poprzez cła i wysokie standardy bezpieczeństwa dla importowanych towarów. Powinniśmy budować własny przemysł oparty na tańszej energii

Tańsza energia, a przez to niższe koszty produkcji w Europie to jeden z kierunków, który wskazuje Unia Europejska w rywalizacji z tanimi towarami z Azji, głównie z Chin. Jednocześnie rynek Starego Kontynentu powinien być chroniony poprzez zbalansowane cła oraz wysokie standardy bezpieczeństwa stawiane importowanym produktom. Zdaniem europosła Dariusza Jońskiego ważne jest rozwijanie przemysłu w Europie bez względu na narodowość właścicieli. Relacje z Chinami muszą zostać na nowo zdefiniowane i przebiegać na równych zasadach.
Handel
Poprawia się jakość raportów dużych spółek giełdowych dotyczących zrównoważonego rozwoju. Pozostają też obszary do dopracowania

Ekspertki i eksperci z Deloitte’a przeprowadzili analizę ujawnień taksonomicznych spółek notowanych na Giełdzie Papierów Wartościowych, która objęła sprawozdania z działalności za rok 2024 w części dotyczącej zrównoważonego rozwoju. To trzeci rok ujawniania stopnia zgodności przedsiębiorstw z Taksonomią Unii Europejskiej, co przekłada się na zwiększoną jakość i porównywalność prezentowanych danych. Jednocześnie można oczekiwać, że inwestycje zgodne z Taksonomią będą coraz istotniejszym elementem strategii rozwoju przedsiębiorstw w kolejnych latach.
Szkolenia

Akademia Newserii
Akademia Newserii to projekt, w ramach którego najlepsi polscy dziennikarze biznesowi, giełdowi oraz lifestylowi, a także szkoleniowcy z wieloletnim doświadczeniem dzielą się swoją wiedzą nt. pracy z mediami.