DigiKat — izvršni pregled / executive overview

Kartografija katoličke tematike u hrvatskom digitalnom medijskom prostoru

Izvršni pregled
2021.–2026.
Objavljeno

11. kolovoza 2026.

DigiKat je istraživanje Hrvatskoga katoličkog sveučilišta koje računalnim metodama društvenih znanosti mjeri kako se o katoličkoj tematici piše i raspravlja u hrvatskom digitalnom medijskom prostoru, na portalima, društvenim mrežama i forumima. Provedeno je prema načelima otvorene znanosti.

Ovaj pregled sažima cijeli projekt. Digitalni prostor čita se kroz pet analitičkih razina. Prva pokazuje tko objavljuje i s kolikim učinkom, druga o čemu se govori, treća kako se govori, a četvrta i peta kada rasprava eruptira i kako se prostor mijenja kroz vrijeme. Zajedno one od raspršenoga korpusa objava grade jasnu kartu digitalnoga medijskog prostora katoličke tematike. Svaka razina ovdje je sažeta na najvažnije, a poveznica vodi na stranicu koja je razrađuje.

DigiKat is a research project of the Catholic University of Croatia that uses computational social science to measure how Catholic topics are written about and discussed across Croatia’s digital media space, on news portals, social networks and forums. It is conducted according to the principles of open science.

This overview summarises the whole project. The digital space is read through five analytical layers. The first shows who publishes and to what effect, the second what is being discussed, the third how it is discussed, and the fourth and fifth when debate erupts and how the space changes over time. Together they turn a scattered corpus of posts into a clear map of the digital media space around Catholic topics. Each layer is distilled here to its essentials, with a link to the page that develops it in full.

413.985
Medijskih objavaMedia posts
9
Vrsta izvora i platformiSource and platform types
44,3 mil.44.3M
InterakcijaInteractions
2021.–2026.
Razdoblje analizeAnalysis period
Kako čitati brojke — tri osnovne metrikeHow to read the numbers — three core metrics

Volumen je ukupan broj objava i mjeri produktivnost aktera. Angažman su ukupne interakcije, odnosno zbroj lajkova, komentara, dijeljenja i sličnih reakcija publike. Doseg je procijenjeni broj korisnika koji su objavu mogli vidjeti. Doseg je procjena pružatelja podataka, a ne broj stvarnih pregleda.

Volume is the total number of posts and measures how productive an actor is. Engagement is the sum of interactions: likes, comments, shares and similar audience reactions. Reach is the estimated number of users who could have seen a post. Reach is a data-provider estimate, not a count of actual views.

Mapa ekosustava

01 · 4 arhetipa aktera4 actor archetypes

Tko objavljuje i s kojim učinkom

Prva razina mjeri volumen, doseg i angažman po platformama i izvorima. Na logaritamskoj karti dosega i angažmana, s rezovima na medijanima platforme, akteri se razvrstavaju u četiri arhetipa, a to su Divovi, Graditelje zajednica, Megafone i Specijalizirane aktere. Njihovi su položaji izračunati iz podataka, a ne procijenjeni.

Mapa ekosustava, cijela analiza

Who publishes, and to what effect

The first layer measures volume, reach and engagement by platform and source. On a log–log map of reach against engagement, split at each platform’s medians, actors sort into four archetypes, namely Giants, Community Builders, Megaphones and Specialists. Their positions are computed from the data, not estimated.

Ecosystem map, full analysis

Vodoravni složeni stupci: udjeli platformi u objavama, interakcijama i dosegu. Web-portali padaju s 69,2 % objava na 40,6 % dosega, a Facebook raste s 15,3 % objava na 47,4 % dosega.

Graf pokazuje kako se svaka od tri metrike dijeli među platformama. Svaki stupac zbraja se na 100 %. „Ostale platforme” obuhvaćaju Twitter/X, Reddit, forume, Instagram, TikTok i komentare zajedno, a svaka od njih pojedinačno nosi manji udio.

The chart shows how each of the three metrics is split among platforms. Each bar sums to 100 %. “Other platforms” groups Twitter/X, Reddit, forums, Instagram, TikTok and comments together, and each of these individually carries a smaller share.

Trodijelna točkasta karta aktera po dosegu i angažmanu za web, YouTube i Facebook, s medijanskim linijama koje dijele četiri kvadranta arhetipova.

Opisna karta aktera: doseg (okomito) i interakcije (vodoravno), po platformama; veličina točke je broj objava. Izvor:Descriptive actor map: reach (vertical) and interactions (horizontal), by platform; point size is the number of posts. Source: Mapa ekosustava

Tematske struje i atmosfera diskursa

02 · 16 tematskih kategorija16 thematic categories

Tematske struje

Druga razina odgovara na pitanje o čemu se govori. Računalnom obradom teksta i rječnikom od 16 tematskih kategorija obrađen je dio korpusa. Prikaz uspoređuje učestalost, gustoću rječničkih podudaranja, zabilježene reakcije i preklapanje oznaka.

Tematske struje, cijela analiza

Thematic streams

The second layer asks what is being discussed. Computational text processing and a dictionary of 16 thematic categories are applied to part of the corpus. The view compares frequency, dictionary-match density, recorded reactions and overlap among labels.

Thematic streams, full analysis

03 · 8 emocija · RIK8 emotions · RIK

Atmosfera diskursa

Treća razina opisuje kako se govori. Mjeri se tonalitet (leksikoni CroSentilex i CroSentilex Gold), osam emocionalnih oznaka (lilaHR) te Relativni indeks konflikta (RIK). To su automatizirane leksičke mjere riječi u tekstu, a ne namjere autora, osjećaji publike ili unaprijed utvrđene komunikacijske strategije.

Atmosfera diskursa, cijela analiza

Discourse atmosphere

The third layer describes how things are said. It measures tonality (the CroSentilex and CroSentilex Gold lexicons), eight emotion labels (lilaHR) and the Relative Conflict Index (RIK). These are automated lexical measures of words in text, not author intentions, audience feelings or predefined communication strategies.

Discourse atmosphere, full analysis

Mrežni graf šesnaest tematskih kategorija; veze označavaju korelacije supojavljivanja oznaka, a položaj čvorova služi čitljivosti.

Mreža povezanosti tematskih kategorija: veze prikazuju korelacije supojavljivanja u uzorku, bez unaprijed potvrđenih klastera. Izvor:Network of thematic-category links: edges show co-occurrence correlations in the sample, without predefined confirmed clusters. Source: Tematske struje

Fokus na događaje i evolucija ekosustava

04 · prag: 3 standardne devijacijethreshold: 3 std. deviations

Fokus na događaje

Četvrta razina označava neuobičajene dane. „Digitalni seizmograf” izdvaja odstupanja dnevnog volumena i konfliktnog rječnika veća od tri standardne devijacije unutar godine. To su statističke zastavice, a ne automatski prepoznati događaji. Njihov sadržaj i mogući uzrok zahtijevaju naknadnu provjeru.

Fokus na događaje, cijela analiza

Focus on events

The fourth layer flags unusual days. A “digital seismograph” marks within-year deviations in daily volume and conflict vocabulary greater than three standard deviations. These are statistical flags, not automatically recognised events. Their content and possible causes require subsequent verification.

Focus on events, full analysis

05 · 60,3 % → 27,1 %

Evolucija ekosustava

Peta razina daje vremenski presjek. Udio deset najvećih izvora u zabilježenim interakcijama pada s 60,3 % (2021.) na 27,1 % (2025.), dok se platformski udjeli mijenjaju. Taj obrazac opisuje prikupljeni korpus i sam po sebi ne dokazuje stvarnu seobu publike ni pluralizaciju prostora.

Evolucija ekosustava, cijela analiza

Ecosystem evolution

The fifth layer offers a temporal cross-section. The share of the ten largest sources in recorded interactions falls from 60.3 % (2021) to 27.1 % (2025), while platform shares change. This pattern describes the collected corpus and does not in itself establish actual audience migration or pluralisation.

Ecosystem evolution, full analysis

Kako nastaju podaci i analitičke razine

Svaka brojka u ovom pregledu ima isti rodoslov. Od sirovih izvoza do javnih agregata podaci teku u jednom smjeru, a svaki korak proizvodi provjerljiv artefakt.

Every number in this overview shares the same lineage. From raw exports to public aggregates, the data flows in one direction, and each step produces a verifiable artefact.

01 · Prikupljanje i akumulator. Vendorski monitoring-izvozi u xlsx formatu spajaju se u akumulator koji zadržava sve isporučene retke.
01 · Collection and accumulator. Vendor monitoring exports in xlsx format are merged into an accumulator that retains every delivered row.
02 · Filtriranje. Objava unutar prvih 3.000 znakova mora pogoditi najmanje jedan odlučan i dva različita pojma iz popisa od 119, a zatim dosegnuti ocjenu modela od najmanje 0,70. Isto pravilo vrijedi za cijelo razdoblje. riječi + model
02 · Filtering. Within its first 3,000 characters, a post must match at least one decisive and two distinct terms from a list of 119, then reach a model score of at least 0.70. The same rule applies across the whole period. terms + model
03 · Službeni korpus. Izvedeni skup od 413.985 objava × 54 stupca. Redci, URL-ovi i puni tekst nisu u repozitoriju, a javni manifest bilježi opseg i pravilo rezanja. službeni korpus
03 · Official corpus. A derived dataset of 413,985 posts × 54 columns. Rows, URLs and full text are not in the repository, and a public manifest records its scope and cutting rule. official corpus
04 · Agregati. Skripta R/03_aggregate.R proizvodi 14 javnih agregata bez osobnih podataka (CC BY 4.0), iz kojih su izračunate sve brojke ovog pregleda.
04 · Aggregates. The script R/03_aggregate.R produces 14 public aggregates with no personal data (CC BY 4.0), from which every number in this overview is computed.
05 · Analitičke razine. Pet razina čita agregate i jezično obrađen tekst (udpipe, leksikoni CroSentilex, CroSentilex Gold i lilaHR) i pretvara ih u pet pogleda na isti korpus.
05 · Analytical layers. Five layers read the aggregates and the language-processed text (udpipe and the CroSentilex, CroSentilex Gold and lilaHR lexicons) and turn them into five views of the same corpus.

Projekt slijedi načela otvorene znanosti. Javni su manifest korpusa, agregati bez teksta i URL-ova, kod i metodologija. Redci službenoga korpusa i puni tekst dostupni su samo kroz zasebno odobren pristup. Više o podacima donosi stranica Baza podataka.

The project follows open-science principles. The corpus manifest, text- and URL-free aggregates, code and methodology are public. Official-corpus rows and full text require separately approved access. The Database page has more on the data.

Korpus je istraživačka infrastruktura za opaženi dio hrvatskoga digitalnog prostora, i to 9 vrsta izvora i platformi kroz 6 kalendarskih godina, uz nepotpunu 2026. godinu. Nije cjelovit popis medija ni vjerojatnosni uzorak populacije, ali javni agregati omogućuju provjeru kodiranih opisnih nalaza i razvoj novih analiza uz jasno navedene granice.

The corpus is research infrastructure for an observed portion of Croatia’s digital space, namely 9 source and platform types across 6 calendar years, with an incomplete 2026. It is neither a complete media census nor a probability sample, but its public aggregates allow coded descriptive findings to be checked and new analyses to be developed within explicit limits.

Agentski sloj i pravila po kojima projekt nastaje

Uz podatkovni i analitički sloj, projekt ima i treći, manje vidljiv sloj, agentski. Dio razvojnog posla (pisanje koda, provjere kvalitete, priprema stranica) obavlja se uz pomoć agenata umjetne inteligencije (AI), ali ne slobodnom rukom. Središnja datoteka CLAUDE.md u javnom repozitoriju djeluje kao projektni ustav. Svaki zahvat, ljudski ili strojni, prolazi kroz ista javna pravila, kodirane postupke (vještine), nezavisne provjere i tvrde brane.

Za znanstvenu je publiku ključno da taj sloj jamči i podrijetlo brojki. Svaka je vrijednost u ovom pregledu deterministička funkcija javnih agregata i manifesta, iznova izračunata pri renderiranju, pa svatko može reproducirati (ili osporiti) bilo koju brojku iz istih javnih podataka. Pregled se odbija sagraditi ako agregati ne pripadaju aktualnom korpusu, ako zbroj redaka nije 413.985 ili ako se platformski udjeli ne zatvaraju na 100 %.

Ograda je jasna i namjerna. Agenti jamče unutarnju dosljednost, nikada znanstvenu valjanost, pa oznake, tumačenja i konačne odluke ostaju ljudski. Sam je postav pritom prenosiv predložak za otvorenu računalnu društvenu znanost uz pomoć umjetne inteligencije i može postati predmetom istraživanja.

Ustroj sloja razrađen je na zasebnoj stranici, dostupnoj i na engleskom. Ona donosi ikonografski prikaz njegovih četiriju organa (pravila, vještine, provjere, zaštite), životni ciklus svakog zahvata i tvrde brane.

Alongside the data layer and the analytical layer, the project has a third and less visible one, the agentic layer. Part of the development work (writing code, quality checks, preparing pages) is done with the help of artificial-intelligence (AI) agents, but not freehand. The central file CLAUDE.md in the public repository acts as the project’s constitution. Every action, human or machine, passes through the same public rules, codified procedures (skills), independent checks and hard guards.

For a scientific audience, what matters is that this layer also guarantees number provenance. Every value in this overview is a deterministic function of the public aggregates and manifest, recomputed during rendering, so anyone can reproduce or challenge it from the same public inputs. The overview refuses to build if the aggregates do not belong to the current corpus, if their rows do not sum to 413,985, or if platform shares do not close at 100%.

The limit is clear and deliberate. The agents guarantee internal consistency, never scientific validity, so the labels, interpretations and final decisions remain human. The setup itself is a transferable template for open computational social science under AI assistance, and could become an object of study in its own right.

How the layer is built is set out on a dedicated page, also available in English. It shows the four organs (rules, skills, checks, guards), the life cycle of every change, and the hard guards.

Cijeli prikaz agentskog sloja The agentic layer, full view

Gdje dalje

Cjelovite analize, interaktivna mreža izvora i javni opis korpusa dostupni su na stranicama projekta. Mreža prikazuje objavljene profile iz Kataloga izvora na šest platformi. Reddit, forumi i komentari prisutni su u korpusu, ali nisu profilirani kao pojedinačni akteri. Poveznice su strukturne (pripadnost platformi i zajednički brend), a ne izmjereni odnosi.

The full analyses, interactive source network and public corpus description are available on the project’s pages. The network shows published Source Catalogue profiles on six platforms. Reddit, forums and comments occur in the corpus but are not profiled as individual actors. Its links are structural (platform membership and shared brand), not measured relationships.

Cijela stranica projektaFull project site Baza podatakaDatabase Mreža izvoraSource network GitHub

doc. dr. sc. Luka Šikić voditelj projekta · Hrvatsko katoličko sveučilište · DigiKatprincipal investigator · Catholic University of Croatia · DigiKat

DigiKat · CC BY 4.0 · sve su brojke izračunate iz javnih agregata pri renderiranju.DigiKat · CC BY 4.0 · all numbers are computed from the public aggregates at render time.