MONARH AI · PROCEDURA STUDIULUI DE PRECIZIE
Metoda se publică
înaintea rezultatului.
Tot ce citiți mai jos e fixat înainte de tragerea eșantionului și înainte de prima etichetă. Pragurile sunt scrise dinainte, ca să nu poată fi mutate după ce se văd datele.
pre-înregistrat 12.08.2026 · publicat 14.08.2026
întrebările și pragurile sunt cele pre-înregistrate și nu s-au schimbat de atunci
rezultatele se publică la încheierea etichetării, oricare ar fi ele
01 / Întrebările
Cinci întrebări, formulate o singură dată. Prima e cea care contează. Celelalte patru există ca să o poată apăra.
Două paliere de decizie, măsurate separat
Sistemul ia în practică două decizii diferite, deci se măsoară amândouă, cu praguri alese după rolul fiecăreia înainte de a se vedea vreo etichetă.
| Palier | Sistemul afirmă când dă | Omul afirmă când dă | Acoperire | Confirmare |
|---|---|---|---|---|
| Dezinformare | HIGH · CRITICAL | ridicat · critic | ≥ 0,70 | ≥ 0,60 |
| Rău posibil cel puțin mediu | MEDIUM · HIGH · CRITICAL | mediu · ridicat · critic | ≥ 0,85 | ≥ 0,40 |
Palierul de sus produce afirmații publice, deci i se cere confirmare mare. Cel de jos e o plasă de triaj, unde costul unei alarme false e timp de verificare, deci i se cere acoperire mare și i se admite o confirmare mai mică. Cele două se publică întotdeauna împreună: unul dat singur ar permite alegerea celui care iese mai bine după ce se văd datele.
De ce palierul de jos nu poartă numele de material inflamator. Evaluatorul e întrebat cât rău poate face materialul dacă cineva îl crede: dacă e fals, dacă are o țintă și dacă îndeamnă la ceva. Dacă ațâță rămâne o întrebare nepusă, fiindcă un material poate ațâța fără să afirme nimic fals. Palierul poartă numele lucrului care a fost măsurat.
02 / Ce nu poate răspunde acest studiu
- Numitorul se oprește la ce a colectat MONARH și nu cuprinde tot TikTok-ul din România. Nu există o listă completă a TikTok-ului românesc, deci nu se poate trage un eșantion din el. Cifra se raportează cu formularea „din fluxul monitorizat".
- Acoperirea colectării se măsoară separat și se raportează ca a doua cifră. Abia produsul celor două cifre se apropie de „din tot ce circulă", iar înmulțirea lor nu se face niciodată în tăcere.
- Dezinformarea rămâne o judecată umană. Manualul de codare o fixează și alfa îi măsoară stabilitatea, fără ca vreunul din ele să o transforme într-o măsurătoare obiectivă. Rezultatul se scrie ca „acord cu doi evaluatori antrenați".
03 / Populația și eșantionul
Populația înseamnă toate postările din bază la momentul tragerii, adică tot ce a văzut colectorul, inclusiv ce a considerat fără risc. Se îngheață într-un fișier înainte de tragere.
Eșantionul are 1800 de unități, stratificat pe treapta de risc dată de sistem, cu alocare Neyman.
| Treapta sistemului | Unități în eșantion | De ce |
|---|---|---|
| NONE | 288 | aici stau ratările invizibile, fără ele nu există acoperire |
| LOW | 417 | |
| MEDIUM | 463 | aici se concentrează majoritatea ratărilor estimate |
| HIGH | 512 | |
| CRITICAL | 120 | recensământ, dacă treapta are sub 120 de unități |
Precizia așteptată pe întrebarea principală: ±4,7 puncte, estimată pe 2000 de eșantioane simulate. Mărimea de 1800 vine din acest calcul: sub ea, intervalul devine prea larg ca să poată distinge trecerea pragului declarat de căderea sub el.
Sămânța generatorului aleator se scrie în fișier înainte de tragere, iar tragerea se face o singură dată. 400 de unități, aproximativ 22% din eșantion, sunt etichetate de amândoi evaluatorii, pentru măsurarea acordului.
Excluderea declarată: prezentările de imagini
79 din unitățile trase sunt postări în format de prezentare de imagini, cu coloană sonoră și fără niciun flux video. Instrumentul cere ca evaluatorul să poată reda clipul dintr-un fișier local, iar aici nu există ce reda. Marcajul de prezentare apare în adresa miniaturii la 79 din 79, față de 0 din cele 1456 de unități cu flux video confirmat, deci e un format și nu un accident.
treapta celor 79 excluse: NONE 2 · LOW 22 · MEDIUM 24 · HIGH 23 · CRITICAL 8
Excluderea nu cade la fel pe toate treptele, deci defalcarea de mai sus intră obligatoriu în raport. Numitorul studiului devine 1456 din 1818. Ce spune sistemul despre prezentările de imagini rămâne nevalidat de acest studiu.
Pierderea de descărcare se grupează pe creator
Clipurile dispar de pe platformă între colectare și descărcare. Ce nu se mai găsește se raportează ca pierdere și nu se înlocuiește în tăcere cu altceva.
rata globală de pierdere 19,9% (362 din 1818) creatori distincți 828 creatori cu 2 sau mai multe 204 au pierdut tot, observat 17 au pierdut tot, așteptat 4,1 raport observat / așteptat 4,13×
Pierderea nu se împrăștie uniform: un creator care își face contul privat pleacă cu tot ce avea în eșantion, iar primii opt creatori pierduți integral duc cu ei 49 de unități.
De ce nu se repară cu ponderi. Ponderarea pe strat presupune că unitățile rămase într-un strat sunt un eșantion aleatoriu din el. Aici nu sunt, fiindcă lipsesc pachete întregi de material al aceluiași autor. Intervalele de încredere se dau deci cu mențiunea că unitatea efectivă de eșantionare e mai aproape de creator decât de postare, iar lista celor 17 creatori pierduți integral se publică odată cu rezultatul.
04 / Cum se etichetează
Clipul se redă dintr-un fișier local și niciodată printr-un link către platformă
Motivul e orbirea. Pagina platformei arată contul, aprecierile și comentariile, adică exact informația care înclină judecata înainte ca ea să înceapă. Din același motiv, formatul cu filigran e interzis la descărcare: el inscripționează numele contului peste imagine și ar strica orbirea pe sute de unități deodată, fără să apară în vreun raport.
Textul extras automat rămâne vizibil sub clip. A patra întrebare are nevoie de judecata evaluatorului în amândouă formele, cu clip și fără.
Vizionarea integrală nu e obligatorie
Unitatea de etichetat e postarea, iar clipul e una din căile de lămurire, alături de descriere, transcriere și textul citit din cadre. Un evaluator care se lămurește din text nu mai are ce afla din minutul cinci. Panoul nu dovedește deci nimic despre vizionare, și nicio afirmație de forma „fiecare unitate a fost vizionată" nu are voie să apară în raport. Ce rămâne apărat e că unitatea a putut fi redată: un fișier care nu se încarcă are durata zero, iar pe el poarta serverului refuză orice judecată. Timpul petrecut se cronometrează și intră în raport ca observație, oricare ar fi el.
Ordinea e aleatorie și diferită pentru fiecare evaluator
Cu ordini diferite, oboseala nu se mai poate confunda cu o proprietate a materialului. Peste asta, cel mult 150 de unități de fiecare evaluator pe zi, cu pauză obligatorie la fiecare 50: deriva de la finalul unei liste lungi contaminează chiar cifra principală.
Re-ancorare înainte, arbitraj după
Înainte de prima etichetă, cei doi evaluatori parcurg împreună 30 de exemple de calibrare alese pe granițele dintre trepte și scriu de comun acord regula de departajare. Cele 30 nu intră în eșantion.
După etichetare se arbitrează toate dezacordurile din cele 400 de unități dublate. Acordul se calculează pe etichetele dinainte de arbitraj, fiindcă altfel nu mai măsoară nimic. Ambele cifre se publică.
05 / Ce se înregistrează pentru fiecare unitate
| Câmp | Valori | De ce |
|---|---|---|
| în populație | da / nu | e materialul în categoria pe care MONARH o urmărește? |
| nivel | 0 la 4 | gravitatea, pe scala din manualul de codare |
| unde e manipularea | imagine · voce · text pe ecran · descriere · context · montaj | fără el nu se poate spune de ce ratează sistemul. Dacă manipularea stă în imagine sau în montaj, nici textul citit din cadre, nici transcrierea nu o pot prinde, iar asta e un rezultat în sine |
| s-ar fi văzut din text | da / nu | răspunde direct la a patra întrebare: era prinsă și fără video? |
| notă | text liber |
06 / A doua componentă: acoperirea colectării
Acoperirea măsurată prin întrebarea principală se referă la ce colectăm. Ca să se știe cât de mare e ce colectăm, se face o măsurătoare separată, independentă de evaluatori.
Se ia lista materialelor de dezinformare din România publicate de surse externe în fereastra studiului, adică de verificatori de fapte și de rapoarte publice. Se caută fiecare în baza noastră și se numără câte existau acolo, indiferent de scorul pe care sistemul li l-a dat.
acoperire = câte am colectat / câte au existat pe lista externă
Se raportează separat și nu se înmulțește cu prima cifră, fiindcă lista externă e formată din cazurile ajunse celebre și nu e un eșantion aleatoriu dintr-o populație.
07 / Ce nu se face
- Nu se mută niciun prag din acest text după ce se văd datele. Dacă un prag se mută totuși, motivul se scrie lângă el și se publică ambele cifre.
- Nu se publică nicio cifră intermediară cât timp etichetarea e în curs. O cifră scoasă la jumătate ar fi altă cifră decât cea finală.
- Nu se etichetează mai mult în treapta CRITICAL ca să iasă rezultatul frumos. Alocarea de mai sus vine dintr-un calcul și rămâne așa cum a fost fixată.
- Pragul de semnalare al sistemului rămâne neatins pe durata studiului. E un reglaj de producție, iar mutarea lui în timpul măsurătorii ar face rezultatul de nefolosit.
Studiul e condus de echipa care a construit sistemul. Asta e o limită, se declară ca atare, iar apărarea împotriva ei stă în pre-înregistrare, în orbirea evaluatorilor și în publicarea datelor brute odată cu rezultatul.
MONARH AI · procedura studiului de precizie · pre-înregistrată 12.08.2026 · înapoi la MONARH AI · contact@monarhdef.ro

