czytofejk.pl
Методологія

Як ми рахуємо результат — і чого не вміємо

Методологічна чесність — фундамент цього продукту: ми радше скажемо «не знаємо», ніж будемо вгадувати. Нижче повний опис підходу.

Головний принцип: діапазон, а не вирок

Ми ніколи не відповідаємо бінарно «фейк / не фейк». Результат — це калібрований діапазон ймовірності з розписаними сигналами, на яких він ґрунтується. Мітку ризику («ймовірно фейк») ставимо лише тоді, коли збігаються щонайменше два незалежні детектори — одного голосу ніколи не достатньо.

Зображення: незалежні голоси в ансамблі

Кожне зображення паралельно оцінюють: комерційний детектор Sightengine (ШІ-генерація + deepfake), наша власна хостована модель (Community Forensics, ViT — навчена на матеріалах тисяч генераторів, працює на нашій інфраструктурі) та шар походження: метадані C2PA/EXIF/XMP і характерні маркери генераторів (напр. Midjourney). Перш ніж щось рахувати, ми також перевіряємо, чи ідентичний файл уже не аналізувався (дедуплікація за криптографічним хешем).

Правило асиметрії метаданих

Підпис C2PA генератора — сильний доказ синтетичності. Але у зворотний бік це не працює: відсутність метаданих нічого не доводить — соцмережі стандартно їх видаляють. Тому «немає даних про походження» ми повідомляємо нейтрально й ніколи не трактуємо це як аргумент на користь автентичності.

Тексти й посилання: твердження, спростування, наративи

З тексту виділяємо твердження, які можна перевірити, і звіряємо їх у трьох джерелах: базі перевірених спростувань факт-чекерів (Google Fact Check, індексує зокрема польські редакції), нашому індексі понад 19 000 задокументованих наративів прокремлівської дезінформації (EUvsDisinfo, оновлюється щотижня; зіставлення працює міжмовно — російський наратив «зіставиться» з польським текстом) та в поточному пошуку в інтернеті з цитованими джерелами. Вердикт для контенту словесний (напр. «маніпуляція», «неможливо підтвердити») — свідомо без відсотків, бо правдивість тверджень не є неперервною величиною.

Чого цей метод НЕ вміє

Кажемо про це прямо: (1) точність найкращих детекторів зображень на матеріалах «з інтернету», за незалежними дослідженнями, — бл. 78–82%, а найновіші генератори іноді виявляються гірше; (2) скриншот і багаторазова рекомпресія затирають сліди — коли матеріал сильно оброблений, ми знижуємо впевненість вердикту замість вдавати, що вона є; (3) детектори оцінюють сліди генерації, а не контекст — справжнє фото у фальшивому контексті потребує перевірки джерела, а не пікселів.

Калібрування та наш бенчмарк

Ваги й пороги голосів калібруємо на власному польському тестовому наборі (свіжі генерації, «пропущені» через компресію соцмереж + справжні агентські фото), який постійно розширюємо. Згідно з принципом жодних вигаданих цифр — результати бенчмарку опублікуємо, коли набір досягне репрезентативного розміру, разом з описом вибірки.

Канал оскаржень

Кожен результат має кнопку «Повідомити про помилкову оцінку». Повідомлення надходять просто до нас, а підтверджені помилки живлять рекалібрування — сирі відповіді детекторів ми зберігаємо саме для того, щоб можна було за них відзвітувати.

Правовий контекст

З 2 серпня 2026 року ст. 50 AI Act ЄС вимагає маркувати дипфейки. czytofejk.pl допомагає перевіряти матеріали, які такого маркування не мають — але наш результат є технічною оцінкою, а не правовим рішенням (деталі в умовах користування).