Jak oznaczamy pliki
Materiały wygenerowane przez AI, wydane z katalogu Caisting.ai, niosą dwie niezależne warstwy oznaczenia. Ta strona wyjaśnia, co dokładnie jest w pliku, co z tego może sprawdzić osoba postronna i czego nie obiecujemy.
Identyfikatory naszego znaku wodnego zgłosimy do publicznego rejestru algorytmów C2PA; we wpisie podamy adres tej strony jako miejsce, w którym można dowiedzieć się więcej.
Warstwa pierwsza: znak wodny
W obrazie i wideo osadzamy niewidoczny znak wodny, który niesie identyfikator postaci, a w materiałach z paczki licencyjnej także identyfikator licencji. Znak jest kluczowany — odczytujemy go my, na stronie weryfikacji Caisting.ai. Bez naszego klucza nikt z zewnątrz go nie odczyta ani nie wykryje. Znak przeżywa typowe przetwarzanie pliku: przeskalowanie, ponowną kompresję, kadrowanie. Nasza biblioteka obsługuje również dźwięk, choć dzisiejsze materiały z katalogu są nieme.
Identyfikatory algorytmu, którymi opisujemy tę warstwę:
- ai.caisting.wm.image — obraz
- ai.caisting.wm.video — wideo
- ai.caisting.wm.audio — dźwięk
Warstwa druga: podpisane metadane C2PA
Do pliku dokładamy podpisane metadane w standardzie C2PA, znanym też jako Content Credentials. Niosą one etykietę treści wygenerowanej przez sztuczną inteligencję oraz identyfikator powiązania miękkiego, czyli ten sam ładunek znaku wodnego zapisany wprost w metadanych.
Tę warstwę może sprawdzić każdy, bez naszego udziału — dowolnym publicznym narzędziem czytającym Content Credentials, dopóki plik zachowa metadane.
Wyjątek: prawdziwe zdjęcia osoby
Paczka licencyjna bliźniaka cyfrowego bywa uzupełniona o prawdziwe fotografie osoby, która użyczyła wizerunku. Takie pliki nie są treścią AI, więc nie dostają ani etykiety treści wygenerowanej przez sztuczną inteligencję, ani znaku wodnego, ani identyfikatora powiązania miękkiego. Podpisujemy je wyłącznie metadanymi pochodzenia — po to, żeby było wiadomo, że wyszły od nas.
Jeśli sprawdzasz taki plik i nie widzisz etykiety AI, to nie znaczy, że plik jest naruszony. Znaczy, że jest fotografią, a nie materiałem wygenerowanym.
Dwa zastrzeżenia, o których mówimy wprost
Metadane są ulotne. Większość edytorów graficznych i platform społecznościowych usuwa je przy zapisie. Po takim zapisie w materiale AI zostaje już tylko znak wodny — a ten odczytujemy my. W prawdziwej fotografii osoby, opisanej wyżej, nie zostaje nic: nie ma tam znaku wodnego, bo nie jest treścią wygenerowaną.
Nasz certyfikat podpisujący nie jest jeszcze na liście zaufania C2PA. Narzędzia sprawdzające potwierdzą obecność podpisu, ale mogą oznaczyć wystawcę jako niezaufanego. Zgłosiliśmy się do programu zgodności C2PA, który prowadzi do certyfikatu z listy zaufania — to osobna droga niż rejestr algorytmów, o którym mowa wyżej. Do czasu jej domknięcia opisujemy rzecz dokładnie tak, jak jest.
Jak sprawdzić plik
Otwórz go w dowolnym narzędziu czytającym Content Credentials — przy materiale AI zobaczysz etykietę treści wygenerowanej przez sztuczną inteligencję oraz identyfikator powiązania miękkiego. Jeśli masz kod licencji w formacie CAI-XXXXX-XXXX, możesz sprawdzić jej status pod adresem caisting.ai/verify.
Dlaczego dwie warstwy
Każda z nich ma inną słabość. Metadane są czytelne dla każdego, ale znikają przy zwykłym zapisie pliku. Znak wodny przeżywa przetwarzanie, ale bez naszego klucza jest nieczytelny. Razem dają oznaczenie, które przetrwa zarówno przepuszczenie pliku przez edytor, jak i brak kontaktu z nami.
Kontakt
W sprawach dotyczących oznaczania plików: hi@caisting.ai