Детектори ШІ-текстів не дають абсолютної гарантії

Без абсолютної гарантії. Детектори не можуть на 100% визначити текст, створений штучним інтелектом

Інструменти виявлення текстів, створених штучним інтелектом, можуть працювати досить точно. Вони все одно не забезпечують повної впевненості. Результат залежить від розвитку мовних моделей. Алгоритми змінюються постійно.

Як працюють сучасні детектори

Системи на кшталт Pangram та Originality.ai аналізують сотні дрібних закономірностей у тексті. Вони оцінюють не лише окремі слова. Важливе їхнє взаємне розташування. Алгоритми знаходять математичні ознаки, непомітні людині.

Розробники визнають межі таких систем. Генеральний директор Pangram Макс Сперо зазначив, що компанія збирає більше даних. Мета — підвищити рівень упевненості. Сто відсоткової точності досягти не вдасться.

Керівник Originality.ai Джон Гіллгам порівняв визначення ШІ-тексту з прогнозом погоди. Алгоритм працює з імовірностями. Він не дає абсолютної впевненості. Навіть високий показник не гарантує правильний результат.

Швидкий розвиток ChatGPT, Claude та Gemini ускладнює завдання. Ознаки використання ШІ сьогодні можуть зникнути завтра після оновлення моделі. Існують сервіси, які переробляють згенерований текст. Вони роблять його більш схожим на людський.

Детектори діють за принципом чорної скриньки. Навіть їхні творці не завжди пояснюють конкретні комбінації ознак, що привели до висновку.

Водяні знаки та часткове використання ШІ

Цифрові водяні знаки пропонують інший спосіб визначення походження контенту. Закон ЄС про штучний інтелект передбачає маркування певного матеріалу, створеного або зміненого ШІ. Передбачені також машинозчитувані водяні знаки. Їх можна обходити або видаляти.

Anthropic почала впроваджувати водяні знаки для текстів Claude. Дослідники невдовзі знайшли способи їх обходу. Google застосовує невидимий SynthID. Компанія також використовує метадані C2PA для зображень, відео й музики.

Експерт з цифрової криміналістики професор Дартмутського коледжу Хані Фарід вважає, що недосконалість технологій не означає відмову від них. Водяні знаки й детектори можуть бути лише частиною системи захисту. Цю систему доводиться постійно вдосконалювати.

Ще складніше виявити контент, у якому ШІ застосували лише частково. Людина могла написати текст самостійно. Потім вона попросила нейромережу його відредагувати. Водяний знак покаже факт втручання. Він не пояснить масштаб змін.

Фахівці радять не покладатися на результат одного детектора. Важливими залишаються перевірка джерела інформації, редакційні стандарти та критичне мислення.