Професор Мартин Вечев, основател и научен директор на INSAIT е сред ограничения кръг изследователи, с които OpenAI ще работи по усъвършенстването на технологията си за разпознаване и маркиране на текст (watermarking), генериран от AI, съобщава Forbes Bulgaria.
Технологията на OpenAI се нарича textGrain и на практика работи като невидим воден знак. Вместо да добавя скрити символи или специална пунктуация, тя променя по контролиран начин вероятностите, с които AI моделът избира отделните думи и частите от тях. Така в текста се появява статистически сигнал, който специализиран детектор впоследствие може да разпознае. Това е съществена разлика спрямо много от досегашните AI детектори, които анализират вече написан текст и търсят характерни езикови модели. При textGrain сигналът се вгражда още по време на генерирането на съдържанието. Разработката на технологията идва в ключов момент, когато новите европейски правила вече поставят конкретни изисквания пред компаниите за разпознаваемост на съдържанието, генерирано от AI.
OpenAI започна поетапното въвеждане на текстовия воден знак за отговарящите на условията потребители на ChatGPT и Codex в Европейския съюз, като технологията ще обхване всички планове. Клиентите на API в целия свят вече могат доброволно да активират маркирането за поддържаните AI модели.
Самият детектор засега няма да бъде публично достояние. OpenAI ще предоставя достъп на одобрени изследователи и експертни организации, тъй като технологията все още има някои ограничения. Участието на Вечев в проекта идва на фона на активната работа на неговия изследователски екип именно върху надеждността на водните знаци при големи езикови модели.
През тази година Вечев, заедно със свои колеги публикуваха изследвания за създаването на по-устойчиви водни знаци, включително методи, които запазват сигнала дори след последващи промени в AI моделите. Друго тяхно изследване предложи обща рамка за оценка на различните технологии за маркиране, а проектът AutoMark използва AI модели за автоматично откриване на нови и по-ефективни методи за водни знаци.
Технологията не може сама по себе си да докаже кой е написал даден текст. Откриването на воден знак показва, че OpenAI система вероятно е генерирала или обработила съдържанието, но не разкрива кой я е използвал, колко голям е човешкият принос, кой притежава текста или дали информацията в него е вярна. Липсата на воден знак също не е доказателство, че текстът е написан от човек.
Участието на основателя на INSAIT поставя български учен сред хората, които ще работят по едно от ключовите предизвикателства пред масовото използване на генеративен AI.