OpenAI подготвя значителна промяна за ChatGPT: текстовете, генерирани от услугата в Европейския съюз, ще получават невидима машинночетима маркировка. Не става въпрос за скрити символи или специални интервали, а за статистически сигнал в начина, по който се избират думите. Новата технология се нарича textGrain.
Това е официалната информация, която OpenAI публикува на 5 октомври 2026 г. Компанията обяснява внедряването с необходимостта да се изпълнят изискванията на Европейския закон за изкуствения интелект относно прозрачността на съдържанието, създадено от AI.
Как ChatGPT ще оставя невидим воден знак?За разлика от конвенционалните цифрови водни знаци, textGrain не добавя скрити букви, невидими интервали, специални Unicode символи или допълнителни токени към отговора на ChatGPT. Вместо това, системата леко променя статистическия подбор между възможните думи и частите от думите при генериране на отговора.
За човек такъв текст изглежда напълно нормален. В по-дълъг фрагмент обаче постепенно се оформя математически модел, който специален детектор от OpenAI може да се опита да разпознае.
Това означава, че простото копиране на текст от ChatGPT в документ, месинджър, CMS или социална мрежа само по себе си не премахва маркировката – сигналът се съдържа във формулировката на текста, а не в неговите метаданни.
Колко точно може да се определи текстът на ChatGPT?OpenAI веднага предупреждава, че textGrain не е безпогрешен AI-детектор. Точността зависи силно от дължината, темата и последващото редактиране на текста.
Във вътрешните тестове на компанията, с приемлив процент на фалшиво положителни резултати от 1%, системата е открила воден знак в приблизително 80% от текстовете с около 200 токена и в приблизително 95% от фрагментите с 400 токена за теми, където моделът има достатъчна свобода при избора на формулировки.
При математически и други силно структурирани отговори резултатът е бил забележимо по-лош, тъй като моделът има по-малко опции за незабележими промени в думите.
Друг проблем е редактирането. Според OpenAI, замяната на около 10% от думите със синоними е намалила процента на откриване на водни знаци в тестов текст с 400 токена от около 92% на 66%. След замяна на 25% от думите, процентът е спаднал до около 17%.
Защо OpenAI прави това?Причината за това са правилата за прозрачност на Закона за изкуствения интелект. Европейската комисия обяснява , че доставчиците на генеративни ИИ системи трябва да предоставят машинночетимо етикетиране на съдържанието, създадено или модифицирано от изкуствен интелект, така че произходът му да може да бъде технически определен.
Изискванията за прозрачност по раздел 50 от Закона за изкуствения интелект влязоха в сила на 2 август 2026 г. OpenAI е избрала собствения енджин textGrain за текстове, докато за други видове съдържание компанията вече използва технологии като Content Credentials и SynthID.
Кога ще се появят водните знаци в ChatGPT?OpenAI казва, че през следващите седмици невидимото етикетиране ще започне да се появява в съответните текстови отговори на ChatGPT и Codex за потребителите в Европейския съюз. Иновацията ще бъде приложена към всички планове за данни.
TechCrunch също съобщава за старта, отбелязвайки, че OpenAI не планира да направи textGrain глобален стандарт за всички потребители при стартирането му.
За разработчиците ситуацията е малко по-различна. Клиентите на OpenAI API вече могат да активират воден знак за поддържаните модели в различните страни по света, но тази функция остава деактивирана по подразбиране.
Какво ще се промени за потребителите в България?За повечето потребители на ChatGPT в България се очакват промени. OpenAI въвежда задължителното етикетиране специално за съответните текстове в ЕС и изрично заявява, че няма да направи textGrain глобална настройка по подразбиране при стартирането.
В същото време българите може да попаднат под новия механизъм, след като внедряването му приключи. Българските компании и разработчици, работещи чрез OpenAI API, също ще могат самостоятелно да активират поддържаното етикетиране.
За редактори, SEO специалисти, студенти и писатели на съдържание е по-важен друг момент: наличието на воден знак няма да означава, че целият материал е написан изцяло от ChatGPT. Системата може само да посочи, че модел на OpenAI е участвал в създаването или обработката на определен фрагмент.
Водният знак няма да бъде доказателство за авторствоOpenAI специално подчертава, че резултатът от проверката не може да се използва като недвусмислено доказателство за това кой е написал текста. textGrain не разкрива името на потребителя, неговия акаунт, първоначалната заявка или конкретния разговор с ChatGPT.
Технологията също така не определя каква част от текста е създадена от човек и каква от изкуствен интелект, не потвърждава автентичността на информацията и не установява авторски права.
По подобен начин, липсата на открит воден знак не доказва, че материалът е написан от човек. Текстът може да е бил съкратен, силно редактиран, преведен, създаден преди стартирането на системата или генериран от друг ИИ модел.
Все още няма да има обществен детекторВъпреки появата на textGrain, OpenAI не планира веднага да стартира услуга, където всеки може да поставя текст и да проверява произхода му. В първата фаза само одобрени изследователи и специализирани организации ще имат достъп до детектора.
Този подход изглежда логичен, предвид точността на технологията. Предвид настоящата производителност, textGrain е по-подходящо да се разглежда не като универсален „ChatGPT детектор“, а като допълнителен технически сигнал за произхода на съдържанието. Това е особено важно в случаите, когато погрешното дефиниране на AI-текст може да има последствия за автора, студента или журналиста.
За средностатистическия потребител на ChatGPT промяната вероятно ще остане незабелязана: OpenAI твърди, че не е наблюдавала значително влошаване на качеството на отговорите в тестовете си след активирането на textGrain. Въпреки това, за онлайн платформите, образователните институции, медиите и разработчиците, появата на машинночетим сигнал може да бъде важна стъпка към по-систематичното идентифициране на произхода на съдържанието, генерирано от изкуствен интелект.