RSS Amplifier

Капитал - статии · Aug 25, 2026

Белязан: как текст ще може да се проверява за AI произход

0
Sign in to vote or save

Петър Ташков · Капитал

Темата накратко

В опит да приведат моделите си към съответствие със законодателството на ЕС повечето компании, разработващи генеративни AI модели, ще трябва да започнат да въвеждат маркировка в създадения от техните модели текст. Сред първите компании, въвели "AI воден знак" в своите модели, са Anthropic и Google. Anthropic твърди, че нейните чатботове ще използват случаен, но проследим от машина модел при избора на някои думи, който оставя незабележима за човешкото око следа. Методът обаче има и ограничения.

Синтезирано с AI.

През последните няколко години дълги тирета, булети, "Не е X, a е Y", клиширани думи и изрази като "революционен" и "дълбоко трансформиращ", започнаха да стават все по-популярни в онлайн пространството. Имената на виновниците вероятно са познати на мнозина - Gemini, ChatGPT, Claude, Grok, и редица други. Индивидуалното им участие в отделни текстове обаче продължава да бъде все така недоказуемо, или поне не с абсолютна сигурност.

С времето се появиха немалко инструменти, които се опитват да докажат присъствието или отсъствието на AI като съавтор на текст - Turnitin, Copyleaks и GPTZero набраха популярност и се използват включително и в академичната среда. Но паралелно с тях се развиха и т.нар. humanizer-и, които правят текста "по-човешки" и заличават следите, оставени от чатботовете. На този фон фалшиви позитивни резултати (както и фалшиви отрицателни) продължават да се появяват, а нито една от компаниите зад инструментите за проверка не може да гарантира 100-процентова успеваемост при засичане на изкуствен интелект в текст.

Европейският съюз (ЕС) също взе участие в усилията за прозрачност на AI моделите, като от 2 август тази година, съгласно изискванията на акта на ЕС за изкуствения интелект, всеки нов модел трябва да въвежда машинно четим знак в генерирано съдържание, включително и текст. По-стари модели също трябва да започнат да вграждат водния знак, като срокът за това е декември 2026 г. По всичко изглежда, че това ще се случи - редица от най-влиятелните компании в сектора, сред които OpenAI, Microsoft, Amazon и Mistral, вече са подписали кодексът на ЕС за добри практики във връзка с новото законодателство.

Първите компании, започнали да привеждат моделите си към съответствие с европейското законодателство, също са налице. Google маркира генерирания от Gemini текст още отпреди влизането в сила на новите правила на континента, а през август и Anthropic се присъедини, като обяви, че всички текстови отговори на нейните бъдещи модели също ще съдържат водни знаци.

Воден знак, но не като физическите

От прессъобщението на Anthropic става ясно, че като основа стартъпът ще използва технологията SynthID-text, разработена от лабораториите на Google, която позволява на AI моделите да оставят следа в текста, като променят източника на произволност в избора на думи. Така няма да се добавят скрити символи или видими знаци в генерираното съдържание.

Използвайки съответния подход, моделът ще идентифицира места в текста, в които няколко различни думи могат да бъдат използвани, без да променят неговия смисъл. Като пример Anthropic представя ситуация, в която AI модел генерира изречението "времето днес беше студено и ", като трябва да избере между думите "мрачно" и "сиво", които носят "сходно значение". В такава ситуация моделът традиционно би използвал случайна дума измежду двете, а с новата технология отново ще направи случаен избор, но следвайки проследим модел, който може да се разчете от машина, която разполага с "ключа" за него. Това би позволило да се изчислява вероятност даден откъс да е написан от изкуствен интелект, като се сравнява колко от изборите съвпадат с очакваните.

Компанията твърди, че по този начин отговор с воден знак е неразличим за читателя от такъв, в който няма воден знак, а следата би трябвало да се запази дори и ако даден текст е преписан или леко редактиран. Тя също отбелязва, че AI водните знаци се различават съществено от своите съименници върху банкноти, други физически обекти и някои дигитални документи, които са видими за невъоръжено око.

Въпреки това методът не позволява да се докаже с абсолютна сигурност произходът на даден текст, а единствено да се изчисли вероятност. Anthropic подчертава, че воден знак единствено може да определи, че Claude вероятно е взаимодействал със съдържанието в даден момент, без да различава "Claude е написал това" от "Claude силно е редактирал това". Компанията планира да представи API за проверките, но все още не го е направила.

Под радара

Подходът на Anthropic (сходен на този, който Google използва от известно време) има предимства пред много от досегашните инструменти за проверка на AI генериран текст, които бяха принудени да оценяват откъсите "отвън", търсейки обичайни за моделите езикови конструкции. Стартъпът обаче признава, че той все пак има ограничения, особено при текстове, позволяващи по-малка "творческа свобода" на изкуствения интелект.

Това значи, че писаният от LLM-и програмен код, както и откъси, които минават единствено граматична проверка, ще имат много по-малко водни знаци заради по-малкия брой възможни избори и промени, които моделът може да направи. Същото важи и за по-кратки текстове или такива, базирани строго на факти. Преводи обаче ще могат да бъдат засичани по-лесно, защото отново дават на модела повече шансове да въвежда отличителните белези.

Със сходна технология за вграждане на водни знаци разполага и OpenAI според информация на Wall Street Journal. Тя обаче все още не е въведена в експлоатация, като говорител на компанията е съобщил пред изданието, че методът е "технологично обещаващ", но носи "важни рискове", които стартъпът претегля, докато търси алтернативи.

Източник на WSJ твърди също, че служители са изразили опасения около наличието на прости подходи за премахване на маркировката, като например превеждане на текста два пъти с Google Translate.

Шон Гьодеке, старши програмист в Github, твърди в свой блог, че премахването на водните знаци винаги ще бъде тривиално. "Ако имате достъп до дори сравнително слаб LLM без воден знак, може да премахнете белезите на SynthID, като поискате от LLM-а да перифразира съдържанието на текста", обяснява Гьодеке.

Желанието на потребители да заобиколят или премахнат водните знаци създаде и нов пазар за съответните инструменти още преди Anthropic да е представил интерфейса си за проверка. Business Insider отбелязва появата на няколко такива, сред които е и безплатен инструмент с отворен код, публикуван в Github от френския технологичен предприемач Гийом Майер, който твърди, че създаването на първата версия на инструмента му е отнело около пет часа. "Мисля, че е грешното решение на реален проблем", коментира Майер пред изданието.

Прозрачност или AI хигиена

Докато действията на Европейския съюз целят да промотират прозрачност в AI индустрията, според експерти те биха могли също да бъдат и от полза за самите компании, разработващи моделите. Пред британския Guardian преподавателят по компютърни науки Стивън Мърдок коментира, че прилагането на водни знаци може да помогне на компаниите да избягват AI генерирано съдържание в интернет пространството, когато обучават своите собствени модели.

Това е изключително важно за тях, защото използването на AI източници може да доведе до своеобразен колапс на модела, което прави физическите книги и съдържанието, създавано от хора, изключително ценни. На този фон съдебни документи показват, че от 2024 г. Anthropic работи върху инициатива с името Project Panama, за изкупуване, сканиране и унищожаване на книги, а разследване на 404 Media сочи, че Amazon също изкупува големи количества книги, сред които и редки издания, с цел използване при обучаване на AI модели.

Като форма на собствена AI хигиена вероятно може да се разглежда и новата функцията за сигнализиране на AI съдържание, представена от Linkedin в края на юли (платформа, в която според анализ на Pangram над 40% от дългоформатното текстово съдържание е плод на изкуствен интелект). Новият бутон "изглежда ми като AI slop", изглежда като позитивно развитие за потребителите, а борбата с нискокачественото съдържание бе представена от продуктовия директор на платформата като топ приоритет. Но тя би донесла и допълнителни ползи за притежаваната от тегхиганта Microsoft платформа, като не само ще ѝ позволи да ограничи обсега на нискокачествените публикации, а също и да събере информация за това какво всъщност потребителите считат за AI slop.

Нюзлетър: Вечерни новини Вечерни новини

Всяка делнична вечер получавате трите най-четени статии от деня, заедно с още три, препоръчани от редакторите на "Капитал"

Мета ще плати до 18 млрд. долара за безопасността на децата в социалните мрежи

Read the original on capital.bg

Comments

Nothing yet. Say the first thing.

    Sign in to join the conversation.