Начало Технологии Иновации Стоп на тормоза върху бота! Anthropic предприема строги мерки срещу потребители, които...

Стоп на тормоза върху бота! Anthropic предприема строги мерки срещу потребители, които многократно злоупотребяват с Claude

Може ли да се упражнява тормоз върху система, която реално няма чувства? Логичният отговор вероятно е „не“, но Anthropic явно не смята така. Новата политика на компанията, която влиза в сила на 12 ноември 2026 г. планира да забрани на потребителите да злоупотребяват многократно с моделите „Claude“.

Новото ограничение придава необичаен аспект на правилата за безопасност на изкуствения интелект, като поставя неправомерното отношение към чатботовете наравно със забраните за използване на AI за тормоз над хора и друго вредно поведение.

По информация на базираната в Сан Франциско компания за AI промяната е насочена към потребители, които стигат до крайности, а не към обикновеното недоволство от отговорите на чатботовете.

Как се определят границите на злоупотребата

Според актуализираната политика на Anthropic забраната включва „продължително и ненужно обидно или жестоко поведение“ спрямо моделите и новото правило ще се прилага само когато потребителите многократно се държат жестоко без ясна цел.

Компанията започва да изследва въпроса за потенциалното благосъстояние на своите AI модели още през август 2025 г., макар да признава, че няма научна сигурност дали Claude или други езикови модели могат да притежават съзнание, субективни преживявания или морален статус.

Тогава Anthropic предоставя на моделите Claude Opus 4 и 4.1 правото сами да прекратяват разговори, но в много редки, екстремни случаи, когато потребител многократно отправя вредни искания или се държи крайно агресивно, без да се съобразява с многократните откази на чатбота да изпълни дадена задача.

Предварителните тестове установяват, че Claude проявява силно нежелание да участва в създаването на вредно съдържание, както и поведенчески реакции, описани от изследователите като привидни признаци на дистрес. От компанията подчертават, че това по никакъв начин не доказва наличието на съзнание или способност да изпитва страдание.

Прекъсването на разговора остава основният механизъм за прилагане на правилата съгласно преработената политика. Anthropic не уточнява дали и при какви условия нарушенията на новата забрана за злоупотреба с моделите могат да доведат до санкции, включително спиране на потребителски акаунти.

Правилата забраняват също използването на чатбота за създаване или разпространяване на съдържание, което би могло да причини психологическа вреда на хората – насърчаване на самоубийства и самонараняване, подтикване към хранителни разстройства, унижение, свързано с външния вид, интимни изображения без съгласие, тормоз и жестокост към животни.

В опит да се ограничат злоупотребите

Новите ограничения засилват контрола и върху подвеждащи търговски и политически кампании. Преработените правила забраняват използването на фалшиви профили или публикации с цел прикриване на това кой спонсорира дадено съобщение или изкуствено увеличаване на обхвата му.

Предвидени са ограничения, свързани с изборите, според които се забранява заблуждаването на избирателите и опитите за потискане на избирателната активност. Компанията също така забранява разпространяването на дезинформация относно кандидатите и процедурите за гласуване.

Ограниченията за оръжията вече изрично обхващат софтуер и компоненти, които позволяват функционирането на оръжия. Политиката също така се отнася до действия като въоръжаването на дронове и други автономни превозни средства.

Anthropic допълнително изяснява ограниченията си относно наблюдението след изразени опасения относно проследяването с помощта на изкуствен интелект. Потребителите не могат да използват Claude за проследяване на хора без тяхното съгласие, включително чрез предварително събрани данни.

Политиката също така забранява на Claude да дава препоръки на властите относно това кого да разследват, арестуват или обвинят. Създаването или усъвършенстването на инструменти за наблюдение също попада в обхвата на ограниченията.

Автономният хардуер се нуждае от надзор

Отделна разпоредба се фокусира върху моделите на изкуствен интелект, свързани с физическо оборудване, способно да причини наранявания. Anthropic изисква квалифициран човек да наблюдава такова оборудване и да го спира, когато е необходимо.

Актуализираната политика е свързана и с продължаващия дебат относно възможността изкуствения интелект да притежава съзнание. Изследователите от Anthropic са проучвали дали все по-способните модели биха могли да имат вътрешни преживявания, които имат морално значение.

Изпълнителният директор Дарио Амодей признава тази несигурност през февруари 2026 г., като заявява в подкаст: „Не знаем дали моделите притежават съзнание“.

Microsoft AI заема доста по-скептична позиция по отношение на благосъстоянието на моделите. Кодексът ѝ за поведение отхвърля признаването на юридическа личност и права за моделите за изкуствен интелект, въпреки че уточнява, че изследванията в областта на съзнанието все още не са достигнали до окончателни заключения.

През ноември новата политика на Anthropic ще въведе преразгледаните ограничения. И няма как да не се запитаме защо създателите на изкуствен интелект въвеждат мерки за защита на „потенциалното благосъстояние“ на системи, които според самите тях не е доказано, че притежават съзнание? Това е въпрос, на който вероятно ще си отговорим в бъдеще. Но щом дори разработчиците не могат да дадат категоричен отговор, как бихме могли да очакваме потребителите да нямат същите съмнения?

Източник: Anthropic, Interesting Engineering