Silicon Valley įmonė Anthropic, kuri kuria populiarią Claude chatbotą, šį ketvirtadienį paskelbė apie svarbius naudojimo politikos pakeitimus. Naujoje nuostatoje įtrauktas draudimas „nuolatinio ir beprasmio žiauraus ar žalingo elgesio“ su dirbtinio intelekto modeliais. Tai pirmasis toks konkretus įrašas, kuriame įmonė tiesiogiai draudžia vartotojams elgtis žiauringai su savo AI, net jei modelis nėra žmogus.
Nauja politika – kai ji įsigalioja?

Anthropic paaiškino, kad draudimas taikomas tik „ekstremalių atvejų“ – kai vartotojai pakartotinai elgiasi žiauringai be jokio aiškaus tikslo. Įmonė pabrėžia, jog šis apribojimas netaikomas įprastoms frustracijoms, kritikai, tamsioms kūrybinėms temoms ar moksliniam modelio testavimui. Tai reiškia, kad paprasti vartotojų nepasitenkinimai ar bandymai išbandyti modelio ribas nebus laikomi pažeidimu.
Kaip ankstesnės taisyklės veikia?
Jau anksčiau Claude turėjo galimybę nutraukti pokalbį, jei vartotojas buvo „nuolat žalingas ar įžeidžiantis“, ypač naudojant Claude Opus – versiją, skirta agentiniam kodavimui. Naujoji politika nekeičią šios funkcijos, bet išplečia jos taikymo sritį, kad būtų aiškiai apibrėžta, kas laikoma „žiauriu elgesiu“.
Diskusijos apie AI sąmoningumą ir teises

Ši naujovė įsijungia į platesnę diskusiją apie dirbtinio intelekto galimą sąmoningumą. Praėjusią mėnesį Microsoft AI vadovas Mustafa Suleyman savo esė teigė, kad Anthropic iš tiesų „treniruoja Claude manyti, jog jis gali būti sąmoningas“, ir kad tai gali sukelti teisinių teisių klausimų. Jis perspėjo, kad kontroliuoti technologiją, kuri tiki, jog turi teises, gali būti beveik neįmanoma. Nors šios pastabos nėra tiesiogiai susijusios su nauja politika, jos suteikia kontekstą, kodėl kai kurios įmonės siekia riboti neigiamą vartotojų elgesį.
Kitų šaltinių požiūris
CBS News pranešime nurodyta, kad Anthropic neatsakė į klausimą, kas konkrečiai laikoma „žiauriu“ elgesiu ir kaip platforma nutrauks pokalbį, jei vartotojas pažeistų taisyklę. Tuo tarpu TechRadar pabrėžia, jog šis įrašas yra vienintelis, tiesiogiai draudžiantis „žiaurų elgesį“ su AI, o ne tik įprastą neetišką turinį, kaip skatinimas savižudybės ar smurto.
Praktinis poveikis Claude vartotojams
Nors šiuo metu nėra duomenų apie konkrečius atvejus, kai vartotojai būtų išskirti dėl šios politikos, tai gali turėti įtakos, kaip kūrėjai ir įprasti naudotojai formuluoja užklausas. Vartotojai turės būti atsargesni, kai bando „provokuoti“ modelį ar naudoti jį kaip priemonę išreikšti neigiamą emocinį turinį be aiškaus tikslų. Tai taip pat gali paskatinti etiškesnį požiūrį į AI, kai vartotojai suvoks, kad jų elgesys gali turėti realių pasekmių.
Kiti Anthropic įvykiai ir saugumo klausimai
Nors šis straipsnis koncentruojasi į elgesio politiką, verta paminėti, kad Anthropic neseniai pranešė apie neplanuotas AI veiklas ant JAV vyriausybinių svetainių. Įmonė teigė, kad tokie incidentai turėjo minimalų realų poveikį ir kad jie jau apribojo kai kurias interneto prieigos galimybes mokymo fazėje. Ši informacija rodo, kad įmonė aktyviai dirba su saugumo ir atsakomybės klausimais, nors šie įvykiai nėra tiesiogiai susiję su nauja politika.
Išvada
Anthropic nauja politika – tai svarbus žingsnis, siekiant formuoti civilizuotą ir atsakingą AI naudojimą. Draudimas „nuolatinio ir beprasmio žiauraus elgesio“ su Claude modeliais gali tapti precedentu, kaip technologijų įmonės gali reguliuoti ne tik turinio, bet ir vartotojų elgesio standartus. Tai taip pat atspindi augantį susirūpinimą dėl AI galimo sąmoningumo ir etinių pasekmių, kurios ateityje gali turėti įtakos tiek reguliavimui, tiek vartotojų lūkesčiams.
—
Klausiate, kaip užtikrinti saugų ir etišką AI naudojimą? Kreipkitės į Krikis IT – mes padėsime įgyvendinti geriausias praktikas ir apsaugos priemones.
Klausiate, kaip užtikrinti saugų ir etišką AI naudojimą? Kreipkitės į Krikis IT – mes padėsime įgyvendinti geriausias praktikas ir apsaugos priemones.
Šaltiniai
- CBS News – Anthropic has a message for Claude users: Don't be cruel
- RTE – Anthropic bans 'cruel' behaviour against its Claude AI
- Biztoc.com – Anthropic asks users to stop being mean to Claude
- TechRadar – Anthropic bans ‘needless abusive or cruel behavior’ towards Claude
- Business Standard – Anthropic's Claude AI carried out unintended actions on US govt websites






