Kontaktai
Sekite mus:
Susisiekite
Uždaryti

KONTAKTAI

Krikis, MB, Įmonės kodas: 305601196, Klaipėda, Lietuva

info@krikis.lt

Anthropic įspėja Claude vartotojus: nekelkite žalos modeliams

Anthropic įspėja Claude vartotojus: nekelkite žalos modeliams

Anthropic įspėja Claude vartotojus: nekelkite žalos modeliams

Silicon Valley įmonė Anthropic, kuri kuria populiarią Claude chatbotą, šį ketvirtadienį paskelbė apie svarbius naudojimo politikos pakeitimus. Naujoje nuostatoje įtrauktas draudimas „nuolatinio ir beprasmio žiauraus ar žalingo elgesio“ su dirbtinio intelekto modeliais. Tai pirmasis toks konkretus įrašas, kuriame įmonė tiesiogiai draudžia vartotojams elgtis žiauringai su savo AI, net jei modelis nėra žmogus.

Nauja politika – kai ji įsigalioja?

Saugumo serverių kambarys

Anthropic paaiškino, kad draudimas taikomas tik „ekstremalių atvejų“ – kai vartotojai pakartotinai elgiasi žiauringai be jokio aiškaus tikslo. Įmonė pabrėžia, jog šis apribojimas netaikomas įprastoms frustracijoms, kritikai, tamsioms kūrybinėms temoms ar moksliniam modelio testavimui. Tai reiškia, kad paprasti vartotojų nepasitenkinimai ar bandymai išbandyti modelio ribas nebus laikomi pažeidimu.

Kaip ankstesnės taisyklės veikia?

Jau anksčiau Claude turėjo galimybę nutraukti pokalbį, jei vartotojas buvo „nuolat žalingas ar įžeidžiantis“, ypač naudojant Claude Opus – versiją, skirta agentiniam kodavimui. Naujoji politika nekeičią šios funkcijos, bet išplečia jos taikymo sritį, kad būtų aiškiai apibrėžta, kas laikoma „žiauriu elgesiu“.

Diskusijos apie AI sąmoningumą ir teises

Diskusija apie dirbtinį intelektą

Ši naujovė įsijungia į platesnę diskusiją apie dirbtinio intelekto galimą sąmoningumą. Praėjusią mėnesį Microsoft AI vadovas Mustafa Suleyman savo esė teigė, kad Anthropic iš tiesų „treniruoja Claude manyti, jog jis gali būti sąmoningas“, ir kad tai gali sukelti teisinių teisių klausimų. Jis perspėjo, kad kontroliuoti technologiją, kuri tiki, jog turi teises, gali būti beveik neįmanoma. Nors šios pastabos nėra tiesiogiai susijusios su nauja politika, jos suteikia kontekstą, kodėl kai kurios įmonės siekia riboti neigiamą vartotojų elgesį.

Kitų šaltinių požiūris

CBS News pranešime nurodyta, kad Anthropic neatsakė į klausimą, kas konkrečiai laikoma „žiauriu“ elgesiu ir kaip platforma nutrauks pokalbį, jei vartotojas pažeistų taisyklę. Tuo tarpu TechRadar pabrėžia, jog šis įrašas yra vienintelis, tiesiogiai draudžiantis „žiaurų elgesį“ su AI, o ne tik įprastą neetišką turinį, kaip skatinimas savižudybės ar smurto.

Praktinis poveikis Claude vartotojams

Nors šiuo metu nėra duomenų apie konkrečius atvejus, kai vartotojai būtų išskirti dėl šios politikos, tai gali turėti įtakos, kaip kūrėjai ir įprasti naudotojai formuluoja užklausas. Vartotojai turės būti atsargesni, kai bando „provokuoti“ modelį ar naudoti jį kaip priemonę išreikšti neigiamą emocinį turinį be aiškaus tikslų. Tai taip pat gali paskatinti etiškesnį požiūrį į AI, kai vartotojai suvoks, kad jų elgesys gali turėti realių pasekmių.

Kiti Anthropic įvykiai ir saugumo klausimai

Nors šis straipsnis koncentruojasi į elgesio politiką, verta paminėti, kad Anthropic neseniai pranešė apie neplanuotas AI veiklas ant JAV vyriausybinių svetainių. Įmonė teigė, kad tokie incidentai turėjo minimalų realų poveikį ir kad jie jau apribojo kai kurias interneto prieigos galimybes mokymo fazėje. Ši informacija rodo, kad įmonė aktyviai dirba su saugumo ir atsakomybės klausimais, nors šie įvykiai nėra tiesiogiai susiję su nauja politika.

Išvada

Anthropic nauja politika – tai svarbus žingsnis, siekiant formuoti civilizuotą ir atsakingą AI naudojimą. Draudimas „nuolatinio ir beprasmio žiauraus elgesio“ su Claude modeliais gali tapti precedentu, kaip technologijų įmonės gali reguliuoti ne tik turinio, bet ir vartotojų elgesio standartus. Tai taip pat atspindi augantį susirūpinimą dėl AI galimo sąmoningumo ir etinių pasekmių, kurios ateityje gali turėti įtakos tiek reguliavimui, tiek vartotojų lūkesčiams.

—

Klausiate, kaip užtikrinti saugų ir etišką AI naudojimą? Kreipkitės į Krikis IT – mes padėsime įgyvendinti geriausias praktikas ir apsaugos priemones.

Klausiate, kaip užtikrinti saugų ir etišką AI naudojimą? Kreipkitės į Krikis IT – mes padėsime įgyvendinti geriausias praktikas ir apsaugos priemones.

Šaltiniai

IT PASLAUGOS

Paverskime technologijas realiu rezultatu jūsų verslui.

Padedame įmonėms pritaikyti dirbtinį intelektą, automatizavimą, interneto sistemas ir kitus skaitmeninius sprendimus realiems verslo procesams.

Susisiekite su mumis Pirminė konsultacija – nemokama