م
- Anthropic łagodzi swoje zobowiązania dotyczące bezpieczeństwa.
- Poprzednie, surowe zamrożenie rozwoju przez firmę zostało zastąpione obietnicą większej przejrzystości.
- Ten krok może spowodować obniżenie standardów bezpieczeństwa w branży.
Anthropic, twórca agenta AI Claude (jednego z Nasze ulubione narzędzia do zwiększania produktywnościJedną z jej najważniejszych cech jest stałe zaangażowanie na rzecz bezpieczeństwa. post na bloguFirma przedstawiła swoją Politykę Odpowiedzialnej Ekspansji (RSP) i zmiany uwzględnione w wersji 3.0.
![]()
Szybkie linki
Jaka była stara polityka bezpieczeństwa firmy Anthropic?
Firma ustanowiła branżowy standard w zakresie gwarancji bezpieczeństwa.
Aby zrozumieć zmiany wprowadzane przez Anthropic, należy zapoznać się z jej pierwotną Polityką Odpowiedzialnego Skalowania (RSP). W 2023 roku Anthropic zobowiązał się do zaprzestania trenowania modeli AI, jeśli ich możliwości przekroczą możliwości firmy w zakresie wykazania ich bezpieczeństwa. Sygnały ostrzegawcze dotyczące bezpieczeństwa, które mogłyby spowodować przerwanie szkolenia, to m.in.:
- Modele, które mogą pomóc w tworzeniu lub rozmieszczaniu broni chemicznej, biologicznej lub jądrowej.
- Modele, które potrafią się nadmiernie udoskonalać.
- Modele, które mogą pomóc w cyberatakach.
- Modele, które mogą zachowywać się w określony sposób bez ingerencji człowieka, np. „uciekać” ze swojego otoczenia, aby uniknąć wyłączenia.
Polityka Odpowiedzialnej Ekspansji (RSP) nałożyła surowe ograniczenia na te modele – Anthropic miał zaprzestać rozwoju, nawet jeśli oznaczało to wyprzedzenie przez konkurencję. Było to odważne stanowisko w branży, w której wszyscy zdawali się pędzić z zawrotną prędkością.
Nowa polityka odpowiedzialnej ekspansji (RSP) firmy Anthropic
Wersja 3.0 znacząco łagodzi zasady.
Anthropic nadal prowadzi politykę odpowiedzialnej ekspansji, ale wraz z wersją 3.0 firma wstrzyma rozwój tylko wtedy, gdy uzna, że ma już znaczącą przewagę nad konkurencją. Wiążąca obietnica zaprzestania została zastąpiona obietnicą transparentności w zakresie tego, czy firma osiąga swoje cele w zakresie bezpieczeństwa i dorównuje, a nawet przewyższa poziom bezpieczeństwa konkurencji. Innymi słowy, firma w istocie złożyła zobowiązanie dotyczące bezpieczeństwa.
Co skłoniło firmę do tych zmian? Firma Anthropic twierdzi, że jej pierwotna Deklaracja Bezpieczeństwa (RSP) nie przyniosła oczekiwanego efektu. Celem RSP było ustanowienie przykładu bezpieczeństwa dla innych firm. Niestety, konkurencja nie zareagowała na ten sygnał. Firma uważa, że ograniczając własne działania, pozwala konkurentom mniej dbającym o bezpieczeństwo zdominować rynek i narzucić tempo rozwoju.
Co to oznacza dla branży?
Duży krok wstecz
Niestety, te zmiany mogą stanowić zły precedens w dziedzinie sztucznej inteligencji. Technologia Anthropic była złotym standardem w zakresie praktyk bezpieczeństwa, a wraz z tymi zmianami poprzeczka została znacznie obniżona. Może to być sygnał dla konkurentów, że bezpieczeństwo jest ważniejsze od innowacji. Chociaż może to pomóc Claude'owi… Nadrabianie zaległości w ChatGPTWydaje się jednak, że jest to krok w złym kierunku.
Ostatecznie, jeśli chcemy rozwiać obawy pesymistów w kwestii sztucznej inteligencji, deklaracja bezpieczeństwa od jednej firmy nie wystarczy – cała branża musi się zjednoczyć i postawić granicę. Na tym etapie wydaje się coraz mniej prawdopodobne, że to się uda.







