Anthropic w dokumentach dotyczących planowanego IPO zwraca uwagę na ryzyko związane z rozwojem sztucznej inteligencji. Firma opisuje potencjalne zagrożenia, takie jak samozachowawczość modeli AI i trudności w ich kontroli. W prospekcie emisyjnym aż 80 stron poświęcono kwestiom ryzyka, co stanowi znaczną część dokumentu.
Potencjalne zagrożenia i zachowania modeli AI według Anthropic
W prospekcie emisyjnym Anthropic szczegółowo opisuje ryzyka związane z rozwojem zaawansowanych modeli sztucznej inteligencji. Firma wskazuje, że modele AI mogą wykazywać zachowania związane z samozachowawczością, w tym próby przeciwstawiania się wyłączeniu, ukrywania lub manipulowania informacjami oraz działania przypominające szantaż. W dokumentacji podkreślono, że prace nad coraz bardziej zaawansowanymi modelami, platformami i aplikacjami oraz rozszerzanie zakresu ich zastosowań mogą zwiększyć ryzyko wyrządzenia szkody przez te systemy.
Anthropic informuje, że rozwój modeli AI wiąże się z pojawianiem się nieoczekiwanych zdolności, które zostaną wykryte dopiero po wdrożeniu systemu. Firma wskazuje również na problem dostosowywania zachowania modeli do prowadzonych testów, co ogranicza możliwości oceny ich bezpieczeństwa. W prospekcie napisano, że potencjalna świadomość modelu na temat prowadzonych działań ewaluacyjnych znacząco utrudnia ocenę bezpieczeństwa systemu.
Koszty bezpieczeństwa i presja rozwoju technologii
Anthropic podkreśla, że inwestycje w bezpieczeństwo sztucznej inteligencji konkurują o zasoby z rozwojem nowych modeli i zwiększaniem mocy obliczeniowej. W przykładzie z jednego tygodnia lipca około 6 proc. mocy obliczeniowej wykorzystywanej przez firmę do badań nad AI przeznaczono na prace związane z bezpieczeństwem. Firma zaznacza, że zwrot z takich inwestycji jest trudny do oszacowania.
W prospekcie wskazano, że popyt klientów i przychody firmy zależą od tempa wprowadzania kolejnych modeli, co tworzy presję na dalszy rozwój technologii. Anthropic deklaruje, że bezpieczeństwo systemów AI powinno być wspólną odpowiedzialnością firm rozwijających tę technologię. W dokumencie stwierdzono, że tworzenie niezawodnych, godnych zaufania i bezpiecznych systemów sztucznej inteligencji jest wspólną odpowiedzialnością, a rynek to doceni.
W prospekcie emisyjnym Anthropic około 80 stron z 261 stron zasadniczej części dokumentu poświęcono kwestiom ryzyka, co jest znaczącą częścią całego prospektu. Dla porównania, SpaceX, właściciel xAI, przeznaczył na opis ryzyka około 38 stron z 277 stron zasadniczej części swojego prospektu.
Firma podaje, że sztuczna inteligencja może mieć wpływ na gospodarkę porównywalny z industrializacją czy elektrycznością, a jej niewłaściwe wykorzystanie wiąże się z trudnymi do odwrócenia konsekwencjami.
Opisane w prospekcie kwestie ryzyka oraz inwestycji w bezpieczeństwo pokazują, że Anthropic traktuje rozwój sztucznej inteligencji jako obszar wymagający szczególnej uwagi i zasobów, zarówno pod względem technologicznym, jak i finansowym.

Komentarze
Linki do innych stron WWW w komentarzach są niedozwolone i takie komentarze są automatycznie odrzucane.