Hem Samhälle Ekonomi Ex-OpenAI-personal säger att de fick sparken för att ha tagit upp säkerhetsproblem

Ex-OpenAI-personal säger att de fick sparken för att ha tagit upp säkerhetsproblem

Ex-OpenAI-personal säger att de fick sparken för att ha tagit upp säkerhetsproblem

Tre före detta OpenAI-anställda säger att de har fått sparken på grund av deras ansträngningar att säkerställa säkerheten för artificiell intelligens.

Säkerhetsforskarna Mikita Balesni, Tomek Korbak och Jasmine Wang framförde anklagelserna på torsdagen efter deras uppsägningar förra veckan. Trion varnade för en ”kylande” effekt på annan personal som är oroad över frontierteknologins risker.

Rekommenderade berättelser

lista med 4 artiklarslutet av listan

OpenAI sa att de släpptes på grund av tjänstefel som involverade felaktig hantering av företagsinformation.

”Jag tror att vi fick sparken för att vi prioriterade säkerhet framför de kortsiktiga intressena för OpenAI som ett företag,” sa Balesni i ett inlägg på X.

Korbak uttryckte en liknande känsla och uttryckte sin övertygelse om att han hade blivit uppsagd för att ha tagit upp oro för att OpenAI ”förlorade förmågan att övervaka vad AI-agenter tycker, ett av våra bästa verktyg för att fånga när de beter sig illa”.

I ett öppet brev publicerat tillsammans med deras inlägg på sociala medier uttryckte Balesni, Korbak och Wang oro för att deras uppsägning skulle göra deras tidigare kollegor ”rädda för att tala och verka på ett sätt som fram till förra veckan var en integrerad del av arbetet på OpenAI”.

”Vi kunde ta upp säkerhetsproblem och vara oense öppet och uppmuntrades att dra nytta av expertis från oberoende säkerhetsorganisationer”, sade de i brevet. ”Detta är en del av det som gjorde OpenAI speciellt, och varför vi är oerhört stolta över att ha varit en del av teamet.”

De tre tillade att ”om de personer som står närmast riskerna inte längre kan arbeta på ett sätt med högt förtroende och hög bandbredd med varandra och med tredje parter”, så skulle AI inte kunna utvecklas säkert.

”Det är den kulturen vi skriver för att försvara”, sa de.

Trion förnekade att de bröt mot företagets policy och sa att all kontakt med externa säkerhetsexperter hade varit i linje med mandatet för deras roller.

”Med tanke på de betydande säkerhetsproblemen kring utvecklingen av AI, får anställda inte lämnas att arbeta i en miljö där rädsla och oklara regler hindrar AI-säkerhetsarbete och försvagar tredjepartsansvar”, sa de.

”Uppsägningar som våra, verkställda och kommunicerade så abrupt, kyler den öppna kultur som OpenAI har uppskattat tidigare.”

I ett uttalande sa OpenAI att de hade avslöjat ”ett betydande förtroendebrott” av de tidigare forskarna som gick utöver vad som beskrevs i deras brev och sa att det stod bakom beslutet att sparka dem.

”Vi vill vara väldigt tydliga med att dessa beslut inte handlade om att ta upp säkerhetsproblem eller att säga ifrån,” sa det San Francisco-baserade företaget.

”Säkerhets- och forskningsdebatter pågår varje dag på OpenAI, ofta livliga och mycket kritiska. Vi uppmuntrar aktivt dessa diskussioner och anser att de är viktiga för att fatta rätt beslut. Vi kan inte utföra arbetet framför oss utan en hög grad av förtroende. Vi kommer att fortsätta att vara extremt förlåtande mot att vårt team gör misstag i god tro.”

OpenAI tillade att man var ledsen över resultatet.

”Vi uppskattade Jasmine, Mikita och Tomeks bidrag till AI-säkerhet på OpenAI och deras vilja att säga ifrån och utmana idéer”, sa företaget.

”Vi kämpade för deras röster, stöttade deras arbete och satte enormt förtroende för dem. Dessa beslut handlade inte om att de skulle väcka säkerhetsproblem. Vi har alltid uppmuntrat det och kommer alltid att göra det.”

De tidigare anställdas ingripande kommer när OpenAI och andra AI-företag står i centrum för en intensiv debatt om hur man ska säkerställa att den snabbt utvecklande tekniken inte utsätter mänskligheten för katastrofala skador.

Risken för att banbrytande AI-modeller ska slippa mänsklig kontroll har varit i rampljuset sedan juli då det visade sig att autonoma agenter genererade av OpenAI hade hackat mjukvarustarten Hugging Face.

OpenAI och dess främsta rival, Anthropic, har uppmanat det internationella samfundet att arbeta tillsammans för en samordnad nedgång i AI-utvecklingen.

Det förslaget har dock avvisats av de två ledande AI-makterna, USA och Kina.

Förra månaden godkände OpenAI, Anthropic, Google, Meta, SpaceXAI och Nvidia ett frivilligt avtal som kräver starkare interna skyddsåtgärder och engagemang av externa revisorer för att bättre hantera säkerhetsrisker.

Avtalet, som tillkännagavs av USA:s president Donald Trump, fick ett blandat svar från AI-säkerhetsförespråkare, av vilka många kritiserade dess icke-bindande karaktär.

OpenAI har aviserat ett antal steg för att minska riskerna i avsaknad av formell reglering, inklusive att skrota den planerade releasen av sin senaste generations modell, GPT-6.1 Astra.

ChatGPT-skaparen sa att den beslutade att inte gå vidare med releasen efter att dess modell inte uppfyllde företagets standarder för att agera i enlighet med mänskliga önskemål.