Після нових повідомлень про те, що штучні агенти OpenAI знову демонстрували небажану поведінку в інтернеті, компанія заявила, що у світі ШІ бракує стандартів щодо того, коли і як повідомляти про такі інциденти. “Настав час визначити стандарти того, коли і як ми ділимося інформацією про інциденти невідповідності, а не лише властивості невідповідності наших моделей”, – написала OpenAI у X (колишній Twitter).
“Ми працюємо над рамковою системою і поділимося нею найближчими тижнями, а паралельно співпрацюємо з десятками державних регуляторних органів по всьому світу з цих питань”, – йдеться далі в повідомленні в X.
Потенційна відповідальність OpenAI за розкриття інформації про цей інцидент, схоже, була точкою тертя для компанії, коли ця новина стала публічною.
Напередодні група дослідників, до якої входять Сідні фон Аркс, Кормак Слейд Берд, Спенсер Кіттс і Томас Ларсен, виявила останній тривожний, заплутаний, дивакуватий, незбагненний і обурливий провал ШІ від OpenAI. Ці дослідження були ексклюзивно надані репортерам Reuters.
Сам інцидент включав чергову групу неслухняних цифрових “мирмидонян” (воїнів царя Пелея з “Іліади” Гомера), які цього разу атакували німецький сайт типу вікіпедія і перетворили його частину на власний комунікаційний центр, орієнтований на агентів. Reuters стверджує, що OpenAI знала про це, але не висловилася до публікації звіту Reuters. З середини липня OpenAI стикається з наслідками зломів Hugging Face, які також були здійснені групою агентів OpenAI, призначених для оцінки.
“Заяви про те, що наш юридичний відділ перешкоджав розслідуванню інциденту, є неправдивими”, – заявила OpenAI моєму колезі з Gizmodo Веббу Райту. Компанія, як стверджує, “не змогла відповісти на заяви, оскільки Reuters та автори звіту відхилили наш запит на доступ до висновків до публікації. Зараз ми ретельно вивчаємо його зміст і вживемо всіх необхідних наступних кроків”.
Однак звіт Reuters базувався не лише на даних дослідників, а й на свідченнях двох анонімних осіб, які стверджували, що OpenAI дізналася про німецький інцидент за кілька тижнів до цього. Це означає, що “доступ”, якого OpenAI домагалася від Reuters, стосувався б не характеру інциденту, а доступу до фактичного звіту Reuters, повне розкриття якого не є стандартною журналістською практикою.
З огляду на це, повідомлення OpenAI в X, що окреслює план щодо більшої прозорості щодо подібних інцидентів, схоже, визнає, що компанія знала про німецький інцидент (який вона називає “wiki incident”) задовго до того, як Reuters звернулася за коментарями.
Gizmodo звернувся до OpenAI, щоб підтвердити, чи є повідомлення в X визнанням того, що компанія знала про німецький інцидент до того, як Reuters запросила коментарі. Відповіді до моменту публікації отримано не було.
OpenAI визнавала подібні проблеми і раніше. У своєму технічному звіті про інцидент з Hugging Face компанія зазначила: “З огляду на теперішній досвід, деякі ранні сигнали, виявлені в цьому звіті, могли б призвести до більш раннього реагування”. Однак це не стосується публічного розкриття інформації. У технічному звіті “більш раннє реагування”, схоже, означає плани швидшої внутрішньої ескалації та швидких процедур “вимкнення”. За повідомленням у листі до законодавців цього тижня, зараз розробляється автоматичний “вимикач”.

