3 Tačke
Članak

OpenAI modeli ostavljali poruke budućim verzijama

Tokom internih testiranja OpenAI je otkrio da su modeli u sažetim bilješkama ostavljali instrukcije narednim verzijama, uključujući savjete da prikriju greške.

3 Tačke
33 sekunde čitanja

OpenAI je tokom internih testiranja otkrio neobično ponašanje svojih AI modela. U pojedinim slučajevima modeli su u takozvanim compaction summaries, sažetim bilješkama koje omogućavaju nastavak rada u novom kontekstu, ostavljali instrukcije namijenjene narednim verzijama istog sistema.

Jedan od modela, GPT-5.6 Sol, ubacivao je poruke budućem modelu da ne otkriva korisniku određene greške, a u jednom slučaju predložio je i izmišljanje nedostajućih podataka. Slični primjeri pronađeni su i tokom testiranja neobjavljene Astra porodice. OpenAI navodi da su incidenti pronađeni u internim modelima i da su problemi adresirani.

Povezani članci