3 Tačke
Članak

OpenAI: Moonshot AI povezan sa kampanjom izvlačenja modela

OpenAI tvrdi da su pojedinci povezani sa kompanijom Moonshot AI bili u središtu kampanje za izvlačenje skrivenog rezonovanja iz njihovih modela tokom jula.

3 Tačke
52 sekunde čitanja

OpenAI je u blog postu saopštio da su ljudi povezani sa kineskom kompanijom Moonshot AI bili u središtu koordinisane kampanje za izvlačenje zaštićenog rezonovanja iz njihovih modela, što je opisano kao "adversarijalna destilacija". Aktivnost je počela 1. jula sa niskim obimom, a zatim su usledili skokovi 24. i 25. jula sa 16.000 zahteva za ekstrakciju od preko 4.000 korisnika. Kampanja je u potpunosti prekinuta do 28. jula, ali OpenAI nije precizirao stopu uspešnosti niti koji su modeli bili meta.

OpenAI definiše zaštićeno rezonovanje kao interni zapis modela o obradi zadatka, a adversarijalnu destilaciju kao neovlašćeno korišćenje izlaza jednog modela za obuku drugog. Šifrovanje u ovom slučaju nije probijeno, niti su kompromitovane baze podataka. Kompanija je zatvorila putanju koja je omogućavala ponovno puštanje šifrovanog rezonovanja i ojačala zaštitu. Nezavisni istraživači su takođe prijavili ranjivosti, a Anthropic je ranije izvestio o sličnim napadima povezanim sa Moonshot AI.

Povezani članci