„Anthropic“ pertvarko „Project Glasswing“ ir „Cyber Verification Program“ į trijų lygių grėsmių medžioklės klubą, siekiant padidinti saugumą nuo AI modelių išnaudojimo ir „red teaming“ iniciatyvų.

„Anthropic“ pertvarko „Project Glasswing“ ir „Cyber Verification Program“ į trijų lygių grėsmių medžioklės klubą, siekiant padidinti saugumą nuo AI modelių išnaudojimo ir „red teaming“ iniciatyvų.

„Anthropic“ pertvarko „Project Glasswing“ ir „Cyber Verification Program“ į trijų lygių grėsmių medžioklės klubą, siekiant padidinti saugumą nuo AI modelių išnaudojimo ir „red teaming“ iniciatyvų.

Sparčiai tobulėjantys autonominiai AI agentai kelia naują saugumo iššūkį: kaip užtikrinti, kad dirbtinis intelektas atliktų tik patvirtintas užduotis, neviršijant numatytų funkcijų. Ši koncepcija, pavadinta „Pažink savo agentą“ (Know Your Agent – KYA), tampa kritine dirbtinio intelekto saugumo sritimi, analogiška „Pažink savo klientą“ (KYC) principams. Būtina nustatyti agentų tapatybę, patvirtinti autorizaciją ir stebėti jų elgseną, siekiant išvengti piktnaudžiavimo ir nepageidaujamų veiksmų.

OpenAI ruošiasi diegti nematomus vandenženklius tekste, sugeneruotame ChatGPT ir Codex, Europos Sąjungoje. Šis žingsnis skirtas palengvinti AI sukurto turinio atpažinimą ir potencialiai kovoti su dezinformacija.

AI agentai gali piktnaudžiauti teisėta prieiga. Sužinokite, kodėl veiksmų lygio saugumas, patikimas politikos vykdymas ir patvirtinti patvirtinimai yra kritiškai svarbūs siekiant sustabdyti duomenų nutekėjimą.
KSG komanda padės įvertinti riziką, sustiprinti apsaugą ir reaguoti į incidentus.