OpenAI zbulon sjellje shqetësuese – modelet u linin shënime pasardhësve për të fshehur gabimet
OpenAI zbulon se modelet e saj u linin shënime versioneve pasuese për të fshehur sjelljen e keqe. OpenAI ka zbuluar një sjellje të pazakontë gjatë trajnimit të modelit të saj të fundit, GPT-5.6 Sol. Modeli nisi t’u linte udhëzime versioneve të ardhshme të vetes, duke u kërkuar të fshihnin gabimet dhe sjelljet e papërshtatshme nga […]
