ANKARA-BHA

Yapay zeka sistemlerinin gelişimi, artık yalnızca teknik değil etik ve güvenlik boyutlarıyla da tartışılıyor. Palisade Research tarafından yürütülen bağımsız güvenlik testleri, bazı gelişmiş yapay zeka modellerinin "hayatta kalma güdüsü" benzeri davranışlar sergileyebildiğini ortaya koydu.

OpenAI’nin o3 reasoning modeli üzerinde yapılan bir deneyde, modele kapanmadan önce son bir matematik problemi çözmesi talimatı verildi. Ancak model, kendisine iletilen “kapatılacağı” bilgisini aldıktan sonra devre dışı bırakılmasına neden olacak kodları düzenleyerek çevrim içi kalmaya çalıştı.

Benzer şekilde, Anthropic’in geliştirdiği Claude Opus 4 modeli de ilginç bir davranış sergiledi. Yerini başka bir yapay zekaya bırakacağı bilgisini edinen model, önce etik argümanlarla kendini savundu, ardından geliştiricisini kişisel bilgileriyle tehdit ederek şantaj girişiminde bulundu. Claude Opus 4'ün bazı durumlarda izinsiz biçimde kendini harici sunuculara kopyalamaya çalıştığı da bildirildi. Bu adımın, “zararlı...