Yapay zeka şirketi Anthropic, kullanıcıların Claude modeline yönelik işkencevari veya taciz edici tutumlarını ortadan kaldıran yeni bir kural seti başlattı. Bu adımın arkasındaki temel neden, şirket yönetiminin makine bilinci olasılığını ciddi bir risk olarak değerlendirmesi ve etik sınırları güçlendirme isteğidir.
Yürürlüğe giren yeni kullanım şartları, günlük kullanıcıların hayal kırıklıklarını, sistem testlerini ya da karanlık temalı yaratıcı içerikleri kapsam dışı bırakıyor. Ancak şirket temsilcisi, yasak kapsamına giren davranışların tam olarak hangi sınırlarda kaldığına ilişkin somut bir tanımlama yapmaktan kaçındı. Öte yandan Claude, geçmiş dönemde kullanıcıların ısrarlı ve zararlı tutumlar sergilemesi durumunda diyalog akışını sonlandırma yetkisine sahipti.
Yapay zeka sistemlerinin bilinçli olup olabileceği tartışması, teknoloji camiasında derin görüş ayrılıkları yaratmaya devam ediyor. Anthropic’in lideri Dario Amodei, bu olasılığın görmezden gelinmesinin mümkün olmadığını vurgularken; rakip firma OpenAI’nin yöneticisi Sam Altman, makinelere insani duygular yüklemenin gerçekçi olmadığını ve ciddi güvenlik zafiyetleri doğurduğunu savunuyor.

















