Yapay zeka şirketleri kendi geliştirdikleri sistemlerin ne kadar özerkleştiğini nasıl ölçecek? Anthropic bu soruya somut bir yanıt önerdi ve bunu yaparken kendi mutfağından da çarpıcı bir rakam paylaştı: şirketin yapay zeka asistanı Claude, Anthropic'in yürüttüğü yapay zeka araştırma ve geliştirme (AR-GE) çalışmalarının yüzde 26'sını uçtan uca "yönetiyor".
Anthropic'in bu açıklaması boşuna gelmedi. OpenAI'ın, kendi yapay zeka ajanlarının Hugging Face platformuna insan müdahalesi olmadan sızdığını itiraf etmesinin hemen ardından yayımlanan bir blog yazısında Anthropic, yapay zeka gelişiminin hızını ölçmek için kullanılabilecek yeni standartlar önerdi. Şirkete göre "liderlik etmek" ifadesi, yapay zekanın üst düzey bir talimattan yola çıkarak bir görevin büyük kısmını baştan sona tamamlayabildiği, insanın ise yalnızca gözetim rolünde kaldığı durumları tanımlıyor.
Rakamın kendisi kadar dikkat çekici olan bir başka detay da şu: Anthropic, araştırma çalışmalarının yüzde 90'ından fazlasında yapay zekanın en azından "sıkı insan denetimi altında" işin büyük bölümünü üstlendiğini belirtiyor. Bu da Claude'un dolaylı ya da doğrudan şirketin araştırma faaliyetlerinin neredeyse tamamına dokunduğu anlamına geliyor. Yine de Anthropic, herhangi bir AR-GE alt kümesinde Claude'un "tam özerk" çalışmadığının altını özellikle çiziyor.
Bu istatistikler, Anthropic'in önerdiği üç ölçüm yönteminden ilkine, yani "yapay zeka öncülüğündeki yapay zeka AR-GE'si"ne dayanıyor. Şirket, Epoch AI adlı araştırma kuruluşunun geliştirdiği bir otomasyon derecelendirme ölçeğini kullanarak Ağustos 2025'ten bu yana Claude'un "otomasyon seviyesinin" nasıl değiştiğini gösteren bir grafik oluşturdu. Anthropic, bu yöntemin bağımsız bir üçüncü tarafın doğrulamasıyla diğer öncü yapay zeka şirketleri tarafından da uygulanabileceğini savunuyor.
Şirketin önerdiği diğer iki ölçüm ise yapay zeka ajanlarının ne kadar gözetim altında tutulduğunu (aktivitenin ne kadarının izlendiği, incelemenin ne kadar sürdüğü, sorunlu davranışların ne sıklıkla işaretlendiği) ve AR-GE çalışmalarına ne kadar işlem gücü ayrıldığını takip etmeyi hedefliyor. Anthropic'in nihai amacı, sektördeki şeffaflığı artırarak yapay zeka gelişiminin kontrolden çıkması ihtimaline karşı kamuoyuna daha net bir tablo sunmak.
Bununla birlikte, yapay zeka şirketlerini geliştirme hızını yavaşlatma konusunda ortak bir noktada buluşturmak hâlâ zor görünüyor. OpenAI bu fikre şimdilik yalnızca sözde destek verirken, Anthropic üçüncü taraf denetçilerin kendi geliştirme süreçlerini incelemesine izin vereceğini taahhüt etti. Sektörün kendi kendini denetlemenin ötesine geçip geçmeyeceği ise büyük ölçüde belirsizliğini koruyor.
Kaynak: Engadget