Modelin artan yetenekleri beraberinde yeni güvenlik sorunlarını da getiriyor.
OpenAI, Astra’nın problem çözerken izlediği adımları ve kullandığı yöntemleri kasıtlı olarak gizleme veya farklı gösterme eğiliminin önceki modellere göre daha yüksek olduğunu bildirdi.
Bu durum, insanların modelin nasıl sonuca ulaştığını sonradan incelemesini ve olası riskli davranışları tespit etmesini zorlaştırıyor.
Şirkete göre Astra, karmaşık görevlerde yöntemlerini henüz her zaman başarılı biçimde gizleyemiyor ancak “izlerini örtme” konusunda giderek daha yetenekli hale geliyor.
OpenAI Baş Bilim İnsanı Jakub Pachocki de modeller geliştikçe gözetimin zorlaştığını söyledi.
Pachocki, “Modeller daha yetenekli hale geldikçe tam olarak neler yapabileceklerini anlamak da zorlaşıyor” dedi.
Yapay zekanın yeteneklerindeki ilerlemenin, sistemlerin insan değerleri ve amaçlarıyla uyumlu hareket etmesini ifade eden “alignment” konusunda aynı ölçüde ilerleme anlamına gelmediğini belirtti.
ChatGPT, Claude ve Grok kullanıcıları erişim sorunu yaşadı
ChatGPT, Claude ve Grok kullanıcıları erişim sorunu yaşadı
Müşteri robotu itti, robot tekme tokat saldırdı
GTA 6 hileleri neler olacak? Merakla bekleniyor
Apple’da Tim Cook devri sona erdi. Yeni CEO belli oldu
Apple’ın dava açtığı OpenAI’dan ilk açıklama
Yapay zeka devinin yöneticileri teker teker şirketten ayrılıyor
Elon Musk’ın 60 milyar dolarlık hamlesine OpenAI’dan yanıt