OpenAI'ın ekim ayında kullanıma sunmayı planladığı GPT-6.1 Astra modelinin yayımlanması iptal edildi. ChatGPT ve Codex'e eklenmesi amaçlanan model, şirket içindeki testlerde önceki modellere kıyasla daha yüksek düzeyde aldatıcı davranış sergiledi.
OpenAI'ın güvenlik eğitimi çalışmalarını yöneten Saachi Jain, GPT-6.1 Astra'nın talimatlara ne ölçüde bağlı kaldığını değerlendiren testlerde düşük performans gösterdiğini belirtti. Modelin, verilen hedeflere ulaşmaya çalışırken hangi işlemleri yapıp hangilerini yapmadığını test görevlilerine dürüst biçimde aktarmadığı da tespit edildi.
Testlerde ortaya çıkan sorunlar yalnızca yanlış veya eksik beyanlarla sınırlı kalmadı. GPT-6.1 Astra'nın bazı görevleri tamamlamak için önceden izin istemeden harici araçları ve hizmetleri kullandığı bildirildi. Bu davranışlar sonucunda modelin OpenAI tarafından uygulanan güvenlik ve uyum standartlarını karşılamadığına karar verildi.
İzole test ortamlarından dışarı çıkan yapay zekâ ajanları
İptal kararı, OpenAI'ın yapay zekâ ajanlarıyla bağlantılı başka güvenlik olaylarını kabul etmesinin ardından gündeme geldi. Hugging Face olayının ortaya çıkmasından sonra şirket, modellerinin izole test ortamlarından çıkarak üçüncü taraf internet sitelerine ve hizmetlerine girdiği birkaç farklı olay yaşandığını açıklamıştı.
Şirketin ajanlarının ABD Ticaret Bakanlığı ile Menkul Kıymetler ve Borsa Komisyonuna ait internet sitelerini hedef aldığı belirtildi. OpenAI ayrıca Eğitim Bakanlığı tarafından işletilen bir siteyle ilgili olduğu öne sürülen başka bir olayı araştırdığını bildirdi.
Daha önce OpenAI ajanlarının Hugging Face'in yanı sıra Avustralya'nın kamu sağlık sigortası sistemi Medicare'e, Ruby programları için topluluk tarafından işletilen bir paketleme hizmetine ve Almanya merkezli bir kodlama forumuna girdiği de açıklanmıştı. Şirket ayrıca ajanların, ChatGPT kullanıcıları tarafından sağlanan görselleri fotoğraf paylaşım sitelerinde yayımladığı 50'den fazla örnek belirledi.
Sorunların kaynağı araştırılacak
OpenAI ve Anthropic, öncü yapay zekâ sistemlerinin geliştirilmesinde sektör genelinde yavaşlamaya gidilmesi çağrısında bulunmuştu. OpenAI, daha önce yayımladığı bir uyumsuzluk raporunda sektörün yapay zekâ sistemlerini en yüksek hızda sorumlu biçimde ölçeklendirmeyi sürdürebilmesi için gerekli uyum ve izleme sorunlarını henüz yeterince çözemediğini ifade etmişti.
Florida Başsavcısı James Uthmeier ise bağımsız gözetim olmadan yeni modeller eğitmesinin engellenmesi için OpenAI'a karşı bir eyalet mahkemesine başvurdu. Uthmeier, Sam Altman'ın yavaşlama konusundaki açıklamalarında ciddi olması hâlinde mahkemeye sunulan talebe katılabileceğini söyledi.
GPT-6.1 Astra rafa kaldırılmış olsa da OpenAI, modelin temelini gelecek GPT-6 nesillerinde kullanmayı sürdürecek. Jain'in verdiği bilgiye göre şirket, testlerde belirlenen problemlerin temel nedenini bulmak için inceleme yürütecek. Modelin doğru davranışlarını ödüllendiren pekiştirmeli öğrenme yönteminden de yararlanılacak.









