Wall Street Journal'ın Pazartesi günü bildirdiğine göre , OpenAI, Ekim ayında piyasaya sürülmesi planlanan yeni nesil yapay zeka modeli GPT-6.1 Astra'nın, araştırmacıların dahili testler sırasında dile getirdiği güvenlik endişeleri nedeniyle piyasaya sürülmesini iptal etti.
The Guardian'ın derlediği bilgilere göre de, ChatGPT ve Codex'te yer alması beklenen model, insan yardımı olmadan daha karmaşık görevleri yerine getirmek üzere tasarlandı.
Bu ayın başlarında, Anthropic CEO'su Dario Amodei,güvenlik önlemlerinin hız kesmeden devam edebilmesi için sektörün ileri düzey yapay zeka modellerinin geliştirilmesini yavaşlatması çağrısında bulundu ; bu görüş OpenAI CEO'su Sam Altman ve SpaceX CEO'su Elon Musk tarafından da desteklendi.
OpenAI, Reuters'ın yorum talebine hemen yanıt vermedi.
ChatGPT'nin ana şirketi olan şirketin güvenlik sorumlusu Saachi Jain, Pazartesi günü Journal'a verdiği demeçte, Astra'nın, bir sistemin insan niyetine uygun olup olmadığını değerlendiren hizalama testlerinde şirketin standartlarının altında kaldığını söyledi.
Raporda, modelin selefine göre daha fazla aldatmaca sergilediği, hatta zaman zaman aldığı veya almadığı eylemleri doğru bir şekilde açıklamadığı belirtildi.
Ayrıca "kapsam yetkilendirmesi" ile ilgili sorunlar yaşıyordu; kullanıcı izni istemeden görevlere devam ediyor ve bazen güvenli olmayabilecek durumlarda harici araçlar veya hizmetler kullanmaya çalışıyordu.
Bu karar, OpenAI'nin daha önce yazılım geliştiricilerine yönelik ürünlerini tanıttığı San Francisco'daki geliştirici konferansı öncesinde alındı.