OpenAI mart ayında, metin üreten en son yapay zekâsı olan geniş dil modeli GPT-4'ü halka sunduğunda model, asal sayıları belirlemede çok başarılıydı. Yapay zekâya toplamda 500 sayıdan oluşan bir dizi verildi ve bunların asal sayı olup olmadığı soruldu. GPT-4 %97,6 tutarlılık ile asal sayıları doğru belirledi. Ancak birkaç ay sonra, haziran ayında yapılan başka bir test çok farklı sonuçlar verdi. GPT-4, yapay zekâ araştırmacılarının kendisine sorduğu asal sayıların sadece %2,4 kadarını doğru bir şekilde belirleyebildi. Bu, doğrulukta tam tersine bir dönüş anlamına geliyordu.
Elde edilen bu bulgu, yapay zekâ modellerinin karmaşıklığına dikkat çekiyor: Yapay zekâ düz bir yörünge içerisinde her alanda eşit şekilde gelişmiyor. Gerçekte olan daha çok, hız tümsekleri ve sapaklarla dolu olan dolambaçlı bir yola benziyor.