Rekabet bu hafta ham zekâ skorlarından çıktı. Görev maliyeti, siber savunma ve geliştirici iş akışı öne geçti.
Ucuz model kâğıt üstünde cazip görünür. Gerçek maliyeti ancak görev doğruluğu ve güvenlik sınırları bağımsız ölçüldüğünde ortaya çıkar.
Bu tür modellerde asıl soru modelin ne yapabildiği değil. Erişimi kimin aldığı belirleyici oluyor.
Bir modeli benchmark yaygınlaştırmıyor. Geliştiricinin her gün açtığı editöre girmesi yaygınlaştırıyor.
Üretken müzikte esas sınav kalite değil. Lisansın, içerik kökeninin ve sanatçı taklidi kontrolünün gerçekte nasıl işlediği belirleyecek.