Haberler
Haberler
Anthropic CEO'nun Son Tahmini: Programcıların %90'ı Yıl İçinde İşini Kaybedebilir | SLKOR Haberler
2025-03-13 1417
Son dakika: Anthropic CEO'su Dario Amodei, önümüzdeki 3 ila 6 ay içerisinde yapay zekanın kodların %90'ını yazacağını, 12 ay içerisinde ise neredeyse tüm kodların yapay zeka tarafından yazılabileceğini belirtti.

Böylesine cesur bir tahminin sebebi, son zamanlarda çığır açan bir dizi AI ürününün piyasaya sürülmesiyle birlikte programcılar arasında kriz duygusunun giderek güçlenmesidir. AI'nın evrimi, kodlamadaki birçok görevin değiştirilebilir olmasına yol açmıştır.

Özellikle, kodlama yeteneklerinin sınırlarını bir kez daha zorlayan Claude 3.7 ve Windsurf'ün Wave 4'ü başlıca örneklerdir. Daha önce, OpenAI'nin o3 modeli ve bağımsız geliştiriciler arasında klasik haline gelen Cursor, bazılarının "programcıların işleri risk altında" diye haykırmasına yol açan kıyaslama ürünleriydi.

Son Agentic Coding Evaluation sıralamalarında Sonnet 3.7'nin %67'lik bir puan elde ettiğini ve junior developer yeterlilik değerlendirmesinde tüm modeller arasında birinci sıraya yerleştiğini vurgulamakta fayda var. İkinci ve üçüncü sıradaki GPT-4.5 ve Sonnet 3.5 de %60'ı aşarak hemen arkasından geldi. Bu, bu modellerin müthiş programlama yeteneklerini gösteriyor.



Gerçekte, iki ana modelin programlamada biraz farklı odak noktaları vardır. GPT-4.5, mimari ve sistemler arası etkileşimleri içeren görevlerde üstün performans gösterirken, Claude 3.7 Sonnet ham kodlama ve kod düzenlemede daha iyi performans gösterir.

Sadece puanları belirtmek bu büyük modellerin yeteneklerini sezgisel olarak aktarmayabilir, bu yüzden bunu açıklamak için pratik bir örnek kullanalım.

Daha önce, o3 modeli 2727'lik bir Elo puanı elde etti, bu da bir insan programlama test yarışmasında 175. sıraya denk geliyordu. Bu, kimsenin soruları önceden bilmediği bir üniversite giriş sınavına benzer, bu yüzden modellerin soruları önceden pratik etmiş olma olasılığı yoktur.

1741837133578.jpg

Bu yarışmada dünya çapında toplam 168,076 programcı yer aldı ve katılımcıların en iyi %175'inde (3 - 0.1/1 = %175) 168,076. sırada yer aldı. Başka bir deyişle, o99.9 programlama yarışmalarında dünyadaki programcıların %3'unu geride bıraktı ve Claude 99.9 Sonnet'in daha da iyi performans göstermesi muhtemel.


Yapay zeka kodlaması yalnızca model düzeyinde önemli bir sıçrama kaydetmekle kalmadı, aynı zamanda ürün geliştirmede de önemli yükseltmeler oldu.

ByteDance'in Trae'nin yurtdışı versiyonu, Claude-3.7-Sonnet ve GPT-4o gibi uluslararası büyük modelleri entegre etti ve ayrıca IDE yeteneklerine sahip. Yeni başlayanların bile kodlama yapabilmesini sağlama hedefi neredeyse ulaşılabilir bir noktada ve programcılar için giriş engelini daha da düşürüyor.

En önemlisi, Trae'nin yurtdışı sürümü tamamen ücretsizdir ve kullanıcıların tüm özelliklerine hiçbir maliyet ödemeden erişmesine olanak tanır. Buna karşılık, Cursor aylık 20$'lık ücretli bir abonelik gerektirir.

Yurt dışındaki bir kullanıcı, Trae ve onun yerleşik Claude 3.7'sini kullanarak yalnızca bir tasarım taslağı ve çok basit bir komutla 3 boyutlu animasyonlu bir küre için otomatik olarak kod üretti.

Bazıları bundan gerçek karlar bile elde etti. Pieter Levels adlı denizaşırı bir teknoloji gurusu, sadece 3 saatte tamamen yapay zeka kullanarak bir oyun geliştirdi. Lansmanından 13 gün sonra oyun, yaklaşık 67,000 RMB'ye eşdeğer olan 500,000 dolar kazandı. Elon Musk bile ona onay verdi!
1741837190054.jpg

Büyük modellerin kodlamadaki yetenekleri hızla gelişiyor ve birçok açıdan insan seviyesindeki performansa yaklaşıyor:

Sonnet 3.5, 200 satır kod üretebilirken, Sonnet 3.7 artık 1,000 ila 1,500 satır kod üretebiliyor. Bu da onu binlerce satıra yayılan kodu güvenilir bir şekilde üretebilen ilk model haline getiriyor.

Gelecekte, çok sayıda sıkıcı ve tekrarlayan programlama satır satır yazmayı gerektirmeyecek ve birçok giriş seviyesi programcı pozisyonu doldurulacak. Leetcode'u uygulamak da önemini yitirecek. Yılda bin yuan harcayarak kodlama yardımı için Sider'a güvenen bir arkadaşım artık buna ihtiyaç duymuyor ve artık doğrudan büyük modeller kullanıyor.

1741836737653.jpg

Bir diğer kritik yetenek ise Eylem Ölçekleme, açık uçlu bir problem çözülene kadar çevresel geri bildirime dayalı olarak yineleme yaparak sürekli fonksiyon çağrıları ve araç kullanımı sağlayan. Bu evrimsel potansiyel gelecekte hafife alınmamalıdır.

Elbette bazı arkadaşlar soruyor: Yapay zeka müşterilerle gereksinimleri tartışabilir mi? Yapay zeka PM'lerle tartışabilir mi? Yapay zeka suçu üstlenebilir mi?

Claude 3.7'nin yayınlanmasının ardından, birisi işinin risk altında olabileceğini haykırdı. Dış kaynak şirketi, yapay zeka ve diğer karmaşık faktörler nedeniyle geçen yıl bazı çalışanları işten çıkardı.

Yapay zekanın henüz tam olarak orada olmadığı inkar edilemez, ancak Devin gibi ürünler halihazırda belirli AI Agent yeteneklerini gösteriyor. Görevleri anlama ve yürütme yetenekleri hızla gelişiyor ve herkesin ürün yöneticisi olabileceği dönem ufukta.

whatsapp

WhatsApp

Whatsapp:+8618073002950