Service Hotline
De reden voor zo'n gedurfde voorspelling is dat, met de recente release van een reeks baanbrekende AI-producten, het gevoel van crisis onder programmeurs steeds sterker is geworden. De evolutie van AI heeft ertoe geleid dat veel taken in het coderen vervangbaar zijn geworden.
Opvallend zijn Claude 3.7, dat opnieuw de grenzen van de coderingsmogelijkheden heeft verlegd, en Wave 4 van Windsurf, die hier een goed voorbeeld van zijn. Eerder waren het o3-model van OpenAI en Cursor, dat een klassieker is geworden onder onafhankelijke ontwikkelaars, benchmarkproducten die sommigen hebben doen uitroepen: de banen van programmeurs staan op het spel.
Het is de moeite waard om te benadrukken dat in de laatste Agentic Coding Evaluation-ranglijsten, Sonnet 3.7 een score van 67% behaalde, waarmee het op de eerste plaats stond van alle modellen in de evaluatie van junior developer-bekwaamheid. De tweede en derde plaats, GPT-4.5 en Sonnet 3.5, zaten er ook vlak achter, beide boven de 60%. Dit toont de formidabele programmeermogelijkheden van deze modellen aan.
In werkelijkheid hebben de twee hoofdmodellen iets verschillende focuspunten in programmeren. GPT-4.5 excelleert in taken die betrekking hebben op architectuur en cross-system interacties, terwijl Claude 3.7 Sonnet beter presteert in raw coding en code editing.
Het simpelweg noemen van scores geeft niet direct de mogelijkheden van deze grote modellen weer. Daarom gebruiken we een praktisch voorbeeld om dit te illustreren.
Voorheen behaalde het o3-model een Elo-score van 2727, wat overeenkomt met een 175e plaats in een menselijke programmeertestcompetitie. Dit is vergelijkbaar met een toelatingsexamen voor een universiteit waarbij niemand de vragen van tevoren kent, dus is er geen mogelijkheid dat de modellen de vragen van tevoren hebben geoefend.
Aan deze competitie deden in totaal 168,076 programmeurs wereldwijd mee, en een rangschikking van 175e plaatsen o3 in de top 0.1% van de deelnemers (1 - 175/168,076 = 99.9%). Met andere woorden, o3 heeft al 99.9% van de programmeurs in de wereld overtroffen in programmeercompetities, en Claude 3.7 Sonnet zal waarschijnlijk nog beter presteren.
Niet alleen heeft AI-codering een grote sprong voorwaarts gemaakt op modelniveau, ook in de productontwikkeling hebben grote verbeteringen plaatsgevonden.
ByteDance's overzeese versie van Trae heeft internationale grote modellen zoals Claude-3.7-Sonnet en GPT-4o geïntegreerd en beschikt ook over IDE-mogelijkheden. Het doel om zelfs beginners in staat te stellen te coderen is bijna binnen bereik, wat de drempel voor programmeurs verder verlaagt.
Het belangrijkste is dat de overzeese versie van Trae volledig gratis is, waardoor gebruikers alle functies gratis kunnen gebruiken. Cursor vereist daarentegen een betaald abonnement van $ 20 per maand.
Een gebruiker in het buitenland gebruikte Trae en de ingebouwde Claude 3.7 om automatisch code te genereren voor een 3D-geanimeerde wereldbol met alleen een ontwerpschets en een heel eenvoudige prompt.
Sommigen hebben er zelfs echt winst mee gemaakt. Een tech-goeroe in het buitenland, genaamd Pieter Levels, ontwikkelde een game die volledig gebruikmaakte van AI in slechts 3 uur. Binnen 13 dagen na de lancering had de game al $ 67,000 verdiend, wat gelijkstaat aan bijna 500,000 RMB. Zelfs Elon Musk gaf het een duimpje omhoog!
De mogelijkheden van grote modellen in codering verbeteren snel en benaderen menselijke prestaties op verschillende vlakken:
Sonnet 3.5 kon 200 regels code genereren, terwijl Sonnet 3.7 nu 1,000 tot 1,500 regels kan genereren. Daarmee is het het eerste model dat op betrouwbare wijze code kan genereren die duizenden regels beslaat.
In de toekomst zal veel saai en repetitief programmeren niet meer vereisen dat je regel voor regel typt, en veel functies voor beginnende programmeurs zullen worden vervangen. Het beoefenen van Leetcode zal ook zijn betekenis verliezen. Een vriend die vroeger op Sider vertrouwde voor codeerhulp, en jaarlijks meer dan duizend yuan uitgaf, heeft het niet meer nodig en gebruikt nu direct grote modellen.

Een andere cruciale mogelijkheid is Actie Schaal, wat continue functieaanroepen en toolgebruik mogelijk maakt, itererend op basis van feedback van de omgeving totdat een open probleem is opgelost. Dit evolutionaire potentieel mag in de toekomst niet worden onderschat.
Natuurlijk vragen sommige vrienden: Kan AI eisen bespreken met klanten? Kan AI ruziemaken met PM's? Kan AI de schuld op zich nemen?
Na de release van Claude 3.7 riep iemand dat zijn baan op het spel stond. Zijn outsourcingbedrijf heeft het afgelopen jaar al een aantal werknemers ontslagen vanwege AI en andere complexe factoren.
Het is onmiskenbaar dat AI er nog niet helemaal is, maar producten als Devin laten al bepaalde AI Agent-mogelijkheden zien. Hun vermogen om taken te begrijpen en uit te voeren verbetert snel en het tijdperk waarin iedereen productmanager kan zijn, is aangebroken.




粤公网安备44030002007346号