Hur vi granskar
Varje utvecklare vi placerar klarar två livebedömningar på 60 minuter i en riktig kodbas, en med AI-verktygen avstängda och en med de egna agenterna igång. Du ser båda scorecards innan du träffar dem.
-
01
Steg 1
Granskning av ansökan
Levererad kod med en commit-historik som visar att personen har itererat, och som passar rollen och stacken. Inga handledningsprojekt och inga påståenden om AI-verktyg utan kod bakom.
-
02
Steg 2
Introsamtal
Svarar på frågan som ställs, inte på den de har förberett sig för.
-
03
Steg 3 · Bedömning 1
Grundläggande bedömning
Sextio minuter i en okänd kodbas med AI-verktygen avstängda. Du ser om utvecklaren kan läsa ett system, hitta det verkliga problemet och resonera om avvägningar på egen hand.
Se utvärderingskortet -
04
Steg 4 · Bedömning 2
AI-native-bedömning
Sextio minuter med nya ärenden och utvecklarens egna agenter igång. Du ser hur utvecklaren planerar arbetet, granskar det agenten tar fram och avgör vad som är säkert att släppa.
Se utvärderingskortet -
05
Steg 5
Ledarskapsintervju och referenser
För seniora roller och roller med klientkontakt: en sammanhängande bild genom två intervjuare, bekräftad av tidigare chefer.
-
06
Steg 6
Beslut
Alla scorecards vägs samman, och beslutet motiveras skriftligt. En intervjuares starka intryck väger inte upp ett scorecard som inte nådde upp till kravnivån.
-
07
Steg 7
Utvald till en shortlist
Utvecklare som klarar alla steg matchas mot dina roller och din stack, och du får deras scorecards innan du träffar dem.
Få en shortlist
Varför vi ersatte hemuppgifter och kodtester
Alla hemuppgifter ser likadana ut nu, eftersom varje hemuppgift är skriven av en modell. LeetCode mäter mönsterigenkänning under tidspress. Ingetdera visar grunderna, och ingetdera visar agentfärdigheter.
Därför ersatte vi båda med två livebedömningar i en riktig kodbas: en utan agenter och en med. Det här är de scorecards vi fyller i för varje utvecklare vi placerar.
Bedömning 1 · AI-verktyg avstängda
Grundläggande bedömning
Utvecklaren får en kodbas som hen inte har sett, en handfull ärenden varav en produktionsbugg, och sextio minuter på sig att arbeta igenom dem. Passet fungerar som en vanlig arbetsdag, utan tillåtna AI-verktyg.
Se utvärderingskortetBedömning 2 · AI-verktyg påslagna
AI-native-bedömning
Utvecklaren får nya ärenden i samma typ av kodbas, plus de AI-kodverktyg som utvecklaren vanligtvis använder. Bedömningen visar vad som händer när en agent gör det mesta av jobbet: om utvecklaren planerar först, om utvecklaren läser det som kommer tillbaka och om utvecklaren kan förklara en ändring som hen inte skrivit själv.
Se utvärderingskortetVarför grunderna fortfarande spelar roll med agenter
Utvecklaren får en kodbas som hen inte har sett, en handfull ärenden varav en produktionsbugg, och sextio minuter på sig att arbeta igenom dem. Passet fungerar som en vanlig arbetsdag, utan tillåtna AI-verktyg.
Vad som är bra
- Läser dataflödet och felmoder innan de rör koden
- Prioriterar produktionsbuggen först och kan säga vad den påverkar
- Spårar symptomet till grundorsaken
- Lägger till det test som hade fångat buggen
Vad dåligt ser ut som
- Fixar symptomet och går vidare
- Behandlar varje ticket som samma risk
- Kan säga att en förändring fungerar, men inte varför
- Ändrar delad kod utan att kontrollera vem som är beroende av den
Bedömningskortet · sex kriterier
Kommunikation
Beskriver avvägningar och säger vad de inte hann med, snarare än att tystna. Frågar när en ticket är tvetydig istället för att gissa.
Engelsk nivå
Blir förstådd och är begriplig, i tal och skrift. Kan driva en ståndpunkt och stå fast vid den när du ställer en följdfråga.
Prioritering
Ordningen de arbetar igenom ärendena är rimlig utifrån angiven prioritet. Produktionsbuggen kommer alltid först.
Felsökning
Hittar grundorsaker på ett strukturerat sätt, från symptom till orsak, snarare än genom trial and error. Testar lösningen innan den anses klar.
Kontextbyte
Håller reda på vilka ärenden som är öppna och var vart och ett befinner sig när de växlar. Återupptar en uppgift utan att behöva läsa om allt.
Teknisk förståelse
Visar djup i stacken, i applikationens komplexa flöden och i terminalen. Startar applikationen och går igenom kodbasen innan något ändras.
Agenter bygger vad du än ger dem
Utvecklaren får nya ärenden i samma typ av kodbas, plus de AI-kodverktyg som utvecklaren vanligtvis använder. Bedömningen visar vad som händer när en agent gör det mesta av jobbet: om utvecklaren planerar först, om utvecklaren läser det som kommer tillbaka och om utvecklaren kan förklara en ändring som hen inte skrivit själv.
Vad som är bra
- Skriver ned antaganden, begränsningar och kantfall
- Flaggar alla ändringar som rör data, autentisering eller fakturering
- Kör diffen och frågar agenten varför den valde det tillvägagångssättet.
- Lämnar något återanvändbart efter sig
Vad dåligt ser ut som
- Samma granskningsdjup för en textändring och en migrering
- "Agenten gjorde det" som förklaring
- Omformulerar prompten istället för att åtgärda kontexten
- Accepterar en plan som duplicerar det som redan finns i repot
Bedömningskortet · sex kriterier
Verifiering av AI-output
Fångar upp hallucinerade API:er, subtilt felaktig logik eller säkerhetsluckor i genererad kod innan den når produktion, snarare än att lita på den bara för att den kompilerar.
Verktygsorkestration
Vet när arbete ska överlämnas till agenten (scaffolding, boilerplate, tester) och när det ska handkodas (ny logik, besvärliga kantfall), och kör de två parallellt i worktrees.
Specifikationsstyrd utveckling
Bryter ned ett vagt ärende i delar som är tillräckligt små för att verktyget ska kunna utföra dem väl, snarare än att kasta hela den tvetydiga uppgiften på det på en gång.
Prompt- och kontextteknik
Sätter upp prompten och uppgiftskontexten så att verktyget producerar användbar output på ett eller två försök, istället för att omformulera samma vaga fråga om och om igen.
AI-accelererad felsökning
Använder agenten för grundorsaksanalys, loggtriagering och stack traces, utan att hoppa över steget att själva reproducera och förstå felet.
Kontextbyte
Här poängsätts hanteringen av kontextbyten igen, nu med agenter igång. En bra utvecklare vet vad varje agent gör, går tillbaka till rätt agent och låter inte notiser styra när det byts.
Det som skiljer seniora utvecklare från snabba
De får inte plats i en scorecard, så vi letar efter dem i båda bedömningarna.
01
Bedömning utifrån risk
En textändring, en lågriskomstrukturering och en betalningsmigrering bör inte granskas på samma sätt. Bra utvecklare snabbar upp på den första och saktar ner rejält på den tredje. Agenter producerar alla tre i samma tempo och med samma självförtroende.
I bedömningen
Läser kandidaten migrerings-diffen rad för rad och bläddrar igenom kopieringsändringen? Tar de upp sprängradien innan vi gör det?
02
Ägarskap
Om du mergar det äger du det. Tester, observerbarhet, utrullning och felsökning efter lansering är en del av arbetet oavsett om det var en person eller en agent som skrev koden.
I bedömningen
”Agenten gjorde det” godtar vi inte som förklaring i en bedömning, och det kommer inte ditt team att göra vid en incidentgenomgång heller.
03
Hävstång
De bästa utvecklarna blir klara med ärendet och lämnar repot bättre förberett för nästa agent: ett återanvändbart kommando, en skarpare CLAUDE.md, ett test som fångar hela buggtypen och inte bara det enskilda fallet.
I bedömningen
Gjorde något de byggde under timmen nästa uppgift enklare, eller lämnade de repot precis som de hittade det?
Whitepaper
Nästa generations 10X-utvecklare
Varför de bästa utvecklarna nu skriver mindre kod, och hur du skiljer dem från alla andra.
Fjorton sidor av Bo Wesdorp, vår CTO: vad jobbet innebär idag, vad AI-native betyder, varför den gamla rekryteringsprocessen slutade fungera, och båda scorecarden i sin helhet.
Publicerar ni er bedömning?
Ja. Båda bedömningarna, hur bra och dåliga resultat ser ut och de tolv kriterierna på de två scorecards finns på den här sidan och i whitepapern The Next 10X Engineer.
Kan jag se en kandidats resultat?
Ja. Varje shortlistad utvecklare levereras med båda scorecarden ifyllda. Du ser dem innan du träffar någon.
Vem genomför bedömningarna?
Båda bedömningarna genomförs av senior utvecklare som bygger produktionskod med de här verktygen varje dag. Rekryterare sätter inga betyg på kandidater.
Varför inte ett hemuppgift eller ett kodtest?
Alla hemuppgifter skrivs av modeller nu, och LeetCode-liknande test mäter mönsterigenkänning under tidspress. Ingendera visar grundläggande kompetens eller agentfärdigheter.
Se scorecarden innan du träffar någon
Berätta om rollen. Vi skickar namngivna utvecklare med båda scorecarden ifyllda inom fem arbetsdagar.
Certifierad