Utvecklare som granskar ett databasschema tillsammans

Hur vi granskar

Varje utvecklare vi placerar klarar två livebedömningar på 60 minuter i en riktig kodbas, en med AI-verktygen avstängda och en med de egna agenterna igång. Du ser båda scorecards innan du träffar dem.

Hela urvalsprocessen
  1. 01

    Steg 1

    Granskning av ansökan

    Levererad kod med en commit-historik som visar att personen har itererat, och som passar rollen och stacken. Inga handledningsprojekt och inga påståenden om AI-verktyg utan kod bakom.

  2. 02

    Steg 2

    Introsamtal

    Svarar på frågan som ställs, inte på den de har förberett sig för.

  3. 03

    Steg 3 · Bedömning 1

    Grundläggande bedömning

    Sextio minuter i en okänd kodbas med AI-verktygen avstängda. Du ser om utvecklaren kan läsa ett system, hitta det verkliga problemet och resonera om avvägningar på egen hand.

    Se utvärderingskortet
  4. 04

    Steg 4 · Bedömning 2

    AI-native-bedömning

    Sextio minuter med nya ärenden och utvecklarens egna agenter igång. Du ser hur utvecklaren planerar arbetet, granskar det agenten tar fram och avgör vad som är säkert att släppa.

    Se utvärderingskortet
  5. 05

    Steg 5

    Ledarskapsintervju och referenser

    För seniora roller och roller med klientkontakt: en sammanhängande bild genom två intervjuare, bekräftad av tidigare chefer.

  6. 06

    Steg 6

    Beslut

    Alla scorecards vägs samman, och beslutet motiveras skriftligt. En intervjuares starka intryck väger inte upp ett scorecard som inte nådde upp till kravnivån.

  7. 07

    Steg 7

    Utvald till en shortlist

    Utvecklare som klarar alla steg matchas mot dina roller och din stack, och du får deras scorecards innan du träffar dem.

    Få en shortlist
Bedömning 1 · Grundkunskaper

Varför grunderna fortfarande spelar roll med agenter

Utvecklaren får en kodbas som hen inte har sett, en handfull ärenden varav en produktionsbugg, och sextio minuter på sig att arbeta igenom dem. Passet fungerar som en vanlig arbetsdag, utan tillåtna AI-verktyg.

Vad som är bra

  • Läser dataflödet och felmoder innan de rör koden
  • Prioriterar produktionsbuggen först och kan säga vad den påverkar
  • Spårar symptomet till grundorsaken
  • Lägger till det test som hade fångat buggen

Vad dåligt ser ut som

  • Fixar symptomet och går vidare
  • Behandlar varje ticket som samma risk
  • Kan säga att en förändring fungerar, men inte varför
  • Ändrar delad kod utan att kontrollera vem som är beroende av den

Bedömningskortet · sex kriterier

01

Kommunikation

Beskriver avvägningar och säger vad de inte hann med, snarare än att tystna. Frågar när en ticket är tvetydig istället för att gissa.

02

Engelsk nivå

Blir förstådd och är begriplig, i tal och skrift. Kan driva en ståndpunkt och stå fast vid den när du ställer en följdfråga.

03

Prioritering

Ordningen de arbetar igenom ärendena är rimlig utifrån angiven prioritet. Produktionsbuggen kommer alltid först.

04

Felsökning

Hittar grundorsaker på ett strukturerat sätt, från symptom till orsak, snarare än genom trial and error. Testar lösningen innan den anses klar.

05

Kontextbyte

Håller reda på vilka ärenden som är öppna och var vart och ett befinner sig när de växlar. Återupptar en uppgift utan att behöva läsa om allt.

06

Teknisk förståelse

Visar djup i stacken, i applikationens komplexa flöden och i terminalen. Startar applikationen och går igenom kodbasen innan något ändras.

Bedömning 2 · AI-native arbetssätt

Agenter bygger vad du än ger dem

Utvecklaren får nya ärenden i samma typ av kodbas, plus de AI-kodverktyg som utvecklaren vanligtvis använder. Bedömningen visar vad som händer när en agent gör det mesta av jobbet: om utvecklaren planerar först, om utvecklaren läser det som kommer tillbaka och om utvecklaren kan förklara en ändring som hen inte skrivit själv.

Vad som är bra

  • Skriver ned antaganden, begränsningar och kantfall
  • Flaggar alla ändringar som rör data, autentisering eller fakturering
  • Kör diffen och frågar agenten varför den valde det tillvägagångssättet.
  • Lämnar något återanvändbart efter sig

Vad dåligt ser ut som

  • Samma granskningsdjup för en textändring och en migrering
  • "Agenten gjorde det" som förklaring
  • Omformulerar prompten istället för att åtgärda kontexten
  • Accepterar en plan som duplicerar det som redan finns i repot

Bedömningskortet · sex kriterier

01

Verifiering av AI-output

Fångar upp hallucinerade API:er, subtilt felaktig logik eller säkerhetsluckor i genererad kod innan den når produktion, snarare än att lita på den bara för att den kompilerar.

02

Verktygsorkestration

Vet när arbete ska överlämnas till agenten (scaffolding, boilerplate, tester) och när det ska handkodas (ny logik, besvärliga kantfall), och kör de två parallellt i worktrees.

03

Specifikationsstyrd utveckling

Bryter ned ett vagt ärende i delar som är tillräckligt små för att verktyget ska kunna utföra dem väl, snarare än att kasta hela den tvetydiga uppgiften på det på en gång.

04

Prompt- och kontextteknik

Sätter upp prompten och uppgiftskontexten så att verktyget producerar användbar output på ett eller två försök, istället för att omformulera samma vaga fråga om och om igen.

05

AI-accelererad felsökning

Använder agenten för grundorsaksanalys, loggtriagering och stack traces, utan att hoppa över steget att själva reproducera och förstå felet.

06

Kontextbyte

Här poängsätts hanteringen av kontextbyten igen, nu med agenter igång. En bra utvecklare vet vad varje agent gör, går tillbaka till rätt agent och låter inte notiser styra när det byts.

Det som inte ryms på ett kort

Det som skiljer seniora utvecklare från snabba

De får inte plats i en scorecard, så vi letar efter dem i båda bedömningarna.

01

Bedömning utifrån risk

En textändring, en lågriskomstrukturering och en betalningsmigrering bör inte granskas på samma sätt. Bra utvecklare snabbar upp på den första och saktar ner rejält på den tredje. Agenter producerar alla tre i samma tempo och med samma självförtroende.

I bedömningen

Läser kandidaten migrerings-diffen rad för rad och bläddrar igenom kopieringsändringen? Tar de upp sprängradien innan vi gör det?

02

Ägarskap

Om du mergar det äger du det. Tester, observerbarhet, utrullning och felsökning efter lansering är en del av arbetet oavsett om det var en person eller en agent som skrev koden.

I bedömningen

”Agenten gjorde det” godtar vi inte som förklaring i en bedömning, och det kommer inte ditt team att göra vid en incidentgenomgång heller.

03

Hävstång

De bästa utvecklarna blir klara med ärendet och lämnar repot bättre förberett för nästa agent: ett återanvändbart kommando, en skarpare CLAUDE.md, ett test som fångar hela buggtypen och inte bara det enskilda fallet.

I bedömningen

Gjorde något de byggde under timmen nästa uppgift enklare, eller lämnade de repot precis som de hittade det?

Omslaget till whitepaper-rapporten The Next 10X Engineer

Whitepaper

Nästa generations 10X-utvecklare

Varför de bästa utvecklarna nu skriver mindre kod, och hur du skiljer dem från alla andra.

Fjorton sidor av Bo Wesdorp, vår CTO: vad jobbet innebär idag, vad AI-native betyder, varför den gamla rekryteringsprocessen slutade fungera, och båda scorecarden i sin helhet.

Vanliga frågor

Vanliga frågor

Om din inte finns här hjälper vi dig gärna.

Kontakta oss
Publicerar ni er bedömning?

Ja. Båda bedömningarna, hur bra och dåliga resultat ser ut och de tolv kriterierna på de två scorecards finns på den här sidan och i whitepapern The Next 10X Engineer.

Kan jag se en kandidats resultat?

Ja. Varje shortlistad utvecklare levereras med båda scorecarden ifyllda. Du ser dem innan du träffar någon.

Vem genomför bedömningarna?

Båda bedömningarna genomförs av senior utvecklare som bygger produktionskod med de här verktygen varje dag. Rekryterare sätter inga betyg på kandidater.

Varför inte ett hemuppgift eller ett kodtest?

Alla hemuppgifter skrivs av modeller nu, och LeetCode-liknande test mäter mönsterigenkänning under tidspress. Ingendera visar grundläggande kompetens eller agentfärdigheter.

Vi pratar

Se scorecarden innan du träffar någon

Berätta om rollen. Vi skickar namngivna utvecklare med båda scorecarden ifyllda inom fem arbetsdagar.

Omdömen påClutch4.9 av 5 från 36 recensioner
ISO 27001
Certifierad

Boka trettio minuter med Dale

Kalendern tillhandahålls av HubSpot, som sätter egna cookies. Ladda den här, eller boka på HubSpots sida.

Öppna bokningssida