← Kunstig intelligens
Benchmark
En standardisert test for å sammenligne hvor god AI-modeller er på bestemte oppgaver - som en eksamen for AI.
MMLU tester generell kunnskap, HumanEval tester koding - modeller rangeres etter score.
En standardisert test for å sammenligne hvor god AI-modeller er på bestemte oppgaver - som en eksamen for AI.
MMLU tester generell kunnskap, HumanEval tester koding - modeller rangeres etter score.
Jeg bruker Google Analytics for å se hvor mange som besøker siden og hvilke artikler folk faktisk leser. Det krever informasjonskapsler, og derfor spør jeg først. Velger du «Kun nødvendige», lastes ingen sporing. Du kan når som helst endre valget på siden om informasjonskapsler.