TenkiBench-datasettet
Oppgavene bak benchmarken, servert som JSON, JSONL eller CSV med metodikk og lisens i samme svar. Ferdige siteringer i BibTeX, APA og MLA ligger på nettstedet.
Datasettet er den delen av TenkiBench det er lettest å bygge videre på uten å kjøre noe selv. Endepunktet leverer oppgavene med en konvolutt som oppgir versjon, metodikk, lisens og antall, slik at et uttrekk kan siteres presist i stedet for å bli kopiert inn i et regneark og miste opphavet. Et mindre hold-out-sett holdes tilbake for å hindre at oppgavene lekker inn i treningsdata, og hashene for de tilbakeholdte oppgavene er publisert så uttrekket fortsatt kan etterprøves.
Interessert i lignende?
Vi tar på oss prosjekter med konkrete KI-utfordringer hvor lokal- kjøring eller AI Act-etterlevelse er reelle krav. Start med en KI-kartlegging, eller send en linje direkte.