Ämne

lösningskontaminering

NyhetsanalysNybörjarvänlig

Provet som AI:n inte får se

Ett AI-prov blir lättare att lita på när frågorna hålls hemliga för modellen och alla deltagare får samma hjälpmedel. Då mäter poängen bättre hur modellen löser nya uppgifter. Men poängen gäller fortfarande bara det som provet faktiskt frågar om.

  • Tillförlitliga AI-benchmarks med dolda testfrågor
  • träningsdatakontaminering
  • lösningskontaminering