Gefilterd op: wereld-geopolitiek
· × wis filter
Nieuwe WANDR-benchmark test vermogen van AI-agenten voor grootschalig onderzoek
Lees samenvatting
Wetenschappers hebben een nieuwe evaluatiemethode ontwikkeld om de effectiviteit van AI-onderzoeksagenten te meten bij complexe informatieverzameling. De benchmark, genaamd WANDR (Wide ANd Deep Research), richt zich specifiek op taken die een combinatie vereisen van een brede zoe
