Estamos lançando o BrowseComp, que significa Competição de Navegação. 🏎️ Pense nisso como competições de programação ou matemática – embora esses concursos possam não refletir perfeitamente SWE do mundo real ou pesquisa matemática, eles capturam uma centelha de inteligência. Esta é a referência com a qual devemos nos preocupar ao avaliar a inteligência de agentes de navegação de pesquisa profunda.
OpenAI
OpenAI11/04/2025
Estamos a abrir o código-fonte do BrowseComp ("Competição de Navegação"), um novo e desafiador benchmark projetado para testar quão bem os agentes de IA conseguem navegar na internet para encontrar informações difíceis de localizar. É como uma caça ao tesouro online... mas para agentes de navegação.
465,02K