스타트업 뉴스AI타임스2026년 7월 20일

퍼플렉시티, 연구 에이전트 벤치마크 'WANDR' 출시…"최고 AI도 실무는 한계"

AI 연구 에이전트가 실제 업무에서 경쟁사 분석과 시장조사, 기업 실사 등을 수행하는 사례가 늘어나고 있지만, 현재의 성능은 방대한 정보를 빠짐없이 수집하고 이를 모두 신뢰할 수 있는 근거로 입증하는 수준에 크게 미치지 못하는 것으로 나타났다. 퍼플렉시티는 14일(현지시간) AI 연구 에이전트의 실제 지식 노동 수행 능력을 평가하기 위한 새로운 오픈 벤치마크 'WANDR(Wide ANd Deep Research)'를 공개했다. 이를 통해 현재 최고 성능의 AI 시스템조차 완전한 리서치 수행에는 크게 미치지 못하는 것으로 나타났다고
공공조달·정부지원사업 실무에 필요한 제안서 템플릿과 최신 공고는 문서 스토어 공고에서 확인하세요.