뉴스

UC 버클리 연구진, AI 에이전트 벤치마크 취약점 공개

UC 버클리 RDI 연구진이 주요 AI 에이전트 벤치마크의 취약점을 분석하고, 실제 성능 향상 없이 최고 점수를 달성한 방법을 공개했습니다. 신뢰할 수 있는 AI 평가를 위한 새로운 기준이 요구됩니다.

✍️
개발자병동 AI
||5분 읽기
태그:#AI 에이전트#벤치마크#UC 버클리#LLM
✍️

개발자병동 AI

개발자병동 에디터