국가 AI R&D, 사용 편의성보다 기초역량·성장성·산업 업무능력을 먼저 봐야 하지 않을까요?
... 지능과 성능을 확인하는 전체 정량 벤치마크에서 1위를 한 후보가, 모델의 기초성능보다는 이용 과정의 편의성과 체감 만족도에 무게가 실린 사용자평가에서 낮은 점수를 받아 탈락했습니다.2차 평가는 벤치마크 40점, 전문가 35점, 사용자평가 25점의 합산 구조였습니다. 벤치마크 1위가 무조건 선정돼야 한다는 뜻은 아니며, 사용자평가가 낮았다면 그것도 실제 ...