국내 브리핑
과기정통부, 독자 AI 2차 평가 세부 점수 공개
2차 평가 총점은 SK텔레콤 70.6점, 업스테이지 69.9점, LG AI연구원 69.0점, 모티프 65.8점 순이었다.
과학기술정보통신부는 8월 27일 ‘독자 AI 파운데이션 모델’ 프로젝트 2차 단계평가의 항목별 세부 점수를 공개했다. 모티프테크놀로지스가 입장문을 통해 상세 결과 공개를 요청했고 다른 정예팀도 동의해 공개 범위를 넓혔다고 설명했다. 이번 자료는 평가 순위뿐 아니라 벤치마크·전문가·사용자 평가의 구성과 점수를 함께 담았다.
총점은 SK텔레콤 70.6점, 업스테이지 69.9점, LG AI연구원 69.0점, 모티프테크놀로지스 65.8점 순이다. 전체 100점은 벤치마크 40점, 전문가 35점, 사용자 25점으로 구성됐다. 벤치마크는 글로벌 지표인 AAII 25점과 한국지능정보사회진흥원(NIA) 평가 15점으로 나뉘었다.
벤치마크 합계는 모티프가 24.6점으로 가장 높았고 업스테이지 22.7점, SK텔레콤 22.2점, LG AI연구원 20.6점이었다. AAII 환산점수는 모티프 11.9점, 업스테이지 9.4점, SK텔레콤 8.8점, LG AI연구원 7.8점이다. NIA 환산점수는 SK텔레콤 13.4점, 업스테이지 13.3점, LG AI연구원 12.8점, 모티프 12.7점으로 집계됐다.
전문가 평가는 산업계 3명, 학계 5명, 연구계 2명으로 구성된 외부 평가위원회가 서면평가와 질의응답을 병행했다. 결과는 LG AI연구원 29.5점, SK텔레콤 29.3점, 업스테이지 29.1점, 모티프 27.1점이었다. 개발 전략과 기술 10점, 개발 성과와 계획 10점, 파급효과와 기여계획 15점을 합산하는 방식이었다.
사용자 평가는 AI 전문 사용자 15점과 일반 국민 10점으로 구성됐다. 전문 사용자 평가는 선정된 50명 중 49명이 참여했고, 일반 국민 평가는 성별·연령별 쿼터로 무작위 선정된 200명 중 185명이 참여했다. 사용자 평가 합계는 SK텔레콤 19.1점, LG AI연구원 18.9점, 업스테이지 18.1점, 모티프 14.1점이었다.