
독자 인공지능(AI) 파운데이션 모델(독파모) 사업 2차 평가에서 탈락한 모티프테크놀로지스가 27일 정식 이의 제기를 신청했다고 밝혔다. 모티프는 입장문을 통해 전체 평가 항목별·업체별 상세 점수와 평가 내용 공개, 벤치마크 평가 배점 산정 방식의 근거 제시, 전문가 평가 상세 기준 및 판단 근거 공개, 사용자 평가 방법론과 블라인드 평가 적용 여부 공개 등을 요구했다.
모티프가 2차 평가에 제출한 '모티프 3' 모델은 글로벌 AI 종합 성능 지표인 AAII에서 47점을 받았다. 이는 같은 평가에 참여한 업스테이지(37점), SK텔레콤(35점), LG AI연구원(31점)의 모델보다 높은 점수다. 모티프는 "평가 결과 자체는 존중하고 받아들였지만, 언론을 통해 과기정통부는 모티프3가 AAII 벤치마크 점수만 높았을 뿐 전문가 평가와 사용자 평가에서 문제가 있었다고 설명한 것으로 보도됐다"고 밝혔다. 이어 "일부 언론에 보도된 과기정통부 고위 관계자 발언에서는 모티프3가 벤치마크 점수에 비해 실제 추론 성능이 미흡하고 사용성과 활용성이 떨어진다는 평가까지 언급됐다"며 "이는 독파모 사업의 본질과 향후 나아가야 할 방향에 대한 근본적인 의문을 제기한다고 생각한다"고 말했다. 모티프는 "평가점수의 상세한 공개와 재심의를 정중히 요청한다"고 덧붙였다.
독파모 2차 평가는 벤치마크 평가 40점(AAII 25점·NIA 15점), 전문가 평가 35점, 사용자 평가 25점으로 구성됐다. 모티프는 글로벌 최고 수준 모델의 AAII 점수가 63점인데 이를 25점 만점으로 환산하면 15.75점에 불과해 모델 간 실제 성능 차이가 평가 점수에 충분히 반영되기 어렵다며 배점 산정 방식에 문제를 제기했다.
전문가 평가와 관련해서는 LG AI연구원의 사례를 들었다. 모티프는 "AAII 점수가 가장 낮은 LG의 경우 이전 1차 대비 모델 규모를 2배 이상 키웠지만 벤치마크 점수 개선은 미미했다"며 "가장 성능이 낮은 모델이 전문가 평가에서 1위를 차지했다는 결과에 대한 구체적인 판단 근거를 이해하기 어렵다"고 밝혔다. 또 "전문가 평가 과정에서 '컨소시엄의 주관, 참여기업 중 외국계 자본이나 해외 법인이 의결권 있는 주요주주로 참여하고 있는 기업이 있느냐'와 같이 그 목적을 이해하기 어려운 질문들을 서면으로 요청받은 바 있다"며 관련 평가 기준에 대한 설명을 요구했다. 사용자 평가에 대해서도 "브랜드 인지도나 선입견이 평가에 영향을 미칠 가능성을 배제하기 어렵다"며 블라인드 평가 방식 적용 여부와 상세 결과 공개를 요청했다.
모티프는 다만 "이의 제기는 저희가 독파모에 선정돼야 한다는 주장을 위한 것이 아니다"라며 "이의 제기 결과와 관계없이 독파모 3차에는 참여하지 않겠다"고 밝혔다.
· · · · · · · · · ·
관련기사
▶ LS ITC-모티프테크놀로지스, 제조 현장 맞춤형 AI 모델 공동 개발 나선다
▶ 과기정통부, 인천 ICT 콤플렉스 개소…AI SW 인재양성 거점 마련
▶ 과기정통부, 「ICT 챌린지 2026」 개최…포항공대 InteractX팀 최종 우승
· · · · · · · · · ·
함께 보면 좋은 상품
[네이버] 메이크샐러드 단백질 닭가슴살 직장인 벌크업 저당 식단 냉동 도시락 간편식 바베큐 외 15종 — 4,900원
[쿠팡] 로그나스 종아리 마사지기 발바닥 발 마사지 볼 롤러 — 3,000원
※ 이 글에는 네이버 쇼핑 커넥트 활동의 일환으로, 판매 발생 시 일정액의 수수료를 제공받는 링크가 포함되어 있습니다.
※ 이 글은 쿠팡 파트너스 활동의 일환으로, 이에 따른 일정액의 수수료를 제공받습니다.
· · · · · · · · · ·
스페셜타임스는 AI 기술의 도움을 받아 더 빠르고 다양한 뉴스를 독자에게 전달하기 위해 노력하고 있습니다.
NEWS 참여포털
내 지역 날씨·재난·복지를 한 곳에서
폭염경보부터 고속도로 사고까지, 오늘 필요한 것만
withnews.co.kr →

