'독파모' 2차 평가 항목별 최고점은 모티프·SKT·LG 작성일 08-20 12 목록 <div id="layerTranslateNotice" style="display:none;"></div> <strong class="summary_view" data-translation="true">AAII 모티프 11.9점·NIA SKT 13.4점<br>전문가·국민 평가선 LG AI연 최고점</strong> <div class="article_view" data-translation-body="true" data-tiara-layer="article_body" data-tiara-action-name="본문이미지확대_클릭"> <section dmcf-sid="qfih8dyOZS"> <figure class="figure_frm origin_fig" contents-hash="5d4f68ba3324e0bbf1f5c77da1b32963095d33c83d916aba58851aaa818f25d1" dmcf-pid="B4nl6JWIHl" dmcf-ptype="figure"> <p class="link_figure"><img alt="류제명 과기정통부 2차관이 18일 오전 서울 종로구 정부서울청사에서 '독자 AI 파운데이션 모델' 프로젝트 2차 단계평가 결과를 발표하고 있다.ⓒ데일리안 조인영 기자" class="thumb_g_article" data-org-src="https://t1.daumcdn.net/news/202608/20/dailian/20260820150849502bxqt.png" data-org-width="700" dmcf-mid="zmhukIb0Gv" dmcf-mtype="image" height="auto" src="https://img4.daumcdn.net/thumb/R658x0.q70/?fname=https://t1.daumcdn.net/news/202608/20/dailian/20260820150849502bxqt.png" width="658"></p> <figcaption class="txt_caption default_figure"> 류제명 과기정통부 2차관이 18일 오전 서울 종로구 정부서울청사에서 '독자 AI 파운데이션 모델' 프로젝트 2차 단계평가 결과를 발표하고 있다.ⓒ데일리안 조인영 기자 </figcaption> </figure> <p contents-hash="ddc6e660fa0d8971a1a46c089b2b9c6d4bd89784b2ca3de109563a26e82e8a1d" dmcf-pid="b8LSPiYC1h" dmcf-ptype="general">과학기술정보통신부가 ‘독자 AI 파운데이션 모델(독파모)’ 프로젝트 2차 단계평가의 세부 기준과 결과를 20일 공개했다.</p> <p contents-hash="c7baa319616f6ce209194d572901b879847c7b5f549eb65b28761802c7d47280" dmcf-pid="K6ovQnGhXC" dmcf-ptype="general">평가 결과 AAII 벤치마크는 모티프테크놀로지스, NIA 벤치마크와 AI 전문 사용자 평가는 SK텔레콤, 전문가 평가와 일반 국민 평가는 LG AI연구원이 각각 항목별 최고점을 기록했다.</p> <p contents-hash="085246fd5d430486cca1054169c9e994848eb53a807e9cd8b4497b5fa1370f9d" dmcf-pid="9PgTxLHlXI" dmcf-ptype="general">먼저 벤치마크 평가는 AAII(Artificial Analysis Intelligence Index) 벤치마크 평가(배점 25점)와 NIA 벤치마크 평가(배점 15점)로 구성된다.</p> <p contents-hash="762ec79f6d112cb601845deb56f483b12dfb349f56671f96fe06dafb986170cb" dmcf-pid="2QayMoXSZO" dmcf-ptype="general">AAII 벤치마크 점수 측정 방법 등은 6월말 AA(Artificial Analysis)에서 공표한 기준을 채택했다.</p> <p contents-hash="4855cf1d35af293b5296cf654f8192db13a016e001ce49c467f82698cfe0cb92" dmcf-pid="VxNWRgZvZs" dmcf-ptype="general">AAII 벤치마크 평가는, AA가 직접 평가 결과를 도출해 제공했고, AAII 벤치마크 점수는 25점 만점 스케일링해 최종 점수에 반영했다.</p> <p contents-hash="bfba97b136ddd0e3cb6593cad7a4e72e193997162020ee024f5127dff6a65e54" dmcf-pid="fMjYea5T1m" dmcf-ptype="general">AAII 벤치마크 평가 점수는 모티프테크놀로지스 정예팀이 11.9점의 최고점을 득점했고, 4팀의 평균 점수는 9.48점이다.</p> <p contents-hash="06334e16f99ef2a8e766b07b56400b4d0c493b5b95730e725199023b3d9a19e6" dmcf-pid="4RAGdN1yHr" dmcf-ptype="general">NIA 벤치마크 평가는 7개 분야(수학, 지식, 장문이해, 안전성, 신뢰성, 한국어, 지시이행) 벤치마크 데이터셋으로 NIA에서 평가 결과를 도출하고 15점 만점 스케일링해 최종 점수에 반영했다.</p> <p contents-hash="615e953699af00d830ec310476c3f39ea716049909c5763725fdd61a3b0a0c9d" dmcf-pid="8ecHJjtWtw" dmcf-ptype="general">NIA 벤치마크 평가 점수는 SK텔레콤 정예팀이 13.4점의 최고점을 득점했고, 4팀의 평균 점수는 13.05점이다.</p> <p contents-hash="2ddcddc68fd9cb05ec25b85001fa61c22db40ceb23297a70264b8f899978770f" dmcf-pid="6dkXiAFYHD" dmcf-ptype="general">전문가 평가는 다수 외부 전문가(산업계 3명, 학계 5명, 연구계 2명)로 평가위원회를 구성해 추진하고, 정예팀이 제출한 평가서류 등을 바탕으로 약 5일 간의 서면평가와 QnA를 병행해 진행했다.</p> <p contents-hash="18b595e598093f3e01271f810de10c573d1833b2fb1c5dc1fa1549172a081817" dmcf-pid="PPgTxLHlGE" dmcf-ptype="general">전문가 평가 기준은 개발 전략 및 기술 10점, 개발 성과 및 계획 10점, 파급효과 및 기여계획 15점이며(독자성 최소기준 점검 병행), 각 평가위원 별 점수는 이를 합산해 산정했다.</p> <p contents-hash="bec7aac44d79e0dfeac62a9706911663b34f4b7ed37d6f6910120bbf3045bda8" dmcf-pid="QQayMoXSXk" dmcf-ptype="general">새롭게 참여한 모티프테크놀로지스와 기존 정예팀 간 공정 경쟁 지원을 위해, 모티프테크놀로지스 정예팀의 국내 AI생태계 파급효과 평가는 새로운 독자 AI모델 기반이 아닌, 기존 AI모델의 현장확산 실적·계획까지 폭넓게 종합해 평가했다.</p> <p contents-hash="87896c6dc3736e3edfb2f960b3cb07a15e91fa3e4ba7582c426e35fdce99946f" dmcf-pid="xxNWRgZvGc" dmcf-ptype="general">정예팀별 평가점수 산출은 위원별 평가점수 중 최고·최저 점수를 제외한 나머지 평가점수를 산술 평균했다.</p> <p contents-hash="84b374682ae6e908b4a0f159604940f7505d7f054d34bf87dd488bc3ebbc08c3" dmcf-pid="WWpRG3nQGj" dmcf-ptype="general">이를 종합한 전문가 평가 점수는 LG AI연구원 정예팀이 29.5점의 최고점을 득점했고, 4팀의 평균 점수는 28.75점이다.</p> <p contents-hash="4a2e26532b89a48c5f235cd2d0da48f1d1e36ffccb5229acaf39a46b7f36a3c0" dmcf-pid="YYUeH0Lx1N" dmcf-ptype="general">사용자 평가는 AI모델의 활용성과 정예팀의 AI 서비스 역량 평가 등을 강화하기 위해서, AI 전문 사용자진 평가(배점 15점)와 일반 국민 평가 (배점 10점)로 구성했다.</p> <p contents-hash="4f31264835356495abd01324bea2019e6a3f5e6adc68e84e874c9eead7a9396b" dmcf-pid="GGudXpoMHa" dmcf-ptype="general">각 팀의 AI 사용 웹사이트를 기반으로 AI 사용성(Usability) 등에 대한 평가를 진행했다.</p> <p contents-hash="e22603ac8ba751ad3035593f992b9e03c13d54c8b3285fe4d0d00baa1e8efa21" dmcf-pid="HH7JZUgRHg" dmcf-ptype="general">또한 평가단 대상 프롬프트 가이드라인 제공, AI사용 웹사이트 내 정예팀별 AI모델 평가 순서 무작위 제공, 일정시간(최소 3분) 이상의 충분한 사용자 평가 지원 등을 통해 평가의 공정성을 높였다.</p> <p contents-hash="082e33be2049a74027f6cc4114631546307932360fd4598d0e07948dfb69db06" dmcf-pid="XXzi5uaeGo" dmcf-ptype="general">AI 전문 사용자진 평가는 이해충돌 확인 등을 거쳐 50명이 선정돼, 실제 49명이 평가에 참여했다. AI 전문 사용자진의 평가는 절대평가로서, 최저 1점부터 최고 5점까지 점수를 부여하도록 했다.</p> <p contents-hash="02660a3e3704f6f4323b1eaea3d7574d58241723be2629eb548925c6099cc2c8" dmcf-pid="ZZqn17NdXL" dmcf-ptype="general">각 AI 전문 사용자가 절대평가해 점수를 합산하고, 15점 만점으로 스케일링해 최종 점수를 산출했다.</p> <p contents-hash="2264d882f6b0428289511e7d2b636a5529735a65222a2ffab9b35aac6c0dc7a5" dmcf-pid="11boFqAiti" dmcf-ptype="general">종합한 AI 전문 사용자진 평가 점수는 SK텔레콤 정예팀이 11.6점의 최고점을 득점했고, 4팀의 평균 점수는 10.53점이다.</p> <p contents-hash="e3002f54034139d9ba41f119b92ef2b7fd2de78c50566d58a173c1ea3e47f000" dmcf-pid="ttKg3BcnGJ" dmcf-ptype="general">일반 국민 평가단의 경우, 일반 국민에 대한 대표성 제고를 위해, 충분한 기간 동안 공모한 후, 국내 주민등록인구 통계 기준으로 성별·연령별 쿼터를 설정하고, 시스템을 통해 무작위로 200명이 선정됐고, 실제 185명이 평가에 참여했다.</p> <p contents-hash="a287edafbe483e93d199253683ec242f195c1c41c638c4fcdb9786824570165f" dmcf-pid="FF9a0bkLHd" dmcf-ptype="general">국민 평가단의 평가 역시 정예팀별 절대평가로 진행돼, 최저 1점부터 최고 5점까지 점수를 부여하도록 했다. 각 사용자(일반 국민)가 절대평가해 점수를 합산하고, 10점 만점으로 스케일링해 최종 점수를 산출했다.</p> <p contents-hash="c7a713acd876609b85d32920fdf5d4cd41549185eaacb1373557237402ae0599" dmcf-pid="332NpKEo5e" dmcf-ptype="general">이를 종합한 일반 국민 평가단 평가 점수는 LG AI연구원 정예팀이 7.6점의 최고점을 득점했고, 4팀의 평균 점수는 7.03점이다.</p> <p contents-hash="80e077f7d765504c580f7de1a476622027c4561612902d8c78f3819de01b80ae" dmcf-pid="02dIfRvmZR" dmcf-ptype="general">과기정통부는 독파모 정예팀을 비롯한 다양한 기업들이 이번 프로젝트의 결과에 머무르지 않고, 각자의 AI 모델과 기술을 지속적으로 발전시켜 국내 AI 생태계에서 그 가치를 인정받고 실제 현장에서 활용·확산할 수 있도록 정책적 지원을 확대한다는 계획이다.</p> </section> </div> <p class="" data-translation="true">Copyright © 데일리안. 무단전재 및 재배포 금지.</p> 관련자료 이전 [FRC 2026] 장유진 코헤시티코리아 상무 “잠자는 백업 데이터, 금융권 AI 자산으로 활용해야” 08-20 다음 한재성 인디켐 대표 “중국에서 인도로 반도체 소재 공급망 다변화 필요” 08-20 댓글 0 등록된 댓글이 없습니다. 로그인한 회원만 댓글 등록이 가능합니다.