진짜 개인적으로 너무너무너무 화가납니다. 😡😡
우리 대한한국에서 일명 '독자 AI 파운데이션 모델'(독파모)는 지금 "대한민국 대표 AI를 위해 팍팍 지원"한다면서,
정작 전세계 벤치마크 지표(Artificial Analysis)에서..
--> "🇰🇷 한국 AI 모델 중에 1위 모델을 탈락"시키는
한국식 탁상행정의 민낯을 보여줬습니다.
독파모가 뭔지도 모르는 분들 많을 텐데, 이건 그냥 공모전이 아닙니다.
"독자 AI 파운데이션 모델."
한국이 국가적으로 밀어줄 "대표 LLM 팀"을 고르고, GPU와 후속 지원을 몰아주는 사실상의 국대 선발전입니다.
근데 여기서 나온 결과가 황당합니다.
첨부한 사진 그래프 보시면,
한국의 모티프테크놀로지스가 만든 "Motif 3"가 벤치마크 기준으로 4개 후보 중 🥇 1위입니다.
점수도 47점으로 SKT 35, 업스테이지 35, LG 31보다 높습니다.
--> 그런데 탈락했습니다. (한국에서 만든 AI중 가장 좋은 성능의 AI인데..)
왜냐고요?
이번 평가는
1. 벤치마크 40점
2. 전문가 평가 35점
3. 사용자 평가 25점
이렇게 들어갔기 때문입니다.
즉, 실제 성능을 보는 점수는 40점인데,
사람 판단이 크게 들어가는 점수는 60점입니다.
여기서부터 딱 한국식 문제가 터집니다.
( 사람들 주관적 평가 >> 전세계 성능 점수 )
성능으로 증명한 팀보다,
전문가 평가 + 사용자 평가로 판이 뒤집혔습니다.
저는 이게 제일 어이없습니다.
전문