텔레그램 채널 주요 소식 모아보기
넘쳐나는 크립토 뉴스! 양질의 컨텐츠만 큐레이션해서 보여드려요.
BITMAN X는 암호화폐와 관련된 데이터들을 취합 및 제공하는 정보 서비스이며 이용자의 투자 의사결정에 대해 어떠한 책임도 지지 않습니다.
광고 문의
teleg
  • 전체보기
  • 뉴스/정보
  • 현물/선물트레이딩
  • 에어드랍/이벤트
  • 상장관련
viewCount1588
1시간 전
..
BChoSN/29281/6089172506926322186
골때리는 한국식 AI
목록으로 돌아가기텔레그램 링크 바로가기
이전 - 🗞 [이성진의 金맥 지도] 코스피 주춤하자 코인 거래...다음 - 동학농민운동 유공자 선정 방법 "썰 좀 풀어봐라" 신...
BChoSN/1713420685720790954
변창호 코인사관학교 BCH
@BChoSN
채팅방 @engzip Contact @bchocoin #AD = 비용 지원 받은 포스팅 / #KOL = 요청 받은 포스팅
최근포스팅
SK, AI/데이터사업 분사 원문
viewCount778
26분 전
비트도 다시 80k 두드리러
viewCount1126
38분 전
인구신 또 당신입니까 엔비디아 프리장 +5.9% 상승 중
viewCount1545
49분 전
진짜 개인적으로 너무너무너무 화가납니다. 😡😡

우리 대한한국에서 일명 '독자 AI 파운데이션 모델'(독파모)는 지금 "대한민국 대표 AI를 위해 팍팍 지원"한다면서, 

정작 전세계 벤치마크 지표(Artificial Analysis)에서..

--> "🇰🇷 한국 AI 모델 중에 1위 모델을 탈락"시키는 

한국식 탁상행정의 민낯을 보여줬습니다.

독파모가 뭔지도 모르는 분들 많을 텐데, 이건 그냥 공모전이 아닙니다.

"독자 AI 파운데이션 모델."

한국이 국가적으로 밀어줄 "대표 LLM 팀"을 고르고, GPU와 후속 지원을 몰아주는 사실상의 국대 선발전입니다.

근데 여기서 나온 결과가 황당합니다.

첨부한 사진 그래프 보시면,
한국의 모티프테크놀로지스가 만든 "Motif 3"가 벤치마크 기준으로 4개 후보 중 🥇 1위입니다.

점수도 47점으로 SKT 35, 업스테이지 35, LG 31보다 높습니다.

--> 그런데 탈락했습니다. (한국에서 만든 AI중 가장 좋은 성능의 AI인데..)

왜냐고요?

이번 평가는
1. 벤치마크 40점
2. 전문가 평가 35점
3. 사용자 평가 25점

이렇게 들어갔기 때문입니다.
즉, 실제 성능을 보는 점수는 40점인데,

사람 판단이 크게 들어가는 점수는 60점입니다.
여기서부터 딱 한국식 문제가 터집니다.

( 사람들 주관적 평가 >> 전세계 성능 점수 )

성능으로 증명한 팀보다,
전문가 평가 + 사용자 평가로 판이 뒤집혔습니다.

저는 이게 제일 어이없습니다.

전문
변창호 코인사관학교 BCH
진짜 개인적으로 너무너무너무 화가납니다. 😡😡 우리 대한한국에서 일명 '독자 AI 파운데이션 모델'(독파모)는 지금 "대한민국 대표 AI를 위해 팍팍 지원"한다면서, 정작 전세계 벤치마크 지표(Artificial Analysis)에서.. --> "🇰🇷 한국 AI 모델 중에 1위 모델을 탈락"시키는 한국식 탁상행정의 민낯을 보여줬습니다. 독파모가 뭔지도 모르는 분들 많을 텐데, 이건 그냥 공모전이 아닙니다. "독자 AI 파운데이션 모델." 한국이 국가적으로 밀어줄 "대표 LLM 팀"을 고르고, GPU와 후속 지원을 몰아주는 사실상의 국대 선발전입니다. 근데 여기서 나온 결과가 황당합니다. 첨부한 사진 그래프 보시면, 한국의 모티프테크놀로지스가 만든 "Motif 3"가 벤치마크 기준으로 4개 후보 중 🥇 1위입니다. 점수도 47점으로 SKT 35, 업스테이지 35, LG 31보다 높습니다. --> 그런데 탈락했습니다. (한국에서 만든 AI중 가장 좋은 성능의 AI인데..) 왜냐고요? 이번 평가는 1. 벤치마크 40점 2. 전문가 평가 35점 3. 사용자 평가 25점 이렇게 들어갔기 때문입니다. 즉, 실제 성능을 보는 점수는 40점인데, 사람 판단이 크게 들어가는 점수는 60점입니다. 여기서부터 딱 한국식 문제가 터집니다. ( 사람들 주관적 평가 >> 전세계 성능 점수 ) 성능으로 증명한 팀보다, 전문가 평가 + 사용자 평가로 판이 뒤집혔습니다. 저는 이게 제일 어이없습니다. 전문