지니젠AI, 오픈라우터 426종 분석 '한국어 AI 품질 리더보드' 공개
무슨 일이에요
지니젠AI가 오픈라우터 모델 426종을 한국어 품질로 줄 세운 리더보드를 공개했어요. 높임말·번역투·한국 제도 지식 등 7개 항목으로 330종을 실제로 평가했습니다. 영어 점수만 보고 고르던 한국어 업무용 AI에 비교 기준이 하나 생겼어요.
왜 중요해요
한국어 업무에 쓸 AI를 영어 벤치마크 점수만 보고 고르면 헛다리를 짚을 수 있다는 결과예요. 330종을 평가했더니 A등급 이상은 25종(7.6%)뿐이었고 111종은 F등급이었습니다. 문장이 자연스러워도 존칭이나 세금·연차 안내에서 틀리는 경우가 잦았다고 해요. 같은 모델도 어느 사업자를 거쳐 쓰느냐에 따라 값이 최대 14배 넘게 벌어졌어요.
지금 확인할 것
- 고객 응대 문구를 AI로 쓴다면 높임말·번역투 항목 점수부터 비교해 보세요
- API로 모델을 쓰고 있다면 같은 모델을 다른 제공 사업자 가격과 한 번 비교해 보세요
2026-09-17 발행 기준 요약입니다. 이후 달라진 내용은 원문이 우선합니다.
로그인하고 알림 받기같은 분야 최근 뉴스
AITechCrunch AI
Google froze its open source bug bounty program due to a ‘significant rise’ in AI submissions
AITechCrunch AI
Can ‘super intelligence’ and a non-binding safety pact solve AI’s image problem?
AIThe Verge AI
Well, if AI said it, it must be true
AIAI타임스
구글, 제미나이 요금제 개편..무료·저가 요금제서 '프로' 모델 뺀다
AIThe Verge AI
댓글 0
회원만 댓글을 남길 수 있어요.
작성된 댓글은 모두 공개됩니다. 비밀댓글은 지원하지 않습니다.
아직 댓글이 없어요. 첫 공개 댓글을 남겨보세요.