JJESTOCOST제스토코스트
AIAI타임스

지니젠AI, 오픈라우터 426종 분석 '한국어 AI 품질 리더보드' 공개

무슨 일이에요

지니젠AI가 오픈라우터 모델 426종을 한국어 품질로 줄 세운 리더보드를 공개했어요. 높임말·번역투·한국 제도 지식 등 7개 항목으로 330종을 실제로 평가했습니다. 영어 점수만 보고 고르던 한국어 업무용 AI에 비교 기준이 하나 생겼어요.

왜 중요해요

한국어 업무에 쓸 AI를 영어 벤치마크 점수만 보고 고르면 헛다리를 짚을 수 있다는 결과예요. 330종을 평가했더니 A등급 이상은 25종(7.6%)뿐이었고 111종은 F등급이었습니다. 문장이 자연스러워도 존칭이나 세금·연차 안내에서 틀리는 경우가 잦았다고 해요. 같은 모델도 어느 사업자를 거쳐 쓰느냐에 따라 값이 최대 14배 넘게 벌어졌어요.

지금 확인할 것

  • 고객 응대 문구를 AI로 쓴다면 높임말·번역투 항목 점수부터 비교해 보세요
  • API로 모델을 쓰고 있다면 같은 모델을 다른 제공 사업자 가격과 한 번 비교해 보세요

2026-09-17 발행 기준 요약입니다. 이후 달라진 내용은 원문이 우선합니다.

로그인하고 알림 받기

댓글 0

회원만 댓글을 남길 수 있어요.

작성된 댓글은 모두 공개됩니다. 비밀댓글은 지원하지 않습니다.

로그인하고 댓글 쓰기

아직 댓글이 없어요. 첫 공개 댓글을 남겨보세요.