갱신 2026-09-22

한 줄 요약

한국어 데이터 100건짜리 분류 과제를 Jev와 비교 대상 생성 모델에 똑같이 시켜 시간·비용·판단 일치율을 직접 재 본 영상으로, 홍보 문구의 배수는 재현되지 않았지만 6~8배 수준의 차이는 확인했다고 정리한다.

핵심 내용

주요 주장 / 데이터

직접 측정한 값이다. 비교 대상 모델은 자막에 **"GPT 5.6 테라"**로 나오는데 그런 모델명을 확인할 수 없어 자막 표기 그대로 인용하고 **(모델명 불확인)**으로 둔다. 모든 실험에서 지시문과 병렬 처리 개수를 통일했고, 비교 모델에는 Jev와 같은 형태로 응답하도록 설계했다고 밝힌다 (2026-09 기준).

과제 (각 100건) Jev 직접 호출 게이트웨이 경유 비교 모델 (모델명 불확인)
한국어 고객 문의 분류 2.1초 3.7초 17.4초
댓글 피드 분류 5.6초 35.2초
광고 메일 분류 6.3초 45.2초

같은 분류를 했다고 정답을 맞혔다는 뜻은 아니라는 점을 영상 자신이 여러 번 강조한다. 일치율은 정확도가 아니라 "두 모델이 같은 기준으로 판단했다"는 지표로만 읽어야 한다.

외부 검증 (2026-09-22, 웹)

자동 생성 자막의 고유명사 오인식을 공식 문서 표기로 교정한다 52.

자막 표기 올바른 표기
제브 · 재브 · 재부 · 잭 · 제프 · 제 Jev
타입세 · 타이세프 · 타이세이 TypeSafe AI
LRM · LM LLM(대규모 언어 모델)
놀 · 노일 · "놀이스코어" Noul — 초이스·스코어·놀 = Choice·Score·Noul
시스템 모델 System One (시스템 원)
버셀 · "V세 AI 게이트웨이" · "AR 게이트웨이" Vercel AI Gateway

출처 정보