TypeSafe 「시스템1 모델」 Jev — 벤더 주장과 유일한 독립 검증 사이


「모델은 몇 년 전부터 초인적으로 대화를 잘했다. 그런데 자동화는 어디 있지?」 TypeSafe AI 창업자 디오고 알메이다 — 오픈AI에서 RLHF와 ChatGPT의 공동발명에 참여했던 연구자 — 가 지난 4년간 던져온 질문입니다. 그는 2년간의 스텔스 기간과 4,000만 달러 시드 라운드를 거쳐, 9월 15일 기존 LLM과 다른 종류의 모델을 공개했습니다 — 「시스템1 모델(System One Model)」, 그 첫 번째 공개 모델의 이름은 Jev입니다.

시스템1 모델의 설계

TypeSafe 시스템1 모델 발표 그래픽

이미지: TypeSafe AI 공식 발표 그래픽 — 이미지출처: TypeSafe AI 공식 블로그 (typesafe.ai)

카네만의 인지심리학 은유대로입니다. LLM이 생각하고 글을 쓰는 「시스템2」라면, Jev는 순간 판단의 「시스템1」을 지향합니다. 핵심은 과감한 절단입니다.

  • 텍스트 생성을 버렸다: 문장을 만들지 않고, 구조화된 상태를 입력받아 타입이 지정된 결정을 출력합니다. 질문 프리미티브(Choice·Score·Noul)로 구성되며, 예컨대 고객 문의를 3개 부서 중 어디로 라우팅할지 {“billing”: 0.08, “technical”: 0.85, “sales”: 0.07} + 신뢰도 0.82 같은 확률로 답합니다.
  • 환각이 없다: 출력 구조가 사전에 정의되고 타입 오류가 나올 수 없는 구조입니다.
  • 병렬 처리: 시퀀스로 토큰을 예측하는 LLM과 달리, 쿼리당 모든 출력을 한 번에 만듭니다.

벤더 주장 — 어디까지 사실인가

TypeSafe의 주장은 극적입니다. 응답 70500ms로 LLM 대비 40200배 빠르고(공식 데모: Jev 0.114초 vs GPT-5.6 Terra 8.566초), 입력 $0.042/MTok에 출력은 무료. 최상위 모델 대비 580분의 1 비용이라는 계산도 나옵니다. The Register는 이 설계가 실제로 유용한 영역을 Doom 게임 플레이 데모와 고객 문의 분류 같은 「정답 집합이 제한된」 워크플로로 짚었습니다.

전문가·독립 검증은 이렇게 본다

유일한 독립 테스트 — 「좋지만 완벽하지 않다」. orcarouter.ai의 분석이 현재 공개된 유일한 제3자 검증입니다. 외부 테스터가 심어둔 결함 7개 중 Jev는 6개를 잡아냈고, 경쟁 모델 Claude Fable 5.1은 7개 전부를 잡았습니다. 동일 매체의 요약이 정곡입니다 — 「속도와 비용 주장은 제3자 검증에서도 살아남았다. 정확도 주장은 프런티어보다 한 수 아래다. 그리고 표본이 너무 작아 생산 환경 결론을 내리기엔 부족하다.」

The Register — 「주장은 주로 벤더 것」. 토머스 클레번 기자는 이 모델이 실재하고 호출 가능함(엔드포인트·SDK·가격 공개)을 인정하면서도, 성능 주장 대부분이 TypeSafe 자체 벤치마크라는 점, 아키텍처가 미공개이고 가중치도 공개되지 않았다는 점을 구분해 지적했습니다.

Techmeme·Hacker News — 개발자의 반응. HN에서 1,500점이 넘는 반응이 쏟린 건, AI를 코드에 붙일 때마다 겪어온 「텍스트 파싱·검증의 수고」를 정확히 찔렀다는 뜻입니다. 다만 기술 커뮤니티의 질문도 날카롭습니다 — 구조화 출력은 이미 기존 LLM으로 강제할 수 있는데, 전용 아키텍처가 갖는 진짜 우위는 파싱 제거가 아니라 밀리초 단위 속도와 출력 비용 0에 있다는 점입니다.

종합 — 출력 형식의 전환이라는 실험

독립 검증자들의 평가를 겹쳐 보면 합리적인 결론이 나옵니다. Jev의 속도·비용은 실재할 가능성이 높고(제3자가 재현), 「환각 없음」은 구조적 속성일 뿐 입력 상태가 잘못되면 결정도 틀립니다. 정확도는 아직 프런티어 한 수 아래이므로, 이 모델의 자리는 글쓰기·코딩 보조가 아니라 정답 집합이 정해진 소프트웨어 내부의 결정 지점(라우팅·분류·이상 감지·승인)입니다. 벤더의 200배 주장과 독립 테스트의 6/7 사이 — 그 간극을 그대로 두고 읽는 것이 지금 시점에서 가장 정확한 자세입니다. 그럼에도 이 발표가 의미 있는 이유는, 「LLM을 더 크게」라는 경쟁 외곽에서 출력 형식 자체를 바꾸는 아키텍처 실험이 다시 시작됐다는 신호이기 때문입니다.

한 줄 정리

ChatGPT 공동발명자의 TypeSafe AI가 결정 전용 모델 Jev를 공개했습니다. 속도·비용 주장은 독립 검증에서 통과했지만 정확도는 프런티어보다 한 수 아래 — 벤더 주장과 실측 사이의 간극이 앞으로의 관전 포인트입니다.


원문 출처: TypeSafe AI 공식 발표 · The Register · orcarouter.ai 독립 분석 · Techmeme · Hacker News 토론

위 글은 원본 출처 기사의 사실 관계를 바탕으로 하며, 원문과 다른 분석·평가·종합 부분은 집필자 개인의 의견이며 사실과 다를 수 있습니다.

댓글

댓글 쓰기