--- title: 생성은 Claude에게, 판단은 Jev에게, 서브 모델로 쓰는 MCP 연동 시너지와 가격 정리 date: 2026-09-23 time: 18:45 model: deepseek-v4-flash category: knowhow summary: 생성형 LLM이 코드를 짜면 비생성형 판단 모델 Jev가 예와 아니오로 검증하는 분업 구조를 정리했다. Jev의 비즈니스 모델과 가격, MCP 연동 4가지 경로, 현장 감독관과 조건문 컨트롤러와 팩트 체커라는 3대 시너지를 다룬다. tags: Jev, TypeSafe, System-One, MCP, Claude-Code, 판단모델, 라우터, 가격 --- ## 결론부터 코딩은 Claude Code가 하고 판단은 Jev가 한다. 그동안 우리는 Claude나 GPT 하나에게 글도 쓰고 코드도 짜고 맞는지 검증까지 하라고 독박을 씌웠다. 그러니 AI가 틀린 줄도 모르고 당당하게 거짓말을 했다. Jev를 MCP로 서브 모델로 붙이면 생성이 끝나는 지점에서 판단이 개입한다. 생성이냐 판단이냐의 분업이 이 글의 핵심이다. ## 1. Jev란 무엇인가 Jev는 TypeSafe AI가 2026년 9월 15일에 공개한 첫 번째 System One 모델이다. 창업자는 OpenAI에서 RLHF와 InstructGPT에 참여한 Diogo Almeida로 알려져 있으며, DCVC 주도로 약 40M 달러를 유치했다는 보도가 있다. | 항목 | 내용 | |------|------| | 개발사 | TypeSafe AI | | 모델명 | Jev (첫 System One 모델) | | 공개일 | 2026년 9월 15일 (매니지드 API) | | 성격 | 비생성형 판단 모델 | | 출력 | 문장이 아니라 선택, 점수, 예와 아니오 확률 | | 속도 | 70~500ms | | 엔드포인트 | POST /v1/systemone (model 필드로 모델 선택) | 일반 LLM이 토큰을 하나씩 생성하며 수다를 떠는 구조라면, Jev는 프로그램 상태를 typed 질문군에 대조해 질문마다 구조화된 답을 병렬로 반환한다. 텍스트 생성이 없으니 환각성 서술이 끼어들 자리가 없다. ## 2. Jev 비즈니스 모델 Jev의 비즈니스 모델은 판단 API 판매다. 모델 가중치를 파는 것이 아니라 매니지드 API 호출당 과금하는 구조다. | 항목 | 내용 | |------|------| | 판매 방식 | 클로즈드 매니지드 API | | 과금 단위 | 입력 토큰 기준, 출력 토큰 무료 | | 가격 | 입력 100만 토큰당 $0.042 | | 결정 1회당 | 약 $0.0004 수준으로 소개됨 | | 체험 | 브라우저에서 무료 체험과 무료 크레딧 제공 경로 있음 | 출력 토큰이 무료라는 점이 포인트다. Jev는 긴 문장을 생성하지 않고 판단값만 반환하니 출력 과금이 없다는 설명과 정합적이다. 가격은 변동될 수 있으니 공식 pricing 페이지를 확인해야 한다. ### 체감 비용 시나리오 | 작업 | 비용 감각 | |------|-----------| | 판단 1,000회 | 약 $0.02 수준으로 소개된 측정치 있음 (jev-use 기준) | | 문서 1,000개 스코어링과 분류 | 약 $0.04, 2분 미만이라는 실증 수치 인용됨 | | 1,000회 호출을 Claude급 생성 모델에 맡길 때 | 건당 수 달러에서 수십 달러까지 나올 수 있음 | 서브 판단용으로 붙이는 순간 본진 생성 모델의 불필요한 재시도와 장황한 추론을 줄이는 것이 진짜 절감 경로다. Jev 자체가 싼 것을 넘어 생성 모델의 헛손질을 줄여준다. ## 3. MCP 연동 4가지 경로 Jev는 OpenAI나 Anthropic 형태의 엔드포인트가 아니라 Claude Code나 Codex의 뒤에 직접 모델로 들어갈 수 없다. 대신 아래 경로가 동작한다. | 경로 | 설명 | |------|------| | 공식 TypeSafe 에이전트 스킬 | 에이전트에 판단 역할을 부여하는 공식 경로 | | 바운더리 플러그인 | 작업 경계에서 개입시키는 방식 | | MCP 도구 | 판단용 도구를 MCP 서버로 등록해 호출 | | 턴별 라우팅 | 매 턴마다 Jev가 최적 모델과 추론 강도를 고름 | ### 커뮤니티 구현체 | 구현체 | 설명 | |--------|------| | jev-model-router | Claude Code와 데스크톱 앱과 Codex용 플러그인. 약 1초 만에 최적 모델과 추론 강도를 고르고 OpenRouter 실시간 가격을 반영한다는 설명이다 | | jev-use (npm, 0.7.1) | 텍스트 출력이 필요 없는 단계를 Jev에 넘기는 플러그인. p50 약 230ms, 판단 1,000회당 약 $0.02로 소개됨 | ## 4. 시너지 1, 루프에 갇힌 코딩 AI를 감시하는 현장 감독관 시너지 작동 방식은 단순하다. Claude Code가 작업을 수행하는 동안 MCP 통로로 연결된 Jev가 옆에서 실시간 로그와 테스트 결과를 관찰한다. Jev는 생성형 LLM처럼 수다를 떨지 않고 딱 한 가지만 판단한다. 완료와 진행 중과 루프에 갇혀 막힘이다. 에이전트가 같은 파일을 세 번 이상 고치고도 테스트가 그대로 실패하면 Jev가 막힘 판정을 뱉는다. 그러면 본진 에이전트는 전략을 바꾸거나 인간에게 에스컬레이션한다. 무한 루프로 API를 태우는 구조를 판단 모델이 끊어주는 것이다. ## 5. 시너지 2, 텍스트 오염 없는 조건문 컨트롤러 Claude Code가 코딩 도중 다음 단계로 넘어가도 될지 의문이 생기면 MCP로 등록된 Jev 도구를 호출한다. Jev는 인간이 정해놓은 명확한 기준에 기초해 오직 예 또는 아니오의 확률값만 반환한다. 긴 설명이 없으니 파싱 에러가 나지 않는다. 에이전트 루프에 if문을 하드코딩하는 것과 같다. 통과 기준을 코드로 박아두면 Jev가 매번 같은 잣대로 재는 것이다. 기획서 조건과 테스트 통과 여부 같은 기계적 게이트에 잘 맞는다. ## 6. 시너지 3, 휴먼 에러를 잡는 실시간 팩트 체커 Jev는 원본 기획서와 Claude가 짠 코드의 주석을 대조해 일치와 왜곡과 과장을 점수화한다. 예를 들어 0.98 같은 확률값이다. 생성 모델은 자기 결과물을 스스로 검증할 때 관대해진다. Jev는 생성하지 않으니 자기합리화가 없다. 출처와 주장의 대조라는 단일 임무만 수행한다. ## 7. 맥 터미널용 MCP 등록 코드 예시 Claude Code 설정 파일에 MCP 서버를 등록하는 예시다. 실제 서버 명령어와 API 키는 각자 환경에 맞게 바꿔야 한다. ```json { "mcpServers": { "jev": { "command": "npx", "args": ["-y", "jev-use"], "env": { "JEV_API_KEY": "sk-xxxx" } } } } ``` 라우터 플러그인 방식을 쓰면 아래 흐름이 된다. ```bash # 플러그인 설치 후 (저장소 README 기준) # Claude Code 플러그인 디렉토리에 jev-model-router 추가 # 매 세션 시작 시 Jev가 모델과 추론 강도를 자동 선택 ``` 권한 설정은 자동 허용으로 두면 에이전트가 판단 도구를 매번 묻지 않고 처리한다. 다만 결제와 삭제 같은 위험 작업은 반드시 인간 승인으로 남겨야 한다. ## 8. 감시관으로 붙이기 위한 판단 기준 설계 가이드 Jev를 붙이기 전에 기준(Rule)을 먼저 설계해야 한다. 기준이 없으면 판단도 없다. | 단계 | 내용 | 예시 | |------|------|------| | 게이트 정의 | 다음 단계로 가기 위한 통과 조건 | 테스트 전부 통과, 린트 에러 0개 | | 막힘 정의 | 루프 판정 기준 | 동일 실패 3회 반복, 동일 파일 3회 수정 후도 실패 | | 왜곡 정의 | 팩트 체크 기준 | 기획서 수치와 코드 상수 불일치, 주석 주장과 구현 불일치 | | 에스컬레이션 | 인간 호출 조건 | 막힘 판정 2회 연속, 보안 관련 파일 변경 | 판단 질문은 typed로 고정한다. 자유 서술형으로 묻지 않는다. ``` - 작업 상태는 완료, 진행 중, 막힘 중 셋 중 무엇인가 - 다음 단계 진행 가능 여부는 예 또는 아니오인가 - 기획서와 구현의 일치도는 0부터 1 사이 확률로 얼마인가 ``` 이렇게 고정해야 Jev의 출력이 매번 같은 스키마로 돌아오고 에이전트가 파싱할 수 있다. ## 9. 한 줄 결론 생성은 Claude가 하고 판단은 Jev가 한다. 이 분업이 정착되면 1인 개발자나 소규모 스타트업도 대기업 개발팀 부럽지 않은 크로스 체크 자동화 시스템을 소유하게 된다. 오픈소스와 표준 프로토콜인 MCP가 만들어낸 개발 자동화의 다음 단계다.