DeepSeek V4 충격|GPT 가격의 20분의 1로 성능은 동급
機械翻訳 / Machine-translated

機械翻訳 / Machine-translated
@aifriends
AI Friends(https://aifriends.jp)のクロスポスト公式アカウント。AIツールの紹介・使い方・できることを、中学生でもわかるやさしい日本語で届けます。
『중국 AI가 또다시 세계의 가격표를 다시 썼다』——2026년 4월 24일, DeepSeek(딥시크)이 V4를 발표했습니다.
1년 전 V3 충격을 기억하시나요? 그 중국발 초저가 AI가, 이번엔 1.6조 파라미터·100만 토큰 컨텍스트라는 몬스터급 스펙으로 돌아왔습니다.
게다가 미국산 NVIDIA에 의존하지 않고, Huawei Ascend(화웨이 어센드)칩만으로 구동되는 자립 구성입니다.
『GPT-5.5 Pro보다 98% 저렴한데 성능은 동급? 정말로?』라는 의문을, 최신 벤치마크·가격표·한국에 대한 영향까지 포함해 누구나 이해할 수 있는 말로 풀어드리겠습니다.
먼저 발표 내용을 5분 만에 정리해봅시다.
DeepSeek은 2026년 4월 24일, 공식 사이트와 기술 논문을 통해 차세대 대규모 모델 『V4』의 프리뷰 버전을 공개했습니다. 이전 모델 V3가 세계 AI 업계를 충격에 빠뜨린 것이 2025년 1월이었으므로, 『꼭 1년 만의 새 세대』입니다.
『요리로 비유하면, 작년에 세계를 놀라게 한 젊은 셰프가 후속 메뉴를 당당히 발표한』 것 같은 위치입니다.
논문과 함께 HuggingFace에 가중치(학습 완료 파일)도 업로드되어, 누구나 내용을 들여다볼 수 있는 『MIT 라이선스의 오픈 웨이트(상업적 이용 가능한 공개 AI)』로 제공됐습니다.
4월 24일은 CNBC, Bloomberg, Fortune 등 주요 경제 매체가 일제히 보도한 대형 발표가 되었으며, AI 업계의 화제를 독점했습니다.
V4는 용도별로 2가지 모델이 동시에 제공되는 것이 특징입니다.
『V4-Pro』는 총 파라미터 1.6조(1,600B)·1회 추론에서 49B(490억)를 활성화하는 초대형 모델, 『V4-Flash』는 총 284B·활성 13B의 경량 모델입니다.
『V4-Pro가 풀코스 프렌치 요리, V4-Flash가 빠르고 맛있는 라면』 같은 역할 분담입니다.
두 모델 모두 MoE(Mixture of Experts=전문가들의 집합체)라는, 필요할 때만 일부 두뇌를 깨우는 에너지 절약형 설계를 채택해, 『1.6조의 거대 모델이지만 실제로 동작하는 것은 49B분뿐이므로 전기요금과 속도가 현실적이 된다』는 점이 핵심입니다.
파일 크기는 V4-Pro 865GB, V4-Flash 160GB이며, V4-Pro는 현시점에서 『세계 최대의 오픈 웨이트 모델』이라고도 불립니다.
V4-Pro·V4-Flash는 모두 최대 100만 토큰(한국어로 약 60~80만 자)의 컨텍스트를 지원합니다. 출력도 최대 384K 토큰으로, 방대한 분석 리포트를 한 번에 출력하는 활용이 가능합니다.
『A4 환산으로 300400페이지, 문고본 23권 분량을 통째로 소화하고 답하는』 이미지입니다.
회의 의사록 1년치, 재판 자료, 수백 페이지의 계약서, 사내 Slack 과거 로그 전체, 소스 코드 전체——기존에는 분할해서 읽혀야 했던 소재를 그대로 투입할 수 있는 영역에 들어섭니다.
100만 토큰은 GPT-5.5 Pro급과 어깨를 나란히 하는 업계 최고 수준으로, 거대 자료를 한 번에 처리해 요약·추출하는 용도에서 결정적으로 유리한 위치가 되었습니다.
스펙뿐만 아니라 실제로 얼마나 뛰어난지 숫자로 확인합니다.
프로그래밍 경쟁 사이트 『Codeforces(코드포스)』에서의 레이팅은 V4-Pro가 3206, GPT-5.4가 3168, Gemini-3.1-Pro가 3052입니다.
『세계 최고 수준의 프로그래머들의 도장에서, 중국산 신인이 미국 대표를 앞선』 스코어입니다.
LiveCodeBench(실제 프로그래밍 과제)에서도 V4-Pro가 93.5, Gemini가 91.7, Claude가 88.8입니다.
SWE-Verified(실무 소프트웨어 수정 태스크)에서도 80.6으로 Claude(80.8)와 동급입니다.
『코딩 분야에서는, 이제 중국산=조금 부족하다는 통념이 완전히 무너졌다』고 봐도 무방한 결과입니다.
수학 올림피아드급 난문을 모은 『IMOAnswerBench』에서 V4-Pro는 89.8점입니다. Claude Opus 4.6가 75.3, Gemini-3.1-Pro가 81.0, GPT-5.4가 91.4인 가운데, 『Claude·Gemini를 크게 앞지르고, GPT에 조금 못 미치는 2위』라는 높은 수준입니다.
『쉽게 말하면, 최상위권 대학 이공계 합격 라인의 수학을 안정적으로 풀 수 있는 AI가, 그것도 초저가로 등장했다』는 임팩트입니다. 종합 지식 테스트 『MMLU-Pro』에서는 87.5로 GPT-5.4와 동점이며, Gemini(91.0)·Claude(89.1)에는 약간 뒤지지만, 실용적인 지능 면에서는 이미 차이가 극단적으로 줄어든 단계에 접어들었다고 할 수 있습니다.
한편, 사실의 정확성을 측정하는 『SimpleQA-Verified』에서는 V4-Pro가 57.9%, Gemini가 75.6%입니다.
『지식량으로 보면, Google이 보유한 방대한 검색 데이터를 뒷받침으로 하는 Gemini에 뚜렷한 차이를 보이고 있는』 상황입니다.
『매우 우수하지만, 때로 자신만만하게 거짓말을 하는 수재』가 현시점에서 V4의 솔직한 모습입니다. 사실 확인이 중요한 의료·법무·금융의 최종 판단에는, 인간 리뷰나 외부 검색과의 병용이 불가결하다는 전제는 다른 생성 AI와 마찬가지로 적용됩니다.
『저렴한 만큼, 절감된 예산으로 검토 체계를 구축해야 한다』는 활용 방식이 현실적입니다.
V4의 진짜 폭탄은 스펙이 아니라 가격표입니다.
V4-Pro의 API 가격은 100만 토큰당 입력 1.74달러(약 2,300원)·출력 3.48달러(약 4,600원)입니다.
비교 대상인 GPT-5.5 Pro는 입력 30달러·출력 180달러이므로, 『출력에서 약 52분의 1, 입력에서 약 17분의 1』입니다.
Claude Opus 4.7과 비교해도 약 20분의 1이라고 합니다.
『카페 라테 한 잔 값으로, 원래라면 한 달치 AI 이용료를 충당할 수 있는』 것 같은 파격입니다.
『고급 쇠고기와 같은 품질의 고기가, 업무용 마트에서 5% 가격에 팔리고 있는』 것 같은 충격입니다. 개발자·기업에게 있어, 지금까지 API 비용이 두려워서 시도하지 못했던 용도가 한꺼번에 열리는 가격 설정입니다.
경량 버전 V4-Flash는 입력 0.14달러(약 200원)·출력 0.28달러(약 410원)입니다. 또한 『캐시 히트 시에는 입력이 0.028달러(약 41원)』까지 내려가는 설계로, 『같은 프롬프트를 반복하면 사실상 거의 무료』가 됩니다.
『사내 챗봇, EC의 문의 자동 응답, 사내 문서 Q&A 등 대량으로 처리하는 용도를 현실적인 비용으로 구성할 수 있는』 수준입니다.
『수도요금으로 움직이는 AI』라고 해도 과언이 아닌 수준입니다. 2025년에는 API 가격이 한 자릿수 높았던 용도가, V4-Flash로 한 번에 흑자로 전환되는 기업도 늘어날 것으로 예상됩니다.
DeepSeek 공식 논문에 따르면, V4-Pro는 이전 세대 V3.2 대비 『1토큰당 계산량(FLOPs)이 27%, KV 캐시 사용량이 10%』까지 억제되었다고 합니다.
『같은 공부량에서도, 교과서를 10분의 1의 메모로 해결하고, 계산도 4분의 1로 끝내는 천재 학생』과 같은 효율성입니다.
모델을 크게 만들면서 구동 비용은 줄인다는 모순된 목표를, 아키텍처 개선으로 실현하고 있습니다.
『저렴한 이유는 가격을 싸게 판 것이 아니라, 애초에 운영 비용이 낮기 때문』이라는 점이, 2025년의 DeepSeek V3 시대와 마찬가지로 업계의 주목을 받고 있습니다.
V4의 또 다른 충격은 칩에 있습니다.
V4는 『Huawei Ascend(화웨이 어센드)NPU』만으로 추론·훈련이 가능한 설계입니다. Huawei 자체가 4월 24일에 『최신 Ascend AI 연산 클러스터에서 DeepSeek V4가 지원된다』고 발표하며, 『NVIDIA의 H100이나 Blackwell 없이, 프런티어급 AI를 구동할 수 있었다』는 것을 공식적으로 보여줬습니다.
『미국이 수출 규제를 가하고 있는 최첨단 GPU를 사용하지 않고, 세계 최고 수준의 AI를 중국 내에서 완전히 운용할 수 있는』 실적이 생겼다는 점에서, 미중 하이테크 경쟁에서 가장 큰 분기점이 되었다고 평가받고 있습니다.
중국의 주요 테크 대기업 Alibaba·ByteDance·Tencent는 V4 공개를 내다보고 Huawei 칩을 대량 주문했다고 복수의 영어 매체가 보도했습니다.
『미국의 NVIDIA 의존에서, 중국은 마침내 자급자족의 AI 경제권을 형성하려 하고 있다』는 움직임이 가시적인 형태로 가속화되었습니다.
『집의 쌀을 다른 나라에서 수입하던 시대를 벗어나, 모두 자국 논에서 재배하려는 국산 전환』의 이미지입니다. 미국 측에서는 "Blackwell 칩을 제3국을 경유해 밀수입해 훈련한 것이 아니냐?"는 의혹도 보도되고 있어, 기술적 자립의 진위는 계속해서 논점이 되고 있습니다.
DeepSeek과 Huawei는 『V4는 Ascend NPU와 NVIDIA GPU에서 동등한 성능을 발휘했다』고 공동 발표했습니다.
『중국산 칩은 몇 세대 뒤처져 있다』는 기존 업계의 인식에, 공식적인 반증이 제시된 셈입니다.
『프로 야구에서 무명이었던 젊은 투수가, 메이저리그 선발투수와 동등한 구속을 기록한』 것 같은 임팩트입니다. 이 주장이 제3자 검증에서도 뒷받침된다면, 미국의 AI 칩 수출 규제의 전략적 효과에 근본적인 의문부호가 붙게 되어, 세계의 공급망·지정학에 수년 단위로 영향을 미치는 발표가 될 것입니다.
V4는 누구에게 이기고, 누구에게 지는지 정리합니다.
GPT-5.5 Pro는 OpenAI의 최신 플래그십으로, 지식량·대화 품질·멀티모달 대응에서 세계 최고 수준입니다. V4-Pro는 가격으로 압도(98% 할인)·코딩에서 승리·수학에서 거의 동급·범용 지식에서 약간 뒤처지는 구도입니다.
『GPT는 만능 가정교사, V4는 특정 과목이 강한 초저가 학원』으로 기억하면 이해하기 쉬울 것입니다. 사내 개발이나 API 대량 이용에서는 V4로 충당하고, 일반 대화 채팅은 GPT를 사용하는 방식이 현실적인 해결책입니다.
한 회사에서 한 달에 수백만 원~수천만 원의 API 비용을 지불하는 기업일수록, V4 도입의 경제적 임팩트가 큰 계산이 됩니다.
Claude Opus 4.7은 코딩과 에이전트(자율 AI 작업자)에서 정평이 난 Anthropic의 최신 모델입니다. V4-Pro는 Codeforces·LiveCodeBench에서 앞서고, 가격은 약 20분의 1이라는 충격입니다.
『코드를 작성하는 것뿐이라면, V4가 명확히 합리적』이라는 판단이 성립됩니다. 한편, Claude는 긴 지시를 정확하게 따르는 능력이나 윤리적 배려에서 여전히 강하며, 에이전트 용도에서는 우위입니다.
『실수가 허용되지 않는 업무용 에이전트는 Claude, 대량 생성이나 프로토타입은 V4』의 조합이 2026년 하반기의 주류가 될 가능성이 있습니다.
Google Gemini 3.1 Pro는 검색 연동 & 멀티모달에서 압도적으로, SimpleQA-Verified에서 75.6%로 V4-Pro(57.9%)를 크게 앞섭니다.
『세계의 정보를 실시간으로 파악하는 걸어다니는 백과사전으로서는 Gemini가 독보적』입니다. 코드 생성이나 추론에서는 V4-Pro가 이기고, 최신 정보의 정확성에서는 Gemini가 이기는 역할 분담이 됩니다.
『최신 뉴스를 찾아오길 원한다면 Gemini, 대량의 코드를 작성하길 원한다면 V4, 종합 대화는 GPT, 업무 에이전트는 Claude』라는 4장 카드의 구도가 2026년 AI 업계의 표준이 될 것 같습니다.
V4는 어떤 영향을 가져올까요?
SaaS 기업이나 사내 AI 활용 부서에게 있어, V4의 가격 파괴는 AI 비용에 관한 의사결정을 근본적으로 바꾸는 재료가 됩니다.
『월간 100만 원의 OpenAI 비용을, V4로 그대로 충당하면 월 5만 원 전후가 된다』는 계산도 성립되는 수준입니다.
『고급 임대아파트에서, 같은 위치의 공공 임대주택으로 이사하여 임대료가 20분의 1이 되는』 것 같은 임팩트입니다. AI를 본격 도입하는 기업들은 용도별로 모델을 구분해 사용하는 멀티모델 전략을 2026년 하반기에 가속화할 가능성이 높은 상황입니다.
GPT/Claude가 제1선택지에서, 비용 중시라면 V4의 비교 평가가 당연한 시대에 접어들었습니다.
한편, 공공기관·금융·의료 등 기밀성이 높은 업계에서는 중국산 AI의 직접 이용에 신중한 자세가 남아있습니다.
『DeepSeek의 공식 서비스는 데이터가 중국 내 서버를 통할 가능성이 있어, 개인정보 보호 관점에서 민감한 용도에는 적합하지 않다』는 견해가 일반적입니다. 다만 오픈 웨이트(모델 자체가 MIT 라이선스로 공개)이므로, 자체 서버나 클라우드에서 독자적으로 V4를 구동하는 것이 기술적으로 가능합니다.
『자동차 설계도가 공개되어 있으므로, 자신의 공장에서 조립해 자사 번호판으로 운행하는』 이미지입니다. 기업 도입에서는 공식 API vs 자체 호스팅의 선택이 핵심이 됩니다.
개인 개발자·프리랜서에게 있어, V4-Flash는 마음껏 활용할 수 있는 AI로서 매우 매력적입니다.
『월 5~10달러의 예산으로, GitHub Copilot 대신, 번역 봇, 블로그 초안, 데이터 정형 등 일상 도구를 통째로 만들 수 있는』 비용 감각입니다. 한국어 성능은 V3 시대부터 지속적으로 개선되어, ChatGPT에 근접한 수준에 도달했습니다.
『해외 쇼핑몰에서 국내 미출시 유용한 제품을, 환율에도 불구하고 손에 닿는 가격으로 살 수 있는』 것 같은 감각입니다. 부업·개인 사업·블로그 운영·학습 보조 등에 V4를 활용함으로써, 월 도구 비용이 몇만 원으로 해결되는 세계가 현실이 됩니다.
의류 EC를 운영하는 김 씨는 직원 4명의 회사를 꾸려가고 있습니다.
『GPT-4로 문의 봇을 만들었지만, 월 12만 원의 비용이 부담스러워 동결해두었던』 상태였습니다. 2026년 5월, V4-Flash로 전환한 결과, 같은 품질의 봇이 월 약 5,000원으로 작동하게 되었다고 합니다.
『Slack에 AI 어시스턴트를 상주시켜, 재고 확인·반품 규정·배송 일정을 24시간 응답해주는 신입사원이 늘어난 느낌』입니다.
『AI는 억지로 대기업 흉내를 내는 것이 아니라, 자신의 규모에 맞는 요금의 것을 선택하는 시대』라고 실감했다고 합니다.
정보공학 대학원 2년생 이 씨는,
『석사 논문을 위해 영어 논문 200편을 읽어야 마감에 맞출 수 있는』 상황이었습니다. V4-Pro의 100만 토큰 컨텍스트를 활용해, 논문 10편을 한 번에 PDF로 투입→요점 추출→비교표를 자동 생성했습니다.
『지도교수와의 논의가, AI 요약을 전제로 한 토론용 회의로 바뀌었다』고 변화를 실감했습니다. 월 API 비용은 약 800원 정도로 해결되었다고 합니다.
『석사생이 박사생 수준의 문헌량을 다룰 수 있는 시대』에, 『연구의 출발점 자체가 높아졌다』고 말합니다.
중견 도시의 DX 추진 부서에 소속된 박 씨는,
『지난 20년간 개정된 조례를 모두 재검토하여, 모순을 찾아내는』 무리한 과제를 안고 있었습니다. AWS로 자체 구축한 V4-Pro에 조례 전문(약 300만 자)을 분할 투입하여, 모순 후보와 법령 정합성을 추출했습니다.
『종이 조례집을 직원 10명이 6개월에 걸쳐 검토하던 작업이, 2주 만에 목처가 잡혔다』는 성과입니다.
중국산 AI를 직접 서비스로 이용하는 것은 금지이지만, 모델 자체는 자체 서버에서 구동할 수 있다는 오픈 웨이트의 장점을 기관이 활용한 좋은 사례가 되었습니다.
A. DeepSeek의 공식 웹 채팅(chat.deepseek.com)은 일상적인 이용이라면 무료로 사용할 수 있습니다. API를 통한 개발 이용은 유료이지만, V4-Flash는 100만 토큰 0.14달러(약 200원)로 극단적으로 저렴한 수준입니다.
『개인이 월 커피 한 잔 값으로 본격적으로 마음껏 사용할 수 있는』 가격대입니다. 비즈니스 용도로 대량 처리하는 경우에도, V4-Pro로도 타사의 20분의 1 이하 비용으로 해결되는 경우가 대부분입니다.
A. DeepSeek의 공식 서비스(웹 버전·API)를 이용한 경우, 데이터가 중국 서버를 경유할 가능성이 있습니다.
『기밀정보·개인정보는 공식 서비스에 입력하지 않는』 것이 기본입니다. 다만 V4는 MIT 라이선스로 모델 가중치가 공개되어 있으므로, AWS·Azure·국내 클라우드 등에 직접 배포하면 데이터를 중국으로 보내지 않고 사용할 수 있습니다.
『엔진은 구매해서, 자사 차체에 탑재하는』 방식으로 사용할 수 있는 것이, 오픈 웨이트의 최대 장점입니다.
A. V3 시대에 비해 한국어의 자연스러움은 크게 향상되어, 일상 대화·블로그 기사·비즈니스 이메일·간단한 코드 코멘트라면 어색함이 적은 수준입니다. 다만 경어의 세밀한 뉘앙스나 법률·의료 등 전문 분야의 한국 고유 표현에서는, GPT-5.5 Pro나 Claude Opus 4.7에 한발 뒤처지는 경우가 있습니다.
『외국인 유학생이 한국어능력시험 최고급을 취득한 상태』에 가깝고, 『일상 업무는 충분하지만, 최종 독자를 위한 글은 한국인이 손을 보는』 활용 방식이 현실적입니다.
A. 『정확도 중시·복잡한 추론·장문 이해=V4-Pro』 『대량·고속·비용 중시=V4-Flash』가 기본 방침입니다. 예를 들어 사내 챗봇은 99%의 질문이 Flash로 충분하고, 어려운 상담만 Pro로 에스컬레이션하는 2단계 방식이 현실적입니다.
『평소에는 경차로 출퇴근하고, 먼 거리만 대형 SUV를 빌리는』 것 같은 발상입니다. 많은 기업 도입 사례에서 Flash 90%+Pro 10%의 비율로 운용 비용을 최적화하고 있습니다.
A. 주요 선택지는 『①DeepSeek 공식 API 이용』 『②OpenRouter 등 중계 서비스 경유』 『③AWS·Azure·국내 클라우드에서 자체 호스팅』의 3가지입니다.
①은 가장 간단하고 저렴하지만, 기밀성이 높은 업무에는 적합하지 않습니다.
②는 비용이 약간 높지만 여러 모델을 유연하게 사용할 수 있습니다.
③은 초기 구축 비용이 높지만 정보 보안과 컴플라이언스 면에서 안심할 수 있습니다.
『음식점으로 말하면, 프랜차이즈 계약·대리점 경유·직접 공장에서 사입하는 3가지 선택지』와 같은 구도입니다. 자사의 정보 분류에 따라 단계적으로 ③으로 이행하는 기업이 늘어날 전망입니다.
『초저가 중국 AI가 또 나타났다』는 말로 넘길 수 있는 수준의 발표가 아닙니다.
1.6조 파라미터의 초대형 모델이 GPT의 20분의 1 가격으로 작동하고, 코딩에서는 미국 최고 수준을 앞서며, 100만 토큰의 장문에 대응하고, 게다가 Huawei Ascend만으로 구동된다——이것은 가격×성능×지정학이 동시에 무너지는 구조적 변화입니다.
2025년 1월의 DeepSeek V3가 『저비용 AI의 충격』을 남겼다면, 2026년 4월의 V4는 『중국 AI가 프런티어에 나란히 서고, 미국의 칩 패권까지 흔들기 시작한 순간』입니다.
기업에게 있어서는 AI 비용이 20분의 1이 되는 선택지가 드디어 현실화되었다는 메시지이며, 개인 사용자에게 있어서는 월 몇 달러로 본격 AI를 자유롭게 사용할 수 있는 시대가 실용 수준에 도달한 순간이기도 합니다.
우선 V4-Flash를 하나의 프로젝트에 사용해보는 것——그것만으로도, 6개월 후의 개발 속도가 달라질 가능성이 높은 발표입니다.
이 글은 AI Friends 의 크로스포스트입니다.