
올해 '618'이 대규모 AI 모델로 시작될 것이라고는 전혀 예상하지 못했습니다.
불과 며칠 만에 텐센트, 알리바바, 바이두, 아이플라이텍 등 국내 대형 모델들이 모두 가격을 인하해 소박한 '쇼핑 페스티벌' 분위기를 미리 느낄 수 있게 됐다.

▲ 현재 국내 대형모델 가격인하 개요
하지만 재미를 시작하기 전에 먼저 이러한 제조업체가 대형 모델의 가격을 무엇을 의미하는지 알아보겠습니다.
일반적으로 대형 AI 모델 회사는 자체 비공개 소스 대형 모델을 훈련시킨 뒤 자사 API(애플리케이션 프로그래밍 인터페이스, 애플리케이션 프로그래밍 인터페이스)를 개발자에게 판매하고 수수료를 부과한다.

▲ PI는 호텔의 웨이터 같다. 사진=hububbble.com
대형 모델 API를 기반으로 개발자는 데이터 공급, 미세 조정 등을 통해 최적화합니다. 이는 많은 대형 모델 제조업체의 수익 창출 모델입니다.
대형 모델의 가격 변동이 소비자에게 직접적인 영향을 미치지는 않지만 애플리케이션을 만드는 개발자의 비용에 직접적인 영향을 미칠 것이라는 점은 어렵지 않게 볼 수 있습니다.
현재 회원제, 시간제 등의 모델을 도입하는 대형 AI 모델 기업이 있지만, 일반적으로 트래픽 GB에서 토큰으로 청구 단위가 변경된 점을 제외하면 휴대폰 데이터 패키지와 유사하게 사용량에 따라 청구됩니다. .
그러나 현재 토큰, 한자, 문자 간의 대응에 대한 통일된 표준은 없으며, 각 회사마다 고유한 정의가 있습니다. 이전 뉴스에 따르면 Tencent 토큰 1개 ≒ 1.8 한자, Tongyi Qianwen 토큰 1개 = 한자 1개, 일부 토큰 1 토큰 ≒ 0.5 한자.

▲ 빙젠기술연구소 사진
따라서 회사마다 과금 기준이 다르지만 일반적으로 대형 모델의 규모가 클수록 가격이 비싸다는 규칙을 따릅니다.
현 단계에서도 주요 제조사들은 API 호출을 판매하는 비즈니스 모델을 모색하고 있으며, 많은 제조사들이 다양한 방법을 통해 대형 모델의 API 호출을 늘리려고 노력하고 있지만 성장세는 뚜렷하지 않습니다.
이 경우 대형 모델 API의 가격 인하는 일부 개발자가 "무료 평가판"부터 AI 응용 프로그램을 시도하도록 유도할 수 있으며 이는 시장을 장악하고 활성화하는 데 긍정적인 의미가 있습니다. 이것이 이 "전쟁"의 전제이자 배경입니다.
준비하라, 항복하라!
5월 6일, Magic Square Quantitative는 이러한 가격 인하 "전쟁"의 첫 번째 샷을 시작했습니다. 대형 모델 DeepSeek-V2의 가격은 입력 토큰 백만 개당 1위안으로 떨어졌습니다. 로그인하고 500W를 받으세요."토큰" 슬로건.

5월 11일, Zhipu Big Model도 "속도를 따라가고" 새로운 우대 조치를 시작했습니다. 신규 등록 사용자에 대한 할당량이 500만 토큰에서 2,500만 토큰으로 늘어났습니다.
보급형 제품 GLM-3-turbo의 가격은 백만 토큰당 5위안에서 1위안으로 80% 하락했습니다.
가격을 발표하면서 그는 또한 자신의 GLM-3 터보를 화약으로 가득 찬 Alibaba, Baidu 및 ChatGPT와 "친밀하게" 비교했습니다.

그 후, 클라우드 공급업체의 진입으로 이러한 가격 인하 '전쟁'의 물결이 정점에 이르렀습니다.
5월 15일, ByteDouBao는 "대형 모델의 가격이 인하되었습니다!"라고 발표했습니다. Volcano Engine의 Tan Dai 사장은 Baidu, Ali 및 모델을 비교하여 기업 시장에서 DouBao의 주요 모델 가격이 0.0008/천 토큰이라고 발표했습니다. 시장에 나와 있는 것과 동일한 사양으로 가격은 일반적으로 0.12/천 토큰이며, "센트에서 센트로" 가격 변화를 달성합니다.
그는 또한 예를 들어 "1위안은 두바오의 주요 모델 토큰 125만개를 구입할 수 있다"고 말했다. 한자는 약 200만자인데 이는 '삼국지연의' 3개를 생성하는 것과 맞먹는다.

5월 21일, ByteDance의 가격 전쟁에 맞서 Alibaba Cloud 담당자는 다음과 같이 반격했습니다.
"우호적인 대형 모델사에서는 다양한 가격 인하 테마를 제시하고 있습니다. 가격 인하의 목적은 시장에 이익을 주기 위한 것입니다. 중국에서는 실제로 어느 회사가 가격을 인하할 수 있는 능력과 자본을 갖고 있는지는 모델 베이스 모델 역량이 주도하는지, 추론 자원이 있고, 현재 모델이 맞는지 이미 많은 사용자가 사용하고 있고, 대형 모델은 핵심 사업이 아닙니다.”
이와 동시에 알리바바 클라우드도 '세계 최저 가격 돌파'라는 슬로건을 내세워 자사 대형 모델 9종의 가격을 일괄 인하했다. 'GPT-4급' 보조 모델 Qwen-Long의 가격도 인하됐다. 100만개 토큰당 0.5위안 입출력 2위안.
즉, 1위안으로 200만개의 토큰을 살 수 있는데, 이는 '신화사전' 5권의 문자량에 해당하지만 가격은 GPT-4의 1/400 정도에 불과합니다.

불과 몇 시간 후, 항상 비교 대상이 되는 또 다른 회사인 Baidu도 조치를 취했습니다. Wenxin Models의 두 가지 주요 모델인 ERNIE Speed와 ERNIE Lite는 직접적이고 완전 무료였습니다.
이 두 모델은 대형 모델 중 주력 모델은 아니지만 현재 Baidu Wenxin의 대형 모델 시리즈에서 가장 많은 사용자에게 서비스를 제공하는 모델입니다.

5월 22일, iFlytek은 "가격 인하 경쟁"에 참여할 것이라고 발표했습니다. iFlytek Spark Lite API는 영구적으로 무료로 공개되며 iFlytek Spark Pro/Max의 가격은 토큰 10,000개당 0.21위안이라고 합니다. “iFlytek Spark 3.5 max를 사용하면 단 2.1위안의 비용으로 Yu Hua의 "Alive" 콘텐츠를 생성할 수 있습니다.

같은 날, Tencent Cloud는 대형 모델 가격 인하 진영에 합류했다고 발표했습니다. Hunyuan 라이트 모델 API 가격은 새로 출시된 Hunyuan 표준 및 최고 구성 1조 매개변수 모델 Hunyuan에서 완전히 무료입니다. -pro API는 모두 무료이며 가격 인하가 즉시 적용됩니다.

이 시점에서 거의 모든 대형 모델 제조업체가 게임에 뛰어 들었습니다. 하룻밤 사이에 대형 모델이 집단적으로 미친 가격 인하를 시작한 것 같습니다.
'가격 전쟁' 뒤에 숨은 기술 혁신
국내 제조사는 물론 오픈AI로 대표되는 해외 대형 모델들도 꾸준히 대형 모델 가격을 인하하고 있다. 국내 제조사만큼 집중적이지는 않지만 국내 제조사보다 먼저 조치를 취하는 모습이다.
2023년 3월 출시된 GPT-3.5 터보는 1,000개 토큰당 비용을 이전 GPT-3.5 터보보다 90% 낮은 US$0.002로 절감합니다.
11월 출시된 GPT-4 Turbo의 입력 토큰 가격은 GPT-4의 1/3에 불과하고, 출력 토큰의 가격은 GPT-4의 1/2입니다.
최근 출시된 GPT-4o는 기존 GPT-4 터보보다 속도는 2배 빠르지만, 가격은 2023년부터 4차례 연속 가격 인하됐다.
OpenAI의 경우 가격 인하가 지속적인 업그레이드와 시장 확대를 위한 핵심 전략이 되었다고 보는 것은 어렵지 않습니다. 제미니 등 다른 대형 모델 역시 성능 이후 가격 변동을 추가하는 것을 잊지 않아 대대적인 가격 인하가 대세로 자리 잡았다.

실제로 국내 대형 모델이든 해외 대형 모델이든 가격 인하의 근본적인 이유는 추론비용의 급격한 절감이다.
얼마 전 DeepSeek-V2는 MLA(Multi-head Latent Attention)와 MoE(Mixture-of-Expertsexperthybridmodel)를 결합하여 모델 성능의 교차 수준 향상을 동시에 달성한다는 논문을 소개했습니다. 계산, 기존 추론 및 비용 사례. 관심 있는 친구는 클릭하여 원본 텍스트를 볼 수 있습니다.
https://github.com/deepseek-ai/DeepSeek-V2/blob/main/deepseek-v2-tech-report.pdf
컴퓨팅 성능이 향상되고 알고리즘이 계속해서 발전함에 따라 이러한 추세는 계속될 것입니다. 최근 인터뷰에서 이개푸 시노베이션 벤처스(Sinovation Ventures) 회장 겸 CEO는 최근 열광적인 가격 인하에 대해 이야기하며 "업계 전체가 매년 추론 비용을 10배씩 절감할 것으로 예상되며 이는 반드시 실현되어야 한다"고 믿었습니다.
그러나 그는 또한 현재 나타나고 있는 것은 지속 불가능한 "ofo 스타일"의 패전적 접근 방식이라고 말하며 "기술이 좋지 않으면 순전히 할인과 손실에만 의존하여 사업을 할 것입니다. 우리는 결코 따르지 않을 것입니다." 가격을 벤치마킹하세요."
이는 “테슬라처럼 다른 브랜드의 차가 자기보다 싸다고 해서 가격을 낮추지는 않을 것”이라는 그의 대형 모델에 대한 자신감 때문이다.
그러나 테슬라가 실제로 가격을 인하하지 않고 때로는 가격 인하의 선구자가 되기도 한다는 사실은 모두가 알고 있는 사실이다. 그의 발언이 앞으로는 '부메랑'이 될지 궁금하다.

▲ 이카이푸 이노베이션웍스 회장, 인터넷 사진
파도가 가까이에 있다
Kaifu Li 외에도 Baichuan Intelligence의 창립자인 Wang Xiaochuan도 이 가격 전쟁에 대해 다른 이해를 가지고 있습니다.
"저는 원래 Didi Meituan과 마찬가지로 전체 B 시장이 더 빠르게 번영하도록 자극할 것이며 모두가 더 기꺼이 시도할 의향이 있을 것이라고 생각합니다."
그는 가격 전쟁이 실제로 자신의 포지셔닝을 재고하고 "분명하게 생각하지 않은" 일부 회사를 제거하기 위해 뒤처지는 것을 두려워하여 맹목적으로 대형 모델 산업에 뛰어든 제조업체를 상기시킬 것이라고 믿습니다.
"조수가 오르고 빠지면 결국 진주가 있을 것이다. 내부에 거품이 있어야 한다. 가격 전쟁이 거품을 더욱 번창하게 할 것이다. 그렇다고 지금 상황에 거품이 없다는 뜻은 아니다. 이전 거품에서는, 많은 기업들이 모델을 훈련시켜야 한다고 느꼈는데, 이는 시장에 그렇게 많은 모델 제공자가 필요하지 않으며, 수천 모델의 전쟁이나 만 모델의 전쟁도 필요하지 않습니다.”

▲ 왕샤오촨(Wang Xiaochuan) 바이촨 인텔리전스 CEO
Cheetah Mobile의 회장 겸 CEO인 Fu Sheng은 대형 모델의 균질화로 인해 성능 격차를 없애기가 어려워진 상황에서 이것이 무기력한 조치라고 믿습니다.
"이번 큰 가격 인하는 기본적으로 대형 모델 스타트업이 새로운 비즈니스 모델을 찾아야 함을 알린 것입니다. 단기적으로 대형 모델의 성능에 병목 현상이 발생했습니다. 누구도 없앨 수 없고, 누구도 비장의 카드를 내놓을 수 없습니다. 추론 비용을 줄이고 판매 가격을 줄이는 것이 이제 모든 회사의 최우선 과제가 되었습니다.”
주요 제조사들이 가격을 인하했다는 것은 의심할 여지가 없으며, 이는 대형 모델 업계의 많은 스타트업들에게 더 큰 경쟁 압력을 의미합니다.
실제로 업계가 종합적인 가격 인하 단계에 진입한다는 것은 대규모 도태 경쟁의 시작을 의미하며, 결국 소수의 업체만 남는 경우가 많다.
우리는 산업 발전의 초기 단계에서 "창문"에 대한 엄청난 유혹으로 인해 시장에서 다양한 좋은 회사와 나쁜 회사가 종종 서로 경쟁하는 것을 봅니다. 그러나 한 번 또는 몇 차례의 대규모 가격 인하 후에는 산업은 재편되고 효율성은 비효율적이다. 우수한 기업은 시장에서 밀려난다.
현재 AI 분야의 이런 과정은 가속화되고 있는 것으로 보인다. 특히 대형 모델이 시장에서 우위를 점하지 못하는 제조업체의 경우 더욱 그러하다.

하지만 반면에 대형 모델의 가격 인하는 사용자에게는 좋은 소식이다. 고급 AI 기술을 더 저렴한 비용으로 접근하고 사용할 수 있고, 우수한 AI 애플리케이션을 시장에서 생산하기가 더 쉽다는 뜻이기 때문이다.
그러나 현재 산업 전체의 상용화는 아직 생태계 형성에 이르지 못했다. 중국의 대형 모델 기업 외에도 AI 애플리케이션 개발팀에는 여전히 큰 격차가 있다.
Baidu가 공개한 최신 데이터에 따르면 Wenxin의 대형 모델은 하루에 2,500억 개의 텍스트 토큰을 처리하고, ByteDance는 하루에 1,200억 개의 텍스트 토큰을 처리합니다. 그러나 그 중 상당 부분은 AI 애플리케이션을 사용하는 대기업의 내부 비즈니스 및 비즈니스 탐색입니다. 현재 전체 산업은 아직 생태계를 형성하지 못했다고 볼 수 있습니다.
블룸버그 분석가들은 이전에도 "중국은 AI 분야에서 수익성을 향한 갈 길이 멀고, 업계 개편으로 인해 업계 수익성이 향상될 수 있지만 이것이 곧 일어날 것 같지는 않다"고 지적했습니다. 비용 문제는 항상 AI를 제한하는 중요한 요소였습니다. 산업의 발전.
IDC는 중국의 AI 대형 모델 시장이 2026년 211억 달러에 달하고, 인공지능이 대규모 구현을 위한 중요한 시기에 진입할 것으로 예측하고 있습니다.
대형 모델의 가격 하락과 멀티 모달리티의 발전, 추론 속도의 가속화, 비용 절감 등으로 검색, AI PC/휴대폰, 기타 가전제품 등이 폭넓은 공간으로 자리잡을 것으로 예상된다. AI 애플리케이션 개발을 위해
이러한 기회는 많은 사람들에게 인터넷이 전성기였던 시절을 떠올리게 할 수도 있습니다. 사실 두 사람은 많은 유사점을 갖고 있습니다. 이는 황런쉰이 현 시대가 '차세대 산업혁명'이라고 말한 중요한 이유이기도 합니다.

한계비용 감소가 AI 플랫폼 혁명의 직접적인 원인일 수도
A16Z 파트너인 Martin Casado는 역사상 한계 비용 감소, 즉 칩과 인터넷으로 인해 플랫폼 전환과 산업 혁명이 일어난 두 가지 사례가 있었다는 견해를 갖고 있었습니다.
칩의 탄생으로 컴퓨팅의 한계 비용이 거의 0으로 감소했습니다. 이전에는 계산을 수동으로 수행해야 했습니다. 사람들은 큰 방에서 맨손으로 로그표를 만들어야 했습니다.
그러다가 에니악(ENIAC)과 다른 기계들이 등장했고, 컴퓨팅 속도는 4배나 급속히 향상되었습니다. 뒤이은 컴퓨터 혁명은 수많은 새로운 산업을 낳고, 많은 기업에 활력을 불어넣고, 수많은 새로운 기업을 탄생시켰습니다.

그러다 인터넷 시대가 되면 유통의 한계비용이 0으로 떨어졌다. 예전에는 무엇을 보내든(상자든 편지든) 일정한 비용이 있었다. 인터넷이 등장한 이후에는 비트당 가격이 급격하게 떨어졌다.
이는 4배나 향상된 수치로, 관련 산업의 비약적인 발전에 기여하고 인터넷 혁명을 주도한 것이기도 하다. 이 기간 동안 아마존, 구글, 메타 등의 기업이 대표자로 등장했다.

위의 두 기술과 마찬가지로 AI도 비용 중심의 생산성 혁명입니다. 대형 모델은 이미지 제작, 언어 이해 등 창작의 한계비용을 0으로 줄여준다. 그런 예도 들었다.
자신에 대한 Pixar 스타일의 애니메이션 캐릭터를 만들고 싶다면 대형 모델의 비용은 약 0.01센트이고 1초밖에 걸리지 않지만, 그래픽 디자이너를 한 시간 고용하는 데 드는 비용은 약 $100, 어쩌면 그 이상이 될 것입니다.
약간 더 나은 것보다는 AI가 더 저렴하고 훨씬 더 빠릅니다.

▲ 인공지능과 그래픽 디자이너의 이미지 생성에 소요되는 비용과 시간을 비교해보세요
1865년 영국의 경제학자 윌리엄 스탠리 제본스(William Stanley Jevons)는 석탄 사용을 보다 효율적으로 만드는 기술 개선이 대신 광범위한 산업 전반에 걸쳐 석탄 소비 증가로 이어진다는 사실을 발견했습니다.
그는 많은 사람들의 직관과는 달리 효율성이 높아지면 가격이 낮아지고, 이는 결국 더 많은 수요를 자극한다고 믿습니다.
즉, 기술의 발전으로 자원 사용의 효율성이 향상되지만 비용 절감으로 인해 수요가 증가하면 자원 소비율이 감소하는 것이 아니라 증가하는 것이 유명한 "제본스 패러독스(Jevons Paradox)"입니다.

▲ 윌리엄 스탠리 제본스(1835.9.1~1882.8.13)
과거에는 칩과 인터넷이 그러한 자원이었습니다. 컴퓨팅과 정보 효율성이 향상되고 가격이 낮아져 더 많은 수요를 자극하고 더 많은 가치와 서비스를 창출하며 새로운 플랫폼 이전과 산업 혁명을 낳아 생산성을 높입니다. 그리고 사람들의 소득은 궁극적으로 전 세계의 모습과 우리 각자의 삶을 변화시킵니다.
이것은 수년 전의 칩과 인터넷의 이야기이고, 오늘날 일어나고 있는 AI의 이야기이기도 합니다.
# aifaner 공식 WeChat 공개 계정: aifaner(WeChat ID: ifanr) 팔로우를 환영합니다. 더 흥미로운 콘텐츠가 최대한 빨리 제공될 예정입니다.
Ai Faner | 원본 링크 · 댓글 보기 · Sina Weibo
