
거짓말은 하지 않겠습니다. Nvidia는 DLSS(Deep Learning Super Sampling) 3 를 통해 좋은 성과를 거두었으며 이러한 성공이 판매에 기여하지 않았을 가능성은 거의 없습니다. 미드레인지 GPU를 훨씬 더 뛰어난 기능으로 전환할 수 있는 기능을 갖춘 DLSS 3는 매우 획기적이며, 존재한다면 이는 강력한 판매 포인트입니다.
그러면 다음에는 무엇이 나올까요? RTX 40 시리즈는 거의 종료되었으며, 곧 Nvidia가 시도하고 판매할 수 있는 새로운 GPU가 출시될 예정입니다. 잠재적으로 세대 독점 업스케일링 기술에 대한 추가 인센티브가 없을 수도 있습니다. DLSS 3는 따라가기 힘든 작업이 될 것이며, 곧 출시될 그래픽 카드 에 대한 소문이 사실로 밝혀지면 Nvidia가 대박을 터뜨리려면 DLSS 4가 정말로 필요할 수도 있습니다.
GPU가 거의 중요하지 않은 경우

우리는 새로운 GPU 세대의 정점에 있기 때문에 RTX 40 시리즈를 되돌아보고 결점이 없는 것은 아니지만 여전히 거대하다고 판단하는 것이 안전하다고 느낍니다.
RTX 30 시리즈의 뒤를 이어 Nvidia가 새로운 GPU를 판매하기 위해 해야 할 일은 많지 않았습니다. 결국 시장은 엄청난 부족 현상을 겪었습니다. 기준은 매우 낮게 설정되었습니다. 소비자는 저렴하고 작업을 수행하며 큰 번거로움 없이 사용할 수 있는 GPU를 원했습니다. 이것이 많은 게이머들의 기준이라고 가정했을 때 Nvidia는 3점 만점에 2점을 제공했습니다. RTX 40 시리즈는 쉽게 구할 수 있으며 이 세대의 일부 GPU는 정말 인상적입니다. 그러나 그 누락된 지점은 더 까다로워지는 부분입니다.
Nvidia는 각각 1,600달러와 1,200달러의 GPU 2개를 탑재한 RTX 40 시리즈를 출시했는데, 이상하게도 더 비싼 카드가 가격 대비 더 나은 가치를 제공했습니다. 뒤따른 GPU는 모두 환상적이지는 않았으며 달러당 성능 요소가 새로운 세대에서 기대할 수 있는 수준에 미치지 못했습니다. RTX 4060 Ti 와 같은 일부 카드는 결국 이전 세대 카드와 거의 동일한 성능을 제공했습니다. 이는 차세대 제품에서 보고 싶은 것이 아닙니다.
그러나 Nvidia는 특정 카드인 DLSS 3에 관계없이 이 세대에서 큰 절약 은혜를 받았습니다.
우리는 DLSS 3가 보급형부터 중급 그래픽 카드에 어떤 변화를 가져올 수 있는지에 대한 많은 예를 보유하고 있습니다. 이를 지원하는 타이틀에서 DLSS 3은 일부 카드에서 기대하는 것보다 훨씬 뛰어난 성능을 제공합니다.

예를 들어 RTX 4070 Super를 살펴보겠습니다. 레이 트레이싱을 활성화한 상태에서 Cyberpunk 2077을 4K에서 실행하려고 시도했을 때 GPU는 초당 19프레임(fps)을 끌어내면서 당연히 어려움을 겪었습니다. DLSS 3을 켜면 갑자기 부드러운 77fps로 실행됩니다. DLSS 없이 4K에서 편안하게 게임을 실행하려면 훨씬 더 비싼 GPU가 필요합니다. 두 배나 비쌉니다.
Nvidia는 DLSS를 통해 좋은 기술을 보유하고 있으며 이에 대해 현명했습니다. 단일 세대 GPU에서만 사용할 수 있도록 하여 모든 페이월을 종료하기 위해 페이월 뒤에 잠갔습니다. 이전 버전의 DLSS는 RTX 카드 소유자 모두가 사용할 수 있지만 DLSS 3은 RTX 40 시리즈에만 적용됩니다. 업그레이드에 대한 인센티브는 어떻습니까?
DLSS 2와는 거리가 멀다는 점을 감안할 때 DLSS 3만으로는 일부 구매자가 최신 카드를 선택하거나 Nvidia를 선택하도록 유도하기에 충분하지 않았습니다. 개인적으로 RTX 4080과 AMD RX 7900 XTX의 차이점을 따졌을 때 DLSS 3가 Nvidia를 고수하기로 결정하는 데 중요한 역할을 했습니다.
일부 RTX 40 시리즈 카드는 훌륭합니다. 일부는 단지 DLSS 3용 선박일 뿐이며 Nvidia의 프레임 생성 능력 덕분에 여전히 판매되고 있습니다. DLSS 3은 그래픽 카드 자체가 훨씬 덜 중요하도록 만들었으며 Nvidia는 RTX 50 시리즈 에 대해 이를 반복해야 할 수도 있습니다.
암울한 추측

RTX 50 시리즈가 올해 말에 출시될 것이라는 소문이 돌았음에도 불구하고 우리는 아직 추측에 근거한 것이 아닌 그에 대해 아는 바가 많지 않습니다. 사실, 해당 세대가 Blackwell이라고 불린다는 사실 외에 Nvidia가 실제로 확인한 바가 있는지는 확실하지 않습니다. 그래서 우리는 사실일 수도 있고 아닐 수도 있는 정보를 제공하기 위해 유출자에게 의지하지만, 그것이 모두 좋은 것은 아닙니다.
RTX 50 시리즈와 관련하여 가장 탐나는 유출은 모두 사양에 관한 것입니다. 가격을 엿보기를 희망하기에는 아직 이르기 때문입니다. 이를 위해 가장 최근의 유출은 kopite7kimi에서 비롯되었으며 Moore의 법칙은 죽었다(Moore's Law Is Dead) 는 자신의 추측을 내세웠습니다.
유출자는 그래픽 처리 클러스터(GPC) 수와 텍스처 처리 클러스터(TPC)를 곱하여 고급형 GB202부터 보급형 GB207까지 각 GPU에 대한 소문난 스트리밍 멀티프로세서(SM) 수를 공개했습니다. 그 숫자를 두 배로 늘리면 총 SM 수가 됩니다. 이는 각 GPU가 얼마나 많은 CUDA 코어를 사용하는지 알려주며, 이는 이전 GPU와 어떻게 비교되는지를 보여주는 좋은 지표입니다.
계산을 제쳐두고, RTX 50 시리즈에서 잠재적으로 볼 수 있는 것은 RTX 40 시리즈의 반복처럼 보입니다. 최고 GPU인 GB202는 보고된 192개의 SM(AD102의 142개의 SM) 또는 SM의 33% 개선을 통해 전반적으로 엄청난 향상을 제공해야 합니다. 대폭 축소 되어 RTX 5080에 나타날 수 있다고 알려진 GB203으로 내려가면 개선된 부분은 5%에 불과합니다.
GB205 GPU는 정말 위험한 부분입니다. SM 부스트가 없다는 것이 아니라 AD104에 비해 실제로 17% 다운그레이드되었습니다(이 세대에는 GB204가 없음). SM이 60개에서 50개로 줄었습니다. 다음으로 GB206은 SM 개수가 정확히 동일한 반면 GB207은 SM 개수가 정확히 같다고 합니다. 다시 한 번 SM이 24개에서 20개로 17% 감소했습니다.
이것이 확인된다면 RTX 5090을 제외하고 전반적으로 미묘한 개선이 이루어지고 있는 것입니다. 그럼에도 불구하고 그래픽 카드가 실제로 얼마나 많은 칩을 활용할지는 불분명합니다. RTX 4090은 AD102 칩의 모든 성능을 활용하지 않았으므로 완제품에서 최종 SM 수가 더 작을 수 있습니다.
GB202 12*8 512비트 GDDR7
GB203 7*6 256비트 GDDR7
GB205 5*5 192비트 GDDR7
GB206 3*6 128비트 GDDR7
GB207 2*5 128비트 GDDR6— kopite7kimi (@kopite7kimi) 2024년 6월 11일
물론, 새로운 세대에는 단순히 컴퓨팅 성능이 향상되는 것보다 더 많은 이점이 있습니다. 무어의 법칙은 죽었다(Moore's Law Is Dead)는 GB203 칩(RTX 5080)이 최대 10%의 클럭 속도 증가, 더 나은 IPC(Instructions Per Lock) 및 대역폭의 대폭 증가를 제공해야 한다고 추측합니다. 후자는 Nvidia가 더 빠른 GDDR7 메모리로 전환한다고 알려져 있기 때문에 그것만으로도 많은 도움이 될 것입니다.
이러한 예측은 더 낙관적입니다. YouTube 사용자는 RTX 5090 아래의 모든 계층에서 15~30%의 향상을 추정하며, 플래그십의 경우 최대 60%의 증가를 볼 수 있습니다. 하지만 이는 여전히 RTX 3090에서 RTX 4090보다 적으며, 15% 증가만으로는 새로운 구매자를 유인하기에는 충분하지 않을 수 있습니다. 가격에 따라 다르며, Nvidia가 RTX 40 Super 카드 로 교훈을 얻은 것으로 보이지만 RTX 50 시리즈가 저렴할 것이라고는 기대하지 않습니다.
예측이 실현되고 게임 성능이 크게 향상되지 않은 새로운 GPU를 얻을 수 있지만 가격이 인상되면 Nvidia에는 또 다른 판매 포인트가 필요합니다. DLSS 4가 필요하고 탁월해야 합니다.
DLSS 4에서 무엇을 기대할 수 있나요?

RTX 50 시리즈와 마찬가지로 Nvidia의 차세대 AI 업스케일링 기술은 수수께끼에 싸여 있습니다. 우리는 그것이 일어날 가능성이 가장 높다는 것을 알고 있지만 올해가 될까요? 그것은 무엇을 가져올 것인가? 우리는 또 다시 추측에 의존해야 하지만 이번에는 Nvidia의 CEO인 Jensen Huang 자신이 이를 부추겼습니다.
Computex 이후 Q&A( More Than Moore 가 공유)에서 Huang은 게임에서의 AI 사용에 대해 이야기했습니다. 우리 모두는 Nvidia가 AI를 좋아한다는 것을 알고 있으며 G-Assist 와 같은 기능이 곧 출시될 예정이므로 앞으로 게임에서 더 많은 AI를 보게 될 것입니다.
“미래에는 텍스처와 개체도 생성할 예정인데, 개체의 품질은 낮을 수 있지만 보기 좋게 만들 수는 있습니다. 우리는 또한 게임에서 캐릭터를 생성할 것입니다. 6명으로 구성된 그룹을 생각해 보세요. 두 명은 실제이고 나머지는 장기 사용 AI일 수 있습니다.”라고 Huang은 말했습니다.
그의 답변 내내 AI의 압도적인 사용은 계속됐다. 그는 덧붙였습니다. “게임은 AI로 만들어질 것이고, 내부에 AI가 있을 것이며, G-Assist를 사용하여 PC도 AI로 만들 수도 있습니다. PC를 AI 보조자로 활용해 게임을 도와줄 수 있습니다.”
Huang의 답변에는 DLSS에 대한 언급은 없지만 DLSS와 Nvidia ACE에 대한 질문에 대한 답변으로 나왔습니다. 하지만 이러한 기능이 DLSS 4에 포함될까요? DLSS 5에 맞춰 완전히 실현될 수 있을까요? 그들은 완전히 다른 것이 될까요? 말하기에는 너무 이르지만 Nvidia가 AI를 게임 경험의 기반으로 만들고자 하는 것은 분명합니다.
단순한 프레임 대신 게임 내 자산을 생성하는 것은 성능을 향상시킬 수 있는 것처럼 들리지 않을 수도 있지만 실제로는 그럴 수 있습니다. 이로 인해 일부 작업이 CUDA 코어에서 AI 및 기계 학습 워크로드를 처리하기 위해 만들어진 텐서 코어로 전환됩니다. 결과적으로, 텐서 코어가 AI 측면을 처리하는 동안 GPU에는 성능에만 집중할 수 있는 더 많은 리소스가 있어야 합니다.
자산 생성은 우리가 DLSS 3에서 알고 있는 프레임 생성보다 한 단계 더 발전한 것입니다. Nvidia가 생성하기를 희망하는 것은 게임 내 자산뿐만 아니라 이를 실현하기 위해 Nvidia ACE로 구동되는 NPC도 포함합니다. 그 중 절반이라도 DLSS 4에 적용된다면 Nvidia는 진정한 보석을 손에 쥐게 될 것이며 이미 가까워지고 있습니다. DLSS 3은 이제 실제로 DLSS 3.7 입니다. 버전 3.5는 광선 재구성을 제공했으며 3.7은 더 많은 사소한 업그레이드를 제공했습니다.
하위 호환성? 아마도 그렇지 않을 것이다

DLSS 4가 연내 곧 출시될 것이라고 가정해 보겠습니다. (그리고 이는 RTX 50 시리즈와 함께 출시될 것이라는 가정에만 기반을 두고 있으므로 이에 대해 제 말을 인용하지 마세요.) 또한 그것이 탁월할 것이라고 가정해 봅시다. 그런데 DLSS 4가 RTX 40 시리즈와 이전 버전과 호환되나요? 그것은 내가 기꺼이 내기를 걸고 싶지 않은 스트레칭입니다. 모든 하드웨어 고려 사항을 제쳐두고, Nvidia가 DLSS 4가 시장에 출시되면 모든 잠재력을 발휘할 기회를 놓칠 수도 있다는 것을 믿기 어렵습니다.
AMD는 Nvidia에 대해 다른 접근 방식을 가지고 있습니다. FSR 3.0은 채택 속도가 매우 느리지만 업스케일링 기술은 모든 공급업체의 GPU에서 사용할 수 있습니다. 한편, DLSS 3는 느리지만 확실하게 점점 더 많은 게임에 진출하고 있습니다. DLSS 4는 카운터를 재설정하고 빈 상태로 시작하여 더 널리 보급되기 전에 일부 타이틀에 나타날 수 있습니다.
어떤 식으로든 대중에게 깊은 인상을 주기 위해 Nvidia는 현 시점에서 대담한 조치가 필요할 수 있습니다. 즉, 쉽게 사용할 수 있는 다른 옵션이 있을 때 게임 성능이 15% 향상되는 것은 줄어들지 않을 것입니다. 미드레인지에서 AMD의 RDNA 4 와 꽤 치열한 경쟁을 벌여야 하므로 RTX 5070과 같은 카드는 가격을 정당화하기 위해 추가 지원을 사용할 수 있습니다.
DLSS 4가 제 시간에 도착하면 RTX 50 독점이 되어 "괜찮은" GPU를 매우 뛰어난 GPU로 바꾸기 위해 뒤에서 열심히 노력하더라도 놀라지 않을 것입니다. 우리는 기다려야 할 것입니다.
