작년에 언급했듯이 , 게임 및 AI 워크로드에 권장되는 이상적인 RAM 용량은 96GB의 시스템 메모리였습니다. 그 이후로 많은 변화가 있었기 때문에, 96GB 키트는 더 이상 권장되는 옵션이 아닐 수도 있습니다.
메모리 시장은 극적인 변화를 겪었습니다. AI 인프라가 막대한 양의 DRAM 및 HBM 용량을 소비하면서, 소비자용 DRAM의 공급과 가격에 상당한 압박을 가하고 있습니다. 2026년에는 96GB 키트를 구하기 어려울 수도 있고, 상당한 가격 프리미엄이 붙을 수도 있어, 일반 매니아들의 시스템 구성에 있어 그 매력이 상당히 떨어질 전망입니다.
그래서 다시 연구실로 돌아가, 주어진 상황에서 최선의 해결책을 찾으려고 노력하고 있습니다.
RTX 4090과 로컬 LLM 워크로드를 사용하여 32GB 및 64GB 구성을 비교하는 한편, DDR5 성능이 미치는 영향도 분석했습니다.
테스트 시스템은 다음과 같았습니다:
결론은 간단합니다. 최신 게임 및 AI 시스템의 경우, 64GB DDR5가 최적의 선택이며, DDR5-6000 C40은 용량, 성능, 실용성 면에서 탁월한 균형을 제공합니다.
예상대로 32GB 메모리로는 700억 개의 매개변수를 가진 대규모 LLM을 처리할 수 없습니다. RAM 사용률이 95%를 훌쩍 넘어서 시스템 속도가 느려집니다. 반면, 64GB 시스템은 약 15GB의 RAM이 남아 있어 사용자가 다른 작업을 동시에 수행할 수 있습니다.
토큰 생성 시간 측면에서는 큰 차이가 눈에 띄지 않습니다. 64GB 6000C40 키트가 약간 앞서기는 하지만, 그렇다고 해서 실질적으로 가장 우수하다고 볼 수는 없습니다. 이 특정 그래프에서는 두 키트 중에서 가장 빠른 실행 결과와 가장 느린 실행 결과를 선정하여 비교했습니다.
하지만 평균 3회 실행 결과만 보면 결과는 동일합니다. 5600C40과 6000C40 키트는 프롬프트 처리에 거의 같은 시간이 소요되었습니다. 6000C40 키트가 0.5초 정도 더 빨랐지만, 이는 오차 범위 내에 들어갑니다.
전반적으로 64GB는 시스템에 심각한 메모리 부하를 주지 않으면서도 훨씬 더 큰 규모의 로컬 AI 워크로드를 실행하기에 충분한 메모리 용량을 제공했습니다. 이러한 차이점은 중요합니다.
하지만 왜 로컬 LLM일까요? ChatGPT나 다른 온라인 API를 사용하면 안 될까요? 바로 개인정보 보호 때문입니다. 사용자가 온라인 서비스에 업로드한 데이터는 대중에게 노출될 수 있습니다. 자신이 관리하는 기기에서 LLM을 실행하면 인터넷에 연결할 필요가 없으며, LLM의 동작을 최대한 통제할 수 있습니다. 로컬 LLM의 장점은 개인정보 보호에만 그치지 않습니다. 비용, 맞춤 설정, 문맥 길이 역시 로컬 LLM의 장점으로 꼽히는 중요한 요소들입니다.
테스트에는 메타(Meta)의 Llama 3.1 70B Instruct 모델이 사용되었으며, Ollama를 통해 로컬에서 실행되었습니다. 이 70B 모델은 약 700억 개의 매개변수를 포함하며 128K 컨텍스트 윈도우를 지원합니다. 이는 모든 AI 사용자가 70B 모델을 실행해야 한다는 것을 의미하는 것은 아닙니다. 다만, 일반적으로 더 큰 모델일수록 지식과 관계를 표현하는 능력이 더 뛰어나며, 까다로운 추론, 코딩, 분석 및 지시 사항 이행 작업에서 더 우수한 성능을 발휘할 수 있습니다.
RTX 4090 그래픽 카드는 24GB의 전용 VRAM을 제공합니다. 이는 엄청난 용량의 그래픽 메모리이지만, 대규모 로컬 AI 모델의 경우 반드시 충분한 것은 아닙니다. 모델이 사용 가능한 VRAM 용량을 초과하면, 작업 부하의 일부는 시스템 메모리(RAM)에 상주해야 합니다. 바로 이때 시스템 RAM은 Windows, 게임, 백그라운드 애플리케이션을 위한 단순한 자원을 넘어 훨씬 더 중요한 역할을 하게 됩니다.
주요 성능 워크로드에는 Llama3.1 8B가 선정되었습니다. 이는 RTX4090에 탑재된 24GB VRAM보다 상당히 적은 용량이기 때문에, 시스템 메모리가 워크로드에서 차지하는 비중이 줄어듭니다.
모델에게 수천 단어를 생성하는 것과 같은 인위적인 벤치마크를 수행하도록 요구하는 대신, 일상적인 AI 사용을 대표하는 과제들을 활용했다.
여기에는 계획 수립, 요약, 분석, 체계적인 콘텐츠 생성 등의 활동이 포함되었습니다.
다음과 같은 요청 사항이 주어졌습니다. “도쿄, 교토, 오사카, 히로시마를 둘러보는 10일간의 일본 여행을 계획 중입니다. 날짜별로 상세한 일정을 작성해 주세요. 매일 주요 관광지, 방문 순서, 장소 간 대략적인 이동 시간, 추천 식당이나 맛집 거리, 그리고 실용적인 팁을 포함해 주세요. 일정을 구성한 근거를 설명하고, 일정에 발생할 수 있는 문제점을 지적해 주세요. 마지막에는 간결한 준비물 목록과 이동 시간 대비 관광 시간의 총합에 대한 요약을 제시해 주세요.”
PC 매니아 시장은 변화하고 있다.
이 제품들은 최신 게임, 멀티태스킹, 그리고 실질적인 로컬 AI 워크로드를 처리하기에 충분한 성능을 제공하면서도, 대용량 키트에서 점점 더 자주 발생하는 비용 및 가용성 문제를 피할 수 있게 해줍니다.
DDR5-6000 C40 사양과 결합되어 용량과 메모리 성능 사이에서 뛰어난 균형을 제공합니다.
기사의 제품
Stay up to date with CORSAIR. Get our latest News, Guides, and Product Updates in your Google feeds.
Add CORSAIR as a preferred sourceThanks for helping us improve this article.
JOIN OUR OFFICIAL CORSAIR COMMUNITIES
Join our official CORSAIR Communities! Whether you're new or old to PC Building, have questions about our products, or want to chat about the latest PC, tech, and gaming trends, our community is the place for you.