기획
 






 
 
 




전송 2009-09-30 18:00
[테크닉]

Radeon HD 5800은 듀얼코어? 소문의 진상을 알아보자

1. 처음 2. CPU와 GPU의 다른 아키텍처
3. HD 5800 시리즈의 듀얼코어화? 4. HD 5800 시리즈는 CPU식 듀얼코어화의 시작

     2. CPU와 GPU의 다른 아키텍처



CPU와 GPU는 서로 다른 아키텍처로 발전

일반적으로 CPU는 분기 예측과 랜덤 메모리 액세스 등의 범용 컴퓨팅 즉, 시리얼 명령에 최적화되어 다양한 연산을 해줄 수 있는 프로세서이며, GPU는 부동소수점 연산을 이용하여 병렬 명령 처리에 최적화되고 그래픽 처리와 같은 특정 연산에 강점을 보이는 프로세서다.

이러한 결과 CPU와 GPU의 아키텍처는 서로에 강점을 가진 분야에서 연산 성능을 증가시키면서 서로 다른 방향으로 발전해왔다.

하지만, GPU는 특정 연산에 최적화된 프로세서이기 때문에 CPU와 같은 범용 컴퓨팅에 활용도는 크게 떨어질 수밖에 없는 구조를 가진다. 반대로 CPU는 여러 가지 연산에는 유용하게 사용될 수 있지만, 그래픽연산 등에서는 상대적으로 떨어지는 성능을 제공한다. 그러나, 최근 GPGPU 기술을 통해 GPU들은 CPU와 협력하여 서로 부족한 부분을 보완할 수 있게 바뀌고 있다.

 


CPU와 다른 GPU 아키텍처

GPU는 CPU와 비교하여 명령 실행 및 제어가 보다 간단하다. GPU는 엄연히 이야기해서 CPU에 해당하는 코어 이미 수백개씩 가지고 있는데, CPU의 코어단위에 속하는 GPU의 코어는 엄연히 스트림 프로세서 또는 쉐이더 프로세서로 불리고 있다. GPU는 보통 여러 개의 스트림 프로세서를 일정 단위로 묶어 (클러스터, SIMD 엔진) 연산을 처리하도록 구성되고 있다.

HD 5800 시리즈를 예로들면, 20/ 18개의 SIMD 엔진 (16 스레드 프로세서 내부에 5개의 스트림 코어가 내장 (16 x 5 = 80)되며, 20/ 18 SIMD 엔진을 구성하여 1600/ 1440개의 스트림 프로세서를 제공)으로 구성된다. 이 클러스터들에 포함된 스트림 프로세서들은 같은 명령을 처리하도록 설계되고 있다. GPGPU를 이용한 GPU 병렬 컴퓨팅이 확대되고 있지만, GPU는 어디까지나 많은 데이터의 동일한 처리에 최적화된 병렬 프로세서다.

현재의 GPU들은 클러스터 전체가 1개의 명령으로 여러 개의 데이터를 처리하는 SIMD (Single Instruction Multiple Data) 구조로 만들어지며, NVIDIA GT300의 경우 MIMD (Multiple Instruction Multiple Data)의 새로운 아키텍처가 적용될 것으로 알려지고 있다.

 

CPU는 GPU보다 복잡하다

반면, CPU는 명령 실행 및 제어하는 구조가 GPU보다 복잡하다. 현재의 CPU들은 명령 실행 유닛이 GPU보다 많은 편이며, 이에 따라 서로 다른 명령을 병렬로 실행할 수 있는 구조를 갖고 있다. 예를들어 명령 1과 2를 실행함과 동시에 또다른 명령 3을 실행하는 유닛을 동작하도록할 수 있다.

멀티코어 CPU들은 각각의 CPU 코어들이 각각의 실행 유닛에 서로 다른 명령을 실행할 수도 있고 같은 명령에 대해 서로 협력하여 더 높은 성능을 제공할 수 있는 구조를 갖추고 있다. 이는 CPU가 명령을 유연하게 실행할 수 있다는 것을 말해주며, GPU는 일정한 데이터에 대해서 같은 명령을 실행하여 유연성이 떨어지는 모습을 보여준다.

또, CPU는 동시에 다수의 명령을 실행할 수 있는 명령 스케쥴러가 제공되지만, GPU는 복잡한 명령 스케쥴러를 제공하지 않고 소프트웨어를 이용한 스케쥴링이 진행된다. 그만큼 GPU는 소프트웨어의 최적화도 중요하다.

 

CPU는 GPU에 비교해 실행유닛 비율 떨어져

그러나, CPU는 GPU와 비교하여 명령 제어 관련 유닛이 복잡해지고 더욱 커져 실질적인 실행 유닛의 비율이 줄어드는 문제를 갖고 있다. 그와 비교해 GPU는 명령 제어 유닛이 차지하는 비율이 CPU보다 상대적으로 적기 때문에 실질적인 실행 유닛인 스트림 프로세서를 GPU 내부에 더 많이 포함할 수 있다. 이는 GPU가 CPU보다 다이 면적 당 연산 성능이 높을 수밖에 없는 이유다.

일반적으로 GPU에 캐쉬가 탑재되지 않을 경우 코어 간의 메모리 지연시간도 없으며, 내부 버스도 간단해진다. 이로 인해 프로세서를 마음껏 탑재가 가능하여 CPU보다 연산 성능이 크게 증가된다.

하지만, GPU는 프로그램에 조건 분기명령이 포함될 경우 처리 성능이 크게 떨어지는 경우가 있으며, 이는 GPU를 범용 컴퓨팅이 가능해진 현재에도 GPU로 실행할 수 있는 어플리케이션들에 제약이 있다는 것을 말해준다. 결과적으로 현재 GPU 아키텍처로는 CPU가 할 수 있는 일들을 모두 대체하기는 힘들다는 것을 의미한다.

 

이론적으로 효율적인 것은 하나의 프로세서에 하나의 분기처리가 가능해야 하지만, 이는 현실적으로는 어렵고, 명령 제어 관련 유닛이 복잡해지면 오히려 그만큼 실적인 실행유닛이 줄어 성능저하를 가져오게 된다. 이에따라 현재의 GPU들은 분기명령 처리 향상을 위해 GPU를 개선하는 방향으로 나가고 있으며, 기존보다 범용적인 작업들에 GPU를 활용할 수 있도록 GPGPU에 보다 최적화된 모습도 보여준다.

 


멀티코어화 되는 CPU와 GPU

CPU는 현재 멀티코어화가 진행되고 있다. CPU는 과거에는 클럭을 높이고 내부 연산 성능을 높이는 방법이 주로 사용되어 왔다. 그런데 최근에는 미세공정 적용이 더디어지고 클럭 향상 및 내부 연산 성능 개선의 한계에 다다르자 코어 수를 직접적으로 늘려 처리 성능을 높이는 멀티코어화가 대안으로 떠올랐다.

이 결과 현재는 듀얼코어를 넘어 쿼드코어, 그리고 얼마 있으면 6코어 프로세서도 데스크탑 시장에 등장할 것으로 알려지고 있다. 이처럼 CPU의 멀티코어화는 과거부터 사용해온 성능 향상 방법이 한계에 다다르자 이를 해결하기 위해 적용되기 시작한 방법이다. 현재의 멀티코어 CPU는 서로 독립된 코어로 구성되지만, 공동으로 하나의 작업을 빠르고 효율적으로 처리하는 것도 가능하고 서로 다른 작업을 각각 처리할 수도 있다.

 

GPU는 싱글 GPU들도 CPU 관점에서 볼 경우 CPU의 코어에 해당하는 스트림 프로세서를 이미 크게 늘려놓고 있는 상황이기 때문에 이미 멀티코어인 제품이라 할 수 있다. 하지만, CPU와 달리 GPU의 멀티코어화는 GPU가 CPU보다 상대적으로 복잡하지 않은 제어부를 갖고 있어 보다 빠르게 스트림 프로세서를 늘려 성능을 증가시킬 수 있었기 때문이며 오히려 공정 등으로 인해 더 많은 트랜지스터를 집적하지 못하는 것이 성능 확장의 걸림돌이 되기도 했다. 즉, CPU와 달리 일정 수준의 성능 향상을 위해 트랜지스터 집적률을 높여 연산 성능 향상이 가능한 스트림 프로세서를 크게 늘리는 것이 일반적인 GPU의 멀티코어화라고 볼 수 있다.

GPU는 현재 상황에 맞는 일정 성능을 제공하기 위해 제한된 면적에 트랜지스터를 더 많이 집적해야 하는데 이는 어려운 작업이며, 미세공정이 뒷받침되어야 더욱 효과를 볼 수 있다. 이 결과 많은 수의 스트림 프로세서를 병렬로 연결하여 배치함으로써 이전 세대의 GPU보다 높은 처리 성능을 얻을 수 있게 되었고 이는 AMD ATI와 NVIDIA 모두 같은 방법을 사용하고 있다. 이처럼 GPU의 멀티코어화는 CPU처럼 처리 성능을 높이는 관점에서는 목적이 같으나 근본적인 연산 처리 방법은 크게 달라지지 않았다고 볼 수 있다.

 


AMD와 NVIDIA의 서로 다른 GPU 발전방향

AMD는 중간 공략이 먼저, 최고성능은 그다음

AMD ATI의 GPU 개발 전략은 잘 알려져 있듯이 일정 수준의 성능을 가진 GPU를 만들고 고성능을 위한 듀얼 GPU나 성능을 줄인 GPU를 만들어 경쟁사보다 빠른 시장 출시 및 대응이 가능한 스윗스팟 전략이다. 물론, 이전 세대보다 성능이 더 높아지는 것은 당연한 부분이다.

또한, GPU는 본업인 그래픽처리에 집중하면서 연산 성능을 개선하고 성능 저하를 가져오는 복잡한 부분들을 제거해나가는 방식이다. 이는 결과적으로 경쟁사보다 더 빠르게 시장에 GPU들을 내놓을 수 있었고 여기에는 경쟁사보다 빠르게 적용된 미세공정의 덕도 톡톡히 보고 있다. 그리고 그래픽 처리에 특화된 기능의 확장에 많은 수의 트랜지스터를 할당하여 처리 효율 및 성능을 높이는 것도 포함된다. 결과적으로 최근에 등장한 HD 5800 시리즈는 HD 4800 시리즈의 800개의 스트림 프로세서보다 2배 가량 더 늘어난 1600/ 1440개의 스트림 프로세서를 제공할 수 있게 된 것도 AMD ATI의 GPU 전략 덕분이다.

NVIDIA는 단일 GPU 최고 성능이 목표

NVIDIA는 AMD ATI와는 약간 다른 GPU 개발 전략을 갖고 있다. 우선 단일 GPU로 최고 성능을 제공하는 GPU를 개발한 후 고성능 듀얼 GPU나 하위 제품들을 만드는 방식이다. 이 방식의 장점은 높은 성능을 제공하는 것이지만, 그에 따른 여러 가지 단점들도 갖게 된다.

단일 GPU로 최고 성능을 목표로 하다보니 GPU 내부 연산 성능개선과 명령 제어부가 이전보다 복잡해지며, 범용성에도 중점을 두고 개발되다보니 다이 사이즈가 경쟁사보다 커지는 것은 물론 이에 따른 발열이나 소비전력도 크게 늘어난다. DX11 GPU로 알려진 GT300 역시 HD 5800 시리즈에 사용된 RV870보다 더 커질 것으로 알려지고 있으며, 제조 공정은 40nm로 서로 같으나 비교적 최근까지 AMD ATI보다 한 단계씩 느린 공정이 적용되곤 했다.

또, 다이 사이즈가 커지면서 실리콘 웨이퍼 당 생산할 수 있는 GPU의 수가 크게 줄어 칩의 생산과 제조에 드는 비용이 경쟁사보다 크게 늘어난다는 것도 문제가 된다. 최근에는 이런점들에대한 지연 때문에 개발 시간도 느려져 경쟁사보다 느리게 시장에 제품을 내놓는 문제도 발생되고 있다.

 

전략에 따라 효율도 달라

AMD ATI와 NVIDIA의 GPU 개발 전략의 차이에 따라 각 GPU의 효율도 다르다. 일반적으로 NVIDIA GPU 아키텍처는 어떤 프로그램이라도 효율적으로 실행이 가능한 장점을 가지지만, 명령 제어 유닛이 상대적으로 커져 GPU 다이 사이즈가 커지는 문제를 가진다.

AMD ATI의 GPU 아키텍처는 그래픽 연산 처리의 효율이 높은 장점을 갖게 되지만, 그 외의 프로그램에서의 성능 차가 나타날 가능성이 높은 단점을 동시에 갖는다. 그러나, 명령 제어 유닛이 NVIDIA GPU들보다 상대적으로 적기 때문에 실질적인 연산 실행유닛의 수는 크게 증가되며, 이에 따라 AMD ATI GPU들이 트랜지스터 당 성능 효율이 높다.

 

최근 AMD ATI와 NVIDIA 양사는 그래픽 연산처리 능력을 향상시키기 위해 GPU를 개선하고 있는 것과 동시에 GPU의 병렬 컴퓨팅 즉, GPGPU 기술 지원에도 힘을 쏟아 이에 보다 최적화된 GPU 구조를 도입하고 있다.

GPU의 듀얼코어화 역시 AMD ATI가 경쟁사인 NVIDIA보다 빠르게 이루어져 각사의 전략에 따른 차이가 드러나고 있다.

  태그(Tag)  : 라데온 HD 5800
이전페이지 | 다음페이지.HD 5800 시리즈의 듀얼코어화?
관련 기사 보기
태그가 등록되지 않아 관련 기사를 출력할 수 없습니다

  권경욱 前 기자 / 필명 바이퍼투 / 바이퍼투님에게 문의하기 press@bodnara.co.kr
남들은 스마트폰이나 타블렛 PC에 관심을 갖고 있지만, 여전히 PC가 좋다. 새로운 것, 독특한 것을 좋아하지만, 남앞에 나서거나 사진찍히는 것을 싫어해 기자에는 제일 어울리지 않는 성격. 누구보다 빠르게 PC 하드웨어 정보를 전달하기 위해 노력하고 있으며, PC 하드웨어에 대한 열정은 현재진행형이다.
기자가 쓴 다른 기사 보기

Creative Commons License 보드나라의 기사는 저작자표시-비영리-변경금지 2.0 대한민국 라이선스에 따라 이용할 수 있습니다. Copyright ⓒ 넥스젠리서치(주) 보드나라 미디어국
싸이월드 공감 기사링크 퍼가기 기사내용 퍼가기 이 기사를 하나의 페이지로 묶어 볼 수 있습니다. 출력도 가능합니다.
홈으로 탑으로
보드나라 많이본 기사
RTX 30 시리즈도 DLSS 5 구동 가능, 정상적 실행 불가 수준 성능
엔비디아, RTX 50 시리즈 전력 제한 해재 오버클럭 차단?
이엠텍, PALIT 지포스 RTX 50 게이밍 PC 단 1시간 G마켓 라이브 특가 진행
MS, 윈도우 11 9월 업데이트 이슈 대응 긴급 패치 배포
메인스트림 게이머의 심리적 마지노선 가격 모델, 라데온 RX 9070 GRE vs RTX 5070 성능 비교
애플의 가변 조리개와 폴더블 스마트폰, 아이폰 18 Pro 시리즈 및 아이폰 듀오 공개
비싸진 SSD 어떻게 고를까?, 가격 상승기 SSD 선택 가이드
세계 최초 라이젠 프로 9000 워크스테이션, 레노버 ThinkStation P4 공개
   이 기사의 의견 보기
트위터 베타서비스 개시! 최신 PC/IT 소식을 트위터를 통해 확인하세요 @bodnara

기자의 시각이 항상 옳은것은 아닙니다. 나머지는 여러분들이 채워 주십시요.

2014년부터 어려운 이야기를 쉽게 하는 것으로 편집방침을 바꿉니다.

로또만이살길.. (vobavoba) vobavoba님의 미디어로그 가기  / 09-09-30 20:17/ 자국/ 신고/ 이댓글에댓글달기
이제는 GPU도 멀티시대군요..X2이런거랑은 다르네요

Meho (ho5945) ho5945님의 미디어로그 가기  / 09-09-30 20:26/ 자국/ 신고/ 이댓글에댓글달기
그럼 GPU는 단순하면서도 연산처리유닛의 종류가 적지만 그만큼 단순반복 유닛의 수가 많은거고 CPU는 복잡하지만 범용적이면서 연산처리유닛의 종류는 많지만 수가 적은거겠네요?
GPU와 CPU의 차이가 이런것이었을 줄이야...

내용이 굉장히 마음에 듭니다. 이 기사를 개인소장해버리고 싶어지네요~

사파 (jeehy) jeehy님의 미디어로그 가기  / 09-09-30 20:52/ 자국/ 신고/ 이댓글에댓글달기
870이 770의 아키텍쳐를 그대로 승계했다고 하더니
그래도 내부적으로는 많은 변화가 있었군요.
특히 전혀 모르던 사항에 대한 심도 깊은 기사가 아주 좋네요.

티케 (kado) kado님의 미디어로그 가기  / 09-09-30 21:51/ 자국/ 신고/ 이댓글에댓글달기
제가 바라던대로 되네요.. 크파네 sli네 이런 삽질은 이제 그만두고 이렇게 가야 정상이지요
blasty (ID) blasty님의 미디어로그 가기  / 09-09-30 22:10/ 자국/ 신고/ 이댓글에댓글달기
현재 40 나노 공정도 상당히 애를 먹었는데, 집적의 한계를 이런 식으로 해결할수 있겠군요

유리카 (king8407) king8407님의 미디어로그 가기  / 09-09-30 22:41/ 자국/ 신고/ 이댓글에댓글달기
CPU와 GPU가 잘 연결되어 간다면 잘 어울릴거 같네요.
bigfog (ID) bigfog님의 미디어로그 가기  / 09-09-30 22:44/ 자국/ 신고/ 이댓글에댓글달기
생각해 보니, 성능이니 오버니 전력사용량등에 대한 기사는 넘치고 넘치는데, 아키텍처에 대한 기사를 보드국에서 처음 본 것 같군요...~0~; (영어는 까막눈이니 영문사이트는 제외 ~0~;;;)
좋은 기사 잘 보고 갑니다. ^^

듀크 (lordstar) lordstar님의 미디어로그 가기  / 09-09-30 22:54/ 자국/ 신고/ 이댓글에댓글달기
ATI도 나름대로 타개책을 강구하고 있군요.
꾸준한 노력 덕분인지 좋은 제품이 계속 나와서 다행입니다.
Scavenger (bmw375) bmw375님의 미디어로그 가기  / 09-09-30 22:58/ 자국/ 신고/ 이댓글에댓글달기
AMD와 ATI의 합병으로 인해 CPU와 GPU에 각각 존재하던 기술이 합쳐지기 시작하는 느낌이 드는군요. 과연 다음 세대에서는 어떤 모습으로 발전할지 기대됩니다.

전투기 (f15cc) f15cc님의 미디어로그 가기  / 09-10-01 0:18/ 자국/ 신고/ 이댓글에댓글달기
점점 효율적인 구조로 가고있는것 같네요

터미널 (uncompress) uncompress님의 미디어로그 가기  / 09-10-01 1:07/ 자국/ 신고/ 이댓글에댓글달기
와... 뭘 먹으면 바이퍼투님처럼 박식해 지나요?

bluet (zzbaebae) / 09-10-01 5:52/ 자국/ 신고/ 이댓글에댓글달기
좋은 기사 감사한 마음으로 읽고 갑니다.

허접프로그래머 (valkyrie) valkyrie님의 미디어로그 가기  / 09-10-01 9:17/ 자국/ 신고/ 이댓글에댓글달기
듀얼코어 구조로 바뀐다는 의미가 이런 의미였군요. 앞으로 AMD가 어떤 방향으로 GPU를 만들어갈지 눈에 보이는듯한 기분입니다.

리크 (redcurse) redcurse님의 미디어로그 가기  / 09-10-01 9:48/ 자국/ 신고/ 이댓글에댓글달기
이제 GPU도 날로 새롭게 발전해나겠네요

끓여만든배 (kama136) / 09-10-01 10:39/ 자국/ 신고/ 이댓글에댓글달기
단순히 공정이나 약간의 개선이 아닌 내부적으로 변화가 있었군요.
hyeimi (ID) / 09-10-01 10:58/ 자국/ 신고/ 이댓글에댓글달기
가려운 곳을 긁어주는 내용 잘 읽었습니다.

당신기억 (bluemun) bluemun님의 미디어로그 가기  / 09-10-01 11:27/ 자국/ 신고/ 이댓글에댓글달기
RV870에 이런 기술이 들어 가 있었군요. SIMD가 멀티코어 형태로 발전하는 것이 어쩌면 앞으로 발전 방향 같기도 하는데 GT300은 이런 문제를 어떻게 극볼할지..

겨울이좋아 (noblechae) / 09-10-01 11:55/ 자국/ 신고/ 이댓글에댓글달기
그러니까 작업영역을 나누어놨다고 보면되는건가요? 어째든 기존의 GPU와 다른 아키텍쳐라는건 분명하네요.
actium (ID) actium님의 미디어로그 가기  / 09-10-01 12:12/ 자국/ 신고/ 이댓글에댓글달기
이제는 GPU도 듀얼코어의 시대가 되었군요. 하기사 그럴때도 되었지요. 발열과 소모전력을 줄이기 위해서는 가야할 길이니...
sd1015 (ID) / 09-10-01 19:09/ 자국/ 신고/ 이댓글에댓글달기
AMD 화이팅입니다~!

아리마퐁퐁 (tototro) tototro님의 미디어로그 가기  / 09-10-01 19:19/ 자국/ 신고/ 이댓글에댓글달기
나와라 나와...기대가 되네요...

로멜린디 (lomelindy) / 09-10-01 20:36/ 자국/ 신고/ 이댓글에댓글달기
이제 갈수록 저 숫자가 늘겠죠..-ㅂ- GPU 쿼드도 한 2년안에 볼기세..
그럼 CPU는 얼마나 늘어나게 될까요.
naturelove / 09-10-01 22:19/ 자국/ 신고/ 이댓글에댓글달기
123
박보국 (neturelove) / 09-10-01 22:22/ 자국/ 신고/ 이댓글에댓글달기
예전에 CPU가 멀티코어로 성능을 향상 시키고 있을 때, GPU는 어떤식으로 성능을 향상시키고 있는지 궁금했던적이 있었고, 또 멀티코어로 언젠가는 갈것이라고 생각은 했었는데... 드디어 시작이군요! 기사 내용도 알차고 좋네요 ^^

리링 (leebr21) leebr21님의 미디어로그 가기  / 09-10-02 11:13/ 자국/ 신고/ 이댓글에댓글달기
기술은 끊임없이 발전하는군요. 듀얼 쿼드 그래픽이 계속 나오면 성능이 엄청나겠습니다! ㅎㅎ
whdnzj / 09-10-02 14:34/ 자국/ 신고/ 이댓글에댓글달기

토리장군 (msinp) / 09-10-02 23:45/ 자국/ 신고/ 이댓글에댓글달기
좋은 정보 잘보고 갑니다~

Tuna☆09 (ohye701) ohye701님의 미디어로그 가기  / 09-10-06 23:14/ 자국/ 신고/ 이댓글에댓글달기
그것만으로도 우세를 점하는 모습을 보인다는것으로 가치는 인정받을수 있겠죠.

무무상 (jackyang) jackyang님의 미디어로그 가기  / 09-10-07 3:01/ 자국/ 신고/ 이댓글에댓글달기
Gpu도 듀얼코어가 나오기 시작하는군요. 그러나 결국은 가야할길이긴 한듯 보이네요.
메이알 / 09-10-14 1:02/ 자국/ 신고/ 이댓글에댓글달기
와, 이렇게 가다가 CPU와 GPU가 통합된 하나의 코어가 보드에 박힌채로 나오는건 아닌지 모르겠네요.
닉네임 웹봇방지

홈으로 탑으로
 
 
2026년 09월
주간 히트 랭킹

[결과발표] 2026년 2분기 포인트 소진 로또 13
[결과발표] 2026년 1분기 포인트 소진 로또 15
[결과발표] 2025년 4분기 포인트 소진 로또 17
[결과발표] 2025년 3분기 포인트 소진 로또 16
[결과발표] 2025년 2분기 포인트 소진 로 18

실시간 댓글
소셜 네트워크