뉴스
 








 
 
 




전송 2023-11-10 10:40
[뉴스/보도자료]

인텔 가우디 가속기, FP8 소프트웨어로 GPT-3에서 두 배 높은 성능 제공

인텔은 오늘 ML커먼스가 인텔 가우디2(Intel Gaudi2) 가속기 및 인텔 어드밴스드 매트릭스 익스텐션(Intel AMX)이 탑재된4세대 인텔 제온 스케일러블 프로세서(4th Gen Intel Xeon Scalable processors)의AI 모델 학습에 대한 업계 표준 MLPerf 트레이닝(MLPerf Training) v3.1 벤치마크 측정 결과를 발표했다고 밝혔다. 인텔 가우디2는 v3.1 학습 GPT-3 벤치마크에서 FP8 데이터 유형을 적용해 두 배 높은 성능을 보여줬다.

 

최신 ML커먼스의 MLPerf 결과는 지난 6월 발표한 MLPerf 트레이닝 결과보다 강력한 인텔의 AI 성능을 기반으로 한다. 인텔 제온 프로세서는 MLPerf 결과를 제출하는 유일한 CPU이며, 인텔 가우디2는 테스트 결과 기준으로 세 가지 가속기 솔루션 중 하나로, 이 중 두 가지 솔루션만 현재 구매 가능하다.

인텔 가우디2 및 4세대 제온 프로세서는 다양한 하드웨어 구성으로 우수한 AI 학습 성능을 입증해 점점 더 다양해지는 고객의 AI 컴퓨팅 요구 사항을 해결할 수 있다.

인텔 가우디2 결과: 가우디2는 AI 컴퓨팅 요구사항에 있어 엔비디아의 H100을 대체할 수 있는 유일한 대안으로 가격 대비 뛰어난 성능을 제공한다. 가우디2에 대한 MLPerf 결과는 AI 가속기의 학습 성능이 향상되었음을 입증한다.

가우디2는 FP8 데이터 유형 구현으로 v3.1 학습 GPT-3 벤치마크에서 두 배의 성능 향상을 보였다. 6월 MLPerf 벤치마크 대비 학습 시간이 절반 이상으로 단축됐으며, 384개의 인텔 가우디2 가속기를 사용해 153.38분 만에 학습을 완료하기도 했다. 가우디2 가속기는 E5M2 및 E4M3 형식 모두에서 FP8을 지원하며 필요 시 지연 스케일링 옵션도 제공한다.
인텔 가우디2는 BF16을 사용해 20.2분 만에 64개의 가속기로 스테이블 디퓨전(Stable Diffusion) 멀티모달 모델에 대한 학습을 시연했다. 향후 MLPerf 트레이닝 벤치마크에서는 FP8 데이터 유형에 대한 스테이블 디퓨전 성능이 제출될 예정이다.
8개의 인텔 가우디2 가속기에서 BERT와 ResNet-50에 대한 벤치마크 결과는 각각 BF16을 사용하여 13.27분과 15.92분을 나타냈다.

4세대 제온 결과: 인텔은 MLPerf 결과를 제출한 유일한 CPU 벤더다. 4세대 제온에 대한 MLPerf 결과는 제온의 강력한 성능을 강조한다.

인텔은 RESNet50, RetinaNet, BERT 및 DLRM dcnv2에 대한 결과를 제출
4세대 인텔 제온 스케일러블 프로세서의 ResNet50, RetinaNet 및 BERT에 대한 결과는 2023년 6월 MLPerf 벤치마크에 제출된 강력한 기본 성능 결과와 유사
DLRM dcnv2는 6월에 제출된 새로운 CPU 모델, 4개의 노드만 사용해 227분의 학습 시간을 기록

4세대 제온 프로세서의 성능을 통해, 많은 엔터프라이즈 기업이 범용 CPU를 사용하여 기존 엔터프라이즈 IT 인프라에서 중소 규모의 딥 러닝 모델을 경제적이고 지속적으로 학습할 수 있으며, 특히 학습이 간헐적인 워크로드인 사용 사례에 적합하다.

인텔은 소프트웨어 업데이트 및 최적화를 통해 향후 MLPerf 벤치마크에서 AI 성능 결과가 더욱 향상될 것으로 예상하고 있다. 인텔의 AI 제품은 고객에게 성능, 효율성 및 유용성을 요구하는 동적인 요구 사항을 충족하는 AI 솔루션에 대한 더 많은 선택지를 제공한다.

  태그(Tag)  : 인텔, AI, CPU
관련 기사 보기
[영상] ASUS의 창신메모리 호환성 지원이 미치는 영향 등, PC시장 흐름 파악에 필요한 작은 뉴스모음
[영상] 그래픽카드 가격 폭등 시대에 라데온 9050 출시하는, AMD의 PC시장 CPU와 GPU 전략 평가
[영상] PC 오버클럭 히스토리 총망라한, PC 흥망사 통합본 오버클럭 특집(1-4편)
[영상] 인텔 2분기 실적과 향후 전망, 그리고 최신 뉴스를 정리해드립니다
[영상] AI 에이전트의 핵심 서버 CPU 흥망사, 메인프레임과 워크스테이션 시대 [PC흥망사 18-1]
[영상] NVIDIA RTX SPARK는 인텔과 AMD의 X86 노트북 시장을, AI를 무기로 정복할 수 있을까?
태그(Tags) : 인텔, AI, CPU     관련기사 더보기

  편집부 / 필명 편집부 / 편집부님에게 문의하기 press@bodnara.co.kr
기자가 쓴 다른 기사 보기

Creative Commons License 보드나라의 기사는 저작자표시-비영리-변경금지 2.0 대한민국 라이선스에 따라 이용할 수 있습니다. Copyright ⓒ 넥스젠리서치(주) 보드나라 미디어국
이기사와 사진은 업체에서 제공받은 보도자료와 사진으로, 보드나라의 논조와는 다르다는 점을 알려드립니다.
싸이월드 공감 기사링크 퍼가기 기사내용 퍼가기 이 기사를 하나의 페이지로 묶어 볼 수 있습니다. 출력도 가능합니다.
홈으로 탑으로
보드나라 많이본 기사
RTX 30 시리즈도 DLSS 5 구동 가능, 정상적 실행 불가 수준 성능
MSI, RTX 50 노트북 구매 고객에 ‘컨트롤 레조넌트’ 증정
엔비디아, RTX 50 시리즈 전력 제한 해재 오버클럭 차단?
이엠텍, PALIT 지포스 RTX 50 게이밍 PC 단 1시간 G마켓 라이브 특가 진행
메인스트림 게이머의 심리적 마지노선 가격 모델, 라데온 RX 9070 GRE vs RTX 5070 성능 비교
미야모토 무사시 검의 길을 밝힐 선택은?, 귀무자 검의 길 CPU 6종 벤치마크
애플의 가변 조리개와 폴더블 스마트폰, 아이폰 18 Pro 시리즈 및 아이폰 듀오 공개
비싸진 SSD 어떻게 고를까?, 가격 상승기 SSD 선택 가이드
   이 기사의 의견 보기
트위터 베타서비스 개시! 최신 PC/IT 소식을 트위터를 통해 확인하세요 @bodnara

기자의 시각이 항상 옳은것은 아닙니다. 나머지는 여러분들이 채워 주십시요.

2014년부터 어려운 이야기를 쉽게 하는 것으로 편집방침을 바꿉니다.
닉네임 웹봇방지

홈으로 탑으로
 
 
2026년 09월
주간 히트 랭킹

[결과발표] 2026년 2분기 포인트 소진 로또 13
[결과발표] 2026년 1분기 포인트 소진 로또 15
[결과발표] 2025년 4분기 포인트 소진 로또 17
[결과발표] 2025년 3분기 포인트 소진 로또 16
[결과발표] 2025년 2분기 포인트 소진 로 18

실시간 댓글
소셜 네트워크