BTC $78,699.11 -0.32%
ETH $2,492.06 +1.50%
BNB $704.80 +1.09%
XRP $1.40 -3.06%
SOL $100.29 +3.06%
TRX $0.3360 -0.22%
DOGE $0.0866 -0.37%
ADA $0.2102 -0.89%
BCH $266.31 -0.12%
LINK $11.53 +1.20%
HYPE $81.68 +1.65%
AAVE $126.24 -0.73%
SUI $0.7508 -1.91%
XLM $0.1828 -1.25%
ZEC $815.47 +3.93%
BTC $78,699.11 -0.32%
ETH $2,492.06 +1.50%
BNB $704.80 +1.09%
XRP $1.40 -3.06%
SOL $100.29 +3.06%
TRX $0.3360 -0.22%
DOGE $0.0866 -0.37%
ADA $0.2102 -0.89%
BCH $266.31 -0.12%
LINK $11.53 +1.20%
HYPE $81.68 +1.65%
AAVE $126.24 -0.73%
SUI $0.7508 -1.91%
XLM $0.1828 -1.25%
ZEC $815.47 +3.93%

groq

전체
뉴스 플래시

first_img 엔비디아는 Groq 랙의 전면 생산을 발표했으며, Nebius에 배치될 예정이다

엔비디아의 고위 이사인 Dion Harris는 현지 시간으로 월요일에 Groq 3 LPX 랙이 전면 양산 단계에 들어섰으며, 새로운 클라우드 서비스 제공업체 Nebius의 데이터 센터에 배치될 예정이라고 발표했습니다. 이 조치는 엔비디아가 지난해 12월 Groq와 약 200억 달러 규모의 기술 라이센스 거래를 체결한 후 획득한 기술이 공식적으로 상용화됨을 의미하며, 여러 Groq 핵심 직원들이 엔비디아에 합류하였고, 창립자인 Jonathan Ross가 엔비디아의 수석 소프트웨어 아키텍트로 임명되었습니다.엔비디아는 Groq 칩의 생산을 가속화하고 고객에게 제품을 제공하고 있으며, 낮은 지연 시간 추론의 중요성을 강조하고 있습니다. 올해 3월에 출시된 Groq 3 LPX는 Vera Rubin 플랫폼 추론 가속기로, 칩 다이 위에 500MB의 고속 SRAM을 통합하여 메모리 병목 현상을 줄입니다. 각 LPX 랙은 256개의 Groq 3를 통합할 수 있으며, 엔비디아는 벤치마크 테스트를 인용하여 초당 3400개의 토큰을 처리할 수 있다고 밝혔습니다. 이 칩은 삼성에서 제조되었습니다.Harris는 낮은 지연 시간 칩이 GPU를 대체하는 것이 아니라, 작업 부하의 다양한 단계에 적합한 프로세서를 사용하는 것이라고 말했습니다. 클라우드 서비스 제공업체는 지연에 민감한 사용자에게 더 높은 요금제를 제공할 수 있습니다. 엔비디아 CEO인 황仁勋은 프로그래밍 애플리케이션을 위한 데이터 센터 공간의 약 4분의 1을 Groq 칩에 할당할 계획이며, 나머지 부분은 Vera Rubin 시스템을 사용할 예정입니다. 또한 2027년까지 Blackwell과 Vera Rubin의 누적 매출이 1조 달러에 이를 것으로 예상하고 있습니다.

엔비디아: SpaceXAI는 Vera CPU 가속 에이전트 기반 AI를 배포하고 Vera Rubin 플랫폼을 우주 기반 컴퓨팅으로 확장할 것입니다

엔비디아 공식 발표에 따르면, SpaceXAI는 차세대 에이전트 AI 애플리케이션을 가속화하기 위해 엔비디아 Vera CPU를 배포할 예정이다. Vera는 AI 에이전트를 위해 특별히 설계된 최초의 CPU로, 88개의 엔비디아 자체 개발 Olympus 코어를 갖추고 있으며, 공간 다중 스레딩 기술과 LPDDR5X 고대역폭 메모리를 사용하여 대역폭이 1.2TB/s에 달한다. 에이전트 AI, 강화 학습 및 데이터 처리와 같은 시나리오에서 x86 CPU에 비해 작업 완료 속도가 최대 1.8배 향상될 수 있다.SpaceXAI의 사장 Mike Nicolls는 Vera의 CPU 성능과 메모리 대역폭이 대규모 작업 조정, 코드 실행 및 데이터 처리를 지원할 수 있어 GPU가 가장 효율적으로 작동하게 하여, 와트당 계산에서 더 많은 유효 출력을 얻을 수 있다고 말했다.SpaceXAI는 또한 NVIDIA Vera Rubin 플랫폼을 기반으로 Grok 뒤에 있는 AI 인프라를 확장하여 기가와트급 계산 용량으로 나아갈 계획이다. Vera Rubin은 엔비디아 가속 계산, NVLink 연결, Spectrum-X 네트워크 및 BlueField 데이터 처리 기술을 통합하여, 각 토큰 비용을 낮추고 AI 공장의 전체 에너지 효율성을 향상시키는 것을 목표로 한다.더욱 주목할 만한 것은 SpaceXAI가 최적화된 Vera Rubin NVL72 시스템을 우주로 보낼 것이며, 첫 번째 세대 Starmind AI 위성이 이 랙급 아키텍처를 채택하여 엔비디아 가속 계산이 지상 데이터 센터에서 궤도 계산으로 확장되는 첫 번째 상징적인 배치가 될 것이라는 점이다.
app_icon
ChainCatcher Building the Web3 world with innovations.