OpenAI Jalapeño 칩은 Nvidia의 비즈니스에 영향을 미치는 약속으로 추론을 터뜨립니다.
작업의 핵심
- OpenAI는 최초의 Jalapeño 수확량 데이터를 공개합니다. 회사는 이 칩이 다른 AI 시스템보다 추론 작업을 더 효율적으로 완료하고 더 빠른 응답을 반환한다고 주장합니다.
- Broadcom이 ASIC 제조 파트너로 계약했습니다. Jalapeño는 이미 훈련된 모델을 실행하고 에이전트를 배포하도록 설계된 애플리케이션별 IC입니다.
- 움직임은 법안과 협상력을 가리킨다. 추론에 대한 Nvidia의 의존도를 줄이면 운영 비용이 절감되고 AI 하드웨어의 균형이 깨질 수 있습니다.
AI 추론의 효율성 향상
OpenAI 성명에 따르면 Jalapeño는 다른 인공 지능 시스템보다 뛰어난 효율성으로 추론 작업을 완료하고 더 빠른 응답을 반환합니다. 개발은 Broadcom과 협력하여 진행되었습니다.
OpenAI의 하드웨어 부사장인 Richard Ho는 이 칩이 낮은 대기 시간과 동시에 더 높은 성능이라는 특이한 균형을 이루고 있다고 설명했습니다. 대부분의 AI 시스템에서는 이러한 변수 중 하나를 최적화하면 다른 변수에는 불이익이 발생합니다.
이 칩은 6월에 출시되었으며 이미 훈련된 모델이 작업을 실행하거나 에이전트를 배포하는 단계인 추론을 위해 특별히 설계되었습니다. 대량 모델 훈련의 직접적인 경쟁자는 아닙니다.그러나 생산비의 상당 부분을 설명하는 일상적인 작업에 대한 것입니다.
여기에는 전략적 긴장이 존재합니다. AI 하드웨어 분야에서 Nvidia의 지배력은 훈련용 GPU와 CUDA 소프트웨어 생태계를 통해 뒷받침됩니다. OpenAI가 추론의 일부를 자체 ASIC으로 전환하면 서비스 비용이 줄어들고 Nvidia에 대한 협상력이 변경됩니다.
싸움은 단지 모델을 훈련하는 것이 아니라 단일 공급업체에 의존하지 않고 수익성 있게 서비스를 제공하는 것입니다.
Nvidia의 법안 위반에 대한 OpenAI의 베팅
추론 비용을 줄이는 것이 수익성의 지렛대입니다.. OpenAI 모델이 제공하는 각 요청은 인프라를 소비합니다. 독점 칩은 이러한 비용을 절감하고 자율 에이전트의 확장을 가속화할 수 있습니다.
Broadcom은 산업 파트너로서 이 계획에 계속 전념하고 있습니다. 제조업체는 Google 및 Meta와 같은 대규모 고객을 위해 ASIC 시장에서 입지를 확보했습니다. OpenAI를 사용하면 대규모 생산 요구 사항과 업계 최대 규모의 컴퓨팅 비용을 가진 파트너를 추가할 수 있습니다.
작은 글씨가 중요합니다. OpenAI가 게시한 벤치마크에는 독립적인 검증이 부족하며 회사는 특정 Nvidia 모델과의 자세한 비교를 제공하지 않습니다.
스페인은 반도체 장벽에서 경기를 관전한다
스페인은 전문 반도체를 기술 구매자로 따라갑니다.. 이 나라에는 엔비디아에 필적할 만한 AI 칩 설계자가 없지만 공공 부문과 대기업은 이 인프라에 의존하는 클라우드 서비스를 소비합니다. 추론 비용 절감은 은행, 통신, 산업 분야에 AI를 통합하는 기업의 송장에 직접적인 영향을 미칩니다.
PERTE Chip과 슈퍼컴퓨팅 센터는 로컬 역량 구축을 시도했습니다. 그럼에도 불구하고 미국, 대만과의 거리는 여전히 구조적이다. 우리는 OpenAI 운동을 유럽의 디지털 주권을 조건으로 하는 글로벌 공급망에 대한 또 다른 타격으로 분석합니다.
시장은 할라피뇨가 대규모로 배치되면 실제 용량을 확인할 것이다. 날짜는 확정되지 않았으며 다음 이정표는 OpenAI가 서비스 품질을 저하시키지 않고 추론의 상당 부분을 칩 자체로 옮기는지 확인하는 것입니다.
감사된 숫자를 볼 수 있습니다.
