OpenAI는 2026년 6월, Broadcom을 설계 파트너로 한 자체 실리콘 개발을 공식 확인했다. 칩 이름은 Jalapeño이며, 보드와 랙 통합은 Celestica가 담당한다. 공개된 대화에 따르면 이 칩은 추론 작업 전체를 위한 단일하고 균형 잡힌 부품으로 설계됐다. 최근 업계가 prefill, speculative decode, full decode를 서로 다른 전용 하드웨어로 나누는 흐름과 달리, Jalapeño는 데이터센터 안에서 동일한 형태로 통합되는 구성을 택했다.

또 하나의 특징은 칩 설계 과정에 OpenAI의 내부 모델을 직접 활용했다는 점이다. 적용 범위는 연산 구조 설계, 제한된 면적 안에 회로를 배치하는 작업, 그리고 하드웨어에 맞춘 커널 사후 최적화까지 포함된다. 원문에 따르면 한 attention 구현은 약 40시간 만에 메모리·연산 지붕선 활용도가 1% 미만에서 거의 90% 수준으로 올라갔다. 이 사례는 AI 모델이 반도체 설계와 저수준 최적화에도 쓰이기 시작했음을 보여준다.