Meta’s Infrastructure Team Needs A Culture Reset

Wayne Ma · SemiAnalysis · 2026년 7월 22일, 02:41 · ⏱ 17 분 소요  | Substack에서 읽기 ↗
요약
Meta의 인프라 조직 문화는 비효율적이며, 이로 인해 TCO를 악화시키고 AI 발전을 지연시키는 고비용의 과잉 설계된 하드웨어 결정이 내려지고 있습니다. Meta의 맞춤형 설계가 표준 SKU보다 열등하기 때문에 Nvidia가 반사이익을 얻고 있으나, Meta의 GenAI 팀(TBD)이 선호하지 않는 맞춤형 MI450 축소 모델로 인해 Meta 내 AMD의 물량 확보에는 리스크가 존재합니다.
  • Meta는 Rivos를 25억 달러 이상에 인수했으나 해당 GPU IP를 사용한 칩 개발을 취소했고, 이후 Rivos 엔지니어의 약 30%가 해고되었습니다.
  • Grand Teton은 Broadcom PCIe 스위치를 통해 추가 SSD를 탑재하여 비용과 복잡성을 높였으나, 스토리지 활용도가 낮아 결국 설계가 취소되었습니다.
  • Meta의 Ariel GB200 서버는 절반만 채워진 NVL36x2 구성을 사용하여 표준 NVL72 대비 TCO가 14% 증가했으며, 해당 SKU를 사용하는 유일한 고객이었습니다.
  • Meta의 맞춤형 AMD MI450은 표준 MI450X 대비 연산 및 HBM 성능이 절반으로 줄어들어 GenAI 워크로드에 매력적이지 않으며, TBD는 이에 관심이 없습니다.
  • Meta의 6개월 단위 스택 랭킹(stack ranking) 제도는 단기적인 사고방식을 강요하여 '윈도우 드레싱' 프로젝트와 잦은 피벗을 유발하고 공급업체들과의 관계를 악화시킵니다.
  • 공급망 팀은 엔지니어링에 대한 영향력이 거의 없으며, 이로 인해 부서 간 협업 설계가 아닌 정치적 의도에 따른 하드웨어 선택이 이루어집니다.
  • Meta의 하드웨어 로드맵은 소프트웨어만큼 빠르게 변경되어, 엔지니어들이 6개월 내에 폐기될 수 있는 프로젝트에 노력을 낭비하게 만듭니다.
  • 시스템이 RecSys와 GenAI를 모두 지원해야 한다는 Zuckerberg의 지시는 지켜지지 않았으며, Ariel 및 맞춤형 AMD 설계는 RecSys에 최적화되어 있으나 GenAI에는 악영향을 미칩니다.
읽는 시간 17 분
길이 17,112 자
카테고리 finance
아이디어
Wayne Ma Substack 작가, SemiAnalysis
커스텀 사양으로 성능을 낮춘(연산 및 HBM 절반) MI450에 대한 Meta의 요구는 해당 칩을 생성형 AI용으로 매력 없게 만들며, TBD는 이에 관심이 없습니다. TBD가 Nvidia의 제품을 선호할 것이기 때문에 이는 Meta에서 AMD의 물량을 완전히 무너뜨릴 수 있습니다.
커스텀 사양으로 성능을 낮춘(연산 및 HBM 절반) MI450에 대한 Meta의 요구는 해당 칩을 생성형 AI용으로 매력 없게 만들며, TBD는 이에 관심이 없습니다. AMD가 표준 MI450을 강제하지 않는 한, TBD는 Nvidia의 Rubin을 선호할 것이므로 이는 Meta에서 AMD의 물량을 완전히 무너뜨릴 수 있습니다. 리스크: AMD가 Meta를 설득하여 풀 사양 MI450을 채택하게 한다면 부정적인 입장은 반전될 수 있습니다. 해당 기사는 AMD가 '성인답게 행동하며(put on their big boy pants)' TBD와 협력할 것을 촉구합니다.
Wayne Ma Substack 작가, SemiAnalysis
본 기사는 Meta의 맞춤형 GB200(Ariel)이 경쟁사들이 구매한 표준 NVL72 대비 TCO가 14% 더 높고 성능이 떨어진다는 점을 상세히 다룹니다. 이는 Nvidia의 표준 SKU가 가진 우위를 입증하며, 벤더
본 기사는 Meta의 맞춤형 GB200(Ariel)이 경쟁사들이 구매한 표준 NVL72 대비 TCO가 14% 더 높고 성능이 떨어진다는 점을 상세히 다룹니다. 이는 Nvidia의 표준 SKU가 가진 우위를 입증하며, 하이퍼스케일러들에 대한 벤더 종속(vendor lock-in)을 강화합니다. 리스크: Meta가 조직 문화를 성공적으로 개선할 경우 향후 맞춤형 설계가 더 경쟁력을 갖출 수 있으나, 단기적으로는 Meta의 실책이 Nvidia에 수혜로 작용합니다.
Wayne Ma Substack 작가, SemiAnalysis
Grand Teton의 설계는 Broadcom PCIe 스위치(서버당 4개)에 대한 의존도를 높여 BOM, 전력 소비 및 복잡성을 증가시켰습니다. 비록 해당 설계는 취소되었으나, 이는 Broadcom 부품을 사용하려는 Meta의 의지를 보여줍니다.
Grand Teton의 설계는 Broadcom PCIe 스위치(서버당 4개)에 대한 의존도를 높여 BOM, 전력 소비 및 복잡성을 증가시켰습니다. 비록 해당 설계는 취소되었으나, 이는 Nvidia 네트워킹을 회피할 때 Broadcom 부품을 사용하려는 Meta의 의지를 보여줍니다. 리스크: Rivos IP 취소 사례에서 볼 수 있듯이, Meta의 잦은 피벗은 Broadcom 설계 채택 취소로 이어질 수 있습니다.
Wayne Ma Substack 작가, SemiAnalysis
Meta의 커스텀 AMD MI450은 12-Hi 대신 8-Hi HBM4를 사용하여 GPU당 HBM 탑재량이 적음을 시사합니다. 만약 Meta가 표준 MI450이나 Nvidia Rubin으로 전환할 경우, HBM 수요가 증가할 수 있습니다. 더 직접적으로는, 기사의 비판은
Meta의 커스텀 AMD MI450은 12-Hi 대신 8-Hi HBM4를 사용하여 GPU당 HBM 탑재량이 적음을 시사합니다. 만약 Meta가 표준 MI450이나 Nvidia Rubin으로 전환할 경우, HBM 수요가 증가할 수 있습니다. 더 직접적으로는, HBM을 절반으로 줄인다는 기사의 비판은 하이퍼스케일러들이 풀 HBM 스택을 선호할 가능성이 높음을 시사하며, 이는 Micron 및 SK하이닉스와 같은 HBM 공급업체에 호재가 될 것입니다. 리스크: HBM 공급 과잉 또는 가격 압박; Micron의 Meta에 대한 노출도는 공개되지 않음.
더 보기 SemiAnalysis

This newsletter, published July 22, 2026, features Wayne Ma discussing AMD, NVDA, AVGO, MU. 4 trade ideas extracted by AI with direction and confidence scoring.

Speakers: Wayne Ma  · Tickers: AMD, NVDA, AVGO, MU