오늘의 미국주식
장마감
로그인 회원가입

GLM-5 모델 시리즈의 메모리 효율 및 추론 비용 분석

Semianalysis ·

AMD Advanced Micro Devices Inc
$645.86 -0.55%
차트·분석 보기 →
  1. 1SGLang 팀은 계층적 메모리 시스템인 HiSparse를 설계했다.
  2. 2GB200의 총 11,873개 토큰 대비 GB300의 17.5% 처리량 우위가 확인됐다.
  3. 3Z.ai는 GLM-5.2에서 IndexShare(또는 IndexCache)를 제안했다.

그래서 핵심이 뭔가요?

SGLang 팀이 메모리를 효율적으로 쓰는 시스템을 만들었어요. GB300이 GB200보다 처리량이 17.5% 더 높게 나타났어요.

출처 Semianalysis · 원문 보기 ↗

오늘의 AI 픽 5종목, 무료로 전부 공개합니다
숨기는 것 없이, 지난 픽의 성적표(S&P500 대비)까지 그대로 보여드립니다.
오늘의 픽 보기 →