엔비디아가 대규모 언어 모델의 가중치 배포를 앞당기는 '모델익스프레스(ModelExpress)'를 현지 시각 7월 24일 기술 블로그에서 공개했다. 딥시크 V4 프로 기준으로 이미 서비스 중인 복제본에서 새 복제본으로 가중치와 커널 캐시를 10초 안에 전송해, 전체 기동 ...
자세한 내용은 원문에서 확인하세요.
아직 댓글이 없습니다.