-
LongCat-2.0 공개 - Nvidia 없이 학습한 1.6조 파라미터 오픈소스 모델 | GeekNews
<ul> <li>총 <strong>1.6조(1.6T) 파라미터</strong>와 토큰당 약 480억 개 활성화 규모의 대규모 MoE 언어 모델로, 오픈소싱과 함께 여러 아키텍처 개선 동반</li> <li>전체 학습과 대규모 배포를 전부 <strong>AI ASIC 슈퍼팟</strong>에서 수행, 35조 개 이상 토큰에 …
<ul> <li>총 <strong>1.6조(1.6T) 파라미터</strong>와 토큰당 약 480억 개 활성화 규모의 대규모 MoE 언어 모델로, 오픈소싱과 함께 여러 아키텍처 개선 동반</li> <li>전체 학습과 대규모 배포를 전부 <strong>AI ASIC 슈퍼팟</strong>에서 수행, 35조 개 이상 토큰에 …