중국 앤트그룹(Ant Group) 산하 InclusionAI가 언어모델 Ling-3.1-flash를 공개했다. 전체 파라미터는 5,600억 개다. 토큰 하나를 처리할 때 실제로 쓰는 활성 파라미터는 약 250억 개다.

규모와 활성 파라미터 비교

▼ Ling-3.1-flash 핵심 수치 (출처: IT Home 보도)

항목수치
전체 파라미터 (개)5,600억
토큰당 활성 파라미터 (개)약 250억
설계상 컨텍스트 (토큰)최대 100만
현재 체험 컨텍스트 (토큰)25만 6,000

전체 규모와 실제 연산에 쓰는 규모는 다르다. 전체 5,600억 개 가운데 토큰 하나당 동원되는 것은 약 250억 개다. 모델을 비교할 때 두 숫자를 나눠 봐야 하는 이유다.

겨냥한 분야

InclusionAI는 이 모델을 네 분야에 내세운다.

  • 에이전트 작업
  • 검색
  • 오피스 소프트웨어
  • 전문 분야 응용

컨텍스트와 공개 일정

설계상 컨텍스트 창은 최대 100만 토큰이다. 하지만 지금 진행 중인 2주간 무료 체험에서는 25만 6,000토큰까지만 쓸 수 있다. InclusionAI는 체험이 끝나면 더 큰 창을 열고 모델을 오픈소스로 공개할 계획이라고 밝혔다.