AI 모델 및 플랫폼
GLM-5.3, 인공분석 인텔리전스 인덱스에서 60점 기록, Kimi K3와 동등

Z.ai의 GLM-5.3은 인공분석에 의해 평가됨으로 인텔리전스 인덱스에서 60점을 받았으며, 독립 평가자는 2026년 8월 18일에 이를 보고했습니다. 이는 중국 연구소의 최신 추론 모델이 Moonshot AI의 Kimi K3와 동등한 수준이며, 현재 63점으로 1위에 오른 Anthropic의 Claude Opus 5보다 3점 낮은 것입니다.
이 점수는 GLM-5.3이 최대 추론 노력을 적용한 상태를 기준으로 하며, 이는 Z.ai가 코딩 작업에 권장하는 설정입니다. 60점은 동일 비교군에 속한 181개 모델의 중간값 35점을 크게 웃으며, 전체 순위에서는 8위를 차지합니다.
이 결과는 2026년 8월 14일에 Z.ai가 출시한 모델에 대한 첫 번째 독립적인 평가이며, 이 모델은 특이한 구조를 가지고 있습니다: GLM-5.3은 GLM-5.2와 동일한 기본 모델을 사용하고, 모든 능력 향상이 새로운 사전학습이 아닌 사후 학습을 통해 이루어졌습니다.
GLM-5.3이 여기까지 온 과정
Z.ai의 릴리스 포스트는 장기 과제 환경에서 강화 학습을 한 달간 확장한 내용을 설명합니다: 환경 수 증가, 과제 다양성 확대, 컴퓨팅 파워 증가—all 모두 연구소가 GLM-5.2를 위해 구축한 학습 스택에서 이루어졌습니다. 회사는 이 접근법을 통해 Terminal-Bench 3.0을 4.6에서 28.3으로, DeepSWE v1.1을 46.2에서 66.9로 끌어올렸으며, 자체 포스트에서는 코딩, 사이버보안, 에이전트 벤치마크에서 Kimi K3, Claude Opus 4.8, Claude Fable 5, 그리고 GPT-5.6 Sol과 비교한 다양한 결과를 문서화했습니다. Unite.AI는 출시와 함께 나타난 사이버보안 결과를 상세히 다루었으며, 모델이 지난 주에 출시되었을 때 이를 보도했습니다.
인공분석의 수치는 벤더가 자체 보고한 표와는 다른 무게를 가집니다. 평가자는 자체 스위트를 직접 실행하기 때문입니다. 인텔리전스 인덱스 v4.1.1은 에이전트 기반 실제 업무 과제, 에이전트 도구 사용, 터미널 코딩, 과학적 추론 및 지식, 대학원 수준 과학 질문, 물리학 추론, 지식 신뢰성 및 환각, 장기 컨텍스트 추론 등 아홉 가지 평가를 종합합니다. GLM-5.3의 60점은 이 배터리 전반에 걸친 실행 결과를 종합한 것이며, Z.ai API에서 총 평가 비용은 $1,238.50였습니다.
GLM-5.3이 순위표에서 차지하는 위치
동일 60점이라는 결과가 가장 큰 헤드라인 비교입니다. 2026년 7월 16일에 출시된 Kimi K3도 인덱스에서 동일한 60점을 기록했으며, 인공분석 순위에서 최고 점수를 받은 오픈-웨이트 모델으로 남아 있습니다. GLM-5.3은 라이선스 측면에서는 다르지만 점수 면에서는 동일합니다. Moonshot은 수익 기반 라이선스 하에 Kimi K3의 가중치를 공개했으며, 현재 GLM-5.3은 아직 독점 모델로 분류되고, 인공분석은 모델의 파라미터 수를 7530억 개로 기록했습니다.
2026년 7월 24일에 출시된 Claude Opus 5는 여전히 인덱스 1위인 63점을 유지하고 있습니다. GLM-5.3과 리더 간의 3점 차이는 빠른 사후 학습 사이클이 메우지 못한 거리이며, 이는 봄 이후 변해온 최전선과도 관련이 있습니다.
가격 측면에서 두 60점 모델은 크게 차이를 보입니다. GLM-5.3은 Z.ai API에서 입력 토큰 백만 개당 $1.40, 출력 토큰 백만 개당 $4.40을 청구하는 반면, Moonshot의 Kimi K3는 각각 $3.00과 $15.00을 부과합니다. 인텔리전스 인덱스 작업당 비용으로 환산하면 GLM-5.3은 $0.68, Kimi K3는 $0.84, Claude Opus 5는 $2.34가 됩니다. 세 모델 중 GLM-5.3이 가장 낮은 비용으로 동일 점수를 달성했지만, 출력 토큰 양이 가장 많아 평가 스위트 전체에서 1억 7천만 개의 출력 토큰을 생성했으며, 동일 클래스의 중간값 7200만 개보다 크게 초과했습니다.
다음에 출시될 내용
GLM-5.3은 Z.ai API를 통해 제공되며, 모든 GLM Coding Plan 구독자에게 배포되었습니다. 이 모델은 ‘thinking’ 기능을 활성화해야 사용 가능하며, 세 가지 노력 수준을 제공합니다. Z.ai는 ‘thinking’이 비활성화된 상태로 호출되는 애플리케이션은 마이그레이션이 완료될 때까지 작동하지 않을 것이라고 경고합니다.
가중치가 남은 마지막 요소입니다. Z.ai는 2026년 8월 14일 출시 두 주 후, 안전성 평가와 강화 작업이 완료되는 시점에 가중치를 공개하겠다고 약속했습니다. 이렇게 되면 GLM-5.3은 Kimi K3와 함께 인덱스 60점 구간에서 오픈-웨이트 옵션으로 제공되며, 토큰당 가격은 대략 절반 수준이 됩니다.












