Z.ai, 이미지 인식 가능한 GLM-5.3-Flash 출시… GLM-5.2 대비 약 10배 저렴
MoE 아키텍처 기반 신규 오픈 모델, 이미지 및 비디오 지원과 100만 토큰 컨텍스트 윈도우 제공
Zhipu AI의 글로벌 브랜드 Z.ai가 2026년 8월 26일 GLM-5.3-Flash를 공식 출시했다. 성능은 높이면서도 GLM-5.2 대비 이용 비용을 약 10배 절감한 중형 모델로 포지셔닝했다.
이 모델은 작업에 따라 모델의 특정 부분만 활성화하는 MoE(Mixture-of-Experts) 아키텍처를 채택했다. 총 파라미터는 320B이지만 토큰당 실제 활성화 파라미터는 18B에 불과해 연산 자원을 절감한다. 공개된 벤치마크 테스트 결과에 따르면 GLM-5.3-Flash는 여러 항목에서 GLM-5.2보다 전반적으로 우수한 성능을 기록했다.
주요 변화는 별도의 모델 없이도 이미지와 비디오를 모두 처리할 수 있는 멀티모달(Multimodal) 기능이다. 일반적인 대화 및 코딩 외에도 화면 분석, 이미지 문서 분석, 웹사이트 시각적 요소 분석 등의 작업에 적합하다.
또한 GLM-5.3-Flash는 100만 토큰의 컨텍스트 윈도우(Context Window)를 지원하여 방대한 문서나 코드를 한 번에 처리할 수 있다. 다만 지원하는 컨텍스트 크기가 크다고 해서 모델이 모든 세부 정보를 동일한 정확도로 기억하고 활용한다는 의미는 아니다.
정식 출시 전 이 모델은 OpenRouter 및 OpenCode를 통해 'Ox Alpha'라는 익명으로 시험 운영된 바 있다. 아울러 초기부터 중국산 AI 칩을 지원하도록 설계되어 해외 하드웨어 의존도를 낮추려는 노력을 반영했다.
Z.ai는 MIT 라이선스 하에 모델 가중치를 오픈 웨이트(Open Weights) 형태로 공개하여, 개발자와 기업이 라이선스 조건에 따라 연구, 미세조정(파인튜닝) 또는 자체 시스템 배포를 진행할 수 있도록 했다.
비용이 약 10배 절감되고 가중치가 공개된 모델은 이미지 인식이나 대용량 데이터 처리가 필요한 태국 개발자들에게 폐쇄형 모델에만 의존하지 않는 새로운 선택지가 될 수 있다. 다만 실제 도입 전 태국어 정확도와 실제 작업 적합성을 테스트해야 한다.