TL;DR. 닫힌 프런티어(Claude·OpenAI·Google) 바깥에서 본체 모델을 내놓는 랩들의 자리. 2026년 6~8월에 넷이 연달아 들어왔다 — Kimi K3(Moonshot, 07-16) · Qwen3.8-Max(Alibaba, 08-03) · GLM 5.2(Z.ai, 06-14) · Grok 4.6(xAI, 08-12). 능력은 이미 같은 구간이다 — AA 지능 지수 톱6에 이 카테고리가 셋이고, 그중 둘이 GPT-5.6 Sol보다 위다. 단정 하나 — 분기는 벤치가 아니라 개방의 조건에서 일어나고, 그 조건은 열림·시차 개방·닫힘 셋으로 갈린다.
이 자리를 뭐라 부르나
정의 — models의 벤더 칸 중, 닫힌 프런티어 세 곳(Anthropic·OpenAI·Google)에 속하지 않는 본체 모델들의 묶음. 가중치 공개 여부가 아니라 벤더가 기준이다 — Grok 4.6은 가중치가 닫혀 있지만 여기 들어온다. 개방은 진입 조건이 아니라 이 카테고리 안에서 모델을 가르는 축이다.
벤더별로 나누지 않고 한 칸에 모으는 이유 — 랩이 넷인데 벤더 페이지를 넷 만들면 각 칸에 모델이 하나씩 남는다. 이들을 실제로 비교하는 축은 벤더가 아니라 개방의 조건과 가격이라, 한 자리에 놓고 줄세우는 편이 맞다.
스택
| 모델 | 랩 | 개방 | 라이선스 | AA 지능 지수 | 가격(입력/출력) |
|---|---|---|---|---|---|
| Kimi K3 | Moonshot AI | 열림 (07-27) | Kimi K3 License (자체, 관대) | 59.7 (전체 4위) | $3 / $15 |
| Qwen3.8-Max | Alibaba | 열림 (08-12) | qwen3.8-max (자체, OSI 아님) |
58.1 (전체 6위) | 미확인 |
| GLM 5.2 | Z.ai (구 Zhipu) | 열림 (06-14) | MIT | 톱10 밖 | $1.4 / $4.4 |
| Grok 4.6 | xAI | 시차 | proprietary (이전 세대만 사후 공개) | 60.9 (전체 3위) | $2 / $6 |
AA 지능 지수는 2026-08-15 스냅샷 기준. AA 자체 기사(v4.1)의 Kimi K3 57·GLM 5.2 51과 지수 버전이 달라 세대 간 비교에는 쓰지 않는다. 넷 중 셋이 전체 톱6 안에 있고, Grok 4.6은 3위이면서 이 표에서 가장 싸다.
네 모델의 강약은 각 단독 글에서 1차 출처로 받친다.
- Grok 4.6 — 종합 3위를 유지하며 프런티어 구간에서 가장 싸다(출력 $6). 단 가중치가 닫혀 있고 컨텍스트가 500K로 절반이다.
- Kimi K3 — 2.8T MoE·1M 컨텍스트·네이티브 비전. 열린 것 중 능력이 가장 높고 공개 가중치 중 가장 크다. 대신 열린 셋 중 가장 비싸다.
- Qwen3.8-Max — 2.4T MoE로 Max 티어를 처음 열었다. 단 공개 체크포인트가 API 모델과 다르다.
- GLM 5.2 — 능력은 아래지만 MIT에 가장 싸다. 라이선스 리스크를 0으로 두고 싶으면 여전히 이 자리.
진짜 갈림은 능력이 아니라 개방의 조건
데모는 넷 다 된다. 도입에서 갈리는 축은 셋이다.
축 1 — 개방은 이분법이 아니라 세 포지션이다. "열렸나 닫혔나"로 물으면 이 카테고리가 안 갈린다. 실제로는 셋이다.
| 포지션 | 모델 | 지금 받을 수 있나 | 도입 의미 |
|---|---|---|---|
| 열림 | Kimi K3 · Qwen3.8-Max · GLM 5.2 | 받는다 | 접근 회수가 구조적으로 불가 |
| 시차 개방 | Grok 4.6 | 못 받는다. 다음 세대 때 이전 세대가 열릴 수 있다 | 계획의 근거로 쓸 수 없다 |
| 닫힘 | Claude · OpenAI · Google | 안 열린다 | 벤더·규제에 접근이 묶인다 |
가운데 항이 중요하다. xAI는 Grok-1을 2024-03에 Apache 2.0으로, Grok 2 계열을 2025년에 열었다 — 관행은 실재한다. 그러나 일정을 벤더가 정하고, 열렸을 때 라이선스가 OSI 표준이 아니었다(2025-08 Grok 2.5는 반경쟁 조항 포함 자체 라이선스). 언젠가 열린다는 도입 계획의 근거가 못 된다.
축 2 — 열린 셋 안에서도 라이선스가 세 갈래로 벌어진다. 오픈웨이트가 한 덩어리라는 전제가 여기서 깨진다. GLM 5.2는 MIT다(HF 카드) — 표준 OSI라 법무 검토가 사실상 끝나 있다. Kimi K3는 Kimi K3 License로, 수정 MIT 계열의 관대한 자체 라이선스지만 OSI 승인은 아니다. Qwen3.8-Max는 qwen3.8-max 라는 자체 라이선스를 달았다(HF 카드). 셋 다 가중치를 받을 수 있지만, 받아서 무엇을 할 수 있는가는 같지 않다. 기업 도입에서는 이 축이 벤치 3점 차이보다 먼저 걸린다.
축 3 — 공개 체크포인트가 API 모델과 같은 물건이 아니다. Qwen3.8-Max가 이 축을 드러냈다. API의 Qwen3.8-Max는 텍스트·이미지·영상 입력에 1M 컨텍스트로 소개됐는데, 실제 공개된 Qwen/Qwen3.8-2.4T-A95B 카드는 텍스트 전용이고("Multimodal inputs are not supported"), 컨텍스트도 네이티브 262,144에 확장 시 ~1,010,000이다. 즉 벤치를 보고 고른 모델과 다운로드한 모델이 같지 않을 수 있다. 가중치 공개 여부만 보고 "같은 걸 받는다"고 읽으면 틀린다 — 모델 카드의 modality·컨텍스트를 API 스펙과 대조하는 게 이 카테고리의 필수 절차가 됐다.
가격이 두 번째 본체 축이다
능력이 수렴하면 남는 건 가격인데, 이 카테고리가 그 축을 가져갔다. models 표에서 종합 상위 넷의 출력 단가를 나란히 놓으면 갈린다 — Fable 5 $50, Opus 5 $25, Kimi K3 $15, Grok 4.6 $6. 종합 3위 모델의 출력가가 1위의 1/4이고, GLM 5.2는 $4.4로 그보다도 싸다.
단 토큰 단가가 아니라 태스크당 비용으로 재야 한다. GLM 5.2는 verbose해서 AA 기준 태스크당 $0.32, Kimi K3는 $0.94다 — 토큰 단가 차이(약 2배)보다 태스크당 차이(약 3배)가 크다.
왜 지금 이 카테고리를 여는가
두 신호가 8주 안에 겹쳤다.
첫째, 닫힌 프런티어의 접근권이 벤더 것이 아니라는 게 실증됐다. Claude Fable 5는 출시 사흘 만에 미 정부 export-control 지시로 접근이 끊겼다(2026-06-12). 07-01에 해제됐지만, 스위치를 쥔 쪽이 벤더가 아니었다는 사실은 남는다.
둘째, 능력 격차가 도입을 막을 수준이 아니게 됐다. AA 지능 지수 톱6에 이 카테고리가 셋이고, Grok 4.6(3위)·Kimi K3(4위)가 GPT-5.6 Sol(5위)보다 위다. models 표가 닫힌 셋만 줄세우던 전제가 깨진 자리다.
결론
도입 질문은 "빅3 바깥이 쓸 만한가"가 아니다. 그 질문은 2026년 여름에 닫혔다. 남은 질문은 넷이다.
- 접근이 끊기면 감당되나 — 안 되면 열린 셋에서 고른다. 시차 개방(Grok)은 지금 닫힌 것과 같게 취급한다.
- 라이선스를 어디까지 감당하나 — MIT면 검토가 끝난다(GLM). 자체 라이선스면 조항을 직접 읽어야 한다(Kimi·Qwen).
- 받는 체크포인트가 벤치의 그 모델인가 — modality·컨텍스트를 모델 카드에서 확인한다. Qwen3.8-Max는 다르다.
- 비용을 태스크당으로 계산했나 — 토큰 단가가 아니라 태스크당이다. GLM $0.32, Kimi K3 $0.94.
출처
- AA Intelligence Index 2026 스냅샷 (2026-08-15, 177개 모델)
- Artificial Analysis — Kimi K3가 지능 지수 3위 (가격·태스크당 비용)
- Artificial Analysis — GLM-5.2가 오픈웨이트 지능 지수 1위 (2026-06 시점)
- Qwen/Qwen3.8-2.4T-A95B 모델 카드 (Hugging Face) (라이선스·컨텍스트·모달리티)
- MoonshotAI/Kimi-K3 (아키텍처·가중치 공개)
- xAI — Open Release of Grok-1 · TechCrunch — Grok 2.5 공개 (시차 개방 관행과 그 라이선스)