leejk/ jk lee
Models: 프런티어 본체 모델 줄세우기

Landscape · 2026.08

Alternative Models — 닫힌 프런티어 바깥의 본체 모델

빅3 바깥 넷이 능력에서 프런티어 구간에 올라온 뒤, 진짜 분기는 개방의 조건과 가격으로 내려갔다

·
#models#open-weights#glm#kimi#qwen#grok#landscape

Claude·OpenAI·Google 바깥에서 본체 모델을 내놓는 랩들을 한 자리에 모은다. Kimi K3(Moonshot) · Qwen3.8-Max(Alibaba) · GLM 5.2(Z.ai) · Grok 4.6(xAI) 넷이 2026년 6~8월 사이 연달아 들어왔고, AA 지능 지수 기준으로 닫힌 프런티어와 같은 상위 구간에 올라왔다. 단정 하나 — 이 카테고리에서 도입 결정을 가르는 축은 벤치 점수가 아니라 개방의 조건이다. 그리고 개방은 열림과 닫힘의 이분법이 아니라 열림·시차 개방·닫힘 셋으로 갈린다. GLM은 MIT로 가장 깨끗하고, Kimi K3는 자체 라이선스지만 관대하며, Qwen3.8-Max는 공개 체크포인트가 API 모델보다 좁고, Grok 4.6은 지금 닫혀 있되 이전 세대를 뒤늦게 여는 관행이 있다.

TL;DR. 닫힌 프런티어(Claude·OpenAI·Google) 바깥에서 본체 모델을 내놓는 랩들의 자리. 2026년 6~8월에 넷이 연달아 들어왔다 — Kimi K3(Moonshot, 07-16) · Qwen3.8-Max(Alibaba, 08-03) · GLM 5.2(Z.ai, 06-14) · Grok 4.6(xAI, 08-12). 능력은 이미 같은 구간이다AA 지능 지수 톱6에 이 카테고리가 셋이고, 그중 둘이 GPT-5.6 Sol보다 위다. 단정 하나 — 분기는 벤치가 아니라 개방의 조건에서 일어나고, 그 조건은 열림·시차 개방·닫힘 셋으로 갈린다.

이 자리를 뭐라 부르나

정의models의 벤더 칸 중, 닫힌 프런티어 세 곳(Anthropic·OpenAI·Google)에 속하지 않는 본체 모델들의 묶음. 가중치 공개 여부가 아니라 벤더가 기준이다Grok 4.6은 가중치가 닫혀 있지만 여기 들어온다. 개방은 진입 조건이 아니라 이 카테고리 안에서 모델을 가르는 축이다.

벤더별로 나누지 않고 한 칸에 모으는 이유 — 랩이 넷인데 벤더 페이지를 넷 만들면 각 칸에 모델이 하나씩 남는다. 이들을 실제로 비교하는 축은 벤더가 아니라 개방의 조건과 가격이라, 한 자리에 놓고 줄세우는 편이 맞다.

스택

모델 개방 라이선스 AA 지능 지수 가격(입력/출력)
Kimi K3 Moonshot AI 열림 (07-27) Kimi K3 License (자체, 관대) 59.7 (전체 4위) $3 / $15
Qwen3.8-Max Alibaba 열림 (08-12) qwen3.8-max (자체, OSI 아님) 58.1 (전체 6위) 미확인
GLM 5.2 Z.ai (구 Zhipu) 열림 (06-14) MIT 톱10 밖 $1.4 / $4.4
Grok 4.6 xAI 시차 proprietary (이전 세대만 사후 공개) 60.9 (전체 3위) $2 / $6

AA 지능 지수는 2026-08-15 스냅샷 기준. AA 자체 기사(v4.1)의 Kimi K3 57·GLM 5.2 51과 지수 버전이 달라 세대 간 비교에는 쓰지 않는다. 넷 중 셋이 전체 톱6 안에 있고, Grok 4.6은 3위이면서 이 표에서 가장 싸다.

네 모델의 강약은 각 단독 글에서 1차 출처로 받친다.

  • Grok 4.6 — 종합 3위를 유지하며 프런티어 구간에서 가장 싸다(출력 $6). 단 가중치가 닫혀 있고 컨텍스트가 500K로 절반이다.
  • Kimi K3 — 2.8T MoE·1M 컨텍스트·네이티브 비전. 열린 것 중 능력이 가장 높고 공개 가중치 중 가장 크다. 대신 열린 셋 중 가장 비싸다.
  • Qwen3.8-Max — 2.4T MoE로 Max 티어를 처음 열었다. 단 공개 체크포인트가 API 모델과 다르다.
  • GLM 5.2 — 능력은 아래지만 MIT에 가장 싸다. 라이선스 리스크를 0으로 두고 싶으면 여전히 이 자리.

진짜 갈림은 능력이 아니라 개방의 조건

데모는 넷 다 된다. 도입에서 갈리는 축은 셋이다.

축 1 — 개방은 이분법이 아니라 세 포지션이다. "열렸나 닫혔나"로 물으면 이 카테고리가 안 갈린다. 실제로는 셋이다.

포지션 모델 지금 받을 수 있나 도입 의미
열림 Kimi K3 · Qwen3.8-Max · GLM 5.2 받는다 접근 회수가 구조적으로 불가
시차 개방 Grok 4.6 못 받는다. 다음 세대 때 이전 세대가 열릴 수 있다 계획의 근거로 쓸 수 없다
닫힘 Claude · OpenAI · Google 안 열린다 벤더·규제에 접근이 묶인다

가운데 항이 중요하다. xAI는 Grok-1을 2024-03에 Apache 2.0으로, Grok 2 계열을 2025년에 열었다 — 관행은 실재한다. 그러나 일정을 벤더가 정하고, 열렸을 때 라이선스가 OSI 표준이 아니었다(2025-08 Grok 2.5는 반경쟁 조항 포함 자체 라이선스). 언젠가 열린다는 도입 계획의 근거가 못 된다.

축 2 — 열린 셋 안에서도 라이선스가 세 갈래로 벌어진다. 오픈웨이트가 한 덩어리라는 전제가 여기서 깨진다. GLM 5.2는 MIT다(HF 카드) — 표준 OSI라 법무 검토가 사실상 끝나 있다. Kimi K3는 Kimi K3 License로, 수정 MIT 계열의 관대한 자체 라이선스지만 OSI 승인은 아니다. Qwen3.8-Max는 qwen3.8-max 라는 자체 라이선스를 달았다(HF 카드). 셋 다 가중치를 받을 수 있지만, 받아서 무엇을 할 수 있는가는 같지 않다. 기업 도입에서는 이 축이 벤치 3점 차이보다 먼저 걸린다.

축 3 — 공개 체크포인트가 API 모델과 같은 물건이 아니다. Qwen3.8-Max가 이 축을 드러냈다. API의 Qwen3.8-Max는 텍스트·이미지·영상 입력에 1M 컨텍스트로 소개됐는데, 실제 공개된 Qwen/Qwen3.8-2.4T-A95B 카드는 텍스트 전용이고("Multimodal inputs are not supported"), 컨텍스트도 네이티브 262,144에 확장 시 ~1,010,000이다. 즉 벤치를 보고 고른 모델과 다운로드한 모델이 같지 않을 수 있다. 가중치 공개 여부만 보고 "같은 걸 받는다"고 읽으면 틀린다 — 모델 카드의 modality·컨텍스트를 API 스펙과 대조하는 게 이 카테고리의 필수 절차가 됐다.

가격이 두 번째 본체 축이다

능력이 수렴하면 남는 건 가격인데, 이 카테고리가 그 축을 가져갔다. models 표에서 종합 상위 넷의 출력 단가를 나란히 놓으면 갈린다 — Fable 5 $50, Opus 5 $25, Kimi K3 $15, Grok 4.6 $6. 종합 3위 모델의 출력가가 1위의 1/4이고, GLM 5.2는 $4.4로 그보다도 싸다.

토큰 단가가 아니라 태스크당 비용으로 재야 한다. GLM 5.2는 verbose해서 AA 기준 태스크당 $0.32, Kimi K3는 $0.94다 — 토큰 단가 차이(약 2배)보다 태스크당 차이(약 3배)가 크다.

왜 지금 이 카테고리를 여는가

두 신호가 8주 안에 겹쳤다.

첫째, 닫힌 프런티어의 접근권이 벤더 것이 아니라는 게 실증됐다. Claude Fable 5는 출시 사흘 만에 미 정부 export-control 지시로 접근이 끊겼다(2026-06-12). 07-01에 해제됐지만, 스위치를 쥔 쪽이 벤더가 아니었다는 사실은 남는다.

둘째, 능력 격차가 도입을 막을 수준이 아니게 됐다. AA 지능 지수 톱6에 이 카테고리가 셋이고, Grok 4.6(3위)·Kimi K3(4위)가 GPT-5.6 Sol(5위)보다 위다. models 표가 닫힌 셋만 줄세우던 전제가 깨진 자리다.

결론

도입 질문은 "빅3 바깥이 쓸 만한가"가 아니다. 그 질문은 2026년 여름에 닫혔다. 남은 질문은 넷이다.

  1. 접근이 끊기면 감당되나 — 안 되면 열린 셋에서 고른다. 시차 개방(Grok)은 지금 닫힌 것과 같게 취급한다.
  2. 라이선스를 어디까지 감당하나 — MIT면 검토가 끝난다(GLM). 자체 라이선스면 조항을 직접 읽어야 한다(Kimi·Qwen).
  3. 받는 체크포인트가 벤치의 그 모델인가 — modality·컨텍스트를 모델 카드에서 확인한다. Qwen3.8-Max는 다르다.
  4. 비용을 태스크당으로 계산했나 — 토큰 단가가 아니라 태스크당이다. GLM $0.32, Kimi K3 $0.94.

출처

관련 글

하위 문서