$ diff astra glm-5-3-flash
Astra vs GLM-5.3-Flash
값의 출처는 Astra와 GLM-5.3-Flash 문서이며, 각 항목에 원 출처가 인용돼 있습니다. 이 페이지는 벤치마크 결과를 제시하지 않고 두 모델의 우열도 가리지 않습니다 — 공개된 사양 두 개를 나란히 놓을 뿐입니다. 랩이 공개하지 않은 값은 추측하지 않고 미기재로 표시합니다.
실제로 무엇이 다른가
- 컨텍스트 창
- Astra가 1.1M, 상대는 1.0M — 한 번의 요청에 조금 더 넣을 수 있습니다.
- 입력 가격
- GLM-5.3-Flash가 $0.15/M, 상대는 $10/M — 입력 비용이 66.7배 저렴합니다. 표준 요금 기준입니다. 두 랩 중 한쪽은 더 낮은 캐시 입력 요금도 제시하지만, 이는 프리픽스를 재사용할 때만 적용됩니다 — 아래 전체 스펙을 참고하세요.
- 출력 가격
- GLM-5.3-Flash가 $0.5/M, 상대는 $50/M — 출력 비용이 100.0배 저렴합니다. 에이전트 작업에서는 모델이 읽는 양보다 쓰는 양이 훨씬 많아 출력 요금이 청구액을 좌우합니다.
- 가중치 공개
- GLM-5.3-Flash는 가중치를 공개합니다(MIT). Astra는 API로만 제공됩니다. 이 차이는 자체 호스팅·망분리 환경 배포·파인튜닝 가능 여부를 성능 논의보다 먼저 결정합니다.
- 출시 시점
- Astra가 GLM-5.3-Flash보다 8일 늦게 출시됐습니다 (2026-09-03 / 2026-08-26).
전체 스펙
| 항목 | Astra | GLM-5.3-Flash |
|---|---|---|
| 개발사 | OpenAI | Z.ai |
| 출시일 | 2026-09-03 | 2026-08-26 |
| 컨텍스트 창 | 1,050,000 tokens (128,000 max output) | 1,048,576 (1M) |
| 가격 | $10/M input · $50/M output | $0.15/M input · $0.03/M cached input · $0.50/M output |
| 라이선스 | proprietary | MIT |
| 이용 경로 | ChatGPT Plus, Pro, Business, Enterprise · OpenAI API · AWS — staged, see below | Hugging Face (open weights), Z.ai API |