v7.11.0 — AI Infra Sizing
v7.11.0 — 모델 카탈로그 업데이트 (Qwen3.8 27B)
이번 릴리스
사용자 요청으로 최신 LLM 모델 업데이트 여부를 조사했습니다. 결과를 요약하면:
- 신규 추가: Qwen3.8 27B(Alibaba, 2026-08-14 공개, Apache 2.0) — Gated DeltaNet 선형 어텐션과 게이트형 풀 어텐션을 3:1로 섞은 하이브리드 구조, 262K 토큰 네이티브 컨텍스트, 기본 활성화된 사고 모드가 특징입니다. Hugging Face 공식 저장소(
Qwen/Qwen3.8-27B)와 그 위에서 파생된 여러 양자화 저장소(ggml-org, unsloth, malekoo)로 실존을 교차 확인했습니다. - 기존 항목 재검증, 변경 없음: DeepSeek V4-Pro/V4-Flash, Qwen3.6 27B/35B A3B, GLM-5.2는 이미 실제 공개 스펙(파라미터·컨텍스트·라이선스)과 일치해 그대로 유지했습니다. DeepSeek V4-Pro의 2026-08-13 "V4-Pro-0813" GA 체크포인트는 스펙 변경이 없는 증분 업데이트로 확인해 별도 반영하지 않았습니다.
- 보류(추가하지 않음): Qwen3.8-2.4T-A95B(Qwen3.8 Max의 오픈 MoE 변형)는 출처마다 공개일이 8/2·8/12로 엇갈리고 커스텀 라이선스 조건도 불명확해 이번엔 제외했습니다. "GLM-5.2 Turbo"로 불리는 변형도 기존 GLM-5.2와 구분되는 확정 스펙을 찾지 못해 추가하지 않았습니다. 둘 다 다음 조사 때 재확인 대상입니다.
- 데이터 정합성 수정: 신규 추가한 Qwen3.8 27B 항목에 다른 모든 모델과 달리
data/model-metadata.js의 출처(releaseDate/sourceUrl) 레코드가 누락돼 있던 것을 데이터 감사에서 발견해 채웠습니다.
점검 결과 (변경 없음 확인)
이번 릴리스를 준비하며 전체 상태도 점검했습니다: GitHub Actions(CI·Data health·Pages·Release) 전부 정상, 열린 이슈 없음, npm audit 취약점 0건, 의존성 업데이트 필요 없음, 국내 GPU 시세 67종 전부 25일 이내 최신, 파일 용량 예산 전부 여유 있음.
모든 모델 스펙과 벤치마크 수치는 참고용이며, 실제 배포 전 공급사·모델 카드 재확인이 필요합니다.