·inference-docs.cerebras.ai
Cerebras, public API에 Qwen 3.8 27B 추가…128k context와 초당 1500 tokens 처리 지원
Cerebras가 public endpoints에서 Qwen 3.8 27B 모델을 제공하며, 유료 기준 최대 128k context와 약 1500 tokens/s 속도를 지원합니다. 해당 모델은 free trial 및 pay-as-you-go tiers에서 이용할 수 있으며, 더 높은 처리량과 production SLA는...
읽기 →