중국 AI 기업 스텝펀이 새로운 대형 언어모델 스텝5 프리뷰를 개발자 플랫폼 오픈라우터에 공식 등재했습니다. 이 모델은 총 파라미터 600B에 달하는 대규모 구조를 채택했지만 실제 추론 시에는 27B만 활성화되는 희소 Mixture-ofExperts 방식을 적용해 효율성을 높였습니다.
가장 눈에 띄는 특징은 100만 토큰에 이르는 방대한 컨텍스트 윈도우입니다. 최대 출력 길이는 64,000 토큰으로 설정되어 긴 문서나 복잡한 코드베이스를 한 번에 다루는 데 유리합니다. 가격 정책은 입력 토큰당 백만 개 기준 1달러, 출력 토큰당 백만 개 기준 2.70달러로 책정됐습니다.
스텝5 프리뷰는 단순한 텍스트 생성을 넘어 에이전트형 작업 수행에 초점을 맞췄습니다. 소프트웨어 엔지니어링과 전문 지식 업무에서 강점을 보이도록 설계되었으며 특히 금융 데이터 분석 분야에서 높은 성능을 기록하고 있습니다. 여러 단계를 거쳐 결과를 정제하고 도구를 활용하는 확장된 태스크 처리에 최적화되었습니다.
오픈라우터 페이지 정보에 따르면 현재 이 모델은 단일 프로바이더가 호스팅하고 있습니다. 요청 라우팅 결정 없이 직접 전달되는 구조이며 캐싱 및 할인 정책을 통해 실제 지불 비용은 표기된 가격보다 낮아질 수 있는 여지가 있습니다. 응답 속도와 지연 시간 지표도 함께 제공되고 있습니다.
기술 커뮤니티 반응은 기대와 현실적 제약 사이에서 갈리고 있습니다. 일부 사용자는 이전 버전인 스텝3.5 플래시 모델을 로컬 환경에서 성공적으로 구동했던 경험을 바탕으로 신버전에 관심을 보였습니다. 하지만 600B라는 거대한 총 파라미터 규모 때문에 개인용 워크스테이션이나 제한된 메모리 환경에서는 실행이 불가능하다는 지적도 나옵니다.
비교 대상으로는 젬마 3.8 플래시 등이 언급되지만 벤치마크 결과 공개 의무화에 대한 불만 섞인 목소리도 존재합니다. 사용자가 직접 성능을 검증하기 전까지는 신뢰성 확보가 어렵다는 시각입니다. 다만 클라우드 API를 통한 접근성은 확보된 상태입니다.
현재로서는 로컬 배포보다는 클라우드 기반 서비스 이용이 주된 경로입니다. 모델의 구체적인 벤치마크 수치나 타 경쟁사 대비 우위 점은 아직 명확히 정리되지 않았습니다. 추가적인 성능 테스트 결과가 나오기 전까지는 에이전트 작업이나 대용량 문서 처리 용도로의 실사용 사례가 쌓이는 것을 지켜볼 필요가 있습니다.
