ToolNavs 유용한 AI 도구 찾기
도구 제출 로그인
돌아가기 AI 정보
SiliconFlow, Hy4 미리보기 출시: 770B 오픈 소스 모델, 새로운 API 항목 추가

SiliconFlow, Hy4 미리보기 출시: 770B 오픈 소스 모델, 새로운 API 항목 추가

AI 정보 Admin 3 회 조회

2026년 9월 14일, SiliconFlow는 공식 계정을 통해 Hy4 프리뷰가 자사 플랫폼에 출시되었다고 발표했습니다. 이 모델은 텐센트의 훈위안 팀이 개발했으며, 총 약 7,700억 개의 파라미터, 토큰당 약 490억 개의 활성화 매개변수, 최대 100만 토큰의 컨텍스트를 지원하고, Apache 2.0 라이선스 하에 공개되어 있습니다. 참고로, Hy4 프리뷰는 그날 출시되지 않았습니다; 이 소식의 새로운 점은 서드파티 추론 플랫폼이 직접 접근 지점을 제공하여, 대규모 모델 가중치를 직접 배포하지 않을 개발자들이 시험 및 평가를 쉽게 할 수 있게 했다는 점입니다.

새로운 API 진입 지점이 어떻게 변하는지

총 7,700억 개의 파라미터 모델은 비디오 메모리, 병렬 스케줄링, 추론 연산에 대한 높은 기준을 요구합니다. 자가 구축 환경은 다중 카드 자원뿐만 아니라 가중치 로딩, 서비스 확장, 동시성 격리도 요구합니다. 플랫폼 호스팅은 이러한 작업을 API 호출로 변환하여, 팀이 소수의 실제 작업으로 코드 생성, 복잡한 분석, 긴 문서를 먼저 검증한 후 자체 구축 자원에 투자할지 결정할 수 있게 합니다. 하지만 SiliconFlow의 발표는 모든 시나리오를 아우르는 가격, 한계, 성능 약속을 동시에 제공하지 않았습니다; 마이그레이션 전에는 여전히 콘솔 내 실시간 모델 목록과 서비스 용어를 참조해야 합니다.

Hy4 미리보기 아키텍처의 하이라이트

  • 희소 활성화: 모델은 78개의 레이어, 256명의 라우팅 전문가, 1명의 공유 전문가를 포함하며, 매번 8명의 라우팅 전문가가 선정되어 단일 실행 계산 부하와 큰 매개변수 용량의 균형을 맞추는 것을 목표로 합니다.
  • 롱 컨텍스트: 공식 모델은 100만 토큰의 컨텍스트에 주석을 달고, Gated DSA, IndexCache 같은 메커니즘을 사용하여 긴 시퀀스 처리 부담을 줄입니다.
  • 오픈 라이선싱: Apache 2.0은 연구, 2차 개발, 기업 평가에 유용하지만, 실제 사용 시에는 모델 웨어하우스에 포함된 완전한 라이선스 문서와 관련 규정을 반드시 확인해야 합니다.

어떤 팀이 먼저 시도해볼 가치가 가장 좋을까요?

대규모 코드베이스를 이해하고, 여러 자료를 검색하며, 연구 보고서를 생성하거나, 복잡한 에이전트 워크플로우를 구축해야 하는 팀은 후보 풀에 포함시킬 수 있습니다. 시험 중에는 짧은 프롬프트만 제출하지 말고; 실제 긴 맥락 입력, 도구 호출, 구조화된 출력, 연속적인 다중 턴 작업을 포함하세요. 100만 개의 토큰은 사용 가능한 맥락 구성이며, 모델이 어떤 길이로든 핵심 정보를 정확히 찾을 것을 자동으로 보장하지는 않으며, 모든 입력이 동일한 주의 품질을 가진다는 의미도 아닙니다.

출입 전 네 번의 점검

  1. 플랫폼의 현재 모델 식별, 지역 가용성, 동시성 제한, 출력 제한을 확인하세요.
  2. 둔감화된 샘플을 사용해 데이터 보존, 로그 권한, 기업 준수 요구사항을 테스트하세요.
  3. 또한 첫 토큰 지연, 전체 응답 시간, 실패율, 각 성공적인 작업의 비용도 기록합니다.
  4. 명목상의 매개변수만 비교하는 것이 아니라, 답변 정확도와 수동 검토 시간을 평가하기 위한 유사한 모델을 대조군으로 준비하세요.

대부분의 팀에게 이번 출시의 가장 큰 의미는 '조달 전 검증'의 기준을 낮춘 것입니다. 이는 대형 모델의 비용 및 거버넌스 문제를 완전히 없애지는 않지만, 강력한 인프라 역량이 필요한 셀프 배포 옵션에서 벗어나 Hy4 프리뷰의 관리 테스트 경로를 더 가볍게 제공하는 것입니다.

추천 도구

더보기