ToolNavs 发现实用AI工具
提交工具 登录
返回AI资讯
SiliconFlow上线Hy4 preview:770B开源模型新增API入口

SiliconFlow上线Hy4 preview:770B开源模型新增API入口

AI资讯 Admin 3 次浏览

2026年9月14日,SiliconFlow通过官方账号宣布Hy4 preview已在其平台上线。该模型由腾讯混元团队开发,总参数约7700亿、每个token激活约490亿,支持最长100万token上下文,并以Apache 2.0许可证开放。需要区分的是,Hy4 preview并非当天首次发布;本次新闻的新增点是第三方推理平台提供了可直接调用的入口,让不准备自行部署超大模型权重的开发者更容易进行试用和评估。

新增API入口改变了什么

7700亿总参数模型对显存、并行调度和推理运维要求很高,自建环境不仅要准备多卡资源,还要处理权重加载、服务扩缩容与并发隔离。平台托管把这些工作转化为API调用,团队可以先用少量真实任务验证代码生成、复杂分析和长文档研究效果,再决定是否投入自建资源。不过,SiliconFlow此次公告没有同时给出足以覆盖所有场景的价格、限额和性能承诺,迁移前仍应以控制台中的实时模型列表与服务条款为准。

Hy4 preview的架构看点

  • 稀疏激活:模型共有78层、256个路由专家和1个共享专家,每次选择8个路由专家,目标是在大参数容量与单次计算量之间取得平衡。
  • 长上下文:官方模型说明标注100万token上下文,并采用Gated DSA、IndexCache等机制降低长序列处理压力。
  • 开放许可:Apache 2.0有利于研究、二次开发和企业评估,但实际使用仍需检查模型仓库附带的完整许可文件与适用法规。

哪些团队最值得先试

需要理解大型代码库、跨多份材料检索、生成研究报告或构建复杂智能体工作流的团队,可以把它列入候选池。试用时不要只提交短提示词,应覆盖真实的长上下文输入、工具调用、结构化输出和连续多轮任务。100万token是可用上下文配置,并不自动保证模型能在任何长度上准确找到关键信息,也不代表全部输入都具有相同注意力质量。

接入前的四项检查

  1. 确认平台当前展示的模型标识、区域可用性、并发额度与输出上限。
  2. 使用脱敏样本测试数据留存、日志权限和企业合规要求。
  3. 同时记录首token延迟、完整响应时间、失败率及每项成功任务成本。
  4. 准备一个同类模型作为对照,评估答案正确率和人工复核时间,而不是只比较标称参数。

对多数团队而言,这次上线最大的意义是降低“先验证再采购”的门槛。它不消除超大模型的成本与治理问题,却让Hy4 preview从需要较强基础设施能力的自部署选项,增加了一条更轻量的托管测试路径。

推荐工具

更多