Z.ai 上线 GLM-4.6V 视觉推理模型,提供原生函数调用与免费 Flash 版
Zhipu 旗下平台 Z.ai 宣布上线 GLM-4.6V 系列视觉语言模型,包括参数规模为 106B、面向云端与高性能集群场景的 GLM-4.6V,以及面向本地与低时延场景的轻量版 GLM-4.6V-Flash。官方介绍称,GLM-4.6V 在训练中支持最长 128K token 上下文,可同时处...
Zhipu 旗下平台 Z.ai 宣布上线 GLM-4.6V 系列视觉语言模型,包括参数规模为 106B、面向云端与高性能集群场景的 GLM-4.6V,以及面向本地与低时延场景的轻量版 GLM-4.6V-Flash。官方介绍称,GLM-4.6V 在训练中支持最长 128K token 上下文,可同时处...
阿里巴巴通义团队发布新版本语音合成模型 Qwen3-TTS(2025-11-27),重点围绕音色丰富度、多语种与自然度进行了全面升级。官方称,本次版本提供超过 49 种高质量音色,从活泼可爱到稳重严肃,覆盖多类应用场景,用户可按需求选择更贴合品牌与内容气质的声音。 在语言与方言支持方面,新版 Qwe...
The Verge 援引知情人士报道称,在 CEO Sam Altman 将当前局面定性为“code red”后,OpenAI 正准备于下周发布 GPT-5.2,将其视为对 Google Gemini 3 的首轮正面回应。文章称,GPT-5.2 已基本准备就绪,内部目标发布日期为 12 月 9 日,...
腾讯混元团队宣布最新版语言模型 Tencent HY 2.0 正式发布,并通过腾讯云 API 面向开发者和企业开放。此次升级采用混合专家(MoE)架构,总参数规模 4060 亿、激活参数 320 亿,支持最长 256K 上下文窗口,相比上一代模型在数学推理、代码生成与复杂任务执行方面均有明显提升。官...
Kling 在 Omni Launch Week 最后一日正式公布 Element Library 功能,定位为构建“超高一致性元素”的核心工具。用户可通过多角度图片为角色、物体和背景建立元素库,Kling O1 在视频生成和镜头运动过程中会持续引用这些元素信息,从而在不同镜头、光线和场景变化下保持...
OpenAI Cookbook 近日上线《GPT-5.1-Codex-Max Prompting Guide》,系统整理该模型在代理与开发者工具场景下的提示设计范式。文档将 Codex-Max 定位为“智能体式编码”模型,强调通过精细的 system 提示与工具约定,引导其在真实代码库中执行多步修改...