OpenAI发布新旗舰图像模型:ChatGPT Images与GPT Image 1.5同步推出
OpenAI于2025年12月16日发布新版ChatGPT Images,并称其由新的旗舰图像生成模型驱动,重点提升指令遵循、编辑精度与细节保留能力,同时将生成速度提升至最高4倍。官方说明指出,新模型在对上传图片进行修改时更能“只改用户要求的部分”,尽量保持光影、构图与人物外观等关键细节一致。 此次...
OpenAI于2025年12月16日发布新版ChatGPT Images,并称其由新的旗舰图像生成模型驱动,重点提升指令遵循、编辑精度与细节保留能力,同时将生成速度提升至最高4倍。官方说明指出,新模型在对上传图片进行修改时更能“只改用户要求的部分”,尽量保持光影、构图与人物外观等关键细节一致。 此次...
Meta推出SAM Audio(SAM-Audio),定位为“统一式”音频分割与编辑AI模型,目标是在复杂混音中按提示隔离并编辑特定声音。典型用例包括:在乐队演出视频中单独提取吉他或人声、过滤户外交通噪声、从播客里去除狗叫等干扰音。 SAM Audio的交互方式强调“人类直觉式提示”,支持三类提示并...
美团LongCat团队在LongCat-Video代码库更新中宣布发布LongCat-Video-Avatar,并同步上线项目页与Hugging Face权重。该模型定位为“音频驱动”的人物视频生成方案,基于LongCat-Video架构,支持Audio-Text-to-Video(AT2V)、Au...
AWS在官方博客与“What's New”中介绍了Amazon Aurora与Kiro powers的集成,并强调Kiro powers支持在IDE内一键安装“能力包”。同时,Kiro powers市场页也新增由AWS提供的“Build AWS infrastructure with CDK and...
Manus AI宣布其Agent系统完成升级,并发布Manus 1.6与Manus 1.6 Max。官方介绍称,1.6 Max作为旗舰代理,在规划与问题求解架构上加强,双盲测试中用户满意度提升超过19.2%,并强调内部基准测试在复杂、多步骤任务上整体表现更好。社交平台常见的“内部基准提升19%”说法...
YouTube帮助中心的可用地区列表已包含“United States”,YouTube Create在美国可下载使用;同时,美国区App Store也已上架YouTube Create iPhone版本。该应用定位为YouTube官方移动剪辑工具,支持将成片直接发布到YouTube,面向Short...